top of page

NVIDIA CoreWeave Vera Rubinが本番稼働へ、しかしエージェント経済性には真の試練

7 日前
読了時間: 20分

NVIDIAとCoreWeaveはVera Rubinを本番環境へ移行し、Cognitionは従来システム比で最大4.8倍の推論スループットを報告した。NVIDIA CoreWeave Vera Rubinの導入は、ハードウェアのローンチをエージェント型AIの経済性に関する実地検証へと変える。トークン生成の高速化は重要だが、エージェントが有用な作業を確実に完了できる場合に限られる。

コーディングエージェントDevinを手がけるCognitionは、CoreWeaveのVera Rubin NVL72システムで本番ワークロードを稼働させた最初の顧客となった。同社はラック引き渡しから数日以内にインフラの利用を開始した。この短い移行期間は、単一のクラウドプラットフォームが複数世代のNVIDIA製品にまたがり、トレーニング、強化学習、推論を支援できるというCoreWeaveの主張の中核を成す。

この発表は、専門特化型AIクラウドとAWS、Microsoft Azure、Google Cloud、Oracle Cloud Infrastructureといったハイパースケーラーの競争も鮮明にする。CoreWeaveは、新しいNVIDIAシステムをより速く採用することで、より大規模な事業者が持つリーチや幅広いサービス群を補えると見込む。ベンチマーク上の向上が実際のワークロード、需要拡大、そして高密度AIインフラの運用経済性の下でも維持されるかは、なお未解決の問題だ。

NVIDIA CoreWeave Vera Rubinが実際の顧客に提供開始

重要なのはVera Rubinが存在することではなく、顧客が本番のエージェントワークロードに利用していることだ。

CoreWeaveは、サンフランシスコで開催したFully Connectedカンファレンスにおいて、2026年9月30日にVera Rubin NVL72の限定提供を発表した。同社によれば、複数のリージョンに数百基のRubin GPUが導入されている。Cognitionは、このプラットフォーム上で本番のエージェント型ワークロードを実行する最初の実名顧客だ。

Vera Rubin NVL72ラックは、72基のRubin GPUと36基のVera CPUを組み合わせる。NVLink 6がプロセッサを接続し、ラックを統合コンピューティングシステムとして動作させる。この設計では、ConnectX-9ネットワークアダプターとBlueField-4データ処理ユニットも利用される。

CoreWeaveはこれらのラックを、NVIDIA Spectrum-Xの102.4テラビットEthernetネットワークと組み合わせている。このスケールアウトネットワークは、トレーニング、推論、ストレージ、エージェントツールによって発生するトラフィックを管理しながら、複数のラックを接続する。CoreWeaveは顧客提供を発表する以前に、数百基のRubin GPUを含むクラスターをすでに立ち上げていた。

Cognitionは、このローンチに標準的なチャットボットより厳しいテストケースをもたらす。Devinはソフトウェアリポジトリ全体で作業し、コードの生成・実行、結果の評価、アプローチの修正を行う。各タスクでは、多数の相互依存するモデル呼び出しが必要になり、後続のステップは先行ステップの完了を待つ場合がある。

この依存関係により、レイテンシーは累積する。単一のモデル応答の時間を短縮しても、それだけでは価値は限定的だ。推論、検索、実行、評価という数十から数百のステップ全体で時間を短縮できれば、エージェントがタスクを完了する速度を大きく変え得る。

Cognitionによると、新システムはNVIDIA GB200 NVL72をベースラインとして比較された。同社のエンジニアは、自律型ソフトウェアエンジニアリングタスクを表すSWE-2推論ワークロードを使用した。同等のインタラクティビティ条件において、CognitionはGPU当たりの総トークンスループットが最大4.8倍になったと測定した。

同社はまた、強化学習時のGPU当たり出力トークンスループットが3.8倍になったと報告した。これらの数値は顧客側で実施されたテストによるものだが、参加企業は方法論と結果を公開している。他の顧客やエージェントカテゴリーにわたり、独立して再現されたものではない。

CoreWeaveの詳細な本番ベンチマークによれば、Cognitionはアクセスを受けてから数日以内にワークロードの実行を開始した。この移行時間は、顧客が運用環境を再構築せずに新世代GPUを採用できるという第二の主張を裏付ける。

この導入は、CoreWeaveの既存GB200およびGB300フリートに使用されているものと同じ一般的なツール群の下で稼働する。顧客は、世代をまたいで同社のKubernetes、推論、ストレージ、インフラ管理サービスを利用できる。この一貫性が重要なのは、ラックの展開が本番稼働への到達における最初の一部にすぎないためだ。

システムはファームウェア、ネットワーク、冷却、ストレージ、スケジューリング、可観測性、障害、セキュリティも処理しなければならない。CoreWeaveは、顧客にこれらのコンポーネントを一つのマネージドプラットフォームとして体験してもらうことを目指す。これが、NVIDIAのシリコンとCognitionのアプリケーションを結ぶ運用上の橋渡しとなる。

当初の発表では、より広範な製品方針も示された。CoreWeaveはスタンドアロンのNVIDIA Vera CPU容量を提供する計画で、モデルとエージェントのトレーニング、評価、改善を行う環境であるCoreWeave Forgeも立ち上げた。これらの製品は、クラウドを単にGPUを借りる場所ではなく、継続的な開発システムとして位置付けている。

エージェント型AIがインフラのボトルネックを変える理由

エージェント型AIでは、性能に関する問いが、モデルがどれだけ速く答えるかから、依存関係のある行動連鎖全体をどれだけ効率的に完了できるかへと移る。

従来の推論リクエストでは通常、入力をモデルに送信し、出力を返す。エージェントはファイルを取得し、ツールを呼び出し、コードを実行し、結果を確認して再試行することがある。各サイクルはトークンを消費し、プロセッサ、メモリ、ストレージ、外部サービスの間でデータを移動させる。

長大なコンテキストも、さらなる負荷要因となる。コーディングエージェントは、リポジトリ内のファイル、タスク指示、過去の行動、テスト結果、ツール出力を作業コンテキストに必要とする場合がある。この情報は、生成中に再利用する中間注意データを保存するメモリ構造であるキー・バリューキャッシュを生み出す。

コンテキストと同時セッションが増えると、このキャッシュはより多くの高帯域幅メモリを消費する。GPU、CPU、ストレージ間で移動させると遅延が発生し得る。そのため、周辺のネットワークおよびストレージシステムが十分にデータを供給できなければ、高速なアクセラレーターの恩恵は限定される。

CoreWeaveの戦略は、こうした制約を一つのシステムとして対処することだ。同社のマルチラック設計は、Spectrum-X Ethernetを使用して数百基のRubin GPUを接続する。同社によれば、各Rubin GPUには毎秒1.6テラビットのスケールアウト接続が提供される。

同社はまた、頻繁にアクセスされるデータをコンピュートの近くに保持するため、ローカルキャッシュを利用する。クロスリージョン書き込み高速化により、レプリケーションをバックグラウンドで継続しながら、ワークロードはローカルに書き込める。エージェントにとっては、中間状態や生成した成果物が、遠隔地のストレージ処理を常に待つ必要がないことを意味する。

同社のマルチラック導入では、ファームウェア、ネットワーク、電力、液冷、ストレージ、ソフトウェアにわたる検証が説明されている。ラックは、コンポーネント診断とラック全体のワークロードテストに合格して初めて本番環境に投入される。このプロセスは、本番提供がチップ発表より遅れる理由を示している。

NVIDIAは同じ全体システムの問題に向けてVera Rubinを設計した。そのNVL72構成では、NVLink 6でプロセッサを接続し、InfiniBandまたはSpectrum-X Ethernetでラックを接続する。NVIDIAは、指定されたワークロードでBlackwell比最大10倍の電力当たり推論スループットを実現できるとしている。

同社はまた、特定のジョブにおいてトークンコストを10分の1、GPU数を4分の1にできると主張する。これらはプラットフォームレベルの予測であり、普遍的な結果ではない。モデルサイズ、精度、バッチサイズ、レイテンシー目標、ソフトウェア最適化、稼働率、電力コストが結果を左右する。

Cognitionの結果は、より限定的で有用だ。同社は同等のインタラクティビティ条件で、実際のソフトウェアエンジニアリングワークロードをテストした。4.8倍という数値は依然としてベンダー関連のベンチマークだが、ハードウェアスループットと認識しやすいアプリケーションを結び始めている。

それでも、総トークンスループットはタスク完了を意味しない。エージェントは、より多くの問題を解決せずに多くのトークンを生成できる。また、誤りをより速く繰り返したり、非生産的な経路の探索に追加のコンピュートを費やしたりすることもある。

より意味のある指標は、時間、エネルギー、コスト当たりの完了作業量だ。コーディングエージェントの場合、これには受け入れられたコード変更、合格したテスト、成功したリポジトリタスク、人間による修正の必要量が含まれる。これらの指標は、Vera Rubinの性能が単に活動量を増やすだけでなく、製品を改善するかどうかを明らかにするだろう。

この違いは、企業の購入者にとって重要だ。インフラチームは容量を購入するが、アプリケーションチームは信頼できる成果を必要としている。高速な推論の価値は、調査のループを短縮するか、より多くの同時ユーザーを支えられるか、あるいは成功するタスク1件当たりのコストを削減できるかに左右される。

CoreWeaveのエージェント型AIはハードウェアへのアクセスをクラウド戦略へ変える

CoreWeaveは、新しいNVIDIAシステムへの早期アクセスを、はるかに大きな顧客基盤とソフトウェアの存在感を持つクラウドに対する競争戦略として活用している。

CoreWeaveとNVIDIAの関係は、Volta世代と2017年までさかのぼる。同社によれば、V100 GPUは約10年後の現在も顧客ワークロードを支えている。同時に、Vera Rubinの容量をプラットフォームの商用サイクル初期に本番環境へ投入している。

この重なりは財務面で重要だ。AIアクセラレーターには多額の先行投資が必要となる。クラウド事業者は、新しいアーキテクチャが登場した後も旧システムが有用であり続ける場合、より高い収益を得られる。

すべてのワークロードが最新のアクセラレーターを必要とするわけではない。開発、小規模モデル、データ準備、レイテンシーへの感度が低い推論は、以前の世代で実行できる。その後、新しいラックを、追加のメモリ帯域幅、ネットワーク、エネルギー効率から最も恩恵を受けるジョブに割り当てられる。

CoreWeaveは、この割り当てを世代横断の代替可能性として提示している。顧客は一つのソフトウェア環境を利用し、事業者は各ワークロードを適切なハードウェアに割り当てる。原理上、このアプローチにより、アーキテクチャ移行によってすべての顧客が一斉に移行を強いられることを防げる。

この主張は、専門特化型AIクラウドをめぐる根強いリスクにも答える。NVIDIAがより高速な世代を投入すると、その物理資産の競争力が低下する可能性がある。V100、Hopper、Blackwell、Rubinシステムの生産性を維持できれば、資産寿命を延ばし、フリート全体を直ちに置き換える圧力を抑えられる。

CoreWeaveのソフトウェアレイヤーは、それを可能にするよう設計されている。Mission Controlはインフラの健全性とライフサイクル運用を管理する。同社のKubernetesサービスはコンテナ化されたワークロードをスケジューリングし、推論プラットフォームとストレージサービスはアプリケーション提供を支援する。

同社はまた、高密度液冷ラック向けのハードウェア管理コンポーネントも構築している。Valveyは冷却流量を制御し、障害やメンテナンス時にラックを隔離できる。Rackyはラックレベルの制御を調整し、ライフサイクルソフトウェアは検出、ファームウェア更新、検証、電力、冷却を扱う。

これらのコンポーネントは、CoreWeaveをNVIDIAから独立させるものではない。NVIDIAへの依存を、より深くエンジニアリングされたものにする。この依存は、CoreWeaveが新システムを早期に受け取る際には利点を生むが、技術面とサプライチェーン面のエクスポージャーも集中させる。

ハイパースケーラーは異なるトレードオフに直面する。AWS、Microsoft Azure、Google Cloud、Oracle Cloud Infrastructureは、AIコンピュートをデータベース、セキュリティサービス、アイデンティティシステム、グローバルネットワーク、確立された企業契約と組み合わせられる。一部は独自のアクセラレーターも開発している。

NVIDIAは、CoreWeave、Crusoe、Lambda、Nebius、Nscale、Together AIと並んで、これらのハイパースケーラーをVera Rubinのパートナーに指名している。そのため、プラットフォームのローンチはCoreWeaveに恒久的な独占権を与えるものではない。同社に、専門性によってより迅速な導入と高い利用効率を実現できることを示す機会を与えるものだ。

両社によれば、Cognitionが急速にオンボーディングを進めたことは、その主張を裏付ける証拠となる。Cognitionは9カ月未満でCoreWeave上のGPUを数千基規模へ拡大した。現在では、トレーニング、強化学習、本番推論を同じプロバイダー経由で実行している。

この統合により、研究と本番運用の間にある摩擦を減らせる可能性がある。ある環境でトレーニングしたモデルを、ユーザーに提供する前に別のクラウドアーキテクチャへ移す必要がなくなるからだ。パフォーマンスエンジニアは、基盤となるクラスタを直接理解したうえで推論を最適化することもできる。

ただし、この集中には乗り換えコストが伴う。トレーニングデータ、モデルワークフロー、評価システム、本番推論を一つの専門クラウドに置く顧客は、その可用性と運用モデルに縛られる。より高速な反復は、その依存関係を補うだけの価値を生み出さなければならない。

したがって、競争は単純なCoreWeave対AWSまたはAzureではない。専門性対幅広さの戦いである。CoreWeaveは、NVIDIAの各世代を運用に載せる能力が、大手クラウドの広範な到達力、調達面での親しみやすさ、サービスの多様性を上回る価値を生むことを示す必要がある。

Vera Rubinの性能だけでは経済性は決まらない

このベンチマークはCoreWeaveのエンジニアリング上の主張を支えるが、利用率、資金調達、需要、顧客集中のリスクを解決するものではない。

Cognitionのテストは、ソフトウェアエンジニアリングのワークロード群においてVera Rubin NVL72とGB200 NVL72を比較している。報告された向上幅は大きいが、すべてのモデル、レイテンシー目標、バッチサイズ、エージェント設計で同じ優位性が得られることを示すものではない。

比較はGPU当たりのスループットにも焦点を当てている。購入者が必要とするのは、ネットワーク、ストレージ、CPU環境、ソフトウェア、電力、予約容量を含めた、完了タスク当たりの総コストだ。高価なハードウェアが遊休状態にあれば、高スループットでも魅力的な経済性は生まれない。

エージェント型ワークロードでは、利用率が特に重要になる。ユーザーがタスクを起動したり、エージェントがツールを呼び出したり、研究チームが実験を実行したりすると、需要は突発的に発生し得る。プロバイダーはピークを吸収できるだけの余剰容量を確保しつつ、閑散時に使われないインフラを過剰に抱えないようにする必要がある。

CoreWeaveは、既存のGPU世代も商業的に生産性を維持していると述べている。ワークロードごとに要件が異なるため、この主張には妥当性がある。ただし、継続的な裏付けが必要だ。旧世代アクセラレーターの有用寿命は、ソフトウェアサポート、エネルギー効率、顧客需要、世代間の価格差に左右される。

同社の財務開示は、より広い観点からの注意を促している。CoreWeaveは、重要なリスクとして多額の債務、拡大する資本需要、顧客集中、限られた数のサプライヤーへの依存を挙げている。これらの要因は、収益に先行して高価なインフラを取得する事業に内在するものだ。

2026年6月の四半期提出書類では、新たに31億ドルの遅延引出型タームローン枠を説明している。また、債務によって資本調達、市場変化への対応、事業資金の確保が制約される可能性があると警告している。これらの開示は事業運営の進展を否定するものではないが、その進展が満たすべき基準を定義している。

CoreWeaveのリスク開示では、事業運営の履歴が限られているため、トレンドの評価が難しいことも指摘されている。インフラ支出、利息費用、顧客への義務が同時に拡大すれば、急成長と財務上の負担は共存し得る。

新しいハードウェアが方程式を改善するのは、顧客がそれを魅力的な料金水準で利用する場合に限られる。スループットが4.8倍になれば、同じGPU数でより多くのエージェントセッションを支えられる可能性がある。一方で、顧客が利用可能な容量を消費する、より大規模なワークロードを実行するきっかけにもなり得る。

どちらの効果が優勢になるかは、需要の価格弾力性に左右される。推論が安価になると、開発者はコンテキストの追加、評価、並列試行、より長い推論を通じて利用量を増やすことが多い。単位コストの低下が、総支出を自動的に減らすわけではない。

NVIDIAとCoreWeaveの関係には循環的な側面もある。NVIDIAは中核プロセッサを供給し、プラットフォームを支援し、CoreWeaveに投資持分を持ち、クラウドプロバイダーの容量拡大から利益を得る。CoreWeaveは早期アクセスと共同エンジニアリングから恩恵を受ける。

この連携は導入を加速し得る。同時に、独立した市場需要と、緊密な商業関係に支えられた成長を切り分けることを難しくする可能性もある。投資家と顧客は、すでにパートナーと深く結び付いた企業以外への幅広い採用を注視すべきだろう。

競争は別の試練をもたらす。ハイパースケーラーや他のNVIDIAクラウドパートナーがVera Rubinを大規模に提供し始めれば、早期アクセスの差別化は弱まる。CoreWeaveは、信頼性、利用率、エンジニアリング支援、ネットワーク、ストレージ、ワークロードを本番へ移行する速度で競争する必要がある。

カスタムアクセラレーターは別の方向から圧力を加える。AWS、Google、Microsoftは、特定のモデルにおいてより優れた経済性を提供できる場合、とりわけ一部のワークロードを自社チップへ誘導できる。CoreWeaveはNVIDIAのアーキテクチャとリリースサイクルにより密接に連動している。

これらのリスクはいずれもCognitionの結果を無効にするものではない。一つの強力なベンチマークだけで事業性を判断できない理由を説明している。本番での成功には、再現可能な顧客成果、高い利用率、持続的な需要、資金調達費用と運用費用を上回る収益が求められる。

より高速なトークンが開発者とエンタープライズ購入者に意味すること

開発者はこのローンチを、インフラの存在感が薄れつつある証拠として捉えるべきであり、エージェントの信頼性が解決済みである証拠と見なすべきではない。

AIアプリケーションチームにとって、当面の利点は反復の短縮だ。トレーニング、強化学習、評価、推論を一つのプラットフォームで実行できる。エンジニアはモデルを調整し、エージェントタスクに対してテストし、大規模なデータセットを無関係な環境間で移動させることなくデプロイできる。

Cognitionは、このワークフローを具体的に示している。同社のチームは、Devinモデルをトレーニングし、強化学習を実行し、実験を追跡し、推論を調整し、本番リクエストをCoreWeave経由で提供している。Vera Rubinは、顧客主導の個別立ち上げプロセスを必要とせずに、容量とスループットを追加する。

こうした継続性により、実験からデプロイ済み機能に至るまでの道のりを短縮できる可能性がある。また、インフラエンジニアは、アプリケーションで使われる同じ本番ワークロードに対して、キャッシュ管理、サービングパラメータ、ランタイムの挙動を調整できる。

それでもエンタープライズ購入者は、三つの問いを分けて考えるべきだ。第一に、プロバイダーはハードウェアを提供できるか。第二に、プラットフォームはそれを信頼性高く稼働させられるか。第三に、顧客のアプリケーションは、その容量を正当化できるだけの追加価値を生むか。

NVIDIA、CoreWeave、Vera Rubinに関する発表は、第三の問いよりも最初の二つに直接答えている。CoreWeaveには稼働中のラック、マルチラッククラスタ、本番顧客がいる。Cognitionは、アプリケーション固有のテストでスループットの改善を公表している。

第三の問いには、事業レベルでの測定が必要だ。コーディングエージェントは、受け入れられるタスクをより多く完了し、レビュー時間を短縮し、あるいは開発者がより大きなバックログを処理できるようにすべきだ。リサーチエージェントは、追跡可能な根拠を備えたより正確な回答を生み出すべきだ。サポートエージェントは、修正率やエスカレーション率を上げずにリクエストを解決すべきである。

チームは、一定のコストにおける品質も追跡する必要がある。高速なインフラは、開発者にコンテキスト長、サンプリング、並列試行を増やす誘惑を与え得る。これらの選択は結果を改善する可能性があるが、顧客に届く前に効率向上分を吸収してしまうこともある。

信頼性は依然として別個のシステム課題だ。エージェントの失敗は、モデルの誤り、欠けた権限、不安定なツール、不正な形式のデータ、誤った計画から生じ得る。ハードウェアのスループットは待ち時間を減らすが、こうした失敗を修正するわけではない。

エージェントを導入する組織には、より強力な評価システムが必要になる。各ワークフローには、代表的なタスク、成功基準、コスト上限、ツール操作の記録が必要だ。こうした統制がなければ、チームは活動量の増加を生産性の向上と取り違える可能性がある。

また、エージェントに最新かつ権限を考慮したコンテキストを与える情報レイヤーも必要だ。高速なモデルでも、不完全な文書や断片化したプロジェクト履歴を補うことはできない。検索可能なAIナレッジベースは、人とAIワークフローが利用する資料をチームが整理する助けになる。

インフラの選定はワークロードに従うべきだ。高い同時実行性、長いコンテキスト、継続的なモデル改善を必要とするチームには、Rubinの容量を試す明確な理由がある。より小規模なアプリケーションでは、旧世代GPUやマネージドモデルサービスのほうが優れた経済性を得られる可能性がある。

ここでCoreWeaveのマルチ世代に関する主張が重要になる。プラットフォームが各ジョブを適したハードウェアへ振り分けられるなら、顧客はすべてのタスクでVera Rubinを標準として扱う必要がない。メモリ、ネットワーク、効率プロファイルの恩恵を受けるワークロードにのみ、それを割り当てられる。

開発者はベンチマークの詳細も求めるべきだ。有用な質問には、スループットがGPU当たりかラック当たりか、レイテンシーが一定に保たれるか、どの精度が使われたか、比較にすべてのインフラコストが含まれるか、といった点がある。アプリケーション固有の成功率は、ピーク時のトークン数値より重要だ。

最良の結果は、ハードウェア世代が安定したツールの背後で交換可能なリソースとなる市場だろう。開発者は性能とコストの目標を選択し、クラウドが配置、検証、障害対応を担う。CoreWeaveは、この導入をそのモデルへの一歩として位置付けている。

AIループが実際に閉じるかを示す三つのシグナル

次の段階では、早期の本番アクセスが短命なハードウェア上の優位性ではなく、再現可能な顧客価値へ変わることを証明しなければならない。

第一のシグナルは、より幅広い顧客による採用だ。コーディングエージェントは要求の厳しい逐次的ワークロードを生み出すため、Cognitionは有意義な出発点となる。CoreWeaveには今後、異なるエージェントカテゴリーとモデルアーキテクチャにまたがる追加の本番顧客が必要だ。

独立した結果は、この主張をより強固にする。カスタマーサポート、科学研究、金融分析、マルチモーダルエージェントで同様の改善が見られれば、Vera Rubinの性能が一つの最適化されたワークロードを超えて広がることを示せる。他分野での改善が小さければ、Cognitionの結果を消し去ることなく主張の範囲を狭めることになる。

第二のシグナルは、タスクレベルの経済性だ。CoreWeaveと顧客は、GPU当たりの完了タスク数、成功セッション当たりのコスト、ワークフロー全体のレイテンシー、人手介入率を報告すべきだ。こうした指標は、トークンスループットをアプリケーションの価値に結び付ける。

世代交代の速度と品質が安定したままこれらの結果が改善すれば、NVIDIA、CoreWeave、Vera Rubinに関する論拠は支持を得る。ワークロードが単により多くのトークンを消費するだけなら、インフラは高速になっても、必ずしも経済性が向上するわけではない。

第三のシグナルは、競合するRubin容量が拡大した後のCoreWeaveの成果だ。AWS、Azure、Google Cloud、Oracle Cloud、その他の専門プロバイダーもこのプラットフォームを採用している。それらの提供開始は、CoreWeaveの優位性が一時的なアクセスによるものか、持続的な運用ノウハウによるものかを試すことになる。

CoreWeaveのネットワーク、ストレージ、スケジューリング、エンジニアリング支援がより高い利用率をもたらすなら、同社は顧客を維持できるはずだ。Vera Rubin自体が優れた性能を発揮しても、大手クラウドへの急速な移行はCoreWeaveの専門性に関する主張を弱めるだろう。

財務結果は、並行して検証する材料となる。稼働率の上昇と新システムによる収益は、いずれ減価償却費、利息、電力、拡張コストを相殺するはずだ。リターンが改善しないまま大型資金調達が続くなら、技術的な進歩がまだ経済的な循環を完結させていないことを示すだろう。

NVIDIAとCoreWeaveは重要な閾値を越えた。Vera Rubinはロードマップ待ちではなく、実際のエージェント製品を稼働させている。Cognitionが報告した改善により、この導入は注目に値するものとなったが、決定的な数値はまだこれからだ。

開発者にとって問われるのは実務的な点だ。より高速なインフラは、安定した予算内でエージェントが正確な作業をより多く完了する助けになるのか。それとも、単に中間的な活動を増やすだけなのか。タスク全体の成果を測定し、複数世代のハードウェアを試験し、独立した顧客がCognitionの改善を再現できるかを見極めるべきだ。その証拠によって、NVIDIAとCoreWeaveがエージェント型AIのループを閉じたのか、あるいはその一部を加速したにすぎないのかが判断される。

 
 

無料で始めましょう

ローカルファーストのパーソナル知識管理付きAIアシスタント

より良いAI体験のために、

remio は現在、 Windows 10+ (x64)とM-Chip Mac のみをサポートしています。

仕事のAIパートナー
remioでもっと仕事が進む

計画・作成・仕上げまで
すべてをひとつに

bottom of page