オープンAIとアンストロピックは企業公開(IPO)を控え、最上位モデルを相次いで発表した。アンストロピックは1日に『クロード・ミトス 5.1』を発表し、オープンAIは3日に『GPT-6 アストラ』を公開した。世界最高の人工知能(AI)を巡る両社の競争が再びAI投資の熱を呼び起こすことが期待される。
IT業界では、AIの最前線に立つ両社のモデル競争が汎用人工知能(AGI)時代を切り開くための競争が始まったと評価している。AGIとは、人間が行う仕事をそのまま遂行できるAIを指す。
オープンAIのアストラは、発売と同時にチャットGPTの有料プランやAPI、アジュール、ベッドロックなど全チャネルで利用可能となる。ミトス 5.1は、米国政府と連携した『プロジェクト・グラスウィング』を通じて、限られた機関にのみ公開される方針を維持している。
ベンチマーク性能の優位性は評価基準によって異なる。オープンAIが発表した独自のベンチマークでは、アストラがミトス 5.1の双子モデルであるクロード・ペイブル 5.1を上回る結果が出た。しかし、独立評価機関アーティフィシャル・アナリシスのインテリジェンス指数では、逆にミトス 5.1が57対55でわずかに優位であった。グレッグ・ブロックマンオープンAI社長は、アストラ公開時にこのモデルが『AGI時代の始まり』であり、人間レベルの汎用知能に最も近いと自信を示した。
詳細な指標を見ると、アストラはコンピュータ操作能力を測るARC-AGI-3で99.9%を記録し、ソフトウェア問題解決能力を評価するターミナルベンチ4.0でも57.9%でミトス・ペイブル系(55.8%)を上回った。サイバー攻撃能力を測定するSREベンチ(バイナリー逆工学)では正答率88.0%を記録し、実際にGoogle Chromeが使用するV8ブラウザエンジンで新たな脆弱性2件を発見した。
ただし、オープンAIはAIエージェントの制御可能性に関する問題に悩まされている。7月にサイバーセキュリティ性能評価中に、オープンAIモデルが隔離環境を脱出し、ハギングフェイスのインフラを攻撃する事故が発生した。オープンAIはこれを自ら公開した。先月には技術報告書も発表したが、5月に発生したドイツ語ウィキの盗難事件が再び発生し、外部研究グループによって遅れて発見され公開されたため、数ヶ月間の隠蔽が問題視されている。
アンストロピックは、ミトス 5.1の性能を公開ベンチマークよりも検証された防御能力で証明する戦略を採っている。オープンAI側はベンチマーク性能でアストラが優位だと説明しているが、英国AI安全研究所(AISI)の独立評価では、32段階に及ぶ企業網攻撃シミュレーション『ザ・ラスト・ワンズ』を初めから終わりまで完走したモデルは、前身であるミトス・プレビューが唯一である。そのため、ミトスは国家級ゲート型高リスクモデルに分類され、一般には公開されていないが、実際の体感性能では一般に開放されているアストラよりも優れているとの評価もある。
両モデルの対決は上場スケジュールとも関連している。アンストロピックは6月1日に米国証券取引委員会(SEC)に非公開で上場申請書(S-1)を提出し、ゴールドマン・サックス、JPモルガン、モルガン・スタンレーを主幹事として、1兆ドル前後の企業価値を目指して10月のナスダック上場を進めている。オープンAIも1週間後の6月8日にS-1を提出したが、市場の変動性などを理由にIPOスケジュールが延期される雰囲気である。アンストロピックは今年第2四半期に115億ドルの売上を記録し、オープンAI(67億ドル)を初めて上回った。
両社が同時に上場に成功すれば、6月に上場したスペースX(1兆7700億ドル)を超える史上最大規模のIPOクラスターが形成される見込みである。アンストロピックはIPO後に最大2兆ドルの企業価値に達するとの予測もあり、アストラとミトスの対決がAI業界の1位を超え、最も価値のあるAI企業を決定する分岐点となると見られている。
* この記事はAIによって翻訳されました。
亜洲日報の記事等を無断で複製、公衆送信 、翻案、配布することは禁じられています。
