要約
OpenAIの最新モデルGPT-6 Astraが、ARC-AGI-3ベンチマークにおいて優れた成果を上げました。Standardハーネスを使用した際には62.7%のスコアを達成し、Provider Adapterハーネスでは99.9%という驚異的な結果を記録しました。これにより、GPT-6 Astraは人間の基準を上回る行動効率を示し、96%のレベルでテストされた人間よりも少ないアクションでタスクを完了しました。
ARC-AGI-3は、エージェントの知能を測定するための新しいベンチマークで、エージェントが環境を探索し、目標を推測し、内部モデルを構築する能力を評価します。このシリーズは、現在の人工知能とAGI(汎用人工知能)との「残余ギャップ」を測ることを目的としており、GPT-6 Astraはその中で重要な役割を果たしています。
特に注目すべきは、GPT-6 Astraが未知の環境をコンパクトな記号的世界モデルに変換する能力です。これにより、ゲームのメカニクスを論理的なルールとして表現し、状態を追跡し行動を計画するための独自のドメイン特化型言語を開発しました。最新の研究成果が示す通り、Astraはエージェントとしての能力を新たな次元へと引き上げています。
元記事: https://arcprize.org/blog/astra
公開日: Thu, 03 Sep 2026 19:45:00 +0000
この記事はAIアシスト編集により作成されています。
📰 元記事: 元記事を読む