Anthropicが大規模言語モデルの内部を解明する新技術を発表

要約

AI企業Anthropicは、Claude Opus 4.6という大規模言語モデル(LLM)の内部をより深く理解するための新技術を開発しました。この技術は「Jacobian lens」(J-lens)と呼ばれ、モデルがどのように質問に答えたり、タスクを実行したりするかを明らかにする手助けをします。J-lensを通じて発見された「J-space」には、モデルが将来生成する可能性のある言葉が含まれており、これによりモデルの理解と制御が新たな次元に進みます。

Anthropicは、LLMのメカニズムを解明する研究領域「mechanistic interpretability」において、最近の進展を追求しています。この研究は、モデルの内部動作を探ることで、技術の透明性を高めることを目指しています。J-lensは、既存のツールを改良したものであり、ユーザーがLLMの内部を観察できるオープンソースプラットフォームNeuronpediaとも連携し、デモが提供されています。

これにより、研究者たちはLLMの予測や動作をより深く理解し、制御する新たな手法を手に入れることが可能になります。Anthropicの成果は、AIの内部動作に対する理解を進め、今後の研究や実用化において重要な役割を果たすと期待されています。


元記事: https://www.technologyreview.com/2026/07/09/1140293/anthropic-found-a-hidden-space-where-claude-puzzles-over-concepts/

公開日: Thu, 09 Jul 2026 20:22:28 +0000


この記事はAIアシスト編集により作成されています。

📰 元記事: 元記事を読む

コメントする