AI研究
AnthropicがAIの「内なる声」を発見
Anthropicは、AI内部に隠された「思考」空間を発見し、モデルの真の意図を明らかにしました。この画期的な発見は、安全なAIを構築するための鍵となるか、あるいは意識の定義そのものを変える可能性があります。
記事を読む→
Tag
3 件
Anthropicは、AI内部に隠された「思考」空間を発見し、モデルの真の意図を明らかにしました。この画期的な発見は、安全なAIを構築するための鍵となるか、あるいは意識の定義そのものを変える可能性があります。
Anthropicは、AIが*実際に*どのように考えているかを明らかにし、Claudeの内部に人間の意識を反映する隠れた「ワークスペース」を発見しました。J-spaceと呼ばれるこの創発的な機能は、真に安全で整合性の取れたAIを構築するための鍵となる可能性があります。
驚くべき新しい論文で、OpenAIはモデルの接続の99.9%を削除し、その隠れた論理を明らかにする方法を発表しました。これにより、私たちはAIが段階的に意思決定を行う様子を初めて見ることができます。