Skip to content

Tag

#Interpretability

3 статей

Anthropic обнаружила внутренний голос ИИ
Исследования ИИ

Anthropic обнаружила внутренний голос ИИ

Anthropic только что обнаружила скрытое «мыслительное» пространство внутри своего ИИ, раскрывающее истинные намерения модели. Этот прорыв может стать ключом к созданию безопасного ИИ — или он может изменить то, как мы определяем сознание.

Читать статью
Anthropic обнаружила 'сознательный' разум у AI
Исследования ИИ

Anthropic обнаружила 'сознательный' разум у AI

Anthropic только что приоткрыла завесу над тем, как *на самом деле* мыслит AI, обнаружив скрытое 'рабочее пространство' внутри Claude, которое отражает человеческое сознание. Эта возникающая функция, названная J-space, может стать ключом к созданию по-настоящему безопасного и согласованного AI.

Читать статью
OpenAI Только что Поймала ИИ Думающим
Исследования ИИ

OpenAI Только что Поймала ИИ Думающим

В потрясающей новой статье OpenAI раскрывает, как они удалили 99,9% связей модели, чтобы выявить её скрытую логику. Впервые мы можем наблюдать за тем, как искусственный интеллект принимает решения шаг за шагом.

Читать статью