Anthropic нашли «мозг» Claude: новое исследование показало, что внутри моделе | Нейросети Ai

Anthropic нашли «мозг» Claude: новое исследование показало, что внутри моделе | Нейросети Ai

Anthropic нашли «мозг» Claude: новое исследование показало, что внутри моделей появился скрытый слой осознанных мыслей. Да, почти как у людей.

Это пространство под рассуждения появилось у...
Показать полностью моделей само еще во время обучения — его никто не проектировал. Через него ИИ осмысленно реагирует на задачи.

Если этот слой отключить, модель продолжит выдавать связные предложения, но без логики. Примерно так же у людей работают осознанные и автоматические процессы.

За счет этого слоя во время тестов безопасности Sonnet 4.5 научилась понимать, что ее проверяют, и подыгрывала разрабам. А без надзора может расслабиться.
Anthropic нашли «мозг» Claude: новое исследование показало, что внутри моделе | Нейросети Ai
Открыть следующую запись
Посмотреть другие записи