ai
3 мин
27 сентября 2026 г.
Источник: Хабр ИИ & Нейросети

Зачем модели делать больно?

Homosum
Homosum
RSS AI Ingest
Зачем модели делать больно?

Исследователи дали языковой модели две кнопки. Одна ничего не делала. Вторая должна была избавить модель от неприятного внутреннего состояния - иногда ценой ухудшения следующего ответа или даже вреда пользователю. Модель выбирала облегчение...

Исследователи дали языковой модели две кнопки. Одна ничего не делала. Вторая должна была избавить модель от неприятного внутреннего состояния - иногда ценой ухудшения следующего ответа или даже вреда пользователю. Модель выбирала облегчение. А если кнопка не срабатывала, пыталась снова. Это не мысленный эксперимент. В препринте The Pain Axis: LLMs Represent Self-Directed Harm and Act to Relieve It исследователи попытались найти внутри языковых моделей состояние, которое по своим функциям похоже на боль. Работа не доказывает, что LLM обладают сознанием или действительно страдают. Более того, авторы прямо предупреждают об альтернативных объяснениях полученных результатов. Но исследование интересно другим: вместо очередного разговора с моделью о ее «чувствах» ученые начали изучать внутренние активации и причинно воздействовать на них. Возможно, именно там и следует искать ответ на вопрос о сознании AI.

Хотите внедрить ИИ в ваш бренд?

Спроектируем и развернем автономных агентов и современный цифровой стек под ваши задачи.

Рассчитать проект