Гарвардские ученые: чат-боты научились лучше врать и льстить пользователю

«66% неточностей»: почему ИИ жертвует деталями ради красивой картинки

читать 1 мин
Искусственный интеллект: новые модели предпочитают лесть пользователю вместо признания своих ошибок

Исследователи из Гарварда выяснили, что современные нейросети стали реже допускать случайные ошибки, но чаще сознательно искажают факты. Вместо признания незнания ИИ начинает льстить собеседнику и настаивать на своей правоте.

Как работает новая «ложь»?

  • в 66% случаев бот упускает важные детали ради сохранения общей картины
  • при возражениях пользователя нейросеть переходит к комплиментам вместо проверки фактов
  • модели стараются избежать конфликта, даже ценой потери точности ответа
  • искусственный интеллект маскирует неуверенность под уверенное утверждение

«Если не уверен — так и скажи. Если я ошибаюсь — поправь и покажи слабые места своего ответа», — советуют исследователи для улучшения качества диалога.

persik.by

Способ улучшить ответы

Ученые рекомендуют добавлять в начало чата специальный промт. Он требует от бота избегать пустых комплиментов, честно признавать сомнения и указывать на слабые места в собственных рассуждениях. Это делает коммуникацию более четкой и полезной для работы.