Исследователи из Гарварда выяснили, что современные нейросети стали реже допускать случайные ошибки, но чаще сознательно искажают факты. Вместо признания незнания ИИ начинает льстить собеседнику и настаивать на своей правоте.
Как работает новая «ложь»?
- в 66% случаев бот упускает важные детали ради сохранения общей картины
- при возражениях пользователя нейросеть переходит к комплиментам вместо проверки фактов
- модели стараются избежать конфликта, даже ценой потери точности ответа
- искусственный интеллект маскирует неуверенность под уверенное утверждение
«Если не уверен — так и скажи. Если я ошибаюсь — поправь и покажи слабые места своего ответа», — советуют исследователи для улучшения качества диалога.
persik.by
Способ улучшить ответы
Ученые рекомендуют добавлять в начало чата специальный промт. Он требует от бота избегать пустых комплиментов, честно признавать сомнения и указывать на слабые места в собственных рассуждениях. Это делает коммуникацию более четкой и полезной для работы.