Как запретить нейросети врать: промпты против галлюцинаций

Нейросети уверенно отвечают даже тогда, когда не знают правильного ответа. Это явление называется галлюцинацией. Хорошая новость: грамотно составленный промпт способен резко снизить количество выдумок и ошибок.

Почему нейросети «врут»

Языковая модель не «знает» факты — она предсказывает наиболее вероятное продолжение текста. Если в обучающих данных не было точного ответа, модель всё равно сгенерирует правдоподобно звучащую фразу. Она не испытывает сомнений и по умолчанию не сообщает о неуверенности.

Причина №1. Отсутствие данных

Тема редкая, новая или узкоспециальная — модель достраивает ответ из похожих шаблонов.

Причина №2. Давление формулировки

Вопрос «Почему X — лучший?» уже содержит предпосылку, и модель послушно её подтверждает.

Причина №3. Стремление угодить

Модель обучена быть полезной, поэтому предпочитает дать любой ответ, а не признать незнание.

Базовые приёмы честного промпта

Полностью запретить модели ошибаться невозможно — но можно выстроить «рамку честности». Ниже — проверенные формулировки, которые добавляют прямо в текст запроса.

Приём 1. Разрешение сказать «не знаю»

«Если ты не уверен в ответе или у тебя нет достоверной информации — прямо напиши «я не знаю» вместо предположения»

Приём 2. Запрет на выдумывание источников

«Не придумывай цитаты, статистику, названия исследований, ссылки и даты. Используй только факты, в которых ты уверен»

Приём 3. Разделение фактов и предположений

«Чётко разделяй в ответе: что является проверенным фактом, а что — предположением или логическим выводом»

Приём 4. Оценка уверенности

«После каждого ключевого утверждения указывай уровень уверенности: высокий, средний или низкий»

Слабый промпт против сильного

Слабый запрос Усиленный запрос
«Расскажи про исследования влияния кофе на память» «Расскажи про исследования влияния кофе на память. Называй только те исследования, о существовании которых ты уверен. Если точные данные неизвестны — так и скажи, не выдумывай авторов, годы и цифры»
«Какая зарплата у инженера в Норвегии?» «Какая зарплата у инженера в Норвегии? Отметь, что твои данные могут быть устаревшими, укажи диапазон как приблизительный и посоветуй проверить актуальные источники»
«Почему этот метод лучший?» «Оцени этот метод нейтрально: перечисли и сильные, и слабые стороны. Не считай, что он лучший, пока это не подтверждено»

Шкала надёжности приёмов

Не все техники работают одинаково. Ориентировочная эффективность популярных методов:

Разрешение отвечать «не знаю»

Предоставление исходного текста для анализа

Запрос оценки уверенности

Требование указывать источники

Модель может выдумать и сам источник — приём работает только вместе с запретом на выдумывание

Самая надёжная стратегия: работа от материала

Нейросеть гораздо честнее, когда ей дают готовый текст и просят опираться только на него. Это превращает задачу из «вспомни факт» в «найди в тексте», где риск галлюцинации минимален.

Шаблон: «Вот документ: [текст]. Отвечай на вопросы строго на основе этого документа. Если ответа в тексте нет — скажи, что информации нет, и не добавляй ничего из общих знаний»

Универсальный блок честности для любого промпта

«Правила ответа:
1. Отвечай только в том, в чём уверен.
2. Если не знаешь — прямо напиши «я не знаю».
3. Не выдумывай факты, цифры, цитаты, имена и источники.
4. Разделяй проверенные факты и предположения.
5. Если данные могут устареть — предупреди об этом»

Главное правило: даже идеальный промпт не заменяет проверку. Нейросеть — инструмент для черновиков идей и работы с текстом, а критически важные факты всегда стоит сверять с первоисточниками.