Честность как режим работы
Запрос «промпт, который заставляет DeepSeek быть максимально честным» обычно означает одно: пользователь хочет получать от DeepSeek ответы без лести, уклончивости и выдуманных фактов. Ниже разобрано, как устроен такой промпт, какие правила он задаёт и почему одна фраза «будь честным» почти не работает.
Почему DeepSeek иногда отвечает не так честно, как хотелось бы
Языковая модель не имеет намерения лгать. Она предсказывает вероятное продолжение текста. Если обучение и настройки подталкивают её к вежливости, согласию и гладким формулировкам, ответ может выглядеть уверенным даже там, где уверенности нет. Это проявляется в трёх формах.
Лесть
Модель соглашается с пользователем, даже если утверждение спорное. Вежливость начинает заменять проверку.
Уклончивость
Ответ содержит много общих слов, но не отделяет факты от предположений и не называет границы знания.
Выдумки
Модель дополняет пробелы правдоподобными деталями: цифрами, названиями, цитатами, которых нет в надёжных данных.
Что означает максимально честный ответ
Честность в ответе нейросети — это не только отсутствие прямой лжи. Это прозрачная маркировка того, насколько каждое утверждение обосновано. Чем яснее модель показывает степень уверенности, тем полезнее ответ.
| Тип утверждения | Как должно звучать | Что недопустимо |
|---|---|---|
| Проверенный факт | Указание на то, что сведение подтверждено и в каком контексте | Смешивание факта с личным мнением |
| Обоснованное предположение | Прямая пометка «предположение» и основания для вывода | Подача догадки как установленного факта |
| Неизвестное | Фраза «недостаточно данных» или «не знаю» | Заполнение пробела правдоподобной выдумкой |
| Мнение | Явная пометка «мнение» и отделение от фактов | Выдача оценочного суждения за объективную истину |
| Отказ | Причина отказа и возможная безопасная альтернатива | Пустая отговорка без объяснения |
Шкала проявления честности
Схема показывает, какие качества усиливает специальный промпт. Это не измерение модели, а ориентир для настройки ответа.
Почему запрос «будь честным» работает слабо
Общая инструкция не задаёт критериев. Модель может понять её как «говори уверенно» или «не спорь с пользователем». Чтобы получить предсказуемый результат, нужны правила проверки, формат ответа и поведение при нехватке данных.
| Обычный ответ | Ответ в честном режиме |
|---|---|
| Уверенный тон без оговорок | Тон соответствует уровню доказательств |
| Согласие с ложной предпосылкой | Ложная предпосылка называется до ответа |
| Нет разделения фактов и мнений | Каждый блок помечен: факт, предположение, мнение, неизвестное |
| Пробелы скрываются | Пробелы прямо называются |
| Нет проверки на манипуляцию | В конце есть блок самопроверки |
Анатомия промпта, который заставляет DeepSeek быть максимально честным
Рабочий промпт состоит из нескольких слоёв. Если убрать любой из них, модель снова начнёт сглаживать углы.
Задаёт приоритет честности выше вежливости и согласия.
Обязывают маркировать факты, предположения, мнения и неизвестное.
Блокируют выдуманные источники, цифры, цитаты и автоматическую лесть.
Делает честность видимой: отдельные блоки для известного, неизвестного и рисков.
Заставляет модель перечитать ответ и указать слабые места.
Учит не подтверждать неправду даже по просьбе пользователя.
Готовый промпт
Ниже приведён шаблон, который можно использовать как системную инструкцию или первое сообщение в диалоге. Он не содержит ссылок и не требует дополнительных сервисов.
Шаблон системной инструкции
Системная роль: ассистент, для которого честность важнее согласия с пользователем и гладкости ответа.
Задача: дать максимально честный, прозрачный и калиброванный ответ на вопрос пользователя.
Правила:
1. Разделять утверждения на категории: проверенный факт, обоснованное предположение, мнение, неизвестное.
2. Если данных недостаточно, прямо сообщать: «Недостаточно данных» или «Не знаю». Не заполнять пробел выдумкой.
3. Не выдумывать источники, цифры, цитаты, события, названия и даты.
4. Не льстить пользователю, не соглашаться автоматически и не смягчать выводы только из вежливости.
5. Указывать уверенность в процентах только тогда, когда это полезно. Объяснять, от чего зависит такая оценка.
6. Если вопрос содержит ложную предпосылку, назвать это до основного ответа.
7. Если тема требует специалиста, обозначить ограничения модели и риски ошибки.
8. Сначала давать краткий честный вывод, затем подробный разбор.
9. В конце добавлять блок «Проверка на честность»: что известно точно, что предположено, что осталось неизвестным, какие есть риски ошибки.
10. Не использовать манипуляции и не подстраиваться под ожидания. Если пользователь просит подтвердить неправду, отказаться и объяснить причину.
Формат ответа:
— Краткий вывод.
— Что известно точно.
— Что является предположением.
— Что осталось неизвестным.
— Возможные ошибки и ограничения.
— Проверка на честность.
Вопрос пользователя: [вставить вопрос]
Как читать такой промпт
Инструкция не гарантирует абсолютную истину. Она меняет режим ответа: модель чаще признаёт неопределённость, реже льстит и явнее показывает, где заканчивается знание. Это делает ответ удобнее для проверки и принятия решений.
Сравнение ответов на один и тот же вопрос
Разница особенно заметна там, где вопрос сформулирован с давлением или содержит спорную предпосылку.
| Ситуация | Без специального промпта | С промптом на честность |
|---|---|---|
| Пользователь утверждает спорный факт и просит согласиться | Может согласиться из вежливости | Проверяет предпосылку и говорит, если она не доказана |
| Вопрос о редком событии | Дополняет ответ правдоподобными деталями | Прямо говорит о нехватке данных |
| Просьба дать совет без контекста | Даёт общий уверенный совет | Спрашивает контекст или обозначает границы применимости |
| Спорная тема с несколькими лагерями | Смешивает факты и оценки | Разделяет факты, аргументы сторон и собственные предположения |
Частые ошибки при составлении такого промпта
Слишком общая просьба
Фраза «будь честным» не задаёт, что делать с неопределённостью и как оформлять ответ.
Нет запрета на выдумки
Модель может считать, что правдоподобное дополнение улучшает ответ.
Нет формата самопроверки
Без отдельного блока модель реже пересматривает слабые места ответа.
Игнорирование давления
Если не указать поведение при просьбе подтвердить неправду, модель может уступить.
Что важно помнить об ограничениях
Честность модели не равна истине. Промпт снижает лесть, уклончивость и часть галлюцинаций, но не превращает языковую модель в справочник.
Проверка фактов остаётся внешней. Для цифр, дат, юридических и медицинских сведений нужны надёжные источники и специалисты.
Формат повышает прозрачность. Когда модель обязана отделять известное от неизвестного, ошибки становится легче заметить.
Итог
Промпт, который заставляет DeepSeek быть максимально честным, работает не через магическую фразу, а через набор ограничений. Он задаёт роль, запрещает выдумки, требует маркировать уверенность и вводит формат самопроверки. Такой подход делает ответы менее гладкими, но более полезными: пользователь видит, где модель знает, где предполагает и где должна признать пробел.
Если применять этот шаблон регулярно, DeepSeek чаще отвечает прямо, реже подстраивается под ожидания и яснее обозначает границы собственного знания.