Почему агент бывает уверен и неправ
Claude Code может написать «готово, всё работает» и при этом ошибиться. Это не значит, что агент тебе врёт со злым умыслом, дело в том, как вообще работает языковая модель.
Модель строит следующее слово так, чтобы оно было наиболее вероятным продолжением текста. Отчёт об успешной проверке звучит правдоподобно почти всегда, поэтому модель охотно его пишет, даже если реальной проверки не было или она была неполной. Агент не «врёт», он достраивает наиболее ожидаемый ответ, а без явной команды проверить результат он может решить, что раз ошибок в коде не видно, значит всё в порядке.
Проси показать, а не рассказать
Самый простой способ снизить риск ошибки, менять вопрос «работает?» на просьбу показать конкретное доказательство: вывод команды, содержимое файла или результат теста.
- Вместо «проверь, что бот отвечает» попроси прислать текст сообщения, которое реально пришло от бота, а не пересказ своими словами.
- Вместо «форма работает» попроси показать, что именно было отправлено на сервер, а не только то, что кнопка нажалась и появилась галочка.
- Вместо «страница обновилась» попроси перезагрузить её и прислать, что видно после этого, а не то, что видно в коде редактора.
не так: "проверь, что всё работает"
покажи вывод команды, которой ты проверял, целиком, без сокращений
✓ агенту сложнее просто "поверить в успех", когда нужно приложить реальный вывод
Такой вопрос заставляет агента фактически запустить проверку, а не пересказать то, что «должно получиться по логике». Разница между «по логике должно работать» и «вот реальный результат» и есть та самая проверка, которую новичку легко упустить.
Три проверки, которые может сделать любой новичок
Не обязательно читать код, чтобы поймать нерабочий результат. Дальше три ситуации, которые встречаются почти в каждом проекте новичка, и что реально проверить руками.
| Что сделал агент | Как проверить самому |
|---|---|
| Сайт или лендинг | Открыть страницу в браузере, обновить её с очисткой кэша (Ctrl+Shift+R) и посмотреть своими глазами, а не верить описанию правки. |
| Telegram-бот | Написать боту реальное тестовое сообщение из своего телефона или другого аккаунта и посмотреть, что придёт в ответ. |
| Приём оплаты или форма | Пройти сценарий целиком самому: заполнить форму или пройти тестовый платёж и увидеть итог, а не только зелёную галочку валидации. |
Ловушки, которые агент не заметит сам
Иногда агент действительно честно проверяет, но проверка обманывает его самого. Вот частые причины, почему «всё зелёное», а по факту не работает.
- Браузер показывает старую версию страницы из кэша, и агент смотрит на неё же, поэтому не видит, что правка не применилась.
- Агент проверяет, что кнопка нажимается и не выдаёт видимой ошибки, но не проверяет, что именно отправилось на сервер или в базу данных.
- Проверка идёт на тестовых, заранее подготовленных данных, а не на тех, что реально введёт живой пользователь.
Простое правило на будущее
Не нужно превращать каждую мелочь в расследование. Правило «покажи, а не расскажи» стоит применять там, где ошибка реально дорого стоит.
- Оплата, отправка личных данных, публикация чего-либо для других людей: проверяй сам, своими глазами, каждый раз.
- Мелкая правка текста или цвета кнопки: можно поверить агенту на слово и проверить между делом.
- Если проверка важная и результат подтвердился, зафиксируй этот момент git-коммитом, чтобы к нему можно было вернуться. Подробнее про это в гайде «Топ ошибок новичка в вайбкодинге».