Почему AI вдруг стал отвечать хуже и как это проверить

Модель в настройках та же, а ответы за неделю стали слабее. Разбираем, где реальная причина, а где показалось.
31 августа 2026 года у 16% запросов к Claude Sonnet 4 был испорчен ответ. Причина — баг в роутинге контекстного окна, а не то, что «модель отупела». Anthropic нашла это только через три недели после первых жалоб пользователей. Три отдельных бага работали одновременно и маскировали друг друга.
1. Проверь статус-страницу, а не свои ощущения
Первый шаг — не спорить с моделью, а зайти на status.claude.com или status.openai.com. Посмотри историю инцидентов за последние 72 часа. Деградация качества у крупных провайдеров случается регулярно. У неё обычно есть техническая причина, а не «модель поглупела к вечеру».
Anthropic прямо написала в постмортеме о трёх багах августа 2025 года:
«We never reduce model quality due to demand, time of day, or server load» — Anthropic, «A postmortem of three recent issues»
Что смотреть: раздел «incident history», ищи слова degraded performance, elevated errors. Если инцидент есть — проблема не в тебе, жди фикса.
2. Проверь, какая модель отвечает на самом деле
ChatGPT и Claude умеют переключать модель без явного уведомления. У OpenAI это называется safety routing. Система на лету подменяет модель, когда разговор касается «эмоционально чувствительных» тем. После того как тема проходит, возвращает исходную модель.
Один пользователь написал в жалобе на Reddit:
«Adults deserve to choose the model that fits their workflow, context, and risk tolerance» — цитата пользователя, TechRadar
Что смотреть: в интерфейсе — какая модель указана над ответом прямо сейчас. Не та, что была выбрана в настройках в начале диалога. В Claude версия модели видна в шапке чата и в API-ответе, в поле model. Если модель не та, что ты выбирал — вот и причина.
3. Посчитай длину чата
Исследование Стэнфорда «Lost in the Middle» показало: модели хуже используют информацию из середины длинного контекста. Начало и конец диалога они помнят лучше. Качество ответа проседает больше чем на 30%. Это происходит, когда нужный факт лежит не в начале и не в конце диалога, а где-то посередине.
Что смотреть: если диалог длится больше 40-50 сообщений подряд на разные темы, начинай новый чат для новой задачи. Не проси модель «вспомнить, что мы обсуждали час назад» в этом же окне — переформулируй заново.
4. Проверь память и кастомные инструкции
В ChatGPT и в персональных настройках Claude накапливается память: факты о тебе, проекты, привычки. Модель подтягивает их в каждый новый разговор. Пользователи на форуме OpenAI сообщали о регрессии в работе памяти после обновления июня 2026 года. Устаревшие записи не нейтральны — они активно сбивают модель с толку, когда противоречат текущей задаче.
Что смотреть: открой раздел памяти или кастомных инструкций и перечитай, что там записано. Удали записи о завершённых проектах и старых предпочтениях. Проверяй раз в 1-3 месяца — это буквально совет из практики пользователей, столкнувшихся с проблемой.
5. Проверь список подключённых инструментов и MCP-серверов
Каждый подключённый сервис — Gmail, Calendar, файловое хранилище — грузит описание своих команд в системный промпт при каждом сообщении. Даже если ты им сегодня не пользуешься. Чем больше подключений висит без дела, тем больше окна съедено служебным текстом до того, как ты написал первое слово. И тем меньше места остаётся под саму задачу.
Что смотреть: список активных интеграций в настройках. Отключи то, чем не пользуешься в этом проекте. Место в контексте конечное: занято описаниями инструментов — значит недоступно для задачи.
6. Учти, что тебя могут A/B-тестировать
Крупные провайдеры прогоняют часть трафика через альтернативные версии модели, промпты и системные настройки. Ты можешь получить чуть другой ответ на тот же вопрос. Не потому что модель стала хуже — просто тебе достался вариант B. Официального способа проверить, попал ли именно ты в тест, обычно нет. Держи это в уме как объяснение, если разница в качестве бессистемна: то лучше, то хуже, без видимой закономерности.
7. Проверь дату — не сменилась ли модель по умолчанию тихо
Провайдеры периодически меняют модель, которая стоит за словом «по умолчанию», без явного объявления каждому пользователю. Старая версия уходит в архив или получает урезанные лимиты, а интерфейс продолжает выглядеть так же. Разница в качестве в этом случае реальна, просто причина не в деградации, а в замене.
Что смотреть: раздел changelog или release notes провайдера за последний месяц. Если там есть строчка про смену модели по умолчанию — сверь дату с датой, когда ты заметил проблему.
Где это ломается
- Ты меняешь формулировку промпта, чтобы «обойти» плохой ответ, вместо того чтобы проверить статус-страницу. Тратишь час на танцы с бубном вокруг временного бага провайдера.
- Ты держишь один диалог неделями ради «памяти контекста». Именно это убивает качество через эффект «потери в середине».
- Ты веришь, что «модель поглупела». На деле переключилась защитная маршрутизация на менее мощную модель — из-за формулировки вопроса, которая показалась системе рискованной.
- Ты чистишь промпт, но не чистишь память и кастомные инструкции. Старые записи продолжают тянуть ответ в другую сторону.
- Ты подключил десять интеграций «на всякий случай». Не заметил, что четверть окна контекста уходит на их описания ещё до твоего вопроса.
- Ты списываешь единичный плохой ответ на общую деградацию. Постмортем Anthropic прямо говорит, что баги вели себя «frustratingly inconsistent». Один и тот же запрос мог сработать нормально при повторе.
Частые вопросы
Если статус-страница показывает «all systems operational», а ответы всё равно плохие — что делать? Проверь длину диалога и память в первую очередь. Это две причины, которые статус-страница никогда не покажет. Они на твоей стороне, а не на стороне инфраструктуры.
Можно ли отключить автоматическое переключение модели в ChatGPT? На момент проверки прямого переключателя для отключения safety routing нет. OpenAI описывает его как временный и восстанавливающий исходную модель после смены темы, но управлять им пользователь не может.
Стоит ли переключаться на другого провайдера при первой деградации? Сначала проверь статус-страницу и дату. Если это известный текущий инцидент, он обычно чинится за дни, а не за недели. Постоянная миграция между провайдерами при каждом плохом ответе стоит дороже, чем подождать фикс.
Как быстро понять, что дело в длине контекста, а не в баге провайдера? Скопируй последний вопрос в новый чистый диалог без истории. Если ответ сразу стал лучше — дело в контексте, а не в инфраструктуре.
Сделай сегодня
Открой историю текущего рабочего чата, посчитай количество сообщений. Если их больше 40, скопируй последнюю задачу в новый диалог.
Источники
- https://www.anthropic.com/engineering/a-postmortem-of-three-recent-issues
- https://status.claude.com/
- https://simonwillison.net/2025/Sep/17/anthropic-postmortem/
- https://www.techradar.com/ai-platforms-assistants/chatgpt/openai-responds-to-furious-chatgpt-subscribers-who-accuse-it-of-secretly-switching-to-inferior-models
- https://openai.com/index/building-more-helpful-chatgpt-experiences-for-everyone/
- https://community.openai.com/t/regression-in-user-controlled-memory-and-instruction-adherence-after-the-june-2026-rollout/1391057
- https://cs.stanford.edu/~nfliu/papers/lost-in-the-middle.arxiv2023.pdf
- https://arize.com/blog/lost-in-the-middle-how-language-models-use-long-contexts-paper-reading/
Гайд
Claude как рабочий инструмент
128 страниц: контекст, база знаний, каскады моделей и хуки. Два трека — для тех, кто не открывал терминал, и для тех, кому нужен готовый код
Забрать гайд →