> · · 7 мин

За два дня отключили 21 модель: все codex прошлых поколений и оба имени DeepSeek. Плюс тихий баг, который увеличит твой счёт

За два дня отключили 21 модель: все codex прошлых поколений и оба имени DeepSeek. Плюс тихий баг, который увеличит твой счёт

За два дня, 23 и 24 июля, два крупных провайдера выключили модели, на которые у кого-то до сих пор ссылается прод. OpenAI отключила девятнадцать снапшотов, включая вообще все codex-модели предыдущих поколений. DeepSeek убила два своих легаси-имени без грейс-периода. Если у тебя где-то захардкожен gpt-5.2-codex или deepseek-chat — оно уже не работает.

TL;DR: 23 июля OpenAI отключила gpt-5-codex, gpt-5.1-codex, gpt-5.1-codex-max, gpt-5.1-codex-mini, gpt-5.2-codex, gpt-5-chat-latest, gpt-5.1-chat-latest, computer-use-preview, обе deep-research модели и ещё несколько аудио- и search-снапшотов. 24 июля в 15:59 UTC DeepSeek выключила deepseek-chat и deepseek-reasoner. В миграции DeepSeek спрятан тихий баг биллинга. Следующие даты: 24 сентября, 23 октября, 20 января 2027.

Что именно отключила OpenAI 23 июля

Отключены девятнадцать снапшотов, объявленных ещё 22 апреля. Больнее всего разработчикам достаётся кодинг-линейка: не стало ни одной codex-модели прошлых поколений.

Замена почти для всего — gpt-5.6-sol:

  • gpt-5-codex, gpt-5.1-codex, gpt-5.1-codex-max, gpt-5.2-codexgpt-5.6-sol
  • gpt-5-chat-latest, gpt-5.1-chat-latestgpt-5.6-sol
  • o3-deep-research и o4-mini-deep-research (вместе со снапшотами) → gpt-5.6-sol
  • gpt-5.1-codex-minigpt-5.6-terra
  • computer-use-preview и computer-use-preview-2025-03-11gpt-5.6-terra
  • gpt-4o-search-preview-2025-03-11, gpt-4o-mini-search-preview-2025-03-11gpt-5.6-terra
  • gpt-4o-mini-tts-2025-03-20gpt-4o-mini-tts-2025-12-15
  • gpt-audio-mini-2025-10-06gpt-audio-1.5, gpt-realtime-mini-2025-10-06gpt-realtime-2.1-mini
  • Плюс превью-снапшоты gpt-4o-audio, gpt-4o-mini-audio и gpt-4o-mini-realtime от декабря 2024

Отдельно отмечу gpt-5.2-codex. Это не музейный экспонат вроде gpt-3.5 — модель актуального поколения, и её тоже выключили. Сроки жизни снапшотов у OpenAI сейчас измеряются месяцами, и планировать надо исходя из этого, а не из привычки «gpt-4 живёт вечно».

Ещё одна тихая деталь того же обновления: с 2 июля организации, которые за последние 60 дней ни разу не запускали инференс на своей дообученной модели, больше не могут создавать новые fine-tuning задачи. А 6 января 2027 создавать их не сможет уже никто — инференс на существующих дообученных моделях останется, но отвалится вместе с деприкейтом базовой модели.

Что сломала DeepSeek и где спрятан счёт

deepseek-chat и deepseek-reasoner перестали резолвиться 24 июля в 15:59 UTC. Ни грейс-периода, ни алиаса-заглушки. Вызовы просто возвращают ошибку. Оба имени указывали на deepseek-v4-flash: первое на режим без размышления, второе — на режим с размышлением.

Замена выглядит как правка одной строки, и ловушка спрятана именно здесь. deepseek-v4-flash по умолчанию идёт с включённым режимом размышления. Переименовал deepseek-chat в deepseek-v4-flash, не подумав, — включил рассуждение, которого у тебя раньше не было. Больше выходных токенов, выше латентность, больше счёт. Ничего не падает, всё «работает», просто дороже.

Безопасная миграция — задавать поведение явно:

# БЫЛО — мертво после 15:59 UTC 24.07.2026
client.chat.completions.create(
    model="deepseek-chat",
    messages=[...]
)

# СТАЛО — точный аналог deepseek-chat
client.chat.completions.create(
    model="deepseek-v4-flash",
    messages=[...],
    extra_body={"thinking": {"type": "disabled"}}
)

# СТАЛО — точный аналог deepseek-reasoner
client.chat.completions.create(
    model="deepseek-v4-flash",
    messages=[...],
    extra_body={"thinking": {"type": "enabled"}}
)

Вторая ловушка тоньше. deepseek-reasoner указывал на Flash, а не на Pro. Если ты выбирал алиас с «reasoner» в названии, потому что тебе нужна была глубина рассуждения, лобовая замена оставит тебя на Flash-уровне. Апгрейд до deepseek-v4-pro — осознанное решение, а не побочный эффект переименования: у Pro миллион токенов контекста и до 384 тысяч токенов на выход.

И третье: если ты ходишь в DeepSeek через Anthropic-совместимый формат (например, направив туда Claude Code), меняется не только имя модели — там другой базовый URL и по-другому устроен параметр усилия.

Как быстро найти у себя все мёртвые имена

Начни с грепа по всему репозиторию, а не только по коду приложения:

grep -rn "deepseek-chat\|deepseek-reasoner\|gpt-5-codex\|gpt-5\.1-codex\|gpt-5\.2-codex\|gpt-5-chat-latest\|gpt-5\.1-chat-latest\|computer-use-preview\|deep-research" .

Дальше проверь места, куда греп по репозиторию не достаёт, — именно там обычно и находится сюрприз:

  • Конфиги LangChain и LlamaIndex, где имя модели лежит в строке инициализации
  • Настройки бэкендов в Claude Code, Cursor и других агентах, если ты подменял провайдера
  • Переменные окружения и дефолты в Terraform, Helm, docker-compose
  • CI/CD пайплайны, которые гоняют evals по расписанию — они падают тихо и не в рабочее время
  • Шаблоны промптов, ноутбуки и документацию с захардкоженными именами
  • Дашборды и алерты, которые фильтруют метрики по имени модели

Подводные камни

  • Отключение снапшота выглядит не как «модель устарела», а как инцидент. Эндпоинт возвращает ошибку, и если у тебя нет фолбэка, падает фича целиком.
  • Самое опасное здесь — не ошибка, а её отсутствие. Миграция DeepSeek не роняет запросы, а молча включает размышление. Ты узнаешь об этом из счёта в конце месяца, а не из алерта.
  • deepseek-reasoner вёл на Flash. Лобовая замена по названию оставляет тебя без той глубины рассуждения, за которой ты, возможно, и приходил.
  • Уведомления приходят туда, куда никто не смотрит. OpenAI разослала письмо и обновила страницу деприкейтов ещё в апреле. Между «объявили» и «выключили» прошло три месяца, и всё равно кого-то это застало врасплох.
  • Fine-tuning тихо закрывается. С 2 июля новые задачи недоступны организациям, которые 60 дней не трогали свои дообученные модели, — а полное закрытие создания задач назначено на 6 января 2027.
  • У Sora замены нет вообще. Videos API и вся линейка sora-2 уходят 24 сентября без рекомендованного преемника в списке. Это не миграция, это поиск другого вендора.

Какие даты держать в календаре дальше

Ближайшие отсечки, которые ломают код:

  • 24 сентября 2026 — Videos API, sora-2, sora-2-pro и их снапшоты. Замена не предложена.
  • 23 октября 2026gpt-3.5-turbo и gpt-3.5-turbo-0125 уезжают на gpt-5.6-terra; gpt-4, gpt-4-0613 и gpt-4-1106-preview — на gpt-5.6-sol. Да, gpt-3.5-turbo дожил до осени 2026.
  • 6 января 2027 — создание новых fine-tuning задач отключается для всех.
  • 20 января 2027 — легаси audio, realtime и транскрипция: gpt-realtimegpt-realtime-2.1, gpt-audio и gpt-4o-audiogpt-audio-1.5, gpt-4o-realtimegpt-realtime-2.1, gpt-realtime-minigpt-realtime-2.1-mini.

У Anthropic ближайшая крупная волна уже прошла: Opus 4 и Sonnet 4 отключены 15 июня 2026, Haiku 3 ушёл раньше.

Вердикт

Сделай греп сегодня, даже если уверен, что мигрировал — практика показывает, что забывают не код, а CI, ноутбуки и дефолты в IaC. Если ты на DeepSeek, критичнее не почин ошибок, а явное выставление thinking: молчаливое включение размышления не сломает прод, оно просто выставит счёт. И заведи в календаре 23 октября: gpt-3.5-turbo и gpt-4 держатся в чужих зависимостях крепче, чем в твоих собственных.

Как закрыть тему за полчаса

  1. Прогони греп по всему репозиторию, включая .env.example, ноутбуки и конфиги инфраструктуры.
  2. Проверь CI: задачи, которые гоняют evals или интеграционные тесты против API, ломаются тихо и в нерабочее время.
  3. Для DeepSeek — везде явно задай thinking вместо того, чтобы полагаться на дефолт, и отдельно реши, нужен ли тебе deepseek-v4-pro вместо Flash.
  4. Заведи фолбэк на уровне кода: одна ошибка от эндпоинта не должна ронять фичу целиком.
  5. Подпишись на страницы деприкейтов вместо того, чтобы полагаться на почту: список OpenAI и чейнджлог DeepSeek обновляются раньше, чем приходит рассылка.
$ ls ./related/

Похожие статьи

claude-opus-5-real-price.md
Claude Opus 5: «вдвое дешевле» — это не про твой счёт. Цена та же, что у Opus 4.8, а изменилась цензура
> · 8 мин

Claude Opus 5: «вдвое дешевле» — это не про твой счёт. Цена та же, что у Opus 4.8, а изменилась цензура

Anthropic выпустила Claude Opus 5 24 июля: 43,3% на Frontier-Bench против 33,7% у Fable 5. Но цена осталась ровно как у Opus 4.8 — $5/$25. Разбираем, где реальная экономия, почему кибер-классификаторы теперь срабатывают на 85% реже и что не так со сноской под главным бенчмарком.

ai agents llm claude
coding-benchmarks-retrieval.md
80% на SWE-bench это не 80% решённых задач: как кодинг-лидерборды меряют ретривал, а не кодинг
> · 9 мин

80% на SWE-bench это не 80% решённых задач: как кодинг-лидерборды меряют ретривал, а не кодинг

Четыре работы за месяц показали, что кодинг-лидерборды меряют ретривал и обвязку, а не кодинг: OpenAI зарубила два своих бенчмарка, Cursor нашёл 63% найденных фиксов, RuBench поймал GPT-5.6 на добывании ответов с диска. Плюс инструкция, как честно померить агента на своём репозитории.

ai llm benchmarks coding
gemini-36-flash-no-35-pro.md
Google выпустила три Gemini и снова не выпустила 3.5 Pro. Зато уже учит Gemini 4
> · 9 мин

Google выпустила три Gemini и снова не выпустила 3.5 Pro. Зато уже учит Gemini 4

Google выпустила Gemini 3.6 Flash, Flash-Lite и закрытую Flash Cyber, но снова отложила флагман 3.5 Pro и начала учить Gemini 4. Разбираем цены, бенчмарки, дуал-юз кибермодели и подводные камни, включая баг с квотой в Antigravity и недоступность из РФ.

ai llm gemini google
subscribe.sh

$ cat /dev/blog/updates

> Свежие заметки о программировании,

> DevOps и AI — прямо в мессенджер

./subscribe