31 июля рынок ИИ получил сразу два удара в один день. OpenAI объявила о резком снижении цен: входные токены самой доступной модели подешевели с $1 до $0,2 за миллион — минус 80%. Это дешевле, чем у DeepSeek, который в Китае считался эталоном «цены за качество».
В тот же день DeepSeek выкатила новую версию, заявив о серьёзном росте способностей в написании кода и исправлении багов. Совпадение выглядит слишком точным, чтобы быть случайным: это лобовое столкновение двух подходов к вопросу «сколько вообще должен стоить интеллект».
Кому что снизили. Главный герой — Luna: вход $1 → $0,2, выход $6 → $1,2. Terra подешевела скромнее, на 20%: вход $2,5 → $2, выход $15 → $12. Флагман Sol цену не менял ($5 / $30), но получил в API переключатель Fast: скорость в 2,5 раза выше при двойной цене и без потери «интеллекта» — режим заменил прежний Priority Processing.
Подписки ChatGPT и Codex не подорожали, но вызовы Luna и Terra теперь съедают меньше кредитов, то есть за те же $20 в месяц можно сделать больше. Заодно модель авто-ревью в ChatGPT и Codex CLI перевели с GPT-5.4 на Luna — по оценке компании, это удешевляет такие задачи примерно в десять раз.
Показательна сама точка, куда упала цена: вход у Luna теперь на уровне прошлого поколения GPT-5.4 nano, а выход даже на $0,05 дешевле. Но nano умел лишь классификацию и извлечение данных, тогда как Luna вызывает инструменты, держит длинный контекст и выполняет многошаговые сценарии. По сути, полноценную агентную модель продают по цене «малышей».
Откуда взялся запас на скидку. Накануне OpenAI рассказала, что Sol через Codex подключили к продакшен-стеку инференса, и модель под руководством инженеров оптимизировала систему, на которой сама же и работает: переписала часть GPU-ядер на Triton и Gluon (минус 20% сквозной стоимости обслуживания), провела сотни архитектурных экспериментов со спекулятивным декодированием (плюс 15% к эффективности генерации токенов), нашла перекосы в балансировке нагрузки и подобрала конфигурации KV-кэша, до которых у инженеров не доходили руки. Код Sol не идёт в прод напрямую — его проверяют инструментами и людьми. Но арифметика не сходится: 20% плюс 15% никак не складываются в минус 80%. Остальное объясняется рынком.
Давление снизу. По данным OpenRouter, с конца апреля 2026 года китайские модели тринадцать недель подряд обрабатывают больше токенов, чем американские; на неделе 20–26 июля — около 38,6 трлн токенов, 66,5% платформы.
CNBC сообщает, что доля китайских моделей в потреблении американских компаний через OpenRouter с 8 февраля еженедельно превышала 30%, доходя до 46%. Цены: DeepSeek V4 Pro — $0,435 / $0,87 с постоянной скидкой 75% и $0,003625 за миллион при попадании в кэш; Kimi K3 — $3 / $15; GLM-5.2 — $1,4 / $4,4.
По входу Luna уже обошла V4 Pro, по выходу пока дороже, но с поправкой на уровень интеллекта, по оценкам Artificial Analysis, выигрывает в совокупном соотношении цены и качества. В тесте Agents Last Exam Luna обошла флагман Anthropic Fable 5 при стоимости задачи около 1% от конкурента. Сэм Альтман после этого пообещал «лучшее соотношение цены и интеллекта на каждом уровне моделей».
Что это меняет. Разработчик, ежедневно прогоняющий через ИИ десятки тысяч новостей — очистка, разметка, извлечение сущностей, кластеризация, — платит около тысячи юаней в месяц; на топовых моделях счёт был бы вдесятеро больше.
Именно в этой нише жила DeepSeek V4 Flash: средне-высокий уровень при смешной цене. Теперь у неё появился конкурент, который умнее и стоит $0,2 за вход. Проверки, валидация, мониторинг — всё, что раньше боялись гонять часто из-за стоимости вычислений, становится рутинным шагом рабочего процесса.
Кто в выигрыше, кто в проигрыше. Разработчикам — раздолье: агенты могут работать 24/7, сценарии, немыслимые по цене год назад, стали доступны. Китайским моделям — головная боль: ценовой ров засыпают, разрыв в качестве ещё нужно догонять, а модель монетизации придётся продумывать заново. Реакция сообщества в день анонса была бурной, вплоть до прямых обращений к Anthropic: «твой ход».
Главный смысл этой скидки не в сэкономленных долларах, а в сигнале: удешевление больших моделей ускоряется, а эффективность инфраструктуры теперь напрямую конвертируется в цену. Пока интеллект стоит как предмет роскоши, его пробуют изредка. Когда он становится дешёвым, как электричество, он растекается по всем производственным цепочкам. Эпоха бесплатных праздников заканчивается — эпоха дешёвого интеллекта только начинается.
sms_systems@inbox.ru
+ 7 (985) 982-70-55