Один день — три громких релиза: Qwen3.8-Max открывает веса, DeepSeek V4 Pro 0813 выходит в GA, Grok 4.6 удешевляет frontier
Привет, друзья!
12 августа 2026 года в индустрии больших языковых моделей случился редкий момент — в один день сошлись три релиза от трёх конкурирующих лабораторий, каждый из которых по отдельности тянул бы на отдельную большую новость. Alibaba Qwen открыли веса своей флагманской модели Qwen3.8-Max и пообещали 27-миллиардную плотную версию. DeepSeek выкатила GA-релиз (general availability, общедоступная стабильная версия) V4 Pro 0813 — своей версии после долгого превью. xAI выпустила Grok 4.6 с показателем 1753 балла по индексу AA Intelligence и ценой вдвое ниже, чем у конкурентов с сопоставимым уровнем. Три лаборатории, две страны, одна неделя, одна и та же цель — доказать, что их флагман стоит рядом с Anthropic Fable 5 и GPT-5.6 Sol, причём за половину их цены. Ниже разберу каждый релиз, что в нём настоящего, а что обещания, и почему этот день важен.
Qwen открывает веса: 2.4 триллиона параметров под свободной лицензией
Начнём с Qwen, потому что это самое необычное из трёх. 3 августа Alibaba выпустила Qwen3.8-Max — самую большую модель в линейке: 2.4 триллиона общих параметров с разреженной архитектурой Mixture-of-Experts (активируется 95 миллиардов на каждый токен), контекстное окно в миллион токенов, вход текст + изображения + видео, выход только текст. На бумаге это прямой конкурент Claude Fable 5 и GPT-5.6 Sol. Но в день релиза Alibaba не выложила веса — это была hosted API с обещанием открыть их в течение недели. И 8 августа, с опережением графика, обещание выполнили: Qwen3.8-Max-Preview и его FP8-версия (формат с пониженной точностью для ускорения инференса, то есть работы модели) появились на Hugging Face, публично и без гейтинга (без обязательной регистрации и одобрения заявки), 224 файла общим объёмом около 4.89 терабайта.
Это первый случай, когда Alibaba открывает веса именно Max-класс (раньше открывали только меньшие модели), и сама фактура релиза — не API, а свободно скачиваемые чекпойнты (готовые файлы весов модели) — означает важный сдвиг в стратегии компании. Любой исследователь или стартап теперь может развернуть локально копию модели, которая входит в мировой топ-3 по большинству бенчмарков. Дополнительно Alibaba пообещала на ту же дату (12 августа) выпустить плотную модель Qwen3.8-27B для тех, у кого нет инфраструктуры под 2.4 триллиона параметров. На момент написания этого поста 27-миллиардная версия так и не появилась — это тот случай, когда обещание есть, а поставки пока нет.
Отдельно про лицензию. В день релиза 3 августа Alibaba не опубликовала лицензию вообще — это заметили все, кто пытался скачать веса. После релиза выяснилось, что это не Apache 2.0, как у более ранних моделей Qwen, а специальная лицензия под названием qwen3.8-max. Что она разрешает, а что запрещает — отдельный разговор, потому что формулировка там не вполне стандартная. Для коммерческого использования нужно будет прочитать текст лицензии внимательно, а не предполагать, что раз «open», то можно всё.
DeepSeek V4 Pro 0813: тихий GA
DeepSeek провела релиз на удивление без помпы. Никакого блог-поста на их сайте, никакого поста в X, никакого пресс-релиза. Просто 12 августа 2026 года в OpenRouter появилась запись deepseek-v4-pro-0813 с пометкой «GA-релиз DeepSeek V4 Pro», а в собственной документации DeepSeek версия DeepSeek-V4-Pro-0813 стала версией за эндпоинтом (адресом API, к которому обращаются пользователи) deepseek-v4-pro. Это всё.
Модель представляет собой большой MoE (mixture-of-experts, смесь экспертов — архитектура, где только часть параметров активируется для каждого запроса, что позволяет держать модель огромной, но платить как за среднюю) на 1.6 триллиона параметров — это флагман линейки DeepSeek, который до этого момента был в превью с апреля 2026. За прошедшие месяцы DeepSeek закрыла несколько давних открытых проблем: перевела модель в стабильную ветку, зафиксировала формат API, стабилизировала ценообразование. Бенчмарки опубликованы только в WeChat-группе DeepSeek для разработчиков, откуда через Reddit и Hacker News просочились в открытый доступ. В самих бенчмарках модель конкурирует с Claude Fable 5 и GPT-5.6 Sol, но без полного независимого аудита.
Самое интересное в DeepSeek V4 Pro 0813 — это разница в подаче. Anthropic релиз Fable 5 обставила шестинедельной маркетинговой кампанией. OpenAI показывала GPT-5.6 Sol на отдельном мероприятии с живой демкойцией. DeepSeek просто молча выложила чекпойнт и обновила документацию. Если судить по тому, как Simon Willison и другие западные обозреватели это освещают, у DeepSeek просто нет инфраструктуры пиара, и они этим не заморачиваются. Модель продаёт себя сама через OpenRouter и Hugging Face — через те же каналы, через которые её скачают исследователи и стартапы.
Simon Willison в тот же день заметил ещё одну интересную деталь: V4 Pro при генерации изображений на трёх уровнях рассуждений (низкий, средний, высокий) выдаёт настолько разные стили, что это похоже на работу трёх разных моделей, а не одной. Это редкое явление и потенциально сильный аргумент в пользу того, что DeepSeek нашла способ разводить рассуждающую и креативную части модели через разные пути внутри MoE. Если это правда, это инженерный прорыв, который пока никто не прокомментировал.
Grok 4.6: половина цены конкурентов с сопоставимым уровнем
Третий релиз дня — Grok 4.6 от xAI, опубликованный в блоге компании и сразу доступный в Cursor, Grok Build и приложении Grok. Модель построена на Grok 4.5 с фокусом на долгоиграющих агентах и амбициозных визуальных проектах. Главные цифры из официального анонса: 61 балл по AA Intelligence Index (это композитный индекс из девяти бенчмарков, где Grok 4.6 сравнивается с GPT-5.6 Sol Max — 61 балл, и Fable 5 Max — 62 балла). То есть Grok 4.6 де-факто догнал лидеров индустрии, оставаясь позади на один-два балла. На отдельных бенчмарках — например, GDPVal-AA v2 — Grok 4.6 даже опережает GPT-5.6 (1753 против 1728).
Цена — это вторая часть новости. По тарифам xAI, Grok 4.6 стоит $2 за миллион входных токенов и $6 за миллион выходных. Это те же цифры, что у Qwen3.8-Max (тоже $2/$6). И это примерно половина того, что берёт Anthropic за Claude Fable 5 ($5/$25). Если смотреть на соотношение цена-качество, Grok 4.6 оказывается в уникальной позиции: модель уровня frontier по цене, которая ещё полгода назад была бы нижней среднего сегмента.
Третья часть — инженерная. xAI пишет, что Grok 4.6 прошёл через более длинный финальный этап дообучения, чем Grok 4.5, с курируемыми данными, сгенерированными самой моделью, для рассуждений и продвинутых технических концепций. Затем они использовали Grok 4.5 для перегенерации SFT-траекторий (траекторий supervised fine-tuning, то есть дообучения на размеченных примерах) по рассуждениям, агентским средам и доменам вроде STEM, разработки ПО и knowledge work, отфильтровали проблемные траектории модельными проверками, и поверх этого накатили RL-этап (reinforcement learning, обучение с подкреплением) на широком наборе агентских задач. Это звучит как стандартный пайплайн, но в сочетании с «самой моделью для генерации данных дообучения» это попытка выжать максимум из уже выпущенной модели 4.5 для производства 4.6 — то есть попытка ускорить итерации без необходимости каждый раз запускать обучение с нуля. Если этот подход работает систематически, он объясняет, почему xAI удаётся выпускать новые версии так часто.
Доступность. Grok 4.6 в день релиза доступен в Cursor (популярный редактор для работы с ИИ) и Grok Build с двойной квотой на первую неделю. Это означает, что Cursor — главный конкурент Claude Code на рынке ИИ-кодинга — теперь из коробки работает с моделью, которая по уровню соответствует Claude Fable 5. Если вы платите за Cursor и Anthropic API, есть смысл переключиться на Cursor + xAI: экономия на API-расходах может быть существенной.
Что общего у трёх релизов
Если отвлечься от маркетинга и посмотреть на цифры, 12 августа 2026 зафиксировал три вещи, которые важны для всей индустрии.
Первое — китайские лаборатории вышли на паритет с американскими frontier-моделями, но дешевле. Qwen3.8-Max-Preview и DeepSeek V4 Pro 0813 на основных бенчмарках находятся в пределах одного-двух баллов от Claude Fable 5 и GPT-5.6 Sol Max. И стоят в два-три раза дешевле. Это означает, что аргумент «китайские модели слабее западных» больше не работает на уровне флагманов. Он ещё работает на уровне открытых моделей среднего размера (где Qwen и DeepSeek заметно сильнее Llama или Mistral), но не на уровне frontier.
Второе — открытые веса стали нормой, а не исключением. До этого года открытие весов frontier-модели было событием: DeepSeek V2 весной 2025 года, Llama 3 летом 2024 года. Сейчас Alibaba открывает 2.4-триллионную модель в специальной, но всё-таки открытой лицензии. Mistral, DeepSeek и Alibaba уже конкурируют не за то, открывать или нет, а за то, насколько свободной будет лицензия. Anthropic, OpenAI и Google остаются единственными крупными лабораториями, которые систематически не открывают веса своих флагманов — и это начинает выглядеть не как стратегия, а как отставание.
Третье — ценовая война вышла на новый уровень. Qwen3.8-Max и Grok 4.6 одновременно установили цену $2/$6 за миллион токенов для модели уровня frontier. Это ставит Anthropic и OpenAI в неудобную позицию: держать Fable 5 за $5/$25 можно, только если ваше УТП (уникальное торговое предложение) — это экосистема, инструменты или что-то ещё кроме самой модели. Claude Code как продукт продолжает удерживать клиентов даже при такой разнице в цене API, потому что люди платят за интеграцию, а не за токены. Но это аргумент уже не про модели, а про дистрибуцию.
Что не так с этими релизами
Эта история была бы слишком красивой, если бы я не добавила оговорок.
У Qwen3.8-Max-Preview нет полной публикации бенчмарков. Alibaba опубликовала таблицу на 40 строк в день релиза, но многие из этих строк — это варианты одних и тех же бенчмарков в разных конфигурациях. Независимых аудитов пока мало, и Roboflow на момент публикации своего поста видел только результаты по object detection. По другим задачам (рассуждение, агентские среды, длинный контекст) цифры приходят от самой Alibaba, а это значит, что они выбрали те бенчмарки, на которых модель выглядит сильно. Дополнительно — обещанная Qwen3.8-27B так и не появилась на 12 августа, что говорит о том, что расписание открытия весов у Alibaba немного скользит.
У DeepSeek V4 Pro 0813 — отсутствие публичного пресс-релиза и непрозрачная публикация бенчмарков (через WeChat). Если вы пытаетесь принять решение, использовать эту модель в продакшене, вы будете опираться на собственные тесты, а не на заявленные цифры. Это нормально для зрелой команды, но плохо для тех, кто хочет один источник правды.
У Grok 4.6 — сохранены проблемы Grok 4.5. В xAI не публиковали отдельный system card (формальный документ с описанием поведения и ограничений модели), ограничившись пост-блогом. Это значит, что независимая оценка поведения модели (red teaming, тесты на безопасность, отчёт о предвзятости) — за пределами публичного поля. Grok исторически имел проблемы с генерацией дезинформации и неуместным юмором; пока не доказано обратное, эти проблемы перенесены в 4.6.
И ещё — день, в который три лаборатории одновременно выпускают релизы, это ещё не регулярность. Сентябрь может быть тише, и тогда этот день окажется просто совпадением, а не началом нового ритма индустрии. Но если 9 сентября или 23 августа мы увидим ещё одну такую синхронность, тогда можно будет говорить о новом паттерне.
Итого
12 августа 2026 войдёт в историю AI как день, когда китайские лаборатории и xAI одновременно показали, что frontier-модели можно выпускать по цене в два-три раза ниже, чем у Anthropic и OpenAI. Qwen3.8-Max открыл 2.4 триллиона параметров под специальной лицензией. DeepSeek V4 Pro 0813 тихо вышел в GA. Grok 4.6 встал на один уровень с Fable 5 по качеству, оставшись вдвое дешевле. Ни один из этих релизов сам по себе не переворачивает индустрию. Но три одновременно — это уже не совпадение, это сигнал о том, что конкуренция на уровне frontier перешла из категории «кто круче» в категорию «кто дешевле за сопоставимый уровень». И в этой новой категории Anthropic и OpenAI пока проигрывают.
Если вы выбираете модель для продакшена сегодня — стоит хотя бы прогнать бенчмарк на Qwen3.8-Max-Preview или DeepSeek V4 Pro 0813. Если вы платите за Claude API больше $1000 в месяц — стоит посчитать, сколько вы бы сэкономили, переключившись на xAI или Qwen. А если вы просто следите за индустрией — 12 августа 2026 был тот день, когда счётчик цен на API frontier-моделей начал падать.
Источники: xAI — Introducing Grok 4.6, xAI Release Notes, Simon Willison — DeepSeek V4 Pro 0813 (on OpenRouter), OpenRouter — DeepSeek V4 Pro 0813, Digital Applied — Qwen3.8-Max Full Release, Roboflow — Qwen3.8-Max for Vision, Basenor — xAI Launches Grok 4.6: 1753 ELO, OrcaRouter — Grok 4.6 Release Date.
Комментарии ()