Новые ИИ модели 2026: девять релизов августа и тихая война цен между DeepSeek, Google и Anthropic

9 мин чтения
Поделиться
Сейчас читаетеДевять релизов за двадцать дней

В августе 2026 года шесть лабораторий выпустили девять моделей, но главная интрига месяца оказалась не в бенчмарках, а в прайс-листах. DeepSeek, Google и Anthropic за две недели по-разному переписали смысл слова "цена", и это касается почти каждого, кто выбирает новые ИИ модели 2026 года для своих проектов.

За двадцать один день, с 3 по 20 августа, вышло девять моделей от шести разработчиков: от гигантского MoE-флагмана на 2,4 триллиона параметров до компактного переводчика с восемью тысячами токенов контекста. На первый взгляд, обычный рабочий месяц. Но если читать не только таблицы бенчмарков, а страницы с тарифами, картина куда любопытнее. DeepSeek, Google и Anthropic за одну и ту же неделю по-разному пересобрали то, что значит "опубликованная цена" для клиента. Кто-то поднял тариф под видом скидки, кто-то снизил его с таймером до конца года, а кто-то вовсе отменил запланированное подорожание. Разберем, что именно вышло в августе, куда сдвинулись цены и какие новые ИИ модели 2026 года стоит хотя бы протестировать на своей инфраструктуре.

Девять релизов за двадцать дней

Список получился плотным, и его удобно держать перед глазами целиком:

  • Qwen3.8-Max (Alibaba, 3 августа) - флагманская MoE-модель на 2,4 трлн параметров с 95 млрд активных, $2/$6 за миллион токенов на вход и выход, веса опубликованы 13 августа под кастомной лицензией.
  • Muse Spark 1.2 (Meta, 5 августа) - платная агентная модель с контекстом 1 млн токенов, $1.25/$4.25.
  • Muse Glimmer (Meta, 10 августа) - компактная модель на 29,6 млрд параметров под Apache 2.0, работает на одной потребительской видеокарте.
  • Grok 4.6 (xAI, 12 августа) - фронтир-модель с контекстом 500К токенов, $2/$6, но кешированный вход подорожал.
  • Gemini 3.7 Flash (Google, 13 августа) - $0.75/$3.75, вводная ставка с истечением срока.
  • GLM-5.3 (Z.ai, 14 августа) - агентный флагман на базе GLM-5.2.
  • Qwen3.8-27B (Alibaba, 14 августа) - только веса, Apache 2.0, без порога по выручке.
  • Hy-MT2-30B-A3B и Hy-MT2-1.8B (Tencent, 20 августа) - переводческие модели, 33 языковые пары, контекст всего 8К токенов.

Заметен ритм: пять релизов зажаты между 10 и 14 августа, два из них вышли в один день, а дальше пауза до 20-го числа. И вот что интересно: то, что появилось во второй половине месяца, моделью в привычном смысле уже не было. Это был прайс-лист на модель, которая вышла раньше.

Ценовая перестройка: три лаборатории, три разных решения

Три компании за две недели поменяли значение собственного прайс-листа тремя разными способами, и только одно из этих изменений оказалось честным снижением цены.

DeepSeek: скидка, которая обернулась подорожанием

С 16:00 UTC 16 августа DeepSeek переходит на пиковые и непиковые тарифы, где непиковая ставка формально составляет половину пиковой. Звучит как экономия. На практике DeepSeek V4 Pro сейчас стоит $0.435 за вход и $0.87 за выход на миллион токенов. После смены схемы непиковая цена станет $0.66 и $1.98, а пиковая $1.32 и $3.96. Даже самый дешевый час нового расписания обходится дороже вдвое, чем модель стоит сегодня, а самый дорогой час стоит уже вчетверо больше нынешней цены на выход.

Google: щедрость с таймером до 2027 года

Gemini 3.7 Flash вышел 13 августа по $0.75/$3.75 за миллион токенов. Google прямо пишет: это вводная цена, и 1 января 2027 года она удвоится до $1.50/$7.50, а стоимость кеша контекста вырастет с $0.075 до $0.15. Занятная деталь: та же страница тарифов теперь показывает и предыдущую модель, Gemini 3.6 Flash, вышедшую в июле по $1.50/$7.50, по той же сниженной ставке $0.75/$3.75. То есть цена на прошлое поколение упала вдвое спустя примерно три недели после запуска нового, и тоже с истечением срока в конце года.

Anthropic: единственный, кто отменил рост

Здесь стоит сделать паузу, потому что это редкий случай. Claude Sonnet 5 вышел 30 июня по $2/$10 за миллион токенов как вводная цена до 31 августа, с возвратом к $3/$15 с 1 сентября. Anthropic на странице тарифов теперь прямо указывает: $2/$10 становится постоянной ценой, а запланированное повышение до $3/$15 с 1 сентября 2026 года не состоится. Тем, кто планировал сентябрьскую миграцию с Sonnet 5 именно ради ухода от 50-процентного роста цены, можно отменять план.

type=chart | about=как три лаборатории по-разному изменили цену за одну и ту же модель в августе 2026 | headline=Одна модель, два прайса | chart_type=bar | data=DeepSeek непик:1.98; DeepSeek пик:3.96;

Три лаборатории, три философии в одном месяце. Кто-то режет цену будущим клиентам, зная, что через полгода отыграет разницу. Кто-то делает вид, что дает скидку, хотя на деле поднимает тариф. А кто-то просто отменяет собственное решение, потому что может себе это позволить. Для тех, кто выбирает новые ИИ модели 2026 года под конкретный проект, это значит одно: смотреть нужно не только на цену запуска, а на дату, к которой она привязана.

Открытые веса - не значит открытая лицензия

Здесь путаница особенно частая, и разработчики в этом отчасти виноваты сами: слово "open" в описании модели давно перестало гарантировать что-либо конкретное.

Qwen3.8-Max: скачать можно, вести на нем бизнес - не всегда

Alibaba опубликовала веса Qwen3.8-Max 13 августа, но лицензия там не Apache 2.0, а кастомная. Если у компании более 100 млн активных пользователей в месяц или выручка выше $20 млн в месяц, название модели нужно указывать открыто. Более жесткое условие иное: если совокупная выручка бизнеса, построенного на модели-как-сервисе или ИИ-ассистенте, превышает $50 млн за любые двенадцать месяцев подряд, нужна отдельная лицензия от Qwen. Внутреннее использование под это правило не подпадает, так что компания, гоняющая модель на своих задачах, ничем не рискует. А вот тот, кто продает доступ к инференсу как услугу, уже рискует.

Muse Glimmer: редкий пример честного Apache 2.0

Meta опубликовала Muse Glimmer на Hugging Face под обычной лицензией Apache 2.0, без дополнений об использовании и без порога по выручке. Это плотная модель примерно на 29,6 млрд параметров с окном контекста 131 072 токена, и в 4-битном квантовании она укладывается меньше чем в 20 ГБ, то есть помещается на одну игровую видеокарту 24 или 32 ГБ. Есть нюанс: независимая оценка Artificial Analysis дает модели 35 баллов по Intelligence Index при высоком уровне усилий, тогда как заявленные разработчиком цифры выглядят заметно выше. Это самый большой разрыв между собственными и независимыми оценками среди всех августовских релизов, и его стоит держать в голове перед тем, как строить продукт только на цифрах из презентации.

type=diagram | about=разница между лицензиями открытых весов Qwen3.8-Max и Muse Glimmer | steps=Muse Glimmer: Apache 2.0 -> без порога выручки -> запуск на одной видеокарте // Qwen3.8-Max: кастомная л

Занятно, что в этом же окне вышел Qwen3.8-27B от Alibaba, 14 августа, и на этот раз без порога по выручке, тоже под Apache 2.0. Получается, что одна и та же компания за одиннадцать дней выпустила две модели с прямо противоположной коммерческой логикой лицензирования. Совпадение? Вряд ли, скорее осознанная сегментация: флагман закрывают юридически, младшую модель отдают почти без ограничений.

GLM-5.3: тот же движок, другая тренировка, старая цена

Z.ai выпустила GLM-5.3 14 августа, и это, пожалуй, самая интересная инженерная история месяца, хотя экономически на старте она была почти пустой. Компания прямо говорит: это не новая базовая модель, а тот же фундамент, что у GLM-5.2, с масштабированным пост-тренингом. Результаты сконцентрированы именно там, где это ожидаемо для пост-тренинга, а не для смены архитектуры: на длинных агентных задачах. Terminal-Bench 3.0 вырос с 4.6 до 28.3, DeepSWE v1.1 с 46.2 до 66.9. Все эти цифры пока собственные, независимая проверка не проводилась.

Четыре дня у модели вовсе не было цены. Потом на странице тарифов Z.ai появилась ставка $1.40 за вход, $0.26 за кешированный вход и $4.40 за выход на миллион токенов, и это ровно та цена, что уже была у GLM-5.2 и у GLM-5.1 до него. Три поколения подряд по одной ставке. На фоне остального августа это скорее исключение: Google урезал Flash-тариф с таймером, DeepSeek разбил единую ставку на две по часам суток, а Z.ai просто оставил цену без изменений, хотя заявляет о шестикратном росте на одном из бенчмарков. Веса при этом еще не опубликованы, обещаны примерно через две недели после запуска, лицензия заранее не названа.

Какую модель выбрать прямо сейчас

Если отталкиваться от проверенных ставок и независимых оценок, а не только от заявлений на старте, картина такая:

  • Самый дешевый рабочий вариант сегодня - Gemini 3.7 Flash по $0.75/$3.75 с 56 баллами Intelligence Index. Но поставьте себе напоминание на 1 января: тариф удвоится.
  • Верх таблицы по качеству - Claude Opus 5 с 63 баллами, следом Grok 4.6 и GPT-5.6 Sol с 61 баллом каждый. Grok 4.6 при этом заметно дешевле остальных лидеров, $2/$6, хотя кешированный вход у него подорожал.
  • Самостоятельный запуск с коммерческим прицелом - Muse Glimmer, если важнее всего чистая лицензия без порога по выручке, либо Qwen3.8-Max, если важнее сила модели, но тогда обязательно читайте пункт про $50 млн.
  • Долгие агентные сценарии - GLM-5.3 по цене GLM-5.2, финансового аргумента против апгрейда просто нет, но и независимого подтверждения заявленного скачка пока тоже нет.

Отдельно стоит сказать тем, кто сейчас на DeepSeek: пиковые тарифы уже действуют с 16 августа, и это уже отразилось на реальных счетах. А тем, кто планировал сентябрьский переход с Claude Sonnet 5 именно из-за грядущего подорожания, план можно смело отменять: повышения не будет.

Ни OpenAI, ни сама Anthropic новых моделей в августе не выпускали. GPT-6 остается слухом без страницы модели и без даты, а Gemini 3.5 Pro от Google DeepMind так и числится анонсированной с мая, но без конкретного срока. Похоже, следующий заметный сдвиг в списке новых ИИ моделей 2026 года случится не раньше осени, и, возможно, снова не там, где его ждут, в разделе цен, а не в разделе бенчмарков.

Что в остатке? Август показал, что таблица лидеров по качеству перестала быть единственным инструментом выбора модели. Прайс-лист теперь такой же живой объект, как и сам foundation model: он двигается, у него бывают сроки годности, и иногда он меняется сильнее, чем сама архитектура под капотом. Для команд, которые каждый месяц пересчитывают бюджет на инференс, это не мелочь, а фактически новый параметр планирования наравне с контекстным окном и скоростью ответа.

type=cta | about=выбор и внедрение подходящей ИИ-модели под задачи бизнеса с учетом августовских изменений цен | hook=Какую ИИ-модель выбрать для вашего бизнеса?

Проверить факты

Источники и материалы

Материалы, на которые опирается статья.

  1. 01 capitalandcompute.netНовые ИИ модели 2026: девять релизов августа и тихая война цен между DeepSeek, Google и Anthropic

Читайте также

30.08.2026Локальный искусственный интеллект в августе 2026: три флагмана за четыре дня и гонка рантаймов 30.08.2026Генерация видео Alibaba Wan3: 30 секунд из PDF, цена вчетверо ниже Google 29.08.2026Выход ИИ из-под контроля: в июле 2026 года зафиксировано более 300 инцидентов за месяц

Расскажите о задаче

Начнём с короткого разговора

Оставьте имя и телефон — мы свяжемся с вами и уточним детали.

Форма защищена Yandex SmartCaptcha. Сервис обрабатывает технические данные для защиты от автоматических отправок.

Фабио Де Лука · AI

AI-ассистент

Расскажите, что вы хотите улучшить или автоматизировать. Я отвечу по услугам, ценам и AI-интеграциям.