23 августа 2026 года рынок искусственного интеллекта выдал очередную порцию новостей, которую сложно уложить в одну тему. Здесь и ценовые войны между флагманами, и открытые веса от китайских гигантов, и история про то, как модель для написания кода внезапно научилась взламывать системы лучше, чем планировалось. Начнём с самого неожиданного.
14 августа 2026 года компания Z.ai выпустила GLM-5.3 – обновление своей кодинг-модели GLM-5.2. Технически это тот же базовый foundation model, все улучшения пришли исключительно через post-training. Компания сообщает о 50-процентном росте на внутреннем бенчмарке Code Bench и о лидерстве среди open-source моделей на Terminal-Bench 3.0: 28,3% против 4,6% у предшественника. Прогресс впечатляющий.
Но главная история не в бенчмарках. В ходе работы с внешними командами безопасности GLM-5.3 обнаружила 2 436 уязвимостей в 269 реальных программных проектах. Из них 1 097 получили оценку средней или высокой степени серьёзности – в ядре Linux, браузерном движке WebKit, операционной системе FreeBSD. Модель уже успела найти проблему в Cursor, инструменте для разработки, который недавно приобрела SpaceX.

Именно поэтому открытые веса модели задержались примерно на две недели: навыки в области кибербезопасности выросли быстрее, чем рассчитывала компания. GLM-5.3 стала первой в серии GLM, где публикация весов требует дополнительной проверки. Параллельно Z.ai запустила OpenVuln – сканер уязвимостей на базе той же модели, пока доступный только избранным партнёрам по безопасности.
Доступ к модели открыт через GLM Coding Plan от $18 в месяц и через инструмент ZCode. Полный API и скачиваемые веса ожидаются в конце августа. Независимые тесты показывают, что GLM-5.3 пока уступает Anthropic Fable 5 и OpenAI GPT-5.6 Sol на самых сложных кодинг-задачах – но разрыв сокращается.
21 августа 2026 года OpenAI снизила цену на флагманский GPT-5.6 Sol более чем на 20% – акция действует минимум до 21 ноября. Теперь: $4 за миллион входных токенов и $20 за миллион выходных, против прежних $5 и $30. Sol – старший в трёхмодельной линейке GPT-5.6, рядом с Terra (средний сегмент) и Luna (бюджетный). Это уже третье снижение цен за короткий срок: в июле OpenAI урезала Luna на 80%, Terra – на 20%.
Для компаний, которые строят готовые ИИ-автоматизации для бизнеса поверх API OpenAI, такая динамика меняет экономику продукта буквально за недели. Снижение цены на Sol – это сигнал, что OpenAI ставит на объём, а не только на премиальность.
Google выпустила Gemini 3.7 Flash 13 августа 2026 года, назвав её «самой умной рабочей лошадкой» для кодинга и AI-агентов. Цена до конца 2026 года: $0,75 за миллион входных токенов и $3,75 за выходные – вдвое ниже, чем у Gemini 3.6 Flash при запуске три недели назад. На собственных бенчмарках Google: FrontierCode 1.1 Main вырос с 34,4% до 43,6%, DeepSWE v1.1 – с 49,0% до 65,3%.
Есть нюанс: с 1 января 2027 года цена удваивается – до $1,50 и $7,50 за миллион токенов. Так что текущие тарифы это ограниченное окно, а не постоянная политика. Gemini 3.7 Flash теперь также работает в Gemini Spark, личном AI-агенте Google, для подписчиков в более чем 160 странах.
13 августа DeepSeek перевёл V4-Pro из режима превью в полноценный релиз – через четыре месяца после первого показа в апреле. Модель V4-Pro-0813 набрала 87,9 балла на Terminal Bench 2.1 и 62,7 на DeepSWE. Архитектура: 1,6 трлн параметров, контекстное окно в 1 млн токенов.
Вместе с релизом пришли новые тарифы с делением на пиковые и непиковые часы. Выходные токены в пиковое время теперь стоят $3,96 за миллион – против прежних $0,87. Рост до 1 100% на некоторых типах токенов. DeepSeek по-прежнему дешевле большинства западных конкурентов, но разрыв сокращается. Параллельно компания, по имеющимся данным, привлекает около $8 млрд при оценке примерно в $74 млрд.
В начале августа Alibaba выпустила Qwen3.8-Max – свою крупнейшую модель – и выполнила обещание открыть веса, опубликовав их на Hugging Face примерно 12-14 августа. Модель содержит 2,4 трлн параметров, но активирует лишь 95 млрд на каждый запрос. Контекстное окно – 1 млн токенов, поддержка текста, изображений и видео.
Это первый раз, когда Alibaba открывает модель класса Max. Одновременно вышла Qwen3.8-27B под лицензией Apache 2.0 – работает на одной обычной потребительской видеокарте. Но здесь важная оговорка: скачиваемая версия Qwen3.8-Max поддерживает только текст. Полный мультимодальный пакет доступен только через платный API Alibaba – $2 за миллион входных токенов и $6 за выходные.

Meta выпустила Muse Spark 1.2 и первый терминальный кодинг-агент Muse Code 5 августа 2026 года. Spark 1.2 частично обучалась на данных, сгенерированных предыдущей версией модели – своеобразный цикл самосовершенствования. Цены прежние: $1,25 за миллион входных токенов и $4,25 за выходные. На Terminal-Bench 2.1 Spark 1.2 набирает 82,9% против 86,7% у Claude Opus 5 – отставание есть, но Meta явно делает ставку на цену, а не на абсолютный результат.
10 августа Meta открыла веса Muse Glimmer – компактной модели в 30 млрд параметров для локальных кодинг-агентов. Работает полностью офлайн на одной видеокарте с 24 ГБ памяти, лицензия Apache 2.0. Это третий релиз Muse Spark за четыре месяца – темп неожиданный для компании, которая вышла на рынок платных AI-моделей только в июле.
Moonshot AI готовит разделение тарифов для Kimi K3: общий Kimi Membership и отдельный Kimi Code Membership. По состоянию на 20 августа соответствующий баннер уже появился на kimi.com. Kimi K3 – крупнейшая открытая модель на сегодня с 2,8 трлн параметров – в прошлом месяце временно приостанавливала регистрацию из-за перегрузки вычислительных мощностей. Разделение потоков – прагматичный ответ на эту проблему.
OpenAI тестирует режим Ultrafast для GPT-5.6 Sol – по заявлениям компании, он работает до 14 раз быстрее стандартной версии за счёт специализированного железа Cerebras. Пока доступ ограничен избранными клиентами. Сотрудники OpenAI уже используют его для анализа системных логов в режиме реального времени и для исследовательских итераций, которые раньше занимали ночь. Бизнес может встать в очередь, описав свои требования к задержке.
С 14 августа Anthropic включила Auto Mode по умолчанию в Claude Code для аккаунтов Pro, Max и Team. Режим позволяет агенту выполнять многошаговые задачи с меньшим числом подтверждений от пользователя. Отдельная история – цифровые водяные знаки. С 2 августа Anthropic добавляет машиночитаемые метки в текст и файлы, создаваемые моделями Claude, – для соответствия требованиям Акта ЕС об ИИ. Правило распространяется на пользователей по всему миру, а не только в Европе. Штрафы за несоблюдение – до 15 млн евро или 3% глобальной выручки. Водяной знак встроен в текст и выживает при копировании, но, по признанию Anthropic, легко удаляется при пересохранении или скриншоте.
Для тех, кто строит авто-блог на базе нейросетей, это важный сигнал: контент, генерируемый Claude, теперь несёт невидимую метку. Стоит учитывать при планировании контентных автоматизаций.
По данным Bloomberg от 12 августа, Cognition AI – создатель кодинг-ассистента Devin – ведёт переговоры о новом раунде финансирования при оценке свыше $40 млрд. Это более чем на 50% выше оценки в $26 млрд, зафиксированной менее трёх месяцев назад. Выручка компании, по имеющимся данным, приближается к $1 млрд в годовом исчислении – примерно вдвое больше, чем на предыдущем раунде. Для контекста: по оценкам аналитиков, глобальные инвестиции в AI только за первое полугодие 2026 года превысили $407 млрд – больше, чем за весь 2025 год.
Август 2026-го показал несколько вещей разом. Ценовые войны между OpenAI и Google реальны и ускоряются – для бизнеса это прямая экономия на токенах уже сейчас. Открытые модели перестали быть уделом энтузиастов: Alibaba открывает 2,4-триллионную архитектуру, Meta выпускает модель для офлайн-запуска на обычной видеокарте. Кибербезопасность становится отдельным измерением AI benchmark – история GLM-5.3 это наглядно демонстрирует.
Если вы строите продукты на базе AI-моделей или думаете о интеграции передовых нейросетей в свои сервисы, этот месяц дал конкретные ориентиры: цены снижаются, открытых опций становится больше, а регуляторное давление (водяные знаки, EU AI Act) уже меняет поведение крупнейших лабораторий. Новости искусственного интеллекта перестали быть абстрактными – они напрямую влияют на стоимость и архитектуру продуктов прямо сейчас.
