Когда компания публикует release notes раз в две недели, это не просто корпоративная дисциплина — это признак того, что продукт живёт и меняется быстро. С ноября 2024 по июль 2026 года xAI добавила в свой API столько всего, что уследить за отдельными апдейтами почти невозможно. Попробуем разобраться системно: что важно для разработчиков, что меняет жизнь маркетологам и контентщикам, и где скрыты детали, которые с первого раза не бросаются в глаза.
В апреле 2025 года вышли Grok 3 модели в API. Потом, в июле 2025 — Grok 4. Казалось бы, линейная эволюция. Но параллельно появился Grok 4.20 в марте 2026 (с multi-agent режимом), а в июле 2026 — Grok 4.5, заточенный под кодинг и агентные задачи.
Цена Grok 4.5: $2 за миллион входных токенов и $6 за миллион выходных. Плюс настраиваемое reasoning effort: low, medium или high (по умолчанию high). Это важная деталь — если вам нужно просто суммировать текст, не надо платить за полный цикл рассуждений модели.
Отдельно стоит Grok Build. Сначала в мае 2026 появилась версия 0.1 в early access, потом быстро перешла в бету. Это coding-специфическая модель с собственным CLI, поддержкой headless-режима и протоколом Agent Client Protocol. Устанавливается одной командой через curl. Для тех, кто строит автоматизированные coding-агенты — это интересно.
Пожалуй, самый насыщенный блок API xAI обновления за последний год — это голосовые возможности. Разворачивалось поэтапно.
Декабрь 2025: запустили Voice Agent API. Март 2026: появился Text-to-Speech в общем доступе. В апреле 2026 вышел grok-voice-think-fast-1.0 для Voice Agent API. Немного позже, также в апреле, запустился Speech-to-Text на 25 языках — с пакетным и стриминговым режимами.
В мае 2026 добавили Smart Turn — это ML-модель, которая определяет, закончил ли говорящий мысль на паузе. Звучит как техническая мелочь, но на практике это критично для диктовки и голосовых ассистентов: без Smart Turn система «обрезает» фразы посередине. Настраивается через параметр smart_turn, максимальный таймаут тишины задаётся через smart_turn_timeout.
В мае же появились Custom Voices — клонирование голоса из короткого аудиоклипа. Каталог голосов управляется через консоль xAI. Для брендов, которые хотят единый голосовой стиль коммуникации, это открывает ощутимые возможности — особенно если вы уже ведёте авто-блог на базе ИИ и хотите дополнить его аудио-форматом.
Январь 2026: видеогенерация и обновлённая генерация изображений. Март 2026: Batch API начал поддерживать image и video generation. Май 2026: поиск изображений в Web Search (параметр enable_image_search).
Июнь 2026 принёс интересную связку: Public URLs для Files API и интеграцию файлов с Imagine. Теперь можно не перезагружать файлы каждый раз, а ссылаться на image_file_id или video_file_id напрямую. Сохранение результатов генерации в Files с одновременной публикацией через storage_options.public_url — это один round trip вместо нескольких шагов. Мелкая, но приятная оптимизация пайплайна для тех, кто строит, например, контент-завод для бизнеса.

Октябрь 2025 — инструменты для агентов вышли в general availability: web_search, x_search, code_execution. Ноябрь 2025 — Grok 4.1 Fast в Enterprise API, и цены на agent tools упали до $5 за 1000 успешных вызовов (снижение до 50%). Это существенно — агентные пайплайны быстро накапливают стоимость на tool calls.
В мае 2026 одновременно появились три вещи, которые меняют архитектуру агентных систем. Первое — Context Compaction API: сжимает длинные диалоги в более короткий контекст, который можно переиспользовать. Снижает стоимость, ускоряет time-to-first-token. Для долгих агентных циклов это не просто удобство, а экономия.
Второе — WebSocket Responses API Mode. Одно долгоживущее WebSocket-соединение вместо серии HTTP-запросов, когда у агента много tool calls. Задержка ниже — и это чувствуется именно в сложных сценариях с цепочками инструментов.
Третье — Files API с TTL. Можно задать expires_after или явный expires_at для загруженных файлов. Автоматическое удаление по истечении срока. Простая вещь, но без неё хранение файлов быстро превращается в свалку.
Апрель 2026: Cost Tracking. Каждый API-ответ теперь включает точную стоимость запроса в поле cost_in_usd_ticks в объекте usage. Работает для чат-комплишнов, Responses API, генерации изображений и видео, стриминга. Это одна из тех функций, которую разработчики просили давно — контролировать расходы на уровне каждого запроса, а не только через биллинговый дашборд.
Июнь 2026: Priority Processing. Параметр service_tier: “priority” для text inference endpoints. Если вам нужен более высокий приоритет планировщика для конкретного запроса, платите только тогда, когда используете эту опцию. Логика понятная.
Посмотрите на всё это как на набор кирпичей. Отдельно каждый из них интересен. Вместе они позволяют строить системы, которые ещё год назад требовали стыковки нескольких провайдеров: голос, изображения, видео, поиск, агентные инструменты — всё в одном API.
Возьмём конкретный сценарий: автоматизированный контент-пайплайн для бренда. Нужны статьи, изображения, короткие видео и голосовое озвучивание в корпоративном стиле. До обновлений xAI это требовало как минимум трёх разных провайдеров и соответствующей интеграционной головной боли. Сейчас — один API с общей системой управления файлами, единым биллингом и Cost Tracking для контроля расходов. Примерно так устроен подход, который мы описывали в кейсе внедрения авто-блога для промышленной компании — только там использовался Claude Sonnet 4, а сейчас в этот стек логично добавляется xAI для голосовых и видео-задач.
Ещё один момент, который недооценивают: Context Compaction в сочетании с WebSocket API реально меняет то, как работают долгие агентные сессии. Если агент обрабатывает большой документ или ведёт длинный диалог с несколькими tool calls, эти две функции в связке снижают и задержку, и стоимость. Для генерации видеоконтента для брендов с итеративными правками это может быть заметно.

Честно: темп релизов впечатляет, но местами чувствуется, что документация не успевает за кодом. Smart Turn появился в конце мая 2026 — а описание поведения smart_turn_timeout в edge cases пока скудное. Это не критика, это просто реальность быстроразвивающегося API.
Стоит также отметить, что Grok Build 0.1 всё ещё в early access — то есть стабильности production-level ожидать не стоит. Это эксперимент, который интересно наблюдать, но строить на нём продакшн сейчас рискованно.
И ещё: Priority Processing — отличная опция, но если все начнут ставить service_tier: “priority” по умолчанию, смысл приоритизации теряется. Это работает ровно до тех пор, пока приоритетный трафик остаётся меньшинством.
Если вы работаете с API xAI обновления стоит мониторить в двух направлениях. Первое: агентная инфраструктура — Grok 4.20 Multi-agent и Grok Build развиваются быстро, и multi-agent coordination может стать заметным конкурентным преимуществом. Второе: голосовые возможности — Custom Voices плюс Smart Turn плюс Voice Agent API — это уже достаточно зрелый стек для production, особенно если ваш продукт требует брендированного голосового взаимодействия.
Для тех, кто строит автоматизированные системы контента или агентные пайплайны, просматривать готовые ИИ-автоматизации имеет смысл именно сейчас: инструментарий дозрел до уровня, где сложные сценарии реализуются с предсказуемым результатом. Двух лет назад такого выбора просто не было.
