Позвольте начать с цифры, которая действительно удивляет: три крупнейших технологических конгломерата Китая – Tencent, Alibaba и Baidu – одновременно вложили деньги в одну компанию. Это само по себе событие. Эти три игрока конкурируют за одних и тех же клиентов в области AI-видео, Tencent при этом развивает собственную модель Hunyuan. И всё равно все трое написали чеки в Kling. Вот с этого и начнём.
2 июля 2026 года Kuaishou объявил о закрытии раунда финансирования почти в $3 млрд при оценке компании в $18 млрд после сделки. Издание South China Morning Post назвало его «крупнейшим в мире для компании в сфере AI-видеогенерации». Лид-инвесторами выступили CPE Yuanfeng, Guofang Venture Capital, Tencent, Zhongguancun Science City Fund и CITIC Securities, а в числе более чем 38 участников раунда – Alibaba Cloud и Baidu.
Kuaishou сохраняет контроль над компанией: его доля снижается со 100% до 68,33%, остальное распределяется между внешними инвесторами и программой акционирования сотрудников. Раунд повсеместно читается как подготовка к IPO на Гонконгской бирже, которое Kuaishou планирует провести в течение 12 месяцев. Привлечённые средства пойдут на вычислительные мощности и строительство дата-центров.
Выручка под этой оценкой – не история для инвесторов, а реальные цифры. Выручка Kling в первом квартале 2026 года превысила 650 миллионов юаней (около $96 млн), что означает рост более чем на 300% год к году. Аннуализированный темп выручки приближается к $500 млн – это в четыре раза больше, чем год назад. Для сравнения: именно такую траекторию, только с обратным знаком, показал Sora после закрытия в марте 2026 года. Kling наращивает выручку и привлекает рекордный раунд; Sora сжигал деньги без устойчивой бизнес-модели.
Здесь стоит уточнить один момент: слухи о готовящейся сделке ходили ещё в мае, и тогда называлась цифра в $20 млрд. Итоговая оценка оказалась ниже – $18 млрд. Это не провал переговоров, просто полезный ориентир для понимания того, как рынок в итоге оценил компанию.

Параллельно с финансовой новостью произошло кое-что менее очевидное, но, пожалуй, более важное для практиков. За ту же неделю пять разных компаний независимо друг от друга выпустили продукты одного типа – так называемый assembly layer, то есть инструменты для сборки рабочих процессов вокруг видеомоделей.
Pika представила Director’s Suite – экспериментальный таймлайн-редактор для агентного видео со сторибордингом, генерацией клипов и редактированием через чат. Попутно вышли VFX Skill и «4K-VFX» Skill на базе Seedance – последний редактирует существующий клип по единственному промпту, сохраняя лица, жесты, звук и движение камеры. Как раз здесь пригодятся готовые промпты для Seedance 2.0 – они помогают сформулировать нужный результат точнее, чем произвольный запрос.
Runway 8 июля запустил Runway Dev – отдельную платформу для разработчиков и корпоративных клиентов. Один API поверх собственных моделей Runway (Gen-4.5, Aleph 2.0, Act-Two) плюс сторонние модели: Seedance, GPT Image 2, ElevenLabs. «Рецепты» упаковывают экспертизу по промптингу и рабочим процессам в одиночный API-вызов; «Рабочие процессы» позволяют цепочить несколько моделей в кастомные пайплайны. Runway заявляет об уже работающих производственных внедрениях у Adobe, ElevenLabs, Shutterstock, Figma Weave, Gamma и Silverside – это данные самой компании, не независимый аудит.
HeyGen опубликовала данные по своему фреймворку HyperFrames: 1,3 миллиона видео для 267 000 создателей за 90 дней, 32 000 звёзд на GitHub, open-source, запускается внутри Claude Code, Codex и Cursor. Kling закрыл последний пробел в группе из пяти компаний агентной оркестрации: Kling MCP и CLI стали доступны 8 июля, присоединившись к Luma, Adobe, Pika, Runway и Higgsfield. Higgsfield пошла дальше всех в сторону профессионального монтажа – новые плагины интегрируют Gemini Omni Flash и Seed Audio 1.0 прямо в Adobe Premiere Pro и DaVinci Resolve Studio, с поддержкой 18 языков дублирования без выхода из NLE.
Любопытная деталь: четыре независимые компании – Pika, Luma, Runway и HyperFrames – независимо друг от друга использовали слово «Skills» для обозначения одной и той же идеи портативных агентных рабочих процессов. Никакой координации не было. Это либо случайность, либо признак того, что индустрия нащупала реальную концепцию.
Для тех, кто строит контент-завод на ИИ, это принципиально важный сигнал: конкурентное преимущество сегодня не в доступе к той или иной модели, а в том, как именно организован процесс вокруг неё.
7 июля 2026 года Meta Superintelligence Labs представила Muse Video вместе с Muse Image – первые собственные модели изображений и видео, после нескольких лет лицензирования моделей у Midjourney и Black Forest Labs. Muse Video построена на той же базе предобучения, что и Muse Image, генерирует видео с нативным звуком. Meta признаёт недоработки напрямую – в блоге названы «синхронизация аудио и видео» и «физически точное быстрое движение» как области, требующие доработки.
Продукта как такового пока нет: нет опубликованного разрешения, длины клипа, ценообразования. Формулировка – «coming soon to creators and in Meta AI».
Это не помешало Muse Video занять третье место на лидерборде Design Arena по текст-в-видео с результатом Elo 1459 на 5 июля – через несколько дней после превью. Первое место удерживает Gemini Omni Flash (Elo 1527), второе – Seedance 2.0 от Dreamina (Elo 1482). Четвёртое место – HappyHorse-1.0 с Elo 1430.
Картина на Artificial Analysis иная: там лидирует HappyHorse-1.0 в категории текст-в-видео без звука, Seedance 2.0 – с звуком. Gemini Omni Flash и Muse Video в топе там не появляются. Design Arena измеряет слепые человеческие предпочтения; Artificial Analysis ведёт собственный пул голосования. Два авторитетных бенчмарка, два разных лидера. Какому доверять – зависит от того, под какую задачу подбираете модель.

Пока пять компаний занимались инфраструктурой рабочих процессов, xAI спокойно обновила саму модель. 4 июля пользователи Grok Imagine сообщили, что приложение теперь генерирует полный 15-секундный клип за один запрос – «одним длинным дублем», без склейки нескольких коротких генераций. Добавлена возможность дополнительно удлинить клип после генерации. Илон Маск ретвитнул обновление тремя днями позже.
Важная оговорка: официального релиз-нота или блогпоста от xAI нет. Источники – пользовательские отчёты и ретвит основателя. Остальные параметры не изменились: 720p, $0,08 за секунду, обещанный в апреле тир 1080p Pro так и не вышел.
Это, пожалуй, самый показательный эпизод недели: самое заметное изменение в модели – это более плавный путь к тем же 15 секундам. Пока пять компаний строили рабочие процессы, слой моделей молчал.
Обзор AI видео индустрии этой недели складывается в один вывод, который сложно опровергнуть: гонка за лучшую модель уступает место гонке за лучший рабочий процесс. Kling получил $18 млрд не потому что у него лучшая модель – а потому что за ней стоит реальный, учетверившийся бизнес с понятной монетизацией. Пять компаний параллельно строят assembly layer, потому что именно там, по их расчёту, будут платить клиенты. Meta попала в топ-3 на leaderboard до выхода продукта – хорошая новость, но топ-3 в бенчмарке это не то же самое, что инструмент, вокруг которого можно строить пайплайн.
Практический вывод для тех, кто работает с автоматизацией видео с аватарами или строит любые другие видео-воркфлоу: момент для инвестиции в архитектуру процессов – сейчас. Модели будут меняться каждые несколько недель, а качественно выстроенный pipeline останется активом. Аналогичная логика работает при построении авто-блога с генерацией контента – сильная модель без структуры даёт хаос, а не масштаб.
Три вещи, за которыми стоит следить в ближайшие недели: IPO-файлинг Kling (Kuaishou назвал окно в 12 месяцев), развёртывание Seedance 2.5 в США и через API (ByteDance называл середину июля для CapCut и конец июля для API), и то, появится ли пятый вендор, использующий слово «Skills» – или кто-то из четырёх существующих заявит об interop между своими реализациями.
