AI: дайджест за 7 августа 2026
1. Google показал новые демо Gemini Omni: чат-редактирование видео и продление бесплатной акции
Google опубликовал подборку пользовательских и корпоративных демо Gemini Omni, где акцент на интерактивном редактировании видео «как в чате»: смена ракурсов, голосовое изменение сцены, doodle-to-video и рестайлинг. Также продлили акцию «10 бесплатных видео» до 11 августа, что важно для удержания интереса на фоне конкурентов в генеративном видео.
Источники: t.me/cgevent
2. MiniMax раскрыл планы по H3: open-source Regenerate-2K, sparse attention и отдельная image-модель
В AMA MiniMax подтвердил намерение открыть H3-Regenerate-2K как отдельный latent-space regeneration checkpoint и обещает релиз «не очень далеко», параллельно дорабатывая скорость/качество для локального использования. Также описали подход к sparse attention (ближе к MoBA-style block selection) и пообещали первую открытую реализацию в ближайшее время; отдельно заявили, что в разработке полноценная image-модель из линии H3.
Источники: t.me/cgevent
3. Minimax H3 доступен локально: веса на Hugging Face и установка через ComfyUI
Сообщается, что веса Minimax H3 выложены на Hugging Face и модель можно поставить локально в ComfyUI. Заявлены режимы text-to-video и image-to-video, работа с референсами персонажа/стиля/голоса, поддержка 11 языков и вывод до 2K.
Источники: t.me/How2AI
4. Seedance 2.5 выходит в API-экосистему: сравнение тарифов и ограничения по режимам/разрешению
Появились детали по доступности Seedance 2.5 у разных провайдеров и по ценам, включая поминутную/посекундную тарификацию и условия для video-reference. Отдельно отмечены маркетинговые расхождения: 4K и 180 секунд заявляются, но в публичных API у части провайдеров фактически доступны только 480p/720p и генерация до 30 секунд, тогда как 180 секунд фигурирует как beta-режим в Dreamina.
Источники: t.me/cgevent
5. Слухи о первом устройстве OpenAI и Джони Айва: портативный AI-динамик без экрана
По данным из публикации, обсуждается портативный AI-динамик OpenAI без экрана в металлическом корпусе, с микрофонами, камерами/сенсорами и механическими индикаторами состояния. Называются ориентиры цены $300–400, анонса до конца 2026 года и старта продаж в 2027-м; важность в том, что OpenAI может выйти в отдельную категорию «контекстных» устройств как альтернативный интерфейс к сервисам.
Источники: t.me/cgevent
6. Meta выпустила агента Muse Code и Muse Spark 1.2 и ввела сверхдешёвые тарифы при обучении на данных клиента
Сообщается о релизе агента Muse Code и модели Muse Spark 1.2, а также о сравнительных заявлениях по качеству (лучше Grok 4.5, но ниже Opus 5 по их утверждению). Ключевое изменение — новая ценовая политика: при разрешении тренировать модели на данных пользователя цены падают до $0,1/$0,2 за миллион токенов против стандартных $1,25/$4,25, что может заметно повлиять на выбор API для разработчиков.
Источники: t.me/ai_newz
7. Практический вывод по генеративному монтажу: ограничения Seedance 2.0 для MTV-стиля
На примере рекламного ролика описан продакшн-пайплайн и ограничения Seedance 2.0: CRT/static/datamosh получаются нестабильно, качество падает при попытке делать больше 3–4 планов в одной генерации, мелкий текст и логотипы «плывут» и требуют референсов и повторов. Это полезно как прикладные рекомендации для тех, кто пытается делать клиповый монтаж и брендированный контент на генеративном видео.
Источники: t.me/cgevent