AI: дайджест за 5 августа 2026
1. Anthropic формирует команду для проектирования собственных ИИ-чипов под Claude
Anthropic начала нанимать инженеров для разработки специализированных ускорителей под Claude, при этом производство предполагается у внешнего подрядчика. Это может снизить зависимость от Nvidia, удешевить инференс и лучше оптимизировать железо под собственные модели.
Источники: t.me/cgevent
2. MiniMax H3 получил новые кванты GGUF и официальные pruned BF16/FP8 модели в репозитории Comfy-Org
Для MiniMax H3 появились новые GGUF-квантизации (включая FL2VA и Ref2VA) и более компактные сборки, а также официальные pruned BF16 и FP8 scaled веса в репозитории Comfy-Org. Это упрощает локальный запуск и подбор компромисса между качеством и потреблением памяти, плюс доступны готовые workflow.
Источники: t.me/cgevent
3. Black Forest Labs выпустила FLUX 3 Video в API: до 20 секунд видео со звуком и Draft Mode
FLUX 3 Video стала доступна через API и умеет генерировать до 20 секунд видео со звуком, липсинком, ключевыми кадрами и продолжением исходного ролика; заявлена поддержка русского языка. Введён Draft Mode: сначала дешёвый черновик, затем пересчёт в полное качество с сохранением движения/композиции/seed, что снижает стоимость итераций.
Источники: t.me/cgevent
4. OpenAI показала демо GPT-Live для «живого» голосового распознавания и ответов на ходу
В демо GPT-Live модель может параллельно слушать и отвечать без пауз «на подумать», что демонстрирует более естественный realtime-диалоговый режим. Также отмечена роль как оркестратора, который распределяет задачи агентам и отслеживает их выполнение (в т.ч. в Codex).
Источники: t.me/How2AI
5. Hermes: релиз The Herald с wake words, A2A v1.0, CLI-командами и plugin SDK для десктопа
Hermes добавил голосовые wake words со стриминг-ответами и возможностью перебивать, а также A2A v1.0 для взаимодействия агентов по стандартному протоколу. Появились CLI-инструменты для работы с контекстом и диффами, а десктоп-клиент стал платформой с plugin SDK и первым плагином Kanban.
Источники: t.me/How2AI
6. Работа связывает инференс в зрительной коре и диффузионные модели через non-factorial sparse coding
Авторы предложили фреймворк non-factorial sparse coding с парными взаимодействиями латентов и оптимизацией рекуррентной динамики через Denoising Score Matching, заявляя генеративное качество на уровне U-Net при большей интерпретируемости. Важность в том, что подход объединяет нейробиологические механизмы V1 и диффузионные модели, предлагая более прозрачные генеративные системы.
Источники: t.me/gonzo_ML
7. Lift4D: 4D-реконструкция динамических объектов по одному видео
Lift4D восстанавливает 360° геометрию, текстуры и нежёсткие деформации движущихся объектов по обычному видео, достраивая невидимые ракурсы. Это расширяет возможности реконструкции сцен и объектов без многокамерных установок.
Источники: t.me/ai_newz
8. Кейс PHOENIX: гибридный пайплайн 3D+AI для короткометражки с бюджетом $700 и сроком 45 дней
Автор описал полный продакшн-процесс от сценария до постпродакшна, где ключевым этапом стал 3D-аниматик в Unreal Engine и дальнейшая генерация видео с использованием референсов (первый/последний кадр, сцены аниматика, собственные видео-референсы). Практическая ценность — конкретный воспроизводимый пайплайн и ориентиры по времени/стоимости для AI-видеопроизводства.
Источники: t.me/cgevent