AI: дайджест за 26 июля 2026 - 2 августа 2026
1. OpenAI: Astra решила 10 сложных задач по математике и оформила доказательства в Lean
OpenAI опубликовала результаты, где внутренняя мультиагентная модель Astra получила новые или улучшенные решения для 10 математических задач и подготовила формализации доказательств в Lean; заявлены также материалы с разбором рассуждений. Важно как демонстрация прогресса в автоматизации исследований и формальной верификации при относительно небольших затратах на токены.
Источники: t.me/ai_newz, t.me/gonzo_ML
2. Seedance 2.5 официально запущен: 30 секунд, до 180 секунд в бете, 50 референсов и локальное редактирование
ByteDance/Dreamina запустили Seedance 2.5 (31 июля): генерация видео до 30 секунд, до 50 мультимодальных референсов, reference-to-video и локальное редактирование; заявлен бета-режим продолжения до 180 секунд. Это усиливает контроль и пригодность модели для продакшн-пайплайнов, но публичный API BytePlus/ModelArk, по сообщениям, появится позже, а 4K пока не в 2.5.
Источники: t.me/cgevent, t.me/ai_newz
3. Seedance 2.5: опубликованы Blender-воркфлоу и заявлены плагины для Maya/Blender
Появилась обновленная страница воркфлоу Seedance 2.5 для Blender с описанием шести пайплайнов, а в материалах упоминаются Dreamina-плагины для Maya и Blender и поддержка 3D-болванок/green-screen для продакшна. Это важно как шаг к интеграции генерации видео в привычные 3D-инструменты и более управляемой постановке сцен.
Источники: t.me/cgevent, t.me/ai_newz
4. MiniMax H3: заявлен релиз open-weights, но без ясности по лицензии и условиям
MiniMax позиционирует H3 как open-weights мультимодальную видеомодель и, по пересказу со ссылкой на Reuters, обещает опубликовать веса спустя несколько дней после запуска 31 июля 2026, однако лицензия и права на коммерческое использование/дообучение не раскрыты. Важно, потому что полноценная публикация весов для модели с заявленными возможностями (2K, до 15 секунд, звук, референсы, редактирование) может заметно повлиять на рынок, но пока остаются риски «неполной открытости».
Источники: t.me/cgevent
5. DeepSeek обновили V4 Flash в API: V4-Flash-0731 и планы на V4 Pro и агента
DeepSeek выпустили обновление V4-Flash-0731 в API; по заявлению, по бенчмаркам модель обгоняет GLM 5.2 и V4 Pro Preview при сопоставимом расходе токенов, и работает через Responses API с совместимостью с Codex. Важно как усиление конкуренции в сегменте дешевых API-моделей; веса не опубликованы, а обновление V4 Pro обещают в начале августа.
Источники: t.me/ai_newz
6. OpenAI снизила цены на GPT‑5.6 и добавила Fast-режим для Sol
OpenAI снизила стоимость GPT‑5.6: Luna подешевела в 5 раз до $0.20/$1.20 за млн токенов (вход/выход), Terra — на 20% до $2/$12; для Sol цена прежняя, но появился Fast mode (до 2.5× быстрее за 2× цену). Это важно, потому что меняет экономику использования моделей в API и инструментах вроде Codex/ChatGPT Work, усиливая ценовую конкуренцию.
Источники: t.me/cgevent, t.me/denissexy, t.me/ai_newz
7. Исследование: Requential Coding — сжатие моделей через кодирование траектории обучения
В работе Requential Coding предложен подход к сжатию генеративных моделей с потерями через кодирование процесса обучения (student обучается на синтетике, teacher отбирает примеры) и relative entropy coding, что уменьшает «стоимость передачи» до расхождений между моделями. Важно тем, что авторы заявляют первые нетривиальные PAC-Bayes гарантии обобщения для LLM с миллиардами параметров и связь со scaling laws.
Источники: t.me/gonzo_ML
8. Исследование: Multi-Scale Path Divergence как метрика сложности для open-ended эволюции в ALife
Предложена метрика Multi-Scale Path Divergence (MSPD) для оценки сложности и управления open-ended exploration в системах искусственной жизни без black-box нейросетевых критериев, с опорой на идеи статистической физики. Важно как попытка дать интерпретируемую, строго определенную «фитнес-функцию» и диагностический инструмент для эмерджентного поведения.
Источники: t.me/gonzo_ML
9. Minimax H3: демонстрации lip-sync и акцентов в text-to-video на фоне ожиданий open-source
Показаны примеры работы MiniMax H3 с липсинком и имитацией акцентов в text-to-video; автор отмечает, что модель «вот-вот» станет опенсорсной. Это важно как индикатор качества мультимодальных возможностей (речь/акценты/синхронизация губ) и ожиданий вокруг доступности весов.
Источники: t.me/cgevent