AI: дайджест за 3 августа 2026
1. Исследование: «эмерджентные способности» связаны с разреженной маршрутизацией внимания
Авторы показали, что внезапное появление прикладных способностей у трансформеров во время обучения связано с резким обнаружением разреженных паттернов маршрутизации внимания, специфичных для задач. Они выделяют длину контекста и разреженность как ключевые bottleneck’и и утверждают, что альтернативные архитектуры и стратегии предварительного предобучения могут ускорять появление таких способностей, снижая потребность в «скейлинге в лоб».
Источники: t.me/gonzo_ML
2. Qwen 3.8-Max: релиз модели на 2,4T параметров с 1M контекстом и упором на мультимодальность
Вышла Qwen 3.8-Max (2,4T параметров, 95B активных, контекст 1M) с заявленными сильными результатами на мультимодальных бенчмарках (в т.ч. PaperBench, MathVision, CharXiv, OmniDocBench) и позиционированием под агентные сценарии работы с экраном/PDF. При этом отмечается более слабая производительность в чисто кодовых задачах по ряду SWE-бенчмарков по сравнению с некоторыми конкурентами; также приведены цены API и обещание публикации весов через неделю.
Источники: t.me/cgevent
3. Flux.3: ожидание официального релиза и анонс нового видеобенчмарка (без фактуры)
Сообщается, что Flux.3 «тащит» на видео и ожидается официальный релиз на этой неделе, а также обещан новый видеобенчмарк с критикой Seedance. Конкретных метрик, дат релиза или деталей теста не приведено, поэтому практическая значимость новости ограничена.
Источники: t.me/cgevent
4. Moonshot выложили веса Kimi K3 — крупнейшей открытой модели на 2,8T параметров
В недельном дайджесте заявлено, что Moonshot опубликовали веса Kimi K3 (2,8T параметров, 104B активных), и для локального запуска потребуется система с порядка 2 ТБ памяти. Это расширяет доступ к сверхкрупной открытой модели, но требует крайне дорогой инфраструктуры.
Источники: t.me/ai_newz
5. OpenAI снизили цены на GPT 5.6 и добавили Fast-режим для Sol
По данным дайджеста, OpenAI снизили стоимость GPT 5.6: Luna подешевела в 5 раз, Terra — на 20%, а для флагмана Sol появился Fast-режим (в 2,5 раза быстрее за 2x прайс). Это может заметно изменить экономику использования моделей в продакшене и выбор между режимами скорости/стоимости.
Источники: t.me/ai_newz
6. DeepSeek V4 Flash 0731: обновление API и ожидание V4 Pro в начале августа
Утверждается, что версия DeepSeek V4 Flash 0731 в API обходит GLM 5.2, совместима с Codex и остаётся дешевле Luna по токенам и «в пересчёте на таск». Также сообщается, что релиз V4 Pro ожидают в начале августа.
Источники: t.me/ai_newz
7. Astra от OpenAI: мультиагентная модель доказала 10 открытых математических задач в Lean за <$2000
В дайджесте говорится, что новая мультиагентная модель OpenAI Astra доказала 10 открытых математических задач с использованием Lean, потратив менее $2000 на токены по расценкам Sol. Если подтверждается, это заметный шаг в автоматизации формальных доказательств при относительно низкой стоимости вычислений.
Источники: t.me/ai_newz
8. Seedance 2.5 от ByteDance: видео до 180 секунд, интеграция с Blender и точечное редактирование
Сообщается, что Seedance 2.5 научился генерировать видео до 180 секунд, получил интеграцию с Blender и инструменты точечного редактирования, но стал самым дорогим на рынке ($6 за 30 секунд). Это усиливает продукт для продакшена, но повышает барьер по стоимости.
Источники: t.me/ai_newz
9. Chess Pretraining: сайт-тренажёр по выбору лучшего хода в концовке по фрагменту партии
Запущен сайт, где показывают часть шахматной партии и просят выбрать ход, который с наибольшей вероятностью приведёт к победе, ориентируясь на последние ~8 ходов до конца. Это может быть полезным интерактивным форматом для практики и идей вокруг «pretraining»-подобных задач на последовательностях ходов.
Источники: t.me/denissexy