AI: дайджест за 3 августа 2026

AI: дайджест за 3 августа 2026

1. Исследование: «эмерджентные способности» связаны с разреженной маршрутизацией внимания

Авторы показали, что внезапное появление прикладных способностей у трансформеров во время обучения связано с резким обнаружением разреженных паттернов маршрутизации внимания, специфичных для задач. Они выделяют длину контекста и разреженность как ключевые bottleneck’и и утверждают, что альтернативные архитектуры и стратегии предварительного предобучения могут ускорять появление таких способностей, снижая потребность в «скейлинге в лоб».

Источники: t.me/gonzo_ML

2. Qwen 3.8-Max: релиз модели на 2,4T параметров с 1M контекстом и упором на мультимодальность

Вышла Qwen 3.8-Max (2,4T параметров, 95B активных, контекст 1M) с заявленными сильными результатами на мультимодальных бенчмарках (в т.ч. PaperBench, MathVision, CharXiv, OmniDocBench) и позиционированием под агентные сценарии работы с экраном/PDF. При этом отмечается более слабая производительность в чисто кодовых задачах по ряду SWE-бенчмарков по сравнению с некоторыми конкурентами; также приведены цены API и обещание публикации весов через неделю.

Источники: t.me/cgevent

3. Flux.3: ожидание официального релиза и анонс нового видеобенчмарка (без фактуры)

Сообщается, что Flux.3 «тащит» на видео и ожидается официальный релиз на этой неделе, а также обещан новый видеобенчмарк с критикой Seedance. Конкретных метрик, дат релиза или деталей теста не приведено, поэтому практическая значимость новости ограничена.

Источники: t.me/cgevent

4. Moonshot выложили веса Kimi K3 — крупнейшей открытой модели на 2,8T параметров

В недельном дайджесте заявлено, что Moonshot опубликовали веса Kimi K3 (2,8T параметров, 104B активных), и для локального запуска потребуется система с порядка 2 ТБ памяти. Это расширяет доступ к сверхкрупной открытой модели, но требует крайне дорогой инфраструктуры.

Источники: t.me/ai_newz

5. OpenAI снизили цены на GPT 5.6 и добавили Fast-режим для Sol

По данным дайджеста, OpenAI снизили стоимость GPT 5.6: Luna подешевела в 5 раз, Terra — на 20%, а для флагмана Sol появился Fast-режим (в 2,5 раза быстрее за 2x прайс). Это может заметно изменить экономику использования моделей в продакшене и выбор между режимами скорости/стоимости.

Источники: t.me/ai_newz

6. DeepSeek V4 Flash 0731: обновление API и ожидание V4 Pro в начале августа

Утверждается, что версия DeepSeek V4 Flash 0731 в API обходит GLM 5.2, совместима с Codex и остаётся дешевле Luna по токенам и «в пересчёте на таск». Также сообщается, что релиз V4 Pro ожидают в начале августа.

Источники: t.me/ai_newz

7. Astra от OpenAI: мультиагентная модель доказала 10 открытых математических задач в Lean за <$2000

В дайджесте говорится, что новая мультиагентная модель OpenAI Astra доказала 10 открытых математических задач с использованием Lean, потратив менее $2000 на токены по расценкам Sol. Если подтверждается, это заметный шаг в автоматизации формальных доказательств при относительно низкой стоимости вычислений.

Источники: t.me/ai_newz

8. Seedance 2.5 от ByteDance: видео до 180 секунд, интеграция с Blender и точечное редактирование

Сообщается, что Seedance 2.5 научился генерировать видео до 180 секунд, получил интеграцию с Blender и инструменты точечного редактирования, но стал самым дорогим на рынке ($6 за 30 секунд). Это усиливает продукт для продакшена, но повышает барьер по стоимости.

Источники: t.me/ai_newz

9. Chess Pretraining: сайт-тренажёр по выбору лучшего хода в концовке по фрагменту партии

Запущен сайт, где показывают часть шахматной партии и просят выбрать ход, который с наибольшей вероятностью приведёт к победе, ориентируясь на последние ~8 ходов до конца. Это может быть полезным интерактивным форматом для практики и идей вокруг «pretraining»-подобных задач на последовательностях ходов.

Источники: t.me/denissexy

Read more

AI: дайджест за 2 сентября 2026

AI: дайджест за 2 сентября 2026

1. Google выпустила Gemini 3.8 Flash и закрытую версию Cyber для поиска уязвимостей Сообщается о релизе Gemini 3.8 Flash: цена за токен как у 3.7 Flash, но модель в среднем расходует больше токенов; также представлена Gemini 3.8 Flash Cyber для задач поиска уязвимостей, доступ к которой

By Kirill Brusenskiy
AI: дайджест за 1 сентября 2026

AI: дайджест за 1 сентября 2026

1. Инженер SpaceX описал «команду» из Grok Bot, управляющую сотнями cloud-агентов и PR Инженер SpaceX Линкси Ли рассказал, как организовал пять специализированных ботов в Grok Bot, которые запускают Cursor cloud-агентов, проверяют CI/PR, делают код-ревью и мержат безопасные изменения, масштабируя работу до 200+ параллельных агентов. Заявлены результаты вроде 2000+ PR

By Kirill Brusenskiy
AI: дайджест за 31 августа 2026

AI: дайджест за 31 августа 2026

1. Fal запустил интерактивные «бесконечные» AI-стримы и готовит H3 Max Director с долгим контекстом Fal после вирусного кейса с бесконечным AI-стримом запустил fal.live, где зрители могут влиять на генерацию в чате, и совместно с levelsio сделал отдельный проект Infinite Slop. Параллельно компания навайбтренировала новый чекпойнт H3 Max Director: long-form

By Kirill Brusenskiy
AI: дайджест за 30 августа 2026

AI: дайджест за 30 августа 2026

1. Google довела Gemini Omni 1.1 Flash до GA и улучшила продление видео Google перевела Gemini Omni 1.1 Flash в статус GA и добавила инструменты для сборки длинных роликов: видео можно продлевать 10‑секундными кусками до 40 секунд, при этом модель учитывает последние 10 секунд исходника. Появился черновой

By Kirill Brusenskiy