AI: дайджест за 11 июня 2026

AI: дайджест за 11 июня 2026

1. Google выпустила DiffusionGemma: диффузионную LLM на базе Gemma 4

Google представила DiffusionGemma (26B параметров, 4B активных) — текстовую диффузионную модель, генерирующую блоками по 256 токенов с многократным «уточнением» результата. Заявлена скорость свыше 1000 ток/с на одной H100 (FP8) и около 700 ток/с на RTX 5090 при некотором падении качества относительно авторегрессионной Gemma 4; релиз важен как практический шаг к ускорению LLM через диффузию.

Источники: t.me/cgevent, t.me/ai_newz

2. Anthropic пересмотрит «невидимые» ограничения Fable: лимиты сделают видимыми

Anthropic признала ошибкой подход с незаметной деградацией Fable и заявила, что ограничения станут видимыми для пользователей. При этом компания планирует повысить чувствительность фильтров, объясняя это компромиссом между обходом ограничений и влиянием на небольшую долю пользователей.

Источники: t.me/ai_newz

3. SemiAnalysis: подписки Claude и ChatGPT за $200 дают эквивалент тысяч долларов API-использования

SemiAnalysis протестировали тарифы Anthropic и OpenAI за $200/мес, прогоняя длинные coding-задачи до недельных лимитов, и оценили «ценность» как эквивалент примерно $8k для claude-max-20x и $14k для gpt-pro-20x при пересчете на API-цены. Это важно для понимания реальной экономики подписок и конкурентного давления на разработчиков, продающих доступ по API.

Источники: t.me/denissexy, t.me/How2AI

4. Fable 5 демонстрируют как универсальный инструмент для 3D и браузерных проектов

В нескольких примерах Fable 5 используют для генерации прикладных артефактов: реалистичной модели Boeing 747 в ThreeJS, браузерной игры с редактором уровней в одном файле (~1,7 МБ), 3D-карты Дели на открытых данных (OpenFreeMap/MapLibre), а также для риггинга и анимации импортированных GLB-моделей без внешних DCC-инструментов. Тренд важен тем, что LLM начинают закрывать специализированные задачи (3D, геймдев, пайплайны) «из чата», сокращая потребность в отдельных инструментах и датасетах.

Источники: t.me/cgevent, t.me/denissexy

5. Исследование: «латентное мышление» LLM не дает параллельного перебора решений и склонно к шорткатам

Авторы работы проанализировали модели со «скрытой цепочкой рассуждений» и проверили гипотезу, что латентные представления позволяют параллельно удерживать альтернативные пути решения (суперпозиция). По их выводам, ни готовые, ни дообученные модели обычно быстро схлопывают варианты к одному или находят обходные «шорткаты», что ставит под сомнение ожидания о легком улучшении планирования за счет латентного reasoning.

Источники: t.me/gonzo_ML

6. Houdini 22: в sneak peek показали расширенную поддержку Gaussian Splats

В превью Houdini 22 заметили не только рендерную, но и «массовую» поддержку GSplats, включая параметры обучения (нода ML-Train_GSplats), а также Animated и Rigged GSplats. Это важно для продакшн-пайплайнов, где сплаты постепенно становятся полноценным представлением сцены/объектов во «взрослом» 3D.

Источники: t.me/cgevent

7. Анонс Turbo ML Conf 2026 в Москве (18 июля) с фокусом на практические кейсы

Turbo ML Conf 2026 пройдет 18 июля в Москве (ДК «Серп и Молот») и заявляет три трека: R&D, applied ML at scale и ML-инфраструктура, с темами NLP, AI for SDLC и мультимодальные модели. Конференция бесплатная при регистрации, что делает ее заметным событием для русскоязычного ML-сообщества и обмена практиками.

Источники: t.me/cgevent

Read more

AI: дайджест за 3 сентября 2026

AI: дайджест за 3 сентября 2026

1. Google выпустила Gemini 3.8 Flash и закрытую версию Flash Cyber Google представила Gemini 3.8 Flash с упором на агентские сценарии и кодинг: модель лучше решает длинные многошаговые задачи, активнее использует инструменты и поддерживает контекст до 1 млн токенов при максимальном выводе 65K. При низкой цене за токен

By Kirill Brusenskiy
AI: дайджест за 2 сентября 2026

AI: дайджест за 2 сентября 2026

1. Google выпустила Gemini 3.8 Flash и закрытую версию Cyber для поиска уязвимостей Сообщается о релизе Gemini 3.8 Flash: цена за токен как у 3.7 Flash, но модель в среднем расходует больше токенов; также представлена Gemini 3.8 Flash Cyber для задач поиска уязвимостей, доступ к которой

By Kirill Brusenskiy
AI: дайджест за 1 сентября 2026

AI: дайджест за 1 сентября 2026

1. Инженер SpaceX описал «команду» из Grok Bot, управляющую сотнями cloud-агентов и PR Инженер SpaceX Линкси Ли рассказал, как организовал пять специализированных ботов в Grok Bot, которые запускают Cursor cloud-агентов, проверяют CI/PR, делают код-ревью и мержат безопасные изменения, масштабируя работу до 200+ параллельных агентов. Заявлены результаты вроде 2000+ PR

By Kirill Brusenskiy
AI: дайджест за 31 августа 2026

AI: дайджест за 31 августа 2026

1. Fal запустил интерактивные «бесконечные» AI-стримы и готовит H3 Max Director с долгим контекстом Fal после вирусного кейса с бесконечным AI-стримом запустил fal.live, где зрители могут влиять на генерацию в чате, и совместно с levelsio сделал отдельный проект Infinite Slop. Параллельно компания навайбтренировала новый чекпойнт H3 Max Director: long-form

By Kirill Brusenskiy