AI: дайджест за 29 апреля 2026

AI: дайджест за 29 апреля 2026

1. Anthropic выпустила Claude-коннекторы для креативных приложений и стала спонсором Blender

Anthropic анонсировала набор коннекторов Claude для Adobe Creative Cloud и ряда креативных инструментов (включая новый коннектор для Blender) и параллельно стала спонсором Blender. Это усиливает сценарии автоматизации и генерации кода/скриптов прямо внутри профессионального софта и сигнализирует о фокусе Claude на креативных рабочих процессах.

Источники: t.me/cgevent

2. Netflix открыла Vista 4D — пайплайн «пересъёмки» видео с новым ракурсом через 4D-реконструкцию и video diffusion

Netflix представила и выложила в open source проект Vista 4D: из входного видео строится 3D/«4D» реконструкция сцены (облако точек с динамикой), затем задаётся новая камера и финальный результат дорисовывается video diffusion моделью. Важно как практический шаг к управляемому изменению ракурса и длинным клипам на базе реконструкции сцены, пусть пока и с ограничением 720p.

Источники: t.me/cgevent

3. Kandinsky 6.0 Image Pro: единая модель генерации и редактирования, ускорение >40% и Image RAG

Сбер выпустил Kandinsky 6.0 Image Pro, объединив генерацию и редактирование изображений в одной модели и заявив ускорение более чем на 40% за счёт MoE и оптимизаций инференса. Ключевая новинка — Image RAG (подтягивание релевантных изображений в контекст), что улучшает попадание в специфические стили и «культурный код», а также качество правок (удаление/замена объектов, реставрация, стилизация, интерьеры/фасады).

Источники: t.me/ai_newz, t.me/cgevent, t.me/official_gigachat

4. StAItial AI Echo 2: генератор 3D-«миров» из одной картинки стал доступен всем и пока бесплатен

StAItial AI Echo 2 открыл доступ без вейтлиста и позволяет за 6–8 минут генерировать «мир» из одной картинки для просмотра в браузере через сплаты, с экспортом (в т.ч. PLY) и продвинутыми настройками камеры/рендера. Это заметное удешевление и упрощение пайплайна для быстрых 3D-сцен, потенциально полезных для прототипирования и задач вроде симуляций/тренировки роботов.

Источники: t.me/cgevent

5. Gracia.ai заявила стриминг 3D Gaussian splats в браузере/WebXR при 75 Mbps, включая Vision Pro и Quest 3

Команда gracia.ai сообщила, что довела стриминг сплатов до работы в браузере (включая WebXR) и на устройствах вроде Apple Vision Pro и Quest 3 при канале 75 Mbps, добавив CDN-раздачу, пространственное аудио и зачатки релайтинга. Это приближает «объёмное видео» к практическому распространению и воспроизведению на массовых устройствах.

Источники: t.me/cgevent

6. Исследование: Universal Transformer с токенами памяти и корректной инициализацией ACT стабильнее учится рекурсивному рассуждению

В работе «Universal Transformers Need Memory» показано, что одноблочному Universal Transformer с Adaptive Computation Time для сложных задач (например, Sudoku-Extreme) критически нужны выделенные токены памяти как scratchpad, а также важна инициализация роутера ACT: инверсия bias помогает избежать ранней остановки (shallow-halt) и стабилизирует обучение. Важность в том, что это практический рецепт для более надёжных и параметрически компактных рекурсивных моделей, масштабируемых по вычислениям на инференсе.

Источники: t.me/gonzo_ML

7. Talkie: 13B LLM, обученная на 260B токенов данных до 1930 года (public domain), для экспериментов с «предсказанием будущего»

Проект Talkie обучил 13B модель на 260 млрд токенов текстов до 1930 года, используя границу public domain в США, и позиционирует это как крупнейший эксперимент такого рода. Это важно как тестовый стенд для исследований способности моделей выводить новые знания из ограниченного исторического среза; заявлен план выпустить летом модель уровня GPT-3.

Источники: t.me/denissexy, t.me/ai_newz

8. Sync.so добавила перевод и voice cloning в дубляж с lip-sync

Sync.so показала обновлённый пайплайн дубляжа: перевод и клонирование голоса интегрированы с lip-sync так, что новая озвучка лучше совпадает с движением губ. Это усиливает практическую применимость автоматического дубляжа, хотя отмечаются вопросы к качеству на крупных планах и высокая стоимость.

Источники: t.me/cgevent

Read more

AI: дайджест за 2 сентября 2026

AI: дайджест за 2 сентября 2026

1. Google выпустила Gemini 3.8 Flash и закрытую версию Cyber для поиска уязвимостей Сообщается о релизе Gemini 3.8 Flash: цена за токен как у 3.7 Flash, но модель в среднем расходует больше токенов; также представлена Gemini 3.8 Flash Cyber для задач поиска уязвимостей, доступ к которой

By Kirill Brusenskiy
AI: дайджест за 1 сентября 2026

AI: дайджест за 1 сентября 2026

1. Инженер SpaceX описал «команду» из Grok Bot, управляющую сотнями cloud-агентов и PR Инженер SpaceX Линкси Ли рассказал, как организовал пять специализированных ботов в Grok Bot, которые запускают Cursor cloud-агентов, проверяют CI/PR, делают код-ревью и мержат безопасные изменения, масштабируя работу до 200+ параллельных агентов. Заявлены результаты вроде 2000+ PR

By Kirill Brusenskiy
AI: дайджест за 31 августа 2026

AI: дайджест за 31 августа 2026

1. Fal запустил интерактивные «бесконечные» AI-стримы и готовит H3 Max Director с долгим контекстом Fal после вирусного кейса с бесконечным AI-стримом запустил fal.live, где зрители могут влиять на генерацию в чате, и совместно с levelsio сделал отдельный проект Infinite Slop. Параллельно компания навайбтренировала новый чекпойнт H3 Max Director: long-form

By Kirill Brusenskiy
AI: дайджест за 30 августа 2026

AI: дайджест за 30 августа 2026

1. Google довела Gemini Omni 1.1 Flash до GA и улучшила продление видео Google перевела Gemini Omni 1.1 Flash в статус GA и добавила инструменты для сборки длинных роликов: видео можно продлевать 10‑секундными кусками до 40 секунд, при этом модель учитывает последние 10 секунд исходника. Появился черновой

By Kirill Brusenskiy