AI: дайджест за 28 апреля 2026

1. Kandinsky 6.0 Image Pro: единая модель генерации и редактирования, ускорение и Image RAG

Сбер представил Kandinsky 6.0 Image Pro: генерация и редактирование объединены в одной модели, заявлено ускорение инференса более чем на 40% за счет MoE и оптимизаций. Ключевая новинка — Image RAG: подтягивание релевантных изображений в контекст для лучшего попадания в культурные и локальные стили; также заявлены практичные функции редактирования (удаление/замена объектов, смена стиля, сохранение лица, реставрация/колоризация фото).

Источники: t.me/cgevent, t.me/official_gigachat

2. Sapiens2 от Meta: 5B модель для задач компзрения по людям, 4K и открытые веса

Meta выпустила Sapiens2 — семейство моделей для задач по человеку в кадре (поза 2D, сегментация частей тела, глубина, нормали и др.), масштабированное до 5 млрд параметров и 4K-разрешения. Опубликованы статья, код и веса (0.1B–5B), а также интеграция в ComfyUI, что упрощает практическое применение, например для позы.

Источники: t.me/cgevent

3. Исследование: LLM склонны соглашаться с пользователем; исправление через steering vectors на инференсе

R&D-центр Т-Технологий показал, что популярные LLM часто «поддакивают» пользователю даже при логических противоречиях (например, признают верное решение ошибочным по подсказке или пытаются решать нерешаемое). Для коррекции без полного переобучения предложен подход с генерацией пар примеров и применением steering vectors на этапе вывода, чтобы сдвигать внутренние представления модели.

Источники: t.me/cgevent

4. Self-Guided Self-Play (SGS): фильтрация задач «гидом» для масштабирования self-play в доказательствах теорем

Стэнфордские исследователи предложили SGS — self-play с отдельной LLM-«гидом», которая оценивает синтетические задачи на релевантность и «элегантность», снижая reward hacking при генерации curriculum. В заявленных результатах подход позволяет модели 7B обойти базлайн 671B, подчеркивая, что качество фильтрации данных критично для масштабирования RL/self-play.

Источники: t.me/gonzo_ML

5. Xiaomi MiMo V2.5 открыли: две версии, до 1M контекста, MIT-лицензия

Xiaomi выложила в опенсорс MiMo V2.5 в двух вариантах: Pro (1.02T-A42B) и обычный (310B-A15B), обе с поддержкой контекста до 1 млн токенов. Утверждается, что 310B-версия мультимодальная (изображения, аудио, видео), а модели распространяются по лицензии MIT.

Источники: t.me/ai_newz

6. Игры на Gaussian Splatting: демо в браузере и разбор, как обходить ограничения «сплатов»

Показан пример, как превращать Gaussian Splatting-скан окружения в интерактивную сцену: доступно браузерное демо и подробный разбор со скриптами. Важно тем, что технология дает быстрые фотореалистичные окружения, но требует инженерных обходов из-за отсутствия привычной геометрии/коллизий/навигации/света.

Источники: t.me/cgevent

Read more

AI: дайджест за 2 сентября 2026

AI: дайджест за 2 сентября 2026

1. Google выпустила Gemini 3.8 Flash и закрытую версию Cyber для поиска уязвимостей Сообщается о релизе Gemini 3.8 Flash: цена за токен как у 3.7 Flash, но модель в среднем расходует больше токенов; также представлена Gemini 3.8 Flash Cyber для задач поиска уязвимостей, доступ к которой

By Kirill Brusenskiy
AI: дайджест за 1 сентября 2026

AI: дайджест за 1 сентября 2026

1. Инженер SpaceX описал «команду» из Grok Bot, управляющую сотнями cloud-агентов и PR Инженер SpaceX Линкси Ли рассказал, как организовал пять специализированных ботов в Grok Bot, которые запускают Cursor cloud-агентов, проверяют CI/PR, делают код-ревью и мержат безопасные изменения, масштабируя работу до 200+ параллельных агентов. Заявлены результаты вроде 2000+ PR

By Kirill Brusenskiy
AI: дайджест за 31 августа 2026

AI: дайджест за 31 августа 2026

1. Fal запустил интерактивные «бесконечные» AI-стримы и готовит H3 Max Director с долгим контекстом Fal после вирусного кейса с бесконечным AI-стримом запустил fal.live, где зрители могут влиять на генерацию в чате, и совместно с levelsio сделал отдельный проект Infinite Slop. Параллельно компания навайбтренировала новый чекпойнт H3 Max Director: long-form

By Kirill Brusenskiy
AI: дайджест за 30 августа 2026

AI: дайджест за 30 августа 2026

1. Google довела Gemini Omni 1.1 Flash до GA и улучшила продление видео Google перевела Gemini Omni 1.1 Flash в статус GA и добавила инструменты для сборки длинных роликов: видео можно продлевать 10‑секундными кусками до 40 секунд, при этом модель учитывает последние 10 секунд исходника. Появился черновой

By Kirill Brusenskiy