AI: дайджест за 22 мая 2026
1. Cerebras запустила Kimi K2.6 на 1000 токенов/с и сообщается об IPO
Сообщается, что Cerebras запустила модель Kimi K2.6 (триллион параметров) со скоростью около 1000 токенов в секунду — заявляется как первый такой запуск для модели этого масштаба, но доступ пока только для enterprise-клиентов. В том же сообщении утверждается, что компания недавно вышла на IPO, привлекла $5,5 млрд и оценивается в $60 млрд, что указывает на усиление позиций игрока в AI-железе и инференсе.
Источники: t.me/ai_newz
2. Google и CapCut: партнёрство для монтажа фото/видео прямо в Gemini
Анонсировано партнёрство CapCut и Google: пользователи смогут редактировать изображения и видео в приложении Gemini с использованием возможностей CapCut. Это может превратить Gemini в более полноценную среду для креативных задач (вплоть до таймлайна монтажа) и усиливает тренд на интеграцию генерации и постпродакшна в одном интерфейсе.
Источники: t.me/cgevent
3. Runway выпустила Aleph 2 для редактирования видео (1080p, до 30 секунд)
Runway представила Aleph 2 — обновлённый инструмент редактирования видео: правки вносятся в конкретный кадр и применяются ко всему ролику, включая мультишот-сцены. Заявлена поддержка 1080p и длительности до 30 секунд, а также точечные изменения объектов с учётом освещения/физики при сохранении фона, что делает инструмент заметным шагом в video-to-video редактировании.
Источники: t.me/cgevent
4. Black Forest Labs добавила Flux Erase: удаление объектов с ручной маской через API/демо
Black Forest Labs выпустила инструмент Flux Erase для удаления объектов, который требует ручной грубой маски и доступен через API и демо. Указывается, что под капотом Flux.2 Klein 9B и что релиз выглядит слабее альтернатив, что важно для оценки темпа и направления развития линейки Flux.
Источники: t.me/cgevent
5. Meta представила WavFlow: генерация аудио напрямую в waveform без VAE
Опубликована работа WavFlow от Meta по генерации звука (в т.ч. Foley по видео и по тексту), где синтез идёт напрямую в пространстве аудиоволны без VAE и латентного сжатия. Авторы заявляют, что подход работает быстрее и не хуже по качеству, а наличие демо и кода упрощает проверку и применение в продакшне.
Источники: t.me/cgevent
6. PanoWorld: виртуальные туры по дому из 2D-планов с сохранением структуры
Проект PanoWorld показывает преобразование 2D-планов этажей в фотореалистичные согласованные виртуальные туры по дому с сохранением структуры при перемещении. Это перспективно для недвижимости и предпродажной визуализации; отмечено использование гауссианов, при этом код заявлен, но на момент сообщения ещё не опубликован.
Источники: t.me/cgevent
7. Krea.ai: заявлены планы на улучшения K2, техотчёт и возможный open-source релиз
В сообщении со ссылкой на пост разработчика Krea.ai перечислены планы: постоянные улучшения K2, выпуск версии с открытым исходным кодом, публикация техотчёта и блогов, а также возможная отдельная аниме-модель. Если open-source релиз состоится, это может заметно повлиять на доступность и воспроизводимость их подходов.
Источники: t.me/cgevent
8. GRAM (Generative Recursive Reasoning Models): стохастические рекурсивные рассуждения с многотраекторным поиском
Представлен фреймворк GRAM, который делает рекурсивные латентные рассуждения стохастическими и многотраекторными за счёт обучаемого шума и вариационного вывода, чтобы лучше покрывать задачи с множеством решений. Заявлено превосходство над детерминированными бейзлайнами на комбинаторных задачах (судоку, ферзи, раскраска графов) и возможность масштабировать инференс «в ширину» параллельным сэмплингом.
Источники: t.me/gonzo_ML