AI: дайджест за 18 августа 2026

AI: дайджест за 18 августа 2026

1. Alibaba представила генератор песен HappyShrimp 1.0 и объявила партнерство с Taihe Music Group

Alibaba запустила HappyShrimp 1.0 для генерации полноценных песен с упором на удержание структуры и развития трека; описан пайплайн из планирующей модели (~8B), модели музыкальных токенов (~0.4B) и отдельного рендера в аудио (FullDiT на flow matching). Одновременно объявлено стратегическое партнерство с Taihe Music Group, что важно как шаг к легитимизации и коммерциализации AI-музыки на фоне давления правообладателей.

Источники: t.me/cgevent

2. Qwen-Video-Edit: видеоредактирование на базе Qwen-Image-Edit без обучения отдельной видеомодели

Опубликован проект Qwen-Video-Edit, который редактирует видео, раскладывая латенты кадров в «сетку» и прогоняя их через Qwen-Image-Edit с проекционными слоями, а затем улучшая качество и временную стабильность через Wan 2.2. Важно как практический рецепт, как превратить сильную image-edit модель в video-edit пайплайн с кодом и весами, пусть и с заметными требованиями к ресурсам.

Источники: t.me/cgevent

3. Открытая MoE-видеомодель MAGI-2 Preview от Sand.ai генерирует видео с синхронным аудио

Sand.ai выложила в открытый доступ MAGI-2 Preview: single-stream модель, генерирующую 10-секундные ролики сразу с аудиодорожкой, с fine-grained MoE (114B параметров, активируется 6B на токен). Заявлено снижение стоимости инференса примерно в 10 раз относительно плотных моделей и двухстадийный пайплайн с последующим апскейлом до 1080p, что делает подход перспективным для дешевого API-инференса.

Источники: t.me/ai_newz

4. Уязвимость и утилита cmpunlocker превращают майнинговые Nvidia CMP HX170 в более пригодные для AI-инференса

Сообщается, что через уязвимость в драйверах Nvidia энтузиасты частично снимают ограничения у CMP HX170 (майнинговые карты на базе чипа от A100): разблокируется значительная часть памяти и снимаются вычислительные лимиты, что делает их интересными для инференса при низкой цене на вторичке. Ограничением остается интерфейс PCIe 2.0 x4, который пытаются аппаратно доработать.

Источники: t.me/ai_newz

5. В Пекине открылся AGI Bar с бесплатными токенами DeepSeek и локальным запуском DeepSeek V4 Flash

В Пекине описан бар-коворкинг, где вместо Wi‑Fi раздают бесплатные токены DeepSeek, а на месте стоят рабочие станции с NVIDIA для локального запуска DeepSeek V4 Flash. Это иллюстрирует рост офлайн-инфраструктуры вокруг LLM и попытки снизить зависимость от подписок и облака для практических задач вроде кодинга.

Источники: t.me/cgevent

Read more

AI: дайджест за 2 сентября 2026

AI: дайджест за 2 сентября 2026

1. Google выпустила Gemini 3.8 Flash и закрытую версию Cyber для поиска уязвимостей Сообщается о релизе Gemini 3.8 Flash: цена за токен как у 3.7 Flash, но модель в среднем расходует больше токенов; также представлена Gemini 3.8 Flash Cyber для задач поиска уязвимостей, доступ к которой

By Kirill Brusenskiy
AI: дайджест за 1 сентября 2026

AI: дайджест за 1 сентября 2026

1. Инженер SpaceX описал «команду» из Grok Bot, управляющую сотнями cloud-агентов и PR Инженер SpaceX Линкси Ли рассказал, как организовал пять специализированных ботов в Grok Bot, которые запускают Cursor cloud-агентов, проверяют CI/PR, делают код-ревью и мержат безопасные изменения, масштабируя работу до 200+ параллельных агентов. Заявлены результаты вроде 2000+ PR

By Kirill Brusenskiy
AI: дайджест за 31 августа 2026

AI: дайджест за 31 августа 2026

1. Fal запустил интерактивные «бесконечные» AI-стримы и готовит H3 Max Director с долгим контекстом Fal после вирусного кейса с бесконечным AI-стримом запустил fal.live, где зрители могут влиять на генерацию в чате, и совместно с levelsio сделал отдельный проект Infinite Slop. Параллельно компания навайбтренировала новый чекпойнт H3 Max Director: long-form

By Kirill Brusenskiy
AI: дайджест за 30 августа 2026

AI: дайджест за 30 августа 2026

1. Google довела Gemini Omni 1.1 Flash до GA и улучшила продление видео Google перевела Gemini Omni 1.1 Flash в статус GA и добавила инструменты для сборки длинных роликов: видео можно продлевать 10‑секундными кусками до 40 секунд, при этом модель учитывает последние 10 секунд исходника. Появился черновой

By Kirill Brusenskiy