AI: дайджест за 18 августа 2026
1. Alibaba представила генератор песен HappyShrimp 1.0 и объявила партнерство с Taihe Music Group
Alibaba запустила HappyShrimp 1.0 для генерации полноценных песен с упором на удержание структуры и развития трека; описан пайплайн из планирующей модели (~8B), модели музыкальных токенов (~0.4B) и отдельного рендера в аудио (FullDiT на flow matching). Одновременно объявлено стратегическое партнерство с Taihe Music Group, что важно как шаг к легитимизации и коммерциализации AI-музыки на фоне давления правообладателей.
Источники: t.me/cgevent
2. Qwen-Video-Edit: видеоредактирование на базе Qwen-Image-Edit без обучения отдельной видеомодели
Опубликован проект Qwen-Video-Edit, который редактирует видео, раскладывая латенты кадров в «сетку» и прогоняя их через Qwen-Image-Edit с проекционными слоями, а затем улучшая качество и временную стабильность через Wan 2.2. Важно как практический рецепт, как превратить сильную image-edit модель в video-edit пайплайн с кодом и весами, пусть и с заметными требованиями к ресурсам.
Источники: t.me/cgevent
3. Открытая MoE-видеомодель MAGI-2 Preview от Sand.ai генерирует видео с синхронным аудио
Sand.ai выложила в открытый доступ MAGI-2 Preview: single-stream модель, генерирующую 10-секундные ролики сразу с аудиодорожкой, с fine-grained MoE (114B параметров, активируется 6B на токен). Заявлено снижение стоимости инференса примерно в 10 раз относительно плотных моделей и двухстадийный пайплайн с последующим апскейлом до 1080p, что делает подход перспективным для дешевого API-инференса.
Источники: t.me/ai_newz
4. Уязвимость и утилита cmpunlocker превращают майнинговые Nvidia CMP HX170 в более пригодные для AI-инференса
Сообщается, что через уязвимость в драйверах Nvidia энтузиасты частично снимают ограничения у CMP HX170 (майнинговые карты на базе чипа от A100): разблокируется значительная часть памяти и снимаются вычислительные лимиты, что делает их интересными для инференса при низкой цене на вторичке. Ограничением остается интерфейс PCIe 2.0 x4, который пытаются аппаратно доработать.
Источники: t.me/ai_newz
5. В Пекине открылся AGI Bar с бесплатными токенами DeepSeek и локальным запуском DeepSeek V4 Flash
В Пекине описан бар-коворкинг, где вместо Wi‑Fi раздают бесплатные токены DeepSeek, а на месте стоят рабочие станции с NVIDIA для локального запуска DeepSeek V4 Flash. Это иллюстрирует рост офлайн-инфраструктуры вокруг LLM и попытки снизить зависимость от подписок и облака для практических задач вроде кодинга.
Источники: t.me/cgevent