AI: дайджест за 26 августа 2026
1. Ox Alpha раскрыта как модель семейства GLM от Z.ai; обещаны открытые веса и переход к коммерческим условиям
Z.ai (Zhipu) подтвердила, что Ox Alpha — новая версия семейства GLM: мультимодальная reasoning-модель для кодинга и агентов с контекстом до 1 млн токенов и выводом до 131K. Сообщается, что открытые веса планируют выпустить 26/27 августа, а бесплатный доступ продлят примерно на неделю перед объявлением коммерческих цен; модель уже доступна как GLM 5.3 Flash с опубликованными весами и тарифами API.
Источники: t.me/ai_newz, t.me/cgevent
2. Qwen 3.8 Flash Next: 125B-A6B модель на архитектуре Qwen 4, ориентирована на эффективный локальный запуск
Вышла Qwen 3.8 Flash Next (125B-A6B, 51B Engram) на архитектуре Qwen 4: по заявлению источника, она обходит Qwen 3.8 27B и конкурентна с DeepSeek V4 Flash. Модель уже поддерживается vLLM и SGLang, а формат позиционируется как удобный для локальных машин с 128 ГБ памяти.
Источники: t.me/ai_newz
3. OpenAI раскрыла детали inference-чипа Jalapeño и заявила заметный выигрыш по эффективности и задержке
OpenAI представила результаты и детали по Jalapeño: чип с 216 ГБ HBM4, до 13,4 PFLOP/s в mxfp4, и заявленные улучшения по сравнению с решениями Nvidia по токенам/ватт и latency; компания уже гоняет на нём GPT-OSS 120B, DeepSeek R1 и Kimi K2.5. Важность новости в том, что OpenAI демонстрирует конкурентоспособный собственный инференс-ускоритель и очень быстрый цикл разработки (примерно с октября 2024 до первых чипов в мае 2026), с планами массового развёртывания в следующем году.
Источники: t.me/ai_newz, t.me/cgevent
4. Epic подтвердила Unreal Engine 5.9 с фокусом на ИИ и расширением Unreal MCP для агентного управления редактором
Epic на Unreal Fest Seoul 2026 подтвердила UE 5.9 (несмотря на прежние заявления, что 5.8 — последний релиз перед UE6) и обозначила ИИ как ключевой фокус, включая расширение возможностей Unreal MCP для агентных инструментов. Также показан workflow, где генеративные модели работают как дополнительный render pass поверх контролируемой сцены (камера/геометрия/композиция), что важно для интеграции генеративного видео/изображений в production-пайплайн.
Источники: t.me/cgevent
5. Anthropic объединила память Claude между обычными чатами и Claude Cowork
Anthropic сделала единую систему памяти для обычного чата Claude и Claude Cowork: знания о проектах и предпочтениях теперь доступны в обоих режимах. Память можно просматривать по темам, редактировать и удалять; чувствительные категории данных по умолчанию не сохраняются, при этом Claude Code остаётся с отдельной системой памяти.
Источники: t.me/cgevent
6. Apple анонсировала новые Mac mini и Mac Studio с упором на локальный AI; источники расходятся по линейке чипов M6
Сообщается о новых Mac mini и Mac Studio, позиционируемых как более подходящие для локального запуска LLM за счёт унифицированной памяти (до 512 ГБ у топ-конфигураций) и заявленных ускорений AI-вычислений. При этом источники расходятся: один утверждает, что Mac mini выходит на M6, а Mac Studio — на M5 Ultra, другой — что Apple отменила M6 Pro/Max/Ultra и использует связку M6 (базовый) и M5 Pro в линейке Mac mini; в обоих сообщениях совпадают ориентиры по ценам и акцент на on-device AI.
Источники: t.me/cgevent, t.me/How2AI
7. Keenable вышла из стелса и запустила агентский поиск
Keenable объявила о выходе из стелса и релизе агентского поиска; заявляется, что решение выигрывает у exa по соотношению цена/качество. Детали приводятся по ссылке на внешний пост, но сам факт запуска нового продукта и позиционирование относительно конкурента — ключевая новость.
Источники: t.me/ai_newz