AI: дайджест за 4 июля 2026
1. DeepSeek представила DSpark для ускорения спекулятивного декодирования
Команда DeepSeek-AI описала фреймворк DSpark: полуавторегрессионный параллельный «драфтер» и шедулер префиксов на основе уверенности, чтобы ускорять инференс LLM под высокой конкурентной нагрузкой. Заявлено ускорение генерации на 60–85% для DeepSeek-V4 при сохранении пропускной способности и без деградации качества в «хвосте» последовательности; код и модель выложены публично.
Источники: t.me/gonzo_ML
2. Probabilistic TRM: стохастический поиск в Tiny Recursive Models для дешёвого test-time compute
В работе про Probabilistic TRM (PTRM) предложили добавлять гауссовский шум в скрытое состояние уже обученных Tiny Recursive Models на инференсе, создавая несколько траекторий и выбирая лучшую через предобученную Q-head. Авторы утверждают, что компактные рекурсивные модели (5–7 млн параметров) могут превосходить SOTA LLM на структурированных задачах удовлетворения ограничений при стоимости инференса более чем в 10 000 раз ниже, что усиливает тренд на масштабирование вычислений в латентном пространстве на этапе инференса.
Источники: t.me/gonzo_ML