AI: дайджест за 2 сентября 2026
1. Google выпустила Gemini 3.8 Flash и закрытую версию Cyber для поиска уязвимостей
Сообщается о релизе Gemini 3.8 Flash: цена за токен как у 3.7 Flash, но модель в среднем расходует больше токенов; также представлена Gemini 3.8 Flash Cyber для задач поиска уязвимостей, доступ к которой закрыт. Важно как очередное ускорение релизного цикла и как отдельная линия «кибер»-моделей с ограниченным доступом.
Источники: t.me/ai_newz
2. WSJ: Google готовила Gemini 3.8 Flash (Skimaki) с упором на agentic coding
По данным WSJ, Google готовила Gemini 3.8 Flash под внутренним именем Skimaki с фокусом на agentic coding и заявляла превосходство над Opus 5 в задачах кодинга. Важно как сигнал об усилении конкуренции в «кодинговых» моделях и попытке Google сократить разрыв с лидерами.
Источники: t.me/cgevent
3. World Labs представила Atlas — «world model» для пространственного понимания и генерации наблюдений
World Labs описала Atlas как модель, которая строит и поддерживает единое пространственное представление мира из текста/изображений/видео/3D и затем может восстанавливать 3D, генерировать новые ракурсы, панорамы и видео с заданной траекторией камеры. Важно тем, что это сдвиг от генерации готовых 3D-ассетов к моделированию мира как основы для разных задач (включая real-to-sim).
Источники: t.me/cgevent
4. Anthropic выпустила Claude Fable 5.1 и Mythos 5.1: новые бенчмарки, цены и режимы доступа
Anthropic анонсировала Fable 5.1 (для всех) и Mythos 5.1 (ослабленные ограничения для проверенных организаций) и привела рост показателей на ряде бенчмарков; также заявлено удешевление cache reads на 75% при сохранении базовых цен. Важно как обновление флагманской линейки, изменение экономики использования (кэш) и формализация «двухрежимного» доступа для чувствительных доменов (кибер/био).
Источники: t.me/How2AI, t.me/cgevent
5. Artificial Analysis: из-за многословности реальная стоимость задач у Fable 5.1 может вырасти
По проверкам Artificial Analysis, несмотря на заявленную экономию за счёт более дешёвых cache reads, Fable 5.1 генерирует больше выходных токенов, из-за чего итоговая стоимость на их метриках оказалась выше, чем у Fable 5, и заметно выше Opus 5. Важно как напоминание, что прайсинг «за токены» и кэш-скидки не гарантируют удешевления реальных рабочих нагрузок.
Источники: t.me/How2AI
6. OpenAI: Astra классифицирована как «критическая» по киберрискам; 100% на ExploitBench и доп.проверки на «читерство»
В блоге OpenAI говорится, что Astra отнесли к «критическому» уровню киберспособностей, так как модель может находить новые уязвимости и собирать цепочки атак; в качестве примера упомянуты 100% на ExploitBench и отдельная проверка на свежих уязвимостях с июня, а также тесты на попытки компрометации окружения. Важно как индикатор ужесточения оценок рисков перед релизом и как демонстрация методик валидации киберспособностей моделей.
Источники: t.me/cgevent