На этой неделе вышли сразу 5 новых моделей от ведущих разработчиков ИИ. Собрали краткий обзор каждой - с характеристиками, ценами и ключевыми отличиями.
GPT-6 Astra (OpenAI)
3 сентября OpenAI представил GPT-6 Astra - модель, которую президент компании Грег Брокман назвал «поколенческим скачком». Первая модель OpenAI, прошедшая порог критической кибербезопасности по Preparedness Framework.
Astra устанавливает рекорды: FrontierMath Tier 4 - 98%, ARC-AGI-3 - 99.9%, ExploitBench - 100%. Модель превосходит всех конкурентов в использовании компьютера, браузере, программировании и научных задачах.
Пока доступна в ограниченном превью для доверенных партнёров. Цены ещё не объявлены.
Gemini 3.8 Flash (Google)
2 сентября Google выпустил Gemini 3.8 Flash - лучшую модель для рассуждений и программирования в серии Flash. Та же скорость и цена, что у 3.7 Flash: $0.75 за 1M входных токенов, $3.75 за 1M выходных.
Значительные улучшения в программной инженерии, агентах и многошаговых рассуждениях. DeepSWE v1.1: превосходит более крупные и дорогие модели. HLE-Verified: 54.9%.
Также выпущена версия Cyber - для кибербезопасности, доступна через программу Fairwind.
Claude Fable 5.1 (Anthropic)
1 сентября Anthropic выпустил Claude Fable 5.1 - новую модель для программирования и работы со знаниями. Та же модель, что Mythos 5.1, но с другими механизмами безопасности.
На 25% дешевле Fable 5 для типичных задач, до 45% дешевле для агента. Cache reads дешевле на 75%.
Бенчмарки: Terminal-Bench-Science 0.1 - 52.6% (Fable 5: 24.7%), Terminal-Bench 4.0 - 55.8%, CursorBench 3.2.0 - 73.4%. Превосходит Opus 5 на большинстве задач при более низкой цене.
Цена: $10/1M входных, $50/1M выходных токенов.
Qwen 3.8 Flash (Alibaba)
26 августа Alibaba представила Qwen 3.8 Flash - экспериментальную модель с архитектурой для будущего Qwen 4. 125B параметров, 6B активных, открытые веса.
Гибридная архитектура: Gated DeltaNet + Qwen Sparse Attention, N-gram Embedding, Gated Residual. Контекст - до 1M токенов.
Бенчмарки: DeepSWE 1.1 - 58.7%, SWE-bench Pro - 62.5%, SWE-bench Multilingual - 81.0%, GPQA Diamond - 91.7%.
Цена: $0.16/1M входных, $0.47/1M выходных - одна из самых дешёвых моделей на рынке.
GLM-5.3-Flash (Z.ai)
26 августа Z.ai выпустила GLM-5.3-Flash - первую нативно мультимодальную модель в серии GLM-5. 320B параметров, 18B активных, открытые веса.
Гибридная архитектура: linear + sparse attention, Manifold-Constrained Hyper-Connections. Контекст - 1M токенов. Визуальная самопроверка: модель может обнаруживать проблемы в сгенерированном контенте и исправлять их.
Приближается к Claude Opus 4.8 по программированию и агентам: Terminal Bench 2.1 - 84.3%, DeepSWE v1.1 - 63.4%, AutomationBench - 48.8%.
Тестировалась анонимно как 'ox-alpha' на OpenCode и OpenRouter - стала самой популярной моделью недели.
Что это значит для пользователей СТИВА
Все 5 моделей - свежие релизы сентября-августа 2026. В СТИВА мы следим за выходом новых моделей и добавляем их в каталог. ChatGPT, Claude, Gemini, Qwen и GLM уже доступны - новые версии появятся в каталоге по мере интеграции.
Промокод ICHIF - +10% токенов при первой оплате на stiva.ai.
