Новые модели ИИ выходят так часто, что за ними трудно успеть. Сентябрь 2026 года — хороший повод свериться: вышли новые поколения у OpenAI, Anthropic, xAI, Alibaba, Zhipu, DeepSeek и Meta*. Рассказываем главное для тех, кто работает с Нумероскоп.
Главные новинки месяца
- Anthropic обновила старшую линейку: Claude Opus 5.5 вышла 22 сентября. Компания заявляет уровень Fable 5.1 при цене ниже, чем у Opus 5, и ответы на треть быстрее. Рассуждение у модели включено всегда, регулируется только глубина.
- Qwen 3.8 — это пять моделей сразу. Старшая Max работает в облаке и держит 1 млн токенов, 27B можно скачать и запустить у себя (лицензия Apache 2.0), а Omni Flash, вышедшая 18 сентября, умеет разбирать голос и видео.
- У xAI — Grok 4.7: вышла 21 сентября, в тесте CursorBench прибавила почти шесть пунктов к Grok 4.6. Окно — 500 тысяч токенов, в API — $2 за миллион входных токенов.
- У китайской Zhipu AI — GLM 5.3 (753 млрд параметров, окно 1 млн токенов) и мультимодальные GLM 5.3 Flash и FlashX. Веса GLM 5.3 Flash открыты под свободной лицензией MIT.
- OpenAI выпустила поколение GPT-6 из трёх моделей. Флагман Astra (общий доступ с 4 сентября) рассчитан на сложный анализ, код и длинные задачи, Sol (22 сентября) — рабочая модель на каждый день, Luna — самая быстрая и дешёвая. У всех трёх окно на 1,05 млн токенов и понимание картинок.
- DeepSeek 10 сентября выпустила V4.1 Flash — первую модель новой архитектуры с нативным зрением: 552 млрд параметров, окно на 1 млн токенов, открытая лицензия MIT. В API она уже заменила экспериментальную V4 Flash Vision.
- У Meta* — Muse Spark 1.3 (2 сентября): окно на 1 млн токенов, на 20% меньше вызовов инструментов и на 25% меньше токенов на задачу, чем у версии 1.2. Самый сильный режим max пока в закрытом превью.
Общий тренд: миллион токенов и дешёвые быстрые модели
Новинки объединяют две вещи. Во-первых, огромное окно контекста — около миллиона токенов у GPT-6, Claude Opus 5.5, Qwen 3.8, GLM 5.3, DeepSeek V4.1 Flash и Muse Spark 1.3. Во-вторых, понимание изображений почти у всех: скриншот или фото можно просто приложить к вопросу.
Чем новинки полезны для текстов и толкований
Новые модели пишут развёрнутые и связные тексты — это удобно для толкований и заметок. Но это языковые модели: они не «знают» будущего и не заменяют специалиста.
Что выбрать под задачу
- Бесплатно и на каждый день — DeepSeek V4.1 Flash, GLM 5.3 или Qwen 3.8 Flash.
- Расшифровать голосовое или видео — Qwen 3.8 Omni Flash.
- Документы и тексты для работы — GPT-6 Sol или Claude Opus 5.5.
- Сложный код и большие проекты — GPT-6 Astra, Claude Opus 5.5 или Grok 4.7.
- Запустить модель у себя — Qwen 3.8 27B.
Как попробовать новые модели из России
Официально большинство новинок в России недоступны: в списках стран OpenAI и Anthropic России нет, сервисы Meta* запрещены, а API почти везде оплачивается зарубежной картой. Рабочий вариант — сервис-агрегатор с оплатой в рублях: в нём новые модели собраны в одном окне, а VPN не нужен.
Короткие ответы
Можно ли скачать GPT-6 или Claude Opus 5.5?
Нет, их веса закрыты — они работают только в облаке. Скачать и запустить у себя можно открытые модели: Qwen 3.8 27B, GLM 5.3, DeepSeek V4.1 Flash.
GPT-6 Astra Pro — это отдельная модель?
Нет. Pro — режим углублённого рассуждения той же модели: ответ дольше и дороже, но лучше на сложных задачах.
Что стало с DeepSeek V4 Flash Vision?
Экспериментальная модель выведена из работы: с 10 сентября её запросы в API DeepSeek обслуживает V4.1 Flash, которая понимает картинки лучше.
Что значит «окно на миллион токенов»?
Это объём текста, который модель держит в голове за один запрос: несколько толстых книг, большой архив документов или целый программный проект.
Появятся ли новые модели в работе с Нумероскоп?
Главное — больше выбора для подготовительной работы: тексты, разбор материалов, промпты. Попробовать новинки рядом с привычными инструментами можно по кнопке на этой странице.
* Meta Platforms Inc. признана в России экстремистской организацией, её деятельность запрещена.