Сентябрь 2026 года выдался плотным: почти каждый крупный разработчик ИИ выпустил новую модель. Разбираем, что вышло, чем модели отличаются и что из этого пригодится тем, кто пользуется ZeroGPT.
Коротко о каждой модели
- Anthropic 22 сентября выпустила Claude Opus 5.5. По заявлению компании, на большинстве задач она держит уровень самой мощной Fable 5.1, а стоит на 40% дешевле Opus 5. Окно — 1 млн токенов, ответ — до 128 тысяч токенов.
- DeepSeek V4.1 Flash вышла 10 сентября: понимает изображения, держит 1 млн токенов контекста и, по заявлению DeepSeek, обходит даже собственный флагман V4 Pro. С 14 сентября запросы к V4 Pro в API обслуживает именно она.
- xAI после нескольких переносов выпустила Grok 4.7 — 21 сентября. Новая базовая модель, упор на код и агентные задачи, окно на 500 тысяч токенов; цена в API осталась как у Grok 4.6.
- GLM 5.3 от Zhipu — открытая модель, которую разработчик называет самой сильной среди открытых для программирования. Рядом — GLM 5.3 Flash, понимающая картинки и видео, и её скоростной режим FlashX.
- OpenAI выпустила поколение GPT-6 из трёх моделей. Флагман Astra (общий доступ с 4 сентября) рассчитан на сложный анализ, код и длинные задачи, Sol (22 сентября) — рабочая модель на каждый день, Luna — самая быстрая и дешёвая. У всех трёх окно на 1,05 млн токенов и понимание картинок.
- Qwen 3.8 — это пять моделей сразу. Старшая Max работает в облаке и держит 1 млн токенов, 27B можно скачать и запустить у себя (лицензия Apache 2.0), а Omni Flash, вышедшая 18 сентября, умеет разбирать голос и видео.
- Meta* 2 сентября выпустила Muse Spark 1.3 — модель рассуждений с окном на 1 млн токенов, которая понимает изображения, видео и документы. По заявлению компании, на те же задачи она тратит на четверть меньше токенов, чем версия 1.2.
Что объединяет новинки
Если свести месяц к одной мысли: мощные модели стали дешевле, а дешёвые — умнее. Claude Opus 5.5 стоит меньше Opus 5, GPT-6 Sol вдвое дешевле предшественника, а DeepSeek перевела запросы к флагману V4 Pro на быструю V4.1 Flash.
Что это значит для проверки текстов
Чем сильнее модели, тем труднее детекторам. Новое поколение — GPT-6, Claude Opus 5.5 — пишет заметно ровнее, поэтому полагаться только на автоматическую проверку рискованно: лучше смотреть на смысл и источники.
Что выбрать под задачу
- Короткие ответы, письма, переводы — GPT-6 Luna или DeepSeek V4.1 Flash.
- Длинные документы целиком — Claude Opus 5.5 или GPT-6 Sol.
- Программирование — Claude Opus 5.5, Grok 4.7 или GLM 5.3.
- Картинки и скриншоты на входе — Qwen 3.8 Max или DeepSeek V4.1 Flash.
- Аудио и видео на входе — Qwen 3.8 Omni Flash.
Как попробовать новые модели из России
Официально большинство новинок в России недоступны: в списках стран OpenAI и Anthropic России нет, сервисы Meta* запрещены, а API почти везде оплачивается зарубежной картой. Рабочий вариант — сервис-агрегатор с оплатой в рублях: в нём новые модели собраны в одном окне, а VPN не нужен.
Короткие ответы
GPT-6 Astra Pro — это отдельная модель?
Нет. Pro — режим углублённого рассуждения той же модели: ответ дольше и дороже, но лучше на сложных задачах.
Нужен ли VPN, чтобы пользоваться новыми нейросетями?
Если работать через агрегатор с оплатой в рублях — нет. Напрямую сервисы OpenAI и Anthropic в России официально не работают.
Можно ли скачать GPT-6 или Claude Opus 5.5?
Нет, их веса закрыты — они работают только в облаке. Скачать и запустить у себя можно открытые модели: Qwen 3.8 27B, GLM 5.3, DeepSeek V4.1 Flash.
Что значит «окно на миллион токенов»?
Это объём текста, который модель держит в голове за один запрос: несколько толстых книг, большой архив документов или целый программный проект.
Появятся ли новые модели в работе с ZeroGPT?
Главное — больше выбора для подготовительной работы: тексты, разбор материалов, промпты. Попробовать новинки рядом с привычными инструментами можно по кнопке на этой странице.
* Meta Platforms Inc. признана в России экстремистской организацией, её деятельность запрещена.