Новые модели ИИ выходят так часто, что за ними трудно успеть. Сентябрь 2026 года — хороший повод свериться: вышли новые поколения у OpenAI, Anthropic, xAI, Alibaba, Zhipu, DeepSeek и Meta*. Рассказываем главное для тех, кто работает с ElevenLabs.
Новые модели по порядку
- Главная новость месяца — поколение GPT-6. В нём три модели: Astra для самых сложных задач, Sol для повседневной работы и быстрая Luna. Astra открылась 4 сентября, Sol и Luna — 22 сентября; окно у всех — 1,05 млн токенов.
- Anthropic 22 сентября выпустила Claude Opus 5.5. По заявлению компании, на большинстве задач она держит уровень самой мощной Fable 5.1, а стоит на 40% дешевле Opus 5. Окно — 1 млн токенов, ответ — до 128 тысяч токенов.
- Alibaba развернула линейку Qwen 3.8: флагман Max на 2,4 трлн параметров, быстрые Flash и Omni Flash и открытые модели 27B и Open 2.4T. Omni Flash вышла 18 сентября и понимает не только текст и картинки, но и аудио с видео.
- У Meta* — Muse Spark 1.3 (2 сентября): окно на 1 млн токенов, на 20% меньше вызовов инструментов и на 25% меньше токенов на задачу, чем у версии 1.2. Самый сильный режим max пока в закрытом превью.
- DeepSeek 10 сентября выпустила V4.1 Flash — первую модель новой архитектуры с нативным зрением: 552 млрд параметров, окно на 1 млн токенов, открытая лицензия MIT. В API она уже заменила экспериментальную V4 Flash Vision.
- У китайской Zhipu AI — GLM 5.3 (753 млрд параметров, окно 1 млн токенов) и мультимодальные GLM 5.3 Flash и FlashX. Веса GLM 5.3 Flash открыты под свободной лицензией MIT.
- Grok 4.7 вышла 21 сентября. По данным xAI, это заметное улучшение Grok 4.6 при той же цене и скорости: сильнее в программировании и многошаговых задачах, понимает картинки, держит 500 тысяч токенов контекста.
Главное изменение месяца
Почти у всех новинок окно контекста — около миллиона токенов: в один запрос помещаются книги, архивы переписки или целый программный проект. Второй тренд — быстрые модели резко подешевели: GPT-6 Luna стоит в API $0,10 за миллион входных токенов, DeepSeek V4.1 Flash и GLM 5.3 Flash — около $0,15.
Что это значит для работы со звуком
Для аудио самая интересная новинка — Qwen 3.8 Omni Flash: она принимает звук на вход и понимает речь на 113 языках. Можно расшифровать запись встречи, голосовое или подкаст и сразу получить конспект. Синтезировать речь модель при этом не умеет.
Шпаргалка: что для чего
- Короткие ответы, письма, переводы — GPT-6 Luna или DeepSeek V4.1 Flash.
- Длинные документы целиком — Claude Opus 5.5 или GPT-6 Sol.
- Программирование — Claude Opus 5.5, Grok 4.7 или GLM 5.3.
- Картинки и скриншоты на входе — Qwen 3.8 Max или DeepSeek V4.1 Flash.
- Аудио и видео на входе — Qwen 3.8 Omni Flash.
Как попробовать новые модели из России
С доступом всё не так просто: OpenAI и Anthropic официально не работают в России, сервисы Meta* запрещены, а оплатить API российской картой нельзя. Проще всего пользоваться новинками через агрегатор с рублёвой оплатой — там не нужен VPN и зарубежная карта.
Короткие ответы
Какие из новинок можно попробовать бесплатно?
Быстрые модели: DeepSeek V4.1 Flash, GLM 5.3, Qwen 3.8 Flash и Qwen 3.8 Omni Flash. Флагманы — GPT-6, Claude Opus 5.5, Grok 4.7 — платные.
Что стало с DeepSeek V4 Flash Vision?
Экспериментальная модель выведена из работы: с 10 сентября её запросы в API DeepSeek обслуживает V4.1 Flash, которая понимает картинки лучше.
Нужен ли VPN, чтобы пользоваться новыми нейросетями?
Если работать через агрегатор с оплатой в рублях — нет. Напрямую сервисы OpenAI и Anthropic в России официально не работают.
Что значит «окно на миллион токенов»?
Это объём текста, который модель держит в голове за один запрос: несколько толстых книг, большой архив документов или целый программный проект.
Появятся ли новые модели в работе с ElevenLabs?
Новые модели не заменяют сам ElevenLabs, а дополняют его: помогают подготовить текст, разобрать исходники, составить точный запрос. Попробовать их можно по кнопке на этой странице — без VPN.
* Meta Platforms Inc. признана в России экстремистской организацией, её деятельность запрещена.