Новые модели ИИ выходят так часто, что за ними трудно успеть. Сентябрь 2026 года — хороший повод свериться: вышли новые поколения у OpenAI, Anthropic, xAI, Alibaba, Zhipu, DeepSeek и Meta*. Рассказываем главное для тех, кто работает с Character AI.
Коротко о каждой модели
- У xAI — Grok 4.7: вышла 21 сентября, в тесте CursorBench прибавила почти шесть пунктов к Grok 4.6. Окно — 500 тысяч токенов, в API — $2 за миллион входных токенов.
- Muse Spark 1.3 от Meta* — мультимодальная модель для долгих агентных задач: окно на 1 млн токенов, понимание изображений, видео и документов. Вышла 2 сентября, веса закрыты.
- У китайской Zhipu AI — GLM 5.3 (753 млрд параметров, окно 1 млн токенов) и мультимодальные GLM 5.3 Flash и FlashX. Веса GLM 5.3 Flash открыты под свободной лицензией MIT.
- Qwen 3.8 — это пять моделей сразу. Старшая Max работает в облаке и держит 1 млн токенов, 27B можно скачать и запустить у себя (лицензия Apache 2.0), а Omni Flash, вышедшая 18 сентября, умеет разбирать голос и видео.
- У OpenAI вышло поколение GPT-6: флагман Astra, рабочая Sol и лёгкая Luna. В API они стоят $10, $2 и $0,10 за миллион входных токенов — разница в сто раз, поэтому модель стоит выбирать под задачу. Версии Pro — это не отдельные модели, а режим углублённого рассуждения.
- Claude Opus 5.5 — новая модель Anthropic для длинных задач: кода, аналитики, работы с большими документами. Вышла 22 сентября, окно на 1 млн токенов, знания до июня 2026 года; в API — $4 за миллион входных токенов.
- DeepSeek 10 сентября выпустила V4.1 Flash — первую модель новой архитектуры с нативным зрением: 552 млрд параметров, окно на 1 млн токенов, открытая лицензия MIT. В API она уже заменила экспериментальную V4 Flash Vision.
Общий тренд: миллион токенов и дешёвые быстрые модели
Новинки объединяют две вещи. Во-первых, огромное окно контекста — около миллиона токенов у GPT-6, Claude Opus 5.5, Qwen 3.8, GLM 5.3, DeepSeek V4.1 Flash и Muse Spark 1.3. Во-вторых, понимание изображений почти у всех: скриншот или фото можно просто приложить к вопросу.
Что это значит для общения с ИИ-персонажами
Для ролевых диалогов важны память и живой тон. Окно на миллион токенов у новинок означает, что персонаж дольше помнит историю разговора, а Grok 4.7 традиционно отличается неформальным стилем.
Шпаргалка: что для чего
- Бесплатно и на каждый день — DeepSeek V4.1 Flash, GLM 5.3 или Qwen 3.8 Flash.
- Расшифровать голосовое или видео — Qwen 3.8 Omni Flash.
- Документы и тексты для работы — GPT-6 Sol или Claude Opus 5.5.
- Сложный код и большие проекты — GPT-6 Astra, Claude Opus 5.5 или Grok 4.7.
- Запустить модель у себя — Qwen 3.8 27B.
Как попробовать новые модели из России
С доступом всё не так просто: OpenAI и Anthropic официально не работают в России, сервисы Meta* запрещены, а оплатить API российской картой нельзя. Проще всего пользоваться новинками через агрегатор с рублёвой оплатой — там не нужен VPN и зарубежная карта.
Попробовать новые модели без VPN →
Короткие ответы
Что стало с DeepSeek V4 Flash Vision?
Экспериментальная модель выведена из работы: с 10 сентября её запросы в API DeepSeek обслуживает V4.1 Flash, которая понимает картинки лучше.
Какие из новинок можно попробовать бесплатно?
Быстрые модели: DeepSeek V4.1 Flash, GLM 5.3, Qwen 3.8 Flash и Qwen 3.8 Omni Flash. Флагманы — GPT-6, Claude Opus 5.5, Grok 4.7 — платные.
GPT-6 Astra Pro — это отдельная модель?
Нет. Pro — режим углублённого рассуждения той же модели: ответ дольше и дороже, но лучше на сложных задачах.
Нужен ли VPN, чтобы пользоваться новыми нейросетями?
Если работать через агрегатор с оплатой в рублях — нет. Напрямую сервисы OpenAI и Anthropic в России официально не работают.
Что новые нейросети меняют для пользователей Character AI?
Новые модели не заменяют сам Character AI, а дополняют его: помогают подготовить текст, разобрать исходники, составить точный запрос. Попробовать их можно по кнопке на этой странице — без VPN.
* Meta Platforms Inc. признана в России экстремистской организацией, её деятельность запрещена.