Новые модели ИИ выходят так часто, что за ними трудно успеть. Сентябрь 2026 года — хороший повод свериться: вышли новые поколения у OpenAI, Anthropic, xAI, Alibaba, Zhipu, DeepSeek и Meta*. Рассказываем главное для тех, кто работает с Delta Chat.
Новые модели по порядку
- Zhipu AI (Z.ai) выпустила GLM 5.3 — открытую модель для кода на 753 млрд параметров с окном на 1 млн токенов — и первые мультимодальные модели серии: Flash и ускоренный FlashX, который с 18 сентября выдаёт до 200 токенов в секунду.
- У Meta* — Muse Spark 1.3 (2 сентября): окно на 1 млн токенов, на 20% меньше вызовов инструментов и на 25% меньше токенов на задачу, чем у версии 1.2. Самый сильный режим max пока в закрытом превью.
- Anthropic 22 сентября выпустила Claude Opus 5.5. По заявлению компании, на большинстве задач она держит уровень самой мощной Fable 5.1, а стоит на 40% дешевле Opus 5. Окно — 1 млн токенов, ответ — до 128 тысяч токенов.
- DeepSeek V4.1 Flash вышла 10 сентября: понимает изображения, держит 1 млн токенов контекста и, по заявлению DeepSeek, обходит даже собственный флагман V4 Pro. С 14 сентября запросы к V4 Pro в API обслуживает именно она.
- Qwen 3.8 — это пять моделей сразу. Старшая Max работает в облаке и держит 1 млн токенов, 27B можно скачать и запустить у себя (лицензия Apache 2.0), а Omni Flash, вышедшая 18 сентября, умеет разбирать голос и видео.
- У xAI — Grok 4.7: вышла 21 сентября, в тесте CursorBench прибавила почти шесть пунктов к Grok 4.6. Окно — 500 тысяч токенов, в API — $2 за миллион входных токенов.
- OpenAI выпустила поколение GPT-6 из трёх моделей. Флагман Astra (общий доступ с 4 сентября) рассчитан на сложный анализ, код и длинные задачи, Sol (22 сентября) — рабочая модель на каждый день, Luna — самая быстрая и дешёвая. У всех трёх окно на 1,05 млн токенов и понимание картинок.
Что объединяет новинки
Если свести месяц к одной мысли: мощные модели стали дешевле, а дешёвые — умнее. Claude Opus 5.5 стоит меньше Opus 5, GPT-6 Sol вдвое дешевле предшественника, а DeepSeek перевела запросы к флагману V4 Pro на быструю V4.1 Flash.
Чем новинки полезны для продуктивности
Для продуктивности новинки дают выбор «по весу задачи»: быстрые бесплатные модели для рутины и мощные — для документов и планирования. Окно на миллион токенов позволяет работать с целой базой заметок сразу.
Какую модель выбрать
- Бесплатно и на каждый день — DeepSeek V4.1 Flash, GLM 5.3 или Qwen 3.8 Flash.
- Расшифровать голосовое или видео — Qwen 3.8 Omni Flash.
- Документы и тексты для работы — GPT-6 Sol или Claude Opus 5.5.
- Сложный код и большие проекты — GPT-6 Astra, Claude Opus 5.5 или Grok 4.7.
- Запустить модель у себя — Qwen 3.8 27B.
Как попробовать новые модели из России
С доступом всё не так просто: OpenAI и Anthropic официально не работают в России, сервисы Meta* запрещены, а оплатить API российской картой нельзя. Проще всего пользоваться новинками через агрегатор с рублёвой оплатой — там не нужен VPN и зарубежная карта.
Короткие ответы
Какие из новинок можно попробовать бесплатно?
Быстрые модели: DeepSeek V4.1 Flash, GLM 5.3, Qwen 3.8 Flash и Qwen 3.8 Omni Flash. Флагманы — GPT-6, Claude Opus 5.5, Grok 4.7 — платные.
Что стало с DeepSeek V4 Flash Vision?
Экспериментальная модель выведена из работы: с 10 сентября её запросы в API DeepSeek обслуживает V4.1 Flash, которая понимает картинки лучше.
GPT-6 Astra Pro — это отдельная модель?
Нет. Pro — режим углублённого рассуждения той же модели: ответ дольше и дороже, но лучше на сложных задачах.
Что значит «окно на миллион токенов»?
Это объём текста, который модель держит в голове за один запрос: несколько толстых книг, большой архив документов или целый программный проект.
Что новые нейросети меняют для пользователей Delta Chat?
Главное — больше выбора для подготовительной работы: тексты, разбор материалов, промпты. Попробовать новинки рядом с привычными инструментами можно по кнопке на этой странице.
* Meta Platforms Inc. признана в России экстремистской организацией, её деятельность запрещена.