Сентябрь 2026 года выдался плотным: почти каждый крупный разработчик ИИ выпустил новую модель. Разбираем, что вышло, чем модели отличаются и что из этого пригодится тем, кто пользуется ChatSonic.
Главные новинки месяца
- В линейке Qwen 3.8 от Alibaba есть и облачный флагман Max, и открытые версии для запуска на своих серверах — 27B и Open 2.4T. Свежая Omni Flash (18 сентября) принимает текст, изображения, аудио и видео.
- У китайской Zhipu AI — GLM 5.3 (753 млрд параметров, окно 1 млн токенов) и мультимодальные GLM 5.3 Flash и FlashX. Веса GLM 5.3 Flash открыты под свободной лицензией MIT.
- Новая DeepSeek V4.1 Flash — быстрая модель с нативным пониманием картинок и окном на 1 млн токенов. Вышла 10 сентября, веса открыты под MIT, а в API она стоит от $0,15 за миллион входных токенов.
- Meta* 2 сентября выпустила Muse Spark 1.3 — модель рассуждений с окном на 1 млн токенов, которая понимает изображения, видео и документы. По заявлению компании, на те же задачи она тратит на четверть меньше токенов, чем версия 1.2.
- xAI после нескольких переносов выпустила Grok 4.7 — 21 сентября. Новая базовая модель, упор на код и агентные задачи, окно на 500 тысяч токенов; цена в API осталась как у Grok 4.6.
- Claude Opus 5.5 — новая модель Anthropic для длинных задач: кода, аналитики, работы с большими документами. Вышла 22 сентября, окно на 1 млн токенов, знания до июня 2026 года; в API — $4 за миллион входных токенов.
- У OpenAI вышло поколение GPT-6: флагман Astra, рабочая Sol и лёгкая Luna. В API они стоят $10, $2 и $0,10 за миллион входных токенов — разница в сто раз, поэтому модель стоит выбирать под задачу. Версии Pro — это не отдельные модели, а режим углублённого рассуждения.
Что объединяет новинки
Почти у всех новинок окно контекста — около миллиона токенов: в один запрос помещаются книги, архивы переписки или целый программный проект. Второй тренд — быстрые модели резко подешевели: GPT-6 Luna стоит в API $0,10 за миллион входных токенов, DeepSeek V4.1 Flash и GLM 5.3 Flash — около $0,15.
Что это значит для чат-ботов
В чат-ботах главное изменение — окно на миллион токенов стало нормой: в один разговор помещаются книги и пачки документов. А быстрые модели вроде GPT-6 Luna и DeepSeek V4.1 Flash стали настолько дешёвыми, что их можно использовать без оглядки на лимиты.
Какую модель выбрать
- Бесплатно и на каждый день — DeepSeek V4.1 Flash, GLM 5.3 или Qwen 3.8 Flash.
- Расшифровать голосовое или видео — Qwen 3.8 Omni Flash.
- Документы и тексты для работы — GPT-6 Sol или Claude Opus 5.5.
- Сложный код и большие проекты — GPT-6 Astra, Claude Opus 5.5 или Grok 4.7.
- Запустить модель у себя — Qwen 3.8 27B.
Можно ли пользоваться новинками в России
С доступом всё не так просто: OpenAI и Anthropic официально не работают в России, сервисы Meta* запрещены, а оплатить API российской картой нельзя. Проще всего пользоваться новинками через агрегатор с рублёвой оплатой — там не нужен VPN и зарубежная карта.
Короткие ответы
Какие из новинок можно попробовать бесплатно?
Быстрые модели: DeepSeek V4.1 Flash, GLM 5.3, Qwen 3.8 Flash и Qwen 3.8 Omni Flash. Флагманы — GPT-6, Claude Opus 5.5, Grok 4.7 — платные.
Что стало с DeepSeek V4 Flash Vision?
Экспериментальная модель выведена из работы: с 10 сентября её запросы в API DeepSeek обслуживает V4.1 Flash, которая понимает картинки лучше.
Какая нейросеть самая мощная в сентябре 2026?
Однозначного лидера нет. В разных тестах впереди GPT-6 Astra, Claude Fable 5.1 и Claude Opus 5.5; Grok 4.7 в ряде рейтингов второй. Для конкретной задачи надёжнее проверить две-три модели на своём примере.
Что значит «окно на миллион токенов»?
Это объём текста, который модель держит в голове за один запрос: несколько толстых книг, большой архив документов или целый программный проект.
Появятся ли новые модели в работе с ChatSonic?
Главное — больше выбора для подготовительной работы: тексты, разбор материалов, промпты. Попробовать новинки рядом с привычными инструментами можно по кнопке на этой странице.
* Meta Platforms Inc. признана в России экстремистской организацией, её деятельность запрещена.