Сентябрь 2026 года выдался плотным: почти каждый крупный разработчик ИИ выпустил новую модель. Разбираем, что вышло, чем модели отличаются и что из этого пригодится тем, кто пользуется Трагос.
Главные новинки месяца
- У Meta* — Muse Spark 1.3 (2 сентября): окно на 1 млн токенов, на 20% меньше вызовов инструментов и на 25% меньше токенов на задачу, чем у версии 1.2. Самый сильный режим max пока в закрытом превью.
- Claude Opus 5.5 — новая модель Anthropic для длинных задач: кода, аналитики, работы с большими документами. Вышла 22 сентября, окно на 1 млн токенов, знания до июня 2026 года; в API — $4 за миллион входных токенов.
- Qwen 3.8 — это пять моделей сразу. Старшая Max работает в облаке и держит 1 млн токенов, 27B можно скачать и запустить у себя (лицензия Apache 2.0), а Omni Flash, вышедшая 18 сентября, умеет разбирать голос и видео.
- Новая DeepSeek V4.1 Flash — быстрая модель с нативным пониманием картинок и окном на 1 млн токенов. Вышла 10 сентября, веса открыты под MIT, а в API она стоит от $0,15 за миллион входных токенов.
- Главная новость месяца — поколение GPT-6. В нём три модели: Astra для самых сложных задач, Sol для повседневной работы и быстрая Luna. Astra открылась 4 сентября, Sol и Luna — 22 сентября; окно у всех — 1,05 млн токенов.
- Grok 4.7 вышла 21 сентября. По данным xAI, это заметное улучшение Grok 4.6 при той же цене и скорости: сильнее в программировании и многошаговых задачах, понимает картинки, держит 500 тысяч токенов контекста.
- GLM 5.3 от Zhipu — открытая модель, которую разработчик называет самой сильной среди открытых для программирования. Рядом — GLM 5.3 Flash, понимающая картинки и видео, и её скоростной режим FlashX.
Общий тренд: миллион токенов и дешёвые быстрые модели
Почти у всех новинок окно контекста — около миллиона токенов: в один запрос помещаются книги, архивы переписки или целый программный проект. Второй тренд — быстрые модели резко подешевели: GPT-6 Luna стоит в API $0,10 за миллион входных токенов, DeepSeek V4.1 Flash и GLM 5.3 Flash — около $0,15.
Что это значит для текстов и толкований
Для текстов о символах, снах и интерпретациях новые модели полезны как собеседники и редакторы: они формулируют мягче и связнее. Относиться к их ответам стоит как к тексту для размышления, а не как к предсказанию.
Какую модель выбрать
- Бесплатно и на каждый день — DeepSeek V4.1 Flash, GLM 5.3 или Qwen 3.8 Flash.
- Расшифровать голосовое или видео — Qwen 3.8 Omni Flash.
- Документы и тексты для работы — GPT-6 Sol или Claude Opus 5.5.
- Сложный код и большие проекты — GPT-6 Astra, Claude Opus 5.5 или Grok 4.7.
- Запустить модель у себя — Qwen 3.8 27B.
Можно ли пользоваться новинками в России
Официально большинство новинок в России недоступны: в списках стран OpenAI и Anthropic России нет, сервисы Meta* запрещены, а API почти везде оплачивается зарубежной картой. Рабочий вариант — сервис-агрегатор с оплатой в рублях: в нём новые модели собраны в одном окне, а VPN не нужен.
Короткие ответы
GPT-6 Astra Pro — это отдельная модель?
Нет. Pro — режим углублённого рассуждения той же модели: ответ дольше и дороже, но лучше на сложных задачах.
Что значит «окно на миллион токенов»?
Это объём текста, который модель держит в голове за один запрос: несколько толстых книг, большой архив документов или целый программный проект.
Какая нейросеть самая мощная в сентябре 2026?
Однозначного лидера нет. В разных тестах впереди GPT-6 Astra, Claude Fable 5.1 и Claude Opus 5.5; Grok 4.7 в ряде рейтингов второй. Для конкретной задачи надёжнее проверить две-три модели на своём примере.
Что стало с DeepSeek V4 Flash Vision?
Экспериментальная модель выведена из работы: с 10 сентября её запросы в API DeepSeek обслуживает V4.1 Flash, которая понимает картинки лучше.
Появятся ли новые модели в работе с Трагос?
Новые модели не заменяют сам Трагос, а дополняют его: помогают подготовить текст, разобрать исходники, составить точный запрос. Попробовать их можно по кнопке на этой странице — без VPN.
* Meta Platforms Inc. признана в России экстремистской организацией, её деятельность запрещена.