Новые нейросети сентября 2026: какие модели брать, чтобы обучить свою
В сентябре 2026 года вышли GPT-6, Claude Opus 5.5, Grok 4.7, Qwen 3.8, GLM 5.3 и DeepSeek V4.1 Flash. Разбираем новинки с практической стороны: какие можно скачать и дообучить, какие работают только в облаке и что выбрать под свою задачу.
Главные новинки месяца
- Claude Opus 5.5 — новая модель Anthropic для длинных задач: кода, аналитики, работы с большими документами. Вышла 22 сентября, окно на 1 млн токенов, знания до июня 2026 года; в API — $4 за миллион входных токенов.
- Meta* 2 сентября выпустила Muse Spark 1.3 — модель рассуждений с окном на 1 млн токенов, которая понимает изображения, видео и документы. По заявлению компании, на те же задачи она тратит на четверть меньше токенов, чем версия 1.2.
- GLM 5.3 от Zhipu — открытая модель, которую разработчик называет самой сильной среди открытых для программирования. Рядом — GLM 5.3 Flash, понимающая картинки и видео, и её скоростной режим FlashX.
- DeepSeek V4.1 Flash вышла 10 сентября: понимает изображения, держит 1 млн токенов контекста и, по заявлению DeepSeek, обходит даже собственный флагман V4 Pro. С 14 сентября запросы к V4 Pro в API обслуживает именно она.
- OpenAI выпустила поколение GPT-6 из трёх моделей. Флагман Astra (общий доступ с 4 сентября) рассчитан на сложный анализ, код и длинные задачи, Sol (22 сентября) — рабочая модель на каждый день, Luna — самая быстрая и дешёвая. У всех трёх окно на 1,05 млн токенов и понимание картинок.
- У xAI — Grok 4.7: вышла 21 сентября, в тесте CursorBench прибавила почти шесть пунктов к Grok 4.6. Окно — 500 тысяч токенов, в API — $2 за миллион входных токенов.
- В линейке Qwen 3.8 от Alibaba есть и облачный флагман Max, и открытые версии для запуска на своих серверах — 27B и Open 2.4T. Свежая Omni Flash (18 сентября) принимает текст, изображения, аудио и видео.
Главное изменение месяца
Почти у всех новинок окно контекста — около миллиона токенов: в один запрос помещаются книги, архивы переписки или целый программный проект. Второй тренд — быстрые модели резко подешевели: GPT-6 Luna стоит в API $0,10 за миллион входных токенов, DeepSeek V4.1 Flash и GLM 5.3 Flash — около $0,15.
Чем новинки полезны для чат-ботов
Для тех, кто общается с ИИ каждый день, новинки означают больше выбора: у каждой крупной компании теперь есть и мощная модель, и быстрая бесплатная. Для переписки и вопросов хватает DeepSeek V4.1 Flash или GLM 5.3, для серьёзной работы — GPT-6 Sol или Claude Opus 5.5.
Что выбрать под задачу
- Бесплатно и на каждый день — DeepSeek V4.1 Flash, GLM 5.3 или Qwen 3.8 Flash.
- Расшифровать голосовое или видео — Qwen 3.8 Omni Flash.
- Документы и тексты для работы — GPT-6 Sol или Claude Opus 5.5.
- Сложный код и большие проекты — GPT-6 Astra, Claude Opus 5.5 или Grok 4.7.
- Запустить модель у себя — Qwen 3.8 27B.
Можно ли пользоваться новинками в России
Официально большинство новинок в России недоступны: в списках стран OpenAI и Anthropic России нет, сервисы Meta* запрещены, а API почти везде оплачивается зарубежной картой. Рабочий вариант — сервис-агрегатор с оплатой в рублях: в нём новые модели собраны в одном окне, а VPN не нужен.
Частые вопросы
Что значит «окно на миллион токенов»?
Это объём текста, который модель держит в голове за один запрос: несколько толстых книг, большой архив документов или целый программный проект.
Какие из новинок можно попробовать бесплатно?
Быстрые модели: DeepSeek V4.1 Flash, GLM 5.3, Qwen 3.8 Flash и Qwen 3.8 Omni Flash. Флагманы — GPT-6, Claude Opus 5.5, Grok 4.7 — платные.
Нужен ли VPN, чтобы пользоваться новыми нейросетями?
Если работать через агрегатор с оплатой в рублях — нет. Напрямую сервисы OpenAI и Anthropic в России официально не работают.
Что стало с DeepSeek V4 Flash Vision?
Экспериментальная модель выведена из работы: с 10 сентября её запросы в API DeepSeek обслуживает V4.1 Flash, которая понимает картинки лучше.
* Meta Platforms Inc. признана в России экстремистской организацией, её деятельность запрещена.
Подобрать локальную модель и настроить под данные
Скажите, какой у вас компьютер и какие данные, — агент подберёт модель, напишет установку и инструкцию, подготовит базу знаний.
Поставить задачу →Частые вопросы
Нужна ли видеокарта?
Желательна: без неё модели до 4 миллиардов работают на процессоре, медленно. Mac с единой памятью — исключение.
Локальная модель понимает русский?
Qwen и Gemma — хорошо; Llama — заметно хуже.
Можно ли дообучить локальную модель?
Да, LoRA через Unsloth на своей видеокарте или в бесплатном Colab, затем экспорт в GGUF и запуск в Ollama.