Полевой гид по нейросетям · РФПроверяем руками · est. 2026

Главная / Что в мире

Что в мире ИИ: сентябрь 2026

Уровень: Все уровни

№ 00 OK Проверил факты: Алексей Суровцев · 2026-09-17 · 5 мин чтения

Короткий ответ: за две первые недели сентября вышли пять заметных моделей — Claude Fable 5.1, GPT-6 Astra, Gemini 3.8 Flash, Meta Muse Spark 1.3 и DeepSeek-V4.1-Flash. Главный вывод не в том, кто победил, а в том, что рейтинги разошлись: разные независимые замеры дают разных лидеров, а разрыв между первым и пятым местом сузился до неразличимого на практике. Для пользователя это означает, что выбирать пора не по рейтингу, а по задаче, цене и доступности.

1. Пять релизов за две недели

Claude Fable 5.1 от Anthropic вышел 1 сентября, Gemini 3.8 Flash от Google получил стабильный статус 2 сентября, в тот же день Meta выпустила открытую линейку Muse Spark 1.3, 3 сентября OpenAI представила GPT-6 Astra, а 10 сентября DeepSeek выкатил V4.1-Flash.

Почему важно. Такая плотность релизов сама по себе сигнал: рынок перешёл в режим, где флагман живёт недели, а не годы. Планировать работу «под конкретную модель» перестало иметь смысл — планировать нужно под задачу и менять инструмент по мере надобности.

Что делать. Не переезжать за каждым релизом. Держите список своих типовых задач и проверяйте новую модель только на них — если прирост не виден, переезд не нужен.

2. Рейтинги разошлись, и это главное событие месяца

По Intelligence Index от Artificial Analysis впереди Claude Fable 5.1, за ним GPT-6 Astra и Claude Opus 5. По LMArena, где люди вслепую выбирают лучший из двух ответов, лидирует Grok-4.1 Thinking с рейтингом 1483. По научным задачам GPQA Diamond лучший результат у GPT-5.6 Sol — 94,6%. На очных сравнениях по коду выигрывает Claude Opus 5.

Почему важно. Это не путаница, а следствие методики: индекс меряет способность решать задачи, арена — насколько ответ нравится человеку, GPQA — знание науки. Модель может быть умнее и при этом проигрывать в приятности.

И отдельно то, о чём почти не пишут: абсолютные значения одного и того же индекса у разных публичных источников расходятся. Для Claude Fable 5.1 мы встречали и 66, и 53,4. Порядок мест при этом совпадает. Опираться стоит на порядок, а не на цифру, и настороженно относиться к любому материалу, где одна такая цифра подаётся как истина.

Что делать. Смотреть замер, который соответствует вашей задаче: код — арены по коду, наука — GPQA, живое общение — LMArena.

3. Цена перестала следовать за силой

Grok 4.6, вышедший 12 августа, оказался «выбором по цене» на фронтире: по силе он тянется к GPT-5.6 Sol, а стоит примерно втрое дешевле. DeepSeek идёт тем же путём — сильная модель с открытой линейкой и низкой ценой.

Почему важно. Ещё год назад «лучшее» и «дорогое» были почти синонимами. Сейчас нет, и для пользователя из России это важнее рейтингов: при оплате через агрегатор вы платите за фактические токены, а значит выбор более дешёвой модели сопоставимой силы напрямую уменьшает счёт.

Что делать. Сравнивать не только качество, но и цену за результат. Часто выгоднее взять модель второго места и сделать три попытки, чем одну попытку у лидера.

4. Контекст в два миллиона токенов

Grok-4 Fast Reasoning держит самый большой практический контекст на рынке — 2 млн токенов.

Почему важно. Это меняет класс решаемых задач: в один запрос помещается книга, годовой архив переписки или крупный репозиторий кода. Раньше такие задачи приходилось резать на части и склеивать результаты, теряя связность.

Что делать. Если ваша работа — разбор больших объёмов (документы, договоры, архивы), это единственный релиз месяца, который стоит проверить сразу.

5. Агентный ИИ и робототехника — главные темы года

Семантический анализ 4,7 тысячи новостных сообщений об ИИ в российских медиа за год (май 2025 — май 2026) показал три самые заметные темы: модели, агентный ИИ и робототехника.

Почему важно. Агентный ИИ — это переход от «модель отвечает» к «модель делает»: сама ищет, сравнивает, выполняет многошаговую задачу. Такие режимы уже появились в потребительских сервисах, включая российские агрегаторы.

Что делать. Попробовать агентный режим на задаче, где вы обычно делаете десять действий руками, — сбор информации по списку, сравнение вариантов, заполнение таблицы. Это тот случай, где прирост виден сразу.

6. Наука и медицина: то, что не видно обычному пользователю

На ПМЭФ 2026 Минобрнауки показало три разработки: бионическую руку NEXUS-1S с нейроинтерфейсом, комплекс трёхмерной биопечати живых тканей и линейку лазерных датчиков NINA. Отдельно в августе в России прошла первая роботизированная операция.

Почему важно. Это направления, где ИИ работает не как чат, а как часть физической системы — распознавание, управление, обработка сигналов. Среди перспективных областей эксперты называют применение ИИ в материаловедении, биоинформатике и геологии.

Что делать. Пользователю — ничего, и это честный ответ. Но если вы выбираете, куда развиваться профессионально, это карта направлений, где спрос на специалистов будет расти, а конкуренция пока меньше, чем в генерации картинок.

Доступно ли это из России

Что Доступ напрямую Как получить
Claude Fable 5.1, Claude Opus 5 нет агрегатор или свой аккаунт с зарубежной картой
GPT-6 Astra, GPT-5.6 Sol нет агрегатор или свой аккаунт
Gemini 3.8 Flash нет агрегатор или свой аккаунт
Grok 4.6, Grok-4 Fast нет агрегатор или свой аккаунт
DeepSeek-V4.1-Flash нет агрегатор, свой аккаунт или локальный запуск
Meta Muse Spark 1.3 нет локальный запуск открытой модели
Агентные режимы частично есть в российских агрегаторах

Полная картина с путями доступа по каждой модели — в живом каталоге. Как устроены сами пути и чем они отличаются по цене и возможностям — в разборе способов оплаты и доступа.

Мимо прошло

Заявления вендоров о превосходстве собственных моделей, не подтверждённые независимыми замерами: в сентябре таблицы OpenAI и Anthropic противоречили друг другу по одним и тем же тестам. Мы это разбирали отдельно — и с тех пор ситуация не изменилась.

Разбор выходит регулярно: мировые релизы и исследования с обязательной проверкой, что из этого доступно отсюда и на каких условиях. Источники в каждом пункте — первичные публикации и независимые замеры, а не пересказы.

Частые вопросы

Какая модель сейчас лучшая в мире?

Зависит от того, что считать лучшим. По независимому Intelligence Index от Artificial Analysis впереди Claude Fable 5.1, по слепому голосованию людей на LMArena — Grok-4.1 Thinking, по научным задачам GPQA Diamond — GPT-5.6 Sol с 94,6%. Единого лидера нет, и это само по себе новость.

Стоит ли переходить на новую модель сразу после релиза?

Обычно нет. Разрыв между первым и пятым местом сузился настолько, что на повседневных задачах разницу вы не заметите, зато заметите в цене и скорости. Менять инструмент стоит под конкретную задачу, где старый заметно не справляется.

Что из мировых релизов доступно из России?

Почти всё — через российские агрегаторы с оплатой в рублях, часть моделей ещё и локально. Недоступны напрямую только личные аккаунты в зарубежных сервисах: для них нужны VPN-доступ и зарубежная карта.