Подборка · данные на 18 августа 2026

Самые быстрые нейросети

Скорость важна там, где вы читаете ответ по мере появления: диалог, черновики, короткие правки. На длинной задаче, где модель работает сама, разница в токенах в секунду почти не чувствуется — там важнее, доведёт ли она дело до конца.

#МодельСкоростьИнтеллектКод$ / 1 млнСкоростьКонтекст
1Gemini 3.5 Flash-LiteGoogle328 ток/с37.449.3$0.85328 ток/с1 млн
2Gemini 3.7 FlashGoogle322 ток/с56.076.1$1.5322 ток/с1 млн
3Qwen3.7 MaxAlibaba201 ток/с46.766.0$3.8201 ток/с1 млн
4Gemini 3.6 FlashGoogle200 ток/с51.669.2$1.5200 ток/с1 млн
5Gemini 3.5 FlashGoogle180 ток/с46.7$3.4180 ток/с1 млн
6GLM-5.2Z AI172 ток/с52.668.8$2.1172 ток/с1 млн
7GPT-5.6 LunaOpenAI159 ток/с52.371.4$0.45159 ток/с1 млн
8Nex-N2-ProNex AGI138 ток/с41.759.1$1138 ток/с262 тыс.
9Mistral Medium 3.5Mistral136 ток/с30.446.9$3136 ток/с256 тыс.
10Agnes 2.5 Pro AlphaSapiens AI132 ток/с39.758.8$0.56132 ток/с1 млн
11Nemotron 3 UltraNVIDIA131 ток/с38.349.3$1.1131 ток/с262 тыс.
12Qwen3.5 122B A10BAlibaba130 ток/с32.845.7$1.1130 ток/с262 тыс.
13GPT-5.3 CodexOpenAI129 ток/с45.5$4.8129 ток/с400 тыс.
14Muse GlimmerMeta126 ток/с35.149.0$0.58126 ток/с131 тыс.
15GPT-5.6 TerraOpenAI121 ток/с56.676.7$4.5121 ток/с1 млн
16Qwen3.6 35B A3BAlibaba118 ток/с32.141.9$0.84118 ток/с262 тыс.
17o3OpenAI118 ток/с31.1$3.5118 ток/с200 тыс.
18Step 3.7 FlashStepFun117 ток/с30.939.6$0.44117 ток/с262 тыс.
19Gemini 3.1 Pro PreviewGoogle108 ток/с47.768.8$4.5108 ток/с1 млн
20KAT-Coder-Pro V2KwaiKAT107 ток/с33.759.5$0.52107 ток/с256 тыс.

Источник данных — Artificial Analysis, снимок от 18 августа 2026. Цена смешанная: три токена запроса на один токен ответа.

Как считали

Отсортировано по медианной скорости выдачи в токенах в секунду. Модели слабее 30 по индексу интеллекта отфильтрованы: быстрый бесполезный ответ — это не быстро, это просто бесполезно.

Вопросы

Что такое токены в секунду?

Токен — это кусочек текста примерно в половину слова. Сто токенов в секунду ощущаются как текст, который печатается быстрее, чем вы успеваете читать.

Почему быстрая модель иногда отвечает долго?

Скорость выдачи и время до первого слова — разные величины. Модель, которая перед ответом долго думает, начнёт отвечать позже, зато сам ответ пойдёт быстро. В сумме на коротком вопросе она может проиграть более медленной.

Нужен ли VPN, чтобы пользоваться этими моделями?

Нет. Все модели с пометкой «есть в Промто» работают из России без VPN и без зарубежной карты: доступ идёт через нашу инфраструктуру, оплата — российской картой с нейробаланса.

Откуда взяты цифры и как часто обновляются?

Это замеры независимой лаборатории, которая прогоняет модели по одинаковым наборам задач. Дату снимка мы показываем прямо на странице — цифры меняются с каждым обновлением моделей, и понимать, насколько они свежие, важнее, чем видеть красивое число.