25 сентября 2026 г.
Открытые нейросети впервые обогнали закрытые - но деньги остались у закрытых

Открытые нейросети впервые сделали больше половины всей работы ИИ. В августе 2026 на модели с открытыми весами пришлось 56% всех токенов в продакшене - против менее 10% годом раньше. Но деньги остались у закрытых: им уходит 86% всех трат, одной Anthropic - 64%. Объём ушёл к бесплатным весам, выручка осталась у флагманов.
Цифры - из свежего отчёта Vercel, который каждый месяц считает, через какие модели реально гоняют задачи тысячи продакшен-приложений. Раскол между «кто делает работу» и «кому за неё платят» - это главный сюжет года в прикладном ИИ. Ниже разберу, откуда взялись эти проценты, кто эти открытые модели и что со всем этим делать тебе.
Что именно замерили
Речь про AI Gateway Production Index - ежемесячный отчёт Vercel. У компании есть шлюз, через который приложения ходят к разным моделям: удобно, когда хочешь дёргать и Claude, и DeepSeek, и Qwen из одного места и не держать пять отдельных ключей. Через этот шлюз каждый месяц проходят десятки триллионов токенов, и Vercel анонимно сводит статистику: сколько токенов пришлось на какую модель и сколько на неё потратили денег.
Ценность цифры в том, что это не бенчмарк и не опрос. Бенчмарк меряет, кто умнее на тесте, опрос - кто на слуху. А тут видно, что люди реально запустили в прод и за что платят каждый день. Два разных числа на каждую модель: объём (сколько работы она делает) и трата (сколько на неё уходит денег). Именно расхождение этих двух чисел и оказалось самым интересным.
Путь с 7% до 56% за девять месяцев
Ещё в декабре 2025-го открытые веса тянули меньше 10% всех токенов на этом шлюзе - нишевая история для энтузиастов. В апреле 2026-го стало 13%. В августе - уже 56%. За неполный год открытые модели прошли путь от «попробовать на выходных» до большинства реальной нагрузки.
Причина простая: они догнали по качеству на массовых задачах и стоят в разы дешевле, а часть вообще бесплатна, если поставить у себя. Как только открытая модель начинает справляться с рутиной не хуже платной, дальше решает цена. И бизнес проголосовал токенами.

Почему объём у открытых, а деньги у закрытых
Вот тот самый раскол в цифрах. Открытые модели: 56% токенов, но только 14% трат. Закрытые: 44% токенов и 86% денег. Одна Anthropic собирает 64% всех расходов на шлюзе.
Логика за этим такая. Открытая модель стоит копейки за токен или вообще ноль, поэтому на неё вешают всё массовое: разбор писем, классификацию тикетов, извлечение данных, черновики, объёмный чат. Миллиарды токенов - но дешёвых. Закрытый флагман стоит в разы дороже за тот же токен, и его берегут для задач, где ошибка обходится дорого: сложный код, юридический разбор, финальная проверка. Мало токенов - но каждый золотой.
Разрыв в цене за токен между дешёвой открытой моделью и топовым флагманом легко доходит до десяти-двадцати раз. Поэтому даже если открытая модель обработала в разы больше запросов, в деньгах её вклад теряется на фоне сотни дорогих вызовов флагмана. Один тяжёлый прогон сложного кода на Opus может стоить как тысяча разборов писем на открытой модели.
В деньгах десяток дорогих вызовов перевешивает поток дешёвых. Поэтому картинка выходит зеркальной: работу делают открытые, а кассу собирают закрытые. Это не противоречие, это разделение труда - и его стоит держать в голове, когда собираешь свой стек.

Кто эти открытые модели
Почти все лидеры по объёму - китайские. На OpenRouter, другой крупной площадке-роутере, все пять самых нагруженных моделей оказались с открытыми весами, а во главе - DeepSeek с его дешёвой Flash-версией, порядка 18 триллионов токенов в неделю. По оценкам, китайские открытые модели гоняют около 18 триллионов токенов в неделю против примерно 5,5 у американских - разрыв почти втрое.
За DeepSeek идут Qwen от Alibaba, Kimi от Moonshot и GLM от Zhipu. Все они с открытыми весами, все доступны из России без плясок с картой, а часть можно поставить на своё железо. Про каждую на блоге есть отдельный разбор - если раньше это выглядело экзотикой, то теперь именно на них крутится большинство реальной нагрузки в мире.
То, что во главе списка именно китайские лаборатории, - не случайность. Пока американские компании держат сильнейшие модели закрытыми и продают доступ, китайские выкладывают веса открыто и берут рынок объёмом: разработчику по всему миру проще начать с бесплатной модели, которую можно потрогать и поставить к себе. Стратегии зеркальные, и отчёт Vercel показывает, к чему каждая привела - одни собрали выручку, другие собрали пользователей.
Цена часа работы падает
Второй вывод отчёта бьёт по кошельку в хорошем смысле. Средняя цена за токен в августе упала на 23,2% - это третий месяц снижения подряд. Медианная команда заплатила за токен на 7,6% меньше, чем в июле, а в среднем токен стоит уже меньше половины от того, что было пять месяцев назад.
Дешевеет даже премиум-сегмент. За один месяц старший Fable 5 потерял две трети своей доли в тратах, а Opus 5 - вдвое дешевле - утроил долю. Свежий GPT-6 Astra за двое суток после запуска забрал треть всех расходов на модели OpenAI. Люди массово переключаются на то, что даёт то же качество за меньшие деньги, - и делают это быстро, за дни, а не за кварталы.
Гонит цену вниз именно давление открытых весов. Когда рядом есть бесплатная модель, которая тянет твою рутину, закрытым лабам приходится либо резать ценник, либо выпускать версии дешевле и быстрее при том же уме - что мы и видим по релизам последних месяцев. Раньше конкуренция шла за первое место в бенчмарке, теперь она идёт за цену часа работы. Для того, кто платит по счетам, это разворот в правильную сторону.
Что это значит для тебя
Если ты что-то строишь на ИИ, вывод практический. Открытые модели дозрели до прода на массовых задачах. Разумная схема - гибрид: рутину вешаешь на дешёвую открытую модель, а на дорогой флагман эскалируешь те самые 5% задач, где нужен максимум ума. Ровно по этому принципу работают умные роутеры, которые сами выбирают модель под задачу - не гонят каждый запрос на самое мощное.
Для тех, кто в России, у открытых весов есть отдельный бонус: не нужно воевать с биллингом и VPN. Модель можно взять через агрегатор с одним ключом или поставить на своё железо, и данные при этом не уходят на чужой сервер.
И главное - не читай заголовок «открытые победили» как «закрытые проиграли». Закрытые по-прежнему собирают деньги и держат самые тяжёлые задачи. Победил здесь тот, кто платит: час работы ИИ дешевеет на глазах. Одна и та же задача стоит всё меньше - и умение собрать связку «дешёвое на объём плюс дорогое на сложное» теперь важнее, чем спор, какая модель абсолютно лучшая.
Источники
- Vercel: AI Gateway Production Index (сентябрь 2026)
- The New Stack: открытые веса взяли большинство токенов, Anthropic держит 64% трат
- FourWeekMBA: раскол объёма и трат на шлюзе Vercel
- Interconnects (Nathan Lambert): открытые и закрытые модели на разных экспонентах
- TechTimes: китайские открытые модели тянут большинство токенов разработчиков
