Vuncloud Блог
← К столбцу Cloud Lab

Почему китайские AI-модели доминируют в рейтинге OpenRouter? 5 сигналов для разработчиков

OpenRouter · DeepSeek V4 · Qwen · использование токенов · открытые веса · бум Agent · гид по выбору~10 мин чтения

Серверные стойки и сетевые кабели в дата-центре — символизирует смещение глобального трафика токенов OpenRouter к китайским AI-моделям

Если вы недавно открывали рейтинг OpenRouter, могли удивиться: большая часть топ-10 — модели китайских лабораторий, а по еженедельному использованию токенов китайские вендоры вместе уже много недель подряд превышают половину мирового объёма.

Это не маркетинговый лозунг «подъём отечественных», а результат голосования кошельков разработчиков по всему миру. OpenRouter — одна из крупнейших нейтральных платформ маршрутизации LLM; она считает реальные токены API-вызовов — ближе к продакшену, чем бенчмарки.

Эта статья отвечает на три вопроса: насколько сильно доминирование? почему? что это значит для кода и Agent?

50%+
С конца июня 2026 китайские модели — более половины еженедельных токенов OpenRouter
6/10
Топ-10 моделей в июне 2026: ~6 мест китайским open-source моделям
~10×
Месячный рост токенов DeepSeek V4 Flash (май–июнь 2026)

1. Что измеряет рейтинг OpenRouter

OpenRouter — агрегирующий слой LLM API: единый интерфейс для DeepSeek, Claude, Gemini, Qwen и сотен моделей, оплата по реальным токенам. Рейтинг сортирует по фактическому потреблению, а не по:

  • лабораторным бенчмаркам (MMLU, HumanEval и т. п.);
  • медийной огласке или раундам финансирования;
  • модели по умолчанию в одном приложении.

Когда китайские модели «доминируют» на OpenRouter, это значит: независимые разработчики, стартапы и side projects по всему миру массово используют их в продакшен-инференсе — coding-copilot, support-боты, document-agent, пакетная обработка данных.

Не то же самое, что MAU ChatGPT

Пользователи OpenRouter — в основном разработчики с API, не доля потребительских чат-приложений. Но очень предсказуемо для «кто станет следующим open-source по умолчанию» — в 2024 лидировал Llama, в 2026 нарратив переписан.

2. Насколько сильно: снимок июля 2026

По блогу OpenRouter и сторонним сводкам за июнь–июль 2026 важны такие цифры:

Измерение Явление Пример модели / вендора
Рейтинг модели #1 DeepSeek V4 Flash долго на первом месте, месячные токены — триллионы DeepSeek
Топ-10 моделей ~6 китайских моделей; Claude Sonnet/Opus, Gemini Flash между ними Hy3, MiniMax M3, MiMo-V2.5, V4 Pro…
Доля токенов вендоров DeepSeek ~18%; Xiaomi ~8%; MiniMax, Tencent по ~8%; Qwen ~4%; вместе >46 % идентифицированного использования Несколько китайских компаний + Alibaba
Недельный тренд С конца апреля 2026 китайские недельные токены 10 недель подряд выше американских аналогов
Open-source ландшафт Meta Llama <1 % маршрутизации OpenRouter; Qwen — более 1 млрд загрузок на Hugging Face Qwen заменяет Llama как самая используемая открытая база

Показательная деталь: Xiaomi MiMo имеет огромную долю маршрутизации coding-токенов — не побочный проект смартфонной компании, а сигнал, что разработчики берут его как модель программирования по умолчанию.

3. Пять сигналов: почему китайские модели

Сигнал 1: экстремальное соотношение цена/качество — объём оторван от выручки

Самое заметное на OpenRouter: доля токенов взлетает, счёт растёт умеренно. DeepSeek V4 Flash стоит намного дешевле сопоставимых закрытых US-моделей; данные Vercel: DeepSeek ~17 % инференса, ~1 % выручки.

Для инди-разработчиков и стартапов это значит:

  • тот же месячный бюджет — в десять раз больше Agent-циклов;
  • прототип без стресса «лишние доллары за 1M токенов»;
  • дорогая модель на критическом пути, дешёвая — на длинный хвост batch.

Доминирование в рейтинге — прежде всего экономическое доминирование.

Сигнал 2: открытые веса меняют пути дистрибуции

В 2023–2024 «open-source LLM» почти означал Meta Llama. В 2026 поле open-weight — в Китае:

  • DeepSeek, Qwen, MiMo публикуют скачиваемые веса — self-hosting, fine-tuning, дистилляция;
  • облака, IDE-плагины, вертикальные SaaS переупаковывают ту же базу и возвращаются в статистику OpenRouter;
  • нет vendor lock-in, стоимость переключения близка к нулю.

Пока US open-source вроде Llama 4 замедляется и доля маршрутизации падает, китайские лаборатории занимают нишу «open-source по умолчанию» через более частые релизы и открытые лицензии.

Сигнал 3: взрыв Agent-нагрузок — кто выдерживает длинные контекстные циклы

2025: чат «вопрос–ответ». 2026: Agent с многократными вызовами инструментов — чтение файлов, команды, правка кода, обратная связь — легко сотни тысяч токенов на задачу.

DeepSeek в insight OpenRouter: V4 — первая модель DeepSeek, достаточная для agentic-нагрузок. V4 Flash использует MoE + sparse attention (DSA) и опускает стоимость million-context инференса до batch-уровня.

Модели в топе делят профиль: быстрые, дешёвые, длинный контекст, пригодны для циклов — продакшен-конвейер, а не разовый puzzle-бенчмарк.

Терминал разработчика и интерфейс кода — символизирует высокочастотные coding- и tool-call нагрузки китайских моделей на OpenRouter
В эпоху Agent рейтинг награждает модели, которые «работают 7×24 и остаются доступными» — цена/качество и длинный контекст важнее разового шоу.

Сигнал 4: скорость итераций — новое поколение каждые три месяца

Структурный сигнал июньского рейтинга: использование DeepSeek V3.2 падает, V4 Flash/Pro взлетает. «Устаревание» open-source моделей сжалось с лет до кварталов или месяцев.

У китайских лабораторий в 2026 высокий темп релизов: Tencent Hy3 Preview, новая MiMo, MiniMax M3. Разработчики не ждут двенадцать месяцев — кто в этом месяце дешёв и хорош на OpenRouter, попадает в CI и конфиг Agent.

Сигнал 5: толщина экосистемы — сеть производных Qwen

По токенам одной модели — пик DeepSeek V4 Flash. По базе экосистемы — Alibaba Qwen как второй ров:

  • более 1 млрд загрузок Hugging Face, больше Llama;
  • более 200 000 производных с тегом Qwen;
  • ~40 % новых глобальных open-source LLM-производных на базе Qwen.

Многие «fine-tune XY» или «domain XY» на OpenRouter стоят на Qwen или DeepSeek. Доминирует не только оригинальный SKU, но и агрегированный трафик леса производных.

4. Американские модели не проиграли — роли сменились

Не читайте рейтинг как «US AI мёртва». Точнее — перераспределение ролей:

Уровень Примеры Позиция в рейтинге
Премиум-инференс / сложный код Claude Opus 4.8, Sonnet 4.6 Меньше токенов, чем DeepSeek Flash, но лидерство в intelligence-бенчмарках; для «сложных» задач и PR-ревью
Закрытые универсалы GPT-4.x, Gemini 3 Рост замедлился, всё ещё интеграция по умолчанию у крупных игроков
Batch-Agent / open-source по умолчанию DeepSeek V4, Qwen, MiMo, Hy3 Лидеры по объёму токенов; «достаточно хорошо и дёшево» — новый default
Старый open-source король Серия Llama Маршрутизация OpenRouter <1 %, нишу заняли китайские открытые модели

Интересный контраст: Claude Opus 4.8 #1 по intelligence, #7 по использованию токенов. Умный — дорого; многие берут «на 90 % так же умный, намного дешевле» для основного трафика.

5. Как разработчику выбрать модель

Рейтинг — карта, не догма. Слои по задачам:

  1. Критический путь (архитектура, security-аудит, сложные баги): Claude Opus/Sonnet или премиум GPT; принять высокую цену.
  2. Ежедневные Agent-циклы (код, тесты, batch-документы): DeepSeek V4 Flash, Qwen3 coder, MiMo — на OpenRouter проверить задержку и галлюцинации.
  3. Приват / compliance: скачать open weights Qwen/DeepSeek, self-host или VPC; внешний API через OpenRouter как fallback.
  4. Мульти-модельный роутинг: auto router OpenRouter или правила приложения — простые задачи на китайский open source, при низкой уверенности — апгрейд до Claude.

Не смотрите только на #1

Hy3, MiniMax M3 и др. растут быстро, но галлюцинации и стабильность tool-call зависят от сценария. В проде неделю на реальном коде и реальных тикетах — потом фиксируйте default.

6. Связка с Mac / облачной разработкой

OpenRouter — облачный API; многие команды всё равно гоняют лёгкий инференс или оркестрацию Agent локально или на build-машине:

  • Mac mini M4: unified memory для квантизованных Qwen/DeepSeek (Ollama, MLX); локально пробовать prompt, затем крупная модель на OpenRouter;
  • Claude Code / Cursor / OpenClaw: модели настраиваются; рейтинг показывает сдвиг default к китайскому open source — пересматривайте toolchain ежеквартально;
  • Windows как основной ПК + iOS-релиз: AI-эксперименты и Xcode packaging на Cloud Mac — API глобально, build-узел APAC/US West с низкой задержкой.

Полный поток без Mac: гид по Cloud Mac; локальный vs облачный AI: Mac mini M4 для AI-разработки.

FAQ

Как формируется рейтинг OpenRouter?

Реальное потребление токенов API, агрегация по модели и вендору. Отражает фактическое использование и расходы, не лабораторные баллы.

Доминирование китайских моделей — накрутка?

Данные от независимых разработчиков и приложений по миру. Рост связан с ценой/качеством, open-source дистрибуцией и соответствием Agent — совпадает с волной V4 в 2026.

Какие китайские модели лидируют?

Рейтинг моделей: DeepSeek V4 Flash, Tencent Hy3, MiniMax M3, Xiaomi MiMo-V2.5, DeepSeek V4 Pro и др. Вендоры: DeepSeek, Xiaomi, MiniMax, Tencent, Qwen с заметной долей.

Американские модели плохие?

Премиум-возможности остаются, но ежедневные токены уходят на более дешёвый китайский open source. Разделение труда, не замена.

Как выбрать обычному разработчику?

Слои по задачам + оценка на реальных бизнес-кейсах; OpenRouter для экспериментов, месячный счёт для проверки — не только заголовки СМИ.

Как это связано с Mac-разработкой?

Open weights работают локально на Mac M; Cloud Mac — стабильный узел параллельно Agent и Xcode. API + локально — распространённая архитектура.

Итог

Доминирование китайских AI-моделей на OpenRouter — на поверхности смена цветов рейтинга, по сути разработчики токенами ответили на три вопроса:

  • База open-source по умолчанию? — сдвиг от Llama к Qwen/DeepSeek;
  • Движок инференса Agent по умолчанию? — дёшево, быстро, длинный контекст;
  • Премиум closed source ещё нужен? — да, но всё больше как «спецоружие», а не штатная винтовка.

Рейтинг меняется еженедельно. Важнее заголовка «кто первый»: сколько токенов ваш Agent сжигает в месяц и сколько можно безопасно перевести на китайский open source — это реальный сигнал для бюджета и скорости поставки.

Agent + сборка приложения? Cloud Mac M4 как узел «всё в одном»

Выделенный Mac mini M4 от Vuncloud: MLX/Ollama локально, Xcode CI и оркестрация Agent OpenRouter в облаке. Помесячная проба без предварительной покупки железа.

Тарифы Cloud Mac · Гид по AI на M4

Данные: блог OpenRouter и публичные сторонние сводки июнь–июль 2026; ранги и доли обновляются еженедельно — см. openrouter.ai/rankings. Последнее обновление: 7 июля 2026.

Полевые заметки · AI-инсайты

Agentам нужен compute, релизам — Mac

OpenRouter · Cloud Mac M4 · локальный инференс + облачная сборка

Тарифы Cloud Mac
Ограниченное предложение Смотреть тарифы