Если вы недавно открывали рейтинг OpenRouter, могли удивиться: большая часть топ-10 — модели китайских лабораторий, а по еженедельному использованию токенов китайские вендоры вместе уже много недель подряд превышают половину мирового объёма.
Это не маркетинговый лозунг «подъём отечественных», а результат голосования кошельков разработчиков по всему миру. OpenRouter — одна из крупнейших нейтральных платформ маршрутизации LLM; она считает реальные токены API-вызовов — ближе к продакшену, чем бенчмарки.
Эта статья отвечает на три вопроса: насколько сильно доминирование? почему? что это значит для кода и Agent?
1. Что измеряет рейтинг OpenRouter
OpenRouter — агрегирующий слой LLM API: единый интерфейс для DeepSeek, Claude, Gemini, Qwen и сотен моделей, оплата по реальным токенам. Рейтинг сортирует по фактическому потреблению, а не по:
- лабораторным бенчмаркам (MMLU, HumanEval и т. п.);
- медийной огласке или раундам финансирования;
- модели по умолчанию в одном приложении.
Когда китайские модели «доминируют» на OpenRouter, это значит: независимые разработчики, стартапы и side projects по всему миру массово используют их в продакшен-инференсе — coding-copilot, support-боты, document-agent, пакетная обработка данных.
Не то же самое, что MAU ChatGPT
Пользователи OpenRouter — в основном разработчики с API, не доля потребительских чат-приложений. Но очень предсказуемо для «кто станет следующим open-source по умолчанию» — в 2024 лидировал Llama, в 2026 нарратив переписан.
2. Насколько сильно: снимок июля 2026
По блогу OpenRouter и сторонним сводкам за июнь–июль 2026 важны такие цифры:
| Измерение | Явление | Пример модели / вендора |
|---|---|---|
| Рейтинг модели #1 | DeepSeek V4 Flash долго на первом месте, месячные токены — триллионы | DeepSeek |
| Топ-10 моделей | ~6 китайских моделей; Claude Sonnet/Opus, Gemini Flash между ними | Hy3, MiniMax M3, MiMo-V2.5, V4 Pro… |
| Доля токенов вендоров | DeepSeek ~18%; Xiaomi ~8%; MiniMax, Tencent по ~8%; Qwen ~4%; вместе >46 % идентифицированного использования | Несколько китайских компаний + Alibaba |
| Недельный тренд | С конца апреля 2026 китайские недельные токены 10 недель подряд выше американских аналогов | — |
| Open-source ландшафт | Meta Llama <1 % маршрутизации OpenRouter; Qwen — более 1 млрд загрузок на Hugging Face | Qwen заменяет Llama как самая используемая открытая база |
Показательная деталь: Xiaomi MiMo имеет огромную долю маршрутизации coding-токенов — не побочный проект смартфонной компании, а сигнал, что разработчики берут его как модель программирования по умолчанию.
3. Пять сигналов: почему китайские модели
Сигнал 1: экстремальное соотношение цена/качество — объём оторван от выручки
Самое заметное на OpenRouter: доля токенов взлетает, счёт растёт умеренно. DeepSeek V4 Flash стоит намного дешевле сопоставимых закрытых US-моделей; данные Vercel: DeepSeek ~17 % инференса, ~1 % выручки.
Для инди-разработчиков и стартапов это значит:
- тот же месячный бюджет — в десять раз больше Agent-циклов;
- прототип без стресса «лишние доллары за 1M токенов»;
- дорогая модель на критическом пути, дешёвая — на длинный хвост batch.
Доминирование в рейтинге — прежде всего экономическое доминирование.
Сигнал 2: открытые веса меняют пути дистрибуции
В 2023–2024 «open-source LLM» почти означал Meta Llama. В 2026 поле open-weight — в Китае:
- DeepSeek, Qwen, MiMo публикуют скачиваемые веса — self-hosting, fine-tuning, дистилляция;
- облака, IDE-плагины, вертикальные SaaS переупаковывают ту же базу и возвращаются в статистику OpenRouter;
- нет vendor lock-in, стоимость переключения близка к нулю.
Пока US open-source вроде Llama 4 замедляется и доля маршрутизации падает, китайские лаборатории занимают нишу «open-source по умолчанию» через более частые релизы и открытые лицензии.
Сигнал 3: взрыв Agent-нагрузок — кто выдерживает длинные контекстные циклы
2025: чат «вопрос–ответ». 2026: Agent с многократными вызовами инструментов — чтение файлов, команды, правка кода, обратная связь — легко сотни тысяч токенов на задачу.
DeepSeek в insight OpenRouter: V4 — первая модель DeepSeek, достаточная для agentic-нагрузок. V4 Flash использует MoE + sparse attention (DSA) и опускает стоимость million-context инференса до batch-уровня.
Модели в топе делят профиль: быстрые, дешёвые, длинный контекст, пригодны для циклов — продакшен-конвейер, а не разовый puzzle-бенчмарк.
Сигнал 4: скорость итераций — новое поколение каждые три месяца
Структурный сигнал июньского рейтинга: использование DeepSeek V3.2 падает, V4 Flash/Pro взлетает. «Устаревание» open-source моделей сжалось с лет до кварталов или месяцев.
У китайских лабораторий в 2026 высокий темп релизов: Tencent Hy3 Preview, новая MiMo, MiniMax M3. Разработчики не ждут двенадцать месяцев — кто в этом месяце дешёв и хорош на OpenRouter, попадает в CI и конфиг Agent.
Сигнал 5: толщина экосистемы — сеть производных Qwen
По токенам одной модели — пик DeepSeek V4 Flash. По базе экосистемы — Alibaba Qwen как второй ров:
- более 1 млрд загрузок Hugging Face, больше Llama;
- более 200 000 производных с тегом Qwen;
- ~40 % новых глобальных open-source LLM-производных на базе Qwen.
Многие «fine-tune XY» или «domain XY» на OpenRouter стоят на Qwen или DeepSeek. Доминирует не только оригинальный SKU, но и агрегированный трафик леса производных.
4. Американские модели не проиграли — роли сменились
Не читайте рейтинг как «US AI мёртва». Точнее — перераспределение ролей:
| Уровень | Примеры | Позиция в рейтинге |
|---|---|---|
| Премиум-инференс / сложный код | Claude Opus 4.8, Sonnet 4.6 | Меньше токенов, чем DeepSeek Flash, но лидерство в intelligence-бенчмарках; для «сложных» задач и PR-ревью |
| Закрытые универсалы | GPT-4.x, Gemini 3 | Рост замедлился, всё ещё интеграция по умолчанию у крупных игроков |
| Batch-Agent / open-source по умолчанию | DeepSeek V4, Qwen, MiMo, Hy3 | Лидеры по объёму токенов; «достаточно хорошо и дёшево» — новый default |
| Старый open-source король | Серия Llama | Маршрутизация OpenRouter <1 %, нишу заняли китайские открытые модели |
Интересный контраст: Claude Opus 4.8 #1 по intelligence, #7 по использованию токенов. Умный — дорого; многие берут «на 90 % так же умный, намного дешевле» для основного трафика.
5. Как разработчику выбрать модель
Рейтинг — карта, не догма. Слои по задачам:
- Критический путь (архитектура, security-аудит, сложные баги): Claude Opus/Sonnet или премиум GPT; принять высокую цену.
- Ежедневные Agent-циклы (код, тесты, batch-документы): DeepSeek V4 Flash, Qwen3 coder, MiMo — на OpenRouter проверить задержку и галлюцинации.
- Приват / compliance: скачать open weights Qwen/DeepSeek, self-host или VPC; внешний API через OpenRouter как fallback.
- Мульти-модельный роутинг: auto router OpenRouter или правила приложения — простые задачи на китайский open source, при низкой уверенности — апгрейд до Claude.
Не смотрите только на #1
Hy3, MiniMax M3 и др. растут быстро, но галлюцинации и стабильность tool-call зависят от сценария. В проде неделю на реальном коде и реальных тикетах — потом фиксируйте default.
6. Связка с Mac / облачной разработкой
OpenRouter — облачный API; многие команды всё равно гоняют лёгкий инференс или оркестрацию Agent локально или на build-машине:
- Mac mini M4: unified memory для квантизованных Qwen/DeepSeek (Ollama, MLX); локально пробовать prompt, затем крупная модель на OpenRouter;
- Claude Code / Cursor / OpenClaw: модели настраиваются; рейтинг показывает сдвиг default к китайскому open source — пересматривайте toolchain ежеквартально;
- Windows как основной ПК + iOS-релиз: AI-эксперименты и Xcode packaging на Cloud Mac — API глобально, build-узел APAC/US West с низкой задержкой.
Полный поток без Mac: гид по Cloud Mac; локальный vs облачный AI: Mac mini M4 для AI-разработки.
FAQ
Как формируется рейтинг OpenRouter?
Реальное потребление токенов API, агрегация по модели и вендору. Отражает фактическое использование и расходы, не лабораторные баллы.
Доминирование китайских моделей — накрутка?
Данные от независимых разработчиков и приложений по миру. Рост связан с ценой/качеством, open-source дистрибуцией и соответствием Agent — совпадает с волной V4 в 2026.
Какие китайские модели лидируют?
Рейтинг моделей: DeepSeek V4 Flash, Tencent Hy3, MiniMax M3, Xiaomi MiMo-V2.5, DeepSeek V4 Pro и др. Вендоры: DeepSeek, Xiaomi, MiniMax, Tencent, Qwen с заметной долей.
Американские модели плохие?
Премиум-возможности остаются, но ежедневные токены уходят на более дешёвый китайский open source. Разделение труда, не замена.
Как выбрать обычному разработчику?
Слои по задачам + оценка на реальных бизнес-кейсах; OpenRouter для экспериментов, месячный счёт для проверки — не только заголовки СМИ.
Как это связано с Mac-разработкой?
Open weights работают локально на Mac M; Cloud Mac — стабильный узел параллельно Agent и Xcode. API + локально — распространённая архитектура.
Итог
Доминирование китайских AI-моделей на OpenRouter — на поверхности смена цветов рейтинга, по сути разработчики токенами ответили на три вопроса:
- База open-source по умолчанию? — сдвиг от Llama к Qwen/DeepSeek;
- Движок инференса Agent по умолчанию? — дёшево, быстро, длинный контекст;
- Премиум closed source ещё нужен? — да, но всё больше как «спецоружие», а не штатная винтовка.
Рейтинг меняется еженедельно. Важнее заголовка «кто первый»: сколько токенов ваш Agent сжигает в месяц и сколько можно безопасно перевести на китайский open source — это реальный сигнал для бюджета и скорости поставки.
Agent + сборка приложения? Cloud Mac M4 как узел «всё в одном»
Выделенный Mac mini M4 от Vuncloud: MLX/Ollama локально, Xcode CI и оркестрация Agent OpenRouter в облаке. Помесячная проба без предварительной покупки железа.
Читать также
- Как выбрать модель Claude: Sonnet 5, Fable 5, Opus 4.8 — полное сравнение
- Подходит ли Mac Mini M4 для AI-разработки на Cloud Mac? (2026)
- Гонка моделей закончилась—почему Mac-узлы так трудно достать
- OpenRouter официально: DeepSeek V4 и рост Agent-токенов (английский)
Данные: блог OpenRouter и публичные сторонние сводки июнь–июль 2026; ранги и доли обновляются еженедельно — см. openrouter.ai/rankings. Последнее обновление: 7 июля 2026.