OpenRouter 聚合 400+ 模型、統一 API,每週 token 量反映正式環境的真實路由選擇。本文對照 2026 年 6 月 Top10,聚焦 Claude、Gemini、DeepSeek、Kimi 四家。
標題裡的「贏家」沒有標準答案:有人看用量、有人看單價、有人看最難 5% 任務誰還在。下面用表格攤開口徑,方便你對照自己的場景選型。
1. 為什麼看 OpenRouter?
Benchmark 測單次推理上限;OpenRouter 測誰在被打 API——IDE 預設模型、Agent 框架路由、SaaS fallback,都會體現在週 token 曲線。這與 算力基礎設施戰爭 同一條邏輯:2026 年比的不只是模型分數,更是誰能穩定、便宜地交付 token。
讀榜前記住三點(Agent 多輪呼叫會放大價差,詳見 Agent 帳單):
| 前提 | 含義 |
|---|---|
| Token ≠ 收入 | 便宜模型天然 token 更多 |
| ≠ 全球 API 總量 | ChatGPT、Azure、端側流量不在此榜 |
| Agent 放大價差 | 多輪 tool call 讓單價差再乘數量級 |
2. 廠商 Top10(2026 年 6 月)
數據來自 OpenRouter 公開 Rankings 及第三方週 token 追蹤。Top10 合計約 19T token/週,精確數字隨週波動,以 官方頁面 為準。
這張表回答「流量大頭在誰手裡」。若你只做 API 路由、不做 C 端 App,廠商份額比任何 benchmark 都更接近真實採購傾向。
| # | 廠商 | 代表模型 | 份額 | 定位 |
|---|---|---|---|---|
| 1 | DeepSeek | V3.2 / V4 | ~16.3% | 用量冠軍,Agent 批量首選 |
| 2 | Anthropic | Claude Sonnet / Opus 4.x | ~15.5% | 複雜任務溢價留存 |
| 3 | Gemini 3.x | ~13.2% | 長上下文 + 生態分發 | |
| 4 | OpenAI | GPT-5.x | ~8.7% | 品牌強,OpenRouter 份額下滑 |
| 5 | Xiaomi | MiMo-V2-Pro | ~8.6% | 低價衝量黑馬 |
| 6 | Tencent | Hy 系列 | ~7.8% | 編碼 / Agent |
| 7 | MiniMax | M2.5 / M2.7 | ~7.2% | Agent 原生,OpenClaw 熱潮 |
| 8 | OpenRouter | 平台聚合 | ~5.9% | 預設路由 / 免費層 |
| 9 | Qwen | Qwen 3.6 Plus | ~4.7% | 開源 + 雲部署 |
| 10 | Moonshot | Kimi K2.x | ~3–5%* | 單模型常進 Top10,廠商份額波動 |
* 中國系 Top10 合計 ~44%+。Kimi 單模型可衝週榜第二,廠商份額通常低於前三。
前四名合計過半流量;第五名起是衝量型選手。多數團隊選型落在前四 + Kimi 這個子集。
3. 模型層 Top10(2026 Q2)
廠商份額看「錢流向誰」;模型排行看「哪張 model ID 在被呼叫」。選型應鎖定具體 ID,而非只記品牌名。
| 排名區間 | 模型 | 廠商 | 場景 |
|---|---|---|---|
| 1–2 | MiMo-V2-Pro / MiniMax M2.5 | Xiaomi / MiniMax | 超低價 Agent 批量 |
| 2–4 | Claude Sonnet 4.6 | Anthropic | IDE Agent 預設 |
| 3–5 | DeepSeek V3.2 / V4 | DeepSeek | 推理 / 程式碼 / 可自託管 |
| 4–6 | Qwen 3.6 Plus | 阿里 | 多語言 MoE |
| 5–7 | Claude Opus 4.6 / 4.7 | Anthropic | 架構級 / 安全審查 |
| 6–8 | Gemini 3.1 Pro / Flash Lite | 超長上下文 / 多模態 | |
| 7–9 | Kimi K2 / K2.5 / K2.6 | Moonshot | Agent 並行 / 編碼 |
Kimi 是「單模型衝進 Top10、廠商份額滯後」的爆款路徑;DeepSeek 則是持續霸榜。下面四家橫向比較。
4. 四巨頭對比:Claude vs Gemini vs DeepSeek vs Kimi
| 維度 | DeepSeek | Claude | Gemini | Kimi |
|---|---|---|---|---|
| 廠商份額 | ~16.3%(第 1) | ~15.5%(第 2) | ~13.2%(第 3) | ~3–5%(第 10) |
| 核心優勢 | 單位 intelligence 成本 | 最難任務仍付溢價 | 長上下文 + GCP 生態 | Agent 並行 / 編碼脈衝 |
| 典型場景 | 批量 tool call、日誌摘要 | 架構決策、安全審查 | 百萬 token 文件、多模態 | OpenClaw、多 sub-agent |
| 相對短板 | 合規 / 延遲 / 英文創意 | 單價高 | 純編碼 hype 低於 Sonnet | 份額波動大,追版本風險 |
| 「贏家」標籤 | 用量冠軍 | 溢價與信任 | 分發與預設選項 | Agent 編碼爆款 |
文件:Claude · Gemini API。台灣團隊常見組合:日常 DeepSeek / Sonnet,長文件 Gemini,難題 Opus——不必押注單一廠商。
5. 「真正贏家」按什麼尺子?
| 評判維度 | 領先者 |
|---|---|
| Token 份額(路由投票) | DeepSeek > Anthropic > Google |
| 單價 × 份額(收入近似) | Anthropic、Google 可能反超 |
| 最難 5% 任務 | Claude Opus / Gemini Pro |
| Agent 批量成本 | DeepSeek、MiniMax、Kimi、MiMo 輪換 |
財務、工程、維運看同一張榜,結論可以完全不同——這正是 Top10 值得每月複查的原因。
6. 分層路由參考
下表是 2026 年 Top10 下常見流量分配;合規敏感任務請改直連 API 或自託管權重。
| 任務層 | 推薦模型 | 流量佔比 |
|---|---|---|
| 輕量 / 子 Agent | DeepSeek Chat / Gemini Flash Lite / Kimi K2 | ~80% |
| 日常編碼 | Claude Sonnet 4.6 / DeepSeek V3.2 / Qwen 3.6 | ~15% |
| 架構 / 審查 | Claude Opus 4.6 | ~5% |
| 超長 / 多模態 | Gemini 3.1 Pro | 按需 |
OPENROUTER_MODEL_FAST=deepseek/deepseek-chat OPENROUTER_MODEL_CODING=anthropic/claude-sonnet-4.6 OPENROUTER_MODEL_HARD=anthropic/claude-opus-4.6 OPENROUTER_MODEL_LONG=google/gemini-3.1-pro
搭配 Model Routing fallbacks,429 時自動降級。建議用 10–20 個真實任務跑一週 eval,再鎖定比例。
7. 三個常見誤讀
| 誤讀 | 實際情況 |
|---|---|
| DeepSeek 第一 = Claude 輸了 | 80% 子任務 DeepSeek + 20% Opus 審查,互補 |
| Kimi 進 Top10 = All-in Kimi | 鎖定 model ID + eval,別追品牌名 |
| OpenRouter = 全球格局 | 僅反映 API / Agent 開發者路由 |
8. 常見問題
| 問題 | 簡答 |
|---|---|
| 個人預設選誰? | 編碼:Sonnet 4.6 或 DeepSeek V3.2;省錢:Flash Lite |
| OpenRouter vs 直連? | 開發用 OpenRouter;正式環境直連要 SLA / 合規 |
| DeepSeek 只是刷量? | 用固定 eval 跑一週自證 |
| Kimi vs DeepSeek? | 多 sub-agent 試 Kimi;穩定低價選 DeepSeek |
| Gemini 值得押注? | 已在 GCP / 要長上下文 → 是 |
| 數據多久變? | 滾動 7 天;新模型 1–2 週可重塑 Top10 |
9. 結語
DeepSeek 用量第一,Claude 守溢價,Gemini 靠生態,Kimi 脈衝進榜——贏家是把路由寫進架構的人。
路由省下的 token,別死在執行環境
Agent 在本機睡眠或 CI 排隊會整段重跑,L2 省下的錢會在 L3/L4 燒回去。Nuvcloud M4 Mac mini 常線上 macOS,適合 OpenClaw、Claude Code 長任務。
查看定價,日租跑一輪路由 + Agent 對照 TCO。