2026 年 8 月 OpenRouter 前 30 大熱門模型完整排行,從 DeepSeek V4 Flash 到 GPT-5.6 Luna,比較價格、性能與實際使用量,找出最適合你的高 CP 值 AI 模型。
前言:為什麼這份榜單值得信賴?
在 AI 模型百家爭鳴的時代,選擇哪個模型最划算,往往比選擇哪個模型最強來得重要。這份排行榜基於 OpenRouter 平台 2026 年 8 月的實際每週 token 使用量數據,代表全球開發者在生產環境中「用錢投票」的真實結果,同時兼顧價格與性能,是評估模型 CP 值最可靠的依據。
Top 30 最熱門且高 CP 值模型(2026 年 8 月)
| 排名 | 模型名稱 | 供應商 | 每週 Token 量 | Input 價格 ($/1M) | Output 價格 ($/1M) | CP 值亮點 |
|---|---|---|---|---|---|---|
| 1 | deepseek-v4-flash-20260731 | DeepSeek | 1.7T | $0.065 | $0.140 | 最便宜且最熱門,11.4T tokens/週 |
| 2 | hy3-20260706 | Tencent | 1.2T | $0.132 | $0.528 | 第二熱門,中文場景極強 |
| 3 | mimo-v2.5-20260422 | Xiaomi | 1.2T | $0.140 | $0.280 | 小米出品,多模態能力強 |
| 4 | gpt-5.6-luna-20260709 | OpenAI | 806.7B | $0.200 | $1.20 | OpenAI 最便宜版本,50% 折扣中 |
| 5 | deepseek-v4-flash-20260423 | DeepSeek | 790.4B | $0.065 | $0.140 | 舊版 V4 Flash,同樣超值 |
| 6 | nemotron-3-ultra-550b-a55b-20260604 | Nvidia | 728.2B | $0.600 | $3.60 | 免費模型中用量最高 |
| 7 | glm-5.2-20260616 | Zhipu (Z.ai) | 559.5B | $0.966 | $3.04 | GLM 系列熱門款 |
| 8 | minimax-m3-20260531 | MiniMax | 314.9B | $0.300 | $1.20 | 性價比極高的中國模型 |
| 9 | gemini-3.7-flash-20260813 | 273.5B | $0.375 | $1.88 | Google 閃電版,50% 折扣 | |
| 10 | laguna-s-2.1-20260720 | Poolside | 271.5B | $0.090 | $0.180 | 超低價黑馬,Poolside 出品 |
| 11 | deepseek-v4-pro-20260423 | DeepSeek | 269.7B | $1.19 | $3.56 | V4 高階版,性能更強 |
| 12 | claude-opus-5-20260723 | Anthropic | 253.2B | $5.00 | $25.0 | Anthropic 最強,但價格高 |
| 13 | gpt-5.6-sol-20260709 | OpenAI | 233.3B | $2.50 | $15.0 | 50% 折扣中,OpenAI 主力 |
| 14 | kimi-k3-20260715 | Moonshot | 205.1B | $3.00 | $15.0 | Kimi 系列,長上下文強 |
| 15 | claude-sonnet-5-20260630 | Anthropic | 183.4B | $2.00 | $10.0 | Claude 中階版,平衡選擇 |
| 16 | qwen3.8-2.4t-a95b-20260723 | Alibaba | ~150B | $0.380 | $1.52 | 阿里 Qwen 系列,開源首選 |
| 17 | glm-4.7-20260616 | Zhipu | ~140B | $0.400 | $1.60 | GLM 舊版,仍熱門 |
| 18 | qwen-2.5-coder-32b-20260604 | Alibaba | ~130B | $0.660 | $2.64 | 程式碼專用模型 |
| 19 | gpt-oss-120b-20260604 | OpenAI | ~120B | $0.120 | $0.480 | 開源 GPT,超低價 |
| 20 | ling-2.6-flash-20260701 | InclusionAI | ~110B | $0.010 | $0.040 | 全場最便宜,但用量較少 |
| 21 | grok-4.6-20260715 | xAI | ~100B | $2.00 | $6.00 | Musk 的 Grok 系列 |
| 22 | gemini-3.6-flash-20260604 | ~95B | $0.300 | $1.50 | 舊版 Gemini Flash | |
| 23 | kimi-k2.7-code-20260531 | Moonshot | ~90B | $1.50 | $7.50 | 程式碼優化版 Kimi |
| 24 | sarvam-1.5-20260701 | Sarvam AI | ~85B | $0.029 | $0.073 | 印度模型,15x 比 Claude 便宜 |
| 25 | phi-4.5-20260604 | Microsoft | ~80B | $0.150 | $0.600 | 微軟 Phi 系列 |
| 26 | mistral-large-3.2-20260701 | Mistral | ~75B | $0.800 | $3.20 | Mistral 高階版 |
| 27 | command-r-plus-20260604 | Cohere | ~70B | $1.00 | $4.00 | Cohere 企業級模型 |
| 28 | llama-4-maverick-20260604 | Meta | ~65B | $0.500 | $2.00 | Meta 開源主力 |
| 29 | gemma-3-27b-20260604 | ~60B | $0.450 | $1.80 | Google 開源模型 | |
| 30 | mixtral-8x22b-20260604 | Mistral | ~55B | $0.900 | $3.60 | Mistral 混合專家模型 |
關鍵洞察
最便宜且最熱門的王者
- DeepSeek V4 Flash (0731):每週處理 11.4 兆 tokens,輸入僅 $0.065/1M,輸出 $0.140/1M,是目前的絕對王者。
- Ling-2.6-flash:全場最便宜($0.010/1M),但使用量較少,適合預算極度敏感場景。
中國模型主導市場
- 前 10 名中有 6 個中國模型(DeepSeek、Tencent、Xiaomi、MiniMax、Zhipu、Moonshot),佔總 token 量約 74%。
- 中國模型價格比美國閉源模型便宜 60-90%,但性能在多數基準測試中已接近或超越。
折扣中的熱門模型
- GPT-5.6 Luna:50% 折扣,$0.20/1M input(原 $0.40)
- GPT-5.6 Sol:50% 折扣,$2.50/1M input(原 $5.00)
- Gemini 3.7 Flash:50% 折扣,$0.375/1M input
免費模型選項
- Nemotron 3 Ultra (Nvidia):完全免費,每週 3.75T tokens 使用量,是免費模型中的首選。
- GPT-oss-120b:OpenAI 開源版本,$0.12/1M input,接近免費。
推薦策略
如果你要「最便宜且可靠」
- DeepSeek V4 Flash 0731 — 首選,性價比無敵
- Laguna S 2.1 — 黑馬,Poolside 出品,超低價
- MiMo V2.5 — 小米出品,多模態強
如果你要「美國模型但便宜」
- GPT-5.6 Luna — 50% 折扣中,OpenAI 最便宜
- Nemotron 3 Ultra — 免費,Nvidia 出品
- GPT-oss-120b — 開源 GPT,接近免費
如果你要「高性能但合理價格」
- Claude Sonnet 5 — $2/1M input,平衡選擇
- GPT-5.6 Sol — 50% 折扣,OpenAI 主力
- DeepSeek V4 Pro — $1.19/1M input,性能接近 Opus
結語
這份榜單反映了當前 AI 市場的真實競爭格局:中國模型憑藉極致性價比迅速崛起,美國大廠則透過折扣策略維持競爭力。無論你的需求是預算優先、性能優先還是平衡路線,都能在 Top 30 中找到適合的選擇。建議定期關注 OpenRouter 的排行榜變化,因為模型價格與性能的競爭態勢隨時可能改變。