OpenRouter 免費模型研究報告
2026 年 7 月更新 · 22 款完全免費的 AI 模型完整比對
不需信用卡,註冊就能用 API 呼叫。以下是我們實際測試、交叉比對的第一手報告。
📋 快速結論
OpenRouter 目前提供 22 款完全免費的 AI 模型,來自 NVIDIA、Google、OpenAI、Meta、Qwen、Cohere、Poolside 等頂尖機構。若你只有 30 秒,直接看這個表:
| 你的場景 | 直接選這個 | 原因 |
|---|---|---|
| 💻 寫程式 | Qwen3 Coder 480B | 1M 上下文 + 工具呼叫最穩 |
| 🤖 跑 Agent 自動化 | Nemotron 3 Ultra | NVIDIA 550B MoE,Agent 編排最強 |
| 👁️ 分析圖片/文件 | Gemma 4 31B | 品質分最高(65),支援視覺 |
| 📝 寫文章/摘要 | Nemotron 3 Super | 1M 上下文 + 品質分 60 |
| 🏷️ 分類/標籤 | gpt-oss-20b | 輕量快速,結構化輸出穩定 |
📊 22 款免費模型完整列表
| # | 模型 | 提供者 | 上下文 | 品質分 | 工具呼叫 | 視覺 | 適合場景 |
|---|
⚠️ 品質分為 Theozard Quality Score,非官方基準。免費模型目錄會動態變動,資料時間:2026 年 7 月。
資料來源即時載入自 /report-data.json。
🧠 Agent 場景採用熱度
以下是 OpenRouter 平台 30 天實際 token 處理量 排名,直接反應社群的真實採用狀況:
2026 年 6 月 OpenRouter 免費模型 Token 處理量排名(單位:Billion tokens)
| 排名 | 模型 | Token 處理量 | 說明 |
|---|---|---|---|
| 1 | Nemotron 3 Ultra | 718B | NVIDIA 官方 Agent 旗艦,55B 活躍參數 |
| 2 | Laguna M.1 | 614B | Poolside 編碼 Agent 專用 |
| 3 | Nemotron 3 Super | 397B | 輕量版但同樣 1M 上下文 |
觀察: NVIDIA 的 Nemotron 系列在 Agent 場景幾乎壟斷免費榜單。如果你正在做 Agent 工作流的原型驗證,Nemotron 3 Ultra 是目前最穩的起點。
📄 上下文長度比較
4 款免費模型達到或接近 1M+ 上下文,這是付費模型才有的規格:
免費模型上下文長度橫向比較(單位:K tokens)
| 模型 | 上下文 | 備註 |
|---|---|---|
| Nemotron 3 Ultra | 1,000K | 550B MoE,品質分未公開 |
| Nemotron 3 Super | 1,000K | 推理能力強,品質分 60 |
| Qwen3 Coder 480B | 1,000K | 專為程式碼設計,支援工具呼叫 |
| Free Models Router | 200K | 自動路由,不保證單一模型 |
💡 實戰建議: 1M 上下文非常適合 RAG 的前處理、長文件摘要、大型程式碼庫分析。但要留意——上下文越長,首次輸出延遲也越高(推理成本隨 token 數平方級成長)。如果你的任務只需要 10 頁文件的摘要,選 128K–256K 的模型反而更快。
💰 付費 vs 免費對照表
免費模型在 Agent 場景已經相當可用,但與頂尖付費模型仍有具體差距:
| 指標 | 免費模型(最佳) | 付費模型(最佳) | 差距 |
|---|---|---|---|
| SWE-bench | 約 22% | 約 63%(DeepSeek V4 Flash) | -41% |
| SLA 保證 | 無 | 99.9%+ | ❌ |
| 上下文長度 | 1.0M | 1.0M | 持平 |
| 工具呼叫 | ✅(多數支援) | ✅(更穩定) | 接近 |
| 視覺能力 | 6 款支援 | 多數支援 | 有限 |
| Rate Limit | 50–1,000/天 | 無限制(依方案) | 受限 |
| 模型穩定性 | 可能隨時下架 | 長期維護 | 不穩定 |
關鍵發現: 免費模型的 SWE-bench 成績普遍落在 20–30% 範圍,而頂尖付費模型(DeepSeek V4 Flash、Claude Opus 4.8)可達 60% 以上。如果你的應用對程式碼正確性要求極高(如自動化 PR Review、大型重構),付費模型是必要的投資。
🤖 Agent 角色匹配指南
免費模型各有擅長。以下是根據不同 Agent 角色推薦的模型組合:
🧑💻 Coding Agent
程式碼生成、除錯、重構、單元測試撰寫、跨檔案修改
- 免費 Qwen3 Coder 480B
- 免費 Laguna M.1
- 免費 North Mini Code
- 付費 DeepSeek V4 Flash
- 付費 MiniMax M3
- 付費 Claude Opus 4.8
🎯 關鍵需求
工具呼叫(Tool Calling)、長上下文(256K+)、程式碼理解力。Qwen3 Coder 擅長大型專案,Laguna M.1 擅長軟體工程 Agent 工作流。免費模型適合單文件/輕量任務;多檔案重構需升級付費模型。
🔧 常用工具
Claude Code / Cursor / Windsurf / Cline / OpenClaw
🔍 Research / 分析 Agent
文獻回顧、多來源綜合分析、報告生成、事實提取與比對
- 免費 Nemotron 3 Ultra
- 免費 Gemma 4 31B
- 付費 DeepSeek V4 Flash
- 付費 GLM-5.2
- 付費 Claude Sonnet 4.6
🎯 關鍵需求
超長上下文(1M+)、事實準確性、多來源引用能力。免費的 Nemotron 3 Ultra 有 1M 上下文,非常適合做「來源提取」階段的批次處理,再交給付費模型做綜合分析。
🔧 常用工具
Perplexity / NotebookLM 風格工作流
🧠 Orchestrator / Planner
多 Agent 排程、任務分解、工作流程編排、複雜指令分解與派發
- 免費 Nemotron 3 Ultra
- 付費 GLM-5.2
- 付費 Claude Opus 4.8
🎯 關鍵需求
結構化規劃、多步驟推理、工具協調能力。Nemotron 3 Ultra 是 NVIDIA 專為 Agent orchestration 打造的 550B 旗艦模型。GLM-5.2 是目前 AA Index 最高的開源模型(51分)。
🔧 常用工具
LangChain / LangGraph / CrewAI / AutoGen
✍️ 內容創作 / Writer
部落格文章、社群文案、新聞稿、創意寫作、SEO 內容
- 免費 Gemma 4 31B
- 免費 Llama 3.3 70B
- 付費 Claude Sonnet 4.6
- 付費 GPT-5.4
🎯 關鍵需求
文筆流暢度、風格多變性、長篇結構保持。Gemma 4 31B 品質分 65 為免費模型最高,適合初稿和大綱。Claude Sonnet 以優異的寫作品質著稱,適合最終潤色。
🔧 常用工具
WordPress / Medium / Substack / Notion
🏷️ 分類 / Router
內容分類、意圖識別、查詢路由、標籤生成、結構化資料提取
- 免費 gpt-oss-20b
- 免費 Nemotron Nano 9B V2
- 付費 Claude Haiku 3.5
- 付費 GPT-4.1 Mini
🎯 關鍵需求
低延遲、高吞吐、結構化輸出(JSON mode)。gpt-oss-20b 是 OpenAI 開源的輕量模型,分類任務表現穩定。大量並發請求時仍建議使用付費模型以獲得 SLA 保證。
🔧 常用工具
自訂 Pipeline / n8n / LangChain LCEL
👁️ 視覺 / Vision
圖片理解、文件 OCR、圖表分析、影片幀分析、視覺問答
- 免費 Gemma 4 31B
- 免費 Nemotron Nano 12B v2 VL
- 付費 GPT-5.4
- 付費 Claude Opus 4.8
- 付費 Gemini 3.0 Ultra
🎯 關鍵需求
多模態理解力、高解析度圖片支援、OCR 準確度。免費模型中 Gemma 4 31B 視覺能力最強,適合通用圖片理解;Nemotron Nano 12B VL 適合輕量 OCR 任務。
🔧 常用工具
文件數位化流程 / 自動化標註工具
✅ 適合 vs ❌ 不適合場景
免費模型絕非萬能,以下幫你快速判斷:
| 適合 ✅ | 不建議 ❌ |
|---|---|
| 文章初稿、大綱發想 | 客戶面對的客服系統 |
| 程式碼除錯、簡單腳本 | 金融/合規文件分析 |
| 分類、標籤、路由任務 | 醫療診斷建議 |
| RAG 檢索前處理與 chunking | 長時間生產環境 Agent |
| 研究摘要、資料提取 | 涉及隱私數據的任務 |
| 快速原型驗證與 MVP | 高頻交易/即時決策 |
| 個人自動化流程 | 需要 HIPAA/GDPR 合規的場景 |
⚠️ Rate Limits 說明
免費方案有明確的使用上限,規劃時請注意:
| 等級 | 每天請求數 | RPM | 條件 |
|---|---|---|---|
| Free | 50 次 | 20 | 未加值信用卡 |
| Tier 1 | 1,000 次 | 20 | 加值 $10+ |
| Tier 2 | 5,000+ 次 | 60+ | 累積消費達門檻 |
- 429 錯誤:超過限制時 API 會回傳 429,需等待或加值 credits
- 模型輪替:Owl Alpha、Lyria 系列等已於 2026 年 7 月下架,免費模型目錄會動態變動
- 無 SLA:免費模型不保證服務可用性,不適合生產環境
📥 完整互動式報告
如需可排序表格、深度分析、付費對比的完整版本(包含所有互動式圖表),請下載:
👉 下載完整 HTML 報告瀏覽器直接開啟,無需網路。內含完整的 CSS 與 JS,離線也可使用。
🔗 參考資料
最後更新:2026 年 7 月 3 日