22 款免費模型 vs 付費前沿模型 ─ 效能、價格、場景、Agent 角色完整分析
截至 2026 年 6 月,OpenRouter 上共有 22 款完全免費的 AI 模型,來自 NVIDIA、Google、OpenAI、Meta、Qwen、Cohere、Poolside、Nous Research 等頂尖機構。不需信用卡,註冊即可用。
過去 18 個月,開源模型與前沿封閉模型的差距穩定維持在 3–6 個月,但成本差距高達 35–100 倍。這讓免費模型在特定場景中極具競爭力。
| # | 模型名稱 | 提供者 | 上下文 | 品質分 | 工具 | 視覺 | 適合場景 |
|---|---|---|---|---|---|---|---|
| 1 | Nemotron 3 Ultra | NVIDIA | 1.0M | — | ✅ | — | Agent 編排、長推理、企業級工作流 |
| 2 | Nemotron 3 Super | NVIDIA | 1.0M | 60 | ✅ | — | 通用任務、編程、多步推理 |
| 3 | gpt-oss-120b | OpenAI | 131K | 55 | ✅ | — | 結構化任務、工具協作 |
| 4 | Gemma 4 31B | 262K | 65 | ✅ | ✅ | 多模態、視覺理解、通用推理 | |
| 5 | Gemma 4 26B A4B | 262K | 52 | ✅ | ✅ | 視覺任務、輕量推理 | |
| 6 | Qwen3 Coder 480B | Qwen | 1.0M | 41 | ✅ | — | 程式碼生成、大型專案、Agent 編碼 |
| 7 | gpt-oss-20b | OpenAI | 131K | 41 | ✅ | — | 分類、路由、輕量工具任務 |
| 8 | Nemotron 3 Nano 30B | NVIDIA | 256K | 40 | ✅ | — | 工具呼叫、一般推理 |
| 9 | Nemotron 3 Nano Omni | NVIDIA | 256K | 36 | ✅ | ✅ | 視覺 + 工具混合任務 |
| 10 | Laguna M.1 | Poolside | 262K | — | ✅ | — | 軟體工程 Agent、多步編碼 |
| 11 | Laguna XS.2 | Poolside | 262K | — | ✅ | — | 輕量編碼 Agent |
| 12 | North Mini Code | Cohere | 256K | — | ✅ | — | 快速編碼、終端任務、輕量 Agent |
| 13 | Qwen3 Next 80B | Qwen | 262K | 33 | ✅ | — | 輕量推理、指令跟隨 |
| 14 | Nemotron Nano 12B v2 VL | NVIDIA | 128K | 25 | ✅ | ✅ | 輕量視覺任務、文件 OCR |
| 15 | Llama 3.3 70B | Meta | 131K | 24 | ✅ | — | 通用文字任務、內容生成 |
| 16 | Nemotron Nano 9B V2 | NVIDIA | 128K | 24 | ✅ | — | 資料提取、分類、路由 |
| 17 | Llama 3.2 3B | Meta | 131K | 16 | — | — | 極輕量文本任務 |
| 18 | Nemotron 3.5 Content Safety | NVIDIA | 128K | — | — | ✅ | 內容審查、安全分類 |
| 19 | LFM2.5-1.2B-Thinking | LiquidAI | 33K | 13 | ✅ | — | 極輕量推理實驗 |
| 20 | LFM2.5-1.2B-Instruct | LiquidAI | 33K | 13 | — | — | 極輕量文本 |
| 21 | Uncensored (Dolphin 24B) | Venice | 33K | — | — | — | 無過濾場景(特殊用途) |
| 22 | Free Models Router | OpenRouter | 200K | — | ✅ | ✅ | 自動路由:隨機選取免費模型 |
以下針對 Agent 工作流 與 長上下文處理 兩個場景,深入比較各免費模型的實測表現。
以 OpenRouter 30 天 token 處理量估算 Agent 採用熱度
免費模型中 5 款達 1M+ 上下文,已超越多數付費模型
| 模型 | 參數量 | 上下文 | 工具呼叫 | 視覺 | 推理 | 最佳場景 |
|---|---|---|---|---|---|---|
| Owl Alpha | — | 1.05M | ✅ | — | — | Agent 自動化、工具編排、長鏈路任務 |
| Nemotron 3 Ultra | 550B/55B | 1.0M | ✅ | — | ✅ | Agent 編排、企業級工作流、長推理 |
| Laguna M.1 | — | 262K | ✅ | — | ✅ | 編碼 Agent、多步驟軟體工程 |
| Nemotron 3 Super | 120B/12B | 1.0M | ✅ | — | ✅ | 通用 Agent、多步推理、編程 |
| Qwen3 Coder | 480B/35B | 1.0M | ✅ | — | — | 程式碼生成、大型專案 Agent |
| Gemma 4 31B | 30.7B | 262K | ✅ | ✅ | ✅ | 多模態 Agent、視覺+文字混合 |
| Cohere North Mini Code | 30B/3B | 256K | ✅ | — | ✅ | 輕量編碼 Agent、終端任務 |
💡 分析結論:Nemotron 3 Ultra 是 Agent 場景 的免費首選——Nemotron 3 Ultra 則以 550B 參數 + Mamba-Transformer 混和架構提供深度推理。
在 長上下文 方面,4 款免費模型達 1M+ 上下文(Nemotron 3 Ultra/Super, Qwen3 Coder, Free Models Router),已可處理整份程式碼庫或長篇研究報告,完全不輸付費模型。
⚠️ Owl Alpha 已於 2026 年 7 月從 OpenRouter 下架。以下是下架前收集到的歷史數據,僅供參考。
| 釋出日期 | 2026-04-28 |
| 提供者 | Stealth(匿名) |
| 參數量 | 未公開 |
| 上下文 | 1,048,756 (1M) |
| 最大輸出 | 約 260K tokens |
| 工具呼叫 | ✅ Function Calling |
| 定價 | 完全免費 |
| 資料記錄 | ⚠️ 可能被記錄用於訓練 |
以 OpenRouter 平台模型使用量排名
⚠️ Owl Alpha 已下架(原使用量為 Nemotron 3 Ultra 的 12 倍)
🦉 Owl Alpha(歷史記錄):曾是最受歡迎的 Agent 免費模型,已於 2026 年 7 月下架。備援方案:Nemotron 3 Ultra 或 DeepSeek V4 Flash。
NVIDIA Nemotron 3 Ultra 是 Nemotron 3 家族的旗艦,550B 參數(55B 活躍)的混合 MoE 開源模型,2026 年 6 月 4 日釋出。Nemotron 3 Ultra 有完整的技術論文、HuggingFace 權重、以及 NVIDIA 官方支援。
| 釋出日期 | 2026-06-04 |
| 提供者 | NVIDIA |
| 參數量 | 550B 總計 / 55B 活躍(MoE) |
| 架構 | Mamba-Transformer + LatentMoE |
| 上下文 | 1,048,576 (1M) |
| 多 Token 預測 | ✅ MTP(Multi-Token Prediction) |
| 定量化 | NVFP4(4-bit),5x 吞吐量提升 |
| AA Index | 48 分(開源第 2) |
| 授權 | OpenMDW 全開源 |
| Nano | Super | Ultra | |
|---|---|---|---|
| 參數 | 30B A3B | 120B A12B | 550B A55B |
| 上下文 | 256K | 1M | 1M |
| 工具呼叫 | ✅ | ✅ | ✅ |
| 推理 | — | ✅ | ✅ |
| 品質分 | 40 | 60 | — |
| 用途 | 邊緣/輕量 | 通用 Agent | 企業級編排 |
🔶 Nemotron 3 Ultra 適合這樣用:需要完整開源可控的企業級 Agent 編排、長上下文推理、工具呼叫密集型任務。免費版適合 test/prototype,生產環境建議走 NVIDIA NIM 或自部署。Nemotron 3 Ultra 有 NVIDIA 背書和完整技術文件,適合需要長期穩定依賴的場景。
Qwen3-Coder-480B-A35B 是阿里巴巴 Qwen 團隊開發的 MoE 程式碼生成旗艦,480B 總參數 / 35B 活躍,專為 Agentic Coding 設計。在 OpenRouter 上為完全免費模型。
| 釋出日期 | 2025 年 7 月 |
| 提供者 | 阿里巴巴 Qwen 團隊 |
| 參數量 | 480B 總計 / 35B 活躍 |
| 上下文 | 1,048,576 (1M) |
| 訓練數據 | 7.5T tokens(程式碼為主) |
| 工具呼叫 | ✅ Function Calling + Tool Use |
| 搭配工具 | Cline / Claude Code / OpenClaw / Qwen Code CLI |
Laguna M.1 是 Poolside 推出的旗艦編碼 Agent 模型,225.8B 總參數 / 23.4B 活躍,從零開始訓練(非基於 Llama),OpenRouter 上完全免費。有完整的技術論文、Apache 2.0 授權。
| 釋出日期 | 2026-04-28 |
| 提供者 | Poolside |
| 參數量 | 225.8B 總計 / 23.4B 活躍(MoE) |
| 上下文 | 262K(支援 32K 輸出) |
| 架構 | 從零訓練,非基於 Llama |
| 授權 | Apache 2.0 |
| OpenRouter 使用量 | 614B tokens (30d) |
Gemma 4 31B 是 Google DeepMind 的多模態開源模型,30.7B 稠密參數,支援文字+圖像輸入。在免費模型中度品質分最高(65),也是唯一同時具備視覺理解、推理、工具呼叫的免費模型。
| 釋出日期 | 2026 年 4 月 |
| 提供者 | Google DeepMind |
| 參數量 | 30.7B 稠密 |
| 上下文 | 262K |
| 輸入 | 文字 + 圖像(多模態) |
| 工具呼叫 | ✅ |
| 推理能力 | ✅(Google 宣稱) |
| 部署成本 | 4-bit 量化僅需 16-20GB VRAM |
📌 三款模型一句話總結:
Qwen3 Coder = 編碼特化的 1M 上下文怪獸,適合大型專案級程式碼生成。
Laguna M.1 = 從零訓練的軟體工程 Agent,有公開 benchmark,Apache 2.0 可自部署。
Gemma 4 31B = 唯一免費多模態模型,視覺+推理+工具三合一,可本地跑。
以下為 OpenRouter 上主流付費模型的每百萬 token 價格(Input / Output),方便與免費模型做 ROI 對比。
| 模型 | 提供者 | Input | Output | 上下文 | SWE-bench | 備註 |
|---|---|---|---|---|---|---|
| DeepSeek V4 Flash | DeepSeek | $0.14 | $0.28 | 1M | ~79% | 🚀 最便宜前沿級模型,快取後僅 $0.029/M |
| DeepSeek V4 Pro | DeepSeek | $1.74 | $3.48 | 1M | ~81% | 更強推理,開源權重 |
| MiniMax M3 | MiniMax | $0.60 | $2.40 | 1M | 80.5% | 🎯 最佳性價比(>80% SWE-bench 最便宜) |
| GLM-5.2 | Z.AI | $1.40 | $4.40 | 1M | — | AA Index #1 開源模型(51 分) |
| Gemini 3.1 Pro | $2.00 | $12.00 | 1M | 80.6% | 超過 200K 則 $4/$18 | |
| Claude Sonnet 4.6 | Anthropic | $3.00 | $15.00 | 1M | ~86% | 長文件推理首選 |
| Claude Opus 4.8 | Anthropic | $5.00 | $25.00 | 1M | 88.6% | 旗艦級編碼+推理 |
| GPT-5.5 | OpenAI | $5.00 | $30.00 | 1M | 88.7% | OpenAI 最新旗艦 |
| GPT-5.4 nano | OpenAI | $0.20 | $1.25 | — | — | 預算級分類/提取 |
| Gemini 3.5 Flash | $1.50 | $9.00 | — | — | 穩定 Agent 工作馬 |
💡 關鍵發現:相同編碼任務,GPT-5.5 每月花費 $12,000,DeepSeek V4 Flash 僅 $252(48 倍差距)。付費模型之間價差極大,選對模型比選付費/免費更重要。
不同 Agent 角色對模型能力有完全不同的需求。以下根據 AI Agent 產業生態(NVIDIA、TeamDay.ai、StackOne、IBM 等) 整理出 22 種常見 Agent 角色,點擊標籤即可切換查看詳細推薦:
📌 總結:免費模型的甜蜜點 ─ 分類/Router(100% 免費可行)、內容安全/Guard(專用免費模型)、資料提取/ETL、翻譯、創意發想、輕量編碼。
📌 不建議用免費的 ─ 文件/合規、BI/數據分析、客戶面對客服、安全敏感性程式碼。
參考 TeamDay.ai 的實務架構:
| 步驟 | 模型層級 | 輸出 | 審查關卡 |
|---|---|---|---|
| 1. 分類 | 免費 gpt-oss-20b | 任務標籤、優先級、目標 Agent | Schema 驗證 |
| 2. 提取 | 免費 Nemotron Nano 9B | 事實、行資料、連結、候選主張 | 來源比對 |
| 3. 草稿 | 免費 Qwen3 Coder / Gemma 4 | 簡報、備忘錄、大綱、初稿 | 付費模型審查 |
| 4. 決策 | 付費 DeepSeek V4 Flash / Claude | 建議、風險評估、最終用語 | 高風險需人工審核 |
| 5. 執行 | Harness + Tools | 檔案、報告、程式碼、資產 | 工作區產物與審批 |
| 方案 | 費用 | 免費模型額度 | 付費模型 | 平台費 | 適合對象 |
|---|---|---|---|---|---|
| 🆓 Free | $0 | 50 次/天、20 RPM | ❌ 無 | — | 測試、低量實驗 |
| 💳 Pay-as-you-go | 加值 $10+ | 1,000 次/天、20 RPM | ✅ 無限制 | 5.5%(信用卡) | 開發、生產環境 |
| 🏢 Enterprise | 議價 | 無限制 | ✅ 全部 | 折扣 | 企業 SLA |
:floor suffix 讓 OpenRouter 自動選最便宜 provider,可再省 20-40%。
簡短答案:目前 OpenRouter「沒有」官方的推薦獎金(Referral / Affiliate)計畫。
截至 2026 年 6 月,OpenRouter 官方網站、定價頁面、支援中心、API 文件均沒有提到任何推薦獎勵機制。搜尋引擎和 Reddit 等社群也無相關討論。
| 方式 | 說明 | 備註 |
|---|---|---|
| 🆓 免費模型 | 25+ 個模型完全 $0,無需信用卡 | 等於直接送你免費額度 |
| 📈 Pay-as-you-go 無最低消費 | 沒有綁約、沒有月費,用多少付多少 | 靈活度本身就是 bonus |
| 🔁 BYOK 免費 1M 請求/月 | 自帶 provider key,每月前 100 萬次請求免平台費 | 相當於每月省下可觀費用 |
| 🛡️ Zero Completion Insurance | 失敗請求不計費,只收成功的錢 | 隱藏的省錢機制 |
| 🏪 第三方 Coupon 優惠碼 | Startupworld 等第三方網站提供 12%-27% 折扣碼 | 非官方,需自行驗證有效 |
| 🏢 Enterprise 協議 | 大量使用可談平台費折扣 | 需業務聯絡 |
💡 競品對照:AgentRouter(OpenRouter 競爭對手)有 $200 註冊獎勵;LLMGateway 有推薦獎金(被推薦者花費的 1%)。OpenRouter 目前靠「免費模型 + 無最低消費」吸引用戶,暫未推出推薦獎金。
🔍 如果你找到推薦連結或 Coupon,建議先在官方驗證真實性,避免使用來路不明的折扣碼。
| 類別 | 冠軍 | 亞軍 | 備註 |
|---|---|---|---|
| 💻 程式碼生成 | Qwen3 Coder 480B (1M ctx) | Laguna M.1 | Qwen3 最強程式碼 + 函式呼叫 |
| 🤖 Agent 工作流 | Nemotron 3 Ultra (1M ctx) | Owl Alpha | 專為 Agent orchestration 設計 |
| 👁️ 視覺理解 | Gemma 4 31B (品質 65) | Nemotron 3 Nano Omni | Gemma 4 品質分最高 |
| 📝 通用文字 | Nemotron 3 Super (品質 60) | gpt-oss-120b (55) | 1M 上下文 + 工具呼叫 |
| ⚡ 快速分類 | gpt-oss-20b | Nemotron Nano 9B | 輕量、快速、結構化輸出 |
| 📚 長文件處理 | Owl Alpha (1.05M ctx) | Nemotron 3 Ultra (1M) | 最長上下文 + Agent 支援 |
| 🔧 工具呼叫 | Nemotron 3 Ultra | Owl Alpha | 兩者皆支援完整 tool calling |
| 🛡️ 內容安全 | Nemotron 3.5 Content Safety | — | 專用安全分類模型 |
| 排名 | 模型 | 品質分 | 上下文 | 視覺 | 工具 |
|---|---|---|---|---|---|
| 🥇 | Gemma 4 31B | 65 | 262K | ✅ | ✅ |
| 🥈 | Nemotron 3 Super 120B | 60 | 1.0M | — | ✅ |
| 🥉 | gpt-oss-120b | 55 | 131K | — | ✅ |
| 4 | Gemma 4 26B A4B | 52 | 262K | ✅ | ✅ |
| 5 | Qwen3 Coder 480B A35B | 41 | 1.0M | — | ✅ |
免費方案僅 50 次/天、20 RPM。超過即 429 錯誤。加值 $10 後提升至 1,000 次/天。
免費模型可能隨時下架、變更、或在尖峰時段降速。不建議做生產系統唯一依賴。
免費模型輸出品質波動較大,對複雜推理、安全性敏感任務的處理能力不如付費模型。
部分免費模型(如 Laguna M.1)明確表示 prompts 和 completions 可能被記錄 用於模型改善。敏感資料不應傳送。
免費模型僅來自 4 個免費 provider,不如付費方案的 70+ providers 選擇多。
免費模型目錄變化頻繁。一個模型今天免費,明天可能轉為付費或下架。需有備援方案。
| 場景 | 免費模型 | 節省 vs 付費 | 品質接受度 |
|---|---|---|---|
| 📝 文章大綱 / 標題生成 | Nemotron 3 Super (free) | 100% | ⭐⭐⭐⭐ |
| 🏷️ 內容分類 / 標籤建議 | gpt-oss-20b (free) | 100% | ⭐⭐⭐⭐ |
| 📄 YouTube 逐字稿摘要 | Nemotron 3 Ultra (free) | 100% | ⭐⭐⭐½ |
| 🐍 Python 腳本生成 | Qwen3 Coder (free) | 100% | ⭐⭐⭐⭐ |
| 🔍 工具比較研究 | Gemma 4 31B (free) | 100% | ⭐⭐⭐½ |
| 📊 數據提取(JSON) | Nemotron Nano 9B (free) | 100% | ⭐⭐⭐ |
💡 終極建議:OpenRouter 上的免費模型已足夠優秀處理 60-70% 的日常 AI 任務(提取、分類、草稿、簡單編碼)。
保留付費模型給 30-40% 需要深度推理、穩定 SLA、高品質輸出的關鍵任務。
善用 openrouter/free 路由器 做 fallback,搭配 :floor suffix 選最便宜 provider,可以讓每月 API 花費趨近於零。