Ollama
CLI + 伺服器一個指令,模型就在你機器上跑起來。無限制、無配額。
localhost:11434/v1
目錄 · 核實於 2 Sep 2026
25 家真正提供免費額度的供應商的速率限制、上下文視窗與 API 網址 —— 以及完全不需要供應商的本機執行環境。
借用別人的運算資源,不花一分錢,按給量多寡排序。
| 供應商 | 免費額度 | 上下文 | 模型數 | 註冊要求 | 包含模型 |
|---|---|---|---|---|---|
| 每天 1,500 次請求 | 1M | 17 個模型 | 信箱 | Gemini 3.7 FlashGemini 3.6 FlashGemini 3.5 FlashGemini 3.5 Flash LiteGemini 3.1 Flash LiteGemini 3 FlashGemini 2.5 FlashGemini 2.5 Flash LiteGemini 2.5 Flash ImageGemini 2.0 FlashGemini 2.0 Flash LiteGemini 3.1 Flash ImageGemini 3.1 Flash TTSGemini 2.5 Flash TTSGemini Embedding 001Gemini Embedding 2Imagen 4 Fast… | |
| 每天 1,000 次請求 | 131K | 7 個模型 | 信箱 | ||
| 每分鐘 40 次請求 | 1M | 82 個模型 | 手機 | GPT-OSS 120BYi LargeFuyu 8BJamba 1.5 LargeSea Lion 7BStarcoder 2 15BDbrxDeepSeek Coder 6.7BDeepSeek V4 Flash 0731DeepSeek V4 Pro 0813Codegemma 1.1 7BCodegemma 7BDeplotDiffusiongemma 26B A4BGemma 2BGemma 3 12BGemma 3 4BGemma 4 31BRecurrentgemma 2BGranite 3.0 3B A800mGranite 3.0 8BGranite 34B CodeGranite 8B CodeCodellama 70BLlama 3.2 11B VisionLlama 3.2 90B VisionLlama Guard 4 12BLlama 2 70BMuse Glimmer 30BKosmos 2Phi 3 Vision 128kPhi 3.5 MoEMiniMax M3Codestral 22B V0.1Mistral 7B V0.3Mistral LargeMistral Large 2Mistral NemotronMixtral 8x22B V0.1Kimi K2.6Kimi K3Mistral Nemo 12BAi Synthetic Video DetectorCosmos Reason 2 8BEmbed Qa 4Ising Calibration 1.5 31BLlama 3.1 Nemoguard 8B Content SafetyLlama 3.1 Nemoguard 8B Topic ControlLlama 3.1 Nemotron 51BLlama 3.1 Nemotron 70BLlama 3.1 Nemotron Safety Guard 8B V3Llama 3.1 Nemotron Ultra 253B V1Llama 3.2 Nemoretriever 1B Vlm Embed V1Llama 3.2 Nv Embedqa 1B V1Llama Nemotron Embed VL 1B V2Llama 3 Chatqa 1.5 70BMistral Nemo Minitron 8B 8kNemotron 3 Embed 1BNemotron 3 Nano Omni 30B A3B ReasoningNemotron 3 Super 120B A12BNemotron 3 Ultra 550B A55BNemotron 3.5 Content SafetyNemotron 3.5 Lightning 30B A3BNemotron 4 340BNemotron 4 340B RewardNemotron Nano 3 30B A3BNemotron ParseNeva 22BNv Embedqa Mistral 7B V2NvclipRiva Translate 4BRiva Translate 4B V1.1Riva Translate 4B V2VilaGPT-OSS 20BLaguna XS 2.1Arctic Embed LPalmyra Creative 122BPalmyra Fin 70B 32kPalmyra Med 70BPalmyra Med 70B 32kZamba 2 7B… | |
| 18 個模型零成本 | 1M | 18 個模型 | 信箱 | Ling 3.0 Flash FinDots 3 Note PreviewLFM 2.5 2.6BNemotron 3.5 LightningInkling SmallLaguna S 2.1InklingLaguna XS 2.1North Mini CodeGLM 5.2Nemotron 3.5 Content SafetyNemotron 3 UltraMiniMax M3Nemotron 3 Nano OmniGemma 4 26B A4BGemma 4 31BMiniMax M2.7Nemotron 3 SuperFree Models Router… | |
| 每月 $5 贈金 | 1M | 12 個模型 | 信箱 | GPT-OSS 120BGPT 5.4 MiniGemma 4 31BGemini 2.5 FlashQwen 3.8 Flash NextGLM 5.3 FlashKimi K2.7 CodeMiniMax M3Nemotron 3 SuperLlama 4 MaverickGrok 4.6DeepSeek V3.2 Thinking… | |
| 每天 $10 用量 | 1M | 5 個模型 | 信箱 | ||
| 每天 200 次請求 | 1M | 12 個模型 | 信箱 | Laguna M.1Laguna XS.2Ling 3.0 TinyGemma 4 31BLeanstral 1.5Nemotron 3 Super 120B A12BNemotron 3 Nano Omni 30B A3B ReasoningNemotron 3 Nano 30B A3BNemotron 3.5 Content SafetyNemotron 3 Ultra 550B A55BMuse Glimmer 30BNemotron 3.5 Lightning 30B A3B… | |
| 一次性 $5 贈金 | 65K | 2 個模型 | 信用卡 | ||
| 每天 10,000 個神經元 | 262K | 40 個模型 | 信箱 | GPT-OSS 120BQwen 3.8 27BGPT-OSS 20BLlama 3.3 70BLlama 4 ScoutLlama 3.1 8B FastLlama 3.1 8B FP8Llama 3.2 11B VisionLlama 3.2 1BLlama 3.2 3BGemma 4 26BGLM 4.7 FlashGranite 4.0 H MicroNemotron 3 SuperQwen 3 30B A3BQwen 2.5 Coder 32BQwQ 32BMistral Small 3.1DeepSeek R1 Distill 32BLlama Guard 3 8BWhisper Large V3 TurboBGE M3BGE BaseEmbeddingGemma 300MFLUX.1 SchnellQwen 3 Embedding 0.6BGemma 3 12BLlama 3.1 8BMistral 7BLLaVA 1.5 7BWhisperNova 3MeloTTSStable Diffusion XLResnet 50BART Large CNNDistilBERT SST 2SQLCoder 7BPhi 2… | |
| Free mode 與 Labs | 256K | 12 個模型 | 信箱 | Mistral SmallMistral Small 2506Mistral NemoCodestralPixtral 12BLabs Mistral SmallMistral EmbedMistral ModerationMistral OCRMistral Small 3.1Devstral SmallMagistral Small… | |
| 每月 1,000 次請求 | 256K | 12 個模型 | 信箱 | Command ACommand A+Command R+Command RCommand R7BCommand A ReasoningCommand A TranslateEmbed V4Embed English V3Embed Multilingual V3Rerank V3.5Rerank English V3… | |
| 每分鐘 10 次(帶 token 40 次) | 1M | 5 個模型 | 免 | ||
| 註冊送贈金 | 1M | 3 個模型 | 信箱 | ||
| 每月 $0.10 贈金 | 131K | 135 個模型 | 信箱 | GPT-OSS 120BQwen 3.8 27BGLM 5.3 FlashGLM 5.3Kimi K3DeepSeek V4 Flash 0731Granite 4.2 30BGLM 5.3 Flash BF16Muse Glimmer 30BGemma 4 31BGranite 4.2 3BLlama 3.1 8BGranite 4.2 8BGLM 5.3 BF16Qwen 3.8 2.4T A95BDeepSeek V4 Pro 0813DeepSeek V4 FlashQwen 3.5 9BInkling SmallQwen 3.6 35B A3BGemma 4 26B A4BHy3GLM 5.2InklingLing 3.0 FlashGPT-OSS 20BMiniMax M3DeepSeek V4 ProTernary Bonsai 27B GgufGLM 4.7 FlashDeepSeek R1Qwen 3 8BLlama 3.3 70BQwen 2.5 Coder 7BNVIDIA Nemotron 3 Ultra 550B A55B NVFP4Qwen 3 Coder NextNVIDIA Nemotron 3.5 Lightning 30B A3B BF16Qwen 3 Coder 30B A3BQwen 3 4B 2507Qwen 3.5 35B A3BQwen 3.6 27BMiMo V2.5Qwen 2.5 Coder 32BApertus V1.5 8BQwen 3 14BKimi K2.6GLM 5.2 FP8Kimi K2.7 CodePhi 4Gemma 3 4BQwen 3 235B A22B 2507Apertus V1.5 70BL3 8B Stheno V3.2Qwen 3 30B A3BStep 3.7 FlashQwen 3 Next 80B A3BDeepSeek V3.2MiMo V2.5 ProLlama 4 Scout 17B 16EQwen 3 32BQwen 3.5 397B A17BQwen 3 235B A22BKimi K2.5Gemma 3 27BQwen 3.5 27BQwen 3.5 122B A10BQwen 3 235B A22B Thinking 2507Tiny Aya GlobalGLM 5Gemma 3 12BHermes 3 Llama 3.1 70BTiny Aya WaterGLM 5.1Llama Guard 4 12BQwen 2.5 72BGLM 5.1 FP8Apertus 8B 2509DeepSeek V3GLM 4.7DeepSeek V3 0324DeepSeek R1 Distill Llama 8BWizardLM 2 8x22BERNIE 4.5 VL 424B A47B Base PTDeepSeek V3.2 ExpGLM 4.6V FlashAutoGLM Phone 9B MultilingualTernary Bonsai 27B AWQ 4bitL3 8B Lunaris V1Gemma SEA LION V4 27BLlama 4 Maverick 17B 128E FP8Qwen 3 VL 235B A22BDeepSeek R1 Distill Llama 70BApertus 70B 2509GLM 4.5VQwen 3 VL 30B A3BGLM 4 32B 0414Qwen SEA LION V4 32BQwen 3 VL 235B A22B ThinkingQwen 2.5 Coder 3BMiniMax M1 80kBielik 11B V3.0Qwen 2.5 VL 72BDeepSeek R1 Distill Qwen 7BKimi K2DeepSeek R1 0528GLM 4.5DeepSeek R1 Distill Qwen 14BGLM 4.5 AirDeepSeek V3.1GLM 4.6 FP8Qwen 3 4B Thinking 2507Qwen 3 Coder 480B A35BDeepSeek V3.1 TerminusC4ai Command R 08 2024GLM 4.6Kimi K2 0905Step 3.5 FlashAya Expanse 32BGLM 4.7 FP8MiniMax M2MiniMax M2.7C4ai Command R7B 12 2024MiniMax M2.1GLM 4.5V FP8C4ai Command R7B Arabic 02 2025MiniMax M2.5GLM 4.6VC4ai Command A 03 2025Aya Vision 32BGLM 4.6V FP8GPT-OSS Safeguard 20BCommand A Reasoning 08 2025Command A Translate 08 2025Tiny Aya EarthTiny Aya Fire… | |
| 每天 2,000 次請求 | 1M | 50 個模型 | 手機 | Qwen 3.8 27BDeepSeek V4 FlashDeepSeek V4 ProDeepSeek V4 Pro 0813EA 29B A4BAntAngelMedLongCat Flash LiteMiniMax M1MiniMax M3Mistral LargeQwen Image EditCompassJudger 32BInternVL 3.5ERNIE 4.5 0.3BERNIE 4.5 21BERNIE 4.5 300BERNIE 4.5 VL 28BQwen Image EditQwen 3 14BQwen 3 235BQwen 3 235BQwen 3 235B ThinkingQwen 3 30B A3BQwen 3 30B A3B ThinkingQwen 3 4BQwen 3 8BQwen 3 Coder 30BQwen 3 Embedding 0.6BQwen 3 Embedding 4BQwen 3 Embedding 8BQwen 3 Next 80BQwen 3 Next 80B ThinkingQwen 3 VL 235BQwen 3 VL 8BQwen 3 VL 8B ThinkingQwen 3.5 122BQwen 3.5 27BQwen 3.5 35BQwen 3.5 397BQwen 3.8 Flash NextIntern S1Intern S1 MiniIntern S2Step 3.5 FlashStep 3.7 FlashHunyuan Hy3XiYanSQL 32BXiYanSQL 32B 2504GLM 4.7 FlashGLM 5.2… | |
| GLM Flash 系列免費 | 200K | 4 個模型 | 手機 | ||
| 每天 20 次請求 | 1M | 7 個模型 | 信箱 | ||
| 每月啟動贈金 | 1M | 19 個模型 | 信箱 | ||
| 7 個模型 €0 | 262K | 7 個模型 | 免 | Riva TTS EnglishRiva TTS GermanRiva TTS SpanishRiva TTS ItalianQwen 3Guard Gen 0.6BQwen 3Guard Gen 8BStable Diffusion XL… | |
| 每模型 1M token,90 天 | 1M | — 個模型 | 手機 | ||
| 6 個免費模型 | 1M | 6 個模型 | 信箱 | ||
| 3 個月 $10 贈金 | 256K | 2 個模型 | 信箱 | ||
| 實名驗證後按模型限額 | 131K | 3 個模型 | 手機 | ||
| 30 天 $1 試用 | 128K | 1 個模型 | 信用卡 | ||
| $5 啟動贈金 | 128K | 2 個模型 | 信箱 |
沒有配額、沒有金鑰、沒有請求離開你的筆電。只要模型裝得下,永遠免費。
一個指令,模型就在你機器上跑起來。無限制、無配額。
localhost:11434/v1
有圖形介面的 Ollama:探索、下載、本機對話。
localhost:1234/v1
幾乎所有本機工具底層執行的引擎。純 C++,零依賴。
localhost:8080/v1
100% 離線運作的開源 ChatGPT 替代品。
localhost:1337/v1
在本機與你的文件對話,資料從不離開筆電。
Local RAG
正式環境真正在用的推論伺服器。PagedAttention 與連續批次處理,跑在你自己的 GPU 上。
localhost:8000/v1
Apple 的陣列運算框架。在 M 系列 Mac 上是本機跑模型最快的方式。
localhost:8080/v1
一個檔案同時是模型和執行環境。下載、chmod +x、執行,完全免安裝。
localhost:8080/v1
包著 llama.cpp 的單一執行檔,為長文與創意寫作調校。
GGUF
不是模型的免費 AI 工具:編輯器、Playground,以及幫你決定該選什麼的那些。
沒有符合的結果。 .
簡短回答。長版本在各供應商頁面上。
本頁大多數供應商都不需要。Google AI Studio 只用電子郵件就能每天呼叫 1,500 次 Gemini;Groq 最快,每天 1,000 次;LLM7.io 和 Kilo 的 :free 模型連帳號都不用。NVIDIA NIM、ModelScope、SiliconFlow、Zhipu 和 Alibaba 只要求手機號碼,絕不要求信用卡;Cerebras 和 Nebius 的註冊贈送額度則要求綁定付款方式。
按請求數,Google AI Studio 每天 1,500 次,NVIDIA NIM 每分鐘 40 次且未公布每日上限。按 token 數,Cerebras 憑 5 美元贈款每天可達一百萬。按上下文,Gemini、NIM 和 DeepSeek V4 都有 1M。沒有單一贏家,所以上面的表格支援排序。
基本上不能。這些大多是評估性質的額度,沒有可用性承諾,有些還明確禁止正式使用。先用它做原型,上線前查好付費方案價格。
供應商接受與 OpenAI SDK 相同的請求格式,所以你只需換兩行程式碼 —— API 網址和金鑰 —— 其餘程式碼原封不動。這裡列出的幾乎全部相容。
不需要。llama.cpp 和 GPT4All 能在普通筆電 CPU 上跑 7B 模型,較新的 Mac 透過 MLX 跑得很順。GPU 買來的是速度,不是入場券。
有些會 —— Google 對免費版 Gemini 說得很直白。除非供應商另有說明,否則預設你的提示詞可以被拿去訓練;機密內容請放在本機執行環境裡跑。