무료로 쓸 수 있는 모든 모델.
모델을 골라 어떤 제공업체가 무료로 주는지 확인하세요.
- 모델
- 34
- 오픈 가중치
- 25
- 공급업체
- 23
Qwen 3Alibaba의 패밀리: 노트북에서 도는 0.6B부터 MoE 거인까지. 호스팅 API는 정확한 웨이트를 지정. 이 페이지는 패밀리 페이지.
Llama 3.3 70BMeta의 클래식 오픈 모델. 여기 거의 모든 무료 제공사가 제공하는 가장 무난한 기본값.
GPT-OSS 120BOpenAI의 오픈 웨이트 모델. 내 하드웨어에서도, Groq에서 무료로도. Cerebras는 $5 가입 크레딧으로 가능.
DeepSeek V4DeepSeek의 현행 패밀리: V4 Flash와 V4 Pro, 1M 컨텍스트, thinking은 별도 모델이 아닌 스위치.
Nemotron 3 UltraNVIDIA의 550B Ultra. 에이전트·함수 호출용으로 튜닝. NIM·OpenRouter(`:free`)·Requesty에서 무료.
DeepSeek V4 FlashDeepSeek의 현행 주력: 1M 컨텍스트, thinking은 스위치식. 공식 id는 deepseek-v4-flash. AMD는 DeepSeek-V4-Flash-0731 제공.GLM 5.2Z.ai의 현행 플래그십. 코딩과 도구 호출이 뛰어남. OpenRouter에서 무료(`z-ai/glm-5.2:free`). Z.ai 본가 GLM-5는 토큰 과금.
Qwen CoderQwen의 코딩 계열. 로컬에서 돌릴 수 있는 크기면서 에디터 자동완성을 떠받칠 품질.
Qwen 3.8 27BAlibaba의 현행 27B: 하나의 id로 thinking/instruct 겸용, 이미지 입력 가능. Groq는 131K. Cloudflare 무료는 262K.Mixtral 8x7BMoE가 오픈 진영에서 통한다는 걸 증명한 mixture-of-experts 모델. Mistral 공식 API에서는 은퇴. 로컬에서는 여전히 좋은 선택.
Laguna XSPoolside의 소형 코딩 모델. OpenRouter 무료 id는 poolside/laguna-xs-2.1. Requesty는 33K로 poolside/laguna-xs.2 제공.
Gemini 3.7 FlashGoogle의 현행 Flash 주력 — 코딩·에이전트·멀티모달 입력, 1M 컨텍스트, AI Studio에서 무료 체험.
Kimi K3Moonshot의 현행 오픈 MoE. 도구 호출과 코딩이 강점. NVIDIA NIM에서 무료. Groq는 구 K2 종료.
DeepSeek R12025년에 chain-of-thought를 오픈한 추론 모델. DeepSeek 공식 API에서는 사라졌지만 일부 호스트에서 무료, 로컬 웨이트로도 가능.
Qwen3.8-Flash-NextFlash-Next 3.8 체크포인트. AMD Radeon Cloud가 하루 $10 Token Factory 한도로 제공하는 바로 그 id.Gemma 4 31BGoogle의 오픈 31B. Cerebras가 $5 가입 크레딧으로 gemma-4-31b 제공. Requesty는 google/gemma-4-31b-it을 $0으로 게재.
Nemotron 3 Super120B Super. Requesty 문서 예제이자 그 게이트웨이의 $0 id. OpenRouter에서도 `:free`.Gemini 3.5 Flash Lite현행 최저가 Gemini. 분류·추출 같은 하루 수천 번 도는 작업용.
GPT-OSS 20B작은 쪽의 GPT-OSS. Groq에서는 120B보다 빠르고, 같은 131K 윈도우에 하루 1,000 요청.
GPT-OSS Safeguard 20BGPT-OSS 계열의 안전 분류기. Groq가 다른 20B와 같은 무료 채팅 한도로 제공.
DeepSeek V3.1이전 세대 DeepSeek. 공식 API에서는 은퇴. SambaNova 무료 티어는 V3.1을 계속 호스팅.GLM 4.7 FlashZ.ai의 영구 무료 라인. 200K 컨텍스트. 같은 호스트의 glm-4.7·glm-5·glm-5.2는 토큰 과금.
Qwen 3.6 27B이전 세대 27B. 여전히 Groq 무료 리스트에 있음. 3.8과 같은 131K 윈도우·분당 30 요청.
Qwen 3.7 PlusAlibaba Model Studio(싱가포르/국제)의 현행 plus id. 1M 컨텍스트, 90일간 1M 무료 토큰. qwen3-plus는 현행 id가 아님.
Qwen 3 30B-A3B30B MoE(활성 3B). Cloudflare가 무료 Workers AI 풀에서 @cf/qwen/qwen3-30b-a3b-fp8 제공.
Qwen 3.5 397B397B-A17B의 Qwen 3.5. Ollama Cloud의 현행 Qwen id는 qwen3.5:397b.
Qwen 3 8BQwen 3의 8B instruct. SiliconFlow 무료 티어 예시 id. 로컬에서도 돌릴 수 있는 크기.Mistral SmallMistral의 현행 스몰 라인. La Plateforme의 Free mode가 이 id. Labs 모델(labs- 접두사)도 무료.
Command ACohere의 엔터프라이즈 모델. RAG과 인용을 위해 설계. 체험 키는 만료 없음.
Jamba 1.5 Large하이브리드 Mamba-Transformer. 아키텍처 덕에 긴 문서에서 유난히 저렴.Groq Compound모델이 아니라 시스템: Groq가 요청을 여러 모델과 웹 검색 등 내장 도구로 라우팅.
Groq Compound MiniGroq의 더 가벼운 Compound 시스템. 같은 도구 라우팅 사상, 더 작은 기본 구성.
Mistral Medium 3.5Mistral의 밸런스형: 유럽 호스팅과 256K 컨텍스트. La Plateforme에서는 유료. 무료 티어의 주인공은 아님.
Phi-4Microsoft의 소형 모델. 추론 벤치에서 크기 이상의 성능을 냄.