it's free*.ai

llamafile

O llamafile é o truque da Mozilla: um único arquivo que é ao mesmo tempo os pesos GGUF e o runtime (llama.cpp mais Cosmopolitan Libc). Baixe, chmod +x, execute. Sem instalação, sem Python, sem Docker.

O llamafile é o truque da Mozilla: um único arquivo que é ao mesmo tempo os pesos GGUF e o runtime (llama.cpp mais Cosmopolitan Libc). Baixe, chmod +x, execute. Sem instalação, sem Python, sem Docker.

`--server` expõe o compatível com OpenAI na porta 8080. O contexto se fixa no lançamento com -c. A ferramenta certa quando você quer entregar um modelo a alguém como executável.

Contexto máximo
Set with -c at launch
Nível gratuito
Ilimitado e privado
Requisito
Nada — sem conta

Endpoint

URL basehttp://localhost:8080/v1
Limite de taxaNone — it is your machine

Exemplos de código

npm install openai
import OpenAI from 'openai'

const client = new OpenAI({
  baseURL: 'http://localhost:8080/v1',
  apiKey: 'not-needed'
})

const response = await client.chat.completions.create({
  model: 'LLaMA_CPP',
  messages: [{ role: 'user', content: 'Explain closures in one paragraph.' }]
})

console.log(response.choices[0].message.content)

Vale saber

Modelos que você obtém de graça2