De onde vem o modelo
Isto não é uma lista de integrações. É um protocolo só: qualquer coisa que
responda a /v1/chat/completions e /v1/models do jeito que a OpenAI responde
pode ser apontada, e os modelos dela aparecem no seletor sem serem declarados um
a um.
Então a lista abaixo não é «para quem construímos suporte». É para onde as pessoas
apontam — e a cada endpoint dela foi pedida a lista de modelos, sem chave, em
2026-09-06. Um 401 é a prova: o caminho existe, ele quer uma chave e tem o
formato da API da OpenAI.
Na sua própria máquina
Ollama · LM Studio · llama.cpp · LocalAI · Jan · Xinference · KoboldCpp · llamafile
No seu próprio servidor
vLLM · SGLang · Text Generation Inference · NVIDIA NIM · LiteLLM como gateway na frente de qualquer um deles
Hospedando modelos abertos
Fireworks AI · Together AI · Groq · DeepInfra · Baseten · Novita AI · Hyperbolic · Nebius AI Studio · Cerebras · SambaNova · Featherless · Chutes · NVIDIA NIM · Hugging Face Inference · OpenRouter · Vercel AI Gateway · Perplexity
Na China
SiliconFlow 硅基流动 · Infinigence 无问芯穹 · PPIO 派欧云 · Qiniu 七牛云 · ModelScope 魔搭 · Alibaba DashScope 阿里云百炼 · Volcengine Ark 火山方舟 · Doubao 豆包 · Baidu Qianfan 百度千帆 · iFlytek Spark 讯飞星火 · DeepSeek · Zhipu 智谱 · Moonshot 月之暗面 · MiniMax · StepFun 阶跃星辰 · Tencent Hunyuan 腾讯混元 · Baichuan 百川智能 · Xiaomi MiMo 小米
Modelos fechados, quando você quiser um
OpenAI · Anthropic · Mistral · xAI
Muitas vezes dá para chegar a um modelo por mais de um caminho
A Xiaomi e a ByteDance mantêm o próprio endpoint e têm seus modelos carregados por terceiros, o que importa quando um é mais barato, mais rápido ou mais perto de você do que o outro.
| Modelo | De quem o fez | Também carregado por |
|---|---|---|
| Xiaomi MiMo | api.xiaomimimo.com/v1 | OpenRouter · Novita · DeepInfra · PPIO · Featherless · Hugging Face |
| Doubao 豆包 | Volcengine Ark ark.cn-beijing.volces.com/api/v3 | Qiniu 七牛云 |
| ByteDance Seed | Volcengine Ark | OpenRouter · DeepInfra |
A coluna da direita vem de pedir a lista de modelos a cada provedor e olhar, em 2026-09-10. A da esquerda vem da documentação deles, confirmada com uma requisição sem chave.
Documentado, mas não verificado aqui
Google Gemini, GitHub Models e Cloudflare Workers AI documentam um endpoint compatível com a OpenAI, e nenhum dos três pôde ser confirmado com uma requisição sem chave. Estão aqui e não acima para que a diferença fique visível.
Cotas gratuitas
Vários deles dão alguma coisa — Groq, Cerebras, ModelScope, NVIDIA, os modelos gratuitos da OpenRouter, o nível Flash da 智谱, SiliconFlow, 百度千帆, Google e GitHub entre eles. O que é gratuito muda de mês para mês e não é algo que este arquivo consiga manter verdadeiro, então nenhum valor é citado: veja a página de preços do provedor. É o jeito mais barato de experimentar isto com um modelo maior do que a sua máquina aguenta.
Duas observações honestas. Ser alcançável não é a mesma coisa que ser bom nisto — é para isso que serve a tabela de modelos acima, e ela tem uma linha porque um modelo foi executado. E um provedor que responde à API da OpenAI mas não à parte de chamada de ferramentas vai conversar e pouco mais.