D'où vient le modèle
Ce n'est pas une liste d'intégrations. C'est un seul protocole : tout ce qui
répond à /v1/chat/completions et /v1/models comme le fait OpenAI peut être visé,
et ses modèles apparaissent dans le sélecteur sans être déclarés un par un.
La liste ci-dessous n'est donc pas « ce pour quoi nous avons écrit du support ».
C'est là où les gens le pointent — et chaque endpoint qui y figure s'est vu
demander sa liste de modèles, sans clé, le 2026-09-06. Un 401 en est la preuve :
le chemin existe, il veut une clé, et il a la forme de l'API OpenAI.
Sur votre propre machine
Ollama · LM Studio · llama.cpp · LocalAI · Jan · Xinference · KoboldCpp · llamafile
Sur votre propre serveur
vLLM · SGLang · Text Generation Inference · NVIDIA NIM · LiteLLM comme passerelle devant n'importe lequel d'entre eux
Hébergeant des modèles ouverts
Fireworks AI · Together AI · Groq · DeepInfra · Baseten · Novita AI · Hyperbolic · Nebius AI Studio · Cerebras · SambaNova · Featherless · Chutes · NVIDIA NIM · Hugging Face Inference · OpenRouter · Vercel AI Gateway · Perplexity
En Chine
SiliconFlow 硅基流动 · Infinigence 无问芯穹 · PPIO 派欧云 · Qiniu 七牛云 · ModelScope 魔搭 · Alibaba DashScope 阿里云百炼 · Volcengine Ark 火山方舟 · Doubao 豆包 · Baidu Qianfan 百度千帆 · iFlytek Spark 讯飞星火 · DeepSeek · Zhipu 智谱 · Moonshot 月之暗面 · MiniMax · StepFun 阶跃星辰 · Tencent Hunyuan 腾讯混元 · Baichuan 百川智能 · Xiaomi MiMo 小米
Modèles fermés, quand vous en voulez un
OpenAI · Anthropic · Mistral · xAI
On peut souvent atteindre un modèle par plus d'un chemin
Xiaomi et ByteDance exploitent leur propre endpoint et voient leurs modèles portés par d'autres, ce qui compte quand l'un est moins cher, plus rapide ou plus proche de vous que l'autre.
| Modèle | De son créateur | Également porté par |
|---|---|---|
| Xiaomi MiMo | api.xiaomimimo.com/v1 | OpenRouter · Novita · DeepInfra · PPIO · Featherless · Hugging Face |
| Doubao 豆包 | Volcengine Ark ark.cn-beijing.volces.com/api/v3 | Qiniu 七牛云 |
| ByteDance Seed | Volcengine Ark | OpenRouter · DeepInfra |
La colonne de droite vient d'avoir demandé sa liste de modèles à chaque fournisseur et d'avoir regardé, le 2026-09-10. Celle de gauche vient de leur propre documentation, confirmée par une requête sans clé.
Documenté, mais non vérifié ici
Google Gemini, GitHub Models et Cloudflare Workers AI documentent tous un endpoint compatible OpenAI, et aucun des trois n'a pu être confirmé par une requête sans clé. Ils sont ici plutôt qu'au-dessus pour que la différence se voie.
Quotas gratuits
Plusieurs d'entre eux donnent quelque chose — Groq, Cerebras, ModelScope, NVIDIA, les modèles gratuits d'OpenRouter, le palier Flash de 智谱, SiliconFlow, 百度千帆, Google et GitHub, entre autres. Ce qui est gratuit change d'un mois à l'autre et n'est pas quelque chose que ce fichier peut garder vrai, donc aucun montant n'est cité : allez voir la page de tarifs du fournisseur. C'est la manière la moins chère d'essayer ceci avec un modèle plus gros que ce que votre machine peut contenir.
Deux remarques honnêtes. Être joignable n'est pas la même chose qu'être bon à cela — c'est à quoi sert le tableau des modèles ci-dessus, et il a une ligne parce qu'un seul modèle a été essayé. Et un fournisseur qui répond à l'API OpenAI mais pas à sa partie appel d'outils discutera, et guère plus.