Zum Hauptinhalt springen

Woher das Modell kommt

Das ist keine Liste von Integrationen. Es ist ein Protokoll: Alles, was auf /v1/chat/completions und /v1/models so antwortet wie OpenAI, kann angesprochen werden, und seine Modelle erscheinen in der Auswahl, ohne einzeln deklariert zu werden.

Die Liste unten ist also nicht „wofür wir Unterstützung gebaut haben“. Sie ist, worauf Leute es richten — und jeder Endpunkt darin wurde am 2026-09-06 ohne Schlüssel nach seiner Modellliste gefragt. Ein 401 ist der Beweis: der Pfad existiert, er will einen Schlüssel, und er hat die Form der OpenAI-API.

Auf Ihrem eigenen Rechner

Ollama · LM Studio · llama.cpp · LocalAI · Jan · Xinference · KoboldCpp · llamafile

Auf Ihrem eigenen Server

vLLM · SGLang · Text Generation Inference · NVIDIA NIM · LiteLLM als Gateway vor jedem von ihnen

Offene Modelle im Hosting

Fireworks AI · Together AI · Groq · DeepInfra · Baseten · Novita AI · Hyperbolic · Nebius AI Studio · Cerebras · SambaNova · Featherless · Chutes · NVIDIA NIM · Hugging Face Inference · OpenRouter · Vercel AI Gateway · Perplexity

In China

SiliconFlow 硅基流动 · Infinigence 无问芯穹 · PPIO 派欧云 · Qiniu 七牛云 · ModelScope 魔搭 · Alibaba DashScope 阿里云百炼 · Volcengine Ark 火山方舟 · Doubao 豆包 · Baidu Qianfan 百度千帆 · iFlytek Spark 讯飞星火 · DeepSeek · Zhipu 智谱 · Moonshot 月之暗面 · MiniMax · StepFun 阶跃星辰 · Tencent Hunyuan 腾讯混元 · Baichuan 百川智能 · Xiaomi MiMo 小米

Geschlossene Modelle, wenn Sie eines wollen

OpenAI · Anthropic · Mistral · xAI

Ein Modell ist oft auf mehr als einem Weg erreichbar

Xiaomi und ByteDance betreiben einen eigenen Endpunkt und lassen ihre Modelle von anderen führen — was zählt, sobald der eine billiger, schneller oder näher an Ihnen ist als der andere.

ModellVom HerstellerAußerdem geführt von
Xiaomi MiMoapi.xiaomimimo.com/v1OpenRouter · Novita · DeepInfra · PPIO · Featherless · Hugging Face
Doubao 豆包Volcengine Ark ark.cn-beijing.volces.com/api/v3Qiniu 七牛云
ByteDance SeedVolcengine ArkOpenRouter · DeepInfra

Die rechte Spalte stammt daher, jeden Anbieter am 2026-09-10 nach seiner Modellliste gefragt und hineingesehen zu haben. Die linke stammt aus deren eigener Dokumentation, bestätigt mit einer Anfrage ohne Schlüssel.

Dokumentiert, aber hier nicht verifiziert

Google Gemini, GitHub Models und Cloudflare Workers AI dokumentieren alle einen OpenAI-kompatiblen Endpunkt, und keiner der drei ließ sich mit einer Anfrage ohne Schlüssel bestätigen. Sie stehen hier statt oben, damit der Unterschied sichtbar ist.

Kostenlose Kontingente

Mehrere davon geben etwas her — Groq, Cerebras, ModelScope, NVIDIA, die kostenlosen Modelle von OpenRouter, die Flash-Stufe von 智谱, SiliconFlow, 百度千帆, Google und GitHub unter ihnen. Was kostenlos ist, ändert sich von Monat zu Monat und ist nichts, was diese Datei wahr halten kann, deshalb werden keine Beträge genannt: sehen Sie auf der Preisseite des Anbieters nach. Es ist der billigste Weg, das hier mit einem Modell zu probieren, das größer ist, als Ihr Rechner es fassen kann.

Zwei ehrliche Anmerkungen. Erreichbar zu sein heißt nicht, darin gut zu sein — dafür ist die Modelltabelle oben da, und sie hat eine Zeile, weil ein Modell ausprobiert wurde. Und ein Anbieter, der die OpenAI-API beantwortet, aber ihren Werkzeugaufruf-Teil nicht, wird sich unterhalten und wenig sonst.