Einrichtung · chinesische Modelle

Claude Code mit DeepSeek, GLM, Kimi und Qwen: Einrichtung mit einem Schlüssel

Stand 2026-10-07 nutzen Sie chinesische Modelle in Claude Code über QCode so: ANTHROPIC_BASE_URL bleibt bei https://api.qcode.cc/api und ANTHROPIC_AUTH_TOKEN bei Ihrem cr_-Schlüssel; in der Sitzung wechseln Sie mit /model glm-5.3 (oder deepseek-v4-pro, kimi-k3, qwen3.8-max), oder Sie setzen vor dem Start ANTHROPIC_MODEL. Laut QCode-Dokumentation laufen die Familien GLM, Kimi, DeepSeek und Qwen sowohl über den Anthropic-Endpunkt als auch über den OpenAI-Chat-Endpunkt. Diese Seite fasst Einrichtung, Einsatzgebiete der Modelle, Unterschiede zu Claude und typische Fehler zusammen, auf Basis der QCode-Dokumentation und der offiziellen Dokumentation der Hersteller.

Aktualisiert 2026-10-08

#Ein cr_-Schlüssel#Wechsel per /model#Anthropic-Endpunkt#GLM · Kimi · DeepSeek · Qwen

Vier Kernpunkte vorab

4 Familien

Chinesische Modellfamilien am selben Schlüssel

Zhipu GLM, Moonshot Kimi, DeepSeek und Alibabas Qwen teilen sich laut QCode-Dokumentation mit Claude einen cr_-Schlüssel und dieselben Endpunkte.

/api

ANTHROPIC_BASE_URL bleibt gleich

Zeigt Claude Code bereits auf https://api.qcode.cc/api, ändert sich die Adresse beim Wechsel auf ein chinesisches Modell nicht; ohne abschließenden Schrägstrich eintragen.

/model glm-5.3

Ein Befehl in der Sitzung

Die ID zeichengenau eingeben, etwa deepseek-v4-pro, kimi-k3 oder qwen3.8-max, nicht einen Anzeigenamen wie „GLM-5.3“.

1M / 128K

GLM-5.3: Kontext / max. Ausgabe (offiziell)

Laut Zhipu verarbeitet GLM-5.3 derzeit nur Text und denkt immer mit; Moonshot nennt für kimi-k3 ein Kontextfenster von 1 Million Tokens und native Bilderkennung.

So funktioniert es: Sie wechseln das Modell, nicht die Adresse

Stand 2026-10-07 brauchen Sie für ein chinesisches Modell in Claude Code weder ein neues Tool noch einen neuen Endpunkt oder Schlüssel: Der Anthropic-Endpunkt von QCode, https://api.qcode.cc/api, nimmt Modell-IDs von Claude und von den vier chinesischen Familien an. Claude Code bleibt also konfiguriert wie bisher, und /model wechselt auf glm-5.3, deepseek-v4-pro, kimi-k3 oder qwen3.8-max. Die Claude-Code-Dokumentation sagt es klar: ANTHROPIC_BASE_URL ändert, wohin Anfragen gehen, nicht welches Modell antwortet; ändern müssen Sie also den Modellnamen. Die QCode-Dokumentation empfiehlt weiterhin die Claude-5-Familie als Standard für den Alltag und beschreibt die chinesischen Modelle als geeignet für chinesischsprachige Büroarbeit und lange Texte, große Mengen zu niedrigerem Stückpreis und Vergleichsläufe gegen Claude. DeepSeek, Zhipu, Moonshot und Alibaba Cloud Model Studio veröffentlichen jeweils eine offizielle Anleitung, um Claude Code an ihren eigenen Anthropic-kompatiblen Endpunkt anzubinden; auf diesem Weg brauchen Sie pro Hersteller einen eigenen Schlüssel und eine eigene Adresse.

Neues auf Herstellerseite

Laut offizieller DeepSeek-Newsseite erschien DeepSeek-V4.1-Flash am 2026-09-10; das Unternehmen gibt native multimodale Bilderkennung an. Die DeepSeek-Preisseite ergänzt: Der alte Name deepseek-v4-flash wird weiter angenommen, das zugehörige Modell ist aber abgeschaltet, und solche Anfragen bedient DeepSeek-V4.1-Flash. Zhipus Dokumentation hält fest, dass GLM-5.3 derzeit nur Text verarbeitet, ein Kontextfenster von 1M und maximal 128K Ausgabe unterstützt und das Denken immer aktiv ist, ohne Möglichkeit zum Abschalten. Moonshots Modellliste beschreibt kimi-k3 mit nativer Bilderkennung und einem Kontextfenster von 1 Million Tokens. Die Dokumentation von Alibaba Cloud Model Studio zu Anthropic-kompatiblem Messages führt qwen3.8-max, qwen3.8-flash und qwen3.7-plus unter den unterstützten Modellen. Das sind Aussagen der Hersteller über ihre eigenen Plattformen; welche ID Sie bei QCode eintragen, richtet sich nach der QCode-Dokumentation und /models.

Zeitleiste

2026-09-10

DeepSeek-V4.1-Flash erscheint (offizielle DeepSeek-Newsseite).

2026-09-18

Die QCode-Dokumentation gleicht die angebotenen chinesischen IDs mit qcode.cc/models und dem öffentlichen Modell-Endpunkt ab: glm-5.3, glm-5.3-flash, kimi-k3, deepseek-v4-pro, deepseek-v4-flash, deepseek-v4.1-flash, qwen3.8-max, qwen3.8-flash, qwen3.7-plus.

2026-10-07

Diese Seite wird mit der QCode-Dokumentation (die Seiten zu chinesischen Modellen und zu Endpunkten wurden beide am 2026-09-25 aktualisiert) und der offiziellen Dokumentation der vier Hersteller abgeglichen.

Bestätigt vs. nicht angegeben

Bestätigt (wörtlich in offiziellen Seiten)

All das lässt sich wörtlich prüfen: Die QCode-Dokumentation sagt, dass die vier chinesischen Familien (GLM, Kimi, DeepSeek, Qwen) sowohl den Anthropic-Endpunkt als auch den OpenAI-Chat-Endpunkt nutzen können, Claude-Modelle dagegen nur den Anthropic-Endpunkt; zeigt Claude Code bereits auf QCode, bleibt ANTHROPIC_BASE_URL unverändert, und /model mit einer ID wechselt das Modell; ANTHROPIC_MODEL greift bei jedem Start verbindlich, ANTHROPIC_DEFAULT_MODEL legt nur den Standard für neue Sitzungen fest (ab 2.1.236); chinesische Modelle erscheinen auch mit aktivierter Gateway-Modellerkennung nicht in der /model-Auswahl; Nicht-Claude-Modelle bekommen in Claude Code unter Umständen keine nativen Funktionen wie Extended Thinking. Auf Herstellerseite veröffentlichen DeepSeek, Zhipu, Moonshot und Alibaba Cloud Model Studio offizielle Anleitungen, um Claude Code an ihre eigenen Anthropic-kompatiblen Endpunkte anzubinden.

Offiziell nicht angegeben / hier nicht geprüft

Drei Dinge sind nicht dokumentiert oder hier nicht geprüft: ① Die QCode-Dokumentation nennt drei Wege, ein chinesisches Modell zu wählen, nämlich /model, ANTHROPIC_MODEL und ANTHROPIC_DEFAULT_MODEL, und sagt nichts darüber, wie sich ANTHROPIC_DEFAULT_HAIKU_MODEL, CLAUDE_CODE_SUBAGENT_MODEL oder das Suffix [1m] bei QCode verhalten; die Herstelleranleitungen, die sie verwenden, zielen auf deren eigene Endpunkte. Ebenso offen bleibt, ob man für chinesische Modelle die offizielle Claude-Code-Variable CLAUDE_CODE_MAX_CONTEXT_TOKENS setzen sollte, die das angenommene Kontextfenster überschreibt; diese Seite spekuliert nicht darüber hinaus. ② Welches chinesische Modell in Claude Code am besten programmiert: Hier stehen keine Benchmarks, nur die Kombinationsempfehlungen von QCode. ③ Kontext- und Ausgabegrenzen von qwen3.8-max und den übrigen Qwen-Modellen wurden hier nicht einzeln geprüft; maßgeblich sind /models und die offiziellen Seiten von Alibaba Cloud.

Im Vergleich zu Claude-Modellen und Hersteller-Endpunkten

vs. Claude-Modelle

Die QCode-Dokumentation rät, Claude als Hauptwahl zu behalten und andere Modelle ergänzend einzusetzen, da Nicht-Claude-Modelle in Claude Code Teile von Extended Thinking möglicherweise nicht unterstützen. Die Hersteller nennen eigene Unterschiede: GLM-5.3 etwa verarbeitet nur Text, und das Denken lässt sich nicht abschalten. Die Claude-Code-Dokumentation ergänzt, dass Claude Code bei einer nicht erkannten Modell-ID am Kontextfenster komprimiert, das es für diese ID annimmt. Als Kombination schlägt QCode für den Programmieralltag zuerst claude-sonnet-5 vor, und deepseek-v4-pro oder glm-5.3 für einen Vergleichslauf oder ein knappes Budget.

vs. eigene Endpunkte der Hersteller

DeepSeek (https://api.deepseek.com/anthropic), Zhipu (https://open.bigmodel.cn/api/anthropic), Moonshot (https://api.moonshot.cn/anthropic) und Alibaba Cloud Model Studio veröffentlichen Anleitungen für Claude Code, doch jeder verlangt einen eigenen Schlüssel und eine eigene ANTHROPIC_BASE_URL, und alle Ebenen (Hauptdialog, Hintergrundaufgaben, Subagents) müssen auf die eigenen Modelle zeigen: Moonshots Anleitung warnt, dass bei nur teilweise gesetzten Variablen die betroffenen Szenarien still fehlschlagen. Über QCode deckt ein cr_-Schlüssel Claude und alle vier chinesischen Familien ab, und ein Wechsel ändert nur das Modell.

Chinesische Modelle in Claude Code einrichten: fünf Schritte

① Setzen Sie wie in der QCode-Dokumentation zu Umgebungsvariablen zwei Werte: ANTHROPIC_BASE_URL=https://api.qcode.cc/api (ohne abschließenden Schrägstrich) und ANTHROPIC_AUTH_TOKEN=Ihr cr_-Schlüssel; für Nordamerika und Europa gibt es us.qcode.cc (Los Angeles). ② Starten Sie claude und geben Sie in der Sitzung /model glm-5.3 ein oder eine andere angebotene ID wie deepseek-v4-pro, kimi-k3 oder qwen3.8-max, zeichengenau. ③ Soll jeder Start mit einem chinesischen Modell beginnen, setzen Sie ANTHROPIC_MODEL (greift bei jedem Start); wollen Sie nur den Standard für neue Sitzungen festlegen, nutzen Sie ANTHROPIC_DEFAULT_MODEL (ab Claude Code 2.1.236; eine Auswahl per /model hat Vorrang). ④ Mit /status prüfen Sie, welches Modell aktiv ist. ⑤ Für ein OpenAI-kompatibles Tool statt Claude Code tragen Sie https://api.qcode.cc/openai/v1 und dieselben chinesischen Modell-IDs ein; Claude-Modelle laufen nicht über diesen Endpunkt, nutzen Sie dafür Claude Code oder ein anderes Tool mit Anthropic-Protokoll.

Bei QCode

Über QCode aufrufbar sind die chinesischen Modell-IDs glm-5.3, glm-5.3-flash, glm-5.2, kimi-k3, deepseek-v4-pro, deepseek-v4-flash, deepseek-v4.1-flash, qwen3.8-max, qwen3.8-flash und qwen3.7-plus, mit demselben cr_-Schlüssel (in der Konsole erstellt) wie Claude-Modelle, etwa claude-sonnet-5 und claude-opus-5-5. Claude Code nutzt den Anthropic-Endpunkt https://api.qcode.cc/api; chinesische Modelle in OpenAI-kompatiblen Tools nutzen https://api.qcode.cc/openai/v1, Claude-Modelle dagegen nur den Anthropic-Endpunkt; der Schlüssel gilt familienübergreifend. Für Nordamerika und Europa gibt es us.qcode.cc (Los Angeles). Abgerechnet wird pro Token; die Preise je Modell stehen unter /models. Jede Anfrage lässt sich auf probe.qcode.cc nach Eingabe des Schlüssels einsehen.

Häufig gestellte Fragen

Kann Claude Code DeepSeek, GLM, Kimi oder Qwen nutzen?

Ja. Über QCode bleibt ANTHROPIC_BASE_URL bei https://api.qcode.cc/api, und Sie wechseln in der Sitzung mit /model deepseek-v4-pro (oder glm-5.3, kimi-k3, qwen3.8-max). Die QCode-Dokumentation hält fest, dass die Familien GLM, Kimi, DeepSeek und Qwen sowohl den Anthropic- als auch den OpenAI-Chat-Endpunkt nutzen können, und derselbe cr_-Schlüssel ruft weiterhin auch Claude auf.

Muss ich ANTHROPIC_BASE_URL ändern?

Nein. Laut QCode-Dokumentation bleibt ANTHROPIC_BASE_URL unverändert, sobald Claude Code über die Umgebungsvariablen auf QCode zeigt. Den Grund nennt die Claude-Code-Dokumentation: ANTHROPIC_BASE_URL ändert, wohin Anfragen gehen, nicht welches Modell antwortet; das Modell wechseln Sie per /model oder ANTHROPIC_MODEL.

Warum erscheinen chinesische Modelle nicht in der /model-Auswahl?

Claude Code übernimmt beim Einlesen der Modellliste eines Gateways nur Modelle, deren Name claude oder anthropic enthält – das ist also so vorgesehen. Laut QCode-Dokumentation listet die Auswahl bei QCode auch mit CLAUDE_CODE_ENABLE_GATEWAY_MODEL_DISCOVERY=1 nur Claude-IDs. Geben Sie /model glm-5.3 direkt ein oder setzen Sie ANTHROPIC_MODEL bzw. ANTHROPIC_DEFAULT_MODEL.

Ich habe den Modellnamen eingetragen und bekomme einen Fehler. Was tun?

Meist stimmt die ID nicht. Die QCode-Dokumentation verlangt die Schreibweise glm-5.3, nicht „GLM-5.3“ oder einen Anzeigenamen; eingestellte Namen wie qwen3.7-max, kimi-k2.6 und glm-5.1 liefern Fehler. Die Claude-Code-Dokumentation weist darauf hin, dass ein per ANTHROPIC_MODEL gesetzter Wert nicht vorab geprüft wird; ein Tippfehler zeigt sich bei der ersten Anfrage als „There's an issue with the selected model“. Ein 401 betrifft den Schlüssel: Er muss mit cr_ beginnen und darf keine Leerzeichen enthalten.

Wie unterscheiden sich chinesische Modelle in Claude Code von Claude?

Vor allem bei nativen Funktionen. Die QCode-Dokumentation warnt, dass Nicht-Claude-Modelle in Claude Code native Funktionen wie Extended Thinking unter Umständen nicht nutzen können; im Zweifel setzen Sie sie also ergänzend ein. Die Hersteller werden konkret: GLM-5.3 verarbeitet nur Text und kann das Denken nicht abschalten, während Moonshot für kimi-k3 native Bilderkennung angibt. Die Claude-Code-Dokumentation sagt zudem, dass bei einer nicht erkannten Modell-ID am angenommenen Kontextfenster komprimiert wird; wie sich das für chinesische Modelle anpassen lässt, beschreibt die QCode-Dokumentation nicht.

Welches chinesische Modell passt wofür?

Laut Kombinationstabelle von QCode: Für den Programmieralltag zuerst claude-sonnet-5, für Vergleichsläufe oder knappes Budget deepseek-v4-pro oder glm-5.3; für schwieriges Schlussfolgern und große Refactorings bleibt claude-opus-5 vorn, zum Sparen lässt sich kimi-k3 testen; für lange chinesische Texte, Protokolle und Büroarbeit sind kimi-k3, glm-5.3 und qwen3.8-max verbreitet; für Massen- und Routineaufgaben haben deepseek-v4-flash und qwen3.8-flash einen niedrigeren Stückpreis.

Quellen

QCode: die Seiten der QCode-Dokumentation zu chinesischen Modellen, zu Endpunkten und API-Formaten sowie zu Umgebungsvariablen (alle aktualisiert am 2026-09-25), dazu der Leitfaden zur Modellwahl und die Seite zu Kosten und Preisen, abgerufen am 2026-10-07. Claude Code: die Seiten zur Modellkonfiguration und zu Umgebungsvariablen in der offiziellen Claude-Code-Dokumentation von Anthropic (was ANTHROPIC_BASE_URL bewirkt, Vorrang von /model und ANTHROPIC_MODEL, /status, die Haiku-Variable für Hintergrundfunktionen, das angenommene Kontextfenster für nicht erkannte Modell-IDs), am selben Tag abgerufen. Hersteller: DeepSeek-API-Dokumentation (Anbindung von Claude Code, Anthropic API, Modelle und Preise, Meldung zum Start von V4.1 Flash); Dokumentation der offenen Zhipu-Plattform (Claude-API-Kompatibilität, GLM-5.3, GLM-5.3-Flash und die Coding-Plan-Seite zum Modellwechsel); offene Kimi-Plattform (Kimi in Claude Code, Modellliste); Hilfecenter von Alibaba Cloud Model Studio (Claude Code, Anthropic-kompatibles Messages); alles abgerufen am 2026-10-07.

Ein Schlüssel, chinesische Modelle in Claude Code

Claude, GLM, Kimi, DeepSeek und Qwen teilen sich einen cr_-Schlüssel; ein Wechsel ändert nur das Modell. Bezahlt wird pro Token, die Preise je Modell stehen unter /models.

Weiterführende Lektüre

Einrichtung und Zitate auf dieser Seite wurden am 2026-10-07 mit der QCode-Dokumentation und den offiziellen Seiten von DeepSeek, Zhipu, Moonshot, Alibaba Cloud Model Studio und Anthropic abgeglichen; Änderungen beim Anbieter sind ohne Vorankündigung möglich. Endpunkte und Variablen aus Herstelleranleitungen gelten nur auf deren eigenen Plattformen. Welche Modelle aufrufbar sind, steht unter /models.

Erst testen, dann entscheiden

Unsicher bei der Tarifwahl? Beginnen Sie mit Starter ($8.57/Monat) und wechseln Sie auf einen höheren Tarif, wenn Sie zufrieden sind — der ungenutzte Wert des alten Tarifs geht auf Ihr Guthaben zurück.