Zum Inhalt springen

Go

Kostengünstiges Abonnement für offene Coding-Modelle.

OpenCode Go ist ein kostengünstiges Abonnement für 10 $/Monat, das dir zuverlässigen Zugriff auf beliebte offene Coding-Modelle bietet.

Go funktioniert wie jeder andere Provider in OpenCode. Du abonnierst OpenCode Go und erhältst deinen API-Key. Es ist völlig optional und du musst es nicht nutzen, um OpenCode zu verwenden.

Es wurde in erster Linie für internationale Nutzer entwickelt und bietet einen stabilen weltweiten Zugriff.


Hintergrund

Offene Modelle sind richtig gut geworden. Sie erreichen bei Coding-Aufgaben mittlerweile eine Leistung, die nahe an proprietäre Modelle herankommt. Und da viele Provider sie wettbewerbsfähig anbieten können, sind sie in der Regel viel günstiger.

Allerdings kann es schwierig sein, zuverlässigen Zugriff mit geringer Latenz auf sie zu erhalten. Provider variieren in Qualität und Verfügbarkeit.

Um dies zu beheben, haben wir einige Dinge getan:

  1. Wir haben eine ausgewählte Gruppe offener Modelle getestet und mit ihren Teams darüber gesprochen, wie man sie am besten ausführt.
  2. Anschließend haben wir mit einigen Providern zusammengearbeitet, um sicherzustellen, dass diese korrekt bereitgestellt werden.
  3. Zuletzt haben wir die Kombination aus Modell und Provider einem Benchmark unterzogen und eine Liste erstellt, die wir mit gutem Gewissen empfehlen können.

OpenCode Go bietet dir Zugriff auf diese Modelle für 10 $/Monat.


Wie es funktioniert

OpenCode Go funktioniert wie jeder andere Provider in OpenCode.

  1. Du meldest dich bei OpenCode Zen an, abonnierst Go und kopierst deinen API-Key.
  2. Du führst den Befehl /connect in der TUI aus, wählst OpenCode Go und fügst deinen API-Key ein.
  3. Führe /models in der TUI aus, um die Liste der über Go verfügbaren Modelle zu sehen.

Die aktuelle Liste der Modelle umfasst:

  • Grok 4.6
  • GLM-5.3-Flash
  • GLM-5.3
  • GLM-5.2
  • GLM-5.1
  • GPT 5.6 Luna
  • Kimi K3
  • Kimi K2.7 Code
  • Kimi K2.6
  • LongCat-2.0
  • MiMo-V2.5
  • MiMo-V2.5-Pro
  • MiniMax M3
  • MiniMax M2.7
  • Muse Spark 1.3 Contributor (begrenzte Regionen)
  • Muse Spark 1.2 Contributor (begrenzte Regionen)
  • Qwen3.8 Max
  • Qwen3.8 Flash
  • Qwen3.7 Max
  • Qwen3.7 Plus
  • Qwen3.6 Plus
  • DeepSeek V4.1 Flash
  • DeepSeek V4 Pro
  • DeepSeek V4 Flash
  • DeepSeek V4 Flash Vision Exp
  • Hy4 preview
  • Hy3

Die Liste der Modelle kann sich ändern, während wir neue testen und hinzufügen.


Wo kann ich es verwenden?

OpenCode Go wurde für OpenCode und andere Coding-Agenten entwickelt, die ähnliche Arten von Anfragen erzeugen. Der Datenverkehr wird auf Missbrauch überwacht, der das Nutzungserlebnis anderer beeinträchtigt.

Dein Client sollte:

  1. typischen Datenverkehr eines Coding-Agenten senden
  2. sich mit einem eigenen User-Agent wie my-coding-agent/1.0 identifizieren und nicht mit dem allgemeinen Namen eines SDKs oder einer HTTP-Bibliothek.
  3. für jede Unterhaltung eine stabile Sitzungs-ID in x-opencode-session senden, damit wir das Routing und Prompt-Caching optimieren können.

Validierte Clients

Neben OpenCode wurden die folgenden Clients für die ordnungsgemäße Verwendung mit OpenCode Go validiert. Wir garantieren jedoch nicht, dass sie auch in Zukunft funktionieren werden.

ClientSitzungsunterstützung
HermesBuilds mit PR #101864 senden den Header bei Haupt- und zusätzlichen OpenCode-Anfragen. Der Fix wurde nach v0.21.0 gemergt; diese Version allein enthält ihn nicht.
Claude CodeGo erkennt seinen nativen Sitzungs-Header. Es ist kein Wrapper für benutzerdefinierte Header erforderlich.
CodexGo erkennt seinen nativen Sitzungs-Header. Einige Versionen und Proxy-Konfigurationen lassen ihn weiterhin weg; stelle sicher, dass der Sitzungs-Header beim Weiterleiten von Anfragen erhalten bleibt.
ZCodeGo erkennt seinen nativen Sitzungs-Header. Unsere Anfrage für x-opencode-session ist weiterhin offen, aber es ist nicht mehr erforderlich, genau diesen Header zu senden.
PiAktuelle Builds senden Sitzungsinformationen für OpenCode. Aktualisiere ältere Installationen.
jcodeAktualisiere auf v0.81.6 oder neuer. Diese Version enthält den Fix für den Sitzungs-Header.
Kilo Code CLIBuilds mit PR #13752 stellen OpenCode-Sitzungs-Header wieder her. Dieser Fix gilt für die CLI, nicht für die VS-Code-Erweiterung. Siehe Issue #13723.

Bekannte problematische Clients

Bei diesen Clients fehlt in den von uns untersuchten Versionen die Sitzungsunterstützung oder sie ist unvollständig. Die verlinkten Berichte dokumentieren Fixes und Problemumgehungen.

ClientStatus und Nachverfolgung
DeepSeek HarnessSitzungsinformationen werden bei einigen Modellpfaden übermittelt, fehlen aber bei anderen. Wir erkennen seinen nativen Header; dieser muss noch von allen Adaptern gesendet werden. Diskussion #5495.
GitHub Copilot ChatAutomatische Unterstützung für Sitzungs-Header wurde in VS Code Issue #334186 angefragt.
Kimi CodeAutomatische Unterstützung für Sitzungs-Header wurde in Issue #3506 angefragt.
MiMo CodeFür Issue #2317 gibt es einen vorgeschlagenen Fix in PR #2327, der noch nicht gemergt wurde.

Nutzungslimits

Nutzungslimits werden als monatliche Dollarbeträge festgelegt. Die folgende Tabelle zeigt das monatliche Limit und die Tokenpreise für jedes Modell.

Für jedes Modell gelten folgende Nutzungslimits: 5 Stunden — 20 % des monatlichen Limits; wöchentlich — 50 %; und monatlich — 100 %.

Wenn ein Modell beispielsweise ein monatliches Limit von $60 hat, kannst du bis zu folgende Beträge nutzen:

  • 5-Stunden-Limit — Nutzung im Wert von $12
  • Wöchentliches Limit — Nutzung im Wert von $30
  • Monatliches Limit — Nutzung im Wert von $60

Tokenpreise gelten pro 1M Tokens.

ModelInputOutputCached ReadCached WriteMonatliches Limit
GLM-5.3-Flash$0.15$0.50$0.03-$60
GLM-5.3$1.40$4.40$0.26-$15
GLM-5.2$1.40$4.40$0.26-$60
GLM-5.1$1.40$4.40$0.26-$60
Kimi K3$3.00$15.00$0.30-$15
Kimi K2.7 Code$0.95$4.00$0.19-$60
Kimi K2.6$0.95$4.00$0.16-$60
LongCat-2.0$0.30$1.20$0.006-$60
MiMo V2.5$0.14$0.28$0.0028-$60
MiMo V2.5 Pro$0.435$0.87$0.003625-$15
MiniMax M3$0.30$1.20$0.06-$60
MiniMax M2.7$0.30$1.20$0.06$0.375$60
MiniMax M2.5$0.30$1.20$0.06$0.375$60
Muse Spark 1.3 Contributor$0.10$0.20$0.002-$60
Muse Spark 1.2 Contributor$0.10$0.20$0.002-$60
Qwen3.8 Max$2.00$6.00$0.25$2.50$15
Qwen3.8 Flash$0.15$0.47$0.016$0.20$30
Qwen3.7 Max$2.50$7.50$0.50$3.125$30
Qwen3.7 Plus (≤ 256K tokens)$0.40$1.60$0.04$0.50$60
Qwen3.7 Plus (> 256K tokens)$1.20$4.80$0.12$1.50$60
Qwen3.6 Plus (≤ 256K tokens)$0.50$3.00$0.05$0.625$60
Qwen3.6 Plus (> 256K tokens)$2.00$6.00$0.20$2.50$60
DeepSeek V4.1 Flash (Off-Peak)$0.15$0.60$0.003-$15
DeepSeek V4.1 Flash (Peak)$0.30$1.20$0.006-$15
DeepSeek V4 Pro (Off-Peak)$0.66$1.98$0.022-$15
DeepSeek V4 Pro (Peak)$1.32$3.96$0.044-$15
DeepSeek V4 Flash (Off-Peak)$0.15$0.60$0.003-$30
DeepSeek V4 Flash (Peak)$0.30$1.20$0.006-$30
DeepSeek V4 Flash Vision Exp (Off-Peak)$0.15$0.60$0.003-$15
DeepSeek V4 Flash Vision Exp (Peak)$0.30$1.20$0.006-$15
Hy4 preview$0.834$2.501$0.042-$30
Hy3$0.14$0.58$0.035-$60
Grok 4.6 (≤ 200K tokens)$2.00$6.00$0.50-$15
Grok 4.6 (> 200K tokens)$4.00$12.00$1.00-$15
GPT 5.6 Luna (≤ 272K tokens)$0.20$1.20$0.02$0.25$15
GPT 5.6 Luna (> 272K tokens)$0.40$1.80$0.04$0.50$15

DeepSeek V4.1 Flash / V4 Pro / V4 Flash / V4 Flash Vision Exp: Die Peak-Zeiten sind montags bis freitags von 01:00-04:00 und 06:00-10:00 UTC; alle anderen Zeiten, einschließlich der Wochenenden, sind Off-Peak. Mehr erfahren.

DeepSeek V4 Flash Vision Exp: Bilder werden anhand ihrer Abmessungen in Tokens umgewandelt und zusammen mit Text-Tokens als Input-Tokens abgerechnet. Mehr erfahren.

Geschätzte Anfragen

Die folgende Tabelle enthält eine geschätzte Anzahl von Anfragen basierend auf typischen Go-Nutzungsmustern:

ModelAnfragen pro 5 StundenAnfragen pro WocheAnfragen pro Monat
GLM-5.3-Flash6,32015,79031,580
GLM-5.32205401,080
GLM-5.28802,1504,300
GLM-5.18802,1504,300
Kimi K3110250490
Kimi K2.7 Code1,3503,3806,750
Kimi K2.61,1502,8805,750
LongCat-2.011,40028,60057,200
MiMo-V2.530,10075,200150,400
MiMo-V2.5-Pro3,2508,15016,300
MiniMax M33,2008,00016,000
MiniMax M2.73,4008,50017,000
Muse Spark 1.3 Contributor45,300113,300226,600
Muse Spark 1.2 Contributor45,300113,300226,600
Qwen3.8 Max160400810
Qwen3.8 Flash5,40013,50027,000
Qwen3.7 Max170420840
Qwen3.7 Plus4,30010,80021,600
Qwen3.6 Plus3,3008,20016,300
DeepSeek V4.1 Flash6,50016,25032,500
DeepSeek V4 Pro1,0502,6005,200
DeepSeek V4 Flash13,00032,50065,000
DeepSeek V4 Flash Vision Exp6,50016,25032,500
Hy4 preview1,3503,3806,770
Hy34,30010,75021,500
Grok 4.6169423845
GPT 5.6 Luna2,0505,10010,250

Die Schätzungen verwenden die folgenden Token-Anzahlen pro Anfrage; die tatsächliche Nutzung variiert.

  • Grok 4.6 — 390 Input-, 32.500 Cached-, 120 Output-Tokens pro Anfrage
  • GLM-5.3-Flash — 1.000 Input-, 55.000 Cached-, 200 Output-Tokens pro Anfrage
  • GLM-5.3/5.2/5.1 — 700 Input-, 52.000 Cached-, 150 Output-Tokens pro Anfrage
  • GPT 5.6 Luna — 1.000 Input-, 50.000 Cached-, 220 Output-Tokens pro Anfrage
  • Kimi K3 — 1.050 Input-, 76.500 Cached-, 300 Output-Tokens pro Anfrage
  • Kimi K2.7/K2.6 — 870 Input-, 55.000 Cached-, 200 Output-Tokens pro Anfrage
  • LongCat-2.0 — 920 Input-, 88.900 Cached-, 200 Output-Tokens pro Anfrage
  • DeepSeek V4.1 Flash — 410 Input-, 71.300 Cached-, 310 Output-Tokens pro Anfrage
  • DeepSeek V4 Pro — 750 Input-, 82.000 Cached-, 290 Output-Tokens pro Anfrage
  • DeepSeek V4 Flash — 410 Input-, 71.300 Cached-, 310 Output-Tokens pro Anfrage
  • DeepSeek V4 Flash Vision Exp — 410 Input-, 71.300 Cached-, 310 Output-Tokens pro Anfrage
  • MiniMax M3 — 510 Input-, 56.000 Cached-, 190 Output-Tokens pro Anfrage
  • MiniMax M2.7 — 300 Input-, 55.000 Cached-, 125 Output-Tokens pro Anfrage
  • Muse Spark 1.3 Contributor — 620 Input-, 71.400 Cached-, 300 Output-Tokens pro Anfrage
  • Muse Spark 1.2 Contributor — 620 Input-, 71.400 Cached-, 300 Output-Tokens pro Anfrage
  • Qwen3.8 Max — 420 Input-, 66.000 Cached-, 200 Output-Tokens pro Anfrage
  • Qwen3.8 Flash — 600 Input-, 58.000 Cached-, 200 Output-Tokens pro Anfrage
  • Qwen3.7 Max — 420 Input-, 66.000 Cached-, 200 Output-Tokens pro Anfrage
  • Qwen3.7 Plus — 500 Input-, 57.000 Cached-, 190 Output-Tokens pro Anfrage
  • Qwen3.6 Plus — 500 Input-, 57.000 Cached-, 190 Output-Tokens pro Anfrage
  • Hy4 preview — 830 Input-, 71.500 Cached-, 295 Output-Tokens pro Anfrage
  • Hy3 — 830 Input-, 71.500 Cached-, 295 Output-Tokens pro Anfrage
  • MiMo-V2.5 — 830 Input-, 71.500 Cached-, 295 Output-Tokens pro Anfrage
  • MiMo-V2.5-Pro — 790 Input-, 86.000 Cached-, 305 Output-Tokens pro Anfrage

Du kannst deine aktuelle Nutzung in der Console verfolgen.

Die Nutzungslimits können sich ändern, während wir aus der frühen Nutzung und dem Feedback lernen.


Nutzung über die Limits hinaus

Wenn du auch Guthaben auf deinem Zen-Konto hast, kannst du in der Console die Option Use balance aktivieren. Wenn diese aktiviert ist, greift Go auf dein Zen-Guthaben zurück, nachdem du deine Nutzungslimits erreicht hast, anstatt Anfragen zu blockieren.


Warum einige Modelle weniger Nutzung bieten

Mit Go zahlst du $10/Monat, und die enthaltene monatliche Nutzung variiert je nach Modell.

Bei den meisten Modellen ermöglichen wir dies durch Mengenrabatte und reservierte GPU-Kapazität. Diese Ersparnisse geben wir dann in Form von zusätzlicher monatlicher Nutzung an dich weiter.

Bei einigen Modellen hatten wir bisher keine Gelegenheit, einen Rabatt auszuhandeln oder sie kostengünstiger zu hosten, entweder weil das jeweilige Modell neu oder sein öffentlicher Preis bereits rabattiert ist.

Bei diesen Modellen erhältst du immer noch etwas mehr, als wenn du die Modellanbieter direkt bezahlen würdest. Deshalb ist ihre enthaltene monatliche Nutzung geringer.


Endpunkte

Du kannst auf die Go-Modelle auch über die folgenden API-Endpunkte zugreifen.

ModellModell-IDEndpunktAI SDK Package
Grok 4.6grok-4.6https://opencode.ai/zen/go/v1/responses@ai-sdk/openai
GPT 5.6 Lunagpt-5.6-lunahttps://opencode.ai/zen/go/v1/responses@ai-sdk/openai
GLM-5.3-Flashglm-5.3-flashhttps://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
GLM-5.3glm-5.3https://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
GLM-5.2glm-5.2https://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
GLM-5.1glm-5.1https://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
Kimi K3kimi-k3https://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
Kimi K2.7 Codekimi-k2.7-codehttps://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
Kimi K2.6kimi-k2.6https://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
LongCat-2.0longcat-2.0https://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
DeepSeek V4.1 Flashdeepseek-v4.1-flashhttps://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
DeepSeek V4 Prodeepseek-v4-prohttps://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
DeepSeek V4 Flashdeepseek-v4-flashhttps://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
DeepSeek V4 Flash Vision Expdeepseek-v4-flash-vision-exphttps://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
MiMo-V2.5mimo-v2.5https://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
MiMo-V2.5-Promimo-v2.5-prohttps://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
MiniMax M3minimax-m3https://opencode.ai/zen/go/v1/messages@ai-sdk/anthropic
MiniMax M2.7minimax-m2.7https://opencode.ai/zen/go/v1/messages@ai-sdk/anthropic
MiniMax M2.5minimax-m2.5https://opencode.ai/zen/go/v1/messages@ai-sdk/anthropic
Muse Spark 1.3 Contributormuse-spark-1.3-contributorhttps://opencode.ai/zen/go/v1/responses@ai-sdk/openai
Muse Spark 1.2 Contributormuse-spark-1.2-contributorhttps://opencode.ai/zen/go/v1/responses@ai-sdk/openai
Qwen3.8 Maxqwen3.8-maxhttps://opencode.ai/zen/go/v1/messages@ai-sdk/anthropic
Qwen3.8 Flashqwen3.8-flashhttps://opencode.ai/zen/go/v1/messages@ai-sdk/anthropic
Qwen3.7 Maxqwen3.7-maxhttps://opencode.ai/zen/go/v1/messages@ai-sdk/anthropic
Qwen3.7 Plusqwen3.7-plushttps://opencode.ai/zen/go/v1/messages@ai-sdk/anthropic
Qwen3.6 Plusqwen3.6-plushttps://opencode.ai/zen/go/v1/messages@ai-sdk/anthropic
Hy4 previewhy4-previewhttps://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
Hy3hy3https://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible

Die Modell-ID in deiner OpenCode Config verwendet das Format opencode-go/<model-id>. Für Kimi K3 würdest du beispielsweise opencode-go/kimi-k3 in deiner Config verwenden.


Models

Du kannst die vollständige Liste der verfügbaren Modelle und ihrer Metadaten hier abrufen:

https://opencode.ai/zen/go/v1/models

Datenschutz

ModellModelltrainingDatenaufbewahrung
Grok 4.6Nicht verwendet30 Tage
GPT 5.6 LunaNicht verwendet30 Tage
GLM-5.3-FlashNicht verwendet0 Tage
GLM-5.3Nicht verwendet0 Tage
GLM-5.2Nicht verwendet0 Tage
GLM-5.1Nicht verwendet0 Tage
Kimi K3Nicht verwendet0 Tage
Kimi K2.7 CodeNicht verwendet0 Tage
Kimi K2.6Nicht verwendet0 Tage
LongCat-2.0Nicht verwendet0 Tage
MiMo-V2.5-ProNicht verwendet0 Tage
MiMo-V2.5Nicht verwendet0 Tage
Qwen3.8 MaxNicht verwendet0 Tage
Qwen3.8 FlashNicht verwendet0 Tage
Qwen3.7 MaxNicht verwendet0 Tage
Qwen3.7 PlusNicht verwendet0 Tage
Qwen3.6 PlusNicht verwendet0 Tage
MiniMax M3Nicht verwendet0 Tage
MiniMax M2.7Nicht verwendet0 Tage
Muse Spark 1.3 ContributorJaKein ZDR
Muse Spark 1.2 ContributorJaKein ZDR
DeepSeek V4.1 FlashNicht verwendet0 Tage
DeepSeek V4 ProNicht verwendet0 Tage
DeepSeek V4 FlashNicht verwendet0 Tage
DeepSeek V4 Flash Vision ExpNicht verwendet0 Tage
Hy4 previewNicht verwendet0 Tage
Hy3Nicht verwendet0 Tage
  • Grok 4.6: ZDR deaktiviert wichtige API-Funktionen, die von gespeicherten Daten abhängen, einschließlich der zustandsbehafteten Responses API, Files and Collections und der Batch API. Mehr erfahren.
  • GPT 5.6 Luna: Für die Nutzung aller API-Funktionen werden Protokolle zur Missbrauchsüberwachung erstellt und bis zu 30 Tage lang aufbewahrt. Mehr erfahren.
  • Muse Spark 1.3 Contributor: Stark vergünstigte Tokenpreise im Gegenzug für die Erlaubnis, deine Prompts und Vervollständigungen zum Trainieren zukünftiger Meta-Modelle zu verwenden. Die Verfügbarkeit ist auf Regionen beschränkt, die gemäß der Richtlinie zur geografischen Nutzung von Meta zulässig sind. Mehr erfahren.
  • Muse Spark 1.2 Contributor: Stark vergünstigte Tokenpreise im Gegenzug für die Erlaubnis, deine Prompts und Vervollständigungen zum Trainieren zukünftiger Meta-Modelle zu verwenden. Die Verfügbarkeit ist auf Regionen beschränkt, die gemäß der Richtlinie zur geografischen Nutzung von Meta zulässig sind. Mehr erfahren.
  • DeepSeek: Die ZDR-Vereinbarung wird monatlich erneuert. Die aktuelle Vereinbarung gilt bis einschließlich 30. September 2026.

Ziele

Wir haben OpenCode Go entwickelt, um:

  1. AI Coding durch ein kostengünstiges Abonnement für mehr Menschen zugänglich zu machen.
  2. Zuverlässigen Zugriff auf die besten offenen Coding-Modelle zu bieten.
  3. Modelle zu kuratieren, die für den Einsatz als Coding Agent getestet und einem Benchmark unterzogen wurden.
  4. Keinen Lock-in-Effekt zu haben, indem wir dir ermöglichen, auch jeden anderen Provider mit OpenCode zu nutzen.