Pular para o conteúdo

Go

Assinatura de baixo custo para modelos abertos de programação.

O OpenCode Go é uma assinatura de baixo custo de US$ 10/mês que oferece acesso confiável a modelos abertos de programação populares.

O Go funciona como qualquer outro provedor no OpenCode. Você assina o OpenCode Go e obtém a sua chave de API. Ele é totalmente opcional e você não precisa usá-lo para usar o OpenCode.

Ele foi projetado principalmente para usuários internacionais e oferece acesso global estável.


Contexto

Os modelos abertos ficaram muito bons. Eles agora alcançam um desempenho próximo aos modelos proprietários para tarefas de programação. E como muitos provedores podem servi-los de forma competitiva, eles geralmente são muito mais baratos.

No entanto, obter um acesso confiável e de baixa latência a eles pode ser difícil. Os provedores variam em qualidade e disponibilidade.

Para resolver isso, fizemos algumas coisas:

  1. Testamos um grupo selecionado de modelos abertos e conversamos com suas equipes sobre a melhor forma de executá-los.
  2. Em seguida, trabalhamos com alguns provedores para garantir que eles estivessem sendo servidos corretamente.
  3. Por fim, avaliamos por benchmark a combinação de modelo/provedor e elaboramos uma lista que nos sentimos confortáveis em recomendar.

O OpenCode Go lhe dá acesso a esses modelos por US$ 10/mês.


Como funciona

O OpenCode Go funciona como qualquer outro provedor no OpenCode.

  1. Você entra no OpenCode Zen, assina o Go e copia a sua chave de API.
  2. Você executa o comando /connect na TUI, seleciona OpenCode Go e cola a sua chave de API.
  3. Execute /models na TUI para ver a lista de modelos disponíveis através do Go.

A lista atual de modelos inclui:

  • Grok 4.6
  • GLM-5.3-Flash
  • GLM-5.3
  • GLM-5.2
  • GLM-5.1
  • GPT 5.6 Luna
  • Kimi K3
  • Kimi K2.7 Code
  • Kimi K2.6
  • LongCat-2.0
  • MiMo-V2.5
  • MiMo-V2.5-Pro
  • MiniMax M3
  • MiniMax M2.7
  • Muse Spark 1.3 Contributor (regiões limitadas)
  • Muse Spark 1.2 Contributor (regiões limitadas)
  • Qwen3.8 Max
  • Qwen3.8 Flash
  • Qwen3.7 Max
  • Qwen3.7 Plus
  • Qwen3.6 Plus
  • DeepSeek V4.1 Flash
  • DeepSeek V4 Pro
  • DeepSeek V4 Flash
  • DeepSeek V4 Flash Vision Exp
  • Hy4 preview
  • Hy3

A lista de modelos pode mudar conforme testamos e adicionamos novos.


Onde posso usá-lo?

O OpenCode Go foi projetado para o OpenCode e outros agentes de programação que produzem tipos semelhantes de requisições. O tráfego é monitorado para detectar abusos que prejudiquem a experiência de outros usuários.

Seu cliente deve:

  1. Enviar o tráfego típico de um agente de programação
  2. Identificar-se com seu próprio user agent, como my-coding-agent/1.0, em vez do nome genérico de um SDK ou de uma biblioteca HTTP.
  3. Enviar um ID de sessão estável em x-opencode-session para cada conversa, para que possamos otimizar o roteamento e o cache de prompts.

Clientes validados

Além do OpenCode, os clientes a seguir foram validados para funcionar corretamente com o OpenCode Go. No entanto, não garantimos que continuarão funcionando no futuro.

ClienteSuporte a sessões
HermesAs builds que contêm o PR #101864 enviam o header nas requisições principais e auxiliares do OpenCode. A correção foi incorporada após a v0.21.0; essa versão por si só não a inclui.
Claude CodeO Go reconhece seu header de sessão nativo. Não é necessário usar um wrapper para headers personalizados.
CodexO Go reconhece seu header de sessão nativo. Algumas versões e configurações de proxy ainda o omitem; preserve o header de sessão ao encaminhar requisições.
ZCodeO Go reconhece seu header de sessão nativo. Nossa solicitação de x-opencode-session continua aberta, mas não é mais necessário enviar especificamente esse header.
PiAs builds atuais enviam informações de sessão para o OpenCode. Atualize instalações mais antigas.
jcodeAtualize para a versão v0.81.6 ou posterior, que inclui a correção do header de sessão.
Kilo Code CLIAs builds que contêm o PR #13752 restauram os headers de sessão do OpenCode. Essa correção abrange a CLI, não a extensão do VS Code. Consulte a issue #13723.

Clientes com problemas conhecidos

Esses clientes não têm suporte a sessões ou apresentam suporte incompleto nas versões que investigamos. Os relatórios vinculados acompanham correções e soluções alternativas.

ClienteStatus e acompanhamento
DeepSeek HarnessAs informações de sessão chegam por alguns caminhos de modelos, mas não por outros. Reconhecemos seu header nativo; ainda é necessário enviá-lo por todos os adaptadores. Discussão #5495.
GitHub Copilot ChatO suporte automático ao header de sessão foi solicitado na issue #334186 do VS Code.
Kimi CodeO suporte automático ao header de sessão foi solicitado na issue #3506.
MiMo CodeA issue #2317 tem uma correção proposta no PR #2327, que ainda não foi incorporada.

Limites de uso

Os limites de uso são definidos como valores mensais em dólares. A tabela abaixo mostra o limite mensal e os custos de tokens de cada modelo.

Cada modelo tem os seguintes limites de uso: 5 horas — 20% do limite mensal; semanal — 50%; e mensal — 100%.

Por exemplo, se um modelo tiver um limite mensal de $60, você poderá gastar até:

  • Limite de 5 horas — $12 de uso
  • Limite semanal — $30 de uso
  • Limite mensal — $60 de uso

Os preços de tokens são indicados por 1M tokens.

ModeloEntradaSaídaLeitura em cacheEscrita em cacheLimite mensal
GLM-5.3-Flash$0.15$0.50$0.03-$60
GLM-5.3$1.40$4.40$0.26-$15
GLM-5.2$1.40$4.40$0.26-$60
GLM-5.1$1.40$4.40$0.26-$60
Kimi K3$3.00$15.00$0.30-$15
Kimi K2.7 Code$0.95$4.00$0.19-$60
Kimi K2.6$0.95$4.00$0.16-$60
LongCat-2.0$0.30$1.20$0.006-$60
MiMo V2.5$0.14$0.28$0.0028-$60
MiMo V2.5 Pro$0.435$0.87$0.003625-$15
MiniMax M3$0.30$1.20$0.06-$60
MiniMax M2.7$0.30$1.20$0.06$0.375$60
MiniMax M2.5$0.30$1.20$0.06$0.375$60
Muse Spark 1.3 Contributor$0.10$0.20$0.002-$60
Muse Spark 1.2 Contributor$0.10$0.20$0.002-$60
Qwen3.8 Max$2.00$6.00$0.25$2.50$15
Qwen3.8 Flash$0.15$0.47$0.016$0.20$30
Qwen3.7 Max$2.50$7.50$0.50$3.125$30
Qwen3.7 Plus (≤ 256K tokens)$0.40$1.60$0.04$0.50$60
Qwen3.7 Plus (> 256K tokens)$1.20$4.80$0.12$1.50$60
Qwen3.6 Plus (≤ 256K tokens)$0.50$3.00$0.05$0.625$60
Qwen3.6 Plus (> 256K tokens)$2.00$6.00$0.20$2.50$60
DeepSeek V4.1 Flash (Off-Peak)$0.15$0.60$0.003-$15
DeepSeek V4.1 Flash (Peak)$0.30$1.20$0.006-$15
DeepSeek V4 Pro (Off-Peak)$0.66$1.98$0.022-$15
DeepSeek V4 Pro (Peak)$1.32$3.96$0.044-$15
DeepSeek V4 Flash (Off-Peak)$0.15$0.60$0.003-$30
DeepSeek V4 Flash (Peak)$0.30$1.20$0.006-$30
DeepSeek V4 Flash Vision Exp (Off-Peak)$0.15$0.60$0.003-$15
DeepSeek V4 Flash Vision Exp (Peak)$0.30$1.20$0.006-$15
Hy4 preview$0.834$2.501$0.042-$30
Hy3$0.14$0.58$0.035-$60
Grok 4.6 (≤ 200K tokens)$2.00$6.00$0.50-$15
Grok 4.6 (> 200K tokens)$4.00$12.00$1.00-$15
GPT 5.6 Luna (≤ 272K tokens)$0.20$1.20$0.02$0.25$15
GPT 5.6 Luna (> 272K tokens)$0.40$1.80$0.04$0.50$15

DeepSeek V4.1 Flash / V4 Pro / V4 Flash / V4 Flash Vision Exp: Os horários Peak são 01:00-04:00 e 06:00-10:00 UTC, de segunda a sexta-feira; todos os demais horários, incluindo os fins de semana, são Off-Peak. Saiba mais.

DeepSeek V4 Flash Vision Exp: As imagens são convertidas em tokens com base em suas dimensões e cobradas como tokens de entrada junto com os tokens de texto. Saiba mais.

Requisições estimadas

A tabela abaixo apresenta uma quantidade estimada de requisições com base nos padrões típicos de uso do Go:

Modelrequisições por 5 horasrequisições por semanarequisições por mês
GLM-5.3-Flash6,32015,79031,580
GLM-5.32205401,080
GLM-5.28802,1504,300
GLM-5.18802,1504,300
Kimi K3110250490
Kimi K2.7 Code1,3503,3806,750
Kimi K2.61,1502,8805,750
LongCat-2.011,40028,60057,200
MiMo-V2.530,10075,200150,400
MiMo-V2.5-Pro3,2508,15016,300
MiniMax M33,2008,00016,000
MiniMax M2.73,4008,50017,000
Muse Spark 1.3 Contributor45,300113,300226,600
Muse Spark 1.2 Contributor45,300113,300226,600
Qwen3.8 Max160400810
Qwen3.8 Flash5,40013,50027,000
Qwen3.7 Max170420840
Qwen3.7 Plus4,30010,80021,600
Qwen3.6 Plus3,3008,20016,300
DeepSeek V4.1 Flash6,50016,25032,500
DeepSeek V4 Pro1,0502,6005,200
DeepSeek V4 Flash13,00032,50065,000
DeepSeek V4 Flash Vision Exp6,50016,25032,500
Hy4 preview1,3503,3806,770
Hy34,30010,75021,500
Grok 4.6169423845
GPT 5.6 Luna2,0505,10010,250

As estimativas usam as seguintes quantidades de tokens por requisição; o uso real varia.

  • Grok 4.6 — 390 tokens de entrada, 32.500 em cache, 120 tokens de saída por requisição
  • GLM-5.3-Flash — 1.000 tokens de entrada, 55.000 em cache, 200 tokens de saída por requisição
  • GLM-5.3/5.2/5.1 — 700 tokens de entrada, 52.000 em cache, 150 tokens de saída por requisição
  • GPT 5.6 Luna — 1.000 tokens de entrada, 50.000 em cache, 220 tokens de saída por requisição
  • Kimi K3 — 1.050 tokens de entrada, 76.500 em cache, 300 tokens de saída por requisição
  • Kimi K2.7/K2.6 — 870 tokens de entrada, 55.000 em cache, 200 tokens de saída por requisição
  • LongCat-2.0 — 920 tokens de entrada, 88.900 em cache, 200 tokens de saída por requisição
  • DeepSeek V4.1 Flash — 410 tokens de entrada, 71.300 em cache, 310 tokens de saída por requisição
  • DeepSeek V4 Pro — 750 tokens de entrada, 82.000 em cache, 290 tokens de saída por requisição
  • DeepSeek V4 Flash — 410 tokens de entrada, 71.300 em cache, 310 tokens de saída por requisição
  • DeepSeek V4 Flash Vision Exp — 410 tokens de entrada, 71.300 em cache, 310 tokens de saída por requisição
  • MiniMax M3 — 510 tokens de entrada, 56.000 em cache, 190 tokens de saída por requisição
  • MiniMax M2.7 — 300 tokens de entrada, 55.000 em cache, 125 tokens de saída por requisição
  • Muse Spark 1.3 Contributor — 620 tokens de entrada, 71.400 em cache, 300 tokens de saída por requisição
  • Muse Spark 1.2 Contributor — 620 tokens de entrada, 71.400 em cache, 300 tokens de saída por requisição
  • Qwen3.8 Max — 420 tokens de entrada, 66.000 em cache, 200 tokens de saída por requisição
  • Qwen3.8 Flash — 600 tokens de entrada, 58.000 em cache, 200 tokens de saída por requisição
  • Qwen3.7 Max — 420 tokens de entrada, 66.000 em cache, 200 tokens de saída por requisição
  • Qwen3.7 Plus — 500 tokens de entrada, 57.000 em cache, 190 tokens de saída por requisição
  • Qwen3.6 Plus — 500 tokens de entrada, 57.000 em cache, 190 tokens de saída por requisição
  • Hy4 preview — 830 tokens de entrada, 71.500 em cache, 295 tokens de saída por requisição
  • Hy3 — 830 tokens de entrada, 71.500 em cache, 295 tokens de saída por requisição
  • MiMo-V2.5 — 830 tokens de entrada, 71.500 em cache, 295 tokens de saída por requisição
  • MiMo-V2.5-Pro — 790 tokens de entrada, 86.000 em cache, 305 tokens de saída por requisição

Você pode acompanhar o seu uso atual no console.

Os limites de uso podem mudar à medida que aprendemos com o uso inicial e o feedback.


Uso além dos limites

Se você também tiver créditos no seu saldo do Zen, pode habilitar a opção Use balance no console. Quando habilitada, o Go usará o seu saldo do Zen como alternativa após você atingir os seus limites de uso em vez de bloquear as requisições.


Por que alguns modelos têm um uso menor

Com o Go, você paga $10/mês, e o uso mensal incluído varia conforme o modelo.

Para a maioria dos modelos, conseguimos fazer isso por meio de descontos por volume e capacidade reservada de GPU. Repassamos essa economia a você na forma de um uso mensal maior.

Para alguns modelos, ainda não tivemos a oportunidade de negociar um desconto ou hospedá-los a um custo menor, seja porque o modelo é novo ou porque o preço público já tem desconto.

Para esses modelos, você ainda recebe um pouco mais do que receberia se pagasse diretamente aos provedores dos modelos; por isso, o uso mensal incluído com eles é menor.


Endpoints

Você também pode acessar os modelos do Go através dos seguintes endpoints de API.

ModeloID do ModeloEndpointPacote do AI SDK
Grok 4.6grok-4.6https://opencode.ai/zen/go/v1/responses@ai-sdk/openai
GPT 5.6 Lunagpt-5.6-lunahttps://opencode.ai/zen/go/v1/responses@ai-sdk/openai
GLM-5.3-Flashglm-5.3-flashhttps://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
GLM-5.3glm-5.3https://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
GLM-5.2glm-5.2https://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
GLM-5.1glm-5.1https://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
Kimi K3kimi-k3https://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
Kimi K2.7 Codekimi-k2.7-codehttps://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
Kimi K2.6kimi-k2.6https://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
LongCat-2.0longcat-2.0https://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
DeepSeek V4.1 Flashdeepseek-v4.1-flashhttps://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
DeepSeek V4 Prodeepseek-v4-prohttps://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
DeepSeek V4 Flashdeepseek-v4-flashhttps://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
DeepSeek V4 Flash Vision Expdeepseek-v4-flash-vision-exphttps://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
MiMo-V2.5mimo-v2.5https://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
MiMo-V2.5-Promimo-v2.5-prohttps://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
MiniMax M3minimax-m3https://opencode.ai/zen/go/v1/messages@ai-sdk/anthropic
MiniMax M2.7minimax-m2.7https://opencode.ai/zen/go/v1/messages@ai-sdk/anthropic
MiniMax M2.5minimax-m2.5https://opencode.ai/zen/go/v1/messages@ai-sdk/anthropic
Muse Spark 1.3 Contributormuse-spark-1.3-contributorhttps://opencode.ai/zen/go/v1/responses@ai-sdk/openai
Muse Spark 1.2 Contributormuse-spark-1.2-contributorhttps://opencode.ai/zen/go/v1/responses@ai-sdk/openai
Qwen3.8 Maxqwen3.8-maxhttps://opencode.ai/zen/go/v1/messages@ai-sdk/anthropic
Qwen3.8 Flashqwen3.8-flashhttps://opencode.ai/zen/go/v1/messages@ai-sdk/anthropic
Qwen3.7 Maxqwen3.7-maxhttps://opencode.ai/zen/go/v1/messages@ai-sdk/anthropic
Qwen3.7 Plusqwen3.7-plushttps://opencode.ai/zen/go/v1/messages@ai-sdk/anthropic
Qwen3.6 Plusqwen3.6-plushttps://opencode.ai/zen/go/v1/messages@ai-sdk/anthropic
Hy4 previewhy4-previewhttps://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
Hy3hy3https://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible

O ID do modelo na sua configuração do OpenCode usa o formato opencode-go/<model-id>. Por exemplo, para o Kimi K3, você usaria opencode-go/kimi-k3 na sua configuração.


Modelos

Você pode buscar a lista completa de modelos disponíveis e seus metadados em:

https://opencode.ai/zen/go/v1/models

Privacidade

ModeloTreinamento de modelosRetenção de dados
Grok 4.6Não usado30 dias
GPT 5.6 LunaNão usado30 dias
GLM-5.3-FlashNão usado0 dias
GLM-5.3Não usado0 dias
GLM-5.2Não usado0 dias
GLM-5.1Não usado0 dias
Kimi K3Não usado0 dias
Kimi K2.7 CodeNão usado0 dias
Kimi K2.6Não usado0 dias
LongCat-2.0Não usado0 dias
MiMo-V2.5-ProNão usado0 dias
MiMo-V2.5Não usado0 dias
Qwen3.8 MaxNão usado0 dias
Qwen3.8 FlashNão usado0 dias
Qwen3.7 MaxNão usado0 dias
Qwen3.7 PlusNão usado0 dias
Qwen3.6 PlusNão usado0 dias
MiniMax M3Não usado0 dias
MiniMax M2.7Não usado0 dias
Muse Spark 1.3 ContributorSimNão é ZDR
Muse Spark 1.2 ContributorSimNão é ZDR
DeepSeek V4.1 FlashNão usado0 dias
DeepSeek V4 ProNão usado0 dias
DeepSeek V4 FlashNão usado0 dias
DeepSeek V4 Flash Vision ExpNão usado0 dias
Hy4 previewNão usado0 dias
Hy3Não usado0 dias
  • Grok 4.6: O ZDR desativa recursos importantes da API que dependem de dados armazenados, incluindo a Responses API com estado, Files and Collections e a Batch API. Saiba mais.
  • GPT 5.6 Luna: Logs de monitoramento de abuso são gerados para todo uso de recursos da API e retidos por até 30 dias. Saiba mais.
  • Muse Spark 1.3 Contributor: Preços de tokens com grandes descontos em troca da permissão para usar seus prompts e respostas geradas para treinar futuros modelos da Meta. A disponibilidade é limitada às regiões permitidas pela Política de Uso Geográfico da Meta. Saiba mais.
  • Muse Spark 1.2 Contributor: Preços de tokens com grandes descontos em troca da permissão para usar seus prompts e respostas geradas para treinar futuros modelos da Meta. A disponibilidade é limitada às regiões permitidas pela Política de Uso Geográfico da Meta. Saiba mais.
  • DeepSeek: O acordo de ZDR é renovado mensalmente. O acordo atual é válido até 30 de setembro de 2026.

Objetivos

Criamos o OpenCode Go para:

  1. Tornar a programação com IA acessível a mais pessoas com uma assinatura de baixo custo.
  2. Fornecer acesso confiável aos melhores modelos abertos de programação.
  3. Ter modelos sob curadoria que são testados e avaliados (benchmarked) para o uso por agentes de programação.
  4. Não ter nenhuma restrição de fornecedor (lock-in), permitindo que você use qualquer outro provedor com o OpenCode também.