콘텐츠로 이동

Go

오픈 코딩 모델을 위한 저비용 구독 서비스입니다.

OpenCode Go는 인기 있는 오픈 코딩 모델에 안정적으로 액세스할 수 있게 해주는 월 $10의 저비용 구독 서비스입니다.

Go는 OpenCode의 다른 제공자와 똑같이 작동합니다. OpenCode Go를 구독하고 API 키를 발급받으면 됩니다. 이는 완전히 선택 사항이며, OpenCode를 사용하기 위해 꼭 필요하지는 않습니다.

주로 해외 사용자를 위해 설계되었으며, 전 세계에서 안정적으로 이용할 수 있습니다.


배경

오픈 모델은 정말 많이 발전했습니다. 이제는 코딩 작업에서 독점 모델에 가까운 성능을 보여줍니다. 그리고 많은 제공자가 경쟁력 있게 서비스를 제공할 수 있기 때문에, 보통 훨씬 더 저렴합니다.

하지만 이런 모델에 안정적이고 낮은 지연 시간으로 액세스하는 일은 쉽지 않을 수 있습니다. 제공자마다 품질과 가용성이 다르기 때문입니다.

이를 해결하기 위해, 저희는 몇 가지를 진행했습니다.

  1. 선별된 오픈 모델 그룹을 테스트하고, 각 팀과 가장 잘 운영하는 방법에 대해 논의했습니다.
  2. 그런 다음 몇몇 제공자와 협력해, 이 모델들이 올바르게 서비스되도록 했습니다.
  3. 마지막으로 모델/제공자 조합을 벤치마킹해, 자신 있게 추천할 수 있는 목록을 만들었습니다.

OpenCode Go를 사용하면 월 $10으로 이러한 모델에 액세스할 수 있습니다.


작동 방식

OpenCode Go는 OpenCode의 다른 제공자와 똑같이 작동합니다.

  1. **OpenCode Zen**에 로그인해 Go를 구독하고 API 키를 복사합니다.
  2. TUI에서 /connect 명령을 실행하고 OpenCode Go를 선택한 다음 API 키를 붙여넣습니다.
  3. TUI에서 /models를 실행해 Go를 통해 사용할 수 있는 모델 목록을 확인합니다.

현재 모델 목록에는 다음이 포함됩니다.

  • Grok 4.6
  • GLM-5.3-Flash
  • GLM-5.3
  • GLM-5.2
  • GLM-5.1
  • GPT 5.6 Luna
  • Kimi K3
  • Kimi K2.7 Code
  • Kimi K2.6
  • LongCat-2.0
  • MiMo-V2.5
  • MiMo-V2.5-Pro
  • MiniMax M3
  • MiniMax M2.7
  • Muse Spark 1.3 Contributor (일부 지역에서만 제공)
  • Muse Spark 1.2 Contributor (일부 지역에서만 제공)
  • Qwen3.8 Max
  • Qwen3.8 Flash
  • Qwen3.7 Max
  • Qwen3.7 Plus
  • Qwen3.6 Plus
  • DeepSeek V4.1 Flash
  • DeepSeek V4 Pro
  • DeepSeek V4 Flash
  • DeepSeek V4 Flash Vision Exp
  • Hy4 preview
  • Hy3

새로운 모델을 테스트하고 추가함에 따라 이 목록은 변경될 수 있습니다.


어디에서 사용할 수 있나요?

OpenCode Go는 OpenCode 및 유사한 유형의 요청을 생성하는 다른 코딩 에이전트용으로 설계되었습니다. 다른 사용자의 이용 경험을 저해하는 악용이 있는지 트래픽을 모니터링합니다.

클라이언트는 다음 요건을 충족해야 합니다.

  1. 일반적인 코딩 에이전트 트래픽을 전송합니다.
  2. 일반적인 SDK 또는 HTTP 라이브러리 이름이 아닌 my-coding-agent/1.0과 같은 자체 user agent로 식별합니다.
  3. 라우팅과 프롬프트 캐싱을 최적화할 수 있도록 각 대화에서 안정적인 세션 ID를 x-opencode-session으로 전송합니다.

검증된 클라이언트

OpenCode 외에도 다음 클라이언트가 OpenCode Go에서 올바르게 작동하는 것으로 검증되었습니다. 다만 앞으로도 계속 작동할 것이라고 보장하지는 않습니다.

클라이언트세션 지원
HermesPR #101864가 포함된 빌드는 OpenCode의 기본 요청과 보조 요청 모두에서 헤더를 전송합니다. 이 수정은 v0.21.0 이후에 병합되었으므로 v0.21.0 릴리스 자체에는 포함되지 않습니다.
Claude CodeGo는 Claude Code의 고유 세션 헤더를 인식합니다. 사용자 지정 헤더 래퍼가 필요하지 않습니다.
CodexGo는 Codex의 고유 세션 헤더를 인식합니다. 일부 버전과 프록시 설정에서는 여전히 이 헤더가 누락되므로 요청을 전달할 때 세션 헤더를 유지하세요.
ZCodeGo는 ZCode의 고유 세션 헤더를 인식합니다. x-opencode-session 요청은 아직 열려 있지만 이제 해당 헤더를 별도로 전송할 필요는 없습니다.
Pi현재 빌드는 OpenCode에 세션 정보를 전송합니다. 이전 설치 버전은 업데이트하세요.
jcode세션 헤더 수정이 포함된 v0.81.6 이상으로 업데이트하세요.
Kilo Code CLIPR #13752가 포함된 빌드는 OpenCode 세션 헤더를 복원합니다. 이 수정은 CLI에만 적용되며 VS Code 확장에는 적용되지 않습니다. issue #13723을 참조하세요.

알려진 문제가 있는 클라이언트

조사한 버전에서 다음 클라이언트는 세션 지원이 없거나 불완전했습니다. 링크된 보고서에서 수정 사항과 해결 방법을 추적합니다.

클라이언트상태 및 추적
DeepSeek Harness일부 모델 경로에서는 세션 정보가 전달되지만 다른 경로에서는 누락됩니다. Go는 DeepSeek Harness의 고유 헤더를 인식하며, 남은 작업은 모든 어댑터에서 이 헤더를 전송하는 것입니다. Discussion #5495.
GitHub Copilot Chat자동 세션 헤더 지원은 VS Code issue #334186에서 요청되었습니다.
Kimi Code자동 세션 헤더 지원은 issue #3506에서 요청되었습니다.
MiMo CodeIssue #2317PR #2327로 수정안이 제안되었지만 아직 병합되지 않았습니다.

사용 한도

사용 한도는 월간 달러 금액으로 정의됩니다. 아래 표는 각 모델의 월간 한도와 토큰 비용을 보여줍니다.

각 모델의 사용 한도는 5시간 한도는 월간 한도의 20%, 주간 한도는 50%, 월간 한도는 100%입니다.

예를 들어 월간 한도가 $60인 모델은 다음 금액까지 사용할 수 있습니다.

  • 5시간 한도 — $12 사용
  • 주간 한도 — $30 사용
  • 월간 한도 — $60 사용

토큰 가격은 1M tokens 기준입니다.

ModelInputOutputCached ReadCached Write월간 한도
GLM-5.3-Flash$0.15$0.50$0.03-$60
GLM-5.3$1.40$4.40$0.26-$15
GLM-5.2$1.40$4.40$0.26-$60
GLM-5.1$1.40$4.40$0.26-$60
Kimi K3$3.00$15.00$0.30-$15
Kimi K2.7 Code$0.95$4.00$0.19-$60
Kimi K2.6$0.95$4.00$0.16-$60
LongCat-2.0$0.30$1.20$0.006-$60
MiMo V2.5$0.14$0.28$0.0028-$60
MiMo V2.5 Pro$0.435$0.87$0.003625-$15
MiniMax M3$0.30$1.20$0.06-$60
MiniMax M2.7$0.30$1.20$0.06$0.375$60
MiniMax M2.5$0.30$1.20$0.06$0.375$60
Muse Spark 1.3 Contributor$0.10$0.20$0.002-$60
Muse Spark 1.2 Contributor$0.10$0.20$0.002-$60
Qwen3.8 Max$2.00$6.00$0.25$2.50$15
Qwen3.8 Flash$0.15$0.47$0.016$0.20$30
Qwen3.7 Max$2.50$7.50$0.50$3.125$30
Qwen3.7 Plus (≤ 256K tokens)$0.40$1.60$0.04$0.50$60
Qwen3.7 Plus (> 256K tokens)$1.20$4.80$0.12$1.50$60
Qwen3.6 Plus (≤ 256K tokens)$0.50$3.00$0.05$0.625$60
Qwen3.6 Plus (> 256K tokens)$2.00$6.00$0.20$2.50$60
DeepSeek V4.1 Flash (Off-Peak)$0.15$0.60$0.003-$15
DeepSeek V4.1 Flash (Peak)$0.30$1.20$0.006-$15
DeepSeek V4 Pro (Off-Peak)$0.66$1.98$0.022-$15
DeepSeek V4 Pro (Peak)$1.32$3.96$0.044-$15
DeepSeek V4 Flash (Off-Peak)$0.15$0.60$0.003-$30
DeepSeek V4 Flash (Peak)$0.30$1.20$0.006-$30
DeepSeek V4 Flash Vision Exp (Off-Peak)$0.15$0.60$0.003-$15
DeepSeek V4 Flash Vision Exp (Peak)$0.30$1.20$0.006-$15
Hy4 preview$0.834$2.501$0.042-$30
Hy3$0.14$0.58$0.035-$60
Grok 4.6 (≤ 200K tokens)$2.00$6.00$0.50-$15
Grok 4.6 (> 200K tokens)$4.00$12.00$1.00-$15
GPT 5.6 Luna (≤ 272K tokens)$0.20$1.20$0.02$0.25$15
GPT 5.6 Luna (> 272K tokens)$0.40$1.80$0.04$0.50$15

DeepSeek V4.1 Flash / V4 Pro / V4 Flash / V4 Flash Vision Exp: Peak 시간은 월요일부터 금요일까지 01:00-04:00 및 06:00-10:00 UTC이며, 주말을 포함한 그 외 모든 시간은 Off-Peak입니다. 자세히 알아보기.

DeepSeek V4 Flash Vision Exp: 이미지는 크기에 따라 토큰으로 변환되며 텍스트 토큰과 함께 입력 토큰으로 청구됩니다. 자세히 알아보기.

예상 요청 횟수

아래 표는 일반적인 Go 사용 패턴을 기준으로 한 예상 요청 횟수를 보여줍니다.

Model5시간당 요청 횟수주간 요청 횟수월간 요청 횟수
GLM-5.3-Flash6,32015,79031,580
GLM-5.32205401,080
GLM-5.28802,1504,300
GLM-5.18802,1504,300
Kimi K3110250490
Kimi K2.7 Code1,3503,3806,750
Kimi K2.61,1502,8805,750
LongCat-2.011,40028,60057,200
MiMo-V2.530,10075,200150,400
MiMo-V2.5-Pro3,2508,15016,300
MiniMax M33,2008,00016,000
MiniMax M2.73,4008,50017,000
Muse Spark 1.3 Contributor45,300113,300226,600
Muse Spark 1.2 Contributor45,300113,300226,600
Qwen3.8 Max160400810
Qwen3.8 Flash5,40013,50027,000
Qwen3.7 Max170420840
Qwen3.7 Plus4,30010,80021,600
Qwen3.6 Plus3,3008,20016,300
DeepSeek V4.1 Flash6,50016,25032,500
DeepSeek V4 Pro1,0502,6005,200
DeepSeek V4 Flash13,00032,50065,000
DeepSeek V4 Flash Vision Exp6,50016,25032,500
Hy4 preview1,3503,3806,770
Hy34,30010,75021,500
Grok 4.6169423845
GPT 5.6 Luna2,0505,10010,250

예상치에는 요청당 다음 토큰 수를 사용하며, 실제 사용량은 달라질 수 있습니다.

  • Grok 4.6 — 요청당 입력 390, 캐시 32,500, 출력 토큰 120
  • GLM-5.3-Flash — 요청당 입력 1,000, 캐시 55,000, 출력 토큰 200
  • GLM-5.3/5.2/5.1 — 요청당 입력 700, 캐시 52,000, 출력 토큰 150
  • GPT 5.6 Luna — 요청당 입력 토큰 1,000개, 캐시 토큰 50,000개, 출력 토큰 220개
  • Kimi K3 — 요청당 입력 1,050, 캐시 76,500, 출력 토큰 300
  • Kimi K2.7/K2.6 — 요청당 입력 870, 캐시 55,000, 출력 토큰 200
  • LongCat-2.0 — 요청당 입력 920, 캐시 88,900, 출력 토큰 200
  • DeepSeek V4.1 Flash — 요청당 입력 410, 캐시 71,300, 출력 토큰 310
  • DeepSeek V4 Pro — 요청당 입력 750, 캐시 82,000, 출력 토큰 290
  • DeepSeek V4 Flash — 요청당 입력 410, 캐시 71,300, 출력 토큰 310
  • DeepSeek V4 Flash Vision Exp — 요청당 입력 410, 캐시 71,300, 출력 토큰 310
  • MiniMax M3 — 요청당 입력 510, 캐시 56,000, 출력 토큰 190
  • MiniMax M2.7 — 요청당 입력 300, 캐시 55,000, 출력 토큰 125
  • Muse Spark 1.3 Contributor — 요청당 입력 620, 캐시 71,400, 출력 토큰 300
  • Muse Spark 1.2 Contributor — 요청당 입력 620, 캐시 71,400, 출력 토큰 300
  • Qwen3.8 Max — 요청당 입력 420, 캐시 66,000, 출력 토큰 200
  • Qwen3.8 Flash — 요청당 입력 600, 캐시 58,000, 출력 토큰 200
  • Qwen3.7 Max — 요청당 입력 420, 캐시 66,000, 출력 토큰 200
  • Qwen3.7 Plus — 요청당 입력 500, 캐시 57,000, 출력 토큰 190
  • Qwen3.6 Plus — 요청당 입력 500, 캐시 57,000, 출력 토큰 190
  • Hy4 preview — 요청당 입력 830, 캐시 71,500, 출력 토큰 295
  • Hy3 — 요청당 입력 830, 캐시 71,500, 출력 토큰 295
  • MiMo-V2.5 — 요청당 입력 830, 캐시 71,500, 출력 토큰 295
  • MiMo-V2.5-Pro — 요청당 입력 790, 캐시 86,000, 출력 토큰 305

현재 사용량은 **console**에서 확인할 수 있습니다.

초기 사용량과 피드백을 바탕으로 사용 한도는 변경될 수 있습니다.


한도 초과 사용

Zen 잔액에 크레딧도 있다면, console에서 Use balance 옵션을 활성화할 수 있습니다. 이 옵션을 켜면, 사용 한도에 도달했을 때 요청을 차단하는 대신 Go가 Zen 잔액으로 자동 전환됩니다.


일부 모델의 사용량이 더 적은 이유

Go에서는 월 $10를 지불하며, 포함된 월간 사용량은 모델마다 다릅니다.

대부분의 모델은 대량 할인과 예약된 GPU 용량을 통해 이를 실현합니다. 그런 다음 더 많은 월간 사용량을 제공하는 방식으로 절감 혜택을 사용자에게 돌려드립니다.

일부 모델은 새로 출시되었거나 공개 가격에 이미 할인이 적용되어 있어, 아직 할인을 협상하거나 더 저렴한 비용으로 호스팅할 기회가 없었습니다.

이러한 모델도 모델 제공자에게 직접 비용을 지불할 때보다 약간 더 많은 사용량을 제공합니다. 이것이 해당 모델에 포함된 월간 사용량이 더 적은 이유입니다.


엔드포인트

다음 API 엔드포인트를 통해서도 Go 모델에 액세스할 수 있습니다.

모델모델 ID엔드포인트AI SDK 패키지
Grok 4.6grok-4.6https://opencode.ai/zen/go/v1/responses@ai-sdk/openai
GPT 5.6 Lunagpt-5.6-lunahttps://opencode.ai/zen/go/v1/responses@ai-sdk/openai
GLM-5.3-Flashglm-5.3-flashhttps://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
GLM-5.3glm-5.3https://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
GLM-5.2glm-5.2https://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
GLM-5.1glm-5.1https://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
Kimi K3kimi-k3https://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
Kimi K2.7 Codekimi-k2.7-codehttps://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
Kimi K2.6kimi-k2.6https://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
LongCat-2.0longcat-2.0https://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
DeepSeek V4.1 Flashdeepseek-v4.1-flashhttps://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
DeepSeek V4 Prodeepseek-v4-prohttps://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
DeepSeek V4 Flashdeepseek-v4-flashhttps://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
DeepSeek V4 Flash Vision Expdeepseek-v4-flash-vision-exphttps://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
MiMo-V2.5mimo-v2.5https://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
MiMo-V2.5-Promimo-v2.5-prohttps://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
MiniMax M3minimax-m3https://opencode.ai/zen/go/v1/messages@ai-sdk/anthropic
MiniMax M2.7minimax-m2.7https://opencode.ai/zen/go/v1/messages@ai-sdk/anthropic
MiniMax M2.5minimax-m2.5https://opencode.ai/zen/go/v1/messages@ai-sdk/anthropic
Muse Spark 1.3 Contributormuse-spark-1.3-contributorhttps://opencode.ai/zen/go/v1/responses@ai-sdk/openai
Muse Spark 1.2 Contributormuse-spark-1.2-contributorhttps://opencode.ai/zen/go/v1/responses@ai-sdk/openai
Qwen3.8 Maxqwen3.8-maxhttps://opencode.ai/zen/go/v1/messages@ai-sdk/anthropic
Qwen3.8 Flashqwen3.8-flashhttps://opencode.ai/zen/go/v1/messages@ai-sdk/anthropic
Qwen3.7 Maxqwen3.7-maxhttps://opencode.ai/zen/go/v1/messages@ai-sdk/anthropic
Qwen3.7 Plusqwen3.7-plushttps://opencode.ai/zen/go/v1/messages@ai-sdk/anthropic
Qwen3.6 Plusqwen3.6-plushttps://opencode.ai/zen/go/v1/messages@ai-sdk/anthropic
Hy4 previewhy4-previewhttps://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
Hy3hy3https://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible

OpenCode config의 model idopencode-go/<model-id> 형식을 사용합니다. 예를 들어 Kimi K3의 경우 config에서 opencode-go/kimi-k3를 사용하면 됩니다.


모델

사용 가능한 전체 모델 목록과 메타데이터는 다음에서 가져올 수 있습니다.

https://opencode.ai/zen/go/v1/models

개인정보 보호

모델모델 학습데이터 보존
Grok 4.6사용되지 않음30일
GPT 5.6 Luna사용되지 않음30일
GLM-5.3-Flash사용되지 않음0일
GLM-5.3사용되지 않음0일
GLM-5.2사용되지 않음0일
GLM-5.1사용되지 않음0일
Kimi K3사용되지 않음0일
Kimi K2.7 Code사용되지 않음0일
Kimi K2.6사용되지 않음0일
LongCat-2.0사용되지 않음0일
MiMo-V2.5-Pro사용되지 않음0일
MiMo-V2.5사용되지 않음0일
Qwen3.8 Max사용되지 않음0일
Qwen3.8 Flash사용되지 않음0일
Qwen3.7 Max사용되지 않음0일
Qwen3.7 Plus사용되지 않음0일
Qwen3.6 Plus사용되지 않음0일
MiniMax M3사용되지 않음0일
MiniMax M2.7사용되지 않음0일
Muse Spark 1.3 ContributorZDR 아님
Muse Spark 1.2 ContributorZDR 아님
DeepSeek V4.1 Flash사용되지 않음0일
DeepSeek V4 Pro사용되지 않음0일
DeepSeek V4 Flash사용되지 않음0일
DeepSeek V4 Flash Vision Exp사용되지 않음0일
Hy4 preview사용되지 않음0일
Hy3사용되지 않음0일
  • Grok 4.6: ZDR은 저장된 데이터에 의존하는 중요한 API 기능(상태 저장형 Responses API, Files and Collections, Batch API 포함)을 비활성화합니다. 자세히 알아보기.
  • GPT 5.6 Luna: 모든 API 기능 사용에 대해 악용 모니터링 로그가 생성되며 최대 30일 동안 보존됩니다. 자세히 알아보기.
  • Muse Spark 1.3 Contributor: 향후 Meta 모델 학습에 사용자의 프롬프트와 생성 결과를 사용할 수 있도록 허용하는 대신 토큰 가격이 대폭 할인됩니다. Meta의 지역별 사용 정책에서 허용하는 지역에서만 이용할 수 있습니다. 자세히 알아보기.
  • Muse Spark 1.2 Contributor: 향후 Meta 모델 학습에 사용자의 프롬프트와 생성 결과를 사용할 수 있도록 허용하는 대신 토큰 가격이 대폭 할인됩니다. Meta의 지역별 사용 정책에서 허용하는 지역에서만 이용할 수 있습니다. 자세히 알아보기.
  • DeepSeek: ZDR 계약은 매월 갱신됩니다. 현재 계약은 2026년 9월 30일까지 유효합니다.

목표

OpenCode Go를 만든 목적은 다음과 같습니다.

  1. 저비용 구독으로 더 많은 사람이 AI 코딩을 접근 가능하게 이용할 수 있도록 합니다.
  2. 최고의 오픈 코딩 모델에 안정적으로 액세스할 수 있게 합니다.
  3. 코딩 에이전트 사용에 맞게 테스트되고 벤치마킹된 모델을 선별합니다.
  4. OpenCode에서 다른 제공자도 함께 사용할 수 있게 해 종속성 없음을 유지합니다.