Jiminbox 모델 선택 가이드
Jiminbox 모델의 특징, 차감 단가와 적합한 작업을 비교해 사용할 모델을 고르는 방법을 안내합니다.
조사 기준
모델 ID와 표시 단가는 2026년 7월 28일 New API의 활성 모델 목록을 기준으로 정리했습니다. DeepSeek V4 출시 상태와 상류 기능은 2026년 8월 14일 공식 문서를 다시 확인했으며, Jiminbox 운영자는 Flash가 0731 버전, Pro가 0813 정식 버전으로 라우팅된다고 확인했습니다. 모델 구성과 단가는 바뀔 수 있으므로 실제로 연결하기 전에는 New API 모델 목록을 확인하세요.
범위와 의사결정 맥락
이 가이드는 현재 Jiminbox가 제공하는 모델을 빠짐없이 살펴보고, 작업에 맞는 첫 모델을 고르는 데 목적이 있습니다. 공급사마다 평가 방식이 다른 벤치마크 점수를 한 줄로 줄 세우기보다 컨텍스트 길이, 입력 형식, 도구 지원, 표시 단가와 공급 안정성을 비교합니다.
먼저 알아둘 점
claude-*는 실제 Claude 모델이 아닙니다
Jiminbox의 claude-haiku-4-5, claude-sonnet-4-6, claude-opus-4-8은 Anthropic의 Claude 모델을 제공한다는 뜻이 아닙니다. Jiminbox 운영자가 확인한 현재 설정에 따르면, 이 ID는 Claude Code의 타사 추론 기능에서 사용할 수 있도록 만든 호환 경로입니다. claude-haiku-4-5는 GLM-5.1로, claude-sonnet-4-6과 claude-opus-4-8은 GLM-5.2로 전달됩니다.
따라서 이름에 들어 있는 Haiku, Sonnet과 Opus를 실제 Anthropic 모델의 성능, 컨텍스트 길이 또는 기능과 연결해서 해석하면 안 됩니다. 위 연결 대상은 현재 운영 설정이며 추후 달라질 수 있습니다.
표시 단가는 플랜 크레딧 차감 기준입니다
아래 Jiminbox 단가는 New API에서 미국 달러로 표시하는 플랜 크레딧 차감 기준입니다. 사용자가 공급사에 직접 지불하는 현금 가격이나 Jiminbox의 실제 공급 원가를 뜻하지 않습니다. GPT, Gemini와 Claude의 공식 API 가격과 단위는 같아 보여도 결제 구조가 다르므로 참고용으로만 비교해야 합니다.
캐시 입력은 이전 요청에서 재사용된 입력 토큰에 적용되는 단가입니다. 단순 계산은 (일반 입력 토큰 × 입력 단가 + 캐시 입력 토큰 × 캐시 입력 단가 + 출력 토큰 × 출력 단가) ÷ 100만입니다. 예를 들어 캐시 없이 입력 10만 토큰과 출력 1만 토큰을 deepseek-v4-flash로 처리하면 표시 차감량은 약 $0.0168입니다. 실제 요청의 토큰 수와 차감 내역은 Usage Logs 확인 방법을 따라 확인하세요.
Jiminbox에서 확인된 기능 범위
Jiminbox New API는 현재 이미지 입력, 함수 호출과 MCP 도구 연동을 지원합니다. 영상과 음성 입력은 지원하지 않습니다. JSON 모드와 FIM은 지원 여부가 확인되지 않았습니다. 공급사 문서에 더 많은 기능이 적혀 있더라도 Jiminbox에서 모두 제공된다는 뜻은 아닙니다.
빠르게 고르기
| 하려는 작업 | 먼저 써 볼 모델 | 고르는 이유 |
|---|---|---|
| 일반 대화, 요약, 번역과 간단한 코드 | mimo-v2.5, deepseek-v4-flash | 차감 단가가 가장 낮고 두 모델 모두 공급사 기준 100만 토큰 컨텍스트를 지원합니다. |
| 긴 문서나 큰 코드베이스를 저렴하게 다루기 | deepseek-v4-flash, mimo-v2.5 | 긴 입력을 처리하면서 크레딧 소비를 낮추기 좋습니다. |
| 복잡한 코딩과 에이전트 작업 | deepseek-v4-flash, glm-5.2, deepseek-v4-pro, kimi-k2.7-code, minimax-m3 | Flash 0731과 Pro 0813은 에이전트 작업을 중심으로 갱신되었습니다. 다른 고급 모델과 절대 순위는 작업별로 직접 비교해야 합니다. |
| 100만 토큰급 고급 모델이 필요할 때 | glm-5.2, deepseek-v4-pro, minimax-m3 | 공급사 기준 100만 토큰 컨텍스트를 지원합니다. |
| Claude Code에서 Jiminbox 타사 추론 사용 | claude-* 호환 ID | Claude Code와의 호환을 위한 GLM 라우팅 경로입니다. 실제 Claude 모델은 아닙니다. |
| 이미지도 함께 분석 | mimo-v2.5, kimi-k2.6, minimax-m3 후보 | Jiminbox는 이미지 입력을 지원합니다. 영상과 음성 입력은 현재 지원하지 않습니다. |
현재 제공 모델 전체 목록
단가는 입력 / 캐시 입력 / 출력 순서이며, 모두 100만 토큰당 New API 표시값입니다. Pro와 MAX에서 공통으로 쓰는 기본 모델 외의 고급 모델은 현재 MAX의 고급 모델 풀을 기준으로 정리했습니다. 최신 값은 New API 모델 목록에서 확인합니다.
Pro와 MAX 공통 모델
| 모델 ID | 공급사 기준 특징 | 컨텍스트 | 표시 단가 |
|---|---|---|---|
deepseek-v4-flash | 정식 API 공개 베타, 저비용 추론·코딩 에이전트와 도구 호출 | 100만 | 0.028 / $0.28 |
mimo-v2.5 | 저비용 장문 처리, 에이전트와 멀티모달 작업 지향 | 100만 | 0.0028 / $0.28 |
MAX 고급 모델 풀
MAX 이용자는 아래 표의 모든 모델을 선택할 수 있습니다.
| 모델 ID | 공급사 기준 특징 | 컨텍스트 | 표시 단가 |
|---|---|---|---|
deepseek-v4-pro | 0813 정식 GA, 복잡한 추론과 장기 에이전트 작업에 초점을 둔 대형 모델 | 100만 | 0.0145 / $3.48 |
glm-5 | 코딩, 도구 사용과 일반 업무를 위한 기반 모델 | 20만 | 0.10 / $1.60 |
glm-5.1 | 장시간 코딩·에이전트 작업과 문서 작성 강화 | 20만 | 0.26 / $4.40 |
glm-5.2 | 프로젝트 규모 코드와 장기 작업을 위한 최신 GLM | 100만 | 0.26 / $4.40 |
kimi-k2.5 | 범용 대화, 에이전트와 멀티모달 작업 | 25.6만 | 0.102 / $3.00 |
kimi-k2.6 | 텍스트·이미지 이해와 도구 사용, 공급사 문서상 영상 입력 | 25.6만 | 0.16 / $4.00 |
kimi-k2.7-code | 장문 지시 준수와 코딩 작업에 특화 | 25.6만 | 0.19 / $4.00 |
minimax-m2.5 | 비용을 낮춘 코딩과 에이전트 작업 | 20.48만 | 0.03 / $1.20 |
minimax-m2.7 | M2.5 이후 세대의 코딩·에이전트 모델 | 20.48만 | 0.06 / $1.20 |
minimax-m3 | 100만 토큰, 이미지와 도구를 활용한 코딩 | 100만 | 0.12 / $2.40 |
claude-haiku-4-5 | Claude Code 호환용 GLM-5.1 라우팅 ID | 20만 | 0.10 / $2.50 |
claude-sonnet-4-6 | Claude Code 호환용 GLM-5.2 라우팅 ID | 100만 | 0.24 / $6.00 |
claude-opus-4-8 | Claude Code 호환용 GLM-5.2 라우팅 ID | 100만 | 0.24 / $6.00 |
모델 ID는 고정된 품질 보증이 아닙니다
Jiminbox의 모델과 라우팅 대상은 공급 상황에 따라 바뀔 수 있습니다.
claude-*호환 ID도 위에 적힌 현재 연결 대상을 기준으로 사용하고, 이름만 보고 실제 Anthropic 모델로 해석하지 마세요.
DeepSeek V4 출시 상태
DeepSeek는 V4 Flash 0731을 2026년 7월 31일 공개 베타로, V4 Pro 0813을 8월 13일 정식 GA로 출시했습니다. Jiminbox에서는
deepseek-v4-flash와deepseek-v4-pro라는 기존 ID를 그대로 사용합니다. Pro 0813의 출시 변화와 공급사 공개 평가는 DeepSeek V4 Pro 0813에서 확인합니다. DeepSeek 변경 기록
GLM-5.3 발표 상태
Z.ai는 2026년 8월 14일 GLM-5.3을 발표했습니다. 같은 GLM-5.2 베이스에서 장기 코딩·에이전트 후속 학습을 확장한 모델이며, 표준 API와 공개 가중치는 아직 준비 중입니다. Jiminbox에서 제공된다는 뜻은 아니므로 모델 목록에 실제로 나타날 때까지 현재
glm-5.2를 사용하세요. 자세한 비교는 GLM 5.3에서 확인합니다.
모델 계열별 특징
모델군별 상세 페이지는 버전 차이, 공급사가 제시한 대표 활용 분야, Jiminbox에서 고르는 기준과 공식 출처를 함께 설명합니다.
| 모델군 | 먼저 확인할 내용 | 상세 가이드 |
|---|---|---|
| DeepSeek V4 | Flash 0731과 Pro 0813의 선택 기준 | DeepSeek V4 모델 가이드 |
| DeepSeek V4 Pro 0813 | 정식판의 에이전트 기능, 추론 강도와 API 주의점 | DeepSeek V4 Pro 0813 |
| MiMo V2.5 | 저비용 100만 토큰 모델과 멀티모달 활용 | MiMo V2.5 모델 가이드 |
| GLM 5 계열 | GLM-5·5.1·5.2와 claude-* 호환 경로 | GLM 5 계열 모델 가이드 |
| GLM-5.3 | 5.2 대비 장기 코딩·에이전트 개선과 출시 상태 | GLM 5.3 |
| Kimi K2 계열 | K2.5·K2.6·K2.7 Code의 역할과 공급 수명 | Kimi K2 계열 모델 가이드 |
| MiniMax M 계열 | M2.5·M2.7·M3의 에이전트·코딩 활용 | MiniMax M 계열 모델 가이드 |
최신 GPT, Gemini와 Claude 비교
아래 모델은 Jiminbox에서 제공하는 목록이 아니라 현재 시장의 비교 기준입니다. 가격은 각 공급사의 표준 API에서 텍스트 100만 토큰당 입력 / 출력 가격입니다. 장문 할증, 캐시, 배치, 우선 처리와 도구 호출 비용은 제외했습니다.
| 공급사 모델 | 상태와 용도 | 컨텍스트 / 최대 출력 | 공식 단가 |
|---|---|---|---|
| GPT-5.6 Sol | 복잡한 전문 업무용 최상위 GPT | 105만 / 12.8만 | 30 |
| GPT-5.6 Terra | 지능과 비용의 균형 | 105만 / 12.8만 | 15 |
| GPT-5.6 Luna | 비용에 민감한 대량 작업 | 105만 / 12.8만 | 6 |
| Gemini 3.1 Pro Preview | 복잡한 멀티모달·에이전트·코딩 | 약 105만 / 6.55만 | 12, 20만 초과 시 18 |
| Gemini 3.6 Flash | 정식 출시된 고속 멀티모달·에이전트 모델 | 약 105만 / 6.55만 | 7.50 |
| Gemini 3.5 Flash-Lite | 정식 출시된 대량 처리·추출 모델 | 약 105만 / 6.55만 | 2.50 |
| Claude Fable 5 | 장기 실행 에이전트를 위한 최고 성능 등급 | 100만 / 12.8만 | 50 |
| Claude Opus 5 | 복잡한 에이전트 코딩과 기업 업무 | 100만 / 12.8만 | 25 |
| Claude Sonnet 5 | 속도와 지능의 균형 | 100만 / 12.8만 | 15 |
| Claude Haiku 4.5 | 가장 빠른 Claude 등급 | 20만 / 6.4만 | 5 |
GPT-5.6 Sol, Terra와 Luna는 모두 텍스트와 이미지 입력, 함수 호출과 구조화 출력을 지원합니다. OpenAI의 Responses API에서는 웹 검색, 파일 검색, 코드 실행, 셸, 컴퓨터 사용, MCP와 도구 검색 같은 통합 도구를 함께 쓸 수 있습니다. 27.2만 토큰을 넘는 입력에는 장문 할증이 적용됩니다. GPT-5.6 Sol · GPT-5.6 Terra · GPT-5.6 Luna
Gemini 3.6 Flash와 3.5 Flash-Lite는 정식 출시 모델이며 100만 토큰 컨텍스트, 사고 모드, 코드 실행, 검색 기반 근거 확인과 컴퓨터 사용을 지원합니다. Gemini 3.1 Pro는 더 높은 성능을 목표로 하지만 아직 Preview입니다. 세 모델 모두 텍스트, 이미지, 영상, 음성 및 PDF 입력을 공식 지원합니다. Gemini 최신 모델 · Gemini 3.1 Pro Preview · Gemini API 가격
Anthropic의 최신 공개 모델은 Claude Fable 5, Opus 5, Sonnet 5와 Haiku 4.5입니다. Fable, Opus와 Sonnet은 100만 토큰 컨텍스트를 지원하고, 현재 Claude 모델은 텍스트와 이미지 입력 및 텍스트 출력을 지원합니다. 다시 말해 Jiminbox의 claude-opus-4-8 같은 호환 ID는 이 표의 실제 Anthropic 모델과 별개입니다. Claude 모델 개요 · Claude Opus 5 · Claude Sonnet 5
Jiminbox가 제공하는 장점
적은 크레딧으로 긴 문맥 다루기
MiMo V2.5와 DeepSeek V4 Flash는 Jiminbox 표시 단가가 입력 0.28이면서 공급사 기준 100만 토큰 컨텍스트를 지원합니다. 최신 GPT, Gemini와 Claude의 저가 등급과 비교해도 표시 단가가 낮습니다. 다만 이는 동일한 품질을 뜻하지 않으며, Jiminbox 플랜 크레딧과 외부 API 현금 가격의 차이도 고려해야 합니다.
하나의 Key로 여러 성격의 모델 시험하기
저비용 모델, 코딩 특화 모델, 긴 문맥 모델을 같은 OpenAI 호환 주소와 New API Key에서 모델 ID만 바꿔 가며 사용합니다. 특정 공급사에 앱 설정을 고정하지 않고 작업에 따라 모델을 바꾸기 쉽다는 점이 핵심입니다.
다양한 코딩·에이전트 모델
DeepSeek V4, GLM 5 계열, Kimi K2.7 Code와 MiniMax M3는 모두 공급사 문서에서 코딩, 도구 사용 또는 장기 에이전트 작업을 주요 용도로 설명합니다. 절대 성능을 한 줄로 순위 매길 수는 없지만 같은 실제 작업을 여러 모델에 맡겨 결과와 차감량을 비교하기 좋은 구성입니다.
Claude Code에 제3자 모델 연결하기
claude-* 호환 ID는 Claude Code의 타사 추론 경로를 유지하면서 GLM-5.1 또는 GLM-5.2를 연결합니다. Claude Code의 작업 흐름은 필요하지만 실제 Anthropic Claude를 사용해야 하는 것은 아닌 경우에 유용합니다.
GPT, Gemini와 Claude의 직접 API가 더 나은 경우
- 공식 도구가 필요할 때: OpenAI의 Responses API 도구나 Gemini의 검색·지도 근거 확인, Anthropic의 최신 Claude 기능을 그대로 써야 한다면 각 공급사의 직접 API가 더 명확합니다.
- 영상·음성 입력이 필요할 때: Jiminbox는 이미지 입력을 지원하지만 영상과 음성 입력은 지원하지 않습니다. 해당 입력이 필요하면 이를 공식 제공하는 공급사 경로가 적합합니다.
- 모델 정체성을 고정해야 할 때: 특정 버전의 GPT, Gemini나 Claude를 계약과 평가 기준에 맞춰 고정해야 한다면 라우팅 별칭보다 공식 모델 ID가 적합합니다.
- 기업용 지원이 필요할 때: 전용 처리량, 데이터 거주, 규정 준수와 공식 지원이 필요하면 공급사의 기업용 서비스가 더 알맞습니다.
권고 근거
Jiminbox 모델 선택의 기본 원칙은 필요한 기능을 만족하는 모델 가운데 예상 차감량이 낮은 모델부터 시작하는 것입니다. 작업 결과가 부족할 때만 고급 모델로 올리면 같은 Key와 엔드포인트를 유지한 채 비용과 결과를 직접 비교하기 쉽습니다. 반대로 특정 GPT, Gemini나 Claude의 고유 기능과 모델 버전을 반드시 보장해야 한다면 해당 공급사의 직접 API가 더 알맞습니다.
선택하는 가장 안전한 방법
- 먼저
mimo-v2.5또는deepseek-v4-flash로 실제 작업을 실행합니다. 코딩과 에이전트 작업에서도 Flash를 먼저 시험합니다. - 세계 지식이나 복잡한 추론이 부족할 때
glm-5.2,deepseek-v4-pro,kimi-k2.7-code또는minimax-m3와 결과를 비교합니다. - 같은 프롬프트로 정답성, 수정 횟수, 처리 시간과 Usage Logs의 차감량을 비교합니다.
- 이미지 입력, 긴 컨텍스트와 도구 호출은 작은 예제로 실제 동작을 확인합니다. 영상과 음성 입력은 Jiminbox에서 지원하지 않습니다.
- 장기간 사용할 앱에서는 모델 하나를 고정하기보다 교체 가능한 설정을 유지합니다.
근거와 직접성
현재 모델 ID와 표시 단가는 Jiminbox New API 목록에서 직접 확인했습니다. deepseek-v4-flash의 0731 버전, deepseek-v4-pro의 0813 버전과 claude-*의 GLM 라우팅 목적은 Jiminbox 운영자의 설명을 반영했습니다. GLM-5.3은 2026년 8월 14일의 Z.ai 공식 발표와 모델 문서를 사용했으며 Jiminbox 제공 모델로 계산하지 않았습니다. 모델별 컨텍스트, 입력 형식, 도구와 공식 가격은 각 공급사의 공식 문서를 사용했습니다. 반면 “어떤 작업에 먼저 써 볼지”에 관한 안내는 이 자료를 바탕으로 한 선택 제안이며, 객관적인 성능 순위를 뜻하지 않습니다.
한계 및 변경 조건
공급사가 공개한 벤치마크는 평가 조건과 도구 구성이 서로 달라 절대 순위 근거로 사용하지 않았습니다. Jiminbox의 모델 목록이나 라우팅 대상, 공급사 가격·버전, 게이트웨이에서 제공되는 기능이 바뀌면 이 문서의 추천도 다시 검토해야 합니다. 중요한 작업은 자신의 코드, 문서와 자동화 흐름으로 직접 평가하세요.
다음 단계: New API Key와 사용량 가이드 · opencode 설치 가이드 · claude desktop 설치 가이드 · Jiminbox 사용 정책