DeepSeek V4 모델 가이드

DeepSeek V4 Flash와 V4 Pro의 현재 버전, 활용 범위와 선택 기준을 비교합니다.

DeepSeek V4 Preview 공식 성능 도표

DeepSeek V4 계열의 초기 모델 카드에 공개된 공급사 자체 평가 도표입니다. 2026년 7월 31일 Flash 0731과 8월 13일 Pro 0813 출시 전 자료이므로, 현재 버전의 독립 평가 결과로 해석하면 안 됩니다. 이미지 출처

조사 기준

DeepSeek의 출시 상태, 모델 버전과 상류 기능은 2026년 8월 14일 공식 변경 기록, 가격표와 모델 카드를 기준으로 확인했습니다. Jiminbox 운영자는 같은 날 deepseek-v4-pro가 이름을 바꾸지 않은 채 DeepSeek-V4-Pro-0813로 갱신되었다고 확인했습니다. Jiminbox 표시 단가는 2026년 7월 28일 확인값이므로, 요청 전에는 New API 모델 목록을 다시 확인합니다.

현재 제공 버전

Jiminbox 모델 ID실제 버전출시 상태플랜컨텍스트최대 출력
deepseek-v4-flashDeepSeek-V4-Flash-0731정식 API 공개 베타Pro · MAX100만38.4만
deepseek-v4-proDeepSeek-V4-Pro-0813정식 GAMAX100만38.4만

DeepSeek는 2026년 8월 13일 V4 Pro의 정식 GA 버전을 앱, 웹과 API에 배포했습니다. 호출 이름은 기존과 같은 deepseek-v4-pro이며, Jiminbox에서도 같은 모델 ID를 그대로 사용합니다. DeepSeek 변경 기록 · DeepSeek 모델과 가격

정식판에서 달라진 내용과 공개 평가, 추론 강도와 API 주의점은 DeepSeek V4 Pro 0813에서 자세히 설명합니다.

한눈에 비교

구분DeepSeek V4 Flash 0731DeepSeek V4 Pro 0813
우선 고려할 작업반복 호출, 일반 코딩, 비용에 민감한 에이전트 작업복잡한 저장소 작업, 긴 도구 실행, 전문 지식과 고난도 추론
전체 / 활성 매개변수2,840억 / 130억1.6조 / 490억
공식 API 추론 강도low · high · maxlow · high · max
공식 API 형식Chat Completions · Responses · AnthropicChat Completions · Responses · Anthropic
Jiminbox 이용 플랜Pro · MAXMAX
Jiminbox 표시 단가*입력 0.028 / 출력 $0.28입력 0.0145 / 출력 $3.48

* 표시 단가는 New API의 Jiminbox 플랜 크레딧 차감 기준이며 DeepSeek 직접 API 가격이 아닙니다. 2026년 7월 28일 확인값이므로 현재 값은 New API 모델 목록을 기준으로 판단합니다.

두 모델 모두 공식 DeepSeek API에서 사고 모드와 비사고 모드, JSON 출력, 함수 호출, Responses API와 FIM을 지원합니다. FIM은 비사고 모드에서만 사용할 수 있습니다. Jiminbox의 지원 범위는 상류 공식 API와 다를 수 있습니다. DeepSeek 모델과 가격

모델별 특징과 활용

deepseek-v4-flash

Flash는 비용을 낮추면서 긴 문서나 코드베이스를 다루고, 반복 호출이 많은 작업을 실행할 때 먼저 선택하기 좋습니다. 0731 버전은 기존 구조와 크기를 유지하면서 에이전트 작업을 중심으로 출시 전 추가 학습을 다시 거쳤습니다.

대표 활용 예시는 다음과 같습니다.

  • 일상적인 질문, 요약과 정보 추출
  • 짧은 코드 작성과 일반적인 수정
  • 저장소 탐색과 반복적인 코드 검토
  • 호출 횟수가 많은 자동화와 도구 연동
  • Pro를 사용하기 전에 작업 난이도와 예상 차감량을 확인하는 1차 실행

이 활용 범위는 DeepSeek가 공개한 Flash 0731 변경 기록과 공식 모델 카드를 바탕으로 한 선택 제안입니다. DeepSeek 변경 기록 · DeepSeek V4 Flash 공식 모델 카드

deepseek-v4-pro

Pro는 더 많은 매개변수를 활성화하고 세계 지식, 복잡한 추론과 장시간 에이전트 작업에 초점을 둔 대형 모델입니다. 현재 Jiminbox 모델 ID는 2026년 8월 13일 정식판을 가리킵니다.

대표 활용 예시는 다음과 같습니다.

  • 여러 파일과 도구를 오가는 복잡한 저장소 작업
  • 원인을 좁혀 가는 고난도 디버깅
  • 수학, 과학과 기술 문서의 단계별 분석
  • 긴 작업 흐름을 계획하고 실행하는 코딩 에이전트
  • Flash 결과가 부족한 작업의 2차 검토와 비교

DeepSeek는 0813 정식판에서 에이전트와 실제 운영 환경의 성능이 크게 향상됐다고 발표했습니다. 공개 수치는 공급사 자체 평가이며, 출시 직후에는 독립된 재현 평가가 충분히 쌓이지 않았습니다. DeepSeek 변경 기록 · Pro 0813 자세히 보기

Jiminbox에서 고르는 방법

  1. 일반 작업과 반복 호출은 deepseek-v4-flash로 시작합니다.
  2. 저장소가 크거나 도구 실행이 길어지고, Flash 결과가 충분하지 않으면 deepseek-v4-pro로 같은 작업을 비교합니다.
  3. 두 결과의 정확도, 수정 횟수, 처리 시간과 Usage Logs의 차감량을 함께 확인합니다.

Pro 0813은 Preview보다 에이전트 성능이 강화됐지만, 모든 짧은 요청에서 Flash보다 효율적이라는 뜻은 아닙니다. 작업 실패 비용이 크거나 여러 번 다시 시도하는 상황이라면 Pro가 유리할 수 있고, 반복성이 높은 일상 작업이라면 Flash가 더 경제적일 수 있습니다.

기능과 호환성

  • DeepSeek 공식 API는 사고 모드와 비사고 모드를 지원합니다.
  • low, high와 max 추론 강도를 선택할 수 있으며 기본값은 high입니다.
  • JSON 출력과 함수 호출을 지원합니다.
  • OpenAI Chat Completions, Responses API와 Anthropic 호환 형식을 제공합니다.
  • FIM Completion은 두 모델 모두 비사고 모드에서만 지원합니다.
  • 공식 모델 카드에 따르면 V4 Pro 계열의 컨텍스트는 100만 토큰이고 최대 출력은 38.4만 토큰입니다.

사고 모드에서는 temperature, top_p, presence_penaltyfrequency_penalty가 적용되지 않습니다. 도구 호출을 이어 갈 때는 이전 응답의 reasoning_content를 다음 요청에도 전달해야 합니다. Thinking Mode · DeepSeek 모델과 가격

Jiminbox 지원 범위

Jiminbox에서는 함수 호출과 MCP 도구 연동을 사용할 수 있습니다. JSON 모드, FIM, Responses API와 세부 추론 강도는 Jiminbox New API에서 지원 여부가 확인되지 않았으므로 작은 요청으로 먼저 시험합니다. DeepSeek 직접 API의 기능이 Jiminbox에서도 모두 동작한다고 가정하면 안 됩니다.

다음 단계

DeepSeek V4 Pro 0813 · 전체 모델 비교로 돌아가기 · New API Key와 사용량 가이드 · opencode 설치 가이드