DeepSeek V4 Flash 0731 API

Post-trained 0731 코딩, 저장소 작업, 도구 사용 및 전체 스택 작업, 플러스 1M 컨텍스트 창에서 주요 이득과 릴리스.

DeepSeek텍스트 생성1M 컨텍스트출시 2026년 7월 31일Germany독점 엔드포인트신규

DeepSeek V4 Flash 0731 소개

Post-trained 0731 코딩, 저장소 작업, 도구 사용 및 전체 스택 작업, 플러스 1M 컨텍스트 창에서 주요 이득과 릴리스.

enable thinking and thought budget, 함수 호출, 엄격한 JSON Schema 출력 및 옵션 Linkup 웹 검색과 텍스트 입력, 하이브리드 사고를 지원합니다. Thinking 토큰은 출력 토큰으로 청구됩니다.

다른 이름 DeepSeek Flash 0731

reasoningfunction callingstructured outputagentic coding

DeepSeek V4 Flash 0731 사양

모델 ID
deepseek-v4-flash-0731
제공자
DeepSeek
카테고리
텍스트 생성
출시
2026년 7월 31일
컨텍스트 창
1M 토큰
최대 출력
393,216 토큰
입력
텍스트
출력
텍스트
구조화된 출력
JSON Schema
리전
Germany
엔드포인트
POST/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/deepseek-v4-flash-0731:generateContent
대체 모델 ID
deepseek/deepseek-v4-flash-0731deepseek-ai/deepseek-v4-flash-0731

DeepSeek V4 Flash 0731 API 요금

EmpirioLabs 카탈로그의 실시간 종량제 요금입니다. 사용한 만큼만 결제하며 월 최소 요금이 없습니다.

유형
사양
요금
이름 *
1M 신속한 토큰 당
$0.14
제품정보
1M 생성 토큰
$0.28
웹 검색 (링크업)
호출 할 때 invoked
$0.013
전체 가격 페이지에서 비교

DeepSeek V4 Flash 0731 API 호출 방법

DeepSeek V4 Flash 0731은(는) OpenAI 호환 Chat Completions API를 제공합니다. 아무 OpenAI SDK나 EmpirioLabs API 키와 함께 https://api.empiriolabs.ai/v1로 지정하고 모델 ID deepseek-v4-flash-0731를 사용하세요. EmpirioLabs 대시보드에서 API 키를 발급받으세요.

cURL
curl https://api.empiriolabs.ai/v1/chat/completions \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek-v4-flash-0731",
    "messages": [
      {"role": "user", "content": "Write a haiku about the ocean."}
    ]
  }'
Python (OpenAI SDK)
from openai import OpenAI

client = OpenAI(
    base_url="https://api.empiriolabs.ai/v1",
    api_key="YOUR_EMPIRIOLABS_API_KEY",
)

response = client.chat.completions.create(
    model="deepseek-v4-flash-0731",
    messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)
DeepSeek V4 Flash 0731 API 전체 레퍼런스

DeepSeek V4 Flash 0731 API 파라미터

EmpirioLabs에서 DeepSeek V4 Flash 0731 API가 지원하는 요청 파라미터입니다. 필드를 생략하면 기본값이 적용됩니다.

파라미터유형기본값범위 / 값설명
temperaturenumber0.70 ~ 2샘플링 온도. 0 = 결정론적, 2 = 최대 무작위성.
top_pnumber0.90 ~ 1핵 샘플링 확률 질량. 더 낮은 = 더 집중된 상태입니다.
max_tokensnumber40961 ~ 393216최대 출력 토큰.
stopstring--최대 4개의 문자열에서 모델이 더 이상 토큰 생성을 멈춥니다.
enable_thinkingbooleantrue-답변하기 전에 step-by-step 추론을 가능하게 하세요.
reasoning_effortenummediumnone, low, medium, high, max추론 노력 수준. 어떤 것도 사고를 막지 못한다. 로우, 미디엄, 하이, 최대는 선택한 모델에 맞춘 제한된 사고 예산을 설정합니다. OpenAI 스타일의 reasoning_effort 필드로 전송되었고, 모델 서비스에 대한 enable_thinking와 thinking_budget로 번역되었습니다.
thinking_budgetnumber327681 ~ 393216추론 과정을 위해 최대 토큰을 예약했습니다. 393216까지.
response_formatenum--출력을 JSON으로 제한하세요. 유효한 JSON 객체에 대해 JSON 모드를 사용하거나, 제공한 스키마와 일치하는 출력 강제 JSON 스키마를 사용하세요.
web_search_linkupbooleanfalse-Linkup이 제공하는 선택적 웹 검색. 활성화되면 최신 웹 소스를 쿼리로 최신 사용자 메시지를 검색하여 모델에 추가 맥락으로 제공합니다. 모델의 일반적인 토큰 비용 외에 호출당 $0.013 추가 비용이 발생합니다. 기본적으로 비활성화되어 있습니다.
disable_formattingbooleanfalse-활성화되면 게이트웨이는 Linkup 웹 검색을 사용한 어시스턴트 응답에 "Sources" 풋을 추가하지 않습니다. 모델 출력이 장식이 전혀 예상되지 않는 다른 시스템으로 전송될 때 유용합니다.

알아두면 좋은 점

생각은 기본적으로 활성화되며 비활성화 될 수 있습니다. Reasoning 토큰은 출력 토큰으로 청구됩니다. 선택 Linkup 웹 검색은 invoked 때만 청구됩니다.

DeepSeek V4 Flash 0731 API: 자주 묻는 질문

DeepSeek V4 Flash 0731 API 비용은 얼마인가요?

EmpirioLabs에서 DeepSeek V4 Flash 0731은(는) 종량제로 청구됩니다: 이름 * $0.14 1M 신속한 토큰 당; 제품정보 $0.28 1M 생성 토큰; 웹 검색 (링크업) $0.013 호출 할 때 invoked. 이 페이지의 실시간 요금표는 항상 API 청구 금액과 일치합니다.

DeepSeek V4 Flash 0731의 컨텍스트 윈도우는 얼마인가요?

DeepSeek V4 Flash 0731은(는) 1M 토큰 컨텍스트 윈도우를 지원합니다 (응답당 최대 393,216 출력 토큰).

DeepSeek V4 Flash 0731 API는 OpenAI와 호환되나요?

네. DeepSeek V4 Flash 0731은(는) OpenAI 호환 Chat Completions API를 제공하므로, 기존 OpenAI SDK에서 base_urlhttps://api.empiriolabs.ai/v1로 지정하고 모델 ID를 deepseek-v4-flash-0731로 설정하면 바로 동작합니다.

통합하기 전에 브라우저에서 DeepSeek V4 Flash 0731을(를) 사용해 볼 수 있나요?

네. EmpirioLabs 플레이그라운드에서 API와 동일한 파라미터로 DeepSeek V4 Flash 0731을(를) 브라우저에서 실행하므로 코드를 작성하기 전에 프롬프트를 테스트할 수 있습니다.

DeepSeek V4 Flash 0731 API 키는 어떻게 발급받나요?

EmpirioLabs 계정을 만든 다음 대시보드의 API Keys에서 키를 생성하세요. 요금은 종량제 크레딧이라 실행한 요청에 대해서만 결제합니다.

더 나은 엔드포인트를 사용할 준비가 되셨나요?

저희 가격을 확인하시거나 저희 스택에 자체 모델을 배포하고 싶으시면 연락해 주세요.