홈 블로그

DeepSeek V4.1 플래시 API 사용 방법

DeepSeek V4.1 플래시 API 블로그 표지

Sep 14, 2026

EmpirioLabs AI

DeepSeek V4.1 플래시는 EmpirioLabs에서 이용 가능합니다. 이 아키텍처는 DeepSeek의 새로운 아키텍처 계열의 경량 플래그십으로, 입력용 8B의 활성 파라미터와 출력용 16B의 552B 매개변수 mixture-of-experts 모델, 네이티브 이미지 이해, 100만 토큰 컨텍스트 창, 최대 384K 출력 토큰을 지원합니다. DeepSeek는 DeepSeek V4 Pro보다 먼저 벤치마크 결과를 발표했습니다.

모델이 하는 일은

V4.1 Flash는 동일한 요청에서 텍스트와 이미지를 읽기 때문에, 프롬프트와 함께 스크린샷, 도표, 사진을 보낼 수 있습니다. 기본적으로 하이브리드 사고가 켜져 있습니다: 모델이 답변하기 전에 추론을 하고, 낮은 지연 시간 답변을 위해 사고를 끄거나 사고 예산으로 제한할 수 있습니다. 함수 호출과 JSON 모드는 표준 채팅 완료 서피스에서 작동하며, 선택적으로 링크 웹 검색을 활성화하면 최근 웹 컨텍스트를 추가합니다.

DeepSeek V4.1 플래시를 호출하는 방법

OpenAI 호환 채팅 완료 엔드포인트를 사용하고 설정하세요 모델 번호: 로 deepseek-v4-1-flash. 이미지 부품은 표준을 사용합니다 image_url 콘텐츠 블록:

curl https://api.empiriolabs.ai/v1/chat/completions \ -H '인증: 보유자 $EMPIRIOLABS_API_KEY' \ -H 'Content-Type: application/json' \ -d '{ "model": "deepseek-v4-1-flash", "enable_thinking": true, "thinking_budget": 32768, "messages": [ { "role": "user", "content": [ {"type": "text", "text": "이 차트는 무엇을 보여주는가?" "추세를 두 문장으로 요약하세요."}, {"type": "image_url", "image_url": {"url": "https://example.com/chart.png"}} ] }'

동일한 모델 ID가 모델 페이지에 나열된 응답, 메시지, Gemini 호환 엔드포인트에도 적용됩니다.

운용 노트

  • JSON 모드 (a response_format 유형 json_object메시지의 어딘가에 json이라는 단어가 필요합니다. 이 모델에서는 엄격한 JSON 스키마 응답 형식이 제공되지 않습니다.
  • 추론 토큰은 출력 토큰으로 청구됩니다. 집합 enable thinking을 활성화 로 거짓 짧고 지연에 민감한 답변 또는 그 이하의 답변을 위한 것입니다 thinking_budget 논리를 묶기 위해서입니다.

제품정보

토큰 사용은 별도의 캐시 입력 요금이 없고 별도의 캐시 입력 요금이 없습니다. 링크업 웹 검색은 실행될 때만 호출당 소액의 수수료를 부과합니다. 라이브 보기 모델 페이지 그리고 가격표 현재 요금에 대해 말이죠.

건설 시작

DeepSeek v4.1 플래시를 시도해 보세요 팟캐스트, 읽기 API 문서또는 다른 모델들과 비교하거나 모델 카탈로그·.

공개: 이 문서는 AI 지원으로 작성되었으며 EmpirioLabs AI에 의해 검토되었습니다.

더 나은 엔드포인트를 사용할 준비가 되셨나요?

저희 모델을 탐색하시거나, 비즈니스 문의, 맞춤형 배포 또는 기타 어떤 사항이든 문의해 주세요.