홈 블로그

Qwen3.7 플래시 API 사용 방법

API를 통한 Qwen3.7 플래시

Jul 28, 2026

EmpirioLabs AI

Qwen3.7 플래시는 EmpirioLabs에서 이용 가능합니다. 이 게임은 알리바바의 Qwen3.7 비전 언어 시리즈 중 빠른 단계로, 다중 모달 이해, 에이전트 도구 사용, 장기 맥락 작업을 위해 구축되었으며, 1M 토큰 컨텍스트 창, 전환 가능한 사고, 텍스트, 이미지, 비디오 입력을 지원합니다. OpenAI 호환 API로 실행되므로, 필드 하나를 변경하면 전환할 수 있습니다.

Qwen3.7 플래시가 잘하는 점

플래시는 Qwen3.7 계열 중 속도와 비용 계층이기 때문에, 문서 및 스크린샷 이해, 비디오 질문 답변, 추출 파이프라인, 그리고 도구를 호출하는 에이전트 루프 등 실제 추론이 필요한 대량 작업에 적합합니다. 이미지와 비디오를 읽고, 표준 함수 호출로 도구를 호출하며, 주문형 JSON을 반환하고, 내장 도구를 통해 웹 검색, 코드 실행, URL 읽기도 할 수 있습니다. 싱가포르와 중국 두 가지 배포 모두 가능하므로, 지연 시간과 가격 요구에 맞는 곳을 선택할 수 있습니다.

어떻게 부를까요

표준 채팅 완료 메시지 보내기:

curl https://api.empiriolabs.ai/v1/chat/completions \ -h "인증: 보유자 $EMPIRIOLABS_API_KEY" \ -h "콘텐츠-유형: application/json" \ -d '{ "model": "qwen3-7-flash", "messages": [ {"role": "user", "content": "이번 분기' 보고서를 다섯 개의 글머리기호로 요약하세요."} ] }''

최종 답변이 돌아옵니다 내용, 그리고 생각이 있을 때 모델의 추론은 에 속한다. 사이트 맵·.

생각을 통제하세요

생각은 기본적으로 켜져 있습니다. 짧고 지연에 민감한 통화에서는 꺼두거나, 모델이 추론적으로 사용할 토큰 수에 대한 예산을 설정하세요. 또한 사용할 수 있습니다 이유 effort 이 모델의 예산 크기에 대응하는 '없음', '낮음', '중간', '높음', '최대'가 있습니다:

{ "model": "qwen3-7-flash", "messages": [{"role": "user", "content": "마이그레이션 계획 및 명령 정당화."}], "enable_thinking": true, "thinking_budget": 32768 }

추론 토큰은 출력 토큰으로 청구됩니다.

이미지 및 영상

사용자 메시지에서 텍스트와 함께 이미지와 동영상을 콘텐츠 부분으로 전달한 후, 그 내용이 무엇을 보여주는지 질문하세요. 한 요청에 여러 입력을 첨부할 수 있습니다:

{ "model": "qwen3-7-flash", "messages": [{"role": "user", "content": [ {"type": "text", "text": "이 두 스크린샷 사이에 무엇이 바뀌었나요?", {"type": "image_url", "image_url": {"url": "https://example.com/before.png"}}, {"type": "image_url", "image_url": {"url": "https://example.com/after.png"}} ]}] }

내장 도구

Qwen3.7 플래시는 웹 검색, URL 읽기 웹 추출기, 코드 해석기, text-to-image 및 image-to-image 검색을 포함하고 있습니다. 각각은 토글이며, 모델이 실제로 호출할 때만 청구됩니다. 웹 추출기와 코드 인터프리터는 사고 활성화가 필요합니다:

{ "model": "qwen3-7-flash", "messages": [{"role": "user", "content": "최신 릴리스에 어떤 것이 출시되었나요?"}], "tool_web_search": true }

도구가 실행될 때, 응답은 다음과 같이 전달됩니다. usage.tool_usage 토큰 카운트 옆에 매핑해서 정확히 어떤 토큰이 호출되었는지 감사할 수 있습니다.

구조화된 출력 및 함수 호출

사용 response_format 이름 * {"type": "json_object"} 유효한 JSON 객체를 강제로 입력하고, 전달합니다 도구 모델이 자신의 코드에 호출하고 싶을 때 표준 함수 호출을 위한 것입니다.

프롬프트 캐싱

반복되는 프롬프트 접두사는 자동으로 캐시되며, 캐시된 입력 토큰은 신선한 입력보다 훨씬 낮은 요금으로 청구됩니다. 여러 요청에 걸쳐 긴 공유 시스템 프롬프트나 문서 헤더를 보내면, 코드를 변경하지 않고도 그 할인을 받을 수 있습니다.

지역

기본 설정 qwen3-7-flash 싱가포르 배치 임무입니다. qwen3-7-flash:variant1 중국이 같은 모델을 더 낮은 비율로 도입하는 것입니다. 두 모델 모두 같은 파라미터를 사용하기 때문에 모델 필드만으로도 전환할 수 있습니다.

제품정보

Qwen3.7 플래시는 토큰당 요금제로 결제하는 방식입니다. 입력 및 출력 속도는 짧은 프롬프트에서는 하향, 매우 긴 프롬프트에서는 상승하며, 캐시된 입력 청구서는 할인된 요금으로 처리되며, 내장 도구는 실행 시 호출당 소액의 요금만 부과합니다. 실시간 요금을 확인하세요. Qwen3.7 플래시 모델 페이지 그리고 가격표, 그리고 다음에 대해 시도해 보세요. 뚱 베어·.

더 나은 엔드포인트를 사용할 준비가 되셨나요?

저희 모델을 탐색하시거나, 비즈니스 문의, 맞춤형 배포 또는 기타 어떤 사항이든 문의해 주세요.