
Kimi K3는 1M 토큰 컨텍스트, 항상 연결된 사고, 네이티브 웹 검색, 텍스트, 이미지, 비디오 입력을 갖춘 Moonshot의 대표 추론 모델입니다.
Kimi K3는 1M 토큰 컨텍스트, 항상 연결된 사고, 네이티브 웹 검색, 텍스트, 이미지, 비디오 입력을 갖춘 Moonshot의 대표 추론 모델입니다.
텍스트, 이미지, 비디오 입력, 함수 호출, JSON 스키마 구조화 출력, 호출당 $0.015 요금으로 청구되는 내장 웹 검색 기능을 지원합니다. 생각은 항상 켜져 있고, 조절 가능한 reasoning_effort 컨트롤(최대 권장)이 있습니다; 추론 토큰은 출력 토큰으로 청구됩니다. 온도 및 기타 샘플링 오버라이드는 모델 서비스에 의해 결정됩니다. 다단계 함수 호출은 reasoning_content 필드가 온전한 상태로 조수 메시지를 재생해야 합니다. 명시적인 캐시 제어, 배치, 미세 조정은 지원되지 않습니다.
다른 이름 Moonshot AI Kimi K3
kimi-k3/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/kimi-k3:generateContentmoonshotai/kimi-k3EmpirioLabs 카탈로그의 실시간 종량제 요금입니다. 사용한 만큼만 결제하며 월 최소 요금이 없습니다.
Kimi K3은(는) OpenAI 호환 Chat Completions API를 제공합니다. 아무 OpenAI SDK나 EmpirioLabs API 키와 함께 https://api.empiriolabs.ai/v1로 지정하고 모델 ID kimi-k3를 사용하세요. EmpirioLabs 대시보드에서 API 키를 발급받으세요.
curl https://api.empiriolabs.ai/v1/chat/completions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "kimi-k3",
"messages": [
{"role": "user", "content": "Write a haiku about the ocean."}
]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.empiriolabs.ai/v1",
api_key="YOUR_EMPIRIOLABS_API_KEY",
)
response = client.chat.completions.create(
model="kimi-k3",
messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)EmpirioLabs에서 Kimi K3 API가 지원하는 요청 파라미터입니다. 필드를 생략하면 기본값이 적용됩니다.
| 파라미터 | 유형 | 기본값 | 범위 / 값 | 설명 |
|---|---|---|---|---|
| max_tokens | number | 32768 | 1 ~ 1048576 | 최대 출력 토큰. 추론 토큰은 이 한도에 포함됩니다. |
| stop | string | - | - | 최대 4개의 문자열에서 모델이 더 이상 토큰 생성을 멈춥니다. |
| reasoning_effort | enum | max | low, high, max | 키미 K3 추론 노력. 생각은 항상 켜져 있다. 노력이 많을수록 답변하기 전에 더 많은 추론 토큰을 소비합니다. 최대치가 권장되고 기본값입니다. |
| tool_web_search | boolean | false | - | 실시간 정보를 웹에서 검색하세요. 호출된 웹 검색 호출마다 요청 비용이 $0.015 증가합니다. |
| response_format | enum | - | - | 출력을 JSON으로 제한하세요. 유효한 JSON 객체에 대해 JSON 모드를 사용하거나, 제공한 스키마와 일치하는 출력 강제 JSON 스키마를 사용하세요. |
텍스트, 이미지, 비디오 입력과 1M 토큰 컨텍스트, 함수 호출, JSON 스키마 구조화 출력, 호출당 $0.015 내장된 웹 검색을 지원합니다. 항상 생각이 켜져 있다; 추론 깊이는 reasoning_effort 컨트롤로 조절 가능하며(최대 권장), 추론 토큰은 출력 토큰으로 청구됩니다. 온도 및 기타 샘플링 설정은 모델 서비스에 의해 정해집니다. API를 통한 다중 단계 함수 호출은 reasoning_content 필드가 그대로 있는 어시스턴트 메시지를 재생해야 합니다.
When this model invokes built-in tools inside a single request, the response carries a normalized usage.tool_usage map alongside the token counts. Tool counts are already factored into cost_usd and are surfaced for transparency.
EmpirioLabs에서 Kimi K3은(는) 종량제로 청구됩니다: 입력 $3.00 1M 프롬프트 토큰당; 제품정보 $15.00 생성된 토큰 1M 단위; 웹 검색 $0.015 호출 시 통화당. 이 페이지의 실시간 요금표는 항상 API 청구 금액과 일치합니다.
Kimi K3은(는) 1M 토큰 컨텍스트 윈도우를 지원합니다 (응답당 최대 131,072 출력 토큰).
네. Kimi K3은(는) OpenAI 호환 Chat Completions API를 제공하므로, 기존 OpenAI SDK에서 base_url을 https://api.empiriolabs.ai/v1로 지정하고 모델 ID를 kimi-k3로 설정하면 바로 동작합니다.
네. EmpirioLabs 플레이그라운드에서 API와 동일한 파라미터로 Kimi K3을(를) 브라우저에서 실행하므로 코드를 작성하기 전에 프롬프트를 테스트할 수 있습니다.
EmpirioLabs 계정을 만든 다음 대시보드의 API Keys에서 키를 생성하세요. 요금은 종량제 크레딧이라 실행한 요청에 대해서만 결제합니다.