
Kimi K3 é o modelo principal de raciocínio da Moonshot, com contexto de token 1M, pensamento sempre ativo, busca nativa na web e entradas de texto, imagem e vídeo.
Kimi K3 é o modelo principal de raciocínio da Moonshot, com contexto de token 1M, pensamento sempre ativo, busca nativa na web e entradas de texto, imagem e vídeo.
Suporta entradas de texto, imagem e vídeo, chamadas de funções, saída estruturada de esquema JSON e busca web embutida cobrada a $0.015 por chamada invocada. O pensamento está sempre ligado com controle de reasoning_effort ajustável (máximo recomendado); tokens de raciocínio são anunciados como tokens de saída. A temperatura e outras substituições de amostragem são fixadas pelo serviço de modelo. A chamada de função em múltiplos passos deve reproduzir a mensagem assistente com seu campo de reasoning_content intacto. Controles explícitos de cache, lotes e ajustes finos não são suportados.
Também conhecido como Moonshot AI Kimi K3
kimi-k3/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/kimi-k3:generateContentmoonshotai/kimi-k3Tarifas pay-as-you-go ao vivo do catálogo EmpirioLabs. Você paga só pelo que usa, sem mínimo mensal.
Kimi K3 atende a API Chat Completions compatível com OpenAI. Aponte qualquer SDK OpenAI para https://api.empiriolabs.ai/v1 com sua chave de API EmpirioLabs e use o id de modelo kimi-k3. Obtenha uma chave de API no painel EmpirioLabs.
curl https://api.empiriolabs.ai/v1/chat/completions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "kimi-k3",
"messages": [
{"role": "user", "content": "Write a haiku about the ocean."}
]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.empiriolabs.ai/v1",
api_key="YOUR_EMPIRIOLABS_API_KEY",
)
response = client.chat.completions.create(
model="kimi-k3",
messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)Parâmetros de requisição suportados pela API Kimi K3 na EmpirioLabs. Os padrões valem quando um campo é omitido.
| Parâmetro | Tipo | Padrão | Intervalo / valores | Descrição |
|---|---|---|---|---|
| max_tokens | number | 32768 | 1 a 1048576 | Tokens de saída máximos. Os tokens de raciocínio contam para esse limite. |
| stop | string | - | - | Até 4 strings em que o modelo para de gerar mais tokens. |
| reasoning_effort | enum | max | low, high, max | Esforço de raciocínio do Kimi K3. Pensar está sempre presente. Esforço maior gasta mais tokens de raciocínio antes de responder. Max é recomendado e o padrão. |
| tool_web_search | boolean | false | - | Pesquise na internet por informações em tempo real. Adiciona $0.015 ao custo da solicitação para cada chamada de busca web invocada. |
| response_format | enum | - | - | Restringa a saída a JSON. Use o modo JSON para qualquer objeto JSON válido, ou esquema JSON para forçar a saída que corresponda a um esquema que você fornece. |
Suporta entradas de texto, imagem e vídeo com contexto de token de 1M, chamada de funções, saída estruturada de esquema JSON e busca web embutida a $0.015 por chamada invocada. Pensar está sempre ligado; A profundidade de raciocínio é ajustável com o controle reasoning_effort (o máximo é recomendado) e os tokens de raciocínio são faturados como tokens de saída. Temperatura e outras configurações de amostragem são fixadas pelo serviço de modelos. A função multi-etapa que chama pela API deve reproduzir a mensagem assistente com seu campo de reasoning_content intacto.
When this model invokes built-in tools inside a single request, the response carries a normalized usage.tool_usage map alongside the token counts. Tool counts are already factored into cost_usd and are surfaced for transparency.
Na EmpirioLabs, Kimi K3 é cobrado por uso: Entrada $3.00 por 1M de tokens de prompt; Saída $15.00 por 1M de tokens gerados; Pesquisa Web $0.015 por chamada quando invocada. A tabela de tarifas ao vivo desta página sempre corresponde ao que a API cobra.
Kimi K3 suporta uma janela de contexto de 1M tokens com até 131.072 tokens de saída por resposta.
Sim. Kimi K3 atende a API Chat Completions compatível com OpenAI, então SDKs OpenAI existentes funcionam apontando base_url para https://api.empiriolabs.ai/v1 e definindo o id de modelo kimi-k3.
Sim. O playground da EmpirioLabs executa Kimi K3 no navegador com os mesmos parâmetros que a API expõe, para você testar prompts antes de escrever código.
Crie uma conta EmpirioLabs e gere uma chave em API Keys no painel. A cobrança usa créditos pay-as-you-go, então você paga apenas pelas requisições que faz.
Confira nossos preços ou entre em contato se quiser que seu próprio modelo seja implementado em nossa pilha.