Kimi K2.6 API

Kimi K2.6 é um modelo de raciocínio multimodal Moonshot com 256K de contexto, codificação forte e entradas de texto, imagem e vídeo.

Moonshot AIGeração de Texto256K contextoLançado 20 de abr. de 2026ChinaEndpoint proprietário

Sobre Kimi K2.6

Kimi K2.6 é um modelo de raciocínio multimodal Moonshot com 256K de contexto, codificação forte e entradas de texto, imagem e vídeo.

Suporta entradas de texto, imagem e vídeo, modo de pensamento por padrão, chamada de função e cache automático. Pesquisa web, saída estruturada, lotes e ajuste fino não são suportados.

Também conhecido como Moonshot AI Kimi K2.6, Kimi-K2.6, kimi-k2-6

reasoningfunction callingcachemultimodal

Especificações de Kimi K2.6

ID do modelo
kimi-k2-6
Provedor
Moonshot AI
Categoria
Geração de Texto
Lançado
20 de abr. de 2026
Janela de contexto
256K tokens
Saída máxima
16.000 tokens
Entrada
TextoImagemVídeo
Saída
Texto
Saída estruturada
JSON Schema
Região
China
Endpoints
POST/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/kimi-k2-6:generateContent

Preços da API Kimi K2.6Economize até 7%

Tarifas pay-as-you-go ao vivo do catálogo EmpirioLabs. Você paga só pelo que usa, sem mínimo mensal.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$0.95$0.8939
Saída
por tokens gerados 1M
$4.00$3.7131
Leu a 'cache' implícita
por fichas de entrada em cache de 1M
$0.1788
Web Search (Linkup)
per call when invoked
$0.013
Comparar na página completa de preços

Como chamar a API Kimi K2.6

Kimi K2.6 atende a API Chat Completions compatível com OpenAI. Aponte qualquer SDK OpenAI para https://api.empiriolabs.ai/v1 com sua chave de API EmpirioLabs e use o id de modelo kimi-k2-6. Obtenha uma chave de API no painel EmpirioLabs.

cURL
curl https://api.empiriolabs.ai/v1/chat/completions \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "kimi-k2-6",
    "messages": [
      {"role": "user", "content": "Write a haiku about the ocean."}
    ]
  }'
Python (OpenAI SDK)
from openai import OpenAI

client = OpenAI(
    base_url="https://api.empiriolabs.ai/v1",
    api_key="YOUR_EMPIRIOLABS_API_KEY",
)

response = client.chat.completions.create(
    model="kimi-k2-6",
    messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)
Referência completa da API Kimi K2.6

Parâmetros da API Kimi K2.6

Parâmetros de requisição suportados pela API Kimi K2.6 na EmpirioLabs. Os padrões valem quando um campo é omitido.

ParâmetroTipoPadrãoIntervalo / valoresDescrição
temperaturenumber0.70 a 2Temperatura de amostragem. 0 = determinística, 2 = aleatoriedade máxima.
top_pnumber0.90 a 1Amostragem do núcleo com a probabilidade de massa. Valores mais baixos tornam as saídas mais focadas.
max_tokensnumber40961 a 16000Tokens de saída máximos.
stopstring--Até 4 strings em que o modelo para de gerar mais tokens.
enable_thinkingbooleantrue-Ative o raciocínio antes de responder.
thinking_budgetnumber327681 a 81920Tokens máximos reservados para raciocínio quando o pensamento está ativado.
reasoning_effortenummediumnone, low, medium, high, maxNível de esforço de raciocínio. Nenhum impede o pensamento. orçamentos limitados de pensamento de conjuntos baixos, médios, altos e máximos, dimensionados para o...
response_formatenum--Restringa a saída a JSON. Use o modo JSON para qualquer objeto JSON válido, ou esquema JSON para forçar a saída que corresponda a um esquema que você fornece.
web_search_linkupbooleanfalse-Busca opcional na web alimentada pelo Linkup. Quando ativadas, fontes web recentes são recuperadas usando sua última mensagem de usuário como consulta e fornecidas ao modelo como contexto adicional. Adiciona $0.013 por chamada quando invocada, além do custo normal do token do modelo. Desativado por padrão.
disable_formattingbooleanfalse-Quando ativado, o gateway não adiciona o rodapé "Fontes" às respostas assistentes que usaram busca web do Linkup. Útil quando a saída do modelo é canalizada para...

API Kimi K2.6: perguntas frequentes

Quanto custa a API Kimi K2.6?

Na EmpirioLabs, Kimi K2.6 é cobrado por uso. A tabela de tarifas ao vivo desta página sempre corresponde ao que a API cobra.

Qual é a janela de contexto de Kimi K2.6?

Kimi K2.6 suporta uma janela de contexto de 256K tokens com até 16.000 tokens de saída por resposta.

A API Kimi K2.6 é compatível com OpenAI?

Sim. Kimi K2.6 atende a API Chat Completions compatível com OpenAI, então SDKs OpenAI existentes funcionam apontando base_url para https://api.empiriolabs.ai/v1 e definindo o id de modelo kimi-k2-6.

Posso testar Kimi K2.6 no navegador antes de integrar?

Sim. O playground da EmpirioLabs executa Kimi K2.6 no navegador com os mesmos parâmetros que a API expõe, para você testar prompts antes de escrever código.

Como consigo uma chave de API Kimi K2.6?

Crie uma conta EmpirioLabs e gere uma chave em API Keys no painel. A cobrança usa créditos pay-as-you-go, então você paga apenas pelas requisições que faz.

Pronto para usar endpoints melhores?

Confira nossos preços ou entre em contato se quiser que seu próprio modelo seja implementado em nossa pilha.