
Kimi K2.7 Code Highspeed é a camada de serviço mais rápido do modelo de codificação agente da Moonshot, com contexto de 256K, raciocínio sempre ativo e entrada de imagem e vídeo.
Kimi K2.7 Code Highspeed é a camada de serviço mais rápido do modelo de codificação agente da Moonshot, com contexto de 256K, raciocínio sempre ativo e entrada de imagem e vídeo.
O nível de serviço mais rápido do Kimi K2.7 Code. Suporta entradas de texto, imagem e vídeo, chamadas de funções, saída estruturada em modo JSON e busca web embutida cobrada a $0.015 por chamada invocada. O pensamento está sempre ligado e os tokens de raciocínio são anunciados como tokens de saída. Substituições de temperatura e outras amostragens são ignoradas porque o serviço de modelo usa configurações fixas de amostragem. A chamada de função em múltiplos passos deve reproduzir a mensagem assistente com seu campo de reasoning_content intacto. Controles explícitos de cache, lotes e ajustes finos não são suportados.
Também conhecido como Moonshot AI Kimi K2.7 Code Highspeed
kimi-k2-7-code-highspeed/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/kimi-k2-7-code-highspeed:generateContentkimi-k2.7-code-highspeedmoonshotai/kimi-k2-7-code-highspeedmoonshotai/kimi-k2.7-code-highspeedTarifas pay-as-you-go ao vivo do catálogo EmpirioLabs. Você paga só pelo que usa, sem mínimo mensal.
Kimi K2.7 Code Highspeed atende a API Chat Completions compatível com OpenAI. Aponte qualquer SDK OpenAI para https://api.empiriolabs.ai/v1 com sua chave de API EmpirioLabs e use o id de modelo kimi-k2-7-code-highspeed. Obtenha uma chave de API no painel EmpirioLabs.
curl https://api.empiriolabs.ai/v1/chat/completions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "kimi-k2-7-code-highspeed",
"messages": [
{"role": "user", "content": "Write a haiku about the ocean."}
]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.empiriolabs.ai/v1",
api_key="YOUR_EMPIRIOLABS_API_KEY",
)
response = client.chat.completions.create(
model="kimi-k2-7-code-highspeed",
messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)Parâmetros de requisição suportados pela API Kimi K2.7 Code Highspeed na EmpirioLabs. Os padrões valem quando um campo é omitido.
| Parâmetro | Tipo | Padrão | Intervalo / valores | Descrição |
|---|---|---|---|---|
| max_tokens | number | 16384 | 1 a 131072 | Tokens de saída máximos. Os tokens de raciocínio contam para esse limite. |
| stop | string | - | - | Até 4 strings em que o modelo para de gerar mais tokens. |
| tool_web_search | boolean | false | - | Pesquise na internet por informações em tempo real. Adiciona $0.015 ao custo da solicitação para cada chamada de busca web invocada. |
| response_format | enum | - | - | Restringa a saída a JSON. Use o modo JSON para qualquer objeto JSON válido, ou esquema JSON para forçar a saída que corresponda a um esquema que você fornece. |
O nível de serviço mais rápido do Kimi K2.7 Code. Suporta entradas de texto, imagem e vídeo com contexto de 256K, chamada de funções, saída estruturada em modo JSON e busca web embutida a $0.015 por chamada invocada. O pensamento está sempre ligado e não pode ser desativado; tokens de raciocínio são anunciados como tokens de saída. Substituições de temperatura e outras amostragens são ignoradas porque o serviço de modelo usa configurações fixas de amostragem. A função multi-etapa que chama pela API deve reproduzir a mensagem assistente com seu campo de reasoning_content intacto.
When this model invokes built-in tools inside a single request, the response carries a normalized usage.tool_usage map alongside the token counts. Tool counts are already factored into cost_usd and are surfaced for transparency.
Na EmpirioLabs, Kimi K2.7 Code Highspeed é cobrado por uso: Entrada $1.90 por 1M de tokens de prompt; Saída $8.00 por 1M de tokens gerados; Pesquisa Web $0.015 por chamada quando invocada. A tabela de tarifas ao vivo desta página sempre corresponde ao que a API cobra.
Kimi K2.7 Code Highspeed suporta uma janela de contexto de 256K tokens com até 131.072 tokens de saída por resposta.
Sim. Kimi K2.7 Code Highspeed atende a API Chat Completions compatível com OpenAI, então SDKs OpenAI existentes funcionam apontando base_url para https://api.empiriolabs.ai/v1 e definindo o id de modelo kimi-k2-7-code-highspeed.
Sim. O playground da EmpirioLabs executa Kimi K2.7 Code Highspeed no navegador com os mesmos parâmetros que a API expõe, para você testar prompts antes de escrever código.
Crie uma conta EmpirioLabs e gere uma chave em API Keys no painel. A cobrança usa créditos pay-as-you-go, então você paga apenas pelas requisições que faz.
Confira nossos preços ou entre em contato se quiser que seu próprio modelo seja implementado em nossa pilha.