
Raciocínio de baixa custo, modalidade completa, com compreensão nativa de imagem, vídeo e áudio em um contexto de 1M, projetado para cargas de trabalho de produção em alta frequência.
Raciocínio de baixa custo, modalidade completa, com compreensão nativa de imagem, vídeo e áudio em um contexto de 1M, projetado para cargas de trabalho de produção em alta frequência.
Também conhecido como MiMo Flash, Xiaomi MiMo V2.6 Flash
mimo-v2-6-flash/v1/chat/completionsmimo-v2.6-flashmimo/v2.6-flashxiaomi/mimo-v2.6-flashTarifas pay-as-you-go ao vivo do catálogo EmpirioLabs. Você paga só pelo que usa, sem mínimo mensal.
MiMo V2.6 Flash atende a API Chat Completions compatível com OpenAI. Aponte qualquer SDK OpenAI para https://api.empiriolabs.ai/v1 com sua chave de API EmpirioLabs e use o id de modelo mimo-v2-6-flash. Obtenha uma chave de API no painel EmpirioLabs.
curl https://api.empiriolabs.ai/v1/chat/completions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "mimo-v2-6-flash",
"messages": [
{"role": "user", "content": "Write a haiku about the ocean."}
]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.empiriolabs.ai/v1",
api_key="YOUR_EMPIRIOLABS_API_KEY",
)
response = client.chat.completions.create(
model="mimo-v2-6-flash",
messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)Parâmetros de requisição suportados pela API MiMo V2.6 Flash na EmpirioLabs. Os padrões valem quando um campo é omitido.
| Parâmetro | Tipo | Padrão | Intervalo / valores | Descrição |
|---|---|---|---|---|
| enable_thinking | boolean | true | - | Ative o modo de pensamento estendido. Mais lento, mas melhora tarefas que exigem muito raciocínio. |
| tool_web_search | boolean | false | - | Pesquise na internet por informações em tempo real. Adiciona $0.015 ao custo da solicitação para cada chamada invocada. |
| web_search_force | boolean | false | - | Forçar o modelo a sempre fazer uma busca na web antes de responder. |
| web_search_max_keyword | number | 3 | 1 a 5 | Número máximo de consultas de busca que o modelo pode executar em uma única solicitação. Cada consulta é uma chamada separada de busca web. |
| web_search_limit | number | 5 | 1 a 10 | Número máximo de páginas web retornadas para cada consulta de busca. |
| temperature | number | 0.7 | 0 a 2 | Temperatura de amostragem. 0 = determinística, 2 = aleatoriedade máxima. |
| top_p | number | 0.9 | 0 a 1 | Amostragem do núcleo com a probabilidade de massa. Menor = mais focado. |
| max_tokens | number | 4096 | 1 a 131072 | Fichas máximas na resposta. |
| stop | string | - | - | Até 4 strings em que o modelo para de gerar mais tokens. |
| response_format | enum | - | - | Restringa a saída a JSON válido. Use o modo JSON para qualquer objeto JSON, ou forneça um Esquema JSON para forçar uma forma exata de resposta. |
| disable_formatting | boolean | false | - | Pule a formatação EmpirioLabs Markdown (citação [[N]](url) reescrita + bloco Referências quando a busca na web foi usada). A resposta bruta a montante com citações... |
A busca web ($0.015/call) é cobrada apenas quando invocada. Aceita entrada de texto, imagem, vídeo e áudio e retorna texto. O modo de pensar está ativado por padrão e pode ser desativado.
When this model invokes tools (web search, code interpreter, etc.) inside a single request, the response carries a normalized usage.tool_usage map alongside the token counts. The example below shows the shape, exact field names, units, and which tools appear can vary slightly per provider:
"usage": {
"prompt_tokens": 123,
"completion_tokens": 456,
"cost_usd": 0.0042,
"tool_usage": {"web_search": 3, "code_interpreter": 1}
}The tool counts are already factored into cost_usd, they are surfaced for transparency so you can audit per-tool billing. The field is omitted when no tools were invoked.
Na EmpirioLabs, MiMo V2.6 Flash é cobrado por uso: Entrada $0.14 por 1M de tokens de prompt; Saída $0.28 por 1M de tokens gerados; Pesquisa Web $0.015 por requisição quando ativado. A tabela de tarifas ao vivo desta página sempre corresponde ao que a API cobra.
MiMo V2.6 Flash suporta uma janela de contexto de 1M tokens com até 131.072 tokens de saída por resposta.
Sim. MiMo V2.6 Flash atende a API Chat Completions compatível com OpenAI, então SDKs OpenAI existentes funcionam apontando base_url para https://api.empiriolabs.ai/v1 e definindo o id de modelo mimo-v2-6-flash.
Sim. O playground da EmpirioLabs executa MiMo V2.6 Flash no navegador com os mesmos parâmetros que a API expõe, para você testar prompts antes de escrever código.
Crie uma conta EmpirioLabs e gere uma chave em API Keys no painel. A cobrança usa créditos pay-as-you-go, então você paga apenas pelas requisições que faz.
Confira nossos preços ou entre em contato se quiser que seu próprio modelo seja implementado em nossa pilha.