Casa Blog

Como Usar a API MiMo v2.6

Capa do blog da API MiMo V2.6

Sep 21, 2026

EmpirioLabs AI

A série MiMo V2.6 da Xiaomi está disponível na EmpirioLabs. Três modelos são fornecidos juntos, e todos compartilham a mesma forma: uma janela de contexto de 1.048.576 tokens, entendimento nativo de imagem, vídeo e áudio com saída de texto, raciocínio por padrão, chamada de função e saída JSON estruturada de até 131.072 tokens de saída.

Os três modelos

  • mimo-v2-6-pro é o navio principal de trilhões de parâmetros, projetado para fluxos de trabalho agentes, tarefas de longo prazo e pesquisa.
  • mimo-v2-6-flash é o membro de baixo custo, voltado para chamadas de alta frequência e trabalhos em lote em grande escala.
  • mimo-v2-6-pro-ultraspeed Atende à mesma qualidade de topo de linha com velocidade de saída substancialmente maior, para trabalhos sensíveis à latência.

O que os modelos fazem

Os três leem texto, imagens, vídeo e áudio no mesmo pedido e respondem no texto, então você pode enviar uma captura de tela, um clipe curto e uma nota de voz junto com um prompt. O modo de pensar está ativado por padrão e pode ser desativado por requisição. A chamada de função e ambos os modos JSON funcionam na superfície padrão de conclusão de chat: um response_format do tipo json_object para qualquer objeto JSON, ou um estrito json_schema Quando você precisa de uma forma exata de resposta.

Os três podem pesquisar na web e retornar uma seção de Fontes com a resposta: MiMo V2.6 Pro e MiMo V2.6 Flash com busca nativa na web, e MiMo V2.6 Pro UltraSpeed com busca opcional na web Linkup.

Como chamar o MiMo V2.6

Use o endpoint de conclusão de chat compatível com OpenAI e configure modelo Para o ID que você deseja. As partes de imagem, vídeo e áudio usam os blocos de conteúdo padrão:

curl https://api.empiriolabs.ai/v1/chat/completions \ -H 'Autorização: Portador $EMPIRIOLABS_API_KEY' \ -H 'Tipo-de-Conteúdo: application/json' \ -d '{ "modelo": "mimo-v2-6-pro", "enable_thinking": verdadeiro, "mensagens": [ { "função": "usuário", "conteúdo": [ {"tipo": "texto", "texto": "O que este gráfico mostra? Resposta em duas frases."}, {"tipo": "image_url", "image_url": {"url": "https://example.com/chart.png"}} ] } ] }'

Notas operacionais

  • Imagens muito pequenas são rejeitadas. Uma imagem de teste de quadrado de 14 pixels retorna como um erro genérico de solicitação inválida que não menciona o tamanho, enquanto a mesma solicitação com um quadrado de 64 pixels é bem-sucedida. Envie ícones e amostras com uma resolução razoável em vez do tamanho nativo.
  • A busca na web usa um controle diferente no UltraSpeed. Tomada do Flash do MiMo V2.6 Pro e MiMo V2.6 tool_web_search; MiMo V2.6 Pro UltraSpeed web_search_linkup. Quando você mover uma solicitação entre modelos, envie a flag que esse modelo aceita.
  • O raciocínio está ativado por padrão e os tokens de raciocínio são faturados como tokens de saída. Turn activar pensar Resumidamente, respostas sensíveis à latência.
  • A saída é limitada a 131.072 tokens. Solicitar mais retorna um erro nomeando o limite.

Preços

O uso do token é cobrado com uma taxa de entrada publicada e uma taxa de saída publicada por modelo, sem taxa separada de entrada em cache. A busca na web adiciona uma pequena taxa por chamada apenas quando a busca realmente é executada, e a busca nativa no MiMo V2.6 Pro e MiMo V2.6 Flash pode rodar mais de uma busca em uma única solicitação. Veja ao vivo página do modelo e página de preços Para as taxas atuais.

Comece a construir

Tente a série no Área de reprodução, ler Documentação da API, ou comparar com outros modelos na Catálogo de modelos.

Divulgação: Este artigo foi escrito com assistência de IA e revisado por EmpirioLabs IA.

Pronto para usar endpoints melhores?

Explore nossos modelos ou entre em contato conosco para consultas de negócios, implantações personalizadas ou qualquer outra coisa.