Inicio Blog

Cómo usar la API MiMo V2.6

Portada del blog de la API MiMo V2.6

Sep 21, 2026

EmpirioLabs AI

La serie MiMo V2.6 de Xiaomi está disponible en EmpirioLabs. Tres modelos se combinan y los tres comparten la misma forma: una ventana de contexto de 1.048.576 tokens, comprensión nativa de imagen, vídeo y audio con salida de texto, razonamiento por defecto, llamada a funciones y salida JSON estructurada de hasta 131.072 tokens de salida.

Los tres modelos

  • mimo-v2-6-pro es el buque insignia de un billón de parámetros, diseñado para flujos de trabajo agentes, tareas a largo plazo e investigación.
  • mimo-v2-6-flash es el miembro de bajo coste, dirigido a llamadas de alta frecuencia y trabajo por lotes a gran escala.
  • mimo-v2-6-pro-ultraspeed Ofrece la misma calidad insignia a una velocidad de salida sustancialmente mayor, para trabajos sensibles a la latencia.

Lo que hacen los modelos

Los tres leen texto, imágenes, vídeo y audio en la misma petición y responden en texto, así que puedes enviar una captura de pantalla, un clip corto y una nota de voz junto a un prompt. El modo de pensar está activado por defecto y puede desactivarse por petición. La llamada de función y ambos modos JSON funcionan en la superficie estándar de completados de chat: un response_format de tipo json_object para cualquier objeto JSON, o un estricto json_schema Cuando necesitas una forma de respuesta exacta.

Los tres pueden buscar en la web y devolver una sección de Fuentes con la respuesta: MiMo V2.6 Pro y MiMo V2.6 Flash con búsqueda web nativa, y MiMo V2.6 Pro UltraSpeed con búsqueda web opcional en Linkup.

Cómo llamar a MiMo V2.6

Utiliza el endpoint de completación de chats compatible con OpenAI y establece modelo Al ID que quieres. Las partes de imagen, vídeo y audio utilizan los bloques de contenido estándar:

curl https://api.empiriolabs.ai/v1/chat/completions \ -H 'Autorización: Portador $EMPIRIOLABS_API_KEY' \ -H 'Tipo-Contenido: application/json' \ -d '{ "modelo": "mimo-v2-6-pro", "enable_thinking": true, "mensajes": [ { "rol": "usuario", "contenido": [ {"tipo": "texto", "texto": "¿Qué muestra este gráfico? Respuesta en dos frases."}, {"tipo": "image_url", "image_url": {"url": "https://example.com/chart.png"}} ] } ] }'

Notas operativas

  • Las imágenes muy pequeñas son rechazadas. Una imagen de prueba de 14 píxeles cuadrados aparece como un error genérico de solicitud inválida que no menciona el tamaño, mientras que la misma solicitud con un cuadrado de 64 píxeles tiene éxito. Envía iconos y muestras a una resolución razonable en lugar de su tamaño nativo.
  • La búsqueda web usa un control diferente en UltraSpeed. Toma de Flash MiMo V2.6 Pro y MiMo V2.6 tool_web_search; MiMo V2.6 Pro UltraSpeed toma web_search_linkup. Cuando mueves una solicitud entre modelos, envía la bandera que ese modelo acepta.
  • El razonamiento está activado por defecto y los tokens de razonamiento facturan como tokens de salida. Turn habilitar pensar Apagado por respuestas cortas, sensibles a la latencia.
  • La salida está limitada a 131.072 tokens. Solicitar más devuelve un error que indica el límite.

Precios

El uso de tokens se factura a una tasa de entrada publicada y una a una tasa de salida publicada por modelo, sin una tasa separada de entrada en caché. La búsqueda web añade una pequeña comisión por llamada solo cuando una búsqueda realmente se ejecuta, y la búsqueda nativa en MiMo V2.6 Pro y MiMo V2.6 Flash puede ejecutar más de una búsqueda en una sola petición. Ver la función en directo página modelo y página de precios para las tarifas actuales.

Empieza a construir

Prueba la serie en el Playground, leer el Documentación de la API, o compararlo con otros modelos en el Catálogo de modelos.

Divulgación: Este artículo fue escrito con asistencia AI y revisado por EmpirioLabs AI.

¿Listo para usar mejores endpoints?

Explora nuestros modelos o contáctanos para consultas empresariales, despliegues personalizados o cualquier otra cosa.