Precios

Paga según la marcha, o elige un plan con asignaciones semanales.

Catálogo de precios

Precios de modelos de IA as-you-go de pago.

El precio de EmpirioLabs varía según el modelo y la unidad: tokens, imágenes, segundos de audio o vídeo, mensajes, recursos 3D y solicitudes de búsqueda. La tabla interactiva de precios carga el catálogo actual, mientras que estas tarifas representativas permanecen legibles sin JavaScript del cliente.

Documentación de modelo abierto

Las tarifas de la API de modelos se muestran y se facturan en USD. El checkout puede mostrar métodos de pago locales cuando sean elegibles.

Kling 3.0 Turbo

Kling AILanzado 17 jun 2026Generacion de video
Endpoint propietario

Texto a video e imagen a video con audio nativo sincronizado, en 720p o 1080p durante 3 a 15 segundos, con control de relacion de aspecto y prompt.

Tipo
Especificación
Tarifa
720p
por segundo
$0.18
1080p
por segundo
$0.225

GLM 5.2

Z.aiSingaporeLanzado 16 jun 2026Ctx 1MGeneracion de texto
Endpoint propietario

Modelo de razonamiento y codigo con contexto de 1M de tokens, salida de 128K, esfuerzo de razonamiento ajustable, busqueda web nativa y llamadas a herramientas.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$1.40
Salida
por 1M de tokens generados
$4.40
Búsqueda web
por solicitud
$0.033

GLM 5.2

Z.aiGermanyLanzado 16 jun 2026Ctx 1MGeneracion de texto
Endpoint propietario
Save up to 21%

Modelo de razonamiento y codigo con contexto de 1M de tokens, salida de 128K, esfuerzo de razonamiento ajustable, busqueda web nativa y llamadas a herramientas.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$1.40$1.10
Producto
por 1M de tokens generados
$4.40$3.851
Caché implícita
por fichas de entrada en caché de 1M
$0.275
Búsqueda web (Linkup)
por llamada cuando se invoca
$0.013

Kimi K3

Moonshot AIInternationalLanzado 15 jul 2026Ctx 1MGeneracion de texto
Endpoint propietario

Kimi K3 es el modelo de razonamiento insignia de Moonshot con un contexto de token de 1M, pensamiento siempre activo, búsqueda web nativa y entradas de texto, imagen y vídeo.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$3.00
Producto
por 1M de tokens generados
$15.00
Búsqueda web
por llamada cuando se invoca
$0.015

Muse Spark 1.2

Meta AILanzado 5 ago 2026Ctx 1MGeneracion de texto
Endpoint propietario

El modelo de razonamiento fronterizo actualizado de Meta con un contexto de 1.048.576 tokens, conocimiento de imagen, vídeo, audio y PDF, búsqueda web y uso de herramientas.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$1.25
Producto
por 1M de tokens generados
$4.25
Caché implícita
por fichas de entrada en caché de 1M
$1.00
Búsqueda web
por consulta de búsqueda
$0.00825

Kimi K2.7 Code

Moonshot AIInternationalLanzado 16 jun 2026Ctx 256KGeneracion de texto
Endpoint propietario

Kimi K2.7 Code es el modelo de codigo agentico de un billon de parametros de Moonshot, con contexto de 256K, razonamiento siempre activo y entradas de texto, imagen y video.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$0.95
Salida
por 1M de tokens generados
$4.00
Busqueda web
por llamada cuando se invoca
$0.015

Kimi K2.7 Code

Moonshot AIGermanyLanzado 16 jun 2026Ctx 256KGeneracion de texto
Endpoint propietario
Save up to 7%

Kimi K2.7 Code es el modelo de codigo agentico de un billon de parametros de Moonshot, con contexto de 256K, razonamiento siempre activo y entradas de texto, imagen y video.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$0.95$0.8939
Producto
por 1M de tokens generados
$4.00$3.7131
Caché implícita
por fichas de entrada en caché de 1M
$0.1788
Búsqueda web (Linkup)
por llamada cuando se invoca
$0.013

Muse Spark 1.1

Meta AILanzado 9 jul 2026Ctx 1MGeneracion de texto
Endpoint propietario

Modelo de razonamiento metafrontera con un contexto de 1.048.576 tokens más comprensión de imagen, vídeo, audio y PDF, búsqueda web y uso de herramientas.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$1.25
Producto
por 1M de tokens generados
$4.25
Caché implícita
por fichas de entrada en caché de 1M
$1.00
Búsqueda web
por consulta de búsqueda
$0.00825

Fugu Ultra v1.1

Sakana AILanzado 23 jul 2026Ctx 1MGeneracion de texto
Endpoint propietario

Conductor multiagente actualizado para razonamiento duro, codificación e investigación, con esfuerzo máximo diferenciado, contexto 1M, entrada de imagen y búsqueda web.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
<=272K $5.00>272K $10.00
Producto
por 1M de tokens generados
<=272K $30.00>272K $45.00
Caché implícita
por fichas de entrada en caché de 1M
<=272K $0.50>272K $1.00

Qwen3.7 Plus

Alibaba CloudSingaporeLanzado 1 jun 2026Ctx 1MGeneracion de texto
Endpoint propietario

Modelo de visión Qwen3.7 rentable para texto, imagen, vídeo, codificación, uso de herramientas, comprensión de la interfaz gráfica y flujos de trabajo de contexto 1M.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
<=256K $0.40256K-1M $1.20
Producto
por 1M de tokens generados
<=256K $1.60256K-1M $4.80
Búsqueda web
por llamada cuando se invoca
$0.03
Búsqueda de texto a imagen
por llamada cuando se invoca
$0.03
Búsqueda imagen a imagen
por llamada cuando se invoca
$0.03
Extractor de telarañas
por llamada cuando se invoca
$0.00
Intérprete de código
por llamada cuando se invoca
$0.00

Qwen3.7 Plus

Alibaba CloudChinaLanzado 1 jun 2026Ctx 1MGeneracion de texto
Endpoint propietario
Save up to 31%

Modelo de visión Qwen3.7 rentable para texto, imagen, vídeo, codificación, uso de herramientas, comprensión de la interfaz gráfica y flujos de trabajo de contexto 1M.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$0.40<=256K $0.276$1.20256K-1M $0.826
Producto
por 1M de tokens generados
$1.60<=256K $1.101$4.80256K-1M $3.301
Caché implícita
por cada 1M de tokens de prompt almacenados en caché
$0.08<=256K $0.056$0.24256K-1M $0.166
Búsqueda web
por llamada cuando se invoca
$0.01
Búsqueda de texto a imagen
por llamada cuando se invoca
$0.01
Búsqueda imagen a imagen
por llamada cuando se invoca
$0.01
Extractor de telarañas
por llamada cuando se invoca
$0.00
Intérprete de código
por llamada cuando se invoca
$0.00

Kimi K2.7 Code Highspeed

Moonshot AIInternationalLanzado 16 jun 2026Ctx 256KGeneracion de texto
Endpoint propietario

Kimi K2.7 Code Highspeed es la capa de servicio más rápido del modelo de codificación agente de Moonshot, con contexto de 256K, razonamiento siempre activado y entrada de imagen y vídeo.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$1.90
Producto
por 1M de tokens generados
$8.00
Búsqueda web
por llamada cuando se invoca
$0.015

Fugu Ultra v1.0

Sakana AILanzado 21 jun 2026Ctx 1MGeneracion de texto
Endpoint propietario

Conductor multiagente original para razonamiento duro, codificación e investigación, con contexto 1M, entrada de imágenes, llamada a funciones y búsqueda web.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
<=272K $7.50>272K $15.00
Producto
por 1M de tokens generados
<=272K $45.00>272K $67.50
Caché implícita
por fichas de entrada en caché de 1M
<=272K $1.50>272K $3.00

Qwen3.7 Flash

Alibaba CloudSingaporeLanzado 15 jul 2026Ctx 1MGeneracion de texto
Endpoint propietario

Modelo de lenguaje visual Fast Qwen3.7 para texto, imagen, vídeo, uso de herramientas y tareas agentes, con caché implícita y un contexto de token de 1M.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
<=32K $0.0332K-256K $0.10256K-1M $0.20
Producto
por 1M de tokens generados
<=32K $0.1332K-256K $0.40256K-1M $0.80
Caché implícita
por fichas de entrada en caché de 1M
<=32K $0.00632K-256K $0.02256K-1M $0.04
Búsqueda web
por llamada cuando se invoca
$0.03
Búsqueda de texto a imagen
por llamada cuando se invoca
$0.03
Búsqueda imagen a imagen
por llamada cuando se invoca
$0.03
Extractor de telarañas
por llamada cuando se invoca
$0.00
Intérprete de código
por llamada cuando se invoca
$0.00

Qwen3.7 Flash

Alibaba CloudChinaLanzado 15 jul 2026Ctx 1MGeneracion de texto
Endpoint propietario
Save up to 18%

Modelo de lenguaje visual Fast Qwen3.7 para texto, imagen, vídeo, uso de herramientas y tareas agentes, con caché implícita y un contexto de token de 1M.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$0.03<=32K $0.028$0.1032K-256K $0.083$0.20256K-1M $0.165
Producto
por 1M de tokens generados
$0.13<=32K $0.11$0.4032K-256K $0.33$0.80256K-1M $0.66
Caché implícita
por fichas de entrada en caché de 1M
<=32K $0.006$0.0232K-256K $0.017$0.04256K-1M $0.033
Búsqueda web
por llamada cuando se invoca
$0.01
Búsqueda de texto a imagen
por llamada cuando se invoca
$0.01
Búsqueda imagen a imagen
por llamada cuando se invoca
$0.01
Extractor de telarañas
por llamada cuando se invoca
$0.00
Intérprete de código
por llamada cuando se invoca
$0.00

MiniMax M3

MiniMaxSingaporeLanzado 1 jun 2026Ctx 1MGeneracion de texto
Endpoint propietario
Save up to 25%

MiniMax M3 es un modelo de razonamiento multimodal para codificación, agentes y análisis de contexto largo con entrada de texto, imagen y vídeo.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$0.30<=512K $0.225$0.60>512K $0.45
Producto
por 1M de tokens generados
$1.20<=512K $0.90$2.40>512K $1.80
Caché implícita
por fichas de entrada en caché de 1M
$0.06<=512K $0.045$0.12>512K $0.09
Búsqueda web (Linkup)
por llamada cuando se invoca
$0.013

MiniMax M3

MiniMaxSingaporeLanzado 1 jun 2026Ctx 1MGeneracion de texto
Endpoint propietario
Save up to 25%

MiniMax M3 es un modelo de razonamiento multimodal para codificación, agentes y análisis de contexto largo con entrada de texto, imagen y vídeo.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$0.45<=512K $0.3375$0.90>512K $0.675
Producto
por 1M de tokens generados
$1.80<=512K $1.35$3.60>512K $2.70
Caché implícita
por fichas de entrada en caché de 1M
$0.09<=512K $0.0675$0.18>512K $0.135
Búsqueda web (Linkup)
por llamada cuando se invoca
$0.013

Qwen3.7 Max

Alibaba CloudSingaporeLanzado 21 may 2026Ctx 1MGeneracion de texto
Endpoint propietario

Qwen3.7 Max es un modelo de texto emblemático para programación, productividad, agentes de larga duración, pensamiento profundo, herramientas y contexto de 1M de tokens.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$2.50
Producto
por 1M de tokens generados
$7.50
Búsqueda web
por llamada cuando se invoca
$0.02
Extractor de telarañas
por llamada cuando se invoca
$0.02
Intérprete de código
por llamada cuando se invoca
$0.02

Qwen3.7 Max

Alibaba CloudChinaLanzado 21 may 2026Ctx 1MGeneracion de texto
Endpoint propietario
Save up to 34%

Qwen3.7 Max es un modelo de texto emblemático para programación, productividad, agentes de larga duración, pensamiento profundo, herramientas y contexto de 1M de tokens.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$2.50$1.65
Producto
por 1M de tokens generados
$7.50$4.951
Búsqueda web
por llamada cuando se invoca
$0.01
Extractor de telarañas
por llamada cuando se invoca
$0.01
Intérprete de código
por llamada cuando se invoca
$0.01

Qwen3.8 Max

Alibaba CloudSingaporeLanzado 3 ago 2026Ctx 1MGeneracion de texto
Endpoint propietario

Buque insignia del MoE a escala de billones para programación, agentes a largo plazo y trabajo profesional, con comprensión de imagen y vídeo en un contexto de 1M-token.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$2.00
Producto
por 1M de tokens generados
$6.00
Búsqueda web
por llamada cuando se invoca
$0.02
Búsqueda de texto a imagen
por llamada cuando se invoca
$0.02
Búsqueda imagen a imagen
por llamada cuando se invoca
$0.02
Extractor de telarañas
por llamada cuando se invoca
$0.00
Intérprete de código
por llamada cuando se invoca
$0.00

Qwen3.8 Max

Alibaba CloudChinaLanzado 3 ago 2026Ctx 1MGeneracion de texto
Endpoint propietario
Save up to 18%

Buque insignia del MoE a escala de billones para programación, agentes a largo plazo y trabajo profesional, con comprensión de imagen y vídeo en un contexto de 1M-token.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$2.00$1.65
Producto
por 1M de tokens generados
$6.00$4.951
Búsqueda web
por llamada cuando se invoca
$0.01
Búsqueda de texto a imagen
por llamada cuando se invoca
$0.01
Búsqueda imagen a imagen
por llamada cuando se invoca
$0.01
Extractor de telarañas
por llamada cuando se invoca
$0.00
Intérprete de código
por llamada cuando se invoca
$0.00

ACE-Step 1.5 XL

ACE-StepLanzado 2 abr 2026Generación de audio
Inferencia nativa
Save up to 17%

Modelo de generación musical de código abierto para audio guiado por text-to-song y letras, con inferencia XL Turbo rápida de 8 pasos para iteraciones controlables de canciones.

Tipo
Especificación
Tarifa
Generación musical
por segundo generado
$0.0003$0.00025

FLUX.2 Klein 4B

Black Forest LabsLanzado 15 ene 2026Generación de imágenes
Inferencia nativa
Save up to 39%

Modelo de generación y edición de imágenes 4B FLUX.2 Klein con licencia apache con soporte de text-to-image, edición de imágenes de referencia y flujo de trabajo creativo.

Tipo
Especificación
Tarifa
Generación de imágenes
por imagen
$0.014$0.0085

MiniMax M2.7 Highspeed

MiniMaxSingaporeLanzado 18 mar 2026Ctx 200KGeneracion de texto
Endpoint propietario
Save up to 50%

Variante M2.7 de alta velocidad ajustada para una inferencia rápida con un alto rendimiento de propósito general y grandes capacidades agentes.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$0.60$0.30
Producto
por 1M de tokens generados
$2.40$1.20
Caché implícita
por fichas de entrada en caché de 1M
$0.06$0.03
Búsqueda web (Linkup)
por llamada cuando se invoca
$0.013

TTS 2

InworldLanzado 5 may 2026Generación de audio
Endpoint propietario
Save up to 12%

Modelo de voz en tiempo real con dirección de voz en inglés sencillo, una identidad de voz en 100+ idiomas y time-to-first-audio de streaming por debajo de 200 ms.

Tipo
Especificación
Tarifa
Síntesis
por 1M de caracteres
$25.00$22.00

TTS 1.5 Mini

InworldLanzado 21 ene 2026Generación de audio
Endpoint propietario
Save up to 30%

Síntesis de voz TTFB por debajo de 130 ms con 271+ voces en 15 idiomas, prosodia expresiva y streaming SSE en tiempo real para agentes de voz de baja latencia.

Tipo
Especificación
Tarifa
Síntesis
por 1M de caracteres
$25.00$17.50

TTS 1.5 Max

InworldLanzado 21 ene 2026Generación de audio
Endpoint propietario
Save up to 15%

Síntesis de voz de calidad de emisión con prosodia expresiva rica, 271+ voces en 15 idiomas y transmisión SSE en tiempo real con marcas de tiempo por palabra.

Tipo
Especificación
Tarifa
Síntesis
por 1M de caracteres
$35.00$29.75

GLM 5.1

Z.aiChinaLanzado 7 abr 2026Ctx 202KGeneracion de texto
Endpoint propietario
Save up to 41%

Modelo de razonamiento de IA Zhipu de largo contexto con contexto 202K, salida 128K, llamada a herramientas, salida estructurada y soporte para caché.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$1.40<=32K $0.825$1.4032K-200K $1.10
Producto
por 1M de tokens generados
$4.40<=32K $3.301$4.4032K-200K $3.851
Caché implícita
por fichas de entrada en caché de 1M
$0.26<=32K $0.165$0.2632K-200K $0.22
Búsqueda web (Linkup)
por llamada cuando se invoca
$0.013

Kimi K2.6

Moonshot AIChinaLanzado 20 abr 2026Ctx 256KGeneracion de texto
Endpoint propietario
Save up to 7%

Kimi K2.6 es un modelo de razonamiento multimodal Moonshot con contexto 256K, codificación fuerte y entradas de texto, imagen y vídeo.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$0.95$0.8939
Producto
por 1M de tokens generados
$4.00$3.7131
Caché implícita
por fichas de entrada en caché de 1M
$0.1788
Búsqueda web (Linkup)
por llamada cuando se invoca
$0.013

DeepSeek V4 Flash 0731

DeepSeekGermanyLanzado 31 jul 2026Ctx 1MGeneracion de texto
Endpoint propietario

Versión 0731 post-entrenada con grandes avances en codificación, trabajo de repositorio, uso de herramientas y tareas full-stack, además de una ventana contextual de 1M.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$0.14
Producto
por 1M de tokens generados
$0.28
Búsqueda web (Linkup)
por llamada cuando se invoca
$0.013

MiniMax M2.7

MiniMaxSingaporeLanzado 18 mar 2026Ctx 200KGeneracion de texto
Endpoint propietario
Save up to 50%

MiniMax M2.7 es un modelo de chat de razonamiento de propósito general con pensamiento entrelazado, llamadas a funciones y caché de prompts.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$0.30$0.15
Producto
por 1M de tokens generados
$1.20$0.60
Caché implícita
por fichas de entrada en caché de 1M
$0.06$0.03
Búsqueda web (Linkup)
por llamada cuando se invoca
$0.013

TRELLAS.2 4B

MicrosoftGeneración 3D
Inferencia nativa
Save up to 90%

TRELLIS.2 modelo de imagen a 3D que convierte una imagen de referencia en un recurso GLB texturizado con controles de resolución, semilla, malla, textura y exportación.

Tipo
Especificación
Tarifa
Activo 512
por solicitud
$0.25$0.025
Activo 1024
por solicitud
$0.30$0.249
Activo de 1536
por solicitud
$0.499

Qwen3.5 122B-A10B

Alibaba CloudChinaLanzado 24 feb 2026Ctx 256KGeneracion de texto
Endpoint propietario
Save up to 71%

Qwen3.5 122B-A10B es un modelo de razonamiento multimodal con contexto de 256K, inferencia eficiente y escasa de MoE, y entrada de texto, imagen y vídeo.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$0.40<=128K $0.115$0.40128K-256K $0.287
Producto
por 1M de tokens generados
$3.20<=128K $0.917$3.20128K-256K $2.294
Búsqueda web
por llamada cuando se invoca
$0.01

Qwen3.5 397B-A17B

Alibaba CloudChinaLanzado 16 feb 2026Ctx 256KGeneracion de texto
Endpoint propietario
Save up to 71%

Qwen3.5 397B-A17B es un modelo de razonamiento multimodal emblemático para lenguaje, código, agentes, tareas de interfaz gráfica y comprensión de imágenes y vídeos.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$0.60<=128K $0.172$0.60128K-256K $0.43
Producto
por 1M de tokens generados
$3.60<=128K $1.032$3.60128K-256K $2.58
Búsqueda web
por llamada cuando se invoca
$0.01

Qwen3.5 35B-A3B

Alibaba CloudChinaLanzado 24 feb 2026Ctx 256KGeneracion de texto
Endpoint propietario
Save up to 77%

Qwen3.5 35B-A3B es un modelo nativo de visión y lenguaje eficiente con un enrutamiento MoE escaso, pensamiento profundo y entrada de texto, imagen y vídeo.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$0.25<=128K $0.057$0.25128K-256K $0.229
Producto
por 1M de tokens generados
$2.00<=128K $0.459$2.00128K-256K $1.835
Búsqueda web
por llamada cuando se invoca
$0.01

Qwen3.5 27B

Alibaba CloudChinaLanzado 24 feb 2026Ctx 256KGeneracion de texto
Endpoint propietario
Save up to 71%

Qwen3.5 27B es un modelo de razonamiento multimodal denso con respuestas rápidas, contexto 256K y comprensión de texto, imagen y vídeo.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$0.30<=128K $0.086$0.30128K-256K $0.258
Producto
por 1M de tokens generados
$2.40<=128K $0.688$2.40128K-256K $2.064
Búsqueda web
por llamada cuando se invoca
$0.01

Qwen3.6 27B

Alibaba CloudChinaLanzado 22 abr 2026Ctx 256KGeneracion de texto
Endpoint propietario
Save up to 31%

Qwen3.6 27B mejora la codificación agente, el razonamiento STEM, la visión espacial, el OCR y la comprensión de texto, imagen y vídeo en contexto 256K.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$0.60$0.412564
Producto
por 1M de tokens generados
$3.60$2.475384
Búsqueda web
por llamada cuando se invoca
$0.01

Qwen3.6 Flash

Alibaba CloudSingaporeLanzado 16 abr 2026Ctx 1MGeneracion de texto
Endpoint propietario

Modelo de visión Fast Qwen3.6 para codificación agente, razonamiento matemático, comprensión espacial, OCR, y entrada de texto, imagen y vídeo.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
<=256K $0.25256K-1M $1.00
Producto
por 1M de tokens generados
<=256K $1.50256K-1M $4.00
Búsqueda web
por llamada cuando se invoca
$0.02

Qwen3.6 Flash

Alibaba CloudChinaLanzado 16 abr 2026Ctx 1MGeneracion de texto
Endpoint propietario
Save up to 34%

Modelo de visión Fast Qwen3.6 para codificación agente, razonamiento matemático, comprensión espacial, OCR, y entrada de texto, imagen y vídeo.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$0.25<=256K $0.165$1.00256K-1M $0.66
Producto
por 1M de tokens generados
$1.50<=256K $0.99$4.00256K-1M $3.961
Búsqueda web
por llamada cuando se invoca
$0.01

Gemma 4 26B-A4B

GoogleLanzado 31 mar 2026Ctx 256KGeneracion de texto
Inferencia nativa
Save up to 83%

Gemma 4 26B A4B es un modelo multimodal abierto de Google con 256K de contexto, texto, imagen y entrada de vídeo, herramientas y salida estructurada.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$0.15$0.05
Producto
por 1M de tokens generados
$0.50$0.29
Caché implícita
por fichas de entrada en caché de 1M
$0.15$0.025
Búsqueda web (Linkup)
por llamada cuando se invoca
$0.013

Qwen3.5 9B

Alibaba CloudLanzado 23 feb 2026Ctx 256KGeneracion de texto
Inferencia nativa
Save up to 13%

Qwen3.5 9B es un modelo de razonamiento multimodal compacto con 256K de contexto, entrada de imagen y vídeo, herramientas funcionales y salida estructurada.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$0.10$0.09
Producto
por 1M de tokens generados
$0.15$0.13
Caché implícita
por fichas de entrada en caché de 1M
$0.045
Búsqueda web (Linkup)
por llamada cuando se invoca
$0.013

Qwen3.5 4B

Alibaba CloudLanzado 2 mar 2026Ctx 256KGeneracion de texto
Inferencia nativa

Qwen3.5 4B es un modelo de razonamiento multimodal de bajo coste con 256K de contexto, entrada de imagen y vídeo, herramientas funcionales y salida estructurada.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$0.04
Producto
por 1M de tokens generados
$0.07
Caché implícita
por fichas de entrada en caché de 1M
$0.02
Búsqueda web (Linkup)
por llamada cuando se invoca
$0.013

Qwen3.6 35B A3B

Alibaba CloudLanzado 16 abr 2026Ctx 128KGeneracion de texto
Inferencia nativa
Save up to 72%

Qwen3.6 35B A3B es un modelo de razonamiento mixture-of-experts experto en 256 con 128K de contexto, herramientas funcionales y salida JSON estrictamente estructurada.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$0.248$0.07
Producto
por 1M de tokens generados
$1.485$0.42
Caché implícita
por fichas de entrada en caché de 1M
$0.035
Búsqueda web (Linkup)
por llamada cuando se invoca
$0.013

GLM 4.7 Flash

Z.aiSingaporeLanzado 19 ene 2026Ctx 200KGeneracion de texto
Endpoint propietario

Modelo de texto GLM-4.7 gratuito y ligero para codificación, razonamiento, escritura en contexto largo y chat general.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
Gratis
Producto
por 1M de tokens generados
Gratis
Caché implícita
por fichas de entrada en caché de 1M
Gratis
Búsqueda web
por solicitud cuando esté habilitada
$0.033

GLM 4.5 Flash

Z.aiSingaporeLanzado 28 jul 2025Ctx 200KGeneracion de texto
Endpoint propietario

Modelo de texto GLM-4.5 gratuito y ligero para razonamiento, programación, chat de formato largo y tareas generales de lenguaje.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
Gratis
Producto
por 1M de tokens generados
Gratis
Caché implícita
por fichas de entrada en caché de 1M
Gratis
Búsqueda web
por solicitud cuando esté habilitada
$0.033

GLM 4.6V Flash

Z.aiSingaporeLanzado 8 dic 2025Ctx 128KGeneracion de texto
Endpoint propietario

Modelo multimodal gratuito de GLM-4.6V para comprensión de imágenes, vídeos, archivos y texto con llamada a funciones nativas.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
Gratis
Producto
por 1M de tokens generados
Gratis
Caché implícita
por fichas de entrada en caché de 1M
Gratis
Búsqueda web
por solicitud cuando esté habilitada
$0.033

Amazon Nova Canvas

AmazonLanzado 3 dic 2024Generación de imágenes
Endpoint propietario

La generación y edición de imágenes modela creando y modificando imágenes a partir de texto o entradas de imagen, con inpainting, prueba virtual y controles de estilo.

Tipo
Especificación
Tarifa
Estándar Pequeño (≤1024×1024)
por imagen
$0.12
Pequeña prima (≤1024×1024)
por imagen
$0.18
Estándar grande (≤2048×2048)
por imagen
$0.18
Prima grande (≤2048×2048)
por imagen
$0.24

Amazon Nova Reel 1.1

AmazonLanzado 7 abr 2025Generacion de video
Endpoint propietario

Modelo de generación de vídeo que produce vídeos de hasta 2 minutos con múltiples tomas a partir de texto y prompts de imagen opcionales con mejor calidad y consistencia.

Tipo
Especificación
Tarifa
Por segundo
por segundo
$0.14

Deepgram Nova 3

DeepgramLanzado 12 feb 2025Transcripción
Endpoint propietario

Transcripción de voz a texto usando el modelo Nova-3 con soporte multilingüe y ajustes avanzados personalizables para cargas de producción.

Tipo
Especificación
Tarifa
Transcripción
por minuto de audio
$0.014

DeepReasoning

WinFuncLanzado 26 ene 2025Generacion de texto
Endpoint propietario

Combina DeepSeek R1 chain-of-thought razonamiento con Anthropic Claude la creación y generación de código detrás de una interfaz unificada controlada por datos.

Tipo
Especificación
Tarifa
R1-0528 + Claude Sonnet 4.5 (por defecto)
por cada token de 1K
In $0.012 / Out $0.058
R1-0528 + Claude Haiku 4.5
por cada token de 1K
In $0.0048 / Out $0.023
R1-0528 + Claude Opus 4.5
por cada token de 1K
In $0.019 / Out $0.092
R1-0528 + Claude Sonet 4
por cada token de 1K
In $0.012 / Out $0.058
R1-0528 + Claude Opus 4.1
por cada token de 1K
In $0.053 / Out $0.26
R1-0528 + Claude Opus 4
por cada token de 1K
In $0.053 / Out $0.26
Búsqueda web (Linkup)
por llamada cuando se invoca
$0.013

DeepSeek V3.2

DeepSeekSingaporeLanzado 1 dic 2025Ctx 128KGeneracion de texto
Endpoint propietario

LLM de código abierto Mixture-of-Experts optimizado para razonamiento, programación y tareas generales de lenguaje de alta eficiencia a través de prompts de formato largo.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$0.57
Producto
por 1M de tokens generados
$1.71
Búsqueda web
por solicitud cuando esté habilitada
$0.015

DeepSeek V4 Flash

DeepSeekGermanyLanzado 24 abr 2026Ctx 1MGeneracion de texto
Endpoint propietario

Modelo MoE ligero con 284B de parámetros totales / 13B activos y contexto nativo de 1M, ajustado para un uso de baja latencia y alta concurrencia rentable.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$0.14
Producto
por 1M de tokens generados
$0.28
Búsqueda web (Linkup)
por llamada cuando se invoca
$0.013

DeepSeek V4 Flash

DeepSeekSingaporeLanzado 24 abr 2026Ctx 1MGeneracion de texto
Endpoint propietario

Modelo MoE ligero con 284B de parámetros totales / 13B activos y contexto nativo de 1M, ajustado para un uso de baja latencia y alta concurrencia rentable.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$0.20
Producto
por 1M de tokens generados
$0.40
Búsqueda web
por solicitud cuando esté habilitada
$0.02

DeepSeek V4 Flash

DeepSeekChinaLanzado 24 abr 2026Ctx 1MGeneracion de texto
Endpoint propietario
Save up to 2%

Modelo MoE ligero con 284B de parámetros totales / 13B activos y contexto nativo de 1M, ajustado para un uso de baja latencia y alta concurrencia rentable.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$0.14$0.138
Producto
por 1M de tokens generados
$0.28$0.275
Caché implícita
por fichas de entrada en caché de 1M
$0.028
Búsqueda web
por solicitud cuando esté habilitada
$0.01

DeepSeek V4 Pro

DeepSeekGermanyLanzado 24 abr 2026Ctx 1MGeneracion de texto
Endpoint propietario
Save up to 5%

LLM MoE insignia con 1,6T totales / 49B parámetros activos y contexto nativo de 1M para matemáticas avanzadas, inferencia lógica y codificación especializada.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$1.74$1.65
Producto
por 1M de tokens generados
$3.48$3.30
Búsqueda web (Linkup)
por llamada cuando se invoca
$0.013

DeepSeek V4 Pro

DeepSeekSingaporeLanzado 24 abr 2026Ctx 1MGeneracion de texto
Endpoint propietario

LLM MoE insignia con 1,6T totales / 49B parámetros activos y contexto nativo de 1M para matemáticas avanzadas, inferencia lógica y codificación especializada.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$2.40
Producto
por 1M de tokens generados
$4.80
Búsqueda web
por solicitud cuando esté habilitada
$0.02

DeepSeek V4 Pro

DeepSeekChinaLanzado 24 abr 2026Ctx 1MGeneracion de texto
Endpoint propietario
Save up to 5%

LLM MoE insignia con 1,6T totales / 49B parámetros activos y contexto nativo de 1M para matemáticas avanzadas, inferencia lógica y codificación especializada.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$1.74$1.65
Producto
por 1M de tokens generados
$3.48$3.301
Caché implícita
por fichas de entrada en caché de 1M
$0.138
Búsqueda web
por solicitud cuando esté habilitada
$0.01

Exa Answer

ExaInvestigación y búsqueda
Endpoint propietario

Respuesta rápida al estilo LLM a una pregunta en lenguaje natural, basada en resultados de búsqueda web exa frescos con citas en línea y enlaces a fuentes.

Tipo
Especificación
Tarifa
Respuesta
por solicitud
$0.01

Gemini 2.5 Flash TTS

GoogleLanzado 20 may 2025Generación de audio
Endpoint propietario

Baja latencia text-to-speech con voces de un y varios altavoces y estilo, acento y tono expresivo controlables para aplicaciones de producción.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$1.50
Producto
por 1M de tokens generados
$30.00

Gemini 2.5 Pro TTS

GoogleLanzado 20 may 2025Generación de audio
Endpoint propietario

Vista previa TTS de alta calidad para podcasts, audiolibros y atención al cliente, con voces expresivas con múltiples altavoces en 23+ idiomas.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$3.00
Producto
por 1M de tokens generados
$60.00

Gemini 3.1 Flash TTS

GoogleLanzado 13 abr 2026Generación de audio
Endpoint propietario

TTS altamente controlable con nuevas etiquetas de audio para un estilo, tono, ritmo y entrega precisos en narración, asistentes y aplicaciones de voz.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$2.60
Producto
por 1M de tokens generados
$52.00

Gemma 3 27B

GoogleLanzado 10 mar 2025Ctx 128KGeneracion de texto
Endpoint propietario

Modelo de lenguaje de visión de código abierto con contexto de 128K, 140+ lenguajes, math/reasoning mejorado, salidas estructuradas y llamadas a funciones.

Tipo
Especificación
Tarifa
Por mensaje
Fijado
$0.0040
Búsqueda web (Linkup)
por llamada cuando se invoca
$0.013

GLM TTS

Z.aiLanzado 11 dic 2025Generación de audio
Inferencia nativa

text-to-speech basado en LLM con clonación de voz sin disparo a partir de 3-10 segundos de audio y salida expresiva emocionalmente controlable mediante RL multi-recompensa.

Tipo
Especificación
Tarifa
Rápido (INT8)
por cada 1.000 caracteres
$0.20
Calidad (FP16)
por cada 1.000 caracteres
$0.21

GPTZero

GPTZeroHerramientas y agentes
Endpoint propietario

Detector de aprendizaje profundo que señala partes de texto probablemente generadas por IA frente a humanas, clasificando el contenido como completamente humano, IA o mixto.

Tipo
Especificación
Tarifa
Escaneo de texto
por cada 1.000 palabras
$0.39

HappyHorse 1.0

Alibaba CloudSingaporeLanzado 6 may 2026Generacion de video
Endpoint propietario

Modelo de vídeo que ofrece modos Texto a Vídeo, Imagen a Vídeo, Referencia a Vídeo y Edición de Vídeo con salida de alta fidelidad y fluidez para el movimiento.

Tipo
Especificación
Tarifa
Todos los modos 720P
por segundo
$0.14
Todos los modos 1080P
por segundo
$0.24

Hunyuan Image 3

TencentLanzado 28 sept 2025Generación de imágenes
Endpoint propietario

Modelo de text-to-image de código abierto sobre una arquitectura multimodal Mixture-of-Experts con detalle fotorrealista y un renderizado de texto multilingüe potente.

Tipo
Especificación
Tarifa
Estándar
por imagen
$0.13

Hunyuan Video 1.5

TencentLanzado 20 nov 2025Generacion de video
Inferencia nativa
Save up to 19%

Modelo de vídeo de 8.3B parámetros con salida nativa 720p (escalable a 1080p), coherencia de movimiento fuerte y comprensión bilingüe de prompts de hasta 10s.

Tipo
Especificación
Tarifa
480p
por segundo
$0.075$0.061
720p
por segundo
$0.29
1080p (escalado)
por segundo
$0.67

Janus-Pro DeepSeek

DeepSeekLanzado 27 ene 2025Generación de imágenes
Endpoint propietario

Marco autorregresivo en el modelo Janus Pro 7B que unifica la comprensión multimodal y la generación de imágenes en una sola arquitectura.

Tipo
Especificación
Tarifa
Generación de imágenes
por imagen
$0.030
Análisis de imágenes
por imagen subida
$0.030

Kling O3

Kling AILanzado 5 feb 2026Generacion de video
Endpoint propietario

Modelo de vídeo en modos Standard o Pro con Texto a Vídeo, Imagen a Vídeo, Referencia a Vídeo, edición, sonido nativo y transiciones multiescena.

Tipo
Especificación
Tarifa
T2V/I2V estándar
por segundo
$0.168
Sonido T2V/I2V estándar
por segundo
$0.224
Entrada de vídeo estándar
por segundo
$0.252
Pro T2V/I2V
por segundo
$0.224
Pro T2V/I2V Sonido
por segundo
$0.280
Entrada de vídeo Pro
por segundo
$0.336
4K T2V/I2V/Árbitro
por segundo
$0.525

Kling v3 Motion Control

Kling AIGeneracion de video
Endpoint propietario

Kling 3.0 modelo que transfiere movimiento de un vídeo de referencia a un personaje de una imagen de referencia, con niveles estándar 720p y Pro 1080p.

Tipo
Especificación
Tarifa
Estándar (720p)
por segundo
$0.14
Pro (1080p)
por segundo
$0.18

Linkup Standard

LinkupCtx 100KInvestigación y búsqueda
Endpoint propietario

Búsqueda web impulsada por IA con resúmenes detallados y respuestas, más rápida que la búsqueda profunda. Ocupa el puesto #1 en el benchmark de OpenAI SimpleQA.

Tipo
Especificación
Tarifa
Por mensaje
Fijado
$0.013

Mistral Medium 3

Mistral AILanzado 7 may 2025Ctx 130KGeneracion de texto
Endpoint propietario

Modelo de lenguaje rentable que ofrece un razonamiento sólido y un rendimiento multimodal para cargas de trabajo generales de producción con latencia competitiva.

Tipo
Especificación
Tarifa
Por mensaje
Fijado
$0.015
Búsqueda web (Linkup)
por llamada cuando se invoca
$0.013

Mistral Medium 3.1

Mistral AILanzado 12 ago 2025Ctx 131KGeneracion de texto
Endpoint propietario

Modelo de nivel empresarial con un razonamiento sólido, programación y rendimiento STEM, que soporta despliegues híbridos, on-premises e in-VPC.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$0.52
Producto
por 1M de tokens generados
$2.60
Búsqueda web (Linkup)
por llamada cuando se invoca
$0.013

Mistral Small 3.1

Mistral AILanzado 17 mar 2025Ctx 128KGeneracion de texto
Endpoint propietario

Modelo multimodal de 24B parámetros con contexto de 128K para análisis de imágenes, programación, matemáticas y tareas multilingües, ajustado para una inferencia local eficiente.

Tipo
Especificación
Tarifa
Por mensaje
Fijado
$0.0019
Búsqueda web (Linkup)
por llamada cuando se invoca
$0.013

Mistral Small 4

Mistral AILanzado 16 mar 2026Ctx 256KGeneracion de texto
Endpoint propietario

Modelo híbrido que unifica las familias Instruct, Razonamiento (Magistral) y Devstral: 40% menos tiempo de finalización y 3x rendimiento frente a los 3 pequeños.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$0.15
Producto
por 1M de tokens generados
$0.60
Búsqueda Web Estándar
por llamada
$0.084
Búsqueda Web Premium
por llamada
$0.140
Intérprete de código
por llamada
$0.084
Generación de imágenes
por imagen
$0.280

MOSS Video and Audio

OpenMOSSLanzado 29 ene 2026Generacion de video
Inferencia nativa

Modelo base MoE 32B de código abierto que genera vídeo y audio sincronizados en un solo paso de inferencia con sincronización labial precisa de doble torre.

Tipo
Especificación
Tarifa
Vídeo 360p
por vídeo
$0.17
Vídeo 720p
por vídeo
$2.82
T2V Rápido
Tasa adicional
$0.065
Calidad T2V
Tasa adicional
$0.13

Nova Lite 1.0

AmazonLanzado 3 dic 2024Ctx 300KGeneracion de texto
Endpoint propietario

Modelo multimodal de bajo coste para texto, imágenes y vídeo en un contexto de 300K (hasta ~30 minutos de vídeo), ajustado para velocidad y asequibilidad.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$0.069
Producto
por 1M de tokens generados
$0.28
Entrada en caché
por cada 1M de fichas
$0.0386
Búsqueda web (Linkup)
por llamada cuando se invoca
$0.013

Nova Lite 2

AmazonLanzado 2 dic 2025Ctx 1MGeneracion de texto
Endpoint propietario

Modelo de razonamiento multimodal rápido y rentable para texto, imágenes, documentos y vídeo en un contexto de 1M (documentación larga y clips de ~90 minutos).

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$0.38
Producto
por 1M de tokens generados
$3.16
Entrada en caché
por cada 1M de fichas
$0.2128
Búsqueda web (Linkup)
por llamada cuando se invoca
$0.013

Nova Micro 1.0

AmazonLanzado 3 dic 2024Ctx 128KGeneracion de texto
Endpoint propietario

Modelo base solo texto ajustado para latencia y coste ultra bajos en contexto de 128K. Fuerte para resumen, traducción y chat, con un 44% de descuento en caché.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$0.040
Producto
por 1M de tokens generados
$0.16
Entrada en caché
por cada 1M de fichas
$0.0224
Búsqueda web (Linkup)
por llamada cuando se invoca
$0.013

Nova Premier 1.0

AmazonLanzado 30 abr 2025Ctx 1MGeneracion de texto
Endpoint propietario

El modelo más capaz de la familia. text/image/vídeo multimodal en un contexto de 1M con chain-of-thought razonamiento entre herramientas y fuentes de datos.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$3.00
Producto
por 1M de tokens generados
$15.00
Entrada en caché
por cada 1M de fichas
$1.68
Búsqueda web (Linkup)
por llamada cuando se invoca
$0.013

Nova Pro 1.0

AmazonLanzado 3 dic 2024Ctx 300KGeneracion de texto
Endpoint propietario

Modelo base multimodal que equilibra precisión, velocidad y coste para texto, imágenes y vídeo en contexto de 300K (hasta ~30 min de vídeo).

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$2.40
Producto
por 1M de tokens generados
$9.60
Entrada optimizada por latencia
por 1M de tokens de prompt
$3.00
Salida optimizada por latencia
por 1M de tokens generados
$12.00
Búsqueda web (Linkup)
por llamada cuando se invoca
$0.013

OpenAI Whisper 1

OpenAILanzado 21 sept 2022Transcripción
Endpoint propietario

Whisper-1 speech-to-text transcripción entrenada con audio supervisado multilingüe, con un límite de subida de 25 MB por archivo.

Tipo
Especificación
Tarifa
Por minuto de audio
por minuto
$0.030

Perplexity Advanced Deep Research

PerplexityInvestigación y búsqueda
Endpoint propietario

Investigación de nivel institucional impulsada por el razonamiento Claude Opus 4.6, con máxima profundidad, acceso mejorado a las herramientas y amplia cobertura de fuentes.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$12.00
Producto
por 1M de tokens generados
$60.00
Llamada de búsqueda web
por llamada
$0.012
Llamada de obtención de URL
por llamada
$0.0012

Perplexity Deep Research

PerplexityCtx 128KInvestigación y búsqueda
Endpoint propietario

Modelo de investigación para la recuperación, síntesis y razonamiento en varios pasos, buscando, leyendo y evaluando fuentes de forma autónoma en temas complejos.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$4.80
Producto
por 1M de tokens generados
$19.00
Fichas de citación
por cada 1M de fichas
$4.80
Fichas de razonamiento
por cada 1M de fichas
$7.20
Consultas de búsqueda
por consulta
$0.012

Perplexity Sonar

PerplexityCtx 127KInvestigación y búsqueda
Endpoint propietario

Búsqueda web en tiempo real con citas precisas y fuentes personalizables para up-to-date integración de búsqueda por IA en aplicaciones de producción.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$2.40
Producto
por 1M de tokens generados
$2.40
Tarifa base (Contexto Limitado)
por solicitud
$0.012
Tarifa base (Contexto medio)
por solicitud
$0.019
Tarifa base (Contexto Amplio)
por solicitud
$0.029

Perplexity Sonar Pro

PerplexityCtx 200KInvestigación y búsqueda
Endpoint propietario

Modelo basado en búsquedas con el doble de citas y una ventana de contexto más amplia, ajustado para consultas complejas que requieren respuestas profundas y matizadas.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$7.20
Producto
por 1M de tokens generados
$36.00
Tarifa base (Contexto Limitado)
por solicitud
$0.014
Tarifa base (Contexto medio)
por solicitud
$0.024
Tarifa base (Contexto Amplio)
por solicitud
$0.034

Perplexity Sonar Reasoning Pro

PerplexityCtx 128KInvestigación y búsqueda
Endpoint propietario

Modelo de razonamiento en el R1-1776 de código abierto sin censura con búsqueda web, superando a los principales motores de búsqueda y LLMs en el benchmark SimpleQA.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$4.80
Producto
por 1M de tokens generados
$19.00
Tarifa base (Contexto Limitado)
por solicitud
$0.014
Tarifa base (Contexto medio)
por solicitud
$0.024
Tarifa base (Contexto Amplio)
por solicitud
$0.034

Pixverse v5

PixVerseLanzado 29 ago 2025Generacion de video
Endpoint propietario

Generación de vídeo cinematográfico en modos Texto a Vídeo, Imagen a Vídeo y Transición con alto detalle, movimiento fluido y animaciones realistas.

Tipo
Especificación
Tarifa
360p/540p 5s
por vídeo
$0.45
360p/540p 8s
por vídeo
$0.90
720p 5s
por vídeo
$0.60
720p 8s
por vídeo
$1.20
1080p 5s
por vídeo
$1.20

Pixverse v5.6

PixVerseLanzado 26 ene 2026Generacion de video
Endpoint propietario

Genera vídeos a partir de texto o de imágenes de 1-2 fotogramas de hasta 1080p, múltiples relaciones de aspecto, duraciones de 5-10 segundos, con audio sincronizado opcional.

Tipo
Especificación
Tarifa
360p/540p 5s sin audio
por vídeo
$0.40
360p/540p 5s audio
por vídeo
$0.80
360p/540p 8s sin audio
por vídeo
$0.80
360p/540p audio 8s
por vídeo
$1.60
360p/540p 10s sin audio
por vídeo
$0.88
360p/540p audio de los 10s
por vídeo
$1.76
720p 5s sin audio
por vídeo
$0.65
Audio 720p 5s
por vídeo
$1.30
720p 8s sin audio
por vídeo
$1.30
Audio 720p 8s
por vídeo
$2.60
720p 10s sin audio
por vídeo
$1.43
Audio 720p 10s
por vídeo
$2.86
1080p 5s sin audio
por vídeo
$0.75
Audio 1080p 5s
por vídeo
$1.50
1080p 8s sin audio
por vídeo
$1.50
Audio 1080p 8s
por vídeo
$3.00

Qwen Image 2.0

Alibaba CloudSingaporeLanzado 3 mar 2026Generación de imágenes
Endpoint propietario

Modelo unificado de generación y edición de imágenes con un renderizado de texto complejo de Chinese/English líder en su clase, texturas realistas y fusión multi-imagen.

Tipo
Especificación
Tarifa
Estándar
por imagen
$0.035
Pro
por imagen
$0.075

Qwen Image 3.0

Alibaba CloudSingaporeLanzado 21 jul 2026Generación de imágenes
Endpoint propietario

Generación y edición de imágenes Qwen con variantes Base y Pro, tipografía multilingüe, referencias multiimagen y salida controlable en 1K o 2K.

Tipo
Especificación
Tarifa
Salida base (1K o 2K)
por imagen
$0.030
Salida Pro hasta 2,25MP (1K)
por imagen
$0.040
Salida Pro superior a 2,25MP (2K)
por imagen
$0.075
Imagen de entrada (1K o 2K)
por imagen de entrada
$0.003

Qwen3.5 Flash

Alibaba CloudSingaporeLanzado 24 feb 2026Ctx 1MGeneracion de texto
Endpoint propietario
Save up to 10%

Modelo de visión y lenguaje con atención lineal híbrida más MoE escaso, contexto 1M y rápida inferencia multimodal de text/image/vídeo.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$0.10$0.090
Producto
por 1M de tokens generados
$0.40$0.368
Búsqueda web
por llamada cuando se invoca
$0.015
Búsqueda de texto a imagen
por llamada cuando se invoca
$0.012
Búsqueda imagen a imagen
por llamada cuando se invoca
$0.012
Extractor de telarañas
por llamada cuando se invoca
$0.00
Intérprete de código
por llamada cuando se invoca
$0.00

Qwen3.5 Flash

Alibaba CloudChinaLanzado 24 feb 2026Ctx 1MGeneracion de texto
Endpoint propietario
Save up to 68%

Modelo de visión y lenguaje con atención lineal híbrida más MoE escaso, contexto 1M y rápida inferencia multimodal de text/image/vídeo.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$0.090<=128K $0.029128K-256K $0.115256K-1M $0.172
Producto
por 1M de tokens generados
$0.368<=128K $0.287128K-256K $1.147256K-1M $1.72
Búsqueda web
por llamada cuando se invoca
$0.01

Qwen3.5 Omni Flash

Alibaba CloudSingaporeLanzado 30 mar 2026Ctx 256KGeneracion de texto
Endpoint propietario

Modelo omnimodal rentable que maneja texto, imagen, audio y vídeo, con hasta 3 horas de audio y 1 hora de vídeo en 90+ idiomas.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
per 1M prompt tokens $0.40per 1M prompt tokens $3.00
Producto
por 1M de tokens generados
per 1M generated tokens $2.20per 1M generated tokens $11.90
Búsqueda web
por llamada cuando se invoca
$0.015

Qwen3.5 Omni Plus

Alibaba CloudSingaporeLanzado 30 mar 2026Ctx 256KGeneracion de texto
Endpoint propietario

Modelo omnimodal insignia para texto, imagen, audio y vídeo. 3 horas de audio, 1 mano de vídeo, 90+ idiomas de entrada y 30+ de salida, 55 timbres de voz.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
per 1M prompt tokens $1.40per 1M prompt tokens $11.00
Producto
por 1M de tokens generados
per 1M generated tokens $8.30per 1M generated tokens $44.00
Búsqueda web
por llamada cuando se invoca
$0.015

Qwen3.5 Plus

Alibaba CloudSingaporeLanzado 16 feb 2026Ctx 1MGeneracion de texto
Endpoint propietario
Save up to 10%

Modelo multimodal con arquitectura híbrida para un pensamiento profundo eficiente y una comprensión visual entre texto, imagen y vídeo en un contexto de 1M.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$0.40<=256K $0.36$1.20256K-1M $1.08
Producto
por 1M de tokens generados
$2.40<=256K $2.21$7.20256K-1M $6.62
Búsqueda web
por llamada cuando se invoca
$0.015
Búsqueda de texto a imagen
por llamada cuando se invoca
$0.012
Búsqueda imagen a imagen
por llamada cuando se invoca
$0.012
Extractor de telarañas
por llamada cuando se invoca
$0.00
Intérprete de código
por llamada cuando se invoca
$0.00

Qwen3.5 Plus

Alibaba CloudChinaLanzado 16 feb 2026Ctx 1MGeneracion de texto
Endpoint propietario
Save up to 69%

Modelo multimodal con arquitectura híbrida para un pensamiento profundo eficiente y una comprensión visual entre texto, imagen y vídeo en un contexto de 1M.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$0.36<=128K $0.115$0.36128K-256K $0.287$1.08256K-1M $0.573
Producto
por 1M de tokens generados
$2.21<=128K $0.688$2.21128K-256K $1.72$6.62256K-1M $3.44
Búsqueda web
por llamada cuando se invoca
$0.01

Qwen3.6 Max Preview

Alibaba CloudSingaporeLanzado 20 abr 2026Ctx 256KGeneracion de texto
Endpoint propietario

La mayor variante de vista previa de la serie 3.6 (solo texto): mejora en la ejecución de los agentes de codificación, habilidades de front-end más sólidas y un conocimiento más amplio de la long-tail.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
<=128K $1.31128K-256K $1.97
Producto
por 1M de tokens generados
<=128K $7.88128K-256K $11.82
Búsqueda web
por llamada cuando se invoca
$0.020

Qwen3.6 Plus

Alibaba CloudSingaporeLanzado 2 abr 2026Ctx 1MGeneracion de texto
Endpoint propietario

Modelo de visión con grandes mejoras respecto a la versión 3.5: codificación agente y frontal, reconocimiento multimodal, OCR y localización de objetos.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
<=256K $0.50256K-1M $2.00
Producto
por 1M de tokens generados
<=256K $3.00256K-1M $6.00
Búsqueda web
por llamada cuando se invoca
$0.026
Búsqueda de texto a imagen
por llamada cuando se invoca
$0.0208
Búsqueda imagen a imagen
por llamada cuando se invoca
$0.0208
Extractor de telarañas
por llamada cuando se invoca
$0.00
Intérprete de código
por llamada cuando se invoca
$0.00

Qwen3.6 Plus

Alibaba CloudChinaLanzado 2 abr 2026Ctx 1MGeneracion de texto
Endpoint propietario
Save up to 45%

Modelo de visión con grandes mejoras respecto a la versión 3.5: codificación agente y frontal, reconocimiento multimodal, OCR y localización de objetos.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$0.50<=256K $0.276$2.00256K-1M $1.101
Producto
por 1M de tokens generados
$3.00<=256K $1.651256K-1M $6.602
Búsqueda web
por llamada cuando se invoca
$0.01

Qwen3 Max

Alibaba CloudSingaporeLanzado 23 sept 2025Ctx 256KGeneracion de texto
Endpoint propietario
Save up to 10%

256K-contexto insignia con grandes mejoras en razonamiento, seguimiento de instrucciones y soporte multilingüe, además de mayor precisión coding/math.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$1.20<=32K $1.08$2.4032K-128K $2.16$3.00128K-256K $2.70
Producto
por 1M de tokens generados
$6.00<=32K $5.52$12.0032K-128K $11.04$15.00128K-256K $13.80
Búsqueda web
por llamada cuando se invoca
$0.015

Qwen3 Max Preview

Alibaba CloudSingaporeLanzado 5 sept 2025Ctx 256KGeneracion de texto
Endpoint propietario
Save up to 20%

Versión previa con grandes avances respecto a la serie 2.5 en comprensión chino-inglés, instrucciones complejas, capacidad multilingüe y uso de herramientas.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$1.20<=32K $1.08$2.4032K-128K $2.16$3.00128K-256K $2.70
Producto
por 1M de tokens generados
$6.00<=32K $4.80$12.0032K-128K $9.60$15.00128K-256K $12.00
Búsqueda web
por llamada cuando se invoca
$0.015

Qwen3 Max Thinking

Alibaba CloudSingaporeLanzado 23 sept 2025Ctx 256KGeneracion de texto
Endpoint propietario
Save up to 10%

Modelo de razonamiento con uso de herramientas adaptativas (búsqueda, memoria, intérprete de código) y escalado en tiempo de prueba para mayor precisión en tareas complejas.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$1.20<=32K $1.08$2.4032K-128K $2.16$3.00128K-256K $2.70
Producto
por 1M de tokens generados
$6.00<=32K $5.52$12.0032K-128K $11.04$15.00128K-256K $13.80
Búsqueda web
por llamada cuando se invoca
$0.015

Qwen3 Rerank

Alibaba CloudSingaporeLanzado 5 jun 2025Ctx 4KReclasificadores
Endpoint propietario

Reclasificador semántico de documentos. Ordena hasta 500 candidatos por consulta por relevancia, soporta 100+ lenguajes y acepta instrucciones de ordenación personalizadas.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$0.10

Seed 2.0 Code

ByteDanceMalaysiaLanzado 14 feb 2026Ctx 256KGeneracion de texto
Endpoint propietario

Modelo 256K ajustado para codificación, con resultados front-end sólidos y soporte multilingüe para herramientas y agentes de codificación por IA.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
<=128K $0.40128K-256K $0.80
Producto
por 1M de tokens generados
<=128K $2.40128K-256K $4.80

Seed 2.0 Lite

ByteDanceMalaysiaLanzado 14 feb 2026Ctx 256KGeneracion de texto
Endpoint propietario

Modelo equilibrado de propósito general para cargas de trabajo empresariales de alta frecuencia: procesamiento de información, contenido, búsqueda y análisis de datos.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
<=128K $0.31128K-256K $0.62
Producto
por 1M de tokens generados
<=128K $2.50128K-256K $5.00

Seed 2.0 Mini

ByteDanceMalaysiaLanzado 14 feb 2026Ctx 256KGeneracion de texto
Endpoint propietario

Modelo multimodal centrado en latencia con contexto de 256K, cuatro modos de esfuerzo de razonamiento y image/video comprensión para un uso de alta concurrencia.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
<=128K $0.12128K-256K $0.24
Producto
por 1M de tokens generados
<=128K $0.50128K-256K $1.00

Seed 2.0 Pro

ByteDanceMalaysiaLanzado 14 feb 2026Ctx 256KGeneracion de texto
Endpoint propietario

Modelo general insignia con contexto de 256K para razonamiento complejo, comprensión multimodal, generación estructurada y ejecución aumentada por herramientas.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
<=128K $0.63128K-256K $1.26
Producto
por 1M de tokens generados
<=128K $3.79128K-256K $7.58

Seedance 2.0 Fast

ByteDanceMalaysiaLanzado 12 feb 2026Generacion de video
Endpoint propietario

Variante de vídeo 2.0 optimizada para velocidad y clips cinematográficos con sincronización de audio nativa, control de cámara y movimiento estable a menor coste por renderizado.

Tipo
Especificación
Tarifa
T2V/I2V 480P
por segundo
$0.122
T2V/I2V 720P
por segundo
$0.260
Entrada de vídeo 480P
por segundo
$0.284
Entrada de vídeo 720P
por segundo
$0.610

Seedance 2.0 Pro

ByteDanceMalaysiaLanzado 12 feb 2026Generacion de video
Endpoint propietario

Modelo de vídeo multimodal para salida cinematográfica de texto, imagen, audio o vídeo, con movimiento estable y caracteres consistentes.

Tipo
Especificación
Tarifa
T2V/I2V 480P
por segundo
$0.139
T2V/I2V 720P
por segundo
$0.300
T2V/I2V 1080P
por segundo
$0.749
T2V/I2V 4K
por segundo
$1.555
Entrada de vídeo 480P
por segundo
$0.342
Entrada de vídeo 720P
por segundo
$0.736
Entrada de vídeo 1080P
por segundo
$1.841
Entrada de vídeo 4K
por segundo
$3.732

Seedream 5.0 Lite

ByteDanceMalaysiaLanzado 13 feb 2026Generación de imágenes
Endpoint propietario

Modelo de imagen multimodal unificado que razona mediante prompts antes de renderizar, produciendo editajes y visuales de marca de alta resolución y consistentes.

Tipo
Especificación
Tarifa
Estándar
por imagen
$0.0350

Seedream 5.0 Pro

ByteDanceMalaysiaLanzado 8 jul 2026Generación de imágenes
Endpoint propietario

Modelo de imagen Premium Seedream para text-to-image, ediciones y fusión multirreferencia con salida de 1K, 1,5K y 2K, además de optimización de prompts estándar o rápido.

Tipo
Especificación
Tarifa
Potencia de hasta 2,61MP
por imagen
$0.075
Potencia superior a 2,61MP
por imagen
$0.150
Imagen de entrada extra
por imagen de entrada después de la primera
$0.005

SoulX Podcast

Soul AI LabLanzado 29 oct 2025Generación de audio
Inferencia nativa

Modelo de voz de código abierto para diálogos de podcast de formato largo y múltiples altavoces con control paralingüístico (risas, suspiros) y clonación de voz sin tomas.

Tipo
Especificación
Tarifa
Base
por cada 1.000 caracteres
$0.015
Dialecto
por cada 1.000 caracteres
$0.015

Stable Audio 2.0

Stability AILanzado 3 abr 2024Generación de audio
Endpoint propietario

Genera audio de hasta 3 minutos a partir de indicaciones de texto, soportando text-to-audio y audio-to-audio con duración, pasos y escala CFG ajustables.

Tipo
Especificación
Tarifa
Coste base
por generación
$0.58
Coste por paso
por paso
$0.00

Stable Audio 2.5

Stability AILanzado 10 sept 2025Generación de audio
Endpoint propietario

Up-to-3-minute audio de texto con text-to-audio, audio-to-audio e inpainting de audio para producción musical, diseño de sonido y remezclas.

Tipo
Especificación
Tarifa
Generación
por generación
$0.68

SVI 2.0 Pro

VITA-Group / EPFLLanzado 26 dic 2025Generacion de video
Inferencia nativa

Stable Video Infinity 2.0 Pro en WAN 2.2: extiende imágenes fijas a vídeos teóricamente de longitud infinita manteniendo identificadores de personajes consistentes.

Tipo
Especificación
Tarifa
Vídeo 480p
por segundo
$0.057
Vídeo 720p
por segundo
$0.17
T2V Rápido
Tasa adicional
$0.065
Calidad T2V
Tasa adicional
$0.13

Tavily Research

TavilyInvestigación y búsqueda
Endpoint propietario

Asistente de investigación multi-búsqueda que explora un tema, analiza fuentes y produce un informe de investigación detallado con citas.

Tipo
Especificación
Tarifa
Mini
Promedio por tarea
~$1.19
Pro
Promedio por tarea
~$2.75

Text Embedding v4

Alibaba CloudSingaporeLanzado 4 jun 2025Ctx 8KIncrustaciones
Endpoint propietario

Incrustación de texto multilingüe con dimensiones de salida seleccionables (64–2048). Hasta 8.192 tokens por entrada.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$0.07

Tongyi Embedding Vision Flash

Alibaba CloudSingaporeLanzado 23 sept 2025Ctx 1KIncrustaciones
Endpoint propietario

Embebido multimodal optimizado para velocidad, misma forma que Vision-Plus, tokens de image/video 3× más baratos.

Tipo
Especificación
Tarifa
Entrada de texto
por cada 1M de fichas
$0.09
Entrada de imagen / vídeo
por cada 1M de fichas
$0.03

Tongyi Embedding Vision Plus

Alibaba CloudSingaporeLanzado 23 sept 2025Ctx 1KIncrustaciones
Endpoint propietario

Incrustación multimodal que produce vectores independientes para entradas, texto, imagen y vídeo.

Tipo
Especificación
Tarifa
Entrada de texto
por cada 1M de fichas
$0.09
Entrada de imagen / vídeo
por cada 1M de fichas
$0.09

Wan 2.6

Alibaba CloudSingaporeLanzado 12 ene 2026Generacion de video
Endpoint propietario

Modelo de generación de vídeo multimodal para historias cinematográficas con múltiples planos y sincronización audiovisual nativa (sincronización labial, diálogo, música, efectos sonoros).

Tipo
Especificación
Tarifa
720P estándar
por segundo
$0.10
1080P estándar
por segundo
$0.15
Flash 720P (audio)
por segundo
$0.050
Flash 720P (sin audio)
por segundo
$0.0250
Flash 1080P (audio)
por segundo
$0.0750
Flash 1080P (sin audio)
por segundo
$0.03750

Wan 2.7

Alibaba CloudSingaporeLanzado 26 abr 2026Generacion de video
Endpoint propietario

Modelo de vídeo multimodal compatible con T2V, I2V, edición de vídeo y reference-to-video, con salida de alta fidelidad desde entradas, texto, imagen o vídeo.

Tipo
Especificación
Tarifa
Todos los modos 720P
por segundo
$0.10
Todos los modos 1080P
por segundo
$0.150

Wan2.7 Image

Alibaba CloudSingaporeLanzado 1 abr 2026Generación de imágenes
Endpoint propietario

Modelo compañero de generación y edición de imágenes: text-to-image, ediciones en caja delimitadora y conjuntos de imágenes cohesivos, con salida de hasta 4K en Pro.

Tipo
Especificación
Tarifa
Estándar
por imagen
$0.030
Pro
por imagen
$0.075

Whisper Large v3 Turbo

OpenAILanzado 1 oct 2024Transcripción
Inferencia nativa
Save up to 17%

Transcripción controlada Whisper Large v3 Turbo con ASR multilingüe, traducción, VAD, marcas de tiempo, subtítulos, palabras calientes y controles de decodificador.

Tipo
Especificación
Tarifa
Transcripción controlada
por minuto de audio
$0.006$0.005

Manus

ManusHerramientas y agentes
Endpoint propietario

Agente de IA autónomo que convierte un prompt de alto nivel en subtareas, llama a herramientas y APIs, y entrega resultados end-to-end sin orquestación manual.

Tipo
Especificación
Tarifa
Adaptativo - Manus 1.6 Lite
por tarea
$1.44 - $2.63
Adaptativo - Manus 1.6
por tarea
$2.89 - $5.25
Adaptativo - Manus 1.6 Max
por tarea
$5.25 - $9.19

Vídeo Grok Imagine 1.5

xAILanzado 16 jun 2026Generacion de video
Endpoint propietario

Generación de texto a vídeo, image-to-video y reference-to-video con hasta siete imágenes de referencia para caracteres consistentes, hasta 15 segundos a 1080p.

Tipo
Especificación
Tarifa
480p
por segundo
$0.096
720p
por segundo
$0.168
1080p
por segundo
$0.300
Entrada de imagen
por imagen
$0.05

MiMo V2.5 Pro

XiaomiLanzado 27 abr 2026Ctx 1MGeneracion de texto
Endpoint propietario

Modelo de primer nivel para flujos de trabajo agentes, ingeniería de software compleja y tareas a largo plazo, que sostiene trabajo a través de 1000+ llamadas de herramientas en contexto de 1M.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$2.175
Producto
por 1M de tokens generados
$4.35
Caché implícita
por fichas de entrada en caché de 1M
$0.018
Búsqueda web
por solicitud cuando esté habilitada
$0.015

MiMo V2.5

XiaomiLanzado 22 abr 2026Ctx 1MGeneracion de texto
Endpoint propietario

Modelo multimodal con comprensión visual y auditiva nativa en un contexto 1M, diseñado para razonar y actuar a través de modalidades en flujos de trabajo agentivos.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$0.70
Producto
por 1M de tokens generados
$1.40
Caché implícita
por fichas de entrada en caché de 1M
$0.014
Búsqueda web
por solicitud cuando esté habilitada
$0.015

HappyHorse 1.1

Alibaba CloudSingaporeLanzado 22 jun 2026Generacion de video
Endpoint propietario

Texto, imagen y reference-to-video en un solo modelo. Movimiento cinematográfico, consistencia de personajes en hasta 9 referencias y audio nativo sincronizado.

Tipo
Especificación
Tarifa
720p
por segundo
$0.14
1080p
por segundo
$0.18

Seedance 2.0 Mini

ByteDanceMalaysiaLanzado 15 jun 2026Generacion de video
Endpoint propietario

La gama Seedance 2.0 más rápida y asequible para clips cortos de cinemática con audio nativo, control de cámara y entradas de imagen o vídeo a 480p y 720p.

Tipo
Especificación
Tarifa
T2V/I2V 480P
por segundo
$0.070
T2V/I2V 720P
por segundo
$0.150
Entrada de vídeo 480P
por segundo
$0.167
Entrada de vídeo 720P
por segundo
$0.359

Step 3.7 Flash

StepFunInternationalLanzado 28 may 2026Ctx 256KGeneracion de texto
Endpoint propietario

Modelo de razonamiento multimodal StepFun con entrada de imagen y vídeo, llamada a herramientas, esfuerzo de razonamiento ajustable y contexto 256K.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$0.20
Producto
por 1M de tokens generados
$1.15
Caché implícita
por fichas de entrada en caché de 1M
$0.04
Búsqueda web (Linkup)
por llamada cuando se invoca
$0.013

Step 3.5 Flash

StepFunInternationalLanzado 12 feb 2026Ctx 256KGeneracion de texto
Endpoint propietario

Modelo de razonamiento textual StepFun para agentes, codificación, llamadas a herramientas y análisis de contexto largo.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$0.10
Producto
por 1M de tokens generados
$0.30
Caché implícita
por fichas de entrada en caché de 1M
$0.02
Búsqueda web (Linkup)
por llamada cuando se invoca
$0.013

Step 3.5 Flash 2603

StepFunInternationalLanzado 2 abr 2026Ctx 256KGeneracion de texto
Endpoint propietario

Variante Flash Step 3.5 optimizada para agentes con modos de bajo y alto esfuerzo de razonamiento.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$0.10
Producto
por 1M de tokens generados
$0.30
Caché implícita
por fichas de entrada en caché de 1M
$0.02
Búsqueda web (Linkup)
por llamada cuando se invoca
$0.013

StepAudio 2.5 Chat

StepFunInternationalCtx 256KGeneracion de texto
Endpoint propietario

Modelo de conversación de audio y texto StepFun con salida de texto y comprensión paralingüística.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$1.43
Producto
por 1M de tokens generados
$3.57
Caché implícita
por fichas de entrada en caché de 1M
$0.29
Búsqueda web (Linkup)
por llamada cuando se invoca
$0.013

Step Image Edit 2

StepFunInternationalLanzado 29 abr 2026Generación de imágenes
Endpoint propietario

Modelo de generación y edición de imágenes de StepFun para ediciones de text-to-image y de una sola imagen.

Tipo
Especificación
Tarifa
Imagen de salida
por imagen generada
$0.003

StepAudio 2.5 TTS

StepFunInternationalLanzado 21 abr 2026Generación de audio
Endpoint propietario

Modelo contextual de StepFun text-to-speech con dirección de voz en lenguaje natural y entrega expresiva.

Tipo
Especificación
Tarifa
Síntesis
por cada 10.000 caracteres
$0.85

Step TTS 2

StepFunInternationalGeneración de audio
Endpoint propietario

StepFun text-to-speech modelo con voces oficiales, voces clonadas personalizadas y controles de etiqueta de voz.

Tipo
Especificación
Tarifa
Síntesis
por cada 10.000 caracteres
$0.40

StepAudio 2.5 ASR

StepFunInternationalLanzado 24 abr 2026Transcripción
Endpoint propietario

Modelo de reconocimiento de voz en streaming StepFun para transcripción de audio en chino e inglés.

Tipo
Especificación
Tarifa
Transcripción
por hora de audio
$0.022

Seed 2.1 Turbo

ByteDanceMalaysiaLanzado 13 jul 2026Ctx 256KGeneracion de texto
Endpoint propietario

Modelo de codificación y agente de próxima generación con entrega de código de calidad de ingeniería, autonomía a largo plazo y comprensión multimodal de 256K.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$0.63
Producto
por 1M de tokens generados
$3.13

Qwen Audio 3.0 TTS

Alibaba CloudSingaporeLanzado 20 jul 2026Generación de audio
Endpoint propietario

Síntesis de voz por niveles con más de 1.000 voces, 16 idiomas, 20 dialectos chinos, dirección de transmisión en lenguaje natural y etiquetas emocionales en línea.

Tipo
Especificación
Tarifa
Síntesis de más
por cada 10.000 caracteres
$0.20
Síntesis flash
por cada 10.000 caracteres
$0.15

MiniMax H3

MiniMaxSingaporeLanzado 31 jul 2026Generacion de video
Endpoint propietario

Genera clips de 4 a 15 segundos de hasta 2K con audio estéreo nativo, siguiendo texto, imagen, vídeo y referencias de audio en una sola solicitud.

Tipo
Especificación
Tarifa
768p
por segundo
$0.18
2K
por segundo
$0.26
Regeneración 2K
por segundo
$0.10
Entrada de imagen de referencia
por imagen de entrada tras las primeras 5
$0.08
Entrada de expansión rápida
por 1M de tokens de prompt
$1.80
Salida de expansión prompta
por 1M de tokens generados
$7.20

GPT Image 2

OpenAILanzado 21 abr 2026Generación de imágenes
Endpoint propietario

El modelo de imagen insignia de OpenAI con alta fidelidad en prompts, renderizado de texto nítido y edición basada en instrucciones en hasta 16 imágenes de referencia.

Tipo
Especificación
Tarifa
Bajo
por imagen
$0.012
Medio
por imagen
$0.106
Alto
por imagen
$0.422

Kling V3

Kling AILanzado 5 feb 2026Generacion de video
Endpoint propietario

El generador de vídeo Kling 3.0 de Kuaishou con text-to-video, primer y último fotograma image-to-video, audio nativo y salida 720p, 1080p o 4K.

Tipo
Especificación
Tarifa
T2V/I2V estándar
por segundo
$0.168
Sonido T2V/I2V estándar
por segundo
$0.252
Pro T2V/I2V
por segundo
$0.224
Pro T2V/I2V Sonido
por segundo
$0.336
4K T2V/I2V
por segundo
$0.84

Wan 2.5

Alibaba CloudSingaporeLanzado 24 sept 2025Generacion de video
Endpoint propietario

El modelo de vídeo Wan 2.5 de Alibaba con text-to-video y image-to-video, audio nativo, pistas de audio personalizadas opcionales y salida de 480p a 1080p.

Tipo
Especificación
Tarifa
480P
por segundo
$0.05
720P
por segundo
$0.10
1080P
por segundo
$0.15

Wan 2.2

Alibaba CloudSingaporeLanzado 28 jul 2025Generacion de video
Endpoint propietario

La familia de vídeo Wan 2.2 de Alibaba con niveles estándar y de flash, interpolación de primer y último fotograma, y salida de 480p a 1080p a bajo coste.

Tipo
Especificación
Tarifa
480P estándar
por segundo
$0.02
1080P estándar
por segundo
$0.10
Flash 480P
por segundo
$0.015
Flash 720P
por segundo
$0.036
Flash 1080P
por segundo
$0.07

Wan 2.1

Alibaba CloudSingaporeLanzado 25 feb 2025Generacion de video
Endpoint propietario

El modelo de vídeo Wan 2.1 de Alibaba con niveles turbo y plus para text-to-video, image-to-video y primer y último fotograma a 480p o 720p.

Tipo
Especificación
Tarifa
Turbo
por segundo
$0.036
Además.
por segundo
$0.10

Wan2.5 Image

Alibaba CloudSingaporeLanzado 24 sept 2025Generación de imágenes
Endpoint propietario

El modelo de imagen Wan 2.5 de Alibaba con text-to-image y edición multirreferencial de hasta 3 imágenes a unos 1,7 megapíxeles.

Tipo
Especificación
Tarifa
Estándar
por imagen
$0.030

Wan2.2 Image

Alibaba CloudSingaporeLanzado 28 jul 2025Generación de imágenes
Endpoint propietario

El modelo Wan 2.2 de Alibaba text-to-image con niveles plus y flash y hasta 1440x1440 de salida a bajo precio por imagen.

Tipo
Especificación
Tarifa
Además.
por imagen
$0.05
Flash
por imagen
$0.025

Wan2.1 Image

Alibaba CloudSingaporeLanzado 25 feb 2025Generación de imágenes
Endpoint propietario

El modelo Wan 2.1 text-to-image de Alibaba con niveles turbo y plus y hasta 1440x1440 de salida a bajo precio por imagen.

Tipo
Especificación
Tarifa
Turbo
por imagen
$0.025
Además.
por imagen
$0.05

Seedance 2.5

ByteDanceMalaysiaLanzado 7 ago 2026Generacion de video
Endpoint propietario

Modelo de vídeo de formato largo para clips coherentes de hasta 30 segundos, con hasta 50 imágenes de referencia, vídeos y clips de audio, audio nativo, edición y extensión.

Tipo
Especificación
Tarifa
T2V/I2V 480P
por segundo
$0.206
T2V/I2V 720P
por segundo
$0.462
Entrada de vídeo 480P
por segundo de entrada más salida
$0.123
Entrada de vídeo 720P
por segundo de entrada más salida
$0.276

140 / 155 Modelos

No hay objetos encontrados.

Métrica

Especificaciones

Precio (por 1M de fichas)

No hay objetos encontrados.

Métrica

Especificaciones

Precio (por 1M de fichas)

No hay objetos encontrados.

Métrica

Especificaciones

Precio (por 1M de fichas)

No hay objetos encontrados.

Métrica

Especificaciones

Precio (por 1M de fichas)

No hay objetos encontrados.

Métrica

Especificaciones

Precio (por 1M de fichas)

No hay objetos encontrados.

Métrica

Especificaciones

Precio (por 1M de fichas)

No hay objetos encontrados.

Métrica

Especificaciones

Precio (por 1M de fichas)

No hay objetos encontrados.

No hay objetos encontrados.

Métrica

Especificaciones

Precio (por 1M de fichas)

No hay objetos encontrados.

Métrica

Especificaciones

Precio (por 1M de fichas)

No hay objetos encontrados.

Métrica

Especificaciones

Precio (por 1M de fichas)

No hay objetos encontrados.

Métrica

Especificaciones

Precio (por 1M de fichas)

No hay objetos encontrados.

Métrica

Especificaciones

Precio (por 1M de fichas)

No hay objetos encontrados.

Métrica

Especificaciones

Precio (por 1M de fichas)

No hay objetos encontrados.

Métrica

Especificaciones

Precio (por 1M de fichas)

No hay objetos encontrados.

No hay objetos encontrados.

Métrica

Especificaciones

Precio (por 1M de fichas)

No hay objetos encontrados.

Métrica

Especificaciones

Precio (por 1M de fichas)

No hay objetos encontrados.

Métrica

Especificaciones

Precio (por 1M de fichas)

No hay objetos encontrados.

Métrica

Especificaciones

Precio (por 1M de fichas)

No hay objetos encontrados.

Métrica

Especificaciones

Precio (por 1M de fichas)

No hay objetos encontrados.

Métrica

Especificaciones

Precio (por 1M de fichas)

No hay objetos encontrados.

Métrica

Especificaciones

Precio (por 1M de fichas)

No hay objetos encontrados.