Explora los modelos de chat, imagen, video y audio de APIAny: capacidades, tipos de solicitud, precios y parámetros de cada modelo.
30 grupos

Z-Image de Alibaba es un modelo ligero de texto a imagen, rápido y económico, ideal para pósters, imágenes de e-commerce y contenido en gran volumen.
Entrada
Salida
desde
8 créditos /img

GPT-Image 2 de OpenAI genera y edita imágenes, con retoque local y fusión de referencias, hasta 4K y cobro por token, para publicidad y diseño de producto.
Entrada
Salida
desde
30 créditos /img

Nano Banana de Google es un modelo de imagen multicanal, rápido y estable, con texto e imagen a imagen y hasta 5 referencias, ideal para creatividad cotidiana.
Entrada
Salida
desde
15 créditos /img

Nano Banana 2 Lite de Google (Gemini 3.1 Flash-Lite Image) es un modelo ligero de DeepMind para generación rápida en 1K y edición de prompts con baja latencia.
Entrada
Salida
desde
45 créditos /img

Nano Banana 2 de Google es un modelo de imagen de alta calidad, con texto e imagen a imagen, hasta 4K y 14 referencias, ideal para e-commerce y diseño.
Entrada
Salida
desde
25 créditos /img

Nano Banana Pro de Google es la versión insignia de la serie, para flujos profesionales, con imágenes en 4K de mayor fidelidad y hasta 14 referencias.
Entrada
Salida
desde
60 créditos /img

Seedance 5.0 de ByteDance, vía el canal oficial Volcengine Ark, genera imágenes desde texto o imagen hasta 3K, ideal para e-commerce y marketing visual.
Entrada
Salida
desde
70 créditos /img
Seedance 2.0 de ByteDance es un modelo de video con calidad cinematográfica, audio, referencias y clips de 5 a 15 segundos hasta 1080p, para anuncios y shorts.
Entrada
Salida
desde
720 créditos /video
Seedance 1.0 de ByteDance es un modelo ligero de imagen a video, genera clips de 5 a 10 segundos a bajo costo, ideal para producir en masa videos cortos.
Entrada
Salida
desde
70 créditos /video
Seedance 1.5 de ByteDance mejora el movimiento y detalle de la 1.0, con audio y clips de imagen a video de hasta 12 segundos, para videos con mejor acabado.
Entrada
Salida
desde
150 créditos /video
Veo 3.1 Fast de Google es un modelo rápido de texto o imagen a video con audio sincronizado nativo en 16:9 o 9:16, ideal para video corto en redes sociales.
Entrada
Salida
desde
330 créditos /video

NSFW Image Detection clasifica el riesgo de contenido adulto en imágenes subidas o remotas para automatizar moderación, revisión y publicación segura.
Entrada
Salida
desde
0.5 créditos /img
Gemini Omni texto a video de Google, vía el canal APIPod, genera clips de 6, 8 o 10 segundos en 720p o 1080p desde texto, sin necesidad de imagen de referencia.
Entrada
Salida
desde
500 créditos /video

GLM-5.2 de Zhipu es un modelo bilingüe (chino e inglés) de nueva generación para chat, generación de código y tareas de agentes, con gran desempeño en chino.
Entrada
Salida
Entrada
≈ $1.88-$3.75
Salida
≈ $6.25-$12.5
Lectura de caché
≈ $0.375-$0.75

Gemini 3.5 Flash de Google es un modelo de chat multimodal rápido y económico, con imagen y texto y contexto de un millón de tokens, para alta concurrencia.
Entrada
Salida
Entrada
≈ $0.938-$1.88
Salida
≈ $6.25-$12.5
Lectura de caché
≈ $0.0938-$0.188

MiniMax M3 es un modelo de lenguaje con contexto de un millón de tokens, destacado en comprensión de documentos extensos, razonamiento y uso de herramientas.
Entrada
Salida
Entrada
≈ $1.2-$2.4
Salida
≈ $5-$10
Lectura de caché
≈ $1.5-$3

DeepSeek V4 es un modelo enfocado en el razonamiento, con contexto de 128K tokens, destacado en generación de código y lógica compleja a precio muy competitivo.
Entrada
Salida
Entrada
≈ $0.212-$0.425
Salida
≈ $0.475-$0.95
Lectura de caché
≈ $0.025-$0.05

GPT-5.5 de OpenAI es el modelo insignia para razonamiento complejo, código e instrucciones de varios pasos, con contexto de 400K tokens para apps exigentes.
Entrada
Salida
Entrada
≈ $4.25-$8.5
Salida
≈ $25-$50
Lectura de caché
≈ $0.425-$0.85

GPT-5.6 Sol de OpenAI es la versión de alta capacidad de GPT-5.6 para razonamiento complejo, código, agentes y automatización de producción exigente.
Entrada
Salida
Entrada
≈ $6-$12
Salida
≈ $40-$80
Lectura de caché
≈ $0.85-$1.7

Grok 4.5 de xAI es un modelo de alta capacidad para razonamiento, análisis de código, contexto largo y asistentes conectados a herramientas.
Entrada
Salida
Entrada
≈ $0.6-$1.2
Salida
≈ $1.2-$2.4
Lectura de caché
≈ $0.6-$1.2

A premium reasoning route for visual front-end prototyping, repository-scale coding, large evidence sets, long-running agents, and complex knowledge work that benefits from a 1.05M-token working context.
Entrada
Salida
Entrada
≈ $2-$4
Salida
≈ $10-$20
Lectura de caché
≈ $0.2-$0.4

Gemini 2.5 Flash Lite de Google es un modelo de chat de costo ultrabajo y baja latencia, con contexto de un millón de tokens, para tareas de alta frecuencia.
Entrada
Salida
Entrada
≈ $0.1-$0.2
Salida
≈ $0.15-$0.3
Lectura de caché
≈ $0.01-$0.02

Gemini 3.1 Flash Lite de Google mejora el razonamiento sobre la 2.5 sin perder economía, equilibrando velocidad y calidad para tareas ligeras diarias.
Entrada
Salida
Entrada
≈ $0.15-$0.3
Salida
≈ $1-$2
Lectura de caché
≈ $0.0125-$0.025

Gemini 3.1 Pro de Google es el modelo multimodal insignia de la serie, con sólido razonamiento complejo y gran capacidad de contexto para producción exigente.
Entrada
Salida
Entrada
≈ $1.25-$2.5
Salida
≈ $7.5-$15
Lectura de caché
≈ $0.625-$1.25

GPT-4o mini de OpenAI es un modelo de chat multimodal rápido y asequible, con respuestas ágiles y bajo costo, para preguntas cotidianas y ayuda con código.
Entrada
Salida
Entrada
≈ $0.275-$0.55
Salida
≈ $0.412-$0.825
Lectura de caché
≈ $0.0138-$0.0275

GPT-5.4 de OpenAI es un modelo de alta capacidad para razonamiento avanzado, código y flujos de agentes, con contexto de 400K tokens para uso en producción.
Entrada
Salida
Entrada
≈ $2.5-$5
Salida
≈ $15-$30
Lectura de caché
≈ $0.25-$0.5

Claude Opus 4.8 de Anthropic es el modelo insignia, para razonamiento, codificación y escritura extensa muy exigentes, con gran manejo de contexto largo.
Entrada
Salida
Entrada
≈ $2.5-$5
Salida
≈ $12-$24
Lectura de caché
≈ $0.25-$0.5

Anthropic Claude Opus 5 from APIAny — Anthropic’s newest Opus-tier flagship for the hardest coding, long-running agents, and judgment-heavy review.
Entrada
Salida
Entrada
≈ $3.75-$7.5
Salida
≈ $18.75-$37.5
Lectura de caché
≈ $0.375-$0.75

Claude Sonnet 4.6 de Anthropic es un modelo insignia equilibrado, con razonamiento sólido a velocidad y costo de producción, para despliegues estables a escala.
Entrada
Salida
Entrada
≈ $1.5-$3
Salida
≈ $7.5-$15
Lectura de caché
≈ $1-$2

Claude Sonnet 5 de Anthropic está orientado a agentes de código capaces, razonamiento prolongado, flujos con muchas herramientas y aplicaciones de gran contexto.
Entrada
Salida
Entrada
≈ $1.88-$3.75
Salida
≈ $10-$20
Lectura de caché
≈ $1.25-$2.5