Explora los modelos de chat, imagen, video y audio de APIAny: capacidades, tipos de solicitud, precios y parámetros de cada modelo.
17 grupos

GLM-5.2 de Zhipu es un modelo bilingüe (chino e inglés) de nueva generación para chat, generación de código y tareas de agentes, con gran desempeño en chino.
Entrada
Salida
Entrada
≈ $1.88-$3.75
Salida
≈ $6.25-$12.5
Lectura de caché
≈ $0.375-$0.75

Gemini 3.5 Flash de Google es un modelo de chat multimodal rápido y económico, con imagen y texto y contexto de un millón de tokens, para alta concurrencia.
Entrada
Salida
Entrada
≈ $0.938-$1.88
Salida
≈ $6.25-$12.5
Lectura de caché
≈ $0.0938-$0.188

MiniMax M3 es un modelo de lenguaje con contexto de un millón de tokens, destacado en comprensión de documentos extensos, razonamiento y uso de herramientas.
Entrada
Salida
Entrada
≈ $1.2-$2.4
Salida
≈ $5-$10
Lectura de caché
≈ $1.5-$3

DeepSeek V4 es un modelo enfocado en el razonamiento, con contexto de 128K tokens, destacado en generación de código y lógica compleja a precio muy competitivo.
Entrada
Salida
Entrada
≈ $0.212-$0.425
Salida
≈ $0.475-$0.95
Lectura de caché
≈ $0.025-$0.05

GPT-5.5 de OpenAI es el modelo insignia para razonamiento complejo, código e instrucciones de varios pasos, con contexto de 400K tokens para apps exigentes.
Entrada
Salida
Entrada
≈ $4.25-$8.5
Salida
≈ $25-$50
Lectura de caché
≈ $0.425-$0.85

GPT-5.6 Sol de OpenAI es la versión de alta capacidad de GPT-5.6 para razonamiento complejo, código, agentes y automatización de producción exigente.
Entrada
Salida
Entrada
≈ $6-$12
Salida
≈ $40-$80
Lectura de caché
≈ $0.85-$1.7

Grok 4.5 de xAI es un modelo de alta capacidad para razonamiento, análisis de código, contexto largo y asistentes conectados a herramientas.
Entrada
Salida
Entrada
≈ $0.6-$1.2
Salida
≈ $1.2-$2.4
Lectura de caché
≈ $0.6-$1.2

A premium reasoning route for visual front-end prototyping, repository-scale coding, large evidence sets, long-running agents, and complex knowledge work that benefits from a 1.05M-token working context.
Entrada
Salida
Entrada
≈ $2-$4
Salida
≈ $10-$20
Lectura de caché
≈ $0.2-$0.4

Gemini 2.5 Flash Lite de Google es un modelo de chat de costo ultrabajo y baja latencia, con contexto de un millón de tokens, para tareas de alta frecuencia.
Entrada
Salida
Entrada
≈ $0.1-$0.2
Salida
≈ $0.15-$0.3
Lectura de caché
≈ $0.01-$0.02

Gemini 3.1 Flash Lite de Google mejora el razonamiento sobre la 2.5 sin perder economía, equilibrando velocidad y calidad para tareas ligeras diarias.
Entrada
Salida
Entrada
≈ $0.15-$0.3
Salida
≈ $1-$2
Lectura de caché
≈ $0.0125-$0.025

Gemini 3.1 Pro de Google es el modelo multimodal insignia de la serie, con sólido razonamiento complejo y gran capacidad de contexto para producción exigente.
Entrada
Salida
Entrada
≈ $1.25-$2.5
Salida
≈ $7.5-$15
Lectura de caché
≈ $0.625-$1.25

GPT-4o mini de OpenAI es un modelo de chat multimodal rápido y asequible, con respuestas ágiles y bajo costo, para preguntas cotidianas y ayuda con código.
Entrada
Salida
Entrada
≈ $0.275-$0.55
Salida
≈ $0.412-$0.825
Lectura de caché
≈ $0.0138-$0.0275

GPT-5.4 de OpenAI es un modelo de alta capacidad para razonamiento avanzado, código y flujos de agentes, con contexto de 400K tokens para uso en producción.
Entrada
Salida
Entrada
≈ $2.5-$5
Salida
≈ $15-$30
Lectura de caché
≈ $0.25-$0.5

Claude Opus 4.8 de Anthropic es el modelo insignia, para razonamiento, codificación y escritura extensa muy exigentes, con gran manejo de contexto largo.
Entrada
Salida
Entrada
≈ $2.5-$5
Salida
≈ $12-$24
Lectura de caché
≈ $0.25-$0.5

Anthropic Claude Opus 5 from APIAny — Anthropic’s newest Opus-tier flagship for the hardest coding, long-running agents, and judgment-heavy review.
Entrada
Salida
Entrada
≈ $3.75-$7.5
Salida
≈ $18.75-$37.5
Lectura de caché
≈ $0.375-$0.75

Claude Sonnet 4.6 de Anthropic es un modelo insignia equilibrado, con razonamiento sólido a velocidad y costo de producción, para despliegues estables a escala.
Entrada
Salida
Entrada
≈ $1.5-$3
Salida
≈ $7.5-$15
Lectura de caché
≈ $1-$2

Claude Sonnet 5 de Anthropic está orientado a agentes de código capaces, razonamiento prolongado, flujos con muchas herramientas y aplicaciones de gran contexto.
Entrada
Salida
Entrada
≈ $1.88-$3.75
Salida
≈ $10-$20
Lectura de caché
≈ $1.25-$2.5