DeepSeek V4.1 Flash
DeepSeek V4.1 Flash: multimodal reasoning, coding and tool use with a 1M-token context window. Separate from DeepSeek V4 Flash.
Entrada
Salida
Entrada
≈ $0.375
Salida
≈ $1.5
Lectura de caché
≈ $0.0075
21 grupos
DeepSeek V4.1 Flash: multimodal reasoning, coding and tool use with a 1M-token context window. Separate from DeepSeek V4 Flash.
Entrada
Salida
Entrada
≈ $0.375
Salida
≈ $1.5
Lectura de caché
≈ $0.0075
DeepSeek V4 Flash es una variante de baja latencia de DeepSeek V4, conserva el razonamiento y reduce tiempo de respuesta, ideal para alta concurrencia.
Entrada
Salida
Entrada
≈ $0.525
Salida
≈ $1.57
Lectura de caché
≈ $0.0175
GLM 5.3 Flash: multimodal reasoning, coding and tool use with a 1M-token context window. Thinking is always enabled with low, high or max effort.
Entrada
Salida
Entrada
≈ $0.14
Salida
≈ $0.49
Lectura de caché
≈ $0.0405
Gemini 3.5 Flash de Google es un modelo de chat multimodal rápido y económico, con imagen y texto y contexto de un millón de tokens, para alta concurrencia.
Entrada
Salida
Entrada
≈ $0.938
Salida
≈ $6.25
Lectura de caché
≈ $0.0938
MiniMax M3 es un modelo de lenguaje con contexto de un millón de tokens, destacado en comprensión de documentos extensos, razonamiento y uso de herramientas.
Entrada
Salida
Entrada
≈ $1.2
Salida
≈ $5
Lectura de caché
≈ $1.5
DeepSeek V4 es un modelo enfocado en el razonamiento, con contexto de 128K tokens, destacado en generación de código y lógica compleja a precio muy competitivo.
Entrada
Salida
Entrada
≈ $0.212
Salida
≈ $0.475
Lectura de caché
≈ $0.025
GPT-5.5 de OpenAI es el modelo insignia para razonamiento complejo, código e instrucciones de varios pasos, con contexto de 400K tokens para apps exigentes.
Entrada
Salida
Entrada
≈ $4.25
Salida
≈ $25
Lectura de caché
≈ $0.425
GPT-5.6 Sol de OpenAI es la versión de alta capacidad de GPT-5.6 para razonamiento complejo, código, agentes y automatización de producción exigente.
Entrada
Salida
Entrada
≈ $6
Salida
≈ $40
Lectura de caché
≈ $0.85
OpenAI GPT-6 — a flagship model for complex reasoning, code generation, and multi-step instructions, with a 400K-token context window for demanding apps
Entrada
Salida
Entrada
≈ $3.5
Salida
≈ $30
Lectura de caché
≈ $0.531
Grok 4.5 de xAI es un modelo de alta capacidad para razonamiento, análisis de código, contexto largo y asistentes conectados a herramientas.
Entrada
Salida
Entrada
≈ $0.6
Salida
≈ $1.2
Lectura de caché
≈ $0.6
Grok 4.6 is an advanced AI model designed to deliver fast, writing, coding, research, data analysis, and creative problem-solving through natural conversation
Entrada
Salida
Entrada
≈ $0.6
Salida
≈ $1.2
Lectura de caché
≈ $0.6
A premium reasoning route for visual front-end prototyping, repository-scale coding, large evidence sets, long-running agents, and complex knowledge work that benefits from a 1.05M-token working context.
Entrada
Salida
Entrada
≈ $2
Salida
≈ $10
Lectura de caché
≈ $0.2
Grok 4.7 for text conversations and coding through an OpenAI-compatible API. Priced at the same credit rates as Grok 4.6.
Entrada
Salida
Entrada
≈ $0.6
Salida
≈ $1.2
Lectura de caché
≈ $0.6
Gemini 2.5 Flash Lite de Google es un modelo de chat de costo ultrabajo y baja latencia, con contexto de un millón de tokens, para tareas de alta frecuencia.
Entrada
Salida
Entrada
≈ $0.1
Salida
≈ $0.15
Lectura de caché
≈ $0.01
Gemini 3.1 Flash Lite de Google mejora el razonamiento sobre la 2.5 sin perder economía, equilibrando velocidad y calidad para tareas ligeras diarias.
Entrada
Salida
Entrada
≈ $0.15
Salida
≈ $1
Lectura de caché
≈ $0.0125
Gemini 3.1 Pro de Google es el modelo multimodal insignia de la serie, con sólido razonamiento complejo y gran capacidad de contexto para producción exigente.
Entrada
Salida
Entrada
≈ $1.25
Salida
≈ $7.5
Lectura de caché
≈ $0.625
GPT-4o mini de OpenAI es un modelo de chat multimodal rápido y asequible, con respuestas ágiles y bajo costo, para preguntas cotidianas y ayuda con código.
Entrada
Salida
Entrada
≈ $0.275
Salida
≈ $0.412
Lectura de caché
≈ $0.0138
GPT-5.4 de OpenAI es un modelo de alta capacidad para razonamiento avanzado, código y flujos de agentes, con contexto de 400K tokens para uso en producción.
Entrada
Salida
Entrada
≈ $2.5
Salida
≈ $15
Lectura de caché
≈ $0.25
Claude Opus 4.8 de Anthropic es el modelo insignia, para razonamiento, codificación y escritura extensa muy exigentes, con gran manejo de contexto largo.
Entrada
Salida
Entrada
≈ $2.5
Salida
≈ $12
Lectura de caché
≈ $0.25
Anthropic Claude Opus 5 from APIAny — Anthropic’s newest Opus-tier flagship for the hardest coding, long-running agents, and judgment-heavy review.
Entrada
Salida
Entrada
≈ $3.75
Salida
≈ $18.75
Lectura de caché
≈ $0.375
Claude Sonnet 4.6 de Anthropic es un modelo insignia equilibrado, con razonamiento sólido a velocidad y costo de producción, para despliegues estables a escala.
Entrada
Salida
Entrada
≈ $1.5
Salida
≈ $7.5
Lectura de caché
≈ $1
APIAny lista modelos públicos de chat y texto en un endpoint compatible con OpenAI, con precios en créditos en cada ficha.
Por APIAny Editorial · Actualizado
Filtre por tipo o proveedor, compare precios en créditos y abra una página de modelo para el playground y ejemplos de solicitud.
Fuentes
Las citas siguientes proceden de la documentación oficial de API que APIAny implementa.
The Chat Completions API endpoint will generate a model response from a list of messages comprising a conversation.
The Gemini API provides access to Google's most capable generative AI models.
The Images API provides several endpoints that let you generate images from text prompts or create edits of existing images.
El catálogo de modelos APIAny es la lista en vivo de modelos públicos de chat, imagen, vídeo, audio y seguridad que puede llamar con una clave API.