DeepSeek V4.1 Flash
DeepSeek V4.1 Flash: multimodal reasoning, coding and tool use with a 1M-token context window. Separate from DeepSeek V4 Flash.
Entrée
Sortie
Entrée
≈ $0.375
Sortie
≈ $1.5
Lecture cache
≈ $0.0075
21 groupes
DeepSeek V4.1 Flash: multimodal reasoning, coding and tool use with a 1M-token context window. Separate from DeepSeek V4 Flash.
Entrée
Sortie
Entrée
≈ $0.375
Sortie
≈ $1.5
Lecture cache
≈ $0.0075
DeepSeek V4 Flash, variante à faible latence de V4, garde l'essentiel du raisonnement en réduisant temps de réponse et coût, pour forte charge.
Entrée
Sortie
Entrée
≈ $0.525
Sortie
≈ $1.57
Lecture cache
≈ $0.0175
GLM 5.3 Flash: multimodal reasoning, coding and tool use with a 1M-token context window. Thinking is always enabled with low, high or max effort.
Entrée
Sortie
Entrée
≈ $0.14
Sortie
≈ $0.49
Lecture cache
≈ $0.0405
Gemini 3.5 Flash de Google, modèle conversationnel multimodal rapide et économique, entrée image et texte, contexte d'1 million de tokens, forte charge.
Entrée
Sortie
Entrée
≈ $0.938
Sortie
≈ $6.25
Lecture cache
≈ $0.0938
MiniMax M3, grand modèle de langage à fenêtre de contexte d'1 million de tokens, excelle en compréhension de longs documents, raisonnement et outils.
Entrée
Sortie
Entrée
≈ $1.2
Sortie
≈ $5
Lecture cache
≈ $1.5
DeepSeek V4, LLM axé raisonnement avec contexte de 128K tokens, excelle en génération de code et logique complexe, à un tarif très compétitif.
Entrée
Sortie
Entrée
≈ $0.212
Sortie
≈ $0.475
Lecture cache
≈ $0.025
GPT-5.5 d'OpenAI, modèle phare pour raisonnement complexe, génération de code et instructions multi-étapes, contexte de 400K tokens pour apps exigeantes.
Entrée
Sortie
Entrée
≈ $4.25
Sortie
≈ $25
Lecture cache
≈ $0.425
GPT-5.6 Sol d'OpenAI est la version haute capacité de la famille GPT-5.6 pour le raisonnement complexe, le code, les agents et l'automatisation exigeante.
Entrée
Sortie
Entrée
≈ $6
Sortie
≈ $40
Lecture cache
≈ $0.85
OpenAI GPT-6 — a flagship model for complex reasoning, code generation, and multi-step instructions, with a 400K-token context window for demanding apps
Entrée
Sortie
Entrée
≈ $3.5
Sortie
≈ $30
Lecture cache
≈ $0.531
Grok 4.5 de xAI est un modèle puissant pour le raisonnement, l'analyse de code, les contextes longs et les assistants connectés aux outils.
Entrée
Sortie
Entrée
≈ $0.6
Sortie
≈ $1.2
Lecture cache
≈ $0.6
Grok 4.6 is an advanced AI model designed to deliver fast, writing, coding, research, data analysis, and creative problem-solving through natural conversation
Entrée
Sortie
Entrée
≈ $0.6
Sortie
≈ $1.2
Lecture cache
≈ $0.6
A premium reasoning route for visual front-end prototyping, repository-scale coding, large evidence sets, long-running agents, and complex knowledge work that benefits from a 1.05M-token working context.
Entrée
Sortie
Entrée
≈ $2
Sortie
≈ $10
Lecture cache
≈ $0.2
Grok 4.7 for text conversations and coding through an OpenAI-compatible API. Priced at the same credit rates as Grok 4.6.
Entrée
Sortie
Entrée
≈ $0.6
Sortie
≈ $1.2
Lecture cache
≈ $0.6
Gemini 2.5 Flash Lite de Google, modèle conversationnel ultra économique et rapide, contexte d'1 million de tokens, pour tâches quotidiennes fréquentes.
Entrée
Sortie
Entrée
≈ $0.1
Sortie
≈ $0.15
Lecture cache
≈ $0.01
Gemini 3.1 Flash Lite de Google améliore le raisonnement par rapport à la 2.5 tout en restant économique, équilibrant vitesse et qualité au quotidien.
Entrée
Sortie
Entrée
≈ $0.15
Sortie
≈ $1
Lecture cache
≈ $0.0125
Gemini 3.1 Pro de Google, modèle multimodal phare de Gemini, raisonnement complexe puissant et long contexte pour applications de production exigeantes.
Entrée
Sortie
Entrée
≈ $1.25
Sortie
≈ $7.5
Lecture cache
≈ $0.625
GPT-4o mini d'OpenAI, modèle conversationnel multimodal rapide et abordable, pour questions quotidiennes et aide au code léger, faible coût.
Entrée
Sortie
Entrée
≈ $0.275
Sortie
≈ $0.412
Lecture cache
≈ $0.0138
GPT-5.4 d'OpenAI, modèle très performant pour raisonnement avancé, génération de code et workflows d'agents, contexte de 400K tokens en production.
Entrée
Sortie
Entrée
≈ $2.5
Sortie
≈ $15
Lecture cache
≈ $0.25
Claude Opus 4.8 d'Anthropic, modèle phare de la gamme pour raisonnement, code et rédaction longue les plus exigeants, excellente gestion du contexte long.
Entrée
Sortie
Entrée
≈ $2.5
Sortie
≈ $12
Lecture cache
≈ $0.25
Anthropic Claude Opus 5 from APIAny — Anthropic’s newest Opus-tier flagship for the hardest coding, long-running agents, and judgment-heavy review.
Entrée
Sortie
Entrée
≈ $3.75
Sortie
≈ $18.75
Lecture cache
≈ $0.375
Claude Sonnet 4.6 d'Anthropic, modèle phare équilibré, raisonnement puissant à vitesse et coût adaptés à la production, déploiements stables à grande échelle.
Entrée
Sortie
Entrée
≈ $1.5
Sortie
≈ $7.5
Lecture cache
≈ $1
APIAny liste les modèles publics de chat et de texte sur un endpoint compatible OpenAI, avec des prix en crédits sur chaque fiche.
Par APIAny Editorial · Mis à jour
Filtrez par type ou fournisseur, comparez les crédits, puis ouvrez une page modèle pour le playground et les exemples de requête.
Sources
Les citations ci-dessous proviennent de la documentation API officielle que APIAny implémente.
The Chat Completions API endpoint will generate a model response from a list of messages comprising a conversation.
The Gemini API provides access to Google's most capable generative AI models.
The Images API provides several endpoints that let you generate images from text prompts or create edits of existing images.
Le catalogue de modèles APIAny est la liste live des modèles publics chat, image, vidéo, audio et sécurité appelables avec une seule clé API.