Explorez les modèles de chat, d’image, de vidéo et d’audio d’APIAny : capacités, types de requêtes, prix et paramètres pour chaque modèle.
30 groupes

Z-Image d'Alibaba, modèle texte-vers-image léger et économique, multiples formats, parfait pour affiches, visuels e-commerce et contenu en masse.
Entrée
Sortie
dès
8 crédits /img

GPT-Image 2 d'OpenAI génère et retouche des images jusqu'en 4K (retouche localisée, fusion multi-références), facturé au token, pour design produit soigné.
Entrée
Sortie
dès
30 crédits /img

Nano Banana de Google, modèle d'image multicanal rapide et fiable, texte et image-vers-image, jusqu'à 5 références, pour la création visuelle quotidienne.
Entrée
Sortie
dès
15 crédits /img

Nano Banana 2 Lite de Google (Gemini 3.1 Flash-Lite Image), modèle léger DeepMind pour génération rapide en 1K et édition de prompts à faible latence.
Entrée
Sortie
dès
45 crédits /img

Nano Banana 2 de Google, modèle d'image haut de gamme, texte et image-vers-image, jusqu'à 4K et 14 références, pour l'e-commerce et le design exigeant.
Entrée
Sortie
dès
25 crédits /img

Nano Banana Pro de Google, version phare de la gamme pour workflows pro, génère des images 4K haute fidélité à partir de jusqu'à 14 images de référence.
Entrée
Sortie
dès
60 crédits /img

Seedance 5.0 de ByteDance, via le canal officiel Volcengine Ark, génère des images jusqu'en 3K, idéal pour visuels e-commerce et contenu marketing.
Entrée
Sortie
dès
70 crédits /img
Seedance 2.0 de ByteDance, modèle vidéo au rendu cinématographique avec bande-son native, clips de 5 à 15 secondes en 1080p, pour publicités et courts formats.
Entrée
Sortie
dès
720 crédits /video
Seedance 1.0 de ByteDance, modèle image-vers-vidéo léger et rapide, clips de 5 à 10 secondes à faible coût, pour produire en masse des vidéos courtes.
Entrée
Sortie
dès
70 crédits /video
Seedance 1.5 de ByteDance améliore mouvement et détail par rapport à la 1.0, bande-son native, clips image-vers-vidéo jusqu'à 12 secondes, formats soignés.
Entrée
Sortie
dès
150 crédits /video
Veo 3.1 Fast de Google génère vite des vidéos texte ou image-vers-vidéo avec audio synchronisé natif, en 16:9 ou 9:16, pour les formats courts sociaux.
Entrée
Sortie
dès
330 crédits /video

NSFW Image Detection classe le risque de contenu adulte dans les images envoyées ou distantes pour automatiser modération, files de contrôle et publication sécurisée.
Entrée
Sortie
dès
0.5 crédits /img
Gemini Omni texte-vers-vidéo de Google, via APIPod, génère des clips de 6, 8 ou 10 secondes en 720p ou 1080p à partir de texte, sans image de référence.
Entrée
Sortie
dès
500 crédits /video

GLM-5.2 de Zhipu, LLM bilingue chinois-anglais nouvelle génération, pour dialogue général, génération de code et tâches d'agent, performant en chinois.
Entrée
Sortie
Entrée
≈ $1.88-$3.75
Sortie
≈ $6.25-$12.5
Lecture cache
≈ $0.375-$0.75

Gemini 3.5 Flash de Google, modèle conversationnel multimodal rapide et économique, entrée image et texte, contexte d'1 million de tokens, forte charge.
Entrée
Sortie
Entrée
≈ $0.938-$1.88
Sortie
≈ $6.25-$12.5
Lecture cache
≈ $0.0938-$0.188

MiniMax M3, grand modèle de langage à fenêtre de contexte d'1 million de tokens, excelle en compréhension de longs documents, raisonnement et outils.
Entrée
Sortie
Entrée
≈ $1.2-$2.4
Sortie
≈ $5-$10
Lecture cache
≈ $1.5-$3

DeepSeek V4, LLM axé raisonnement avec contexte de 128K tokens, excelle en génération de code et logique complexe, à un tarif très compétitif.
Entrée
Sortie
Entrée
≈ $0.212-$0.425
Sortie
≈ $0.475-$0.95
Lecture cache
≈ $0.025-$0.05

GPT-5.5 d'OpenAI, modèle phare pour raisonnement complexe, génération de code et instructions multi-étapes, contexte de 400K tokens pour apps exigeantes.
Entrée
Sortie
Entrée
≈ $4.25-$8.5
Sortie
≈ $25-$50
Lecture cache
≈ $0.425-$0.85

GPT-5.6 Sol d'OpenAI est la version haute capacité de la famille GPT-5.6 pour le raisonnement complexe, le code, les agents et l'automatisation exigeante.
Entrée
Sortie
Entrée
≈ $6-$12
Sortie
≈ $40-$80
Lecture cache
≈ $0.85-$1.7

Grok 4.5 de xAI est un modèle puissant pour le raisonnement, l'analyse de code, les contextes longs et les assistants connectés aux outils.
Entrée
Sortie
Entrée
≈ $0.6-$1.2
Sortie
≈ $1.2-$2.4
Lecture cache
≈ $0.6-$1.2

A premium reasoning route for visual front-end prototyping, repository-scale coding, large evidence sets, long-running agents, and complex knowledge work that benefits from a 1.05M-token working context.
Entrée
Sortie
Entrée
≈ $2-$4
Sortie
≈ $10-$20
Lecture cache
≈ $0.2-$0.4

Gemini 2.5 Flash Lite de Google, modèle conversationnel ultra économique et rapide, contexte d'1 million de tokens, pour tâches quotidiennes fréquentes.
Entrée
Sortie
Entrée
≈ $0.1-$0.2
Sortie
≈ $0.15-$0.3
Lecture cache
≈ $0.01-$0.02

Gemini 3.1 Flash Lite de Google améliore le raisonnement par rapport à la 2.5 tout en restant économique, équilibrant vitesse et qualité au quotidien.
Entrée
Sortie
Entrée
≈ $0.15-$0.3
Sortie
≈ $1-$2
Lecture cache
≈ $0.0125-$0.025

Gemini 3.1 Pro de Google, modèle multimodal phare de Gemini, raisonnement complexe puissant et long contexte pour applications de production exigeantes.
Entrée
Sortie
Entrée
≈ $1.25-$2.5
Sortie
≈ $7.5-$15
Lecture cache
≈ $0.625-$1.25

GPT-4o mini d'OpenAI, modèle conversationnel multimodal rapide et abordable, pour questions quotidiennes et aide au code léger, faible coût.
Entrée
Sortie
Entrée
≈ $0.275-$0.55
Sortie
≈ $0.412-$0.825
Lecture cache
≈ $0.0138-$0.0275

GPT-5.4 d'OpenAI, modèle très performant pour raisonnement avancé, génération de code et workflows d'agents, contexte de 400K tokens en production.
Entrée
Sortie
Entrée
≈ $2.5-$5
Sortie
≈ $15-$30
Lecture cache
≈ $0.25-$0.5

Claude Opus 4.8 d'Anthropic, modèle phare de la gamme pour raisonnement, code et rédaction longue les plus exigeants, excellente gestion du contexte long.
Entrée
Sortie
Entrée
≈ $2.5-$5
Sortie
≈ $12-$24
Lecture cache
≈ $0.25-$0.5

Anthropic Claude Opus 5 from APIAny — Anthropic’s newest Opus-tier flagship for the hardest coding, long-running agents, and judgment-heavy review.
Entrée
Sortie
Entrée
≈ $3.75-$7.5
Sortie
≈ $18.75-$37.5
Lecture cache
≈ $0.375-$0.75

Claude Sonnet 4.6 d'Anthropic, modèle phare équilibré, raisonnement puissant à vitesse et coût adaptés à la production, déploiements stables à grande échelle.
Entrée
Sortie
Entrée
≈ $1.5-$3
Sortie
≈ $7.5-$15
Lecture cache
≈ $1-$2

Claude Sonnet 5 d'Anthropic cible les agents de code performants, le raisonnement prolongé, les workflows riches en outils et les applications de production à grand contexte.
Entrée
Sortie
Entrée
≈ $1.88-$3.75
Sortie
≈ $10-$20
Lecture cache
≈ $1.25-$2.5