Comparatif et prix des modèles IA

Pour l’estimation du coût par image, le prompt fait environ ~600 tokens input + image 640×640 ≈ ~500 tokens image = ~1100 tokens input, et la réponse JSON ≈ ~200 tokens output.

Modèles à tokens (LLM/VLM)

ModèlePrix input / output ($/M tokens)Coût/image
Grok 4.3$1.25 / $2.50$0.0019
Gemini 3.5-flash$1.50 / $9.00$0.0035
Mistral medium-3.5$1.50 / $7.50$0.0032
Pixtral-large-latest$2.00 / $6.00$0.0034
Claude sonnet-5 (intro, jusqu’au 31/08/26)$2.00 / $10.00$0.0042
Claude sonnet-5 (prix standard après 31/08/26)$3.00 / $15.00$0.0063
Gemini 3.1-pro-preview$2.00 / $12.00$0.0046
Claude opus-4-8$5.00 / $25.00$0.0105
GPT-5.6 (tier « Sol », flagship)$5.00 / $30.00$0.0115
GPT-5.6 (tier « Terra »)$2.50 / $15.00$0.0058
GPT-5.6 (tier « Luna »)$1.00 / $6.00$0.0023
GPT-5.5$5.00 / $30.00$0.0115
Claude fable-5$10.00 / $50.00$0.0210

Mistral reste gratuit pour un usage raisonnable …

Perplexity : Si l’api et le mode pré analyser l’évènement sont activés l’application passe par les modèles Sonar de Perplexity avec recherche web activée, il faut ajouter des frais fixes de $5–14 par 1000 requêtes en plus des tokens.

Rekognition est à utiliser que pour la reconnaissance de personne pas adapté à la création de légende.

Rekognition dégresse fortement en volume (jusqu’à $0.00025/image au-delà de 35 Millions d’images/mois.