Pour l’estimation du coût par image, le prompt fait environ ~600 tokens input + image 640×640 ≈ ~500 tokens image = ~1100 tokens input, et la réponse JSON ≈ ~200 tokens output.

Modèles à tokens (LLM/VLM)
| Modèle | Prix input / output ($/M tokens) | Coût/image |
|---|---|---|
| Grok 4.3 | $1.25 / $2.50 | $0.0019 |
| Gemini 3.5-flash | $1.50 / $9.00 | $0.0035 |
| Mistral medium-3.5 | $1.50 / $7.50 | $0.0032 |
| Pixtral-large-latest | $2.00 / $6.00 | $0.0034 |
| Claude sonnet-5 (intro, jusqu’au 31/08/26) | $2.00 / $10.00 | $0.0042 |
| Claude sonnet-5 (prix standard après 31/08/26) | $3.00 / $15.00 | $0.0063 |
| Gemini 3.1-pro-preview | $2.00 / $12.00 | $0.0046 |
| Claude opus-4-8 | $5.00 / $25.00 | $0.0105 |
| GPT-5.6 (tier « Sol », flagship) | $5.00 / $30.00 | $0.0115 |
| GPT-5.6 (tier « Terra ») | $2.50 / $15.00 | $0.0058 |
| GPT-5.6 (tier « Luna ») | $1.00 / $6.00 | $0.0023 |
| GPT-5.5 | $5.00 / $30.00 | $0.0115 |
| Claude fable-5 | $10.00 / $50.00 | $0.0210 |
Mistral reste gratuit pour un usage raisonnable …
Perplexity : Si l’api et le mode pré analyser l’évènement sont activés l’application passe par les modèles Sonar de Perplexity avec recherche web activée, il faut ajouter des frais fixes de $5–14 par 1000 requêtes en plus des tokens.
Rekognition est à utiliser que pour la reconnaissance de personne pas adapté à la création de légende.
Rekognition dégresse fortement en volume (jusqu’à $0.00025/image au-delà de 35 Millions d’images/mois.