
API d'IA gratuite en 2026 : ce que chacun autorise
L'API Gemini gratuite exclut tous les modèles d'images, vidéos et musique. Découvrez les limites réelles et tarifs officiels de chaque fournisseur en 2026.
Si vous cherchiez une API d'IA gratuite pour générer des images ou des vidéos sans frais, la page tarifaire officielle de Google a une mauvaise nouvelle. Tous les modèles Nano Banana, les trois modèles Imagen 4, chaque version de Veo et les modèles de musique Lyria affichent le même message sous Couche gratuite : « Non disponible »[1]. La couche gratuite existe bel et bien, mais elle se limite au texte.
Cette distinction est enfouie dans un tableau que la plupart des gens survolent, et elle explique beaucoup de frustrations. Voici ce que la couche gratuite de chaque grand fournisseur autorise réellement, extrait de leurs pages tarifaires en juillet 2026, plus la ligne du tableau de Google que presque personne ne lit.
Résumé
- La couche gratuite de Google n'a pas de modèles d'images, de vidéos ou de musique. Nano Banana, Nano Banana 2, 2 Lite, Pro, Imagen 4, Veo 2, Veo 3, Veo 3.1 et Lyria 3 affichent tous « Non disponible » sous Couche gratuite[1].
- Google marque les entrées de la couche gratuite comme utilisées pour améliorer ses produits. Chaque bloc de modèle porte la ligne « Utilisé pour améliorer nos produits », avec Oui pour la Couche gratuite et Non pour la Couche payante[1]. Google ne précise pas ce qu'« améliorer » couvre.
- Les limites de débit de la couche gratuite ne sont plus publiées. Google dit que les limites « peuvent être consultées dans Google AI Studio » et que « les limites de débit spécifiées ne sont pas garanties et la capacité réelle peut varier »[2].
- OpenAI documente une demande de test gratuite, mais aucune allocation en cours. Son guide de démarrage vous félicite pour « avoir exécuté une demande API de test gratuite »[8] ; la page tarifaire ne mentionne aucune allocation d'inférence gratuite au-delà de cela[3].
- Replicate a des limites gratuites ; fal n'en annonce pas. Replicate vous permet de « exécuter certains modèles sur Replicate gratuitement, mais après un certain temps, on vous demandera de configurer la facturation »[7]. La page tarifaire de fal ne mentionne pas du tout une couche gratuite[4].
- Payer une fraction de centime par image est un problème différent de ne rien payer, et beaucoup plus facile à résoudre.
Ce que la couche gratuite d'API Gemini de Google autorise réellement
La page tarifaire de l'API Gemini de Google liste une colonne Couche gratuite à côté d'une colonne Couche payante pour chaque modèle. Vingt modèles affichent « Gratuit » dans cette colonne : Gemini 3.6 Flash, 3.5 Flash, 3.5 Flash-Lite, 3.5 Live Translate, 3.1 Flash-Lite, 3.1 Flash Live Preview, 3.1 Flash TTS Preview, 3 Flash Preview, 2.5 Pro, 2.5 Flash, 2.5 Flash-Lite, 2.5 Flash Native Audio, 2.5 Flash Preview TTS, les modèles Embedding, Robotics-ER 1.6 Preview et Gemma 4[1].
Tous les modèles de médias génératifs figurent sur l'autre liste. Le tableau ci-dessous est copié de cette page.
| Modèle | Couche gratuite | Couche payante |
|---|---|---|
| Nano Banana (Gemini 2.5 Flash Image) | Non disponible | 0,039 $ par image |
| Nano Banana 2 Lite (3.1 Flash Lite Image) | Non disponible | 0,0336 $ par 1K images |
| Nano Banana 2 (3.1 Flash Image) | Non disponible | 0,067 $ par 1K images |
| Nano Banana Pro (Gemini 3 Pro Image) | Non disponible | 0,134 $ par 1K/2K images |
| Imagen 4 Fast / Standard / Ultra | Non disponible | 0,02 $ / 0,04 $ / 0,06 $ par image |
| Veo 3.1 Lite | Non disponible | 0,05 $ par seconde (720p) |
| Veo 3.1 Fast | Non disponible | 0,10 $ par seconde (720p) |
| Veo 3.1 Standard | Non disponible | 0,40 $ par seconde (720p et 1080p) |
| Veo 2 | Non disponible | 0,35 $ par seconde |
| Lyria 3 Clip / Pro | Non disponible | 0,04 $ / 0,08 $ par chanson |
Google le dit explicitement aussi. La description de Veo 3.1 se lit : « disponible pour les développeurs sur le niveau payant de l'API Gemini »[1].
Donc quand quelqu'un demande si Nano Banana a une API gratuite, la réponse de la documentation de Google elle-même est non, pour toutes les quatre variantes, pour l'entrée comme pour la sortie. La ligne de grounding avec Google Search sur ces modèles est aussi marquée « Non disponible » pour la couche gratuite[1].
La ligne que personne ne lit
Faites défiler jusqu'au bas de n'importe quel bloc de modèle sur cette page tarifaire et vous trouverez une ligne intitulée « Utilisé pour améliorer nos produits ». Pour la Couche gratuite, il y a Oui. Pour la Couche payante, il y a Non[1].
Cette ligne apparaît sous chaque modèle, y compris ceux qui sont véritablement gratuits. Google ne définit pas « améliorer nos produits » sur cette page, donc la lecture honnête est celle-ci : sur la couche gratuite, vos invites et tout document ou image que vous joignez sont conservés pour l'utilisation propre de Google d'une manière que la couche payante exclut.
Pour un projet de week-end, c'est acceptable. Pour tout ce qui touche au travail client, aux documents internes ou au contenu soumis par l'utilisateur, cela vaut la peine de relire deux fois avant de coller une invite de production dans une clé de couche gratuite. La couche payante bascule cette ligne à Non, ce qui est la différence de produit réelle entre les deux couches pour de nombreux modèles.
Des limites de débit que vous ne pouvez pas consulter avant de vous inscrire
Jusqu'à récemment, vous pouviez lire directement les chiffres de demandes par minute et par jour de la couche gratuite de Google dans la documentation. Ce tableau a disparu. La page des limites de débit dit maintenant que les limites « dépendent de divers facteurs (tels que votre niveau d'utilisation) et peuvent être consultées dans Google AI Studio », suivi de « les limites de débit spécifiées ne sont pas garanties et la capacité réelle peut varier »[2].
Le tableau des niveaux d'utilisation est toujours là, et il est court. La qualification pour la couche gratuite est « Projet actif ou essai gratuit » sans plafond de facturation. Le niveau 1 vous oblige à « configurer et lier un compte de facturation actif » avec un plafond de 250 $. Le niveau 2 nécessite 100 $ payés plus trois jours, le niveau 3 nécessite 1 000 $ payés plus trente jours[2].
Un plafond de couche gratuite est toujours publié, et il vaut la peine de le savoir : le grounding de recherche sur Gemini 2.5 Flash est « Gratuit, jusqu'à 500 RPD », avec cette limite quotidienne partagée avec Flash-Lite[1]. Tout le reste sur le débit de la couche gratuite dépend du projet et n'est visible que depuis votre compte.
Deux conséquences pratiques. Vous ne pouvez pas planifier la capacité d'une API d'IA gratuite avant d'avoir un compte. Et quitter la couche gratuite est une étape de compte de facturation, pas une mise à niveau de plan, donc la migration « ajouter une carte plus tard » est un peu plus compliquée qu'il n'y paraît.
Ce que les autres fournisseurs entendent par gratuit
Le paysage en dehors de Google est plus simple, et dans la plupart des cas, cela signifie qu'il n'y a pas d'API d'IA gratuite à discuter du tout.
OpenAI. Le guide de démarrage se termine par « Félicitations, vous avez exécuté une demande API de test gratuite ! » puis vous oriente vers la facturation[8]. OpenAI ne publie pas le nombre de telles demandes qu'une nouvelle clé reçoit, seulement que la procédure pas à pas est gratuite à compléter. Au-delà de cela, la page tarifaire liste les taux par token et par image sans allocation d'inférence gratuite ; ses seules quantités gratuites sont le stockage, 1 Go pour la recherche de fichiers et 1 Go par compte par mois pour les téléchargements ChatKit[3]. ChatGPT gratuit est un produit grand public et ne s'accompagne pas de crédits API.
fal.ai. La page tarifaire s'intitule Pay-Per-Use. La lisant de bout en bout, il n'y a aucune mention d'une couche gratuite, d'un essai ou de crédits de démarrage[4].
Replicate. C'est la seule véritable couche gratuite du groupe, et elle est délibérément vague : « Vous pouvez exécuter certains modèles sur Replicate gratuitement, mais après un certain temps, on vous demandera de configurer la facturation »[7]. Pas de liste de modèles, pas de quota, pas de fenêtre de réinitialisation. Au-delà de cela, la page tarifaire s'applique : « Vous ne payez que pour ce que vous utilisez sur Replicate. Certains modèles sont facturés par matériel et heure, d'autres par entrée et sortie »[5] — et les modèles facturés par matériel facturent pour le temps GPU occupé, donc un modèle lent coûte plus cher qu'un modèle rapide pour une sortie identique.
Remarquez la forme de ce qui est offert. Un appel de procédure pas à pas documenté gratuitement, ou une allocation non spécifiée sur un sous-ensemble non spécifié. Personne sur ce marché ne donne gratuitement la génération d'images ou de vidéos à grande échelle, car chaque génération a un coût de calcul difficile en dessous. Le texte est assez bon marché pour être subventionné par bonne volonté. Une image 4K ne l'est pas.
Ce qu'une fraction de centime achète réellement
Une fois que vous acceptez que le média génératif n'est gratuit nulle part, la question change de « qui est gratuit » à « à quel point la première facture peut-elle être petite ». C'est une bien meilleure question, car la réponse est maintenant véritablement petite.
Voici les taux spécifiques au modèle actuel sur reAPI, où 1 crédit = 0,001 $ et les générations défaillantes sont remboursées automatiquement. Les lignes Seedance ci-dessous sont les taux de base sans vidéo source[6] :
| Modèle et niveau | Prix |
|---|---|
| GPT Image 2, Stable Low | 0,005 $ par image |
| Nano Banana 2 Lite, 1K | 0,02 $ par image |
| GPT Image 2, Self 1K | 0,03 $ par image |
| GPT Image 2, Self 4K | 0,08 $ par image |
| Seedance 2.0 Mini, 480p | 0,038 $ par seconde de sortie |
| Seedance 2.0 Fast Face, 480p | 0,062 $ par seconde de sortie |
| Seedance 2.0 Face, 480p | 0,07125 $ par seconde de sortie |
| Seedance 2.0 Mini, 720p | 0,082 $ par seconde de sortie |
| Seedance 2.0 Fast Face, 720p | 0,132 $ par seconde de sortie |
| Seedance 2.0 Face, 720p | 0,15375 $ par seconde de sortie |
Les modèles de texte facturent par token plutôt que par génération, et c'est là que la couche gratuite de Google est un véritable concurrent. La raison de payer pour le texte est cette ligne de données, pas la capacité[1] :
| Modèle | Entrée | Sortie |
|---|---|---|
| Kimi K3 | 2,50 $ pour 1M tokens | 12 $ pour 1M tokens |
| GPT-5.6 Sol | 4 $ pour 1M tokens | 24 $ pour 1M tokens |
Deux des taux d'image méritent qu'on s'y attarde. Nano Banana 2 Lite à 0,02 $ par 1K images est inférieur au tarif payant de Google lui-même de 0,0336 $ pour le même modèle[1][6], et il ne nécessite pas de compte de facturation lié. Et un rendu GPT Image 2 de bas niveau à un demi-centime signifie que tester une invite vingt fois coûte un dime.
S'inscrire sur reAPI inclut des crédits de démarrage sans carte requise, suffisant pour parcourir le guide de démarrage et voir une vraie sortie avant de décider quoi que ce soit. Les taux par modèle pour tout ce qui n'est pas listé ci-dessus sont sur la page tarifaire, à côté du prix officiel affiché de chaque modèle à titre de comparaison.
Une contrainte supplémentaire sans rapport avec le prix : Google intègre un filigrane SynthID dans la sortie image de ses modèles. Si votre cas d'usage implique la revente ou l'édition en aval, lisez ce que SynthID fait à la sortie Nano Banana avant de vous engager dans un pipeline.
FAQ
Puis-je obtenir une API d'IA gratuite ?
Pour le texte, oui. L'API Gemini de Google propose environ vingt modèles de texte, audio et embedding sans frais, y compris Gemini 2.5 Pro et la famille 3.x Flash[1]. Pour la génération d'images, de vidéos ou de musique, aucun grand fournisseur n'offrait de couche gratuite en juillet 2026.
Nano Banana a-t-il une API gratuite ?
Non. Les quatre variantes Nano Banana répertorient tous la Couche gratuite comme « Non disponible » pour l'entrée, la sortie et le grounding de recherche. Les taux payants vont de 0,0336 $ par 1K images sur 2 Lite à 0,24 $ par image 4K sur Pro[1].
Y a-t-il une API Veo 3.1 gratuite ?
Non. Google décrit Veo 3.1 comme « disponible pour les développeurs sur le niveau payant de l'API Gemini » et répertorie la Couche gratuite comme « Non disponible » pour les variantes Standard, Fast et Lite[1].
Google s'entraîne-t-il sur mes demandes API de couche gratuite ?
La formulation de Google est « Utilisé pour améliorer nos produits », pas « s'entraîner », et la page ne définit pas le terme. Cette ligne se lit Oui sur la Couche gratuite et Non sur la Couche payante pour chaque modèle[1]. Elle s'applique aux modèles qui sont réellement gratuits, puisque les modèles de médias n'ont pas de couche gratuite du tout.
Quelles sont les limites de débit Gemini de la couche gratuite ?
Les limites de demande par modèle ne sont plus publiées. La documentation vous dirige pour consulter vos propres limites dans Google AI Studio et ajoute que « les limites de débit spécifiées ne sont pas garanties et la capacité réelle peut varier »[2]. La seule exception toujours imprimée est le grounding de recherche à 500 demandes par jour sur la couche gratuite[1]. Quiconque vous cite un chiffre RPM spécifique de couche gratuite pour un modèle lit une version en cache de cette page.
Les clés API OpenAI s'accompagnent-elles de crédits gratuits ?
Le guide de démarrage décrit explicitement son appel de procédure pas à pas comme « une demande API de test gratuite »[8], mais OpenAI ne documente pas une allocation gratuite permanente. La page tarifaire n'en mentionne pas ; ses seules quantités gratuites sont 1 Go de stockage de recherche de fichiers et 1 Go par mois de stockage de téléchargement ChatKit[3].
Replicate est-il gratuit pour commencer ?
Oui, dans les limites que Replicate ne quantifie pas : « Vous pouvez exécuter certains modèles sur Replicate gratuitement, mais après un certain temps, on vous demandera de configurer la facturation »[7]. Les modèles et la quantité ne sont pas précisés, donc c'est un moyen d'essayer quelque chose plutôt que quelque chose à planifier. Après cela, « Vous ne payez que pour ce que vous utilisez »[5].
Quel est le moyen le moins cher de tester un modèle d'image ?
Les taux par image sont maintenant assez bas pour que le test soit une erreur d'arrondi. Un rendu Stable Low sur GPT Image 2 est 0,005 $, donc vingt images de test coûtent dix cents[6]. C'est un chemin plus prévisible que de contourner les quotas de couche gratuite que vous ne pouvez pas voir à l'avance.
Choisir un niveau sans se coincer
Si votre travail est du texte, prenez la couche gratuite de Google. Elle est véritablement gratuite et elle couvre des modèles capables. Le coût non mesuré en dollars est la ligne « Utilisé pour améliorer nos produits », ce qui compte pour certains projets et pas pour d'autres.
Si votre travail est des images, des vidéos ou de la musique, abandonnez la recherche d'une API d'IA gratuite et optimisez plutôt pour la plus petite première facture possible. Cela signifie une facturation par génération plutôt que par abonnement, pas de compte de facturation prérequis, et des taux que vous pouvez lire avant de vous inscrire. Une API d'IA gratuite qui exclut les modèles pour lesquels vous êtes venu n'est pas un point de départ. Un demi-centime par image l'est.
Références
- Google. Tarification de l'API Gemini Developer — taux de la couche gratuite et de la couche payante par modèle. Consultée en juillet 2026 depuis ai.google.dev/gemini-api/docs/pricing
- Google. Limites de débit de l'API Gemini — niveaux d'utilisation et qualification des niveaux. Consultée en juillet 2026 depuis ai.google.dev/gemini-api/docs/rate-limits
- OpenAI. Tarification des API. Consultée en juillet 2026 depuis platform.openai.com/docs/pricing
- fal.ai. Tarification des API GenAI — paiement à l'usage. Consultée en juillet 2026 depuis fal.ai/pricing
- Replicate. Tarification. Consultée en juillet 2026 depuis replicate.com/pricing
- reAPI. Tarification des modèles — GPT Image 2, Nano Banana 2 Lite, Seedance 2.0 Face, Fast Face et Mini. Taux Seedance consultés le 17 août 2026 depuis reapi.ai/models
- Replicate. Facturation — limites gratuites. Consultée en juillet 2026 depuis replicate.com/docs/topics/billing
- OpenAI. Guide de démarrage des API. Consultée en juillet 2026 depuis developers.openai.com/api/docs/quickstart
Lectures complémentaires
- reAPI. Couche gratuite de l'API Nano Banana. reapi.ai/blog/nano-banana-api-free-tier
- reAPI. Ce que SynthID fait à la sortie Nano Banana. reapi.ai/blog/nano-banana-watermark-synthid
Auteur

Catégories
Plus d'articles

Meilleures alternatives à CometAPI en 2026 : 5 options comparées
Vous cherchez une alternative à CometAPI en 2026 ? Comparez OpenRouter, WaveSpeed, Together AI, Replicate et reAPI sur les modèles, les prix, la vitesse et l’API.


API Motion Control Kling : v2.6 vs v3, prix et préparation
Configurez Kling Motion Control v2.6 ou v3 avec les bons paramètres d'orientation, la durée source et le tarif pour minimiser la dérive du visage et du corps.


Seedance Face Detected : les erreurs expliquées
Résoudre les erreurs Seedance Face Detected en vérifiant références, formats, contrôle automatisé et remboursement, sans supposer leur cause interne.
