
Anthropic
Claude Opus 5
À partir de $2.40 par 1M de tokens
Kimi K3 est le modèle fleuron de Moonshot pour le codage à long horizon et le travail de connaissance de bout en bout. Kimi K3 lit une fenêtre de contexte de 1 048 576 tokens, raisonne toujours, et propose un curseur d'effort de raisonnement à trois crans, de low à max. La vision native couvre les images et la vidéo, les poids sont ouverts, et sur reAPI Kimi K3 est facturé sous le tarif par token publié par Moonshot, en entrée comme en sortie.
kimi-k3Les modèles de chat tournent sur la passerelle api.reapi.ai, qui possède sa propre console et sa propre clé. Ouvre la console pour exécuter Kimi K3 via l'interface Chat Completions compatible OpenAI.
Des workflows réels et des cas d'usage en production que tu peux construire et déployer avec ce modèle.

Moonshot positionne Kimi K3 sur le codage à long horizon et le décrit menant des tâches d'ingénierie avec un minimum de supervision humaine — lisant et modifiant de grandes bases de code, coordonnant des outils en terminal. Ce qui distingue Kimi K3 d'un modèle de code purement textuel, c'est que la vision est native et non greffée : captures d'écran et retours visuels sont des entrées, et Moonshot cite explicitement le développement de jeux, l'ingénierie frontend et la CAO. Cela ferme une boucle qu'un modèle textuel ne peut pas fermer, puisque le modèle peut regarder ce qu'il vient de construire et juger si la mise en page est réellement fautive avant d'éditer à nouveau.
Lire la doc API
La fenêtre de contexte de Kimi K3 fait 1 048 576 tokens, et la FAQ de Moonshot précise que le tarif est plat, sans palier selon la longueur de contexte — remplir la fenêtre coûte donc, au token, ce que coûte n'importe quel autre token. Un ensemble de contrats, un dossier de recherche ou une année de dépôts part entier vers Kimi K3, ce qui supprime la couche de récupération dont le seul rôle était de contourner un contexte étroit. Le travail répété revient ensuite au cache de contexte : sur Kimi K3 il est automatique, sans identifiant de cache, sans TTL et sans paramètre supplémentaire — un préfixe stable devant une question qui change est donc le motif à adopter.

Deux contrôles d'appel d'outils sont arrivés avec cette génération. Un choix d'outil requis force au moins un appel sur le tour, ce qui est la façon d'empêcher un agent de répondre de mémoire quand il devait aller vérifier — les modèles K2 refusent cette valeur, Kimi K3 l'accepte. Et un outil peut être introduit en cours de conversation en plaçant sa définition complète dans un message système, si bien qu'un large inventaire d'outils n'a pas à être déclaré d'avance à chaque requête. Les sorties structurées et un JSON Schema gardent parsable ce que Kimi K3 renvoie en fin de boucle.
Basé sur les crédits — 1 crédit = 0,001 USD. Tu ne paies que les générations réussies.
| Catégorie | Unité | Prix |
|---|---|---|
| Facturation au token | ||
| Entrée | 1M tokens | $2.5 |
| Sortie | 1M tokens | $12 |
Moonshot publie un tarif par million de tokens pour l'entrée et la sortie de Kimi K3. Sur reAPI, Kimi K3 passe sous ce tarif des deux côtés, et d'un cinquième entier en sortie — aucun abonnement en dessous, aucun engagement minimum, paiement à l'usage en USD sur le solde de votre passerelle. Les chiffres exacts figurent dans le tableau tarifaire de cette page.
Kimi K3 est servi depuis un endpoint `/v1/chat/completions` standard, et le quickstart de Moonshot pilote lui-même le modèle via le SDK OpenAI — cette compatibilité est donc le choix du fournisseur, pas une couche que nous ajoutons. Adopter Kimi K3 tient à une base URL, une clé et une chaîne de modèle. Pas de changement de SDK, et rien dans Kimi K3 ne réclame un client dédié.
La clé api.reapi.ai qui appelle Kimi K3 appelle aussi les familles Claude, GPT et Gemini. Opposer Kimi K3 à un modèle de pointe fermé, ou basculer quand un fournisseur passe une mauvaise heure, tient à une chaîne de modèle plutôt qu'à une deuxième intégration, une deuxième facture et un deuxième jeu d'identifiants.
Sur reAPI, ces deux modèles tombent pratiquement au même tarif par token, ce qui fait du prix la partie la moins intéressante de la comparaison. Ce qui diffère, c'est la forme : Kimi K3 est le modèle à poids ouverts qui raisonne toujours, rend son texte de raisonnement et accepte la vidéo, tandis que Claude Opus 5 est le modèle fermé à l'échelle d'effort plus fine qui garde son raisonnement pour lui. Deux de ces lignes sont celles qui cassent du code repris chez un autre fournisseur — sur Kimi K3 la réflexion ne se coupe pas, et son texte de raisonnement doit être renvoyé dans les historiques multi-tours.
La comparaison reflète le comportement documenté par chaque fournisseur au moment de la rédaction. Les tarifs sont décrits en termes de rapports et non de montants ; les chiffres réels pour Kimi K3 figurent dans le tableau tarifaire ci-dessus.
Inscrivez-vous sur api.reapi.ai, ouvrez la console et générez une clé API. Cette unique clé atteint Kimi K3 et tous les autres modèles de la passerelle, facturés depuis un seul solde.
OuvrirMettez votre base URL sur api.reapi.ai et votre clé sur celle que vous venez de créer. Tout client qui parle déjà OpenAI Chat Completions fonctionne sans modification — aucun changement de SDK n'est nécessaire pour atteindre Kimi K3.
OuvrirMettez le champ model sur `kimi-k3` et postez vos messages. Activez le streaming pour les longues sorties, retirez tout temperature ou top_p que vous envoyiez, et choisissez un effort de raisonnement — Kimi K3 réfléchit toujours, et le cran par défaut est le plus coûteux.
OuvrirQuestions courantes sur ce modèle.
Explorez d’autres modèles de la même catégorie.

Anthropic
À partir de $2.40 par 1M de tokens

OpenAI
À partir de $2.00 par 1M de tokens

Anthropic
À partir de $2.00 par 1M de tokens

Anthropic
À partir de $2.00 par 1M de tokens
Essaie-le dans le playground ou récupère une clé API pour intégrer dès maintenant.