Seedance 2.0 Mini & Fast API aux prix les plus bas au monde — jusqu'à 68 % de réduction sur le tarif officiel

Moonshot AI Models on AtlasCloud | Kimi

Atlas Cloud héberge la gamme complète Kimi via la MoonshotAI API, de K2-Thinking pour le raisonnement profond à K2.6 pour le codage par agent. Le tout facturé à l'usage, avec un contexte de 262K.

Moonshot AI est développé par Moonshot AI. Atlas Cloud (exploité par Atlas Cloud AI LLC) en fournit l’accès mais n’en est pas propriétaire. Toutes les marques appartiennent à leurs détenteurs respectifs.

Large Language Models by Moonshot AI

Propulsez le chat, le raisonnement et les agents à grande échelle avec les meilleurs grands modèles de langage, servis rapidement et à moindre coût sur Atlas Cloud.

Voir tous les modèles

Moonshot AI Models API Pricing Details

Compare standard vs. our pricing across every Moonshot AI model.

ModelStandard Price (USD)Our Price (USD)Discount
Kimi K3
$3/$15per 1M tokens1048.6K context
$3/$15M in/outper 1M tokens1048.6K context
View
Kimi K2.7 Code
$0.95/$4per 1M tokens262.1K context
$0.95/$4M in/outper 1M tokens262.1K context
View
Kimi K2.6
$0.95/$4per 1M tokens262.1K context
$0.95/$4M in/outper 1M tokens262.1K context
View
Kimi K2.5
$0.6/$3per 1M tokens262.1K context
$0.49/$2.5M in/outper 1M tokens262.1K context
View

Explore models from other providers

Instantly explore and experiment with 400+ production-ready models in the Atlas Playground. Start customizing with one click.

Cas d'utilisation de l'API Moonshot AI que vous pouvez développer sur Atlas Cloud

L'essaim d'agents et les capacités d'exécution à long terme de Kimi permettent aux équipes d'exécuter des tâches qui nécessiteraient des jours d'efforts humains en une seule session automatisée. Les équipes utilisent la série M en conjonction avec K2-Thinking pour tout couvrir, des modifications de code autonomes à la recherche multi-documents à grande échelle.

Modernisation de la Base de Code Héritée

Les équipes d'ingénierie utilisent Kimi K2.6 pour exécuter des agents de codage à long terme qui remanient de manière autonome les bases de code de production lors de sessions prolongées de plusieurs heures. Dans un exemple documenté, K2.6 a réécrit un moteur d'appariement financier vieux de 8 ans en 13 heures et a permis d'améliorer le débit de 185 % sans intervention humaine entre les validations (commits). La tarification à l'usage d'Atlas Cloud rend pratique l'exécution de ces sessions prolongées d'agents sans engagement de capacité.

Traitement parallèle de documents par lots

Les équipes opérationnelles utilisent l'essaim de 300 agents de Kimi K2.6 pour traiter de grands lots de documents en parallèle. Une seule exécution d'orchestration a mis en correspondance un CV avec 100 rôles professionnels et a produit en sortie 100 CV entièrement personnalisés. Le même modèle s'applique à l'examen de contrats, aux contrôles de conformité et à tout flux de travail où une entrée fixe doit être évaluée par rapport à un grand ensemble variable de cibles.

Raisonnement Profond pour l'Analyse Complexe

Les équipes de recherche et juridiques utilisent Kimi K2-Thinking pour des problèmes d'analyse en plusieurs étapes nécessitant un raisonnement interne prolongado. Le modèle prend en charge jusqu'à 200 à 300 appels d'outils séquentiels par session, bouclant sur des cycles raisonnement-appel-raisonnement sans intervention humaine entre les étapes. Sur Atlas Cloud, son prix est de 0,6 $ par million de tokens en entrée et il partage la fenêtre de contexte de 262K avec le reste de la gamme Kimi.

Production automatisée d'articles de recherche

Les équipes académiques et de contenu utilisent Kimi K2.6 pour transformer les documents sources en résultats de recherche complets. Lors d'une démonstration, K2.6 a converti un article d'astrophysique en un article de recherche de 40 pages, un ensemble de données structuré contenant plus de 20 000 entrées et 14 graphiques de niveau astronomique en une seule session. Cela réduit le délai d'exécution des flux de travail de la littérature aux résultats de plusieurs semaines à quelques heures.

Prospection Commerciale à Grande Échelle

Les équipes de croissance et de vente utilisent les essaims Kimi K2.6 pour identifier des prospects et générer des ressources de prospection en parallèle. Une exécution d'exemple a identifié 30 magasins de détail dans une ville cible sans sites Web et a généré une page de destination pour chacun d'eux. Le même modèle fonctionne pour l'enrichissement des pistes, la cartographie du paysage concurrentiel et toute tâche combinant la découverte et la génération de contenu à l'échelle d'une liste.

Analyse Visuelle de Documents et de Code

Les équipes produit et données utilisent les capacités de vision natives de Kimi K2.5 et K2.6 pour traiter les entrées d'images et de vidéos aux côtés du texte dans le même appel API. L'encodeur MoonViT gère les diagrammes, les captures d'écran, les maquettes d'interface utilisateur (UI) et les numérisations de documents sans prétraitement externe. Cela est utile pour les pipelines qui convertissent directement les spécifications visuelles en code, ou extraient des données structurées à partir de documents riches en images.

Concrétisez la vision de votre entreprise avec Atlas Cloud AI.

Contacter les ventes

Foire aux questions sur les modèles Moonshot AI

Kimi K2.6 is MoonshotAI's latest open-source multimodal LLM, released in April 2026 under a Modified MIT license. It runs a Mixture-of-Experts architecture with 1 trillion total parameters and 32 billion active during inference. It is designed for agentic coding, long-horizon task execution, and multi-agent swarm orchestration.

Kimi K2.6 évolue jusqu'à 300 sous-agents exécutant jusqu'à 4 000 étapes coordonnées en une seule exécution. Kimi K2.5 sur Atlas Cloud prend en charge l'exécution en essaim avec jusqu'à 100 sous-agents. Les tâches sont décomposées dynamiquement en sous-tâches parallèles, spécialisées par domaine, pour une production totalement autonome.

Kimi K2-Thinking utilise un raisonnement profond par chaîne de pensée avec jusqu'à 200 à 300 appels d'outils séquentiels par session. Le modèle raisonne, appelle un outil, interprète le résultat, appelle un autre outil et poursuit cette boucle sans intervention humaine. Il est adapté à l'inférence logique en plusieurs étapes, aux mathématiques complexes et aux problèmes où un raisonnement interne étendu améliore la précision.

Oui. Kimi K2.5 et K2.6 incluent MoonViT, un encodeur de vision de 400 millions de paramètres qui traite nativement les images et les vidéos. Vous pouvez passer des entrées d'image ou de vidéo directement dans l'appel API avec le texte sans prétraitement externe. Cela prend en charge les flux de travail d'analyse visuelle, de compréhension de documents et de génération d'image en code.

Oui. Kimi K2.6 est publié sous une licence MIT modifiée, qui autorise une utilisation commerciale. Les poids ouverts sont disponibles sur HuggingFace pour les déploiements auto-hébergés. Atlas Cloud propose également K2.6 via une API pour les équipes qui préfèrent un accès géré sans frais généraux d'infrastructure.

Kimi K2.6 obtient un score de 80,2 % sur SWE-Bench Verified et de 54,0 % sur Humanity's Last Exam avec des outils, surpassant GPT-5.5 sur ces deux benchmarks. Il est également en tête sur BrowseComp avec 83,2 %, devant GPT-5.4. Ces résultats sont obtenus à un coût par million de tokens environ 80 % inférieur à celui de GPT-5.5.

Le prix de Kimi K2.5 est de 0,49 $ par million de tokens d'entrée et de 2,5 $ par million de tokens de sortie sur Atlas Cloud. Kimi K2-Thinking et K2-Instruct-0905 fonctionnent à 0,6 $ par million de tokens d'entrée avec le même tarif de sortie. Consultez la page du modèle Kimi K2.6 sur Atlas Cloud pour connaître ses tarifs spécifiques actuels.

Explorer Plus de Familles

Seedance 2.5

L'API Seedance 2.5 est désormais disponible sur Atlas Cloud ! Elle offre aux développeurs le tout dernier modèle vidéo de ByteDance. Il génère jusqu'à 30 secondes de vidéo native en un seul passage à partir de texte, d'une seule image ou de jusqu'à 50 références multimodales, avec un son synchronisé et du texte multilingue dans le cadre. Sur Atlas Cloud, vous y accédez via une clé unique, la cohérence du sujet et la physique améliorée maintenant la fluidité des plans longs.

Voir la Famille

Wan 3.0

L'API Wan 3.0 est la nouvelle génération de la famille vidéo Wan d'Alibaba, conçue pour repousser les limites de la génération de formats longs, du contrôle multi-références et de la qualité audiovisuelle à de nouveaux sommets. Atlas Cloud héberge déjà Wan 2.7, 2.6 et 2.5, et Wan 3.0 fonctionne sur la même clé unifiée sans configuration distincte. Commencez à créer dès aujourd'hui. Faites défiler vers le bas jusqu'à la vitrine pour découvrir ce que Wan 3.0 peut créer.

Voir la Famille

MiniMax H3

MiniMax H3 est la famille de modèles vidéo de MiniMax pour la génération guidée par du texte, des images et des références. Créez des clips de 5 à 15 secondes, guidez le mouvement à l’aide d’une dernière image facultative, préservez les sujets des images de référence ou sélectionnez H3 Developer lorsque l’audio généré s’intègre au flux de travail. Atlas Cloud réunit H3, H3 Fast, H3 Max et H3 Developer dans un seul flux API, avec une tarification standard à partir de 0,038 $ par seconde. Commencez à créer dès aujourd’hui.

Voir la Famille

Seedream 5.0 Pro

L'API Seedream 5.0 Pro offre aux développeurs le modèle d'édition d'images contrôlable de ByteDance sur Atlas Cloud. Elle positionne les modifications avec précision à l'aide d'ancrages et de coordonnées, sépare les images en calques modifiables, fusionne de multiples références et fait correspondre les couleurs et matériaux exacts, avec du texte multilingue en 2K et 3K. Sur Atlas Cloud, vous y accédez via une seule clé !

Voir la Famille

Seedance 2.0

L'API Seedance 2.0 vous donne un accès en production au modèle vidéo multimodal de ByteDance — des entrées quadrimodales (texte, image, vidéo, audio) et un système « Universal Reference » leader du secteur qui verrouille la composition, les mouvements de caméra et les actions des personnages à travers les plans. Intégrez un contrôle de niveau réalisateur avec un seul appel d'API, un tarif fixe de 0,09 $/s, une clé instantanée et aucune liste d'attente — le tout soutenu par une disponibilité et une conformité de niveau entreprise. Seedance 2.0 Native 4K est désormais disponible !

Voir la Famille

GPT Image 2.5

La famille GPT Image 2.5 d'OpenAI offre aux développeurs le choix entre Flare et Sunburst pour les flux de travail d'images en production. Effectuez des rendus à des résolutions arbitraires allant jusqu'à 3840x2160 et choisissez parmi cinq niveaux de qualité, y compris xhigh et max, pour répondre à des exigences de sortie spécifiques. Atlas Cloud fournit une inférence REST prête à l'emploi sans démarrage à froid et avec une tarification standard à partir de 0,004 $ par génération. Commencez à créer dès aujourd'hui.

Voir la Famille

GPT Image 2

L'API GPT Image 2 offre aux développeurs un accès au dernier modèle d'image d'OpenAI, le successeur de GPT Image 1.5. Elle génère et modifie des images avec un rendu de texte précis pour les caractères latins et CJK, ainsi qu'une composition solide pour les affiches, les maquettes et les infographies. Sur Atlas Cloud, vous y accédez via une API unifiée aux côtés de plus de 300 modèles, avec des crédits gratuits, une disponibilité de 99,99 % et sans aucune vérification d'organisation OpenAI requise.

Voir la Famille

Gemini Omni Flash

L’API gemini omni met à la disposition des développeurs la famille Gemini Omni Flash nativement multimodale de Google DeepMind, notamment Gemini Omni 1.1 Flash. Créez des vidéos cinématographiques avec un audio natif synchronisé, animez des images fixes avec un contrôle précis des images de début et de fin, ou révisez des séquences existantes grâce à des modifications guidées par texte qui préservent le contenu inchangé. Atlas Cloud fournit une clé compatible OpenAI, un accès unifié et une tarification transparente à l’usage. Commencez à développer dès aujourd’hui.

Voir la Famille

Grok Imagine

L'API Grok Imagine couvre les modèles d'image, vidéo et parole d'xAI, de Image 2.0 à Video 1.5 et xAI TTS v1. Générez des images statiques en 1K ou 2K selon 14 rapports d'aspect, créez une vidéo de 15 secondes en 1080p, guidez les plans avec jusqu'à 7 images de référence, ou narrez-les dans 20 langues. Atlas Cloud exécute chaque mode sur un seul point de terminaison, avec un tarif à l'utilisation à partir de $0.02 par image et $0.05 par seconde. Commencez à créer aujourd'hui.

Voir la Famille

Google

Les modèles créatifs les plus puissants de Google sont tous disponibles sur Atlas Cloud. Veo 3.1 offre une génération de vidéos cinématographiques, Nano Banana 2 permet de créer des images haute fidélité, et Gemini apporte une intelligence multimodale à chaque flux de travail. Accédez à la suite complète de modèles Google via une seule API key avec une disponibilité Day-0 et une tarification à l'usage (pay-as-you-go).

Voir la Famille

Seedance 2.0 Mini

Seedance 2.0 Mini apporte la génération de vidéos multimodale de ByteDance aux flux de travail où la vitesse et les coûts sont primordiaux. Il offre les capacités de base de Seedance 2.0 avec une empreinte plus légère — une génération plus rapide, un coût par vidéo réduit et la même intégration API que celle que vous utilisez déjà. Pour les équipes qui gèrent des pipelines à haut volume ou du prototypage à grande échelle, Mini est le choix par défaut pratique.

Voir la Famille

ByteDance

De la génération de vidéos cinématiques à la création d'images haute fidélité, les modèles les plus puissants de ByteDance sont disponibles sur Atlas Cloud. Exécutez Seedance et Seedream à grande échelle avec les prix d'inférence les plus bas et aucune surcharge d'infrastructure.

Voir la Famille

Articles recommandés

Guides, tutoriels et actualités produit pour tirer le meilleur d'Atlas Cloud.