DEUX SEMAINES SEULEMENT | 20 % DE RÉDUCTION sur Seedream 5.0 Pro !

Comment exécuter Hermes Agent avec l'API DeepSeek depuis Atlas Cloud

Un guide étape par étape pour exécuter l'agent open-source Hermes sur les modèles DeepSeek V4 via l'API compatible OpenAI d'Atlas Cloud, avec des exemples de configuration et des tarifs.

Comment exécuter Hermes Agent avec l'API DeepSeek depuis Atlas Cloud

Vous avez installé Hermes Agent, l'agent autonome open-source de Nous Research, et vous avez maintenant besoin d'un modèle suffisamment économique pour fonctionner toute la journée et suffisamment puissant pour gérer de véritables appels d'outils. DeepSeek V4 est un choix évident en termes de coût, et Atlas Cloud sert la famille DeepSeek via un seul point de terminaison compatible OpenAI, aux côtés de plus de 300 autres modèles. Ce guide explique comment connecter Hermes Agent à DeepSeek sur Atlas Cloud, depuis l'URL de base et les ID de modèle jusqu'à un config.yaml fonctionnel, afin que l'agent s'exécute sur une infrastructure de qualité production sans un deuxième SDK.

Ce que vous connectez

Hermes Agent est un agent persistant et auto-améliorant qui s'exécute sur votre propre serveur. Il est conçu pour être agnostique au modèle et au fournisseur, il ne se soucie donc pas de savoir si les jetons DeepSeek proviennent directement de DeepSeek ou via une passerelle, tant que le point de terminaison parle la forme de l'API OpenAI.

Atlas Cloud est une plateforme d'inférence d'IA multimodale qui expose des modèles de texte, d'image et de vidéo via une seule clé API compatible OpenAI et un seul compte de facturation. Parce que la surface est compatible OpenAI, la connexion de Hermes est un changement d'URL de base et de clé, pas une réécriture.

Ce couplage est important pour un agent persistant. Hermes est conçu pour fonctionner pendant des semaines, accumulant de la mémoire et des compétences réutilisables, de sorte que le modèle derrière lui est un coût récurrent plutôt qu'un appel unique. DeepSeek V4 maintient ce coût récurrent bas sans sacrifier la qualité des appels d'outils, et le router via Atlas Cloud signifie que la même clé qui répond à un tour de chat peut ensuite générer une image ou un clip vidéo lorsqu'une compétence en a besoin. Vous ne choisissez pas seulement un modèle bon marché, vous choisissez un point de terminaison que l'agent ne dépassera pas.

Deux faits décident de toute la configuration, et il est important de les comprendre parfaitement avant de toucher un fichier de configuration :

  • L'URL de base d'Atlas Cloud est https://api.atlascloud.ai/v1.
  • Les ID de modèle DeepSeek sur Atlas Cloud portent le préfixe deepseek-ai/, par exemple deepseek-ai/deepseek-v4-pro. C'est différent du simple deepseek-v4-pro que Hermes utilise avec son fournisseur DeepSeek intégré, qui pointe vers le propre point de terminaison de DeepSeek. Lorsque vous routez via Atlas Cloud, vous utilisez l'ID complet préfixé et un fournisseur compatible OpenAI personnalisé, et non celui intégré.

Étape 1 : Obtenez votre clé API Atlas Cloud

Connectez-vous à console.atlascloud.ai, ouvrez Clés API, cliquez sur Créer une clé API et copiez-la dans un endroit sûr. L'accès est basé sur la consommation, il n'y a donc pas de dépôt ni de dépense minimale. Vous vous inscrivez, obtenez une clé et payez par requête.

Gardez la clé hors du contrôle de version. Hermes sépare délibérément les secrets des paramètres : config.yaml contient une structure non sensible et peut être commitée ou partagée en toute sécurité, tandis que ~/.hermes/.env contient les clés et est ignoré par Git par défaut. Placer la clé Atlas Cloud dans .env et y faire référence par son nom depuis la configuration est ce qui vous permet de versionner la configuration de votre agent sans divulguer d'informations d'identification.

text
1echo "ATLASCLOUD_API_KEY=your-atlas-cloud-key" >> ~/.hermes/.env

Étape 2 : Confirmez les ID de modèle DeepSeek que vous pouvez appeler

Atlas Cloud publie sa liste de modèles en direct sur un point de terminaison public, vous n'avez donc jamais à deviner un ID. Un appel rapide renvoie les chaînes exactes que l'API accepte.

text
1curl https://api.atlascloud.ai/v1/models \
2  -H "Authorization: Bearer $ATLASCLOUD_API_KEY"

Interroger la liste en premier n'est pas une perte de temps. Les ID de modèle changent à mesure que de nouvelles versions sont publiées, et un ID obsolète provenant d'un article de blog ou d'un ancien script est la raison la plus courante de l'échec d'un premier appel. Le point de terminaison /v1/models est la vérité pour ce que l'API acceptera aujourd'hui, donc le vérifier avant de modifier une configuration permet d'éviter une série d'erreurs de modèle inconnu. Les entrées DeepSeek que vous utiliserez le plus souvent sont les suivantes :

ID du modèleIdéal pourFenêtre contextuelle
deepseek-ai/deepseek-v4-proBoucle d'agent principale, codage, appels d'outils1M de jetons
deepseek-ai/deepseek-v4-flashTâches auxiliaires, débit élevé1M de jetons
deepseek-ai/deepseek-v3.2Chat général sensible aux coûts163K de jetons

DeepSeek V4 Pro est facturé 1,68 $ par million de jetons d'entrée et 3,38 $ par million de jetons de sortie sur Atlas Cloud, tandis que V4 Flash est facturé 0,14 $ en entrée et 0,28 $ en sortie. Cet écart est la raison principale de la séparation du travail principal et auxiliaire entre les deux, ce que la configuration ci-dessous fait.

Étape 3 : Pointez Hermes vers Atlas Cloud

Étant donné qu'Atlas Cloud est un point de terminaison compatible OpenAI personnalisé plutôt que le fournisseur DeepSeek intégré de Hermes, vous le définissez explicitement dans ~/.hermes/config.yaml. Le bloc de fournisseur nomme l'URL de base et la variable d'environnement qui contient votre clé, et le bloc de modèle sélectionne l'ID DeepSeek préfixé.

text
1inference:
2  provider: atlascloud
3  base_url: https://api.atlascloud.ai/v1
4  api_key_env: ATLASCLOUD_API_KEY
5  model:
6    default: deepseek-ai/deepseek-v4-pro

Enregistrez le fichier, puis démarrez l'agent.

text
1hermes

Si le premier message renvoie une réponse normale, le câblage est correct. Si vous obtenez une erreur d'authentification, la clé dans .env est incorrecte ou non chargée ; si vous obtenez une erreur de modèle inconnu, vérifiez à nouveau le préfixe deepseek-ai/ par rapport à la sortie /v1/models de l'étape 2.

L'erreur la plus courante ici est d'utiliser le fournisseur deepseek intégré de Hermes tout en s'attendant à ce qu'Atlas Cloud réponde. Le fournisseur intégré est câblé au propre point de terminaison de DeepSeek et à ses noms de modèle bruts, il facturera donc votre compte DeepSeek et ignorera complètement Atlas Cloud. Le routage via Atlas Cloud est un choix délibéré de fournisseur personnalisé : votre propre base_url, votre clé Atlas Cloud et les ID de modèle deepseek-ai/ préfixés. Gardez ces trois éléments ensemble et les deux chemins ne seront jamais confondus.

Étape 4 : Envoyez du travail bon marché à Flash

Hermes exécute de nombreux appels de faible valeur en arrière-plan : résumé Web, analyse de vision, compression de contexte, approbation de commande. Payer les tarifs V4 Pro pour ceux-ci est un gaspillage. Pointez les emplacements auxiliaires vers V4 Flash afin que la boucle principale conserve le modèle le plus puissant tandis que les tâches d'arrière-plan s'exécutent à une fraction du coût.

text
1auxiliary:
2  web_extract:
3    provider: atlascloud
4    base_url: https://api.atlascloud.ai/v1
5    api_key_env: ATLASCLOUD_API_KEY
6    model: deepseek-ai/deepseek-v4-flash
7  compression:
8    provider: atlascloud
9    base_url: https://api.atlascloud.ai/v1
10    api_key_env: ATLASCLOUD_API_KEY
11    model: deepseek-ai/deepseek-v4-flash
12    timeout: 120

Chaque emplacement auxiliaire accepte son propre fournisseur, modèle, URL de base, clé et chaîne de secours, vous pouvez donc ajuster chaque tâche d'arrière-plan indépendamment.

Étape 5 : Ajoutez une solution de secours pour la résilience

Un agent de longue durée finira par atteindre une limite de débit ou une connexion expirée. Une chaîne de secours le maintient en fonctionnement au lieu de générer une erreur. Ici, la tâche de compression essaie d'abord V4 Flash, puis revient à un deuxième modèle Atlas Cloud avant d'abandonner.

text
1auxiliary:
2  compression:
3    provider: atlascloud
4    base_url: https://api.atlascloud.ai/v1
5    api_key_env: ATLASCLOUD_API_KEY
6    model: deepseek-ai/deepseek-v4-flash
7    fallback_chain:
8      - provider: atlascloud
9        base_url: https://api.atlascloud.ai/v1
10        api_key_env: ATLASCLOUD_API_KEY
11        model: deepseek-ai/deepseek-v3.2

Hermes essaie chaque entrée dans l'ordre jusqu'à ce que l'une réussisse, de sorte qu'un seul problème de fournisseur ne bloque pas l'agent. Pour un agent qui s'exécute sans surveillance selon un calendrier, c'est la différence entre une tâche cron qui se rétablit discrètement et une qui meurt à 3 heures du matin et vous laisse une trace de pile le matin.

Quand cette configuration est la bonne

Exécuter Hermes sur DeepSeek via Atlas Cloud est le plus logique lorsque vous souhaitez une seule clé et une seule facture pour tout ce que l'agent touche. Parce que le même point de terminaison sert également des modèles d'image et de vidéo, un agent qui commence en texte seul peut ensuite générer des images ou des clips sans nouvelle intégration ni deuxième compte fournisseur. Si votre agent n'appellera jamais que DeepSeek et rien d'autre, le fournisseur DeepSeek intégré pointant vers la propre API de DeepSeek est le chemin le plus simple. La route Atlas Cloud prend tout son sens lorsque vous souhaitez avoir la possibilité d'ajouter des modèles de différentes modalités derrière une seule surface compatible OpenAI.

Vous pouvez confirmer chaque ID de modèle et prix en direct vous-même sur atlascloud.ai/models avant de valider quoi que ce soit dans un fichier de configuration, ce qui est l'habitude à conserver à mesure que la gamme DeepSeek évolue.

Modèles récents

Une seule API pour toute l'IA multimédia.

Explorer tous les modèles