Sie haben Hermes Agent, den Open-Source-autonomen Agenten von Nous Research, installiert und benötigen nun ein Modell, das günstig genug ist, um den ganzen Tag zu laufen, und stark genug, um echte Tool-Aufrufe zu verarbeiten. DeepSeek V4 ist eine offensichtliche Wahl in Bezug auf die Kosten, und Atlas Cloud bedient die DeepSeek-Familie über einen einzigen OpenAI-kompatiblen Endpunkt zusammen mit über 300 anderen Modellen. Diese Anleitung führt Sie durch die Verbindung von Hermes Agent mit DeepSeek auf Atlas Cloud, von der Basis-URL und den Modell-IDs bis zu einer funktionierenden config.yaml, sodass der Agent auf produktionsreifer Infrastruktur ohne ein zweites SDK läuft.
Was Sie verbinden
Hermes Agent ist ein persistenter, sich selbst verbessernder Agent, der auf Ihrem eigenen Server läuft. Er ist bewusst modell- und anbieterunabhängig, sodass es ihm egal ist, ob DeepSeek-Tokens direkt von DeepSeek oder über ein Gateway kommen, solange der Endpunkt die OpenAI-API-Form spricht.
Atlas Cloud ist eine Full-Modal-KI-Inferenzplattform, die Text-, Bild- und Videomodelle über einen OpenAI-kompatiblen API-Schlüssel und ein Abrechnungskonto bereitstellt. Da die Oberfläche OpenAI-kompatibel ist, ist die Verbindung von Hermes eine Änderung der Basis-URL und des Schlüssels, keine Neuschreibung.
Diese Paarung ist für einen persistenten Agenten wichtig. Hermes ist darauf ausgelegt, wochenlang zu laufen, Erinnerungen und wiederverwendbare Fähigkeiten anzusammeln, sodass das dahinterliegende Modell eine wiederkehrende Kostenquelle ist und kein einmaliger Aufruf. DeepSeek V4 hält diese wiederkehrenden Kosten niedrig, ohne die Qualität der Tool-Aufrufe zu beeinträchtigen, und die Weiterleitung über Atlas Cloud bedeutet, dass derselbe Schlüssel, der eine Chat-Antwort liefert, später ein Bild oder einen Videoclip generieren kann, wenn eine Fähigkeit dies erfordert. Sie wählen nicht nur ein günstiges Modell, sondern einen Endpunkt, dem der Agent nicht entwachsen wird.
Zwei Fakten entscheiden über die gesamte Einrichtung, und beide sollten genau richtig verstanden werden, bevor Sie eine Konfigurationsdatei anfassen:
- Die Atlas Cloud Basis-URL ist
https://api.atlascloud.ai/v1. - DeepSeek-Modell-IDs auf Atlas Cloud tragen das Präfix
deepseek-ai/, zum Beispieldeepseek-ai/deepseek-v4-pro. Dies unterscheidet sich von dem bloßendeepseek-v4-pro, das Hermes mit seinem integrierten DeepSeek-Anbieter verwendet, der auf DeepSeeks eigenen Endpunkt verweist. Wenn Sie über Atlas Cloud routen, verwenden Sie die vollständige präfixierte ID und einen benutzerdefinierten OpenAI-kompatiblen Anbieter, nicht den integrierten.
Schritt 1: Holen Sie sich Ihren Atlas Cloud API-Schlüssel
Melden Sie sich unter console.atlascloud.ai an, öffnen Sie API Keys, klicken Sie auf Create API Key und kopieren Sie ihn an einen sicheren Ort. Der Zugang ist Pay-as-you-go, es gibt also keine Einzahlung und keine Mindestausgaben. Sie melden sich an, erhalten einen Schlüssel und zahlen pro Anfrage.
Halten Sie den Schlüssel außerhalb der Versionskontrolle. Hermes trennt Geheimnisse absichtlich von Einstellungen: config.yaml enthält nicht-sensible Struktur und kann sicher committet oder geteilt werden, während ~/.hermes/.env Schlüssel enthält und standardmäßig von Git ignoriert wird. Wenn Sie den Atlas Cloud-Schlüssel in .env ablegen und ihn in der Konfiguration namentlich referenzieren, können Sie Ihre Agenten-Einrichtung versionieren, ohne Anmeldeinformationen preiszugeben.
text1echo "ATLASCLOUD_API_KEY=your-atlas-cloud-key" >> ~/.hermes/.env
Schritt 2: Bestätigen Sie die DeepSeek-Modell-IDs, die Sie aufrufen können
Atlas Cloud veröffentlicht seine Live-Modellliste an einem öffentlichen Endpunkt, sodass Sie nie eine ID erraten müssen. Ein schneller Aufruf liefert die genauen Zeichenfolgen, die die API akzeptiert.
text1curl https://api.atlascloud.ai/v1/models \ 2 -H "Authorization: Bearer $ATLASCLOUD_API_KEY"
Das Abfragen der Liste ist keine unnötige Arbeit. Modell-IDs ändern sich, wenn neue Versionen veröffentlicht werden, und eine veraltete ID aus einem Blogbeitrag oder einem alten Skript ist der häufigste Grund, warum ein erster Aufruf fehlschlägt. Der /v1/models-Endpunkt ist die absolute Wahrheit darüber, was die API heute akzeptiert, daher spart das Überprüfen vor dem Bearbeiten einer Konfiguration eine Runde von Fehlern aufgrund unbekannter Modelle. Die DeepSeek-Einträge, die Sie am häufigsten verwenden werden, sind diese:
| Modell-ID | Am besten geeignet für | Kontextfenster |
|---|---|---|
deepseek-ai/deepseek-v4-pro | Hauptagenten-Schleife, Codierung, Tool-Aufrufe | 1M Tokens |
deepseek-ai/deepseek-v4-flash | Hilfsaufgaben, hoher Durchsatz | 1M Tokens |
deepseek-ai/deepseek-v3.2 | Kostensensibler allgemeiner Chat | 163K Tokens |
DeepSeek V4 Pro kostet auf Atlas Cloud 1,68 $ pro Million Eingabe-Tokens und 3,38 $ pro Million Ausgabe-Tokens, während V4 Flash 0,14 $ Eingabe und 0,28 $ Ausgabe kostet. Diese Lücke ist der Hauptgrund, die Haupt- und Hilfsarbeit auf die beiden aufzuteilen, was die folgende Konfiguration tut.
Schritt 3: Hermes auf Atlas Cloud verweisen
Da Atlas Cloud ein benutzerdefinierter OpenAI-kompatibler Endpunkt und nicht der integrierte DeepSeek-Anbieter von Hermes ist, definieren Sie ihn explizit in ~/.hermes/config.yaml. Der Anbieterblock benennt die Basis-URL und die Umgebungsvariable, die Ihren Schlüssel enthält, und der Modellblock wählt die präfixierte DeepSeek-ID aus.
text1inference: 2 provider: atlascloud 3 base_url: https://api.atlascloud.ai/v1 4 api_key_env: ATLASCLOUD_API_KEY 5 model: 6 default: deepseek-ai/deepseek-v4-pro
Speichern Sie die Datei und starten Sie dann den Agenten.
text1hermes
Wenn die erste Nachricht eine normale Antwort zurückgibt, ist die Verkabelung korrekt. Wenn Sie einen Authentifizierungsfehler erhalten, ist der Schlüssel in .env falsch oder nicht geladen; wenn Sie einen Fehler aufgrund eines unbekannten Modells erhalten, überprüfen Sie das Präfix deepseek-ai/ erneut anhand der /v1/models-Ausgabe aus Schritt 2.
Der häufigste Fehler hierbei ist, den integrierten deepseek-Anbieter von Hermes zu verwenden, während man erwartet, dass Atlas Cloud antwortet. Der integrierte Anbieter ist fest mit DeepSeeks eigenem Endpunkt und seinen bloßen Modellnamen verdrahtet, sodass er Ihr DeepSeek-Konto gerne abrechnet und Atlas Cloud vollständig ignoriert. Das Routing über Atlas Cloud ist eine bewusste Wahl eines benutzerdefinierten Anbieters: Ihre eigene base_url, Ihr Atlas Cloud-Schlüssel und die präfixierten deepseek-ai/-Modell-IDs. Halten Sie diese drei zusammen, und die beiden Pfade werden niemals verwechselt.
Schritt 4: Günstige Arbeit an Flash senden
Hermes führt viele geringwertige Aufrufe im Hintergrund aus: Web-Zusammenfassung, Bildanalyse, Kontextkomprimierung, Befehlsgenehmigung. Dafür V4 Pro-Tarife zu zahlen, ist Verschwendung. Verweisen Sie die Hilfs-Slots auf V4 Flash, damit die Hauptschleife das stärkere Modell behält, während die Hintergrundaufgaben zu einem Bruchteil der Kosten laufen.
text1auxiliary: 2 web_extract: 3 provider: atlascloud 4 base_url: https://api.atlascloud.ai/v1 5 api_key_env: ATLASCLOUD_API_KEY 6 model: deepseek-ai/deepseek-v4-flash 7 compression: 8 provider: atlascloud 9 base_url: https://api.atlascloud.ai/v1 10 api_key_env: ATLASCLOUD_API_KEY 11 model: deepseek-ai/deepseek-v4-flash 12 timeout: 120
Jeder Hilfs-Slot akzeptiert seinen eigenen Anbieter, sein eigenes Modell, seine eigene Basis-URL, seinen eigenen Schlüssel und seine eigene Fallback-Kette, sodass Sie jede Hintergrundaufgabe unabhängig voneinander optimieren können.
Schritt 5: Einen Fallback für Ausfallsicherheit hinzufügen
Ein lang laufender Agent wird irgendwann auf ein Ratenlimit oder eine Zeitüberschreitung der Verbindung stoßen. Eine Fallback-Kette sorgt dafür, dass er weiterarbeitet, anstatt Fehler zu melden. Hier versucht die Komprimierungsaufgabe zuerst V4 Flash und greift dann auf ein zweites Atlas Cloud-Modell zurück, bevor sie aufgibt.
text1auxiliary: 2 compression: 3 provider: atlascloud 4 base_url: https://api.atlascloud.ai/v1 5 api_key_env: ATLASCLOUD_API_KEY 6 model: deepseek-ai/deepseek-v4-flash 7 fallback_chain: 8 - provider: atlascloud 9 base_url: https://api.atlascloud.ai/v1 10 api_key_env: ATLASCLOUD_API_KEY 11 model: deepseek-ai/deepseek-v3.2
Hermes versucht jeden Eintrag der Reihe nach, bis einer erfolgreich ist, sodass ein einzelner Anbieter-Hickup den Agenten nicht zum Stillstand bringt. Für einen Agenten, der unbeaufsichtigt nach einem Zeitplan läuft, ist dies der Unterschied zwischen einem Cron-Job, der sich leise erholt, und einem, der um 3 Uhr morgens stirbt und Ihnen am Morgen einen Stack-Trace hinterlässt.
Wann diese Einrichtung die richtige Wahl ist
Das Ausführen von Hermes auf DeepSeek über Atlas Cloud ist am sinnvollsten, wenn Sie einen Schlüssel und eine Rechnung für alles haben möchten, was der Agent berührt. Da derselbe Endpunkt auch Bild- und Videomodelle bedient, kann ein Agent, der textbasiert beginnt, später Bilder oder Clips generieren, ohne eine neue Integration oder ein zweites Anbieterkonto. Wenn Ihr Agent nur DeepSeek und nichts anderes aufrufen wird, ist der integrierte DeepSeek-Anbieter, der auf DeepSeeks eigene API verweist, der einfachere Weg. Die Atlas Cloud-Route verdient ihren Platz, sobald Sie Raum haben möchten, um Modelle über Modalitäten hinweg hinter einer einzigen, OpenAI-kompatiblen Oberfläche hinzuzufügen.
Sie können jede Modell-ID und jeden Live-Preis selbst unter atlascloud.ai/models überprüfen, bevor Sie dies in eine Konfigurationsdatei übernehmen, was eine Gewohnheit ist, die es sich lohnt beizubehalten, während sich die DeepSeek-Produktpalette weiterentwickelt.







