Sie möchten DeepSeek aus Ihrem eigenen Code aufrufen und möchten lieber kein separates DeepSeek-Konto, eine separate Rechnung und ein separates SDK zusätzlich zu dem verwalten, womit Ihr Produkt bereits kommuniziert. Atlas Cloud stellt die DeepSeek V4-Familie über einen einzigen OpenAI-kompatiblen Endpunkt bereit, sodass ein DeepSeek-Aufruf genau wie ein OpenAI-Aufruf mit einer anderen Basis-URL aussieht. Diese Seite listet die DeepSeek-Modelle auf, die Sie auf Atlas Cloud erreichen können, was jedes pro Token kostet, und einen Schnellstart, den Sie in ein Terminal einfügen können.
Auf einen Blick
| Modell-ID | Am besten für | Kontext | Input $/M | Output $/M |
|---|---|---|---|---|
deepseek-ai/deepseek-v4-pro | Hauptaufgaben, Codierung, Agenten | 1M Tokens | $1.68 | $3.38 |
deepseek-ai/deepseek-v4-flash | Hoher Durchsatz, günstige Hilfsaufgaben | 1M Tokens | $0.14 | $0.28 |
deepseek-ai/deepseek-v3.2 | Kostensensibler allgemeiner Chat | 163K Tokens | live prüfen | live prüfen |
deepseek-ai/DeepSeek-V3.1 | Stabile Basis der vorherigen Generation | 131K Tokens | live prüfen | live prüfen |
Die angezeigten Preise sind die Atlas Cloud-Referenzpreise für die V4-Familie; jedes Modell zeigt seinen Live-Preis im Playground neben seinem Run-Button an, bestätigen Sie also dort die aktuelle Zahl, bevor Sie ein Budget darauf aufbauen.
Welches DeepSeek-Modell soll verwendet werden
Die DeepSeek-Produktlinie auf Atlas Cloud teilt sich sauber nach Aufgaben auf, und die Wahl des richtigen Modells hängt hauptsächlich davon ab, die Token-Kosten dem Aufgabenwert anzupassen.
-
DeepSeek V4 Pro ist die Standardeinstellung für alles, was wichtig ist: Codierung, Tool-Aufrufe, mehrstufiges Denken und Agenten-Schleifen. Es kombiniert effiziente sparse attention mit starkem Denkvermögen und einem Kontextfenster von einer Million Tokens, und mit 1,68 $ pro Million Eingabe-Tokens bleibt es auch unter ständiger Last erschwinglich.
-
DeepSeek V4 Flash ist das Arbeitstier für Volumen. Mit 0,14 $ Eingabe und 0,28 $ Ausgabe kostet es ungefähr ein Zehntel von Pro bei der Eingabe, was es zur richtigen Wahl für Zusammenfassungen, Klassifizierungen, Kontextkomprimierung und jeden hochfrequenten Aufruf macht, bei dem erstklassiges Denkvermögen nicht der Punkt ist.
-
DeepSeek V3.2 und die V3.1-Linie bleiben verfügbar, wenn Sie ein kostensensibles allgemeines Chat-Modell oder eine stabile Basis der vorherigen Generation zum Vergleich wünschen. Sie sind eher als Fallback-Ziele nützlich als als primäre Auswahl, sobald V4 verfügbar ist.
Ein praktisches Muster ist, V4 Pro als primäres Modell zu verwenden und günstige, hochvolumige Arbeiten an V4 Flash weiterzuleiten, sodass Sie Premium-Preise nur für die Aufrufe zahlen, die sie verdienen.
Das Kontextfenster von einer Million Tokens bei beiden V4-Modellen ist es wert, verstanden und nicht ignoriert zu werden. Es ändert, was Sie in einem einzigen Aufruf übergeben können: ganze Codebasen, lange Dokumentensätze oder eine vollständige Konversationshistorie, die bei einem 128K-Modell hätte zerlegt werden müssen. Diese Kapazität macht nicht jeden Aufruf teurer, da Sie für die tatsächlich gesendeten Tokens bezahlen, aber sie beseitigt den technischen Aufwand des Aufteilens und Wiederzusammensetzens von Eingaben. Für eine Anwendung, die über große Eingaben nachdenkt, ist das Kontextfenster oft ein größerer praktischer Gewinn als ein marginaler Preisunterschied zwischen Modellen.
Schnellstart
Atlas Cloud ist vollständig OpenAI-kompatibel, wenn Sie also bereits das OpenAI SDK verwenden, besteht die gesamte Änderung in der Basis-URL und dem Schlüssel.
Zuerst besorgen Sie sich einen Schlüssel. Melden Sie sich unter console.atlascloud.ai an, öffnen Sie API Keys und erstellen Sie einen. Der Zugang ist Pay-as-you-go, es gibt also keine Anzahlung und kein Minimum, Sie zahlen pro Anfrage.
Exportieren Sie den Schlüssel als Umgebungsvariable, anstatt ihn in den Quellcode einzufügen. Dies hält ihn aus Ihrem Code und aus der Versionskontrolle heraus, und es entspricht der Art und Weise, wie das OpenAI SDK bereits nach Anmeldeinformationen sucht, sodass die meisten vorhandenen Tools ihn ohne zusätzliche Änderungen übernehmen. Auf einem Server legen Sie ihn einmal im Shell-Profil oder in der Prozessumgebung fest; in einem Container übergeben Sie ihn als Laufzeit-Geheimnis, anstatt ihn in das Image einzubacken.
Bestätigen Sie dann die genauen Modell-IDs vom Live-Endpunkt, anstatt einem hartcodierten String zu vertrauen:
text1curl https://api.atlascloud.ai/v1/models \ 2 -H "Authorization: Bearer $ATLASCLOUD_API_KEY"
Führen Sie nun einen Chat-Aufruf durch. In Python mit dem OpenAI SDK:
text1from openai import OpenAI 2 3client = OpenAI( 4 api_key="your-atlas-cloud-key", 5 base_url="https://api.atlascloud.ai/v1", 6) 7 8resp = client.chat.completions.create( 9 model="deepseek-ai/deepseek-v4-pro", 10 messages=[{"role": "user", "content": "Explain sparse attention in one paragraph."}], 11) 12print(resp.choices[0].message.content)
Dieselbe Anfrage als roher Curl-Aufruf, wenn Sie lieber kein SDK verwenden möchten:
text1curl https://api.atlascloud.ai/v1/chat/completions \ 2 -H "Authorization: Bearer $ATLASCLOUD_API_KEY" \ 3 -H "Content-Type: application/json" \ 4 -d '{ 5 "model": "deepseek-ai/deepseek-v4-pro", 6 "messages": [{"role": "user", "content": "Hello from Atlas Cloud"}] 7 }'
Wenn der Aufruf eine Vervollständigung zurückgibt, sind Sie fertig. Ein Authentifizierungsfehler bedeutet, dass der Schlüssel falsch oder nicht exportiert ist; ein Fehler bei einem unbekannten Modell bedeutet fast immer, dass das Präfix deepseek-ai/ fehlt oder die ID veraltet ist, weshalb die /v1/models-Prüfung zuerst erfolgt.
Warum DeepSeek über Atlas Cloud routen
DeepSeek direkt über seine eigene API aufzurufen, ist völlig in Ordnung, wenn DeepSeek das einzige Modell ist, das Sie jemals verwenden werden. Der Grund, über Atlas Cloud zu gehen, ist die Konsolidierung: Ein OpenAI-kompatibler Schlüssel und ein Abrechnungskonto decken DeepSeek plus über 300 weitere Modelle für Text, Bild und Video ab. Ein Produkt, das mit DeepSeek V4 für den Chat beginnt, kann später ein Bildmodell oder ein Videomodell hinzufügen, ohne einen zweiten Anbieter, ein zweites SDK oder eine zweite Rechnung.
Atlas Cloud listet auch die SOC II-Zertifizierung und HIPAA-Konformität auf demselben Konto auf, mit Verschlüsselung im Ruhezustand und während der Übertragung, was wichtig ist, sobald DeepSeek echten Benutzerverkehr bedient und nicht nur einen Prototyp. OpenRouter ist eine weitere OpenAI-kompatible Möglichkeit, DeepSeek zu erreichen, und verfügt über einen eigenen breiten Modellkatalog; der Unterschied bei Atlas Cloud ist der vereinheitlichte vollständige Modellkatalog und die aufgelisteten Compliance-Zeilen auf einem Schlüssel.
Die operativen Details sind wichtig, sobald der Verkehr real ist. Atlas Cloud bietet TPM- und RPM-Überwachung pro Modell und pro Anwendung auf seiner Enterprise-Stufe sowie benutzerdefinierte Ratenbegrenzungen, sodass ein Anstieg in einem Teil Ihres Produkts nicht stillschweigend einen anderen aushungert. Die Kombination mit einem Fallback-Modell, DeepSeek V4 Flash hinter V4 Pro zum Beispiel, bietet Ihnen einen Dienst, der unter Last elegant abbaut, anstatt Benutzern Fehler zurückzugeben.
Wo die aktuellen Zahlen bestätigt werden können
Modell-IDs und Preise ändern sich, wenn neue DeepSeek-Versionen veröffentlicht werden. Zwei Quellen bleiben aktuell: der Live-Endpunkt https://api.atlascloud.ai/v1/models für genaue IDs und atlascloud.ai/models für die pro Token angezeigten Preise neben jedem Modell. Überprüfen Sie beides, bevor Sie eine bestimmte ID oder Rate in den Produktionscode einbinden, und die DeepSeek-Integration wird weiterhin funktionieren, während sich die Produktlinie weiterentwickelt.







