Quieres llamar a DeepSeek desde tu propio código, y preferirías no gestionar una cuenta de DeepSeek separada, una factura separada y un SDK separado además de cualquier otra cosa con la que tu producto ya se comunique. Atlas Cloud sirve a la familia DeepSeek V4 a través de un único endpoint compatible con OpenAI, por lo que una llamada a DeepSeek se ve exactamente como una llamada a OpenAI con una URL base diferente. Esta página enumera los modelos de DeepSeek a los que puedes acceder en Atlas Cloud, lo que cuesta cada uno por token y un inicio rápido que puedes pegar en un terminal.
De un vistazo
| ID del modelo | Mejor para | Contexto | Entrada $/M | Salida $/M |
|---|---|---|---|---|
deepseek-ai/deepseek-v4-pro | Cargas de trabajo principales, codificación, agentes | 1M tokens | $1.68 | $3.38 |
deepseek-ai/deepseek-v4-flash | Tareas auxiliares baratas y de alto rendimiento | 1M tokens | $0.14 | $0.28 |
deepseek-ai/deepseek-v3.2 | Chat general sensible al costo | 163K tokens | verificar en vivo | verificar en vivo |
deepseek-ai/DeepSeek-V3.1 | Línea base estable de generación anterior | 131K tokens | verificar en vivo | verificar en vivo |
Los precios mostrados son las tarifas de referencia de Atlas Cloud para la familia V4; cada modelo muestra su precio en vivo en el Playground junto a su botón Ejecutar, así que confirma el número actual allí antes de construir un presupuesto en torno a él.
Qué modelo de DeepSeek usar
La línea de DeepSeek en Atlas Cloud se divide limpiamente por trabajo, y elegir el correcto se trata principalmente de hacer coincidir el costo del token con el valor de la tarea.
-
DeepSeek V4 Pro es el predeterminado para cualquier cosa que importe: codificación, llamadas a herramientas, razonamiento de varios pasos y bucles de agente. Combina una atención dispersa eficiente con un razonamiento sólido y una ventana de contexto de un millón de tokens, y a $1.68 por millón de tokens de entrada, sigue siendo asequible incluso bajo una carga constante.
-
DeepSeek V4 Flash es el caballo de batalla para el volumen. A $0.14 de entrada y $0.28 de salida, cuesta aproximadamente una décima parte de Pro en la entrada, lo que lo convierte en la elección correcta para la summarización, clasificación, compresión de contexto y cualquier llamada de alta frecuencia donde el razonamiento de primer nivel no es el objetivo.
-
DeepSeek V3.2 y la línea V3.1 siguen estando disponibles cuando se desea un modelo de chat general sensible al costo o una línea base estable de generación anterior para comparar. Son útiles como objetivos de respaldo más que como opciones principales una vez que V4 está disponible.
Un patrón práctico es ejecutar V4 Pro como su modelo principal y enrutar el trabajo barato y de gran volumen a V4 Flash, de modo que solo pague tarifas premium por las llamadas que las merecen.
La ventana de contexto de un millón de tokens en ambos modelos V4 vale la pena entenderla en lugar de ignorarla. Cambia lo que se puede pasar en una sola llamada: bases de código completas, conjuntos de documentos largos o un historial de conversación completo que habría necesitado ser dividido en un modelo de 128K. Esa capacidad no encarece cada llamada, ya que se paga por los tokens que realmente se envían, pero elimina la sobrecarga de ingeniería de dividir y volver a unir las entradas. Para una aplicación que razona sobre grandes entradas, la ventana de contexto suele ser una ganancia práctica mayor que una diferencia de precio marginal entre modelos.
Inicio rápido
Atlas Cloud es totalmente compatible con OpenAI, por lo que si ya usas el SDK de OpenAI, todo el cambio es la URL base y la clave.
Primero, obtén una clave. Inicia sesión en console.atlascloud.ai, abre Claves de API y crea una. El acceso es de pago por uso, por lo que no hay depósito ni mínimo, pagas por solicitud.
Exporta la clave como una variable de entorno en lugar de pegarla en el código fuente. Esto la mantiene fuera de tu código y fuera del control de versiones, y coincide con la forma en que el SDK de OpenAI ya busca credenciales, por lo que la mayoría de las herramientas existentes la recogen sin ningún cambio adicional. En un servidor, configúrala una vez en el perfil del shell o en el entorno del proceso; en un contenedor, pásala como un secreto de tiempo de ejecución en lugar de incorporarla en la imagen.
Luego, confirma los ID exactos del modelo desde el endpoint en vivo en lugar de confiar en una cadena codificada:
text1curl https://api.atlascloud.ai/v1/models \ 2 -H "Authorization: Bearer $ATLASCLOUD_API_KEY"
Ahora haz una llamada de chat. En Python con el SDK de OpenAI:
text1from openai import OpenAI 2 3client = OpenAI( 4 api_key="your-atlas-cloud-key", 5 base_url="https://api.atlascloud.ai/v1", 6) 7 8resp = client.chat.completions.create( 9 model="deepseek-ai/deepseek-v4-pro", 10 messages=[{"role": "user", "content": "Explain sparse attention in one paragraph."}], 11) 12print(resp.choices[0].message.content)
La misma solicitud como una llamada curl sin procesar, si prefieres no tocar un SDK:
text1curl https://api.atlascloud.ai/v1/chat/completions \ 2 -H "Authorization: Bearer $ATLASCLOUD_API_KEY" \ 3 -H "Content-Type: application/json" \ 4 -d '{ 5 "model": "deepseek-ai/deepseek-v4-pro", 6 "messages": [{"role": "user", "content": "Hello from Atlas Cloud"}] 7 }'
Si la llamada devuelve una finalización, has terminado. Un error de autenticación significa que la clave es incorrecta o no está exportada; un error de modelo desconocido casi siempre significa que falta el prefijo deepseek-ai/ o que el ID está obsoleto, por lo que la verificación /v1/models se realiza primero.
Por qué enrutar DeepSeek a través de Atlas Cloud
Llamar a DeepSeek directamente desde su propia API está perfectamente bien cuando DeepSeek es el único modelo que usarás. La razón para pasar por Atlas Cloud es la consolidación: una clave compatible con OpenAI y una cuenta de facturación cubren DeepSeek más de 300 modelos adicionales en texto, imagen y video. Un producto que comienza con DeepSeek V4 para chat puede agregar más tarde un modelo de imagen o un modelo de video sin un segundo proveedor, un segundo SDK o una segunda factura.
Atlas Cloud también enumera la certificación SOC II y el cumplimiento de HIPAA en la misma cuenta, con cifrado en reposo y en tránsito, lo que importa una vez que DeepSeek está sirviendo tráfico de usuarios reales en lugar de un prototipo. OpenRouter es otra forma compatible con OpenAI de llegar a DeepSeek y tiene un amplio catálogo de modelos propio; la diferencia de Atlas Cloud es el catálogo unificado de modalidad completa y las filas de cumplimiento enumeradas en una clave.
Los detalles operativos importan una vez que el tráfico es real. Atlas Cloud expone el monitoreo de TPM y RPM por modelo y por aplicación en su nivel empresarial, además de límites de velocidad personalizados, por lo que un pico en una parte de su producto no agota silenciosamente a otra. Combinar eso con un modelo de respaldo, DeepSeek V4 Flash detrás de V4 Pro, por ejemplo, le brinda un servicio que se degrada con gracia bajo carga en lugar de devolver errores a los usuarios.
Dónde confirmar los números actuales
Los ID y precios de los modelos cambian a medida que se lanzan nuevas versiones de DeepSeek. Dos fuentes se mantienen actualizadas: el endpoint en vivo https://api.atlascloud.ai/v1/models para los ID exactos, y atlascloud.ai/models para los precios por token que se muestran junto a cada modelo. Verifica ambos antes de conectar un ID o una tarifa específica al código de producción, y la integración de DeepSeek seguirá funcionando a medida que la línea evolucione.







