Has instalado Hermes Agent, el agente autónomo de código abierto de Nous Research, y ahora necesitas un modelo que sea lo suficientemente económico como para dejarlo funcionando todo el día y lo suficientemente potente como para manejar llamadas de herramientas reales. DeepSeek V4 es una elección obvia en cuanto a costo, y Atlas Cloud sirve a la familia DeepSeek a través de un único endpoint compatible con OpenAI junto con más de 300 modelos. Esta guía te lleva a través de la conexión de Hermes Agent a DeepSeek en Atlas Cloud, desde la URL base y los IDs de modelo hasta un config.yaml funcional, para que el agente se ejecute en una infraestructura de grado de producción sin un segundo SDK.
Qué estás conectando
Hermes Agent es un agente persistente y auto-mejorable que se ejecuta en tu propio servidor. Está diseñado para ser agnóstico al modelo y al proveedor, por lo que no le importa si los tokens de DeepSeek provienen directamente de DeepSeek o a través de una pasarela, siempre y cuando el endpoint hable el formato de la API de OpenAI.
Atlas Cloud es una plataforma de inferencia de IA full-modal que expone modelos de texto, imagen y video a través de una clave API compatible con OpenAI y una única cuenta de facturación. Debido a que la superficie es compatible con OpenAI, conectar Hermes es un cambio de URL base y clave, no una reescritura.
Esa combinación es importante para un agente persistente. Hermes está diseñado para funcionar durante semanas, acumulando memoria y habilidades reutilizables, por lo que el modelo detrás de él es un costo recurrente en lugar de una llamada única. DeepSeek V4 mantiene ese costo recurrente bajo sin sacrificar la calidad de las llamadas a herramientas, y enrutarlo a través de Atlas Cloud significa que la misma clave que responde un turno de chat puede generar una imagen o un videoclip cuando una habilidad lo necesite. No solo estás eligiendo un modelo económico, estás eligiendo un endpoint que el agente no superará.
Dos hechos deciden toda la configuración, y ambos merecen ser entendidos correctamente antes de tocar un archivo de configuración:
- La URL base de Atlas Cloud es
https://api.atlascloud.ai/v1. - Los IDs de modelo de DeepSeek en Atlas Cloud llevan el prefijo
deepseek-ai/, por ejemplodeepseek-ai/deepseek-v4-pro. Esto es diferente deldeepseek-v4-prosin prefijo que Hermes usa con su proveedor DeepSeek incorporado, que apunta al propio endpoint de DeepSeek. Cuando enrutas a través de Atlas Cloud, usas el ID completo con prefijo y un proveedor personalizado compatible con OpenAI, no el incorporado.
Paso 1: Obtén tu clave API de Atlas Cloud
Inicia sesión en console.atlascloud.ai, abre Claves API, haz clic en Crear Clave API y cópiala en un lugar seguro. El acceso es de pago por uso, por lo que no hay depósito ni gasto mínimo. Te registras, obtienes una clave y pagas por solicitud.
Mantén la clave fuera del control de versiones. Hermes separa los secretos de la configuración a propósito: config.yaml contiene la estructura no sensible y es seguro para confirmar o compartir, mientras que ~/.hermes/.env contiene las claves y se ignora por git por defecto. Poner la clave de Atlas Cloud en .env y referenciarla por nombre desde la configuración es lo que te permite versionar la configuración de tu agente sin filtrar una credencial.
text1echo "ATLASCLOUD_API_KEY=your-atlas-cloud-key" >> ~/.hermes/.env
Paso 2: Confirma los IDs de modelo de DeepSeek que puedes llamar
Atlas Cloud publica su lista de modelos en vivo en un endpoint público, por lo que nunca tendrás que adivinar un ID. Una llamada rápida devuelve las cadenas exactas que acepta la API.
text1curl https://api.atlascloud.ai/v1/models \ 2 -H "Authorization: Bearer $ATLASCLOUD_API_KEY"
Consultar la lista primero no es un trabajo inútil. Los IDs de modelo cambian a medida que se lanzan nuevas versiones, y un ID obsoleto de una publicación de blog o un script antiguo es la razón más común por la que falla una primera llamada. El endpoint /v1/models es la verdad fundamental de lo que la API aceptará hoy, por lo que verificarlo antes de editar una configuración ahorra una ronda de errores de modelo desconocido. Las entradas de DeepSeek que usarás con más frecuencia son estas:
| ID de modelo | Mejor para | Ventana de contexto |
|---|---|---|
deepseek-ai/deepseek-v4-pro | Bucle principal del agente, codificación, llamadas a herramientas | 1M tokens |
deepseek-ai/deepseek-v4-flash | Tareas auxiliares, alto rendimiento | 1M tokens |
deepseek-ai/deepseek-v3.2 | Chat general sensible al costo | 163K tokens |
DeepSeek V4 Pro tiene un precio de $1.68 por millón de tokens de entrada y $3.38 por millón de tokens de salida en Atlas Cloud, mientras que V4 Flash tiene un precio de $0.14 de entrada y $0.28 de salida. Esa brecha es la razón principal para dividir el trabajo principal y auxiliar entre los dos, lo que hace la configuración a continuación.
Paso 3: Apunta Hermes a Atlas Cloud
Debido a que Atlas Cloud es un endpoint personalizado compatible con OpenAI en lugar del proveedor DeepSeek incorporado de Hermes, lo defines explícitamente en ~/.hermes/config.yaml. El bloque del proveedor nombra la URL base y la variable de entorno que contiene tu clave, y el bloque del modelo selecciona el ID de DeepSeek con prefijo.
text1inference: 2 provider: atlascloud 3 base_url: https://api.atlascloud.ai/v1 4 api_key_env: ATLASCLOUD_API_KEY 5 model: 6 default: deepseek-ai/deepseek-v4-pro
Guarda el archivo y luego inicia el agente.
text1hermes
Si el primer mensaje devuelve una respuesta normal, la conexión es correcta. Si obtienes un error de autenticación, la clave en .env es incorrecta o no se cargó; si obtienes un error de modelo desconocido, vuelve a verificar el prefijo deepseek-ai/ con la salida de /v1/models del Paso 2.
El error más común aquí es intentar usar el proveedor deepseek incorporado de Hermes esperando que Atlas Cloud responda. El proveedor incorporado está cableado al propio endpoint de DeepSeek y a sus nombres de modelo sin prefijo, por lo que facturará felizmente tu cuenta de DeepSeek e ignorará por completo a Atlas Cloud. Enrutar a través de Atlas Cloud es una elección deliberada de proveedor personalizado: tu propia base_url, tu clave de Atlas Cloud y los IDs de modelo deepseek-ai/ con prefijo. Mantén esos tres juntos y los dos caminos nunca se confundirán.
Paso 4: Envía trabajo económico a Flash
Hermes ejecuta muchas llamadas de bajo valor en segundo plano: resumen web, análisis de visión, compresión de contexto, aprobación de comandos. Pagar tarifas de V4 Pro por eso es un desperdicio. Apunta las ranuras auxiliares a V4 Flash para que el bucle principal mantenga el modelo más potente mientras las tareas en segundo plano se ejecutan a una fracción del costo.
text1auxiliary: 2 web_extract: 3 provider: atlascloud 4 base_url: https://api.atlascloud.ai/v1 5 api_key_env: ATLASCLOUD_API_KEY 6 model: deepseek-ai/deepseek-v4-flash 7 compression: 8 provider: atlascloud 9 base_url: https://api.atlascloud.ai/v1 10 api_key_env: ATLASCLOUD_API_KEY 11 model: deepseek-ai/deepseek-v4-flash 12 timeout: 120
Cada ranura auxiliar acepta su propio proveedor, modelo, URL base, clave y cadena de respaldo, para que puedas ajustar cada tarea en segundo plano de forma independiente.
Paso 5: Agrega un respaldo para la resiliencia
Un agente de larga duración eventualmente alcanzará un límite de velocidad o una conexión con tiempo de espera agotado. Una cadena de respaldo lo mantiene funcionando en lugar de generar errores. Aquí, la tarea de compresión intenta V4 Flash primero, luego recurre a un segundo modelo de Atlas Cloud antes de rendirse.
text1auxiliary: 2 compression: 3 provider: atlascloud 4 base_url: https://api.atlascloud.ai/v1 5 api_key_env: ATLASCLOUD_API_KEY 6 model: deepseek-ai/deepseek-v4-flash 7 fallback_chain: 8 - provider: atlascloud 9 base_url: https://api.atlascloud.ai/v1 10 api_key_env: ATLASCLOUD_API_KEY 11 model: deepseek-ai/deepseek-v3.2
Hermes intenta cada entrada en orden hasta que una tiene éxito, por lo que un solo contratiempo del proveedor no detiene al agente. Para un agente que se ejecuta sin supervisión en un horario, esta es la diferencia entre un trabajo cron que se recupera silenciosamente y uno que muere a las 3 am y te deja un rastreo de pila por la mañana.
Cuándo esta configuración es la adecuada
Ejecutar Hermes en DeepSeek a través de Atlas Cloud tiene más sentido cuando deseas una clave y una factura para todo lo que el agente toca. Debido a que el mismo endpoint también sirve modelos de imagen y video, un agente que comienza solo con texto puede generar imágenes o clips más tarde sin una nueva integración o una segunda cuenta de proveedor. Si tu agente solo llamará a DeepSeek y nada más, el proveedor DeepSeek incorporado que apunta a la propia API de DeepSeek es el camino más simple. La ruta de Atlas Cloud se justifica una vez que deseas espacio para agregar modelos en diferentes modalidades detrás de una única superficie compatible con OpenAI.
Puedes confirmar cada ID de modelo y precio en vivo en atlascloud.ai/models antes de comprometer todo esto en un archivo de configuración, que es el hábito que vale la pena mantener a medida que la línea de productos de DeepSeek evoluciona.







