APENAS DUAS SEMANAS | 20% DE DESCONTO no Seedream 5.0 Pro!

Como executar o Hermes Agent com a API DeepSeek da Atlas Cloud

Um guia passo a passo para executar o Hermes Agent de código aberto em modelos DeepSeek V4 através da API compatível com OpenAI da Atlas Cloud, com exemplos de configuração e preços.

Como executar o Hermes Agent com a API DeepSeek da Atlas Cloud

Você instalou o Hermes Agent, o agente autônomo de código aberto da Nous Research, e agora precisa de um modelo por trás dele que seja barato o suficiente para deixar funcionando o dia todo e forte o suficiente para lidar com chamadas de ferramentas reais. DeepSeek V4 é uma escolha óbvia em termos de custo, e a Atlas Cloud serve a família DeepSeek através de um único endpoint compatível com OpenAI, juntamente com mais de 300 outros modelos. Este guia descreve como conectar o Hermes Agent ao DeepSeek na Atlas Cloud, desde a URL base e IDs de modelo até um config.yaml funcional, para que o agente seja executado em infraestrutura de nível de produção sem um segundo SDK.

O que você está conectando

O Hermes Agent é um agente persistente e autoaperfeiçoável que é executado em seu próprio servidor. Ele é agnóstico a modelos e provedores por design, então não importa se os tokens DeepSeek vêm diretamente do DeepSeek ou através de um gateway, desde que o endpoint fale a forma da API OpenAI.

Atlas Cloud é uma plataforma de inferência de IA full-modal que expõe modelos de texto, imagem e vídeo através de uma chave de API compatível com OpenAI e uma conta de faturamento. Como a superfície é compatível com OpenAI, conectar o Hermes é uma mudança de URL base e chave, não uma reescrita.

Essa combinação é importante para um agente persistente. O Hermes é construído para funcionar por semanas, acumulando memória e habilidades reutilizáveis, então o modelo por trás dele é um custo recorrente, e não uma chamada única. O DeepSeek V4 mantém esse custo recorrente baixo sem abrir mão da qualidade da chamada de ferramentas, e roteá-lo através da Atlas Cloud significa que a mesma chave que responde a uma conversa pode mais tarde gerar uma imagem ou um clipe de vídeo quando uma habilidade precisar de um. Você não está apenas escolhendo um modelo barato, você está escolhendo um endpoint que o agente não superará.

Dois fatos decidem toda a configuração, e ambos valem a pena serem acertados antes de você tocar em um arquivo de configuração:

  • A URL base da Atlas Cloud é https://api.atlascloud.ai/v1.
  • Os IDs de modelo DeepSeek na Atlas Cloud carregam o prefixo deepseek-ai/, por exemplo deepseek-ai/deepseek-v4-pro. Isso é diferente do deepseek-v4-pro puro que o Hermes usa com seu provedor DeepSeek integrado, que aponta para o próprio endpoint do DeepSeek. Ao rotear através da Atlas Cloud, você usa o ID completo prefixado e um provedor personalizado compatível com OpenAI, não o integrado.

Passo 1: Obtenha sua chave de API da Atlas Cloud

Faça login em console.atlascloud.ai, abra Chaves de API, clique em Criar Chave de API e copie-a para um local seguro. O acesso é pago conforme o uso, então não há depósito e nenhum gasto mínimo. Você se cadastra, obtém uma chave e paga por solicitação.

Mantenha a chave fora do controle de versão. O Hermes separa segredos de configurações propositalmente: config.yaml contém estrutura não sensível e é seguro para commitar ou compartilhar, enquanto ~/.hermes/.env contém chaves e é ignorado pelo git por padrão. Colocar a chave da Atlas Cloud em .env e referenciá-la pelo nome na configuração é o que permite versionar sua configuração de agente sem vazar uma credencial.

text
1echo "ATLASCLOUD_API_KEY=sua-chave-atlas-cloud" >> ~/.hermes/.env

Passo 2: Confirme os IDs de modelo DeepSeek que você pode chamar

A Atlas Cloud publica sua lista de modelos ativos em um endpoint público, então você nunca precisa adivinhar um ID. Uma chamada rápida retorna as strings exatas que a API aceita.

text
1curl https://api.atlascloud.ai/v1/models \
2  -H "Authorization: Bearer $ATLASCLOUD_API_KEY"

Consultar a lista primeiro não é um trabalho ocupado. Os IDs de modelo mudam à medida que novas versões são lançadas, e um ID obsoleto de uma postagem de blog ou um script antigo é o motivo mais comum pelo qual uma primeira chamada falha. O endpoint /v1/models é a verdade para o que a API aceitará hoje, então verificá-lo antes de editar uma configuração economiza uma rodada de erros de modelo desconhecido. As entradas DeepSeek que você usará com mais frequência são estas:

ID do ModeloMelhor paraJanela de contexto
deepseek-ai/deepseek-v4-proLoop principal do agente, codificação, chamadas de ferramentas1M tokens
deepseek-ai/deepseek-v4-flashTarefas auxiliares, alto throughput1M tokens
deepseek-ai/deepseek-v3.2Chat geral sensível ao custo163K tokens

O DeepSeek V4 Pro custa US$ 1,68 por milhão de tokens de entrada e US$ 3,38 por milhão de tokens de saída na Atlas Cloud, enquanto o V4 Flash custa US$ 0,14 de entrada e US$ 0,28 de saída. Essa diferença é a razão para dividir o trabalho principal e auxiliar entre os dois, o que a configuração abaixo faz.

Passo 3: Aponte o Hermes para a Atlas Cloud

Como a Atlas Cloud é um endpoint personalizado compatível com OpenAI, e não o provedor DeepSeek integrado do Hermes, você o define explicitamente em ~/.hermes/config.yaml. O bloco do provedor nomeia a URL base e a variável de ambiente que contém sua chave, e o bloco do modelo seleciona o ID DeepSeek prefixado.

text
1inference:
2  provider: atlascloud
3  base_url: https://api.atlascloud.ai/v1
4  api_key_env: ATLASCLOUD_API_KEY
5  model:
6    default: deepseek-ai/deepseek-v4-pro

Salve o arquivo e inicie o agente.

text
1hermes

Se a primeira mensagem retornar uma resposta normal, a fiação está correta. Se você receber um erro de autenticação, a chave em .env está errada ou não foi carregada; se você receber um erro de modelo desconhecido, verifique novamente o prefixo deepseek-ai/ em relação à saída /v1/models do Passo 2.

O erro mais comum aqui é usar o provedor deepseek integrado do Hermes enquanto espera que a Atlas Cloud responda. O provedor integrado é conectado diretamente ao próprio endpoint do DeepSeek e seus nomes de modelo puros, então ele cobrará alegremente sua conta DeepSeek e ignorará a Atlas Cloud completamente. O roteamento através da Atlas Cloud é uma escolha deliberada de provedor personalizado: sua própria base_url, sua chave da Atlas Cloud e os IDs de modelo deepseek-ai/ prefixados. Mantenha esses três juntos e os dois caminhos nunca se confundirão.

Passo 4: Envie trabalho barato para o Flash

O Hermes executa muitas chamadas de baixo valor nos bastidores: sumarização da web, análise de visão, compressão de contexto, aprovação de comandos. Pagar as taxas do V4 Pro por isso é um desperdício. Aponte os slots auxiliares para o V4 Flash para que o loop principal mantenha o modelo mais forte enquanto as tarefas em segundo plano são executadas por uma fração do custo.

text
1auxiliary:
2  web_extract:
3    provider: atlascloud
4    base_url: https://api.atlascloud.ai/v1
5    api_key_env: ATLASCLOUD_API_KEY
6    model: deepseek-ai/deepseek-v4-flash
7  compression:
8    provider: atlascloud
9    base_url: https://api.atlascloud.ai/v1
10    api_key_env: ATLASCLOUD_API_KEY
11    model: deepseek-ai/deepseek-v4-flash
12    timeout: 120

Cada slot auxiliar aceita seu próprio provedor, modelo, URL base, chave e cadeia de fallback, para que você possa ajustar cada tarefa em segundo plano independentemente.

Passo 5: Adicione um fallback para resiliência

Um agente de longa duração eventualmente atingirá um limite de taxa ou uma conexão com tempo limite. Uma cadeia de fallback o mantém funcionando em vez de gerar erros. Aqui, a tarefa de compressão tenta o V4 Flash primeiro, depois volta para um segundo modelo da Atlas Cloud antes de desistir.

text
1auxiliary:
2  compression:
3    provider: atlascloud
4    base_url: https://api.atlascloud.ai/v1
5    api_key_env: ATLASCLOUD_API_KEY
6    model: deepseek-ai/deepseek-v4-flash
7    fallback_chain:
8      - provider: atlascloud
9        base_url: https://api.atlascloud.ai/v1
10        api_key_env: ATLASCLOUD_API_KEY
11        model: deepseek-ai/deepseek-v3.2

O Hermes tenta cada entrada em ordem até que uma seja bem-sucedida, para que um único problema do provedor não paralise o agente. Para um agente que é executado sem supervisão em um cronograma, esta é a diferença entre um trabalho cron que se recupera silenciosamente e um que morre às 3 da manhã e deixa um rastreamento de pilha pela manhã.

Quando esta configuração é a mais adequada

Executar o Hermes no DeepSeek através da Atlas Cloud faz mais sentido quando você deseja uma chave e uma fatura para tudo o que o agente toca. Como o mesmo endpoint também serve modelos de imagem e vídeo, um agente que começa apenas com texto pode posteriormente gerar imagens ou clipes sem uma nova integração ou uma segunda conta de fornecedor. Se o seu agente for chamar apenas o DeepSeek e nada mais, o provedor DeepSeek integrado apontado para a própria API do DeepSeek é o caminho mais simples. A rota da Atlas Cloud ganha seu lugar quando você deseja espaço para adicionar modelos em várias modalidades por trás de uma única superfície compatível com OpenAI.

Você pode confirmar cada ID de modelo e preço ao vivo em atlascloud.ai/models antes de enviar qualquer um deles para um arquivo de configuração, o que é o hábito que vale a pena manter à medida que a linha DeepSeek evolui.

Modelos recentes

Uma API para toda a IA de mídia.

Explorar Todos os Modelos
Executar Hermes Agent com a API DeepSeek na Atlas Cloud | Atlas Cloud