Nous Research의 오픈 소스 자율 에이전트인 Hermes Agent를 설치했고, 이제 하루 종일 실행하기에 충분히 저렴하고 실제 도구 호출을 처리할 수 있을 만큼 강력한 모델이 필요합니다. DeepSeek V4는 비용 면에서 확실한 선택이며, Atlas Cloud는 300개 이상의 다른 모델과 함께 단일 OpenAI 호환 엔드포인트를 통해 DeepSeek 제품군을 제공합니다. 이 가이드는 Hermes Agent를 Atlas Cloud의 DeepSeek에 연결하는 과정을 안내합니다. 기본 URL 및 모델 ID부터 작동하는 config.yaml까지, 에이전트가 두 번째 SDK 없이 프로덕션급 인프라에서 실행되도록 합니다.
연결할 대상
Hermes Agent는 자체 서버에서 실행되는 영구적이고 자체 개선되는 에이전트입니다. 모델 및 공급자 불가지론적으로 설계되었으므로, 엔드포인트가 OpenAI API 형식을 지원하는 한 DeepSeek 토큰이 DeepSeek에서 직접 오든 게이트웨이를 통해 오든 상관하지 않습니다.
Atlas Cloud는 하나의 OpenAI 호환 API 키와 하나의 청구 계정을 통해 텍스트, 이미지 및 비디오 모델을 노출하는 완전 모달 AI 추론 플랫폼입니다. 표면이 OpenAI 호환이므로 Hermes를 연결하는 것은 재작성이 아니라 기본 URL 및 키 변경입니다.
이러한 페어링은 영구 에이전트에게 중요합니다. Hermes는 몇 주 동안 실행되도록 구축되어 메모리와 재사용 가능한 기술을 축적하므로, 그 뒤에 있는 모델은 일회성 호출이 아니라 반복 비용입니다. DeepSeek V4는 도구 호출 품질을 포기하지 않고 반복 비용을 낮게 유지하며, Atlas Cloud를 통해 라우팅하면 채팅 턴에 응답하는 동일한 키가 나중에 기술이 필요할 때 이미지나 비디오 클립을 생성할 수 있습니다. 저렴한 모델을 선택하는 것이 아니라 에이전트가 성장할 수 있는 엔드포인트를 선택하는 것입니다.
두 가지 사실이 전체 설정을 결정하며, 구성 파일을 만지기 전에 두 가지 모두 정확히 이해하는 것이 중요합니다.
- Atlas Cloud 기본 URL은
https://api.atlascloud.ai/v1입니다. - Atlas Cloud의 DeepSeek 모델 ID는
deepseek-ai/접두사를 포함합니다. 예를 들어deepseek-ai/deepseek-v4-pro입니다. 이는 Hermes가 내장된 DeepSeek 공급자와 함께 사용하는deepseek-v4-pro와는 다릅니다. 이는 DeepSeek 자체 엔드포인트를 가리킵니다. Atlas Cloud를 통해 라우팅할 때는 내장된 공급자가 아닌 전체 접두사 ID와 사용자 지정 OpenAI 호환 공급자를 사용합니다.
1단계: Atlas Cloud API 키 받기
console.atlascloud.ai에 로그인하여 API 키를 열고 API 키 생성을 클릭한 다음 안전한 곳에 복사합니다. 액세스는 종량제이므로 보증금이나 최소 지출이 없습니다. 가입하고 키를 받은 다음 요청당 비용을 지불합니다.
키를 버전 제어에서 제외하십시오. Hermes는 의도적으로 비밀을 설정과 분리합니다. config.yaml은 민감하지 않은 구조를 포함하며 커밋하거나 공유해도 안전하지만, ~/.hermes/.env는 키를 포함하며 기본적으로 git-ignored됩니다. Atlas Cloud 키를 .env에 넣고 구성에서 이름으로 참조하면 자격 증명을 유출하지 않고 에이전트 설정을 버전 관리할 수 있습니다.
text1echo "ATLASCLOUD_API_KEY=your-atlas-cloud-key" >> ~/.hermes/.env
2단계: 호출할 수 있는 DeepSeek 모델 ID 확인
Atlas Cloud는 공개 엔드포인트에 라이브 모델 목록을 게시하므로 ID를 추측할 필요가 없습니다. 빠른 호출은 API가 허용하는 정확한 문자열을 반환합니다.
text1curl https://api.atlascloud.ai/v1/models \ 2 -H "Authorization: Bearer $ATLASCLOUD_API_KEY"
목록을 먼저 쿼리하는 것은 불필요한 작업이 아닙니다. 새 버전이 출시됨에 따라 모델 ID가 변경될 수 있으며, 블로그 게시물이나 오래된 스크립트의 오래된 ID는 첫 번째 호출이 실패하는 가장 흔한 이유입니다. /v1/models 엔드포인트는 API가 오늘 허용할 내용에 대한 진실의 원천이므로, 구성을 편집하기 전에 확인하면 알 수 없는 모델 오류를 한 번 줄일 수 있습니다. 가장 자주 사용할 DeepSeek 항목은 다음과 같습니다.
| 모델 ID | 가장 적합한 용도 | 컨텍스트 창 |
|---|---|---|
deepseek-ai/deepseek-v4-pro | 주요 에이전트 루프, 코딩, 도구 호출 | 1M 토큰 |
deepseek-ai/deepseek-v4-flash | 보조 작업, 높은 처리량 | 1M 토큰 |
deepseek-ai/deepseek-v3.2 | 비용에 민감한 일반 채팅 | 163K 토큰 |
DeepSeek V4 Pro는 Atlas Cloud에서 백만 입력 토큰당 1.68달러, 백만 출력 토큰당 3.38달러로 책정되어 있으며, V4 Flash는 입력 0.14달러, 출력 0.28달러로 책정되어 있습니다. 이 차이가 아래 구성에서처럼 주요 작업과 보조 작업을 두 모델로 분할하는 전체 이유입니다.
3단계: Hermes를 Atlas Cloud로 지정
Atlas Cloud는 Hermes의 내장 DeepSeek 공급자가 아닌 사용자 지정 OpenAI 호환 엔드포인트이므로 ~/.hermes/config.yaml에 명시적으로 정의합니다. 공급자 블록은 기본 URL과 키를 포함하는 환경 변수를 지정하고, 모델 블록은 접두사가 붙은 DeepSeek ID를 선택합니다.
text1inference: 2 provider: atlascloud 3 base_url: https://api.atlascloud.ai/v1 4 api_key_env: ATLASCLOUD_API_KEY 5 model: 6 default: deepseek-ai/deepseek-v4-pro
파일을 저장한 다음 에이전트를 시작합니다.
text1hermes
첫 번째 메시지가 정상적인 응답을 반환하면 연결이 올바른 것입니다. 인증 오류가 발생하면 .env의 키가 잘못되었거나 로드되지 않은 것입니다. 알 수 없는 모델 오류가 발생하면 2단계의 /v1/models 출력과 deepseek-ai/ 접두사를 다시 확인하십시오.
여기서 가장 흔한 실수는 Atlas Cloud가 응답할 것으로 예상하면서 Hermes의 내장 deepseek 공급자를 사용하는 것입니다. 내장 공급자는 DeepSeek 자체 엔드포인트와 해당 모델 이름에 하드 와이어링되어 있으므로 DeepSeek 계정에 청구하고 Atlas Cloud를 완전히 무시합니다. Atlas Cloud를 통한 라우팅은 의도적인 사용자 지정 공급자 선택입니다. 즉, 자체 base_url, Atlas Cloud 키, 접두사가 붙은 deepseek-ai/ 모델 ID입니다. 이 세 가지를 함께 유지하면 두 경로가 혼동되지 않습니다.
4단계: Flash에 저렴한 작업 보내기
Hermes는 웹 요약, 비전 분석, 컨텍스트 압축, 명령 승인 등 많은 저가치 호출을 백그라운드에서 실행합니다. 이러한 작업에 V4 Pro 요금을 지불하는 것은 낭비입니다. 보조 슬롯을 V4 Flash로 지정하여 주 루프는 더 강력한 모델을 유지하고 백그라운드 작업은 훨씬 저렴한 비용으로 실행되도록 합니다.
text1auxiliary: 2 web_extract: 3 provider: atlascloud 4 base_url: https://api.atlascloud.ai/v1 5 api_key_env: ATLASCLOUD_API_KEY 6 model: deepseek-ai/deepseek-v4-flash 7 compression: 8 provider: atlascloud 9 base_url: https://api.atlascloud.ai/v1 10 api_key_env: ATLASCLOUD_API_KEY 11 model: deepseek-ai/deepseek-v4-flash 12 timeout: 120
각 보조 슬롯은 자체 공급자, 모델, 기본 URL, 키 및 대체 체인을 허용하므로 모든 백그라운드 작업을 독립적으로 조정할 수 있습니다.
5단계: 복원력을 위한 대체 추가
오랫동안 실행되는 에이전트는 결국 속도 제한이나 시간 초과된 연결에 도달할 것입니다. 대체 체인은 오류가 발생하는 대신 계속 작동하도록 합니다. 여기서는 압축 작업이 먼저 V4 Flash를 시도한 다음 포기하기 전에 두 번째 Atlas Cloud 모델로 대체됩니다.
text1auxiliary: 2 compression: 3 provider: atlascloud 4 base_url: https://api.atlascloud.ai/v1 5 api_key_env: ATLASCLOUD_API_KEY 6 model: deepseek-ai/deepseek-v4-flash 7 fallback_chain: 8 - provider: atlascloud 9 base_url: https://api.atlascloud.ai/v1 10 api_key_env: ATLASCLOUD_API_KEY 11 model: deepseek-ai/deepseek-v3.2
Hermes는 하나가 성공할 때까지 각 항목을 순서대로 시도하므로 단일 공급자 문제가 에이전트를 멈추게 하지 않습니다. 일정에 따라 무인으로 실행되는 에이전트의 경우, 이는 조용히 복구되는 cron 작업과 새벽 3시에 죽고 아침에 스택 추적을 남기는 cron 작업의 차이입니다.
이 설정이 적합한 경우
Atlas Cloud를 통해 DeepSeek에서 Hermes를 실행하는 것은 에이전트가 사용하는 모든 것에 대해 하나의 키와 하나의 청구서를 원할 때 가장 합리적입니다. 동일한 엔드포인트가 이미지 및 비디오 모델도 제공하므로, 텍스트 전용으로 시작하는 에이전트는 새로운 통합이나 두 번째 공급업체 계정 없이 나중에 이미지나 클립을 생성할 수 있습니다. 에이전트가 DeepSeek만 호출하고 다른 것은 호출하지 않는다면, DeepSeek 자체 API를 가리키는 내장 DeepSeek 공급자가 더 간단한 경로입니다. Atlas Cloud 경로는 단일 OpenAI 호환 표면 뒤에 다양한 모달리티에 걸쳐 모델을 추가할 여유를 원할 때 그 가치를 발휘합니다.
DeepSeek 라인업이 발전함에 따라 이러한 습관을 유지하는 것이 중요합니다. 구성 파일에 커밋하기 전에 atlascloud.ai/models에서 모든 모델 ID와 실시간 가격을 직접 확인할 수 있습니다.







