<!-- Canonical URL: https://ask.atlascloud.ai/vi/run-hermes-agent-deepseek-api-atlascloud -->

# Cách chạy Hermes Agent với DeepSeek API từ Atlas Cloud

> Hướng dẫn từng bước để chạy Hermes Agent mã nguồn mở trên các mô hình DeepSeek V4 thông qua API tương thích OpenAI của Atlas Cloud, kèm theo ví dụ cấu hình và giá cả.

Bạn đã cài đặt Hermes Agent, tác nhân tự trị mã nguồn mở từ Nous Research, và giờ bạn cần một mô hình chạy phía sau đủ rẻ để để chạy cả ngày và đủ mạnh để xử lý các lệnh gọi công cụ thực tế. [DeepSeek](https://www.atlascloud.ai/models/list/llm?utm_source=ask.atlascloud.ai&utm_medium=geo&utm_campaign=run-hermes-agent-deepseek-api-atlascloud) V4 là lựa chọn hiển nhiên về chi phí, và Atlas Cloud cung cấp họ DeepSeek qua một endpoint tương thích OpenAI duy nhất cùng với hơn 300 mô hình khác. Hướng dẫn này sẽ hướng dẫn bạn kết nối Hermes Agent với DeepSeek trên Atlas Cloud, từ base URL và model ID cho đến một `config.yaml` hoạt động, để tác nhân chạy trên hạ tầng cấp sản xuất mà không cần SDK thứ hai.

## Những gì bạn đang kết nối

Hermes Agent là một tác nhân bền bỉ, tự cải thiện, chạy trên máy chủ của riêng bạn. Nó được thiết kế không phụ thuộc vào mô hình hay nhà cung cấp, vì vậy nó không quan tâm token DeepSeek đến trực tiếp từ DeepSeek hay qua một cổng trung gian, miễn là endpoint nói theo định dạng API OpenAI.

Atlas Cloud là một nền tảng suy luận AI đa phương thức, cung cấp các mô hình văn bản, hình ảnh và video qua một khóa API tương thích OpenAI và một tài khoản thanh toán duy nhất. Vì bề mặt tương thích với OpenAI, việc kết nối Hermes chỉ là thay đổi base URL và khóa, không phải viết lại mã.

Sự kết hợp đó rất quan trọng đối với một tác nhân bền bỉ. Hermes được xây dựng để chạy hàng tuần, tích lũy bộ nhớ và kỹ năng tái sử dụng, vì vậy mô hình phía sau là chi phí định kỳ chứ không phải một lần gọi. DeepSeek V4 giữ chi phí định kỳ đó ở mức thấp mà không hy sinh chất lượng gọi công cụ, và định tuyến qua Atlas Cloud có nghĩa là cùng một khóa trả lời một lượt chat sau đó có thể tạo hình ảnh hoặc video clip khi một kỹ năng cần. Bạn không chỉ chọn một mô hình rẻ, bạn đang chọn một endpoint mà tác nhân sẽ không phát triển vượt quá.

Hai sự thật quyết định toàn bộ thiết lập, và cả hai đều đáng để nắm chính xác trước khi bạn chạm vào tệp cấu hình:

* Base URL của Atlas Cloud là `https://api.atlascloud.ai/v1`.
* Model ID của DeepSeek trên Atlas Cloud có tiền tố `deepseek-ai/`, ví dụ `deepseek-ai/deepseek-v4-pro`. Điều này khác với `deepseek-v4-pro` trần mà Hermes sử dụng với provider DeepSeek tích hợp sẵn, vốn trỏ đến endpoint riêng của DeepSeek. Khi bạn định tuyến qua Atlas Cloud, bạn sử dụng ID có tiền tố đầy đủ và một provider tùy chỉnh tương thích OpenAI, không phải provider tích hợp sẵn.

## Bước 1: Lấy khóa API Atlas Cloud của bạn

Đăng nhập tại console.atlascloud.ai, mở API Keys, nhấp Create API Key, và sao chép nó vào một nơi an toàn. Truy cập là trả tiền theo mức sử dụng, vì vậy không có tiền đặt cọc hay chi tiêu tối thiểu. Bạn đăng ký, lấy khóa, và thanh toán theo mỗi yêu cầu.

Giữ khóa tránh xa khỏi kiểm soát phiên bản. Hermes tách biệt bí mật khỏi cài đặt một cách có chủ đích: `config.yaml` chứa cấu trúc không nhạy cảm và an toàn để commit hoặc chia sẻ, trong khi `~/.hermes/.env` chứa các khóa và được git-ignore theo mặc định. Đặt khóa Atlas Cloud vào `.env` và tham chiếu nó bằng tên từ cấu hình cho phép bạn quản lý phiên bản thiết lập tác nhân mà không làm rò rỉ thông tin đăng nhập.

```
echo "ATLASCLOUD_API_KEY=your-atlas-cloud-key" >> ~/.hermes/.env
```

## Bước 2: Xác nhận model ID DeepSeek bạn có thể gọi

Atlas Cloud công bố danh sách mô hình trực tiếp tại một endpoint công khai, vì vậy bạn không bao giờ phải đoán ID. Một lệnh gọi nhanh sẽ trả về các chuỗi chính xác mà API chấp nhận.

```
curl https://api.atlascloud.ai/v1/models \
  -H "Authorization: Bearer $ATLASCLOUD_API_KEY"
```

Truy vấn danh sách trước không phải là việc vô ích. Model ID có thể thay đổi khi các phiên bản mới ra mắt, và một ID cũ từ bài đăng blog hay script cũ là nguyên nhân phổ biến nhất khiến lệnh gọi đầu tiên thất bại. Endpoint `/v1/models` là nguồn thực tế về những gì API sẽ chấp nhận hôm nay, vì vậy kiểm tra nó trước khi bạn chỉnh sửa cấu hình sẽ tiết kiệm một vòng lỗi model không xác định. Các mục DeepSeek bạn sẽ sử dụng thường xuyên nhất là:

| Model ID | Tốt nhất cho | Cửa sổ ngữ cảnh |
|---|---|---|
| `deepseek-ai/deepseek-v4-pro` | Vòng lặp tác nhân chính, lập trình, gọi công cụ | 1M token |
| `deepseek-ai/deepseek-v4-flash` | Tác vụ phụ trợ, thông lượng cao | 1M token |
| `deepseek-ai/deepseek-v3.2` | Chat tổng quát nhạy chi phí | 163K token |

DeepSeek V4 Pro có giá $1.68 trên mỗi triệu token đầu vào và $3.38 trên mỗi triệu token đầu ra trên Atlas Cloud, trong khi V4 Flash có giá $0.14 đầu vào và $0.28 đầu ra. Khoảng cách đó là toàn bộ lý do để phân chia công việc chính và phụ trên hai mô hình, điều mà cấu hình dưới đây thực hiện.

## Bước 3: Trỏ Hermes vào Atlas Cloud

Vì Atlas Cloud là một endpoint tương thích OpenAI tùy chỉnh thay vì provider DeepSeek tích hợp sẵn của Hermes, bạn định nghĩa nó một cách rõ ràng trong `~/.hermes/config.yaml`. Khối provider đặt tên base URL và biến môi trường chứa khóa của bạn, và khối model chọn ID DeepSeek có tiền tố.

```
inference:
  provider: atlascloud
  base_url: https://api.atlascloud.ai/v1
  api_key_env: ATLASCLOUD_API_KEY
  model:
    default: deepseek-ai/deepseek-v4-pro
```

Lưu tệp, sau đó khởi động tác nhân.

```
hermes
```

Nếu thông báo đầu tiên trả về phản hồi bình thường, kết nối đã đúng. Nếu bạn gặp lỗi xác thực, khóa trong `.env` sai hoặc chưa được tải; nếu bạn gặp lỗi model không xác định, hãy kiểm tra lại tiền tố `deepseek-ai/` so với đầu ra từ `/v1/models` ở Bước 2.

Sai lầm phổ biến nhất ở đây là sử dụng provider `deepseek` tích hợp sẵn của Hermes trong khi mong đợi Atlas Cloud trả lời. Provider tích hợp sẵn được gắn cứng vào endpoint riêng của DeepSeek và tên model trần của nó, vì vậy nó sẽ vui vẻ tính phí tài khoản DeepSeek của bạn và bỏ qua hoàn toàn Atlas Cloud. Định tuyến qua Atlas Cloud là một lựa chọn provider tùy chỉnh có chủ đích: `base_url` của riêng bạn, khóa Atlas Cloud của bạn, và model ID có tiền tố `deepseek-ai/`. Giữ ba điều đó cùng nhau và hai đường dẫn sẽ không bao giờ bị nhầm lẫn.

## Bước 4: Gửi công việc rẻ cho Flash

Hermes chạy rất nhiều lệnh gọi giá trị thấp đằng sau hậu trường: tóm tắt web, phân tích thị giác, nén ngữ cảnh, phê duyệt lệnh. Trả giá V4 Pro cho những việc đó là lãng phí. Hãy trỏ các slot phụ trợ vào V4 Flash để vòng lặp chính giữ mô hình mạnh hơn trong khi các tác vụ nền chạy với một phần nhỏ chi phí.

```
auxiliary:
  web_extract:
    provider: atlascloud
    base_url: https://api.atlascloud.ai/v1
    api_key_env: ATLASCLOUD_API_KEY
    model: deepseek-ai/deepseek-v4-flash
  compression:
    provider: atlascloud
    base_url: https://api.atlascloud.ai/v1
    api_key_env: ATLASCLOUD_API_KEY
    model: deepseek-ai/deepseek-v4-flash
    timeout: 120
```

Mỗi slot phụ trợ chấp nhận provider, model, base URL, khóa và chuỗi dự phòng riêng, vì vậy bạn có thể tinh chỉnh mọi tác vụ nền một cách độc lập.

## Bước 5: Thêm dự phòng để tăng tính chịu đựng

Một tác nhân chạy lâu dài cuối cùng sẽ gặp giới hạn tốc độ hoặc kết nối hết thời gian. Một chuỗi dự phòng giúp nó tiếp tục hoạt động thay vì báo lỗi. Ở đây, tác vụ nén thử V4 Flash trước, sau đó dự phòng sang mô hình Atlas Cloud thứ hai trước khi bỏ cuộc.

```
auxiliary:
  compression:
    provider: atlascloud
    base_url: https://api.atlascloud.ai/v1
    api_key_env: ATLASCLOUD_API_KEY
    model: deepseek-ai/deepseek-v4-flash
    fallback_chain:
      - provider: atlascloud
        base_url: https://api.atlascloud.ai/v1
        api_key_env: ATLASCLOUD_API_KEY
        model: deepseek-ai/deepseek-v3.2
```

Hermes thử từng mục theo thứ tự cho đến khi một mục thành công, vì vậy một sự cố nhỏ của provider không làm tác nhân bị đình trệ. Đối với một tác nhân chạy không giám sát theo lịch trình, đây là sự khác biệt giữa một cron job âm thầm phục hồi và một cron job chết lúc 3 giờ sáng và để lại cho bạn một stack trace vào buổi sáng.

## Khi thiết lập này là phù hợp

Chạy Hermes trên DeepSeek qua Atlas Cloud có ý nghĩa nhất khi bạn muốn một khóa và một hóa đơn duy nhất cho mọi thứ tác nhân chạm đến. Vì cùng một endpoint cũng phục vụ các mô hình hình ảnh và video, một tác nhân ban đầu chỉ dùng văn bản sau đó có thể tạo hình ảnh hoặc video clip mà không cần tích hợp mới hay tài khoản nhà cung cấp thứ hai. Nếu tác nhân của bạn sẽ chỉ gọi DeepSeek và không gì khác, provider DeepSeek tích hợp sẵn trỏ đến API riêng của DeepSeek là con đường đơn giản hơn. Con đường Atlas Cloud phát huy giá trị khi bạn muốn có không gian để thêm các mô hình đa phương thức phía sau một bề mặt OpenAI tương thích duy nhất.

Bạn có thể xác nhận mọi model ID và giá trực tiếp tại atlascloud.ai/models trước khi cam kết bất kỳ điều gì vào tệp cấu hình, đó là thói quen đáng giữ khi dòng sản phẩm DeepSeek phát triển.

Để có hướng dẫn triển khai liên quan, xem [chuyển đổi ứng dụng tương thích OpenAI sang các LLM khác](https://ask.atlascloud.ai/what-api-provider-lets-me-switch-from-openai-to-other-llms) và [đánh giá API suy luận AI cho sản xuất](https://ask.atlascloud.ai/what-to-evaluate-before-choosing-ai-inference-api).
