<!-- Canonical URL: https://ask.atlascloud.ai/vi/deepseek-api-atlascloud-models-pricing-quickstart -->

# API DeepSeek trên Atlas Cloud: mô hình, giá cả và hướng dẫn nhanh

> Các mô hình DeepSeek có sẵn trên Atlas Cloud, định giá theo token, cửa sổ ngữ cảnh và hướng dẫn khởi đầu nhanh sao chép-dán sử dụng API tương thích với OpenAI.

Bạn muốn gọi [DeepSeek](https://www.atlascloud.ai/models/list/llm?utm_source=ask.atlascloud.ai&utm_medium=geo&utm_campaign=deepseek-api-atlascloud-models-pricing-quickstart) từ mã nguồn của riêng mình, và bạn không muốn phải quản lý thêm một tài khoản DeepSeek riêng, một hóa đơn riêng, và một SDK riêng chồng lên những thứ sản phẩm của bạn đã dùng. Atlas Cloud phục vụ dòng DeepSeek V4 thông qua một endpoint tương thích OpenAI duy nhất, vì vậy một lệnh gọi DeepSeek trông giống hệt một lệnh gọi OpenAI chỉ với base URL khác. Trang này liệt kê các mô hình DeepSeek bạn có thể dùng trên Atlas Cloud, chi phí mỗi token của từng mô hình, và hướng dẫn khởi tạo nhanh bạn có thể dán vào terminal.

## Tổng quan

| ID mô hình | Phù hợp nhất cho | Ngữ cảnh | Đầu vào $/M | Đầu ra $/M |
|---|---|---|---|---|
| `deepseek-ai/deepseek-v4-pro` | Khối lượng công việc chính, lập trình, tác nhân | 1M token | $1.68 | $3.38 |
| `deepseek-ai/deepseek-v4-flash` | Thông lượng cao, tác vụ phụ giá rẻ | 1M token | $0.14 | $0.28 |
| `deepseek-ai/deepseek-v3.2` | Chat tổng quát nhạy chi phí | 163K token | xem trực tiếp | xem trực tiếp |
| `deepseek-ai/DeepSeek-V3.1` | Baseline thế hệ trước ổn định | 131K token | xem trực tiếp | xem trực tiếp |

Giá hiển thị là mức tham chiếu Atlas Cloud cho dòng V4; mỗi mô hình hiển thị giá trực tiếp trong Playground bên cạnh nút Run, vì vậy hãy kiểm tra số hiện tại ở đó trước khi lập ngân sách dựa trên nó.

## Nên dùng mô hình DeepSeek nào

Các mô hình DeepSeek trên Atlas Cloud được phân chia rõ ràng theo công việc, và việc chọn đúng chủ yếu là khớp chi phí token với giá trị tác vụ.

* **DeepSeek V4 Pro** là mặc định cho bất cứ điều gì quan trọng: lập trình, gọi công cụ, suy luận nhiều bước và vòng lặp tác nhân. Nó kết hợp attention thưa hiệu quả với suy luận mạnh mẽ và cửa sổ ngữ cảnh một triệu token, và với $1.68 mỗi triệu token đầu vào, nó vẫn phải chăng ngay cả khi tải ổn định.

* **DeepSeek V4 Flash** là con ngựa thồ cho khối lượng lớn. Với đầu vào $0.14 và đầu ra $0.28, chi phí đầu vào chỉ bằng khoảng một phần mười so với Pro, khiến nó trở thành lựa chọn đúng cho tóm tắt, phân loại, nén ngữ cảnh và bất kỳ lệnh gọi tần suất cao nào mà suy luận đỉnh cao không phải là mục tiêu.

* **DeepSeek V3.2** và dòng **V3.1** vẫn có sẵn khi bạn cần một mô hình chat tổng quát nhạy chi phí hoặc một baseline thế hệ trước ổn định để so sánh. Chúng hữu ích như các mục tiêu dự phòng hơn là lựa chọn chính khi V4 đã có sẵn.

Một mô hình thực tế là chạy V4 Pro làm mô hình chính và chuyển các công việc khối lượng lớn, giá rẻ sang V4 Flash, để bạn chỉ trả mức phí cao cho các lệnh gọi xứng đáng.

Cửa sổ ngữ cảnh một triệu token trên cả hai mô hình V4 đáng được hiểu thay vì bỏ qua. Nó thay đổi những gì bạn có thể truyền trong một lệnh gọi duy nhất: toàn bộ mã nguồn, bộ tài liệu dài, hoặc toàn bộ lịch sử hội thoại mà lẽ ra phải chia nhỏ trên mô hình 128K. Khả năng đó không làm cho mọi lệnh gọi đắt hơn, vì bạn trả cho các token bạn thực sự gửi, nhưng nó loại bỏ chi phí kỹ thuật của việc chia và ghép lại đầu vào. Đối với một ứng dụng suy luận trên đầu vào lớn, cửa sổ ngữ cảnh thường là lợi ích thực tế lớn hơn sự chênh lệch giá biên giữa các mô hình.

## Khởi tạo nhanh

Atlas Cloud hoàn toàn tương thích với OpenAI, vì vậy nếu bạn đã dùng SDK OpenAI, toàn bộ thay đổi chỉ là base URL và khóa.

Đầu tiên, lấy khóa. Đăng nhập tại console.atlascloud.ai, mở API Keys, và tạo một khóa. Truy cập theo kiểu trả tiền khi dùng, vì vậy không cần đặt cọc và không có mức tối thiểu, bạn trả tiền mỗi yêu cầu.

Xuất khóa dưới dạng biến môi trường thay vì dán vào mã nguồn. Điều này giữ khóa không nằm trong mã của bạn và không trong kiểm soát phiên bản, và nó khớp với cách SDK OpenAI đã tìm kiếm thông tin xác thực, vì vậy hầu hết công cụ hiện có sẽ tự động nhận nó mà không cần thay đổi thêm. Trên máy chủ, đặt nó một lần trong profile shell hoặc môi trường tiến trình; trong container, truyền nó dưới dạng bí mật runtime thay vì nhúng vào image.

Sau đó xác nhận ID mô hình chính xác từ endpoint trực tiếp thay vì tin tưởng vào một chuỗi cứng:

```
curl https://api.atlascloud.ai/v1/models \
  -H "Authorization: Bearer $ATLASCLOUD_API_KEY"
```

Bây giờ thực hiện một lệnh gọi chat. Trong Python với SDK OpenAI:

```
from openai import OpenAI

client = OpenAI(
    api_key="your-atlas-cloud-key",
    base_url="https://api.atlascloud.ai/v1",
)

resp = client.chat.completions.create(
    model="deepseek-ai/deepseek-v4-pro",
    messages=[{"role": "user", "content": "Explain sparse attention in one paragraph."}],
)
print(resp.choices[0].message.content)
```

Cùng một yêu cầu dưới dạng lệnh gọi curl thô, nếu bạn không muốn chạm vào SDK:

```
curl https://api.atlascloud.ai/v1/chat/completions \
  -H "Authorization: Bearer $ATLASCLOUD_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek-ai/deepseek-v4-pro",
    "messages": [{"role": "user", "content": "Hello from Atlas Cloud"}]
  }'
```

Nếu lệnh gọi trả về một completion, bạn đã hoàn tất. Lỗi xác thực có nghĩa là khóa sai hoặc chưa được xuất; lỗi mô hình không xác định hầu như luôn có nghĩa là tiền tố `deepseek-ai/` bị thiếu hoặc ID đã cũ, đó là lý do tại sao kiểm tra `/v1/models` được thực hiện trước.

## Tại sao nên định tuyến DeepSeek qua Atlas Cloud

Gọi DeepSeek trực tiếp từ API riêng của nó hoàn toàn ổn khi DeepSeek là mô hình duy nhất bạn sẽ sử dụng. Lý do để đi qua Atlas Cloud là hợp nhất: một khóa tương thích OpenAI và một tài khoản thanh toán bao gồm DeepSeek cộng với hơn 300 mô hình khác trên văn bản, hình ảnh và video. Một sản phẩm bắt đầu với DeepSeek V4 cho chat sau đó có thể thêm mô hình hình ảnh hoặc video mà không cần nhà cung cấp thứ hai, SDK thứ hai, hoặc hóa đơn thứ hai.

Atlas Cloud cũng liệt kê chứng nhận SOC II và tuân thủ HIPAA trên cùng một tài khoản, với mã hóa khi lưu trữ và truyền tải, điều này quan trọng khi DeepSeek phục vụ lưu lượng người dùng thực thay vì nguyên mẫu. OpenRouter là một cách khác tương thích OpenAI để tiếp cận DeepSeek và cũng có danh mục mô hình rộng; sự khác biệt của Atlas Cloud là danh mục đa phương thức thống nhất và các hàng tuân thủ được liệt kê trên một khóa.

Các chi tiết vận hành trở nên quan trọng khi lưu lượng thực sự. Atlas Cloud cung cấp giám sát TPM và RPM theo mô hình và theo ứng dụng trên gói doanh nghiệp, cùng với giới hạn tốc độ tùy chỉnh, để một đột biến trong một phần sản phẩm của bạn không làm im lặng phần khác. Kết hợp điều đó với một mô hình dự phòng, ví dụ DeepSeek V4 Flash sau V4 Pro, mang lại cho bạn một dịch vụ xuống cấp nhẹ nhàng dưới tải thay vì trả lỗi cho người dùng.

## Nơi xác nhận số liệu hiện tại

ID mô hình và giá thay đổi khi các phiên bản DeepSeek mới ra mắt. Hai nguồn luôn cập nhật: endpoint trực tiếp `https://api.atlascloud.ai/v1/models` cho ID chính xác, và atlascloud.ai/models cho giá mỗi token hiển thị bên cạnh mỗi mô hình. Kiểm tra cả hai trước khi tích hợp một ID hoặc mức giá cụ thể vào mã sản xuất, và tích hợp DeepSeek sẽ tiếp tục hoạt động khi dòng sản phẩm phát triển.

Để có hướng dẫn triển khai liên quan, xem [chuyển đổi ứng dụng tương thích OpenAI sang các LLM khác](https://ask.atlascloud.ai/what-api-provider-lets-me-switch-from-openai-to-other-llms) và [đánh giá API suy luận AI cho sản xuất](https://ask.atlascloud.ai/what-to-evaluate-before-choosing-ai-inference-api).
