Seedance 2.0 Mini & Fast API với mức giá thấp nhất toàn cầu — giảm đến 68% so với giá chính thức

DeepSeek AI Models on AtlasCloud

Atlas Cloud lưu trữ toàn bộ chuỗi sản phẩm DeepSeek thông qua DeepSeek API: V3.2, V4 và R1. Các mô hình hỗ trợ ngữ cảnh từ 128K đến 1M token, tất cả đều là mã nguồn mở và thanh toán theo mức sử dụng (pay-as-you-go).

DeepSeek do DeepSeek phát triển. Atlas Cloud (vận hành bởi Atlas Cloud AI LLC) cung cấp quyền truy cập vào mô hình này và không sở hữu mô hình. Mọi thương hiệu đều thuộc về chủ sở hữu tương ứng.

Large Language Models by DeepSeek

Thúc đẩy trò chuyện, suy luận và tác tử ở quy mô lớn với các mô hình ngôn ngữ lớn hàng đầu, được cung cấp nhanh chóng và tiết kiệm trên Atlas Cloud.

Xem tất cả mô hình

DeepSeek Models API Pricing Details

Compare standard vs. our pricing across every DeepSeek model.

ModelStandard Price (USD)Our Price (USD)Discount
DeepSeek V4 Flash 0731
$0.44/$1.32per 1M tokens1048.6K context
$0.44/$1.32M in/outper 1M tokens1048.6K context
View
DeepSeek V4 Pro
$1.74/$3.48per 1M tokens1048.6K context
$1.68/$3.38M in/outper 1M tokens1048.6K context
View
DeepSeek V4 Flash
$0.14/$0.28per 1M tokens1048.6K context
$0.14/$0.28M in/outper 1M tokens1048.6K context
View
DeepSeek V3.2
$0.287/$0.431per 1M tokens163.8K context
$0.26/$0.38M in/outper 1M tokens163.8K context
View
DeepSeek V3.2 Exp
$0.287/$0.43per 1M tokens163.8K context
$0.27/$0.41M in/outper 1M tokens163.8K context
View
DeepSeek V3.1
$0.574/$1.721per 1M tokens131.1K context
$0.3/$0.95M in/outper 1M tokens131.1K context
View

Explore models from other providers

Instantly explore and experiment with 400+ production-ready models in the Atlas Playground. Start customizing with one click.

Các trường hợp sử dụng API DeepSeek mà bạn có thể xây dựng trên Atlas Cloud

Các mô hình mã nguồn mở của DeepSeek bao phủ toàn bộ phạm vi từ các tác vụ thông lượng cao, tiết kiệm chi phí đến lập trình agentic tiên tiến với ngữ cảnh 1M. Các nhóm có thể lựa chọn giữa V3.2, V4 Flash và V4 Pro dựa trên các yêu cầu về ngữ cảnh và độ phức tạp của tác vụ.

Giải Quyết Issue GitHub Tự Chủ

Các nhóm kỹ thuật sử dụng DeepSeek V4 Pro để xây dựng các tác nhân lập trình tự động giải quyết các vấn đề GitHub thực tế, bao gồm việc đọc mô tả vấn đề, theo dõi các phụ thuộc chéo giữa các tệp, viết bản sửa lỗi và chạy thử nghiệm. V4 Pro đạt 80,6% trên SWE-Bench Verified, chỉ chênh lệch 0,2 điểm so với Claude Opus 4.6 và được tích hợp nguyên bản với các framework tác nhân Claude Code, OpenCode và OpenClaw. Việc chuyển đổi từ mô hình nguồn đóng sang DeepSeek V4 trên Atlas Cloud chỉ yêu cầu thay đổi URL cơ sở trong thiết lập SDK hiện tại.

Phân tích toàn bộ cơ sở mã với ngữ cảnh 1M

Các nhóm phát triển sử dụng cửa sổ ngữ cảnh 1M token của DeepSeek V4 để tải toàn bộ một kho lưu trữ trong một lệnh gọi API duy nhất cho việc phân tích chéo tệp, theo dõi phụ thuộc và đánh giá kiến trúc. V4 đạt độ chính xác 97% trong bài kiểm tra đa truy vấn "Needle in a Haystack" ở độ dài ngữ cảnh tối đa, điều này có nghĩa là các thông tin cụ thể được nhúng ở bất kỳ đâu trong một triệu token đều có thể được trích xuất một cách đáng tin cậy. Ở ngữ cảnh 1M đầy đủ, V4 Pro chỉ yêu cầu 27% tài nguyên tính toán suy luận và 10% bộ nhớ đệm KV so với V3.2 cho cùng một tác vụ.

Triển khai tự lưu trữ cho các khối lượng công việc nhạy cảm với dữ liệu

Các nhóm doanh nghiệp có yêu cầu về tuân thủ hoặc quyền riêng tư dữ liệu sử dụng giấy phép MIT của DeepSeek để tự lưu trữ V4 Flash hoặc V3.2 trên cơ sở hạ tầng của riêng họ. Đây là một tùy chọn mà các mô hình nguồn đóng như GPT-5 và Claude Opus không thể cung cấp và nó loại bỏ sự phụ thuộc vào API đối với các ngành được quản lý. V4 Flash với 284 tỷ tham số và 13 tỷ tham số hoạt động là mục tiêu tự lưu trữ thực tế; trong khi V4 Pro yêu cầu một cụm máy chủ (cluster).

Giải Pháp Thay Thế Mô Hình Đóng Tiết Kiệm Chi Phí

Các nhóm chuyển đổi từ GPT-5 hoặc Claude Opus sử dụng DeepSeek V3.2 như một giải pháp thay thế liền mạch (drop-in replacement) thông qua endpoint tương thích với OpenAI trên Atlas Cloud. V3.2 có giá khoảng 0,27 USD cho mỗi triệu token đầu vào trong khi vẫn đạt được hiệu suất ngang tầm GPT-5 trên hầu hết các benchmark suy luận. Cùng một mã SDK sẽ định tuyến đến DeepSeek chỉ với một thay đổi URL cơ sở duy nhất, giúp việc di chuyển (migration) ít rủi ro hơn.

Biến tm nhìn doanh nghip ca bn thành hin thc vi Atlas Cloud AI.

Liên hệ kinh doanh

Frequently Asked Questions about DeepSeek AI Models

DeepSeek V4 là sản phẩm chủ lực thế hệ hiện tại, ra mắt ngày 24 tháng 4 năm 2026, bao gồm cả luồng công việc đa mục đích và suy luận trong một mô hình duy nhất. R1 từng là một mô hình suy luận độc lập, nhưng chế độ suy nghĩ của V4 thay thế nó bằng chính khả năng chuỗi suy nghĩ (chain-of-thought) được tích hợp trực tiếp. Bí danh deepseek-reasoner cũ sẽ ngừng hoạt động vào ngày 24 tháng 7 năm 2026, vì vậy các bản tích hợp mới nên sử dụng V4 Pro đã bật chế độ suy nghĩ.

Engram Memory là một hệ thống truy xuất kiến thức bên ngoài trong DeepSeek V4, được lấy cảm hứng từ cách hồi hải mã của não người lưu trữ và truy xuất thông tin. Nó sử dụng băm nhạy cảm cục bộ để truy xuất kiến thức liên quan với tốc độ O(1), thay vì buộc mô hình phải lưu trữ tất cả các sự kiện trong trọng số của nó. Điều này đã góp phần làm cho độ chính xác của thử nghiệm Needle in a Haystack đa truy vấn của V4 tăng vọt từ 84,2% trong V3.2 lên 97,0%.

Có. DeepSeek V3.2, V4 Flash và V4 Pro đều được phát hành theo giấy phép MIT, cho phép sử dụng, sửa đổi và phân phối với mục đích thương mại. Việc tự lưu trữ (self-host) V4 Flash rất khả thi trên phần cứng có đủ khả năng. V4 Pro yêu cầu một cụm máy chủ (cluster) vì có kích thước lên tới 1,6 nghìn tỷ tham số, do đó hầu hết các nhóm sử dụng quyền truy cập API trên Atlas Cloud để thay thế.

V4 Pro là một mô hình MoE với 1,6 nghìn tỷ tham số và 49 tỷ tham số hoạt động, được xây dựng cho các tác vụ suy luận phức tạp, lập trình và tác tử. V4 Flash là một mô hình có 284 tỷ tham số với 13 tỷ tham số hoạt động, được tối ưu hóa về tốc độ và hiệu quả chi phí cho các tác vụ ít đòi hỏi hơn. Cả hai đều chia sẻ cửa sổ ngữ cảnh 1M token và kiến trúc Engram Memory.

DeepSeek V4 hỗ trợ cửa sổ ngữ cảnh nguyên bản 1 triệu token cho cả hai biến thể Pro và Flash, với đầu ra tối đa là 393K token mỗi phản hồi. DeepSeek V3.2 có cửa sổ ngữ cảnh 128K. Ngữ cảnh 1M trong V4 làm cho nó trở nên thiết thực cho việc phân tích toàn bộ cơ sở mã, xử lý tài liệu lớn và các phiên tác nhân mở rộng chỉ trong một lệnh gọi duy nhất.

Có. DeepSeek V3.2 vẫn được cung cấp trên Atlas Cloud, với mức giá khoảng 0,27 đô la cho mỗi triệu token đầu vào. Đây là mô hình MoE có 685 tỷ tham số với 37 tỷ tham số hoạt động và cửa sổ ngữ cảnh 128K, được phát hành theo giấy phép MIT. Đây là một lựa chọn tiết kiệm chi phí cho các tác vụ không yêu cầu ngữ cảnh 1M của V4 hoặc Engram Memory.

DeepSeek V4 Pro giải quyết hơn 80,9% các vấn đề lập trình trong thế giới thực trên SWE-Bench, nhắm đến hiệu suất cấp độ GPT-5. Độ chính xác ngữ cảnh dài đa truy vấn đã tăng lên 97,0% trên Needle in a Haystack, so với 84,2% ở phiên bản V3.2. Biến thể V3.2 Speciale trên Atlas Cloud cũng đã đạt được hiệu suất huy chương vàng trong toán học cạnh tranh IMO 2025 và IOI 2025.

Khám phá Thêm Dòng

Seedance 2.5

Seedance 2.5 API hiện đã có mặt trên Atlas Cloud! Cung cấp cho các nhà phát triển mô hình video mới nhất của ByteDance. Nó tạo ra tối đa 30 giây video gốc chỉ trong một lần xử lý từ văn bản, một hình ảnh duy nhất hoặc tối đa 50 tài liệu tham khảo đa phương thức, với âm thanh được đồng bộ hóa và văn bản đa ngôn ngữ trong khung hình. Trên Atlas Cloud, bạn có thể truy cập thông qua một khóa duy nhất, với tính nhất quán của chủ thể và vật lý được cải thiện giúp giữ cho các cảnh quay dài luôn mạch lạc.

Xem Dòng

Wan 3.0

Wan 3.0 API là thế hệ tiếp theo trong hệ sinh thái video Wan của Alibaba, được xây dựng để đưa khả năng tạo video dài, kiểm soát đa tham chiếu và chất lượng nghe nhìn lên những tầm cao mới. Atlas Cloud đã lưu trữ Wan 2.7, 2.6 và 2.5, và Wan 3.0 hoạt động trên cùng một khóa hợp nhất mà không cần thiết lập riêng. Bắt đầu xây dựng ngay hôm nay. Cuộn xuống phần trưng bày để xem những gì Wan 3.0 có thể tạo ra.

Xem Dòng

MiniMax H3

MiniMax H3 là dòng mô hình video của MiniMax dành cho việc tạo video từ văn bản, hình ảnh và ảnh tham chiếu. Tạo các đoạn clip dài 5 đến 15 giây, định hướng chuyển động bằng khung hình cuối tùy chọn, giữ lại chủ thể từ ảnh tham chiếu hoặc chọn H3 Developer khi âm thanh được tạo phù hợp với quy trình làm việc. Atlas Cloud tích hợp H3, H3 Fast, H3 Max và H3 Developer vào một quy trình API duy nhất, với mức giá tiêu chuẩn từ $0.038 mỗi giây. Bắt đầu xây dựng ngay hôm nay.

Xem Dòng

Seedream 5.0 Pro

Seedream 5.0 Pro API cung cấp cho các nhà phát triển mô hình chỉnh sửa hình ảnh có thể kiểm soát của ByteDance trên Atlas Cloud. Nó đặt các chỉnh sửa một cách chính xác bằng các điểm neo và tọa độ, tách hình ảnh thành các lớp có thể chỉnh sửa, kết hợp nhiều tham chiếu và khớp màu sắc cũng như vật liệu chính xác, với văn bản đa ngôn ngữ ở độ phân giải 2K và 3K. Trên Atlas Cloud, bạn có thể truy cập nó chỉ bằng một khóa!

Xem Dòng

Seedance 2.0

Seedance 2.0 API cung cấp cho bạn quyền truy cập cấp sản xuất vào mô hình video đa phương thức của ByteDance — đầu vào bốn phương thức (văn bản, hình ảnh, video, âm thanh) và hệ thống "Universal Reference" hàng đầu trong ngành giúp khóa bố cục, chuyển động của camera và hành động của nhân vật trên các cảnh quay. Tích hợp quyền kiểm soát cấp độ đạo diễn bằng một lệnh gọi API, mức giá cố định $0,09/giây, cấp khóa tức thì và không có danh sách chờ — được hỗ trợ bởi thời gian hoạt động và sự tuân thủ cấp doanh nghiệp. Seedance 2.0 Native 4K hiện đã ra mắt!

Xem Dòng

GPT Image 2.5

Dòng GPT Image 2.5 từ OpenAI mang đến cho các nhà phát triển lựa chọn giữa Flare và Sunburst cho quy trình xử lý hình ảnh sản xuất. Kết xuất ở độ phân giải tùy ý lên đến 3840x2160 và chọn từ năm cấp độ chất lượng, bao gồm xhigh và max, để đáp ứng các yêu cầu đầu ra cụ thể. Atlas Cloud cung cấp dịch vụ suy luận REST sẵn sàng sử dụng, không có thời gian khởi động lạnh với mức giá tiêu chuẩn chỉ từ 0,004 USD cho mỗi lần tạo. Bắt đầu xây dựng ngay hôm nay.

Xem Dòng

GPT Image 2

GPT Image 2 API cung cấp cho các nhà phát triển quyền truy cập vào mô hình hình ảnh mới nhất của OpenAI, phiên bản kế nhiệm của GPT Image 1.5. Mô hình này tạo và chỉnh sửa hình ảnh với khả năng hiển thị văn bản chính xác trên các chữ viết Latinh và CJK, cùng với bố cục mạnh mẽ cho áp phích, mockup và đồ họa thông tin. Trên Atlas Cloud, bạn có thể truy cập nó thông qua một API thống nhất cùng với hơn 300 mô hình khác, với tín dụng miễn phí, 99,99% thời gian hoạt động và không yêu cầu xác minh tổ chức OpenAI.

Xem Dòng

Gemini Omni Flash

Gemini Omni API mang dòng Gemini Omni Flash đa phương thức nguyên bản của Google DeepMind, bao gồm Gemini Omni 1.1 Flash, đến với các nhà phát triển. Tạo video điện ảnh với âm thanh gốc được đồng bộ, tạo chuyển động cho ảnh tĩnh với khả năng kiểm soát chính xác khung hình bắt đầu và kết thúc, hoặc chỉnh sửa cảnh quay hiện có bằng các hướng dẫn văn bản mà vẫn bảo toàn nội dung không được thay đổi. Atlas Cloud cung cấp một khóa tương thích với OpenAI, quyền truy cập hợp nhất và mức giá trả theo mức sử dụng minh bạch. Bắt đầu xây dựng ngay hôm nay.

Xem Dòng

Grok Imagine

Grok Imagine API của xAI cung cấp các mô hình hình ảnh, video và lời nói, từ Image 2.0 đến Video 1.5 và xAI TTS v1. Render 1K hoặc 2K hình tĩnh trên 14 tỷ lệ khung hình, tạo cảnh 15 giây video 1080p, điều hướng các shot bằng tối đa 7 hình ảnh tham chiếu, hoặc cung cấp lời tường thuật bằng 20 ngôn ngữ. Atlas Cloud chạy mọi chế độ trên một endpoint, có giá theo mô hình trả tiền khi sử dụng từ $0.02 mỗi hình ảnh và $0.05 mỗi giây. Bắt đầu xây dựng hôm nay.

Xem Dòng

Google

Các mô hình sáng tạo mạnh mẽ nhất của Google hiện đều có sẵn trên Atlas Cloud. Veo 3.1 cung cấp khả năng tạo video đậm chất điện ảnh, Nano Banana 2 hỗ trợ tạo hình ảnh có độ chân thực cao, và Gemini mang trí tuệ đa phương thức vào mọi quy trình làm việc. Truy cập toàn bộ bộ mô hình Google thông qua một API key duy nhất với tính khả dụng Day-0 và mức giá dùng bao nhiêu trả bấy nhiêu (pay-as-you-go).

Xem Dòng

Seedance 2.0 Mini

Seedance 2.0 Mini mang khả năng tạo video đa phương thức của ByteDance vào các quy trình làm việc nơi tốc độ và chi phí là quan trọng nhất. Nó cung cấp các khả năng cốt lõi của Seedance 2.0 với mức tiêu thụ tài nguyên nhẹ hơn — tạo nhanh hơn, chi phí mỗi video thấp hơn và tích hợp API giống như bạn đã sử dụng. Đối với các nhóm chạy các quy trình (pipeline) khối lượng lớn hoặc tạo nguyên mẫu ở quy mô lớn, Mini là lựa chọn mặc định thiết thực.

Xem Dòng

ByteDance

Từ tạo video điện ảnh đến kiến tạo hình ảnh có độ trung thực cao, các mô hình mạnh mẽ nhất của ByteDance hiện đã có mặt trên Atlas Cloud. Chạy Seedance và Seedream ở quy mô lớn với mức giá suy luận thấp nhất và không có chi phí quản lý cơ sở hạ tầng.

Xem Dòng

Bài viết đề xuất

Hướng dẫn, bài hướng dẫn và cập nhật sản phẩm giúp bạn khai thác tối đa Atlas Cloud.