Seedance 2.0 Mini & Fast API với mức giá thấp nhất toàn cầu — giảm đến 68% so với giá chính thức

Moonshot AI Models on AtlasCloud | Kimi

Atlas Cloud lưu trữ toàn bộ dòng sản phẩm Kimi thông qua MoonshotAI API, từ K2-Thinking cho suy luận sâu đến K2.6 cho lập trình tác tử. Tất cả đều trả tiền theo mức sử dụng, với ngữ cảnh 262K.

Moonshot AI do Moonshot AI phát triển. Atlas Cloud (vận hành bởi Atlas Cloud AI LLC) cung cấp quyền truy cập vào mô hình này và không sở hữu mô hình. Mọi thương hiệu đều thuộc về chủ sở hữu tương ứng.

Large Language Models by Moonshot AI

Thúc đẩy trò chuyện, suy luận và tác tử ở quy mô lớn với các mô hình ngôn ngữ lớn hàng đầu, được cung cấp nhanh chóng và tiết kiệm trên Atlas Cloud.

Xem tất cả mô hình

Moonshot AI Models API Pricing Details

Compare standard vs. our pricing across every Moonshot AI model.

ModelStandard Price (USD)Our Price (USD)Discount
Kimi K3
$3/$15per 1M tokens1048.6K context
$3/$15M in/outper 1M tokens1048.6K context
View
Kimi K2.7 Code
$0.95/$4per 1M tokens262.1K context
$0.95/$4M in/outper 1M tokens262.1K context
View
Kimi K2.6
$0.95/$4per 1M tokens262.1K context
$0.95/$4M in/outper 1M tokens262.1K context
View
Kimi K2.5
$0.6/$3per 1M tokens262.1K context
$0.49/$2.5M in/outper 1M tokens262.1K context
View

Explore models from other providers

Instantly explore and experiment with 400+ production-ready models in the Atlas Playground. Start customizing with one click.

Các trường hợp sử dụng Moonshot AI API mà bạn có thể xây dựng trên Atlas Cloud

Đám mây tác tử (agent swarm) và khả năng thực thi dài hạn của Kimi cho phép các nhóm chạy các tác vụ có thể mất nhiều ngày công sức của con người chỉ trong một phiên tự động duy nhất. Các nhóm sử dụng M-series cùng với K2-Thinking để xử lý mọi thứ, từ thay đổi mã tự trị đến nghiên cứu đa tài liệu ở quy mô lớn.

Hiện đại hóa Cơ sở Mã Nguồn Cũ

Các nhóm kỹ thuật sử dụng Kimi K2.6 để chạy các tác nhân lập trình dài hạn giúp tự chủ đại tu các cơ sở mã sản xuất qua những phiên kéo dài nhiều giờ. Trong một ví dụ đã được ghi nhận, K2.6 đã viết lại một công cụ khớp lệnh tài chính 8 năm tuổi trong 13 giờ và mang lại hiệu suất tăng 185% mà không cần sự can thiệp của con người giữa các lần commit. Mức giá thanh toán theo mức sử dụng (pay-as-you-go) của Atlas Cloud giúp việc chạy các phiên tác nhân mở rộng này trở nên thiết thực mà không cần cam kết dung lượng.

Xử lý hàng loạt tài liệu song song

Các nhóm vận hành sử dụng bầy đàn 300 tác nhân của Kimi K2.6 để xử lý song song các lô tài liệu lớn. Một lần chạy điều phối duy nhất đã khớp một bản CV với 100 vai trò công việc và tạo ra 100 bản sơ yếu lý lịch được tùy chỉnh hoàn toàn làm đầu ra. Mô hình tương tự cũng áp dụng cho việc đánh giá hợp đồng, kiểm tra tuân thủ và bất kỳ quy trình làm việc nào mà một đầu vào cố định cần được đánh giá dựa trên một tập hợp các mục tiêu lớn và có thể thay đổi.

Suy luận Sâu cho Phân tích Phức tạp

Các nhóm nghiên cứu và pháp lý sử dụng Kimi K2-Thinking cho các vấn đề phân tích nhiều bước yêu cầu suy luận nội bộ mở rộng. Mô hình hỗ trợ tối đa 200 đến 300 lệnh gọi công cụ (tool calls) tuần tự mỗi phiên, lặp qua các chu kỳ suy luận-gọi-suy luận mà không cần con người nhắc nhở (prompting) giữa các bước. Trên Atlas Cloud, mô hình này có giá 0,6 USD cho mỗi triệu token đầu vào và chia sẻ cửa sổ ngữ cảnh 262K với phần còn lại của dòng sản phẩm Kimi.

Sản xuất tự động bài báo nghiên cứu

Các nhóm học thuật và nội dung sử dụng Kimi K2.6 để biến các tài liệu nguồn thành các kết quả nghiên cứu hoàn chỉnh. Trong một lần chạy thử nghiệm, K2.6 đã chuyển đổi một bài báo vật lý thiên văn thành một bài nghiên cứu dài 40 trang, một tập dữ liệu có cấu trúc với hơn 20.000 mục và 14 biểu đồ cấp độ thiên văn chỉ trong một phiên duy nhất. Điều này giúp giảm thời gian quay vòng đối với quy trình làm việc từ tài liệu đến kết quả từ vài tuần xuống còn vài giờ.

Tìm kiếm Khách hàng Tiềm năng Quy mô lớn

Các nhóm phát triển và bán hàng sử dụng các nhóm (swarms) Kimi K2.6 để xác định khách hàng tiềm năng và đồng thời tạo ra các tài liệu tiếp cận. Một lần chạy thử nghiệm đã xác định được 30 cửa hàng bán lẻ ở một thành phố mục tiêu không có trang web và tạo một trang đích cho mỗi cửa hàng. Mô hình tương tự cũng hoạt động hiệu quả cho việc làm phong phú dữ liệu khách hàng tiềm năng, lập bản đồ bối cảnh cạnh tranh và bất kỳ nhiệm vụ nào kết hợp giữa khám phá và tạo nội dung ở quy mô danh sách.

Phân tích Tài liệu Trực quan và Mã

Các nhóm sản phẩm và dữ liệu sử dụng khả năng thị giác tự nhiên của Kimi K2.5 và K2.6 để xử lý đầu vào hình ảnh và video cùng với văn bản trong cùng một lệnh gọi API. Bộ mã hóa MoonViT xử lý các sơ đồ, ảnh chụp màn hình, mô hình UI và bản quét tài liệu mà không cần tiền xử lý bên ngoài. Điều này hữu ích cho các đường ống (pipelines) chuyển đổi trực tiếp thông số kỹ thuật trực quan thành mã hoặc trích xuất dữ liệu có cấu trúc từ các tài liệu chứa nhiều hình ảnh.

Biến tm nhìn doanh nghip ca bn thành hin thc vi Atlas Cloud AI.

Liên hệ kinh doanh

Các câu hỏi thường gặp về mô hình Moonshot AI

Kimi K2.6 is MoonshotAI's latest open-source multimodal LLM, released in April 2026 under a Modified MIT license. It runs a Mixture-of-Experts architecture with 1 trillion total parameters and 32 billion active during inference. It is designed for agentic coding, long-horizon task execution, and multi-agent swarm orchestration.

Kimi K2.6 mở rộng quy mô lên 300 sub-agent thực hiện tới 4.000 bước phối hợp trong một lần chạy duy nhất. Kimi K2.5 trên Atlas Cloud hỗ trợ thực thi theo bầy đàn với tối đa 100 sub-agent. Các nhiệm vụ được phân rã động thành các nhiệm vụ phụ song song, chuyên biệt theo lĩnh vực để mang lại kết quả hoàn toàn tự chủ.

Kimi K2-Thinking sử dụng suy luận chuỗi suy nghĩ (chain-of-thought) sâu với tối đa 200 đến 300 lần gọi công cụ tuần tự trong mỗi phiên. Mô hình này suy luận, gọi một công cụ, diễn giải kết quả, gọi một công cụ khác và tiếp tục vòng lặp này mà không cần sự can thiệp của con người. Nó phù hợp với suy luận logic nhiều bước, toán học phức tạp và các vấn đề mà suy luận nội bộ mở rộng giúp cải thiện độ chính xác.

Có. Kimi K2.5 và K2.6 bao gồm MoonViT, một bộ mã hóa tầm nhìn 400 triệu tham số có khả năng xử lý hình ảnh và video nguyên bản. Bạn có thể truyền trực tiếp đầu vào hình ảnh hoặc video trong lệnh gọi API cùng với văn bản mà không cần tiền xử lý bên ngoài. Điều này hỗ trợ các quy trình phân tích trực quan, hiểu tài liệu và tạo mã từ hình ảnh.

Có. Kimi K2.6 được phát hành theo giấy phép MIT sửa đổi, cho phép sử dụng cho mục đích thương mại. Trọng số mở có sẵn trên HuggingFace cho các đợt triển khai tự lưu trữ. Atlas Cloud cũng cung cấp K2.6 qua API cho các nhóm thích truy cập được quản lý mà không phải chịu chi phí cơ sở hạ tầng.

Kimi K2.6 đạt điểm số 80,2% trên SWE-Bench Verified và 54,0% trên Humanity's Last Exam với các công cụ, vượt qua GPT-5.5 trên cả hai benchmarks. Nó cũng dẫn đầu trên BrowseComp với 83,2%, cao hơn GPT-5.4. Những kết quả này đạt được với chi phí cho mỗi triệu token thấp hơn khoảng 80% so với GPT-5.5.

Kimi K2.5 có giá 0,49 USD cho mỗi triệu token đầu vào và 2,5 USD cho mỗi triệu token đầu ra trên Atlas Cloud. Kimi K2-Thinking và K2-Instruct-0905 hoạt động ở mức 0,6 USD cho mỗi triệu token đầu vào với cùng tỷ lệ đầu ra. Hãy kiểm tra trang mô hình Kimi K2.6 trên Atlas Cloud để biết giá cụ thể hiện tại.

Khám phá Thêm Dòng

Seedance 2.5

Seedance 2.5 API hiện đã có mặt trên Atlas Cloud! Cung cấp cho các nhà phát triển mô hình video mới nhất của ByteDance. Nó tạo ra tối đa 30 giây video gốc chỉ trong một lần xử lý từ văn bản, một hình ảnh duy nhất hoặc tối đa 50 tài liệu tham khảo đa phương thức, với âm thanh được đồng bộ hóa và văn bản đa ngôn ngữ trong khung hình. Trên Atlas Cloud, bạn có thể truy cập thông qua một khóa duy nhất, với tính nhất quán của chủ thể và vật lý được cải thiện giúp giữ cho các cảnh quay dài luôn mạch lạc.

Xem Dòng

Wan 3.0

Wan 3.0 API là thế hệ tiếp theo trong hệ sinh thái video Wan của Alibaba, được xây dựng để đưa khả năng tạo video dài, kiểm soát đa tham chiếu và chất lượng nghe nhìn lên những tầm cao mới. Atlas Cloud đã lưu trữ Wan 2.7, 2.6 và 2.5, và Wan 3.0 hoạt động trên cùng một khóa hợp nhất mà không cần thiết lập riêng. Bắt đầu xây dựng ngay hôm nay. Cuộn xuống phần trưng bày để xem những gì Wan 3.0 có thể tạo ra.

Xem Dòng

MiniMax H3

MiniMax H3 là dòng mô hình video của MiniMax dành cho việc tạo video từ văn bản, hình ảnh và ảnh tham chiếu. Tạo các đoạn clip dài 5 đến 15 giây, định hướng chuyển động bằng khung hình cuối tùy chọn, giữ lại chủ thể từ ảnh tham chiếu hoặc chọn H3 Developer khi âm thanh được tạo phù hợp với quy trình làm việc. Atlas Cloud tích hợp H3, H3 Fast, H3 Max và H3 Developer vào một quy trình API duy nhất, với mức giá tiêu chuẩn từ $0.038 mỗi giây. Bắt đầu xây dựng ngay hôm nay.

Xem Dòng

Seedream 5.0 Pro

Seedream 5.0 Pro API cung cấp cho các nhà phát triển mô hình chỉnh sửa hình ảnh có thể kiểm soát của ByteDance trên Atlas Cloud. Nó đặt các chỉnh sửa một cách chính xác bằng các điểm neo và tọa độ, tách hình ảnh thành các lớp có thể chỉnh sửa, kết hợp nhiều tham chiếu và khớp màu sắc cũng như vật liệu chính xác, với văn bản đa ngôn ngữ ở độ phân giải 2K và 3K. Trên Atlas Cloud, bạn có thể truy cập nó chỉ bằng một khóa!

Xem Dòng

Seedance 2.0

Seedance 2.0 API cung cấp cho bạn quyền truy cập cấp sản xuất vào mô hình video đa phương thức của ByteDance — đầu vào bốn phương thức (văn bản, hình ảnh, video, âm thanh) và hệ thống "Universal Reference" hàng đầu trong ngành giúp khóa bố cục, chuyển động của camera và hành động của nhân vật trên các cảnh quay. Tích hợp quyền kiểm soát cấp độ đạo diễn bằng một lệnh gọi API, mức giá cố định $0,09/giây, cấp khóa tức thì và không có danh sách chờ — được hỗ trợ bởi thời gian hoạt động và sự tuân thủ cấp doanh nghiệp. Seedance 2.0 Native 4K hiện đã ra mắt!

Xem Dòng

GPT Image 2.5

Dòng GPT Image 2.5 từ OpenAI mang đến cho các nhà phát triển lựa chọn giữa Flare và Sunburst cho quy trình xử lý hình ảnh sản xuất. Kết xuất ở độ phân giải tùy ý lên đến 3840x2160 và chọn từ năm cấp độ chất lượng, bao gồm xhigh và max, để đáp ứng các yêu cầu đầu ra cụ thể. Atlas Cloud cung cấp dịch vụ suy luận REST sẵn sàng sử dụng, không có thời gian khởi động lạnh với mức giá tiêu chuẩn chỉ từ 0,004 USD cho mỗi lần tạo. Bắt đầu xây dựng ngay hôm nay.

Xem Dòng

GPT Image 2

GPT Image 2 API cung cấp cho các nhà phát triển quyền truy cập vào mô hình hình ảnh mới nhất của OpenAI, phiên bản kế nhiệm của GPT Image 1.5. Mô hình này tạo và chỉnh sửa hình ảnh với khả năng hiển thị văn bản chính xác trên các chữ viết Latinh và CJK, cùng với bố cục mạnh mẽ cho áp phích, mockup và đồ họa thông tin. Trên Atlas Cloud, bạn có thể truy cập nó thông qua một API thống nhất cùng với hơn 300 mô hình khác, với tín dụng miễn phí, 99,99% thời gian hoạt động và không yêu cầu xác minh tổ chức OpenAI.

Xem Dòng

Gemini Omni Flash

Gemini Omni API mang dòng Gemini Omni Flash đa phương thức nguyên bản của Google DeepMind, bao gồm Gemini Omni 1.1 Flash, đến với các nhà phát triển. Tạo video điện ảnh với âm thanh gốc được đồng bộ, tạo chuyển động cho ảnh tĩnh với khả năng kiểm soát chính xác khung hình bắt đầu và kết thúc, hoặc chỉnh sửa cảnh quay hiện có bằng các hướng dẫn văn bản mà vẫn bảo toàn nội dung không được thay đổi. Atlas Cloud cung cấp một khóa tương thích với OpenAI, quyền truy cập hợp nhất và mức giá trả theo mức sử dụng minh bạch. Bắt đầu xây dựng ngay hôm nay.

Xem Dòng

Grok Imagine

Grok Imagine API của xAI cung cấp các mô hình hình ảnh, video và lời nói, từ Image 2.0 đến Video 1.5 và xAI TTS v1. Render 1K hoặc 2K hình tĩnh trên 14 tỷ lệ khung hình, tạo cảnh 15 giây video 1080p, điều hướng các shot bằng tối đa 7 hình ảnh tham chiếu, hoặc cung cấp lời tường thuật bằng 20 ngôn ngữ. Atlas Cloud chạy mọi chế độ trên một endpoint, có giá theo mô hình trả tiền khi sử dụng từ $0.02 mỗi hình ảnh và $0.05 mỗi giây. Bắt đầu xây dựng hôm nay.

Xem Dòng

Google

Các mô hình sáng tạo mạnh mẽ nhất của Google hiện đều có sẵn trên Atlas Cloud. Veo 3.1 cung cấp khả năng tạo video đậm chất điện ảnh, Nano Banana 2 hỗ trợ tạo hình ảnh có độ chân thực cao, và Gemini mang trí tuệ đa phương thức vào mọi quy trình làm việc. Truy cập toàn bộ bộ mô hình Google thông qua một API key duy nhất với tính khả dụng Day-0 và mức giá dùng bao nhiêu trả bấy nhiêu (pay-as-you-go).

Xem Dòng

Seedance 2.0 Mini

Seedance 2.0 Mini mang khả năng tạo video đa phương thức của ByteDance vào các quy trình làm việc nơi tốc độ và chi phí là quan trọng nhất. Nó cung cấp các khả năng cốt lõi của Seedance 2.0 với mức tiêu thụ tài nguyên nhẹ hơn — tạo nhanh hơn, chi phí mỗi video thấp hơn và tích hợp API giống như bạn đã sử dụng. Đối với các nhóm chạy các quy trình (pipeline) khối lượng lớn hoặc tạo nguyên mẫu ở quy mô lớn, Mini là lựa chọn mặc định thiết thực.

Xem Dòng

ByteDance

Từ tạo video điện ảnh đến kiến tạo hình ảnh có độ trung thực cao, các mô hình mạnh mẽ nhất của ByteDance hiện đã có mặt trên Atlas Cloud. Chạy Seedance và Seedream ở quy mô lớn với mức giá suy luận thấp nhất và không có chi phí quản lý cơ sở hạ tầng.

Xem Dòng

Bài viết đề xuất

Hướng dẫn, bài hướng dẫn và cập nhật sản phẩm giúp bạn khai thác tối đa Atlas Cloud.