MiniMax H3 Developer hiện đã ra mắt — Giảm giá 60%, chỉ từ $0,02 mỗi giây
GPT Image API with 3 Model Tiers

GPT Image API with 3 Model Tiers

GPT Image API cung cấp cho các nhà phát triển nhóm sản phẩm tạo hình ảnh của OpenAI qua ba cấp độ, GPT Image 1, 1.5 và Mini, mỗi cấp độ đều có các biến thể chuyển văn bản thành hình ảnh và chỉnh sửa. Các mô hình này cung cấp văn bản trong hình ảnh chính xác, kết xuất chân thực như ảnh và tuân thủ lời nhắc chặt chẽ trên nhiều phong cách đa dạng. Trên Atlas Cloud, bạn có thể truy cập tất cả các cấp độ thông qua một API thống nhất cùng với hơn 300 mô hình, với giá từ 0,004 đô la cho mỗi hình ảnh và thời gian hoạt động 99,99%.

GPT Image do OpenAI phát triển. Atlas Cloud (vận hành bởi Atlas Cloud AI LLC) cung cấp quyền truy cập vào mô hình này và không sở hữu mô hình. Mọi thương hiệu đều thuộc về chủ sở hữu tương ứng.

Khám phá Mô hình Hàng đầu

Atlas Cloud cung cấp cho bạn các mô hình sáng tạo tiên tiến nhất trong ngành.

Tốc độ tối đa

Chi phí thấp nhất

Phương thứcMô tả
GPT Image-1 T2I API(Text to Image)API Text to Image của GPT Image-1 trao quyền cho các nhà phát triển chuyển đổi lời nhắc văn bản thành các hình ảnh quang học chân thực, tuyệt đẹp với độ chi tiết đặc biệt. Bằng cách kết hợp khả năng suy luận của GPT-4 Turbo với tổng hợp hình ảnh cấp độ DALL·E, nó mang lại khả năng bám sát lời nhắc hàng đầu trong ngành và khả năng bố cục phức tạp để sản xuất hình ảnh ở cấp độ chuyên nghiệp.
GPT Image-1 Edit API(Image to Image)GPT Image-1 Edit API trao quyền cho các nhà phát triển chuyển đổi các hình ảnh hiện có thành những kiệt tác được tinh chỉnh hoặc tái tạo với tính nhất quán liền mạch. Bằng cách sử dụng khả năng hiểu đa phương thức, nó tạo ra các chuyển đổi phong cách chính xác, bố cục theo ngữ cảnh và các sửa đổi có mục tiêu để lặp lại tài sản cấp độ chuyên nghiệp.
GPT Image-1.5 T2I API(Text to Image)GPT Image-1.5 Text to Image API trao quyền cho các nhà phát triển chuyển đổi các lời nhắc văn bản thành hình ảnh chất lượng cao với chi phí được tối ưu hóa. Bằng cách tận dụng kiến trúc do GPT hỗ trợ, nó mang lại khả năng hiểu lời nhắc mạnh mẽ và độ trung thực hình ảnh cho các luồng công việc sản xuất cân bằng.
GPT Image-1.5 Edit API(Image to Image)GPT Image-1.5 Edit API cho phép các nhà phát triển tinh chỉnh các tài sản hiện có bằng các sửa đổi chính xác. Bằng cách hỗ trợ kiểm soát input_fidelity, nó cho phép điều chỉnh tinh vi trong khi vẫn giữ nguyên các yếu tố cần thiết như khuôn mặt và logo.
GPT Image-1 Mini T2I API(Text to Image)GPT Image-1 Mini Text to Image API trang bị cho các nhà phát triển khả năng tạo hình ảnh tiết kiệm chi phí nhất trong dòng sản phẩm. Bằng cách tận dụng kiến trúc GPT-5, nó mang lại kết quả cấp độ chuyên nghiệp với chi phí trên mỗi hình ảnh thấp nhất để sản xuất nội dung với khối lượng lớn.
GPT Image-1 Mini Edit API(Image to Image)GPT Image-1 Mini Edit API trao quyền cho các nhà phát triển chuyển đổi các hình ảnh hiện có với khả năng chỉnh sửa được tinh giản. Bằng cách cung cấp các chức năng chỉnh sửa thiết yếu với chi phí tối thiểu, nó cho phép lặp lại nhanh chóng và các quy trình sản xuất nội dung.

Các tính năng chính của GPT Image API

Khám phá những gì GPT Image API mang lại, từ các phong cách linh hoạt, độ chân thực như ảnh chụp và văn bản trong hình ảnh chính xác cho đến chỉnh sửa dựa trên mặt nạ, kiểm soát nền và các cấp độ chất lượng.

Tạo phong cách linh hoạt bằng cách sử dụng GPT Image API

Tạo phong cách linh hoạt bằng cách sử dụng GPT Image API

Tạo ra các đầu ra hình ảnh đa dạng bao gồm nhiếp ảnh chân thực, tác phẩm nghệ thuật cách điệu, nghệ thuật ý tưởng, đồ họa thông tin, hình minh họa phong cách 3D, v.v. Từ cảnh quan điện ảnh đến các bản phác thảo UI, các mô hình thích ứng chính xác với định hướng sáng tạo của bạn.

Độ trung thực hình ảnh cao sử dụng GPT Image API

Độ trung thực hình ảnh cao sử dụng GPT Image API

Maintains object relationships, lighting consistency, and color balance with industry-leading prompt adherence. Generated images exhibit natural textures, accurate proportions, and physically plausible compositions.

Kết Xuất Văn Bản Chính Xác Bằng GPT Image API

Kết Xuất Văn Bản Chính Xác Bằng GPT Image API

Có khả năng tạo ra nghệ thuật chữ rõ ràng, dễ đọc ngay trong hình ảnh — lý tưởng cho áp phích, meme, truyện tranh, hình ảnh thương hiệu và bất kỳ dự án nào yêu cầu các yếu tố văn bản tích hợp.

Sáng tạo dựa trên nền tảng kiến thức sử dụng GPT Image API

Sáng tạo dựa trên nền tảng kiến thức sử dụng GPT Image API

Tận dụng kiến thức thế giới của GPT-4/GPT-5 để tạo ra các hình ảnh trực quan chính xác về mặt thực tế và phù hợp với ngữ cảnh. Mô hình hiểu được các tham chiếu văn hóa, bối cảnh lịch sử và các khái niệm chuyên ngành.

Chỉnh sửa dựa trên mặt nạ sử dụng GPT Image API

Chỉnh sửa dựa trên mặt nạ sử dụng GPT Image API

Chỉnh sửa các khu vực cụ thể với đầu vào mặt nạ tùy chọn, chỉ sửa đổi các khu vực được chọn trong khi phần còn lại của hình ảnh giữ nguyên. Điều này làm cho GPT Image API trở nên đáng tin cậy để chỉnh sửa ảnh, xóa đối tượng và thay đổi bố cục chính xác.

Điều khiển nền và độ trong suốt

Điều khiển nền và độ trong suốt

Tùy chỉnh nền và tạo đầu ra trong suốt trên các mô hình được hỗ trợ, lý tưởng cho logo, ảnh chụp sản phẩm và công việc thiết kế phân lớp. Bạn có thể đặt các chủ thể vào các cảnh mới hoặc xuất các bản cắt rõ nét mà không cần tạo mặt nạ thủ công.

Quality Tier Control

Quality Tier Control

Chọn chất lượng Thấp, Trung bình hoặc Cao cho mỗi yêu cầu để cân bằng giữa chi tiết và chi phí cho khối lượng công việc của bạn. Các cấp độ thấp hơn giúp tăng tốc độ tạo các bản nháp số lượng lớn, trong khi cấp độ Cao mang lại kết quả chân thực nhất cho các tài sản cuối cùng.

Comparisons with One Prompt

Prompt

Surrealist fashion campaign poster, quadrant layout (2x2 grid of 4 variations), extreme macro photography of a human eye filling the entire frame as background — iris colors vary across panels: blue-green teal, golden hazel, natural brown — hyperrealistic eye texture with visible pores on eyelid skin, dramatic long eyelashes in black with some purple/violet colored lash extensions spiking outward in an editorial exaggerated style, miniaturized female model composited realistically into the eye environment, appearing to sit casually on the lower eyelid or eyelash roots, model wearing streetwear/casual fashion outfits — variations include: oversized grey graphic sweatshirt + black plaid wide-leg pants + black chunky platform boots, grey long-sleeve polo shirt + sage green cargo pants + tan Timberland boots + camo backpack, bold typographic brand logo "LKNLN" stamped/tattooed directly onto the eyelid skin in dark gothic/industrial bold sans-serif font, appearing as if embossed or inked into skin, lighting: dramatic studio lighting on the eye, soft fill on model, depth of field contrast between hyper-sharp iris and soft skin surroundings, color palette: skin tones, teal/hazel iris, muted sage green, plaid grey-black, amber boots, purple accent lashes, photorealistic composite, editorial fashion photography style, small watermark "AI dsgn" in bottom left corner, ultra high resolution, cinematic color grading

GPT Image 1

GPT Image 1

GPT Image 1.5

GPT Image 1.5

GPT Image 2

GPT Image 2

GPT Image API Use Cases for Image Generation

Khám phá những gì bạn có thể xây dựng với GPT Image API, từ nhiếp ảnh chuyên nghiệp và bản mô phỏng giao diện người dùng (UI) đến các chiến dịch tiếp thị, nghệ thuật ý niệm, chuyển đổi phong cách và bản địa hóa nội dung.

Professional Photography & Visual Art

Generate photorealistic images with cinematic lighting, precise composition, and natural textures. From product photography to editorial visuals, GPT Image models produce outputs indistinguishable from professional camera work.

UI/UX Design & Mockups

Create clean, modern design concepts including app interfaces, dashboards, websites, and product layouts. The models excel at generating structured compositions with professional aesthetics.

Marketing & Advertising Campaigns

Rapidly produce campaign-ready visuals for social media, digital ads, and brand marketing. Support for multiple quality tiers enables both rapid A/B testing and high-end final deliverables.

Creative Concept Art & Illustration

Explore styles, moodboards, and concept art at speed. Generate illustrations in diverse artistic styles — from watercolor paintings to anime, comic books to oil paintings.

Style Transfer & Artistic Transformation

Transform existing images into different artistic styles while preserving core subject matter. Convert photos to cartoons, paintings, sketches, or any aesthetic direction with natural language instructions.

Content Localization & Adaptation

Quickly adapt visual content for different markets, audiences, or platforms. Modify backgrounds, adjust colors, update styling, or re-contextualize imagery through simple text descriptions.

So Sánh Mô Hình

Xem các mô hình từ các nhà cung cấp khác nhau so sánh như thế nào — so sánh hiệu suất, giá cả và điểm mạnh độc đáo để đưa ra quyết định sáng suốt.

ModelReference Image LimitOutput NumResolutionAspect Ratio
GPT Image-141~101024×1024, 1024×1536, 1536×1024 1:1, 3:2, 2:3
GPT Image-1.51011024×1024, 1024×1536, 1536×10241:1, 3:2, 2:3
GPT Image-1 Mini41~101024×1024, 1024×1536, 1536×10241:1, 3:2, 2:3
Nano Banana 21414K, 2K, 1K 1:1 3:2 2:3 3:4 4:3 4:5 5:4 9:16 16:9 21:9
Seedream 5.0141~152K~4K+1:1 3:2 2:3 3:4 4:3 4:5 5:4 9:16 16:9 21:9

Cách Sử Dụng GPT Image trên Atlas Cloud

Bắt đầu trong vài phút — làm theo các bước đơn giản sau để tích hợp và triển khai mô hình qua nền tảng Atlas Cloud.

Tạo Tài Khoản Atlas Cloud

Đăng ký tại atlascloud.ai và hoàn tất xác minh. Người dùng mới nhận được tín dụng miễn phí để khám phá nền tảng và thử nghiệm mô hình.

Tại sao Sử dụng GPT Image trên Atlas Cloud

Sự kết hợp của các mô hình tiên tiến của GPT Image với nền tảng được tăng tốc GPU của Atlas Cloud mang lại hiệu suất, khả năng mở rộng và trải nghiệm nhà phát triển độc đáo.

Hiệu suất và Tính linh hoạt

Độ Trễ Thấp:
Suy luận được tối ưu hóa GPU cho suy luận thời gian thực.

API Thống nhất:
Chạy GPT Image, GPT, Gemini và DeepSeek với một tích hợp duy nhất.

Giá cả Minh bạch:
Thanh toán dựa trên token có thể dự đoán với tùy chọn serverless.

Doanh nghiệp và Mở rộng

Trải nghiệm Nhà phát triển:
SDK, phân tích, công cụ tinh chỉnh và mẫu.

Độ tin cậy:
99,99% khả dụng, RBAC và ghi nhật ký sẵn sàng cho tuân thủ.

Bảo mật và Tuân thủ:
SOC 2 Type II, tuân thủ HIPAA, chủ quyền dữ liệu tại Hoa Kỳ.

GPT Image API FAQ

The GPT Image API offers three tiers. GPT Image-1 is the flagship for the highest quality, GPT Image-1.5 balances strong quality with lower cost, and GPT Image-1 Mini is the most cost-efficient for high-volume work. Each tier is available in both text to image and image to image variants.

Each model supports Low, Medium, and High quality settings. Higher quality produces more detailed and photorealistic results but at higher cost. For initial testing and previews, use Low quality for speed and savings. Switch to High quality for final deliverables requiring maximum fidelity.

Text-to-Image models support three output sizes: 1024×1024 (square), 1024×1536 (portrait), and 1536×1024 (landscape). Choose based on your use case — portrait for characters and vertical art, landscape for cinematic scenes and wide compositions, square for general purpose content.

Yes. The GPT Image API edit models accept an optional mask input, so you can control exactly which regions of an image are modified while the rest stays untouched. This supports precise inpainting for retouching, object removal, and localized changes.

The GPT Image API gives developers programmatic access to OpenAI's GPT Image family, a suite of multimodal image generation and editing models. It generates and edits images from text and image inputs, with accurate in-image text, photorealistic rendering, and strong prompt adherence. On Atlas Cloud you reach all three tiers through one unified API alongside 300+ models.

On Atlas Cloud the GPT Image API uses flat per-image pricing, starting at $0.004 per image on GPT Image-1 Mini, $0.008 on GPT Image-1.5, and $0.009 on GPT Image-1. Pricing is transparent with no token math, so you can predict the cost per generation before you run it.

No. OpenAI gates the GPT Image models behind organization verification in its own developer console, which can block individual developers. With the GPT Image API on Atlas Cloud you only need an Atlas Cloud account, so you can get a key and start generating without OpenAI verification.

Yes. Images you generate through the GPT Image API come with full commercial usage rights, and you retain ownership of the content you create. This makes it suitable for client work, marketing campaigns, and products you ship.

Yes. Atlas Cloud exposes an OpenAI-compatible API, so you can point the OpenAI SDK at the Atlas Cloud base URL, add your Atlas key, and call the GPT Image API with your existing code. You can make your first request in minutes without rebuilding your integration.

The GPT Image API gives you programmatic control that the chat experience does not, including quality settings, output size and format, mask-based editing, and batch generation. It is built for integrating image generation into your own apps and pipelines, rather than one-off creation in a chat window.

Khám phá Thêm Dòng

Seedance 2.5

Seedance 2.5 API hiện đã có mặt trên Atlas Cloud! Cung cấp cho các nhà phát triển mô hình video mới nhất của ByteDance. Nó tạo ra tối đa 30 giây video gốc chỉ trong một lần xử lý từ văn bản, một hình ảnh duy nhất hoặc tối đa 50 tài liệu tham khảo đa phương thức, với âm thanh được đồng bộ hóa và văn bản đa ngôn ngữ trong khung hình. Trên Atlas Cloud, bạn có thể truy cập thông qua một khóa duy nhất, với tính nhất quán của chủ thể và vật lý được cải thiện giúp giữ cho các cảnh quay dài luôn mạch lạc.

Xem Dòng

Wan 3.0

Wan 3.0 API là thế hệ tiếp theo trong hệ sinh thái video Wan của Alibaba, được xây dựng để đưa khả năng tạo video dài, kiểm soát đa tham chiếu và chất lượng nghe nhìn lên những tầm cao mới. Atlas Cloud đã lưu trữ Wan 2.7, 2.6 và 2.5, và Wan 3.0 hoạt động trên cùng một khóa hợp nhất mà không cần thiết lập riêng. Bắt đầu xây dựng ngay hôm nay. Cuộn xuống phần trưng bày để xem những gì Wan 3.0 có thể tạo ra.

Xem Dòng

MiniMax H3

API MiniMax H3 mở quyền truy cập vào mô hình video đa phương thức đa dụng của MiniMax, có thể đọc văn bản, hình ảnh, video và âm thanh như một ngữ cảnh duy nhất thay vì xử lý từng tác vụ riêng lẻ. Các clip có thời lượng từ 5 đến 15 giây ở 24 FPS, hỗ trợ nhiều tỷ lệ khung hình từ 21:9 đến 9:16; chỉ với một prompt, bạn có thể hoán đổi nhân vật, thay nền, viết lại hội thoại hoặc sao chép giọng nói từ một clip tham chiếu. Atlas Cloud cung cấp toàn bộ khả năng này thông qua một endpoint tương thích OpenAI. Hãy bắt đầu xây dựng ngay hôm nay.

Xem Dòng

Seedream 5.0 Pro

Seedream 5.0 Pro API cung cấp cho các nhà phát triển mô hình chỉnh sửa hình ảnh có thể kiểm soát của ByteDance trên Atlas Cloud. Nó đặt các chỉnh sửa một cách chính xác bằng các điểm neo và tọa độ, tách hình ảnh thành các lớp có thể chỉnh sửa, kết hợp nhiều tham chiếu và khớp màu sắc cũng như vật liệu chính xác, với văn bản đa ngôn ngữ ở độ phân giải 2K và 3K. Trên Atlas Cloud, bạn có thể truy cập nó chỉ bằng một khóa!

Xem Dòng

Seedance 2.0

Seedance 2.0 API cung cấp cho bạn quyền truy cập cấp sản xuất vào mô hình video đa phương thức của ByteDance — đầu vào bốn phương thức (văn bản, hình ảnh, video, âm thanh) và hệ thống "Universal Reference" hàng đầu trong ngành giúp khóa bố cục, chuyển động của camera và hành động của nhân vật trên các cảnh quay. Tích hợp quyền kiểm soát cấp độ đạo diễn bằng một lệnh gọi API, mức giá cố định $0,09/giây, cấp khóa tức thì và không có danh sách chờ — được hỗ trợ bởi thời gian hoạt động và sự tuân thủ cấp doanh nghiệp. Seedance 2.0 Native 4K hiện đã ra mắt!

Xem Dòng

GPT Image 2

GPT Image 2 API cung cấp cho các nhà phát triển quyền truy cập vào mô hình hình ảnh mới nhất của OpenAI, phiên bản kế nhiệm của GPT Image 1.5. Mô hình này tạo và chỉnh sửa hình ảnh với khả năng hiển thị văn bản chính xác trên các chữ viết Latinh và CJK, cùng với bố cục mạnh mẽ cho áp phích, mockup và đồ họa thông tin. Trên Atlas Cloud, bạn có thể truy cập nó thông qua một API thống nhất cùng với hơn 300 mô hình khác, với tín dụng miễn phí, 99,99% thời gian hoạt động và không yêu cầu xác minh tổ chức OpenAI.

Xem Dòng

Gemini Omni Flash

Gemini Omni API đưa mô hình tạo và chỉnh sửa video đa phương thức của Google DeepMind, được giới thiệu tại Google I/O 2026, vào stack của bạn. Gemini Omni kết hợp công cụ suy luận của Gemini với media tạo sinh, chấp nhận mọi tổ hợp văn bản, hình ảnh, video và âm thanh để tạo ra kết quả nhất quán, dựa trên nền tảng tri thức. Tinh chỉnh kết quả qua hội thoại tự nhiên — hoán đổi vật thể, viết lại cảnh quay và thay đổi phong cách, trong khi vật lý, nhân vật và tính liên tục vẫn được giữ nguyên. Atlas Cloud cung cấp trọn bộ dòng Gemini Omni Flash — chuyển văn bản thành video, chuyển hình ảnh thành video với tối đa 7 hình ảnh tham chiếu, và chuyển tham chiếu thành video — thông qua một API hợp nhất với mức giá minh bạch tính theo giây từ $0.112 và không cần đăng ký thuê bao. Bắt đầu xây dựng ngay hôm nay.

Xem Dòng

Grok Imagine

Grok Imagine API của xAI cung cấp các mô hình hình ảnh, video và lời nói, từ Image 2.0 đến Video 1.5 và xAI TTS v1. Render 1K hoặc 2K hình tĩnh trên 14 tỷ lệ khung hình, tạo cảnh 15 giây video 1080p, điều hướng các shot bằng tối đa 7 hình ảnh tham chiếu, hoặc cung cấp lời tường thuật bằng 20 ngôn ngữ. Atlas Cloud chạy mọi chế độ trên một endpoint, có giá theo mô hình trả tiền khi sử dụng từ $0.02 mỗi hình ảnh và $0.05 mỗi giây. Bắt đầu xây dựng hôm nay.

Xem Dòng

Google

Các mô hình sáng tạo mạnh mẽ nhất của Google hiện đều có sẵn trên Atlas Cloud. Veo 3.1 cung cấp khả năng tạo video đậm chất điện ảnh, Nano Banana 2 hỗ trợ tạo hình ảnh có độ chân thực cao, và Gemini mang trí tuệ đa phương thức vào mọi quy trình làm việc. Truy cập toàn bộ bộ mô hình Google thông qua một API key duy nhất với tính khả dụng Day-0 và mức giá dùng bao nhiêu trả bấy nhiêu (pay-as-you-go).

Xem Dòng

Seedance 2.0 Mini

Seedance 2.0 Mini mang khả năng tạo video đa phương thức của ByteDance vào các quy trình làm việc nơi tốc độ và chi phí là quan trọng nhất. Nó cung cấp các khả năng cốt lõi của Seedance 2.0 với mức tiêu thụ tài nguyên nhẹ hơn — tạo nhanh hơn, chi phí mỗi video thấp hơn và tích hợp API giống như bạn đã sử dụng. Đối với các nhóm chạy các quy trình (pipeline) khối lượng lớn hoặc tạo nguyên mẫu ở quy mô lớn, Mini là lựa chọn mặc định thiết thực.

Xem Dòng

ByteDance

Từ tạo video điện ảnh đến kiến tạo hình ảnh có độ trung thực cao, các mô hình mạnh mẽ nhất của ByteDance hiện đã có mặt trên Atlas Cloud. Chạy Seedance và Seedream ở quy mô lớn với mức giá suy luận thấp nhất và không có chi phí quản lý cơ sở hạ tầng.

Xem Dòng

Alibaba

Atlas Cloud tập hợp toàn bộ dòng mô hình của Alibaba dưới một API duy nhất: Qwen cho các tác vụ ngôn ngữ và hình ảnh, Wan để tạo video với độ phân giải lên đến 1080p. Truy cập mọi mô hình theo hình thức dùng đến đâu trả tiền đến đó (pay-as-you-go) mà không cần đăng ký gói. Alibaba API có sẵn thông qua một URL cơ sở (base URL) duy nhất bằng cách sử dụng ứng dụng khách tương thích với OpenAI hiện có của bạn.

Xem Dòng

Một API cho mọi AI đa phương tiện.

Khám phá tất cả mô hình