Qwen Image 3.0 Pro API – Edycja obrazu: 3 błędy kolejności referencji, które psują końcowy efekt

Edycja obrazów w API Qwen Image 3.0 Pro staje się przydatna, gdy prompt wygląda jak brief produkcyjny: podaj źródło, podaj zmianę i podaj każdy element, który ma pozostać na swoim miejscu.

Qwen Image 3.0 Pro API – Edycja obrazu: 3 błędy kolejności referencji, które psują końcowy efekt

Zespół ds. wzrostu rzadko potrzebuje ładniejszego obrazu. Potrzebuje tej samej osoby w nowym ubraniu, tej samej butelki w nowej scenie kampanii lub tego samego plakatu na nowym rynku. Edytowanie obrazów przez API Qwen Image 3.0 Pro staje się przydatne, gdy prompt przypomina brief produkcyjny: podaj źródło, podaj zmianę i podaj każdy element, który musi pozostać na miejscu.

Ten przewodnik testuje ten brief na 3 zadaniach, które ludzie faktycznie przekazują zespołowi kreatywnemu: przymiarka wirtualna na podstawie 3 odnośników, sezonowa zmiana sceny produktowej oraz lokalizacja hiszpańskiego plakatu. Najważniejsza odpowiedź jest prosta: oznacz obrazki w kolejności, wpisz ograniczenia dotyczące zachowania elementów przed ozdobnikami i sprawdź wynik w rozdzielczości 2K na podstawie krótkiej listy elementów do zachowania.

Atlas Cloud to praktyczne miejsce do przetestowania tej sekwencji w przeglądarce, zanim przeniesiesz ten sam model i kształt zapytania do aplikacji. Pozwala trzymać kolejność obrazów, prompt i wynik w jednym miejscu, zamiast rozpraszać proces walidacji na kilka kart. Zacznij na Atlas Cloud, jeśli chcesz przeprowadzić widoczny test przed wdrożeniem API.

Najważniejsze wnioski

  • Używaj od 1 do 3 ponumerowanych obrazów referencyjnych na jedną edycję.
  • Określ cel edycji i każdy zablokowany element.
  • Zweryfikuj jeden wynik w Playground przed podłączeniem przepływu API.
  • Sprawdź etykiety, dłonie, krawędzie i cienie kontaktowe przed zatwierdzeniem.

Dlaczego edytowanie obrazów przez API Qwen Image 3.0 Pro jest popularne i dlaczego edycje wciąż zawodzą

Oficjalny przykład edycji obrazów Qwen używa tego samego podstawowego kontraktu co przymiarka poniżej: Obraz 1 dostarcza osobę, Obraz 2 dostarcza czarną sukienkę, a Obraz 3 dostarcza pozę. Model przyjmuje od 1 do 3 obrazów, więc kolejność odnośników ma znaczenie, a nie jest tylko kolejnością przesyłania (Przewodnik po edycji obrazów Qwen, wrzesień 2026).

Ta elastyczność tworzy znany wzorzec awarii. Niejasna instrukcja daje modelowi przestrzeń do przerysowania dokładnie tego szczegółu, który Twój zespół próbował chronić. Naprawą jest prosty język z nazwanym źródłem, nazwaną edycją i nazwaną listą elementów do zachowania.

  
Słaba instrukcjaBrief produkcyjny, który można sprawdzić
„Spraw, żeby nosiła tę sukienkę.”„Ubierz Obraz 1 w Obraz 2. Zachowaj twarz, włosy, oświetlenie, kąt kamery, dłonie i kompozycję 2:3 z Obrazu 1.”
„Zrób hiszpański plakat.”„Zastąp tylko te dokładne ciągi znaków. Zablokuj typografię, hierarchię, marginesy, paletę, rysunki i każdy element nietekstowy.”
„Umieść tę butelkę w lecie.”„Zachowaj kształt, nakrętkę, pozycję etykiety, dokładne słowa na etykiecie i wyśrodkowany widok z przodu. Zastąp tylko otoczenie.”

Oficjalna dokumentacja API opisuje model 3.0 Pro jako obsługujący generowanie tekstu na obraz i edycję obrazów, z łączną liczbą pikseli wyjściowych do 2048 × 2048. Dokumentuje również przepisywanie promptu dla tej serii (Dokumentacja API Alibaba Cloud, wrzesień 2026).

Traktuj pierwszy wynik jako kandydata do przeglądu, a nie gwarantowany finalny efekt. Twarze, drobna typografia, kolor źródłowy i proporcje mogą się przesuwać. Jeśli blokada nie zadziała, zmniejsz zakres żądanej zmiany, powtórz dokładną listę blokad i spraw, aby rola obrazu źródłowego była mniej niejednoznaczna.

Edytowanie obrazów przez API Qwen Image 3.0 Pro: wybór modelu i cena

Przepływ pracy jest celowo prosty: przetestuj kolejność źródeł i prompt w Playground, a następnie zachowaj te same uporządkowane odnośniki i instrukcję podczas wdrażania zapytania API przez zespół. Własny przewodnik Qwen po wyborze modeli wymienia wsparcie Pro dla promptów negatywnych, do 6 wyników i pracy nad złożonymi układami (Przewodnik po modelach obrazowych Qwen, wrzesień 2026).

   
Model i zadanieKiedy go użyćWymieniona cena początkowa Atlas Cloud, sprawdzona 3 września 2026
Qwen Image 3.0 Pro Text-to-ImageUtwórz oryginalny, sterowalny obraz bazowy0,04 USD/PIC
Qwen Image 3.0 Pro EditEdycje wrażliwe na tożsamość, opakowania lub gęste teksty na plakatach0,04 USD/PIC
Qwen Image 3.0 EditTańsze koncepcje zbiorcze i wczesne przesiewanie0,03 USD/PIC

Aktualny katalog modeli Atlas Cloud podaje te ceny początkowe. Dokładny rachunek może się zmienić w zależności od liczby wyników, wybranych wymiarów i promocji, dlatego przed uruchomieniem sprawdź aktualną stronę i ustawienia.

  
Wybierz ProWybierz standard
Twarz, materiał butelki, etykieta lub układ tekstu musi przetrwać edycję.Przesiewasz wiele koncepcji wariantów niskiego ryzyka.
Potrzebujesz jednego przewodnika obejmującego od 1 do 3 odnośników i przegląd 2K.Później wypromujesz tylko wybrane zadania do Pro.

Przy wymienionych cenach początkowych jeden oryginalny obraz bazowy plus jedna edycja zaczyna się od około 0,08 USD. Trzy edycje produkcyjne z tego przewodnika zaczynają się od około 0,16 USD, gdy przymiarka obejmuje wygenerowany obraz bazowy. To liczby planistyczne, a nie obietnica ceny.

Krok 1: Wygeneruj sterowalny obraz bazowy

Zacznij od oryginalnego obiektu, aby zespół miał jasne prawa i stabilny punkt odniesienia tożsamości. Przygotuj równocześnie odnośnik ubrania: czarna satynowa sukienka poniżej będzie Obrazem 2 w kroku 2, więc upewnij się, że jej kwadratowy dekolt, długie rękawy, satynowy połysk i naturalne fałdy są wyraźnie widoczne. W Playground Qwen Image 3.0 Pro Text-to-Image wklej dokładnie ten prompt.

07-black-satin-dress-reference.png

Niebrandowana czarna satynowa sukienka midi ułożona płasko w ciepłym studio

Odnośnik ubrania dla Obrazu 2: zachowaj kwadratowy dekolt, długie rękawy, satynowy połysk i kierunek fałd w końcowej edycji.

plaintext
1Create a full-body editorial fashion photograph of an original fictional woman in her late twenties, seated naturally on a simple wooden stool, looking at the camera. She has straight shoulder-length black hair, a neutral expression, and wears a plain cream knit top with dark tailored trousers. Clean studio, warm off-white seamless background, soft window light from camera left, realistic skin texture, visible fabric weave, full hands and shoes, no logos, no text. Leave enough negative space around the body for a clothing replacement test.

Wybierz pionowy format 2:3, 1365 × 2048, 1 wynik, Prompt Rewrite włączone i najwyższą dostępną jakość. Nie dodawaj presetu stylu. Użyj wygenerowanego obrazu bazowego jako Obrazu 1 w kroku 2.

Krok 2: Edytowanie obrazów przez API Qwen Image 3.0 Pro z 3 odnośnikami

Prześlij obrazy w dokładnie tej kolejności: Obraz 1 to obiekt z kroku 1, Obraz 2 to niebrandowana czarna satynowa sukienka ułożona płasko, a Obraz 3 to odnośnik pozy siedzącej. Numeracja jest częścią instrukcji, więc nie pozwól, aby zbiorcza przesyłka zmieniła kolejność plików.

08-seated-pose-reference.png

Odnośnik pozy siedzącej w ujęciu trzy czwarte na drewnianym stołku

Obraz referencyjny 3: źródło pozy ustala pozycję ciała w trzech czwartych, ułożenie dłoni, stołek i ogólne kadrowanie.

plaintext
1Use Image 1 as the identity and facial-reference image. Dress the woman in Image 1 in the exact black satin midi dress from Image 2, preserving the dress silhouette, square neckline, long sleeves, subtle fabric sheen, and natural folds. Match the seated body pose from Image 3. Preserve Image 1's face, straight shoulder-length black hair, skin tone, camera angle, warm off-white studio background, soft window lighting, full hands, and 2:3 portrait composition. Do not add logos, jewelry, extra people, text, or a different background.

Wybierz pionowy format 2:3, 1365 × 2048, 1 wynik, Prompt Rewrite włączone i najwyższą jakość. W implementacji API zachowaj tę samą kolejność tablicy i użyj tej samej instrukcji jako części tekstowej zapytania.

02-fashion-try-on.png

Siedząca kobieta w czarnej satynowej sukience w ciepłym studio

Przypadek 1: tożsamość, czarna satynowa sukienka, pozycja siedząca, ciepłe światło studyjne i kadr pełnoklatkowy są połączone w jednym gotowym zdjęciu modowym.

03-fashion-multi-angle.gif

Krótka sekwencja modowa z widokami z boku, trzy czwarte i z przodu

Kontrola ruchu: obiekt wstaje, odwraca się w stronę okna, a następnie poprawia mankiet w trzech różnych ujęciach.

Przejrzyj wynik punkt po punkcie: kontur twarzy i włosy z Obrazu 1, sylwetka sukienki i połysk z Obrazu 2, pozycja siedząca z Obrazu 3, a następnie dłonie, kadrowanie i tło. Taka lista kontrolna pozwala szybciej wyłapać użyteczny wynik niż ocenianie obrazu jako całości.

Krok 3: Zablokuj opakowanie, odbudowując scenę

Przypadek 2 zmienia świat kampanii wokół produktu bez proszenia edycji o wymyślenie na nowo ujęcia produktowego. Prześlij oryginalną ciemnozieloną butelkę cold brew jako Obraz 1 i jawnie określ ograniczenia dotyczące etykiety.

plaintext
1Keep the bottle in Image 1 exactly unchanged: preserve its shape, cap, dark green glass, label position, the exact words “FIELDNOTE COLD BREW”, and all label typography. Replace only the environment with a bright late-summer breakfast table: pale travertine surface, sliced peach, small linen napkin, condensation droplets on the bottle, sunlit kitchen shadows, and a softly blurred garden in the distance. Keep the bottle centered, front-facing, physically grounded with a natural contact shadow. No additional packaging, no hands, no extra text, no distorted label.

Wybierz pionowy format 3:4, 1536 × 2048, 1 wynik, Prompt Rewrite włączone i najwyższą jakość. Sprawdź etykietę przy powiększeniu 100%, zanim potraktujesz wynik jako materiał produktowy.

04-product-summer-scene.png

Ciemnozielona butelka cold brew na zalanych słońcem stole śniadaniowym z brzoskwinią i lnianą serwetką

Przypadek 2: butelka pozostaje centralnym obiektem, podczas gdy blat, owoce, światło dzienne, ułożenie dłoni i ogród w tle budują nowy świat kampanii.

05-product-multi-angle.gif

Krótka sekwencja produktowa z ujęciem z góry, z niskiego boku i szerokim widokiem okna

Kontrola ruchu: sekwencja przechodzi od ułożenia brzoskwini z góry do niskiego obrotu butelki i momentu serwowania przy oknie, zamiast pojedynczego przybliżenia.

Krok 4: Edytowanie obrazów przez API Qwen Image 3.0 Pro do lokalizacji plakatu

Przypadek 3 to kontrolowana edycja tekstu dla zespołu ds. wzrostu wchodzącego na hiszpańskojęzyczny rynek. Prześlij oryginalny angielski plakat jako Obraz 1. Użyj dosłownych ciągów źródłowych i zastępczych, aby recenzent mógł porównać je linia po linii.

plaintext
1Edit only the written language in Image 1. Replace “CITY NIGHT MARKET” with “MERCADO NOCTURNO DE LA CIUDAD”, replace “FRIDAY 7 PM” with “VIERNES, 19:00”, and replace “RIVERSIDE HALL” with “SALÓN RIBERA”. Preserve the exact poster composition, hierarchy, font style, approximate font sizes, line alignment, yellow-and-indigo color palette, illustrated moon, food-stall drawings, paper texture, margins, and all non-text visual elements. Keep the output as a vertical 4:5 poster. Do not add or remove any logos, dates, people, or decorative elements.

Wybierz pionowy format 4:5, 1638 × 2048, 1 wynik, Prompt Rewrite włączone i najwyższą jakość. Potwierdź znaki diakrytyczne, podziały wierszy, wyrównanie i wszystkie marginesy, zanim zlokalizowana wersja trafi do folderu kampanii.

06-poster-localization-workspace.png

Projektant porównuje dwa układy plakatu nocnego targu na tablicy korkowej w studiu

Scena przeglądu przypadku 3: projektant sprawdza sparowane układy, wydruk próbny, próbki palety i marginesy. Użyj dosłownych ciągów źródłowych i zastępczych z promptu powyżej do ostatecznej próby tekstu.

09-poster-review-multi-angle.gif

Krótka sekwencja przeglądu plakatu z ujęciami z góry, pomiaru i szerokim widokiem biurka

Kontrola ruchu: przegląd przechodzi od rozmieszczenia układu do pomiaru marginesów i porównania na szerokość biurka, dzięki czemu proces QA lokalizacji jest widoczny z trzech punktów widzenia.

Edytowanie obrazów przez API Qwen Image 3.0 Pro: warianty, koszty i prawa

Gdy 3 podstawowe przypadki działają, zespoły mogą skalować ten sam wzorzec instrukcji bez czynienia go niejasnym.

  • Jednoobrazowa zamiana lokalna: nazwij obiekt, jego pozycję i materiał, a następnie wypisz nietknięte obszary.
  • Dwuetapowa fuzja produktów: nazwij Obraz 1 jako scenę, a Obraz 2 jako produkt, a następnie zablokuj opakowanie i skalę.
  • Kompozycja trzech obrazów: przypisz tożsamość, produkt lub ubiór oraz pozę lub kompozycję do Obrazów 1, 2 i 3.
  • Zamiana tekstu: podaj każdy stary i nowy ciąg dosłownie, a następnie zablokuj czcionkę, hierarchię, wyrównanie, marginesy i każdy szczegół nietekstowy.

Przed wysłaniem sprawdź: poprawną kolejność obrazów; jawną listę „zachowaj”; docelowy współczynnik proporcji; etykiety i logotypy; dłonie i krawędzie; oraz fizycznie wiarygodny cień kontaktowy, gdy obiekt jest umieszczony na powierzchni.

   
Plan uruchomieniaObrazyMatematyka planistyczna ceny początkowej
Jeden obraz bazowy plus jedna edycja przymiarki2 obrazy ProOkoło 0,08 USD
Trzy zaprezentowane przypadki4 obrazy ProOkoło 0,16 USD
Trzy przypadki po 4 warianty każdy13 obrazów ProOkoło 0,52 USD

Ceny i promocje mogą się zmieniać, a większa liczba wyników zmienia rachunek. Potwierdź bieżące ustawienia przed uruchomieniem wsadowym.

Używaj wyłącznie zasobów, które posiadasz, do których masz zgodę modelu na wykorzystanie lub wyraźną licencję komercyjną. W przypadku produktów klienckich, osób, znaków towarowych i niewydanych kampanii najpierw potwierdź wymagania swojego zespołu dotyczące prywatności, przechowywania i umów. Nie prezentuj obrazu edytowanego przez AI jako prawdziwego zdjęcia ani nie używaj go do sugerowania cech produktu, które nie istnieją.

Często zadawane pytania

Czy Qwen Image 3.0 Pro Edit obsługuje 1, 2 lub 3 obrazy referencyjne?

Obsługuje od 1 do 3 odnośników. Określ, co kontroluje każdy z nich, np. tożsamość, produkt, ubiór, pozę lub kompozycję, i zachowaj tę kolejność w tablicy obrazów.

Jaki prompt zachowuje tożsamość osoby w edytowaniu obrazów przez API Qwen Image 3.0 Pro?

Najpierw wskaż obraz tożsamości, a następnie zablokuj twarz, włosy, kolor skóry, kąt kamery, oświetlenie, dłonie i kompozycję. Dodaj tylko żądaną edycję po tych ograniczeniach.

Czy edytowanie obrazów przez API Qwen Image 3.0 Pro może zastąpić tekst na plakacie?

Tak, ale zapisz każdy dokładny stary i nowy ciąg oraz jawnie zachowaj typografię, hierarchię, wyrównanie wierszy, marginesy, paletę i grafikę nietekstową. Sprawdź wynik w pełnym rozmiarze.

Czy do obrazów produktowych powinienem używać Qwen Image 3.0 Pro czy standardowego?

Użyj Pro, gdy opakowanie, materiał, tożsamość lub gęsty tekst muszą się obronić podczas przeglądu. Standard to rozsądny punkt wyjścia do przesiewania koncepcji o dużej objętości i niskim ryzyku.

Ile kosztuje przepływ edytowania obrazów przez API Qwen Image 3.0 Pro?

Przy podanej cenie początkowej sprawdzonej w tym przewodniku jeden obraz bazowy plus jedna edycja zaczyna się od około 0,08 USD. Traktuj to jako szacunek planistyczny i przed uruchomieniem potwierdź aktualną stronę modelu, liczbę wyników i wybrane wymiary.

Czy mogę komercyjnie używać edytowanych zdjęć klientów lub brandowanego opakowania?

Tylko z odpowiednimi prawami, zgodą i zatwierdzeniem umownym. Edytowanie obrazów przez API Qwen Image 3.0 Pro nie zastępuje odpowiedzialności zespołu za weryfikację materiału źródłowego i twierdzeń związanych z finalnym obrazem.

Najnowsze modele

Jedno API do całej multimedialnej AI.

Przeglądaj wszystkie modele