Wgrywasz założycielkę, kurtkę i kawiarnię. W rezultacie dostajesz nieznajomego w kawiarni w czymś niejasno przypominającym kurtkę. Qwen Image 3.0 Pro z wieloma obrazami referencyjnymi potrafi rozwiązać taki brief, ale tylko wtedy, gdy każde zdjęcie ma jedno jasne zadanie.
Praktyczna odpowiedź jest prosta: wgraj do 3 obrazów w przemyślanej kolejności. Ustaw obraz 1 jako kotwicę tożsamości, obraz 2 jako kotwicę produktu lub stroju, a obraz 3 jako kotwicę sceny lub stylu. Następnie powtórz to samo w prompcie. Dzięki temu twórca, operator marki lub mały zespół ecommerce dostaje zwarty brief kreatywny zamiast sterty konkurujących ze sobą wskazówek wizualnych.
Ten poradnik pokazuje tę metodę na przykładzie kampanii z założycielką kawiarni, premiery kosmetyków i oryginalnej zmiany pozy postaci z gry. Chodzi o stworzenie nowej kompozycji opartej na referencjach. Nie obiecuje on odwzorowania zdjęć źródłowych piksel po pikselu.
Możesz przetestować cały workflow w jednej karcie przeglądarki na Atlas Cloud, gdzie playground Pro Edit przyjmuje wejścia i prompt razem.
Najważniejsze wnioski
- Przydziel każdej z 3 referencji jedną, nienakładającą się rolę.
- Na pierwszym miejscu umieść tożsamość i wymień obraz 1 w prompcie.
- Pozwól, aby tylko jeden obraz sterował oświetleniem i ogólnym nastrojem.
- Zacznij od 1 wyniku w wysokiej rozdzielczości, a przy każdej ponownej próbie poprawiaj tylko jeden błąd.
Film o workflocie trzech ról w 30 sekund
Ten krótki film zamienia trzy przypadki z artykułu w jeden ciąg wizualny. Zaczyna się od założycielki kawiarni i jej produktu w lokalu, przechodzi przez ciepłą zmianę światła do założycielki marki kosmetycznej i szałwiowej butelki przy trawertynowej toaletce, a następnie przez chłodne odbicie w lustrze dociera do czerwono-skalnego krajobrazu odkrywczyni. Każdy rozdział zmienia punkt widzenia zamiast polegać na jednym najeździe kamery: ujęcia statyczne, boczne, z góry, z jazdą i szerokie plany krajobrazu służą konkretnemu tematowi, produktowi lub wskazówce scenograficznej.
30-sekundowy, 16:9 film Gemini Omni Flash wygenerowany jako ciągłe rozszerzenie w trzech rozdziałach. Przenosi klimat kawiarni do studia kosmetycznego, a następnie do miękkiego pejzażu dźwiękowego wiatru i sygnału, utrzymując ludzi, obiekty i sceny odrębne w wielu ujęciach kamery.
Dlaczego Qwen Image 3.0 Pro z wieloma obrazami referencyjnymi często zawodzi
Edycja z wieloma referencjami robi się popularna, gdy zespół ma prawdziwe zasoby, ale brakuje mu czasu na zorganizowanie sesji zdjęciowej. Portret założycielki, packshot i zdjęcie lokalizacji mogą wyglądać jak wystarczający materiał na reklamę. Jednak trzy obrazy często wywołują przeciąganie liny, jeśli prompt mówi tylko „połącz te".
Model obsługuje edycję z 1–3 referencjami, a kolejność tablicy ma znaczenie. Oficjalna dokumentacja API umieszcza też wynik image-to-image w zakresie od 512×512 do 2048×2048. To sprawia, że kolejność i zapisana priorytetyzacja są częścią kierunku kreatywnego, a nie drobnym szczegółem wdrożeniowym (dokumentacja API Qwen Image 3.0 Alibaba Cloud, wrzesień 2026).
| Symptom błędu | Prawdopodobna przyczyna | Działanie naprawcze |
|---|---|---|
| Wynik przypomina osobę z referencji pozy | Nie wskazano kotwicy tożsamości | Umieść obraz tożsamości jako pierwszy i napisz „zachowaj tożsamość z obrazu 1." |
| Butelka lub opakowanie zamienia się w podobny, ale niewłaściwy obiekt | Obraz produktu pełni też funkcję sceny lub stylu | Przytnij go czysto i przypisz mu wyłącznie strukturę produktu. |
| Wszystkie 3 wejścia uśredniają się w kolaż | Prompt mówi tylko „połącz" | Przypisz obrazom 1, 2 i 3 osobne role. |
| Oświetlenie i kolor wydają się niespójne | Więcej niż jedno wejście narzuca wygląd | Pozwól obrazowi sceny/stylu ustawić atmosferę. |
| Poza jest właściwa, ale postać zniknęła | Źródło pozy ma wyrazistą twarz lub kostium | Przytnij do konturu ciała lub użyj uproszczonej referencji pozy. |
Ten ostatni problem nie jest tylko teoretyczny. W dyskusji społeczności użytkownik opisał, jak referencja postaci została przytłoczona przez referencję pozy o niskiej liczbie wielokątów. Traktuj to jako przydatny raport o błędzie, a nie wyrok dotyczący całego modelu: silne wskazówki wizualne mogą przeważyć nad niedoprecyzowaną instrukcją (dyskusja o błędach wieloreferencyjnych na Reddicie, styczeń 2026).
Jeśli masz więcej niż 3 istotne obrazy, nie zakładaj, że czwarty lub piąty obraz zwiększy wierność modelu. Przygotuj czysty arkusz kontaktowy z kilkoma ujęciami tej samej osoby lub postaci, z odpowiednimi odstępami między widokami, a potem połącz ten arkusz z produktem i sceną. Inną bezpieczną opcją jest proces dwuprzebiegowy: najpierw ustal tożsamość i produkt, a następnie edytuj zatwierdzony wynik w kierunku środowiska.
Qwen Image 3.0 Pro z wieloma obrazami referencyjnymi: workflow i ceny
Do workflow opisanego w tym artykule używaj wyłącznie Qwen Image 3.0 Pro Edit. To narzędzie utrzymuje decyzję kreatywną w jednym miejscu: wgraj 3 referencje, wklej prompt ze świadomymi rolami, wybierz ustawienia wyjściowe i sprawdź wynik. Dokumentacja modeli Qwen opisuje serię Pro jako odpowiednią do złożonych układów, drobnego tekstu, szczegółów fotograficznych i edycji z wieloma referencjami (dokumentacja modeli obrazowych QwenCloud, dostęp wrzesień 2026).
| Symptom błędu | Prawdopodobna przyczyna | Działanie naprawcze |
| Wynik przypomina osobę z referencji pozy | Nie wskazano kotwicy tożsamości | Umieść obraz tożsamości jako pierwszy i napisz „zachowaj tożsamość z obrazu 1." |
| Butelka lub opakowanie zamienia się w podobny, ale niewłaściwy obiekt | Obraz produktu pełni też funkcję sceny lub stylu | Przytnij go czysto i przypisz mu wyłącznie strukturę produktu. |
| Wszystkie 3 wejścia uśredniają się w kolaż | Prompt mówi tylko „połącz" | Przypisz obrazom 1, 2 i 3 osobne role. |
| Oświetlenie i kolor wydają się niespójne | Więcej niż jedno wejście narzuca wygląd | Pozwól obrazowi sceny/stylu ustawić atmosferę. |
| Poza jest właściwa, ale postać zniknęła | Źródło pozy ma wyrazistą twarz lub kostium | Przytnij do konturu ciała lub użyj uproszczonej referencji pozy. |
W momencie pisania tego tekstu publiczny katalog podaje Qwen Image 3.0 Pro Edit od 0,04 USD za obraz. Katalog nie ujawnia osobnego publicznego podziału na rozdzielczość 1K/2K ani na wejścia referencyjne, więc nie planuj budżetu w oparciu o zakładany podział cenowy. Sprawdź kwotę pokazaną przed kliknięciem Run, zwłaszcza jeśli pojawi się rabat. Bazowe 3 przypadki z jednym obrazem przy cenie startowej z katalogu to 0,12 USD przed ewentualnymi powtórzeniami lub zmianami cen.
Kolejne 3 kroki tworzą jedną nieprzerwaną procedurę SOP. Wszystkie korzystają z tej samej logiki kolejności. Utrzymuj referencje w czystości, opisz rolę każdej z nich i jawnie sformułuj prośbę o finalną kompozycję.
Qwen Image 3.0 Pro z wieloma obrazami referencyjnymi: poradnik metody 3 ról
Krok 1: Zbuduj kampanię z założycielką kawiarni
Zacznij od najczystszego portretu tożsamościowego. Obraz 2 powinien pokazywać lniany fartuch i opakowanie kawy bez rozpraszającego miejsca. Obraz 3 powinien przedstawiać wnętrze kawiarni, które zapewnia ciepłe drewno, poranne światło i głębię. Rezultatem powinno być nowe zdjęcie kampanijne, na którym założycielka pozostaje wizualnym punktem centralnym.
plaintext1Create a premium 4:5 editorial campaign photograph. 2 3Image 1 is the identity anchor. Preserve this adult founder’s recognizable face, hairstyle, skin tone, and relaxed expression. 4Image 2 is the wardrobe and product anchor. Preserve the natural linen apron, the dark coffee bag shape, and the muted terracotta-and-cream packaging palette. 5Image 3 is the location and lighting anchor. Place the founder behind a warm independent coffee-shop counter with soft morning window light, wood texture, and a gently blurred café background. 6 7Show the founder holding the coffee bag naturally at chest height. Create a new composition, not a collage. Keep the product proportion believable and the person as the visual focal point. Authentic editorial product photography, 50mm lens look, shallow depth of field, realistic skin texture, no visible extra hands, no duplicated product, no unreadable labels.
Użyj tego połączonego paska referencji jako tablicy briefingowej do kroku 1. Czytaj go od lewej do prawej: Referencja 1, tożsamość dostarcza twarz i wyraz założycielki; Referencja 2, detal produktu dostarcza obiekt kawy i teksturę blatu; Referencja 3, scena i światło dostarcza atmosferę kawiarni i światło z okna. Pasek zachowuje kopiowalną kolejność i jednocześnie precyzyjnie określa zadanie każdego źródła.

Trzyczęściowy pasek referencji do kawy: tożsamość założycielki po lewej, detal produktu kawowego pośrodku i scena kawiarni ze światłem z okna po prawej
Pasek referencji do kroku 1: tożsamość, detal produktu, następnie scena i światło. Zachowaj tę sekwencję podczas wgrywania i pisania promptu.
Wybierz Qwen Image 3.0 Pro Edit, wgraj referencje w dokładnie tej kolejności, wybierz proporcje 4:5 i najwyższą dostępną rozdzielczość, poproś o 1 wynik i ustaw seed 20260903. Zanim uruchomisz ponownie, sprawdź, czy osoba, fartuch/opakowanie i światło kawiarni przetrwały każde z przypisanych im zadań.

Animowane studium kampanii kawowej: założycielka stawia opakowanie obok parującego kubka, gdy kamera przechodzi z wysokiego ujęcia z trzech czwartych do bocznej orbity i widoku blatu na wysokości oczu
Studium ruchu z wielu kątów do kroku 1: Gemini Omni Flash animuje zatwierdzone zdjęcie kawy w jeden ciągły ruch w kawiarni, przesuwając się z wysokiego ujęcia z trzech czwartych przez boczną orbitę do widoku blatu na wysokości oczu. Użyj go, aby sprawdzić, czy założycielka, opakowanie, sprzęt, para i wnętrze kawiarni pozostają czytelne przy zmianie punktu widzenia.
Krok 2: Użyj ponownie Qwen Image 3.0 Pro z wieloma obrazami referencyjnymi do premiery kosmetyków
Ta wersja testuje ograniczenie, które ma największe znaczenie dla małego zespołu produktowego: zarówno założycielka, jak i faktyczna butelka muszą pozostać rozpoznawalne. Użyj czystego, skierowanego na wprost zdjęcia produktu. Unikaj zdjęcia produktu z kontekstem lifestyle’owym, ponieważ konkurowałoby ono z kamienną łazienką z referencji.
plaintext1Create a refined 4:5 skincare launch image for a small founder-led brand. 2 3Image 1 is the identity anchor. Keep the founder’s face, hair, natural skin tone, and calm confident expression recognizable. 4Image 2 is the product anchor. Preserve the exact bottle silhouette, cap shape, label placement, and pale sage product color. Do not invent a second product. 5Image 3 is the environment anchor. Use its warm travertine surface, soft window light, and understated bathroom atmosphere. 6 7Show the founder holding the product with one hand near a stone vanity. The bottle must be fully visible and proportionate. Make a newly composed, high-end but believable lifestyle product photograph. Soft 85mm portrait lens look, realistic hands, subtle shadows, no duplicate fingers, no warped cap, no extra bottles, no invented logos or text.
Wybierz Qwen Image 3.0 Pro Edit z 3 referencjami, proporcje 4:5, najwyższą dostępną rozdzielczość, 1 wynik i seed 20260904. Zanim ocenisz ogólne piękno, sprawdź nakrętkę, sylwetkę, położenie etykiety i dłoń. Te detale niosą większe ryzyko komercyjne niż nieco inny cień w tle.

Animowane studium założycielki marki kosmetycznej: założycielka obraca szałwiową butelkę w świetle okna, gdy kamera przesuwa się z bocznego widoku do wysokiego ujęcia produktu i szerszej kompozycji toaletki
Studium ruchu dla przypadku 2: Gemini Omni Flash zamienia wybrane zdjęcie kosmetyczne w ciągłą akcję produktową, przechodząc z widoku z boku założycielki do wysokiego detalu produktu, a następnie szerszej kompozycji toaletki. Blada szałwiowa butelka, lniany ręcznik i ciepła trawertynowa sceneria pozostają osobno czytelne podczas zmiany punktu widzenia.
Krok 3: Użyj Qwen Image 3.0 Pro z wieloma obrazami referencyjnymi do oryginalnej zmiany pozy postaci
Przypadek postaci najbardziej wyraźnie oddziela tożsamość od pozy. Obraz 2 musi przekazywać wyłącznie ruch. Jeśli zawiera zapadającą w pamięć twarz, przytnij ją przed wgraniem. Ten mały krok przygotowawczy zmniejsza ryzyko, że źródło pozy wniesie swoją tożsamość zamiast geometrii ciała.
plaintext1Create a cinematic 16:9 key art image for an original science-fiction adventure. 2 3Image 1 is the character identity anchor. Preserve the explorer’s original face, haircut, white-and-rust exploration suit, chest patch placement, and backpack silhouette. 4Image 2 controls body pose only. Use its stepping-forward body pose and head direction, but do not copy its face, clothing, or identity. 5Image 3 controls environment, palette, and light. Use its coral dust, blue dawn shadows, and distant rocky horizon. 6 7Show the original explorer stepping over a low red-rock ridge at dawn, looking toward a distant research beacon. Cinematic wide shot, crisp foreground character, layered atmospheric depth, physically believable suit seams and hands. New original composition. No extra limbs, no duplicated helmet, no text, no watermark.
Wybierz Qwen Image 3.0 Pro Edit, 3 referencje, proporcje 16:9, najwyższą dostępną rozdzielczość, 1 wynik i seed 20260905. Najpierw porównaj wynik z obrazem 1. Naszywka na klatce piersiowej, fryzura i sylwetka kombinezonu powinny być czytelne jako oryginalna postać. Następnie sprawdź, czy obraz 2 wniósł tylko krok do przodu i kierunek głowy.

Animowane studium odkrywcy: fikcyjny odkrywca przechodzi przez czerwono-skalną grań, skanuje odległy beacon urządzeniem terenowym i zostaje ukazany w szerokim pejzażu o świcie
Studium ruchu dla przypadku 3: Gemini Omni Flash animuje zdjęcie odkrywcy niskim ujęciem z jazdą podczas marszu, przeciwnym kątem podczas skanowania urządzeniem terenowym i szerokim ujęciem z góry odsłaniającym całość. Fikcyjny odkrywca, biało-rdzawy kombinezon, instrument terenowy, warstwowy czerwono-skalny teren, niebieski świt i odległy beacon badawczy pozostają połączone w jedną scenę.
Warianty Qwen Image 3.0 Pro z wieloma obrazami referencyjnymi, które oszczędzają ponowne próby
Kiedy już potrafisz przydzielić 3 role, możesz zmieniać, która rola ma największą stawkę. Metoda pozostaje stabilna. Zmienia się tylko kolejność wejść i deklaracja priorytetu.
| Wariant | Priorytet obrazu 1 | Obraz 2 | Obraz 3 | Najlepsze zastosowanie |
| Tożsamość na pierwszym miejscu | Osoba lub oryginalna postać | Strój lub produkt | Scena lub światło | Kampanie z założycielami i praca z postaciami |
| Produkt na pierwszym miejscu | Packshot produktu | Osoba trzymająca produkt | Scena lub kierunek kolorystyczny | Strony produktowe, gdzie kształt butelki ma największe znaczenie |
| Styl na pierwszym miejscu | Główna postać | Produkt/detal | Paleta, oświetlenie, medium | Seria wymagająca spójnej dyrekcji artystycznej |
| Ratowanie pozy | Tożsamość postaci | Przycięte źródło pozy ciała | Środowisko | Zmiana pozy bez przejmowania twarzy modelu pozy |
W wariancie produkt na pierwszym miejscu umieść packshot w obrazie 1 i napisz „obraz 1 jest niepodlegającą negocjacjom kotwicą produktu". W wariancie styl na pierwszym miejscu ustaw trzeci obraz jako wizualną referencję światła, palety i medium. W tym polu nie podawaj kolejnej dominującej osoby.
Jeśli masz zbyt wiele obrazów referencyjnych, przygotuj jeden przemyślany arkusz kontaktowy. Użyj go do wielu kątów tej samej postaci lub produktu, pozostawiając wystarczająco dużo pustej przestrzeni, aby każdy widok był odrębny. Pozostałe 2 sloty przeznacz na pozostałe zadania. Więcej wejść może tworzyć więcej konfliktów, więc daj modelowi mniejszy i jaśniejszy brief.
Koszty, prawa i kontrola jakości przed publikacją
Traktuj każdą generację jako szkic do krótkiego przeglądu produkcyjnego. 2-minutowa inspekcja zapobiega częstemu błędom publikowania ładnie wyglądającego obrazu ze złą butelką, zmienioną etykietą lub zapożyczoną tożsamością pozy.
- Powiększ do 100% i sprawdź twarz, dłonie, krawędzie produktu, nakrętkę i widoczny tekst.
- Porównaj wynik z 3 wejściami. Potwierdź, że każde przypisane zadanie pojawiło się w rezultacie.
- Jeśli tylko 1 element jest nieprawidłowy, zmień przy następnym uruchomieniu wyłącznie tę instrukcję. Nie przepisuj całego promptu i nie trać użytecznego wyniku.
Używaj wyłącznie obrazów, które posiadasz, do których masz licencję lub zgodę na wgranie. Nie sugeruj, że prawdziwa osoba, właściciel znaku towarowego lub chroniona postać poparła gotowy obraz. Atlas Cloud jest jedynie prostym miejscem do testowania tego przepływu edycji Pro; nie gwarantuje absolutnej wierności tożsamości, produktu ani tekstu w każdym wyniku.
W prawdziwej kampanii zapisuj ustawienia, seed, wycenę generacji i dokładne pliki wejściowe obok zatwierdzonej wersji. To zamienia metodę Qwen Image 3.0 Pro z wieloma obrazami referencyjnymi ze sprytnego jednorazowego triku w powtarzalny proces zespołowy.
Najczęściej zadawane pytania
Ile obrazów referencyjnych może użyć Qwen Image 3.0 Pro?
Workflow edycji Pro obsługuje od 1 do 3 obrazów referencyjnych. Trzy działają najlepiej, gdy obrazy mają osobne role: tożsamość, produkt lub strój oraz scena lub styl.
Który obraz powinienem wgrać jako pierwszy w workflocie z wieloma referencjami w Qwen Image 3.0 Pro?
Umieść w obrazie 1 to, czego nie możesz stracić. W większości prac z założycielami i postaciami jest to obraz tożsamości. W przypadku ścisłego packshotu ecommerce ustaw produkt jako obraz 1.
Dlaczego Qwen Image 3.0 Pro kopiuje referencję pozy zamiast mojej postaci?
Źródło pozy może zawierać silniejszą twarz, ubiór lub sylwetkę niż reszta. Przytnij je do ciała, napisz, że kontroluje wyłącznie pozę, i jawnie zachowaj tożsamość z obrazu 1.
Czy mogę połączyć osobę, produkt i tło w jednym prompcie?
Tak. To najczystsze zastosowanie metody 3 ról: osoba w obrazie 1, produkt w obrazie 2 i tło lub oświetlenie w obrazie 3. Poproś o nową kompozycję, a nie kolaż.
Czy wyższa rozdzielczość jest warta dodatkowego kosztu w Qwen Image 3.0 Pro?
Wybierz wyższą opcję, gdy musisz sprawdzić krawędzie opakowania, dłonie, szczegóły twarzy lub przyciąć obraz do płatnych social media. Sprawdź bieżącą wycenę przed kliknięciem Run, ponieważ cena startowa z publicznego katalogu nie podaje osobnego publicznego podziału na rozdzielczość.
Co zrobić, jeśli mam więcej niż 3 obrazy referencyjne?
Połącz powiązane widoki w czysty arkusz kontaktowy lub użyj 2 przebiegów. Nie wpychaj każdego obrazu do jednej instrukcji. Jasna hierarchia daje bardziej użyteczne wyniki niż większy stos referencji.







