alibaba/wan-2.5/image-edit

Bild-zu-Bild

Wan 2.5 Image Edit API by Alibaba

alibaba/wan-2.5/image-edit

Image-edit

Open and Advanced Large-Scale Image Generative Models.

Eingabe

Parameterkonfiguration wird geladen...

Ausgabe

Inaktiv

Ihre generierten Bilder erscheinen hier

Konfigurieren Sie Parameter und klicken Sie auf Ausführen, um mit der Generierung zu beginnen

Jede Ausführung kostet $0.021. Für $10 können Sie ca. 476 Mal ausführen.

Sie können fortfahren mit:

Bild zu Video Bild zu Bild

Parameter

Codebeispiel
import requests
import time

# Step 1: Start image generation
generate_url = "https://api.atlascloud.ai/api/v1/model/generateImage"
headers = {
    "Content-Type": "application/json",
    "Authorization": "Bearer $ATLASCLOUD_API_KEY"
}
data = {
    "model": "alibaba/wan-2.5/image-edit",
    "prompt": "A beautiful landscape with mountains and lake",
    "width": 512,
    "height": 512,
    "steps": 20,
    "guidance_scale": 7.5,
}

generate_response = requests.post(generate_url, headers=headers, json=data)
generate_result = generate_response.json()
prediction_id = generate_result["data"]["id"]

# Step 2: Poll for result
poll_url = f"https://api.atlascloud.ai/api/v1/model/prediction/{prediction_id}"

def check_status():
    while True:
        response = requests.get(poll_url, headers={"Authorization": "Bearer $ATLASCLOUD_API_KEY"})
        result = response.json()

        if result["data"]["status"] == "completed":
            print("Generated image:", result["data"]["outputs"][0])
            return result["data"]["outputs"][0]
        elif result["data"]["status"] == "failed":
            raise Exception(result["data"]["error"] or "Generation failed")
        else:
            # Still processing, wait 2 seconds
            time.sleep(2)

image_url = check_status()

Installieren

Installieren Sie das erforderliche Paket für Ihre Programmiersprache.

pip install requests

Authentifizierung

Alle API-Anfragen erfordern eine Authentifizierung über einen API-Schlüssel. Sie können Ihren API-Schlüssel über das Atlas Cloud Dashboard erhalten.

export ATLASCLOUD_API_KEY="your-api-key-here"

HTTP-Header

import os

API_KEY = os.environ.get("ATLASCLOUD_API_KEY")
headers = {
    "Content-Type": "application/json",
    "Authorization": f"Bearer {API_KEY}"
}

Schützen Sie Ihren API-Schlüssel

Geben Sie Ihren API-Schlüssel niemals in clientseitigem Code oder öffentlichen Repositories preis. Verwenden Sie stattdessen Umgebungsvariablen oder einen Backend-Proxy.

Anfrage senden

import requests

url = "https://api.atlascloud.ai/api/v1/model/generateImage"
headers = {
    "Content-Type": "application/json",
    "Authorization": "Bearer $ATLASCLOUD_API_KEY"
}
data = {
    "model": "your-model",
    "prompt": "A beautiful landscape"
}

response = requests.post(url, headers=headers, json=data)
print(response.json())

Anfrage senden

Senden Sie eine asynchrone Generierungsanfrage. Die API gibt eine Vorhersage-ID zurück, mit der Sie den Status prüfen und das Ergebnis abrufen können.

POST/api/v1/model/generateImage

Anfragekörper

import requests

url = "https://api.atlascloud.ai/api/v1/model/generateImage"
headers = {
    "Content-Type": "application/json",
    "Authorization": "Bearer $ATLASCLOUD_API_KEY"
}

data = {
    "model": "alibaba/wan-2.5/image-edit",
    "prompt": "A beautiful landscape with mountains and lake"
}

response = requests.post(url, headers=headers, json=data)
result = response.json()

print(f"Prediction ID: {result['data']['id']}")
print(f"Status: {result['data']['status']}")

Antwort

{
  "code": 200,
  "data": {
    "id": "pred_abc123",
    "status": "processing",
    "model": "model-name",
    "created_at": "2025-01-01T00:00:00Z"
  }
}

Status prüfen

Fragen Sie den Vorhersage-Endpunkt ab, um den aktuellen Status Ihrer Anfrage zu überprüfen.

GET/api/v1/model/prediction/{prediction_id}

Abfrage-Beispiel

import requests
import time

prediction_id = "pred_abc123"
url = f"https://api.atlascloud.ai/api/v1/model/prediction/{prediction_id}"
headers = { "Authorization": "Bearer $ATLASCLOUD_API_KEY" }

while True:
    response = requests.get(url, headers=headers)
    result = response.json()
    status = result["data"]["status"]
    print(f"Status: {status}")

    if status in ["completed", "succeeded"]:
        output_url = result["data"]["outputs"][0]
        print(f"Output URL: {output_url}")
        break
    elif status == "failed":
        print(f"Error: {result['data'].get('error', 'Unknown')}")
        break

    time.sleep(3)

Statuswerte

processingDie Anfrage wird noch verarbeitet.

completedDie Generierung ist abgeschlossen. Ergebnisse sind verfügbar.

succeededDie Generierung war erfolgreich. Ergebnisse sind verfügbar.

failedDie Generierung ist fehlgeschlagen. Überprüfen Sie das Fehlerfeld.

Abgeschlossene Antwort

{
  "data": {
    "id": "pred_abc123",
    "status": "completed",
    "outputs": [
      "https://storage.atlascloud.ai/outputs/result.png"
    ],
    "metrics": {
      "predict_time": 8.3
    },
    "created_at": "2025-01-01T00:00:00Z",
    "completed_at": "2025-01-01T00:00:10Z"
  }
}

Dateien hochladen

Laden Sie Dateien in den Atlas Cloud Speicher hoch und erhalten Sie eine URL, die Sie in Ihren API-Anfragen verwenden können. Verwenden Sie multipart/form-data zum Hochladen.

POST/api/v1/model/uploadMedia

Upload-Beispiel

import requests

url = "https://api.atlascloud.ai/api/v1/model/uploadMedia"
headers = { "Authorization": "Bearer $ATLASCLOUD_API_KEY" }

with open("image.png", "rb") as f:
    files = {"file": ("image.png", f, "image/png")}
    response = requests.post(url, headers=headers, files=files)

result = response.json()
download_url = result["data"]["download_url"]
print(f"File URL: {download_url}")

Antwort

{
  "data": {
    "download_url": "https://storage.atlascloud.ai/uploads/abc123/image.png",
    "file_name": "image.png",
    "content_type": "image/png",
    "size": 1024000
  }
}

Eingabe-Schema

Die folgenden Parameter werden im Anfragekörper akzeptiert.

Gesamt: 0Erforderlich: 0Optional: 0

Keine Parameter verfügbar.

Beispiel-Anfragekörper

{
  "model": "alibaba/wan-2.5/image-edit"
}

Ausgabe-Schema

Die API gibt eine Vorhersage-Antwort mit den generierten Ausgabe-URLs zurück.

idstringrequired

Unique identifier for the prediction.

statusstringrequired

Current status of the prediction.

processingcompletedsucceededfailed

modelstringrequired

The model used for generation.

outputsarray[string]

Array of output URLs. Available when status is "completed".

errorstring

Error message if status is "failed".

metricsobject

Performance metrics.

predict_timenumber

Time taken for image generation in seconds.

created_atstringrequired

ISO 8601 timestamp when the prediction was created.

Format: date-time

completed_atstring

ISO 8601 timestamp when the prediction was completed.

Format: date-time

Beispielantwort

{
  "id": "pred_abc123",
  "status": "completed",
  "model": "model-name",
  "outputs": [
    "https://storage.atlascloud.ai/outputs/result.png"
  ],
  "metrics": {
    "predict_time": 8.3
  },
  "created_at": "2025-01-01T00:00:00Z",
  "completed_at": "2025-01-01T00:00:10Z"
}

Atlas Cloud Skills

Atlas Cloud Skills integriert über 300 KI-Modelle direkt in Ihren KI-Programmierassistenten. Ein Befehl zur Installation, dann generieren Sie per natürlicher Sprache Bilder und Videos und chatten mit LLMs.

Unterstützte Clients

Claude Code

OpenAI Codex

Gemini CLI

Cursor

Windsurf

VS Code

Trae

GitHub Copilot

Cline

Roo Code

Amp

Goose

Replit

40+ unterstützte clients

Installieren

npx skills add AtlasCloudAI/atlas-cloud-skills

API-Schlüssel einrichten

Erhalten Sie Ihren API-Schlüssel über das Atlas Cloud Dashboard und setzen Sie ihn als Umgebungsvariable.

export ATLASCLOUD_API_KEY="your-api-key-here"

Funktionen

Nach der Installation können Sie natürliche Sprache in Ihrem KI-Assistenten verwenden, um auf alle Atlas Cloud Modelle zuzugreifen.

BildgenerierungGenerieren Sie Bilder mit Modellen wie Nano Banana 2, Z-Image und mehr.

VideoerstellungErstellen Sie Videos aus Text oder Bildern mit Kling, Vidu, Veo usw.

LLM-ChatChatten Sie mit Qwen, DeepSeek und anderen großen Sprachmodellen.

Medien-UploadLaden Sie lokale Dateien für Bildbearbeitung und Bild-zu-Video-Workflows hoch.

Mehr erfahren

github.com/AtlasCloudAI/atlas-cloud-skills

MCP-Server

Der Atlas Cloud MCP-Server verbindet Ihre IDE mit über 300 KI-Modellen über das Model Context Protocol. Funktioniert mit jedem MCP-kompatiblen Client.

Unterstützte Clients

Cursor

VS Code

Windsurf

Claude Code

OpenAI Codex

Gemini CLI

Cline

Roo Code

100+ unterstützte clients

Installieren

npx -y atlascloud-mcp

Konfiguration

Fügen Sie die folgende Konfiguration zur MCP-Einstellungsdatei Ihrer IDE hinzu.

{
  "mcpServers": {
    "atlascloud": {
      "command": "npx",
      "args": [
        "-y",
        "atlascloud-mcp"
      ],
      "env": {
        "ATLASCLOUD_API_KEY": "your-api-key-here"
      }
    }
  }
}

Verfügbare Werkzeuge

atlas_generate_imageGenerieren Sie Bilder aus Textbeschreibungen.

atlas_generate_videoErstellen Sie Videos aus Text oder Bildern.

atlas_chatChatten Sie mit großen Sprachmodellen.

atlas_list_modelsDurchsuchen Sie über 300 verfügbare KI-Modelle.

atlas_quick_generateInhaltserstellung in einem Schritt mit automatischer Modellauswahl.

atlas_upload_mediaLaden Sie lokale Dateien für API-Workflows hoch.

Mehr erfahren

github.com/AtlasCloudAI/mcp-server

API-Schema

Schema nicht verfügbar

Keine Beispiele verfügbar

Wird geladen...

Warum Wan 2.5 wählen?

Deutlich günstiger

Trotz der jüngsten Preissenkungen von Google bleibt Veo 3 insgesamt teuer. Wan 2.5 ist leichtgewichtig und kostengünstig, bietet Creators mehr Optionen und reduziert dabei die Produktionskosten erheblich.

Ein-Schritt-Generierung, End-to-End-Synchronisation

Mit Wan 2.5 entfällt das separate Aufnehmen von Sprache oder das manuelle Ausrichten der Lippensynchronisation. Geben Sie einfach einen klaren, strukturierten Prompt an und erhalten Sie in einem Schritt vollständige Videos mit Audio/Voiceover und Lippensync – schneller und einfacher als je zuvor.

Mehrsprachig optimiert

Bei chinesischen Prompts generiert Wan 2.5 zuverlässig audio-visuell synchronisierte Videos. Veo 3 hingegen zeigt bei chinesischen Prompts häufig „unbekannte Sprache“ an.

Präzise Charakterrekonstruktion

Wan 2.5 glänzt bei der Rekonstruktion von Charaktereigenschaften: Erscheinungsbild, Mimik und Bewegungsstil werden authentisch wiedergegeben – für wiedererkennbare, unverwechselbare Figuren, die Storytelling und Immersion auf ein neues Level heben.

Künstlerische Stilwiedergabe

Unterstützt Studio-Ghibli-ähnliche Stilwiedergabe mit handgemalten Aquarelltexturen und Animationseffekten. Das Ergebnis: warme, traumhafte Bilderlebnisse mit starker künstlerischer Wirkung und erzählerischer Tiefe.

Wer profitiert davon?

Marketing-Teams

Ob Produktlaunches, Werbekampagnen oder Markenmarketing – Wan 2.5 hilft Ihnen, hochwertige Videos schnell zu erstellen und Ihre Content-Produktion einfach und effizient zu gestalten.

Produkt-Demos und Tutorials – ohne den üblichen Koordinierungsaufwand
Social-Media-Marketing mit mehrsprachigen Untertiteln und Lippensync
KI-generierter Content ermöglicht es dem Team, sich auf Strategie und Kreativität zu konzentrieren

Bottom line: Fazit: Erstellen war noch nie so einfach, schnell und intelligent – Wan 2.5 ist Ihre Geheimwaffe im Marketing!

Globale Unternehmen

Bietet multinationalen Konzernen ideale Lösungen zur Content-Lokalisierung – für eine einfachere und effizientere Produktion.

Mehrsprachige Videounterstützung mit Prompt-Erkennung
Per Knopfdruck: Lippensynchrone Untertitel und Voiceovers
Schnelle Inhaltslokalisierung für globale Märkte

Bottom line: Fazit: Grenzüberschreitende Content-Produktion war noch nie so einfach, schnell und intelligent.

Story-Creators / YouTuber

Creators können Wan 2.5 nutzen, um ihre Videoproduktion effizienter zu gestalten und dabei durchgehend hohe Qualität zu gewährleisten.

Immersives Storytelling mit präzisen Charakterbewegungen und -ausdrücken
Höhere Veröffentlichungsfrequenz durch reduzierten Schnitt- und Postproduktionsaufwand
Vielseitiger Content – von Kurzvideos bis hin zu animierten Story-Segmenten

Unternehmensschulungs-Teams

Wan 2.5 macht Unternehmensschulungen effizienter und ansprechender.

Professionelle Videos ersetzen trockene Textdokumente
Schnelle Erstellung von Bedienungsanleitungen und Schulungstutorials
Einheitlicher Stil und standardisierter Output für den weltweiten Rollout

Kreative Freelancer / Kleine Studios

Wan 2.5 lässt Kreativität frei fließen – ganz ohne teure Ausrüstung oder Schauspieler. KI generiert alles effizient für Sie.

Vielfältige Projekte ausprobieren – von Kurzfilmen bis hin zu Social-Media-Content
Von der Idee zum fertigen Produkt mit „Ein-Klick-Generierung“
Hochwertige Inhalte ohne teures Equipment oder professionelle Schauspieler

Bottom line: Fazit: Wan 2.5 macht das Erstellen einfacher, freier und aufregender – jeder Versuch ist ein Erlebnis!

Bildungseinrichtungen / Online-Kurs-Ersteller

Kreativität ohne hohe Kosten in die Realität umsetzen – Wan 2.5 macht hochwertige Content-Produktion einfach und wirtschaftlich.

Verschiedene Stile ausprobieren – von Kurzfilmen bis hin zu Werbevideos
Höhere Produktionseffizienz vom Konzept bis zum fertigen Produkt
Qualitativ hochwertiger Content ohne teures Equipment oder professionelle Talente

Bottom line: Fazit: Wan 2.5 macht das Erstellen mühelos, effizient und frei – jeder Versuch ist spektakulär!

Kernfunktionen

Ein-Schritt-A/V-Generierung

Vollständige Videos mit synchronem Audio, Voiceover und Lippensync – in einem einzigen Arbeitsschritt generiert

Zwei-Charakter-Synchronisation

Unterstützt die simultane Generierung zweier Charaktere mit synchronisierten Aktionen, Mimik und Lippensync für natürliche Interaktionen

Professionelle Qualität

Hochwertige Videoausgabe mit realistischen Charakterausdrücken und präziser Lippensynchronisation

Mehrsprachige Unterstützung

Hervorragende Unterstützung für chinesische Prompts und zuverlässige Generierung mehrsprachiger Inhalte

Kostengünstig

Deutlich niedrigere Kosten im Vergleich zu Mitbewerbern bei gleichbleibend professioneller Qualität

Charaktereigenschafts-Rekonstruktion

Rekonstruiert Erscheinungsbild, Mimik und Bewegungsstil von Charakteren mit hoher Originaltreue und Persönlichkeit

Künstlerische Stilwiedergabe

Unterstützt verschiedene Kunststile, darunter Studio-Ghibli-inspirierte handgemalte Aquarelltexturen

Immersive Szenen

Ideal für Dialogszenen, Interviews oder Kurzfilme mit zwei Personen – mit natürlicher audio-visueller Konsistenz

Digital Human Sync

Study Room Scholar

Middle-aged man reading with perfect lip-sync in a warm study environment

Lip-sync with audioEnvironmental soundsCharacter emotion

Prompt

A middle-aged man sitting at a wooden desk in a cozy study room, surrounded by bookshelves and a warm lamp glow. He opens an old book and reads aloud with a calm, deep voice: 'History teaches us more than just facts… it shows us who we are.' The room has subtle background sounds: pages turning, the faint ticking of a clock, and distant rain against the window.

Dual Character Scene

Park Sunset Romance

Couple interaction with synchronized dual character actions and expressions

Dual character syncNatural interactionAmbient soundscape

Prompt

A young couple sitting on a park bench during sunset. The woman leans her head on the man's shoulder. He whispers softly: 'No matter where we go, I'll always be here with you.' The sound includes the rustling of leaves, distant laughter of children playing, and the gentle hum of cicadas in the evening air.

Character Restoration

Ballet Performance Art

Precise character trait restoration with artistic movement and expression

Character trait restorationMovement precisionArtistic lighting

Prompt

A graceful ballerina with her hair in a messy bun, performing a powerful and emotional contemporary ballet routine. She is in a minimalist, dark art studio. Abstract patterns of light and shadow, projected from a hidden source, dance across her body and the surrounding walls, constantly shifting with her movements. The camera focuses on the tension in her muscles and the expressive gestures of her hands. A single, dramatic slow-motion shot captures her mid-air leap, with the light patterns swirling around her like a galaxy. Moody, artistic, high contrast.

Artistic Style Rendering

Ghibli Forest Magic

Studio Ghibli-inspired animation with hand-painted watercolor texture

Ghibli art styleHand-painted textureMagical atmosphere

Prompt

Studio Ghibli-inspired anime style. A young girl with a straw hat lies peacefully in a sun-dappled magical forest, surrounded by friendly, glowing forest spirits (Kodama). A gentle breeze rustles the leaves of the giant, ancient trees. The air is filled with sparkling dust motes, illuminated by shafts of sunlight. The art style is soft, with a hand-painted watercolor texture. The scene feels serene, magical, and heartwarming.

Perfekt Für

🎬

Videoproduktion

📢

Marketing-Content

🎓

Lehrvideos

📱

Social Media

🌐

Mehrsprachiger Content

💼

Unternehmensschulungen

🎭

Unterhaltung

💃

Darstellende Kunst

🎨

Animation & Anime

📚

Storytelling

👥

Zwei-Charakter-Videos

🎙️

Interviews

📺

Rundfunk & Medien

Technische Spezifikationen

Modelltyp:Audio-Visuell Synchronisierte Generierung

Kernfunktionen:A/V-Sync, Charakterrekonstruktion, Künstlerisches Rendering, Mehrsprachig

Sprachunterstützung:Chinesisch, Englisch und weitere

Ausgabequalität:Professionelles HD-Video mit Audio

Generierungsgeschwindigkeit:Schnelle Ein-Schritt-Generierung

API-Integration:RESTful API mit umfassender Dokumentation

Erleben Sie Wan 2.5 – Ihre Revolution der Videoerstellung

Schließen Sie sich Tausenden von Creators und Unternehmen an, die ihre Videoproduktion mit synchroner Audio-Video-Generierung neu definieren.

🎬Ein-Schritt-A/V-Sync

🌍Mehrsprachige Unterstützung

⚡Kostengünstig

Alibaba WAN 2.5 Image Edit

Alibaba WAN 2.5 Image Edit enables you to upload an existing visual and specify the desired adjustments. The model preserves layout and subject structure while implementing high-quality updates based on natural language.

Why creators love it

Structure-preserving edits: Make lighting, color, or object changes without breaking composition.
Text-guided styling: Reimagine materials, moods, or art styles with concise prompts.
Prompt expansion on demand: Enable automatic prompt enrichment when you need extra detail.
Flexible output sizes: Pick the resolution that best matches your downstream workflow.

Perfect for

Marketing and design teams refining campaign visuals.
E-commerce sellers upgrading product imagery.
Content creators polishing thumbnails, covers, and posts.
Artists experimenting with variations of their original work.

Billing rules

Minimum charge: 1 image.
Total cost = number of images × price per resolution.

How to use

Provide the image you want to refine. (Image dimensions must be in (384, 5000))
Describe the desired adjustments in the prompt.
Choose the target resolution and submit.
Review the enhanced output and download the version you like best.

Pro tips

Start with clear instructions about colors, lighting, or objects to adjust.
Pair positive and negative prompts to control what should or should not appear.
Keep source images at or above your target resolution for optimal fidelity.

Note

If you did not upload the image locally, please ensure that the image URL is accessible! A successfully accessible image will display a preview in the interface.

Recommended Resolutions

Aspect Ratio	Exact (W×H)	Exact Pixels	Rounded (W×H, ÷64)	Rounded Pixels
1:1	1448 × 1448	2,096,704	1408 × 1408	1,982,464
3:2	1773 × 1182	2,095,686	1728 × 1152	1,990,656
4:3	1672 × 1254	2,096,688	1664 × 1216	2,023,424
16:9	1936 × 1089	2,108,304	1920 × 1088	2,088,960
21:9	2212 × 948	2,096,976	2176 × 960	2,088,960
1:1	1024 × 1024	1,048,576	1024 × 1024	1,048,576
3:2	1254 × 836	1,048,344	1216 × 832	1,011,712
4:3	1182 × 887	1,048,434	1152 × 896	1,032,192
16:9	1365 × 768	1,048,320	1344 × 768	1,032,192
21:9	1564 × 670	1,047,880	1536 × 640	983,040
1:1	323 × 323	104,329	320 × 320	102,400
3:2	397 × 264	104,808	384 × 256	98,304
4:3	374 × 280	104,720	448 × 320	143,360
16:9	432 × 243	104,976	448 × 256	114,688
21:9	495 × 212	104,940	576 × 256	147,456

Wan-2.7 Pro Image-to-image

Edits and recomposes images with Wan 2.7 image pro using text instructions and multi-image references for higher quality outputs.

Wan-2.7 Pro Text-to-image

Generates images from text prompts with Wan 2.7 image pro, supporting higher fidelity outputs and 4K-ready workflows.

Wan-2.7 Image-to-image

Edits and recomposes images with Wan 2.7 image using text instructions, multi-image references, and optional interaction boxes.

Wan-2.7 Text-to-image

Generates images from text prompts with Wan 2.7 image, supporting fast iteration and strong prompt fidelity for illustration and photorealistic outputs.

Qwen Image 2.0 Pro Text-to-image

Qwen Image 2.0 Pro is a professional-grade text-to-image model with superior quality and advanced prompt understanding. Up to 2k. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

Qwen Image 2.0 Pro Edit

Qwen Image 2.0 Pro Edit is a professional-grade image editing model with superior quality and advanced instruction understanding. Up to 2k. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

Qwen Image 2.0 Edit

Qwen Image 2.0 Edit is an advanced image-editing model with improved quality and better understanding of instructions. Up to 2k. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

Qwen Image 2.0 Text-to-image

Qwen Image 2.0 is an advanced text-to-image model with enhanced image quality and improved prompt understanding. Up to 2k. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

Qwen-Image Edit Plus 20251215

Supports multiple image inputs and outputs, allowing for precise modification of text within images, addition, deletion, or movement of objects, alteration of subject actions, transfer of image styles, and enhancement of image details.

From$0.03/BILD

$0.021/BILD

-30%