bytedance/avatar-omni-human-v1.5

Áudio para Vídeo

Avatar Omni Human 1.5 API by ByteDance

bytedance/avatar-omni-human-v1.5

Avatar-omni-human-v1.5

Open and Advanced Large-Scale Video Generative Models.

Entrada

Carregando configuração de parâmetros...

Saída

Inativo

Os vídeos gerados serão exibidos aqui

Configure os parâmetros e clique em executar para começar a gerar

Cada execução custará $0.06. Com $10 você pode executar aproximadamente 166 vezes.

Você pode continuar com:

Seedance 2.0 Kling v3 Vidu Wan2.7

Parâmetros

Exemplo de código
import requests
import time

# Step 1: Start video generation
generate_url = "https://api.atlascloud.ai/api/v1/model/generateVideo"
headers = {
    "Content-Type": "application/json",
    "Authorization": "Bearer $ATLASCLOUD_API_KEY"
}
data = {
    "model": "bytedance/avatar-omni-human-v1.5",
    "prompt": "A beautiful sunset over the ocean with gentle waves",
    "width": 512,
    "height": 512,
    "duration": 3,
    "fps": 24,
}

generate_response = requests.post(generate_url, headers=headers, json=data)
generate_result = generate_response.json()
prediction_id = generate_result["data"]["id"]

# Step 2: Poll for result
poll_url = f"https://api.atlascloud.ai/api/v1/model/prediction/{prediction_id}"

def check_status():
    while True:
        response = requests.get(poll_url, headers={"Authorization": "Bearer $ATLASCLOUD_API_KEY"})
        result = response.json()

        if result["data"]["status"] in ["completed", "succeeded"]:
            print("Generated video:", result["data"]["outputs"][0])
            return result["data"]["outputs"][0]
        elif result["data"]["status"] == "failed":
            raise Exception(result["data"]["error"] or "Generation failed")
        else:
            # Still processing, wait 2 seconds
            time.sleep(2)

video_url = check_status()

Instalar

Instale o pacote necessário para a sua linguagem de programação.

pip install requests

Autenticação

Todas as solicitações de API requerem autenticação por meio de uma chave de API. Você pode obter sua chave de API no painel do Atlas Cloud.

export ATLASCLOUD_API_KEY="your-api-key-here"

Cabeçalhos HTTP

import os

API_KEY = os.environ.get("ATLASCLOUD_API_KEY")
headers = {
    "Content-Type": "application/json",
    "Authorization": f"Bearer {API_KEY}"
}

Mantenha sua chave de API segura

Nunca exponha sua chave de API em código do lado do cliente ou repositórios públicos. Use variáveis de ambiente ou um proxy de backend.

Enviar uma solicitação

import requests

url = "https://api.atlascloud.ai/api/v1/model/generateVideo"
headers = {
    "Content-Type": "application/json",
    "Authorization": "Bearer $ATLASCLOUD_API_KEY"
}
data = {
    "model": "your-model",
    "prompt": "A beautiful landscape"
}

response = requests.post(url, headers=headers, json=data)
print(response.json())

Enviar uma solicitação

Envie uma solicitação de geração assíncrona. A API retorna um ID de predição que você pode usar para verificar o status e obter o resultado.

POST/api/v1/model/generateVideo

Corpo da solicitação

import requests

url = "https://api.atlascloud.ai/api/v1/model/generateVideo"
headers = {
    "Content-Type": "application/json",
    "Authorization": "Bearer $ATLASCLOUD_API_KEY"
}

data = {
    "model": "bytedance/avatar-omni-human-v1.5",
    "prompt": "A beautiful sunset over the ocean with gentle waves"
}

response = requests.post(url, headers=headers, json=data)
result = response.json()

print(f"Prediction ID: {result['data']['id']}")
print(f"Status: {result['data']['status']}")

Resposta

{
  "code": 200,
  "data": {
    "id": "pred_abc123",
    "status": "processing",
    "model": "model-name",
    "created_at": "2025-01-01T00:00:00Z"
  }
}

Verificar status

Consulte o endpoint de predição para verificar o status atual da sua solicitação.

GET/api/v1/model/prediction/{prediction_id}

Exemplo de polling

import requests
import time

prediction_id = "pred_abc123"
url = f"https://api.atlascloud.ai/api/v1/model/prediction/{prediction_id}"
headers = { "Authorization": "Bearer $ATLASCLOUD_API_KEY" }

while True:
    response = requests.get(url, headers=headers)
    result = response.json()
    status = result["data"]["status"]
    print(f"Status: {status}")

    if status in ["completed", "succeeded"]:
        output_url = result["data"]["outputs"][0]
        print(f"Output URL: {output_url}")
        break
    elif status == "failed":
        print(f"Error: {result['data'].get('error', 'Unknown')}")
        break

    time.sleep(3)

Valores de status

processingA solicitação ainda está sendo processada.

completedA geração está completa. As saídas estão disponíveis.

succeededA geração foi bem-sucedida. As saídas estão disponíveis.

failedA geração falhou. Verifique o campo de erro.

Resposta concluída

{
  "data": {
    "id": "pred_abc123",
    "status": "completed",
    "outputs": [
      "https://storage.atlascloud.ai/outputs/result.mp4"
    ],
    "metrics": {
      "predict_time": 45.2
    },
    "created_at": "2025-01-01T00:00:00Z",
    "completed_at": "2025-01-01T00:00:10Z"
  }
}

Enviar arquivos

Envie arquivos para o armazenamento do Atlas Cloud e obtenha uma URL que pode ser usada nas suas solicitações de API. Use multipart/form-data para enviar.

POST/api/v1/model/uploadMedia

Exemplo de upload

import requests

url = "https://api.atlascloud.ai/api/v1/model/uploadMedia"
headers = { "Authorization": "Bearer $ATLASCLOUD_API_KEY" }

with open("image.png", "rb") as f:
    files = {"file": ("image.png", f, "image/png")}
    response = requests.post(url, headers=headers, files=files)

result = response.json()
download_url = result["data"]["download_url"]
print(f"File URL: {download_url}")

Resposta

{
  "data": {
    "download_url": "https://storage.atlascloud.ai/uploads/abc123/image.png",
    "file_name": "image.png",
    "content_type": "image/png",
    "size": 1024000
  }
}

Schema de entrada

Os seguintes parâmetros são aceitos no corpo da solicitação.

Total: 0Obrigatório: 0Opcional: 0

Nenhum parâmetro disponível.

Exemplo de corpo da solicitação

{
  "model": "bytedance/avatar-omni-human-v1.5"
}

Schema de saída

A API retorna uma resposta de predição com as URLs de saída geradas.

idstringrequired

Unique identifier for the prediction.

statusstringrequired

Current status of the prediction.

processingcompletedsucceededfailed

modelstringrequired

The model used for generation.

outputsarray[string]

Array of output URLs. Available when status is "completed".

errorstring

Error message if status is "failed".

metricsobject

Performance metrics.

predict_timenumber

Time taken for video generation in seconds.

created_atstringrequired

ISO 8601 timestamp when the prediction was created.

Format: date-time

completed_atstring

ISO 8601 timestamp when the prediction was completed.

Format: date-time

Exemplo de resposta

{
  "id": "pred_abc123",
  "status": "completed",
  "model": "model-name",
  "outputs": [
    "https://storage.atlascloud.ai/outputs/result.mp4"
  ],
  "metrics": {
    "predict_time": 45.2
  },
  "created_at": "2025-01-01T00:00:00Z",
  "completed_at": "2025-01-01T00:00:10Z"
}

Atlas Cloud Skills

O Atlas Cloud Skills integra mais de 300 modelos de IA diretamente no seu assistente de codificação com IA. Um comando para instalar e depois use linguagem natural para gerar imagens, vídeos e conversar com LLM.

Clientes compatíveis

Claude Code

OpenAI Codex

Gemini CLI

Cursor

Windsurf

VS Code

Trae

GitHub Copilot

Cline

Roo Code

Amp

Goose

Replit

40+ clientes compatíveis

Instalar

npx skills add AtlasCloudAI/atlas-cloud-skills

Configurar chave de API

Obtenha sua chave de API no painel do Atlas Cloud e defina-a como variável de ambiente.

export ATLASCLOUD_API_KEY="your-api-key-here"

Funcionalidades

Após a instalação, você pode usar linguagem natural no seu assistente de IA para acessar todos os modelos do Atlas Cloud.

Geração de imagensGere imagens com modelos como Nano Banana 2, Z-Image e mais.

Criação de vídeosCrie vídeos a partir de texto ou imagens com Kling, Vidu, Veo, etc.

Chat com LLMConverse com Qwen, DeepSeek e outros grandes modelos de linguagem.

Upload de mídiaEnvie arquivos locais para fluxos de trabalho de edição de imagens e imagem para vídeo.

Saiba mais

github.com/AtlasCloudAI/atlas-cloud-skills

MCP Server

O Atlas Cloud MCP Server conecta seu IDE com mais de 300 modelos de IA através do Model Context Protocol. Funciona com qualquer cliente compatível com MCP.

Clientes compatíveis

Cursor

VS Code

Windsurf

Claude Code

OpenAI Codex

Gemini CLI

Cline

Roo Code

100+ clientes compatíveis

Instalar

npx -y atlascloud-mcp

Configuração

Adicione a seguinte configuração ao arquivo de configuração de MCP do seu IDE.

{
  "mcpServers": {
    "atlascloud": {
      "command": "npx",
      "args": [
        "-y",
        "atlascloud-mcp"
      ],
      "env": {
        "ATLASCLOUD_API_KEY": "your-api-key-here"
      }
    }
  }
}

Ferramentas disponíveis

atlas_generate_imageGere imagens a partir de prompts de texto.

atlas_generate_videoCrie vídeos a partir de texto ou imagens.

atlas_chatConverse com grandes modelos de linguagem.

atlas_list_modelsExplore mais de 300 modelos de IA disponíveis.

atlas_quick_generateCriação de conteúdo em uma etapa com seleção automática de modelo.

atlas_upload_mediaEnvie arquivos locais para fluxos de trabalho de API.

Saiba mais

github.com/AtlasCloudAI/mcp-server

API Schema

Schema não disponível

Sem exemplos disponíveis

Carregando...

Avatar Omni Human 1.5

Turn a single portrait photo into a lifelike, lip-synced talking video — driven entirely by an audio clip.

Avatar Omni Human 1.5 (OmniHuman) by ByteDance is a state-of-the-art digital-human video generation model. Give it one reference image of a person and an audio track, and it generates a natural, expressive video of that person speaking — with accurate lip sync, head motion, and facial expressions that match the audio.

Key Capabilities

Audio-driven lip sync — mouth movements precisely follow the speech in your audio.
Identity preservation — the generated person stays faithful to your reference image.
Natural motion — lifelike head pose, blinking, and micro-expressions, not a stiff talking head.
Multilingual — works with audio in many languages, including Chinese, English, Japanese, Korean, Spanish, and Indonesian.
High resolution — render output at up to 1080p.

How It Works

Provide a reference image (a clear photo of a person) and a driving audio clip (the speech to be spoken).
The model animates the person to "speak" the audio, producing a full talking-head video.
The output video's duration matches the length of your audio.

Generation is asynchronous: you submit a request and receive a task ID, then poll for the result. A typical clip takes a few minutes depending on audio length and resolution.

Inputs

Parameter	Required	Description
`image_url`	Yes	URL of the reference portrait. A clear, front-facing photo with a fully visible face works best.
`audio_url`	Yes	URL of the driving audio (speech). The generated video's length equals this audio's length.
`prompt`	No	Optional text hint for action / scene / expression. Supports Chinese, English, Japanese, Korean, Spanish, and Indonesian.
`output_resolution`	No	`720` (default) or `1080`.
`seed`	No	Fix the seed for reproducible output; `-1` for random.

Best Practices

Reference image: use a high-quality, well-lit, front-facing photo with one clearly visible face. Avoid heavy occlusion (hands or objects over the face), extreme angles, or faces that are too small in frame.
Audio: clean speech with minimal background noise yields the most accurate lip sync.
Single subject: for best results the reference image should contain a single, clear primary person.

Typical Use Cases

Virtual presenters and AI news anchors
Talking-avatar marketing and product explainers
Localized / dubbed spokesperson videos
Education and training content
Social-media avatars and digital influencers

Notes & Limitations

Output video length is bounded by the input audio length.
Quality depends heavily on input quality — blurry images or noisy audio reduce lip-sync accuracy.
Best suited to a single primary speaker; complex multi-person scenes are not the target use case.

Pricing

Billed at $0.12 per second of generated video (output duration = audio duration).

Powered by ByteDance OmniHuman 1.5, served through Atlas Cloud.

Avatar Omni Human 1.5 API by ByteDance

Entrada

Saída

Parâmetros

Exemplo de código

Instalar

Autenticação

Cabeçalhos HTTP

Enviar uma solicitação

Enviar uma solicitação

Corpo da solicitação

Resposta

Verificar status

Exemplo de polling

Valores de status

Resposta concluída

Enviar arquivos

Exemplo de upload

Resposta

Schema de entrada

Exemplo de corpo da solicitação

Schema de saída

Exemplo de resposta

Atlas Cloud Skills

Clientes compatíveis

Instalar

Configurar chave de API

Funcionalidades

MCP Server

Clientes compatíveis

Instalar

Configuração

Ferramentas disponíveis

API Schema

Avatar Omni Human 1.5

Key Capabilities

How It Works

Inputs

Best Practices

Typical Use Cases

Notes & Limitations

Pricing

Explorar Modelos Semelhantes

Seedance 2.0 Mini Reference-to-Video

Seedance 2.0 Mini Image-to-Video

Seedance 2.0 Mini Text-to-Video

Seedance 2.0 Fast Reference-to-Video

Seedance 2.0 Fast Image-to-Video

Seedance 2.0 Fast Text-to-Video

Seedance 2.0 Reference-to-Video

Seedance 2.0 Image-to-Video

Seedance 2.0 Text-to-Video

Seedance v1.5 Pro Image-to-Video

Seedance v1.5 Pro Text-to-Video

Seedance v1.5 Pro Image-to-Video Fast

Seedance v1.5 Pro Text-to-Video Fast

Seedance v1 Pro Fast Text-to-video

Seedance v1 Pro Fast Image-to-video

Seedance v1 Pro t2v 1080p

Uma API para toda a IA de mídia.

Join our Discord community

Entrada

Saída

Parâmetros

Exemplo de código

Instalar

Autenticação

Cabeçalhos HTTP

Enviar uma solicitação

Enviar uma solicitação

Corpo da solicitação

Resposta

Verificar status

Exemplo de polling

Valores de status

Resposta concluída

Enviar arquivos

Exemplo de upload

Resposta

Schema de entrada