NEWO seu próximo anúncio UGC viral está a apenas um clique. Conheça o Studio.Criar anúncio
PopcraftPopcraft
Novo modelo

Seedance 2.5 · ByteDance

Trinta segundos, numa única geração

Um anúncio inteiro, uma demonstração de produto ou o ritmo de uma cena é retornado como uma geração de trinta segundos em vez de cinco clipes e uma junção — mantido coeso por até cinquenta ativos de referência e editado posteriormente sem necessidade de regerar.

Disponível no Popcraft, ao lado do Seedance 2.0.

30sem uma única geração
50ativos de referência por trabalho
10+idiomas, nativamente
Em comparação com o Seedance 2.0
Geração única mais longa
15s30s
Imagens de referência
930
Clipes de referência, vídeo + áudio
310 + 10
Proporção de tela de saída
6 fixos0,4–2,5
Modelos de vídeo no Popcraft

Trinta segundos, duas vezes

Dois dos filmes de demonstração da própria ByteDance, na duração para a qual o modelo foi concebido. Cada um é uma única geração — imagem, mudanças de câmera e som chegam juntos, sem nada montado depois.

Seedance 2.51920×108029.98sCom somUma esquina de rua, de ponta a ponta. Uma única geração, com a música e o som da rua chegando junto com a imagem. A câmera muda de enquadramento nove vezes dentro dela — nível da rua, vista aérea do cruzamento, planos fechados de rostos, um plano aberto em contraluz — e nenhuma dessas mudanças é uma junção entre gerações. Este é o filme reproduzido silenciosamente atrás do título no topo da página. Aqui, ele tem som.
Seedance 2.51280×72030.04sCom somUm vídeo explicativo com início, meio e fim. A história do dinheiro num único cenário de massa de modelar — escambo, moeda, cédula, banco, um pagamento por aproximação — ao longo de nove momentos encenados que mantêm o material, a iluminação e a escala do início ao fim.

O que procurar neles

Os quatro avanços são os detalhes que decidem se uma tomada parece uma filmagem real ou um resultado gerado.

Iluminação

Luz que obedece ao ambiente

Os reflexos nos olhos parecem vidro com profundidade, e a direção, a atenuação e a reflexão seguem a física da cena em vez de parecerem pintados.

Câmera

Movimentos que mantêm a linha

As trajetórias de aproximação, afastamento, panorâmica e inclinação voltam mais suaves e estáveis, o que faz com que um movimento de trinta segundos se sustente ao longo de toda a sua duração.

Desempenho

Expressão como uma curva

Microexpressões — um tremor nos olhos, o pressionar dos lábios — conduzidas como movimento contínuo ao longo de todo o tempo, em vez de alternadas bruscamente entre poses.

Realismo

Pele, cabelo e a lacuna da estranheza

Textura da pele, brilho do cabelo e pequenos movimentos faciais mais próximos de como uma câmera os registra, com menos do aspecto plástico que denuncia um rosto gerado.

Quatro coisas mudam, e apenas uma delas é a duração

O 2.5 avança em quatro eixos: gerações mais longas, referências mais ricas, edição precisa e criação multilíngue. A duração é o grande destaque. A edição é a mudança que realmente se sente no dia a dia de trabalho.

Duração
30s uma geração

Trinta segundos a partir de uma única geração

Até trinta segundos em uma única geração, mantendo o movimento de câmera, a continuidade e um arco narrativo completo em todo o clipe. O Seedance 2.0 atinge no máximo quinze. A Extensão Temporal de Alta Fidelidade avança ou recua um clipe curto, ou conecta dois deles.

Referências
50 ativos por tarefa

Tudo o que a cena precisa, em um único briefing

Trinta imagens, dez clipes de vídeo e dez clipes de áudio podem ser incluídos numa única geração — elenco, produto, local, comportamento da câmera, música e voz juntos. Na versão 2.0, esse limite era de nove imagens e três clipes.

Edição
Local reescritas

Altere um detalhe, mantenha o clipe

A Edição de Vídeo Controlável mantém o enquadramento, a câmera e o ritmo, e reescreve apenas o que você especificar: um fundo, uma peça de roupa, um produto, a expressão de um ator, a música. Uma falha em trinta segundos bons deixa de ser motivo para gerar tudo de novo.

Idioma
10+ idiomas

Descreva com suas próprias palavras

Chinês, inglês, espanhol, indonésio, malaio, tailandês, árabe, português, vietnamita, japonês e coreano, entre outros, nativamente — o prompt não precisa mais ser traduzido antes que o modelo o leia. O cumprimento de instruções está mais forte em todos os aspectos.

2.5 ao lado de 2.0, linha por linha

O Seedance 2.0 continua na linha e, em 4K, ainda é a ferramenta certa para um plano curto.

CapacidadeSeedance 2.0Seedance 2.5
Geração única mais longa15s30s
Imagens de referência930
Clipes de vídeo e áudio de referência310 de vídeo + 10 de áudio
Duração total de referência15s30s de vídeo, 30s de áudio, contados separadamente
Referência apenas de áudioSuportado
Marcações de tempo no promptApenas números de planoMarcas de tempo em segundos inteiros
Imagens do sujeito em múltiplos ângulosNão recomendadoSuportado
Proporção de tela de saídaSeis proporções fixasQualquer proporção de 0,4 a 2,5, definida pela entrada
Saída em MOV, para edição e extensãoSuportado — continuidade de cor e áudio na junção

Cada recurso chega com uma função

A contagem é a parte fácil. O que o torna útil é que cada ativo é anexado com um símbolo @ e recebe uma função declarada, para que o modelo saiba qual imagem é o ator e qual é a iluminação.

Imagens
30 por tarefa

Até 4K, 30 MB cada. JPEG, PNG, WebP, BMP, TIFF, GIF, HEIC, HEIF. Conjuntos multivistas do mesmo assunto são suportados no 2.5, ao passo que o 2.0 os desaconselhava.

Clipes de vídeo
10 por tarefa

De 480p a 4K, 200 MB cada, 2–30s por clipe, MP4 ou MOV. Os clipes compartilham um total de trinta segundos.

Clipes de áudio
10 por tarefa

15 MB cada, 2–30s por clipe, MP3 ou WAV, com seu próprio total separado de trinta segundos. As referências apenas de áudio são novas no 2.5 — uma trilha musical de fundo, uma voz ou uma faixa de efeitos podem guiar o ritmo, a sincronização de batidas e a sincronização labial por conta própria.

O que uma referência pode transmitir

Sujeito
A aparência ou a voz de uma pessoa, animal, produto, objeto de cena, local ou personagem inventado — aquilo que precisa se manter igual durante todo o clipe.Use a mulher em @image 1 como personagem principal, caminhando por uma rua da cidade ao anoitecer.
Movimento
Ação, movimento de câmera, ritmo e efeitos extraídos de um clipe e aplicados a um sujeito diferente. Funciona entre diferentes espécies e estilos, não apenas entre tomadas.Siga o movimento de câmera e o ritmo de corrida em @video 1; o sujeito é @image 1.
Modelo branco
Um modelo 3D simples e sem textura orienta a coreografia da câmera e a composição da cena; os materiais finalizados, a iluminação e a atmosfera vêm de imagens estáticas. Uma geometria simples funciona melhor aqui do que um modelo detalhado.Renderize o movimento no modelo branco do @video 1; sujeito na @image 1, cena na @image 2.
Estilo
Paleta, gradação de cor e textura extraídas de uma imagem ou clipe, enquanto o elenco permanece o seu.Use a gradação noturna azul-fria de @video 1, mantendo a personagem principal de @image 1.
Áudio
Música, melodia, diálogo ou timbre vocal. Atribua uma voz para cada personagem e o filme responde falando com ela.A voz do pai: grave, pausada, de meia-idade. Referência @audio 1.
Storyboard
Um storyboard de vários quadros lido como um esboço de enredo. Quinze quadros ou menos, arte em traço preferencialmente a um quadro renderizado, e nenhum texto desenhado nos quadros. O resultado segue a história, e não o desenho quadro a quadro.Siga os quatro painéis em @image 1; o personagem é @image 2.
Quadros-chave
Uma imagem como primeiro quadro, duas como primeiro e último, ou um conjunto de quadros-chave independentes. Diferente de um storyboard, o resultado segue estes elementos de perto.A @image 1 é o primeiro quadro, a @image 5 é o último; leve-a do ambiente interno para o externo.
Plano aberto ao nível da rua: o protagonista com boné vermelho e fones de ouvido atravessa no semáforo.Plano fechado lateral: a mesma mulher passa por uma parede de tijolos, com o rosto de perfil.Plano aberto com luz de fundo: ela caminha em direção à câmera sob o sol baixo, com outras pessoas atrás dela.Plano geral final: ela está na travessia no final do filme com mais três pessoas.
Uma pessoa, quatro configurações, uma geração. Quatro quadros em ordem do filme de rua de trinta segundos acima: um plano aberto ao nível da rua, um perfil em close-up, uma aproximação em contraluz e um plano aberto final. Manter um rosto, uma peça de roupa e uma silhueta estáveis ao longo de todo o clipe é a função atribuída a uma referência de assunto quando você define os detalhes.
Um conjunto focado é melhor do que um completo. A qualidade depende da combinação e não da quantidade: mantenha os assuntos de imagem em oito ou menos, os assuntos de áudio e vídeo em cinco, e os clipes de referência na faixa de cinco a dez segundos, onde um clipe de dois segundos traz muito pouco e um de trinta segundos dilui o que importa. Onde os ativos competem, a prioridade são os personagens principais, depois os produtos e objetos-chave, depois o ambiente e, por fim, o estilo.

O re-roll deixa de ser a única opção

Ambas as capacidades utilizam um clipe finalizado como @video 1 e não alteram nada do que você não mencionar. A edição reescreve parte do que já existe. A extensão escreve o que vem antes ou depois.

Primeiro quadro do filme de rua: um cruzamento vazio em uma esquina ensolarada, algumas pessoas na calçada distante.Último quadro do filme de rua: quatro pessoas juntas no mesmo cruzamento no final do filme.
O primeiro e o último quadro do filme de rua de trinta segundos. A extensão é solicitada em uma destas duas bordas: escreva para trás no minuto anterior ao cruzamento vazio ou para a frente a partir do momento em que o grupo está. A edição funciona em tudo entre eles, mantendo o quadro e reescrevendo apenas o que você nomear.
Edição de vídeo controlável

Reescreva uma região, mantenha o resto

Adicione um sujeito, remova outro, troque uma peça de roupa ou uma cena em relação a uma imagem de referência, ou altere o áudio — uma trilha sonora diferente, um efeito adicionado, uma fala redublada. As marcas de tempo restringem a edição a uma janela: 0:02–0:05 e nada fora dela se move.

O padrão que funciona tem três partes: aponte para a origem, nomeie o objeto e a alteração, depois adicione uma cláusula de preservação para que o modelo não altere o restante do quadro.

Substitua a roupa escura do homem no @video 1\npela roupa da @image 2.\nMantenha todo o resto inalterado.
Extensão temporal de alta fidelidade

Escreva o que vem antes e depois

Estenda para a frente a partir do último quadro, para trás até o momento anterior ao primeiro, ou gere a ponte que falta entre dois clipes para que se unam. Personagem, cena e câmera mantêm-se ao longo da transição, e é possível solicitar que ela seja contínua tanto na imagem como no som.

A extensão é como seis segundos fortes se tornam trinta finalizados sem regenerar a parte que já funciona. MOV na entrada e MOV na saída é o caminho recomendado — mantém a consistência de cor, brilho e áudio ao longo da junção.

Comece a partir do quadro final do @video 1 e estenda\n6 segundos: ela sai do quadro, o céu escurece,\nas luzes da rua acendem uma a uma. Mantenha a transição fluida.

O que a entrada decide por você

O 2.5 divide as tarefas conforme os ativos de origem definam ou não o formato do resultado. O 2.0 não estabelece essa linha, e esta é a parte com mais probabilidade de surpreender quem estiver migrando.

TarefaProporção de telaDuração
EdiçãoBloqueado ao clipe de origemSegue a fonte, com margem de cerca de um terço de segundo
Primeiro quadro, ou primeiro e últimoBloqueado à imagem do primeiro quadroVocê define
ExtensãoBloqueado ao clipe de origemVocê define
Geração de referênciaAbertoVocê define
Storyboards e quadros-chaveAbertoVocê define
Forneça um primeiro e um último quadro nas mesmas dimensões. Onde eles diferirem, o último quadro é esticado para corresponder ao primeiro, sendo esse esticamento o modelo fazendo o que lhe foi instruído, em vez de uma falha a ser contornada no prompt.

Onde trinta segundos mostram seu valor

Os casos de uso do modelo dividem-se em cinco famílias. Quatro deles são tarefas que se tornam mais rápidas. O quinto só se torna possível quando uma geração dura tanto tempo.

História e narrativa

Uma cena que se desenrola

Um momento do enredo executado na íntegra em uma única geração, com um elenco mantido coeso por imagens estáticas de referência. Correções de continuidade — uma estrutura visível, um objeto disperso — tornam-se uma edição em vez de uma nova filmagem.

Publicidade e comércio

Um máster, depois todas as versões

Um corte principal e depois as versões: troque o SKU, o modelo, o texto na tela ou o mercado, mantendo a aparência do produto e o visual da marca bloqueados por referência. A locução segue nos idiomas que você precisa.

Conhecimento e explicação

Toda a ideia numa única tomada

Uma ideia explicada do início ao fim em trinta segundos, um apresentador substituído sem necessidade de regravação e o mesmo conjunto distribuído em vários idiomas.

Industrial

Um procedimento, do início ao fim

Etapas de montagem e operação exibidas de ponta a ponta, com placas de identificação, painéis de especificações e textos de embalagem reescritos por produto, mantendo a gravação original.

O que a duração extra possibilita

O trabalho que quinze segundos recusavam

Trailers de jogos e CG, apresentadores virtuais, um curta expandido para uma série, um personagem envelhecido ou com novo estilo para um corte sazonal.

A pré-visualização aplica-se a todas as cinco. Um esboço genérico em cinza — do tipo que um artista de layout faz em uma tarde — é usado como fonte de movimento, enquanto os materiais finalizados, a iluminação e a atmosfera vêm de imagens estáticas. A coreografia de câmera que você projetou é mantida na renderização, razão pela qual uma geometria simples funciona melhor aqui do que um modelo detalhado.

Escreva como uma lista de tomadas

Trate o modelo como um produtor que lê um briefing estruturado. O formato abaixo é o que sobrevive ao ser repassado a outra pessoa.

Duas figuras de argila trocam um velo por um vaso ao lado de uma fogueira.Um comerciante de argila numa banca de mercado segura um colar de conchas.Um martelo atinge uma moeda de ouro com o rosto de um rei sobre um bloco de madeira.Uma prensa tipográfica de argila imprime uma nota.Uma balança pesa uma nota contra um prato de moedas entre duas figuras.Um banqueiro senta-se numa mesa com pilhas de notas e um cofre atrás dele.Uma figura insere um cartão num terminal ao lado de uma pilha de barras de ouro.Uma figura aproxima um telefone de um leitor de cartão diante de um horizonte de néon.O diorama inteiro afastado: o cenário disposto de ponta a ponta numa mesa, quente numa extremidade e em neon na outra.
Nove quadros, em ordem, do filme de massa de modelar de trinta segundos acima. Escambo, moedas de concha, uma moeda cunhada, uma nota impressa, a balança, o banqueiro, o cofre, um toque por aproximação, o conjunto completo. É assim que uma lista de tomadas se parece depois de gerada: nove momentos, cada um com sua própria encenação, dentro de uma única tarefa.
A estrutura

Cinco partes, nesta ordem

Assunto, local, evento, gênero e estilo, movimento de câmera. Em seguida, uma sequência de planos — marcações de tempo em segundos inteiros ou planos numerados, ambos são lidos — descrevendo por segmento o que é visto, como a câmera se move, o que é dito e o que é ouvido. Conclua com as constantes: o ângulo, o ambiente, a atmosfera, o som de fundo.

Mantenha cerca de um segundo de história por segundo de tela. Pouco conteúdo em uma janela faz o modelo improvisar; muito conteúdo faz com que ele corte freneticamente ou descarte metade.

Os ativos

Mapeie cada um, no texto

Numere os ativos na ordem de envio e vincule cada um no prompt: qual é o sujeito, qual é a voz, qual é a ação, qual é a cena. Escrever um nome na imagem e usá-lo no prompt é a maneira confiável de obter dois do mesmo personagem.

Quando uma referência já for precisa, diga para segui-la e pare. Redescrever o movimento contido nela dá ao modelo duas instruções para reconciliar.

img1–2 são o personagem 1, dublado por @audio 1;\nimg3–4 são o personagem 2, dublado por @audio 2.\nSiga a ação de lançamento de feitiço em @video 1 e o\nmovimento de órbita em @video 2.
Linguagem de câmera
Termos padrão são inseridos como estão — tamanhos de plano, push in, pull out, pan, track, orbit, ângulo baixo, take único, dolly zoom, câmera na mão, speed ramp. Um termo de nicho precisa de uma explicação simples em seguida, e uma transição precisa do seu ponto de ativação e do seu método.
Ação e expressão
Descreva a maior parte da ação de forma geral e reserve os detalhes para os dois ou três momentos principais que precisam de impacto. As expressões são melhor interpretadas quando descritas por extenso do que nomeadas com uma expressão idiomática.
Positivo em vez de negativo
Diga o que deve estar presente. Instruções negativas são respeitadas quando se referem a legendas e áudio — sem legendas, sem música de fundo —, que também são os dois elementos que o modelo mais tende a adicionar sem ser solicitado.
Som
Ambiência, efeitos, diálogos e trilha sonora podem ser definidos a partir de uma referência de áudio e descritos nas instruções, incluindo qual deles deve dar lugar quando alguém fala.

Quanto custa um segundo do 2.5

O Seedance 2.5 é cobrado por segundo de vídeo gerado, na resolução que você escolher. As tarifas do nível do plano aplicam-se automaticamente — o desconto pertence ao plano e aplica-se a cada geração.

Taxa de lista, 720p
42 créditos / segundo

O custo de uma geração do Seedance 2.5 em 720p na tarifação padrão. 480p custa 24 créditos por segundo — a forma mais barata de iterar antes de uma passagem final.

Planos Pro
−40% na tarifa, anual

−20% na cobrança mensal. O desconto aplica-se a cada geração do Seedance, e não apenas uma vez.

Planos Max
−60% na tarifa, anual

−40% na cobrança mensal. A maior taxa de desconto e o motivo pelo qual vale a pena executar duas vezes uma geração de trinta segundos.

As tarifas atuais para cada modelo estão disponíveis na página de preços, que apresenta os valores efetivamente pagos pelo seu plano.

Perguntas

Sim — o Seedance 2.5 está disponível no seletor de modelos de vídeo do Popcraft. Escolha-o ao lado do Seedance 2.0, defina uma duração de até trinta segundos e gere.

Não. O Seedance 2.0 e o Seedance 2.0 4K permanecem na lista de modelos. Uma tomada de produto de seis segundos não precisa de um limite de trinta segundos, e a saída em 4K é um motivo para escolher o 2.0 para isso. O que o 2.5 adiciona é a duração, a quantidade de referências e a capacidade de editar um clipe que você já possui.

Cinquenta é o limite máximo, e a recomendação é ficar bem abaixo disso: oito ou menos sujeitos de imagem, cinco ou menos quando as referências principais forem áudio ou vídeo, clipes de cinco a dez segundos e storyboards de quinze quadros ou menos. Além desses limites, a estabilidade cai e as gerações começam a precisar de repetições.

Pegue um clipe de que você já gosta e estenda-o. A extensão é o teste mais barato dessa afirmação, pois começa a partir de um material que você já aprovou. Se a emenda se mantiver — o rosto, a gradação de cor, a velocidade da câmera —, vale a pena investir numa geração mais longa para o restante das promessas do modelo. Se não se mantiver, você descobriu isso pelo preço de poucos segundos.

Trinta segundos é o anúncio inteiro

A junção entre dois clipes de quinze segundos é onde um filme gerado se revela. O Seedance 2.5 torna essa junção opcional.

Continue explorando

Modelos relacionados