Do esboço ao vídeo e ao 3D jogável
Por Oleg Sidorkin, CTO da Cinevva
Levar uma personagem de um esboço plano a um jogo 3D jogável costumava exigir um artista conceitual, um modelador 3D, um especialista em rigging, um animador e alguém para integrar tudo em uma engine. Queríamos descobrir quanto desse pipeline as ferramentas criativas da Cinevva conseguiriam fazer por conta própria. Veja o que descobrimos.
A personagem é Kali the Kitty, da Cubcoats, uma marca infantil que vendeu mais de um milhão de moletons de pelúcia com capuz por meio da Nordstrom, Amazon e Disney Store. A Cubcoats tem oito personagens originais com personalidades definidas, um mundo fictício em uma ilha e 14 patentes. A marca será relançada em 2026 como uma plataforma focada em licenciamento, e queríamos mostrar como essa propriedade intelectual fica quando vai além dos produtos físicos: um curta em vídeo vertical e uma personagem 3D com rig que você pode controlar em um navegador. Tudo abaixo é resultado real dessa exploração.
Arraste os visualizadores 3D para girar ao redor dos modelos. Role a tira de filme para ver como o curta vertical avança do primeiro ao último quadro.
Da ilustração plana de um livro a uma personagem que você pode girar
A Cubcoats já tinha lindas ilustrações 2D. A direção de arte de Mimi Chao deu a cada personagem uma aparência calorosa, arredondada e desenhada à mão, que funciona perfeitamente em moletons e livros infantis. Mas ilustrações planas não alimentam um pipeline 3D. Precisávamos de uma personagem em alta fidelidade que pudesse servir como referência para geração de vídeo, criação de malha e rigging, sempre mantendo o mesmo rosto.
Começamos enviando as ilustrações originais do livro ao nosso Gerador de Imagens e pedindo que ele produzisse uma versão renderizada em 3D da mesma personagem.

As proporções foram mantidas, a personalidade ficou evidente e o visual suave de desenho animado em 3D deu a todas as ferramentas das etapas seguintes uma referência consistente. A partir daí, refinamos a pose e o enquadramento exatos até termos uma referência principal definitiva.


A pose T é importante porque o rigging exige que os braços fiquem afastados do tronco. Ignore essa etapa e o sistema automático de rigging fundirá os braços ao corpo e desistirá do processo. Geramos a pose T a partir do mesmo visual definitivo da personagem para que a silhueta e as proporções permanecessem consistentes em todas as etapas.
Escreva a história antes de gerar qualquer coisa
Antes de usar as ferramentas de vídeo, escrevemos uma sequência narrativa em linguagem simples. O traço de personalidade de Kali no universo da Cubcoats é “Positiva”. É ela quem faz todos se sentirem incluídos e mantém o otimismo quando as coisas ficam difíceis. Por isso, criamos um arco de dez segundos em torno dessa ideia:
Kali entra em uma floresta escura e enevoada à noite, segurando uma pequena lanterna brilhante. Ela se assusta, senta-se sozinha e quase desiste. Então descobre uma árvore dourada mágica que se ilumina atrás dela. Encantamento, alegria e partículas douradas caindo como chuva. Do medo à esperança em um só instante.
Esse é o enredo inteiro. Ele não precisa ser complexo. Precisa encaixar uma virada emocional em uma única cena contínua, para que o quadro inicial e o quadro final realmente possam se conectar.
Dois quadros que delimitam toda a história
Geramos duas imagens-chave a partir desse enredo usando nosso Gerador de Imagens. Usamos a orientação vertical para corresponder ao formato do curta. Os prompts descrevem exatamente a mesma personagem em dois momentos diferentes.
Prompt do quadro inicial:
Renderização animada em 3D no estilo Pixar de Kali, uma pequena gatinha rosa com grandes olhos escuros e redondos, orelhas pontudas cor-de-rosa, barriga rosa-clara e um rosto alegre e arredondado. Ela está parada na entrada de uma floresta escura e enevoada à noite, segurando uma pequena lanterna brilhante com as duas patas. Suas orelhas estão levemente abaixadas e sua expressão é nervosa, mas determinada. Iluminação cinematográfica com a luz azul e fria da lua vindo de cima e o brilho laranja e quente da lanterna. Névoa densa entre troncos de árvores escuras ao fundo. Ângulo da câmera: plano médio, levemente baixo, olhando para cima em direção a ela. Sem texto, sem marca-d'água.
Prompt do quadro final:
Renderização animada em 3D no estilo Pixar de Kali, uma pequena gatinha rosa com grandes olhos escuros e redondos, orelhas pontudas cor-de-rosa e barriga rosa-clara. Ela está parada diante de uma enorme árvore mágica coberta por flores douradas brilhantes, com os braços bem abertos e um enorme sorriso radiante de alegria. Pétalas douradas flutuam no ar ao redor dela. A árvore irradia uma luz dourada e quente que ilumina toda a clareira da floresta. O céu noturno estrelado está visível acima. Ângulo da câmera: plano aberto visto levemente de baixo, com uma composição de revelação épica. Sem texto, sem marca-d'água.


O Seedance interpola entre esses dois extremos. A descrição da personagem permanece idêntica nos dois prompts para que o modelo saiba que se trata da mesma pessoa. Apenas a cena, a emoção e a câmera mudam.
O vídeo ficou melhor do que esperávamos
Carregamos os dois quadros no Gerador de Vídeos da Cinevva, escolhemos o Seedance 1.5 Pro, definimos a proporção 9:16 e a duração de 15 segundos, inserimos o enredo no prompt de movimento e clicamos em Gerar.

O clipe interpola entre os dois extremos. O áudio nativo foi gerado na mesma execução. Estes são alguns quadros capturados ao longo da linha do tempo.









Da esquerda para a direita: progressão do curta vertical gerado.
Usar os quadros inicial e final foi a opção certa quando precisávamos chegar a uma pose de encerramento exata. Para arcos emocionais mais longos, uma única referência acompanhada de um prompt funcionou bem com o modo storyboard Kling 3.0 Pro do Gerador de Vídeos. Configurações diferentes para trabalhos diferentes.
A mesma personagem, agora em 3D
É aqui que as coisas ficam interessantes. A imagem em pose T, pertencente à mesma família visual das referências do vídeo, foi enviada ao nosso Gerador de Modelos 3D para a geração de um modelo 3D a partir da imagem. O objetivo não é fazer a malha do jogo corresponder ao vídeo pixel por pixel. O objetivo é corresponder à memória do jogador. A personagem no jogo deve transmitir a mesma personalidade que ela transmite no vídeo. E, como definimos uma única identidade visual desde o início, foi exatamente isso que aconteceu.

O Gerador de Modelos 3D produz um arquivo GLB texturizado. Ele ainda não está pronto para um jogo, mas é claramente a Kali. A silhueta ficou correta. Os materiais ficaram próximos do esperado. Bom o bastante para seguir em frente.
Arraste estes modelos
Resultado bruto do Gerador de Modelos 3D. Sem rig, apenas uma malha texturizada. Ao lado, a mesma personagem após o rigging automático, com uma animação de caminhada incorporada.
Rigging e animação
O Gerador de Modelos 3D fornece uma malha. Para que essa malha se mova, ela precisa de um esqueleto e de animações. Nossa plataforma cuida do rigging automaticamente: envie o GLB e receba um modelo com rig e uma biblioteca completa de animações. Ciclos de caminhada, respiração em repouso, saltos e tudo mais de que uma personagem de jogo precisa.
A animação de caminhada padrão parecia quase certa, mas não totalmente. Os braços de Kali ficavam muito próximos do corpo, e sua cabeça se inclinava em um ângulo ligeiramente errado. Ambas as características faziam sentido para um humanoide genérico, mas não combinavam com uma gatinha arredondada de desenho animado. Por isso, adicionamos correções de ossos em tempo de execução no código do jogo: um deslocamento nos ombros para empurrar os braços para fora e uma correção na rotação da cabeça para eliminar a inclinação. Pequenos ajustes, grande diferença. Sem eles, ela parecia rígida e robótica. Com eles, ela voltou a parecer a Kali.
Controlando a personagem em um navegador
Colocamos o modelo com rig na Cinevva Engine. Câmera em terceira pessoa, movimentação com WASD, itens colecionáveis espalhados pelo cenário e câmera orbital quando a personagem está parada. Ajustar a transição entre as animações exigiu algumas iterações: crossfade entre repouso e caminhada, normalização da altura, correção do eixo frontal e ajustes nos deslocamentos dos ossos. A câmera em terceira pessoa atrás da personagem completa a jornada do esboço até algo que você pode controlar.
Experimente. Use WASD para se mover.
O que eu diria a quem fosse fazer isso amanhã
Defina um único visual para a personagem antes de usar qualquer ferramenta de geração. Cada minuto dedicado a acertar essa referência economiza uma hora tentando recuperar a consistência depois.
Primeiro, escreva um enredo curto. Depois, gere os quadros inicial e final com o Gerador de Imagens. Mantenha as imagens de referência dentro dos limites de tamanho da API. Use uma pose T criada a partir do mesmo sistema visual ao alimentar o Gerador de Modelos 3D.
Envie os dois quadros ao Gerador de Vídeos e deixe-o fazer a interpolação. Para a malha do jogo, aplique o rig ao modelo pela plataforma e ajuste os deslocamentos dos ossos em tempo de execução caso as animações padrão não se encaixem perfeitamente nas proporções da sua personagem.
Há dois anos, esse pipeline não existia. Você precisaria de uma equipe e de um orçamento. Agora, precisa de um esboço e das ferramentas criativas da Cinevva. Acredito que essa seja uma mudança significativa em quem pode dar vida a uma personagem.
Ferramentas da Cinevva utilizadas: Gerador de Imagens, Gerador de Vídeos, Gerador de Modelos 3D, rigging automático e Cinevva Engine. Conteúdo referente ao início de 2026.