Skip to content

Tencent leva o Motus à Gamescom: uma família de modelos para rigging, skinning e movimento

A Tencent Games participou da Gamescom pela primeira vez como fornecedora de tecnologia neste ano, e a parte do estande que nos interessou foi o Motus. Em 24 de agosto, na gamescom dev, o líder técnico Zijiao Zeng apresentou uma palestra intitulada "Dando vida à geometria 2.0: avanços no pipeline unificado de IA para animação de personagens 3D" e, em 27 de agosto, a Tencent publicou o comunicado que descreve o que é o Motus.

Em resumo: trata-se de uma família de modelos fundacionais de animação generativa conectados em um único pipeline, que começa com uma malha estática e termina com um personagem se movimentando em um jogo. Rigging, skinning, geração de movimentos a partir de texto, vídeo ou quadros-chave, correção de movimentos e interação em tempo real fazem parte do mesmo sistema. O argumento é que "o tempo economizado com IA pode ser perdido na troca de ferramentas e nas correções manuais", portanto, a forma de realmente ganhar tempo é parar de trocar de ferramenta.

O que cada etapa promete

A etapa de rigging analisa a topologia de um personagem e, segundo a Tencent, produz um esqueleto pronto para produção "em segundos". Em seguida, calcula os pesos de skinning para que músculos, roupas e partes anexadas se deformem de maneira natural. A geração de movimentos aceita um prompt de texto, um vídeo de referência ou alguns quadros-chave e produz o clipe, incluindo animações com vários personagens para cenários de combate, cooperação e interação social nos quais dois ou mais rigs precisam reagir uns aos outros.

O pipeline Motus, etapa por etapaConforme descrito no comunicado da Tencent de 27 de agosto.1 · RIGEsqueleto a partirda topologia"em segundos"2 · SKINNINGPesos paramúsculos, roupase partes anexadas3 · GERARMovimento a partirde texto, vídeo ouquadros-chavevários personagens4 · REFINARCorrigir tremores,interpenetração epés deslizandoanomalias articulares5 · INTERAGIRÁudio ou textocontrola rosto ecorpo ao vivoNPCs, apresentadores

A etapa que eu destacaria é a de refinamento. A Tencent afirma que o Motus detecta e corrige automaticamente tremores, interpenetração da malha, articulações anormais e deslizamento dos pés. Quem já gerou movimentos com um modelo sabe que é nesses quatro pontos que o tempo vai embora. O clipe parece bom em um visualizador, mas então o calcanhar desliza dois centímetros enquanto deveria estar apoiado, ou uma mão atravessa uma coxa durante um giro, e alguém passa uma tarde ajustando curvas para corrigir o problema. Um gerador que se recusa a entregar o clipe até que ele passe por essas verificações é um produto diferente de um gerador que produz belas visualizações giratórias.

A última etapa transforma áudio ou texto em expressões faciais, movimentos corporais e respostas em tempo real, com foco em NPCs, humanos digitais e apresentadores virtuais. Essa é a parte que conecta o Motus ao outro anúncio da Tencent no evento, o GIGA, um conjunto de agentes gerais para jogos treinados para jogar ao lado de seres humanos.

Onde ele já é usado e quem pode utilizá-lo

O próprio comunicado diz apenas que o Motus "foi aplicado em diversos títulos". A cobertura do PC Guide e do Digital Citizen completou a lista: Game for Peace, PUBG Mobile, Delta Force, Honor of Kings, Roco Kingdom, League of Legends e Teamfight Tactics. Esses estão entre os jogos mais jogados do planeta, portanto, não se trata de uma demonstração de pesquisa à procura do primeiro cliente.

Estande da Tencent Games Central Tech na gamescom dev, com painéis do Motus, GIGA, MagicDawn e outras ferramentas, além de uma multidão de participantes

O estande da Tencent Games Central Tech na gamescom dev. O Motus dividiu a parede com o GIGA, o MagicDawn e o WeTest. Foto: Tencent Games.

O Motus era apenas um dos painéis em uma parede mais ampla. A Tencent aproveitou o evento para apresentar a Central Tech como uma marca para suas ferramentas internas: o GIGA para agentes de jogos; o MagicDawn, que, segundo a empresa, transformou Roco Kingdom em um mundo aberto multiplataforma de 64 quilômetros quadrados; o Acorn AI Studio da WeTest, voltado para agentes que testam jogos como seres humanos; além do GVoice e do sistema Anti-Cheat Expert. Nenhum deles veio acompanhado de uma página de cadastro. Nada em nenhum dos dois comunicados diz que o Motus será oferecido a estúdios de fora da Tencent, e nada diz que não será.

Isso importa porque a Tencent tem um amplo histórico de projetos de código aberto em outras áreas. Tanto o modelo de linguagem Hunyuan HY3 quanto a linha de geração Hunyuan3D foram lançados com seus pesos. O Motus pertence a uma divisão diferente, com um histórico diferente, e os jogos que ele equipa fazem parte da vantagem competitiva da própria Tencent, portanto, eu não presumiria que ele seguirá o mesmo caminho.

Por que estamos lendo as letras miúdas

Executamos o mesmo pipeline em uma aba do navegador. Nosso gerador automático de rigs ajusta um esqueleto e pesos de skinning a uma malha enviada, a biblioteca de animações redireciona 260 clipes em domínio público para esse esqueleto e a ferramenta de texto para movimento gera um clipe a partir de uma frase. Passamos a maior parte deste verão trabalhando exatamente nos problemas que a Tencent inclui na etapa de refinamento, desde fixar no chão pés que deslizam até impedir que as mãos de um personagem atravessem seu próprio corpo durante um giro rápido.

Portanto, a reação sincera envolve duas coisas ao mesmo tempo. A descrição da Tencent sobre qual é a parte difícil corresponde exatamente à nossa experiência, o que é reconfortante. Ao mesmo tempo, uma empresa com esses jogos e esses dados possui um conjunto de treinamento para movimentos que ninguém fora de um punhado de grandes publishers consegue igualar, o que reforça que o caminho aberto e baseado em domínio público que escolhemos é o caminho realmente disponível para todos os demais. Se o Motus algum dia for lançado como produto, vamos testá-lo no mesmo dia. Até lá, a lição útil da Gamescom é que o formato do pipeline está convergindo: criar o rig, aplicar o skinning, gerar e então concentrar o trabalho de verdade na correção.

Referências