El contenido de este sitio se ha traducido mediante inteligencia artificial (IA) o tecnología de traducción automática, y puede contener errores.

Skip to content

De las palabras a los mundos: cómo convertir indicaciones de una sola línea en historias digitales multimodales con agentes LLM

View Publication

Author

Danrui Li (Universidad de Rutgers), Samuel S. Sohn (Universidad de Rutgers), Sen Zhang (Universidad de Rutgers), Che-Jui Chang (Universidad de Rutgers), Mubbasir Kapadia (Roblox)

Venue

ACM SIGGRAPH Motion, Interaction, and Games 2024

Abstract

La narración digital, esencial en el entretenimiento, la educación y el marketing, se enfrenta a retos en cuanto a la escalabilidad y la flexibilidad de la producción. El marco StoryAgent, presentado en este artículo, utiliza modelos de lenguaje a gran escala y herramientas generativas para automatizar y perfeccionar la narración digital. Mediante un enfoque de redacción de historias de arriba abajo y de generación de activos de abajo arriba, StoryAgent aborda cuestiones clave como la intervención manual, la orquestación de escenas interactivas y la coherencia narrativa. Este marco permite la producción eficiente de narrativas interactivas y coherentes en múltiples modalidades, democratizando la creación de contenidos y mejorando la participación. Nuestros resultados demuestran la capacidad del marco para producir historias digitales coherentes sin vídeos de referencia, lo que supone un avance significativo en la narración digital automatizada.