या साइटवरील सामग्री कृत्रिम बुद्धिमत्ता (AI) किंवा मशीन भाषांतर तंत्रज्ञानाचा वापर करून भाषांतरित केली आहे आणि त्यात त्रुटी असू शकतात.

Skip to content

शब्दांपासून जगांपर्यंत: LLM एजंटांसह एक-ओळीच्या सूचना बहु-मोडल डिजिटल कथांमध्ये रूपांतरित करणे

View Publication

Author

डानरुई ली (रटगर्स विद्यापीठ), सॅम्युअल एस. सोहन (रटगर्स विद्यापीठ), सेन झांग (रटगर्स विद्यापीठ), चे-ज्यूई चांग (रटगर्स विद्यापीठ), मुब्बसीर कापाडिया (रॉब्लॉक्स)

Venue

ACM SIGGRAPH मोशन, इंटरॅक्शन आणि गेम्स २०२४

Abstract

मनोरंजन, शिक्षण आणि विपणन या क्षेत्रांमध्ये अत्यावश्यक असलेल्या डिजिटल स्टोरीटेलिंगला उत्पादनक्षमतेच्या वाढी आणि लवचिकतेच्या बाबतीत आव्हानांना सामोरे जावे लागते. या पेपरमध्ये सादर केलेले स्टोरीएजंट फ्रेमवर्क डिजिटल स्टोरीटेलिंगचे स्वयंचलन आणि परिष्करण करण्यासाठी लार्ज लँग्वेज मॉडेल्स आणि जनरेटिव्ह साधनांचा वापर करते. टॉप-डाउन कथा मसुदा आणि बॉटम-अप मालमत्ता निर्मिती या दृष्टिकोनाचा अवलंब करून, स्टोरीएजंट हाताने हस्तक्षेप, परस्परसंवादी दृश्य रचना आणि कथानक सुसंगतता यांसारख्या मुख्य समस्या हाताळतो. हा फ्रेमवर्क अनेक माध्यमांमध्ये परस्परसंवादी आणि सुसंगत कथानकांचे कार्यक्षम उत्पादन सक्षम करतो, सामग्री निर्मितीचे लोकशाहीकरण करतो आणि सहभाग वाढवतो. आमच्या निकालांनुसार, हा फ्रेमवर्क संदर्भ व्हिडिओशिवाय सुसंगत डिजिटल कथा तयार करण्याची क्षमता दर्शवितो, जे स्वयंचलित डिजिटल कथाकथनात एक महत्त्वपूर्ण प्रगती दर्शवते.