Licon MSR V2 for LTX-2.3

LTX-2.3 MSR V2 เป็นโมเดลสร้างวิดีโอ AI ใหม่จาก LiconStudio ที่มุ่งแก้ปัญหาความต่อเนื่องของตัวละครและฉาก โดยใช้ภาพอ้างอิง 2–5 รูปเพื่อให้ระบบจำรายละเอียดได้แม่นยำขึ้นและลดอาการหน้าดริฟท์หรือภาพกระตุก เวอร์ชันนี้รองรับการรวมตัวละครและองค์ประกอบจากหลายภาพในวิดีโอเดียว พร้อมเข้าใจตำแหน่ง การโต้ตอบ และลำดับเหตุการณ์ได้ดีขึ้น โดยแนะนำให้ใช้งานผ่าน ComfyUI และเขียนพรอมป์ให้ชัดเจนเกี่ยวกับบทบาทของแต่ละภาพ LTX-2.3 MSR V2 โมเดล AI สร้างวิดีโอรุ่นใหม่ คุมหน้าตัวละครและฉากได้นิ่งขึ้น ปัญหาใหญ่อย่างหนึ่งของการใช้ AI สร้างวิดีโอ (Video Generation) คือเรื่องความต่อเนื่อง ไม่ว่าจะเป็นหน้าตัวละครที่เปลี่ยนไปเรื่อยๆ ทุกวินาที หรือการสั่งให้ตัวละคร 2 ตัวจากคนละรูปมาอยู่ในฉากเดียวกันแล้ว AI ทำออกมาเลอะเทอะ ล่าสุดทาง LiconStudio ได้ปล่อยโมเดล LTX-2.3 Multiple Subject Reference เวอร์ชัน 2 (MSR V2) ออกมาบน Hugging Face ซึ่งทำมาเพื่อแก้ปัญหานี้โดยเฉพาะ จุดเด่นและหลักการทำงาน โมเดลนี้ใช้วิธีนำรูปต้นแบบ…

Photographer

LTX-2.3 MSR V2 เป็นโมเดลสร้างวิดีโอ AI ใหม่จาก LiconStudio ที่มุ่งแก้ปัญหาความต่อเนื่องของตัวละครและฉาก โดยใช้ภาพอ้างอิง 2–5 รูปเพื่อให้ระบบจำรายละเอียดได้แม่นยำขึ้นและลดอาการหน้าดริฟท์หรือภาพกระตุก

เวอร์ชันนี้รองรับการรวมตัวละครและองค์ประกอบจากหลายภาพในวิดีโอเดียว พร้อมเข้าใจตำแหน่ง การโต้ตอบ และลำดับเหตุการณ์ได้ดีขึ้น โดยแนะนำให้ใช้งานผ่าน ComfyUI และเขียนพรอมป์ให้ชัดเจนเกี่ยวกับบทบาทของแต่ละภาพ

LTX-2.3 MSR V2 โมเดล AI สร้างวิดีโอรุ่นใหม่ คุมหน้าตัวละครและฉากได้นิ่งขึ้น

ปัญหาใหญ่อย่างหนึ่งของการใช้ AI สร้างวิดีโอ (Video Generation) คือเรื่องความต่อเนื่อง ไม่ว่าจะเป็นหน้าตัวละครที่เปลี่ยนไปเรื่อยๆ ทุกวินาที หรือการสั่งให้ตัวละคร 2 ตัวจากคนละรูปมาอยู่ในฉากเดียวกันแล้ว AI ทำออกมาเลอะเทอะ

ล่าสุดทาง LiconStudio ได้ปล่อยโมเดล LTX-2.3 Multiple Subject Reference เวอร์ชัน 2 (MSR V2) ออกมาบน Hugging Face ซึ่งทำมาเพื่อแก้ปัญหานี้โดยเฉพาะ

จุดเด่นและหลักการทำงาน

โมเดลนี้ใช้วิธีนำรูปต้นแบบ (Reference) จำนวน 2 ถึง 5 รูป มาแปลงให้เป็นข้อมูลภาพเสมือน แล้วใส่เข้าไปในกระบวนการประมวลผลของวิดีโอโดยตรง ทำให้ AI สามารถจดจำรายละเอียดเล็กๆ ของแต่ละรูปได้ดีขึ้น โดยไม่ต้องติดตั้งโปรแกรมเสริมหนักๆ เพิ่มเติม

Woman in a red striped sweater, jeans, and yellow headphones shown from front, side, back, and close-up views

สิ่งที่ปรับปรุงใหม่ใน เวอร์ชัน 2 (V2)

  1. หน้าตัวละครและเสื้อผ้าเป๊ะขึ้น: AI เก็บรายละเอียดของตัวละครได้แม่นยำขึ้น หน้าไม่ดริฟท์หรือไม่เปลี่ยนไปมาระหว่างเล่นวิดีโอ
  2. เฟรมนิ่งขึ้น: ลดอาการภาพกระตุก (Flickering) และความไม่สมบูรณ์ของภาพ ทำให้การเคลื่อนไหวดูเป็นธรรมชาติตามเวลา
  3. เข้าใจบริบทและฉากดีขึ้น: AI เข้าใจตำแหน่งการวางตัวละครและฉากได้ดีขึ้น เช่น ตำแหน่งซ้าย-ขวา ลำดับการเกิดเหตุการณ์ และการปฏิสัมพันธ์ระหว่างตัวละคร

ทำอะไรได้บ้าง

  • ดึงเอกลักษณ์จากหลายรูปมารวมกัน: สามารถใส่รูปตัวละคร A และรูปตัวละคร B เพื่อให้เข้ามาอยู่ในวิดีโอเดียวกันได้
  • ผสมคุณลักษณะจากหลายรูป: เช่น เลือกเอาหน้าจากรูปแรก ใส่เสื้อผ้าจากรูปที่สอง และใช้ฉากหลังจากรูปที่สาม
  • เข้าใจคำสั่งเชิงปฏิสัมพันธ์: สั่งให้ตัวละครทำท่าทางใส่กัน เช่น ยื่นของให้กัน หรือเดินเข้าหากันได้อย่างแม่นยำขึ้น

ข้อแนะนำสำหรับการใช้งาน

  • โมเดลนี้ใช้งานผ่าน ComfyUI ร่วมกับปลั๊กอิน ComfyUI-Licon-MSR
  • ควรเขียน Prompt อธิบายบทบาทของแต่ละรูปให้ชัดเจนและกระชับ
  • หากเป็นวิดีโอที่มีการเคลื่อนไหวเร็ว แนะนำให้ตั้งค่าที่ 50 fps เพื่อความลื่นไหล

ถือเป็นอีกหนึ่งโมเดลที่ช่วยให้คนที่ทำคอนเทนต์วิดีโอด้วย AI ทำงานได้ง่ายขึ้น และควบคุมคุณภาพของผลงานได้นิ่งกว่าเดิมมากครับ

อ้างอิง: https://huggingface.co/LiconStudio/LTX-2.3-Multiple-Subject-Reference


Leave a Reply

Your email address will not be published. Required fields are marked *