ฝ่ายขาย และการตลาด
085-848-2253[email protected]http://m.me/beartai
สมัครงาน/ฝึกงาน ติดต่อได้ที่
[email protected]
Read
Alibaba

Alibaba ‘EMO’ โมเดล AI สร้างวิดีโอร้องเพลงได้จากรูปภาพ แสดงสีหน้าได้แบบสมจริง!

Table of Content

สถาบัน Intelligent Computing ของ Alibaba ได้เปิดตัว ‘EMO’ (Emote Portrait Alive) โมเดล AI ที่สามารถสร้างวิดีโอร้องเพลงหรือการพูดได้จากภาพเพียงภาพเดียว

สำหรับ EMO เป็นเป็นเทคโนโลยี ‘Expressive Audio-Driven Portrait-Video Generation Framework’ ที่เราสามารถใส่รูปกับเสียงเข้าไป แล้วตัว AI จะเปลี่ยนภาพนิ่งใบนั้นเป็นวิดีโอที่ขยับพูดคุยหรือร้องเพลงได้ตรงกับเสียงที่เราใส่เข้าไปนั้นเองครับ แถมไม่ได้เป็นการขยับปากให้ตรงกับเสียงเฉย ๆ แต่ยังมีการแสดงสีหน้าอารมณ์ที่สมจริงด้วย โดยสามารถสร้างวิดีโอที่ความยาวสูงสุด 1 นาที 30 วินาที

Alibaba

ตัว EMO ยังรองรับการใช้งานในหลากหลายภาษา และใช้งานได้กับสไตล์ศิลปะหลายหลายประเภทเลยครับ ไม่ว่าจะเป็นภาพถ่าย ภาพวาด หรือแม้กระทั้งอนิเมะ และ 1 ในตัวอย่างที่ทีมทำออกมาโชว์ดูเหมือนเป็นการข้ามค่ายหน่อย ๆ ก็คือการนำภาพผู้หญิงใส่แว่นกันแดดในการเปิดตัวของ OpenAi ‘Sora’ มาร้องเพลง ‘Don’t Start Now’ ของ ดูอา ลิปา (Dua Lipa)

รายละเอียดการวิจัยทั้งหมดของ EMO สามารถดูได้ที่เว็บไซต์ Github พร้อมกับบทความวิจัยที่เกี่ยวข้องที่ ArXiv ครับ

Highlight

สตาร์ตอัปไทยสร้างได้แล้ว…โจทย์ต่อไปคือ “โตให้ถึงโลก” เมื่อ SITE 2027 ตั้งเป้า Scale Up to Global

24/07/2026
Read More

ทรัมป์ตั้งกำแพงภาษีรอบใหม่กับกว่า 60 ประเทศ รวมไทย อ้างปม ‘แรงงานบังคับ’

24/07/2026
Read More

พบยาต้านเศร้าในสมองฉลาม : เมื่อยารักษาใจมนุษย์ กลับเป็นมลพิษต่อสัตว์ทะเล ?

24/07/2026
Read More

นักวิจัยพบ ยาลดน้ำหนักอาจชะลอความแก่ในผู้ป่วย

24/07/2026
Read More

แต่ทำไม “รถบิน” ถึงยังดูเกินฝัน ?​

24/07/2026
Read More

ความรู้สึกแรกหลังขับ DENZA Z9GT หรู-แรง-เฉียบ

23/07/2026
Read More

Related Content