--> Alibaba เปิดตัว Wan2.2-S2V สร้างสรรค์ภาพถ่ายให้มีชีวิต แปลงเสียงพูดเป็นวิดีโอ | NextTopBrand

Value Content$type=grid$count=9$meta=0$sn=0$rm=0$hide=post

Alibaba เปิดตัว Wan2.2-S2V สร้างสรรค์ภาพถ่ายให้มีชีวิต แปลงเสียงพูดเป็นวิดีโอ

Alibaba พัฒนา AI ได้รวดเร็วมาก อัปเดตเร็วที่สุด ล่าสุดได้เปิดตัว Wan2.2-S2V โมเดลโอเพ่นซอร์สสำหรับสร้างสรรค์ภาพถ่ายให้มีชีวิต ด้วยโมเดลแปลงเสียงพูดเป็นวิดีโอ (Speech-to-Video model) ที่เสมือนว่าเป็นบุคคลในภาพนิ่ง มาร้องเพลงแบบถ่ายทอดอารมณ์ได้สมจริง พร้อมน้ำเสียงที่ไพเราะเหลือเชื่อ

อาลีบาบา เปิดตัว Wan2.2-S2V (Speech-to-Video) โมเดลโอเพ่นซอร์สล่าสุดที่ออกแบบมาสำหรับการสร้างวิดีโอมนุษย์ดิจิทัล (digital human video) ที่สามารถแปลงภาพถ่ายบุคคลให้กลายเป็นอวทาร์คุณภาพระดับภาพยนตร์ที่พูด ร้องเพลง และแสดงท่าทางได้ 

โมเดลนี้เป็นส่วนหนึ่งของ Wan2.2 ซึ่งเป็นชุดโมเดลการสร้างวิดีโอของอาลีบาบา โมเดลนี้สามารถสร้างวิดีโอแอนิเมชันคุณภาพสูงจากภาพภาพเดียวและคลิปเสียงหนึ่งคลิป

Wan2.2-S2V มอบความสามารถด้านการสร้างแอนิเมชันตัวละครที่หลากหลาย รองรับการสร้างวิดีโอได้หลายมุมมอง ทั้งแบบพอร์ตเทรต ครึ่งตัว และเต็มตัว อีกทั้งยังสามารถสร้างการเคลื่อนไหวของตัวละครและองค์ประกอบแวดล้อมแบบไดนามิกตามคำสั่งที่กำหนด ช่วยให้ครีเอเตอร์สามารถถ่ายทอดภาพได้อย่างแม่นยำ ตรงตามเรื่องราวและการออกแบบ


โมเดลนี้สามารถสร้างตัวละครที่แสดงได้เสมือนจริง ตั้งแต่บทสนทนาที่เป็นธรรมชาติ ไปจนถึงการแสดงดนตรี โดยอาศัยเทคโนโลยีแอนิเมชันที่ขับเคลื่อนด้วยเสียงที่มีประสิทธิภาพสูง และยังจัดการกับตัวละครหลายตัวภายในฉากได้อย่างราบรื่น ครีเอเตอร์สามารถแปลงเสียงบันทึกให้เป็นภาพเคลื่อนไหวที่สมจริง รองรับอวทาร์ที่หลากหลาย ตั้งแต่การ์ตูนและสัตว์ ไปจนถึงตัวละครที่มีสไตล์เฉพาะตัว  

เทคโนโลยีนี้มอบความละเอียดของการแสดงผลที่ยืดหยุ่น ทั้ง 480P และ 720P เพื่อตอบโจทย์ความต้องการที่หลากหลายของคอนเทนต์ครีเอเตอร์มืออาชีพให้มั่นใจได้ว่าจะได้ภาพคุณภาพสูงที่ตรงตามมาตรฐานทางวิชาชีพและงานสร้างสรรค์ที่หลากหลาย จึงเหมาะอย่างยิ่งสำหรับคอนเทนต์บนสื่อโซเชียลและงานนำเสนอระดับมืออาชีพ 

นวัตกรรมทางเทคโนโลยีที่หลากหลาย

Wan2.2-S2V มีประสิทธิภาพเหนือแอนิเมชันแบบ talking-head ด้วยการผสมผสานการควบคุมการเคลื่อนไหวหลักในภาพรวมด้วยคำสั่งจากข้อความ และการเคลื่อนไหวเฉพาะจุดที่มีรายละเอียดสูงด้วยข้อมูลจากเสียงเข้าด้วยกัน ทำให้ตัวละครเคลื่อนไหวได้อย่างเป็นธรรมชาติและสื่ออารมณ์ได้อย่างลึกซึ้ง แม้ในสถานการณ์ที่ซับซ้อนและท้าทาย

เทคนิคการประมวลผลเฟรมที่เป็นนวัตกรรมของโมเดลนี้ เป็นอีกหนึ่งความล้ำหน้าสำคัญ เทคโนโลยีนี้ช่วยลดค่าใช้จ่ายในการประมวลผลได้อย่างมีนัยสำคัญ จากการบีบอัดเฟรมที่มีอยู่เดิมซึ่งมีความยาวแบบไม่จำกัดให้เป็นภาพแฝง (latent representation) ที่มีขนาดกะทัดรัดเพียงภาพเดียว ซึ่งช่วยให้สามารถสร้างวิดีโอยาว ๆ ที่มีความเสถียรได้อย่างน่าทึ่ง เป็นการจัดการกับความท้าทายสำคัญในการผลิตคอนเทนต์แอนิเมชันที่ขยายเพิ่มเติม

ความสามารถที่ก้าวล้ำของโมเดลได้รับการยกระดับให้โดดเด่นยิ่งขึ้นด้วยกระบวนการเทรนที่ครอบคลุม ทีมวิจัยของอาลีบาบาได้สร้างชุดข้อมูลภาพและเสียงขนาดใหญ่ที่ออกแบบมาเพื่อรองรับการผลิตภาพยนตร์และรายการโทรทัศน์โดยเฉพาะ Wan2.2-S2V ได้รับการเทรนด้วยความละเอียดหลายระดับ (multi-resolution) จึงสามารถรองรับการสร้างวิดีโอได้หลายรูปแบบอย่างยืดหยุ่น ไม่ว่าจะเป็นคอนเทนต์วิดีโอสั้นที่ถ่ายทำแบบแนวตั้ง ไปจนถึงงานผลิตภาพยนต์และรายการโทรทัศน์แบบเดิมที่ถ่ายทำเป็นแนวนอน 

Wan2.2-S2V พร้อมให้ดาวน์โหลดแล้วบน Hugging Face, GitHub และบน ModelScope ซึ่งเป็นคอมมิวนิตี้ด้านโอเพ่นซอร์สของอาลีบาบา คลาวด์ นอกจากนี้ในฐานะผู้มีส่วนร่วมสำคัญต่อชุมชนโอเพ่นซอร์สระดับโลก อาลีบาบาได้เปิดโอเพ่นซอร์สโมเดล Wan2.1 เมื่อเดือนกุมภาพันธ์ พ.ศ. 2568 และโมเดล Wan2.2 เมื่อเดือนกรกฎาคมที่ผ่านมา ปัจจุบันโมเดลที่อยู่ใน Wan series มียอดดาวน์โหลดรวมกว่า 6.9 ล้านครั้งบน Hugging Face และ ModelScope

COMMENTS

ชื่อ

$type=slider,3,Academic,2,Audio Video,331,Audio Visual,194,automotive,359,beauty,4,Business,275,CSR,35,Economic,9,Electronics,103,Entertainment,172,EV,146,FinTech,153,Food,122,Gallery,2,Health & Beauty,94,Home Appliance,148,InsurTech,15,Interview,6,IT & DeepTech,993,Lifestyle,289,Marketing,220,Mobile Device,1479,Motorbike,37,PR News,566,PropTech,55,Real Estate,361,Review,114,Sports,3,Telecom,223,Travel,6,
ltr
item
NextTopBrand: Alibaba เปิดตัว Wan2.2-S2V สร้างสรรค์ภาพถ่ายให้มีชีวิต แปลงเสียงพูดเป็นวิดีโอ
Alibaba เปิดตัว Wan2.2-S2V สร้างสรรค์ภาพถ่ายให้มีชีวิต แปลงเสียงพูดเป็นวิดีโอ
https://blogger.googleusercontent.com/img/b/R29vZ2xl/AVvXsEhLpKXcnOFB1z2YykxsvwbVpmDapBXfhh3vHZDcfZGeZKDivjuQIUQ42ylQG1PnKIgpRhh3fDNKfESYMNkrJUc6Y9bj09nUJ92p-icZ5eTwQ0tqs6lY0JzpPtKPLK_otp2drkZRgR0ZbYgfrJL0QpcfXLRRpxMHseR5vgX_T4Uf8sEer5qibrpw2ZTIUG8/s16000/popipi%5Bo%5Bpo.png
https://blogger.googleusercontent.com/img/b/R29vZ2xl/AVvXsEhLpKXcnOFB1z2YykxsvwbVpmDapBXfhh3vHZDcfZGeZKDivjuQIUQ42ylQG1PnKIgpRhh3fDNKfESYMNkrJUc6Y9bj09nUJ92p-icZ5eTwQ0tqs6lY0JzpPtKPLK_otp2drkZRgR0ZbYgfrJL0QpcfXLRRpxMHseR5vgX_T4Uf8sEer5qibrpw2ZTIUG8/s72-c/popipi%5Bo%5Bpo.png
NextTopBrand
https://www.nexttopbrand.com/2025/08/alibaba-wan22-s2v.html
https://www.nexttopbrand.com/
https://www.nexttopbrand.com/
https://www.nexttopbrand.com/2025/08/alibaba-wan22-s2v.html
true
673143005888157321
UTF-8
Loaded All Posts Not found any posts VIEW ALL Readmore Reply Cancel reply Delete By Home PAGES POSTS View All RECOMMENDED FOR YOU LABEL ARCHIVE SEARCH ALL POSTS Not found any post match with your request Back Home Sunday Monday Tuesday Wednesday Thursday Friday Saturday Sun Mon Tue Wed Thu Fri Sat January February March April May June July August September October November December Jan Feb Mar Apr May Jun Jul Aug Sep Oct Nov Dec just now 1 minute ago $$1$$ minutes ago 1 hour ago $$1$$ hours ago Yesterday $$1$$ days ago $$1$$ weeks ago more than 5 weeks ago Followers Follow THIS PREMIUM CONTENT IS LOCKED STEP 1: Share. STEP 2: Click the link you shared to unlock Copy All Code Select All Code All codes were copied to your clipboard Can not copy the codes / texts, please press [CTRL]+[C] (or CMD+C with Mac) to copy