สิ่งที่ H3 นำมาสู่โต๊ะ
ตามรายงานของ Reuters รุ่น H3 ของ MiniMax สามารถสร้างคลิปวิดีโอที่ความละเอียด 2K ซึ่งเป็นก้าวที่โดดเด่นจากเอาต์พุต 1080p ซึ่งเป็นมาตรฐานโดยพฤตินัยสำหรับเครื่องมือ AI วิดีโอที่ผู้บริโภคต้องเผชิญส่วนใหญ่ โมเดลยังสร้าง เสียงสเตอริโอ ที่ซิงโครไนซ์กับฟุตเทจที่สร้างขึ้น ซึ่งเป็นความสามารถที่หาได้ยากในพื้นที่การสร้างวิดีโอ โดยที่โมเดลส่วนใหญ่จะส่งคลิปที่ไม่มีเสียงซึ่งต้องใช้ไปป์ไลน์เสียงแยกต่างหาก
บางทีการตัดสินใจที่สำคัญที่สุดในเชิงกลยุทธ์ก็คือความมุ่งมั่นของ MiniMax ที่จะ เปิดน้ำหนัก South China Morning Post รายงานว่า MiniMax กำลังเปิดตัว H3 ที่มีน้ำหนักโมเดลโอเพ่นซอร์สและที่จุดราคาจงใจตัดราคาคู่แข่ง - การรวมกันของสิ่งพิมพ์ที่ถูกมองว่าเป็นความท้าทายโดยตรงต่อแนวทางการค้าแบบปิดของ ByteDance Open Weights ช่วยให้นักพัฒนาและนักวิจัยสามารถดาวน์โหลด ตรวจสอบ ปรับแต่ง และปรับใช้โมเดลบนโครงสร้างพื้นฐานของตนเอง แทนที่จะอาศัย API ที่โฮสต์ไว้เพียงอย่างเดียว
MiniMax อธิบาย H3 ว่าเป็นโมเดล "ทุกรูปแบบ" ตาม AIBase โดยแนะนำว่า H3 ได้รับการออกแบบมาเพื่อจัดการกับอินพุตและเอาท์พุตหลายประเภท เช่น ข้อความ รูปภาพ เสียง และวิดีโอ ภายในสถาปัตยกรรมเดียว แทนที่จะต้องใช้โมเดลพิเศษแยกต่างหากที่เชื่อมโยงเข้าด้วยกัน
ปฏิกิริยาของตลาด
นักลงทุนตอบรับอย่างรวดเร็ว Finance.biggo.com รายงานว่าหุ้นของ MiniMax เพิ่มขึ้นเกือบ 13% หลังการประกาศในช่วงครึ่งปีแรก ซึ่งสะท้อนถึงความเชื่อมั่นของตลาดว่าการกำหนดราคาเชิงรุกและกลยุทธ์แบบเปิดกว้างของบริษัท สามารถดึงดูดความคิดของนักพัฒนาในหมวดหมู่ที่ระบบนิเวศ Doubao ของ ByteDance เป็นผู้นำในการบังคับบัญชา
สงครามราคามีจริง SCMP ตั้งข้อสังเกตว่า MiniMax นำเสนอวิดีโอที่สร้างโดย H3 ในราคาที่ต่ำกว่าอัตราทั่วไปอย่างมาก โดยเดิมพันว่าราคาต่อรุ่นที่ต่ำกว่าจะดึงดูดผู้ใช้ที่มีปริมาณมาก ตั้งแต่ผู้สร้างโซเชียลมีเดียไปจนถึงเอเจนซี่การตลาดไปจนถึงผู้สร้างภาพยนตร์อิสระ ซึ่งมีความไวต่อต้นทุนต่อคลิปสูง
ByteDance กลับมาอีกครั้งด้วย Seedance 2.5
ByteDance จะไม่ปล่อยให้ช่วงเวลาผ่านไปโดยไม่ได้รับคำตอบ บนไทม์ไลน์เดียวกัน ได้เปิดตัว Seedance 2.5 ซึ่งเป็นเวอร์ชันล่าสุดของโมเดลการสร้างวิดีโอ จากข้อมูลของ Pandaily และ CineD นั้น Seedance 2.5 สามารถสร้างวิดีโอได้ ความยาว 30 วินาทีในรุ่นเดียว ซึ่งเป็นการปรับปรุงที่สำคัญกว่ารุ่นก่อนๆ ซึ่งโดยทั่วไปแล้วจะต้องต่อคลิปที่สั้นกว่าเข้าด้วยกันเพื่อให้ได้ลำดับที่ยาวขึ้น
CineD รายงานว่า Seedance 2.5 ยอมรับอินพุตอ้างอิงสูงสุด 50 รายการ ซึ่งช่วยให้ผู้ใช้สามารถแนะนำการสร้างด้วยรูปภาพ ข้อความแจ้ง และการอ้างอิงภาพหลายรายการพร้อมกัน โมเดลนี้ยังแนะนำ การปิดกั้นกล้อง 3 มิติ ซึ่งช่วยให้ผู้สร้างสามารถควบคุมการเคลื่อนไหวของกล้องเสมือนจริงในระดับผู้กำกับ เช่น การแพน ดอลลี่ และเส้นทางวงโคจร ภายในฉากที่สร้างขึ้น TechNode และ Tech ในเอเชียยืนยันความสามารถในการป้อนข้อมูลและการแก้ไขแบบหลายอินพุตของโมเดล โดยวางตำแหน่งให้เป็นเครื่องมือสำหรับการผลิตวิดีโอที่เน้นการเล่าเรื่องที่ซับซ้อนยิ่งขึ้น
ก่อนหน้านี้ CNET ได้รายงานว่า Seedance 2.5 คาดว่าจะเปิดตัว "ในสัปดาห์นี้" และการเปิดตัวพร้อมกันกับ H3 ของ MiniMax ตอกย้ำว่าวงจรการแข่งขันมีการบีบอัดในวิดีโอ AI ของจีนอย่างไร
ทำไมวิดีโอการแข่งขัน AI จึงมีความสำคัญ
การแข่งขันระหว่าง MiniMax กับ ByteDance นั้นเป็นมากกว่าการต่อสู้กันในระดับภูมิภาค การสร้างวิดีโอ AI ได้กลายเป็นหนึ่งในขอบเขตด้านปัญญาประดิษฐ์ที่ใช้เงินทุนสูงและต้องใช้เทคนิคมากที่สุด โดยต้องใช้ทรัพยากรการประมวลผลจำนวนมหาศาลสำหรับการฝึกอบรมและการอนุมาน คู่แข่งระดับโลก รวมถึง Sora ของ OpenAI, Veo ของ Google และบริษัทสตาร์ทอัพที่กำลังเติบโต ต่างแข่งขันกันเพื่อผลิตวิดีโอที่ยาวขึ้น มีความละเอียดสูงกว่า และควบคุมได้มากขึ้นจากข้อความและรูปภาพ
ระบบนิเวศวิดีโอ AI ของจีนได้เคลื่อนไหวไปอย่างรวดเร็ว การตัดสินใจของ MiniMax ในเรื่องน้ำหนักของโอเพ่นซอร์ส H3 เป็นไปตามรูปแบบที่กว้างขึ้นในห้องปฏิบัติการ AI ของจีน รวมถึง DeepSeek, ผู้สร้าง Qwen ของ Alibaba และอื่นๆ ในการปล่อยโมเดลน้ำหนักเปิดอันทรงพลังเพื่อสร้างระบบนิเวศของนักพัฒนา และสร้างความน่าเชื่อถือทางเทคนิค แม้จะต้องแลกกับการผูกขาดทางการค้าในระยะสั้นก็ตาม
การรวมเสียงสเตอริโอใน H3 นั้นมีความโดดเด่นเป็นพิเศษ โมเดลการสร้างวิดีโอส่วนใหญ่ในปัจจุบันจะผลิตเอาต์พุตภาพเท่านั้น โดยปล่อยให้เสียงเป็นขั้นตอนแยกต่างหาก ซึ่งมักจะต้องทำด้วยตนเอง หาก MiniMax สามารถแก้ปัญหาการสร้างเสียงแบบซิงโครไนซ์ที่ความละเอียด 2K ได้อย่างแท้จริง มันจะแสดงถึงเหตุการณ์สำคัญในการบูรณาการที่มีความหมาย แม้ว่าการวัดประสิทธิภาพที่เป็นอิสระและการประเมินภาคปฏิบัติจะจำเป็นในการประเมินคุณภาพและความน่าเชื่อถือที่แท้จริงของเอาต์พุตก็ตาม
คำถามเปิดน้ำหนัก
การเปิดตัว MiniMax ยังจุดชนวนข้อถกเถียงที่ทำให้อุตสาหกรรม AI แตกแยก ผู้เสนอโต้แย้งว่าน้ำหนักแบบเปิดช่วยเร่งการวิจัย ช่วยให้มีการตรวจสอบด้านความปลอดภัย และลดอุปสรรคสำหรับนักพัฒนารายย่อย นักวิจารณ์ รวมถึงห้องปฏิบัติการชายแดนตะวันตกบางแห่ง แย้งว่าการปล่อยโมเดลเจนเนอเรทีฟที่ทรงพลังจะเพิ่มความเสี่ยงของการใช้ในทางที่ผิดอย่างเปิดเผย ตั้งแต่การดีพเฟคไปจนถึงการบิดเบือนข้อมูล
สำหรับตอนนี้ MiniMax กำลังเดิมพันว่าค่าความนิยมของนักพัฒนาและการล็อคระบบนิเวศจากน้ำหนักแบบเปิดจะมีค่ามากกว่าข้อเสียของการแข่งขัน การเดิมพันนั้นจะได้รับผลตอบแทนหรือไม่นั้นขึ้นอยู่กับการยอมรับ: หาก H3 กลายเป็นเครื่องมือเริ่มต้นสำหรับผู้สร้างวิดีโอทั่วประเทศจีนและที่อื่น ๆ กลยุทธ์แบบ open-weight สามารถพิสูจน์ได้ว่าเป็นผลสืบเนื่องสำหรับวิดีโอ AI เนื่องจากการปล่อย Llama ของ Meta มีไว้สำหรับข้อความ
การแข่งขันในทันทีนั้นชัดเจน บริษัท AI รายใหญ่ที่สุดของจีนสองแห่งได้ยิงภาพล่าสุดในสงครามการสร้างวิดีโอในวันเดียวกัน และความก้าวหน้าก็เพิ่มขึ้นอย่างรวดเร็วเท่านั้น
---
ก้าวนำหน้า AIรับข่าวสาร AI การวิเคราะห์ และความก้าวหน้าล่าสุด ทั้งหมดในที่เดียว

