Mistral AI ได้เปิดตัวรุ่นตัวอย่างสาธารณะของ Mistral Large 4 ซึ่งเป็นโมเดลที่ใหญ่ที่สุดและมีความสามารถมากที่สุดที่ห้องปฏิบัติการในฝรั่งเศสได้จัดส่งจนถึงปัจจุบัน บริษัทยืนยันการเปิดตัวในบล็อกโพสต์เมื่อวันที่ 6 ตุลาคม 2026 โดยเปิดเผยว่าโมเดลดังกล่าวมีชื่อเล่นอย่างไม่เป็นทางการซึ่งกลายเป็นที่พูดถึงของชุมชนนักพัฒนาแล้ว: Le Chonk ตามประกาศของ Mistral โมเดลดังกล่าวพร้อมให้ใช้งานแล้ววันนี้ผ่าน API ตัวอย่างบน Mistral Studio โดยมีกำหนดน้ำหนักทั้งหมดจะลดลงภายในสิ้นเดือนนี้
การปล่อยลงสู่พื้นด้วยแรงฉุดทันที กระทู้ Hacker News สองกระทู้ที่พูดถึง Mistral Large 4 สะสมคะแนนรวมกันมากกว่า 900 คะแนนภายในไม่กี่ชั่วโมง และบริการผ่านสายต่างๆ เช่น Reuters, CNBC และ Wired ล้วนครอบคลุมการเปิดตัวนี้ สำนักข่าวรอยเตอร์รายงานว่า Mistral อธิบายว่าโมเดลนี้มีประสิทธิภาพเหนือกว่าคู่แข่งบางรายในจีน ในขณะที่ Wired มองว่าโมเดลนี้เป็นข้อเสนอแบบเปิดที่ดีที่สุดนอกประเทศจีน สำหรับใครก็ตามที่ติดตาม AI news การเปิดตัวครั้งนี้ถือเป็นการเปิดตัวแบบ open-weight ที่สำคัญที่สุดครั้งหนึ่งของไตรมาส และเป็นการเพิ่มระดับโดยตรงของการแข่งขันข้ามมหาสมุทรแอตแลนติกและข้ามมหาสมุทรแปซิฟิกเหนือโมเดลแบบเปิด
ข้อมูลจำเพาะ: เบาบาง ต่อเนื่องหลายรูปแบบ และบริบทแบบยาว
Mistral Large 4 เป็นโมเดลต่อเนื่องหลายรูปแบบที่สร้างขึ้นบนสถาปัตยกรรม Mixture-of-Experts แบบละเอียด เอกสารของ Mistral ระบุพารามิเตอร์ทั้งหมด 1.05 ล้านล้านพารามิเตอร์ โดยมีพารามิเตอร์ที่ใช้งานอยู่ 49 พันล้านพารามิเตอร์ต่อการส่งต่อ จับคู่กับเครื่องเข้ารหัสวิชั่น 1.6 พันล้านพารามิเตอร์ หน้าต่างบริบทครอบคลุม 1 ล้านโทเค็น ถือเป็นโมเดลบริบทที่ยาวที่สุดที่มีอยู่โดยทั่วไป
ราคาในการดูตัวอย่างสาธารณะอยู่ที่ 0.68 ดอลลาร์ต่อโทเค็นอินพุตหนึ่งล้านรายการ และ 2.09 ดอลลาร์ต่อโทเค็นเอาต์พุตหนึ่งล้าน โดยมีอินพุตแคชอยู่ที่ 0.07 ดอลลาร์ต่อล้านโทเค็น ซึ่งเป็นการวางตำแหน่งโมเดลในเชิงรุกกับ API แบบปิดชายแดน และการออกแบบ MoE แบบกระจัดกระจาย แสดงให้เห็นว่า Mistral กำลังเดิมพันว่าเศรษฐศาสตร์เชิงอนุมานจะมีความสำคัญพอๆ กับคะแนนมาตรฐานดิบสำหรับการนำองค์กรไปใช้
คำกล่าวอ้างด้านประสิทธิภาพ: แนวดิ่งระดับองค์กรและความปลอดภัยทางไซเบอร์
คำกล่าวอ้างของมิสทรัลมีความเฉพาะเจาะจงเป็นพิเศษ บริษัทกล่าวว่าโมเดลดังกล่าวมีประสิทธิภาพในการแข่งขันกับโมเดลโอเพ่นซอร์สที่แข็งแกร่งที่สุดทั่วโลก ขณะเดียวกันก็มีประสิทธิภาพเหนือกว่าโมเดลโอเพ่นเวทใดๆ ที่พัฒนาในสหรัฐอเมริกาหรือยุโรปอย่างมาก สำหรับปริมาณงานที่สำคัญขององค์กร รวมถึงความปลอดภัยทางไซเบอร์ การเงิน และกฎหมาย Mistral กล่าวว่าโมเดลนี้มีความล้ำสมัยในบรรดาโมเดลแบบเปิด
ตัวเลขความปลอดภัยทางไซเบอร์เป็นที่สะดุดตาที่สุด Mistral รายงานว่า ใน Artificial Analysis Cyber Index ซึ่งเป็นการประเมินโดยอิสระว่าโมเดล AI ค้นหาและแก้ไขข้อบกพร่องด้านความปลอดภัยในซอฟต์แวร์จริงได้ดีเพียงใด Mistral Large 4 ติดอันดับหนึ่งในห้าโมเดลชั้นนำทั่วโลกและเป็นผู้นำในสาขา open-weight บริษัทยังอ้างว่าโมเดลนี้เหนือกว่าโมเดลปิดชายแดนในบางโดเมน เช่น การต่อสายดินด้วยภาพ การยืนยันเกณฑ์มาตรฐานอิสระจะคุ้มค่าที่จะดูเมื่อมีการจัดส่งตุ้มน้ำหนัก แต่ความเฉพาะเจาะจงของการกล่าวอ้างเหล่านี้ไม่ใช่เรื่องปกติสำหรับการประกาศตัวอย่าง
ปลอมแปลงในยุโรป: โครงสร้างพื้นฐานอธิปไตยเป็นจุดขาย
โมเดลดังกล่าวได้รับการฝึกฝนตั้งแต่เริ่มต้นบน NVIDIA Grace Blackwell GPU จำนวน 3,800 ตัวในศูนย์ข้อมูลของ Mistral ในยุโรป และการดูตัวอย่างสาธารณะจะทำงานบนโครงสร้างพื้นฐานเดียวกันนั้น Mistral มีความชัดเจนเกี่ยวกับกรอบภูมิรัฐศาสตร์ โดยโมเดลดังกล่าวจะพร้อมใช้งานในหลายภูมิภาค รวมถึงการปรับใช้ในยุโรปที่บริษัทดำเนินการแบบ end-to-end โดยไม่ขึ้นอยู่กับผู้ให้บริการดิจิทัลรายอื่นและภายใต้กฎหมายของยุโรป
อำนาจอธิปไตยนั้นขยายไปถึงข้อมูลการฝึกอบรม มิสทรัลตั้งข้อสังเกตว่าคลังข้อมูลการฝึกอบรมส่วนใหญ่มีหลายภาษา ครอบคลุมมากกว่า 160 ภาษา รวมถึงภาษาราชการทุกภาษาของสหภาพยุโรป สำหรับรัฐบาลและองค์กรในยุโรปที่มีข้อกำหนดด้านถิ่นที่อยู่ของข้อมูล นี่คือการสร้างความแตกต่างหลักเมื่อเทียบกับผู้ให้บริการในสหรัฐฯ และจีน
การเดิมพันที่ผิดปกติ: เปิดน้ำหนักสำหรับงานรักษาความปลอดภัยที่น่ารังเกียจ
ส่วนที่โดดเด่นที่สุดของประกาศนี้เกี่ยวข้องกับหลักปฏิบัติด้านความปลอดภัยทางไซเบอร์ ก่อนที่น้ำหนักดังกล่าวจะเผยแพร่ Mistral กำลังรวมทีมโมเดลนี้ในสภาพแวดล้อมจริงกับผู้นำด้านความปลอดภัยทางไซเบอร์ พันธมิตรที่ผ่านการตรวจสอบ และหน่วยงานของรัฐ ซึ่งจะเข้าถึงโมเดลเดียวกันโดยลดการกลั่นกรองและขยายขีดความสามารถทางไซเบอร์
ข้อโต้แย้งของ Mistral ก็คือ การปฏิเสธในระดับผู้ให้บริการสามารถปิดกั้นการวิจัยช่องโหว่ที่ถูกต้องตามกฎหมายและการตอบสนองต่อเหตุการณ์ได้ และการสูญเสียการเข้าถึงความสามารถในช่วงกลางของเหตุการณ์ก็ถือเป็นความเสี่ยงด้านความปลอดภัยเช่นกัน ด้วยการจับคู่ประสิทธิภาพทางไซเบอร์ระดับแนวหน้าเข้ากับน้ำหนักแบบเปิดและการปรับใช้ด้วยตนเอง บริษัทกล่าวว่าองค์กรต่างๆ ได้รับทั้งความสามารถและความเป็นอิสระในการทำงานด้านความปลอดภัยขั้นสูงภายใต้นโยบายของตนเอง นักวิจารณ์จะถามอย่างสมเหตุสมผลว่าจะมีรั้วกั้นอะไรบ้างเมื่อน้ำหนักที่ไม่จำกัดอยู่ในวงกว้าง และการถกเถียงอย่างมีความรับผิดชอบต่อการเปิดเผยข้อมูลเกี่ยวกับความสามารถทางไซเบอร์แบบเปิดมีแนวโน้มที่จะเข้มข้นขึ้นเมื่อน้ำหนักลดลง
อะไรจะเกิดขึ้นต่อไป
Mistral กล่าวว่านี่ยังเป็นเพียงการแสดงตัวอย่าง และโมเดลดังกล่าวได้รับการปรับปรุงอย่างต่อเนื่องในขณะที่บริษัททำการปรับปรุง ระหว่างนี้จนถึงการเปิดตัวตุ้มน้ำหนัก ห้องปฏิบัติการได้ให้คำมั่นว่าจะให้รายละเอียดเพิ่มเติมเกี่ยวกับสถาปัตยกรรมแบบจำลอง การวัดประสิทธิภาพเพิ่มเติม และวิธีการหลังการฝึกอบรม Large 4 จะทำหน้าที่เป็นรากฐานสำหรับโมเดล Mistral พิเศษและปรับให้เหมาะสมรุ่นใหม่ และบริษัทกล่าวว่าจะใช้สภาพแวดล้อมการฝึกอบรม การปรับแต่ง และการเสริมกำลังการเรียนรู้แบบเดียวกับที่นำเสนอแก่ลูกค้าผ่าน Mistral Forge
การแข่งขันแบบเปิดน้ำหนักส่วนใหญ่นำโดยห้องปฏิบัติการของจีนในช่วงสองปีที่ผ่านมา และ Mistral กำลังวางตำแหน่ง Large 4 เพื่อเป็นหลักฐานว่าห้องปฏิบัติการในยุโรปสามารถแข่งขันที่ขอบเขตของการเปิดตัวแบบเปิด แทนที่จะยอมยกพื้นนั้น ไม่ว่าเกณฑ์มาตรฐานจะอยู่ภายใต้การตรวจสอบอย่างเป็นอิสระ และไม่ว่าชุมชนด้านความปลอดภัยจะยอมรับหรือถอยกลับจากท่าทีที่ลดการดูแลลง จะกำหนดทิศทางการต้อนรับที่ Mistral หวังว่าจะเป็นการเปิดตัวในปี 2569
สำหรับตอนนี้ นักพัฒนาสามารถลองใช้ API ตัวอย่างบน Mistral Studio ได้ และระบบนิเวศในวงกว้างจะจับตาดูน้ำหนักที่ลดลงอย่างใกล้ชิดก่อนสิ้นเดือนตุลาคม
ก้าวนำหน้า AI Curve
การเปิดตัวโมเดลในลักษณะนี้กำลังกำหนดรูปแบบการแข่งขันใหม่ทุกสัปดาห์ อ่านข่าว AI เพิ่มเติมที่ aibuzzwire.news สำหรับการครอบคลุมการเปิดตัวครั้งสำคัญ เกณฑ์มาตรฐาน และการเปลี่ยนแปลงนโยบาย
อ่านข่าว AI เพิ่มเติม →