xAI ได้เปิดตัว Grok 4.6 ซึ่งเป็นการทำซ้ำล่าสุดของโมเดลภาษาขนาดใหญ่ระดับแนวหน้า โดยได้คะแนน 61 ในดัชนี Artificial Analysis Intelligence เพื่อให้ตรงกับ GPT-5.6 Sol ของ OpenAI โมเดลดังกล่าวเปิดตัววันนี้และพร้อมใช้งานทันทีใน Cursor และ Grok Build พร้อมการเข้าถึง API และการผสานรวมพันธมิตรผ่าน OpenRouter, Vercel และ Cloudflare

หากต้องการทราบข่าวด่วนและการวิเคราะห์ AI ล่าสุด โปรดไปที่ AI Buzz Wire

Frontier Intelligence ในราคาเพียงเศษเสี้ยว

จากข้อมูลของ Artificial Analysis ซึ่งเป็นแพลตฟอร์มการเปรียบเทียบอิสระ Grok 4.6 ได้รับห้าคะแนนเหนือ Grok 4.5 รุ่นก่อนใน Intelligence Index ทำให้ xAI กลับมาสู่ระดับแนวหน้าพร้อมกับ OpenAI โมเดลนี้ตั้งอยู่ด้านหลัง Claude Opus 5 (63) ของ Anthropic และ Claude Fable 5 (62) และอยู่ข้างหน้า Kimi K3

สิ่งที่ทำให้ Grok 4.6 โดดเด่นเป็นพิเศษคือราคา การกำหนดราคาทั่วไปยังคงไม่เปลี่ยนแปลงจาก Grok 4.5 ที่ 2 ดอลลาร์ต่อโทเค็นอินพุตหนึ่งล้านรายการ และ 6 ดอลลาร์ต่อโทเค็นเอาท์พุตหนึ่งล้านรายการ นั่นทำให้ต่ำกว่า Claude Opus 5 มากกว่า 60% ($5/$25) และ GPT-5.6 Sol ($5/$30) ต้นทุนต่องานที่วัดได้คือ 0.84 เหรียญสหรัฐฯ ซึ่งจัดอยู่ในขอบเขตสติปัญญาเทียบกับต้นทุน Pareto

การตั้งราคาให้คงที่ตลอดชั่วรุ่นถือเป็นเรื่องปกติที่ชายแดน ซึ่งโดยทั่วไปแล้วความฉลาดที่เพิ่มขึ้นจะมาพร้อมกับการเพิ่มขึ้นของราคา Grok 4.6 มอบดัชนีอัจฉริยะห้าจุดในราคาที่ไม่เปลี่ยนแปลง

สร้างขึ้นเพื่อตัวแทนที่ทำงานมายาวนาน

Grok 4.6 สร้างต่อยอดจาก Grok 4.5 โดยที่ xAI อธิบายว่าเป็นการมุ่งเน้นเฉพาะกับเจ้าหน้าที่ที่ทำงานระยะยาวและงานเชิงโต้ตอบและภาพที่ทะเยอทะยานมากขึ้น บริษัทกล่าวว่าโมเดลนี้ยังคงเป็นงานที่ซับซ้อนในหลายขั้นตอน ไม่ว่าจะเป็นการค้นคว้าหัวข้อ การวิเคราะห์ข้อมูล การทำงานข้ามโค้ดเบส หรือการเปลี่ยนแนวคิดให้เป็นแอปพลิเคชันที่สวยงาม

เกณฑ์มาตรฐานตัวแทนบอกเล่าเรื่องราวที่น่าสนใจ บน GDPval-AA v2 ซึ่งเป็นการวัดระดับชั้นนำของงานความรู้เชิงเอเจนต์ในโลกแห่งความเป็นจริง Grok 4.6 บรรลุ Elo ที่ 1753 ตามหลัง Claude Opus 5 เท่านั้นและมีสถิติเทียบเท่ากับ Claude Fable 5 และ Qwen3.8 Max โดยได้คะแนน 50.7% จากเกณฑ์มาตรฐาน Banking สำหรับการบริการลูกค้าแบบหลายรอบ โดยอยู่ในสองอันดับแรกควบคู่ไปกับ Qwen3.8 Max

บน CursorBench v3.2 Grok 4.6 ทำคะแนนได้ 69.9% นำหน้าทั้ง GPT-5.6 Sol (67.2%) และ Grok 4.5 (66.7%) โพสต์ 65.9% บน DeepSWE v1.1 และ 61.3% บน FrontierCode v1.1 Extended

ประสิทธิภาพการเลี้ยวที่โดดเด่น

หนึ่งในการค้นพบที่โดดเด่นจากการวิเคราะห์เชิงประดิษฐ์คือโปรไฟล์ประสิทธิภาพของ Grok 4.6 บน AA-Briefcase ซึ่งเป็นเกณฑ์มาตรฐานส่วนตัวของงานความรู้เชิงตัวแทนในขอบเขตระยะยาว นาฬิการุ่นนี้เปิดตัวด้วย Elo ปี 1577 โดยอยู่ในระดับ Fable 5

ตัวเลขประสิทธิภาพโดดเด่นมาก Grok 4.6 แก้ไขงานในประมาณ 53 รอบและโทเค็นอินพุต 0.5 พันล้านโดยเฉลี่ย เทียบกับประมาณ 103 รอบและโทเค็นอินพุต 2.0 พันล้านสำหรับ Claude Opus 5 สูงสุด เนื่องจากงานเอเจนต์ขอบฟ้ายาวสะสมบริบทอย่างรวดเร็ว โมเดลที่ได้รับคำตอบที่เทียบเคียงได้ในช่วงครึ่งรอบและหนึ่งในสี่ของโทเค็นอินพุตจึงมีข้อได้เปรียบด้านต้นทุนมากกว่าราคาต่อโทเค็น

การฝึกอบรมและความปลอดภัย

Grok 4.6 ได้รับการฝึกอบรมเสริมที่ยาวนานกว่า Grok 4.5 โดยมีข้อมูลที่รวบรวมโดยแบบจำลองเพื่อการให้เหตุผลและแนวคิดทางเทคนิคขั้นสูง ข้อมูลทางวิศวกรรมคุณภาพสูง และตัวเพิ่มประสิทธิภาพและสูตรการฝึกอบรมที่ได้รับการปรับปรุง xAI ใช้ Grok 4.5 เพื่อสร้างวิถี SFT ใหม่ทั้งในด้านการใช้เหตุผล การควบคุมตัวแทน และโดเมน รวมถึง STEM วิศวกรรมซอฟต์แวร์ และงานองค์ความรู้

โมเดลนี้มีหน้าต่างบริบท 500,000 โทเค็น ซึ่งไม่เปลี่ยนแปลงจาก Grok 4.5 xAI รายงานว่า Grok 4.6 ได้รับชุดการทดสอบก่อนการปรับใช้งานที่กว้างที่สุดเท่าที่เคยมีมาสำหรับความสามารถและการสอบเทียบการป้องกัน พร้อมด้วยการทดสอบหลังการใช้งานและการทดสอบโดยบุคคลที่สามอย่างกว้างขวาง

ห้องว่างและราคา

Grok 4.6 พร้อมใช้งานแล้ววันนี้ใน Cursor และ Grok Build xAI นำเสนอการใช้งานแบบรวมสองเท่าภายในทั้งสองแพลตฟอร์มในสัปดาห์แรก ราคาเริ่มต้นที่ 2 เหรียญต่อล้านโทเค็นอินพุต และ 6 เหรียญต่อล้านโทเค็นเอาต์พุต โดยมีรูปแบบที่รวดเร็วให้เลือกในราคาสองเท่า การเข้าถึงแคชจะถูกลดราคาเหลือ 0.50 ดอลลาร์ต่อล้านโทเค็น

การเปิดตัวยังคงดำเนินต่อไปอย่างรวดเร็วสำหรับ xAI โดย Grok 4.6 มาถึงเพียงหนึ่งเดือนหลังจาก Grok 4.5 โมเดลดังกล่าววางตำแหน่ง xAI ให้เป็นคู่แข่งที่สำคัญในการแข่งขันชายแดน โดยเฉพาะอย่างยิ่งสำหรับนักพัฒนาที่ให้ความสำคัญกับประสิทธิภาพเอเจนต์และความคุ้มค่าด้านต้นทุน

ก้าวนำหน้า AI

หากต้องการรายงานข่าวการพัฒนาที่สำคัญที่สุดของอุตสาหกรรม AI อย่างต่อเนื่อง โปรดบุ๊กมาร์ก AI Buzz Wire และไม่พลาดเรื่องราวด่วน

อ่านข่าว AI เพิ่มเติม