กูเกิลเปิดตัวโมเดลรุ่นใหญ่ Gemini 4 Argon ตามที่เคยพูดไว้ก่อนหน้านี้ โดยการกลับมาครั้งนี้ของ Gemini สามารถเอาชนะโมเดลคู่แข่งทั้ง GPT-6 Astra และ Claude Fable 5.1 ได้ในเกือบทุกการทดสอบ
สิ่งที่เป็นจุดอ่อนที่สุดของโมเดลตระกูล Gemini คือเรื่องโค้ดดิ้ง (และเป็นเหตุให้ Gemini Pro 3.5 ออกไม่ได้ตามเป้า) คราวนี้กลับมาด้วยคะแนนเบนช์มาร์ค
- DeepSWE v1.1 ที่ 77.9% เอาชนะโมเดลที่ดีที่สุดก่อนหน้านี้คือ GPT-6 Astra ทำไว้ 74.1% กับ Claude Opus 5.5 ทำไว้ 74.2%
- Vibe Code Bench ทำได้ 91.9% เทียบกับ Claude Fable 5.1 ทำไว้ 90.3%
- ส่วน FrontierSWE กับ Terminal-bench ยังแพ้ GPT-6 Astra และ Claude Opus 5.5 ตามลำดับ
กูเกิลบอกว่าใช้ Gemini 4 Argon สำหรับงานเขียนโค้ดภายในมาสักระยะแล้ว มีทั้งงานแปลงโค้ด C/C++ เดิมมาเป็น Rust จำนวนระดับ 8 แสนบรรทัด และแปลงโค้ด Rust มาเป็นโค้ด Single Instruction, Multiple Data (SIMD) ทำให้ประสิทธิภาพดีขึ้น 2.7 เท่า


ส่วนความสามารถด้านความปลอดภัยไซเบอร์ก็ทำได้ดีกว่า Gemini 3.8 Flash Cyber ที่เป็นโมเดลเฉพาะทาง มีคะแนน CWE-bench v1 ที่ 68% เท่ากับ Grok 4.7 และ GPT-6 Astra โดยตอนนี้โมเดล Gemini 4 ถูกนำมาใช้งานจริงกับงานของ Wiz บริษัทความปลอดภัยที่กูเกิลซื้อกิจการมา
นอกจากเรื่องเขียนโค้ดแล้ว Gemini 4 ยังทำคะแนนได้ดีในงานสายอื่นๆ เช่น งานด้านเศรษฐศาสตร์ การเงิน กฎหมาย ความเข้าใจภาพ ชาร์ท วิดีโอ
อีกจุดที่ Gemini 4 ปรับปรุงขึ้นจากเดิมคือ การใช้งานหน่วยความจำ ที่ปรับแต่งให้เหมาะสมกับศูนย์ข้อมูลของกูเกิลมากกว่าเดิม สามารถลดหน่วยความจำรวมลงได้ 300 TiB (นับเฉพาะตัวโมเดล) และในภาพรวมน่าจะลดลงได้ 500 TiB ถึง 1 PiB
Gemini 4 ยังขยาย context window ขึ้นมาเป็น 1M token แถมในช่วงแรกที่เปิดตัวจะลดราคาให้ 50% ลงมาเหลือ 2 ดอลลาร์ต่อ 1 ล้าน token (input) และ 10 ดอลลาร์ต่อ 1 ล้าน token (หมดช่วงเปิดตัวแล้วจะขึ้นราคาสองเท่า) เรียกว่าตั้งใจตั้งราคามาดึงคนกลับไปใช้ Gemini กันสุดๆ
คุณสมบัติดีขึ้นมากขนาดนี้ ข้อจำกัดเดียวของ Gemini 4 Argon ในตอนนี้คือยังไม่เปิดให้คนทั่วไปใช้งาน เปิดเฉพาะผู้เชี่ยวชาญด้านความปลอดภัยไซเบอร์ที่เข้าโครงการ Fairwind Program ก่อนเพื่อให้มั่นใจว่าโมเดลมีความปลอดภัยมากพอ หลังจากนั้นจึงจะปล่อยผ่าน API และลูกค้ากลุ่ม Google AI Ultra
ที่มา - Google
on