กูเกิลเปิดตัว EmbeddingGemma 2 โมเดลขนาดเล็กสำหรับรันในอุปกรณ์แบบ on-device โดยต่อยอดมาจาก EmbeddingGemma ที่เปิดตัวในเดือนกันยายน 2025
EmbeddingGemma 2 มีฐานมาจาก Gemma 4 มีขนาดพารามิเตอร์ 740M (ใหญ่ขึ้นจากเวอร์ชัน 1 ที่ขนาด 308M) แต่สามารถปิดบางโหมดให้เหลือแต่ text-only จนเหลือขนาด 270M แล้วเลือกเปิดเพิ่มเฉพาะส่วน vision (170M) กับ audio (300M) ได้ กูเกิลบอกว่าโมเดลนี้ถูกใช้งานจริงใน Pixel 11 โดยใช้แรมเพียง 191MB สำหรับโหมด text-only และ 567MB ถ้าเปิดครบทุกโหมด (multimodal)
จุดเด่นของ EmbeddingGemma 2 คือคุณภาพของคำตอบที่ทำได้ดี ทั้งข้อความ เขียนโค้ด เสียง และรูปภาพ ได้คะแนนเบนช์มาร์คระดับสูงใกล้เคียงกับโมเดลที่ขนาดใหญ่กว่ามันมาก ถือว่าเป็นโมเดลที่ทำคะแนนในกลุ่มนำ เมื่อเทียบกับโมเดลขนาดต่ำกว่า 1B ด้วยกัน
EmbeddingGemma 2 มีขนาด context window ที่ 8K เพิ่มขึ้นสี่เท่าจากเวอร์ชันแรก สามารถประมวลผลภาพ 29 ภาพ หรือวิดีโอ 58 เฟรมได้ในคราวเดียว นอกจากนี้การที่มันพัฒนาต่อมาจาก Gemma 4 ทำให้สามารถรัน 2 โมเดลควบคู่กันไปใน pipeline เดียวกัน คือ EmbeddingGemma 2 บนเครื่องปลายทาง และ Gemma 4 บนคลาวด์ เนื่องจากใช้ text tokenizer และ audio encoder ตัวเดียวกัน
โมเดลเปิดให้ใช้งานแล้วบน Hugging Face และ Kaggle
ที่มา - Google

on