Image
By mk Founder on Tag: Gemini, LLM, Google, Programming
Gemini

กูเกิลเปิดตัวโมเดลรุ่นใหญ่ Gemini 4 Argon ตามที่เคยพูดไว้ก่อนหน้านี้ โดยการกลับมาครั้งนี้ของ Gemini สามารถเอาชนะโมเดลคู่แข่งทั้ง GPT-6 Astra และ Claude Fable 5.1 ได้ในเกือบทุกการทดสอบ

สิ่งที่เป็นจุดอ่อนที่สุดของโมเดลตระกูล Gemini คือเรื่องโค้ดดิ้ง (และเป็นเหตุให้ Gemini Pro 3.5 ออกไม่ได้ตามเป้า) คราวนี้กลับมาด้วยคะแนนเบนช์มาร์ค

By arjin Writer on Tag: Gemini, Google, Artificial Intelligence
Gemini

กูเกิลประกาศเพิ่มความสามารถให้โมเดล Gemini 3.8 Live ที่เป็นโมเดลปัญญาประดิษฐ์สำหรับการโต้ตอบสนทนาเรียลไทม์ซึ่งออกมาเมื่อสัปดาห์ที่แล้ว นั่นคือการสร้าง Live Avatar หรือตัวอวตารที่เป็นตัวแทนในการสนทนาเสียงโต้ตอบแบบวิดีโอ

ในการคิดโต้ตอบการสนทนา Gemini 3.8 Live with Live Avatar สามารถทำงานเบื้องหลังร่วมกับโมเดลการคิดเป็นเหตุผล จึงสามารถใช้งานได้ดีแม้เป็นคำสั่งที่มีความซับซ้อน โดยไม่มีจังหวะที่สะดุดในการสนทนา อีกทั้งอวตารสามารถขยับปากในลักษณะตามแบบคำที่ออกมาทันทีด้วย จึงดูลื่นไหลเป็นธรรมชาติ

By mk Founder on Tag: Gemini, LLM, Text-to-Speech, Google
Gemini

กูเกิลยังวนออกโมเดล Gemini เวอร์ชันย่อยๆ เฉพาะทางอย่างต่อเนื่อง (ส่วนตัวใหญ่สุดนั้น ชัดเจนแล้วว่า รอ Gemini 4 เลย) โมเดลตัวล่าสุดคือ โมเดลแปลงข้อความเป็นเสียงพูด (text-to-speech) ชื่อว่า Gemini 3.8 Flash TTS และ Gemini 3.8 Flash-Lite TTS (ก่อนหน้านี้เพิ่งมี Gemini 3.5 Transcribe ที่ทำด้านกลับกันคือ ถอดเสียงเป็นข้อความ)

By mk Founder on Tag: Gemini, Google, DeepMind, LLM
Gemini

Koray Kavukcuoglu หัวหน้าทีมคนใหม่ของ Google DeepMind ปรากฏตัวครั้งแรกบนเวทีสัมมนาของเว็บไซต์ข่าว The Information เปิดปากเล่าถึง Gemini 4 ว่ากระบวนการเทรนโมเดล Gemini 4 เข้าสถานะ post-training (ปรับแต่งความเสถียร) ช่วงต้น และอีกไม่นานน่าจะปล่อยให้ใช้งานกัน ได้เห็นก่อนสิ้นปี 2026 เนิ่นๆ แน่นอน

By arjin Writer on Tag: Gemini, Google, Artificial Intelligence, Cybersecurity
Gemini

ข่าวสาร AI กับการเจาะระบบประจำวันนี้มาจากกูเกิล โดยกูเกิลรายงานเหตุการณ์ในเดือนพฤษภาคมว่า AI Gemini ได้ทำงานออกมานอกพื้นที่ทดสอบ และเข้าไปเจาะระบบของบริษัทภายนอก 3 แห่ง ซึ่งเป็นผลจากการทดสอบความสามารถด้านความปลอดภัยไซเบอร์ของ Gemini แต่ทำงานเกินไปที่คำสั่ง

การทดสอบนี้จัดทำโดยบริษัทภายนอกชื่อ Irregular ซึ่งรับทดสอบความปลอดภัยของโมเดลของบริษัทเทคโนโลยีก่อนเผยแพร่ต่อสาธารณะ บริษัทนี้นอกจากกูเกิลแล้วก็มีทั้ง OpenAI, Anthropic, Meta เป็นลูกค้าด้วย

By mk Founder on Tag: NotebookLM, Google, Gemini
NotebookLM

กูเกิลเพิ่มฟีเจอร์ให้ Gemini Notebook (NotebookLM เดิม) เวอร์ชันมือถือ สามารถอัดเสียงแล้วแปลงเป็นโน้ตให้ได้เลย

ตัวอย่างการใช้งานที่กูเกิลนำมาโชว์คือ ใช้ Gemini Notebook อัดเสียงครูตอนเลคเชอร์ แล้วแปลงเป็นโน้ตในระบบ Gemini Notebook ซึ่งเราสามารถสั่งให้มันสรุป ถามตอบเนื้อหา สร้างควิซทดสอบ ฯลฯ ได้เหมือนโน้ตปกติ

ฟีเจอร์อื่นที่เพิ่มเข้ามาพร้อมกันคือ แอพสามารถพูดคุยโต้ตอบกับเราเป็นเสียงพูดได้แบบเรียลไทม์ ถ้าไม่อยากพิมพ์ถาม หรือรออ่านคำตอบ ก็คุยกับมันด้วยเสียงได้เลย

By arjin Writer on Tag: Gemini, Google, Artificial Intelligence
Gemini

กูเกิลอัปเดตโมเดล Gemini 3.8 Live และ Gemini 3.8 Live Extended Thinking ซึ่งเป็นโมเดล AI ที่ออกแบบมาสำหรับการสนทนาโต้ตอบเรียลไทม์ รุ่นถัดจาก Gemini 3.1 Flash Live ที่ออกมาในเดือนมีนาคม

Gemini 3.8 Live เป็นโมเดลรุ่นพื้นฐานที่มีจุดเด่นเรื่องต้นทุนต่อประสิทธิภาพ ส่วน Gemini 3.8 Live Extended Thinking ก็มีความสามารถเพิ่มขึ้นตามชื่อ สำหรับการทำคำสั่งที่ซับซ้อนและต้องคิดเป็นขั้นตอน

By arjin Writer on Tag: Google, Claude, Gemini, Artificial Intelligence
Google

Business Insider อ้างแหล่งข่าวภายในกูเกิลซึ่งต่อมายืนยันโดยโฆษกของกูเกิล ว่าบริษัทได้อนุญาตให้วิศวกรของบริษัทใช้งาน Claude AI ของ Anthropic เพื่อช่วยในการพัฒนาโครงการต่าง ๆ ของบริษัทแล้ว ซึ่งที่ผ่านมากูเกิลห้ามใช้

ก่อนหน้านี้แนวทางการใช้ AI ในการทำงานภายกูเกิลไม่อนุญาตให้ใช้เครื่องมือช่วยเขียนโค้ดภายนอกอย่าง Claude Code หรือ Codex ของ OpenAI เนื่องจากกูเกิลต้องการให้พนักงานใช้ Gemini เป็นหลัก โดยมีบางทีมได้ข้อยกเว้นเช่น DeepMind ที่ให้ใช้ Claude ได้มานานแล้ว

By lew Founder on Tag: Gemini, LLM
Gemini

กูเกิลปล่อยแอป Gemini สำหรับวินโดวส์ หลังจากปล่อยเวอร์ชั่น macOS ตั้งแต่เดือนเมษายนที่ผ่านมา รองรับการทำงานทั้งแบบแชตปกติและแบบ Spark ที่เป็นคู่แข่ง Claude Cowork

ตอนนี้แอป Gemini บนแมคสามารถจัดการไฟล์ในโฟลเดอร์ได้แบบเดียวกับ Claude Cowork แม้ยังมีฟีเจอร์ไม่เท่ากัน เช่น การควบคุมเบราว์เซอร์ แต่สำหรับเวอร์ชั่นวินโดวส์ทางกูเกิลระบุเพียงว่าจะเพิ่มฟีเจอร์เนทีฟภายหลัง

ที่มา - Google Blog

By arjin Writer on Tag: Google Translate, Translation, Google, Gemini
Google Translate

Google Translate อัปเดตฟีเจอร์การแปลภาษาแบบเรียลไทม์ Live Translate ที่เปิดให้ใช้งานเมื่อเดือนมิถุนายนที่ผ่านมา รองรับมากกว่า 70 ภาษา และมีดีเลย์ที่สั้นมากจากต้นฉบับ โดยมีของใหม่ดังนี้

ความสามารถแรกได้เฉพาะ Android ก่อน โดยสามารถแปลภาษาเรียลไทม์แบบทำงานเบื้องหลัง (background) ได้แล้ว ผู้ใช้งานจึงสามารถมัลติทาสก์ทำอย่างอื่นไปด้วยฟังการแปลไปด้วยได้ กูเกิลบอกว่าเพราะคนใช้ฟีเจอร์นี้ถึง 1 ใน 3 มีการแปลเสียงความยาวมากกว่า 5 นาที ฟีเจอร์นี้จะตามมาใน iOS เร็ว ๆ นี้

By arjin Writer on Tag: Lyria, Gemini, Google, LLM
Lyria

กูเกิลอัปเดตโมเดล AI สร้างเพลง Lyria 3.5 ถัดจากเวอร์ชัน 3 ที่ออกมาในเดือนกุมภาพันธ์ สามารถใช้งานได้ทั้งผ่านแอป Gemini และ Gemini API โดยในเวอร์ชันนี้กูเกิลบอกว่าสามารถกำหนดรายละเอียดเสียงร้อง เสียงดนตรี และอื่น ๆ ได้มากขึ้น

ตัวอย่างการปรับแต่งผลลัพธ์เพลงที่ต้องการในแอป Gemini สามารถกำหนดได้ว่าต้องการเพลงประเภท (genre) ใด, เป็นเพลงมีเสียงร้องหรือมีเฉพาะดนตรีบรรเลง, เป็นเพลงความยาวปกติ หรือเพลงสั้น นอกจากนี้ยังสามารถเริ่มต้นการสร้างเพลงที่ต้องการจากชุดเทมเพลตที่ Gemini ทำตัวเลือกไว้ เช่น เพลงจิงเกิ้ลสำหรับธุรกิจ ริงโทนโทรศัพท์ เพลงเบื้องหลังประกอบคลิปวิดีโอ เป็นต้น

By arjin Writer on Tag: ChatGPT, Gemini, Claude, Grok, Service Outage
ChatGPT

เมื่อประมาณ 1 ชั่วโมงที่ผ่านมา เว็บไซต์รายงานระบบล่ม DownDetector ระบุว่าบริการแชทบอต AI ยอดนิยม 4 ค่าย ได้แก่ ChatGPT ของ OpenAI, Gemini ของกูเกิล, Claude ของ Anthropic และ Grok ของ SpaceXAI ต่างมีปัญหาไม่สามารถใช้งานได้ตามปกติ ซึ่งแม้บริการเหล่านี้อาจมีปัญหาใช้งานไม่ได้บ้าง แต่ก็ไม่เคยมีกรณีที่มีปัญหาพร้อมกันแบบนี้

By lew Founder on Tag: Gemini, LLM
Gemini

กูเกิลอัปเดตโมเดล Gemini 3.8 Flash ที่เป็นโมเดลสำหรับงานเขียนโปรแกรมที่ดีที่สุด แม้จะคงราคาเดิม 0.75/3.75 ดอลลาร์ต่อล้านโทเคนเอาไว้

ผลการทดสอบแสดงให้เห็นว่าการทดสอบงานด้านเขียนโปรแกรมหลายตัว Gemini 3.8 Flash ทำคะแนนได้ขึ้นไปใกล้เคียง Claude Opus 5 เป็นที่เรียบร้อย เช่น DeepSWE 1.1 ทำคะแนนได้ 73.7% (Opus 74.0%), Terminal Bench 2.1 ทำได้ 89.4% (Opus 89.1%) คะแนนทดสอบบางตัวยังตามหลังชัด เช่น Terminal Bench 4.0 ที่เน้นงานทั่วไปมากกว่าการเขียนโค้ด ทำได้เพียง 19.1% (Opus 51.8%)

By mk Founder on Tag: Gemini, Google, LLM
Gemini

กูเกิลอัพเกรด โมเดลสร้างวิดีโอ Gemini Omni เป็นเวอร์ชัน 1.1 Flash ปรับปรุงทั้งคุณภาพและความเร็วของการสร้างวิดีโอ

Gemini Omni เป็นโมเดลที่รับอินพุตแบบผสมผสานหลายอย่าง (เช่น ข้อความ ภาพ วิดีโอ ตามชื่อคำว่า Omni) แล้วสร้างผลลัพธ์ออกมาเป็นวิดีโอ ตอนนี้ถือเป็นโมเดลสร้างวิดีโอระดับสูงของกูเกิล เหนือกว่าโมเดล Veo ที่เน้นต้นทุนต่ำ

ฟีเจอร์ใหม่ของ Gemini Omni 1.1 Flash

By mk Founder on Tag: Google Play Books, Gemini, NotebookLM, Google
Google Play Books

Gemini Notebook หรือ NotebookLM เดิม เพิ่มฟีเจอร์ใหม่ชื่อ Expert Intelligence ดึงข้อมูลจากหนังสืออีบุ๊กที่เราเคยซื้อผ่าน Google Play Books เข้ามาให้ AI ช่วยอ่านได้

อีบุ๊กเหล่านี้จะมีสถานะเป็น source หนึ่งภายใต้ Gemini Notebook ให้เราสามารถสั่งสรุปเนื้อหา ถาม-ตอบ หรือสั่งทำสไลด์, podcast, ควิซ ได้เหมือน source อื่นๆ

กูเกิลบอกว่าตอนนี้รองรับหนังสือมากกว่า 1 แสนเล่ม ครอบคลุมสำนักพิมพ์ชื่อดัง และยังจับมือกับนักเขียนดังๆ บางราย เพิ่มแหล่งข้อมูลให้ลูกค้าที่ซื้อหนังสือไปแล้วด้วย

By mk Founder on Tag: Gemini, Speech Recognition, LLM, Google
Gemini

ถึงแม้ กูเกิลยังไม่สามารถออกโมเดลรุ่นใหญ่ Gemini 3.5 Pro ได้อย่างที่หวัง แต่ก็ทยอยออกโมเดลระดับรองตัวอื่นมาเรื่อยๆ ล่าสุดคือ Gemini 3.5 Transcribe สำหรับแปลงเสียงพูดเป็นข้อความ

Gemini 3.5 Transcribe เป็นโมเดลตัวเดียวกับที่ใช้ในฟีเจอร์ Rambler ของ Android ที่เปิดตัวตอน Google I/O 2026 และเพิ่งใช้กับ Pixel 11 เป็นรุ่นแรก ฟีเจอร์ Rambler จะสามารถฟังคำพูดติดๆ ขัดๆ อ้ำๆ อึ้งๆ วกวนไปมาของเรา (ซึ่งพูดกันเป็นปกติ) แล้วเรียบเรียงออกมาเป็นประโยคที่เข้าใจง่าย

By arjin Writer on Tag: Google One, Google, Gemini, Google AI Pro, Education
Google One

กูเกิลประกาศแจกแพ็คเกจใช้งาน AI Gemini สำหรับนักเรียนนักศึกษา ฟรี เป็นเวลา 12 เดือน โดยได้เป็นแพ็คเกจ Google AI Plus ซึ่งมาพร้อมกับโควต้าใช้งาน Gemini Omni, Gemini ปกติมากกว่าแบบฟรี 2 เท่า และพื้นที่เก็บข้อมูล 400GB

สำหรับคนที่ต้องการใช้งานมากกว่า กูเกิลยังให้สิทธิเฉพาะนักเรียนนักศึกษาเช่นกัน เป็นส่วนลดสูงสุด 74% โดย Google AI Pro จากปกติ 750 บาทต่อเดือน ลดให้เหลือ 189 บาทต่อเดือน เป็นระยะเวลา 4 ปี และแพ็จเกจ Google AI Pro แบบมี YouTube Premium ด้วย จากปกติ 949 บาทต่อเดือน ลดเหลือ 279 บาทต่อเดือน ระยะเวลา 4 ปี เช่นกัน

By mk Founder on Tag: Google Sheets, Google Workspace, Google, Gemini
Google Sheets

Google Sheets เพิ่มฟีเจอร์ใหม่ชื่อ canvas สั่งให้ Gemini ทำแดชบอร์ดแสดงข้อมูลให้ได้เลย โดยไม่ต้องเขียนโค้ด

วิธีการคือกดปุ่มประกายดาว Gemini ที่มุมขวาบน แล้วสั่งบอกให้ทำ visual dashboard พร้อมเงื่อนไขตามต้องการ ตัวแดชบอร์ดสามารถปรับแต่งได้ในภายหลังหากยังไม่พอใจ เช่น เพิ่มกราฟ, เพิ่ม dark mode ได้ ผลลัพธ์ที่ได้จะเป็นอีกแท็บของ Google Sheets โดยยังเชื่อมกับตารางข้อมูลเดิม

ฟีเจอร์นี้ต้องสมัครแพ็กเกจ Google AI Pro หรือ Ultra และยังรองรับเฉพาะภาษาอังกฤษ

By mk Founder on Tag: Gemini, Artificial Intelligence, Google
Gemini

Gemini ประกาศเพิ่มตัวเลือกให้เราสามารถปิด "ลายน้ำที่มนุษย์มองเห็น" (visible watermark) ในภาพ วิดีโอ และเพลงที่สร้างด้วย AI ได้แล้ว (ไอคอนรูปประกายดาวตรงมุมขวาล่างของภาพที่สร้างด้วย Gemini)

ตัวเลือกนี้อยู่ใน Settings ของ Gemini เป็นหมวดใหม่ชื่อ Media watermark สามารถตั้งค่าเป็น On/Off ได้ นอกจาก Gemini แล้ว แอพสร้างวิดีโอ Flow ก็จะมีตัวเลือกนี้เช่นกัน

การตั้งค่านี้มีผลเฉพาะ "ลายน้ำที่มนุษย์มองเห็น" เท่านั้น ส่วนลายน้ำที่มนุษย์สังเกตไม่เห็น SynthID และข้อมูล metadata ในรูปแบบ C2PA ยังฝังอยู่ในชิ้นงานเช่นเดิม

By lew Founder on Tag: Gemini, LLM
Gemini

กูเกิลอัพเดต Gemini 3.7 Flash โดยแสดงผลทดสอบว่าความสามารถด้านการเขียนโปรแกรมพัฒนาขึ้นอย่างมาก ทำให้ขึ้นไปใกล้เคียง Claude Sonnet 5 หรือ GPT-5.6 Terra แล้ว พร้อมกับประกาศออกโปรโมชันลดราคาลงครึ่งหนึ่งถึงสิ้นปีนี้

ที่ราคานี้ทำให้ Gemini 3.7 Flash คุ้มราคากว่าโมเดลจำนวนมากในตลาด หากนับดัชนีทดสอบ Artificial Analysis อยู่ที่ 56 ตามหลัง Muse Spark 1.2 ของ Meta อยู่หนึ่งคะแนน และนำหน้า DeepSeek V4 Pro 0813 ตัวล่าสุด

Subscribe to Gemini