Image

Large Language Model

By mk Founder on Tag: Mistral, LLM
Mistral

Mistral บริษัทปัญญาประดิษฐ์จากฝรั่งเศส เปิดตัวโมเดลชุดใหม่ Mistral 3 เป็นโมเดลแบบเปิด (open weight) ที่ประกอบด้วยโมเดล 2 กลุ่มคือ

Mistral Large 3 โมเดลรุ่นใหญ่ขนาดพารามิเตอร์ 675B ที่เบนช์มาร์คชนะ DeepSeek-V3.1 และ Kimi K2 (ชนะแบบเฉียดๆ แต่ก็ชนะ แพ้ในเรื่องเขียนโค้ด) ถือเป็นโมเดลแบบเปิด กลุ่ม non-reasoning ที่มีผลงานดีเป็นอันดับสองร่วมบน LMArena (ที่หนึ่งตอนนี้คือ DeepSeek-V3.2 แบบ non-reasoning)

By lew Founder on Tag: AWS, LLM, Artificial Intelligence, Security, DevOps, Kiro
AWS

AWS เปิดตัวชุด Agentic AI ที่ช่วยทีมไอทีทำงาน โดยแบ่งออกเป็นสามด้าน ได้แก่ การพัฒนาซอฟต์แวร์, การดูแลความปลอดภัย, และ DevOps สำหรับการซ่อมบำรุงแอปพลิเคชั่นให้ทำงานได้ต่อเนื่อง

By lew Founder on Tag: AWS, LLM, Nova, Amazon
AWS

AWS เปิดตัวบริการปัญญาประดิษฐ์ขนาดใหญ่ในตระกูล Nova ชุดใหม่ โดยมีแกนกลางคือ Nova 2 Lite ที่ความสามารถขึ้นไประดับเดียวกับโมเดลจากผู้พัฒนาหลักๆ เช่น Claude Haiku 4.5, GPT 5 Mini, และ Gemini 2.5 Flash

By mk Founder on Tag: Runway, LLM
Runway

Runway สตาร์ตอัพ AI สร้างวิดีโอชื่อดัง เปิดตัวโมเดล Runway Gen-4.5 ที่พัฒนาขึ้นจาก Gen-4 ที่ออกเมื่อเดือนเมษายน

Runway บอกว่าโมเดล Gen-4.5 ทำคะแนนเบนช์มาร์ค Elo ได้ถึง 1,247 คะแนน เยอะกว่าคู่แข่งอย่าง Google Veo 3 ที่ทำได้ 1,226 คะแนน จุดเด่นของมันคือรักษาความเร็วของ Gen-4 แล้วเพิ่มคุณภาพของผลลัพธ์ให้ดีกว่าเดิมทุกด้าน ตั้งแต่การปฏิบัติตามคำสั่ง prompt อย่างแม่นยำ, รองรับการสร้างซีนที่ซับซ้อน, ความแม่นยำตามหลักฟิสิกส์, รองรับสไตล์ภาพหลากหลายรูปแบบ ทั้งแบบสมจริงและแบบไม่สมจริง (เช่น การ์ตูน)

By lew Founder on Tag: Antigravity, Google, LLM, Programming
Antigravity

ผู้ใช้ Reddit ชื่อบัญชี Deep-Hyena492 รายงานถึงอุบัติเหตุจากการใช้ Google Antigravity ที่เป็น IDE สำหรับเขียนโค้ดแบบ Agentic แต่ระหว่างการใช้งานตัว AI กลับทำงานพลาดและลบไฟล์ทั้งหมดในไดรฟ์ D

Deep-Hyena492 เผยแพร่แชตที่ Antigravity คิดหลังจากลบไดรฟ์ D ไปแล้วแสดงให้เห็นว่ามันรู้ตัวว่าทำงานผิดพลาด และพยายามวิเคราะห์ว่าทำผิดอย่างไร ในกรณีนี้คือมันพยายามลบโฟลเดอร์เดียวเท่านั้นแต่กลับใส่ quote ในคำสั่งผิดจนลบไฟล์ทั้งดิสก์ไปหมด จากนั้นมันพยายามสำรวจความเสียหายด้วยการตรวจสอบ Recycle Bin

By mk Founder on Tag: DeepSeek, LLM
DeepSeek

ช่วงนี้ DeepSeek ขยันปล่อยของรัวๆ หลังจากออก โมเดลคณิตศาสตร์ DeepSeek-Math-V2 ก็ตามมาด้วยโมเดลสายหลักของบริษัทคือ DeepSeek-V3.2 ที่เป็นการอัพเกรดจาก DeepSeek-V3.1 เมื่อเดือนสิงหาคม

DeepSeek โฆษณาว่า V3.2 เป็น "Reasoning-first models built for agents!" ชูจุดเด่นเรื่องการให้เหตุผลโดยเฉพาะ รองรับการใช้เครื่องมือภายนอก โมเดลแยกเป็น 2 รุ่นย่อยคือ V3.2 ตัวมาตรฐาน และ V3.2-Speciale ยกระดับความสามารถด้านการให้เหตุผลไปอีกขั้น

By arjin Writer on Tag: Apple, Research, Artificial Intelligence, LLM
Apple

เมื่อสัปดาห์ที่แล้ว ทีมวิจัยด้านปัญญาประดิษฐ์ของแอปเปิลได้เผยแพร่รายงานการศึกษาเกี่ยวกับการพัฒนาโมเดล LLM ที่ใช้ข้อมูลเสียงมาประกอบกับข้อมูลการเคลื่อนไหว ทำให้วิเคราะห์ข้อมูลกิจกรรมการเคลื่อนไหวของผู้ใช้งานได้แม่นยำมากขึ้น

โมเดลทดสอบนี้ใช้ข้อมูลจากเซ็นเซอร์สองอย่างคือการเคลื่อนไหวและเสียง เรียนรู้จากชุดข้อมูล Ego4D ที่มีข้อมูลเสียงในกิจกรรมต่าง ๆ เช่น ดูดฝุ่น ทำอาหาร ซักผ้า เล่นบาสเกตบอล เล่นกับสัตว์เลี้ยง อ่านหนังสือ ดูทีวี เป็นต้น แล้วทำงานร่วมกับโมเดล LLM อื่น เป็นโมเดลข้อมูลแบบผสมผสานใหม่ ซึ่งการทดสอบนี้ใช้ Gemini-2.5-pro และ Qwen-32B ผลลัพธ์ที่ได้โมเดลสามารถเรียนรู้จำแนกกิจกรรมต่าง ๆ ได้ดี แม้แต่เป็นกิจกรรมที่ไม่มีในชุดข้อมูลฝึกฝน

By mk Founder on Tag: Typhoon, SCB 10X, LLM, Thailand, Speech Recognition
Typhoon

SCB 10X เปิดตัวโมเดลภาษาตระกูล Typhoon Isan ที่ออกแบบมาเพื่อถอดเสียงพูดภาษาอีสานโดยเฉพาะ

Typhoon Isan ASR เป็นโมเดลถอดเสียงเป็นตัวอักษร (Automatic Speech Recognition) ที่พยายามแก้ปัญหาเรื่องภาษาถิ่นของประเทศไทย ซึ่งยังไม่มีการจัดเก็บข้อมูลในระบบดิจิทัลมากนัก เมื่อผู้พูดใช้ภาษาถิ่น โมเดลในปัจจุบันจึงถอดเสียงผิดเพี้ยน ทำให้ทีมพัฒนาของ SCB 10X เลือกภาษาอีสานที่มีคนพูด 20 ล้านคน คิดเป็น 1/3 ของประชากร มาเป็นภาษาแรก

By mk Founder on Tag: Microsoft, LLM
Microsoft

Microsoft Research เปิดตัวโมเดลภาษาขนาดเล็ก (small language models หรือ SLM) ตัวใหม่ชื่อ Fara-7B ออกแบบมาสำหรับควบคุมการใช้งานคอมพิวเตอร์ หรือเรียกว่า Computer Use Agent (CUA)

แนวทางของโมเดลกลุ่ม Computer Use Agent (CUA) คือออกแบบมาควบคุมเมาส์และคีย์บอร์ดโดยตรง ต่างไปจากโมเดลที่ออกผลลัพธ์มาเป็นข้อความ มันจึงสามารถทำงานคลิกปุ่ม เลื่อนจอ พิมพ์ข้อความได้ดี โดยไม่จำเป็นต้องใช้โหมดพิเศษ (เช่น accessibility) เข้าช่วย

By arjin Writer on Tag: Claude, Anthropic, LLM
Claude

Anthropic เปิดตัวโมเดลขั้นสูงรุ่นใหม่ Claude Opus 4.5 ระบุว่ามีความสามารถด้านการเขียนโค้ดดีที่สุดในโลกตอนนี้ ด้วยผลการทดสอบ SWE-bench Verified ที่คะแนน 80.9% ซึ่งเป็นครั้งแรกที่มีโมเดลทำคะแนนได้ระดับสูงกว่า 80 รวมถึงใช้กับงานอื่นอย่าง การวิจัยเชิงลึก การค้นหาข้อมูลละเอียด ไปจนถึงการทำงานร่วมกับเอกสารสไลด์หรือสเปรดชีท

Opus 4.5 เปิดให้ใช้งานแล้วผ่านแอป, API และผู้ให้บริการคลาวด์สามรายใหญ่ สำหรับนักพัฒนาค่าใช้จ่ายอยู่ที่ $5/$25 ดอลลาร์ต่อ 1 ล้านโทเค็น

By lew Founder on Tag: Ai2, LLM, Artificial Intelligence, Open Source
Ai2

Ai2 สถาบันวิจัยที่ก่อตั้งโดย Paul Allen ผู้ร่วมก่อตั้งไมโครซอฟท์ เปิดตัว Olmo 3 โมเดลปัญญาประดิษฐ์แบบเปิดอย่างแท้จริง โดยเปิดเผย checkpoint ของทุกขั้นตอนการฝึกโมเดล, ชุดข้อมูลที่ใช้ฝึก, และซอฟต์แวร์ต่างๆ ที่จำเป็นต่อการฝึกแต่ละขั้น

โมเดลที่เผยแพร่เพื่อการใช้งาน ได้แก่

By arjin Writer on Tag: Gemini, Google, LLM, Artificial Intelligence
Gemini

กูเกิลเปิดตัวโมเดล AI สำหรับแก้ไขและสร้างรูปภาพรุ่นใหม่ Nano Banana Pro หรือในชื่อเป็นทางการคือ Gemini 3 Pro Image ซึ่งพัฒนาบนโมเดล Gemini 3 Pro ที่เปิดตัวไปเมื่อวันก่อน เพิ่มความสามารถหลายอย่างทั้งการเข้าใจภาพที่เห็นได้ดีขึ้น และสามารถให้รายละเอียดจากข้อมูลที่กำหนดดีกว่าเดิม

กูเกิลนำเสนอตัวอย่างความสามารถของ Nano Banana Pro หลายอย่างดังนี้

By mk Founder on Tag: Gemini, LLM, Google, Artificial Intelligence
Gemini

การเปิดตัวโมเดล Gemini 3 Pro ที่ทำคะแนนเบนช์มาร์คเพิ่มขึ้นแบบก้าวกระโดด สร้างเสียงฮือฮาให้วงการ AI อย่างมาก แต่มันยังไม่จบแค่นั้น เพราะกูเกิลยังมี Gemini 3 Deep Thinking ที่เหนือกว่าไปอีกขั้น รอปล่อยของอยู่

ถ้าดูจากคะแนนเบนช์มาร์ค Gemini 3 Pro สามารถทำคะแนน Humanity's Last Exam ที่ออกแบบมาวัดผลเรื่องการให้เหตุผล (reasoning) ได้ 37.5% พออัพเกรดเป็นโหมดคิดเยอะ Gemini 3 Deep Thinking คะแนนเพิ่มเป็น 41% (คู่แข่ง GPT-5 Pro ทำได้ 30.7%)

By lew Founder on Tag: Antigravity, Google, Programming, LLM, IDE
Antigravity

กูเกิลเปิดตัว IDE สำหรับการเขียนโปรแกรมด้วยปัญญาประดิษฐ์ของตัวเองในชื่อ Google Antigravity ซึ่งอาจจะนับเป็นคู่แข่งของ Cursor หรือ Windsurf ที่เป็นบริการ IDE เน้นใช้ AI เขียนโค้ด

กูเกิลระบุว่าการเขียนโค้ดเดิมพยายามทำงานสองแบบ คือการดูโค้ดแบบลงรายละเอียด เรียกว่า synchronous Editor ไปพร้อมกับการสั่งงานแบบดูผลสำเร็จ เรียกว่า asynchronous Manager ทำให้หน้าจอแน่น แนวทางของ Antigravity คือจะมุ่งสู่โหมด asynchronous

ระหว่างการทำงาน Antigravity จะบันทึกการทำงานลง knowledge base อัตโนมัติ ทำให้อะไรที่เคยสอน Gemini ไปก่อนแล้วจะสามารถนำกลับมาใช้ได้อีกในโครงการต่อไป

By lew Founder on Tag: Gemini, Google, LLM, Nano Banana
Gemini

กูเกิลเปิดตัว Gemini 3 โดยยืนยันว่ามันเป็นโมเดลดีที่สุด (state-of-the-art) ในตลาดตอนนี้ มีความสามารถในการวางแผนอย่างลึกเหมาะกับการใช้งานทั้งถามตอบปกติ, เขียนโค้ด, และทำงานอื่นๆ

ตอนนี้ Gemini 3 ยังเปิดตัวเฉพาะรุ่น Pro เท่านั้น โดยสามารถใช้งานได้ทั้งแอป Gemini, AI Studio, และ Google Search AI Mode รุ่น Deep Think จะเป็นรุ่นดันความฉลาดไปสูงสุด แต่กำลังอยู่ระหว่างการทดสอบ และจะเปิดให้กับผู้สมัคร Google AI Ultra เท่านั้น

ผลทดสอบสำคัญๆ เช่น Humanity's Last Exam ของ Gemini 3 Pro อยู่ที่ 37.5% แซงหน้า GPT-5.1 ไปไกล ขณะที่ Gemini 3 Deep Think ทำคะแนนได้ถึง 41%

By lew Founder on Tag: Gemini, LLM
Gemini

เอกสารกำกับโมเดลปัญญาประดิษฐ์ หรือ model card ของ Gemini 3 Pro โมเดลรุ่นต่อไปของกูเกิลที่ยังไม่เปิดตัวหลุดออกมาในเว็บ Pixeldrain แสดงให้เห็นว่าโมเดลรุ่นนี้เอาชนะได้ทั้ง Claude Sonnet 4.5 และ GPT-5.1 และหลายชุดทดสอบชนะขาดยกเว้นเพียง SWE-Bench Verified ที่แพ้ Sonnet 4.5 ไปเล็กน้อย

เอกสารระบุว่า Gemini 3 Pro รองรับอินพุต 1 ล้านโทเค็น และเอาต์พุต 64,000 โทเค็น เป็นโมเดลที่สร้างขึ้นมาใหม่ ไม่ได้ fine-tune จากโมเดลเดิม ตัวโมเดลเป็นแบบ sparse mixture-of-experts ที่โมเดลจะทำงานเพียงบางส่วนตามอินพุตที่ใช้งานอยู่

ตัวโมเดลฝึกข้อมูลถึงเดือนมกราคม 2025

By arjin Writer on Tag: Grok, xAI, Artificial Intelligence, LLM
Grok

xAI เปิดตัว Grok 4.1 โมเดลปัญญาประดิษฐ์เวอร์ชันล่าสุด ที่เป็นรุ่นถัดไป Grok 4 ที่ออกมาเมื่อเดือนกรกฎาคม โดย Grok 4.1 มีสองโมเดลย่อยได้แก่ Grok 4.1 และ Grok 4.1 Thinking ซึ่งเริ่มอัปเดตให้ผู้ใช้งานทุกคนแล้วรวมทั้งแบบฟรี

ผลการทดสอบจาก LMArena ในหมวด Text Arena ที่เป็นการทดสอบหลายด้านแบบไม่เปิดเผยโมเดล พบว่าทั้ง Grok 4.1 และ Grok 4.1 Thinking มีคะแนนที่สูงโดดเด่นกว่าโมเดลอื่น

By lew Founder on Tag: Anthropic, LLM, Security
Anthropic

Anthropic รายงานว่ามีผู้ใช้ที่น่าจะเป็นกลุ่มแฮกเกอร์ที่ได้รับการสนับสนุนจากรัฐบาลจีน (Chinese state-sponsored group) ใช้ Claude Code เพื่อแฮกหน่วยงานจำนวนมาก ทั้งบริษัทเทคโนโลยี, สถาบันการเงิน, บริษัทเคมีภัณฑ์, และหน่วยงานรัฐ

รายงานไม่บอกรายละเอียดช่องโหว่ที่คนร้ายใช้แฮกแต่อย่างใด แต่บอกเพียงว่า คนร้ายใช้ Claude Code ที่เชื่อมกับ MCP เฉพาะทางเช่น เครื่องมือสแกน, ค้นเว็บ, เครื่องมือวิเคราะห์โค้ด เมื่อพบช่องโหว่แล้วก็จะให้ Claude เขียนโค้ดเพื่อกวาดเอาชื่อผู้ใช้และรหัสผ่านจากระบบที่เจาะได้ไปใช้งานต่อไป

By lew Founder on Tag: LLM, Israel
LLM

AI21 Labs บริษัทปัญญาประดิษฐ์จากฝั่งอิสราเอล ผู้สร้างโมเดลปัญญาประดิษฐ์ LLM ตระกูล Jurassic นำเสนอแนวทางการใช้เอกสารภายในมาตอบคำถาม (Retrieval-Augmented Generation - RAG) โดยมีแนวทางคือการแปลงข้อมูลที่ได้จากเอกสารต่างๆ ในองค์กรมาเป็นตารางฐานข้อมูลให้คิวรีได้ เรียกว่า Structured RAG หรือ S-RAG

S-RAG ต้องการตัวอย่างคำถามระหว่างการใส่เอกสาร เพื่อให้ปัญญาประดิษฐ์วิเคราะห์ได้ว่าควรดึงข้อมูลอะไรออกมาใส่ตาราง จากนั้นเมื่อผู้ใช้ถามคำถามจริงก็จะดึงข้อมูลจากตารางรูปแบบเดียวกับการแปลงคำถามเป็น SQL เดิมๆ

By arjin Writer on Tag: Deezer, Music, Artificial Intelligence, LLM, Survey
Deezer

Deezer แพลตฟอร์มฟังเพลงสตรีมมิ่งร่วมมือกับ Ipsos บริษัทวิจัยการตลาด สำรวจกลุ่มตัวอย่างใน 8 ประเทศ จำนวน 9,000 คน เกี่ยวกับทัศนคติและประสบการณ์ในการฟังเพลงที่สร้างจาก AI ซึ่งเป็นประเด็นใหญ่ในจักรวาลฟังเพลงสตรีมมิ่งตอนนี้ เฉพาะ Deezer เองก็เปิดเผยว่ามีเพลงจาก AI อัปโหลดเข้ามาประมาณ 50,000 เพลงต่อวัน คิดเป็น 34% ของเพลงที่อัปโหลดมาทั้งหมด

ผลสำรวจเริ่มด้วยประเด็นการทดสอบ ให้กลุ่มตัวอย่างฟังเพลงแล้วแยกว่าเพลงใดสร้างโดยมนุษย์ และเพลงใดมาจาก AI พบว่า 97% ไม่สามารถแยกความแตกต่างได้, 71% รู้สึกประหลาดใจที่ตอบผิด และ 52% รู้สึกไม่สบายใจที่แยกความแตกต่างไม่ได้ โดย 51% เชื่อว่าเพลง AI มักมีคุณภาพเสียงที่แย่ หรือทำนองคุ้นเกินไป จึงอาจเป็นสาเหตุให้ตอบผิด

Subscribe to LLM