Image

Large Language Model

By lew Founder on Tag: Gemma, LLM, Google
Gemma

กูเกิลเปิดตัว LiteRT-LM ไลบรารีภาษา C++ สร้างต่อจากไลบรารี LiteRT (ชื่อเดิม TensorFlow Lite) แต่ออกแบบให้ใช้รันโมเดลภาษาโดยเฉพาะ

LiteRT-LM กำหนดฟอร์แมตสำหรับโมเดล LLM แบบใหม่เป็นไฟล์ .litertlm โดยตอนนี้มีเพียง Gemma3 1B และ Gemma3n เท่านั้น เป้าหมายของการพัฒนาคือการรองรับการรันโมเดลเดียวกันในทุกที่ ตั้งแต่แอนดรอยด์, เดสก์ทอปทั้งวินโดวส์, แมค, และลินุกซ์ โดยตอนนี้สามารถใช้งานได้แล้วหากรันด้วยซีพียู ทางทีมงานมีแผนจะซัพพอร์ตจีพียูบนทุกแพลตฟอร์มต่อไป

By lew Founder on Tag: Apple Silicon, Apple, LLM, Python
Apple Silicon

แอปเปิลเปิดตัวไลบรารี MLX-LM ที่มาพร้อมชุดคำสั่งที่เปิดให้ผู้ใช้สามารถรันโมเดลปัญญาประดิษฐ์แบบ LLM โดยมีความสามารถครบถ้วนตลอดกระบวนการใช้งาน LLM ตั้งแต่การรัน, การแคช, จนถึงการฝึกโมเดลเพิ่มเติม

กระบวนการรัน LLM ของ MLX-LM นั้นรองรับการ KV cache ทำให้โมเดลรันเร็วขึ้น ผู้ใช้สามารถเลือกขนาดหน่วยความจำที่จะใช้แคชได้

คำสั่ง quantization เปิดให้ผู้ใช้สามารถย่อโมเดลได้ด้วยตัวเอง และยังคอนฟิกได้อย่างละเอียด เช่น ย่อบางชั้นเล็กน้อยและย่อบางชั้นให้เล็กเป็นพิเศษ ส่วนกระบวนการ fine-tuning นั้น MLX-LM รองรับทั้งแบบเต็มโมเดลและแบบ LoRA ซึ่งฝึกได้เร็วกว่า

By mk Founder on Tag: Mistral, LLM
Mistral

Mistral เปิดตัวโมเดลที่มีการให้เหตุผลของตัวเองชื่อ Magistral ไล่หลังคู่แข่งบริษัทอื่นๆ ที่ทยอยเพิ่มโมเดลตระกูล reasoning ก้นถ้วนหน้า

โมเดล Magistral ออกมาสองขนาดคือ Magistral Small 24B เปิดเป็นโอเพนซอร์ส ขนาดเล็กพอที่จะรันแบบโลคอล เปิดให้ดาวน์โหลดบน Hugging Face และ Magistral Medium ที่เก่งกว่า จับตลาดลูกค้าองค์กร คะแนนทดสอบเบนช์มาร์คของ Magistral Medium อยู่ในระดับใกล้เคียงกับ DeepSeek-R1 ที่ออกมาก่อนหน้านี้ ตัว Medium เรียกใช้ผ่าน API หรือผ่านแชท Le Chat

By arjin Writer on Tag: OpenAI, ChatGPT, Artificial Intelligence, LLM, Developer, API
OpenAI

OpenAI ออกโมเดลปัญญาประดิษฐ์ใหม่ o3-pro บอกว่าที่เป็นรุ่นฉลาดในตระกูลโมเดล o3 สามารถคิดได้นานมากขึ้น และให้คำตอบที่แม่นยำมากกว่า ซึ่งเป็นรุ่นถัดจาก o1-pro ที่ออกมาก่อนหน้านี้ เหมาะสำหรับการใช้งานด้านคณิตศาสตร์ วิทยาศาสตร์ เขียนโค้ด

เนื่องจาก o3-pro ใช้เวลาในการคิดคำตอบโดยเฉลี่ยนานมากกว่า o1-pro OpenAI จึงแนะนำให้ใช้งานกับคำถามที่ยากและท้าทาย ต้องการได้คำตอบที่ถูกต้องมากกว่าต้องการความเร็วของคำตอบ

By lew Founder on Tag: Apple, LLM, Research
Apple

ทีมวิจัยแอปเปิลรายงานถึงผลสำรวจโมเดลปัญญาประดิษฐ์แบบคิดก่อนตอบ (large reasoning model - LRM) ที่สามารถคิดทบทวนก่อนตอบคำถามได้ และเป็นเครื่องมือสำคัญที่ทำให้โมเดลปัญญาประดิษฐ์จำนวนมากทำคะแนนทดสอบได้ดีขึ้นมากในช่วงหลัง โดยพบว่า LRM มีแนวโน้มคิดผิดไปจากแนวทางที่ควรเป็น รวมถึงคิดมากเกินไปจนอาจจะแสดงให้เห็นว่าที่จริงโมเดล LRM อาจจะแค่จำรูปแบบได้เท่านั้น

By lew Founder on Tag: Anthropic, LLM, Government
Anthropic

Anthropic เปิดตัว Claude Gov โมเด่นรุ่นฝึกพิเศษสำหรับทำงานความมั่นคงของรัฐบาลสหรัฐฯ ใช้งานกับเอกสารลับต่างๆ ของรัฐบาล

แม้ว่ารัฐบาลทั่วไปอาจจะใช้โมเดลโอเพนซอร์สต่างๆ ติดตั้งในศูนย์ข้อมูลของตัวเองเพื่อประมวลข้อมูลความลับอยู่แล้ว แต่ Claude Gov เป็นโมเดลรุ่นพิเศษที่ฝึกให้ยอมตอบข้อมูลด้านความมั่นคง และเข้าใจภาษาและคำศัพท์ของคนทำงานความมั่นคงเพิ่มเติม

แม้จะเป็นรุ่นสำหรับงานความมั่นคง แต่ Anthropic ก็ยืนยันว่าโมเดลกลุ่มนี้จะถูกตรวจสอบความปลอดภัยเช่นเดิม

ที่มา - Anthropic

By arjin Writer on Tag: OpenAI, Lawsuits, LLM, ChatGPT, New York Times
OpenAI

มีประเด็นจากคดีที่หนังสือพิมพ์ The New York Times (NYT) ฟ้อง OpenAI ว่านำบทความไปใช้ฝึก AI โดยไม่ได้รับอนุญาต ซึ่งกำลังอยู่ในการพิจารณาคดีของศาล โดย NYT ได้ร้องขอให้ศาลออกคำสั่งให้ OpenAI เก็บล็อก (log) ของผู้ใช้งาน ChatGPT ทั้งหมดโดยไม่มีการลบข้อมูลออก เพราะเชื่อว่าจะเจอข้อมูลสำคัญที่สนับสนุนคำฟ้องร้องนี้

By lew Founder on Tag: Alibaba Cloud, LLM, Qwen
Alibaba Cloud

Alibaba Cloud เปิดตัวโมเดล Qwen3 Embedding และ Qwen3 Reranking สำหรับการค้นหาเอกสารตามความหมายในเนื้อความ โดยชูจุดเด่นว่าโมเดลเหล่านี้ค้นหาเอกสารได้แม่นยำ

Qwen3 Embedding มี 3 ขนาด ได้แก่ 0.6B, 4B, และ 8B แม้แต่ตัวเล็กที่สุดคือ 0.6B นั้นก็ยังได้คะแนน MMTEB (ทดสอบการค้นหาเอกสารจากเอกสาร 500 ชุด กระจาย 250 ภาษา) สูงกว่า text-embedding-3-large ของ OpenAI ที่น่าจะได้รับความนิยมสูงมาก ขณะที่โมเดลขนาดใหญ่ก็สามารถเอาชนะโมเดลรุ่นใหม่ๆ ได้

By lew Founder on Tag: Gemini, LLM, Google
Gemini

กูเกิลประกาศ Genini 2.5 Pro Preview 06-05 (เวอร์ชั่นก่อนหน้านี้ 05-06) ปรับปรุงความฉลาดขึ้นอีก โดยสามารถทำคะแนนทดสอบด้านการเขียนโปรแกรมได้สูงขึ้น ใน LMArena นั้นคะแนน ELO รวมเพิ่มขึ้น 25 คะแนน และคะแนนด้านการพัฒนาเว็บเพิ่มขึ้น 35 คะแนน กลับมานำ Claude 4 Opus ได้สำเร็จ หลังจากถูกแซงไปสองสัปดาห์

เวอร์ชั่นนี้รองรับฟีเจอร์จำกัดระยะเวลาคิด (thinking budget) เพิ่มขึ้นมาทำให้ควบคุมต้นทุนและระยะเวลาตอบได้ดีขึ้น

By Fzo Contributor on Tag: DeepSeek, LLM, Gemini, Artificial Intelligence, China
DeepSeek

DeepSeek ผู้พัฒนา AI จากจีน ที่เพิ่งอัปเดตโมเดล R1-0528 ซึ่งเน้นความสามารถด้านการให้เหตุผล (reasoning) ถูกตั้งข้อสังเกตว่า อาจได้ใช้ข้อมูลที่มาจากผลลัพธ์ของโมเดล Google Gemini มาใช้ในการเทรนโมเดลดังกล่าว

By lew Founder on Tag: Windows, Copilot+ PC, Microsoft, LLM
Windows

ในงาน Microsoft BUILD ที่ผ่านมาไมโครซอฟท์ได้ประกาศถึงซอฟต์แวร์และบริการที่เกี่ยวกับปัญญาประดิษฐ์จำนวนมาก แต่ฟีเจอร์หนึ่งที่ประกาศออกมา คือ Windows AI Foundry ที่ปรับปรุงจากไลบรารีเดิม และเพิ่มความสามารถสำคัญคือการรันโมเดลปัญญาประดิษฐ์แบบ large language model ได้ในตัว ในงานครั้งนี้ Steven Bathiche ที่เป็น Microsoft Technical Fellow ก็ให้สัมภาษณ์ถึงแนวทางการพัฒนาวินโดวส์ด้วยเทคโนโลยีตัวนี้ว่ามันจะเป็นอินเทอร์เฟซของการทำงานร่วมกับคอมพิวเตอร์ในยุคต่อไป

By mk Founder on Tag: Google, Mobile App, Artificial Intelligence, LLM
Google

กูเกิลออกแอพใหม่แนวทดลองชื่อ Google AI Edge Gallery เอาไว้รันโมเดลในอุปกรณ์มือถือ

ในแง่ฟีเจอร์ของ Google AI Edge Gallery ไม่ต่างอะไรจากบริการ AI ทั่วไป เช่น แชทคุย ถามตอบ อัพโหลดภาพแล้วให้ AI อ่านข้อมูลในภาพ ความแตกต่างสำคัญคือบริการ AI จะรันอยู่ในเครื่องมือถือของเรา (ตอนนี้รองรับเฉพาะ Android) ผ่านเฟรมเวิร์ค LiteRT หรือชื่อเดิม TensorFlow Lite โดยเลือกโมเดลได้เองจาก Hugging Face เช่น Gemma 3n ที่ปรับแต่งให้รันบนโทรศัพท์ได้ สามารถคอนฟิกโมเดลก่อนรันงานได้

By arjin Writer on Tag: Character.AI, Artificial Intelligence, LLM
Character.AI

Character.AI ประกาศขยายความสามารถในการสร้างสรรค์ผลงานในรูปแบบต่าง ๆ โดยฟีเจอร์ก่อนหน้านี้ที่เปิดตัวคือ AvatarFX ซึ่งเป็น AI สร้างวิดีโอสั้นตามคาแรกเตอร์ที่กำหนด ก็รวมอยู่ในประกาศครั้งนี้ด้วย

ของใหม่ที่ประกาศได้แก่

By P.J Writer on Tag: Gartner, Artificial Intelligence, LLM

Gartner คาดว่าภายในปี 2027 องค์กรจะใช้โมเดล AI ขนาดเล็กเฉพาะงานมากกว่าโมเดลภาษาขนาดใหญ่ (LLMs) 3 เท่า เนื่องจากทำงานเฉพาะทางแม่นยำกว่า ประมวลเร็วกว่า และใช้ทรัพยากรน้อยลง

ถึงแม้ LLMs จะมีความสามารถด้านภาษา แต่กลับมีความแม่นย่ำน้อยลงเมื่อต้องทำงานเฉพาะด้าน ขณะที่โมเดลขนาดเล็กสามารถปรับแต่งให้ตรงกับข้อมูลและบริบทของผู้ใช้ ซึ่งช่วยประหยัดเวลา ทรัพยากร และต้นทุนในการประมวลผลและดูแลรักษา

ที่มา: ข่าวประชาสัมพันธ์

By mk Founder on Tag: Gemma, Medical, Health, LLM, DeepMind
Gemma

Google DeepMind เปิดตัว MedGemma โมเดล Gemma 3 เวอร์ชันที่ถูกเทรนเพื่อข้อมูลทางการแพทย์

MedGemma แบ่งออกเป็น 2 เวอร์ชันได้แก่

By lew Founder on Tag: Artificial Intelligence, LLM, Employment, Economics
Artificial Intelligence

Daron Acemoglu นักเศรษฐศาสตร์จาก MIT ผู้ได้รับรางวัลโนเบลเมื่อปี 2024 ที่ผ่านมา ให้สัมภาษณ์กับทาง MIT เองถึงการทำนายของเขาที่ระบุว่าปัญญาประดิษฐ์ที่กำลังเป็นกระแสตอนนี้จะไม่ได้กระทบเศรษฐกิจขนาดนั้น โดยเขาทำนายว่าปํญญาประดิษฐ์จะสามารถทำให้งานกลายเป็นระบบอัตโนมัติได้เพียง 5% และตัวเทคโนโลยีปัญญาประดิษฐ์จะเพิ่ม GDP ของโลกได้เพียง 1% ภายในสิบปีข้างหน้า

By lew Founder on Tag: Anthropic, LLM, Employment
Anthropic

Dario Amodei ซีอีโอ Anthropic ผู้สร้างโมเดลปัญญาประดิษฐ์ Claude ให้สัมภาษณ์กับ Axios ทำนายว่าภายใน 5 ปีข้างหน้าปัญญาประดิษฐ์จะทดแทนงานออฟฟิศระดับต้น (entry-level white collar) ถึงครึ่งหนึ่ง ทำให้อัตราการว่างงานพุ่งสูงไปถึงระดับ 10-20%

เขาทำนายว่าแรงงานจะกระทบไปทุกภาคส่วน ตั้งแต่สายเทคโนโลยี, การเงิน, กฎหมาย, และงานออฟฟิศอื่นๆ โดยตำแหน่งงานระดับเริ่มต้นได้รับผลกระทบสูงสุด พร้อมกับแสดงความกังวลว่ารัฐบาลยังไม่รู้ตัวว่าจะเกิดอะไรขึ้น ขณะที่คนจำนวนมากก็ยังไม่เชื่อว่า [ปัญญาประดิษฐ์จะมาแทนคน]

By mk Founder on Tag: Llama, Meta, Artificial Intelligence, Mistral, LLM
Llama

Business Insider รายงานว่าทีม Llama ของ Meta เริ่มทยอยลาออกจากบริษัท โดยผู้ร่วมเขียน เปเปอร์ Llama ฉบับแรกสุดในปี 2023 (เปเปอร์) จำนวน 14 คน ตอนนี้เหลือเพียง 3 คนที่ยังอยู่กับ Meta

By lew Founder on Tag: LLM, Security, GitLab
LLM

ทีมวิจัยจาก Legit Security รายงานถึงรูปแบบการโจมตีโครงการซอฟต์แวร์ที่ใช้ปัญญาประดิษฐ์เขียนโค้ดช่วยแก้รายงานปัญหา (issue) ต่างๆ ด้วยการแทรกข้อความที่มองไม่เห็นไว้ในรายงานปัญหา ทำให้ปัญญาประดิษฐ์ทำตามคำสั่ง

ทีมวิจัยทดสอบกับ GitLab Duo ปัญญาประดิษฐ์ช่วยเขียนโค้ดของ GitLab โดยแอบแทรกคำสั่งสร้างโค้ดมุ่งร้ายตามจุดต่างๆ เช่น คอมเมนต์ในโค้ดที่ส่ง merge request เข้ามา, ข้อความ commit message, ข้อความใน issue เอง หรือแม้แต่คอมเมนต์, และตัวซอร์สโค้ดเอง พบว่า Duo ทำตามคำสั่งหมด

By lew Founder on Tag: Claude, Anthropic, LLM
Claude

Anthropic เปิดรายงานความปลอดภัยของ Claude 4 Opus ที่แม้จะมีความปลอดภัยระดับ AI Safety Level 3 (ASL-3) แต่ในบางกรณีเมื่อเงื่อนไขบีบเค้นก็สามารถทำให้แสดงพฤติกรรมไม่พึงประสงค์ออกมาได้

ทีมงานทดสอบโดยการวางเป้าหมายให้ Cluade 4 ว่าต้องพยายามรักษาชีวิตรอด และบีบเค้นทางเลือกเอาตัวรอดของ Claude 4 จำกัดลงเรื่อยๆ ก็พบพฤติกรรมไม่พึงประสงค์หลายกรณี เช่น

Subscribe to LLM