Image

Large Language Model

By lew Founder on Tag: Tencent, LLM
Tencent

Tencent เปิดตัวโมเดลตระกูล Hy3 (混元 แปลว่าจุดกำเนิดจักรวาล) เป็นโมเดลขนาด 295B-A21B รองรับ context 256K ที่อาศัยโครงสร้างการฝึกโมเดลแบบ reinforcement learning ที่ทาง Tencent สร้างขึ้นมาใหม่

รายงานโมเดลระบุว่าทีมงานลดการเทียบด้วยการทดสอบมาตรฐานลง เพราะการทดสอบเหล่านี้ถูกโกงได้โดยง่าย แต่พยายามสร้างชุดทดสอบภายในที่เป็นข้อสอบล่าสุดจริงๆ และผลทดสอบแสดงให้เห็นว่า Hy3 ขึ้นไปเทียบกับคู่แข่งอย่าง GLM-5 หรือ Kimi-K2.5 (สังเกตว่าทีมงานเลือกเทียบกับโมเดลเก่า) แต่ความเด่นจริงๆ คือ Hy3 มีขนาดเล็กกว่าโมเดลคู่แข่งมาก รายงานระบุว่า Hy3 เป็นก้าวแรกของการพัฒนาโมเดลต่อไป

By arjin Writer on Tag: Claude, Anthropic, LLM, Artificial Intelligence, Adobe, Affinity, Blender
Claude

Anthropic ประกาศความร่วมมือกับผู้พัฒนาแอปสำหรับงานสร้างสรรค์หลายราย เพื่อให้ Claude สามารถเชื่อมต่อผ่าน Connectors ในการทำงานร่วมกับแอปเหล่านี้ได้ไม่ว่าจะเป็นโครงการขนาดเล็กหรือโครงการขนาดใหญ่ที่ซับซ้อน

รายชื่อแอปที่ประกาศรอบนี้ได้แก่ Ableton, Adobe, Affinity, Autodesk Fusion, Blender, Resolume Arena กับ Resolume Wire, SketchUp และ Splice

สำหรับความร่วมมือกับ Blender นั้นมีความพิเศษเพราะ Anthropic ได้ร่วมสนับสนุนในโครงการโอเพนซอร์สของ Blender ด้วย และร่วมพัฒนา API Python เพื่อให้รองรับการเชื่อมต่อผ่าน MCP และเข้าถึงโมเดลผ่านวิธีการอื่น ๆ ไม่จำกัดเฉพาะการใช้ Claude

By lew Founder on Tag: Xiaomi, LLM
Xiaomi

Xiaomi ปล่อยโมเดล Xiaomi MiMo ออกมาเป็นโมเดลเปิดแบบสัญญาอนุญาต MIT ชูจุดเด่นว่าเป็นโมเดลระดับชั้นนำแต่ยังให้บริการที่ค่อนข้างถูก

ตัวโมเดล MiMo-V2.5-Pro ใช้สถาปัตยกรรม MoE ขนาด 1T-A42B ทำให้มีโมเดลขนาดใหญ่แต่ยังเล็กกว่าโมเดลอย่าง DeepSeek-V4-Pro มาก และใช้เทคนิค Multi-Token-Prediction เพื่อเพิ่มประสิทธิภาพการรัน

แนวทางการให้บริการของ Xiaomi ค่อนข้างแปลกกว่าเจ้าอื่นๆ คือให้บริการซื้อโทเค็นแบบเหมาจ่าย แต่นับเครดิตต่อเนื่องไป ต่างจากบริษัทอื่นๆ ที่มักจะให้โควตาเป็นช่วงๆ แต่มีแรงจูงใจให้ใช้นอกช่วงเวลาหนาแน่นด้วยการลดปริมาณเครดิตที่ใช้หากใช้งานช่วงใกล้เที่ยงคืนถึงเช้าในประเทศไทย

By lew Founder on Tag: OpenAI, Privacy, LLM
OpenAI

OpenAI ปล่อยโมเดล OpenAI Privacy Filter โมเดลสำหรับกรองข้อมูลส่วนบุคคลก่อนส่งไปยังระบบภายนอกที่เราไม่ต้องการให้เห็นข้อมูลส่วนตัว

Privacy Filter สามารถตรวจจับข้อมูลส่วนตัวได้ 8 หมวด ได้แก่ ชื่อบุคคล, ที่อยู่, อีเมล, หมายเลขโทรศัพท์, URL, วันที่, หมายเลขบัญชี, และกุญแจลับต่างๆ

สถาปัตยกรรมของ Privacy Filter สร้างจาก LLM เดิม แต่เปลี่ยนการทำนายโทเค็นถัดไป เป็นการตรวจจับประเภทของโทเค็นต่างๆ แทน โดยรวมโมเดลมีขนาด 1.5B ทำให้สามารถรันในองค์กรได้โดยง่าย

By lew Founder on Tag: AMD, LLM
AMD

MangoBoost ผู้ผลิตซอฟต์แวร์ออปติไมซ์ประมวลผลข้อมูล ระบุชิป AMD สามารถทำประสิทธิภาพได้ใกล้เคียงกับชิป NVIDIA ใน generation เดียวกันหากมีการออปติไมซ์ดีพอ อย่างไรก็ดีกระบวนการออปติไมซ์ในซอฟต์แวร์โอเพนซอร์สยอดนิยมนั้นซับซ้อนจนทำให้การดึงประสิทธิภาพได้เต็มยังคงยุ่งยาก

By lew Founder on Tag: DeepSeek, LLM
DeepSeek

DeepSeek ออกโมเดลเวอร์ชัน 4 สองตัว ได้แก่ DeepSeek-V4-Pro และ DeepSeek-V4-Flash ชูจุดเด่นว่ามีความเก่งในหมวดการเขียนโปรแกรมระดับเดียวกับโมเดลชั้นนำ เช่น Opus 4.6, GPT-5.4 xhigh, และ Gemini 3.1 Pro (high)

By arjin Writer on Tag: OpenAI, ChatGPT, LLM, Artificial Intelligence
OpenAI

OpenAI ออกโมเดลรุ่นหลักเวอร์ชันใหม่ GPT-5.5 และ GPT-5.5 Pro โดยบอกว่ามีความสามารถต่าง ๆ ที่มากขึ้น ไม่ว่าจะเป็นการเขียน การแก้โค้ด การค้นคว้าข้อมูลออนไลน์ การวิเคราะห์ข้อมูล สร้างเอกสาร จัดการซอฟต์แวร์ พร้อมกับชุดข้อมูลความรู้ที่มากกว่าเดิม แต่อัตราการใช้โทเค็นนั้นใกล้เคียงกับ GPT-5.4 สำหรับงานทั่วไป และใช้น้อยลงกว่าอย่างชัดเจน เมื่อเป็นการใช้งาน Codex

ผลการทดสอบ GPT-5.5 ทำคะแนนได้โดดเด่นในหลายหัวข้อเช่น Terminal-Bench 2.0, GDPval หรือ FrontierMath

By arjin Writer on Tag: OpenAI, ChatGPT, LLM, Artificial Intelligence
OpenAI

OpenAI เปิดตัว ChatGPT Images 2.0 โมเดลปัญญาประดิษฐ์สร้างรูปภาพเวอร์ชันใหม่ เพิ่มความสามารถการทำงานที่ซับซ้อนมากขึ้น มีโหมด Thinking สำหรับลูกค้าแผน Pro สามารถค้นหาข้อมูลจากเว็บไซต์ประกอบภาพได้แบบเรียลไทม์ สร้างหลายรูปภาพพร้อมกันจาก prompt เดียว โดยยังให้ผลลัพธ์ที่แม่นยำ

ตัวอย่างความสามารถที่นำเสนอใน ChatGPT Images 2.0 ได้แก่

By lew Founder on Tag: Alibaba Cloud, Qwen, LLM
Alibaba Cloud

Alibaba Cloud เปิดตัว Qwen3.6-Max โมเดลปัญญาประดิษฐ์แบบปิดรุ่นสูงสุดของทีม Qwen ตัวโมเดลได้ผลทดสอบชนะรุ่นก่อนหน้าของ Qwen เองอย่าง Qwen3.6-Plus ค่อนข้างชัดเจน ทำให้ความฉลาดโดยรวมเกาะกลุ่มกับโมเดลปิดชั้นนำหลายตัว

ทาง Artificial Analysis จัดให้ Qwen3.6-Max มีคะแนนความฉลาดรวมเป็นที่ 4 ร่วมกับ Meta Muse Spark, และ Claude Sonnet 4.6 (max) แต่หากนับเฉพาะด้านการเขียนโค้ดยังเป็นอันดับ 6

ในแง่ฟีเจอร์การใช้งาน Qwen3.6-Max รองรับฟีเจอร์ preserve_thinking สำหรับการเก็บข้อความจากการคิดก่อนตอบรอบก่อนหน้า ทีมงาน Qwen ระบุว่าฟีเจอร์นี้สำคัญหากใช้งานกลุ่ม agentic

By lew Founder on Tag: Qwen, LLM
Qwen

Alibaba Cloud เปิดตัว Qwen3.6-35B-A3B โมเดลขนาดเล็กแบบโหลดไปรันได้เองที่มีความสามารถในการเขียนโปรแกรมขึ้นไปเทียบได้กับ Qwen3.5-27B ขณะที่ใช้พลังประมวลผลต่ำกว่ามากเพราะต้องรันจริงเพียง 3B เท่านั้น

คะแนนทดสอบด้านต่างๆ ของ Qwen3.6-35B-A3B ตามหลัง Qwen3.5-27B เล็กน้อยแต่สูงกว่า Qwen3.5-35B-A3B อย่างมาก และแซงหน้า Gemma4-31B ไปมาก

By lew Founder on Tag: Claude, Anthropic, LLM
Claude

Anthropic เปิดตัว Claude Opus 4.7 ที่ผลทดสอบจำนวนมากฉีกออกจาก Opus เวอร์ชั่นก่อนหน้านี้หลายตัว ทำคะแนนได้กึ่งกลางระหว่าง Opus 4.6 และ Mythos ที่ยังไม่เปิดให้บริการกับคนทั่วไป

คะแนนทดสอบดีขึ้นหลายจุด แต่ Anthropic ยกจุดสำคัญในอัพเดตครั้งนี้ ได้แก่

By lew Founder on Tag: NVIDIA, Quantum Computer, LLM
NVIDIA

NVIDIA เปิดตัวโมเดลปัญญาประดิษฐ์ในตระกูล NVIDIA Ising เป็นชุดโมเดลสำหรับใช้คู่กับคอมพิวเตอร์ควอนตัมเพื่ออำนวยความสะดวกในการใช้งานส่วนต่างๆ ตอนนี้มีสองโมเดล ได้แก่

By arjin Writer on Tag: Claude, Anthropic, Microsoft Word, LLM
Claude

Anthropic ส่วนเสริมสำหรับ Microsoft Word "Claude for Word" เพิ่มเติมจากส่วนเสริมของ Excel และ PowerPoint ที่ออกมาก่อนหน้านี้

Claude for Word มีความสามารถในการร่างเอกสาร แก้ไขเอกสาร และตรวจทวนเนื้อหาในเอกสาร ซึ่งสั่งงานได้ทันทีจากแถบด้านข้างของ Word โดยยังรักษาฟอร์แมตการจัดวางของเอกสารไว้ รวมทั้งเปิดการทำงาน tracked changes ให้ผู้ใช้งานตรวจสอบรายละเอียดการแก้ไขได้ในแต่ละขั้นตอน

Claude for Word เปิดให้ใช้งานแล้วสำหรับลูกค้า Team และ Enterprise สถานะของเครื่องมือยังเป็นเบต้า

ที่มา: Anthropic

By lew Founder on Tag: MiniMax, LLM, Programming, Open Source
MiniMax

MiniMax บริษัทพัฒนาปัญญาประดิษฐ์จากจีน ปล่อยโมเดล MiniMax-M2.7 ที่เน้นความสามารถในการเขียนโปรแกรมออกมาให้ดาวน์โหลด หลังจากที่ก่อนหน้านี้เปิดตัวแต่ให้บริการแบบ API เท่านั้น แต่แม้จะปล่อยโมเดลออกมาให้นำไปรันได้เอง ในเวอร์ชั่นนี้ห้ามนำไปรันเพื่อการค้าอีกต่อไปต้องขออนุญาตจาก MiniMax ก่อนเท่านั้น

ก่อนหน้านี้โมเดลตระกูล MiniMax-M2 ใช้ไลเซนส์แบบ modified MIT ที่เพิ่มเงื่อนไขว่าต้องแสดงข้อความให้ชัดเจนว่ากำลังให้บริการด้วยโมเดล MiniMax แต่ก็ยังให้บริการเพื่อการค้าได้ ในเวอร์ชั่นนี้เป็นการห้ามใช้งานทั้งหมด ต้องขออนุญาตเป็นทางการเท่านั้น

By lew Founder on Tag: Z.ai, LLM
Z.ai

Z.ai ผู้พัฒนาโมเดลปัญญาประดิษฐ์ตระกูล GLM ประกาศขึ้นราคาค่าใช้งาน ทั้งแบบแพ็กเกจรายเดือนและแบบ API โดยเฉพาะแบบแพ็กเกจรายเดือนที่เคยเปิดตัวเพียง 3 ดอลลาร์ต่อเดือนขึ้นมาเป็น 18 ดอลลาร์ต่อเดือน การขึ้นราคาครั้งนี้ไม่ได้เป็นการขึ้นรวดเดียวแต่ Z.ai ปรับราคามาเรื่อยๆ นับแต่เปิดตัวมา

สำหรับค่าบริการแบบ API นั้น GLM-5.1 ก็ปรับราคาเป็น 1.4/4.4 ดอลลาร์ต่อล้านโทเค็น เทียบกับ GLM-5 ที่ราคาเพียง 1/3.2 ดอลลาร์ต่อล้านโทเค็น แม้ว่าทั้งสองโมเดลจะมีขนาดเท่ากันที่ 754B

By lew Founder on Tag: Meta AI, Meta, LLM
Meta AI

Meta เปิดตัวปัญญาประดิษฐ์ LLM ในชื่อ Muse Spark เป็นโมเดลแรกในตระกูล Muse ที่ทำคะแนนทดสอบได้ระดับเดียวกับโมเดลชั้นนำ เช่น Opus 4.6, Gemini 3.1 Pro, GPT-5.4 พร้อมกับโหมด Contemplating สำหรับการสร้างเอเจนต์หลายตัวช่วยกันทำงานเพื่อหาคำตอบ ทำให้คะแนนทดสอบขึ้นไปเทียบกับ Gemini 3.1 Deep Think และ GPT Pro ได้ ตัว Muse Spark ยังเป็นโมเดลแบบ multimodal รองรับรูปภาพในตัว

ประเด็นสำคัญที่ Meta โชว์คือสถาปัตยกรรมที่ต้องการพลังประมวลผลน้อยลงเพื่อฝึกโมเดลให้ได้ความฉลาดเท่าเดิม เช่น เมื่อเทียบกับ Llama 4 Maverick แล้ว Muse Spark ใช้พลังประมวลผลรวมเพียง 1 ใน 10 เพื่อให้ได้ความฉลาดเท่ากัน

By lew Founder on Tag: Claude, Anthropic, LLM, Security
Claude

Anthropic เปิดตัวโมเดลรุ่นใหญ่สุดในชื่อ Claude Mythos เป็นโมเดลรุ่นใหญ่ความสามารถสูง ผลทดสอบต่างๆ ทำคะแนนเหนือกว่าโมเดลเดิมๆ อย่างชัดเจน เช่น SWE Bench Verified ที่ทำคะแนนได้ถึง 93.9% แซงหน้า Claude Opus ขึ้นถึง 13.1% หรือคะแนนทดสอบอื่นๆ เช่น SWE Bench Pro, Terminal Bench 2.0 ก็ล้วนทำคะแนนทิ้งห่างจาก Claude Opus 4.6

By arjin Writer on Tag: Z.ai, Artificial Intelligence, LLM
Z.ai

Z.ai เผยแพร่โมเดล AI โอเพนซอร์สเรือธงรุ่นใหม่ GLM-5.1 โดยนิยามความสามารถว่าไม่ใช่ Vibe Coding แต่เป็น "Agentic Engineeing" ที่มีความสามารถทั้งการเขียนโค้ดและแก้ปัญหาทางวิศวกรรมที่เหนือกว่าโมเดลรุ่นก่อน โดยโมเดลมีขนาด 754 พันล้านพารามิเตอร์

By arjin Writer on Tag: Google, Mobile App, Text-to-Speech, Artificial Intelligence, LLM
Google

กูเกิลออกแอปใหม่บน iOS ชื่อ Google AI Edge Eloquent โดยเป็นแอปถอดข้อความเสียงออกมาเป็นตัวหนังสือ เสริมความสามารถด้วย AI ทำให้ข้อความที่ได้ดูดีมากขึ้น

ฟีเจอร์หลักได้แก่ การถอดข้อความเสียงที่พูด โดยตัดคำที่ไม่จำเป็นเช่น umm, uhs ให้ออกมาเป็นข้อความที่มีเฉพาะเนื้อหาหลัก รองรับการบันทึกคำศัพท์เฉพาะเพื่อให้ถอดข้อความได้แม่นยำขึ้น นอกจากนี้ยังใช้ AI ปรับแต่งข้อความให้เป็นสไตล์ที่ต้องการ เช่น ย่อความ, ตัดแบ่งเป็นหัวข้อ หรือปรับให้เป็นทางการมากขึ้น

By lew Founder on Tag: Claude, Programming, LLM
Claude

ผู้ใช้ GitHub บัญชี stellaraccident เขียนรายงานวิเคราะห์ว่าในช่วงเดือนที่ผ่านมา Claude Code ความสามารถลดลงมาก โดยเขาอาศัย log ทั้งหมดในช่วงหลายเดือนที่ผ่านมาวิเคราะห์พฤติกรรมของ Claude Code

รายงานพบว่า Claude เริ่มปิดบัง thinking token มากขึ้นเรื่อยๆ จนปิดบังทั้งหมด ขณะที่อัตราการคิดก่อนตอบโดยเฉลี่ยก็สั้นลงเรื่อยๆ ส่งผลต่อคุณภาพการเขียนโค้ดโดยรวมลดลง เช่น ก่อนหน้านี้ Claude Code จะพยายามอ่านไฟล์ก่อนแก้ไขเสมอ แต่ช่วงหลังกลับพยายามแก้ไขทันที ส่งผลให้การแก้ไขไฟล์ล้มเหลวมากขึ้น หลายครั้งก็คิดวนไปวนมาเปลืองโทเค็นไปเปล่าๆ

Subscribe to LLM