Image

Large Language Model

By lew Founder on Tag: Qwen, Alibaba Cloud, LLM
Qwen

Alibaba Cloud เปิดตัวโมเดลปัญญาประดิษฐ์ Qwen3.8-27B โมเดลขนาดเล็กที่รันในการ์ดตามบ้านได้แต่ประสิทธิภาพเพิ่มขึ้นจาก Qwen3.6-27B ขึ้นมาอย่างมาก เมื่อเทียบความสามารถด้านการเขียนโปรแกรมนั้นเทียบได้กับ Claude Opus 4.6

คะแนนทดสอบที่เพิ่มขึ้นอย่างมาก เช่น Terminal Bench 2.1 เพิ่มขึ้นเป็น 73.0, SWE-bench Pro เพิ่มเป็น 61.7 และ DeepSWE เพิ่มเป็น 42.2

ตอนนี้ทาง Alibaba เปิดโมเดลให้ดาวน์โหลดแล้ว และยืนยันว่าจะมีบริการ API ออกมาให้ใช้งานภายหลัง แต่ใน OpenRouter ก็มีผู้ให้บริการคือ AkashML ให้บริการอยู่ที่ 0.45/3.2 ดอลลาร์ต่อล้านโทเค็น นับว่าค่อนข้างแพงเมื่อเทียบกับขนาดโมเดล

By mk Founder on Tag: Anthropic, Claude, LLM
Anthropic

Anthropic เปิดเผยในรายงานความเสี่ยง (Risk Report) ประจำเดือนสิงหาคม 2026 ว่ามีโมเดลปัญญาประดิษฐ์ที่ใช้เฉาพะภายในบริษัท ชื่อ "Model 1" และ "Model 2"

ในรายงานบอกว่า Model 1 มีความใกล้เคียงกับ Claude Mythos 5 มาก ต่างกันเล็กน้อยเท่านั้น แต่ Model 2 มีความสามารถสูงกว่า Mythos 5 อย่างมีนัยสำคัญ (ต้นฉบับใช้คำว่า somewhat more capable) ซึ่ง Model 2 ถูกใช้อย่างหนักหน่วง (used heavily) พอๆ กับ Claude Mythos 5 ในงานหลากหลายประเภท เช่น เขียนโค้ด วิจัย ค้นหาช่องโหว่

By arjin Writer on Tag: Z.ai, Artificial Intelligence, LLM
Z.ai

Z.ai ออกโมเดลปัญญาประดิษฐ์แบบโอเพนซอร์สเวอร์ชันใหม่ GLM-5.3 ซึ่งพัฒนาบนพื้นฐานเดียวกับโมเดล GLM-5.2 เวอร์ชันก่อนหน้านี้ ด้วยอาศัยขั้นตอนหลังการฝึกฝนโมเดล (post-training) เพื่อเพิ่มความสามารถด้านต่าง ๆ

GLM-5.3 มีจุดเด่นด้านการเขียนโค้ดที่ทำได้ดียิ่งขึ้น ตัวเลขที่ Z.ai บอกคือทำคะแนนการทดสอบที่ Z.ai ใช้ภายในได้ดีกว่า GLM-5.2 ถึง 50% ส่วนหัวข้ออื่นเช่น Terminal Bench 3.0 หรือ Agents' Last Exam ก็มีคะแนนที่โดดเด่นเมื่อเทียบกับโมเดลชั้นนำของ OpenAI และ Anthropic

By lew Founder on Tag: Gemini, LLM
Gemini

กูเกิลอัพเดต Gemini 3.7 Flash โดยแสดงผลทดสอบว่าความสามารถด้านการเขียนโปรแกรมพัฒนาขึ้นอย่างมาก ทำให้ขึ้นไปใกล้เคียง Claude Sonnet 5 หรือ GPT-5.6 Terra แล้ว พร้อมกับประกาศออกโปรโมชันลดราคาลงครึ่งหนึ่งถึงสิ้นปีนี้

ที่ราคานี้ทำให้ Gemini 3.7 Flash คุ้มราคากว่าโมเดลจำนวนมากในตลาด หากนับดัชนีทดสอบ Artificial Analysis อยู่ที่ 56 ตามหลัง Muse Spark 1.2 ของ Meta อยู่หนึ่งคะแนน และนำหน้า DeepSeek V4 Pro 0813 ตัวล่าสุด

By mk Founder on Tag: OpenAI, LLM, Security
OpenAI

เมื่อเดือนพฤษภาคม OpenAI เปิดตัวโครงการ Daybreak ที่นำโมเดล LLM มาช่วยค้นหาช่องโหว่ความปลอดภัยไซเบอร์ ลักษณะเดียวกับ Project Glasswing ของ Anthropic ที่ใช้โมเดล Claude Mythos

ล่าสุด OpenAI ประกาศขยายโครงการ Daybreak โดยแบ่งผู้ใช้งานเป็น 2 ระดับ ตามรูปแบบการใช้งานที่แตกต่างกัน

By arjin Writer on Tag: Grok, SpaceXAI, LLM, Artificial Intelligence
Grok

SpaceXAI เปิดตัวโมเดลปัญญาประดิษฐ์รุ่นใหม่ Grok 4.6 ซึ่งพัฒนาต่อยอดจากโมเดลรุ่นก่อนหน้า Grok 4.5 เพิ่มความสามารถการทำงานคำสั่งที่รันต่อเนื่องเป็นเวลานาน และรองรับการทำงานที่มีความซับซ้อนได้ดียิ่งขึ้น

ผลการทดสอบ Grok 4.6 ระบุว่ามีคะแนนเทียบได้กับ GPT-5.6 Sol โมเดลรุ่นบนของ OpenAI ในหัวข้อ Artificial Analysis Intelligence Index ที่เป็นการทดสอบ 9 ด้านแล้วคิดคะแนนรวมกัน ขณะที่มีแยกรายหัวข้อมีคะแนนสูสีกับ GPT-5.6 Sol แต่ยังน้อยกว่า Fable 5 Max ของ Anthropic

By lew Founder on Tag: DeepSeek, LLM
DeepSeek

หลัง DeepSeek เปิดตัว DeepSeek V4 Pro ก็ขึ้นราคาตามที่ประกาศไว้ก่อนหน้านี้ โดยราคาหลักๆ ขึ้น 3 เท่าตัว และบางกรณีเพิ่มขึ้นถึง 12 เท่าตัว

สำหรับราคาหลัก คือ อินพุตและเอาท์พุต ทั้ง V4 Flash และ V4 Pro ขึ้นราคา 3 เท่าและ 4.6 เท่า ส่วนที่ขึ้นราคามากที่สุดคือค่าแคชของ V4 Pro ที่ขึ้นจาก 0.003625 ดอลลาร์ต่อล้านโทเค็น มาเป็น 0.044 ดอลลาร์ต่อล้านโทเค็น หรือประมาณ 12 เท่าตัว

แม้จะขึ้นราคามาก แต่ DeepSeek ยังมีส่วนลดนอกช่วงเวลาหนาแน่นที่ให้ราคาเพียงครึ่งเดียว โดยช่วงเวลาหนาแน่น ได้แก่ 8.00-11.00 และ 13.00-17.00 ตามเวลาประเทศไทย

By lew Founder on Tag: DeepSeek, LLM
DeepSeek

DeepSeek ปล่อยอัพเดตโมเดล DeepSeek V4 Pro รุ่นตัวจริงหมายเลขเวอร์ชัน 0813 ออกมาตามที่ประกาศไว้ก่อนหน้านี้ โดยผลทดสอบต่างๆ ดีขึ้นมาก แต่จุดเด่นสำคัญคือราคาค่า API ของเวอร์ชัน 0813 ยังคงราคาเดิมแม้ทาง DeepSeek เคยเตือนว่าจะขึ้นราคาก็ตาม

ผลทดสอบสำคัญๆ เช่น Terminal Bench 3.1 อยู่ที่ 87.9 ตามหลัง Kimi K3 และ Fable 5 ขณะที่ผล DeepSWE อยู่ที่ 62.7 ตามหลังทั้งสองโมเดลเช่นเดียวกัน แต่ Cybergym สามารถเอาชนะไปได้เล็กน้อย

By lew Founder on Tag: Artificial Intelligence, LLM, Singapore, OpenAI
Artificial Intelligence

National University of Singapore (NUS) หรือมหาวิทยาลัยแห่งชาติสิงคโปร์ประกาศแนวทางการศึกษาด้านปัญญาประดิษฐ์ โดยอาศัย 3 แนวทาง ได้แก่ การบังคับเรียนวิชาปัญญาประดิษฐ์, แจกเครื่องมือ ChatGPT Edu ให้ทุกคนใช้งาน, และนำหนังสือในห้องสมุดออกมาเป็นฐานความรู้ให้ปัญญาประดิษฐ์ใช้งาน

ก่อนหน้านี้ NUS ใช้เครื่องมือของ OpenAI อยู่ก่อนแล้วแต่ไม่ได้ซื้อให้นักศึกษาและพนักงานครบทุกคนแต่จำกัดเฉพาะบางคณะ เช่น NUS School of Computing

By lew Founder on Tag: Meta, LLM
Meta

Meta เปิดตัวโมเดลปัญญาประดิษฐ์แบบเปิดในชื่อ Muse Glimmer ที่เน้นความสามารถด้าน agentic ทั้งการเขียนโค้ดและการใช้เครื่องมืออื่นๆ โดยเฉพาะงานในกลุ่ม OpenClaw

ตัวโมเดลมีขนาด 30B ทาง Meta เลือกเทียบกับ Gemma4-31B และ Qwen3.6-27B ผลแสดงให้เห็นว่าความสามารถด้านการเขียนโปรแกรมขึ้นไปเทียบกับ Qwen3.6-27B แต่ผลทดสอบด้าน agentic เช่น MCP Atlas นั้นแซงหน้าชัดเจน

By lew Founder on Tag: DeepSeek, LLM
DeepSeek

DeepSeek ประกาศแจ้งเตือนลูกค้าว่ากำลังเตรียมขึ้นราคาค่า API อย่างมีนัยสำคัญ และขอให้ลูกค้าเตรียมปรับตัว หรือหากเติมเงินไว้ในแพลตฟอร์มก่อนหน้านี้ก็สามารถขอคืนเงินได้

By lew Founder on Tag: Meta, LLM, Meta AI
Meta

Meta ปล่อยโมเดลปัญญาประดิษฐ์ Muse Spark 1.2 หลังจากรุ่น 1.1 เพียงไม่ถึงเดือน ในเวอร์ชันนี้ให้ความสำคัญกับงานเขียนโปรแกรมเป็นพิเศษทำให้คะแนนทดสอบหลายหมวดเริ่มเข้าใกล้ GPT-5.6 Terra มาก มีสลับแพ้ชนะบางผลทดสอบ แม้ว่ายังตาม Claude Opus 5 อยู่ค่อนข้างชัดก็ตาม

ในเวอร์ชั่นนี้ Meta ปล่อย Muse Code โปรแกรมช่วยเขียนโค้ดออกมาพร้อมกัน ระหว่างการฝึกโมเดล Muse Spark 1.2 นี้ก็ฝึกคู่กันไปเพื่อให้แน่ใจว่าทำงานร่วมกันได้ดีที่สุด

By arjin Writer on Tag: OpenAI, ChatGPT, Artificial Intelligence, LLM
OpenAI

เก็บตกข่าวสาร AI เมื่อสัปดาห์ที่แล้ว โดย OpenAI ประกาศลดราคาค่าใช้งาน API โมเดลรุ่นใหม่ได้แก่ GPT-5.6 Terra และ GPT-5.6 Luna ลง โดย Terra โมเดลรุ่นกลาง ลดราคา 20% จากที่ประกาศตอนแรก และ Luna ที่เป็นโมเดลรุ่นเล็ก ลดลงถึง 80%

ราคาใหม่ของ Terra อยู่ที่ 2/12 ดอลลาร์ต่อ 1M โทเค็นอินพุท/เอาท์พุท และ Luna อยู่ที่ 0.2/1.2 ดอลลาร์ ส่วนโมเดลรุ่นบน GPT-5.6 Sol ยังคงราคาเดิมคือ 5/30 ดอลลาร์ แต่มีสิ่งเพิ่มเติมคือโหมดใช้งาน Fast เฉพาะใน Sol ที่ระบุว่าทำงานเร็วกว่าเดิม 2.5 เท่า ขณะที่ราคาคิดเพิ่ม 2 เท่า

By lew Founder on Tag: Qwen, LLM
Qwen

Alibaba Cloud เปิดตัว Qwen3.8-Max ตัวจริง ผ่านทาง API หลังจากที่ก่อนหน้านี้ปล่อยรุ่นพรีวิวออกมา โดยไม่บอกผลทดสอบ รอบนี้ก็เปิดเผยผลทดสอบอย่างละเอียด และพบว่าน่าจะอยู่ในระดับเดียวกับ Claude Opus 4.8

คะแนนทดสอบที่ใช้กันบ่อยๆ มีผลแพ้ชนะ Claude Opus 4.8 สลับไปมา เช่น

By lew Founder on Tag: Kimi, AMD, NVIDIA, LLM
Kimi

Wafer.ai บริการ AI agent สำหรับการเร่งความเร็วการรัน AI รายงานถึงการทดลองรัน Kimi K3 โมเดลแบบเปิดให้ไปรันเองที่คะแนนทดสอบดีที่สุดในตอนนี้ด้วยชิป AMD MI355X ที่ให้แรมสูงทำให้สามารถรันบนเครื่องเดียวขนาด 8 GPU ได้ ส่งผลให้ต้นทุนการรันถูกกว่า NVIDIA B300 มาก เพราะค่าเช่าต่อ GPU ตอนนี้ MI355X อยู่ที่ 2.5 ดอลลาร์ต่อชิปต่อชั่วโมง ขณะที่ B300 อยู่ที่ 6 ดอลลาร์ต่อชิปต่อชั่วโมง

By lew Founder on Tag: DeepSeek, LLM
DeepSeek

DeepSeek เปิดตัวโมเดล DeepSeek-V4-Flash-0731 รุ่นอัปเดตหลังจากออกรุ่นแรกมาตั้งแต่เดือนเมษายน ในรุ่นอัพเดตนี้ใช้สถาปัตยกรรมเดิม ขนาดเท่าเดิม ทำให้ราคา API ยังคงถูกมากเช่นเดิม

แม้จะเป็นโมเดลขนาดไม่ใหญ่มาก 283B-A13B คะแนนทดสอบที่ทาง DeepSeek นำมาโชว์กลับทำได้ดีมาก เช่น Terminal Bench ได้ 82.7 คะแนน หรือ DeepSWE ที่ได้ถึง 54.4 คะแนน แซงหน้า DeepSeek V4 Pro ที่เคยออกมาพร้อมกัน และอยู่ในระดับเดียวกับ Claude Sonnet 5 (max) ทีเดียว

By mk Founder on Tag: Anthropic, Claude, LLM, Security, Hacking
Anthropic

ถัดจากข่าว โมเดลของ OpenAI ไปแฮ็กระบบของ Hugging Face โดยไม่ได้ตั้งใจ ล่าสุดค่าย Anthropic ก็ออกมายอมรับว่ามีโมเดล Claude ไปแฮ็กองค์กรอื่นอีก 3 แห่งเช่นกัน

Anthropic บอกว่าพอเห็นข่าวโมเดลของ OpenAI ไปแฮ็กระบบชาวบ้านเขา ก็เลยกลับมาตรวจสอบโมเดลสายความปลอดภัยของตัวเองบ้าง แล้วก็พบเข้าจริงๆ

By lew Founder on Tag: AMD, Cerebras, LLM
AMD

AMD ประกาศความร่วมมือกับ Cerebras สร้างโซลูชันรัน LLM แบบ disaggregated inference เพื่อให้สามารถให้บริการโทเค็นด้วยอัตราสูง

การรัน LLM มักแบ่งเป็นสองช่วงคือ prompt processing และ decoding โดยช่วงแรกจะต้องการพลังประมวลผลสูงสุด ทำให้ชิปกราฟิกมีความได้เปรียบสูงขณะที่ช่วงหลังจะต้องการแบนด์วิดท์หน่วยความจำมากกว่า Cerebras มีชิป Wafer Scale Engine ที่ใส่หน่วยความจำความเร็วสูงแบบ SRAM เข้าไปในเวเฟอร์ชิปประมวลผลโดยตรง แม้จะมีต้นทุนสูงแต่ก็ทำให้แบนด์วิดท์หน่วยความจำพุ่งสูงถึง 21PB/s เหมาะกับการรันส่วน decode อย่างยิ่ง

By arjin Writer on Tag: Claude, Anthropic, LLM, Artificial Intelligence
Claude

Anthropic อัปเดตโมเดลปัญญาประดิษฐ์รุ่น(เคย)บน Claude Opus 5 โดยคราวนี้เทียบกับ Fable 5 ที่เป็นโมเดลรุ่นบนสุดปัจจุบัน บอกว่ามีความฉลาดในการทำงานซับซ้อนใกล้เคียงกัน แต่ราคาใช้งานถูกกว่าครึ่งหนึ่ง

Opus 5 มีความเก่งกว่าทุกหัวข้อเมื่อเทียบกับ Opus 4.8 ทั้งงานความรู้รอบตัว งานเขียนโค้ด ส่วนหัวข้อที่มักเจอการจำกัดใน Fable 5 อย่างเคมี-ชีววิทยา ก็ไม่มีปัญหาเรื่องนี้ เพราะโมเดลถูกควบคุมไว้แล้วในตอนฝึกฝนข้อมูล

Opus 5 ราคา 5/25 ดอลลาร์ต่อล้านโทเค็น เท่ากับ Opus 4.8

Subscribe to LLM