Image

Large Language Model

Microsoft AI

Microsoft AI เปิดตัวโมเดลตระกูล MAI ที่พัฒนาขึ้นเองอีก 7 ตัว โดยบอกว่าโมเดลทั้งหมดสร้างขึ้นใหม่จากศูนย์ ไม่ได้ใช้ข้อมูลจาก 3rd Party หรือพันธมิตร AI บริษัทต่าง ๆ เพื่อการสร้างรากฐานของตนเองที่ยั่งยืนในระยะยาว

โมเดลเด่นในการเปิดตัวครั้งนี้คือ MAI-Thinking-1 เป็นโมเดลคิดเป็นขั้นตอนขนาดกลาง ที่ไมโครซอฟท์บอกว่าได้ทำการทดสอบกับคนแบบ blind test แล้วทำแบบสอบถามความเห็น พบว่าได้คะแนนดีกว่า Sonnet 4.6 ขณะที่การทดสอบด้านการเขียนโค้ดบางหัวข้อ ทำคะแนนได้เทียบเท่ากับ Opus 4.6

By lew Founder on Tag: OpenAI, AWS, LLM, ChatGPT
OpenAI

OpenAI ประกาศเริ่มขาย GPT-5.4 และ GPT-5.5 บน Amazon Bedrock หลังจากก่อนหน้านี้สองบริษัทพยายามทำธุรกิจร่วมกันโดยเลี่ยงเงื่อนสัญญากับไมโครซอฟท์ แต่สุดท้ายทั้ง OpenAI และไมโครซอฟท์ก็ประกาศลดความสัมพันธ์กัน เปิดทางให้ OpenAI นำโมเดลมาขายได้โดยไม่ต้องดัดแปลงใดๆ อีก

สำหรับผู้ใช้ที่ใช้โปรแกรม Codex ตอนนี้โปรแกรมก็รองรับการใช้งานผ่าน Amazon Bedrock เช่นกัน ทำให้คอนฟิก provider ได้ทันที

By lew Founder on Tag: Claude, LLM
Claude

เว็บ Axios อ้างแหล่งข่าวไม่เปิดเผยตัวตนแต่ระบุว่าเป็นที่ปรึกษาปัญญาประดิษฐ์ ระบุว่าลูกค้ารายหนึ่งไม่ได้จำกัดจำนวนโทเค็นของพนักงาน ทำให้ภายในเดือนเดียวต้องจ่ายค่าโทเค็นไป 500 ล้านดอลลาร์

บัญชี Claude แบบองค์กรเปิดให้องค์กรสามารถจ่ายค่าโทเค็นเพิ่มได้หากโควต้าตามบัญชีหมด หากไม่ได้จำกัดการใช้งานไว้ก็จะเปิดทางให้พนักงานใช้โทเค็นไปเรื่อยๆ

By lew Founder on Tag: MiniMax, LLM
MiniMax

MiniMax ผู้พัฒนาโมเดลปัญญาประดิษฐ์จากจีนที่เน้นความสามารถในการเขียนโปรแกรมในราคาประหยัด ออกโมเดล MiniMax-M3 โมเดลที่รองรับ context ใหญ่ถึง 1M และรับภาพและวิดีโอในตัวเพื่อรองรับงานควบคุมคอมพิวเตอร์

ผลการทดสอบการเขียนโปรแกรม MiniMax-M3 เอาชนะ GPT-5.5 และ Gemini 3.1 Pro แต่ยังตามหลัง Claude Opus 4.7 อยู่ ผลทดสอบสำคัญ เช่น SWE-Bench Pro 59.0%, Terminal-Bench 2.1 66%

By lew Founder on Tag: NVIDIA, LLM, Nemotron
NVIDIA

NVIDIA เปิดตัวโมเดลปัญญาประดิษฐ์ Nemotron 3 Ultra โมเดลขนาดใหญ่ที่สุดที่ NVIDIA เคยเปิดตัวมา มีขนาด 550B-A55B

ตอนนี้ตัวโมเดลยังไม่เปิดให้ดาวน์โหลด แต่ทาง Artificial Analysis ก็ได้ทดสอบโมเดลเวอร์ชั่น BF16 เพื่อดูความสามารถ และให้คะแนนดัชนีความฉลาดที่ 48 คะแนนเหนือกว่า DeepSeek V4 Flash และตามหลัง MiniMax-M2.7 เล็กน้อย

แต่จุดเด่นสำคัญคือผู้ให้บริการรันโมเดลอย่าง DeepInfra สามารถให้บริการโมเดลที่ความเร็วสูงระดับ 300 token/s ได้ ทำให้มันกลายเป็นโมเดลที่เร็วที่สุดในระดับความฉลาดเดียวกัน

By lew Founder on Tag: OpenRouter, LLM
OpenRouter

OpenRouter ประกาศรับเงินทุนรอบใหม่ Series B เป็นเงิน 113 ล้านดอลลาร์ โดยไม่บอกมูลค่าบริษัทล่าสุด มีผู้ลงทุนเป็นบริษัทชื่อดัง เช่น CapitalG, NVentures, ServiceNow Ventures, MongoDB Ventures, Snowflake Ventures, Databricks Ventures, Andreessen Horowitz เป็นต้น

ธุรกิจของ OpenRouter คือหน้าร้านค้าปลีกโมเดล LLM AI จากผู้ให้บริการทั่วโลก รวมถึงบริการ LLM แบบแจกฟรีที่ผู้ให้บริการจำนวนมากต้องการทดสอบเสียงตอบรับก่อนเปิดตัวโมเดลจริง รายได้หลักมาจากการคิดค่าธรรมเนียม 5% ของทุกการใช้จ่ายผ่าน OpenRouter

By lew Founder on Tag: Anthropic, LLM, Claude
Anthropic

Anthropic เปิดตัว Claude Opus 4.8 ที่อัปเกรดจาก Opus 4.7 ในทุกด้าน โดยเฉพาะด้านการเขียนโปรแกรมและการทำงานแบบเอเจนติก แต่จุดสำคัญที่สุดคือเพิ่มความซื่อสัตย์ในการตอบ

ความซื่อสัตย์ของ Opus 4.8 ทำให้มันไม่ยอมตอบคำถามที่มันตอบไม่ได้ และวิเคราะห์ความคืบหน้าของงานว่าทำงานคืบหน้าไปเพียงใด

ผลการวัด misaligned behavior หรือพฤติกรรมไม่พึงประสงค์พบว่า Opus 4.8 มีอัตราลดลงอยู่ในระดับเดียวกับ Claude Mythos

By lew Founder on Tag: Xiaomi, LLM
Xiaomi

Xiaomi ประกาศลดราคาค่าบริการ MiMo-V2.5-Pro ลงกว่าครึ่ง ทำให้ราคาอยู่ในระดับเดียวกับ DeepSeek V4 Pro ที่เพิ่งประกาศลดราคาถาวร โดยลดราคาทั้งการใช้งานปกติและแบบแคช

By arjin Writer on Tag: DeepSeek, LLM
DeepSeek

DeepSeek ออกโมเดลเวอร์ชัน 4 คือ DeepSeek-V4-Pro และ DeepSeek-V4-Flash มาตั้งแต่เดือนที่แล้ว ซึ่งโมเดลรุ่น Pro นั้น DeepSeek ก็ชูจุดเด่นนอกเหนือจากความสามารถคือราคาถูกโดยอยู่ที่ 1.74/3.48 ดอลลาร์ต่อ 1M โทเค็น แถมในช่วงเปิดตัวยังลดราคาถึง 75% ด้วย

ล่าสุด DeepSeek จัดเต็มเรื่องราคาต่อโดยบอกว่าโมเดล deepseek-v4-pro จะคิดราคาใช้งาน API ที่ราคาเท่ากับราคาลด 75% ในช่วงเปิดตัวซึ่งเดิมกำหนดถึงวันที่ 31 พฤษภาคมนี้ไปแบบถาวรเลย ทำให้ราคาใหม่อยู่ที่ 0.435/0.87 ดอลลาร์ต่อ 1M โทเค็น ส่วนราคาโมเดลรุ่นเล็ก DeepSeek-V4-Flash ยังคงเท่าเดิมคือ 0.14/0.28 ดอลลาร์ต่อ 1M โทเค็น

By lew Founder on Tag: Gemini, LLM, Google
Gemini

กูเกิลเปิดบริการ Managed Agents ที่เปิดให้ผู้ใช้เรียกใช้งาน API เหมือนเป็นการเรียก Gemini ปกติ แต่ที่จริงแล้วกลับเป็นการสร้าง virtual machine ให้ Gemini สามารถตรวจงานและรันโค้ดก่อนส่งงานกลับไปยังผู้ใช้

API การเรียกใช้งาน Managed Agents ใช้ Gemini Interactions API เหมือนการเรียก Gemini ปกติ แต่ประกาศให้รันโค้ดในเครื่อง remote พร้อมกับต้องระบุนโยบายการเข้าถึงเน็ตเวิร์กว่าจะยอมให้ agent เชื่อมต่อเซิร์ฟเวอร์โดเมนใดได้บ้าง

ผู้ใช้สามารถเปิดให้ agent เข้าถึงไฟล์ได้ ผ่านการอัปโหลดไฟล์ใน API โดยตรง, เชื่อมเข้ากับ Google Cloud Storage, หรือจะเชื่อมกับ git repository ก็ได้

By lew Founder on Tag: Gemini, Google, LLM
Gemini

กูเกิลเปิดตัว Gemini Spark บริการผู้ช่วยส่วนตัวแบบเดียวกับ OpenClaw แต่รันบน virtual machine ของตัวเอง สามารถสั่งงานที่ต้องทำต่อเนื่อง หรือทำตามช่วงเวลา

ฟีเจอร์นี้สามารถพ่วงกับ Gemini สำหรับ macOS ทำให้สามารถควบคุมเครื่องคอมพิวเตอร์ของเราได้แบบเดียวกับ Claude Cowork สามารถสร้าง skill ใหม่ๆ ให้กับ agent ได้เหมือนกับ Cowork

Gemini Spark ยังจำกัดเฉพาะผู้ทดสอบที่ได้รับเชิญก่อน และเมื่อเปิดบริการแบบเบต้าจะเปิดให้ผู้ใช้บัญชี AI Ultra

ที่มา - Google Blog

By lew Founder on Tag: Gemini, Google, LLM
Gemini

กูเกิลเปิดตัว Gemini 3.5 Flash โมเดลรุ่นใหม่ที่คะแนนทดสอบความฉลาดรวมอยู่ระดับเดียวกันหรือเหนือกว่า Gemini 3.1 Pro แต่ราคาถูกกว่าประมาณ 25% หากเทียบกับ Gemini 3.1 Flash ราคาของรุ่นนี้จะแพงขึ้นถึงสามเท่าตัวทีเดียว

แม้ราคาจะสูงขึ้นเมื่อเทียบกับ Gemini Flash ด้วยกัน แต่กูเกิลก็โชว์ผลทดสอบเทียบกับ Gemini 3.1 Pro, Claude Opus 4.7, และ GPT-5.5 โชว์ว่าผลทดสอบอยู่ในระดับเดียวกัน ผลัดกันแพ้ชนะไปตามชุดทดสอบ

แต่จุดขายจริงๆ ของ Gemini 3.5 Flash คือความเร็วในการรันสูงขึ้นมาก สามารถตอบสนองระดับเกือบ 300 token/sec เร็วกว่า Gemini 3.1 Flash มาก

By mk Founder on Tag: Cursor, Programming, LLM
Cursor

Cursor บริษัท AI ช่วยเขียนโค้ด เปิดตัว โมเดลเขียนโค้ด Composer เวอร์ชันใหม่ 2.5 ที่พัฒนาขึ้นจาก Composer 2.0 เดิม มีคะแนนเบนช์มาร์คทัดเทียมกับ Claude Opus 4.7 แล้ว

Cursor โฆษณาว่า Composer 2.5 มีความสามารถใกล้เคียงกับ Claude Opus 4.7 และ GPT-5.5 แต่มีราคาถูกกว่า ราคาอยู่ที่ 0.50 ดอลลาร์ต่อ 1 ล้านโทเคน (อินพุต) และ 2.50 ดอลลาร์ต่อ 1 ล้านโทเคน (เอาต์พุต)

By lew Founder on Tag: EY, LLM
EY

GPTZero บริการตรวจบทความที่ใช้ LLM รายงานถึงการตรวจบทวิเคราะห์ "Points of Attack: Uncovering Cyber Threats and Fraud in Loyalty Systems." ที่เผยแพร่โดยบริษัทที่ปรึกษา Ernst & Young (EY) สาขาแคนาดาเมื่อปี 2025 และพบว่าบทวิเคราะห์นี้ อ้างอิงที่มาที่ไม่มีจริง, ใช้ค่าสถิติปลอม, และบทความเขียนด้วย AI โดยล่าสุดเว็บไซต์ของทาง EY ได้ถอดบทความนี้ไปแล้ว

จุดที่ทำให้แน่ใจว่าบทความถูกเขียนด้วย AI เช่น การอ้างอิงบทความปลอมสูงถึง 60% จาก URL ที่ไม่มีจริง ชื่อบทความไม่สามารถอ้างอิงถึงที่มาใดได้ บางครั้งการอ้างอิงอ้างถึงนักเขียนจริง แต่ไม่เคยเขียนบทความที่ถูกอ้าง

By lew Founder on Tag: LLM, OpenClaw, Singapore
LLM

ในงาน AI Engineer ในสิงคโปร์วันนี้ Vivian Balakrishnan รัฐมนตรีกระทรวงต่างประเทศสิงคโปร์ขึ้นบรรยายเปิดงาน โดยเล่าถึงประสบการณ์การติดตั้ง AI agent เป็นผู้ช่วยส่วนตัว โดยแชร์ประสบการณ์ทั้งด้านเทคนิคและการใช้งาน

Vivian พยายามสร้าง wiki ส่วนตัวด้วย Nanoclaw โครงการในกลุ่ม OpenClaw ที่ได้รับความนิยมสูงอีกตัวหนึ่ง โดยระบุเหตุผลว่าโครงการเรียบง่ายเพียงพอที่จะอ่านโค้ดได้ โดยติดตั้งใน Rasbberry Pi และตัวโมเดล AI นั้นใช้ Claude Agent SDK แต่เครื่องมืออื่นๆ ใช้เครื่องมือภายในเครื่องตัวเอง ได้แก่

By lew Founder on Tag: OpenRouter, LLM, Programming
OpenRouter

OpenRouter หน้าร้านขายบริการ LLM API เปิดตัว Pareto Router (มาจาก Pareto efficiency) ตัวเลือกโมเดลเขียนโปรแกรมอัตโนมัติ โดยคงความเก่งเท่าเดิม

By lew Founder on Tag: AWS, LLM, Payment
AWS

AWS เพิ่มฟีเจอร์ Amazon Bedrock AgentCore เปิดทางให้นักพัฒนาสามารถสร้าง AI agent ที่ตัดสินใจจ่ายเงินได้ด้วยตัวเองทำให้สามารถสร้างแอปพลิเคชันที่ต้องการข้อมูลแบบเสียเงินได้

จุดที่ AI agent ต้องการเข้าถึงข้อมูลแบบจ่ายเงินมักเป็น API เฉพาะทาง, เนื้อหาเว็บ, หรือการเรียกใช้ AI agent ตัวอื่น การเรียกใช้งาน API เหล่านี้มักมีมูลค่าต่ำกว่า 1 ดอลลาร์

By arjin Writer on Tag: OpenAI, ChatGPT, LLM
OpenAI

OpenAI อัปเดตโมเดล AI รุ่นพื้นฐานสำหรับผู้ใช้งาน GPT-5.5 Instant จากโมเดลหลัก GPT-5.5 ที่ออกมาสัปดาห์ก่อน โดยโมเดลตระกูล Instant ออกแบบมาให้ทำงานถามตอบทั่วไปสำหรับผู้ใช้งานส่วนใหญ่ และใช้งานเป็นโมเดลค่าเริ่มต้น

ในอัปเดตนี้ OpenAI บอกว่า GPT-5.5 Instant ปรับปรุงให้มีการตอบคำถามที่แม่นยำมากขึ้น หลอนน้อยลง และเพิ่มความสามารถในการอ่านรูปภาพ ตอบคำถามวิทยาศาสตร์ -คณิตศาสตร์ดีขึ้น และตัดสินใจได้ดีขึ้นหากไม่รู้ข้อมูลและต้องค้นเว็บไซต์เพิ่ม

By lew Founder on Tag: IBM, LLM, Granite
IBM

IBM เปิดตัวโมเดลปัญญาประดิษฐ์แบบ LLM ในกลุ่ม Granite 4.1 โดยชูจุดเด่นว่าทำงานได้ประสิทธิภาพดีเมื่อเทียบกับกลุ่มโมเดลขนาดเล็กด้วยกัน และยังมีรุ่นเฉพาะทาง เช่น โมเดลอ่านภาพที่ถูกฝึกสำหรับการอ่านเอกสารธุรกิจ และโมเดลแปลงเสียงเป็นข้อความ

By arjin Writer on Tag: Grok, xAI, LLM, Artificial Intelligence
Grok

xAI เปิดตัวโมเดล AI หลักรุ่นใหม่ Grok 4.3 หลังจากทดสอบในสถานะเบต้าเมื่อต้นเดือน มีจุดเด่นด้านการคิดเป็นเหตุผล (Reasoning) ที่ดียิ่งขึ้น มีการประมวลผลก่อนให้คำตอบใดออกมาเพิ่มความแม่นยำ และรองรับ context window สูงสุดมากขึ้นเป็น 1M โทเค็น

ผลการทดสอบ Grok 4.3 ทำคะแนนได้สูงในการทดสอบความรู้เฉพาะทาง เช่น กฎหมาย CaseLaw v2 หรือการเงิน CorpFin

จุดขายสำคัญของ Grok 4.3 คือราคาที่ลดลงของ API อยู่ที่ 1.25/2.50 ดอลลาร์ต่ออินพุท/เอาท์พุท 1M โทเค็น ซึ่งต่ำกว่าโมเดลเรือธงค่ายอื่นอยู่มาก

Subscribe to LLM