Image

Large Language Model

By arjin Writer on Tag: OpenAI, Sora, Artificial Intelligence, LLM
OpenAI

OpenAI เปิดตัว Sora 2 โมเดลปัญญาประดิษฐ์สร้างวิดีโอเวอร์ชันใหม่ ที่บอกว่ามีการเคลื่อนไหวที่แม่นยำขึ้น, สมจริงขึ้น และควบคุมผลลัพธ์ได้ดีกว่าเวอร์ชันแรก นอกจากนี้ยังใส่ความสามารถการขยับตามบทสนทนาและเสียงประกอบด้วย

OpenAI บอกว่าในตอนเปิดตัว Sora รุ่นแรกเมื่อปีที่แล้ว เหตุการณ์นั้นเหมือนกับการออก GPT-1 ทุกอย่างยังเป็นเรื่องใหม่ การทำงานยังไม่สมบูรณ์นัก แต่มองว่า Sora 2 กำลังเป็น GPT-3.5 ที่ความสามารถทำให้ทุกคนพบต้องรู้สึกทึ่ง

By mk Founder on Tag: Claude, LLM, Anthropic, Artificial Intelligence
Claude

Anthropic เปิดตัว Claude Sonnet 4.5 โมเดลตัวแรกในซีรีส์ Claude 4.5 โดยเป็นโมเดลไซส์กลาง (Sonnet) ยังไม่ใช่ รุ่นใหญ่สุด (Opus) ที่เพิ่งออกเวอร์ชัน 4.1 เมื่อเดือนที่แล้ว

จุดเด่นของ Claude Sonnet 4.5 คือยกระดับความสามารถด้านการเขียนโค้ดขึ้นไปอีกขั้น ทำคะแนนเบนช์มาร์คด้านการเขียนโค้ด SWE-bench Verified ได้ 77.2% (Opus 4.1 ทำได้ 74.5%, Sonnet 4 ทำได้ 72.7%) และถ้าเปิดโหมด parallel test-time compute (ทำงานแบบให้เหตุผล reasoning หลายแบบเพื่อหาวิธีที่ดีที่สุด) คะแนนจะขึ้นไปเป็น 82% แถมยังทำงานแก้ปัญหายากๆ ได้ต่อเนื่องนานถึง 30 ชั่วโมง

By mk Founder on Tag: Gemini, LLM, Google
Gemini

กูเกิลอัพเดตโมเดล Gemini 2.5 Flash และ Gemini 2.5 Flash Lite เป็นเวอร์ชันย่อย 09-2025 ที่ฉลาดขึ้นกว่าเดิม และตอบเร็วขึ้นกว่าเดิมด้วย

กูเกิลบอกว่าโมเดลเวอร์ชันอัพเดต จะช่วยแนะนำขั้นตอนทำการบ้านได้ดีขึ้น, ข้อความคำตอบเป็นโครงสร้าง จัดระเบียบข้อความดีขึ้น ใช้หัวข้อ ลิสต์ ตาราง ประกอบมากขึ้น, เข้าใจรูปภาพดีขึ้น, ถอดเสียงพูดได้แม่นยำ, แปลภาษาได้ดีขึ้น

โมเดลนี้ยังบริหาร output token ได้ดีขึ้นสูงสุด 2 เท่าในบางกรณี (โดยเฉพาะ Flash Lite) คำตอบตรงประเด็นมากขึ้นไม่เยิ่นเย้อ การเช่าใช้งานโมเดลจึงประหยัดกว่าเดิมด้วย

By lew Founder on Tag: Chrome, LLM, MCP, Browser, Google
Chrome

กูเกิลปล่อย Chrome DevTools MCP ให้แอปปัญญาประดิษฐ์ เช่น Gemini, Claude, Cursor, หรือ Copilot สั่งงานเบราว์เซอร์ได้โดยตรง สำหรับพัฒนาที่ AI สามารถมองเห็นปัญหาและแก้ไขได้โดยตรง

การใช้งานอาจจะไม่ซับซ้อนเช่น สั่งให้ AI ตรวจว่าเว็บที่ได้ตรงกับงานที่สั่งหรือไม่ หรืออาจจะซับซ้อนขึ้น เช่น การแก้ปัญหา CORS หรือแม้แต่ปัญหาเว็บช้า เพราะตัว MCP เปิดให้ AI เข้าถึงฟีเจอร์ต่างๆ ของ DevTools ได้

การใช้งานเพียงเรียก chrome-devtools-mcp@latest เท่านั้น

ที่มา - Chrome Developer Blog

By arjin Writer on Tag: Qwen, Alibaba Cloud, Artificial Intelligence, LLM
Qwen

Alibaba ออกโมเดลปัญญาประดิษฐ์ใหม่ชุดใหญ่ในซีรีส์ Qwen3 ซึ่งทั้งหมดเป็นโมเดลโอเพนซอร์ส มีรายละเอียดดังนี้

Qwen3-VL โมเดลที่สามารถเข้าใจรูปภาพ-ข้อความ โมเดลหลักคือ Qwen3-VL-235B-A22B ทำงานได้ทั้งโหมด Instruct และ Thinking ผลทดสอบคะแนนดีกว่า Gemini 2.5 Pro

จุดเด่นของ Qwen3-VL คือทำงานบนสมาร์ทโฟนได้ดี, สามารถแปลงภาพจับหน้าจอ เขียนออกมาเป็นโค้ดได้, OCR รองรับ 32 ภาษา, context 256K สเกลได้ถึง 1M, ทำความเข้าใจภาพได้ทั้ง 2D และ 3D ฯลฯ

By arjin Writer on Tag: Qwen, Alibaba Cloud, Alibaba, LLM, Artificial Intelligence
Qwen

Alibaba เปิดตัว Qwen3-Omni โมเดลโอเพนซอร์สในตระกูล Qwen3 ที่รองรับอินพุทผสมผสานทั้งข้อความ ภาพ เสียง วิดีโอ รุ่นถัดจาก Qwen2.5-Omni โดยสามารถสร้างเอาท์พุตได้ทั้งข้อความและเสียง โมเดลทำงานบนสถาปัตยกรรมที่เรียกว่า Thinker–Talker โดยส่วน Thinker สามารถทำความเข้าใจอินพุทที่หลากหลาย ส่วน Talker มีความสามารถการสร้างเสียงโต้ตอบที่เป็นธรรมชาติ

จุดเด่นของ Qwen3-Omni มีหลายอย่าง ทั้งการทำคะแนนสูงสุดในการทดสอบผลลัพธ์เสียง 22 จาก 36 หัวข้อ, รองรับการสร้างเอาท์พุทข้อความ 119 ภาษา, เข้าใจเสียงได้ 19 ภาษา (ไม่มีไทย) และสร้างเสียงโต้ตอบได้ 10 ภาษา (ไม่มีไทย), ความหน่วงต่ำถึง 211ms กรณีอินพุทแบบเสียง, รับอินพุทไฟล์เสียงสูงสุด 30 นาที ฯลฯ

By mk Founder on Tag: Grok, xAI, LLM
Grok

xAI เปิดตัว Grok 4 Fast โมเดลรุ่นเล็กของตระกูล Grok 4 ที่ก่อนหน้านี้มี Grok 4 เฉยๆ กับ Grok 4 Heavy

จุดเด่นของ Grok 4 Fast คือต้นทุนค่ารัน และความรวดเร็วในการตอบ โดยยังคงความสามารถด้าน reasoning ไว้ได้ (เลือกได้ว่าจะเปิด reasoning หรือไม่ด้วย) โมเดลรองรับ context window ขนาดใหญ่ 2M และทำผลงานเบนช์มาร์คได้ดีกว่าคู่แข่งสายตรง GPT-5 Mini แถมยังเป็นรอง GPT-5 ไม่มากด้วย

By mk Founder on Tag: AWS, Amazon, LLM, Qwen, DeepSeek
AWS

AWS ประกาศนำโมเดลค่ายจีน 2 ค่ายคือ Alibaba Qwen และ DeepSeek มาให้บริการบน Amazon Bedrock

กรณีของ Qwen ถือเป็นครั้งแรกที่ Bedrock มีให้บริการ เบื้องต้นมีโมเดลให้ใช้ 4 ตัวคือ

  • Qwen3-Coder-480B-A35B-Instruct
  • Qwen3-Coder-30B-A3B-Instruct
  • Qwen3-235B-A22B-Instruct-2507
  • Qwen3-32B (Dense)

ส่วน DeepSeek นั้นเดิม Bedrock มีให้บริการ DeepSeek-R1 โมเดลกลุ่ม reasoning อยู่ก่อนแล้ว ตอนนี้ขยายมายัง DeepSeek-V3.1 โมเดลสายหลักตัวล่าสุด ด้วย

By lew Founder on Tag: LLM, Programming, Artificial Intelligence, DeepMind, OpenAI
LLM

OpenAI และ DeepMind ได้เหรียญทองการแข่งเขียนโปรแกรมระดับมหาวิทยาลัย International Collegiate Programming Contest (ICPC) ประจำปีนี้ ทั้ง OpenAI และ DeepMind ก็ส่งปัญญาประดิษฐ์ของตัวเองเข้าร่วมแข่งขันและได้เหรียญทองทั้งคู่ แต่เมื่อนับคะแนน OpenAI ได้เต็ม 12/12 แต่ DeepMind ได้ 10/12 ขณะที่ทีมนักศึกษานั้นได้สูงสุดที่ 11/12

ทั้งสองบริษัทไม่ได้ส่งโมเดลรุ่นที่วางขายเข้าแข่งขัน แต่เป็นรุ่นพิเศษ ฝั่ง DeepMind ระบุว่าเป็น Gemini 2.5 Deep Think รุ่นพิเศษ สามารถแก้ปัญหา 8 ข้อแรกได้ภายในเวลา 45 นาทีเท่านั้น และแก้ 10 ข้อได้ในสามชั่วโมง

By mk Founder on Tag: Visual Studio Code, GitHub Copilot, LLM, Programming, IDE
Visual Studio Code

VS Code ออกฟีเจอร์เล็กๆ แต่น่าสนใจคือ Auto Model Selection สลับโมเดลใน GitHub Copilot Chat อัตโนมัติ เพื่อแก้ปัญหาโมเดล (บางตัว) ติดลิมิตการใช้งาน

วิธีการใช้งานคือเลือกโมเดลเป็น Auto แล้ว VS Code จะเลือกสลับโมเดลให้เองระหว่างโมเดลต่างๆ ในระบบ เช่น Claude Sonnet 4, GPT-5, GPT-5 mini โดยจะใช้โมเดลนั้นไปตลอดเซสชันการพูดคุย ไม่มีการสลับโมเดลระหว่างทางให้งง (อย่างน้อยก็ในตอนนี้)

By mk Founder on Tag: Gemma, Google, Research, Google Research, LLM, Privacy
Gemma

ทีมวิจัย Google Research เปิดตัวโมเดล VaultGemma ที่เทรนมาตามแนวทางการรักษาความเป็นส่วนตัวแบบ differential privacy

By mk Founder on Tag: Visual Studio Code, LLM, IDE, Microsoft
Visual Studio Code

VS Code ออกเวอร์ชัน 1.104 (อ่านว่า ร้อยสี่) ประจำรอบเดือนสิงหาคม 2025 มีฟีเจอร์ใหม่ที่น่าสนใจคือ Language Model Chat Provider API เป็น API ที่เปิดทางให้ส่วนขยาย (extension) สามารถให้บริการโมเดลภาษา LLM กับ VS Code ได้ทันที โดยตัวโมเดลจะรันในเครื่องหรือโฮสต์บนคลาวด์ได้

ฟีเจอร์นี้จะทำให้เราสามารถเพิ่มโมเดลลงใน VS Code ด้วยการติดตั้งส่วนขยายได้ "อย่างเป็นระบบ" ตัวอย่างคือ

By arjin Writer on Tag: Qwen, Alibaba Cloud, Artificial Intelligence, LLM
Qwen

Alibaba เปิดตัว Qwen3-Next บอกว่าเป็นโมเดล AI บนสถาปัตยกรรมใหม่ สร้างจากพื้นฐานโมเดล Qwen3 เพื่อปรับปรุงการทำงานใน 2 อย่างได้แก่ ทำให้รองรับอินพุทที่ยาวขึ้น (long-context) และใช้พารามิเตอร์บางส่วนเท่านั้น แม้โมเดลจะมีพารามิเตอร์ขนาดใหญ่ (parameter scaling)

ผลลัพธ์ที่ได้คือโมเดลหลัก Qwen3-Next-80B-A3B-Base ซึ่งขนาดพารามิเตอร์ 80B เมื่อรันขั้นตอน inference จะใช้พารามิเตอร์จริงเพียง 3B เท่านั้น จึงสร้างผลลัพธ์ออกมาได้เร็วกว่าโมเดลเปรียบเทียบ Qwen3-32B ถึง 10 เท่า แม้ภาพรวมจำนวนพารามิเตอร์จะใหญ่กว่า ส่วนการนำไปฝึกฝนต่อก็ใช้ต้นทุนน้อยกว่า 10% เมื่อเทียบด้วยจำนวนชั่วโมงจีพียู ทั้งหมดจึงมีข้อได้เปรียบเทียบเรื่องต้นทุนการประมวลผล

By lew Founder on Tag: Claude, LLM, Programming
Claude

Dmitry Brant วิศวกรของ Wikimedia Foundation รายงานถึงการใช้ Claude Code พอร์ตโค้ดไดร์เวอร์เคอร์เนลลินุกซ์ที่ถูกถอดออกจากเคอร์เนลไปแล้วถึง 20 ปีให้กลับมาใช้งานกับลินุกซ์ล่าสุดได้อีกครั้งโดยใช้เวลาแค่สองวัน

By mk Founder on Tag: Gemma, Google, LLM
Gemma

กูเกิลยังเดินหน้าออกโมเดลขนาดเล็กในตระกูล Gemma ต่อไป หลังจาก Gemma 3 270M ที่เป็นโมเดลตั้งต้นให้นำไปปรับแต่งต่อ ก็ตามมาด้วย EmbeddingGemma โมเดลที่ออกแบบมาสำหรับ on-device AI แบบพร้อมใช้งานทันที

EmbeddingGemma ปรับแต่งมาจาก Gemma 3 อีกที มีขนาดพารามิเตอร์ 308M มีขนาดเล็กพอที่จะทำงานภายใต้แรม 200MB (quantization แล้ว) รันงานในอุปกรณ์แบบออฟไลน์ แต่ถึงแม้ขนาดเล็ก โมเดลมีประสิทธิภาพสูง ตอบเร็ว ทำคะแนนเบนช์มาร์คได้สูงกว่าโมเดลขนาดใกล้เคียงกันตัวอื่นๆ อย่างชัดเจน

By lew Founder on Tag: Z.ai, Artificial Intelligence, LLM, Programming
Z.ai

Z.ai ผู้พัฒนาโมเดลปัญญาประดิษฐ์ GLM ที่เน้นงานเขียนโค้ด เปิดแพ็กเกจรายเดือนแข่งกับ Claude Code โดยชูจุดเด่นราคาถูกกว่าหลายเท่าตัว โดยมีสองแพ็กเกจ ได้แก่

  • GLM Coding Lite ใช้งานได้ 120 พรอมพ์ต่อ 5 ชั่วโมง
  • GLM Coding Pro ใช้งานได้ 600 พรอมพ์ต่อ 5 ชั่วโมง

แนวทางนับ "พรอมพ์" ค่อนข้างต่างจากการขาย API ตามปกติ โดยทาง Z.ai ระบุว่าแต่ละพรอมพ์เทียบเท่ากับการคุยกับปัญญาประดิษฐ์หนึ่งรอบ โดยปัญญาประดิษฐ์สามารถสั่งคำสั่งอื่นๆ เช่น อ่านไฟล์เพิ่มเติม หรือวางแผนการทำงานได้ 15-20 ครั้ง

By lew Founder on Tag: Anthropic, LLM, Funding
Anthropic

Anthropic ผู้สร้างปัญญาประดิษฐ์ Claude ประกาศระดมทุนรอบ F นำโดยกองทุน ICONIQ Capital รวมเงินลงทุน 13,000 ล้านดอลลาร์ มูลค่าบริษัทหลังได้รับเงินลงทุน (post-money) จะมีมูลค่ารวม 183,000 ล้านดอลลาร์ หรือประมาณ 5.9 ล้านล้านบาท การระดมทุนครั้งนี้มีกองทุนใหญ่ๆ ร่วมด้วยจำนวนมาก

ทาง Anthropic ระบุว่ารายได้บริษัทเติบโตขึ้นเร็วมาก นับเฉพาะเดือนสิงหาคมที่ผ่านมามีรายได้เกิน 416 ล้านดอลลาร์ขยายเป็นรายได้ต่อปีเกิน 5,000 ล้านดอลลาร์ และลูกค้าระดับจ่าย 100,000 ดอลลาร์ต่อปีเพิ่มขึ้น 7 เท่าตัว (รายงานตัวเลขเป็น run-rate อนุมานรายได้รายปีจากรายได้ล่าสุด)

By lew Founder on Tag: Fastly, LLM, Programming
Fastly

Fastly บริการ CDN รายใหญ่รายงานผลสำรวจโปรแกรมเมอร์ 791 ราย พบว่าโปรแกรมเมอร์ซีเนียร์ที่ทำงานมานานเกิน 10 ปี ใช้งาน AI ช่วยเขียนโค้ดเกินครึ่ง ขณะที่โปรแกรมเมอร์จบใหม่ใช้ AI ช่วยเขียนโค้ดเพียง 13% เท่านั้น

แม้ว่าโปรแกรมเมอร์ซีเนียร์จะชอบใช้ AI กันมาก แต่เมื่อถามว่าประหยัดเวลาได้จริงไหมกลับตอบไม่ชัดเจนนัก โดย 59% ระบุว่า AI ช่วยให้ทำงานได้เร็วขึ้นบ้าง และ 30% ระบุว่าเสียเวลานั่งแก้โค้ดจาก AI ก็ยังคุ้ม โดยรวมผู้ตอบแบบสอบถามพบว่าต้องแก้โค้ดจาก AI บ่อยๆ ถึง 65%

By lew Founder on Tag: Grok, xAI, LLM, Programming
Grok

Grok Code Fast เพิ่งเปิดตัวมาได้สองวัน แต่ล่าสุดก็ได้รับควาามนิยมสูงมาก จนแซงหน้า Claude 4 Sonnet บน OpenRouter ได้ ด้วยยอดให้บริการถึง 390,000 ล้านโทเค็น แซงหน้า Claude 4 Sonnet ที่ครองอันดับหนึ่งตั้งแต่เปิดตัว

ทาง xAI ไม่ได้เน้นผลการทดสอบมากนัก โดยบอกเพียงว่าผลทดสอบ SWE Bench Verified บางส่วน ได้คะแนน 70.8% ซึ่งคะแนนระดับนี้มักเป็นการใช้ LLM ร่วมกับเฟรมเวิร์ค agentic

By mk Founder on Tag: Llama, Meta AI, Meta, Rumors, Artificial Intelligence, LLM
Llama

เว็บไซต์ข่าว The Information รายงานข้อมูลวงในว่างานแรกๆ ของทีม Meta Superintelligence Labs ที่ตั้งขึ้นใหม่ คือการพิจารณาว่าโมเดล Llama ของ Meta เองนั้นไม่เวิร์ค และบริการของ Meta AI เช่น แชทบอท อาจต้องหันไปใช้โมเดลขององค์กรอื่น เช่น Google Gemini หรือ OpenAI GPT แทน อย่างน้อยก็ใช้ชั่วคราว จนกว่าจะสามารถพัฒนา Llama 5 ให้มีความสามารถทัดเทียมคู่แข่ง

Subscribe to LLM