Image

Large Language Model

By lew Founder on Tag: Cline, LLM, Artificial Intelligence
Cline

Cline ส่วนขยาย VSCode ให้มี AI ช่วยเขียนโค้ดแบบเดียวกับ GitHub Copilot เปิดบริการ ClinePass บริการรายเดือนของตัวเองในราคาเดือนละ 9.99 ดอลลาร์ ให้บริการโมเดลแบบเปิดยอดนิยม เช่น GLM 5.2, Kimi K2.7, DeepSeek v4

By arjin Writer on Tag: OpenAI, ChatGPT, LLM, Artificial Intelligence
OpenAI

OpenAI เผยแพร่รายละเอียดของโมเดลปัญญาประดิษฐ์รุ่นใหม่ GPT-5.6 ซึ่งมี 3 โมเดลย่อยได้แก่ Sol โมเดลเรือธงความสามารถสูง, Terra โมเดลสำหรับการใช้งานทั่วไป และ Luna โมเดลที่เน้นทำงานเร็ว ต้นทุนต่ำ

By arjin Writer on Tag: Z.ai, Artificial Intelligence, LLM
Z.ai

Z.ai ออกโมเดลปัญญาประดิษฐ์โอเพนซอร์สรุ่นใหม่ GLM-5.2 โดยมีจุดเด่นเรื่องความสามารถทำงานต่อเนื่องที่ใช้เวลายาวนานมากได้ เรียกว่า Long-Horizon Task เหนือกว่ารุ่นก่อนหน้า GLM-5.1 ที่ทำได้ต่อเนื่อง 8 ชั่วโมง และยังรองรับ Context ขนาดใหญ่ระดับ 1 ล้านโทเค็นได้ จากเดิมสูงสุดที่ 2 แสนโทเค็น

เพื่อเน้นจุดขายการทำงานแบบ Long-Horizon นี้ การทดสอบด้วย FrontierSWE และ PostTrainBench พบว่าทำคะแนนได้น้อยกว่าเฉพาะ Opus 4.8 เท่านั้น แต่สูงกว่า GPT-5.5 แม้เป็นโมเดลโอเพนซอร์ส

By mk Founder on Tag: Moonshot AI, LLM, Programming
Moonshot AI

Moonshot AI บริษัทจีนเจ้าของโมเดลตระกูล Kimi ออกโมเดลเขียนโค้ดเวอร์ชันใหม่ Kimi K2.7 Code ที่พัฒนาขึ้นจาก Kimi K2.6 รุ่นก่อนหน้านี้

Kimi K2.7 Code เป็นโมเดลขนาดใหญ่ สถาปัตยกรรม Mixture-of-Experts (MoE) มีขนาดพารามิเตอร์ 1T แต่แอคทีฟจริงตอนใช้งานแค่ 32B ผลการเบนช์มาร์คด้านการเขียนโค้ดพัฒนาขึ้นจาก Kimi K2.6 แต่ในภาพรวมยังเป็นรอง GPT-5.5 กับ Claude Opus 4.8 อยู่บ้าง

จุดที่น่าสนใจคือ Kimi K2.7 Code ใช้โทเคนน้อยลง 30% จาก K2.6 เมื่อเทียบกันในโหมดให้เหตุผล (reasoning) หรือแปลง่ายๆ ว่าลดการ "คิดมากไป" (overthinking) ลงมา

By lew Founder on Tag: LLM, Artificial Intelligence
LLM

TokenRouter บริการตลาดกลาง LLM API แบบเดียวกับ OpenRouter ทำโปรโมชันให้บริการ MiniMax M3 ฟรีเป็นเวลา 7 วัน ตั้งแต่วันที่ 11-17 มิถุนายนนี้

ตัวบริการนี้เป็นของบริษัท PaleBlueDot AI สตาร์ตอัพด้าน AI ที่เพิ่งระดมทุนได้ 150 ล้านดอลลาร์เมื่อต้นปีที่ผ่านมา ก่อนหน้านี้บริษัทนี้ให้บริการ Token Factory ที่เป็นบริการคลาวด์ให้เช่า GPU มาก่อน และเพิ่งมาเปิดบริการ TokenRouter เมื่อวันที่ 22 เมษายนที่ผ่านมา

By mk Founder on Tag: Gemma, LLM, Google
Gemma

กูเกิลเปิดตัว DiffusionGemma โมเดลภาษาแบบเปิดรุ่นทดลอง ที่ใช้เทคนิค text diffusion (ปิดบางส่วนของข้อความแล้วคาดเดาผลลัพธ์ ลักษณะเดียวกับโมเดลสร้างภาพ) แทนการทำนายคำตอบทีละโทเค็นแบบโมเดลตระกูล Transformer แบบดั้งเดิม

ข้อดีของโมเดลตระกูล diffusion คือทำงานได้เร็วกว่ามาก เพราะสร้างข้อความผลลัพธ์ทีเดียวทั้งบล็อค ตัวเลขของกูเกิลที่รองรันโมเดลบนจีพียูพบว่า เร็วขึ้นสูงสุด 4 เท่าเมื่อเทียบกับโมเดลตระกูล Gemma รุ่นมาตรฐาน ที่ระดับคุณภาพของผลลัพธ์ใกล้เคียงกัน (ผลลัพธ์บน H100 ออกมาได้มากกว่า 1,000 โทเค็นต่อวินาที)

By arjin Writer on Tag: Anthropic, Claude, Artificial Intelligence, LLM
Anthropic

Anthropic ออกโมเดลปัญญาประดิษฐ์ใหม่ Claude Fable 5 ซึ่งมาจากโมเดลรุ่นใหญ่ความสามารถสูงสุดที่ออกใหม่เช่นกัน Claude Mythos 5 โดย Fable 5 เป็นโมเดลตัวแรกที่เปิดให้สาธารณะได้ใช้งาน หลังจาก Mythos ออกมาเมื่อเดือนเมษายนแบบจำกัดเฉพาะพาร์ตเนอร์บางราย ด้วยเหตุผลด้านความปลอดภัย

By lew Founder on Tag: Xiaomi, LLM
Xiaomi

Xiaomi ประกาศความร่วมมือกับ TileRT ผู้พัฒนารันไทม์สำหรับรัน LLM ความเร็วสูง ทำให้รันโมเดล MiMo-V2.5-Pro ได้ความเร็วระดับ 1000 token/s ได้บนเครื่องเดียวโดยไม่ต้องการชิปพิเศษ

โมเดลที่ใช้ไม่ใช่โมเดลเต็ม แต่เป็นโมเดลย่อบางส่วน โดยเฉพาะส่วน MoE ที่ย่อเป็น MXFP4 ที่ยังได้ระดับความฉลาดใกล้เคียงกับโมเดลเต็ม ส่วนที่เหลือใช้ FP8 การออปติไมซ์อีกส่วนคือ DFlash ทำนายโทเค็นล่วงหน้าเป็นบล็อคแล้วตรวจสอบความถูกต้องทีเดียว

รันไทม์ของ TileRT มีฟีเจอร์ Persistent Engine Kernel ทำงานต่อเนื่องโดยออปติไมซ์การเคลื่อนย้ายข้อมูลให้ได้ประสิทธิภาพที่สุด

By arjin Writer on Tag: Meta AI, Meta, LLM, Rumors
Meta AI

Meta เปิดตัวโมเดลปัญญาประดิษฐ์ LLM ใหม่ Muse Spaek มาตั้งแต่ต้นเดือนเมษายน โดยบอกว่าจะเปิดให้นักพัฒนาใช้งานผ่าน API แบบจำกัดก่อน ในตอนแรกบริษัทมีแผนเปิดใช้งานทั่วไปเดือนพฤษภาคม แต่จนถึงตอนนี้นักพัฒนาทั่วไปก็ยังไม่สามารถใช้งาน API ได้ เลยมีข่าวออกมาว่า Meta เลื่อนแผนเปิดตัวให้ใช้งานทั่วไปออกไปแบบไม่มีกำหนดแล้ว

The Wall Street Journal สอบถามประเด็นนี้ไปยัง Meta ก็ได้คำตอบแบบกลาง ๆ ว่า บริษัทกำลังอยู่ในขั้นตอนทดสอบ API กับพาร์ตเนอร์ และคาดว่าจะเปิดตัวทั่วไปได้ในเดือนนี้ ซึ่งบริษัทก็ทราบดีว่ามีนักพัฒนาจำนวนมากที่รอทดสอบใช้งาน

By arjin Writer on Tag: Gemma, LLM, Google
Gemma

กูเกิลออกโมเดลปัญญาประดิษฐ์ LLM แบบเปิดตระกูล Gemma 4 รุ่นใหม่ Gemma 4 12B โดยบอกว่าเป็นโมเดลขนาดกลางที่ดึงจุดเด่นของโมเดล E4B ที่รันระดับอุปกรณ์ได้ดี กับ 26B MoE ที่มีความสามารถหลากหลาย ทำให้ออกมาเป็นโมเดลที่รันระดับอุปกรณ์และสามารถทำงานได้หลากหลาย รวมทั้งการรับอินพุทแบบเสียง

Gemma 4 12B มีจุดเด่นหลายอย่าง เช่น ไม่ต้องใช้ Encoder เพิ่มเติมสำหรับอินพุทภาพ-เสียง ใช้โมเดลหลักจบในตัวได้เลย ลดการใช้งานหน่วยความจำ, การคิดเป็นเหตุผลทำได้เทียบเคียง 26B, รันได้บนแล็ปท็อปแรม 16GB

By lew Founder on Tag: Uber, LLM, Programming
Uber

Uber ประกาศจำกัดงบค่า AI สำหรับช่วยเขียนโปรแกรมเหลือคนละ 1,500 ดอลลาร์ต่อเดือน โดยที่ผ่านมา Uber ใช้งาน AI ช่วยเขียนโปรแกรมหลายตัว ทั้ง Claude Code, Cursor, และ Codex การจำกัดงบประมาณครั้งนี้ยังแยกกันระหว่างเครื่องมือแต่ละตัวอีกด้วย

พนักงานจะมองเห็นยอดใช้งานของตัวเองผ่าน dashboard กลาง และสามารถขอโควต้าเป็นกรณีพิเศษได้ โฆษกของ Uber ระบุว่าแนวทางการจำกัดงบประมาณเป็นแนวทางมาตรฐานสำหรับการสนับสนุนการใช้งาน AI อย่างรับผิดชอบ

Praveen Neppalli Naga ซีทีโอของ Uber เคยเปิดเผยว่า Uber ใช้งบค่า AI หมดทั้งปีตั้งแต่เดือนเมษายนที่ผ่านมา โดยวิศวกรรวม 5,000 คนใช้งานโทเค็นมากกว่าที่คาดไว้

By lew Founder on Tag: LLM, Claude, DeepSeek, Xiaomi
LLM

OpenRouter อัพเดตการใช้งาน LLM ผ่านแพลตฟอร์มในหมวดการเขียนโปรแกรม โดยความพิเศษในรอบนี้คือ Claude หลุดจากกลุ่ม 5 อันดับแรกที่ใช้เขียนโปรแกรมเป็นครั้งแรก แต่ยังมี Claude Opus 4.7 อยู่อันดับที่ 8 ที่ปริมาณการใช้งาน 4% รวม 129B โทเค็น

5 อันดับแรกของการใช้งานในหมวดการเขียนโปรแกรมสัปดาห์ล่าสุด ได้แก่ 1) MiMo-V2.5 2) MiMo-V2.5-Pro 3) DeepSeek V4 Flash 4) DeepSeek V4 Pro 5) MiniMax M3

Microsoft AI

Microsoft AI เปิดตัวโมเดลตระกูล MAI ที่พัฒนาขึ้นเองอีก 7 ตัว โดยบอกว่าโมเดลทั้งหมดสร้างขึ้นใหม่จากศูนย์ ไม่ได้ใช้ข้อมูลจาก 3rd Party หรือพันธมิตร AI บริษัทต่าง ๆ เพื่อการสร้างรากฐานของตนเองที่ยั่งยืนในระยะยาว

โมเดลเด่นในการเปิดตัวครั้งนี้คือ MAI-Thinking-1 เป็นโมเดลคิดเป็นขั้นตอนขนาดกลาง ที่ไมโครซอฟท์บอกว่าได้ทำการทดสอบกับคนแบบ blind test แล้วทำแบบสอบถามความเห็น พบว่าได้คะแนนดีกว่า Sonnet 4.6 ขณะที่การทดสอบด้านการเขียนโค้ดบางหัวข้อ ทำคะแนนได้เทียบเท่ากับ Opus 4.6

By lew Founder on Tag: OpenAI, AWS, LLM, ChatGPT
OpenAI

OpenAI ประกาศเริ่มขาย GPT-5.4 และ GPT-5.5 บน Amazon Bedrock หลังจากก่อนหน้านี้สองบริษัทพยายามทำธุรกิจร่วมกันโดยเลี่ยงเงื่อนสัญญากับไมโครซอฟท์ แต่สุดท้ายทั้ง OpenAI และไมโครซอฟท์ก็ประกาศลดความสัมพันธ์กัน เปิดทางให้ OpenAI นำโมเดลมาขายได้โดยไม่ต้องดัดแปลงใดๆ อีก

สำหรับผู้ใช้ที่ใช้โปรแกรม Codex ตอนนี้โปรแกรมก็รองรับการใช้งานผ่าน Amazon Bedrock เช่นกัน ทำให้คอนฟิก provider ได้ทันที

By lew Founder on Tag: Claude, LLM
Claude

เว็บ Axios อ้างแหล่งข่าวไม่เปิดเผยตัวตนแต่ระบุว่าเป็นที่ปรึกษาปัญญาประดิษฐ์ ระบุว่าลูกค้ารายหนึ่งไม่ได้จำกัดจำนวนโทเค็นของพนักงาน ทำให้ภายในเดือนเดียวต้องจ่ายค่าโทเค็นไป 500 ล้านดอลลาร์

บัญชี Claude แบบองค์กรเปิดให้องค์กรสามารถจ่ายค่าโทเค็นเพิ่มได้หากโควต้าตามบัญชีหมด หากไม่ได้จำกัดการใช้งานไว้ก็จะเปิดทางให้พนักงานใช้โทเค็นไปเรื่อยๆ

By lew Founder on Tag: MiniMax, LLM
MiniMax

MiniMax ผู้พัฒนาโมเดลปัญญาประดิษฐ์จากจีนที่เน้นความสามารถในการเขียนโปรแกรมในราคาประหยัด ออกโมเดล MiniMax-M3 โมเดลที่รองรับ context ใหญ่ถึง 1M และรับภาพและวิดีโอในตัวเพื่อรองรับงานควบคุมคอมพิวเตอร์

ผลการทดสอบการเขียนโปรแกรม MiniMax-M3 เอาชนะ GPT-5.5 และ Gemini 3.1 Pro แต่ยังตามหลัง Claude Opus 4.7 อยู่ ผลทดสอบสำคัญ เช่น SWE-Bench Pro 59.0%, Terminal-Bench 2.1 66%

By lew Founder on Tag: NVIDIA, LLM, Nemotron
NVIDIA

NVIDIA เปิดตัวโมเดลปัญญาประดิษฐ์ Nemotron 3 Ultra โมเดลขนาดใหญ่ที่สุดที่ NVIDIA เคยเปิดตัวมา มีขนาด 550B-A55B

ตอนนี้ตัวโมเดลยังไม่เปิดให้ดาวน์โหลด แต่ทาง Artificial Analysis ก็ได้ทดสอบโมเดลเวอร์ชั่น BF16 เพื่อดูความสามารถ และให้คะแนนดัชนีความฉลาดที่ 48 คะแนนเหนือกว่า DeepSeek V4 Flash และตามหลัง MiniMax-M2.7 เล็กน้อย

แต่จุดเด่นสำคัญคือผู้ให้บริการรันโมเดลอย่าง DeepInfra สามารถให้บริการโมเดลที่ความเร็วสูงระดับ 300 token/s ได้ ทำให้มันกลายเป็นโมเดลที่เร็วที่สุดในระดับความฉลาดเดียวกัน

By lew Founder on Tag: OpenRouter, LLM
OpenRouter

OpenRouter ประกาศรับเงินทุนรอบใหม่ Series B เป็นเงิน 113 ล้านดอลลาร์ โดยไม่บอกมูลค่าบริษัทล่าสุด มีผู้ลงทุนเป็นบริษัทชื่อดัง เช่น CapitalG, NVentures, ServiceNow Ventures, MongoDB Ventures, Snowflake Ventures, Databricks Ventures, Andreessen Horowitz เป็นต้น

ธุรกิจของ OpenRouter คือหน้าร้านค้าปลีกโมเดล LLM AI จากผู้ให้บริการทั่วโลก รวมถึงบริการ LLM แบบแจกฟรีที่ผู้ให้บริการจำนวนมากต้องการทดสอบเสียงตอบรับก่อนเปิดตัวโมเดลจริง รายได้หลักมาจากการคิดค่าธรรมเนียม 5% ของทุกการใช้จ่ายผ่าน OpenRouter

By lew Founder on Tag: Anthropic, LLM, Claude
Anthropic

Anthropic เปิดตัว Claude Opus 4.8 ที่อัปเกรดจาก Opus 4.7 ในทุกด้าน โดยเฉพาะด้านการเขียนโปรแกรมและการทำงานแบบเอเจนติก แต่จุดสำคัญที่สุดคือเพิ่มความซื่อสัตย์ในการตอบ

ความซื่อสัตย์ของ Opus 4.8 ทำให้มันไม่ยอมตอบคำถามที่มันตอบไม่ได้ และวิเคราะห์ความคืบหน้าของงานว่าทำงานคืบหน้าไปเพียงใด

ผลการวัด misaligned behavior หรือพฤติกรรมไม่พึงประสงค์พบว่า Opus 4.8 มีอัตราลดลงอยู่ในระดับเดียวกับ Claude Mythos

Subscribe to LLM