Image

Large Language Model

By lew Founder on Tag: Apple Intelligence, LLM
Apple Intelligence

แอปเปิลรายงานถึงความคืบหน้าของการพัฒนา Apple Foundation Model (AFM) ที่เป็นโมเดลปัญญาประดิษฐ์แบบ LLM สำหรับการใช้งานใน Apple Intelligence แบ่งเป็นโมเดลสำหรับรับบนเครื่องโดยตรงและโมเดลรันบนเซิร์ฟเวอร์ (ที่แอปเปิลสร้าง private cloud compute เตรียมไว้รอ)

โมเดลทั้งสองรุ่นถูกย่อให้เหลือขนาดเล็กมาก ด้วยเทคนิค Quantization-Aware-Training (QAT) เพื่อให้คงคุณภาพเอาไว้แม้จะย่อโมเดลบนเครื่องขนาดเล็กเหลือ 2-bit และโมเดลบนเซิร์ฟเวอร์เหลือ 3.56 bit ส่วน embedding ย่อเหลือ 4 bit และส่วน KV-cache ย่อเหลือ 8 บิต

By mk Founder on Tag: Veo, Gemini, Google, LLM
Veo

กูเกิลเปิดใช้เช่าใช้งานโมเดลสร้างวิดีโอ Veo 3 ผ่าน Gemini API โดยยังมีสถานะเป็นพรีวิว และใช้คู่กับ Veo 2 ของเดิม

สิ่งที่ทุกคนสนใจที่สุดคงเป็น "ราคา"

  • Veo 3 แบบมีเสียงประกอบ วินาทีละ 0.75 ดอลลาร์
  • Veo 3 แบบไม่มีมีเสียงประกอบ วินาทีละ 0.50 ดอลลาร์
  • Veo 2 ไม่มีมีเสียงประกอบอยู่แล้ว วินาทีละ 0.35 ดอลลาร์

จะเห็นว่าราคา Veo 3 แพงขึ้นมากว่า Veo 2 อยู่พอสมควร ซึ่งกูเกิลบอกว่าจะออก Veo 3 Fast ที่ทำงานเร็วขึ้น ราคาถูกลง ตามมา

By lew Founder on Tag: Google, Project Zero, Security, LLM
Google

ปีที่แล้วกูเกิลโชว์โครงการ Naptime เฟรมเวิร์ค LLM ที่ช่วยนักวิจัยหาช่องโหว่ซอฟต์แวร์ระหว่างนักวิจัยหนีไปงีบ และอัพเกรดเป็น Big Sleep ปัญญาประดิษฐ์แบบ agentic ช่วยหาช่องโหว่ต่อเนื่อง (จนนักวิจัยหลับได้ยาวๆ) ตอนนี้กูเกิลก็ออกมาโชว์ผลงานของ Big Sleep ว่าสร้างผลงานต่อเนื่อง

โครงการหนึ่งที่ Big Sleep ดูแลอยู่คือ SQLite ที่เพิ่งพบช่องโหว่ล่าสุด คือ CVE-2025-6965 เมื่อเดือนที่ผ่านมา นอกจากการวิเคราะห์ช่องโหว่ซอฟต์แวร์แล้ว Big Sleep ยังค้นข้อมูลจาก threat intelligence เพื่อตัดการโจมตีได้เองไปด้วย

By arjin Writer on Tag: Mistral, Artificial Intelligence, LLM
Mistral

Mistral AI เปิดตัว Voxtral โมเดล AI สำหรับเสียงตัวแรกของบริษัท โดยบอกว่าเป็นโมเดลแบบโอเพนซอร์ส ใช้งานได้จริง และมีต้นทุนใช้งานที่เข้าถึงได้

Mistral บอกว่าโมเดล AI สำหรับเสียงที่มีอยู่ปัจจุบันแบ่งได้เป็น 2 ประเภท ซึ่งมีข้อดีข้อเสียที่ต้องแลกกันคือแบบ ASR ที่เป็นโอเพนซอร์ส ที่ทำงานได้จำกัด ข้อผิดพลาดเยอะ และแบบ API เป็นระบบปิด ทำงานได้ดี แต่ต้นทุนใช้งานสูง ปรับแต่งได้ไม่มาก ซึ่ง Voxtral จะทำให้ผู้ใช้งานไม่ต้องแลกข้อดี-ข้อเสียนี้

By lew Founder on Tag: GitHub Copilot, LLM
GitHub Copilot

GitHub เปิดบริการ Coding Agent แบบทำงานเบื้องหลังเมื่อเดือนพฤษภาคมที่ผ่านมา เป็นระบบผู้ช่วยเขียนโค้ดที่ทำงานอัตโนมัติจนเสร็จ แล้วส่งงานเป็น pull request พร้อมตรวขงานทีเดียว โดยของเดิมจำกัดเฉพาะผู้ใช้แบบ Pro+ และ Enterprise เท่านั้น ล่าสุดทาง GitHub ขยายให้ลูกค้าแพ็กเกจ Pro สามารถใช้งานได้เหมือนกัน

By lew Founder on Tag: OpenRouter, LLM, Programming, Moonshot AI, Grok
OpenRouter

สัปดาห์ที่ผ่านมาโมเดลปัญญาประดิษฐ์ที่ทำคะแนนทดสอบในกลุ่มการเขียนโปรแกรมออกใหม่ถึงสองตัว คือ Grok 4 และ Kimi K2 และตอนนี้รายงานการใช้งานก็แสดงให้เห็นว่าโปรแกรมเมอร์เริ่มให้ความสนใจโมเดลทั้งสองตัวนี้จริง เมื่อดูจากรายงานปริมาณการใช้งานรายวันใน OpenRouter ที่แยกตามประเภทการใช้งาน

โมเดลในกลุ่มการเขียนโปรแกรมนั้น Claude 4 Sonnet ยังคงความนิยมสูงสุดถึง 46.3% ตามมาด้วย Gemini 2.5 Pro 12.7% แต่ความพิเศษของรอบนี้คือ Grok 4 ติดอันดับด้วยปริมาณการใช้งานถึง 6.7% แม้ราคาจะพอๆ กับ Claude 4 Sonnet อันดับสิบคือ Kimi K2 ของ Moonshot AI อยู่ที่ 5.1%

By arjin Writer on Tag: Meta, Llama, Rumors, Artificial Intelligence, LLM, Open Source
Meta

หลังจาก Meta ได้ตั้งแผนกปัญญาประดิษฐ์ใหม่ Superintelligence ที่มี Alexandr Wang อดีตซีอีโอ Scale AI เป็นหัวหน้าทีม ล่าสุดมีรายงานจาก The New York Times เกี่ยวกับการหารือถึงการปรับยุทธศาสตร์โมเดล AI ในอนาคตของ Meta ใหม่ทั้งหมด

รายงานบอกว่า Wang ได้พูดคุยกับทีมงานหลักของ Superintelligence เสนอให้ยกเลิกการพัฒนา Behemoth ที่เป็นโมเดล AI รุ่นบนของ Meta ไปเลย ซึ่งโมเดลนี้อยู่ในชุด Llama 4 ที่เปิดตัวไปเมื่อเดือนเมษายน โดยเป็นโมเดล LLM ขนาดใหญ่ที่สุด และมีข่าวก่อนหน้านี้ว่าเลื่อนเปิดตัวไปเป็นปลายปีเพราะความสามารถยังไม่ดีพอ ทั้งนี้ Behemoth เสร็จสิ้นขั้นตอนการฝึกฝนโมเดลแล้ว

By lew Founder on Tag: Kiro, AWS, Programming, LLM, IDE, Amazon
Kiro

AWS เปิดตัว Kiro IDE ปัญญาประดิษฐ์แบบเดียวกับ Cursor หรือ Windsurf แต่ชูจุดเด่นที่สร้างเอกสารอย่างละเอียด และสามารถทำตามเงื่อนไขต่างๆ ที่ผู้ใช้กำหนด ทำให้ควบคุมเอกสารต่างๆ ในโครงการ, ระบบทดสอบ, และโค้ดจริง ให้ตรงกันได้ตลอดเวลา

ตัวปัญญาประดิษฐ์เบื้องหลัง Kiro เป็น Claude 4 และ Claude 3.7 จุดขายสำคัญของ Kiro คือนับการใช้งานตามการ "สั่งงาน" (interaction) เช่น แชตคุย, สั่งเขียนโค้ดตามสเปค, หรือสั่งตรวจเงื่อนไข ระหว่างทางแต่ละคำสั่ง หาก Kiro เรียกใช้เครื่องมือโดยอัตโนมัติ หรือแก้ไขข้อผิดพลาดของตัวเอง ก็จะไม่นับโควต้าแต่อย่างใด ทำให้การใช้งานคาดเดาต้นทุนได้ง่าย

By lew Founder on Tag: EFF, LLM, Artificial Intelligence
EFF

EFF มูลนิธิเรียกร้องเสรีภาพอินเทอร์เน็ต ออกมาวิจารณ์ถึงการใช้ปัญญาประดิษฐ์ช่วยตำรวจจับกุม เช่น การใช้ Axon Draft One บริการเขียนเอกสารแจ้งความอัตโนมัติ ว่าเป็นการใช้งานที่อันตราย และไม่มีการควบคุมเพียงพอ

บทความของ EFF ระบุความเสี่ยงของระบบ เช่น Draft One ว่ามีความเสี่ยงตั้งแต่การแปลงเสียงเป็นข้อความที่อาจจะผิดพลาด หรืออาจจะขยายความบางส่วนจนเกินเหตุ

By mk Founder on Tag: Gemma, DeepMind, LLM, Health, Medical
Gemma

Google DeepMind เปิดตัวโมเดลใน ซีรีส์ MedGemma ที่ใช้วิเคราะห์ข้อมูลด้านการแพทย์ เพิ่มเติม

โมเดลชุดแรกที่เปิดตัวเดือนที่แล้วมีสองตัวคือ

  • MedGemma 27B Text
  • MedGemma 4B Multimodal

โมเดลตัวใหม่รอบนี้มีอีกสองตัวคือ

By mk Founder on Tag: OpenAI, LLM, Sam Altman, Artificial Intelligence
OpenAI

Sam Altman ประกาศเลื่อนการเปิดตัวโมเดลปัญญาประดิษฐ์รุ่นใหม่ของ OpenAI ที่เดิมจะเปิดตัวในสัปดาห์หน้าออกไปอย่างไม่มีกำหนด โดยให้เหตุผลว่าต้องการทดสอบความปลอดภัย (safety test) เพิ่มเติม ซึ่งไม่รู้ว่าจะใช้เวลานานเท่าไร

โมเดลตัวนี้เป็นโมเดลแบบ open-weight หรือบ้างก็เรียก open source model ที่อนุญาตให้ดาวน์โหลดไปรันเองได้ ซึ่งเป็นสิ่งที่ OpenAI ถูกเรียกร้องให้ทำมาโดยตลอด หลังจากปรับนโยบายเป็นการปิดรายละเอียดการทำงานของโมเดลมากขึ้นเรื่อยๆ ในช่วงหลัง โดยโมเดลตัวนี้ (ซึ่งยังไม่มีชื่อ) จะแยกจาก GPT-5 แต่น่าจะเปิดตัวไล่เลี่ยกัน

By lew Founder on Tag: Moonshot AI, LLM, Artificial Intelligence
Moonshot AI

Moonshot AI บริษัทปัญญาประดิษฐ์จากจีนปล่อยโมเดล Kimi K2 โมเดลปัญญาประดิษฐ์ขนาดใหญ่ถึง 1 ล้านล้านพารามิเตอร์ จุดเด่นคือความสามารถด้านการเขียนโปรแกรมนั้นอยู่ระดับเทียบเคียงกับ Claude 4 บางชุดทดสอบชนะได้แม้แต่รุ่น Opus

สถาปัตยกรรมของ Kimi K2 นั้นเป็น mixture-of-experts (MoE) ที่ซอยย่อยถึง 384 experts ทำให้เวลารันจริงจะมีพารามิเตอร์ที่ใช้งานจริงเพียง 32 พันล้านพารามิเตอร์เท่านั้น ทำให้ต้นทุนการรันโดยรวมถูกลง

ทาง Moonshot AI ให้บริการโมเดล Kimi K2 โดยคิดค่าอินพุต 0.6 ดอลลาร์ต่อล้านโทเค็น เอาท์พุต 2.5 ดอลลาร์ต่อล้านโทเค็น ทำให้ราคารวมเป็นเพียง 1 ใน 5 ของ Claude 4 Sonnet เท่านั้น

By lew Founder on Tag: Grok, LLM
Grok

หลังจาก xAI เปิดตัว Grok 4 ออกมา ตอนนี้ผลทดสอบต่างๆ ตอนนี้ผลทดสอบต่างๆ ก็เริ่มออกตามมา และดูเหมือน Grok 4 จะเป็นโมเดลปัญญาประดิิษฐ์ที่ฉลาดที่สุดตามที่ Elon Musk อ้างไว้จริงๆ

ผลทดสอบสำคัญคือ ARC-AGI 2 ชุดทดสอบความฉลาดแบบมนุษย์ มนุษย์โดยทั่วไปทำคะแนนได้สูง 60% แต่ปัญญาประดิษฐ์กลับทำได้แย่ ตอนนี้ Grok 4 คะแนนได้ถึง 15.9% นับว่ากระโดดเกือบสองเท่าตัวจาก Claude Opus 4 Thinking เทียบกับ Grok 3 ที่แก้ปัญหาในชุดทดสอบนี้ไม่ได้เลย

By arjin Writer on Tag: xAI, Elon Musk, Artificial Intelligence, LLM, Grok
xAI

xAI บริษัทปัญญาประดิษฐ์ของ Elon Musk เปิดตัวโมเดล AI Grok รุ่นใหม่ในชื่อ Grok 4 ซึ่ง Musk บอกว่าเป็นปัญญาประดิษฐ์ที่ฉลาดที่สุดในโลกตอนนี้

Grok 4 นำเสนอจุดเด่นในการทำบททดสอบ Humanity's Last Exam ซึ่งมีทั้งคำถามคณิตศาสตร์ วิทยาศาสตร์ และภาษา ได้คะแนนออกมาสูงสุดเมื่อเทียบกับโมเดล AI รุ่นบนสุดของคู่แข่ง โดยไม่ต้องใช้เครื่องมือมาเสริมการทำงานให้ได้คำตอบที่ถูกต้องมากขึ้นด้วย

By lew Founder on Tag: Gemini, LLM
Gemini

กูเกิลเปิดบริการ Gemini API Batch Mode สำหรับผู้ที่ยินดีรอผลตอบกลับช้าๆ โดยมีข้อดีสำคัญคือสามารถขอประมวลผลทีละมากๆ และยังได้ส่วนลดครึ่งหนึ่งเทียบกับการใช้งานตามปกติ

เนื่องจากเหมาะกับการประมวลผลข้อมูลขนาดใหญ่มาก การใช้งานในโหมดนี้สามารถใส่งานเข้าไปได้ทีละ 2GB และใส่งานในคิวได้รวม 20GB งานที่สามารถใช้งานได้ เช่น การวิเคราะห์วิดีโอจำนวนมากๆ แม้กูเกิลจะระบุว่าอาจจะต้องรอถึง 24 ชั่วโมงแต่หากเป็นงานขนาดเล็กก็มักจะได้รับเร็วกว่านั้น

By lew Founder on Tag: ChatGPT, LLM
ChatGPT

Adrian Holovaty ผู้ร่วมก่อตั้งเว็บอ่านโน้ตเพลง Soundslice และยังเป็นผู้สร้างเฟรมเวิร์ค Django เล่าถึงประสบการณ์การมอนิเตอร์ระบบหลังบ้านของ Soundslice ที่ใช้สแกนภาพโน้ตเพลงแล้วเล่นออกมาเป็นเพลง โดยพบความผิดพลาดมากขึ้นในช่วงหลังและเมื่อตรวจสอบพบว่าคนส่งภาพหน้าจอ ChatGPT ที่เป็นโน้ตเพลงแบบ ASCII tab เข้ามา

Holovaty ลองไปเล่น ChatGPT ดูก็พบว่าหลังจากสั่งให้ ChatGPT แต่งเพลงและบอกว่าอยากฟังเพลงที่แต่งขึ้น ChatGPT จะแนะนำให้เข้าเว็บ Soundslice แล้วใส่โน้ตเพลงลงไป ทำให้ผู้ใช้จำนวนนวนหนึ่งมาเปิดบัญชีแล้วพยาายามใส่โน้ตเพลงลงมา

By arjin Writer on Tag: Sakana AI, Artificial Intelligence, LLM
Sakana AI

Sakana AI บริษัทพัฒนาและวิจัยปัญญาประดิษฐ์จากญี่ปุ่น เผยแพร่วิธีการใหม่ในการเรียกใช้งานโมเดล AI คราวละหลายตัว เพื่อให้ช่วยกันทำงานตามคำสั่งหนึ่ง โดยมองเหมือนกับการนำผู้เชี่ยวชาญที่เก่งแต่อย่างมาระดมสมองแก้ปัญหาด้วยกัน ย่อมสร้างคำตอบที่ถูกต้องและดีกว่า

วิธีการนี้ตั้งชื่อว่า Multi-LLM AB-MCTS โดยตัวหลังย่อมาจาก Adaptive Branching Monte Carlo Tree Search โดยทำการค้นหาคำตอบทั้งเชิงลึกและเชิงกว้าง โดยเชิงลึกเพื่อให้ได้แนวทางดีที่สุดของโมเดลนั้น ส่วนเชิงกว้างเพื่อเปิดโอกาสหากมีแนวทางอื่นที่เป็นไปได้ แล้วนำคำตอบมาทดสอบซ้ำไปพร้อมกับการค้นหาคำตอบใหม่ จนได้คำตอบที่ดีที่สุด ซึ่งวิธีการ Monte Carlo Tree Search นี้ เหมือนกับที่ใช้ในโมเดล AI เล่นโกะ AlphaZero ของ DeepMind

By lew Founder on Tag: Cursor, Programming, LLM
Cursor

Cursor ผู้ให้บริการ IDE เขียนโปรแกรมพร้อม AI ออกประกาศขออภัยลูกค้า หลังจากเดือนที่ผ่านมาประกาศปรับรูปแบบการคิดค่าบริการใหม่เป็นการคิดตาม "การประมวลผล" และทำให้ลูกค้าจำนวนหนึ่งถูกเก็บค่าบริการสูงจนน่าตกใจ

เดิม Cursor แบบ Pro ค่าบริการ 20 ดอลลาร์ต่อเดือนอาศัยการนับจำนวน request คิดที่ 500 request ต่อเดือน ยกเว้น Claude Sonnet ที่คิดราคาเป็น 2 request แต่ในความเป็นจริงต้นทุนของ LLM นั้นคิดตามปริมาณโทเค็นเข้าและออกจากโมเดล ซึ่งทำให้กลุ่มผู้ใช้ที่พยายามประมวลผลข้อมูลใหญ่ๆ กินโทเค็นต่อ request สูงมาก

By lew Founder on Tag: Gemini, Programming, LLM, Claude
Gemini

กูเกิลเปิดตัว Gemini CLI ในสัปดาห์ที่ผ่านมา มีจุดเด่นสำคัญคือสามารถใช้บริการฟรีได้ 1,000 ครั้งต่อวัน ทำให้เป็นผู้ช่วยเขียนโปรแกรมราคาประหยัด สร้างความนิยมจนจำนวนดาวใน GitHub ทะลุ 50,000 ดาวไปแล้ว แต่ในหมู่คนเขียนโปรแกรมแบบ vibe coding จำนวนมากก็ยังนิยม Claude มากกว่า ทำให้เริ่มมีความพยายามผสมสองบริการเข้าด้วยกัน

By mk Founder on Tag: Microsoft AI, Microsoft, Medical, LLM, Artificial Intelligence
Microsoft AI

Microsoft AI เปิดตัว MAI Diagnostic Orchestrator (MAI-DxO) เป็นกลไกการควบคุมโมเดล (orchestrator) สำหรับวินิจฉัยอาการป่วย (diagnosis) ที่ให้ผลการทำนายถูกต้องเกิน 80% ในราคาการรันโมเดลที่สามารถเข้าถึงได้

Subscribe to LLM