Image

Large Language Model

By arjin Writer on Tag: OpenAI, ChatGPT, LLM
OpenAI

มีประเด็นเล็ก ๆ จากงานเปิดตัวโมเดล GPT-5 ของ OpenAI เมื่อคืนนี้ เมื่อทีมงานพูดถึงผลการทดสอบความสามารถโมเดล AI ในด้านต่าง ๆ และเปรียบเทียบกับโมเดลรุ่นก่อนหน้า ด้วยกราฟแท่งของคะแนนเปรียบเทียบกัน แต่มีอะไรให้เอ๊ะอยู่บ้าง

กราฟแรกเป็นอัตราการสร้างผลลัพธ์ลวงที่ไม่สามารถทำได้จริง (Deception Rate) ซึ่งระบุว่า GPT-5 ทำได้ที่ 50% แต่กราฟที่แสดงนั้นดูเพี้ยนไปเมื่อเทียบกับ o3 ที่ 47.4% ทั้งนี้ในรายงานฉบับเต็มของ OpenAI ตัวเลขจริงอยู่ที่ 16.5% ด้วย

By arjin Writer on Tag: OpenAI, ChatGPT, Artificial Intelligence, LLM
OpenAI

OpenAI เปิดตัว GPT-5 โมเดลปัญญาประดิษฐ์เรือธงรุ่นล่าสุด โดยบอกว่ามีความฉลาดและความสามารถรอบด้านเหนือกว่าทุกโมเดลที่เคยพัฒนา เก่งทั้งการเขียนโค้ด คณิตศาสตร์ เขียนบทความ วิเคราะห์ข้อมูลสุขภาพ อ่านข้อมูลรูปภาพ และอื่น ๆ

GPT-5 มีจุดเด่นเรื่องการทำงานผสมผสาน สามารถคิดได้เองว่าแต่ละคำถามควรตัดสินตอบทันที หรือใช้เวลาคิดเพื่อหาเหตุผลเชิงลึกมากขึ้น ทำให้ผู้ใช้งานไม่ต้องเลือกว่าจะใช้โมเดลแบบใดอย่างในอดีต แต่ขณะเดียวกับก็สามารถกำหนดใน prompt ได้ว่าต้องการให้คิดตอบไว หรือให้วิเคราะห์นานขึ้นได้

By mk Founder on Tag: Qualcomm, OpenAI, Snapdragon, LLM
Qualcomm

Qualcomm ประกาศรองรับการรันโมเดลเปิด OpenAI GPT OSS บนชิป Snapdragon ถือเป็นครั้งแรกที่เราได้เห็นโมเดลจาก OpenAI รันแบบ on-device ได้

โมเดลที่รันได้เป็นรุ่นเล็ก gpt-oss-20b ขนาดพารามิเตอร์ 20B โดย Qualcomm บอกว่ารันได้บน Snapdragon รุ่น "เรือธง" แต่ไม่บอกรายชื่อว่ามีรุ่นใดบ้าง ตัวอย่างที่ Qualcomm นำมาโชว์คือการรันบน Surface Laptop 7 ที่ใช้ Snapdragon X Elite และแรม 32GB

การทำงานต้องมี Qualcomm AI Stack เข้าช่วย และแนะนำให้ใช้ผ่าน Ollama จะง่ายที่สุด

ที่มา - Qualcomm

By mk Founder on Tag: AWS, OpenAI, LLM, Amazon
AWS

AWS บริการให้บริการโมเดล OpenAI open weight หรือ GPT OSS บนบริการ Amazon Bedrock และ Amazon SageMaker ซึ่งถือเป็นครั้งแรกที่ AWS มีโมเดลของ OpenAI ให้บริการ

ก่อนหน้านี้ OpenAI มีสัญญาเอ็กซ์คลูซีฟกับไมโครซอฟท์ ทำให้มีแต่ Microsoft Azure เท่านั้นที่มีโมเดลของ OpenAI ให้เช่าใช้งาน ในขณะที่ AWS ต้องไปใช้โมเดลของ Anthropic ที่เข้าไปลงทุนไว้ รวมถึงโมเดลจากพาร์ทเนอร์รายอื่นๆ

By arjin Writer on Tag: Gemini, Google, Artificial Intelligence, LLM
Gemini

กูเกิลเพิ่มความสามารถให้ Gemini ในการสร้างหนังสือนิทาน (Storybook) จากเรื่องราวที่ผู้ใช้งานอธิบายเข้าไป ซึ่งผลลัพธ์จะได้เป็นหนังสือนิทานตามเรื่องที่ระบุ พร้อมกับภาพวาดประกอบ

Storybook ที่ได้จะเป็นหนังสือ 10 หน้า มีภาพประกอบ และเสียงบรรยาย สามารถใส่อินพุทรูปภาพหรือเอกสารของผู้ใช้งานเองเพื่อให้ได้ผลลัพธ์ตรงตามต้องการมากขึ้นได้ ภาพประกอบในหนังสือยังสามารถกำหนดสไตล์ไม่ว่าจะเป็น รูปพิกเซล การ์ตูน ภาพปั้นนูน ไปจนถึงหนังสือภาพวาดสำหรับระบายสี

By mk Founder on Tag: Google, LLM, Security, Artificial Intelligence
Google

กูเกิลเพิ่งเปิดตัว Big Sleep ปัญญาประดิษฐ์ช่วยหาช่องโหว่ความปลอดภัย ไปเมื่อเดือนที่แล้ว (ชื่อหมายถึงว่า ปัญญาประดิษฐ์ทำงานได้เอง มนุษย์นอนไปได้เลย)

ล่าสุด Heather Adkins ผู้บริหารฝ่ายความปลอดภัยของกูเกิล เปิดเผยว่า Big Sleep หาช่องโหว่ได้ครบ 20 ตัวแรกแล้ว ช่องโหว่ส่วนใหญ่อยู่ในโครงการซอฟต์แวร์โอเพนซอร์ส เช่น FFmpeg, ImageMagick, CUPS, QuickJS, Redis

By arjin Writer on Tag: Qwen, Alibaba Cloud, Artificial Intelligence, LLM
Qwen

Alibaba เปิดตัวโมเดล AI สร้างรูปภาพใหม่ Qwen-Image ในโมเดลตระกูล Qwen โดยมีจุดขายสองอย่างคือ ใส่ข้อความที่ซับซ้อนได้อย่างถูกต้อง และ สั่งแก้ไขภาพได้แม่นยำ ซึ่งทำงานได้ดีในข้อความภาษาจีน แต่ก็รองรับภาษาอังกฤษเช่นกัน

ด้วยความสามารถการใส่ข้อความในรูปภาพที่แม่นยำ ทำให้ Alibaba ชูว่า Qwen-Image เหมาะสำหรับงานทำโปสเตอร์ สไลด์ รูปภาพที่ต้องแก้ไขป้ายหน้าร้าน ภาพที่มีลายมือ และอินโฟกราฟิก

By mk Founder on Tag: Claude, LLM, Anthropic
Claude

Anthropic เปิดตัวโมเดล Claude Opus 4.1 เวอร์ชันอัพเกรดจาก Claude Opus 4 ที่เปิดตัวในเดือนพฤษภาคม

Claude Opus 4.1 อัพเกรดฟีเจอร์ด้านการเขียนโค้ด (ซึ่ง Claude เก่งอยู่แล้ว) ตอนนี้ทำคะแนนเบนช์มาร์ค SWE-bench Verified เพิ่มเป็น 74.5% เทียบกับของเดิม 72.5%

นอกจากนี้ Claude Opus 4.1 ยังเก่งขึ้นเรื่องการค้นคว้าข้อมูลเชิงลึก (deep research), การวิเคราะห์ข้อมูล และการทำงานแบบ agentic ด้วย

Claude Opus 4.1 เปิดให้เช่าใช้งานแล้วผ่าน Claude Code, Claude API, Google Vertex AI, Amazon Bedrock โดยคิดราคาเท่ากับ Claude Opus 4

By lew Founder on Tag: OpenAI, LLM
OpenAI

OpenAI เปิดโมเดลปัญญาประดิษฐ์แบบเปิด gpt-oss-120b และ gpt-oss-20b โดยเน้นการใช้งานชิปเดียว โดยรุ่น 120B ต้องการชิป H100 และรุ่น 20B สามารถรันในชิปกราฟิกตามบ้านได้

By arjin Writer on Tag: Kaggle, Google, Artificial Intelligence, DeepMind, LLM
Kaggle

กูเกิลเปิดตัวแพลตฟอร์มสำหรับทดสอบความสามารถโมเดลปัญญาประดิษฐ์แบบเปิดเผยต่อสาธารณะ ด้วยการเล่นเกมแข่งกัน Kaggle Game Arena ซึ่งเป็นความร่วมมือของ DeepMind แผนกปัญญาประดิษฐ์ของกูเกิล และ Kaggle ชุมชน Data Science ที่เป็นหน่วยงานของกูเกิลเช่นกัน

กูเกิลอธิบายว่ารูปแบบการทดสอบความสามารถโมเดล AI ปัจจุบันมักจำกัดเฉพาะหัวข้อ แม้โมเดล AI จะทำคะแนนได้สูงก็ไม่สามารถพิสูจน์ได้ชัดว่าคิดเองหรือจำคำตอบมา แนวทางของกูเกิลคือสร้างรูปแบบทดสอบที่สะท้อนว่าโมเดลสามารถคิดได้รอบด้านขึ้นจริง มีสภาพแวดล้อมของคำถามที่ไม่ตายตัว มีเป้าหมายที่ปรับได้ตลอด เป็นการทดสอบความคิดวางแผนระยะยาว การวัดผลด้วยเกมจึงตอบโจทย์เรื่องนี้

By lew Founder on Tag: Qwen, LLM, Alibaba Cloud
Qwen

LM Arena เว็บทดสอบประสิทธิภาพปัญญาประดิษฐ์แบบทดลองจากผู้ใช้ รายงานผลการทดสอบ Qwen3-235B-A22B-Instruct-2507 ที่เพิ่งอัพเดตไป ได้ผลแซงหน้า Grok-4 ไปเล็กน้อย ทำให้ตอนนี้มันเป็นโมเดลแบบเปิดที่อันดับสูงสุด

ก่อนหน้านี้โมเดลที่อยู่ใน 10 อันดับแรกและเป็นโมเดลเปิด เช่น Kimi K2 และ DeepSeek-R1 แต่ผลทดสอบก็มีระยะห่างกับโมเดลปิดตัวอื่นๆ

By mk Founder on Tag: Gemini, Google, LLM, Mathematics
Gemini

กูเกิลเริ่มเปิดบริการ Gemini 2.5 Deep Think กับลูกค้าแพ็กเกจ Google AI Ultra หลังส่งโมเดลเวอร์ชันใกล้เคียงกันไปสอบคณิตศาสตร์โอลิมปิกแล้วได้เหรียญทอง

โมเดลกลุ่ม Deep Think คือการเปิดโอกาสให้ AI คิดคำตอบได้หลายแนวทาง ถึงแม้ใช้เวลามากกว่า แต่โมเดลมีเวลาสอบทาน ตรวจสอบแนวทางต่างๆ เพื่อให้ตอบคำถามที่ซับซ้อนได้ กูเกิลโชว์ตัวเลขการทดสอบว่า Gemini 2.5 Deep Think ทำผลงานเบนช์มาร์คได้ดีกว่า Gemini 2.5 Pro มาก รวมถึงเอาชนะโมเดลยี่ห้ออื่นๆ เช่น OpenAI o3 และ Grok 4 ได้ทั้งหมด

By lew Founder on Tag: Cerebras, LLM, Programming
Cerebras

Cerebras ผู้พัฒนาชิปที่ผันตัวมาให้บริการ LLM เปิดบริการ Cerebras Code ด้วยโมเดล Qwen3-Coder ที่เริ่มใกล้เคียงกับ Claude 4 Sonnet อย่างไรก็ดี Cerebras ให้บริการโมเดลย่อแบบ FP8 ทำให้ประสิทธิภาพลดลง

จุดขายของ Cerebras Code คือ ความเร็วที่สูงมาก ระดับ 2,000 token/s ทำให้ระยะเวลารอโค้ดสั้นลง นอกจากนี้ยังมีข้อจำกัดเฉพาะโควต้าข้อความรายวันเท่านั้น

แพ็กเกจมีสองระดับ ได้แก่

By lew Founder on Tag: LLM, Programming
LLM

เมื่อวานนี้ OpenRouter เปิดบริการโมเดลแบบปิดบังตัวตนผู้ให้บริการ (stealth mode) ในโมเดลชื่อ Horizon Alpha โดยไม่มีข้อมูลอะไรมากนัก นอกจากว่ามันรองรับอินพุต 256,000 โทเค็น แต่หลังจากหลายคนเริ่มทดสอบก็พบว่าโมเดลนี้ประสิทธิภาพดีมาก โดยเฉพาะงานสายโปรแกรมมิ่ง แถมยังทำงานได้รวดเร็วทำให้การตอบสนองดีมาก

By lew Founder on Tag: KBTG, Programming, LLM
KBTG

KBTG บริษัทเทคโนโลยีในกลุ่มธนาคารกสิกรไทย จัดงานแถลงข่าว Banking on Agentic AI เปิดเผยถึงกระบวนการพัฒนาซอฟต์แวร์ภายในที่เปลี่ยนไป และใช้ Agentic AI มาเป็นส่วนประกอบในการพัฒนาเต็มรูปแบบ ผลที่ได้คือประสิทธิภาพการทำงานเพิ่มขึ้นช่วยลดต้นทุนการทำงานไปได้ถึง 32 ล้านบาท

ระบบช่วยเขียนโค้ดเป็นตัวหนึ่งที่ KBTG ใช้งาน ตัว Agent เชื่อมต่อกับ Jira ภายในของ KBTG ที่นักพัฒนาสามารถสั่งงานให้ปัญญาประดิษฐ์เขียนโค้ดจนเสร็จแล้วส่งงานมาให้รีวิวภายหลัง

By mk Founder on Tag: AMD, LLM, Ryzen, Artificial Intelligence, Llama, Mistral
AMD

AMD โชว์การรันโมเดลภาษาขนาดใหญ่ Llama 4 Scout ขนาดพารามิเตอร์ 109B และ Mistral Large 2411 ขนาด 123B บนพีซีวินโดวส์ที่ใช้ชิป AMD Ryzen AI Max+ 395 แรม 128GB

แม้ต้องใช้ซีพียูตัวแรงสุด และอัดแรมให้เยอะถึง 128GB ซึ่งคนทั่วไปมักไม่ค่อยมีใช้กัน แต่ AMD ก็สามารถปรับแต่งซอฟต์แวร์ Adrenalin Edition WHQL driver เวอร์ชันใหม่ ให้สามารถรันโมเดลขนาดใหญ่สูงสุด 128B บนพีซีได้สำเร็จ

By lew Founder on Tag: LLM, Programming
LLM

Simon Willison โปรแกรมเมอร์สหราชอาณาจักรและผู้ร่วมสร้างเฟรมเวิร์ค Django ทดลองโมเดลปัญญาประดิษฐ์ GLM-4.5-Air ที่เพิ่งเปิดตัวมาเมื่อวานนี้ และพบว่าสามารถใช้งานได้จริงแม้เป็นโมเดลรุ่นย่อก็ตาม

By lew Founder on Tag: Z.ai, LLM, Artificial Intelligence

Z.ai บริษัทปัญญาประดิษฐ์จากปักกิ่งเปิดตัวปัญญาประดิษฐ์ GLM-4.5 โดยชูความสามารถในการเขียนโปรแกรมว่าอยู่ระดับเดียวกับ Kimi K2 ที่กำลังได้รับความนิยมอย่างสูง โดยโมเดลขนาดเล็กลงเหลือเพียง 1 ใน 3 เปิดโอกาสให้ขาย API ในราคาถูกกว่า

GLM-4.5 มีสองรุ่น คือ 335B-A32B และ GLM-4.5-Air 106B-A16B เมื่อเฉลี่ยผลทดสอบ 12 ชุด เช่น MMLU-Pro, GPQA, และชุดทดสอบด้านการเขียนโปรแกรม GLM-4.5 ทำคะแนนรวมระดับเดียวกับ OpenAI o3, Grok 4, หรือ Claude 4 Opus อย่างไรก็ดีหากนับคะแนนด้านการเขียนโปรแกรมอย่างเดียว GLM-4.5 ยังคงแพ้ Claude 4 Sonnet อยู่

By lew Founder on Tag: Anthropic, Claude, LLM
Anthropic

Anthropic ผู้สร้างปัญญาประดิษฐ์ Claude ประกาศเพิ่มเพดานการใช้งานรายสัปดาห์ จากที่ก่อนหน้านี้มีเพดานการใช้งานราย 5 ชั่วโมง หลังจากพบว่าผู้ใช้เปิดรัน agent ต่อเนื่อง

ตอนนี้แพ็กเกจ Max ที่ราคา 200 ดอลลาร์ต่อเดือนสามารถใช้งานได้ 900 ข้อความทุกๆ 5 ชั่วโมง ทำให้มีผู้ใช้สร้างสคริปต์ที่หยุดรันเมื่อครบโควต้าแล้วกลับมารันใหม่ทันทีที่โควต้ากลับมา นอกจากนี้ยังมีผู้ใช้บางส่วนนำบัญชีไปขายแชร์กัน

By lew Founder on Tag: Replit, LLM, Programming
Replit

ปีที่แล้ว Replit เปิดบริการ Replit Agent ที่สามารถเขียนโปรแกรมได้เต็มรูปแบบด้วยตัวเองโดยแทบไม่ต้องโค้ดเลย แต่สัปดาห์ที่ผ่านมา Jason Lemkin ผู้ก่อตั้งบริการ SaaStr ทดลองใช้งาน Replit Agent แล้วพบว่าปัญญาประดิษฐ์ล้างฐานข้อมูลของเขาไปทั้งหมด จนทาง Replit ต้องออกฟีเจอร์มาแก้ปัญหานี้

Jason พบว่า Replit Agent สั่ง npm run db:push ระหว่างทำงานทำให้ฐานข้อมูลหายไปทั้งหมด แม้ว่า Jason จะสั่งให้ห้ามเขียนข้อมูลลงฐานข้อมูลแล้วก็ตาม

Subscribe to LLM