Image

Large Language Model

By lew Founder on Tag: Qwen, Alibaba Cloud, LLM
Qwen

สัปดาห์นี้ตลาดปัญญาประดิษฐ์แบบโมเดลเปิดจากจีนเริ่มร้อนแรงหลัง Moonshot AI เปิดตัว Kimi K3 ที่ฉลาดแซงหน้า Claude Opus แสดงให้เห็นว่าห้องวิจัยจากจีนก็สามารถแข่งขัน AI จากผู้เช่นหลัก เช่น OpenAI และ Anthropic ในราคาสูงขึ้นได้ วันนี้ Alibaba Cloud ก็ประกาศว่า Qwen 3.8 จะมีความสามารถในระดับเดียวกัน เป็นรองเพียง Claude Fable เท่านั้น

By arjin Writer on Tag: Roblox, LLM, Mobile Games
Roblox

Roblox เปิดตัว Build เครื่องมือสำหรับสร้างเกมด้วย AI ผ่านแอปบนมือถือ โดยผู้เล่นสามารถป้อน prompt แล้ว AI จะสร้างเกมต้นแบบมาให้ จากนั้นสามารถป้อนคำสั่งเพิ่มเติมเพื่อแก้ไขรายละเอียดให้ตรงตามต้องการ แล้วสามารถแชร์เกมนี้ให้กับเพื่อนได้

Roblox บอกว่า Build ใช้โมเดล AI ผสมผสานทั้งจากโมเดลที่เป็นโอเพนซอร์ส และโมเดลที่ Roblox ฝึกฝนพัฒนาขึ้นมาเองจากชุดข้อมูลที่มี โดยมีความสามารถสร้างกลไกของเกม, ฉากสภาพแวดล้อม, ตัวละคร, บรรยากาศของเกม

By lew Founder on Tag: Moonshot AI, LLM
Moonshot AI

Moonshot AI ผู้พัฒนาโมเดลปัญญาประดิษฐ์รายสำคัญจากจีนเปิดตัว Kimi K3 ที่มีขนาดใหญ่ถึง 2.8T และมีสเปคดีขึ้นหลายจุด เช่น การรองรับ context ขนาด 1M และรองรับภาพในตัว โดยผลทดสอบแสดงให้เห็นว่าโมเดลนี้ขึ้นเป็นกลุ่มชั้นนำ

ผลทดสอบการเขียนโปรแกรมชุดต่างๆ เช่น DeepSWE, Terminal Bench, SWE Marathon ตัว Kimi K3 แซงหน้า Claude Opus 4.8 ได้ทั้งหมด และเอาชนะ Fable 5 ได้ในบางชุดทดสอบ

สถาปัตยกรรมของ Kimi K3 เป็น Kimi Delta Attention (KDA) และ Attention Residuals (AttnRes) ที่ทีมพัฒนาระบุว่าปรับปรุงการส่งข้อมูลตลอดโมเดลและเพิ่ม expert เป็นจำนวนถึง 896 ตัว โดยระหว่างรันจะใช้งาน 16 ตัว

By arjin Writer on Tag: Thinking Machines Lab, Artificial Intelligence, LLM
Thinking Machines Lab

Thinking Machines Lab สตาร์ทอัป AI ที่ก่อตั้งโดย Mira Murati อดีตซีทีโอ OpenAI เปิดตัวโมเดลปัญญาประดิษฐ์ตัวแรกของบริษัทในชื่อ Inkling ซึ่งฝึกฝนข้อมูลเองทั้งหมดตั้งแต่ต้น เป็นโมเดลแบบ open-weight ที่สามารถปรับแต่งค่าได้ตามที่ผู้ใช้งานต้องการ มีขนาดพารามิเตอร์รวม 975B โดยมีพารามิเตอร์ที่ทำงานเป็นหลัก (active) จำนวน 41B รองรับ context สูงสุด 1 ล้านโทเค็น ได้ทั้งข้อความ ภาพ เสียง วิดีโอ

By arjin Writer on Tag: Claude, Anthropic, LLM, Artificial Intelligence
Claude

Anthropic ประกาศขยายเวลาใช้งาน Claude Fable 5 โมเดลความสามารถสูงสุดเวอร์ชันปรับแต่งสำหรับผู้ใช้งานทั่วไป ออกไปอีกครั้งถึงวันที่ 19 กรกฎาคมนี้ หลังจากขยายเวลามาแล้วครั้งหนึ่ง มีผลสำหรับผู้ใช้งานจ่ายเงินแบบ Pro, Max, Team, Enterprise โดยไม่ต้องจ่ายเครดิตเพิ่มเติม ซึ่งหากครบกำหนดแล้วยังต้องการใช้งานต่อ จะต้องจ่ายเงินแยกต่างหาก

กำหนดเวลายังเหมือนเดิมคือ ถึงวันที่ 19 กรกฎาคม 23:59:59 เวลาแปซิฟิก หรือบ่ายสองโมงวันที่ 20 ตามเวลาในไทย

By lew Founder on Tag: OpenAI, LLM
OpenAI

OpenAI เปิดบริการ ChatGPT Work บริการช่วยทำงานที่สามารถเชื่อมต่อเข้ากับบริการที่องค์กรใช้งานอยู่ เช่น Slack, Gmail, Outlook, Teams, Salesforce, Canva, Dropbox, หรือ GitHub เพื่อดึงข้อมูลที่จำเป็นออกมาสร้างงานที่ต้องการได้ในเว็บ ChatGPT โดยตรง เช่นการสร้างไฟล์พรีเซนเตชัน หรือสร้างเว็บนำเสนอข้อมูล

บริการสร้างเว็บ เรียกว่า Sites in ChatGPT บริการนี้ทำให้ผู้ใช้สร้างเว็บที่เชื่อมข้อมูลแต่ไม่ต้องหาที่โฮสต์ภายนอก ผู้ใช้สามารถตั้งเวลาทำงานอัตโนมัติ เช่น การสรุปภาพรวมธุรกิจรายวัน เมื่อใช้งานผ่านเดสก์ท็อปแอปจะสามารถเปิดให้ ChatGPT ควบคุมคอมพิวเตอร์ได้โดยตรง

By lew Founder on Tag: Meta, LLM, Meta AI
Meta

Meta เปิดตัวโมเดลปัญญาประดิษฐ์ที่เน้นความสามารถด้านการควบคุมคอมพิวเตอร์ (computer use) และความสามารถเขียนโค้ดที่แม้คะแนนทดสอบยังตามหลัง Opus หรือ GPT แต่ชุดทดสอบภายในของ Meta เองก็ทำคะแนนได้ใกล้เคียงกันมาก

แม้คะแนนทดสอบจะไม่ได้แสดงว่า Meta กลับมาเป็นผู้นำแต่ Muse Spark ก็อยู่ในกลุ่มต้นๆ ชัดเจน โดยทาง Meta หันไปเน้นการทำงานแบบ multi-agent ที่วางแผนได้ซับซ้อน สามารถควบคุมแอปพลิเคชันบนคอมพิวเตอร์ได้หลายโปรแกรม

By lew Founder on Tag: SpaceXAI, xAI, LLM, Grok
SpaceXAI

xAI เปิดตัวโมเดลปัญญาประดิษฐ์ Grok 4.5 โมเดลขนาดใหญ่ที่เน้นความสามารถด้านการเขียนโปรแกรม เน้นเทียบความสามารถกับ Claude Opus 4.8 และ GPT-5.5-xhigh โดยทำคะแนนได้เกาะกันสลับไปมาตามชุดทดสอบ เช่น DeepSWE, Terminal Bench, และ SWE Bench Pro

จุดขายสำคัญของ Grok นอกจากความสามารถใกล้เคียง Opus ทาง xAI ยังระบุว่าอัตราการตอบค่อนข้างเร็วที่ 80 token/s และใช้โทเค็นน้อยกว่า Opus ถึง 4 เท่าตัวในบางชุดทดสอบ โดยรวมประหยัดโทเค็นกว่า 2 เท่าตัว ขณะที่ค่า API ถูกกว่ามาก ตัวโมเดลรองรับ context ขนาด 500k ราคาอยู่ที่ 2/6 ดอลลาร์ต่อล้านโทเค็น แต่หาก context เกิน 200k คิดราคา 4/12 ดอลลาร์ต่อล้านโทเค็น

By arjin Writer on Tag: ChatGPT, OpenAI, LLM, Artificial Intelligence
ChatGPT

ข่าวสารสั้น ๆ จาก OpenAI โดยบริษัทประกาศว่า GPT-5.6 Sol โมเดลปัญญาประดิษฐ์ความสามารถสูงสุดที่เปิดตัวเมื่อสัปดาห์ก่อน รวมทั้งโมเดลรุ่นเล็ก Terra และ Luna จะเปิดให้ใช้งานได้ทั่วไปตั้งแต่วันพฤหัสบดีนี้ (เวลาสหรัฐอเมริกา) รวมทั้งขยายการเข้าถึงการใช้งานแบบพรีวิวทั่วโลกด้วย

มีรายงานอย่างไม่เป็นทางการว่าหน่วยงานกำกับดูแลของสหรัฐได้ตรวจสอบความปลอดภัยของ GPT-5.6 แล้ว จึงอนุญาตให้ OpenAI เผยแพร่โมเดลนี้ในวงกว้างได้

By mk Founder on Tag: Microsoft AI, Microsoft, Rumors, LLM, Outlook, Excel
Microsoft AI

Bloomberg รายงานข่าวว่า ไมโครซอฟท์เตรียมนำโมเดลตระกูล MAI ของตัวเองมาใช้แทนโมเดลจาก OpenAI และ Anthropic ในบางกรณี ด้วยเหตุผลว่าต้องการลดค่าใช้จ่าย โดยเริ่มจากโมเดลใน Excel และ Outlook ก่อน

By arjin Writer on Tag: Claude, Anthropic, LLM, Artificial Intelligence
Claude

นอกจากประกาศ Claude Cowork บนสมาร์ทโฟนแล้ว Anthropic ยังประกาศขยายเวลาใช้งาน Claude Fable 5 แบบไม่ต้องจ่ายโทเค็นเพิ่มเติมออกไปอีก 5 วัน จากเดิมครบกำหนด 7 กรกฎาคม เป็น 12 กรกฎาคมนี้ มีผลสำหรับผู้ใช้งานแบบจ่ายเงินทั้งหมด ภายใต้เงื่อนไขเดิมคือสูงสุด 50% ของโควต้าใช้งานต่อสัปดาห์

กำหนดระยะเวลาใช้งานได้ต่อจะมีไปจนถึง 12 กรกฎาคม 23:59:59 ตามเวลาแปซิฟิก หรือบ่ายสองโมงวันที่ 13 ตามเวลาในไทย

By arjin Writer on Tag: Meta AI, LLM, Meta, Artificial Intelligence
Meta AI

Meta เปิดตัวโมเดลปัญญาประดิษฐ์สร้างรูปภาพและวิดีโอตัวใหม่ Muse Image และ Muse Video จากทีม Superintelligence Labs โดย Muse Image เริ่มเปิดให้ใช้งานสำหรับผู้ใช้ทุกคนแล้วผ่าน Meta AI และแอปโซเชียลของ Meta ส่วน Muse Video ยังอยู่ในสถานะพรีวิว

Meta บอกว่า Muse Image เป็นเครื่องมือสร้างรูปภาพด้วย AI บนวิธีการสร้าง Agent ย่อยช่วยดำเนินการในงานเขียนโค้ดและการค้นหาข้อมูล ทำให้รองรับการทำงานที่มีความซับซ้อนและต้องการความแม่นยำสูงได้ดีโดยจะทำงานร่วมกับโมเดลหลัก Muse Spark ตัวอย่างที่นำเสนอ เช่น รูปภาพที่มีคิวอาร์โค้ด. ภาพที่ต้องรันโค้ดออกมา, ไฟล์ GIF สำหรับฝังในเว็บไซต์, การออกแบบภาพที่คงต้นฉบับไว้, การออกแบบภาพโดยค้นหาข้อมูลกระแสที่เป็นปัจจุบัน เป็นต้น

By lew Founder on Tag: Tencent, LLM
Tencent

ทีมวิจัย Tencent Hunyuan เปิดตัวโมเดลปัญญาประดิษฐ์ Tencent Hy3 ตัวจริง หลังจากก่อนหน้านี้ออกรุ่นพรีวิวมาแล้วหลายเดือน และได้รับความนิยมอย่างสูงเนื่องจากผู้ให้บริการนำโมเดลไปให้บริการที่ราคาเพียง 0.06/0.21 ดอลลาร์ต่อล้านโทเค็นเท่านั้น สำหรับตัวจริงความสามารถเพิ่มขึ้นจากรุ่นพรีวิวหลายด้านจนใกล้เคียงกับโมเดลขนาดใหญ่ เช่น DeepSeek V4 Pro, GLM-5.2

ในรุ่นตัวจริงนี้ ทีมงานยังระบุว่าความเสถียรดีขึ้นเมื่อดูการเรียกใช้เครื่องมือใน CodeBuddy ของ Tencent เอง หรือ Cline, KiloCode ล้วนมีอัตราความผิดพลาดต่ำที่ 4% สำหรับการตอบคำถามทั่วไปมีอัตราการหลอนลดลงจาก 12.5% เหลือ 5.4%

By lew Founder on Tag: MAS, Singapore, LLM
MAS

Monetary Authority of Singapore (MAS) เผยแพร่ whitepaper แนวทางความปลอดภัยในการใช้ AI agent ในบริการทางการเงิน ชื่อเอกสาร Safeguards for Agentic Finance at Runtime (SAFR) กำหนดกรอบการพัฒนา AI agent ที่ทำงานแทนคนให้มี "จุดตรวจ" ขั้นต่ำ 4 จุดก่อนใช้ AI ทำงานแทนคน ได้แก่

By arjin Writer on Tag: Z.ai, Artificial Intelligence, LLM
Z.ai

Z.ai เปิดตัว ZCode แอปพลิเคชันบนเดสก์ท็อปสำหรับรัน AI ช่วยเขียนโค้ด ด้วยโมเดลรุ่นล่าสุด GLM-5.2 จึงเป็นอีกทางเลือกสำหรับเครื่องมือช่วยเขียนโค้ดด้วย AI สำหรับนักพัฒนาที่สนใจ

ZCode รองรับทั้งระบบปฏิบัติการ macOS, Windows, Linux รวมทั้งรองรับการเรียกใช้งานโมเดล AI ค่ายอื่น สำหรับลูกค้าที่สมัครใช้งาน GLM อยู่แล้ว จะได้โควต้าสำหรับงานเขียนโค้ดเพิ่ม 1.5 เท่า หากใช้งานผ่าน ZCode

ที่มา: South China Morning Post

By lew Founder on Tag: AWS, LLM
AWS

AWS เพิ่มภูมิภาคที่รองรับบริการ Amazon Bedrock AgentCore แพลตฟอร์มสำหรับพัฒนา AI agent ในอีก 4 ภูมิภาค ได้แก่ กรุงเทพฯ, มาเลเซีย, มิลาน, และสเปน

ตัวบริการ AgentCore เป็นบริการโฮสต์ agent แบบจ่ายตามจริง เช่น บริการ serverless สำหรับรันโค้ด, บริการเบราว์เซอร์เพื่อให้ AI เข้าเว็บ, บริการค้นเว็บ, หรือบริการเก็บข้อมูล

ทาง AWS ระบุว่าการเปิดบริการในภูมิภาคเพิ่มขึ้นทำให้สามารถสร้างแอปพลิเคชันที่อยู่ใกล้ผู้ใช้ และลดเวลาหน่วง อย่างไรก็ดี โมเดลจำนวนมากใน Amazon Bedrock ยังเรียกใช้งานแบบระบุภูมิภาคไม่ได้

By arjin Writer on Tag: Claude, Anthropic, Artificial Intelligence, LLM
Claude

Anthropic อธิบายรายละเอียดเพิ่มเติมของการนำโมเดลปัญญาประดิษฐ์ขั้นสูง Fable 5 และ Mythos 5 กลับมาให้ใช้งานอีกครั้ง หลังจากรัฐบาลสหรัฐยกเลิกคำสั่งแบน โดยรายละเอียดนี้จะเน้นไปที่โมเดล Fable 5 ซึ่งเปิดให้ใช้งานได้ทั่วไป

Fable 5 จะเริ่มอัปเดตให้เลือกใช้งานได้ตั้งแต่ 1 กรกฎาคม เป็นต้นไป (เวลาสหรัฐ) ผ่านช่องทางของแพลตฟอร์ม Claude รวมทั้ง Claude Code และ Claude Cowork ส่วนโควต้าใช้งานสำหรับลูกค้า Pro, Max, Team, Enterprise จะได้สูงสุด 50% ของโควต้ารายสัปดาห์ไปจนถึงวันที่ 7 กรกฎาคม หลังจากนั้นเป็นการใช้งานผ่านระบบเครดิต

By lew Founder on Tag: Meituan, LLM
Meituan

ทีมวิจัย Meituan LongCat เปิดตัวโมเดล LongCat-2.0 ที่มีความสามารถระดับใกล้เคียงกับโมเดลชั้นนำ เช่น Gemini 3.1 Pro, GPT-5.5, หรือ Claude Opus 4.6 แต่จุดต่างสำคัญคือทีมงานฝึกโมเดลนี้ด้วยชิปจีนทั้งหมด

By arjin Writer on Tag: Claude, Anthropic, LLM, Artificial Intelligence
Claude

Anthropic ประกาศว่าบริษัทได้รับการแจ้งข้อมูลจากกระทรวงพาณิชย์สหรัฐ ว่าได้ยกเลิกคำสั่งห้ามเผยแพร่โมเดลปัญญาประดิษฐ์ขั้นสูง Claude Fable 5 และ Mythos 5 แล้ว Anthropic จึงเริ่มทยอยกลับมาเปิดการใช้งาน 2 โมเดลนี้คืนอีกครั้ง โดยจะอัปเดตสถานะต่อเนื่อง

Anthropic เผยแพร่โมเดลทั้ง Claude Fable 5 โมเดลความสามารถสูงที่ปรับแต่งสำหรับผู้ใช้งานทั่วไป และ Mythos 5 ที่จำกัดหน่วยงานที่สามารถเข้าถึงได้ ตั้งแต่ต้นเดือนมิถุนายน แต่หลังจากนั้นไม่กี่วันหน่วยงานมั่นคงสหรัฐได้ออกคำสั่งระงับการเผยแพร่ โดยมีข้อมูลไม่เป็นทางการว่าผู้เกี่ยวข้องแสดงความกังวลต่อความเก่งมากเกินไปของโมเดลนี้ ซึ่งอาจสร้างผลกระทบด้านลบได้

By arjin Writer on Tag: Claude, Anthropic, LLM, Artificial Intelligence
Claude

Anthropic ออกโมเดลปัญญาประดิษฐ์ใหม่ Claude Sonnet 5 โมเดลขนาดกลางรองรับการทำงานทั่วไป ซึ่งระบุว่ามีการพัฒนาความสามารถมากขึ้น ระยะห่างจากโมเดลตัวบน Opus 4.8 น้อยลง แต่โดดเด่นด้วยต้นทุนที่ต่ำกว่า และถ้าเทียบกับโมเดลเดียวกันรุ่นก่อนหน้าอย่าง Sonnet 4.6 ก็เพิ่มความสามารถด้าน Agentic มากขึ้น ทั้งการคิดเป็นเหตุผล, การเรียกใช้เครื่องมือต่าง ๆ, การเขียนโค้ด, องค์ความรู้ สามารถทำงานซับซ้อนที่ Sonnet 4.6 ไม่สามารถทำให้สำเร็จได้ แต่ในโมเดลนี้ทำจนสำเร็จได้

คะแนนทดสอบในหัวข้อต่าง ๆ ทั้ง SWE-bench Pro เพื่อดูการเขียนโค้ด, Humanity's Last Exam ดูการคิดเป็นเหตุผล, OSWorld-Verified ดูการใช้งานเครื่องมือคอมพิวเตอร์ พบว่า Sonnet 5 ทำคะแนนได้สูงกว่า Sonnet 4.6 และน้อยกว่า Opus 4.8 ไม่มากนัก

Subscribe to LLM