Image

Large Language Model

By lew Founder on Tag: Xiaomi, LLM
Xiaomi

Xiaomi ประกาศลดราคาค่าบริการ MiMo-V2.5-Pro ลงกว่าครึ่ง ทำให้ราคาอยู่ในระดับเดียวกับ DeepSeek V4 Pro ที่เพิ่งประกาศลดราคาถาวร โดยลดราคาทั้งการใช้งานปกติและแบบแคช

By arjin Writer on Tag: DeepSeek, LLM
DeepSeek

DeepSeek ออกโมเดลเวอร์ชัน 4 คือ DeepSeek-V4-Pro และ DeepSeek-V4-Flash มาตั้งแต่เดือนที่แล้ว ซึ่งโมเดลรุ่น Pro นั้น DeepSeek ก็ชูจุดเด่นนอกเหนือจากความสามารถคือราคาถูกโดยอยู่ที่ 1.74/3.48 ดอลลาร์ต่อ 1M โทเค็น แถมในช่วงเปิดตัวยังลดราคาถึง 75% ด้วย

ล่าสุด DeepSeek จัดเต็มเรื่องราคาต่อโดยบอกว่าโมเดล deepseek-v4-pro จะคิดราคาใช้งาน API ที่ราคาเท่ากับราคาลด 75% ในช่วงเปิดตัวซึ่งเดิมกำหนดถึงวันที่ 31 พฤษภาคมนี้ไปแบบถาวรเลย ทำให้ราคาใหม่อยู่ที่ 0.435/0.87 ดอลลาร์ต่อ 1M โทเค็น ส่วนราคาโมเดลรุ่นเล็ก DeepSeek-V4-Flash ยังคงเท่าเดิมคือ 0.14/0.28 ดอลลาร์ต่อ 1M โทเค็น

By lew Founder on Tag: Gemini, LLM, Google
Gemini

กูเกิลเปิดบริการ Managed Agents ที่เปิดให้ผู้ใช้เรียกใช้งาน API เหมือนเป็นการเรียก Gemini ปกติ แต่ที่จริงแล้วกลับเป็นการสร้าง virtual machine ให้ Gemini สามารถตรวจงานและรันโค้ดก่อนส่งงานกลับไปยังผู้ใช้

API การเรียกใช้งาน Managed Agents ใช้ Gemini Interactions API เหมือนการเรียก Gemini ปกติ แต่ประกาศให้รันโค้ดในเครื่อง remote พร้อมกับต้องระบุนโยบายการเข้าถึงเน็ตเวิร์กว่าจะยอมให้ agent เชื่อมต่อเซิร์ฟเวอร์โดเมนใดได้บ้าง

ผู้ใช้สามารถเปิดให้ agent เข้าถึงไฟล์ได้ ผ่านการอัปโหลดไฟล์ใน API โดยตรง, เชื่อมเข้ากับ Google Cloud Storage, หรือจะเชื่อมกับ git repository ก็ได้

By lew Founder on Tag: Gemini, Google, LLM
Gemini

กูเกิลเปิดตัว Gemini Spark บริการผู้ช่วยส่วนตัวแบบเดียวกับ OpenClaw แต่รันบน virtual machine ของตัวเอง สามารถสั่งงานที่ต้องทำต่อเนื่อง หรือทำตามช่วงเวลา

ฟีเจอร์นี้สามารถพ่วงกับ Gemini สำหรับ macOS ทำให้สามารถควบคุมเครื่องคอมพิวเตอร์ของเราได้แบบเดียวกับ Claude Cowork สามารถสร้าง skill ใหม่ๆ ให้กับ agent ได้เหมือนกับ Cowork

Gemini Spark ยังจำกัดเฉพาะผู้ทดสอบที่ได้รับเชิญก่อน และเมื่อเปิดบริการแบบเบต้าจะเปิดให้ผู้ใช้บัญชี AI Ultra

ที่มา - Google Blog

By lew Founder on Tag: Gemini, Google, LLM
Gemini

กูเกิลเปิดตัว Gemini 3.5 Flash โมเดลรุ่นใหม่ที่คะแนนทดสอบความฉลาดรวมอยู่ระดับเดียวกันหรือเหนือกว่า Gemini 3.1 Pro แต่ราคาถูกกว่าประมาณ 25% หากเทียบกับ Gemini 3.1 Flash ราคาของรุ่นนี้จะแพงขึ้นถึงสามเท่าตัวทีเดียว

แม้ราคาจะสูงขึ้นเมื่อเทียบกับ Gemini Flash ด้วยกัน แต่กูเกิลก็โชว์ผลทดสอบเทียบกับ Gemini 3.1 Pro, Claude Opus 4.7, และ GPT-5.5 โชว์ว่าผลทดสอบอยู่ในระดับเดียวกัน ผลัดกันแพ้ชนะไปตามชุดทดสอบ

แต่จุดขายจริงๆ ของ Gemini 3.5 Flash คือความเร็วในการรันสูงขึ้นมาก สามารถตอบสนองระดับเกือบ 300 token/sec เร็วกว่า Gemini 3.1 Flash มาก

By mk Founder on Tag: Cursor, Programming, LLM
Cursor

Cursor บริษัท AI ช่วยเขียนโค้ด เปิดตัว โมเดลเขียนโค้ด Composer เวอร์ชันใหม่ 2.5 ที่พัฒนาขึ้นจาก Composer 2.0 เดิม มีคะแนนเบนช์มาร์คทัดเทียมกับ Claude Opus 4.7 แล้ว

Cursor โฆษณาว่า Composer 2.5 มีความสามารถใกล้เคียงกับ Claude Opus 4.7 และ GPT-5.5 แต่มีราคาถูกกว่า ราคาอยู่ที่ 0.50 ดอลลาร์ต่อ 1 ล้านโทเคน (อินพุต) และ 2.50 ดอลลาร์ต่อ 1 ล้านโทเคน (เอาต์พุต)

By lew Founder on Tag: EY, LLM
EY

GPTZero บริการตรวจบทความที่ใช้ LLM รายงานถึงการตรวจบทวิเคราะห์ "Points of Attack: Uncovering Cyber Threats and Fraud in Loyalty Systems." ที่เผยแพร่โดยบริษัทที่ปรึกษา Ernst & Young (EY) สาขาแคนาดาเมื่อปี 2025 และพบว่าบทวิเคราะห์นี้ อ้างอิงที่มาที่ไม่มีจริง, ใช้ค่าสถิติปลอม, และบทความเขียนด้วย AI โดยล่าสุดเว็บไซต์ของทาง EY ได้ถอดบทความนี้ไปแล้ว

จุดที่ทำให้แน่ใจว่าบทความถูกเขียนด้วย AI เช่น การอ้างอิงบทความปลอมสูงถึง 60% จาก URL ที่ไม่มีจริง ชื่อบทความไม่สามารถอ้างอิงถึงที่มาใดได้ บางครั้งการอ้างอิงอ้างถึงนักเขียนจริง แต่ไม่เคยเขียนบทความที่ถูกอ้าง

By lew Founder on Tag: LLM, OpenClaw, Singapore
LLM

ในงาน AI Engineer ในสิงคโปร์วันนี้ Vivian Balakrishnan รัฐมนตรีกระทรวงต่างประเทศสิงคโปร์ขึ้นบรรยายเปิดงาน โดยเล่าถึงประสบการณ์การติดตั้ง AI agent เป็นผู้ช่วยส่วนตัว โดยแชร์ประสบการณ์ทั้งด้านเทคนิคและการใช้งาน

Vivian พยายามสร้าง wiki ส่วนตัวด้วย Nanoclaw โครงการในกลุ่ม OpenClaw ที่ได้รับความนิยมสูงอีกตัวหนึ่ง โดยระบุเหตุผลว่าโครงการเรียบง่ายเพียงพอที่จะอ่านโค้ดได้ โดยติดตั้งใน Rasbberry Pi และตัวโมเดล AI นั้นใช้ Claude Agent SDK แต่เครื่องมืออื่นๆ ใช้เครื่องมือภายในเครื่องตัวเอง ได้แก่

By lew Founder on Tag: OpenRouter, LLM, Programming
OpenRouter

OpenRouter หน้าร้านขายบริการ LLM API เปิดตัว Pareto Router (มาจาก Pareto efficiency) ตัวเลือกโมเดลเขียนโปรแกรมอัตโนมัติ โดยคงความเก่งเท่าเดิม

By lew Founder on Tag: AWS, LLM, Payment
AWS

AWS เพิ่มฟีเจอร์ Amazon Bedrock AgentCore เปิดทางให้นักพัฒนาสามารถสร้าง AI agent ที่ตัดสินใจจ่ายเงินได้ด้วยตัวเองทำให้สามารถสร้างแอปพลิเคชันที่ต้องการข้อมูลแบบเสียเงินได้

จุดที่ AI agent ต้องการเข้าถึงข้อมูลแบบจ่ายเงินมักเป็น API เฉพาะทาง, เนื้อหาเว็บ, หรือการเรียกใช้ AI agent ตัวอื่น การเรียกใช้งาน API เหล่านี้มักมีมูลค่าต่ำกว่า 1 ดอลลาร์

By arjin Writer on Tag: OpenAI, ChatGPT, LLM
OpenAI

OpenAI อัปเดตโมเดล AI รุ่นพื้นฐานสำหรับผู้ใช้งาน GPT-5.5 Instant จากโมเดลหลัก GPT-5.5 ที่ออกมาสัปดาห์ก่อน โดยโมเดลตระกูล Instant ออกแบบมาให้ทำงานถามตอบทั่วไปสำหรับผู้ใช้งานส่วนใหญ่ และใช้งานเป็นโมเดลค่าเริ่มต้น

ในอัปเดตนี้ OpenAI บอกว่า GPT-5.5 Instant ปรับปรุงให้มีการตอบคำถามที่แม่นยำมากขึ้น หลอนน้อยลง และเพิ่มความสามารถในการอ่านรูปภาพ ตอบคำถามวิทยาศาสตร์ -คณิตศาสตร์ดีขึ้น และตัดสินใจได้ดีขึ้นหากไม่รู้ข้อมูลและต้องค้นเว็บไซต์เพิ่ม

By lew Founder on Tag: IBM, LLM, Granite
IBM

IBM เปิดตัวโมเดลปัญญาประดิษฐ์แบบ LLM ในกลุ่ม Granite 4.1 โดยชูจุดเด่นว่าทำงานได้ประสิทธิภาพดีเมื่อเทียบกับกลุ่มโมเดลขนาดเล็กด้วยกัน และยังมีรุ่นเฉพาะทาง เช่น โมเดลอ่านภาพที่ถูกฝึกสำหรับการอ่านเอกสารธุรกิจ และโมเดลแปลงเสียงเป็นข้อความ

By arjin Writer on Tag: Grok, xAI, LLM, Artificial Intelligence
Grok

xAI เปิดตัวโมเดล AI หลักรุ่นใหม่ Grok 4.3 หลังจากทดสอบในสถานะเบต้าเมื่อต้นเดือน มีจุดเด่นด้านการคิดเป็นเหตุผล (Reasoning) ที่ดียิ่งขึ้น มีการประมวลผลก่อนให้คำตอบใดออกมาเพิ่มความแม่นยำ และรองรับ context window สูงสุดมากขึ้นเป็น 1M โทเค็น

ผลการทดสอบ Grok 4.3 ทำคะแนนได้สูงในการทดสอบความรู้เฉพาะทาง เช่น กฎหมาย CaseLaw v2 หรือการเงิน CorpFin

จุดขายสำคัญของ Grok 4.3 คือราคาที่ลดลงของ API อยู่ที่ 1.25/2.50 ดอลลาร์ต่ออินพุท/เอาท์พุท 1M โทเค็น ซึ่งต่ำกว่าโมเดลเรือธงค่ายอื่นอยู่มาก

By lew Founder on Tag: Tencent, LLM
Tencent

Tencent เปิดตัวโมเดลตระกูล Hy3 (混元 แปลว่าจุดกำเนิดจักรวาล) เป็นโมเดลขนาด 295B-A21B รองรับ context 256K ที่อาศัยโครงสร้างการฝึกโมเดลแบบ reinforcement learning ที่ทาง Tencent สร้างขึ้นมาใหม่

รายงานโมเดลระบุว่าทีมงานลดการเทียบด้วยการทดสอบมาตรฐานลง เพราะการทดสอบเหล่านี้ถูกโกงได้โดยง่าย แต่พยายามสร้างชุดทดสอบภายในที่เป็นข้อสอบล่าสุดจริงๆ และผลทดสอบแสดงให้เห็นว่า Hy3 ขึ้นไปเทียบกับคู่แข่งอย่าง GLM-5 หรือ Kimi-K2.5 (สังเกตว่าทีมงานเลือกเทียบกับโมเดลเก่า) แต่ความเด่นจริงๆ คือ Hy3 มีขนาดเล็กกว่าโมเดลคู่แข่งมาก รายงานระบุว่า Hy3 เป็นก้าวแรกของการพัฒนาโมเดลต่อไป

By arjin Writer on Tag: Claude, Anthropic, LLM, Artificial Intelligence, Adobe, Affinity, Blender
Claude

Anthropic ประกาศความร่วมมือกับผู้พัฒนาแอปสำหรับงานสร้างสรรค์หลายราย เพื่อให้ Claude สามารถเชื่อมต่อผ่าน Connectors ในการทำงานร่วมกับแอปเหล่านี้ได้ไม่ว่าจะเป็นโครงการขนาดเล็กหรือโครงการขนาดใหญ่ที่ซับซ้อน

รายชื่อแอปที่ประกาศรอบนี้ได้แก่ Ableton, Adobe, Affinity, Autodesk Fusion, Blender, Resolume Arena กับ Resolume Wire, SketchUp และ Splice

สำหรับความร่วมมือกับ Blender นั้นมีความพิเศษเพราะ Anthropic ได้ร่วมสนับสนุนในโครงการโอเพนซอร์สของ Blender ด้วย และร่วมพัฒนา API Python เพื่อให้รองรับการเชื่อมต่อผ่าน MCP และเข้าถึงโมเดลผ่านวิธีการอื่น ๆ ไม่จำกัดเฉพาะการใช้ Claude

By lew Founder on Tag: Xiaomi, LLM
Xiaomi

Xiaomi ปล่อยโมเดล Xiaomi MiMo ออกมาเป็นโมเดลเปิดแบบสัญญาอนุญาต MIT ชูจุดเด่นว่าเป็นโมเดลระดับชั้นนำแต่ยังให้บริการที่ค่อนข้างถูก

ตัวโมเดล MiMo-V2.5-Pro ใช้สถาปัตยกรรม MoE ขนาด 1T-A42B ทำให้มีโมเดลขนาดใหญ่แต่ยังเล็กกว่าโมเดลอย่าง DeepSeek-V4-Pro มาก และใช้เทคนิค Multi-Token-Prediction เพื่อเพิ่มประสิทธิภาพการรัน

แนวทางการให้บริการของ Xiaomi ค่อนข้างแปลกกว่าเจ้าอื่นๆ คือให้บริการซื้อโทเค็นแบบเหมาจ่าย แต่นับเครดิตต่อเนื่องไป ต่างจากบริษัทอื่นๆ ที่มักจะให้โควตาเป็นช่วงๆ แต่มีแรงจูงใจให้ใช้นอกช่วงเวลาหนาแน่นด้วยการลดปริมาณเครดิตที่ใช้หากใช้งานช่วงใกล้เที่ยงคืนถึงเช้าในประเทศไทย

By lew Founder on Tag: OpenAI, Privacy, LLM
OpenAI

OpenAI ปล่อยโมเดล OpenAI Privacy Filter โมเดลสำหรับกรองข้อมูลส่วนบุคคลก่อนส่งไปยังระบบภายนอกที่เราไม่ต้องการให้เห็นข้อมูลส่วนตัว

Privacy Filter สามารถตรวจจับข้อมูลส่วนตัวได้ 8 หมวด ได้แก่ ชื่อบุคคล, ที่อยู่, อีเมล, หมายเลขโทรศัพท์, URL, วันที่, หมายเลขบัญชี, และกุญแจลับต่างๆ

สถาปัตยกรรมของ Privacy Filter สร้างจาก LLM เดิม แต่เปลี่ยนการทำนายโทเค็นถัดไป เป็นการตรวจจับประเภทของโทเค็นต่างๆ แทน โดยรวมโมเดลมีขนาด 1.5B ทำให้สามารถรันในองค์กรได้โดยง่าย

By lew Founder on Tag: AMD, LLM
AMD

MangoBoost ผู้ผลิตซอฟต์แวร์ออปติไมซ์ประมวลผลข้อมูล ระบุชิป AMD สามารถทำประสิทธิภาพได้ใกล้เคียงกับชิป NVIDIA ใน generation เดียวกันหากมีการออปติไมซ์ดีพอ อย่างไรก็ดีกระบวนการออปติไมซ์ในซอฟต์แวร์โอเพนซอร์สยอดนิยมนั้นซับซ้อนจนทำให้การดึงประสิทธิภาพได้เต็มยังคงยุ่งยาก

By lew Founder on Tag: DeepSeek, LLM
DeepSeek

DeepSeek ออกโมเดลเวอร์ชัน 4 สองตัว ได้แก่ DeepSeek-V4-Pro และ DeepSeek-V4-Flash ชูจุดเด่นว่ามีความเก่งในหมวดการเขียนโปรแกรมระดับเดียวกับโมเดลชั้นนำ เช่น Opus 4.6, GPT-5.4 xhigh, และ Gemini 3.1 Pro (high)

By arjin Writer on Tag: OpenAI, ChatGPT, LLM, Artificial Intelligence
OpenAI

OpenAI ออกโมเดลรุ่นหลักเวอร์ชันใหม่ GPT-5.5 และ GPT-5.5 Pro โดยบอกว่ามีความสามารถต่าง ๆ ที่มากขึ้น ไม่ว่าจะเป็นการเขียน การแก้โค้ด การค้นคว้าข้อมูลออนไลน์ การวิเคราะห์ข้อมูล สร้างเอกสาร จัดการซอฟต์แวร์ พร้อมกับชุดข้อมูลความรู้ที่มากกว่าเดิม แต่อัตราการใช้โทเค็นนั้นใกล้เคียงกับ GPT-5.4 สำหรับงานทั่วไป และใช้น้อยลงกว่าอย่างชัดเจน เมื่อเป็นการใช้งาน Codex

ผลการทดสอบ GPT-5.5 ทำคะแนนได้โดดเด่นในหลายหัวข้อเช่น Terminal-Bench 2.0, GDPval หรือ FrontierMath

Subscribe to LLM