Image

Large Language Model

By mk Founder on Tag: Microsoft Copilot, LLM, Enterprise, Microsoft
Microsoft Copilot

เก็บตกประกาศจากงาน Microsoft Build 2025 ไมโครซอฟท์เปิดตัว Microsoft 365 Copilot Tuning บริการปรับแต่ง (fine-tuning) โมเดลสำหรับลูกค้าองค์กร

Microsoft 365 Copilot Tuning ออกแบบมาเพื่อแก้ปัญหากระบวนการทำ fine-tuning หรือปรับแต่งโมเดลให้เหมาะกับความต้องการขององค์กร ที่มักซับซ้อนและต้องใช้ความเชี่ยวชาญเฉพาะด้านสูง ไมโครซอฟท์จึงสร้างเครื่องมือเพื่อให้กระบวนการเหล่านี้ง่ายขึ้น ลดงานเขียนโค้ดและงาน data science ลง เปิดให้คนทั่วไปสามารถปรับแต่งโมเดลให้เหมาะกับงานของตัวเองได้มากขึ้น

By mk Founder on Tag: Claude, Anthropic, LLM, Artificial Intelligence
Claude

ข่าวเด่นวงการ AI วันนี้คือ การเปิดตัวโมเดล Claude 4 ของ Anthropic แต่ความสามารถที่สูงขึ้น ก็มาพร้อมกับความรับผิดชอบที่เพิ่มขึ้นด้วย

Anthropic ประกาศว่า Claude 4 Opus ซึ่งเป็นโมเดลรุ่นท็อปสุด จะมีมาตรการป้องกันโมเดลระดับสูงขึ้นด้วยคือ AI Safety Level 3 (ASL-3)

ASL-3 เป็นมาตรการความปลอดภัยระดับ 3 ตามการแบ่งสเกล Responsible Scaling Policy ที่ Anthropic กำหนดขึ้นเอง ซึ่งมีทั้งหมด 5 ระดับ

By lew Founder on Tag: Anthropic, Claude, LLM
Anthropic

Anthropic ออกโมเดล Claude 4 โดยชูจุดเด่นเป็นปัญญาประดิษฐ์เขียนโค้ดที่ดีที่สุดในโลก สามารถทำคะแนนทดสอบ SWE-Bench Verified ได้ถึง 72.5% และยังทำงานได้แม้จะเป็นการทำงานแบบ agent ที่ต้องทำงานต่อเนื่องหลายพันขั้นตอน กินเวลายาวหลายชั่วโมง

ผลทดสอบที่ Anthropic นำมาโชว์แสดงแนวทางการใช้งานชัดเจน เช่น การเขียนโค้ด หรือการเรียกเครื่องมือในการให้บริการธุรกิจ

By lew Founder on Tag: GitHub Copilot, LLM, Programming, Open Source, Microsoft, .NET
GitHub Copilot

หลังจากไมโครซอฟท์เปิดบริการ Coding Agent ที่สามารถดึงโค้ดไปทดสอบ, แก้ไข แล้วส่งโค้ดกลับมายังโครงการเป็น pull request ทีเดียว ตอนนี้โครงการต่างๆ ของไมโครซอฟท์ก็เริ่มเห็น Coding Agent ส่งแพตช์เข้ามาจำนวนมาก

เนื่องจาก .NET พัฒนาอย่างเปิดเผย เราจึงได้เห็นโปรแกรมเมอร์ของไมโครซอฟท์นั่งคุยกับ Copilot ให้แก้ปัญหาของโค้ดที่ส่งมา

By lew Founder on Tag: Gemma, Gemini, Google, LLM
Gemma

กูเกิลเปิดตัวโมเดลปัญญาประดิษฐ์ Gemma 3n ที่ใช้เทคนิคต่างๆ ในการย่อขนาดโมเดลจนเล็กลงเพียงพอที่จะรันในโทรศัพท์หรือแทบเล็ตได้ โดยยังมีความฉลาดสูง

เทคนิคย่อโมเดลสำคัญคือที่สุดคือ Per-Layer Embeddings (PLE) ที่แยกข้อมูลออกไปเก็บไว้ในสตอเรจ แล้วค่อยนำข้อมูลกลับมาใช้เมื่อรันแต่ละส่วน ทำให้โดยรวมสามารถรันโมเดลโดยใช้แรมไม่ถึงครึ่งของโมเดลเต็มๆ

By lew Founder on Tag: Gemini, DeepMind, Google, LLM
Gemini

DeepMind เปิดตัว Gemini Diffustion โมเดลปัญญาประดิษฐ์ภาษารุ่นพิเศษที่ใช้เทคนิคการสร้างคำตอบต่างจากเดิมที่เป็นการตอบทีละโทเค็น กลายเป็นการสร้างคำตอบออกมาทั้งหมดแม้จะผิดบ้าง แล้วค่อยๆ ปรับให้ตรงขึ้นเรื่อยๆ แบบเดียวกับปัญญาประดิษฐ์สร้างภาพที่มักสร้างจากภาพเบลอๆ แล้วค่อยๆ ชัดขึ้นเรื่อยๆ

จุดเด่นสำคัญของเทคนิคนี้ คือความเร็วในการตอบสูงมาก ตอนนี้ทำได้ 1,479 โทเค็นต่อวินาที ตัวโมเดลมีขนาดเล็ก แม้ว่าทาง DeepMind ไม่ได้เปิดเผยว่าโมเดลจริงๆ มีขนาดเท่าไหร่

By mk Founder on Tag: Gemini, Google, LLM
Gemini

กูเกิลเปิดเผยตัวเลขการใช้งาน Gemini และโมเดล AI ในงาน Google I/O 2025 ดังนี้

  • Gemini มีผู้ใช้ต่อเดือน (MAU) 400 ล้านคน เพิ่มขึ้นจาก ตัวเลขก่อนหน้านี้ 350 ล้านคน กูเกิลบอกว่าการใช้งานเติบโตขึ้นเรื่อยๆ หลังการออกโมเดลตระกูล Gemini 2.5 ถ้านับเฉพาะผู้ใช้โมเดล 2.5 Pro มีอัตราการใช้งานเพิ่มขึ้น 45%
  • จำนวน token ที่ใช้ประมวลผล AI อยู่ที่ 480 ล้านล้าน token ต่อเดือน เติบโตขึ้น 50 เท่าจากปีที่แล้ว ที่ช่วงเวลาเดียวกันประมวลผล 9.7 ล้านล้าน token
  • จำนวนนักพัฒนา Gemini 7 ล้านคน เพิ่มขึ้น 5 เท่าจากปีที่แล้ว, ปริมาณการใช้งาน Gemini บน Vertex AI เพิ่มขึ้น 40 เท่า
By lew Founder on Tag: Gemini, Google, LLM
Gemini

กูเกิลประกาศอัพเดต Gemini 2.5 Flash เป็นเวอร์ชั่น 05-20 ที่ทำคะแนนทดสอบได้ดีขึ้นหลายชุดทดสอบ (แต่ก็มีแย่ลงบางชุดทดสอบด้วย) ความเปลี่ยนแปลงสำคัญคือปริมาณโทเค็นที่ใช้คิดก่อนตอบนั้นลดลง 20-30%

ส่วนที่ปรับปรุงขึ้นมาชัดเจนคือการทดสอบเป็นผู้ช่วยเขียนโค้ด Aider Polygot ที่ขึ้นมาแซง DeepSeek-R1 ได้แล้ว แม้ยังตาม OpenAI o4-mini และ Claude 3.7 ก็ตาม แต่ราคาของ Gemini 2.5 Flash ก็ถูกกว่าหลายเท่าตัว

ก่อนหน้านี้ Gemini 2.5 เป็นรุ่นพรีวิวที่ API ยังไม่นิ่ง รอบนี้แม้จะยังเป็นพรีวิวอยู่แต่กูเกิลสัญญาว่าจะออกเวอร์ชั่นเสถียรภายในต้นเดือนมิถุนายนนี้ ทำให้พร้อมใช้งานแบบโปรดักชั่นแล้ว

By lew Founder on Tag: Gemini, Google, LLM
Gemini

กูเกิลเปิดตัวโหมด Deep Think ของโมเดล Gemini 2.5 Pro เป็นการบอกให้โมเดลคิดหลายๆ ทางก่อนที่จะตอบคำถามออกมา ทำให้คำตอบดีขึ้นกว่าเดิม

ทีมงานทดสอบ Deep Think ด้วยชุดทดสอบ USAMO 2025, LoveCodeBench v6, และ MMMU ผลทดสอบเอาชนะคู่แข่งอย่าง OpenAI o3 ตัวเต็ม หรือ o4-mini ไปได้ โดยเฉพาะชุดทดสอบ USAMO นั้นคะแนนนำห่าง

ฟีเจอร์ Deep Think จะเปิดให้กับผู้ทดสอบที่ได้รับเชิญเท่านั้นในช่วงแรก หากผ่านเงื่อนไขความปลอดภัยแล้วจึงจะเปิดให้ใช้งานวงกว้างภายหลัง

ที่มา - @GoogleDeepMind

By lew Founder on Tag: Jules, Gemini, Google, Programming, LLM
Jules

กูเกิลเปิดตัว Jules ปัญญาประดิษฐ์เขียนโค้ดที่ทำงานคล้าย GitHub Copilot Coding Agent โดยเราสามารถสั่งงานทางพรอมพ์หรือ assign issue ให้ Jules รับผิดชอบ จากนั้น Jules จะดึงโค้ดไปสร้างพื้นที่พัฒนาของตัวเอง แล้วแก้ไขจนเสร็จ จึงส่งเป็น pull request กลับมาให้เรารีวิว รวมถึงสามารถส่งข้อความเสียงสรุปว่าแก้อะไรไปบ้าง

By mk Founder on Tag: Grok, Microsoft Azure, Microsoft, LLM, Elon Musk, xAI
Grok

ไมโครซอฟท์ประกาศนำโมเดล Grok 3 ของ xAI มาให้บริการบน Azure AI Foundry ซึ่งถือเป็นครั้งแรกที่โมเดล Grok ถูกนำมาให้บริการเช่าใช้งานบนคลาวด์ด้วย

ราคาของ Grok 3 บน Azure คิดที่ขาอินพุต 3 ดอลลาร์ต่อ 1 ล้านโทเคน และขาเอาต์พุต 15 ดอลลาร์ต่อ 1 ล้านโทเคน ช่วงนี้ยังให้บริการฟรีแบบพรีวิวไปจนถึงต้นเดือนมิถุนายน 2025

เนื่องในโอกาส Grok มาอยู่บน Azure ทางซีอีโอ Satya Nadella จึงเชิญ Elon Musk มาขึ้นเวที (แบบผ่านวิดีโอ) และมาเล่าประวัติชีวิตของเขาที่เคยฝึกงานกับไมโครซอฟท์ด้วยนิดหน่อย เขายังพูดถึงแผนการออก Grok 3.5 ที่มีฟีเจอร์การให้เหตุผล (reasoning) ที่จะเปิดตัวในเร็วๆ นี้ด้วย

By mk Founder on Tag: Microsoft Edge, Phi, Microsoft, Browser, LLM
Microsoft Edge

Microsoft Edge ผนวกเอา Phi-4-mini โมเดลภาษาขนาดเล็กของไมโครซอฟท์ เข้ามารันในตัวเบราว์เซอร์ และเปิด API ให้เว็บแอพเรียกใช้งานได้

การมาถึงของฟีเจอร์นี้แปลว่า เราสามารถสร้างเว็บแอพที่เรียกใช้ฟีเจอร์ของ LLM แล้วประมวลผลแบบออฟไลน์ได้โดยไม่ต้องพึ่งพาเซิร์ฟเวอร์เลย

ฟีเจอร์นี้จะเริ่มใช้ใน Microsoft Edge 138 ที่ปัจจุบันอยู่ใน Canary/Dev Channel สามารถทำงานได้ทั้งบน Windows 10, 11, macOS 13.3 ขึ้นไป สเปกเครื่องขั้นต่ำจำเป็นต้องมีแรมจีพียูอย่างน้อย 5.5GB และสตอเรจอย่างน้อย 20GB เพื่อใช้ติดตั้งโมเดลตอนเรียกใช้งานครั้งแรก

By lew Founder on Tag: GitHub, LLM, Visual Studio Code, GitHub Copilot, Open Source
GitHub

GitHub เปิดซอร์สส่วนขยาย GitHub Copilot Chat ที่ใช้เชื่อม VS Code เข้ากับบริการ GitHub Copilot กลายเป็นโครงการโอเพนซอร์ส สัญญาอนุญาตแบบ MIT โดยให้เหตุผลสำคัญว่าปัญญาประดิษฐ์ในช่วงหลังดีขึ้นมาก และการสร้างพรอมพ์พิเศษที่เป็นความลับเพื่อให้เขียนโค้ดได้ดีขึ้นนั้นไม่จำเป็นอีกต่อไปแล้ว

ด้านดีของการโอเพนซอร์สนั้นมีหลายอย่าง เช่น เปิดให้ชุมชนเข้ามาช่วยแก้บั๊กและทดสอบฟีเจอร์ใหม่ๆ, ปรับปรุงการทำงานร่วมกับส่วนขยายอื่นๆ, และเปิดให้นักพัฒนาเข้ามาตรวจสอบว่า GitHub ส่งข้อมูลอะไรกลับเซิร์ฟเวอร์บ้าง

By lew Founder on Tag: GitHub, GitHub Copilot, LLM
GitHub

GitHub Copilot เพิ่มฟีเจอร์ทำงานอัตโนมัติเต็มรูปแบบเหมือนนักพัฒนาในทีมอีกคน โดยกระบวนการทำงานจะเริ่มเมื่อมีคนรายงานปัญหา ตัว Coding Agent จะสร้างพื้นที่พัฒนาแล้วพยายามแก้ไขปัญหาจนเสร็จแล้วค่อยส่งงานเป็น pull request ให้มนุษย์ตรวจสอบขั้นสุดท้ายทีเดียว

ทาง GitHub ระบุว่า Coding Agent แก้ปัญหาความซับซ้อนต่ำจนถึงปานกลางได้เป็นอย่างดีโดยเฉพาะโครงการที่มีชุดทดสอบอย่างดีแล้ว เมื่อแพตช์เสร็จแล้ว นักพัฒนายังสามารถรีวิวโค้ดเพิ่มเติมได้ ตัว Coding Agent ก็จะนำความเห็นกลับไปแก้ไขจนกว่าจะได้ผลลัพธ์ตามคำสั่ง

By mk Founder on Tag: Windsurf, Programming, LLM, Software Engineering
Windsurf

Windsurf หรือชื่อเดิม Codeium สตาร์ตอัพผู้พัฒนา IDE เขียนโค้ดพลัง AI ที่กำลังมีข่าวว่าจะโดน OpenAI ซื้อ เปิดตัวโมเดลเขียนโค้ดเวอร์ชันแรกของตัวเองชื่อ SWE-1

SWE-1 เป็นชุดของโมเดลที่เทรนมาสำหรับ "กระบวนการวิศวกรรมซอฟต์แวร์ทั้งหมด" (the entire software engineering process) ไม่ได้แค่สร้างโค้ดอย่างเดียว

By lew Founder on Tag: Google Cloud, LLM, SQL, Database
Google Cloud

Google Cloud โชว์ฟีเจอร์ text-to-SQL ใน BigQuery Studio และ Cloud SQL Studio ที่มีตัวช่วยเขียน SQL โดยเปิดให้ผู้ใช้ถามคำถามภาษาธรรมชาติ

แม้ว่าโดยทั่ว LLM จะเขียน SQL ได้อยู่แล้ว แต่เมื่อใช้งานกับฐานข้อมูลจริงที่มีความซับซ้อนสูง และคำถามจริงของผู้ใช้ที่มักไม่ได้บอกข้อมูลครบนักก็จะเจอข้อจำกัด เช่น ผู้ใช้ถามว่าต้องการรองเท้าที่ขายดีที่สุด แต่ใน schema ของฐานข้อมูลไม่มีอะไรบอกว่าจะหารองเท้าอย่างไร หรือคำว่าขายดีที่สุดแปลว่าจำนวนที่ขายหรือยอดเงินที่ขายได้ ตลอดจนบางครั้ง LLM ก็สับสนถึงความต่างของ SQL แบรนด์ต่างๆ

By arjin Writer on Tag: Meta AI, Llama, Meta, Rumors, LLM, Artificial Intelligence
Meta AI

The Wall Street Journal อ้างแหล่งข่าวที่เกี่ยวข้องเผยว่า Meta ได้เลื่อนกำหนดเผยแพร่โมเดลปัญญาประดิษฐ์ภาษาขนาดใหญ่ Behemoth ออกไปอีก เนื่องจากมีความกังวลเรื่องความสามารถที่ยังไม่ดีมากพอ

Meta เปิดตัว Llama 4 เมื่อเดือนเมษายน โดยเผยแพร่สองรุ่นย่อยคือ Scout ขนาดพารามิเตอร์ 109B และ Maverick ขนาดพารามิเตอร์รวม 400B บอกว่าทั้งสองรุ่นนี้เป็นการดึงความสามารถบางส่วนออกมาจากโมเดลตัวใหญ่ที่สุด Behemoth ขนาดพารามิเตอร์ 2T ซึ่งไม่ได้เปิดตัวพร้อมกัน

By mk Founder on Tag: ChatGPT, OpenAI, LLM
ChatGPT

OpenAI ปล่อยโมเดล GPT-4.1 ที่เปิดตัวช่วงกลางเดือนเมษายน ให้กับผู้ใช้ ChatGPT แพ็กเกจเสียเงิน (Plus, Pro, Team) ใช้งาน หลังจากที่ช่วงแรกเปิดใช้เฉพาะผ่าน API อย่างเดียว การใช้งานผ่าน ChatGPT จำเป็นต้องเลือกโมเดลเองผ่านเมนู more models โดย GPT-4.1 มีเรตลิมิตเท่ากับ GPT-4o

นอกจากนี้ OpenAI ยังนำโมเดลรุ่นเล็ก GPT-4.1 mini มาใช้แทน GPT-4o mini ให้กับผู้ใช้ ChatGPT ทุกคน (รวมแพ็กเกจฟรีด้วย)

By lew Founder on Tag: DeepMind, Google, LLM
DeepMind

DeepMind เปิดตัวปัญญาประดิษฐ์ AlphaEvolve ชุดปัญญาประดิษฐ์แบบ agentic ที่ช่วยออกแบบฟังก์ชั่นต่างๆ เพื่อปรับปรุงประสิทธิภาพการทำงานของทีมงานกูเกิลเอง โดยใช้เข้าไปปร้บปรุงตั้งแต่ระดับชิป, ซอฟต์แวร์, และระบบการจัดการคลัสเตอร์

By lew Founder on Tag: Apple, LLM
Apple

แอปเปิลปล่อยโมเดลปัญญาประดิษฐ์ FastVLM ประกอบไปด้วยโมเดล 6 รุ่นย่อย โดยความสามารถพิิเศษคือความเร็วในการรันสูงขึ้นมากเพราะสถาปัตยกรรม FastViHD ที่เป็น encoder ของปัญญาประดิษฐ์อ่านภาพ มีความเร็วในการอ่านภาพดีกว่าสถาปัตยกรรมอื่นๆ มากโดยเฉพาะในภาพขนาดใหญ่

ตัวโมเดลที่ปล่อยออกมาพัฒนาจากโมเดลที่มีอยู่แล้วในตลาด เช่น LLaVA-OneVision เมื่อแปลงเป็น FastVLM แล้วระยะเวลาเริ่มตอบคำตอบแรก (time-to-first-token - TTFT) เร็วขึ้น 85 เท่าตัว ละอัตราการอ่านภาพรวมเร็วขึ้น 3.4 เท่าตัว หรือโมเดลขนาด 7B พัฒนาจาก Qwen2-7B ก็มีระยะเวลาเริ่มตอบเร็วขึ้น 7.9 เท่าตัว

Subscribe to LLM