Image

Large Language Model

By lew Founder on Tag: Intel Arc, Intel, LLM, GPU
Intel Arc

อินเทลเปิดตัวชิปกราฟิก Intel Arc Pro B70 และ B65 ชิปกราฟิกสำหรับงาน AI เป็นหลัก เพราะมีแรมขนาดใหญ่

Intel Arc Pro B70 มีพลังประมวลผล 22.94 TFLOPS ที่ FP32 และ 367 TOPS ที่ INT8 มาพร้อมแรม GDDR6 ขนาด 32GB แบบ ECC มีแบนวิดท์แรม 608 GB/s กินพลังงานสูงสุด 230 วัตต์

Intel Arc Pro B65 ลดหน่วยประมวลผลกราฟิกลง ทำให้พลังประมวลผลเหลือเพียง 12.28 TFLOPS ที่ FP32 และ 197 TOPS ที่ INT8 แต่รองรับแรม 32GB เท่าๆ กับ B70 และกินพลังงานสูงสุด 200 วัตต์

By lew Founder on Tag: Security, LLM
Security

LiteLLM แจ้งเตือนผู้ใช้ว่ามีคนร้ายเจาะบัญชี PyPI ได้สำเร็จ และอัปโหลดเวอร์ชัน 1.82.7 และ 1.82.8 เมื่อวันที่ 24 มีนาคมที่ผ่านมา โดยทั้งสองเวอร์ชันฝังโค้ดที่ใช้ขโมย API key ขององค์กรออกไป ระยะเวลาที่คนร้ายสามารถวางเวอร์ชันมุ่งร้ายจนมีการตรวจพบและลบออกไปรวมประมาณ 3 ชั่วโมง

LiteLLM เป็น AI API Gateway ที่ได้รับความนิยมสูง หลายองค์กรอาศัยมันเป็นตัวจัดการการใช้งานในองค์กร โดยนำกุญแจกลางขององค์กรมาวางไว้ที่ gateway แล้วให้แอปพลิเคชันต่างๆ ภายในใช้กุญแจของ LiteLLM อีกที ทำให้จัดการงบประมาณได้ง่ายขึ้น รวมถึงสามารถใช้ API กลางแม้จะมีผู้ให้บริการ AI หลายเจ้าก็ตาม

By arjin Writer on Tag: Sora, OpenAI, Artificial Intelligence, LLM
Sora

OpenAI ประกาศเตรียมปิดบริการแอปสร้างวิดีโอด้วย AI Sora โดยตอนนี้ยังไม่เปิดเผยรายละเอียดเพิ่มเติมว่าแอปจะปิดตัวเมื่อใด และโมเดลสร้างวิดีโอด้วย AI จะใช้งานต่อได้ในช่องทางใด OpenAI บอกเพียงรายละเอียดอื่นจะตามมาในภายหลัง

Sora เป็นโมเดลสร้างวิดีโอสั้นด้วย AI ที่ OpenAI เปิดให้คนใช้งานได้มากขึ้นผ่านการออกแอปสมาร์ทโฟน Sora โดยเฉพาะ ซึ่งหากนับอายุแล้วแอปก็ออกมาเพียง 6 เดือนเท่านั้น

By lew Founder on Tag: Cloudflare, LLM, Moonshot AI
Cloudflare

Cloudflare ปรับบริการ Workers AI จากเดิมให้บริการ LLM เฉพาะโมเดลขนาดเล็กถึงขนาดกลาง เช่น GPT-OSS 120B หรือ Nemotron 3 120B มาเป็นการให้บริการโมเดลขนาดใหญ่ด้วย ตัวแรกที่ให้บริการคือ Kimi K2.5 ที่มีขนาดถึง 1.1 ล้านล้านพารามิเตอร์

ทาง Cloudflare ระบุว่าภายในเองก็มีระบบรีวิวโค้ดต่อเนื่อง โดยต้องประมวลผลถึงวันละ 7 พันล้านโทเค็น หากใช้โมเดลชั้นนำก็จะมีค่าใช้จ่ายปีละ 2.4 ล้านดอลลาร์ แต่หากใช้ Kimi K2 จะถูกลง 77% การให้บริการ Kimi K2.5 โดยอาศัยเอนจิน Infire ที่พัฒนาขึ้นเองและเน้นประสิทธิภาพการให้บริการให้คุ้มค่าชิปกราฟิก

By arjin Writer on Tag: OpenAI, ChatGPT, LLM, Artificial Intelligence
OpenAI

OpenAI ออกโมเดลรุ่นเล็กตัวใหม่ GPT‑5.4 mini และ nano ระบุว่านำความสามารถเด่นจาก GPT-5.4 มาใส่ในโมเดลขนาดเล็กนี้ซึ่งมีจุดเด่นคือการทำงานที่รวดเร็ว

GPT‑5.4 mini มีความสามารถหลายด้านที่เหนือกว่า GPT-5 มาก เช่น การเขียนโค้ด การให้เหตุผล การทำความเข้าใจข้อมูลผสมผสานรูปแบบ ตอบสนองได้เร็วกว่า 2 เท่า ผลทดสอบในบางหัวข้อเช่น SWE-Bench Pro หรือ OSWorld-Verified มีคะแนนที่ใกล้เคียงกับโมเดลหลัก GPT-5.4 จึงเหมาะกับการใช้งานที่เน้นการตอบสนองรวดเร็ว เช่น ผู้ช่วยเขียนโค้ดที่ต้องการให้ผู้ใช้งานรู้สึกถึงการตอบโต้ตลอดเวลา, ระบบแนะนำเนื้อหาแบบเรียลไทม์ และอื่น ๆ ส่วน GPT-5.4 nano เหมาะสำหรับ AI ผู้ช่วยที่ทำงานย่อยต่าง ๆ ซึ่งต้องการความรวดเร็ว ใช้เวลาน้อย และมีต้นทุนประมวลผลต่ำ

By lew Founder on Tag: NVIDIA, LLM, Open Source, Nemotron
NVIDIA

NVIDIA เปิดตัวโมเดลปัญญาประดิษฐ์แบบโอเพนซอร์สเพิ่มในงาน GTC 2026 จากก่อนหน้านี้เปิดตัว Nemotron 3 Super มาก่อนแล้ว โดยโมเดลรุ่นใหม่ขยายแนวทางการใช้งานของ Nemotron มากขึ้น

รายการโมเดลที่ปล่อยในงานครั้งนี้ได้แก่

By lew Founder on Tag: NVIDIA Rubin, NVIDIA, Groq, LLM, NVIDIA Vera
NVIDIA Rubin

NVIDIA เปิดตัวแพลตฟอร์ม NVIDIA Vera Rubin ครบชุด โดยตอนนี้อยู่ในสายการผลิตเต็มสูบเตรียมส่งมอบให้ลูกค้าแล้ว ในชุดแพลตฟอร์มประกอบด้วย NVIDIA Vera CPU, NVIDIA Rubin GPU, NVIDIA NVLink 6, NVIDIA ConnectX-8, NVIDIA BlueField-4 DPU, NVIDIA Spectrum-6 Ethernet, และ NVIDIA Groq 3 LPU

ในชุดนี้ที่เด่นที่สุดคือ Groq 3 ที่บริษัททำข้อตกลงซื้อตัวผู้ก่อตั้งมาทำงานด้วยตั้งแต่ปลายปี 2025 ในชุดเป็นชิป LP30

By arjin Writer on Tag: Meta, Rumors, Meta AI, Llama, LLM, Gemini
Meta

เมื่อปลายปีที่แล้วมีข่าวเกี่ยวกับแผนการออกโมเดล AI ตัวใหม่ Avocaco ของ Meta ที่จะมาแทนที่ Llama และอาจเป็นโมเดลแบบปิด เป้าหมายเพื่อให้แข่งขันกับโมเดลค่ายคู่แข่งทัน ในตอนนั้นรายงานบอกว่าโมเดล Avocaco นี้จะออกมาภายในไตรมาสที่ 1 ปี 2026

The New York Times อ้างแหล่งข่าวภายใน Meta สามราย บอกว่าแผนการเปิดตัวโมเดล Avocaco นี้ อาจต้องเลื่อนออกไปอีกอย่างน้อยเดือนพฤษภาคม หลังจากผลทดสอบความสามารถแล้วยังไม่เป็นที่พอใจ

By lew Founder on Tag: NVIDIA, LLM, Nemotron
NVIDIA

NVIDIA เปิดตัวโมเดลปัญญาประดิษฐ์แบบเปิดในตระกูล Nemotron รุ่นใหม่ ในชื่อ Nemotron 3 Super เป็นโมเดลแบบ 120B-A12B ที่ออกแบบมาเพื่อประสิทธิภาพการรันที่ความเร็วสูงโดยเฉพาะเมื่อใช้ชิป Blackwell เหมาะกับการใช้งานภายในองค์กร

แม้จะเป็นโมเดลขนาดใหญ่พอๆ กับ GPT-OSS-120B และ Qwen3.5-122B-A10B แต่จุดเด่นของ Nemotron 3 Super คือการออกแบบให้รองรับเทคนิคให้ต้นทุนการรันต่ำลง ได้แก่

By arjin Writer on Tag: Amazon, LLM, Rumors, Developer, Generative AI
Amazon

CNBC อ้างเอกสารการประชุมภายใน Amazon ซึ่งเป็นการพูดคุยลงรายละเอียดเกี่ยวกับปัญหาเว็บไซต์ล่ม หรือบริการบางอย่างใช้งานไม่ได้ ซึ่งเกิดขึ้นบ่อยมากขึ้นนับตั้งแต่ไตรมาส 3 ปีที่แล้ว ซึ่ง CNBC ให้ความสนใจว่าเนื้อหาส่วนหนึ่งในการประชุมบอกว่าการใช้ GenAI เขียนโค้ด เป็นสาเหตุหนึ่งของปัญหาที่เกิดขึ้น ทำให้บริษัทบอกว่ากระบวนการตรวจสอบก่อนดีพลอยโค้ดจะต้องทำอย่างรัดกุมมากยิ่งขึ้น

OpenAI

OpenAI ประกาศซื้อกิจการ Promptfoo สตาร์ทอัปด้านความปลอดภัย AI ที่พัฒนาเครื่องมือสำหรับค้นหาช่องโหว่ความปลอดภัยใน LLM โดยไม่ได้เปิดเผยมูลค่าในการซื้อ

Promptfoo ก่อตั้งโดย Ian Webster และ Michael D’Angelo มีลูกค้าที่ใช้งานเครื่องมือนี้เป็นบริษัทระดับ Fortune 500 มากกว่า 25% รวมถึงถูกนำไปใช้ในโครงการโอเพนซอร์สเพื่อประเมินทดสอบหาช่องโหว่ด้วย

By lew Founder on Tag: Open Source, LLM, Programming, Artificial Intelligence
Open Source

Mark Pilgrim ผู้สร้างโครงการ chardet ไลบรารีสำหรับตรวจ encoding ของสตริง แสดงความไม่พอใจที่ทีมงานผู้ดูแลโครงการปัจจุบันเปลี่ยนไลเซนส์โครงการในเวอร์ชั่น 7.0.0 เป็น MIT จากเดิมที่โครงการโอเพนซอร์สแบบ LGPL มาตลอด โดยทีมงานผู้ดูแลปัจจุบันอ้างว่าทำได้ เพราะเขียนโครงการขึ้นใหม่ทั้งหมดด้วย AI

By mk Founder on Tag: ChatGPT, OpenAI, LLM
ChatGPT

OpenAI เปิดตัวโมเดลสายหลัก GPT-5.4 และ GPT-5.4 Pro ถือเป็นการข้ามจาก เวอร์ชัน 5.2 มาเป็นเวอร์ชัน 5.4 เลย (5.3 มีเฉพาะ Codex กับ Instant)

By lew Founder on Tag: Qwen, Alibaba Cloud, LLM, Person
Qwen

Junyang Lin หัวหน้าทีมฝ่ายเทคนิค (Tech Lead) ของทีม Qwen ประกาศลาออกหลังจากทำงานวิจัยกับ Alibaba มานาน 7 ปีนับแต่ปี 2019 โดยไม่บอกเหตุผลชัดเจน แต่ทีมวิจัยของ Qwen หลายคนก็ประกาศลาออกในเวลาลไล่เลี่ยกัน

By arjin Writer on Tag: OpenAI, ChatGPT, LLM, Artificial Intelligence
OpenAI

OpenAI อัปเดตโมเดล AI พื้นฐานสำหรับใช้งานทั่วไป GPT-5.3 Instant ซึ่งเป็นรุ่นต่อจาก GPT-5.2 Instant โดยการปรับปรุงที่สำคัญคือให้คำตอบในบทสนทนาที่ดีขึ้น

OpenAI บอกว่าผู้ใช้งาน GPT-5.2 Instant ให้ความเห็นว่าหลายครั้งโมเดลเดิมนั้นชอบทำตัวแปลก ๆ บางครั้งก็ปฏิเสธที่จะตอบคำถามที่สามารถตอบได้ไม่ต้องระมัดระวัง แต่กลับระมัดระวัง ในรุ่นปรับปรุงนี้จึงแก้ไขให้ตอบคำถามที่ควรตอบแบบตรงไปตรงมาขึ้น นอกจากนี้รูปแบบการตอบจะเป็นบทสนทนาที่ดูเป็นธรรมชาติขึ้น

By arjin Writer on Tag: Gemini, LLM, Google
Gemini

กูเกิลออกโมเดลใหม่ Gemini 3.1 Flash-Lite เน้นการทำงานรวดเร็ว ใช้โทเค็นน้อย แต่ให้ผลลัพธ์ประสิทธิภาพดี สำหรับนักพัฒนาที่ต้องการใช้กับเวิร์กโหลดที่มีจำนวนคำสั่งสูง ต้องการผลลัพธ์ทันที

Gemini 3.1 Flash-Lite ทำงานตอบสนองเร็วกว่า 2.5 Flash ถึง 2.5 เท่า และอัตราเอาท์พุทรวมเร็วขึ้น 45% คะแนนทดสอบเทียบกับโมเดลประเภทเดียวกันอย่าง GPQA Diamond หรือ MMMU Pro ก็ทำได้สูงกว่า GPT-5 mini, Claude 4.5 Haiku, Grok 4.1 Fast หรือแม้แต่โมเดลขนาดใหญ่กว่ารุ่นก่อนหน้าอย่าง Gemini 2.5 Flash

By arjin Writer on Tag: Nano Banana, Gemini, Google, LLM, Artificial Intelligence
Nano Banana

กูเกิลออกอัปเดตเครื่องมือ AI สร้างรูปภาพ Nano Banana 2 ซึ่งเพิ่มความสามารถในขั้นสูงระดับมืออาชีพ ขณะเดียวกันก็ทำงานได้รวดเร็วมากขึ้น

Nano Banana 2 มีชื่อทางการคือ Gemini 3.1 Flash Image ซึ่งรวมความสามารถการสร้างรูปภาพที่ซับซ้อนมีรายละเอียดมาก จากโมเดล Nano Banana Pro เข้ามา

By lew Founder on Tag: Semiconductor, LLM, Llama, Processor
Semiconductor

TAALAS บริษัทออกแบบชิปจากแคนาดา สาธิตชิป Taalas HC1 ที่ฝังโมเดลปัญญาประดิษฐ์ Llama 3.1 8B ลงไปในชิปตรงๆ ไม่สามารถแก้ไขได้อีก แต่ให้ความเร็วในการรันสูงถึง 16,960 token/s อยู่ในระดับที่เห็นผลลัพธ์ทันที

โมเดลที่รันไม่ใช่โมเดลเต็ม แต่เป็นรุ่นย่อ 3-bit ทำให้คุณภาพไม่เท่ากับ Llama 3.1 8B ที่ใช้งานกัน แต่ตัวชิปรองรับการรัน LoRA adapter ด้วย ทำให้สามารถปรับแต่งงานเฉพาะทางได้บางส่วนในอนาคต แม้จะแก้ไขโมเดลหลักไม่ได้ก็ตามที โดยรวมชิปมีทรานซิสเตอร์ทั้งหมด 53,000 ล้านตัว กินไฟ 2.5kW

By lew Founder on Tag: Gemini, Google, LLM
Gemini

note: ประกาศทางการออกมาแล้ว

กูเกิลเริ่มปล่อย Gemini 3.1 Pro ให้ใช้งานใน Google AI Studio และ Vertex AI แม้ตอนนี้จะยังไม่มีประกาศเป็นทางการออกมา

ข้อมูลตอนนี้กูเกิลระบุเพียงว่า Gemini 3.1 Pro เป็นโมเดลที่ดีที่สุด (state of the art - SOTA) และทำความเข้าใจคำสั่งได้เป็นอย่างดี รวมถึงมีความสามารถเขียนโปรแกรมระดับสูง

By arjin Writer on Tag: Claude, Anthropic, LLM, Artificial Intelligence
Claude

Anthropic ออกโมเดลปัญญาประดิษฐ์ขนาดกลางรุ่นใหม่ Claude Sonnet 4.6 ถัดจากเวอร์ชัน 4.5 ที่ออกมาเมื่อเดือนกันยายน โดยมีจุดเด่นคือรองรับขนาด context 1M โทเค็น เพิ่มความสามารถรอบด้านทั้งการเขียนโค้ด การใช้งานคอมพิวเตอร์ การให้เหตุผลจากอินพุทที่มีความยาวมาก การวางแผนผู้ช่วย ความรู้ และการออกแบบ

ความสามารถการเขียนโค้ดซึ่งเป็นจุดขายของโมเดล Claude อยู่แล้ว Anthropic บอกว่าใน Sonnet 4.6 ได้ปรับปรุงให้ทำงานในสม่ำเสมอ ทำตามคำสั่งดีขึ้น ยกประสิทธิภาพที่เดิมมีในโมเดลขั้นสูง Claude Opus 4.5 มาใส่ไว้ในนี้

Subscribe to LLM