Image

Large Language Model

By mk Founder on Tag: Nova, Amazon, LLM, Speech Recognition, Speech Synthesis
Nova

Amazon ยังเดินหน้าเปิดตัวโมเดลตระกูล Nova อย่างต่อเนื่อง ถัดจาก Nova Reel โมเดลสร้างวิดีโอ ตามมาด้วย Nova Sonic โมเดลสร้างคำตอบเสียง ที่เป็นโมเดลตัวเดียวทำงานทั้งการเข้าใจเสียงพูด (speech understanding) และสร้างเสียงพูด (speech generation) ไม่ต้องแยกสองโมเดลทำงานอีกต่อไป

ความน่าสนใจของ Nova Sonic คือเป็นโมเดลแบบเสียง-เสียง (speech-to-speech) รับอินพุตเป็นเสียงพูด แล้วสร้างเอาต์พุตเป็นข้อความหรือเป็นเสียงก็ได้ สามารถทำงานแบบเรียลไทม์

By mk Founder on Tag: Nova, Amazon, Artificial Intelligence, LLM
Nova

หลัง Amazon เปิดตัวโมเดลตระกูล Nova ของตัวเองช่วงปลายปี 2024 ก็เริ่มทยอยปล่อยของอย่างต่อเนื่อง ก่อนหน้านี้มี Nova Act โมเดลที่ควบคุมเว็บเบราว์เซอร์ ล่าสุดเปิดตัว Nova Reel ปัญญาประดิษฐ์สร้างวิดีโอสั้นเวอร์ชันใหม่ 1.1

By lew Founder on Tag: Shopify, LLM, Artificial Intelligence, Employment
Shopify

Tobi Lütke ซีอีโอ Shopify ออกจดหมายเวียนในบริษัท ปรับนโยบายการทำงานในอนาคต โดยระบุนโยบาย 6 ข้อ ได้แก่

Microsoft

ไมโครซอฟท์ร่วมมือกับ Meta เปิดให้องค์กรธุรกิจใช้งาน Llama 4 Maverick และ Scout ใน Azure AI Foundry และ Azure Databricks แล้ว

Llama 4 เป็นโมเดล AI โอเพนซอร์สรุ่นใหม่สำหรับการใช้งานแบบ Multimodal ซึ่ง Meta เพิ่งประกาศเปิดตัววันนี้

By arjin Writer on Tag: Llama, Meta AI, Meta, LLM, Artificial Intelligence
Llama

Meta ออกโมเดลปัญญาประดิษฐ์ภาษาขนาดใหญ่ (LLM) รุ่นใหม่ Llama 4 ซึ่ง Mark Zuckerberg ซีอีโอ Meta บอกว่าเป็นโมเดล AI พื้นฐานที่มีประสิทธิภาพสูงที่สุดในโลกตอนนี้

Llama 4 มีสองรุ่นย่อย ได้แก่ Llama 4 Scout ขนาดพารามิเตอร์ 17B, 16 โมเดลย่อย (Experts) รวม 109B ซึ่ง Meta บอกว่าเป็นโมเดลผสมผสานที่มีประสิทธิภาพดีที่สุดในโลกตอนนี้ สามารถรันได้บนจีพียู NVIDIA H100 ตัวเดียว รองรับอินพุท 10M ทำงานได้ดีกว่าโมเดลที่คล้ายกันอย่าง Gemma 3, Gemini 2.0 Flash-Lite และ Mistral 3.1

By mk Founder on Tag: Gemini, LLM, Google
Gemini

กูเกิลเปิดตัว Gemini 2.5 Pro โมเดลพลังสูง ประสิทธิภาพเป็นเยี่ยม เมื่อปลายเดือนมีนาคม จากนั้นมีแหวกขนบเดิมๆ เล็กน้อย ด้วยการเปิดให้ผู้ใช้ Gemini ทุกคนใช้ฟรี โดยไม่ต้องรอกันนาน

ล่าสุดกูเกิลนำโมเดล Gemini 2.5 Pro เปิดให้เช่าใช้งานใน Google AI Studio โดยประกาศราคามาแล้ว ราคาเริ่มต้นคือ อินพุต 1.25 ดอลลาร์ต่อ 1 ล้านโทเคน และเอาท์พุต 10 ดอลลาร์ต่อ 1 ล้านโทเคน

By arjin Writer on Tag: OpenAI, Artificial Intelligence, LLM
OpenAI

Sam Altman ซีอีโอ OpenAI ประกาศว่าบริษัทเปลี่ยนแผนการออกโมเดลรุ่นใหม่ โดยจะกลับมาออกโมเดลคิดเป็นเหตุผล o3 และ o4-mini โมเดลคิดเป็นเหตุผลขนาดเล็กเวอร์ชันใหม่ ทั้งสองโมเดลนี้จะออกมาในอีกไม่กี่สัปดาห์ข้างหน้า

By arjin Writer on Tag: Midjourney, LLM, Artificial Intelligence
Midjourney

Midjourney ออกโมเดลปัญญาประดิษฐ์สร้างรูปภาพเวอร์ชันใหม่ V7 หลังจากไม่มีโมเดลเวอร์ชันใหม่ออกมาเกือบหนึ่งปี โดยสถานะการออกมาให้ใช้งานตอนนี้เป็น alpha-test และจะทยอยปรับปรุงความสามารถทุกสัปดาห์เป็นเวลา 2 เดือน

Midjourney บอกว่า V7 เป็นโมเดลสร้างรูปภาพที่ฉลาดที่สุด สร้างรูปได้สวยงามและแม่นยำที่สุดที่เคยทำออกมา David Holz ซีอีโอ Midjourney บอกว่า V7 มีการเปลี่ยนแปลงสถาปัตยกรรมการทำงานของโมเดลใหม่ทั้งหมด

By lew Founder on Tag: Alibaba Cloud, LLM, Qwen
Alibaba Cloud

ทีม Qwen ของ Alibaba Cloud เปิดตัวโมเดลปัญญาประดิษฐ์เพิ่มสองรุ่น คือ Qwen2.5 Omni โมเดลแบบ multimodal อ่านภาพ, ฟังเสียง, และดูวิดีโอได้ พร้อมกับสามารถตอบเป็นเสียงหรือข้อความได้ อีกโมเดลคือ QVQ-Max โมเดลคิดก่อนตอบแบบอ่านภาพได้ ทำให้สามารถอ่านเอกสารซับซ้อนสูงได้

Qwen2.5 Omni เป็นโมเดล multimodal ที่รับได้ทั้งข้อความ, เสียง, และภาพ โดยภายในมันสามารถดูภาพตามเวลา (time aligned multimodal) ทำให้เข้าใจวิดีโอได้ด้วย ขณะที่ฝั่งเอาท์พุตนั้นสามารถสร้างเสียงตอบกลับได้ ตัวสถาปัตยกรรมรองรับการ "ฟังไป ตอบไป" โดยสามารถรับอินพุตยังไม่จบแต่ตอบไปก่อนได้

By lew Founder on Tag: LLM, Artificial Intelligence, Alan Turing, OpenAI
LLM

ทีมวิจัยจาก UC San Diego อัพเดตรายงานทดสอบ Turing Test แบบจำกัดเวลา เพื่อทดสอบว่าปัญญาประดิษฐ์จะสามารถหลอกว่าเป็นมนุษย์ได้หรือไม่ จากเดิมที่เคยทดสอบตั้งแต่ปี 2023 และรอบนี้พบว่า GPT-4.5 เอาชนะมนุษย์ได้อย่างชัดเจน

กระบวนการทดสอบใช้จะให้ผู้ทดสอบคุยแชตกับ AI และมนุษย์ไปพร้อมกัน โดยสามารถคุยได้เพียง 8 ข้อความและจำกัดเวลา และเมื่อจบเวลา 5 นาทีก็ต้องเลือกว่าหน้าจอไหนเป็นมนุษย์หรือ AI โดยเมื่อปี 2023 นั้น GPT-4 ทำคะแนนได้สูงสุด 41% รอบนี้พบว่า GPT-4.5 สามารถทำคะแนนได้ถึง 73% สูงกว่ามนุษย์จริงๆ อย่างมีนัยสำคัญ

By arjin Writer on Tag: OpenAI, Artificial Intelligence, LLM, ChatGPT
OpenAI

Sam Altman ซีอีโอ OpenAI ประกาศว่าเครื่องมือสร้างรูปภาพตัวใหม่ Image Generation บน ChatGPT ตอนนี้เปิดให้ผู้ใช้งานทุกคนสามารถใช้ได้แล้วรวมทั้งแบบฟรี หลังจากเปิดตัวไปเมื่อสัปดาห์ที่แล้ว โดยจำกัดให้เฉพาะลูกค้า ChatGPT แบบเสียเงิน

Altman ไม่ได้บอกว่าผู้ใช้งาน ChatGPT แบบฟรีจะถูกจำกัดการใช้งานเท่าใด แต่ก่อนหน้านี้เขาบอกตัวเลขว่า 3 รูปต่อวัน เนื่องจากผลตอบรับที่ดีมากเป็นกระแสจนจีพียูที่มีไม่พอใช้งาน

By mk Founder on Tag: Amazon, LLM, Artificial Intelligence, Nova
Amazon

Amazon เปิดตัวโมเดลภาษาขนาดใหญ่ของตัวเองชื่อ Nova ในเดือนพฤศจิกายน 2024 หลังจากนั้นเริ่มนำมาใช้ในผลิตภัณฑ์คอนซูเมอร์อย่าง Alexa+ บ้างแล้ว

ล่าสุด Amazon เปิดตัว Amazon Nova Act โมเดลย่อยในตระกูล Nova ที่เทรนมาเพื่องานควบคุมการท่องเว็บผ่านเบราว์เซอร์โดยเฉพาะ เปิดทางให้เกิดงานสาย Agentic AI ที่นำ Nova Act ไปควบคุมหน้าเว็บต่างๆ ได้ง่ายผ่าน Nova Act SDK ที่เปิดให้นักพัฒนาภายนอกเข้ามาเชื่อมต่อ

By arjin Writer on Tag: OpenAI, Artificial Intelligence, LLM, Sam Altman
OpenAI

Sam Altman ซีอีโอ OpenAI ประกาศว่าบริษัทมีแผนเตรียมออกโมเดล AI แบบ Open-Weight ตัวใหม่ นับตั้งแต่ GPT-2 โดยเปิดรับฟังความคิดเห็นจากนักพัฒนา นักวิจัย และชุมชนที่เกี่ยวข้อง ว่าต้องการให้โมเดล AI ที่ปรับค่า Weight ได้นี้ สามารถปรับส่วนใดได้บ้าง รวมทั้งเตรียมจัดงานสัมมนาแบบ In-Person ในหลายภูมิภาคเพื่อรับฟังความเห็นด้วย

ตั้งแต่กระแสปัญญาประดิษฐ์มีมากขึ้น OpenAI ซึ่งเป็นหนึ่งในผู้จุดกระแส ได้ปรับแนวทางไม่เผยแพร่รายละเอียดการทำงานของโมเดล AI ตั้งแต่ GPT-4 ด้วยเหตุผลของการแข่งขันและป้องกันการนำ AI ไปใช้ในทางที่ไม่ปลอดภัย อย่างไรก็ตามจากกระแสของ DeepSeek เมื่อต้นปี ซึ่งเป็นโมเดลแบบโอเพนซอร์ส รวมกับแนวทางของ Meta ที่โอเพนซอร์ส Llama ตั้งแต่เริ่มต้น ทำให้ Altman เคยยอมรับว่าตัดสินใจผิด และต้องการทบทวนกลยุทธ์นี้ อย่างไรก็ตามแนวทางของ Open-Weight จะไม่เปิดเผยข้อมูลทั้งหมดของโมเดล เช่น ข้อมูลที่ใช้ฝึกฝน เป็นต้น

By lew Founder on Tag: Google, LLM, MCP, Artificial Intelligence, Sundar Pichai
Google

Sundar Pichai ซีอีโอกูเกิลถามชุมชนว่าควรรองรับ MCP หรือไม่ หลังจากมาตรฐาน MCP ถูกเสนอโดย Anthropic และ OpenAI ก็ประกาศรองรับแล้ว ทำให้กูเกิลเป็นผู้พัฒนาปัญญาประดิษฐ์ LLM รายใหญ่รายเดียวที่ยังไม่รองรับ

เสียงตอบรับของคนส่วนใหญ่ก็ระบุว่าต้องการให้กูเกิลรองรับ MCP กัน ซึ่งก็คาดเดาได้เพราะคนจำนวนมากไม่ต้องการพัฒนาเครื่องมือแยกสำหรับกูเกิลอีกชุด

By arjin Writer on Tag: Gemini, Google, LLM
Gemini

กูเกิลประกาศว่าผู้ใช้งานแบบฟรี สามารถใช้งาน Gemini 2.5 Pro (experimental) โมเดลปัญญาประดิษฐ์ความสามารถสูงที่เพิ่งเปิดตัวไม่กี่วันก่อนได้แล้ว โดยเวอร์ชันนี้เป็น experimental นั่นคือฟีเจอร์บางอย่างอาจไม่สามารถใช้งานได้

ในตอนแรกกูเกิลจำกัด Gemini 2.5 Pro ให้เฉพาะลูกค้า Gemini Advanced แต่ในเวลาไม่กี่วันกูเกิลก็บอกว่าเพื่อให้คนเข้าถึงโมเดลนี้มากที่สุด ลูกค้าฟรีก็ได้ใช้งานไปด้วยเลย

By arjin Writer on Tag: ChatGPT, OpenAI, LLM, Artificial Intelligence, Sam Altman
ChatGPT

Sam Altman ซีอีโอ OpenAI เปิดเผยว่ากระแสที่มาแรงมาของเครื่องมือสร้างรูปภาพตัวใหม่ Image Generation บน ChatGPT ทำให้ตอนนี้จีพียูที่มีอยู่ไม่พอแล้ว (GPUs are melting) จึงทำให้ OpenAI ต้องหาทางแก้ไขปัญหานี้

By arjin Writer on Tag: OpenAI, Anthropic, LLM, Standard, MCP
OpenAI

Sam Altman ซีอีโอ OpenAI กล่าวว่าบริษัทจะสนับสนุน Model Context Protocol (MCP) โปรโตคอลมาตรฐานสำหรับการดึงข้อมูลและส่งข้อมูลจากแหล่งต่าง ๆ กับโมเดลปัญญาประดิษฐ์สำหรับองค์กร ซึ่งเป็นมาตรฐานที่บริษัทคู่แข่ง Anthropic นำเสนอเมื่อปลายปีที่แล้ว โดย MCP จะรองรับในทุกผลิตภัณฑ์ของ OpenAI

MCP มีให้ใช้งานแล้วผ่าน SDK สำหรับนักพัฒนา AI Agent ตั้งแต่วันนี้เป็นต้นไป ส่วนแอป ChatGPT บนเดสก์ท็อปและ Responses API จะรองรับเร็ว ๆ นี้

By arjin Writer on Tag: Databricks, Anthropic, Artificial Intelligence, LLM, Enterprise
Databricks

Databricks ประกาศความร่วมมือกับ Anthropic เป็นระยะเวลา 5 ปี เพื่อนำโมเดลปัญญาประดิษฐ์ของ Anthropic ให้บริการบนแพลตฟอร์ม Data Intelligence Platform ทำให้ลูกค้าองค์กรมากกว่า 10,000 ราย สามารถเข้าถึงโมเดลตระกูล Claude เพื่อสร้างแชทบอตและ AI Agent แบบคัสตอมสำหรับใช้กับข้อมูลในองค์กร

By lew Founder on Tag: LLM, Artificial Intelligence
LLM

ทีม ARC Prize ประกาศการแข่งขัน ARC-AGI-2 ข้อสอบไอคิวสำหรับมนุษย์ที่ยังยากสำหรับปัญญาประดิษฐ์ หลังจากข้อสอบชุดแรกเปิดตัวมาตั้งแต่ปี 2020 และตอนนี้มี AI ได้คะแนนสูงสุดคือ o3 ที่ 82.8%

ARC-AGI-2 เป็นข้อสอบที่ทำโดยมษุย์สำเร็จทุกข้อ หากให้ช่วยกันสองคน และมนุษย์โดยทั่วไปเฉลี่ยได้คะแนน 60% ตอนนี้โมเดลที่ดีที่สุดคือ o3 ทำคะแนนได้เพียง 4%

รางวัลรวมของ ARC-AGI-2 อยู่ที่ 1 ล้านดอลลาร์ รางวัลที่หนึ่งเป็นเงิน 700,000 ดอลลาร์หากทำคะแนนได้เกิน 80% และต้องใช้ต้นทุนประมวลผลไม่เกิน 50 ดอลลาร์เท่านั้น

By lew Founder on Tag: Databricks, LLM
Databricks

Databricks นำเสนอแนวทางการฝึกโมเดลปัญญาประดิษฐ์แบบ LLM ในชื่อว่า Test-time Adaptive Optimization (TAO) ที่มุ่งเป้าไปยังองค์กรที่ใช้งาน LLM อยู่แล้วแต่ต้องการโมเดลสำหรับใช้งานภายในที่เก่งใกล้เคียงกัน

แนวทางของ TAO แยกออกเป็นสี่ขั้น ได้แก่

Subscribe to LLM