Image

Large Language Model

Claude

Anthropic เปิดเผยว่าโมเดล AI Claude จะหยุดให้ข้อมูลเนื้อเพลง ที่มีลิขสิทธิ์ของค่ายเพลง หรือสร้างเนื้อเพลงใหม่ที่อิงจากเพลงที่มีลิขสิทธิ์ หลังจากสามค่ายเพลงใหญ่ฟ้อง Anthropic ที่นำเนื้อเพลงลิขสิทธิ์ไปเทรน AI อย่างไรก็ตามคดีความที่ยังฟ้องร้องกันนั้นยังคงดำเนินต่อไป

ในแถลงการณ์ Anthropic บอกว่าบริษัทไม่ได้สร้าง Claude ให้ละเมิดลิขสิทธิ์ ในการพัฒนามีขั้นตอนหลายอย่างเพื่อป้องกันอยู่แล้ว การตัดสินใจหยุดให้ข้อมูลนี้ก็เพื่อแสดงให้เห็นว่าบริษัทให้ความสำคัญกับเรื่องเนื้อหาที่อาจละเมิดลิขสิทธิ์

By lew Founder on Tag: SCB10X, LLM, Artificial Intelligence
SCB10X

SCB10X ประกาศปล่อยโมเดลปัญญาประดิษฐ์ LLM โดยรองรับหลายรูปแบบทั้งแบบขัอความปกติ, แบบรับภาพ, และแบบรับ/ตอบเป็นเสียง

ตัวโมเดลทั้งหมดพัฒนาต่อมาจากโมเดลโอเพนซอร์ส Llama-3.1/3.2, Qwen2.5 พร้อมกับโมเดลความปลอดภัย Typhoon2-Safety ที่พัฒนามาจาก mdeberta-v3-base โดยจุดสำคัญคือการสร้างชุดข้อมูลที่สะท้อนวัฒนธรรมไทย ทีมงานสร้างโมเดลปัญญาประดิษฐ์มาจัดคะแนนข้อมูลว่าเกี่ยวข้องกับประเทศไทยหรือไม่ โดยให้คะแนน 1-5 ชุดข้อมูลที่ได้คะแนนเกินเกณฑ์ในหมวดต่างๆ ก็จะถูกนำมาใช้งาน ข้อมูลอีกส่วนหนึ่งยังเป็นการสร้างจาก LLM ที่อ่านข้อความแล้วเขียนเป็นภาษาไทยในสไตล์ หนังสือเรียน, บล็อก, หรือบทความวิชาการ

By arjin Writer on Tag: Alibaba Cloud, LLM, Qwen
Alibaba Cloud

Alibaba Cloud ประกาศลดราคาค่าใช้งานโมเดลปัญญาประดิษฐ์ที่รับอินพุทเป็นรูปภาพและวิดีโอ Qwen-vl-max ลง 85% โดยราคาอยู่ที่ 0.003 หยวนต่อ 1,000 อินพุทโทเค็น

การลดราคานี้เพื่อให้โมเดลทำความเข้าใจรูปภาพของ Alibaba Cloud สามารถแข่งขันด้านราคากับโมเดลประเภทเดียวกันของ ByteDance ได้ ซึ่งคิดราคาที่ 0.003 หยวน เท่ากัน

By lew Founder on Tag: Meta AI, Meta, LLM, Artificial Intelligence, Chatbot
Meta AI

บริการ Meta AI ที่เป็นแชตบอตสำหรับผู้ใช้ทั่วไปเปิดให้ใช้งานในประเทศไทยแล้ว หลังจากก่อนหน้านี้จำกัดประเทศผู้ใช้งาน

Meta AI ใช้ Llama 3 เป็นฐานในการให้บริการ โดยผู้ใช้ในไทยสามารถใช้งานได้ครบถ้วน ทั้งการสสร้างภาพ หรือแม้แต่แปลงภาพให้กลายเป็นภาพเคลื่อนไหวก็ยังได้

ที่มา - Meta AI

By lew Founder on Tag: LLM, Artificial Intelligence, China, Open Source
LLM

DeepSeek ผู้พัฒนาปัญญาประดิษฐ์ LLM จากจีน ปล่อยโมเดล DeepSeek v3 โมเดล LLM ขนาดใหญ่มาก จำนวนพารามิเตอร์มากขึ้น 685B จากเดิมที่โมเดลเปิดใหญ่สุดคือ Llama 3.1 405B

ตอนนี้ยังไม่มีข้อมูลเกี่ยวกับโมเดลนี้นัก แต่ทาง Aider โครงการซอฟต์แวร์ช่วยเขียนโปรแกรมก็โชว์ผลทดสอบพบว่า DeepSeek v3 ทำคะแนนทดสอบได้ดีมาก แซงหน้า Claude 3.5 Sonnet อละ Gemini Exp 1206 ไปได้ เป็นรองเพียง OpenAI o1 เท่านั้น ตัวโมเดลใช้สถาปัตยกรรม Mixture-of-Experts แยก expert ออก 256 ชุด และเลือกใช้ 8 ชุดในแต่ละ token

By lew Founder on Tag: Alibaba Cloud, LLM, Qwen
Alibaba Cloud

ทีม Qwen ของ Alibaba Cloud เปิดโมเดล QvQ-72B-Preview ที่พัฒนาต่อจาก Qwen-VL-72B แต่ฝึกให้คิดเป็นขั้นเป็นตอนเพื่อเพิ่มความแม่นยำมากขึ้น

ผลทดสอบที่ทีม Qwen ใช้ทดสอบมี 4 ชุด ได้แก่ MMMU, MathVista, MathVision, และ OlympiadBench คะแนนที่ได้ขึ้นไปถึงระดับ Claude 3.5 Sonnet เข้าใกล้ OpenAI o1 มากขึ้น โดยพฤติกรรมของโมเดลจะคิดไปเรื่อยๆ และตอบคำถามสุดท้าย

โมเดลเปิดให้ทดสอบผ่าน HuggingFace ไฟล์โมเดลเปิดให้ดาวน์โหลดในไลเซนส์แบบ Qwen License โดยตอนนี้ยังส่งคำสั่งได้รอบเดียว ไม่สามารถคุยต่อเนื่องได้

By lew Founder on Tag: LLM, Cloud, Artificial Intelligence, Serverless
LLM

Together.AI ผู้ให้บริการคลาวด์ปัญญาประดิษฐ์เปิดบริการปรับแต่งโมเดล (finetune) แบบ LoRA เต็มรูปแบบ โดยทั้งการฝึกโมเดลและการรันโมเดลที่ปรับแต่งมาแล้ว

บริการ Severless LoRA สามารถใช้ adapter ที่ปรับแต่งมาแล้วจากที่อื่นได้ โดยคิดค่ารันตามโทเค็นเท่ากับโมเดลหลักเท่านั้น และสามารถใช้งานได้กับทุกโมเดลที่ทาง Together.AI ให้บริการแบบ serverless อยู่ เช่น Llama และ Qwen

By arjin Writer on Tag: OpenAI, Artificial Intelligence, LLM, Rumors
OpenAI

The Wall Street Journal มีรายงานโดยอ้างแหล่งข่าวที่เกี่ยวข้อง ถึงปัญหาและอุปสรรค์ของการพัฒนา GPT-5 โมเดลแชทบอตปัญญาประดิษฐ์เวอร์ชันใหม่ของ OpenAI หรือที่มีโค้ดเนมภายในว่า Orion ซึ่งพัฒนามานาน 18 เดือนแล้ว

By lew Founder on Tag: OpenAI, LLM
OpenAI

OpenAI เปิดตัวโมเดล o3 โมเดลที่พยายามคิดเป็นขั้น โดยมุ่งเป้าแก้ปัญหาที่ยากมาก เช่น ปัญหาคณิตศาสตร์ระดับงานวิจัยที่แม้แต่นักคณิตศาสตร์ก็อาจจะใช้เวลาเป็นวัน หรือชุดทดสอบ ARC-AGI ที่เป็นชุดทดสอบวัดไอคิว โดยเปิดตัวมาตั้งแต่ปี 2019 ที่ผ่านมาไม่มีปัญญาประดิษฐ์ใดได้คะแนนถึง 50% แม้มนุษย์จะได้คะแนนประมาณ 85%

By arjin Writer on Tag: Apple, NVIDIA, LLM, Artificial Intelligence, Machine Learning, Open Source
Apple

ทีมวิศวกรของฝ่ายวิจัย Machine Learning ของแอปเปิล เผยแพร่รายละเอียดตัวเร่งการทำ LLM Inference โดยร่วมมือกับ NVIDIA เพื่อทดสอบประสิทธิภาพบนจีพียูของ NVIDIA

เครื่องมือที่แอปเปิลพัฒนาและโอเพนซอร์สนี้ชื่อว่า Recurrent Drafter หรือย่อว่า ReDrafter เป็นโมเดลที่รวมสองอัลกอริทึมคือ Beam Search กับ Dynamic Tree Attention เพื่อเร่งความเร็วในการสร้างโทเค็นผลลัพธ์ของ LLM สูงสุดที่ระดับ 3.5 โทเค็นต่อหนึ่งขั้นตอนของโมเดลโอเพนซอร์ส

By arjin Writer on Tag: Instagram, Artificial Intelligence, LLM
Instagram

Adam Mosseri หัวหน้าทีม Instagram นำเสนอตัวอย่างฟีเจอร์ใหม่บน Instagram ให้ผู้ใช้งานแต่งเติมลูกเล่นวิดีโอที่อัปโหลดได้ด้วย Generative AI ของ Meta

เครื่องมือใหม่นี้มีชื่อเรียกว่า Movie Gen AI ซึ่ง Instagram บอกว่าสามารถเปลี่ยนแปลงวิดีโอได้ในทุกรายละเอียดผ่าน Prompt ข้อความสิ่งที่ต้องการ และให้ผลลัพธ์ที่ทำออกมาสมจริงมากที่สุดบนความละเอียด 1080p ทำให้รองรับความต้องการและจินตนาการของครีเอเตอร์บนแพลตฟอร์มได้

By lew Founder on Tag: Gemini, LLM, Google
Gemini

กูเกิลปล่อยโมเดล Gemini สองรุ่นพิเศษ คือ Gemini 2.0 Flash Thinking และ LearnLM ให้ใช้งานใน AI Studio โดยทั้งสองรุ่นยังเป็นรุ่นทดสอบอยู่

Gemini 2.0 Flash Thinking ถูกฝึกให้คิดการทำงานเป็นขั้นๆ ทำให้สามารถคิดงานที่ซับซ้อน ปัญหาเชาว์ที่ต้องคิดหลายชั้น ผลทดสอบตอนนี้มีเพียง LM Arena ที่ออกมาระบุว่าโมเดลนี้ขึ้นอันดับหนึ่งการทดสอบแทบทุกหมวด ยกเว้น Math Arena ที่ยังเป็นรอง o1-preview อยู่แต่ก็ใกล้เคียงกันขึ้นมาก จากเดิมที่ Gemini Exp 1206 ตามหลัง o1-preiew และ o1-mini

By lew Founder on Tag: Anthropic, LLM
Anthropic

ทีมวิจัยของ Anthropic ผู้สร้างปํญญาประดิษฐ์ Claude รายงานถึงงานวิจัยสาธิตความสามารถของปัญญาประดิษฐ์ LLM ที่สามารถ "ซ่อนความต้องการภายใน" เอาไว้ และเก็บพฤติกรรมของตัวเองเอาไว้แม้จะถูกฝึกให้เปลี่ยนพฤติกรรมโดยผู้พัฒนาก็ตาม

By mk Founder on Tag: Gmail, LLM, Spam, E-mail, Google
Gmail

กูเกิลเปิดเผยว่าได้นำโมเดล AI ตัวใหม่ๆ เข้ามาช่วยดักจับสแปมใน Gmail ช่วยให้ผลลัพธ์ดีขึ้น

โมเดลตัวแรกเริ่มใช้งานในปีนี้ เป็นโมเดลภาษา LLM ที่กูเกิลเทรนมาเพื่อดักจับ phishing, malware, spam โดยเฉพาะ สามารถบล็อคสแปมได้เยอะขึ้น 20% และตรวจสอบสแปมที่ผู้ใช้รายงานเข้ามาได้เยอะกว่าเดิม 1,000 เท่า

โมเดลตัวที่สองเพิ่งถูกใช้งานในช่วงเทศกาล Black Friday และได้ผลลัพธ์ที่ออกมาดีเช่นกัน โมเดลตัวนี้จะทำหน้าที่เป็นผู้ควบคุม (supervisor) ของโมเดลตัวอื่นๆ อีกที โดยจะอ่านสัญญาณภัยคุกคามจำนวนหลายร้อยสัญญาณ เมื่อโมเดลตัวอื่นพบว่าอีเมลฉบับใดมีความเสี่ยง

By lew Founder on Tag: LLM, Artificial Intelligence, Japan
LLM

Sakana AI บริษัทวิจัยปัญญาประดิษฐ์จากญี่ปุ่นที่มีผลงานด้าน LLM ต่อเนื่อง นำเสนองานวิจัยใหม่ ที่ฝึกให้โมเดลปัญญาประดิษฐ์เลือกจำแต่ช่วงเวลาดีๆข้อความสำคัญที่เกี่ยวข้องกับการประมวลผล และลืมข้อความที่ทำร้ายจิตใจไม่เกี่ยวข้องกับงานออกไป ทำให้การประมวลผลเร็วขึ้น แม่นยำขึ้น

แนวทางของ Sakana เสนอสถาปัตยกรรม Neural Attention Memory Models (NAMMs) ที่จริงๆ ก็เป็นโมเดลปัญญาประดิษฐ์ที่มาเลือกข้อความส่วนที่ควรลืมและควรจำ ช่วยให้โมเดล LLM หลักประมวลผลเฉพาะข้อความที่สำคัญได้

By mk Founder on Tag: Gemini, LLM, Google
Gemini

ขยันปล่อยของใหม่กันมาทุกวัน หลังจากเปิดตัว Gemini 2.0 Flash โมเดลตัวแรกในชุด Gemini 2.0 ซึ่งยังเป็นโมเดลขนาดเล็กที่สุด

กูเกิลก็เดินหน้าปล่อยโมเดลตัวใหม่ตามมาทันที ใช้ชื่อว่า Gemini-Exp-1206 เป็นโมเดลรุ่นทดสอบในตระกูล Gemini 2.0 Experimental Advanced ที่บอกว่ามีความสามารถสูงขึ้น ทั้งในเรื่องการเขียนโค้ด แก้โจทย์คณิตศาสตร์ การให้เหตุผล การทำตามคำสั่งเป็นขั้นตอน ฯลฯ

กูเกิลไม่ได้เปิดเผยตัวเลขเบนช์มาร์คเหมือนกับ Gemini 2.0 Flash แต่มีคนลองรันทดสอบกับบางงาน เช่น Text2SQL แล้ว พบว่า Gemini-Exp-1206 ให้ผลออกมาดีที่สุด

By arjin Writer on Tag: Artificial Intelligence, Enterprise, Chatbot, LLM
Artificial Intelligence

Financial Times เผยแพร่รายงานเกี่ยวกับปัญหาในองค์กรกับการใช้งาน AI โดยพบว่าองค์กรจำนวนมากประสบปัญหาไม่สามารถออกกฎระเบียบเกี่ยวกับการใช้ AI ในบริษัท ได้เท่าทันกับความรวดเร็วของเทคโนโลยี จึงเป็นทั้งอุปสรรคและความเสี่ยงขององค์กร

ในช่วงที่กระแสการใช้งาน AI สร้างเนื้อหาหรือ Generative AI มาแรงจาก ChatGPT หลายองค์กรเลือกป้องกันปัญหาข้อมูลรั่วไหล โดยสั่งบล็อกการใช้งานไปเลยตั้งแต่ปี 2023 แต่เมื่อเวลาผ่านไป ความสามารถที่มากขึ้น และมีกรณีศึกษาที่ชัดเจนว่าการใช้ AI ช่วยเพิ่มประสิทธิภาพและประสิทธิผลของงานได้ ทำให้ผู้นำองค์กรเริ่มพิจารณาอนุญาตให้ใช้ AI ได้ แต่การตีกรอบว่าอะไรทำได้ หรืออะไรทำไม่ได้ก็เป็นเรื่องที่ไม่ง่ายนัก เพราะต้องออกมาในระดับกฎระเบียบขององค์กร และผ่านการตรวจสอบจากฝ่ายความปลอดภัยข้อมูลสารสนเทศอีก

By arjin Writer on Tag: ChatGPT, OpenAI, Search Engine, LLM, Artificial Intelligence
ChatGPT

OpenAI ประกาศว่า ChatGPT Search บริการค้นหาข้อมูลพลัง AI เริ่มทยอยเปิดให้ใช้งานสำหรับผู้ใช้งานฟรีแล้วตั้งแต่วันนี้เป็นต้นไป หลังจากบริการ ChatGPT Search เปิดตัวเป็นทางการกับผู้ใช้งานเสียเงินเมื่อต้นเดือนพฤศจิกายน ซึ่งปรับมาจาก SearchGPT ที่เปิดตัวในตอนแรก

ChatGPT Search สำหรับผู้ใช้งานฟรีจะรองรับทั้งผ่านเว็บไซต์ chatgpt.com และแอปบนมือถือกับเดสก์ท็อป โดยผู้ใช้งานต้องล็อกอินเท่านั้น

By arjin Writer on Tag: Microsoft, LLM, Artificial Intelligence, Phi
Microsoft

ไมโครซอฟท์เปิดตัว Phi-4 โมเดลปัญญาประดิษฐ์ LLM ขนาดเล็ก 14B พารามิเตอร์ รุ่นใหม่ล่าสุดในตระกูล Phi ซึ่งระบุว่ามีความสามารถที่ดีขึ้นจากรุ่นก่อนหน้า โดยเฉพาะการคำนวณทางคณิตศาสตร์

ผลการเปรียบเทียบในการทำข้อสอบคณิตศาสตร์แข่งขัน AMC ของสหรัฐอเมริกา พบว่า Phi-4 มีคะแนนสูงสุด และดีกว่าแม้เทียบกับโมเดลขนาดใหญ่อย่าง Gemini Pro 1.5 ส่วนโมเดลขนาดเล็กนั้นมีคะแนนนำโดดเด่นไม่ว่าจะเป็น Gemini Flash 1.5, GPT 4o-mini หรือ Qwen 2.5

Subscribe to LLM