Image

Large Language Model

By lew Founder on Tag: LLM, Artificial Intelligence, Education
LLM

เมื่อเดือนตุลาคมที่ผ่านมา Dale และ Jennifer Harris ผู้ปกครองของ RNH ชื่อย่อของนักเรียนโรงเรียน Hingham High School ยื่นฟ้องครูและกรรมการโรงเรียน หลังจาก RNH ถูกตัดคะแนนในวิชา AP U.S. History จนเกรดตก และทำให้อาจจะเสียโอกาสเข้ามหาวิทยาลัย ล่าสุดศาลชั้นต้นรัฐบาลกลาง (U.S. District Court) ก็ตัดสินไม่สั่งคุ้มครองชั่วคราวให้แก้คะแนนให้ RNH

คำตัดสินระบุว่าหลักฐานแสดงให้เห็นว่าโรงเรียนไม่ได้รีบเร่งตัดสินโทษ และโทษก็ไม่ได้รุนแรงเป็นพิเศษหรือต่างจากคนอื่น

By mk Founder on Tag: Samsung, LLM, Artificial Intelligence
Samsung

ซัมซุงมีโมเดลปัญญาประดิษฐ์ของตัวเองชื่อ Gauss เปิดตัวในปี 2023 และกำลังพยายามนำไปใช้กับ Bixby

ในงานสัมมนาสำหรับนักพัฒนา SDC24 Korea เมื่อไม่กี่วันที่ผ่านมา ซัมซุงเปิดตัวโมเดล Gauss 2 ที่มีประสิทธิภาพมากขึ้น ตัวโมเดลเป็น multimodal รองรับทั้งภาษา โค้ด และรูปภาพ สามารถเลือกโมเดลย่อยได้ 3 ตัว แยกตามรูปแบบการใช้งานคือ

By lew Founder on Tag: LLM, Artificial Intelligence, Gemini, OpenAI, ChatGPT, Chatbot
LLM

กูเกิลและ OpenAI ผลัดกันชิงอันดับหนึ่งบนการจัดอันดับ Chatbot Arena ของ LMSys โดยสัปดาห์ที่ผ่านมานับเป็นช่วงที่แข่งกันดุเดือดเป็นพิเศษเพราะเอาชนะสลับกันหลายรอบในสัปดาห์เดียว

By arjin Writer on Tag: Siri, Apple, LLM, Rumors, iOS 19
Siri

ข้อมูลนี้มาจาก Mark Gurman แห่ง Bloomberg คนเดิม เขาบอกว่าแอปเปิลกำลังพัฒนาฟีเจอร์ AI ใหม่สำหรับ iOS 19 และ macOS 16 ที่จะออกมาในปีหน้า โดยเพิ่มความสามารถ Siri ด้วยโมเดลปัญญาประดิษฐ์ภาษาขนาดใหญ่หรือ LLM (Large Language Model) ทำให้มีความสามารถในการสนทนาโต้ตอบให้ข้อมูลดีขึ้น

By lew Founder on Tag: GitHub Copilot, GitHub, LLM, Programming
GitHub Copilot

GitHub ออกรายงานสำรวจประสิทธิภาพของโปรแกรมเมอร์เมื่อใช้ GitHub Copilot ช่วยทำงาน พบว่าโดยรวมแล้วการมี Copilot ทำให้โปรแกรมเมอร์เขียนโค้ดถูกต้องมากขึ้น โค้ดมีคุณภาพสูงขึ้น บั๊กน้อยลง

การวิจัยนี้นำโปรแกรมเมอร์ที่มีประสบการณ์อย่างน้อย 5 ปีจำนวน 202 คนมาแบ่งกลุ่มแบบสุ่ม มีกลุ่มได้ใช้ Copilot 104 คน และกลุ่มไม่ได้ใช้ 98 คน ให้เขียน Web API ตามคำสั่ง จากนั้นสำรวจโค้ดทั้งความถูกต้องด้วยการรันชุดทดสอบ, และสำรวจคุณภาพโต้ด

By lew Founder on Tag: Microsoft Azure, Container, LLM
Microsoft Azure

Azure Container Apps บริการรันคอนเทนเนอร์แบบ serverless จ่ายตามเวลาที่ใช้งานจริง เพิ่มตัวเลือกชิปกราฟิกสำหรับการรัน AI เฉพาะทาง โดยมีชิป NVIDIA T4 และ A100 ให้เลือกใช้งาน

แม้จะเปิดใช้งานแล้ว แต่ลูกค้าทั่วไปที่ไม่ได้ทำข้อตกลง Microsoft Enterprise Agreement จะต้องติดต่อไมโครซอฟท์ขอโควต้า serverless GPU ก่อนใช้งาน โดยตอนนี้มีให้ใช้งานสองศูนย์ข้อมูล คือ West US 3 และ Australia East

By lew Founder on Tag: Microsoft, LLM, PostgreSQL
Microsoft

ไมโครซอฟท์เพิ่มฟีเจอร์ GraphRAG Solution Accelerator สำหรับ PostgreSQL บน Azure Database ทำให้ลูกค้าที่ต้องการพัฒนาแอปพลิเคชั่น RAG บน Azure สามารถใช้งานฐานข้อมูลสำเร็จรูปได้

ปกติแล้วการพัฒนาแอปพลิเคชั่น RAG (Retrieval Augmented Generation) จะอาศัยการค้นหาข้อมูลที่เกี่ยวข้องกับคำค้นหรือคำถามของผู้ใช้เพื่อให้ปัญญาประดิษฐ์ LLM สามารถนำข้อมูลเหล่านั้นมาอ้างอิงในการสร้างคำตอบ แต่ GraphRAG เสนอว่าข้อมูลที่ดึงมาได้ว่าเกี่ยวข้องนั้นหลายครั้งมีข้อมูลที่เชื่อมโยงอยู่ด้วยและควรใช้งานด้วยกัน แม้จะไม่ได้ใกล้เคียงกับคำค้นโดยตรงก็ตาม

By lew Founder on Tag: SCB10X, LLM
SCB10X

SCB10X ร่วมมือกับ Together.ai ผู้ให้บริการ LLM รายสำคัญ เปิดให้บริการโมเดล Typhoon สองรุ่น คือ Typhoon 1.5 8B Instruct และ Typhoon 1.5X 70B-awq (Activation-Aware Weight Quantization - การย่อโมเดลแบบคำนึงถึงความสำคัญของแต่ละพารามิเตอร์)

ตอนนี้ทั้งสองโมเดลใช้งานได้ในหน้า Playground ของ Together.ai แล้ว แต่ยังไม่ประกาศราคาที่แน่ชัดออกมา โดยทาง SCB10X ระบุว่าต้องสอบถามทาง Together.ai โดยตรง แต่ยืนยันว่าจะคิดค่าใช้งานเป็นโทเค็น

By lew Founder on Tag: Cerebras, LLM
Cerebras

Cerebras ผู้พัฒนาชิปเฉพาะทางในการรันโมเดลปัญญาประดิษฐ์ขนาดใหญ่ โชว์บริการ Cerebras Inference ที่ให้บริการโมเดล Llama 3.1 405B แบบความละเอียดเต็ม 16-bit แต่ได้ความเร็วสูงมากถึง 969 token/s และเริ่มตอบโทเค็นแรกในเวลาเพียง 240ms ใกล้เคียงการตอบแบบทันที

By lew Founder on Tag: Alibaba Cloud, LLM, Qwen
Alibaba Cloud

Alibaba เปิดโมเดล Qwen2.5-Turbo โมเดลปัญญาประดิษฐ์ที่ปรับปรุงขึ้นจากรุ่นโอเพนซอร์ส เน้นขนาดข้อมูลที่รองรับได้ จากเดิม 128,000 โทเค็นเป็น 1 ล้านโทเค็น ทำให้รองรับข้อมูลระดับหนังสือทั้งเล่มได้ คิดเป็นขนาดข้อมูลประมาณ 1 ล้านคำหรืออักษรจีน 1.5 ล้านตัวอักษร

ผลทดสอบของ Qwen2.5-Turbo ค่อนข้างดีมากการถามตอบจากข้อมูลขนาดใหญ่ Passkey Retrieval ได้เต็ม 100 คะแนน ขณะที่ชุดทดสอบ RULER ก็ได้คะแนนสูงกว่า GPT-4 เมื่อใส่ข้อมูลเต็ม 1 ล้านโทเค็นจะเริ่มตอบใน 68 วินาที ราคาต่อ 1 ล้านโทเค็นอยู่ที่ 0.3 หยวน ถูกกว่า GPT-4o-mini อยู่ 4.6 เท่าตัว

By arjin Writer on Tag: Mistral, LLM, Artificial Intelligence, Chatbot
Mistral

Mistral AI ประกาศเพิ่มความสามารถให้แพลตฟอร์มแชทบอต le Chat โดยสามารถค้นหาข้อมูลเว็บได้, เพิ่ม Canvas สำหรับปรับแต่งผลลัพธ์ได้สะดวกขึ้น เป็นฟีเจอร์แบบเดียวกับ ChatGPT, วิเคราะห์รูปภาพ-เอกสาร, สร้างรูปภาพ ด้วยโมเดล FLUX และปรับปรุงความเร็วในการตอบสนอง

By arjin Writer on Tag: ChatGPT, OpenAI, Developer, LLM, Windows, macOS
ChatGPT

OpenAI ประกาศรายละเอียดใหม่ของแอป ChatGPT บนเดสก์ท็อปทั้ง macOS และ Windows มีรายละเอียดดังนี้

ChatGPT macOS เพิ่มความสามารถอ่านโค้ดจากแอปเขียนโค้ด เช่น VS Code, Xcode, TextEdit, Terminal หรือ iTerm2 ทำให้นักพัฒนาไม่ต้องคัดลอกตัดแปะโค้ดเพื่อถามกับแชทบอต แต่สามารถถามจากโค้ดที่ปรากฏในหน้าจอได้เลย อย่างไรก็ตาม ChatGPT สามารถให้คำตอบได้เฉพาะในแอปเท่านั้น ยังไม่มีความสามารถที่เข้าไปแก้ไขโค้ดในแอปนั้นได้โดยตรงแบบ GitHub Copilot

By lew Founder on Tag: Artificial Intelligence, LLM, NVIDIA, Google
Artificial Intelligence

MLPerf ชุดทดสอบความสามารถคอมพิวเตอร์และการ์ดเร่งความเร็วสำหรับงานด้าน machine learning โดยเฉพาะ ออกผลทดสอบเวอร์ชั่น 4.1 ที่เน้นวัดความสามารถในการฝึกปัญญาประดิษฐ์กลุ่ม generative AI ทั้งการสร้างข้อความและภาพ โดยผลในรอบนี้มีผู้แข่งสำคัญเพียงสองราย คือ NVIDIA และ Google

By lew Founder on Tag: Alibaba Cloud, LLM, Qwen, Programming
Alibaba Cloud

ทีมวิจัย Qwen ของ Aliababa เปิดตัวโมเดล Qwen2.5-Coder โมเดล LLM ช่วยเขียนโค้ดที่ปรับปรุงกระบวนการฝึกจนได้ประสิทธิภาพสูงสุดในหมู่โมเดลโอเพนซอร์ส คะแนนทดสอบรวมพอๆ กับ GPT-4o ในการทดสอบหลายตัว

กระบวนการฝึก Qwen2.5-Coder นั้นอาศัยการฝึกเป็นขั้น เริ่มตั้งแต่การฝึกโค้ดแบบไฟล์เดี่ยว (file-level pretrain) แล้วขยับมาเป็นการฝึกแบบหลายไฟล์ (repo-level pretrain) สุดท้ายจึงฝึกการเขียนโค้ดตามคำสั่ง โดยอาศัยชุดข้อมูลโค้ดที่พบในอินเทอร์เน็ต นำมาสร้างคำสั่งเพื่อให้ได้โค้ดนั้น แล้วจึงนำชุดข้อมูลไปฝึก

By mk Founder on Tag: Sourcegraph, Gemini, Development, LLM, Google
Sourcegraph

กูเกิลจับมือกับบริษัท Sourcegraph ผู้พัฒนา AI ช่วยเขียนโค้ดชื่อ Cody ทดลองนำโมเดล Gemini 1.5 ที่รองรับอินพุตขนาดยาว 1 ล้านโทเคน ว่าช่วยให้คุณภาพของคำตอบดีขึ้นอย่างไร

Cody เป็นการนำ AI มาอ่านโค้ดภายในขององค์กรลูกค้า เพื่อช่วยให้ค้นหาและแนะนำการเขียนโค้ดใหม่ ใช้ร่วมกับ IDE ยอดนิยมทั้ง Visual Studio และตระกูล JetBrains ได้ โมเดลภาษาที่ Cody เลือกใช้งานเป็นโมเดลยอดนิยมหลายตัวในตลาด เช่น Claude 3/3.5, GPT-4o, Gemini, Mixtral (ลูกค้าเลือกเองโมเดลได้) โดยโมเดลที่ใช้งานในระดับโปรดักชันมีขนาด context window ยาว 10,000 โทเคน (10k)

By mk Founder on Tag: OpenAI, LLM, Artificial Intelligence
OpenAI

เว็บไซต์ The Information รายงานอ้างแหล่งข่าวภายในจาก OpenAI ว่าโมเดลตัวใหม่โค้ดเนม Orion ไม่ได้พัฒนาจาก GPT-4 แบบก้าวกระโดด เหมือนกับตอนเปลี่ยนจาก GPT-3 มาเป็น GPT-4

แหล่งข่าวของ The Information ยังบอกว่า Orion ยังอาจทำงานไม่ได้ดีกว่าโมเดลรุ่นปัจจุบันอย่างชัดเจนนัก (not be reliably better) ในงานบางด่าน เช่น การเขียนโค้ด

By mk Founder on Tag: Gemini, Google, LLM, OpenAI, Development, API
Gemini

ต้องยอมรับว่ากูเกิลเปิดตัว Gemini หลัง ChatGPT เป็นเวลานานพอสมควร ทำให้ตลาด AI/LLM มุ่งไปที่ฝั่ง OpenAI กันหมด แอพที่เรียกใช้งาน LLM จึงมักเขียนเพื่อรองรับโมเดลของฝั่ง OpenAI โดยเรียกใช้ OpenAI Library (ทั้งที่เป็น official และ unofficial) กันซะเป็นส่วนใหญ่

ล่าสุดกูเกิลประกาศ "แฝงตัว" ให้รองรับการเรียกใช้ Gemini ผ่าน OpenAI Library ได้แล้ว ช่วยลดภาระการแก้โค้ดลง โดยโค้ดสามารถเรียกใช้ OpenAI Library ได้เหมือนเดิม แต่ในส่วนของโมเดลเปลี่ยนเป็นเรียก Gemini แทน ช่วยให้แก้โค้ดเพียงไม่กี่บรรทัดเท่านั้น

By nismod Writer on Tag: Google, Singapore, Artificial Intelligence, LLM, Southeast Asia
Google

ปัจจุบันโมเดล LLM เก่งๆ มีหลากหลายโมเดล แต่ส่วนใหญ่ถูกพัฒนาจากกรอบของภาษาอังกฤษ หรือภาษาอื่นที่เป็นภาษาหลักของโลก รวมถึงชุดข้อมูลและการปรับแต่ง ก็ถูกตีกรอบด้วยอิทธิพลและมุมมองจากตะวันตกเป็นหลัก ทำให้ในหลายๆ ประเทศ หลายๆ ภูมิภาค ที่มีภาษาและบริบททางวัฒนธรรมเฉพาะ ไม่สามารถเข้าถึง LLM ได้ ซึ่งบริษัทใหญ่ๆ ก็คงไม่เน้นพัฒนาให้ หรือประเทศนั้นๆ จะพัฒนาเอง ก็ไม่ได้มีทรัพยากรเพียงพอ

By lew Founder on Tag: Artificial Intelligence, LLM
Artificial Intelligence

Ollama ซอฟต์แวร์รันไทม์สำหรับรันโมเดลปัญญาประดิษฐ์ ออกเวอร์ชั่น 0.4 รองรับการรันโมเดลที่รับอินพุตเป็นภาพ โมเดลสำคัญคในกลุ่มนี้คือ Llama 3.2 ของ Meta

llama3.2-vision มีทั้งรุ่น 11B และ 90B ต้องการแรมขั้นต่ำ 8GB ส่วนรุ่น 90B ต้องการขั้นต่ำ 64GB โดยโมเดลรุ่นเล็กเหล่านี้เป็นแบบ quantize 4 bit รุ่นใหญ่สุดแบบ FP16 นั้นเฉพาะไฟล์โมเดลก็ขนาดถึง 177GB แล้ว

การใช้งาน llama3.2-vision สามารถใช้งานได้ทั้งการทำ OCR, อ่านลายมือ, อธิบายภาพ

ที่มา - Ollama

By arjin Writer on Tag: Claude, Anthropic, LLM, Artificial Intelligence
Claude

Anthropic ประกาศว่าโมเดลปัญญาประดิษฐ์ Claude 3.5 Haiku ที่เป็นรุ่นเล็กมีราคาถูก ตอนนี้เปิดให้ใช้งานแล้วผ่าน API และผ่านผู้ให้บริการคลาวด์ทั้ง Amazon Bedrock และ Vertex AI หลังจากเปิดตัวไปเมื่อเดือนที่แล้วพร้อมกับ Sonnet 3.5 รุ่นปรับปรุง

Subscribe to LLM