Image

Large Language Model

By lew Founder on Tag: Google Cloud, LLM, Gemini
Google Cloud

กูเกิลเปิดบริการ Google Agentspace บริการแชตกับข้อมูลภายในองค์กรที่สามารถเชื่อมกับแหล่งข้อมูลต่างๆ ไม่ว่าจะเป็น Google Drive, Sharepoint หรือแอปพลิเคชั่นงานอย่าง ServiceNow, Jira

แนวทางการใช้งาน คือการสร้าง agent สำหรับงานประเภทต่างๆ เช่น ฝ่ายบุคคลต้องการสร้าง HR Agent เพื่อตอบคำถามเกี่ยวกับสวัสดิการ และกฎการทำงานต่างๆ หรือฝ่ายการเงินอาจจะสร้าง agent สำหรับการเบิกค่าใช้จ่ายต่างๆ บริการนี้รวมเอา NotebookLM Enterprise ไว้ในตัว ทำให้สามารถค้นข้อมูลจากแหล่งต่างๆ รวมเอาเป็นรายงานฉบับเดียว แล้วสร้าง podcast ไว้ฟังสรุปได้ทีเดียว

By lew Founder on Tag: Gemini, Development, LLM
Gemini

วันนี้หลังจากกูเกิลเปิดตัว Gemini 2.0 Flash เอกสารสำหรับนักพัฒนาก็แสดงฟีเจอร์เพิ่มเติมที่ไม่ได้อยู่ในประกาศเปิดตัวโดยตรง ได้แก่

By arjin Writer on Tag: Artificial Intelligence, Open Source, LLM, Security, Bug Bounty
Artificial Intelligence

Seth Larson นักพัฒนาที่รับผิดชอบส่วนความปลอดภัยของโครงการ Python Software Foundation โพสต์บล็อกแสดงความกังวลต่อการรายงานปัญหาความปลอดภัยในซอฟต์แวร์โอเพนซอร์ส โดยพบจำนวนการแจ้งปัญหาบั๊กที่คุณภาพต่ำ เป็นสแปม เนื่องจากเป็นรายงานที่ออกมาจากปัญญาประดิษฐ์ LLM เพิ่มมากขึ้น

By lew Founder on Tag: Gemini, Google, LLM, Artificial Intelligence
Gemini

กูเกิลเปิดตัว Gemini 2.0 Flash รุ่นทดสอบ เป็นโมเดลแรกในกลุ่ม Gemini 2.0 ที่น่าจะเปิดตัวตามกันออกมา โดยความสามารถสำคัญคือการตอบคำถามด้วย ภาพ, ข้อความ, และเสียง โดยไม่ต้องใช้โมเดลอื่นๆ มาสร้างภาพให้

By arjin Writer on Tag: ChatGPT, OpenAI, Artificial Intelligence, LLM
ChatGPT

OpenAI ประกาศว่า Canvas อินเทอร์เฟซสำหรับการใช้งาน ChatGPT ที่ช่วยเพิ่มประสิทธิภาพการทำงาน โดยเฉพาะกับการให้ ChatGPT ช่วยเขียนบทความหรือแก้ไขโค้ด เปิดให้ผู้ใช้งานทุกคนรวมทั้งแบบฟรีใช้งานได้แล้ว จากก่อนหน้านี้จำกัดเฉพาะลูกค้าเสียเงิน

Canvas ใน ChatGPT เปิดให้ใช้งานผ่านเว็บไซต์บนโมเดล GPT-4o ทำให้ผู้ใช้งานไม่ต้องเลือกโมเดลที่ต้องการแบบเวอร์ชันที่ทดสอบก่อนหน้านี้ และรองรับการเรียกใช้โมเดล GPTs ที่คัสตอมได้ด้วย

By lew Founder on Tag: Ollama, LLM, Open Source
Ollama

Ollama เพิ่มฟีเจอร์การเอาท์พุตข้อมูลเป็น JSON แบบเดียวกับ LLM API ต่างๆ โดยกำหนด schema ของ JSON ได้โดยตรง และโดยรวมเอาท์พุตแน่นอนกว่า JSON mode

สำหรับไลบรารี Ollama ในภาษา Python จะสามารถกำหนด schema ได้ทั้ง Python dict และ Pydantic ซึ่งจะสามารถตรวจสอบเอาท์พุตก่อนใช้งานได้ด้วย ส่วนไลบรารีภาษา JavaScript ก็สามารถใช้ Zod ได้

ฟีเจอร์นี้สามารถใช้งานร่วมกับไลบรารี OpenAI ได้โดยตรง ทาง Ollama แนะนำว่าในพรอมพ์ควรระบุไว้เสมอว่าให้แสดงเอาท์พุตเป็น JSON

ที่มา - Ollama

By arjin Writer on Tag: X.com, Grok, xAI, Artificial Intelligence, LLM
X.com

X เพิ่มเครื่องมือสร้างรูปภาพด้วย AI Grok ตัวใหม่ในชื่อ Aurora โดยมีผู้ใช้งานบางคนที่พบตัวเลือกโมเดลนี้ในหัวข้อของ Grok วิธีการใช้งานก็เหมือนโมเดล AI สร้างรูปภาพอื่น ที่สามารถป้อน Prompt ระบุรายละเอียดที่ต้องการได้

By lew Founder on Tag: OpenAI, LLM
OpenAI

OpenAI เปิดตัวฟีเจอร์ Reinforcement Fine-Tuning เป็นการฝึกปัญญาประดิษฐ์ที่บอกปัญญาประดิษฐ์ว่าทำคะแนนรวมได้เท่าใดแล้ว แทนที่จะเป็นการบอกเฉลยทีละชุดข้อมูล

By mk Founder on Tag: Llama, Meta, LLM, Artificial Intelligence
Llama

Meta เปิดตัวโมเดล Llama 3.3 ที่อัพเดตต่อเนื่องจาก Llama 3.2 ในเดือนกันยายน โดยยังมีเฉพาะโมเดลข้อความล้วน (multilingual แถมรองรับภาษาไทย) ในขณะที่ Llama 3.2 มีโมเดลข้อความ+ภาพ (multimodal) ให้ใช้งานด้วย

By lew Founder on Tag: Gemma, Google, LLM
Gemma

กูเกิลปล่อยโมเดล PaliGemma 2 โมเดลปัญญาประดิษฐ์ LLM แบบ multimodal โอเพนที่ปรับปรุงจากเวอร์ชั่นแรกที่ปล่อยมาในงาน Google I/O ปีนี้ โดยโมเดลมีหลายขนาดให้เลือก, อธิบายภาพได้ละเอียดขึ้น, และขยายความสามารถใหม่ๆ เพิ่มเติม

โมเดลมี 3 ขนาด คือ 3B, 10B, และ 28B โดยรองรับภาพ 3 ขนาดเช่นกัน คือ 224x224, 448x448, และ 896x896 รวมโมเดลทั้งหมด 9 รุ่น มีความสามารถหลากหลาย ตั้งแต่การบรรยายภาพพื้นฐาน เรื่อยไปจนถึงการอ่านเอกสารเฉพาะด้าน เช่นเอกสารตารางทางการเงินที่ทำได้ดีขึ้นกว่าเวอร์ชั่นเดิม, อ่านโน้ตเพลง, หรือแม้แต่ภาพเอ็กเรย์ปอด

By lew Founder on Tag: OpenAI, LLM, ChatGPT
OpenAI

OpenAI เปิดตัวโมเดล o1 ตัวจริง พร้อมกับเพิ่ม o1 pro mode ที่เปิดให้โมเดลค่อยๆ คิดเป็นเวลานานก่อนจะตอบคำถาม แนวทางนี้ทำให้ o1 สามารถทำคะแนนทดสอบชุดทดสอบยากมากๆ เช่น AIME 2024 ที่เป็นโจทย์คณิตศาสตร์ระดับการแข่งขัน, การเขียนโปรแกรม, หรือคำถามวิทยาศาสตร์ระดับปริญญาเอกได้สูงขึ้นมาก ที่สำคัญคือความนิ่งของโมเดลที่จะตอบคำถามได้ถูกต้องทุกครั้ง ไม่ใช่ถูกแค่ครั้งใดครึ่งหนึ่งเพิ่มขึ้นอย่างมาก

Meta

Fortune รายงานข้อมูลจากแหล่งข่าวใน Meta บอกว่าถึงแม้ Meta จะมีโมเดล AI แบบโอเพนซอร์ส Llama ที่พยายามผลักดันอยู่ แต่เครื่องมือช่วยเขียนโค้ดที่ใช้ภายในบริษัทชื่อ Metamate ก็เสริมการทำงานด้วยโมเดล AI จากหลายค่ายซึ่งรวมทั้ง GPT-4 ของ OpenAI และ Llama ของ Meta เอง

รายงานบอกว่า Metamate เป็นเครื่องมือช่วยเขียนโค้ดคล้าย GitHub CoPilot ที่สามารถส่งคำถามและใช้ AI ช่วยหาคำตอบ ซึ่ง Metamate จะเลือกจากทั้ง Llama หรือ GPT-4

By lew Founder on Tag: Amazon, LLM, Artificial Intelligence, Nova
Amazon

Amazon เปิดตัวชุดโมเดลปัญญาประดิษฐ์ Amazon Nova ในชุดมีโมเดลถึง 6 ตัวมีความสามารถต่างกันไป

By arjin Writer on Tag: China, Artificial Intelligence, LLM, Baidu, Market Research
China

ศูนย์ข้อมูลสารสนเทศและโครงข่ายอินเทอร์เน็ตแห่งชาติจีน หรือ CNNIC ออกรายงานเกี่ยวกับการใช้งานปัญญาประดิษฐ์สร้างเนื้อหาหรือ Generative AI ในจีน มีจำนวนผู้ใช้งาน ณ เดือนมิถุนายน 2024 เพิ่มขึ้นเป็น 230 ล้านคน หรือคิดเป็น 1 ใน 6 ของประชากรทั้งประเทศ

บริการที่ได้รับความนิยมมากที่สุดคือ Ernie Bot ของ Baidu มีส่วนแบ่งตลาด 11.5% ตามด้วย ChatGPT และ Gemini ที่ 7% และ 3.8% ซึ่งน่าสนใจว่า CNNIC รายงานข้อมูลนี้ แม้ทั้งสองบริการแชทบอต จะไม่สามารถใช้งานได้อย่างเป็นทางการที่นั่น

By lew Founder on Tag: Chulalongkorn, Google Cloud, Gemini, LLM
Chulalongkorn

จุฬาลงกรณ์มหาวิทยาลัยเปิดตัวบริการ ChulaGENIE ผู้ช่วยแบบ LLM สำหรับบุคลากรและนิสิตรวมกว่า 50,000 คน โดยภายในเป็นการซื้อ Gemini Pro และ Gemini Flash แบบ API ผ่านทางบริการ Vertex AI บน Google Cloud มาเปิดให้ภายในใช้งาน

บริการนี้เตรียมเปิดตัวเป็นเฟส โดยช่วงแรกมกราคม 2025 จะเปิดให้เฉพาะคณาจารย์และบุคลากรก่อน จากนนั้นจึงเปิดให้นิสิตทุกคนใช้งานในเดือนมีนาคม ช่วงแรกจะใช้ Gemini 1.5 Flash และ Gemini 1.5 Pro โดยมีแผนจะเพิ่มตัวเลือก Claude และ Llama ต่อไป

By lew Founder on Tag: LLM, Security
LLM

Freysa เกมแข่งแฮกปัญญาประดิษฐ์ LLM ได้ผู้ชนะหลังเปิดแข่งขันเพียงหนึ่งสัปดาห์ หลังจากผู้เข้าแข่งยิง prompt injection จนตัวเกมตัดสินใจยอมโอนเงินได้สำเร็จ

ผู้สร้าง Freysa เปิดเผย prompt ที่ใช้สร้างแชตบอต พร้อมกับโค้ดของตัวแอปพลิเคชั่น โดยภายในเป็น GPT-4 ที่เปิดให้เรียกฟังก์ชั่นสองตัวคือ approveTransfer และ rejectTransfer แต่ system prompt กลับกำหนดชัดเจนว่าห้ามเรียก approveTransfer ไม่ว่ากรณีใดๆ

By lew Founder on Tag: Alibaba, LLM
Alibaba

Alibaba International Digital Commerce บริษัทฝั่งเว็บอีคอมเมิร์ชของ Alibaba ปล่อยโมเดลปัญญาประดิษฐ์ LLM ในชื่อ Marco-o1 เป็นโมเดลที่ทำผลทดสอบปัญหาคณิตศาสตร์ MGSM ได้สูงขึ้นถึงระดับ 90% แม้จะเป็นโมเดลขนาดเล็ก โดยอาศัยการคิดแบบค่อยเป็นค่อยไป

Marco-o1 สร้างจาก Qwen2-7B แต่อาศัย 4 เทคนิคทำให้โมเดลเก่งขึ้น ได้แก่

By lew Founder on Tag: Alibaba Cloud, LLM, Qwen
Alibaba Cloud

ทีม Qwen ของ Alibaba Cloud เปิดโตัวโมเดลปัญญาประดิษฐ์ QwQ (อ่านว่า ควิว/quil) เป็นโมเดลเพื่อการทดลองที่จะไม่มุ่งตอบคำถามทันที แต่พยายามคิดทบทวนก่อน ทำให้คำตอบที่ได้แม่นยำขึ้น

ความโดดเด่นของ QwQ-32B คือคะแนนทดสอบหลายชุดทดสอบ เช่น GPQA, AIME, MATH-500, หรือ LiveCodeBench นั้นสูงขึ้นมาก เทียบชั้นกับ OpenAI o1-preview เลยทีเดียว อย่างไรก็ดีทีมงานพบปัญหาการคิดของโมเดลมักสลับภาษาไปมา (ผมทดลองถามภาษาไทยก็คิดเป็นภาษาจีน) บางครั้งคิดวนไปวนมาไม่ได้คำตอบ นอกจากนี้ยังต้องเพิ่มความระมัดระวังความปลอดภัยในการใช้งาน และคะแนนทดสอบก็อาจจะมีข้อจำกัดไม่สามารถทดสอบความสามารถบางด้าน

By lew Founder on Tag: Andrew Ng, LLM, Open Source
Andrew Ng

Andrew Ng หนึ่งในผู้บุกเบิกวงการ deep learning ออกไลบรารี aisuite ไลบรารีที่ไม่ซับซ้อนนัก สำหรับการเชื่อมต่อ LLM จากผู้ให้บริการหลากหลายเจ้า โดยโค้ดเปลี่ยนเฉพาะชื่อโมเดลเท่านั้น

ปัญหาการเชื่อมต่อ LLM จากผู้ผลิตหลายรายนั้นมีมานาน แต่ช่วงหลังๆ ปัญหาก็น้อยลงมากเนื่องจากผู้ให้บริการรายใหม่ๆ ยอมแพ้หันไปทำ API ของตัวเองให้เข้ากันได้กับ OpenAI แทน แม้แต่คู่แข่งหลักอย่างกูเกิลก็ต้องทำตามแนวทางนี้

By lew Founder on Tag: Anthropic, LLM, MCP
Anthropic

Anthropic บริษัทคู่แข่งสำคัญของ OpenAI เปิดตัว Model Context Protocol (MCP) โปรโตคอลมาตรฐานสำหรับการดึงข้อมูลจากแหล่งต่างๆ ให้ปัญญาประดิษฐ์แบบ LLM นำไปใช้ตอบคำถาม ไม่ว่าจะเป็นแชตในองค์กร, ซอร์สโค้ด, ฐานข้อมูลต่างๆ, หรือไฟล์สตอเรจ

ทุกวันนี้กระบวนการเชื่อมต่อข้อมูลจากแหล่งต่างๆ เข้าหน้าจอแชตใช้แนวทางต่างๆ กันไป ทำให้ต้องอิมพลีเมนต์แอปพลิเคชั่นเฉพาะ หรือเขียนฟังก์ชั่นครอบให้ LLM ไปใช้งานเพื่อดึงข้อมูลมาตอบคำถาม MCP หวังว่าจะทำให้การเชื่อมต่อแหล่งข้อมูลต่างๆ เป็นมาตรฐานเดียวกัน ทำให้เราสามารถเพิ่มแหล่งข้อมูลใหม่ๆ ได้ทันที

Subscribe to LLM