Image

Large Language Model

By lew Founder on Tag: Llama, Meta, LLM, Artificial Intelligence
Llama

Meta เปิดตัว Llama 2 ตัวต่อจาก Llama ที่เปิดตัวไปเมื่อเดือนกุมภาพันธ์ที่ผ่านมา ตัวโมเดลมี 3 ขนาดเช่นเดิม คือ 7B, 13B, และ 70B แต่เปลี่ยนแนวทางเพิ่มการฝึกกับชุดคำถามตอบมากขึ้น โดยมีการจูนกับชุดคำถามตอบกว่าแสนรายการ และฝึกเพิ่มด้วยการให้คนมาเลือกคำตอบที่ดีที่สุดอีกกว่าล้านครั้ง

By arjin Writer on Tag: JD.com, Chatbot, LLM, Artificial Intelligence
JD.com

JD.com เปิดตัว ChatRhino หรือชื่อภาษาจีน Yanxi โมเดลภาษาขนาดใหญ่หรือ Large Language Model (LLM) ซึ่งอิงพื้นฐานจากข้อมูลทั่วไป 70% และข้อมูลเฉพาะด้านอีก 30% สำหรับใช้ในงานเฉพาะกลุ่มอุตสาหกรรม เช่น ค้าปลีก ขนส่งสินค้า การเงิน สุขภาพ และงานบริหารจัดการเมือง ที่มีพารามิเตอร์ในโมเดลมากกว่า 1 แสนล้านพารามิเตอร์

ก่อนหน้านี้ JD.com ประกาศแผนเปิดตัวแชตบอท AI ดังกล่าว ซึ่งระบุว่าจะใช้สำหรับงานเฉพาะอุตสาหกรรม ซึ่งเกี่ยวข้องกับธุรกิจในเครือของ JD.com นอกจากนี้ยังเปิดตัวแพลตฟอร์ม ChatRhino สำหรับให้นักพัฒนาภายนอกเข้ามาใช้งานด้าน AI อีกด้วย

By lew Founder on Tag: Bard, Google, LLM, Artificial Intelligence
Bard

กูเกิลอัพเดต Bard ให้รองรับภาษาไทยและภาษาอื่นๆ รวมกว่า 40 ภาษาทั่วโลกตามที่ประกาศไว้ก่อนหน้านี้ในงาน Google I/O ทำให้ตอนนี้ Bard รองรับภาษาหลักๆ แทบทั้งโลก ใกล้เคียงกับ ChatGPT

อัพเดตครั้งนี้ยังเพิ่มฟีเจอร์อีกหลายฟีเจอร์คือ

By mk Founder on Tag: Claude, Anthropic, Artificial Intelligence, LLM
Claude

Anthropic สตาร์ตอัพด้าน AI ที่ก่อตั้งโดยอดีตทีมงาน GPT ของ OpenAI เปิดตัวโมเดลเวอร์ชันใหม่ Claude 2 ที่พัฒนาขึ้นจาก Claude เวอร์ชันแรก ทั้งในแง่ประสิทธิภาพและการให้คำตอบที่ยาวกว่าเดิม (สูงสุด 100,000 tokens เท่ากับว่าสามารถใส่หนังสือลงไปได้ทั้งเล่มเป็นอินพุต)

จุดเด่นของ Claude ตั้งแต่เวอร์ชันแรกที่คุยง่าย ให้คำตอบเข้าใจง่ายและปลอดภัย มีความจำยาวว่าคุยอะไรไปแล้วบ้าง ส่วน Claude 2 ปรับปรุงเรื่องการเขียนโค้ด คณิตศาสตร์ การให้เหตุผล โดย Anthropic เปรียบเทียบความสามารถของ Claude 2 ว่า

By lew Founder on Tag: Artificial Intelligence, LLM, Security
Artificial Intelligence

นักวิจัยจาก Mithril Security รายงานถึงความเป็นไปได้ที่คนร้ายจะสร้างโมเดลปัญญาประดิษฐ์มุ่งร้าย โดยเฉพาะในช่วงหลังที่ปัญญาประดิษฐ์กลุ่ม LLM แบบโอเพนซอร์สมีจำนวนมาก และมีการนำไปใช้งานหลากหลาย

รายงานสาธิตการดัดแปลงโมเดล GPT-J-6B ด้วยเทคนิค Rank-One Model Editing (ROME) ที่รายงานออกมาเมื่อปีที่แล้ว โดยคนร้ายสามารถกำหนด prompt บางประเภทที่ต้องการคำตอบที่ต้องการ แล้วฝึกโมเดลเพื่อใส่คำตอบอย่างเจาะจง

By arjin Writer on Tag: Alibaba Cloud, Artificial Intelligence, LLM
Alibaba Cloud

Alibaba Cloud บริษัทในเครือ Alibaba ที่ดูแลธุรกิจบริการคลาวด์ เปิดตัว Tongyi Wanxiang เครื่องมือสร้างรูปภาพด้วย AI โดยตอนนี้ทดสอบในสถานะเบต้าสำหรับลูกค้าองค์กรก่อน

Tongyi Wanxiang รองรับอินพุททั้งภาษาจีนและภาษาอังกฤษ สามารถพรอมต์คีย์เวิร์ดที่ต้องการได้หลากหลาย รวมทั้งโมเดลยังสามารถแปลงรูปภาพเดิมให้เป็นรูปภาพใหม่ที่อาศัยโครงเดิมตามรายละเอียดคำสั่งได้อีกด้วย

By lew Founder on Tag: Singapore, Microsoft, OpenAI, LLM
Singapore

IHiS สำนักงานให้บริการด้านไอทีสำหรับองค์กรด้านสาธารณสุขของรัฐบาลสิงคโปร์ ทำข้อตกลงกับไมโครซอฟท์ร่วมสร้าง Secure GPT บริการแบบเดียวกับ ChatGPT แต่เน้นงานด้านสาธารณสุขเป็นหลัก

ฟีเจอร์ของ Secure GPT แบ่งออกเป็นสองส่วน คือส่วนสำหรับบุคลากรทางการแพทย์เข้าใช้งาน บุคลากรจะสามารถนสอบถามข้อมูลการปฎิบัติงาน เช่น แนวทางการดูแลผู้ป่วยเบาหวาน หรืออาจจะขอให้สรุปประวัติการรักษาของคนไข้ ส่วนที่สองเป็นเครื่องมือสำหรับพัฒนาแอปพลิเคชั่นอื่นๆ ต่อไปในอนาคต เช่น ไลบรารีพรอมต์สำหรับการใช้งานด้านต่างๆ, การเชื่อมต่อ API ให้กับ Generative AI มาค้นข้อมูลต่อไป

OpenAI

นักเขียนนิยาย 2 คนคือ Mona Awad และ Paul Tremblay ยื่นฟ้อง OpenAI ในข้อหานำนิยายไปใช้เทรนโมเดลโดยไม่ได้รับคำอนุญาต

นักเขียนทั้งสองคนระบุในคำฟ้องว่า ChatGPT สามารถสรุปเนื้อหาในนิยายของพวกเขาออกมาได้อย่างแม่นยำ (ตัวอย่างจากในคำฟ้อง) จึงเชื่อว่านิยายถูกนำไปใช้เทรนโมเดล และกลายเป็น OpenAI ได้รับผลประโยชน์อย่างไม่เป็นธรรมต่อผู้สร้างเนื้อหา ซึ่งได้รับความคุ้มครองตามกฎหมายลิขสิทธิ์อยู่แล้ว

By arjin Writer on Tag: ChatGPT, OpenAI, Bing, Google, LLM, Analyst
ChatGPT

มีรายงานโดยอ้างบทวิเคราะห์จาก Bank of America Securities พูดถึงกระแสของ ChatGPT ที่อาจลดลง ซึ่งข้อมูลจาก Sensor Tower พบว่าจำนวนการดาวน์โหลดแอป ChatGPT ใน iPhone ลดลง 38% ในเดือนมิถุนายน เมื่อเทียบกับตัวเลขเดือนพฤษภาคม ส่วนแอป Bing ซึ่งรองรับการใช้แชตบอทพื้นฐาน ChatGPT เช่นกัน ก็มีตัวเลขการดาวน์โหลดลง 38% ในเดือนมิถุนายน

เมื่อดูส่วนแบ่งตลาดของเสิร์ชเอ็นจิน พบว่าเดือนมิถุนายน Google มีส่วนแบ่งเพิ่มขึ้นมาเป็น 92% ส่วน Bing ของไมโครซอฟท์ลดลงเล็กน้อย โดยตอนนี้มีส่วนแบ่งที่ประมาณ 2.8%

By lew Founder on Tag: MDN, LLM, ChatGPT
MDN

สัปดาห์ที่ผ่านมา MDN เว็บคลังเอกสารสำหรับนักพัฒนาเว็บ เปิดฟีเจอร์ AI Help สำหรับการถามตอบข้อมูลจากเอกสารในเว็บ และ AI Explain สำหรับอธิบายโค้ด โดยใช้ API จาก OpenAI ในการประมวลผล ตอนนี้เหล่านักพัฒนาก็กำลังโวยว่าฟีเจอร์นี้สร้างความเข้าใจผิด อธิบายเนื้อหาผิดพลาด หรือหากสร้างตัวอย่างได้ก็มักเป็นตัวอย่างง่ายๆ เท่านั้น

นักพัฒนาหลายคนยกตัวอย่าง คำอธิบายของ AI Help ที่ตอบผิด บางฟีเจอร์เป็นฟังก์ชั่นมาตรฐานของ CSS แต่ AI ก็ตอบว่าไม่ใช่มาตรฐาน บางทีก็ตอบตรงข้ามกับเนื้อหาในเอกสารไปเลย

By lew Founder on Tag: Salesforce, Artificial Intelligence, LLM
Salesforce

Salesforce AI Research ประกาศผลงานการฝึกปัญญาประดิษฐ์ XGen-7B เป็นปัญญาประดิษฐ์แบบโอเพนซอร์สที่สามารถใช้งานได้อิสระ โดยชูจุดเด่นที่คุณภาพสูงเหนือปัญญาประดิษฐ์ในกลุ่มโอเพนซอร์สด้วยกัน เช่น MPT-7B หรือ Falcon-7B

XGen-7B เทรนบนชิป TPU-v4 ของ Google Cloud ต้นทุนต่อการเทรนด้วยข้อมูล 1 ล้านล้านโทเค็นอยู่ที่ 150,000 ดอลลาร์

By lew Founder on Tag: Artificial Intelligence, LLM, NVIDIA, Intel, CoreWeave
Artificial Intelligence

MLCommons หน่วยงานกลางสำหรับการจัดอันดับประสิทธิภาพคอมพิวเตอร์ในงานด้าน machine learning ประกาศผล MLPerf Training 3.0 แสดงประสิทธิภาพของการฝึกโมเดลปัญญาประดิษฐ์รูปแบบต่างๆ มีผู้ส่งระบบเข้าร่วม 250 ระบบ จากผู้ผลิตหรือคลาวด์รวม 16 ราย ภาพรวมแล้วระบบต่างๆ เร็วขึ้นกว่าการทดสอบรอบก่อนหน้านี้ 1.54 เท่าตัว ความพิเศษของรอบนี้คือมีการทดสอบฝึก GPT-3 เข้ามาด้วย เพื่อดูประสิทธิภาพของการฝึก LLM และรอบนี้มีเฉพาะ NVIDIA และ Intel เท่านั้นที่ส่งผลเข้ามา

By lew Founder on Tag: Baidu, LLM
Baidu

Baidu ประกาศว่าเริ่มปล่อย ERNIE 3.5 ปัญญาประดิษฐ์ภาษาขนาดใหญ่ (LLM) ให้ผู้ได้รับสิทธิ์ทดสอบได้เริ่มใช้งานแล้ว โดยผลทดสอบ AGIEval ของไมโครซอฟท์ และ C-EVAL ของนักวิจัยจีนแสดงให้เห็นว่า ERNIE 3.5 เริ่มมีประสิทธิภาพใกล้เคียง ChatGPT ที่ใช้ GPT-3.5 และเมื่อแยกเฉพาะชุดทดสอบภาษาจีนเอง ERNIE 3.5 ทำคะแนนทดสอบได้ดีกว่า GPT-4

By arjin Writer on Tag: DeepMind, Artificial Intelligence, LLM, Chatbot, Google, Gemini
DeepMind

Demis Hassabis ผู้ร่วมก่อตั้งและซีอีโอ DeepMind ให้ข้อมูลล่าสุดของโมเดล AI ที่ชื่อ Gemini ซึ่งตอนนี้อยู่ในขั้นตอนการพัฒนา และเป็นโมเดลแบบ Large Language ประเภทเดียวกับ GPT-4 ของ OpenAI ที่ปัจจุบันเป็น AI เบื้องหลังแชทบอต ChatGPT

By lew Founder on Tag: Databricks, Artificial Intelligence, LLM
Databricks

Databricks ผู้ให้บริการแพลตฟอร์มข้อมูล เข้าซื้อบริษัท MosaicML แพลตฟอร์มการเทรนและรันโมเดลปัญญาประดิษฐ์ ผู้สร้างโมเดลโอเพนซอร์ส MPT-7B และ MPT-30B ที่สามารถใช้งานในองค์กรได้

ซอฟต์แวร์ของ MosaicML ช่วยให้การฝึกปัญญาประดิษฐ์ขนาดใหญ่ใช้เวลาน้อยลง และรับมือกับปัญหาที่เกิดขึ้น เช่น บางเครื่องในระบบตายไประหว่างการฝึกได้ ทาง Databricks บอกแนวทางชัดเจนว่าจะใช้เทคโนโลยีของ MosaicML มารวมไว้ใน Databricks Lakehouse Platform เพื่อให้องค์กรสามารถฝึกโมเดลปัญญาประดิษฐ์ได้ด้วยตัวเอง

By arjin Writer on Tag: IBM, Wimbledon, Sport, LLM, Artificial Intelligence, Watson, Tennis
IBM

ไอบีเอ็มประกาศนำเทคโนโลยี Generative AI หรือ AI สร้างเนื้อหาอัตโนมัติจาก IBM watsonx มาใช้กับการแข่งขันเทนนิสวิมเบิลดัน ในการสร้างวิดีโอไฮไลท์การแข่งขันแต่ละแมตช์พร้อมเสียงพากย์ ซึ่งถือเป็นครั้งแรกในการแข่งขันเทนนิส

ในวิดีโอไฮไลท์ซึ่งสามารถรับชมได้ผ่านแอป Wimbledon หรือทางเว็บไซต์ wimbledon.com จะมีเสียงบรรยายในช่วงสำคัญของการแข่งขัน พร้อมกับตัวหนังสือคำบรรยาย ซึ่งผู้ชมสามารถเลือกปิด-เปิดส่วนนี้ได้ ทั้งนี้ส่วนไฮไลท์ที่สร้างด้วย AI จะเป็นส่วนเสริมเข้ามา โดยไฮไลท์แบบเดิมที่ใช้คนบรรยายของ Show Courts จะยังมีอยู่เหมือนเดิม

By lew Founder on Tag: Mercedes-Benz, LLM, OpenAI, Microsoft Azure, ChatGPT
Mercedes-Benz

Mercedes-Benz ประกาศเพิ่มฟีเจอร์ของ MBUX Voice Assistant ผู้ช่วยสั่งงานในรถด้วยเสียง ให้ใช้ความสามารถของ ChatGPT เพิ่มเข้ามาเพื่อรองรับคำสั่งที่หลากหลายกว่าเดิม

MBUX Voice Assistant เป็นผู้ช่วยในรถที่เรียกใช้ด้วยคำสั่ง “Hey Mercedes” โดยปกติแล้วผู้ช่วยในกลุ่มนี้ก็มักรับคำสั่งได้จำกัดตามที่ออกแบบไว้ แต่การใช้ ChatGPT เข้ามาจะช่วยให้ผู้ใช้ถามคำถามที่ซับซ้อนกว่าเดิม รวมถึงการขอรายละเอียดจุดหมายปลายทาง หรือการถามนอกเรื่องอย่างสูตรอาหาร

ทาง Mercedes-Benz ใช้โมเดลของ OpenAI ผ่านทาง Azure OpenAI Service ส่วนข้อมูลเสียงจะเก็บรักษาโดย Mercedes-Benz เอง

By lew Founder on Tag: OpenAI, LLM
OpenAI

OpenAI เปิดโมเดล GPT-3.5 (ChatGPT) และ GPT-4 เวอร์ชั่น 0613 ของเดือนนี้ โดยมีฟีเจอร์สำคัญคือการเปิดให้โมเดลสามารถร้องของข้อมูลภายนอกจากฟังก์ชั่นที่เรากำหนดให้ได้ ผ่านทาง Chat Completion API

นักพัฒนาต้องกำหนดข้อมูลฟังก์ชั่นที่ต้องการเรียกส่งไปพร้อมกับคำถามของผู้ใช้ เช่น กำหนดฟังก์ชั่นคิวรีสภาพอากาศปัจจุบัน เมื่อผู้ใช้ถามถึงสภาพอากาศ ค่าตอบกลับจาก Chat Completion API จะระบุว่า AI ต้องการเรียกฟังก์ชั่น แล้วนำอาร์กิวเมนต์ต่างๆ มารันฟังก์ชั่นแล้วส่งข้อมูลกลับไปให้ AI ตอบคำถามอีกทีหนึ่ง

By arjin Writer on Tag: Amazon, Artificial Intelligence, LLM
Amazon

Amazon เริ่มขยับสู่วงการ AI สร้างเนื้อหาหรือ Generative AI แล้ว โดยบริษัทเริ่มทดสอบฟีเจอร์ใหม่ในแอป นำ AI มาเขียนสรุปรีวิวที่ผู้ใช้งานเขียนรีวิวให้บางสินค้า เนื้อหาสรุปนี้ทำให้เห็นภาพรวมของสินค้า และ Amazon จะขึ้นข้อความกำกับด้วยว่าเป็นเนื้อหาที่ใช้ AI สรุปรีวิวอีกที

ส่วนการสรุปรีวิวนี้ทำให้ลูกค้าที่กำลังพิจารณาสินค้าอยู่ ไม่ต้องไล่อ่านทีละรีวิวทั้งหมด เพราะ AI จะสรุปมาให้เลยว่าลูกค้าส่วนใหญ่ชอบอะไร และเขียนรีวิวแง่ลบด้านใดบ้าง

By lew Founder on Tag: Artificial Intelligence, LLM, Open Source
Artificial Intelligence

Together บริษัทปัญญาประดิษฐ์ เปิดตัวโมเดลปัญญาประดิษฐ์ RedPajama 7B โมเดล LLM ขนาดเล็กที่มีคะแนนทดสอบชุดทดสอบ HELM เฉลี่ยสูงกว่า LLaMA ของ Meta และยังเปิดไลเซนส์ให้ใช้งานแบบ Apache 2.0 ที่ใช้งานได้ค่อนข้างอิสระ

ก่อนหน้านี้โมเดลปัญญาประดิษฐ์ขนาดใกล้เคียงกันที่เปิดให้ใช้งานได้อิสระมีมาแล้วหลายตัว เช่น MPT-7B หรือ Falcon 7B แต่โมเดลเหล่านี้ก็ยังทำคะแนนทดสอบสู้ LLaMA ของ Meta ที่ปล่อยออกมาให้ใช้สำหรับงานวิจัยเท่านั้นไม่ได้

Subscribe to LLM