Image

Large Language Model

By arjin Writer on Tag: Meta, Artificial Intelligence, LLM
Meta

มีรายงานจาก The Wall Street Journal พูดถึงแผนการพัฒนา AI ผู้ช่วยตัวใหม่ของ Meta บริษัทแม่ของ Facebook และ Instagram โดยมีเป้าหมายให้ความสามารถสูงกว่าโมเดล Llama 2 ที่เปิดตัวเมื่อสองเดือนที่แล้ว และสามารถแข่งขันกับ GPT-4 ของ OpenAI ได้

By arjin Writer on Tag: Ant Group, LLM, Artificial Intelligence, FinTech
Ant Group

กลุ่มฟินเทค Ant Group เปิดตัวโมเดล AI สร้างเนื้อหาหรือ Generative AI สำหรับสายการเงินโดยเฉพาะ ซึ่ง Ant เรียกว่า Financial LLM โดยมาพร้อมกับแอพพลิเคชันทางการเงินที่ใช้โมเดลดังกล่าวคือ Zhixiaobao 2.0 ผู้ช่วยทางการเงินสำหรับลูกค้าบุคคล และ Zhixiaozhu 1.0 ผู้ช่วยทางการเงินสำหรับลูกค้าสถาบันการเงิน

โดย Zhixiaobao 2.0 จะเข้ามาช่วยทั้งการแนะนำการจัดพอร์ตการลงทุน การกระจายสินทรัพย์ลงทุน ตลอดจนให้ความรู้ทางการเงิน ขณะที่ Zhixiaozhu 1.0 จะมาช่วยในงานการเป็นที่ปรึกษาการลงทุน อ่านบทวิเคราะห์การลงทุน ประเมินโอกาสทางการลงทุน และช่วยสร้างเนื้อหาบทวิเคราะห์

By arjin Writer on Tag: Apple, Artificial Intelligence, LLM, Rumors, Chatbot
Apple

The Information มีรายงานล่าสุดเกี่ยวกับโครงการพัฒนาแชตบอท AI ของแอปเปิล ที่ใช้งานกันภายในบริษัท ซึ่งมีชื่อเล่นว่า Ajax GPT บอกว่าตอนนี้โครงการใช้เงินระดับ__หลายล้านดอลลาร์__ต่อวัน ในการพัฒนาและเทรนโมเดล ขนาดมากกว่า 2 แสนล้านพารามิเตอร์

โมเดลที่พัฒนาตอนนี้มีคำเรียกภายในว่า Foundational Models มีทีมงานประมาณ 16 คน บางคนเป็นอดีตวิศวกรของกูเกิล โดย John Giannandrea รองประธานอาวุโสดูแลด้าน AI เป็นผู้ดูแลทีมนี้ (ซึ่งเขาก็เคยทำงานกูเกิล)

By tontan Contributor on Tag: LLM, Artificial Intelligence, Open Source
LLM

TII (หรือ Technology Innovation Institute) เป็นสถาบันเทคโนโลยีของอาบูดาบี ได้เปิดตัวโมเดล Falcon ที่ขนาด 180 พันล้านพารามิเตอร์ ในชื่อ Falcon 180B ที่ถูกฝึกบนชุดข้อมูลกว่า 3.5 ล้านล้านโทเคน (จำนวนหน่วยย่อยของคำในทางงานประมวลผลภาษาธรรมชาติ) บนการ์ดจอ 4,096 ตัว ด้วยเวลาประมาณ 7,000,000 ชั่วโมงของการ์ดจอ หลังจากที่เคยเปิดตัว Falcon 40B มาก่อนโดน Llama 2 แซงในเวลาต่อมาด้วยขนาด 70 พันล้านพารามิเตอร์ที่ใหญ่กว่า

By lew Founder on Tag: Baidu, LLM
Baidu

Baidu เปิดตัว ERNIE ปัญญาประดิษฐ์ภาษาขนาดใหญ่ (LLM) ที่เน้นภาษาจีนให้คนทั่วไปใช้งาน หลังจากจำกัดการใช้งานเฉพาะบริษัทที่ได้รับสิทธิ์ทดลองเท่านั้น และตอนนี้แอป Ernie ก็กลายเป็นแอปยอดนิยมในจีนอย่างรวดเร็ว

ผู้ใช้ ERNIE ต้องลงทะเบียนด้วยหมายเลขประจำตัวประชาชนเท่านั้นและตัวแชตบอตเตือนผู้ใช้ว่าหากพยายามคุยประเด็นอ่อนไหวหรือมีความเสี่ยงทางกฎหมายนั้นผู้ใช้จะเป็นผู้รับผิดชอบเอง

Google Cloud

Google Cloud มีบริการเช่ารันโมเดล AI ชื่อ Vertex AI ที่ให้บริการมาสักระยะหนึ่งแล้ว และเปิดบริการโมเดล Generative AI เมื่อเดือนพฤษภาคมที่ผ่านมา โดยมีทั้งโมเดลของกูเกิลเอง และโมเดลจากบริษัทอื่นด้วย กูเกิลเรียกบริการนี้ว่า Model Garden

ล่าสุดในงาน Google Cloud Next '23 เมื่อคืนนี้ กูเกิลประกาศเพิ่มโมเดลของพาร์ทเนอร์อีกหลายตัว ได้แก่

By arjin Writer on Tag: Google Meet, Google Workspace, Artificial Intelligence, LLM
Google Meet

กูเกิลประกาศว่าบริการ Duet AI ที่นำความสามารถของ Generative AI มาใช้กับบริการของ Google Workspace ตอนนี้เปิดให้สำหรับผู้ใช้งานทุกคนแล้ว

ในประกาศนี้กูเกิลยังนำ Duet AI มาใส่ใน Google Meet โดยนอกจากระบบจัดการภาพและเสียง ยังมีฟีเจอร์อื่นดังนี้

By arjin Writer on Tag: Google Chat, Google Workspace, Artificial Intelligence, LLM
Google Chat

นอกจาก Google Meet กูเกิลยังประกาศนำความสามารถด้าน Generative AI ของ Duet AI มาเพิ่มในบริการ Google Chat ด้วยเช่นกัน

โดย Google Chat จะทำงานโดยมี Duet AI ทำหน้าที่เป็นแชทบอตหนึ่งในลิสต์สำหรับสนทนาโต้ตอบ ซึ่งมีความสามารถช่วยอัพเดต ค้นหาข้อมูล ตลอดจนให้คำแนะนำคำตอบ ผ่านการค้นหาเนื้อหาจากข้อความในอดีต และไฟล์ในแพลตฟอร์ม Google Workspace ซึ่งจะช่วยให้การทำงานต่อเนื่องและมีประสิทธิภาพมากขึ้น

By arjin Writer on Tag: Yahoo!, LLM, Artificial Intelligence
Yahoo!

Yahoo Mail ประกาศเพิ่มความสามารถด้าน AI หลังจากทดสอบในสถานะเบต้ากับผู้ใช้ iOS ซึ่งตอนนี้ขยายมากลุ่มผู้ใช้งานผ่านเบราว์เซอร์ด้วย โดยมีฟีเจอร์เด่นรองรับการช้อปปิ้ง

ความสามารถใหม่ที่เพิ่มเข้ามาชื่อว่า Shopping Saver ซึ่งจะค้นหาโค้ดและบัตรของขวัญในอินบอกซ์ เพื่อดูว่ามีเครดิตส่วนไหนที่ยังไม่ได้ใช้ และจะแนะนำเมื่อร่างอีเมลเพื่อเตือนให้ใช้งานโค้ดส่วนนี้

นอกจากนี้ Yahoo Mail ยังเพิ่มและปรับปรุงความสามารถใหม่เกี่ยวกับ AI ซึ่งรองรับด้วยเทคโนโลยีของ Google Cloud เช่น ระบบเสิร์ชที่รองรับประโยคคำถาม ระบบแนะนำการเขียนอีเมลในฟอร์แมตที่ต้องการ และตัวช่วยสรุปเนื้อหาอีเมล

By lew Founder on Tag: Llama, Meta, Artificial Intelligence, LLM, Programming
Llama

Meta ปล่อย Code Llama โมเดลปัญญาประดิษฐ์ที่พัฒนาต่อจาก Llama2 มาฝึกกับซอร์สโค้ดขนาด 500 ล้านโทเค็น ได้โมเดลทั้งแบบเติมโค้ดปกติ, แบบรับคำสั่ง, และโมเดลฝึกเฉพาะกับโค้ด Python

ผลทดสอบการเขียนโค้ด HumanEval นั้น Code Llama ขนาด 34B ได้คะแนนดีกว่าโมเดลอื่นๆ ทั้งหมด รวมถึง GPT-3.5 หรือ ChatGPT ด้วย เป็นรองเพียง GPT-4 เท่านั้น ขณะที่โมเดลขนาดรองลงมา เช่น 7B และ 13B ก็ยังทำคะแนนได้ดีและตอบสนองเร็วกว่ามาก

By arjin Writer on Tag: OpenAI, ChatGPT, LLM, Artificial Intelligence
OpenAI

OpenAI ประกาศว่าความสามารถ Fine-tuning หรือการปรับแต่งค่าให้เข้ากับแต่ละ use cases สำหรับ GPT-3.5 Turbo ตอนนี้เปิดให้ใช้งานแล้ว ส่วน Fine-tuning ของ GPT-4 จะเปิดให้ใช้งานได้ในช่วงปลายปี

คุณสมบัติ Fine-tuning เป็นความสามารถสำคัญโดยเฉพาะการนำ ChatGPT ไปใช้ในภาคธุรกิจ เพื่อให้ AI ทำงานได้ตรงกับลักษณะงานที่ระบุ ทำให้บอทมีลักษณะเฉพาะตัวไม่เหมือนการใช้งานทั่วไป

By arjin Writer on Tag: IBM, LLM, Artificial Intelligence, Developer, COBOL, Watson
IBM

ไอบีเอ็มเปิดตัว IBM Watsonx Code Assistant for Z โซลูชัน AI สำหรับแปลโค้ดที่เขียนในภาษา COBOL ให้เป็น Java สำหรับเมนเฟรม IBM Z โดยจะเปิดให้ใช้งานทั่วไปภายในไตรมาสที่ 4 ปี 2023 ซึ่งเป็นส่วนหนึ่งของโครงการเปลี่ยนผ่านแอพพลิเคชัน COBOL ไปสู่โค้ดในภาษาปัจจุบันที่มีต้นทุนจัดการน้อยกว่า และทำได้รวดเร็วขึ้น

Watsonx Code Assistant for Z เป็นเครื่องมือที่สร้างจาก Watsonx.ai บริการสร้างโมเดลของแพลตฟอร์ม WatsonX ที่ตอนนี้มีความเข้าใจภาษาคอมพิวเตอร์ 115 ภาษา จากชุดข้อมูลมากกว่า 1.5 ล้านล้านโทเค็น

By mk Founder on Tag: NCSoft, LLM, Artificial Intelligence, Games
NCSoft

NCSoft บริษัทเกมรายใหญ่ของเกาหลีใต้ เจ้าของเกม Lineage และ Guild Wars เปิดตัวชุดเทคโนโลยีปัญญาประดิษฐ์ เป็นโมเดลภาษาขนาดใหญ่ LLM ชื่อ VARCO สำหรับช่วยสร้างเกม

VARCO ย่อมาจาก "Via AI, Realize your Creativity and Originality" ประกอบด้วยโมเดล 4 ตัวทำงาน 4 ด้านคือ Foundation, Prompt, Dialogue, Generative

งานที่ทำได้ตอนนี้มี 3 อย่างคือ

By lew Founder on Tag: Google, Security, Artificial Intelligence, LLM, Programming
Google

กูเกิลแสดงผลการทดลองใช้ปัญญาประดิษฐ์ในกลุ่ม Large Language Model (LLM) มาเขียนโค้ดยิงไลบรารีต่างๆ ภายใต้โครงการ OSS-Fuzz เพื่อหาช่องโหว่ซอฟต์แวร์

การทดสอบแบบ fuzzing ช่วยให้พบช่องโหว่แบบที่คนคิดไม่ถึงโดยเฉพาะช่องโหว่หน่วยความจำ ด้วยการอาศัยการยิงอินพุตแบบสุ่ม อย่างไรก็ดีโค้ดที่ใช้ทดสอบนั้นต้องเขียนด้วยมือทำให้ชุดทดสอบต่างๆ มักครอบคลุมโค้ดที่ต้องการทดสอบไม่มากนัก โดยเฉลี่ยครอบคลุมเพียง 30% เท่านั้น

By lew Founder on Tag: Chrome, LLM, Google, Google Search, Artificial Intelligence
Chrome

กูเกิลเพิ่มฟีเจอร์ปัญญาประดิษฐ์ในกลุ่ม Search Generative Experience (SGE) ที่ก่อนหน้านี้เป็นการสร้างคำตอบในการถามคำถามผ่านช่องค้นหา โดยฟีเจอร์สำคัญคือการถามตอบคำถามบนเว็บต่างๆ ชื่อว่า SGE while browsing

SGE while browsing ทำให้เบราว์เซอร์สามารถสรุปประเด็นสำคัญบนเว็บที่กำลังอ่านอยู่ พร้อมลิงก์ไปยังจุดต่างๆ บนเว็บ และยังแสดงคำถามตอบจากข้อมูลบนเว็บ ตอนนี้ฟีเจอร์นี้ยังเป็น Search Lab และเปิดใช้ได้ใน Android และ iOS ก่อน ส่วนเดสก์ทอปจะมาภายหลัง

By arjin Writer on Tag: Amazon, Artificial Intelligence, LLM
Amazon

Amazon ประกาศปรับปรุงการแสดงข้อมูลรีวิวสินค้า โดยเพิ่มตัวเลือกนำ AI มาช่วยเขียนสรุปรายละเอียดสินค้า จากรีวิวทั้งหมด ทำให้เห็นภาพรวมว่าคนชอบหรือไม่ชอบสินค้านั้นอย่างไรบ้าง ตามที่ Amazon เคยให้ข่าวก่อนหน้า

ความสามารถใหม่นี้ Amazon บอกว่า เริ่มใช้งานแล้วสำหรับผู้ใช้งานในอเมริกา ผ่านแอปมือถือกลุ่มหนึ่ง เนื้อหาสรุปรีวิวสินค้าที่สร้างด้วย AI ยังระบุตอนท้ายเป็นข้อ ๆ ถึงจุดเด่นที่ผู้รีวิวจำนวนมากพูดถึง และสามารถกดเลือกเพื่อฟิลเตอร์ดูรีวิวที่ให้ข้อมูลด้านนั้น ๆ เพิ่มเติมได้

By mk Founder on Tag: Claude, Anthropic, Artificial Intelligence, LLM
Claude

แนวทางของโมเดลภาษาขนาดใหญ่เมื่อปีที่แล้ว เน้นแข่งขนาดกันใหญ่ขึ้นเรื่อยๆ แต่เทรนด์ของปีนี้มุ่งไปทางโมเดลที่ขนาดเล็กลง โดยคุณภาพของคำตอบที่ได้นั้นไม่ด้อยลงมากนัก

Anthropic บริษัท AI ที่ก่อตั้งโดยอดีตทีมงาน OpenAI เพิ่งเปิดตัวโมเดลเรือธง Claude 2 ไปเมื่อเดือนที่แล้ว แต่ในอีกทางยังมีโมเดลรุ่นเล็กชื่อ Claude Instant ที่ล่าสุดออกเวอร์ชัน 1.2 มีคุณภาพดีขึ้นจากเวอร์ชัน 1.1 ที่ออกมาก่อนหน้า

By mk Founder on Tag: Alibaba Cloud, LLM, Artificial Intelligence, Open Source
Alibaba Cloud

Alibaba Cloud เปิดซอร์สโค้ดของโมเดลภาษาขนาดใหญ่ (LLM) ชื่อ Tongyi Qianwen ที่เคยเปิดตัวครั้งแรกเมื่อเดือนเมษายน 2023 ออกสู่สาธารณะ

โมเดลที่เปิดซอร์สโค้ดออกมายังมีเฉพาะรุ่นเล็ก Qianwen-7B และ Qianwen-7B-Chat ขนาด 7 พันล้านพารามิเตอร์ รองรับบทสนทนาขนาดยาว 8K, คลังคำศัพท์ 150K tokens (Qianwen ตัวเต็มมีขนาดใหญ่ถึง 10 ล้านล้านพารามิเตอร์ และถูกใช้กับบ็อตสนทนาของ Alibaba เอง เช่น DingTalk หรือ Tmall Genie)

By lew Founder on Tag: Stability AI, LLM, Artificial Intelligence, Programming
Stability AI

Stability.AI บริษัทปัญญาประดิษฐ์โอเพนซอร์สเปิดตัว StableCode ปัญญาประดิษฐ์ช่วยเขียนโค้ด สามารถดาวน์โหลดมาใช้งานได้ในเครื่องตัวเอง

StableCode มีสามเวอร์ชั่น ได้แก่

By lew Founder on Tag: Kakao Corp, Kakao Talk, South Korea, SM Entertainment, LLM
Kakao Corp

Kakao ผู้ให้บริการแอปแชต KakaoTalk แถลงผลประกอบการประจำปีพร้อมกับพูดถึงการพัฒนาปัญญาประดิษฐ์ KoGPT ที่กำลังพัฒนาโดยบริษัทลูก Kakao Brain ว่ายังเดินหน้าตามกำหนด

แม้จะไม่บอกกำหนดการณ์ชัดเจนว่าจะเริ่มใช้งาน KoGPT ได้เมื่อใด แต่ก็ระบุว่าน่าจะหลังจากเดือนตุลาคมนี้ ฟีเจอร์แรกๆ ที่อาจจะนำมาใช้งานคือการสรุปแชต โดย Kakao ระบุว่าโมเดลที่นำมาใช้งานต้อง มีต้นทุนการรันต่ำพอ, ความเร็วดี, ข้อมูลอัพเดต, และตอบคำถามได้แม่นยำพอ และบริษัทกำลังพยายามเลือกโมเดลที่ตอบโจทย์ทุกข้อ โดยเลือกโมเดลตั้งแต่ขนาด 6 พันล้านพารามิเตอร์ไปจนถึง 65 พันล้านพารามิเตอร์

Subscribe to LLM