Large Language Model

Tags:
Node Thumbnail

LangChain เปิดตัวเฟรมเวิร์กเวอร์ชัน 0.1.0 แล้ว หลังจากพัฒนามา 1 ปี

LangChain เป็นเฟรมเวิร์กโอเพนซอร์สยอดนิยมที่ออกแบบมาเพื่อช่วยสร้างแอปที่ใช้ LLM โดยเวอร์ชันนี้จะมีทั้ง Python และ JavaScript ซึ่งเป็นการปรับปรุงและเพิ่มความสามารถต่าง ๆ ดังนี้

Tags:
Node Thumbnail

DeepLearning.AI แพลตฟอร์มการเรียนรู้ AI และ Deep Learning ที่ก่อตั้งโดย Andrew Ng เปิดตัวหลักสูตรระยะสั้น Generative AI ในภาษา JavaScript ฟรีในช่วงเวลาจำกัด สอนการสร้างแอป LLM ด้วย LangChain โดย Jacob Lee วิศวกรซอฟต์แวร์ผู้ก่อตั้งและหัวหน้าผู้ดูแลโครงการ LangChain.js ใช้เวลาเรียน 1 ชม. เหมาะสำหรับนักพัฒนาเว็บที่มีพื้นฐานเกี่ยวกับ JavaScript ระดับกลาง

Tags:
Node Thumbnail

Parag Agrawal อดีตซีอีโอเชื้อสายอินเดียของ Twitter ที่ลงจากตำแหน่ง หลัง Elon Musk ซื้อกิจการแล้วปลดออกเป็นคนแรก หลังจากนั้นเขาก็เงียบหายไปเลย (โพสต์สุดท้ายในบัญชีทวิตเตอร์ @paraga เมื่อเดือนตุลาคม 2022)

ล่าสุดเว็บไซต์ Information รายงานว่า Parag กำลังตั้งบริษัทสตาร์ตอัพด้าน AI โดยหาเงินทุนก้อนแรกมูลค่า 30 ล้านดอลลาร์ได้แล้ว จากกลุ่มนักลงทุนที่มี Khosla Ventures เป็นนักลงทุนหลัก

ตอนนี้ยังไม่มีข้อมูลชื่อบริษัทใหม่ของ Parag ว่าชื่ออะไร รู้แค่ว่าเป็นบริษัททำเกี่ยวกับ large language model (LLM)

Tags:
Node Thumbnail

OpenAI ออกมาเขียนบล็อกชี้แจงกรณี The New York Times (NYT) ยื่นฟ้องละเมิดลิขสิทธิ์ โดยระบุว่าเป็นบั๊กที่เกิดได้ยากแล้ว และกำลังแก้ไขให้ไม่มีเหตุการณ์แบบนี้อีก พร้อมกับยืนยันว่าต้องการเป็นพันธมิตรกับสำนักข่าวต่างๆ

Tags:
Node Thumbnail

หลัง Google เปิดตัว Gemini 1.0 โดยมี 3 เวอร์ชันคือ Nano ที่ใช้ใน Pixel แล้ว, Pro ที่ใช้ใน Bard และ Ultra ที่กำลังจะใช้บน Bard Advanced และจะเปิดตัวในปีนี้

ล่าสุดมีนักพัฒนาค้นพบว่า Bard Advanced จะเป็นแบบเสียเงิน (แบบเดียวกับ GPT Plus) โดยจะผูกอยู่กับบริการ Google One ซึ่งช่วงแรกจะเป็นการให้ทดลองใช้ฟรี 3 เดือน

ที่มา - @bedros_p, @evowizz

Tags:
Node Thumbnail

Wang Haifeng ซีทีโอ Baidu เปิดเผยว่าแชทบอต ERNIE ตอนนี้มีผู้ใช้งานรวมมากกว่า 100 ล้านบัญชีแล้ว หลังจาก ERNIE เปิดให้ใช้งานแบบสาธารณะตั้งแต่ต้นเดือนกันยายนที่ผ่านมา

Baidu เปิดตัว ERNIE มาตั้งแต่เดือนมีนาคม ซึ่งเป็นเวลาไม่นานหลังจากกระแส ChatGPT ของ OpenAI มีมากขึ้น ในช่วงแรก Baidu ยังเปิดให้ใช้งาน ERNIE แบบทดสอบจำกัดกลุ่มเฉพาะบริษัทที่ได้รับอนุญาต เนื่องจากกระแสตอบรับมีสูงมาก

Tags:
Node Thumbnail

หนังสือพิมพ์ The New York Times (NYT) ยื่นฟ้องไมโครซอฟท์และ OpenAI ฐานใช้งานบทความของหนังสือพิมพ์โดยไม่ได้รับอนุญาต ทั้งการใช้งานไปในชุดข้อมูลสำหรับฝึก LLM และตัว ChatGPT/Copilot เองก็ตอบบทความแทบทั้งบทความของ NYT ออกมาให้ผู้ใช้ได้

Tags:
Node Thumbnail

แอปเปิลเผยแพร่ Ferret โมเดล AI ภาษาขนาดใหญ่บนข้อมูลสื่อผสม (Multimodal Large Language Model - MLLM) ใน GitHub ซึ่งพบว่าปล่อยออกมาตั้งแต่ 30 ตุลาคม แต่เพิ่งถูกพบและรายงานข่าวออกมา

Ferret มีจุดเด่นคือความสามารถการแยกข้อมูลภาพในรูปทรง-พื้นที่ใดก็ได้ แล้วให้รายละเอียดเจาะเฉพาะส่วนที่เห็น ตัวอย่างที่นำเสนอ เช่น สามารถระบุพื้นที่หางแมวได้ หรือรูปที่มีสัตว์ 2 ตัวซ้อนกัน ก็แยกตัวที่ 1 กับตัวที่ 2 ได้

Tags:
Node Thumbnail

แอปเปิลเผยแพร่งานวิจัยสองฉบับผ่าน arXiv ซึ่งเป็นงานวิจัยเกี่ยวกับเทคนิคการประมวลผล AI ที่อาจถูกนำมาใช้งานกับผลิตภัณฑ์ของแอปเปิลได้ในอนาคต

งานวิจัยแรกชื่อว่า "LLM in a flash" เป็นวิธีการทำให้อุปกรณ์ซึ่งมีหน่วยความจำจำกัด เช่น สมาร์ทโฟน สามารถรันโมเดล AI LLM ที่มีพารามิเตอร์จำนวนมากได้ โดยใช้สองเทคนิคคือ windowing ใช้งานซ้ำ AI ที่ประมวลผลไปแล้วแทนที่จะต้องใช้ข้อมูลใหม่อีกรอบ และวิธี row-column bundling ใช้การอ่านข้อมูลเป็นส่วน ๆ แทนที่จะอ่านทีละคำ ซึ่งเหมาะสำหรับงาน LLM อยู่แล้ว ผลลัพธ์ที่ได้ทำให้สามารถรัน AI LLM ที่ต้องการหน่วยความจำได้สูงถึง 2 เท่า ของหน่วยความจำที่มีอยู่

Tags:
Node Thumbnail

SCB 10X เปิดตัว Typhoon-7b เป็นโมเดลสร้างข้อความ หรือ LLM ภาษาไทยที่เอาชนะโมเดลทุกตัวในภาษาไทยตอนนี้ และมีประสิทธิภาพเทียบเท่ากับ GPT-3.5 ในภาษาไทย

การวัดผลประสิทธิภาพของโมเดลในภาษาไทย ทาง SCB 10X ได้พัฒนาชุดทดสอบวัดผลประสิทธิภาพโมเดล LLM ภาษาไทยชื่อ ThaiExam โดยวัดด้วยข้อสอบสำหรับเด็กมัธยมศึกษาตอนปลายและข้อมูลด้านการลงทุนจากผู้เชี่ยวชาญด้านการลงทุนในประเทศไทย พบว่าประสิทธิภาพโมเดล Typhoon-7b เหนือกว่าทุกโมเดลที่ปล่อยฟรีในภาษาไทยและมีคะแนนเทียบเท่ากับ GPT-3.5

Tags:
Node Thumbnail

OpenAI แบนบัญชีของบริษัท ByteDance หลังมีรายงานว่าทาง ByteDance เอาเอาท์พุตของ OpenAI ไปฝึกปัญญาประดิษฐ์ของตัวเอง

เหตุการณ์ครั้งนี้รายงานโดย Alex Heath จาก The Verge ชี้ว่า ByteDance ฝึก LLM ของตัวเองที่ชื่อ Project Seed ด้วยเอาท์พุตของ OpenAI แม้ภายหลังจะเลิกใช้เอาท์พุตไปฝึกโมเดลโดยตรง แต่ก็ยังใช้สำหรับการวัดคุณภาพของโมเดลตัวเองอยู่

ทาง OpenAI ออกมายืนยันว่าได้แบนบัญชีของ ByteDance ไว้ชั่วคราวระหว่างสอบสวน แต่ที่จริงแล้ว ByteDance เรียก API ของ OpenAI ผ่านทาง Microsoft Azure และยังไม่แน่ชัดว่าไมโครซอฟท์แบนบัญชีของ ByteDance ไปหรือยัง

Tags:
Node Thumbnail

Mozilla Innovation Project เปิดโครงการ llamafile โครงการแพ็กโมเดลปัญญาประดิษฐ์สำเร็จรูป ทำให้รันโมเดลต่างๆ ได้โดยง่าย เป็นไฟล์ไบนารีไฟล์เดียวก็รันได้เลย

ก่อนหน้านี้มีโครงการจำนวนมากที่พยายามนำโมเดล LLM มารันบนเดสก์ทอปอยู่แล้ว เช่น โครงการ llama.cpp แต่ก็ยังต้องอาศัยการคอนฟิกพอสมควร llamafile ทำให้การใช้งานสะดวกขึ้นอีกขั้น โดยอาศัยโครงการ Cosmopolitan Libc มาแพ็กไฟล์ต่างๆ เข้าด้วยกันให้รันได้ทุกที่

ตอนนี้มีโมเดลที่รองรับแล้ว ได้แก่ LLaVA 1.5, Mistral 7B, Mixtral 8x7B, และ WizardCoder-Python 13B

Tags:
Node Thumbnail

Google DeepMind เผยแพร่งานวิจัยในวารสาร Nature ถึงขั้นตอนการค้นหาวิธีแก้ปัญหาด้านคณิตศาสตร์และวิทยาการคอมพิวเตอร์แบบใหม่ เรียกชื่อว่า FunSearch ซึ่งมาจากคำว่า Function+Search มีจุดเด่นคือพื้นฐานทำงานเป็น AI แบบ LLM ที่ถูกเทรนมาก่อน แล้วหาวิธีแก้ปัญหาร่วมกับโค้ดคอมพิวเตอร์ ที่ทำหน้าที่ตรวจสอบความถูกต้องอีกหนึ่งชั้น เพื่อป้องกันการให้คำตอบที่ผิด

ผลลัพธ์ที่ได้คือฟังก์ชัน ในรูปแบบโค้ดคอมพิวเตอร์ แต่มาพร้อมกับวิธีคิดรูปแบบใหม่ ๆ จากกระบวนการของ LLM

ตัวอย่างที่งานวิจัยนี้นำเสนอคือใช้ FunSearch หาอัลกอริทึมของปัญหาการบรรจุกล่องสินค้าในปริมาตรที่กำหนดหรือ Bin Packing Problem

Tags:
Node Thumbnail

สหภาพยุโรปเตรียมออกกฎหมายควบคุมปัญญาประดิษฐ์หลังรัฐสภายุโรป (European Parliament) บรรลุข้อตกลงกับคณะมนตรียุโรป (European Council) ว่าจะผ่านกฎหมายควบคุมปัญญาประดิษฐ์ โดยกฎหมายนี้ควบคุมการใช้งานตามระดับความเสี่ยง โดยแบ่งเป็น 3 ระดับ ได้แก่

Tags:
Node Thumbnail

Mozilla เปิดตัวโครงการใหม่เป็นเครื่องมือสำหรับสร้างเว็บไซต์ด้วย AI มีชื่อว่า Solo เน้นเจาะกลุ่มฟรีแลนซ์ และผู้ประกอบการธุรกิจแบบคนเดียวที่เรียกว่า Solopreneur ทำให้ลดเวลาและขั้นตอนการทำงานได้หลายอย่าง หากต้องการมีเว็บไซต์ธุรกิจ-บริการของตนเอง

Mozilla บอกว่าที่ต้องใช้ AI เพราะแม้ขั้นตอนการสร้างเว็บไซต์ตอนนี้จะง่ายขึ้น มีเทมเพลต มีเครื่องมือคัดรูปภาพ ช่วยเขียนเนื้อหา แต่ทั้งหมดก็ต้องใช้เวลาและไม่ได้ง่ายสำหรับทุกคน Mozilla ยังอ้างผลสำรวจพบว่า Solopreneur ส่วนใหญ่ต้องมีพาร์ตเนอร์ที่เก่งด้านเทคโนโลยีมาคอยช่วยจัดการงานด้านนี้เพิ่ม

Tags:
Node Thumbnail

กูเกิลเปิดให้นักพัฒนาใช้งานโมเดลปัญญาประดิษฐ์ Gemini Pro รุ่นกลางที่ใช้งานใน Bard ตั้งแต่สัปดาห์ที่แล้ว โดยนักพัฒนาสามารถใช้งานได้ฟรีทุกคนในช่วงทดสอบ จำกัดเพียงแค่ห้ามคิวรีเกิน 60 ครั้งต่อนาทีเท่านั้น

โมเดลที่ปล่อยให้ใช้งาน มีทั้ง Gemini Pro ตัวปกติรองรับเฉพาะข้อความ รองรับ context ขนาด 32K และ Gemini Pro Vision ใส่ภาพประกอบได้ด้วย ความพิเศษของ Gemini Pro ที่ปล่อยให้ใช้งานผ่าน API คือมันรองรับภาษาอื่นๆ นอกจากภาษาอังกฤษ รวมทั้งหมด 38 ภาษา

SDK ที่ปล่อยออกมานั้นเปิดให้นักพัฒนาสามารถใช้งานแบบ Generate Content ที่สร้างข้อความต่อจากข้อความที่ผู้ใช้ใส่ลงไป หรือแบบ Chat ที่เป็นการพูดคุยต่อๆ กัน โดยยังไม่มี API แบบ Agent แบบเดียวกับ Assistant API ของ OpenAI

Tags:
Node Thumbnail

ไมโครซอฟท์ปล่อยโมเดลภาษาขนาดเล็ก (small language model หรือ SLM) ชื่อ Phi-2 ขนาด 2.7 พันล้านพารามิเตอร์ ให้ลูกค้าใช้งานบน Azure AI Studio

Phi-2 เป็นผลงานพัฒนาของทีม Machine Learning Foundations ภายใต้ Microsoft Research ตัวมันเองเป็นโมเดลแบบ Transformer เทรนบนข้อมูลขนาด 1.4T token บนเครื่อง NVIDIA A100 GPU จำนวน 96 ตัว ใช้เวลาเทรน 14 วัน ถือเป็นโมเดลที่สร้างโดยคนของไมโครซอฟท์เอง ไม่ต้องพึ่งพาฝั่ง OpenAI

ไมโครซอฟท์เปิดตัว Phi-2 ครั้งแรกในงาน Ignite เมื่อเดือนที่แล้ว จุดเด่นของมันคือเป็นโมเดลขนาด 2.7B ที่มีประสิทธิภาพใกล้เคียงหรือเหนือกว่าโมเดลขนาดที่ใหญ่กว่ามัน 25 เท่า

Tags:
Topics: 
Node Thumbnail

Mistral AI บริษัทปัญญาประดิษฐ์จากฝรั่งเศสเปิดตัวโมเดลรุ่นใหม่ในชื่อ Mixtral 8x7B เป็นโมเดลที่อาศัยสถาปัตยกรรม mixture-of-experts (MoE) ผสมเอาท์พุตระหว่างโมเดลย่อยๆ ภายใน

ขนาดโมเดลรวม 46.7 พันล้านพารามิเตอร์ แต่ระหว่างรันจริง โมเดลจะเรียกใช้โมเดลที่เหมาะสมเพียง 2 ตัวจาก 8 ตัว จากนั้นจะเลือกเอาท์พุตแต่ละโทเค็นจากสอง 2 ตัวนั้นมาใช้งาน ทำให้เวลารันจริงจะใช้พลังประมวลผลเครื่องเท่ากับโมเดลขนาด 12.9 พันล้านพารามิเตอร์เท่านั้น

แนวทาง MoE ทำให้ Mixtral มีคะแนนทดสอบชุดทดสอบต่างๆ ใกล้เคียง GPT-3.5 แม้ขนาดโมเดลและพลังประมวลผลที่ใช้รันจะน้อยกว่ามาก คะแนนทดสอบหลายชุดดีกว่า LLaMA 2 มากแม้จะเทียบกับโมเดลขนาด 70B ก็ตาม

Tags:
Node Thumbnail

Jeff Dean หัวหน้านักวิทยาศาสตร์ของกูเกิล และหัวหน้าทีม (ร่วม) ของ Gemini โพสต์อธิบายที่มาของชื่อ Gemini ว่ามาจากคำว่า "ฝาแฝด" ในภาษาละติน

เหตุผลที่กูเกิลเลือกใช้ชื่อนี้เป็นเพราะต้องการสะท้อนผลงานของ Google DeepMind ที่เกิดจากการรวมทีม Google Brain และ DeepMind เข้าด้วยกัน ก่อนหน้านี้กูเกิลมีทีม AI หลักสองทีม ต่างคนต่างทำโมเดล LLM แยกจากกัน คือ Google Brain (PaLM/PaLM2) และ DeepMind (โมเดลชื่อ Chinchilla) แต่ภายหลังกูเกิลตัดสินใจจับมารวมกัน พัฒนาโมเดลร่วมกัน และช่วยให้ดึงทรัพยากรส่วนอื่นของกูเกิลมาช่วยงานได้อีกมาก

Tags:
Node Thumbnail

กูเกิลเปิดบริการ NotebookLM แอพจดโน้ตพลัง AI สำหรับผู้ใช้ทั่วไป แต่ยังจำกัดประเทศเฉพาะในสหรัฐอเมริกาเท่านั้น

NotebookLM หรือชื่อเดิม Project Tailwind เป็นโครงการทดลอง (experimental) ที่กูเกิลโชว์ครั้งแรกในงาน Google I/O 2023 มันเป็นแอพจดโน้ตที่ใช้โมเดลภาษาขนาดใหญ่ (LLM) มาช่วยสรุปเนื้อหาจากเอกสาร (เช่น PDF) ที่เราอัพโหลดขึ้นไป เมื่อ LLM เรียนรู้จากเอกสารก็จะกลายเป็นผู้เชี่ยวชาญในเรื่องนั้น ที่สามารถตอบคำถามหรือร่างเนื้อหาจากเอกสารให้เราได้

กูเกิลยังปรับปรุงโมเดล LLM มาเป็น Gemini Pro ที่มีความสามารถมากขึ้น และเพิ่มฟีเจอร์การเซฟคำตอบของ NotebookLM เก็บไว้ใช้งานภายหลังได้

Tags:
Node Thumbnail

Anthropic ผู้พัฒนา Claude ปัญญาประดิษฐ์สำคัญที่ชูจุดแข็งว่าสามารถรับอินพุตขนาดใหญ่ รายงานถึงผลการทดสอบการถามตอบเอกสารขนาดใหญ่ว่ามักได้ผลไม่ค่อยดีนัก โดยเฉพาะในกรณีที่ข้อความที่ใช้ตอบคำถามนั้นล้อมด้วยเรื่องที่ไม่เกี่ยวข้องกันนัก

รายงานระบุว่า Claude 2.1 นั้นถูกฝึกให้เลี่ยงการตอบคำถามหากไม่มีข้อความสนับสนุนคำตอบมากพอ แนวทางนี้มีเพื่อลดการตอบคำถามอย่างผิดๆ ทีมงานทดสอบโดยการถามคำถามถึงประโยคหนึ่งที่อยู่ในข้อความยาวๆ ที่พูดเรื่องเดียวกัน จากนั้นนำข้อความชุดนี้ไปผสมกับเอกสารอื่นจนเต็ม context 200k แล้วสลับตำแหน่งไปมา พบว่า Claude สามารถตอบคำถามได้เสมอไม่ว่าข้อความที่ใช้ตอบคำถามจะอยู่ตำแหน่งใดๆ แม้ประสิทธิภาพจะดีขึ้นเล็กน้อยหากข้อความอยู่ส่วนท้าย

Tags:
Node Thumbnail

กูเกิลเปิดตัวปัญญาประดิษฐ์ LLM ตัวใหม่ Gemini 1.0 อย่างเป็นทางการเมื่อวันก่อน ที่กูเกิลบอกว่าผลทดสอบความสามารถสูงเหนือกว่าคู่แข่ง และออกคลิปวิดิโอนำเสนอความสามารถ Gemini ในหลากหลายด้านออกมาด้วย

มีคลิปวิดีโอหนึ่งที่ดูจะเป็นประเด็นมากกว่าตัวอื่น มีชื่อว่า Hands-on with Gemini: Interacting with multimodal AI โดยวิดีโอนี้สาธิตการโต้ตอบของ Gemini ผ่านการให้ข้อมูลในรูปแบบต่าง ๆ เพื่อแสดงว่า Gemini เป็นโมเดล AI ที่ทำงานกับข้อมูลแบบผสมผสาน (multimodal) ได้อย่างดี

Tags:
Node Thumbnail

ถึงแม้กระแสเปิดตัวของใหม่ AI วันนี้จะอยู่ที่ Gemini ของกูเกิล แต่ Meta ก็ประกาศของใหม่เกี่ยวกับ AI ด้วยเช่นกันนั่นคือ Imagine with Meta AI เครื่องสำหรับสร้างรูปภาพด้วย prompt ที่แยกออกมาใช้งานโดยเฉพาะ ไม่ได้ไปรวมกับบริการตัวอื่น ซึ่งเหมือนกับ DALL-E, Midjourney หรือ Stable Diffusion ทำงานบนโมเดล Emu ที่ใช้สร้างรูปภาพ

Imagine with Meta AI ยังเปิดให้ใช้งานแบบจำกัดเฉพาะผู้ใช้ในอเมริกาเท่านั้นผ่าน imagine.meta.com

Tags:
Node Thumbnail

กูเกิลประกาศเปลี่ยนเอนจินด้านหลัง Bard ไปใช้ Gemini Pro ที่เปิดตัวมาวันนี้ ทำให้ความสามารถน่าจะดีขึ้นมากจากเดิมที่ใช้ PaLM-2

Gemini Pro ที่ใช้ใน Bard จะเป็นรุ่นปรับปรุงมาเป็นพิเศษ เป็นความสามารถที่คนใช้งานในแชตบ่อยๆ เช่น การทำความเข้าใจข้อความ, สรุปบทความ, การให้เหตุผล, เขียนโปรแกรม, และการวางแผนต่างๆ โดยหลังจากปรับจูนโมเดลมาแล้วกูเกิลได้ขอให้ผู้ทดสอบภายนอกมาเทียบกับบริการแชตอื่นๆ ก็พบว่า Bard รุ่นใหม่นี้เป็นบริการฟรีที่ดีที่สุด

ปีหน้ากูเกิลจะเปิดบริการ Bard Advanced ที่ใช้ Gemini Ultra โดยยังอยู่ระหว่างการทดสอบความปลอดภัย และเมื่อเปิดใช้งานก็จะเปิดวงเล็กให้ทดสอบก่อนจะเปิดใช้งานจริง โดยตอนนี้ยังไม่แน่ชัดว่า Bard Advanced จะเก็บค่าบริการแบบเดียวกับ ChatGPT Plus หรือไม่

Tags:
Node Thumbnail

กูเกิลเปิดตัว Gemini 1.0 ปัญญาประดิษฐ์แบบ LLM ที่เคยเปิดตัวไว้ตั้งแต่งาน Google I/O ที่ผ่านมา โดยระบุว่าผลการทดสอบคะแนนต่างๆ นั้น Gemini ชนะ GPT-4 แทบทุกการทดสอบ

Gemini เป็นโมเดลปัญญาประดิษฐ์แบบ multimodal ตั้งแต่แรก โดยรองรับข้อมูลทั้ง ข้อความปกติ, โค้ด, เสียง, ภาพ, และวิดีโอ ในเวอร์ชั่น 1.0 กูเกิลระบุว่ามี 3 ขนาด ได้แก่ Gemini Ultra ขนาดใหญ่ที่สุด รองรับงานซับซ้อนสูง, Gemini Pro ขนาดรองลงมาโดยยังทำงานได้หลากหลาย, Gemini Nano โมเดลประสิทธิภาพสูงสำหรับรันบนโทรศัพท์มือถือ

Pages