หากคุณติดตามข่าวสารเกี่ยวกับปัญญาประดิษฐ์ (AI) ในช่วงนี้ คุณคงเคยได้ยินเกี่ยวกับเครื่องมือต่างๆ ที่ดูเหมือนจะทำได้ทุกอย่าง ตั้งแต่เขียนบทกวีไปจนถึงเขียนโปรแกรมโค้ดที่ซับซ้อน เบื้องหลังความมหัศจรรย์ทั้งหมดนี้คือแนวคิดหลัก: โมเดลพื้นฐานโดยพื้นฐานแล้ว มันก็เหมือนกับโครงตัวถังรถยนต์ คือโครงสร้างพื้นฐานที่แข็งแรงทนทาน ซึ่งสามารถปรับแต่งให้เป็นรถสปอร์ต รถบรรทุก หรือรถอเนกประสงค์ได้ ขึ้นอยู่กับความต้องการในแต่ละช่วงเวลา
สิ่งที่ทำให้ระบบเหล่านี้สร้างความเปลี่ยนแปลงอย่างมากคือ เราไม่ได้ออกแบบ AI สำหรับงานเดียวอีกต่อไป แต่เราสร้าง AI สำหรับงานที่หลากหลายแทน ยักษ์ใหญ่ด้านดิจิทัล entrenado con cantidades ingentes de datos que luego podemos «moldear». Este cambio de paradigma ha permitido que la IA pase de ser algo muy rígido a convertirse en una herramienta flexible que aprende patrones generales del mundo para luego aplicarlos a problemas concretos, lo que ha acelerado la innovación a un ritmo que, sinceramente, deja fría a cualquiera.
แบบจำลองพื้นฐานคืออะไรกันแน่?

กล่าวโดยสรุป โมเดลพื้นฐานคือระบบ AI ใดๆ ที่ได้รับการฝึกฝนด้วย ข้อมูลจำนวนมหาศาล (โดยปกติผ่านการตรวจสอบตนเอง) และมีความสามารถในการปรับตัวผ่านกระบวนการที่เรียกว่าการปรับแต่งอย่างละเอียด เพื่อการใช้งานที่หลากหลาย เทคโนโลยีเหล่านี้ไม่ได้ใหม่ทั้งหมด เนื่องจากดึงเอาแนวคิดจาก deep learning และการถ่ายทอดความรู้มาใช้ แต่... ขนาดที่ไม่เคยมีมาก่อน ข้อมูลและเทคโนโลยีการประมวลผลได้นำไปสู่ความสามารถใหม่ๆ ที่ไม่มีใครคาดคิดมาก่อน
สิ่งสำคัญคืออย่าสับสนพวกเขากับ LLM (โมเดลภาษาขนาดใหญ่)แม้ว่าจะใช้คำเหล่านี้สลับกันได้บ่อยครั้ง แต่ความสัมพันธ์นั้นเป็นเหมือนสกุลและชนิด: LLM ทั้งหมดเป็นแบบจำลองพื้นฐาน แต่แบบจำลองพื้นฐานทั้งหมดไม่จำเป็นต้องเป็น LLM ในขณะที่ LLM เน้นที่ข้อความและรหัส แต่แบบจำลองพื้นฐานสามารถเป็นได้มากกว่านั้น ต่อเนื่องหลายรูปแบบประมวลผลภาพ เสียง วิดีโอ หรือแม้แต่สัญญาณรับรู้จากหุ่นยนต์
องค์ประกอบทางเทคนิคที่สำคัญ: หม้อแปลงไฟฟ้าและการฝึกอบรม

สถาปัตยกรรมที่ทำให้สิ่งเหล่านี้เป็นไปได้ทั้งหมดคือ หม้อแปลงไฟฟ้า. Este sistema utiliza un mecanismo llamado «autoatención», que permite al modelo entender la importancia de diferentes partes de una secuencia, sin importar que estén lejos unas de otras. Consta habitualmente de un codificador y un decodificador que generan การแสดงเวกเตอร์ (การฝังข้อมูล) ที่สามารถจับความหมายที่ลึกซึ้งของภาษาหรือภาพได้
กระบวนการสร้างสรรค์มักแบ่งออกเป็นหลายขั้นตอน:
- ก่อนออกกำลังกาย: Es la fase más costosa. El modelo «devora» internet, libros y bases de datos para aprender la estructura general de la información. Aquí es donde se definen el จำนวนพารามิเตอร์จำนวนโทเค็น และหน้าต่างบริบท
- การปรับแต่งอย่างละเอียด: เมื่อแบบจำลองมีความเชี่ยวชาญในหลายด้านแล้ว ก็จะได้รับการฝึกฝนด้วยข้อมูลเฉพาะและกำกับดูแลโดยมนุษย์เพื่อให้กลายเป็นผู้เชี่ยวชาญในด้านใดด้านหนึ่ง เช่น การแพทย์หรือกฎหมาย
- การปรับตัวให้เข้ากับงาน: นี่คือขั้นตอนสุดท้าย ซึ่งเป็นขั้นตอนที่แบบจำลองได้รับการปรับให้เหมาะสมสำหรับฟังก์ชันเฉพาะเจาะจง เช่น การสร้าง เครื่องมือค้นหากฎหมายคดี หรือโปรแกรมสร้างรายงานทางเทคนิค
แบบจำลองที่โดดเด่นซึ่งมีส่วนสำคัญในการกำหนดประวัติศาสตร์

นับตั้งแต่ปี 2018 เราได้เห็นนางแบบมากมายหมุนเวียนเข้ามาและจากไป ทำให้เกิดการเปลี่ยนแปลงมากมาย BERT เขาเป็นหนึ่งในผู้บุกเบิก โดดเด่นในด้านความสามารถในการเข้าใจบริบทแบบสองทิศทาง จากนั้นครอบครัวก็เข้ามามีบทบาท OpenAI GPTโดยมีการพัฒนาจาก GPT-1 ไปสู่ GPT-4 ซึ่งแสดงให้เห็นว่ายิ่งขนาดใหญ่ขึ้นเท่าใด ความสามารถใหม่ๆ ก็ยิ่งเกิดขึ้นมากขึ้นเท่านั้น เช่น การเรียนรู้แบบไม่ต้องเรียกใช้ข้อมูลซ้ำ (zero-shot learning)
แต่พวกเขาไม่ได้อยู่เพียงลำพัง เรามี คล็อด เดอ แอนโทรปิกด้วยรูปแบบต่างๆ เช่น ซอนเน็ต โอปุส และไฮกุ ที่พยายามสร้างสมดุลระหว่างสติปัญญาและความรวดเร็ว ในทางกลับกัน อเมซอนโนวา บริการนี้ครอบคลุมหลากหลายรูปแบบ ตั้งแต่การทำความเข้าใจแบบหลายสื่อไปจนถึงการสร้างวิดีโอเชิงสร้างสรรค์ เราต้องไม่ลืมว่า... การแพร่กระจายที่เสถียรซึ่งนำพลังของแบบจำลองพื้นฐานมาสู่โลกแห่งภาพ หรือ BLOOMเป็นความพยายามร่วมกันในหลายภาษาที่แสดงให้เห็นว่าซอฟต์แวร์โอเพนซอร์สก็มีบทบาทของมันเช่นกัน
ความสามารถและการประยุกต์ใช้ในโลกแห่งความเป็นจริง
โมเดลเหล่านี้ไม่ได้แค่เขียนอีเมลเท่านั้น ผลกระทบของพวกมันขยายไปถึงภาคส่วนที่สำคัญต่างๆ ด้วย:
- สุขภาพ: พวกเขาช่วยในเรื่องต่างๆ การค้นพบยา และการวิเคราะห์ภาพทางการแพทย์ แม้ว่าจะต้องมีการอธิบายอย่างครบถ้วนเพื่อหลีกเลี่ยงข้อผิดพลาดร้ายแรงก็ตาม
- ขวา: สิ่งเหล่านี้ช่วยอำนวยความสะดวกในการตรวจสอบสัญญาและการวิเคราะห์เอกสารทางกฎหมายที่ยาวเหยียด ซึ่งช่วยลดต้นทุนในการเข้าถึงกระบวนการยุติธรรม
- ระดับการศึกษา: พวกเขาอนุญาตให้ การเรียนรู้ส่วนบุคคล และปรับตัวได้ดี แม้ว่าจะมีข้อท้าทายในเรื่องการลอกเลียนแบบและช่องว่างทางเทคโนโลยีก็ตาม
- วิทยาการหุ่นยนต์: เป้าหมายคือการสร้างหุ่นยนต์อเนกประสงค์ที่ไม่จำเป็นต้องตั้งโปรแกรมใหม่ทั้งหมดสำหรับแต่ละงาน แต่ใช้แบบจำลองพื้นฐานแทน มีปฏิสัมพันธ์กับสิ่งแวดล้อม กายภาพ
ด้านมืด: ความเสี่ยง จริยธรรม และสิ่งแวดล้อม
มันไม่ได้สวยงามไปเสียหมด การทำให้เป็นมาตรฐานเดียวกันหมดเป็นความเสี่ยงร้ายแรง: ถ้าทุกคนใช้แบบจำลองพื้นฐานเดียวกัน อะไรก็ตามก็จะ... อคติหรือข้อผิดพลาดโดยเนื้อแท้ se propagará por todas las aplicaciones derivadas, creando un «monocultivo algorítmico». Además, están las alucinaciones, esos momentos en los que la IA inventa datos con una seguridad pasmosa, lo que obliga a una การตรวจสอบโดยมนุษย์อย่างต่อเนื่อง.
จากมุมมองด้านจริยธรรมและกฎหมาย มีการถกเถียงกันอย่างเปิดเผยเกี่ยวกับเรื่องนี้ ทรัพย์สินทางปัญญาสาเหตุที่เป็นเช่นนั้นก็เพราะว่าโมเดลจำนวนมากได้รับการฝึกฝนด้วยข้อมูลโดยไม่ได้รับความยินยอมอย่างชัดเจนจากผู้สร้าง นอกจากนี้ยังส่งผลกระทบต่อสิ่งแวดล้อมด้วย การฝึกฝนโมเดลขนาดใหญ่เหล่านี้ใช้ทรัพยากรจำนวนมหาศาล พลังงานจำนวนมหาศาล และน้ำ ซึ่งทำให้จำเป็นต้องค้นหาสถาปัตยกรรมที่มีประสิทธิภาพมากขึ้นและศูนย์ข้อมูลที่ยั่งยืน
อนาคตและการกำกับดูแลปัญญาประดิษฐ์
เส้นทางข้างหน้าต้องผ่านทางนี้ การเข้าถึงประชาธิปไตยปัจจุบัน การฝึกฝนโมเดล AI ที่ทรงพลังที่สุดกระจุกตัวอยู่ในบริษัทเพียงไม่กี่แห่ง เนื่องจากต้นทุนของฮาร์ดแวร์ (GPU) จึงเป็นเรื่องสำคัญอย่างยิ่งที่มหาวิทยาลัยและรัฐบาลจะต้องลงทุนในโครงสร้างพื้นฐานสาธารณะ เพื่อป้องกันไม่ให้พลังของ AI ตกอยู่ในมือของคนเพียงไม่กี่คน กลุ่มผูกขาดทางเทคโนโลยี.
หัวใจสำคัญคือความโปร่งใสและการตรวจสอบโดยอิสระ การที่บริษัทบอกว่าโมเดลธุรกิจของตนปลอดภัยนั้นไม่เพียงพอ เราต้องการข้อมูลเพิ่มเติม กรอบการกำกับดูแล (เช่น กฎหมาย AI ของสหภาพยุโรป) และมาตรฐานวิชาชีพที่รับรองว่าเครื่องมือเหล่านี้จะถูกนำไปใช้เพื่อพัฒนาสังคม ไม่ใช่เพื่อส่งเสริมการสอดแนมหรือการเผยแพร่ข้อมูลเท็จในวงกว้าง
ระบบนิเวศของปัญญาประดิษฐ์ได้เปลี่ยนไปสู่โครงสร้างที่โมเดลหลักเพียงไม่กี่โมเดลสนับสนุนแอปพลิเคชันเฉพาะทางนับพันรายการ โดยผสมผสานพลังของการประมวลผลขนาดใหญ่เข้ากับความแม่นยำของการปรับแต่งในระดับมนุษย์ ความก้าวหน้านี้ แม้จะก่อให้เกิดประเด็นทางจริยธรรมที่ลึกซึ้งและข้อกังวลเกี่ยวกับการใช้พลังงาน แต่ก็เป็นการนิยามความสัมพันธ์ระหว่างมนุษย์และเครื่องจักรใหม่ โดยเปลี่ยน AI ให้เป็นโครงสร้างพื้นฐานอเนกประสงค์ที่สามารถให้เหตุผล สร้างสรรค์ และเรียนรู้ในหลายๆ ด้านพร้อมกันได้



