Kung sinusubaybayan mo ang mga kamakailang usap-usapan tungkol sa artificial intelligence, malamang ay narinig mo na ang tungkol sa mga kagamitang tila kayang gawin ang lahat mula sa pagsulat ng mga tula hanggang sa pagprograma ng mga kumplikadong code. Sa likod ng lahat ng mahika na ito ay mayroong isang mahalagang konsepto: mga pundasyong modeloSa madaling salita, para silang tsasis ng isang kotse; isang matibay at pangkalahatang istruktura na maaaring ipasadya upang maging isang sports car, trak, o utility vehicle, depende sa kung ano ang kailangan natin sa anumang oras.
Ang dahilan kung bakit lubhang nakakagambala ang mga sistemang ito ay hindi na tayo nagdidisenyo ng AI para sa iisang gawain, kundi sa halip ay lumilikha tayo ng higanteng digital entrenado con cantidades ingentes de datos que luego podemos «moldear». Este cambio de paradigma ha permitido que la IA pase de ser algo muy rígido a convertirse en una herramienta flexible que aprende patrones generales del mundo para luego aplicarlos a problemas concretos, lo que ha acelerado la innovación a un ritmo que, sinceramente, deja fría a cualquiera.
Ano nga ba ang isang pundamental na modelo?

Sa madaling salita, ang isang pundamental na modelo ay anumang sistema ng AI na sinanay gamit ang isang napakalaking dami ng datos (karaniwan ay sa pamamagitan ng self-monitoring) at may kakayahang umangkop, sa pamamagitan ng prosesong tinatawag na fine-tuning, sa napakaraming iba't ibang aplikasyon. Hindi sila ganap na bago, dahil kinukuha ang mga ito mula sa malalim na pagkatuto at paglilipat ng kaalaman, ngunit ang hindi pa naganap na sukat Ang datos at pagkukuwenta ay humantong sa paglitaw ng mga kakayahang hindi inaasahan ninuman.
Mahalagang huwag silang ipagkamali sa LLM (Malalaking Modelo ng Wika)Bagama't kadalasang ginagamit nang palitan, ang ugnayan ay isa sa genus at species: lahat ng LLM ay mga foundational model, ngunit hindi lahat ng foundational model ay mga LLM. Habang ang mga LLM ay nakatuon sa teksto at code, ang mga foundational model ay maaaring multimodalpagproseso ng mga imahe, audio, video, o kahit na mga sensory signal mula sa mga robot.
Ang mga teknikal na haligi: Transformer at pagsasanay

Ang arkitektura na nagdulot ng lahat ng ito na posible ay ang Transformer. Este sistema utiliza un mecanismo llamado «autoatención», que permite al modelo entender la importancia de diferentes partes de una secuencia, sin importar que estén lejos unas de otras. Consta habitualmente de un codificador y un decodificador que generan mga representasyon ng vector (mga pag-embed) na kumukuha ng malalim na kahulugan ng wika o mga imahe.
Ang proseso ng paglikha ay karaniwang nahahati sa ilang yugto:
- Bago mag-ehersisyo: Es la fase más costosa. El modelo «devora» internet, libros y bases de datos para aprender la estructura general de la información. Aquí es donde se definen el bilang ng mga parametro, ang bilang ng mga token at ang window ng konteksto.
- Pagpino: Kapag ang modelo ay pangkalahatan na, ito ay sinasanay gamit ang mga partikular na datos at pinangangasiwaan ng mga tao upang maging isang eksperto sa isang larangan, tulad ng medisina o batas.
- Pag-aangkop sa gawain: Ito ang huling hakbang, kung saan ang modelo ay ino-optimize para sa isang partikular na tungkulin, tulad ng paglikha ng isang search engine para sa kaso ng batas o isang tagabuo ng teknikal na ulat.
Mga natatanging modelo na humubog sa kasaysayan

Simula noong 2018, nakasaksi na tayo ng isang prusisyon ng mga modelo na paparating at aalis, na nagpapabago sa mga bagay-bagay. SI BERT Isa siya sa mga pioneer, kilala sa kanyang kakayahang umunawa ng konteksto sa dalawang direksyon. Pagkatapos ay sumunod ang pamilya. OpenAI GPT, na umuunlad mula GPT-1 patungong GPT-4, na nagpapakita na mas malaki ang saklaw, mas maraming umuusbong na kakayahan, tulad ng zero-shot learning.
Pero hindi sila nag-iisa. Mayroon tayong Claude de Anthropicna may mga bersiyon tulad ng Sonnet, Opus, at Haiku na naghahangad ng balanse sa pagitan ng katalinuhan at bilis. Sa kabilang banda, Amazon Nova Nag-aalok ito ng iba't ibang uri ng pag-unawa, mula sa multimodal na pag-unawa hanggang sa malikhaing paglikha ng video. Hindi natin maaaring kalimutan na Matatag na Pagsasabog, na nagdala ng kapangyarihan ng mga pangunahing modelo sa mundo ng mga imahe, o BLOOM, isang multilingual at kolaboratibong pagsisikap na nagpapakita na ang open source ay mayroon ding lugar.
Mga kakayahan at mga aplikasyon sa totoong mundo
Hindi lang basta nagsusulat ng mga email ang mga modelong ito. Ang epekto nito ay umaabot sa mga kritikal na sektor:
- Kalusugan: Tumutulong sila sa pagtuklas ng droga at ang pagsusuri ng mga medikal na imahe, bagama't nangangailangan ang mga ito ng ganap na pagpapaliwanag upang maiwasan ang mga nakamamatay na pagkakamali.
- Kanan: Pinapadali nito ang pagsusuri ng mga kontrata at ang pagsusuri ng mahahabang legal na salaysay, na binabawasan ang mga gastos sa pag-access sa hustisya.
- Edukasyon: Pinapayagan nila ang a isinapersonal na pagkatuto at adaptibo, bagama't nagdudulot ang mga ito ng mga hamon patungkol sa plagiarismo at sa teknolohikal na agwat.
- Robotics: Ang layunin ay lumikha ng mga generalist na robot na hindi kailangang i-program mula sa simula para sa bawat gawain, ngunit sa halip ay gumamit ng isang base model upang makipag-ugnayan sa kapaligiran pisikal
Ang Madilim na Bahagi: Mga Panganib, Etika, at ang Kapaligiran
Hindi lahat ay sikat ng araw at rosas. Ang homogenization ay isang seryosong panganib: kung lahat ay gagamit ng parehong pangunahing modelo, anuman bias o likas na pagkakamali se propagará por todas las aplicaciones derivadas, creando un «monocultivo algorítmico». Además, están las alucinaciones, esos momentos en los que la IA inventa datos con una seguridad pasmosa, lo que obliga a una patuloy na pag-verify ng tao.
Mula sa etikal at legal na pananaw, mayroong bukas na labanan hinggil sa IPIto ay dahil maraming modelo ang sinasanay gamit ang datos nang walang tahasang pahintulot ng kanilang mga tagalikha. Dagdag pa rito ang epekto sa kapaligiran; ang pagsasanay sa mga higanteng ito ay kumukunsumo ng napakalaking dami ng enerhiya at tubig, na nangangailangan ng paghahanap para sa mas mahusay na mga arkitektura at napapanatiling mga data center.
Ang hinaharap at pamamahala ng AI
Ang daan pasulong ay dumadaan sa demokratisasyon ng pag-accessSa kasalukuyan, ang pagsasanay ng mga pinakamakapangyarihang modelo ng AI ay nakasentro sa iilang kumpanya dahil sa gastos ng mga hardware (GPU). Mahalaga na mamuhunan ang mga unibersidad at gobyerno sa pampublikong imprastraktura upang maiwasan ang pagkahulog ng kapangyarihan ng AI sa kamay ng iilan. teknolohikal na oligopolyo.
Ang susi ay ang transparency at mga independiyenteng pag-audit. Hindi sapat para sabihin ng isang kumpanya na ligtas ang modelo nito; kailangan natin mga balangkas ng regulasyon (tulad ng EU AI Act) at mga propesyonal na pamantayan na tinitiyak na ang mga kagamitang ito ay ginagamit upang mapabuti ang lipunan at hindi upang mapahusay ang malawakang pagsubaybay o maling impormasyon.
Ang ecosystem ng artificial intelligence ay lumipat patungo sa isang istruktura kung saan ang ilang pangunahing modelo ay sumusuporta sa libu-libong espesyalisadong aplikasyon, na pinagsasama ang kapangyarihan ng malawakang pagproseso at ang katumpakan ng pag-tune sa antas ng tao. Ang pagsulong na ito, habang nagtataas ng malalalim na etikal na dilemma at may kinalaman sa pagkonsumo ng enerhiya, ay muling binibigyang-kahulugan ang ugnayan sa pagitan ng mga tao at makina sa pamamagitan ng pagbabago ng AI sa isang pangkalahatang-layunin na imprastraktura na may kakayahang mangatwiran, lumikha, at matuto sa maraming larangan nang sabay-sabay.



