AI nerozumie tomu, čo píše. Postav si ju a uvidíš prečo.
Nakŕm vlastný stroj pár odsekmi textu a on začne písať vety. Gramaticky správne, znejúce prirodzene — a úplne vymyslené. Presne takto funguje aj veľká AI, len s oveľa väčším množstvom textu.
Čo je token
Stroj nevidí slová. Vidí kúsky.
Skôr než AI s textom čokoľvek urobí, rozseká ho na kúsky. Každý kúsok je jeden token. Napíš si vlastnú vetu a pozri sa, ako ju vidí.
Delenie na kúsky slov je len približná ukážka — skutočná AI má vlastný slovník kúskov a každá ho má trochu iný. Podstatné je, že dlhé alebo zriedkavé slovo vidí ako niekoľko častí, nie ako písmená. Preto ti často nevie povedať, koľko je v slove písmen „r“.
Ako AI funguje
Tri veci, ktoré stroj robí. Nič viac.
Chatovacia AI nehľadá odpoveď v knihách a nerozmýšľa. Robí presne to, čo uvidíš v aktivite nižšie — len v obrovskom rozsahu.
Rozseká text na tokeny
Stroj nevidí vety ani význam. Vidí postupnosť kúskov, ktorým sa hovorí tokeny. Náš stroj používa ako token celé slovo, koniec vety je tiež token.
Veľká AI seká jemnejšie, na kúsky slov. Zriedkavé slovo môže byť z troch či štyroch tokenov, približne takto: neuveriteľné. Preto AI často nevie spočítať písmená v slove ani ho napísať odzadu — nikdy ho nevidela ako písmená.
Počíta, čo po čom nasleduje
„Učenie“ je počítanie. Stroj prejde text a pri každom tokene si zapíše, ktorý prišiel po ňom a koľkokrát. Žiadne vedomosti, žiadne pravidlá gramatiky, žiadne pochopenie. Len tabuľka „po X ide Y, toľkokrát“.
Veľká AI si „pamätá“ tisíce tokenov dozadu a namiesto tabuľky má miliardy váh v neurónovej sieti. Výsledok je ale ten istý druh veci: odhad, ktorý token je najpravdepodobnejší ďalší.
Háda ďalší token, dookola
Keď stroj píše, nemá plán, čo chce povedať. Pozrie sa na posledné slová, nájde, čo po nich nasledovalo, jedno vyberie a pripojí. Potom znova. Kým nevyberie koniec vety.
Ak vznikne nezmysel, je to preto, že najpravdepodobnejšie pokračovanie nie je to isté ako pravdivé pokračovanie. Stroj medzi tým nevie rozlíšiť. Nemá čím.
Aktivita
Postav si mini-AI
Tri kroky, ktoré robí každá AI. Tu ich urobíš sám a pozrieš sa strojovi do hlavy.
Nakŕm stroj textom
Čím viac textu, tým „múdrejší“ bude. Použi ukážku alebo vlož vlastný: rozprávku, učebnicu, text piesne.
Natrénuj ho
Stroj text rozseká na tokeny a spočíta, čo po čom nasleduje. To je celé „učenie“.
Nechaj ho písať
Stroj vždy len vyberá ďalšie slovo. Stĺpce nižšie sú presne to, čo v každom kroku vidí. Vyber slovo ty, alebo to nechaj na neho.
Odvaha: opatrný stroj berie skoro vždy najčastejšie slovo a často len opisuje pôvodný text. Odvážny skúša aj zriedkavé slová — je pestrejší, ale častejšie mimo. Veľká AI má to isté nastavenie, preto na tú istú otázku odpovie dvakrát inak.
Čo z toho platí pre veľkú AI
Rozdiel je v rozsahu, nie v princípe
Chatovacia AI robí to isté ako tvoj stroj: seká na tokeny, má naučené, čo po čom nasleduje, a píše odpoveď token po tokene. Má miliardy textov, dlhšiu pamäť a jemnejší odhad. Preto znie prirodzene a preto tak často pôsobí, akoby rozumela.
Nerozumie, predpovedá
V jadre je to stále stroj na najpravdepodobnejšie pokračovanie. Keď odpovie správne, je to preto, že správna odpoveď bola v dátach najčastejšia. Nie preto, že by ju poznala.
Preto si vymýšľa
Tvoj stroj napísal vety, ktoré v texte nikdy neboli, a napísal ich bez váhania. Nevie, že si vymýšľa — nemá čím to zistiť. Veľká AI je na tom rovnako. Tomu sa hovorí halucinácia a nie je to chyba, ktorú by šlo opraviť. Vyplýva zo spôsobu, akým AI funguje.
Vie len to, čo bolo v dátach
Zadaj v kroku 2 slovo, ktoré v texte nie je. Stroj o ňom nevie nič. Veľká AI má dát nesmierne veľa, ale hranice sú rovnaké: nevie, čo sa stalo po zbere dát, nič o tvojej obci, ak sa o nej nepísalo, a nič o tebe. Nepovie „neviem“. Dopíše, čo by tam najpravdepodobnejšie bolo.
Čo si z toho odniesť
AI je výborná tam, kde stačí, aby text znel dobre: preformulovať, zhrnúť, navrhnúť, vysvetliť známu vec. Nespoľahlivá tam, kde záleží na pravde: čísla, mená, dátumy, citáty, čokoľvek nové alebo miestne. Tam treba odpoveď overiť inde. Rovnako, ako by si vetu zo svojho stroja overil pohľadom do pôvodného textu.