Aktivita · Ako funguje AI

AI nerozumie tomu, čo píše. Postav si ju a uvidíš prečo.

Nakŕm vlastný stroj pár odsekmi textu a on začne písať vety. Gramaticky správne, znejúce prirodzene — a úplne vymyslené. Presne takto funguje aj veľká AI, len s oveľa väčším množstvom textu.

funguje aj na telefóne · nič, čo sem napíšeš, sa nikam neposiela

Čo je token

Stroj nevidí slová. Vidí kúsky.

Skôr než AI s textom čokoľvek urobí, rozseká ho na kúsky. Každý kúsok je jeden token. Napíš si vlastnú vetu a pozri sa, ako ju vidí.

Vyčítate vetu
Drak dýchol na ľad a mlyn sa neuveriteľne rýchlo roztočil.
Náš strojvidí slová
drakdýcholnaľadamlynsaneuveriteľnerýchloroztočil
Veľká AIvidí kúsky slov
drakdýcholnaľadamlynsaneuveriteľnerýchloroztočil
11 tokenov / 17 tokenov

Delenie na kúsky slov je len približná ukážka — skutočná AI má vlastný slovník kúskov a každá ho má trochu iný. Podstatné je, že dlhé alebo zriedkavé slovo vidí ako niekoľko častí, nie ako písmená. Preto ti často nevie povedať, koľko je v slove písmen „r“.

Ako AI funguje

Tri veci, ktoré stroj robí. Nič viac.

Chatovacia AI nehľadá odpoveď v knihách a nerozmýšľa. Robí presne to, čo uvidíš v aktivite nižšie — len v obrovskom rozsahu.

KROK 1

Rozseká text na tokeny

Stroj nevidí vety ani význam. Vidí postupnosť kúskov, ktorým sa hovorí tokeny. Náš stroj používa ako token celé slovo, koniec vety je tiež token.

Veľká AI seká jemnejšie, na kúsky slov. Zriedkavé slovo môže byť z troch či štyroch tokenov, približne takto: neuveriteľ. Preto AI často nevie spočítať písmená v slove ani ho napísať odzadu — nikdy ho nevidela ako písmená.

KROK 2

Počíta, čo po čom nasleduje

„Učenie“ je počítanie. Stroj prejde text a pri každom tokene si zapíše, ktorý prišiel po ňom a koľkokrát. Žiadne vedomosti, žiadne pravidlá gramatiky, žiadne pochopenie. Len tabuľka „po X ide Y, toľkokrát“.

Veľká AI si „pamätá“ tisíce tokenov dozadu a namiesto tabuľky má miliardy váh v neurónovej sieti. Výsledok je ale ten istý druh veci: odhad, ktorý token je najpravdepodobnejší ďalší.

KROK 3

Háda ďalší token, dookola

Keď stroj píše, nemá plán, čo chce povedať. Pozrie sa na posledné slová, nájde, čo po nich nasledovalo, jedno vyberie a pripojí. Potom znova. Kým nevyberie koniec vety.

Ak vznikne nezmysel, je to preto, že najpravdepodobnejšie pokračovanie nie je to isté ako pravdivé pokračovanie. Stroj medzi tým nevie rozlíšiť. Nemá čím.

Aktivita

Postav si mini-AI

Tri kroky, ktoré robí každá AI. Tu ich urobíš sám a pozrieš sa strojovi do hlavy.

1

Nakŕm stroj textom

Čím viac textu, tým „múdrejší“ bude. Použi ukážku alebo vlož vlastný: rozprávku, učebnicu, text piesne.

Trénovací text178 slov
2

Natrénuj ho

Stroj text rozseká na tokeny a spočíta, čo po čom nasleduje. To je celé „učenie“.

Tréning
Koľko slov dozadu si pamätá:
3

Nechaj ho písať

Stroj vždy len vyberá ďalšie slovo. Stĺpce nižšie sú presne to, čo v každom kroku vidí. Vyber slovo ty, alebo to nechaj na neho.

Generovanie
Stlač „Začať vetu“…
opatrnývyvážený

Odvaha: opatrný stroj berie skoro vždy najčastejšie slovo a často len opisuje pôvodný text. Odvážny skúša aj zriedkavé slová — je pestrejší, ale častejšie mimo. Veľká AI má to isté nastavenie, preto na tú istú otázku odpovie dvakrát inak.

Čo z toho platí pre veľkú AI

Rozdiel je v rozsahu, nie v princípe

Chatovacia AI robí to isté ako tvoj stroj: seká na tokeny, má naučené, čo po čom nasleduje, a píše odpoveď token po tokene. Má miliardy textov, dlhšiu pamäť a jemnejší odhad. Preto znie prirodzene a preto tak často pôsobí, akoby rozumela.

01

Nerozumie, predpovedá

V jadre je to stále stroj na najpravdepodobnejšie pokračovanie. Keď odpovie správne, je to preto, že správna odpoveď bola v dátach najčastejšia. Nie preto, že by ju poznala.

02

Preto si vymýšľa

Tvoj stroj napísal vety, ktoré v texte nikdy neboli, a napísal ich bez váhania. Nevie, že si vymýšľa — nemá čím to zistiť. Veľká AI je na tom rovnako. Tomu sa hovorí halucinácia a nie je to chyba, ktorú by šlo opraviť. Vyplýva zo spôsobu, akým AI funguje.

03

Vie len to, čo bolo v dátach

Zadaj v kroku 2 slovo, ktoré v texte nie je. Stroj o ňom nevie nič. Veľká AI má dát nesmierne veľa, ale hranice sú rovnaké: nevie, čo sa stalo po zbere dát, nič o tvojej obci, ak sa o nej nepísalo, a nič o tebe. Nepovie „neviem“. Dopíše, čo by tam najpravdepodobnejšie bolo.

04

Čo si z toho odniesť

AI je výborná tam, kde stačí, aby text znel dobre: preformulovať, zhrnúť, navrhnúť, vysvetliť známu vec. Nespoľahlivá tam, kde záleží na pravde: čísla, mená, dátumy, citáty, čokoľvek nové alebo miestne. Tam treba odpoveď overiť inde. Rovnako, ako by si vetu zo svojho stroja overil pohľadom do pôvodného textu.