Jak chatbot píše
Chatbot nepíše myšlenky, ale slova. Jedno po druhém. Vyzkoušejte si, jak hádá to další.
Slovo po slově
- Pondělí, porada za deset minutJana: Napiš mi omluvu, proč nemám hotovou prezentaci.AI: Už píšu. Slovo po slově.
- Jana: Takže ty jen hádáš další slovo?AI: „Hádám“ je silné slovo. Říkejme tomu kvalifikovaný odhad.
- Jana: A celou větu dopředu nevidíš?AI: Vidím jen to, co už je napsané. Z toho odhadnu další slovo. Zkuste si to.
- Teď vy!
Slovo 1 ze 3
Vyberte za AI další slovo.
Ráno si dám kávu a čerstvý
Zbytek procent připadá na tisíce dalších slov.
Jak to funguje
Jak chatbot píše
Chatbot dostane text a spočítá, jak pravděpodobné je každé možné další slovo. Jedno z pravděpodobných vybere, připíše ho a celé to zopakuje. Pořád dokola, dokud odpověď nedopíše.
Přesněji řečeno nepracuje se slovy, ale s tokeny, tedy kousky textu. Krátké slovo bývá jeden token, dlouhé nebo skloňované slovo se rozpadne na několik. Čeština kvůli koncovkám obvykle potřebuje na stejný text víc tokenů než angličtina.
Co z toho vzniklo
- O kávu pozdějiJana: Počkej. Odkud víš, že po kávě přijde zrovna rohlík?AI: Tipněte si.
- Teď vy!
Odkud chatbot ví, jaké slovo obvykle následuje?
Jak to funguje
Učení ve dvou krocích
Nejdřív se model učí z obrovského množství textu, z knih, článků a webových stránek. Má jediný úkol, odhadnout další kousek textu. Tak vznikne stroj, který umí plynule pokračovat v jakémkoli textu.
Pak přijde druhé, menší učení. Na ukázkových rozhovorech a na hodnocení odpovědí, které dělají i lidé. Teprve z něj je asistent, který odpovídá na otázky a drží se zadání.
Databázi vět v sobě nemá. Co se naučil, je uložené jako miliardy čísel. Texty, které viděl mnohokrát, si ale občas zapamatuje skoro doslova.
Proč pokaždé jinak
- Druhý denJana: Včera jsem se tě zeptala na totéž a odpověděl jsi jinak.AI: Nevybírám vždycky to nejpravděpodobnější slovo. Je v tom trocha náhody.
- Jana: A dá se ta náhoda nastavit?AI: Má to knoflík. Říká se mu teplota. Zkuste ho na té omluvě.
- Teď vy!Úředník
Posuňte teplotu a sledujte, jak se omluva mění.
Prezentaci nemám. Důvod: počítač spadl a nestihla jsem ji dodělat.
OpatrněDivoceJak pravděpodobné je další slovo po „Prezentaci nemám. Důvod:…“
- počítač55 %
- vlak30 %
- kočka12 %
- jeřábi3 %
AI: Nudné. Ale šéf tomu uvěří.Nízká teplota: vyhrávají nejpravděpodobnější slova. Text je jistý a předvídatelný. Jak to funguje
Teplota
Teplota je nastavení, které určuje, jak moc chatbot riskuje. Při nízké vybírá skoro vždy nejpravděpodobnější slovo. Při vysoké dostanou šanci i slova, která by jinak skoro nikdy nenapsal.
Ve většině chatovacích aplikací teplotu nastavuje aplikace, ne vy. I proto může stejná otázka dostat pokaždé trochu jinou odpověď. Svou roli hraje i to, jak přesně otázku položíte a o čem jste psali předtím.
Zní to dobře. Je to pravda?
- Jana: Takže píšeš to, co zní pravděpodobně. Ne to, co je pravda.AI: Většinou je to totéž. Většinou.
- Jana: A když ne?AI: Pak to napíšu stejně sebevědomě. A gramaticky bezchybně.
Jak to funguje
Pravděpodobné není totéž co pravdivé
Model se učil psát text, který do situace sedí. Když je správná odpověď v textech častá, trefí se. Když je vzácná, nebo vůbec neexistuje, napíše něco, co jen zní správně.
Sebejistý tón přitom nic neznamená. Model píše stejně plynule, ať má pravdu, nebo ne. Právě o tom bude příští díl.
- Jana: Takže jsi vlastně hodně sečtělý odhadovač.AI: Nejsečtělejší. Ale pořád odhadovač.
Jak to funguje
Kolik toho model přečetl?
Kolik textu přečetly nejnovější modely od OpenAI, Googlu nebo Anthropicu, nevíme. Firmy to nezveřejňují. OpenAI to u modelu GPT-4 v roce 2023 výslovně odmítlo.
Známe čísla od firem, které je zveřejnily. Meta uvedla, že její model Llama 3 z roku 2024 se učil z víc než 15 bilionů tokenů, tedy zhruba z 11 bilionů slov. GPT-3 z roku 2020 se učil z 300 miliard tokenů, asi padesátkrát méně.
Kdyby to byly romány o sto tisících slovech, bylo by to přes sto milionů knih. Většinu ve skutečnosti tvoří webové stránky, ale pro představu: kdo přečte knihu týdně, stihne jich za šedesát let asi tři tisíce.
A kdybyste ten text četli běžnou rychlostí, ve dne v noci a bez přestávky, trvalo by vám to skoro 90 000 let.
Zdroje: Meta: Introducing Meta Llama 3 (2024); Brown a kol.: Language Models are Few-Shot Learners (2020); OpenAI: GPT-4 Technical Report (2023); OpenAI: Co jsou tokeny (token je asi ¾ anglického slova); Brysbaert: How many words do we read per minute? (2019), 238 slov za minutu
Kvíz
- AI: Na závěr pět otázek. Co si vybavíte, to si zapamatujete.Jana: Tohle je pravda, nebo jen pravděpodobné?
- Kvíz
Otázka 1 z 5
Pět otázek, žádné známky.
Jak chatbot vytváří odpověď?
Vyberte jednu odpověď.
Co si odnést
- Chatbot píše po kouscích. Pokaždé odhadne, co bude dál, a vybere jedno z pravděpodobných slov.
- Naučil se to z obrovského množství textu. Při psaní nic nehledá ani neověřuje.
- Teplota určuje, jak moc riskuje. Proto stejná otázka nedostane vždycky stejnou odpověď.
- Pravděpodobné není totéž co pravdivé. Sebejistý tón nic nedokazuje.
Příští epizoda
Proč si AI vymýšlí
Sebejistý kamarád, který nikdy nepřizná, že něco neví. Poznáte, kdy AI vymýšlí?
Nový díl přímo do schránky
Každé dva týdny pošleme nový díl, krátký text k učení a novinky ze světa AI. Zdarma a odhlásit se můžete kdykoli.
Chcete to pro celou firmu? Připravíme živé školení na míru vašemu týmu.