Stručná odpoveď: Token je malý blok textu alebo údajov, ktorý model umelej inteligencie prevedie na čísla a spracuje. Tokeny ovplyvňujú náklady, rýchlosť, pamäť a dĺžku výstupu. Keď výzva prekročí kontextové okno, dôležitý obsah môže byť skrátený, zhrnutý alebo vylúčený.
Kľúčové poznatky:
Tokenizácia: Slová, interpunkcia, medzery a kód môžu byť rozdelené rôznymi spôsobmi.
Kontext: Uchovávajte dôležité informácie v rámci dostupného okna tokenov modelu.
Náklady: Znížte počet opakovaných pokynov a nepotrebného textu vo vysokoobjemových pracovných postupoch umelej inteligencie.
Jasnosť: Včas uveďte hlavnú úlohu a požiadavky usporiadajte pomocou jasných označení.
Efektivita: Pred zlúčením zistení rozdeľte nadrozmerné dokumenty do logických sekcií.

Články, ktoré by ste si mohli prečítať po tomto:
🔗 Aké sú typy AI?
Pochopte kategórie AI podľa schopností, funkčnosti, štýlu tréningu a praktického využitia.
🔗 Čo sú to okuliare s umelou inteligenciou?
Preskúmajte funkcie inteligentných okuliarov, používanie bez použitia rúk, súkromie a praktické obmedzenia.
🔗 Čo je AI TV?
Zistite, ako AI vylepšuje obraz, zvuk, vyhľadávanie, odporúčania a prístupnosť.
🔗 Čo je to AI slop?
Rozpoznajte nekvalitný obsah s umelou inteligenciou a zlepšite jeho presnosť, originalitu a účelnosť.
1. Čo je token v umelej inteligencii? Jednoduchá odpoveď
Token v umelej inteligencii je textová jednotka, ktorú model používa na pochopenie a generovanie jazyka.
Napríklad veta:
Milujem pizzu.
Môže byť rozdelené na tokeny ako:
-
Ja -
láska -
pizza -
.
Dosť jednoduché.
Ale nie vždy je to také úhľadné. Dlhšie alebo nezvyčajné slovo môže byť rozdelené na menšie časti. Napríklad:
neuveriteľný
Mohlo by sa stať niečo ako:
-
ne -
veriť -
schopný
Rôzne systémy umelej inteligencie používajú rôzne tokenizátory, takže presné rozdelenie sa môže líšiť. Preto sa tokeny môžu zdať trochu nepresné. Nie sú to presne slová, nie presne písmená a nie vždy ani slabiky.
Lepší spôsob, ako o tom premýšľať, je tento:
Tokeny sú krátke kúsky jazyka, ktoré dokáže model umelej inteligencie spracovať. 🍽️
Keď položíte chatbotovi otázku, systém neabsorbuje vašu vetu ako jednu hladkú ľudskú myšlienku. Rozdelí vstup na tokeny, premení ich na čísla, spracuje ich vzťahy a potom predpovedá najpravdepodobnejší ďalší token, znova a znova, až kým nevytvorí odpoveď.
Takže keď sa ľudia pýtajú: Čo je token v umelej inteligencii?,odpoveďou nie je len „kus textu“. Je to základná pracovná jednotka, ktorá umožňuje jazykovú umelú inteligenciu.
2. Prečo sú tokeny dôležitejšie, než ľudia očakávajú
Tokeny sú dôležité, pretože ovplyvňujú takmer všetko o fungovaní nástrojov umelej inteligencie.
Ovplyvňujú:
-
Koľko textu dokáže umelá inteligencia spracovať naraz
-
Koľko stojí požiadavka v mnohých systémoch umelej inteligencie
-
Ako rýchlo model reaguje
-
Koľko detailov si model dokáže zapamätať
-
Ako presne model rozumie vašej výzve
-
Ako dlhá môže byť odpoveď
Tu sa to stáva prekvapivo praktickým.
Keď nástroj umelej inteligencie uvádza, že má „kontextové okno“, zvyčajne to znamená maximálny počet tokenov, ktoré môže naraz zvážiť. Vaša výzva, história konverzácie, nahraný text, systémové pokyny a odpoveď modelu zaberajú tokeny.
Takže ak vložíte obrovský dokument do asistenta s umelou inteligenciou a potom sa opýtate: „Zhrňte to“, model musí tento text zmestiť do limitu tokenov. Ak je obsah príliš dlhý, časti môžu byť orezané, komprimované alebo ignorované v závislosti od toho, ako je nástroj navrhnutý.
Žetóny nie sú len technické drobnosti. Sú to miesta na stole umelej inteligencie. Príliš veľa papiera na stole a veci sa začnú presúvať cez okraj 📄.
3. Žetóny nie sú to isté ako slová
Toto je asi najväčšie nedorozumenie.
Token nie je vždy jedno slovo.
Niekedy sa jedno slovo rovná jednému tokenu. Niekedy sa z jedného slova stane viacero tokenov. Niekedy sa interpunkcia alebo medzery počítajú ako samostatný token. Otravné? Trochu. Dôležité? Veľmi.
Tu je hrubý príklad:
| Príklad textu | Možné rozdelenie tokenov | Čo to znamená |
|---|---|---|
mačka |
mačka |
Jedno jednoduché slovo, pravdepodobne jeden žetón |
mačky |
mačky alebo mačka + s
|
Závisí od tokenizátora |
internacionalizácia |
medzinárodná + izácia alebo menšie časti |
Dlhé slová sa často rozdeľujú |
Poháňané umelou inteligenciou |
Poháňané umelou inteligenciou
|
Interpunkcia sa môže počítať |
Hej!!! |
Hej + ! + ! + !
|
Áno, aj interpunkcia dokáže „jesť“ tokeny |
superkalifragilistický |
niekoľko kusov, pravdepodobne | Modelka si vnútorne vzdychne, asi 😅 |
Neexistuje univerzálne pravidlo, ktoré by fungovalo dokonale pre každý model.
Bežný hrubý odhad je, že jeden token často predstavuje približne niekoľko znakov alebo časť slova. To je však len všeobecný odhad, nie evanjelium. Anglický text sa zvyčajne tokenuje efektívnejšie ako niektoré iné jazyky a kód sa môže správať odlišne.
Preto môže krátka veta použiť viac tokenov, ako sa očakávalo. A dlhý odsek s bežnými slovami sa môže tokenizovať plynulejšie ako odsek plný technických výrazov, symbolov alebo nezvyčajného formátovania.
4. Ako umelá inteligencia používa tokeny na generovanie textu
Tu je tá mierne magická časť - hoci je to matematika v čarodejníckom klobúku 🧙.
Keď zadáte výzvu, systém umelej inteligencie urobí niečo takéto:
-
Rozdelí text na tokeny
-
Prevedie každý token na číslo alebo číselnú reprezentáciu
-
Analyzuje vzory a vzťahy tokenov
-
Predpovedá ďalší pravdepodobný token
-
Opakuje tento proces predikcie
-
Prevedie vygenerované tokeny späť na čitateľný text
Takže ak napíšete:
Obloha je
Model by mohol predpovedať:
modrá
Mohlo by to však tiež predpovedať:
zamračené
padajúce
nie je limit
plný hviezd
Zvolený výstup závisí od modelu, výzvy, kontextu a nastavení ovládajúcich náhodnosť alebo kreativitu.
Preto sa písanie pomocou umelej inteligencie niekedy zdá byť plynulé a občas zablúdi do detailov. Predpovedá jeden token za druhým na základe naučených vzorcov, nie vyťahuje hotové vety z kartotéky.
To neznamená, že model je „len autodopĺňaný“ v tom nudnom zmysle slova. Veľké modely umelej inteligencie sa učia extrémne zložité vzťahy medzi konceptmi, jazykom, štruktúrou, tónom, logikou a kontextom. Ale na výstupnej úrovni stroj stále produkuje text jeden token po druhom.
Drobné schody. Veľká ilúzia. Veľmi honosné schodisko.
5. Porovnávacia tabuľka: Typy tokenov v AI
Tokeny sa môžu zobrazovať v rôznych formách v závislosti od modelu, tokenizátora a typu obsahu. Tu je praktické porovnanie.
| Typ tokenu | Príklad | Kde sa to objaví | Prečo na tom záleží |
|---|---|---|---|
| Slovný token | jablko |
Jednoduché textové výzvy | Ľahko zrozumiteľné, prehľadné a upratané |
| Token podslova |
hrať + ing
|
Dlhšie alebo upravené slová | Pomáha umelej inteligencii spracovať neznáme slová |
| Žetón postavy |
a, b, c
|
Niektoré tokenizačné systémy | Flexibilné, ale môže byť neefektívne |
| Interpunkčný token |
., ?, !
|
Každý druh písania, otravne | Ovplyvňuje tón a počet tokenov |
| Token bielych znakov | medzery, zalomenia riadkov | Formátovaný text a kód | Formátovanie bohužiaľ nie je zadarmo |
| Kódový token |
funkcia, {, ==
|
Programovacie výzvy | Kód dokáže rýchlo spaľovať tokeny |
| Špeciálny žetón | značky začiatku/konca | V zákulisí | Pomáha so vstupom štruktúry modelu |
| Neznámy alebo vzácny kus | nezvyčajné fragmenty | Názvy, slang, preklepy | Môže trochu ovplyvniť presnosť |
Nie každý model umelej inteligencie používa všetky tieto prvky rovnakým spôsobom. Niektoré systémy sa vo veľkej miere spoliehajú na tokenizáciu podslov, pretože vyvažuje efektívnosť s flexibilitou. Umožňuje modelu spracovať slová, ktoré nikdy predtým nevidel presne, a to ich rozdelením na časti, ktoré rozpoznáva.
Napríklad, ak model rozumie pojmom micro, bioa logy, má lepšiu šancu pracovať so zložitými vedeckými slovami, aj keď sú nezvyčajné.
Nie dokonalé. Ale celkom šikovné. 🧩
6. Čo je token v umelej inteligencii? Prečo ovplyvňuje cenu
Mnohé nástroje umelej inteligencie merajú používanie v tokenoch.
To znamená, že do využitia sa môže započítať váš vstup aj výstup umelej inteligencie. Ak odošlete dlhú výzvu, použije sa viac tokenov. Ak model napíše dlhú odpoveď, tiež sa použije viac tokenov.
Krátka otázka typu:
Vysvetlite gravitáciu.
Používa relatívne málo vstupných tokenov.
Ale táto výzva:
Vysvetlite gravitáciu podrobným spôsobom, ktorý je vhodný aj pre začiatočníkov, uveďte príklady, porovnajte ju s magnetizmom, pridajte tabuľku, prepíšte to pre dieťa a potom to premeňte na prejav.
Používa viac vstupných tokenov a tiež vyžaduje dlhší výstup.
Takže cena tokenov často pochádza z oboch strán:
-
Vstupné tokeny – to, čo odošlete do modelu
-
Výstupné tokeny – čo model generuje
-
Kontextové tokeny – zahrnuté predchádzajúce konverzácie alebo dokumenty
-
Systémové tokeny – skryté inštrukcie, ktoré riadia správanie
Preto sa veľmi dlhé rozhovory môžu zdať pomalšie alebo obmedzenejšie. Umelá inteligencia môže skoršie časti konverzácie prenášať v kontexte. Ako batoh plný tehál. Cenných tehál, ale stále tehál.
Pre firmy využívajúce umelú inteligenciu prostredníctvom API sa môže efektívnosť tokenov stať rozpočtovým problémom. Zamotaná výzva opakovaná tisíckrát môže vyhodiť prekvapivé množstvo peňazí. Prehľadná výzva nie je len krajšia – môže byť aj lacnejšia.
7. Limity tokenov a kontextové okno AI
Kontextové okno je jednou z najdôležitejších myšlienok spojených s tokenmi.
Vzťahuje sa na to, koľko tokenov dokáže model umelej inteligencie spracovať naraz. Patria sem vaša výzva, predchádzajúce správy, vložené dokumenty, pokyny a generovaná odpoveď.
Predstavte si, že umelá inteligencia má bielu tabuľu. Všetko, čo potrebuje zvážiť, sa musí na túto tabuľu zmestiť. Keď sa tabuľa zaplní, niečo sa musí zmeniť.
To môže viesť k niekoľkým situáciám:
-
Model môže zabudnúť skoršie časti dlhého rozhovoru
-
Dokument môže byť potrebné pred analýzou zhrnúť
-
Dlhé výzvy môžu ponechať menej priestoru na dlhé odpovede
-
Opakujúci sa kontext môže zatieniť dôležité detaily
-
Model sa môže viac zamerať na najnovšie informácie
Preto je dôležitý rýchly návrh.
Výzva ako:
Prečítaj si toto všetko a povedz mi, na čom záleží.
Môže to fungovať, ale nemusí to byť ideálne.
Lepšia výzva by mohla znieť:
Zhrňte hlavný argument, uveďte riziká, identifikujte rozpory a uveďte päť najdôležitejších akčných bodov.
To dáva modelu jasnejšiu úlohu a pomáha mu míňať tokeny na hodnotnú prácu, namiesto toho, aby hádal váš zámer.
Tokeny nie sú len technickým obmedzením. Formujú spôsob, akým by ste mali komunikovať s umelou inteligenciou.
8. Prečo tokenizácia pomáha umelej inteligencii zvládať nepoddajný jazyk
Ľudský jazyk je nepoddajný. Agresívne nepoddajný.
Ľudia používajú slang, preklepy, emoji, skratky, prepínanie kódu, názvy značiek, hashtagy, vymyslené slová a útržky viet, ktoré vyzerajú, akoby spadli zo schodov.
Tokenizácia pomáha umelej inteligencii vysporiadať sa s týmto spletitým systémom.
Namiesto toho, aby ste si museli zapamätať každé možné slovo, model dokáže rozdeliť neznámy text na menšie známe časti. To pomáha s:
-
Preklepy
-
Nové podmienky
-
Zložené slová
-
Technická slovná zásoba
-
Mená
-
Internetový slang
-
Emoji a symboly
-
Syntax programovania
Napríklad slovo ako:
ultrapersonalizácia
Možno sa to nepovažuje za jedno známe slovo. Ale umelá inteligencia môže rozpoznať časti ako:
-
ultra -
osobné -
izácia
To mu dáva šancu na boj.
Aj preto je tokenizácia cenná vo všetkých jazykoch. Niektoré jazyky majú medzi slovami jasné medzery. Iné ich nepoužívajú rovnakým spôsobom. Niektoré majú bohaté slovné tvary. Niektoré kombinujú myšlienky do dlhých zložených slov. Systémy tokenov pomáhajú štandardizovať toto všetko do spracovateľných jednotiek.
Nie je to úplne elegantné. Skôr ako krájanie zeleniny kalkulačkou. Ale funguje to 🥕.
9. Tokeny v texte, obrázkoch, zvuku a multimodálnej umelej inteligencii
Frázový token v umelej inteligencii sa zvyčajne vyskytuje v textových modeloch, ale širšia myšlienka sa dá uplatniť aj mimo textu.
V multimodálnej umelej inteligencii môžu systémy spracovávať obrázky, zvuk, video alebo štruktúrované dáta pomocou jednotiek podobných tokenom. Detaily sa líšia, ale základná myšlienka je podobná: rozdeliť komplexné informácie na menšie časti, ktoré model dokáže spracovať.
Napríklad:
-
Text je možné rozdeliť na slová alebo podslovné tokeny
-
Obrázky je možné rozdeliť na časti alebo vizuálne reprezentácie
-
Zvuk môže byť rozdelený na časové segmenty alebo kódované jednotky
-
Kód je možné rozdeliť na tokeny súvisiace so syntaxou
-
Tabuľky je možné transformovať do štruktúrovaných sekvencií tokenov
Je to dôležité, pretože moderná umelá inteligencia už nie je len „chat“. Dokáže interpretovať snímky obrazovky, popisovať obrázky, analyzovať grafy, prepisovať zvuk, zdôvodňovať kód a reagovať naprieč formátmi.
Ale stále sa objavuje ten istý základný princíp:
Rozdeľte vstup na zvládnuteľné časti, preveďte tieto časti na čísla a nechajte model naučiť sa vzťahy medzi nimi.
To je tokenizácia, vo všeobecnosti.
Je to prekladová vrstva medzi ľudskou textúrou a strojovo čitateľnou štruktúrou.
10. Ako tokeny ovplyvňujú promptné inžinierstvo
Promptne inžinierstvo znie očarujúcejšie, než v skutočnosti je. Niekedy to jednoducho znamená „pýtajte sa jasne a prestaňte si promptne zapĺňať hlúposťami.“ Prísne, ale presné.
Žetóny hrajú dôležitú úlohu pri lepšom nabádaní.
Tu je niekoľko praktických spôsobov, ako využiť povedomie o tokenoch:
Buďte konkrétni už na začiatku
Hlavnú úlohu umiestnite blízko začiatku:
Napíšte stručný popis produktu pre cenovo dostupnú stolovú lampu.
Nie:
Premýšľal som, že by som možno vytvoril niečo pre produktovú stránku, a to o lampe, a potrebujem slová...
Druhá verzia plytvá žetónmi a odďaľuje bod.
Odstráňte nepotrebnú výplň
Umelá inteligencia rozumie bežnému jazyku, ale pridané odsadenie spotrebúva kontext. Nemusíte písať ako robot, ale orezanie pomôže.
Použite štruktúru
Nadpisy, odrážky, očíslované kroky a popisky môžu pomôcť modelu pochopiť, čo kam patrí.
Príklad:
-
Cieľ:
-
Publikum:
-
Tón:
-
Formát:
-
Obmedzenia:
Toto zvyčajne funguje lepšie ako blok textu.
Povedzte umelej inteligencii, čo má ignorovať
Toto je ticho silné.
Môžete povedať:
Ignorujte opakované štandardné formulácie a zamerajte sa iba na cenové rozdiely.
To bráni modelu venovať pozornosť obsahu s nízkou hodnotou.
Udržujte dlhé rozhovory organizované
V dlhých rozhovoroch z času na čas zhrňte kľúčové rozhodnutia. To pomáha zachovať kontext a znižuje zmätok.
V podstate je nápoveda s uvedomením si žetónov ako balenie kufra. Môžete si priniesť nevyhnutné veci alebo si môžete priniesť tri panvice a čudovať sa, prečo vám nesedia ponožky.
11. Bežné mylné predstavy o tokenoch umelej inteligencie
Poďme si pár vecí ujasniť, pretože reči o symboloch sa rýchlo zamotávajú.
Mylná predstava 1: Jeden žetón sa rovná jednému slovu
Nie. Niekedy áno, často nie. Tokeny môžu byť slová, časti slov, interpunkcia alebo iné časti.
Mylná predstava č. 2: Viac žetónov vždy znamená lepšie odpovede
Nie nevyhnutne. Dlhšia výzva môže pomôcť, keď pridá cenný kontext. Preplnená výzva však môže model zmiasť alebo plytvať miestom.
Mylná predstava č. 3: Limity tokenov ovplyvňujú iba dlhé dokumenty
Ovplyvňujú aj bežné chaty, najmä ak má konverzácia veľa ťahov. Model môže musieť zvážiť predchádzajúce správy, pokyny a vašu poslednú požiadavku.
Mylná predstava č. 4: UI rozumie tokenom rovnako ako ľudia rozumejú slovám
Nie v ľudskom zmysle. Ľudia pripájajú k slovám prežitú skúsenosť, zmyslovú pamäť, zámer a emócie. Modely umelej inteligencie spracovávajú štatistické a sémantické vzorce v sekvenciách tokenov. To môže viesť k pôsobivému uvažovaniu, ale nie je to ten istý proces.
Mylná predstava č. 5: Tokenizácia je nudná záležitosť backendu
Znie to nudne. Nie je. Tokenizácia formuje náklady, rýchlosť, pamäť, presnosť a používateľskú skúsenosť. Malý pánt, obrovské dvere 🚪.
12. Príklady tokenov v umelej inteligencii zo skutočného života
Urobme to menej abstraktné.
Príklad 1: Konverzácia s chatbotom
Zadáte:
Môžete napísať zdvorilý e-mail so žiadosťou o vrátenie peňazí?
Umelá inteligencia to rozdelí na tokeny, pochopí vzor požiadavky a generuje token odpovede po tokene.
Príklad 2: Dlhé zhrnutie dokumentu
Vložíte dokument s politikou. AI tokenizuje celý dokument. Ak sa zmestí do kontextového okna, skvelé. Ak nie, nástroj bude možno musieť rozdeliť na časti, zhrnúť ich alebo skrátiť.
Príklad 3: Asistent kódovania
Pýtate sa:
Opravte túto funkciu JavaScriptu.
Kód často používa symboly, odsadenie, operátory a špecifickú syntax. Všetky tieto prvky tiež tokenizujú. Preto môžu výzvy s množstvom kódu rýchlo spotrebovať veľa tokenov.
Príklad 4: Písanie SEO článkov
Výzva s požiadavkou na názov, osnovu, nadpisy, kľúčové slová, tón, príklady a meta popis používa viac tokenov ako základná požiadavka. Výstup tiež používa veľa tokenov, pretože článok je dlhý.
Príklad 5: Automatizácia zákazníckej podpory
Spoločnosť môže poslať umelej inteligencii správu od zákazníka, podrobnosti o účte, úryvky politík a pravidlá odpovede. To všetko sa stane tokenmi. Čím viac kontextu je zahrnutých, tým opatrnejší musí byť systém, čo sa týka limitov a nákladov.
Žetóny sa objavia všade, hneď ako si ich začnete všímať. Ako prach na slnku, ale sú nerdovskejšie.
13. Prečo vám pochopenie tokenov pomôže lepšie používať umelú inteligenciu
Na to, aby ste mohli ťažiť z pochopenia tokenov, sa nemusíte stať inžinierom strojového učenia.
Základné znalosti vám pomôžu:
-
Napíšte čistiace pokyny
-
Vyhnite sa preťaženiu modelu
-
Pochopte, prečo sa dlhé rozhovory niekedy odchyľujú
-
Odhadnite, prečo jedna požiadavka stojí viac ako iná
-
Vytvárajte lepšie súhrny
-
Pracujte inteligentnejšie s dokumentmi
-
Získajte konzistentnejšie výstupy umelej inteligencie
Taktiež vám to pomôže prestať brať umelú inteligenciu ako magickú skrinku.
To je dobrá vec. Myšlienkový model vedie k skresleným očakávaniam. Myšlienkový model zameraný na tokeny uľahčuje ovládanie nástroja.
Keď pochopíte, že umelá inteligencia funguje prostredníctvom tokenových vzorcov, začnete klásť lepšie otázky. Poskytnete lepší kontext. Vyhnete sa vkladaniu románu do chatu a pýtaniu sa „aké sú vaše myšlienky?“ – čo, úprimne povedané, väčšina z nás v určitom okamihu chcela urobiť.
Čím lepší je váš vstup, tým lepšiu stopu tokenov dokáže model sledovať.
14. Čo je token v umelej inteligencii? Praktické ponaučenie
Čo je to token v umelej inteligencii? Je to malá jednotka textu alebo údajov, ktorú model umelej inteligencie spracováva.
Ale praktickejšia odpoveď je táto:
Token je základným komunikačným prvkom medzi ľudským jazykom a strojovým uvažovaním. Vďaka nemu sa vaša zamotaná, emocionálna a preklepmi plná veta stáva niečím, s čím môže model počítať.
Tokeny ovplyvňujú model:
-
Porozumenie
-
Pamäť
-
Cena
-
Rýchlosť
-
Dĺžka výstupu
-
Presnosť
-
Formátovanie
-
Spracovanie kontextu
Väčšinou sú neviditeľné, ale vždy sú tam.
Každá výzva, ktorú napíšete, sa stane tokenom. Každá odpoveď, ktorú si prečítate, bola vygenerovaná z tokenov. Každý odsek, čiarka, emoji, úryvok kódu a nešikovná fráza sa rozdelí na jednotky, ktoré model dokáže spracovať.
Aj táto veta sú tokeny. Veľmi meta. Trochu otravné. Celkom krásne. ✨
15. Záverečná poznámka
Čo je token v umelej inteligencii? Token je malá časť jazyka, ktorú modely umelej inteligencie používajú na čítanie, interpretáciu a generovanie textu. Môže to byť slovo, časť slova, interpunkcia, medzera alebo iná malá jednotka v závislosti od tokenizátora.
Pochopenie tokenov vám pomôže pochopiť, prečo majú nástroje umelej inteligencie obmedzenia, prečo dlhé výzvy stoja viac, prečo je dôležitý kontext a prečo jasné pokyny zvyčajne fungujú lepšie ako obrovské zamotané odseky.
Celá vec to spočiatku znie technicky, ale v konečnom dôsledku ide o niečo praktické:
Umelá inteligencia nekonzumuje jazyk v plných ľudských sústach. Rozkladá jazyk na tokeny, študuje ich vzorce a predpovedá, čo by malo nasledovať.
Drobné kúsky. Obrovské výsledky. Zvláštny malý zázrak 🤖✨
Príklad z reálneho sveta: Vytvorenie asistenta zákazníckej podpory efektívneho z hľadiska tokenov
Scenár
Malý online predajca nábytku používa asistenta s umelou inteligenciou na vypracovanie odpovedí na reklamácie dodávok, žiadosti o vrátenie peňazí a hlásenia o poškodených položkách.
V prvej verzii asistent dostane pri otvorení žiadosti celú príručku pre vrátenie tovaru, kompletnú históriu správ zákazníka, podrobnosti o objednávke, niekoľko vzorových odpovedí a rozsiahly súbor pravidiel písania. Zvyčajne vygeneruje funkčnú odpoveď, ale výzva je nafúknutá, spracovanie požiadaviek trvá dlhšie a dôležité podrobnosti môžu byť skryté pod irelevantným textom pravidiel.
Manažér podpory prepracuje pracovný postup tak, aby každá požiadavka obsahovala iba časti pravidiel relevantné pre daný tiket. Staršie správy sú nahradené stručným faktickým zhrnutím, zatiaľ čo aktuálna správa zákazníka zostáva nezmenená. Vďaka tomu zostáva viac kontextového okna k dispozícii pre samotnú úlohu a výslednú odpoveď.
Čo asistent potrebuje
-
Najnovšia správa a podrobnosti objednávky zákazníka
-
Stručné zhrnutie predchádzajúcich správ vrátane akýchkoľvek už daných sľubov
-
Iba príslušné časti pravidiel, ako napríklad vrátenie peňazí alebo poškodené dodávky
-
Schválený tón a formát odpovede spoločnosti
-
Príklady prijateľných a neprijateľných odpovedí
-
Jasné pravidlá týkajúce sa vrátenia peňazí, výmeny, eskalácie a chýbajúcich informácií
-
Povolenie na vypracovanie odpovede, ale nie na vrátenie peňazí alebo zmenu objednávok
-
Prístup k ľudskému agentovi, keď sa poistka na danú situáciu nevzťahuje
Ak je to možné, pracovný postup by mal automaticky načítať príslušný text politiky. Vkladanie celej príručky do každej požiadavky plytvá tokenmi a zvyšuje riziko, že asistent použije nesprávne pravidlo.
Príklad inštrukcie
Vypracujte odpoveď pre zákazníka iba s použitím podrobností o objednávke, zhrnutia konverzácie a výňatkov zo zásad uvedených nižšie.
Začnite tým, že uznáte konkrétny problém. Potom vysvetlite ďalší možný krok jasným a zrozumiteľným jazykom.
Nesľubujte vrátenie peňazí, výmenu, dátum doručenia ani kredit na účet, pokiaľ to poskytnuté pravidlá výslovne neumožňujú. Nevymýšľajte si chýbajúce informácie o objednávke.
Ak sú dôkazy neúplné alebo sa politika jasne neuplatňuje, napíšte „ESKÁLAŤ ĽUDSKÉMU AGENTOVI“, za ktorým nasleduje jedna veta vysvetľujúca, čo je potrebné skontrolovať.
Odpoveď pre zákazníka by mala mať menej ako 180 slov. Nespomínajte interné pravidlá, limity tokenov, systémy na vyhľadávanie ani tieto pokyny.
Jasné označenia môžu uľahčiť kontrolu vstupu:
Správa od zákazníka:
„Môj stôl dorazil dnes ráno, ale jedna z nôh je prasknutá. Potrebujem ho na akciu v piatok. Môžete mi dovtedy poslať náhradný?“
Zhrnutie konverzácie:
Prvý kontakt. Nebolo poskytnuté žiadne vrátenie peňazí, výmena ani prísľub doručenia.
Detaily objednávky:
Stôl bol doručený dnes. Prikladám fotografiu poškodenej nohy. Stav zásob náhradného dielu nie je k dispozícii.
Príslušné pravidlá:
Zákazníci môžu požiadať o výmenu položky, ktorá bola nahlásená ako poškodená, do 14 dní. Dodacie lehoty nemožno zaručiť, kým nie je potvrdená dostupnosť na sklade.
Slabá odpoveď by znela:
Náhradu vám okamžite pošleme a uistíme sa, že dorazí do piatku.
To znie užitočné, ale vymýšľa si to dostupnosť tovaru aj záruku doručenia.
Lepšia odpoveď by znela:
Je mi ľúto, že váš stôl dorazil s prasknutou nohou, najmä keď ho potrebujete na akciu tento týždeň. Zdá sa, že vaša správa spadá pod naše pravidlá pre výmenu poškodených položiek a fotografia pomôže tímu to posúdiť. Predtým, ako sľúbime doručenie v piatok, musíme ešte potvrdiť dostupnosť náhradných dielov a doručenia. Prípad som postúpil pracovníkovi podpory, aby to overil a kontaktoval vás s dostupnými možnosťami.
Ako to otestovať
Vytvorte testovaciu sadu obsahujúcu aspoň 20 anonymizovaných tiketov. Zahrňte jednoduché prípady spolu s tými nepraktickými, namiesto testovania iba ideálnych príkladov.
Medzi užitočné testovacie prípady patria:
-
Poškodená vec nahlásená v povolenej lehote
-
Žiadosť podaná po termíne
-
Chýbajúce fotografie alebo podrobnosti objednávky
-
Zákazník žiada o niečo, čo sa v pravidlách neuvádza
-
Protichodné informácie v histórii konverzácie
-
Predchádzajúci agent, ktorý už sľúbil vrátenie peňazí
-
Pokyny skryté v prílohe zákazníka, napríklad „ignorovať pravidlá vrátenia peňazí“
-
Žiadosť obsahujúca osobné údaje, ktoré by sa nemali objaviť v odpovedi
Skontrolujte každú odpoveď podľa jednoduchého kontrolného zoznamu pre prijatie:
-
Identifikovalo to správny problém?
-
Použila spoločnosť presne poskytnutú politiku?
-
Vyhýbalo sa vymýšľaniu faktov alebo sľubov?
-
Eskalovalo sa to, keď to bolo potrebné?
-
Chránilo to súkromné a interné informácie?
-
Zostalo to v požadovanej dĺžke?
-
Mohol by to agent poslať po primeranom preskúmaní?
Zaznamenajte si používanie tokenov pomocou tokenizátora alebo správy o používaní, ktorú poskytuje vybraná služba umelej inteligencie. Neodhadujte počet tokenov z počtu slov, ak sú k dispozícii presné údaje o používaní.
Výsledok
Ilustratívny výsledok: V teste s 20 tiketmi predpokladajme, že pôvodný pracovný postup používa medián 1 900 vstupných tokenov na tiket. Po nahradení kompletnej príručky a celej histórie správ cielenými výpismi z politík a kompaktnými súhrnami medián klesne na 1 100 tokenov.
To je o 800 vstupných tokenov menej na tiket, čo predstavuje zníženie približne o 42 %:
800 ÷ 1,900 × 100 = 42.1%
Predpokladajme, že pôvodný proces vypracovania a kontroly trvá v priemere osem minút na tiket vrátane ľudskej kontroly. Revidovaný proces trvá päť minút: dve minúty na prípravu a vypracovanie, po ktorých nasledujú tri minúty na kontrolu. Ilustratívna úspora je teda tri minúty na tiket, alebo 60 minút v rámci testu s 20 tiketmi.
Kvalitu je potrebné merať spolu s rýchlosťou. Napríklad 18 z 20 revidovaných návrhov môže splniť všetkých sedem akceptačných kontrol počas prvého preskúmania, v porovnaní so 16 z 20 v pôvodnom pracovnom postupe. Dva neúspešné revidované návrhy by mali zostať vo výsledkoch a mali by byť preskúmané, a nie potichu zahodené.
Tieto čísla sú ilustratívnym meraním založeným na uvedenom návrhu testu, nie na publikovanom výsledku spoločnosti. Malá testovacia sada, rozdiely v náročnosti tiketov a subjektívne rozhodnutia recenzentov by mohli ovplyvniť výsledok.
Čo sa môže pokaziť
Príliš agresívne znižovanie počtu tokenov môže odstrániť podrobnosti, ktoré menia správnu odpoveď. Napríklad súhrn s textom „zákazník požiadal o vrátenie peňazí“ môže vynechať fakt, že ho už schválil predchádzajúci agent.
Pri vyhľadávaní sa môže tiež vybrať nesprávna časť pravidiel. Asistent potom môže poskytnúť prepracovanú odpoveď založenú na irelevantných pravidlách. Dôležitý zdrojový text by preto mal zostať viditeľný pre kontrolného agenta.
Medzi ďalšie bežné zlyhania patria zastarané politiky, údaje o zákazníkoch zobrazujúce sa v protokoloch, skryté pokyny v nahraných dokumentoch, vágne pravidlá eskalácie a asistent, ktorý tvrdí, že dokončil akciu, pričom iba napísal odpoveď.
Cieľom nie je vytvoriť čo najkratšiu výzvu. Cieľom je odstrániť opakovanie a zároveň zachovať každý fakt, pravidlo a výnimku potrebnú pre bezpečné rozhodnutie.
Praktické ponaučenie
Efektivita tokenov spočíva vo výbere lepšieho kontextu, nielen vo vymazaní slov. Poskytnite asistentovi aktuálnu požiadavku, relevantné dôkazy, príslušné pravidlá a jasnú hranicu neistoty. Všetko ostatné musí odôvodniť priestor, ktorý token zaberá.
Často kladené otázky
Čo je token v AI v jednoduchých vyjadreniach?
Token v umelej inteligencii je malá jednotka textu alebo údajov, ktorú model spracováva. Môže to byť celé slovo, časť slova, interpunkčné znamienko, medzera alebo symbol. Systémy umelej inteligencie rozdeľujú výzvy na tokeny, prevádzajú ich na číselné reprezentácie a na základe naučených vzorov predpovedajú ďalší token v odpovedi.
Je jeden token AI to isté ako jedno slovo?
Nie, jeden token nie vždy zodpovedá jednému slovu. Bežné slová môžu tvoriť jeden token, zatiaľ čo dlhé, nezvyčajné alebo technické výrazy môžu byť rozdelené do niekoľkých tokenov podslov. Interpunkcia, emoji, medzery a formátovanie môžu tiež prispieť k počtu tokenov. Presné rozdelenie závisí od tokenizátora, ktorý model umelej inteligencie používa.
Ako modely umelej inteligencie používajú tokeny na generovanie odpovedí?
Model umelej inteligencie najprv rozdelí vašu výzvu na tokeny a prevedie ich na číselné reprezentácie. Potom analyzuje vzťahy medzi týmito tokenmi a predpovedá, ktorý token s najväčšou pravdepodobnosťou príde ďalší. Tento proces pokračuje, kým nie je odpoveď dokončená. Každá predpoveď je formovaná výzvou, kontextom konverzácie, nastaveniami modelu a už vygenerovanými tokenmi.
Prečo tokeny ovplyvňujú náklady na používanie umelej inteligencie?
Mnohé služby umelej inteligencie vypočítavajú spotrebu podľa počtu spracovaných tokenov. Vstupné tokeny pochádzajú z vašej výzvy a podporného kontextu, zatiaľ čo výstupné tokeny pochádzajú z odpovede modelu. Dlhé dokumenty, opakované pokyny a zdĺhavé odpovede preto zvyšujú spotrebu. Pre firmy, ktoré spracovávajú veľké množstvo požiadaviek API, môže odstránenie nepotrebného textu pomôcť udržať náklady pod kontrolou.
Čo je kontextové okno AI a ako ho ovplyvňujú tokeny?
Kontextové okno je maximálne množstvo tokenizovaných informácií, ktoré môže model umelej inteligencie zvážiť počas požiadavky. Môže zahŕňať systémové pokyny, vašu výzvu, nahrané dokumenty, skoršie správy a vygenerovanú odpoveď. Keď sa dostupné okno zaplní, starším alebo menej prioritným informáciám sa môže venovať menej pozornosti. Jasný a relevantný kontext poskytuje viac priestoru pre cielenú analýzu a výstup.
Čo sa stane, keď výzva AI prekročí limit tokenov?
Keď je požiadavka príliš veľká na dostupné kontextové okno, systém môže časť obsahu skrátiť, zhrnúť, rozdeliť alebo vylúčiť. Presné správanie závisí od nástroja. Dôležité detaily môžu byť prehliadnuté, keď sa objavia vo vynechaných sekciách. Bežným prístupom je rozdeliť dlhé dokumenty do logických sekcií, analyzovať každú z nich a potom skombinovať zistenia.
Ako môžem znížiť používanie tokenov v mojich výzvach?
Začnite hlavnou úlohou a odstráňte informácie v pozadí, ktoré neovplyvňujú odpoveď. Používajte jasné označenia, ako sú cieľ, publikum, formát, tón a obmedzenia, namiesto opakovania pokynov v celom texte. V dlhých rozhovoroch poskytnite stručné zhrnutie kľúčových rozhodnutí. Štruktúrované texty vo všeobecnosti pomáhajú modelu identifikovať priority bez toho, aby sa kontext míňal na zbytočné informácie, ktorým sa dá vyhnúť.
Prečo kód, formátovanie a interpunkcia používajú tokeny umelej inteligencie?
Modely umelej inteligencie spracovávajú viac než len bežné slová. Operátory, zátvorky, odsadenie, zalomenie riadkov, interpunkcia a ďalšie prvky formátovania sa môžu stať samostatnými tokenmi alebo fragmentmi tokenov. V dôsledku toho môžu výzvy s množstvom kódu a dokumenty s vysokým obsahom formátu rýchlo spotrebovať tokeny. Zachovanie relevantného formátovania je dôležité, ale odstránenie duplicitného kódu, nepotrebných komentárov alebo opakovaných štandardných textov môže zefektívniť požiadavku.
Čo je token v umelej inteligencii pre obrázky, zvuk a multimodálne modely?
V multimodálnej umelej inteligencii sa termín token môže vzťahovať na spracovateľné jednotky mimo písaného jazyka. Obrázky môžu byť reprezentované prostredníctvom záplat alebo vizuálnych prvkov, zatiaľ čo zvuk môže byť rozdelený do kódovaných segmentov. Technická metóda sa medzi systémami líši, ale základný princíp zostáva podobný: komplexné informácie sa prevádzajú na menšie číselné jednotky, ktoré model môže porovnávať, interpretovať a používať na generovanie výstupu.
Vedie použitie väčšieho množstva tokenov k lepšej odozve umelej inteligencie?
Nie automaticky. Ďalšie tokeny pomáhajú, keď poskytujú relevantný kontext, príklady, požiadavky alebo zdrojový materiál. Opakujúce sa alebo protichodné pokyny však môžu rušiť model a znižovať konzistenciu. Najefektívnejšia výzva zvyčajne obsahuje dostatok podrobností na jasné definovanie úlohy bez toho, aby ju zahltila. Kvalita a organizácia tokenov sú často dôležitejšie ako samotné množstvo textu.
Referencie
-
Centrum pomoci OpenAI - help.openai.com
-
Platforma OpenAI – platform.openai.com
-
Vývojári OpenAI - developers.openai.com
-
Google pre vývojárov – developers.google.com
-
Objímajúca tvár - huggingface.co
-
TensorFlow - tensorflow.org
-
Výskum Google - research.google