01Inštrukcie
02História
03Dokumenty
04Odpoveď
Keď sa limit zaplní, staršie alebo menej dôležité informácie môžu vypadnúť.
Kontextové okno je pracovný priestor modelu pre aktuálnu požiadavku. Nejde o ľudskú pamäť a jeho veľkosť sama osebe nezaručuje, že model použije každú vloženú informáciu správne.
Po prečítaní budete vedieť
- rozlíšiť kontextové okno, parametre modelu a externú pamäť
- navrhnúť poradie a štruktúru dlhého vstupu
- testovať stratu informácií v rozsiahlych dokumentoch
Zadarmo po registrácii
Celá kapitola je zadarmo po registrácii.
38odborných častí
36minút čítania
30odkazov na zdroje
V plnej kapitole nájdete
- Čo je kontext v jednom volaní modelu
- Kontextové okno, dĺžka vstupu a výstupný limit
- Tokeny nie sú slová ani strany
- Kontext nie je dlhodobá pamäť
- Prečo poradie tokenov potrebuje pozičnú informáciu
- Self-attention: ako sa tokeny vzťahujú k predchádzajúcemu kontextu
- Prečo dĺžka pri štandardnom attention stojí veľa
- FlashAttention zrýchľuje presný attention, ale nemení jeho význam
Registrovať sa alebo prihlásiť
Prihlásenie zabezpečuje ChatGPT. PoznAI nedostane vaše heslo.
Praktické odpovede
Často kladené otázky
Čo sa počíta do kontextového okna?
Systémové inštrukcie, história rozhovoru, vložené dokumenty, aktuálna otázka, výsledky nástrojov a často aj pripravovaná odpoveď.
Pamätá si model všetko z dlhého kontextu rovnako dobre?
Nie. Informácie môže využívať nerovnomerne a dôležitý detail sa môže stratiť medzi veľkým množstvom textu.
Ako pracovať s veľmi dlhým dokumentom?
Rozdeľte úlohu na kroky, označte relevantné časti, používajte vyhľadávanie alebo RAG a overujte odpoveď proti pôvodným pasážam.
Prihlásiť / registrovať