Hranice kontextového okna
Pamätám si, ako som sa snažil do modelu vložiť celú technickú dokumentáciu o rozsahu 300 strán. Model začal strácať niť uprostred textu. Je to fenomén známy ako „stratený v strede“ (lost in the middle). Modely majú tendenciu venovať najväčšiu pozornosť začiatku a koncu dopytu, zatiaľ čo informácie v strede sú často ignorované alebo skreslené.
Pri práci s veľkými objemami dát je preto nevyhnutné informácie segmentovať. Ak pracujete na projekte, ktorý vyžaduje analýzu histórie, odporúčam pozrieť si sekciu História indexovania informácií, aby ste pochopili, ako sa vyvíjalo ukladanie dát. Kontextové okno nie je nekonečné a každé slovo (token) spotrebúva výpočtovú kapacitu a pozornosť modelu.
- — „Vždy definujte najdôležitejšie inštrukcie na úplnom konci dopytu.“
- — „Používajte jasné oddeľovače ako ### alebo --- pre rozlíšenie inštrukcií a dát.“