Slovník výrazov AI/Veľké jazykové modely

Veľké jazykové modely

veľký jazykový model

Anglický výraz large language model

základnéheslo č. 4515 otázok a odpovedí2 odborné zdroje

Presná definícia

Čo znamená veľký jazykový model?

Veľký jazykový model (LLM) je parametrický model sekvencií trénovaný na rozsiahlych textových alebo multimodálnych korpusoch, ktorý odhaduje pravdepodobnosti tokenov a dokáže sa prispôsobiť mnohým jazykovým úlohám z promptu alebo doladenia. Slovo „veľký“ nemá pevnú hranicu; týka sa rozsahu parametrov, dát a výpočtu v danom období.

Skúsenosť a kontext

Ako sa pojem používa v praxi

LLM sa používa na sumarizáciu, vyhľadávanie v dokumentoch, návrhy textu, extrakciu údajov a prácu s kódom. Nasadenie potrebuje presný eval set z cieľovej domény, riadenie prístupu k dátam, limity nástrojových oprávnení a ľudskú kontrolu rizikových výstupov. Výkon benchmarku nenahrádza meranie faktických chýb a nákladov v reálnej prevádzke.

Overiteľnosť

Odborné zdroje

  1. Language Models are Few-Shot Learnersarxiv.org
  2. On the Opportunities and Risks of Foundation Modelsarxiv.org

Praktické odpovede

Často kladené otázky

Ako funguje veľký jazykový model?

Transformer spracuje tokeny na kontextové reprezentácie a predtrénovanie upraví parametre tak, aby predikovali skryté alebo nasledujúce tokeny.

Kedy má veľký jazykový model praktický význam?

LLM sa používa na sumarizáciu, vyhľadávanie v dokumentoch, návrhy textu, extrakciu údajov a prácu s kódom.

S čím si pojem nezamieňať?

Základový model je širšia kategória naprieč modalitami; LLM je zameraný na jazykové sekvencie, hoci môže prijímať aj ďalšie vstupy.

Ako sa výsledok kontroluje?

Hodnotí sa výkon po úlohách, faktická presnosť, kalibrácia, robustnosť promptov, bezpečnosť, latencia a cena na úspešný prípad.

Na čo si dať pozor?

Model môže halucinovať, zdediť bias dát, zverejniť citlivý kontext alebo zneužiť pripojený nástroj; veľkosť sama negarantuje spoľahlivosť.