Veľký jazykový model (LLM, large language model) je typ umelej inteligencie natrénovaný na obrovskom množstve textových dát, ktorý dokáže porozumieť prirodzenému jazyku a generovať text – odpovedať na otázky, písať, sumarizovať, prekladať či programovať. Technologickým základom je architektúra transformer: model sa počas trénovania učí štatistické vzťahy medzi slovami rozdelenými na tokeny a pri generovaní predpovedá vždy najpravdepodobnejšie ďalšie slovo v kontexte. Medzi najznámejšie LLM patria GPT modely od OpenAI, Claude od Anthropicu, Gemini od Googlu a otvorené modely ako Llama alebo Mistral. Schopnosti modelu určuje veľkosť a kvalita trénovacích dát, počet parametrov a veľkosť kontextového okna, teda množstvo textu, ktoré model naraz spracuje. LLM majú aj limity: nepoznajú udalosti po dátume trénovania, môžu halucinovať, teda generovať presvedčivo znejúce nepravdy, a ich výstup závisí od kvality promptu. Vo firmách sa LLM nasadzujú cez API, chatboty, RAG systémy a AI agentov.
Pozri aj: halucinácia AI, kontextové okno.