Słownik AI
LLM
Large Language Model large language model
Duży model językowy - sieć neuronowa trenowana na ogromnych zbiorach tekstu, przewidująca kolejne tokeny.
LLM (duży model językowy) to sieć neuronowa o architekturze transformera, wytrenowana na bardzo dużych zbiorach tekstu. Jej podstawowe zadanie brzmi prosto: przewidzieć najbardziej prawdopodobny następny token.
Skąd biorą się umiejętności
Z tego pozornie prostego celu wyłaniają się zdolności, których nikt nie programował wprost: pisanie kodu, streszczanie, tłumaczenie, rozumowanie. Powód jest taki, że dobre przewidywanie kolejnego słowa wymaga przyswojenia struktur języka, argumentacji i wiedzy o świecie.
Czego LLM nie robi
- Nie przeszukuje internetu ani bazy danych, o ile nie ma podłączonego narzędzia.
- Nie weryfikuje faktów - stąd halucynacje.
- Nie uczy się z Twojej rozmowy; wagi są zamrożone.
- Nie liczy - symuluje liczenie na podstawie wzorców.
Zobacz też: Jak naprawdę działa model językowy.