Słownik AI
Co to jest LLM? Duży model językowy wyjaśniony prostym językiem
LLM, czyli duży model językowy, to AI wytrenowana na ogromnych ilościach tekstu. Przewidując kolejne słowa, potrafi pisać, streszczać, tłumaczyć i odpowiadać na pytania.
Inne nazwy: large language model, duży model językowy, model językowy
Jak działa duży model językowy
LLM (od angielskiego large language model) robi w gruncie rzeczy jedną rzecz: patrzy na dotychczasowy tekst i przewiduje, co powinno pojawić się dalej. Nie całe zdanie naraz, tylko po kawałku, po jednym tokenie. Każdy nowy kawałek dokleja do tekstu i przewiduje następny.
Brzmi to banalnie, ale żeby przewidywać dobrze, model musiał podczas treningu przyswoić sobie gramatykę, fakty, style pisania i sposoby rozumowania ukryte w miliardach stron tekstu. Słowo „duży” odnosi się właśnie do skali. Liczba parametrów, czyli wewnętrznych ustawień modelu, idzie w miliardy, a dane treningowe w biliony tokenów. Pod spodem prawie zawsze działa architektura transformer.
LLM a ChatGPT
ChatGPT to aplikacja, a LLM to silnik w jej środku. Claude od Anthropic i Gemini od Google to z kolei nazwy zarówno modeli, jak i aplikacji do rozmowy z nimi. Poza nimi są modele, które można pobrać i uruchomić u siebie, jak Llama, Mistral czy polskie Bielik i PLLuM. Piszę o nich przy haśle model open source.
Który wybrać do firmy? To zależy od zadania i często odpowiedź brzmi: więcej niż jeden. W projektach kieruję proste zapytania do tańszych modeli, a trudne do mocniejszych. Porównanie trzech najpopularniejszych znajdziesz w tekście ChatGPT, Claude czy Gemini.
Czego model językowy nie wie
Model zna świat tylko do daty, w której skończono go trenować. Nie wie też niczego o Twojej firmie: cennika, regulaminu, historii klienta. Żeby odpowiadał na ich podstawie, trzeba mu te informacje podać w oknie kontekstowym, najczęściej przez RAG.
Nie sprawdza też faktów. Jeśli czegoś nie wie, bywa, że wymyśli coś, co brzmi wiarygodnie, i to zjawisko ma swoją nazwę: halucynacje. Przy długich obliczeniach też potrafi się pomylić, dlatego w dobrze zbudowanych systemach liczy za niego kalkulator albo arkusz, a model tylko prosi o wynik przez function calling.
Najczęstsze pytania
Czy LLM uczy się z moich rozmów?
Sam model w trakcie rozmowy się nie zmienia, jego wiedza jest zamrożona po treningu. Co innego firma, która go udostępnia: aplikacje konsumenckie mogą wykorzystywać rozmowy do trenowania kolejnych wersji, jeśli tego nie wyłączysz. Przy dostępie przez API i w planach firmowych główni dostawcy domyślnie nie używają danych do treningu, ale zawsze warto sprawdzić aktualny regulamin.
Czym różni się LLM od chatbota?
LLM to model, który generuje tekst. Chatbot to program do rozmowy, który może, ale nie musi, korzystać z LLM. Starsze chatboty działały na sztywnych scenariuszach i z modelami językowymi nie miały nic wspólnego.
Kontakt
Masz proces, który zjada czas zespołu?
Napisz dwa zdania o tym, co boli. Odpiszę i powiem wprost, czy warto to automatyzować.
albo zadzwoń +48 735 170 951 · +48 516 461 444
Zwykle odpisuję tego samego dnia.