Vimeo nie odtwarza tego filmu na tej stronie. Film jest przypisany do poprzedniej domeny.
Poznaj najważniejsze koncepcje działania modeli językowych
53 min · Biznes i Automatyzacje
Adam GospodarczykPopularne narzędzia AI (np. ChatGPT, Claude) są raczej podobne. Adresują te same problemy i oferują zbliżone funkcjonalności. Nawet jeśli niekiedy różnice między nimi stają się znaczące z perspektywy użytkownika, od strony technicznej mówimy wciąż o tych samych możliwościach i ograniczeniach, które oferują duże modele językowe (LLM).Dlatego w tym warsztacie spojrzymy na najważniejsze mechaniki i funkcjonalności przez pryzmat tego, co dzieje się „pod spodem", bez jednoczesnego wchodzenia w zbyt techniczne szczegóły. Pozwoli nam to lepiej zrozumieć działanie tych narzędzi i w konsekwencji bardziej świadomie z nimi pracować.
Autoregresja, niedeterministyczne odpowiedzi, limity kontekstu, ograniczenia bazowej wiedzy, tokenizacja czy koszty działania. Każde z wymienionych zagadnień występuje w przypadku obecnie dostępnych modeli językowych i co za tym idzie wpływa także na sposób budowy oraz działanie narzędzi AI. Nawet ogólne zrozumienie tych koncepcji oraz wiedza o tym, jaki wpływ mają one na funkcjonalności np. ChatGPT czy Gemini, pozwala lepiej dostosować swój styl pracy czy lepiej dopasować oczekiwania.
Narzędzia AI oferują funkcjonalności, które są łatwe w obsłudze i możliwe skuteczne w działaniu. Często wymaga to podjęcia działań ukrywających przed nami ograniczenia modeli językowych. Na przykład z technicznego punktu widzenia prowadzenie "nieskończenie długiej" konwersacji na ChatGPT jest niemożliwe. Wiemy jednak, że możemy to zrobić! Po prostu twórcy ChatGPT zastosowali techniki, które ukrywają przed nami fundamentalne ograniczenia modeli językowych. Nie byłoby w tym nic złego gdyby nie fakt, że często przekłada się to jedynie na spadek jakości generowanych odpowiedzi czy nawet trudne do zauważenia błędy.
Twórcy ChatGPT czy Cursor mają do dyspozycji różne narzędzia oraz techniki pracy z modelami generatywnego AI. Przykładowo możliwość dodawania plików czy nawet budowania własnych baz wiedzy, opiera się o mechanizmy wyszukiwania, których skuteczność działania jest ograniczona. W połączeniu z limitami kontekstu modeli językowych, zaczynamy mówić o rozbudowanych mechanizmach, które dają nam poczucie, że "możemy rozmawiać z dokumentami" i szybko zaczynamy wykorzystywać to w codziennej pracy. Jednak gdy przyjrzymy się bliżej, ujawniają się problemy takie jak niepełne wypowiedzi, przekręcone fakty czy jedynie brzmiące wiarygodnie raporty. Tutaj ponownie wiedza o tym, "co dzieje się pod spodem" pozwala lepiej dopasować styl pracy i zwiększyć jakość otrzymywanych rezultatów.
Choć często mówi się o tym, "który model językowy jest najlepszy" tak obecnie to pytanie nie jest poprawne i lepiej zmienić je na "który model językowy jest dostępny DLA MNIE". Dlatego w tym warsztacie znajdziesz zasady, którymi warto kierować się przy premierach nowych modeli oraz tym, jak pozostawać na bieżąco bez konieczności stałego monitorowania tego, co się dzieje na rynku.
Warsztat ten jest przeznaczony dla osób pracujących na co dzień z ChatGPT, Gemini, Claude, Claude Code, Cursor bądź podobnymi narzędziami AI, w których pojawia się interfejs czatu pozwalający na rozmowę z dużym modelem językowym. Znajdziesz w nim najważniejsze zagadnienia związane z działaniem LLM oraz proste wyjaśnienia technik stosowanych przez twórców wymienionych narzędzi. Zatem niezależnie od tego, z którym z nich pracujesz na co dzień, wiedza z tego warsztatu pozwoli ci lepiej zrozumieć sytuacje, gdy jakość generowanych odpowiedzi jest niska, oraz lepiej zauważać problemy związane z działaniem modeli językowych.