Na pierwszy rzut oka jedno i drugie może wyglądać podobnie: wpisujemy polecenie i po chwili otrzymujemy wynik. Różnica jest jednak zasadnicza. Czat przede wszystkim odpowiada, doradza i pomaga użytkownikowi wykonać zadanie, podczas gdy agent może sam przejąć część pracy i wykonać kolejne czynności prowadzące do określonego celu przy pomocy różnych narzędzi. To trochę tak jakby chat był po prostu komunikatorem a agent to pracownik do którego bezpośrednio się zwracasz.

Czat AI – inteligentny rozmówca

Czat AI jest obecnie najbardziej znaną formą korzystania ze sztucznej inteligencji. Użytkownik wpisuje pytanie lub polecenie, a system odpowiada zwykłym językiem. Możemy poprosić go o wyjaśnienie, czym jest chmura internetowa, poprawienie listu, przetłumaczenie tekstu, przygotowanie planu podróży, streszczenie dokumentu, pomoc przy programowaniu albo rozwiązanie problemu z komputerem. Czat można traktować jak bardzo cierpliwego konsultanta, z którym można prowadzić rozmowę, zadawać dodatkowe pytania, prosić o prostsze wyjaśnienie albo zmianę przygotowanej wcześniej odpowiedzi.

W większości przypadków czat na tym jednak kończy swoją pracę. Może podpowiedzieć użytkownikowi, co powinien zrobić, ale niekoniecznie wykona te czynności za niego. Jeżeli zapytamy, jak uporządkować zdjęcia z wakacji, czat może zaproponować sposób tworzenia folderów, nazwy katalogów i zasady sortowania. To użytkownik będzie jednak musiał sam otworzyć menedżera plików, utworzyć katalogi i przenieść do nich zdjęcia.

Agent AI – nie tylko odpowiada, ale również działa

Agent AI jest rozwiązaniem bardziej zaawansowanym. Zamiast pojedynczego pytania może otrzymać cały cel do wykonania, a następnie sam ustalić, jakie kroki będą potrzebne, dobrać odpowiednie narzędzia i wykonać kolejne czynności. Jeśli polecimy mu znaleźć kilka hoteli w Krakowie, porównać ceny, sprawdzić odległość od rynku i przygotować zestawienie, agent może sam przejść przez kolejne etapy zadania, zamiast tylko opisać użytkownikowi, jak takie porównanie zrobić.

To właśnie oznacza, że agent może działać samodzielnie. Nie chodzi o to, że komputer zaczyna robić wszystko bez wiedzy właściciela, lecz o to, że po otrzymaniu celu agent nie musi dostawać osobnej instrukcji dla każdego kolejnego kroku. Może sam zdecydować, że najpierw trzeba otworzyć przeglądarkę, potem wyszukać informacje, następnie zebrać dane do tabeli, zapisać plik i przygotować podsumowanie.

Co agent może robić na komputerze?

Jeżeli ma odpowiednie uprawnienia, agent może uruchamiać programy zainstalowane na komputerze użytkownika, na przykład przeglądarkę internetową, edytor tekstu, arkusz kalkulacyjny albo inne narzędzie potrzebne do wykonania zadania. Może również pracować na plikach zapisanych na komputerze właściciela: otwierać dokumenty, analizować ich zawartość, porównywać dane, tworzyć nowe pliki, aktualizować istniejące informacje albo przygotowywać raporty na podstawie materiałów znajdujących się w określonym folderze.

W zależności od możliwości danego systemu i przyznanych mu praw agent może również korzystać z usług internetowych. Może mieć dostęp do poczty elektronicznej, kalendarza, dysku internetowego, systemu firmowego lub innego serwisu. Jeżeli użytkownik wcześniej wyrazi na to zgodę i odpowiednio skonfiguruje dostęp, agent może odczytywać potrzebne dane, tworzyć dokumenty, wyszukiwać informacje, korzystać z konta użytkownika albo wykonywać inne dozwolone operacje. W niektórych przypadkach może również logować się do serwisów w imieniu właściciela, zwykle poprzez wcześniej zatwierdzone połączenie lub zapisane uwierzytelnienie. Uwierzytelnienie to po prostu sposób potwierdzenia, że dana osoba lub program ma prawo korzystać z określonego konta.

Wszystko zależy od uprawnień

Możliwości agenta są bezpośrednio związane z tym, do czego użytkownik udzielił mu dostępu. Agent nie musi i nie powinien automatycznie otrzymywać pełnego dostępu do całego komputera, wszystkich dokumentów i wszystkich kont internetowych. Może na przykład mieć możliwość odczytu wiadomości e-mail, ale nie ich wysyłania. Może analizować dokumenty w jednym wskazanym folderze, ale nie mieć dostępu do pozostałych plików. Może korzystać z kalendarza, lecz przed dodaniem nowego spotkania poprosić użytkownika o zatwierdzenie.

Im szersze uprawnienia otrzymuje agent, tym więcej może zrobić, ale jednocześnie tym ważniejsza staje się kontrola człowieka. Szczególnie istotne jest to przy czynnościach, które mogą mieć poważne skutki, takich jak wysłanie wiadomości, usunięcie pliku, dokonanie zakupu, zmiana danych albo publikacja treści. Dobrze zaprojektowany system powinien w takich sytuacjach umożliwiać użytkownikowi zatwierdzenie działania przed jego wykonaniem.

Na czym polega praca agentowa?

Praca agentowa polega na tym, że użytkownik przekazuje sztucznej inteligencji cel, a nie tylko pojedyncze polecenie. Agent analizuje zadanie, dzieli je na mniejsze etapy, wybiera odpowiednie narzędzia i wykonuje kolejne czynności. Można to porównać do zlecenia zadania pracownikowi. Jeśli powiemy komuś „przygotuj zestawienie ofert ubezpieczenia samochodu”, nie musimy szczegółowo instruować go, którą stronę ma otworzyć jako pierwszą, gdzie kliknąć i do której komórki tabeli wpisać cenę. Oczekujemy, że sam zorganizuje swoją pracę i dostarczy gotowy wynik.

W przypadku agentów taki ciąg następujących po sobie operacji bywa określany słowem „workflow”. Termin może brzmieć technicznie, ale oznacza po prostu przebieg pracy: uporządkowany zestaw czynności prowadzących od początku zadania do gotowego rezultatu.

Do czego najczęściej służą czaty?

Czaty AI najlepiej sprawdzają się tam, gdzie potrzebna jest rozmowa, wiedza, wyjaśnienie albo przygotowanie treści. Można ich używać do pisania i poprawiania tekstów, tłumaczenia, streszczania dokumentów, nauki, planowania, tworzenia pomysłów, analizowania danych czy pomocy przy obsłudze programów. Są wygodne wtedy, gdy użytkownik chce sam podejmować kolejne decyzje i zachować pełną kontrolę nad wykonaniem zadania. Czat podpowiada, a człowiek działa.

Do czego służą agenci?

Agenci są szczególnie przydatni przy zadaniach składających się z wielu kolejnych czynności albo wymagających użycia kilku różnych narzędzi. Mogą zbierać informacje z różnych źródeł, przygotowywać raporty, analizować dokumenty, porządkować pliki, korzystać z poczty i kalendarza, wykonywać operacje w programach albo przenosić dane pomiędzy różnymi systemami. W firmie agent może przygotować raport na podstawie kilku dokumentów, programista może zlecić mu analizę projektu i wykonanie części prac technicznych, a użytkownik domowy może wykorzystać go do zebrania informacji przed podróżą albo uporządkowania własnych dokumentów.

Czat czy agent?

Najprościej różnicę można zapamiętać w jednym zdaniu: czat pomaga coś zrobić, natomiast agent może część pracy wykonać za nas. Jeżeli potrzebujemy odpowiedzi, porady, wyjaśnienia albo tekstu, zazwyczaj wystarczy czat. Jeżeli chcemy, aby sztuczna inteligencja wykonała kilka następujących po sobie czynności, uruchamiała programy, korzystała z plików na komputerze, logowała się do innych usług albo pracowała na danych z różnych źródeł, wtedy wchodzimy już w obszar działania agentów.

Granica między tymi rozwiązaniami będzie prawdopodobnie coraz mniej widoczna. Nowoczesny system może rozpocząć pracę jak zwykły czat, a po otrzymaniu odpowiedniego zadania i uprawnień przejść do działania agentowego. Dlatego najważniejsze pytanie nie brzmi już „czat czy agent?”, lecz raczej: czy sztuczna inteligencja ma tylko odpowiedzieć, czy ma również wykonać zadanie?