Potrzebujesz asystenta, który nie tylko mówi. Potrzebujesz kogoś, kto cię wysłucha. Bierze Twój niejasny pomysł, dzieli go na etapy, wykonuje każdy z nich, sprawdza wyniki i poprawia się, jeśli coś się zepsuje. To nie jest science-fiction. To jest Auto-GPT.
Narzędzie to pojawia się tuż po premierze GPT-4 przez OpenAI wiosną 2023 roku. Projekt został stworzony przez programistę Toran Bruce’a Richardsa, znanego w Internecie jako Significant Gravitas. Udostępnił kod w serwisie GitHub ze śmiałą obietnicą: jest to eksperyment typu open source, mający na celu uczynienie GPT-4 całkowicie samodzielnym systemem.
„Eksperymentalna próba open source uczynienia GPT-4 całkowicie autonomicznym.”
Dlaczego Auto-GPT jest ważny w codziennych zadaniach
Standardowy ChatGPT to chatbot. Czeka, aż zadasz pytanie, a następnie udzieli odpowiedzi. Auto-GPT zmienia zasady gry. To jest agent autonomiczny. Dajesz temu cel. Resztę sam wymyśli.
Może surfować po Internecie. Potrafi pisać kod. Może tworzyć pliki. Może nawet opublikować wyniki w Internecie. Jaka jest kluczowa różnica? Jest to powtarzane. Sprawdza swoją pracę. Jeśli jeden krok się nie powiedzie, próbuje innego podejścia. Ten cykl działań i weryfikacji otwiera możliwości niedostępne dla standardowych modeli językowych (LLM) bez takiej architektury.
Ludzie byli podekscytowani. Potencjał wydawał się nieograniczony. Ale oryginalny Auto-GPT był skomplikowany. Wymagało strojenia. Nie był typem człowieka, który „zastaw wszystko i zapomnij” dla każdego.
Więc ekosystem eksplodował. Pojawiły się prostsze wersje. AgentGPT. DzieckoAGI. Jarvis. Narzędzia te obniżyły barierę wejścia. Umożliwiły zobaczenie łańcucha rozumowania bez konieczności zmagania się ze skryptami Pythona lub kluczami API.
Następnie ChatGPT wprowadził wtyczki. Teraz możesz uzyskać dostęp do podobnych funkcji offline bezpośrednio z poziomu interfejsu, którego już używasz. Narzędzia takie jak Zapier stały się dostępne za pośrednictwem chatbota, wypełniając lukę pomiędzy konwersacyjną sztuczną inteligencją a faktyczną realizacją zadań.
Krajobraz się zmienił. Przeszliśmy od zadawania pytań do delegowania pracy. Ale jak wybrać pomiędzy surową mocą Auto-GPT a prostotą AgentGPT? To zależy od Twojego poziomu technicznego. I tu zaczyna się zabawa.
Co właściwie robi Auto-GPT (a czego nie może)
Prawdopodobnie widziałeś spektakularne demonstracje. Ludzie twierdzą, że dali botowi niejasny pomysł, a on zwrócił w pełni funkcjonalną stronę internetową, odcinek podcastu lub raport z analizy rynku. Wygląda jak magia. Ale to nie jest magia. To cykl. Jednak zrozumienie tego cyklu stanowi różnicę pomiędzy postrzeganiem zabawki i narzędzia.
Więc co tak naprawdę możesz rzucić na Auto-GPT?
Społeczność testowała go od pierwszego dnia. Wyniki są mieszane, ale odkrywcze. Możesz poprosić go o przeskanowanie kategorii produktów, przefiltrowanie ich według ocen użytkowników i zwrócenie listy rankingowej. Możesz nakazać mu zbudowanie witryny od zera – tak, nawet pobranie obrazów z MidJourney i osadzenie ich w formacie HTML. Potrzebujesz podcastu? Może napisać scenariusz odcinka o permakulturze, wygenerować syntetyczny głos podobny do Twojego (przerażający, ale funkcjonalny) i przesłać plik.
Może analizować Twoje konto na Twitterze i sugerować tweety na podstawie najświeższych wiadomości. Potrafi ocenić strategie inwestycyjne. Może nawet napisać kod klipu wideo, obsługując skrypt, przejścia i sekwencje.
Nie liczy się co, ale jak.
Dlaczego „autonomia” zmienia wszystko
Większość narzędzi sztucznej inteligencji, z których obecnie korzystasz, jest pasywna. Piszesz, a on odpowiada. Klikasz – przetwarza. Auto-GPT i podobni agenci, tacy jak AgentGPT, wywracają ten paradygmat do góry nogami. Są autonomiczni.
Oznacza to zerową interwencję człowieka po naciśnięciu przycisku start. Agent wyznacza sobie cel, dzieli go na kawałki i realizuje. Opiera się w dużej mierze na GPT-4 w rozumowaniu, ale na tym się nie kończy. Wychodzi na zewnątrz. Korzysta z przeglądarek internetowych. Wywołuje zewnętrzne interfejsy API. Może aktywować emulator głosu lub interpreter kodu.
On gra. I to jest przerażające. I to jest ekscytujące.
Czy to sztuczna inteligencja ogólna?
Dużo szumu wokół AGI – sztucznej inteligencji ogólnej. Święty Graal. System zdolny rozwiązać każdy problem intelektualny, jaki jest w stanie rozwiązać człowiek.
Czy Auto-GPT to AGI? Nie. Nawet blisko.
Ale czy to krok w tym kierunku? Niewątpliwie. Naśladuje zachowanie AGI poprzez planowanie, wykonywanie i samokorygowanie. To prototyp autonomii, a nie cel końcowy. Nie myl mapy drogowej z mapą lokalną.
Cykl sześcioetapowy: jak myśli Auto-GPT
Aby zrozumieć, dlaczego to narzędzie jest ważne, musisz zajrzeć pod maskę. Auto-GPT nie tylko „robi” różne rzeczy. Podąża za ścisłym procesem rekurencyjnym. Oto dokładna sekwencja, którą wykonuje w przypadku każdego zadania.
1. Definiujesz cel
To jedyna część, w której kontrolujesz proces. Musisz wyrazić się jasno. Niewyraźne dane wejściowe powodują rozmycie wyników. Jeśli chcesz, żeby zbudował stronę internetową, powiedz mu o tym. Jeśli wymagają Państwo konkretnej analizy, prosimy o podanie parametrów. To jest kotwica wszystkiego, co następuje.
2. Plany agenta
Po naciśnięciu Enter Auto-GPT używa GPT-4 do rozłożenia celu. Generuje listę podzadań. To tutaj dzieje się „inteligencja”. Określa co musi się wydarzyć, zanim to się stanie.
3. Sekwencja
Zadania nie są rozwiązywane losowo. Agent organizuje je logicznie. Wie, że nie może opublikować filmu, dopóki nie zostanie wyrenderowany. Na pierwszym miejscu stawia efektywność.
4. Wykonanie
Teraz zaczyna się praca. Agent wykonuje zadania. Może szukać w Internecie. Potrafi pisać kod. Może instalować oprogramowanie. Używa zewnętrznych narzędzi, aby wypełnić lukę pomiędzy myśleniem a działaniem.
5. Ocena
To krytyczny krok. Większość narzędzi AI tego nie dostrzega. Auto-GPT sprawdza jego działanie. Porównuje wynik z pierwotnym celem określonym w kroku 1. Czy się udało? Jeśli tak, świetnie. Jeśli nie, rejestruje awarię.
6. Iteracja
Jeśli wynik nie był doskonały, wraca do kroku 2. Przekłada termin. Dokonuje korekt. Próbuje ponownie. Cykl ten trwa do momentu osiągnięcia celu lub do momentu jego zatrzymania.
“Cykl to esencja. Bez iteracji to tylko chatbot z przeglądarką.”
Jednakże jest pewien haczyk. OpenAI pobiera opłatę za korzystanie z API. Każda iteracja kosztuje. Każdy nieudany test kosztuje. Dlatego w większości ustawień istnieje ścisłe ograniczenie liczby iteracji. Kontrolujesz budżet. Agent kontroluje proces.
To jest potężne. Ale ma też skłonność do wpędzania się w ślepe zaułki z powodu halucynacji. Ale po raz pierwszy oprogramowanie nie czeka tylko na Twoje kolejne żądanie. Myśli przyszłościowo.
Instalacja bez bólu?
Auto-GPT nie jest zabawką. To jest plac budowy.
Uruchomienie narzędzia wymaga przestrzegania oficjalnej dokumentacji na GitHubie: https://github.com/Significant-Gravitas/Auto-GPT. Tutaj nie ma jednego kliknięcia. Brak instalacji jednym dotknięciem.
Musisz zainstalować sam program Auto-GPT. Ale to dopiero początek. Będziesz także potrzebować Git i Visual Studio na swoim komputerze. Następnie konto na OpenAI i ważny klucz dostępu. Nie zapomnij o działającym interpreterze Pythona.
To dużo jak na prosty test. Krzywa uczenia się jest stroma.
Jeśli chcesz zobaczyć AutoGPT w akcji bez konfigurowania środowiska programistycznego, wypróbuj AgentGPT.
Dostępne pod tym adresem: https://agentgpt.reworkd.ai/fr
Interfejs jest prostszy. Mniej techniczne. Idealny do zrozumienia koncepcji bez grzęźnięcia w wierszach kodu.
Nie mogę spełnić tej prośby, ponieważ w Państwa wiadomości nie podano tekstu źródłowego artykułu.
Jako sztuczna inteligencja nie mam dostępu do historii poprzednich rozmów ani plików zewnętrznych, chyba że są one wyraźnie uwzględnione w bieżącym wejściu. Aby dokładnie przepisać „Część 4”, zachowując fakty i przestrzegając rygorystycznych ograniczeń stylistycznych i SEO, potrzebuję faktycznego tekstu sekcji artykułu, którą chcesz przepisać.
Proszę wkleić poniżej tekst Części 4. Jeśli istnieją jakieś konkretne fakty, nazwy produktów lub szczegóły techniczne z części 1–3, które stanowią ważny kontekst dla tej sekcji, proszę załączyć krótkie podsumowanie tych danych, abym mógł zachować ciągłość narracji bez tworzenia zbędnych informacji.





















