Słowniczek · Narzędzia

Grok Bot

Grok Bot to aplikacja desktopowa firmy SpaceXAI, w której agenci AI dostają własny komputer w chmurze i pracują na nim samodzielnie. Bot loguje się na tej maszynie do aplikacji użytkownika, przechodzi przez ich interfejs tak jak człowiek, operuje na plikach i w terminalu, a na koniec oddaje gotowy wynik. Działa również w narzędziach, które nie udostępniają API ani integracji, bo zamiast interfejsu programistycznego używa tego, co widzi na ekranie. Produkt został udostępniony 11 sierpnia 2026 roku w wersji beta, na macOS, Windows i Linux, z towarzyszącymi aplikacjami na telefon.

Czym różni się od asystenta w oknie czatu

Klasyczny asystent oddaje tekst, który użytkownik sam gdzieś wkleja i zatwierdza. Granica przebiega więc na człowieku: model doradza, wykonanie należy do Ciebie. Grok Bot przenosi tę granicę dalej, bo wykonuje kroki samodzielnie i nie zatrzymuje się w momencie, w którym zamykasz laptopa. Maszyna, na której pracuje, stoi w chmurze i działa niezależnie od Twojego sprzętu. To różnica gatunkowa, a nie różnica stopnia: model przestaje generować rekomendacje, a zaczyna wywoływać skutki w systemach, do których dostał dostęp.

Rutyny i umiejętności

Najważniejszy mechanizm produktu polega na uczeniu przez pokaz. Użytkownik przeprowadza bota przez proces jeden raz, poprawiając go po drodze, a bot zapisuje całą ścieżkę jako rutynę, przyjmuje naniesione korekty i przy kolejnym uruchomieniu wykonuje ją bez nadzoru. Ustabilizowany fragment procesu można zapisać osobno jako umiejętność, czyli nazwany element wielokrotnego użytku w innych zadaniach. Rutyna utrwala jednak proces w takiej postaci, w jakiej został pokazany, razem z jego wadami — chaotyczny obieg dokumentów zostanie odtworzony jako chaos wykonywany szybciej i o dowolnej porze.

Wspólny komputer i wspólna sesja

Grok Bot pozwala uruchomić kilka botów jednocześnie. Mogą pracować nad jednym projektem, wymieniać się wiadomościami bez udziału użytkownika i dzielić kontekstem między wątkami. Metafora zespołu jest tu jednak myląca w jednym kluczowym punkcie, który producent opisuje wprost w dokumentacji bezpieczeństwa: pliki, sesje przeglądarki i poświadczenia wiersza poleceń na tym komputerze są dostępne dla całej listy botów. Zalogowanie jednego bota do skrzynki pocztowej otwiera tę skrzynkę wszystkim pozostałym. To nie są konta z rozdzielonymi uprawnieniami, tylko kilka procesów korzystających z jednej maszyny, a jedyną realną granicą pozostaje zakres uprawnień konta, którym bot się loguje.

Dostęp do aplikacji i lista zgód

Bot nie przechowuje haseł. Kiedy trafi na ekran logowania, którego nie przejdzie sam, oddaje sterowanie użytkownikowi: ten przejmuje komputer bota, wpisuje hasło, klucz dostępu albo kod dwuskładnikowy, przechodzi przez CAPTCHA i wraca na swoje miejsce. Dla części usług dostępne są wtyczki uwierzytelniające. Producent podaje też zamkniętą listę czynności wymagających zgody: wysyłanie wiadomości i zaproszeń, publikowanie treści, zakupy i przelewy, kasowanie lub nadpisywanie danych, zmiana uprawnień, zmiany na produkcji oraz akceptacja warunków prawnych. Wszystko poza tą listą, łącznie z czytaniem i kopiowaniem danych między systemami, bot wykona bez pytania.

Dostępność i koszt

Grok Bot nie ma osobnej subskrypcji. Dostęp wchodzi w istniejące plany: SuperGrok, SuperGrok Plus i SuperGrok Heavy oraz Cursor Pro, Pro+, Ultra i pakiety zespołowe Cursor Teams. Obecność Cursora wynika z tego, że edytor ten został w sierpniu 2026 roku przejęty i działa jako spółka zależna w strukturze SpaceXAI, czyli tej samej, która rozwija modele Grok. Zużycie botów rozlicza się z osobnej puli, niezależnej od limitów planu podstawowego, a jej wielkości producent nie podaje w liczbach. Przy narzędziu pracującym bez nadzoru jest to realne ryzyko kosztowe.

Gdzie agent wygrywa z automatyzacją przez API, a gdzie przegrywa

Klasyczne automatyzacje wpinane przez interfejsy programistyczne, takie jak n8n, Make czy Zapier, zakładają, że po drugiej stronie istnieje API. Grok Bot omija to założenie, więc wchodzi tam, gdzie tamte narzędzia nie sięgają: do starych systemów wewnętrznych, paneli bez integracji i aplikacji, do których dostęp odbywa się wyłącznie przez przeglądarkę. Przewaga kończy się jednak tam, gdzie zaczyna się powtarzalność i skala. Proces wpięty przez API jest tańszy, przewidywalny i daje się odtworzyć krok po kroku, a agent klikający w interfejs zależy od tego, czy w aktualizacji nie przesunął się przycisk. Agent zarabia na siebie przy procesach zmiennych albo pozbawionych API, a nie przy tych, które i tak dałoby się opisać raz i zautomatyzować taniej.

Ryzyka, o których warto wiedzieć przed wdrożeniem

Poza wspólną sesją istotne są jeszcze trzy rzeczy. Po pierwsze, agent czytający strony i wiadomości czyta również treści przygotowane specjalnie dla niego, co otwiera go na wstrzyknięcie polecenia. Po drugie, automatyczna kontrola działań bota jest oparta na modelu, więc ma te same słabości co model kontrolowany — producent zaznacza, że ma ona uzupełniać zasadę minimalnych uprawnień, a nie ją zastępować. Po trzecie, produkt pozostaje w wersji beta, a wczesne recenzje zgłaszają zawieszające się maszyny, agentów zatrzymujących się w połowie zadania i szybkie wypalanie limitu. Przy procesach, których przerwanie zostawia system w stanie pośrednim, jest to ryzyko trudne do zaakceptowania.

Pytania i odpowiedzi

Najczęściej zadawane pytania

Grok Bot to aplikacja desktopowa firmy SpaceXAI, udostępniona 11 sierpnia 2026 roku na macOS, Windows i Linux, z towarzyszącymi wersjami na telefon. Uruchamia agentów AI, z których każdy dostaje własny komputer w chmurze. Na tej maszynie bot loguje się do aplikacji użytkownika, klika w ich interfejs tak jak człowiek, pracuje na plikach i w terminalu, a na koniec oddaje gotowy wynik zamiast instrukcji do samodzielnego wykonania. Ponieważ nie potrzebuje interfejsu programistycznego ani gotowej integracji, radzi sobie również z narzędziami, których w żaden inny sposób nie dałoby się zautomatyzować: starymi systemami wewnętrznymi, panelami bez API i aplikacjami dostępnymi wyłącznie przez przeglądarkę. Produkt jest na razie w wersji beta, a sam producent zaznacza, że między zrobieniem czegoś w dziewięćdziesięciu a w stu procentach leży ogromna różnica.

Czat z modelem kończy się tekstem, który użytkownik sam kopiuje do właściwego miejsca i zatwierdza. Wykonanie pozostaje po stronie człowieka, a model pełni rolę doradcy — widać to nawet w nazwach takich narzędzi, od asystenta po drugiego pilota. Grok Bot wykonuje te kroki samodzielnie, na własnej maszynie w chmurze, i pracuje dalej po tym, jak użytkownik zamknie laptopa. To przesuwa całą kategorię decyzji: przedmiotem wyboru przestaje być treść polecenia, a staje się zakres dostępu, jaki agent dostaje do systemów firmy. Zamiast pytania, jak trafnie model odpowiada, pojawia się pytanie, co dokładnie zastaniemy rano, jeśli pomylił się w nocy i nikt tego nie zauważył.

Nie przechowuje ich. Kiedy bot trafi na ekran logowania, którego nie przejdzie samodzielnie, oddaje sterowanie użytkownikowi: ten przejmuje komputer bota, wpisuje hasło, klucz dostępu albo kod dwuskładnikowy, przechodzi przez zabezpieczenie typu CAPTCHA i wraca do swojej pracy. Dla części usług dostępne są zamiast tego wtyczki uwierzytelniające. Po takiej operacji na maszynie zostaje jednak aktywna sesja przeglądarki, a sesja daje w praktyce ten sam dostęp co hasło, tylko bez pytania o nie i bez drugiego składnika. Z tego powodu producent zaleca wylogowanie się z usługi w momencie, w którym nie powinna już być dostępna. Bez tego kroku dostęp pozostaje otwarty na wszystkie kolejne zadania, również te uruchomione tygodnie później.

Nie i jest to najważniejsza rzecz do zrozumienia przed wdrożeniem. Dokumentacja bezpieczeństwa mówi wprost, że pliki, sesje przeglądarki i poświadczenia wiersza poleceń na komputerze bota są dostępne dla całej listy botów użytkownika. Zalogowanie jednego z nich do skrzynki pocztowej albo do systemu księgowego otwiera ten dostęp wszystkim pozostałym, również tym uruchomionym później do zupełnie innych zadań. Metafora zespołu z rozdzielonymi rolami jest więc myląca: to nie są konta z osobnymi uprawnieniami, tylko kilka procesów korzystających z jednej maszyny. Jedyną twardą granicą pozostaje zakres uprawnień konta, którym bot się loguje, a nie treść wydanego mu polecenia. Konto z dostępem do jednego folderu chroni lepiej niż najstaranniej napisana instrukcja.

Najlepiej sprawdza się tam, gdzie wynik trafia najpierw do człowieka, a dopiero potem dalej: przy przepisywaniu danych między narzędziami pozbawionymi API, przy zbieraniu i porządkowaniu informacji z wielu serwisów oraz przy przygotowywaniu szkiców i zestawień do akceptacji. W tych zastosowaniach błąd kosztuje czas, a nie pieniądze, i daje się wychwycić przed skutkiem. Znacznie gorzej nadaje się do płatności, umów i wysyłki bez zatwierdzenia, ponieważ zgoda kliknięta przez bota wiąże użytkownika, a odbiorca wiadomości widzi jego nazwisko, nie nazwę narzędzia. Osobną kategorią ryzyka są procesy, których przerwanie w połowie zostawia system w stanie pośrednim, na przykład migracje danych albo wystawianie dokumentów.

Powiązane artykuły