Claude Cowork nauczy się twojej pracy. Wystarczy, że pokażesz mu ekran
Cyfrowe rzemiosło pod okiem AI
Anthropic wykonał kolejny krok w stronę autonomizacji asystentów, wprowadzając do swojej desktopowej aplikacji Claude Cowork funkcję „Record a skill”. Rozwiązanie to pozwala użytkownikom na naukę modelu specyficznych procesów poprzez bezpośrednią demonstrację na ekranie komputera. Zamiast pisać skomplikowane instrukcje tekstowe, po prostu wykonujesz zadanie, a Claude analizuje twoje ruchy, kliknięcia oraz towarzyszący im komentarz głosowy.
Dlaczego to ważne teraz
Wejście w fazę „research preview” nowej funkcji na macOS to sygnał, że wyścig agentów AI przenosi się z okna przeglądarki bezpośrednio do naszych systemów operacyjnych. Możliwość automatyzacji zadań bez linijki kodu, przy użyciu zewnętrznych konektorów do Google Docs czy Asana, radykalnie obniża próg wejścia w automatyzację. Jak zauważa serwis The Decoder, to rozwiązanie sprawia, że nawet osoby bez kompetencji programistycznych mogą tworzyć zaawansowane scenariusze pracy, po prostu pokazując maszynie swój workflow.
Mechanizm działania jest prosty: system rejestruje aktywność ekranu, wpisywanie tekstu oraz wyjaśnienia głosowe, a następnie przekształca ten materiał w gotowy do użycia moduł umiejętności. Gdy podobne zadanie pojawi się w przyszłości, asystent wykona je samodzielnie. Wymaga to jednak sporego zaufania – Claude potrzebuje uprawnień do konkretnego folderu na dysku, w którym może nie tylko czytać, ale też edytować i usuwać pliki.
Cena automatyzacji i rynkowa konkurencja
Nowa funkcja nie jest dostępna dla każdego. Skorzystają z niej wyłącznie subskrybenci planów Pro, Max oraz Team. Warto zaznaczyć, że plan Claude Max może kosztować od 100 do nawet 200 USD miesięcznie, zależnie od intensywności zużycia zasobów. Anthropic pozycjonuje to narzędzie jako bardziej przystępną wersję Claude Code. Przedstawiciele firmy na łamach The Verge podkreślają: „Cowork został zaprojektowany, aby przejąć te same obowiązki co Claude Code, ale w sposób bardziej przyjazny dla użytkownika przy zadaniach niewymagających kodowania”.
To bezpośrednia odpowiedź na trendy w segmencie agentów AI, gdzie interakcja wizualna staje się standardem. Integracja głosu i obrazu sprawia, że narracja podczas nagrywania pełni rolę spoiwa, które pozwala modelowi zrozumieć intencje stojące za konkretnymi wyborami w menu czy przesunięciami suwaka. Koniec z mozolnym opisywaniem każdego kroku – teraz wystarczy nagrać swój pulpit i liczyć na to, że algorytm poprawnie odczyta nasze intencje.
