AWS Bedrock AgentCore Browser tool: agent blokowany przez weryfikację CAPTCHA
Napraw blokadę agenta na AgentCore Browser tool przez CAPTCHA: potwierdzenie uprawnień do automatyzacji celu, stabilizacja sesji przeglądarki, zachowanie stanu oraz obsługa CAPTCHA jako stanu z przekazaniem człowiekowi.
Ten runbook dotyczy blokady CAPTCHA na warstwie AgentCore Browser tool. Gdzie Browser tool mieści się w platformie, opisaliśmy w artykule Amazon Bedrock AgentCore: architektura i cennik. W sprawie projektu bezpiecznej, zgodnej z regulaminami automatyzacji agentowej umów konsultację.
Objawy
Agent nie zgłasza awarii narzędzia - po prostu nie może dokończyć zadania na stronie.
# W logach agenta / Browser tool
Agent blocked by CAPTCHA verification while interacting with the website
# Zadanie zatrzymuje się na ekranie weryfikacji; agent albo czeka, albo
# wpada w pętlę ponawiania na tym samym kroku.
Widoczny wpływ:
- Agent dociera do strony, ale utyka na ekranie CAPTCHA i nie przechodzi dalej
- To samo zadanie bywa raz przepuszczane, raz blokowane - zależnie od reputacji sesji i tempa działań
- Agent ponawia próbę w kółko na tym samym kroku, zamiast rozpoznać, że napotkał wyzwanie
- Strony chronione przez systemy antybotowe (na przykład Cloudflare) blokują częściej
Przyczyna
CAPTCHA nie jest błędem narzędzia, lecz odpowiedzią celu na ruch, który uznał za zautomatyzowany. Powody dzielą się na trzy warstwy, a kolejność ma znaczenie.
- Uprawnienia i zgodność - najpierw. Jeżeli automatyzujesz zadanie, który na to nie zezwala (regulamin zabrania botów, brak zgody właściciela, brak dostępu API przeznaczonego do integracji), CAPTCHA jest objawem właściwego problemu: nie powinieneś automatyzować tego zadania w ten sposób. To pierwsza rzecz do ustalenia, ale nie ostatnia.
- Stabilność i reputacja sesji. Agent, który gubi ciasteczka i stan sesji między krokami, działa z nowej, “czystej” tożsamości za każdym razem, przez co wygląda podejrzanie. Zbyt szybkie, maszynowe tempo działań i niestabilna sesja przeglądarki podnoszą prawdopodobieństwo wyświetlenia CAPTCHA.
- Brak modelu stanu CAPTCHA. Agent, który nie rozpoznaje, że jest na ekranie weryfikacji, traktuje stronę wyzwania jak zwykłą treść i ponawia bez sensu. Bez nazwanego stanu, limitu prób i reguły zatrzymania wpada w pętlę zamiast przekazać sprawę człowiekowi.
Reguła kciuka: CAPTCHA to stan do rozpoznania i obsłużenia zgodnie z zasadami, a nie przeszkoda do “przełamania”. Odpowiedzialna automatyzacja zaczyna się od pytania, czy w ogóle wolno Ci automatyzować dane zadanie .
Naprawa
Krok 1: Potwierdź, że masz prawo automatyzować to zadanie
Zanim cokolwiek dostroisz, ustal, czy automatyzacja tego zadania jest dozwolona. Sprawdź regulamin serwisu, warunki korzystania i to, czy istnieje oficjalne API lub partnerski dostęp przeznaczony do integracji. Jeśli cel zakazuje zautomatyzowanego dostępu, właściwą naprawą nie jest obejście CAPTCHA, lecz zmiana podejścia.
- Jeśli jest oficjalne API, przełącz agenta z przeglądarki na to API - zniknie zarówno CAPTCHA, jak i kruchość scrapowania
- Jeśli automatyzujesz własny system lub masz zgodę właściciela, przejdź do kolejnych kroków
- Jeśli cel wyraźnie zabrania botów i nie masz zgody, zatrzymaj się - to kwestia zgodności, nie techniczna
Krok 2: Ustabilizuj sesję przeglądarki
Agent, który między krokami zachowuje stan jak prawdziwy użytkownik, rzadziej wywołuje CAPTCHA. Chodzi o spójną, trwałą sesję, a nie o maskowanie.
- Zachowuj ciasteczka i stan sesji między krokami, zamiast startować z czystej sesji za każdym razem
- Utrzymuj spójny kontekst przeglądarki w obrębie celu, aby zadanie widziało jedną ciągłą sesję, nie serię nowych
- Upewnij się, że strona w pełni się załadowała, zanim agent zacznie działać - przełączanie ramek i akcje na niegotowym stanie wyglądają jak bot
Krok 3: Spowolnij i urealnij tempo działań
Maszynowo szybka, idealnie równa sekwencja akcji to klasyczny sygnał automatyzacji. Wprowadź realistyczne tempo i opóźnienia między krokami, aby interakcja nie wyglądała na zautomatyzowaną wyłącznie z powodu rytmu.
Krok 4: Potraktuj CAPTCHA jako jawny stan z przekazaniem człowiekowi
Zamiast pozwalać agentowi ponawiać w nieskończoność, zamodeluj CAPTCHA jako nazwany stan z pamięcią sesji, dozwolonym przekazaniem człowiekowi, limitem prób i regułą zatrzymania. Dzięki temu agent potrafi nazwać sytuację i wybrać odpowiedzialne kolejne działanie, zamiast kręcić się w pętli.
- Wykryj stan CAPTCHA i zatrzymaj dalsze automatyczne akcje na tym kroku
- Przekaż zadanie człowiekowi (human-in-the-loop), gdy wymagana jest weryfikacja - to samo podejście, które stosujemy przy wrażliwych akcjach agentów
- Ustaw limit prób i twardą regułę zatrzymania, aby agent nie bombardował celu ponowieniami
Weryfikacja
Potwierdź, że agent dochodzi do końca zadania bez utykania na CAPTCHA, a tam gdzie weryfikacja jest konieczna - czysto przekazuje ją człowiekowi.
# Oczekiwany przebieg w logach:
# 1. Agent utrzymuje jedną ciągłą sesję (te same ciasteczka między krokami)
# 2. Albo cel nie pokazuje CAPTCHA, albo agent rozpoznaje stan CAPTCHA
# i przekazuje go człowiekowi zamiast ponawiać
# 3. Brak pętli ponawiania na kroku weryfikacji
Oczekiwane: na dozwolonym celu, ze stabilną sesją i realistycznym tempem, agent kończy zadanie bez wyzwania. Tam, gdzie CAPTCHA się pojawia, agent ją rozpoznaje, zatrzymuje się w ramach limitu prób i przekazuje sprawę człowiekowi - zamiast ponawiać w nieskończoność. Jeśli uruchamiasz wielu agentów korzystających z przeglądarki, spójne reguły obsługi takich stanów to część szerszego nadzoru opisanego przy agent sprawl.
Powiązane
- Amazon Bedrock AgentCore: architektura, komponenty i cennik - gdzie Browser tool mieści się wśród komponentów
- AWS Loom: nadzór nad agentami AI - human-in-the-loop i reguły dla działań agentów
- Agent sprawl: jak opanować rozrost agentów AI - dlaczego spójne reguły dla wielu agentów mają znaczenie
- AWS Bedrock AgentCore Browser tool - rozwiązywanie problemów (dokumentacja AWS)