AWS Bedrock AgentCore Browser tool agenci AI

AWS Bedrock AgentCore Browser tool: agent blokowany przez weryfikację CAPTCHA

Napraw blokadę agenta na AgentCore Browser tool przez CAPTCHA: potwierdzenie uprawnień do automatyzacji celu, stabilizacja sesji przeglądarki, zachowanie stanu oraz obsługa CAPTCHA jako stanu z przekazaniem człowiekowi.

Jerzy Kopaczewski ·
Twój agent korzysta z Amazon Bedrock AgentCore Browser tool, aby działać na stronach internetowych, ale zadanie staje w miejscu, bo agent trafia na weryfikację CAPTCHA. Zanim zaczniesz szukać obejścia, warto zrozumieć, że CAPTCHA to sygnał: cel uznał ruch za zautomatyzowany i prosi o potwierdzenie, że to człowiek. Ten runbook pokazuje, jak podejść do tego odpowiedzialnie - potwierdzić, że masz prawo automatyzować dany cel, ustabilizować sesję tak, by nie wyglądała na podejrzaną, i potraktować CAPTCHA jako jawny stan z przekazaniem do człowieka, a nie jako rzecz do obejścia.

Ten runbook dotyczy blokady CAPTCHA na warstwie AgentCore Browser tool. Gdzie Browser tool mieści się w platformie, opisaliśmy w artykule Amazon Bedrock AgentCore: architektura i cennik. W sprawie projektu bezpiecznej, zgodnej z regulaminami automatyzacji agentowej umów konsultację.

Objawy

Agent nie zgłasza awarii narzędzia - po prostu nie może dokończyć zadania na stronie.

# W logach agenta / Browser tool
Agent blocked by CAPTCHA verification while interacting with the website
# Zadanie zatrzymuje się na ekranie weryfikacji; agent albo czeka, albo
# wpada w pętlę ponawiania na tym samym kroku.

Widoczny wpływ:

  • Agent dociera do strony, ale utyka na ekranie CAPTCHA i nie przechodzi dalej
  • To samo zadanie bywa raz przepuszczane, raz blokowane - zależnie od reputacji sesji i tempa działań
  • Agent ponawia próbę w kółko na tym samym kroku, zamiast rozpoznać, że napotkał wyzwanie
  • Strony chronione przez systemy antybotowe (na przykład Cloudflare) blokują częściej

Przyczyna

CAPTCHA nie jest błędem narzędzia, lecz odpowiedzią celu na ruch, który uznał za zautomatyzowany. Powody dzielą się na trzy warstwy, a kolejność ma znaczenie.

  1. Uprawnienia i zgodność - najpierw. Jeżeli automatyzujesz zadanie, który na to nie zezwala (regulamin zabrania botów, brak zgody właściciela, brak dostępu API przeznaczonego do integracji), CAPTCHA jest objawem właściwego problemu: nie powinieneś automatyzować tego zadania w ten sposób. To pierwsza rzecz do ustalenia, ale nie ostatnia.
  2. Stabilność i reputacja sesji. Agent, który gubi ciasteczka i stan sesji między krokami, działa z nowej, “czystej” tożsamości za każdym razem, przez co wygląda podejrzanie. Zbyt szybkie, maszynowe tempo działań i niestabilna sesja przeglądarki podnoszą prawdopodobieństwo wyświetlenia CAPTCHA.
  3. Brak modelu stanu CAPTCHA. Agent, który nie rozpoznaje, że jest na ekranie weryfikacji, traktuje stronę wyzwania jak zwykłą treść i ponawia bez sensu. Bez nazwanego stanu, limitu prób i reguły zatrzymania wpada w pętlę zamiast przekazać sprawę człowiekowi.

Reguła kciuka: CAPTCHA to stan do rozpoznania i obsłużenia zgodnie z zasadami, a nie przeszkoda do “przełamania”. Odpowiedzialna automatyzacja zaczyna się od pytania, czy w ogóle wolno Ci automatyzować dane zadanie .

Naprawa

Krok 1: Potwierdź, że masz prawo automatyzować to zadanie

Zanim cokolwiek dostroisz, ustal, czy automatyzacja tego zadania jest dozwolona. Sprawdź regulamin serwisu, warunki korzystania i to, czy istnieje oficjalne API lub partnerski dostęp przeznaczony do integracji. Jeśli cel zakazuje zautomatyzowanego dostępu, właściwą naprawą nie jest obejście CAPTCHA, lecz zmiana podejścia.

  • Jeśli jest oficjalne API, przełącz agenta z przeglądarki na to API - zniknie zarówno CAPTCHA, jak i kruchość scrapowania
  • Jeśli automatyzujesz własny system lub masz zgodę właściciela, przejdź do kolejnych kroków
  • Jeśli cel wyraźnie zabrania botów i nie masz zgody, zatrzymaj się - to kwestia zgodności, nie techniczna

Krok 2: Ustabilizuj sesję przeglądarki

Agent, który między krokami zachowuje stan jak prawdziwy użytkownik, rzadziej wywołuje CAPTCHA. Chodzi o spójną, trwałą sesję, a nie o maskowanie.

  • Zachowuj ciasteczka i stan sesji między krokami, zamiast startować z czystej sesji za każdym razem
  • Utrzymuj spójny kontekst przeglądarki w obrębie celu, aby zadanie widziało jedną ciągłą sesję, nie serię nowych
  • Upewnij się, że strona w pełni się załadowała, zanim agent zacznie działać - przełączanie ramek i akcje na niegotowym stanie wyglądają jak bot

Krok 3: Spowolnij i urealnij tempo działań

Maszynowo szybka, idealnie równa sekwencja akcji to klasyczny sygnał automatyzacji. Wprowadź realistyczne tempo i opóźnienia między krokami, aby interakcja nie wyglądała na zautomatyzowaną wyłącznie z powodu rytmu.

Krok 4: Potraktuj CAPTCHA jako jawny stan z przekazaniem człowiekowi

Zamiast pozwalać agentowi ponawiać w nieskończoność, zamodeluj CAPTCHA jako nazwany stan z pamięcią sesji, dozwolonym przekazaniem człowiekowi, limitem prób i regułą zatrzymania. Dzięki temu agent potrafi nazwać sytuację i wybrać odpowiedzialne kolejne działanie, zamiast kręcić się w pętli.

  • Wykryj stan CAPTCHA i zatrzymaj dalsze automatyczne akcje na tym kroku
  • Przekaż zadanie człowiekowi (human-in-the-loop), gdy wymagana jest weryfikacja - to samo podejście, które stosujemy przy wrażliwych akcjach agentów
  • Ustaw limit prób i twardą regułę zatrzymania, aby agent nie bombardował celu ponowieniami

Weryfikacja

Potwierdź, że agent dochodzi do końca zadania bez utykania na CAPTCHA, a tam gdzie weryfikacja jest konieczna - czysto przekazuje ją człowiekowi.

# Oczekiwany przebieg w logach:
# 1. Agent utrzymuje jedną ciągłą sesję (te same ciasteczka między krokami)
# 2. Albo cel nie pokazuje CAPTCHA, albo agent rozpoznaje stan CAPTCHA
#    i przekazuje go człowiekowi zamiast ponawiać
# 3. Brak pętli ponawiania na kroku weryfikacji

Oczekiwane: na dozwolonym celu, ze stabilną sesją i realistycznym tempem, agent kończy zadanie bez wyzwania. Tam, gdzie CAPTCHA się pojawia, agent ją rozpoznaje, zatrzymuje się w ramach limitu prób i przekazuje sprawę człowiekowi - zamiast ponawiać w nieskończoność. Jeśli uruchamiasz wielu agentów korzystających z przeglądarki, spójne reguły obsługi takich stanów to część szerszego nadzoru opisanego przy agent sprawl.

Powiązane