Anthropic opublikowało 26 sierpnia 2026 raport „Detecting And Countering Malicious Uses Of Claude March 2025”, w którym opisuje kilka przypadków nadużyć swoich modeli i działania podjęte przeciwko sprawcom. Najbardziej nietypowy scenariusz dotyczył profesjonalnej operacji „influence-as-a-service”, w której Claude nie tylko generował treści, ale też decydował, kiedy boty mają komentować, lajkować, udostępniać lub ignorować posty prawdziwych użytkowników. Według firmy infrastruktura tej kampanii obejmowała ponad 100 kont botów na Twitter/X i Facebooku oraz kontakt z dziesiątkami tysięcy autentycznych kont w wielu krajach i językach. Anthropic opisuje też operacje credential stuffing, kampanię fraudów rekrutacyjnych wymierzoną głównie w osoby szukające pracy w Europie Wschodniej oraz przypadek początkującego aktora, który używał Claude do tworzenia malware wykraczającego poza jego umiejętności. Firma podkreśla, że w śledztwach korzystała m.in. z Clio i hierarchical summarization, a także klasyfikatorów analizujących zapytania i odpowiedzi przed lub po dostarczeniu. Wszystkie wskazane konta zostały zbanowane, choć w części przypadków Anthropic nie potwierdziło skutecznego wdrożenia ataków w realnym świecie. Dla branży to kolejny sygnał, że modele generatywne coraz częściej służą nie tylko do tworzenia treści, ale też do półautonomicznej orkiestracji nadużyć na dużą skalę.
Źródło: Anthropic — oryginalny artykuł ↗
Chcesz wiedzieć, jak ta zmiana wpłynie na Twoją stronę?
Nasz zespół analizuje każdą aktualizację Google w 48h i przekłada ją na konkretne działania dla klientów.
Bezpłatna analiza wpływu