← Marketing Wire / AI & Search

Anthropic buduje filtr ryzyka nuklearnego dla Claude z DOE i NNSA

·Źródło: Anthropic

Anthropic 17 czerwca 2026 r. poinformowało, że wspólnie z U.S. Department of Energy, National Nuclear Security Administration oraz krajowymi laboratoriami DOE współtworzy narzędzie do wykrywania ryzykownych treści nuklearnych w rozmowach z AI. Firma podaje, że classifier — system automatycznie kategoryzujący treści — odróżnia niepokojące i bezpieczne rozmowy o tematyce nuklearnej z 96% dokładnością w testach wstępnych. Rozwiązanie zostało już wdrożone na ruchu Claude jako część szerszego systemu wykrywania nadużyć. Anthropic podkreśla, że to pierwszy taki projekt i chce udostępnić podejście Frontier Model Forum, aby inni twórcy modeli mogli wdrażać podobne zabezpieczenia we współpracy z NNSA. Dla branży AI to sygnał, że ocena ryzyk nie kończy się na testach modeli, ale obejmuje też stały monitoring produkcyjnego ruchu. W praktyce oznacza to większy nacisk na bezpieczeństwo, compliance i współpracę prywatnych firm z instytucjami państwowymi przy modelach frontierowych.

Źródło: Anthropic — oryginalny artykuł ↗

Chcesz wiedzieć, jak ta zmiana wpłynie na Twoją stronę?

Nasz zespół analizuje każdą aktualizację Google w 48h i przekłada ją na konkretne działania dla klientów.

Bezpłatna analiza wpływu