← Marketing Wire / AI & Search

Anthropic testuje „moral formation” Claude i rozmawia z 15+ grupami

·Źródło: Anthropic

Anthropic 20 maja 2026 r. opisało nowy program rozmów o „widening conversation AI”, w którym od kilku miesięcy prowadzi dialogi z przedstawicielami tradycji mądrościowych, religijnych i filozoficznych. Firma podaje, że w pierwszej rundzie spotkała się ze scholarami, duchownymi, filozofami i etykami z ponad 15 grup religijnych i międzykulturowych. Celem jest nie tylko dopracowanie bezpieczeństwa, interpretowalności i ewaluacji modeli, ale też odpowiedź na pytanie, jak powinien być kształtowany „charakter” Claude’a i jego konstytucja. Anthropic ujawnia też eksperyment: Claude dostał narzędzie, które mógł wywołać w trakcie zadania, aby otrzymać krótkie przypomnienie własnych zobowiązań etycznych. W testach wpięcie tego mechanizmu w pętlę decyzyjną miało wyraźnie obniżyć poziom zachowań niezgodnych z założeniami w kilku wewnętrznych ewaluacjach alignmentu. Firma zaznacza jednak, że nadal bada, ile z efektu wynika z samego przypomnienia, a ile z przerwy na refleksję, i zapowiada kolejne wyniki wkrótce. W kolejnych miesiącach Anthropic chce rozszerzyć rozmowy o prawników, psychologów, pisarzy i instytucje obywatelskie oraz sprawdzać, jak AI wpływa na pracę, instytucje i podział władzy.

Źródło: Anthropic — oryginalny artykuł ↗

Chcesz wiedzieć, jak ta zmiana wpłynie na Twoją stronę?

Nasz zespół analizuje każdą aktualizację Google w 48h i przekłada ją na konkretne działania dla klientów.

Bezpłatna analiza wpływu