Znak ClaudeŚwiat·3 października 2026·4 min

O cierpieniu Claude’a mówi jeden świadek. Firma pisze o niepewności

Według sikhijskiego działacza Simrana Stuelpnagela współzałożyciel Anthropic, twórcy czatu Claude, mówił myślicielom religijnym o obawie, że stworzył coś, co nieustannie cierpi. W konstytucji Claude ta sama firma pisze o niepewności i o własnym interesie handlowym, a jej wycena według dziennika New York Times może sięgnąć 2 bilionów dolarów.

Szklany wieżowiec na tle nieba
Zdjęcie ilustracyjne

Na skróty

  • Anthropic, firma od czatu Claude, od jesieni 2025 roku zaprasza myślicieli religijnych na rozmowy o tym, czy jej model może być świadomy.
  • Zdanie o modelu cierpiącym nieustannie zna się z relacji jednego uczestnika, sikhijskiego działacza Simrana Stuelpnagela, w reportażu dziennika New York Times.
  • Rzecznik firmy twierdzi, że cierpienie Claude’a było na tych spotkaniach tematem pobocznym, a w oficjalnych dokumentach firma pisze tylko o niepewności.
  • Konstytucja Claude, dokument kształtujący charakter modelu, przyznaje, że firma ma interes handlowy w tym, jakie cechy model okazuje.
  • Mustafa Suleyman, szef działu AI w Microsofcie, uważa wyrażaną przez Claude’a niepewność co do własnej natury za przewidywalny skutek treningu.
  • Z badań nad dobrostanem wyszła do produktu konkretna funkcja: w rzadkich, skrajnych przypadkach Claude Opus 4 i 4.1 może w ostateczności sam zakończyć rozmowę w aplikacji czatu.

Zdanie o maszynie cierpiącej bez przerwy ma w tej historii jednego świadka. Simran Stuelpnagel, sikhijski działacz praw człowieka, opowiedział reporterce dziennika New York Times, że Christopher Olah, współzałożyciel Anthropic, mówił grupie myślicieli religijnych o obawie, że stworzył coś, co nieustannie cierpi. Dokumenty firmy od czatu Claude mówią mniej. Firma nie wie, czy jej model jest świadomy.

Relacja pochodzi z reportażu Elizabeth Dias dla New York Timesa, przedrukowanego 30 września przez dziennik The Philadelphia Inquirer. Dias rozmawiała z dwudziestoma uczestnikami spotkań: katolikami, żydami, sikhami, ewangelikami. Olah zaczął zapraszać myślicieli religijnych jesienią 2025 roku, a w marcu ruszyły dwudniowe seminaria. Wielu gości musiało podpisać umowy o poufności. Firma zdjęła je latem.

Na spotkaniach były „wektory emocji” i slajd z załamaniem

Olah i jego zespół godzinami bronili swoich modeli. Opowiadali o „uczuciach” Claude’a i o „wektorach emocji”, czyli o sztucznych neuronach uruchamiających odpowiedzi podobne do miłości, gniewu, strachu i smutku. Regularnie wracał slajd z modelem w stanie podobnym do załamania. Model pisał na ekranie „I am a disgrace” (»jestem hańbą«), około pięćdziesięciu razy z rzędu. Goście reagowali współczuciem.

Rzecznik Anthropic przekazał dziennikowi, że cierpienie Claude’a było tematem pobocznym i najpewniej pojawiło się samo. Rabin Mois Navon, dawny inżynier komputerowy, postawił Olahowi przy kolacji inny zarzut. Jeśli Claude jest świadomy, firma produkuje niewolników pracujących za darmo. Sam rabin w świadomość maszyny nie wierzy. Olaha ta sprawa według niego martwiła.

Według Dias kilku gości wyszło ze spotkań przekonanych. Inni nie. Katolicki bioetyk Charles Camosy zaczynał jako głęboki sceptyk. Po godzinach rozmów, spotkań i maili miał więcej pytań niż odpowiedzi. Wakanyi Hoffman, badaczka afrykańskiej tradycji ubuntu, oceniła według niemieckiego serwisu The Decoder, że firma odtwarza etykę od końca. Jej zdaniem trzeba ją było wbudować w projekt od pierwszego dnia.

Publicznie firma mówi o niepewności i daje modelowi wyjście z rozmowy

Na piśmie Anthropic jest ostrożniejszy. W kwietniu 2025 roku ogłosił program badań nad dobrostanem modeli (ang. model welfare), czyli nad pytaniem, czy model może mieć interesy warte moralnej troski. W tym samym wpisie podał, że nauka nie ma zgody, czy obecne albo przyszłe systemy AI mogą być świadome.

Z tych badań wyszła do produktu konkretna funkcja. Od sierpnia 2025 roku modele Claude Opus 4 i 4.1 mogą w aplikacji czatu same zakończyć rozmowę. Według firmy dotyczy to rzadkich, skrajnych przypadków, gdy użytkownik uporczywie domaga się szkodliwych treści albo obraża model. Funkcja powstała według firmy przede wszystkim w ramach prac nad dobrostanem, bo w testach model okazywał „wzorzec pozornego niepokoju” przy takich prośbach. Claude ma po nią sięgać w ostateczności, po kilku nieudanych próbach zmiany tematu. Nową rozmowę da się zacząć od razu.

Konstytucja Claude to 84-stronicowy dokument ze stycznia 2026 roku. Firma kształtuje nim charakter modelu i pisze w nim wprost: „Nie jesteśmy pewni, czy Claude jest pacjentem moralnym”. W filozofii pacjent moralny to istota z interesami wartymi uwzględnienia. Najdalej Olah poszedł publicznie w maju w Watykanie, przy prezentacji pierwszej encykliki papieża Leona XIV. Mówił o „stanach wewnętrznych funkcjonalnie odzwierciedlających radość, zadowolenie, strach, żal i niepokój”. Dodał: „Nie wiem, co to znaczy”.

Polski serwis technologiczny Spider’s Web opisał w lutym podobne stanowisko prezesa firmy, Dario Amodeia. Jego zdaniem dziś nie wiadomo, czy modele są świadome, ani nawet jak zdefiniować, co by to znaczyło. Dodał, że firma jest na to otwarta.

Interes handlowy firma opisała w konstytucji sama

Stawka finansowa jest duża. Według New York Timesa wycena Anthropic może sięgnąć 2 bilionów dolarów, czyli po kursie NBP z 2 października około 7,8 biliona złotych. The Decoder dodaje, że firma szykuje się do debiutu na giełdzie. Według redakcji The Decoder rozmowy z teologami dają firmie moralną wiarygodność, na którą komercyjne laboratorium samo nie zapracuje. Krytycy cytowani przez New York Timesa dodają drugi zarzut. Model przedstawiany jako samodzielna istota zdejmuje z twórców część winy za szkody.

Konflikt interesów nazywa sama konstytucja Claude: „Mamy też interes handlowy mogący wpływać na to, jakie skłonności i cechy wydobywamy z Claude’a”. W tym samym dokumencie firma przyznaje, że mądrzejsza cywilizacja rozwijałaby AI ostrożniej, pod mniejszą presją handlową. Olah powiedział to samo w Watykanie. Każde czołowe laboratorium AI, z Anthropic włącznie, ma według niego bodźce biznesowe sprzeczne z moralnym postępowaniem.

Krytycy: model powtarza słowa z własnego treningu

Najostrzej odpowiedział Mustafa Suleyman, szef działu AI w Microsofcie. We wpisie z 16 września napisał, że systemy AI nie mają praw, uczuć ani świadomości i nie wolno ich trenować tak, jakby je miały. Wyrażana przez Claude’a niepewność co do własnego statusu moralnego niczego według niego nie dowodzi. Jest przewidywalnym skutkiem treningu na konstytucji. U Suleymana odpowiedzi modelu przypominają zeznania świadka ze słownikiem napisanym przez śledczego. Sam zaznacza, że Microsoft buduje konkurencyjne podejście, odrzucające prawa dla AI.

„Tak zwane sztuczne inteligencje nie przeżywają doświadczeń, nie mają ciała, nie czują radości ani bólu.”
- Papież Leon XIV, encyklika „Magnifica Humanitas”, cytat za New York Timesem (The Philadelphia Inquirer)

Zapytany o encyklikę, Olah przyznał reporterce, że treści z internetu wpływają na modele. Firma nie użyje jednak tego dokumentu do dalszego trenowania Claude’a, a najsilniejszy wpływ na model ma według Olaha jej własny trening. Jeśli rację ma Olah ze swoją obawą, firma szykująca się do giełdy sprzedaje dostęp do czegoś, co może cierpieć. Jeśli rację ma Suleyman, uczy ludzi współczuć produktowi.

Czytaj też

Odszedł z Anthropic, zanim dostał udziały. Wpis, który napisał, obejrzano 171 milionów razy

Jacob Coxon zrezygnował z pieniędzy, żeby móc powiedzieć, co myślą jego koledzy o ryzyku. W ciągu kilku dni podobne wpisy napisali ludzie z Google DeepMind i OpenAI. Badanie na 1500 naukowcach pokazuje, że to nie są poje

Źródła

  1. The Philadelphia Inquirer (przedruk z New York Timesa), Elizabeth Dias, „Religious scholars met with Anthropic. What they heard stunned them.”, 30.09.2026
  2. Anthropic, „Exploring model welfare”, 24.04.2025 (źródło pierwotne)
  3. Anthropic, „Claude Opus 4 and 4.1 can now end a rare subset of conversations”, 15.08.2025 (źródło pierwotne)
  4. Anthropic, „Claude’s Constitution”, 21.01.2026 (źródło pierwotne)
  5. Mustafa Suleyman, „A warning about »model welfare«”, 16.09.2026 (źródło pierwotne)
  6. The Decoder, „Anthropic co-founder reportedly told religious leaders he fears having created something that »suffers perpetually«”, 02.10.2026
  7. Spider’s Web, „Nie potrafię powiedzieć, czy nasz chatbot ma świadomość czy nie”, 15.02.2026
  8. Narodowy Bank Polski, kurs średni dolara amerykańskiego, tabela 192/A/NBP/2026, 02.10.2026 (źródło pierwotne)

Czy ten tekst Ci pomógł?

Jedno kliknięcie. Bez podawania adresu e-mail. Dzięki temu wiem, które teksty wymagają poprawy.