Systemy i czaty·24 września 2026·3 min

Pracownik Anthropic przyznaje, że Claude pisał dla ludzi coraz gorzej. Chwalony za styl Opus 4.6 da się jeszcze wybrać w aplikacji

Jackson Kernion z Anthropic przyznaje, że Claude trenowany na matematyce i kodzie zaczął pisać gęsto, jak dla innego modelu, a Opus 5.5 ma to naprawiać. Według serwisu Arena Opus 5 pisał ponad trzy razy dłużej niż Opus 4.5.

Na skróty

  • Jackson Kernion z Anthropic napisał 22 września, że od czasów Opus 4.6 nie był tak zadowolony z pisania żadnego modelu jak z Opus 5.5.
  • Przyczynę widzi w treningu: model uczony matematyki, kodu i tłumaczenia spraw technicznych innym modelom trzeba osobno nagradzać za proste wyjaśnienia dla ludzi.
  • Według zestawienia serwisu Arena Opus 5 pisał średnio 510 słów na odpowiedź, a Opus 4.5 tylko 158.
  • Opus 4.6 jest jeszcze dostępny w aplikacji Claude, a w interfejsie programistycznym kosztuje za token o jedną czwartą więcej niż Opus 5.5.

Jackson Kernion zajmuje się w Anthropic dostrajaniem modeli Claude. 22 września, w dniu premiery Opus 5.5, napisał na X, że od czasów Opus 4.6 żaden model nie pisał tak, żeby był z niego równie zadowolony. Kolejne wersje lepiej liczyły i programowały. Na ich teksty skarżyli się użytkownicy.

Kernion nazywa problem po imieniu. Opus 5.5 to według niego pierwsze wydanie z celowanymi poprawkami jasności zdań i »zbyt gęstych zrzutów informacji« (overly-dense info dumps). Użytkownik zapytał go, co zepsuło się po wersji 4.6. Odpowiedź: im mocniej model trenuje się na matematyce, kodzie i objaśnianiu spraw technicznych innym modelom, tym bardziej trzeba go osobno nagradzać za proste wyjaśnienia dla ludzi.

W kolejnym wpisie dodał, że charakterystyczny styl Claude, w internecie nazywany »Claudeish«, dopasował się do »psychologii modeli językowych«. Model ma znacznie więcej pamięci roboczej niż człowiek i chwyta drobniejsze szczegóły. Tekst dobry dla niego bywa więc dla ludzi ścianą faktów.

Opus 5 pisał ponad trzy razy dłużej niż Opus 4.5

Skargi zaczęły się w dniu premiery Opus 5. Arena, serwis porównujący modele na prawdziwych pytaniach użytkowników, zestawiła 12 sierpnia dziesiątki tysięcy odpowiedzi. Wynik opisał autor bloga paddo.dev w tekście o stylu Opus 5.

Średnia długość odpowiedzi według serwisu Arena, 12.08.2026

158 słów

Claude Opus 4.5

510 słów

Claude Opus 5

Według tego samego zestawienia zdania Opus 5 były o 58 procent dłuższe, a pauz używał 2,3 raza częściej.

Na Reddicie wątek o powrocie z Opus 5 do Opus 4.6 zebrał 946 głosów. Najwyżej oceniona odpowiedź brzmiała: »żaden człowiek tak się nie porozumiewa«. Serwis Every w recenzji Opus 5.5 z 22 września przyznaje, że wyjaśnienia Opus 5 same wymagały wyjaśnień. O nowym modelu pisze ostrożniej: czyta się go łatwiej, ale często chowa sedno.

Anthropic w komunikacie o Opus 5.5 przyznaje, że sposób pisania był jedną z najczęstszych uwag do Opus 5. Nowy model ma stawiać najważniejszą informację na początku, rzadziej sięgać po żargon i trzymać się zasad pisania podanych przez użytkownika. Firma Box, jeden z pierwszych klientów, podaje w tym komunikacie odpowiedzi krótsze o 40 procent bez utraty trafności.

Opus 4.6 jest jeszcze w aplikacji, a dla programistów kosztuje o jedną czwartą więcej

Strona pomocy Anthropic zaktualizowana 22 września wymienia Opus 4.6 wśród modeli do wyboru w aplikacji Claude. Dodatkowe modele są w menu pod pozycją »More models«. W interfejsie programistycznym (API, czyli dostęp dla programów firmy) producent wycofa go nie wcześniej niż 5 lutego 2027 roku. Za token kosztuje tam 5 dolarów na wejściu i 25 na wyjściu, a Opus 5.5 odpowiednio 4 i 20, czyli o jedną piątą mniej.

Kernion pisze, że problem jest trudny i firma będzie go dalej poprawiać. Dla użytkownika płynie z tego prosty wniosek. Numer wersji mówi o wynikach w matematyce i programowaniu. O jakości maila do klienta nie mówi nic.

Czytaj też

Za najdroższy model płaci się przy zadaniach, które go nie potrzebują

Najmocniejszy model kosztuje więcej i odpowiada wolniej, a przy przepisaniu maila daje to samo co najtańszy. Gdzie przebiega granica i po czym poznać, że została przekroczona.

Źródła

  1. Jackson Kernion, wpis na X o pisaniu Opus 5.5 i Opus 4.6, 22.09.2026 (źródło pierwotne)
  2. Jackson Kernion, odpowiedź na X o przyczynach zmiany stylu, 22.09.2026 (źródło pierwotne)
  3. Jackson Kernion, odpowiedź na X o stylu »Claudeish«, 23.09.2026 (źródło pierwotne)
  4. Anthropic, „Introducing Claude Opus 5.5”, 22.09.2026 (źródło pierwotne)
  5. Anthropic, „Model deprecations”, dokumentacja, stan na 25.09.2026 (źródło pierwotne)
  6. Anthropic, „Change the model, effort, and thinking settings”, strona pomocy, 22.09.2026 (źródło pierwotne)
  7. The Decoder, „Anthropic engineer explains why Claude's writing got worse although the model got smarter”, 23.09.2026
  8. Paddo, „A Dial Worth Turning: Claude Opus 5's Prose, and the Style Guide Anthropic Wrote Against Its Own Model”, 02.09.2026
  9. Every, „Vibe Check: Opus 5.5 Is Pulling Our Codex Converts Back to Claude”, 22.09.2026
  10. Simon Willison, „Claude Opus 5.5, GPT-6 Sol, GPT-6 Luna, and a new price war”, 22.09.2026

Historia zmian

  1. 25 września 2026

    Usunięta część z porównaniem trzech modeli na polskich zadaniach: jej wyników nie zachowano, więc nie dało się ich sprawdzić. Zmieniony tytuł i adres tekstu.

Czy ten tekst Ci pomógł?

Jedno kliknięcie. Bez podawania adresu e-mail. Dzięki temu wiem, które teksty wymagają poprawy.