Pracownik Anthropic przyznaje, że Claude pisał dla ludzi coraz gorzej. Chwalony za styl Opus 4.6 da się jeszcze wybrać w aplikacji
Jackson Kernion z Anthropic przyznaje, że Claude trenowany na matematyce i kodzie zaczął pisać gęsto, jak dla innego modelu, a Opus 5.5 ma to naprawiać. Według serwisu Arena Opus 5 pisał ponad trzy razy dłużej niż Opus 4.5.
Na skróty
- Jackson Kernion z Anthropic napisał 22 września, że od czasów Opus 4.6 nie był tak zadowolony z pisania żadnego modelu jak z Opus 5.5.
- Przyczynę widzi w treningu: model uczony matematyki, kodu i tłumaczenia spraw technicznych innym modelom trzeba osobno nagradzać za proste wyjaśnienia dla ludzi.
- Według zestawienia serwisu Arena Opus 5 pisał średnio 510 słów na odpowiedź, a Opus 4.5 tylko 158.
- Opus 4.6 jest jeszcze dostępny w aplikacji Claude, a w interfejsie programistycznym kosztuje za token o jedną czwartą więcej niż Opus 5.5.
Jackson Kernion zajmuje się w Anthropic dostrajaniem modeli Claude. 22 września, w dniu premiery Opus 5.5, napisał na X, że od czasów Opus 4.6 żaden model nie pisał tak, żeby był z niego równie zadowolony. Kolejne wersje lepiej liczyły i programowały. Na ich teksty skarżyli się użytkownicy.
Kernion nazywa problem po imieniu. Opus 5.5 to według niego pierwsze wydanie z celowanymi poprawkami jasności zdań i »zbyt gęstych zrzutów informacji« (overly-dense info dumps). Użytkownik zapytał go, co zepsuło się po wersji 4.6. Odpowiedź: im mocniej model trenuje się na matematyce, kodzie i objaśnianiu spraw technicznych innym modelom, tym bardziej trzeba go osobno nagradzać za proste wyjaśnienia dla ludzi.
W kolejnym wpisie dodał, że charakterystyczny styl Claude, w internecie nazywany »Claudeish«, dopasował się do »psychologii modeli językowych«. Model ma znacznie więcej pamięci roboczej niż człowiek i chwyta drobniejsze szczegóły. Tekst dobry dla niego bywa więc dla ludzi ścianą faktów.
Opus 5 pisał ponad trzy razy dłużej niż Opus 4.5
Skargi zaczęły się w dniu premiery Opus 5. Arena, serwis porównujący modele na prawdziwych pytaniach użytkowników, zestawiła 12 sierpnia dziesiątki tysięcy odpowiedzi. Wynik opisał autor bloga paddo.dev w tekście o stylu Opus 5.
Średnia długość odpowiedzi według serwisu Arena, 12.08.2026
158 słów
Claude Opus 4.5
510 słów
Claude Opus 5
Według tego samego zestawienia zdania Opus 5 były o 58 procent dłuższe, a pauz używał 2,3 raza częściej.
Na Reddicie wątek o powrocie z Opus 5 do Opus 4.6 zebrał 946 głosów. Najwyżej oceniona odpowiedź brzmiała: »żaden człowiek tak się nie porozumiewa«. Serwis Every w recenzji Opus 5.5 z 22 września przyznaje, że wyjaśnienia Opus 5 same wymagały wyjaśnień. O nowym modelu pisze ostrożniej: czyta się go łatwiej, ale często chowa sedno.
Anthropic w komunikacie o Opus 5.5 przyznaje, że sposób pisania był jedną z najczęstszych uwag do Opus 5. Nowy model ma stawiać najważniejszą informację na początku, rzadziej sięgać po żargon i trzymać się zasad pisania podanych przez użytkownika. Firma Box, jeden z pierwszych klientów, podaje w tym komunikacie odpowiedzi krótsze o 40 procent bez utraty trafności.
Opus 4.6 jest jeszcze w aplikacji, a dla programistów kosztuje o jedną czwartą więcej
Strona pomocy Anthropic zaktualizowana 22 września wymienia Opus 4.6 wśród modeli do wyboru w aplikacji Claude. Dodatkowe modele są w menu pod pozycją »More models«. W interfejsie programistycznym (API, czyli dostęp dla programów firmy) producent wycofa go nie wcześniej niż 5 lutego 2027 roku. Za token kosztuje tam 5 dolarów na wejściu i 25 na wyjściu, a Opus 5.5 odpowiednio 4 i 20, czyli o jedną piątą mniej.
Kernion pisze, że problem jest trudny i firma będzie go dalej poprawiać. Dla użytkownika płynie z tego prosty wniosek. Numer wersji mówi o wynikach w matematyce i programowaniu. O jakości maila do klienta nie mówi nic.
Czytaj też
Za najdroższy model płaci się przy zadaniach, które go nie potrzebują
Najmocniejszy model kosztuje więcej i odpowiada wolniej, a przy przepisaniu maila daje to samo co najtańszy. Gdzie przebiega granica i po czym poznać, że została przekroczona.
Źródła
- Jackson Kernion, wpis na X o pisaniu Opus 5.5 i Opus 4.6, 22.09.2026 (źródło pierwotne)
- Jackson Kernion, odpowiedź na X o przyczynach zmiany stylu, 22.09.2026 (źródło pierwotne)
- Jackson Kernion, odpowiedź na X o stylu »Claudeish«, 23.09.2026 (źródło pierwotne)
- Anthropic, „Introducing Claude Opus 5.5”, 22.09.2026 (źródło pierwotne)
- Anthropic, „Model deprecations”, dokumentacja, stan na 25.09.2026 (źródło pierwotne)
- Anthropic, „Change the model, effort, and thinking settings”, strona pomocy, 22.09.2026 (źródło pierwotne)
- The Decoder, „Anthropic engineer explains why Claude's writing got worse although the model got smarter”, 23.09.2026
- Paddo, „A Dial Worth Turning: Claude Opus 5's Prose, and the Style Guide Anthropic Wrote Against Its Own Model”, 02.09.2026
- Every, „Vibe Check: Opus 5.5 Is Pulling Our Codex Converts Back to Claude”, 22.09.2026
- Simon Willison, „Claude Opus 5.5, GPT-6 Sol, GPT-6 Luna, and a new price war”, 22.09.2026
Historia zmian
25 września 2026
Usunięta część z porównaniem trzech modeli na polskich zadaniach: jej wyników nie zachowano, więc nie dało się ich sprawdzić. Zmieniony tytuł i adres tekstu.
Czy ten tekst Ci pomógł?
Jedno kliknięcie. Bez podawania adresu e-mail. Dzięki temu wiem, które teksty wymagają poprawy.