Głos twórców

Wywiady z twórcami AI rozebrane na wątki — co się zmienia, co robić, co będzie. Zawsze z dosłownym cytatem i linkiem do całej rozmowy.

Boris Cherny· twórca Claude Code, Anthropic

Dzień po premierze Opus 5 twórca Claude Code tłumaczy, dlaczego skasowali 80% instrukcji systemowych — i dlaczego model zrobił się od tego lepszy, nie gorszy.

Y Combinator — Startup School 2026 · prowadzi Diana Hu · sprawdzone 16 sierpnia 2026

Wątek 01

Model przestał dawać się oszukać ukrytą instrukcją

The model does not seem to be prompt injectable anymore. (…) we're looking at neurons in the model's brain that light up when prompt injection happens."

Prompt injection (wstrzyknięcie polecenia) to sytuacja, gdy AI czyta stronę albo dokument, w którym ktoś ukrył polecenie — a model je wykonuje, myśląc, że to instrukcja od użytkownika. Rok temu model robił to bez pytania. Dziś Anthropic broni się trzema warstwami naraz: wytrenowanym modelem, „klasyfikatorem" patrzącym dosłownie na to, które neurony zapalają się przy próbie wstrzyknięcia, i trzecią warstwą przy automatycznym trybie pracy.

Co z tego dla MŚP: Jeśli AI w Twojej firmie czyta cudze strony, maile albo pliki od klientów — to jest dokładnie ten scenariusz ataku. Warto wiedzieć, że to się realnie poprawia z każdą generacją modelu, a nie tylko z marketingu producenta.

Wątek 02

Skasowali 80% instrukcji systemowych — i model zrobił się lepszy

So, yeah, we deleted 80% of the system prompt. (…) the model is actually a little bit more intelligent without these prompts."

Przy każdym nowym modelu zespół Claude Code najpierw kasuje prawie wszystkie instrukcje-podpowiedzi, które kiedyś musieli dopisać, żeby model zachowywał się poprawnie. Powód: nowy model często umie już to, co wcześniej trzeba było mu tłumaczyć krok po kroku — a zbędna instrukcja tylko go ogranicza. Nazywają to „ablacją": kasujesz wszystko, potem dodajesz z powrotem tylko to, co model naprawdę okazuje się potrzebować.

Co z tego dla MŚP: Jeśli masz rozbudowane instrukcje dla AI (w Claude — plik CLAUDE.md, zapisane skille, automatyzacje) i nie zmieniałeś ich od miesięcy — warto raz na jakiś czas je skasować i sprawdzić, czy nowszy model w ogóle ich jeszcze potrzebuje.

Wątek 03

„Product overhang" — model już to potrafi, tylko żaden produkt na to nie pozwala

The model is able to do all sorts of things with today's models (…) that we have not yet realized. (…) often what happens is the product gets in the way. And this getting in the way, we call this hobbling."

To jest chyba najważniejsza teza z całej rozmowy. Sam Claude Code powstał z tej obserwacji: dwa lata temu model (Sonnet 3.5) już potrafił pisać całe pliki kodu naraz, ale wszystkie ówczesne narzędzia dawały mu tylko podpowiadanie pojedynczej linijki — same go ograniczały. Cherny nazywa to „hobbling" (kulawienie modelu przez produkt, który nie pozwala mu pokazać, co naprawdę umie). Jego teza: dzisiejsze modele mają mnóstwo takich niewykorzystanych możliwości, których nikt jeszcze nie zauważył.

Wątek 04

Jeden prompt przepisał program w 11 dni — praca, która zajęłaby zespołowi rok

It ran for 11 days, and it rewrote the entire code base. (…) Over Definitely over a year."

Konkretny przykład z ich własnej firmy: środowisko uruchomieniowe Bun (na którym stoi Claude Code) trzeba było przepisać z jednego języka programowania (Zig) na inny (Rust) — ponad 100 tysięcy linijek kodu. Inżynier dał modelowi jedno zadanie z jasnym kryterium sukcesu (istniejące testy programu muszą dalej przechodzić) i sterował nim po drodze. Model pracował 11 dni bez przerwy. To rozwiązanie działa dziś naprawdę — na nim stoi produkt, którego używają klienci.

Co z tego dla MŚP: Wzorzec, nie konkretna liczba dni: zadanie z jasnym „skończone, gdy…" i sposobem sprawdzenia wyniku model potrafi ciągnąć samodzielnie bardzo długo, bez pilnowania krok po kroku.

Wątek 05

AI, która sama sprząta po sobie kod — 20–30 automatycznych zadań dziennie

We actually have Quad maintaining itself now. (…) now we have every day maybe 20 or 30 of these routines."

W Anthropic AI codziennie samodzielnie: usuwa martwy kod, wypuszcza eksperymenty gotowe do wdrożenia, dopisuje brakujące testy, usuwa niepotrzebne testy i scala powtarzające się fragmenty kodu w jedną wersję (żartobliwie nazwane „policją od powtórek"). Każde takie zadanie to jedno proste zdanie-polecenie uruchamiane cyklicznie — nikt nie pilnuje tego ręcznie.

Co z tego dla MŚP: To jest żywy przykład najwyższego stopnia z naszej drabiny pracy z AI — „dzieje się bez Ciebie". Nie trzeba mieć firmy programistycznej, żeby zastosować tę samą zasadę do powtarzalnych zadań administracyjnych: jedno jasne polecenie, uruchamiane cyklicznie, bez pilnowania.

Wątek 06

Rada dla ludzi pracujących z AI: dawaj zadanie trochę za trudne

You should give the model slightly harder tasks than what you think it can do. (…) describe the task, (…) describe the exit criteria, and then just go with the model cook."

Najczęstszy błąd, jaki widzi u ludzi korzystających z AI: rozpisują polecenie na bardzo drobne kroki („zrób najpierw to, potem to, potem sprawdź tamto"), zamiast opisać, jak wygląda dobry wynik, i pozwolić modelowi samemu dobrać drogę. Druga część tej samej rady: naucz model, jak ma sam sprawdzić, czy dobrze wykonał zadanie — to jest, jego zdaniem, rzecz, którą ludzie najczęściej pomijają.

Co z tego dla MŚP: Konkretna technika do wypróbowania: zamiast listy kroków napisz jedno zdanie „skończone, gdy…" i daj modelowi sposób sprawdzenia własnej pracy (np. „porównaj z oryginałem", „sprawdź czy liczby się zgadzają").

Wątek 07

„Kodowanie jest rozwiązane" — ale z ważnym zastrzeżeniem

Coding is solved for the kind of coding that I do. It's not solved for everyone. (…) There's really kind of in the weeds UI verification (…) it's still not perfect."

Cherny wcześniej publicznie mówił, że „kodowanie jest rozwiązane" — tu sam to studzi. Model wciąż ma problemy z bardzo głębokim kodem systemowym, systemami rozproszonymi i precyzyjną weryfikacją interfejsu „co do piksela". To ważne zdanie równowagi w wywiadzie pełnym entuzjastycznych przykładów — nawet twórca narzędzia mówi wprost, gdzie ono zawodzi.

To był jeden moduł. Reszta stoi na stronie z newsami — wszystkie naraz, każdy w skrócie.

Zobacz wszystkie newsy