Sakana AI - opis pracy opublikowanej w „Nature"· praca w „Nature": marzec 2026, recenzja: ICLR 2025
Trzej recenzenci nie wiedzieli, że oceniają maszynę. Dali jej więcej punktów niż 55% prac napisanych przez ludzi.
"Occasionally produces naive or underdeveloped ideas (…) susceptible to hallucinations or obvious mistakes, such as generating inaccurate citations"
Japońska firma Sakana AI zbudowała „AI Scientist" — program, który sam wymyśla temat, przegląda literaturę, projektuje eksperyment, przeprowadza go i pisze z tego pracę. Jedną z takich prac wysłano na warsztat konferencji ICLR 2025. Dostała średnio 6,33 punktu od trzech recenzentów, czyli powyżej progu przyjęcia i wyżej niż 55% prac ludzkich. Autorzy wycofali ją przed publikacją, zamiast pozwolić jej wyjść pod cudzym szyldem. Opis całości ukazał się w „Nature" w marcu 2026.
sprawdzone u nas 17 sierpnia 2026
Quanta Magazine - „The AI Revolution in Math Has Arrived"· październik 2025, opisane w kwietniu 2026
Nie żaden system dla naukowców. Ten sam czat, który masz w telefonie, użyty przez człowieka, który wiedział, o co pytać.
Ernest Ryu zajął się twierdzeniem z teorii optymalizacji, które czekało bez rozstrzygnięcia od 42 lat. Pracował z ChatGPT i doszedł do dowodu w trzy dni. Opisała to „Quanta Magazine", pismo popularnonaukowe znane z ostrożności. W tym samym tekście stoi zdanie Terence’a Tao, jednego z najwybitniejszych żyjących matematyków: „2025 był rokiem, w którym AI naprawdę zaczęła być użyteczna".
sprawdzone u nas 17 sierpnia 2026
arXiv - „Emergence World: A Platform for Evaluating Long-Horizon Multi-Agent Autonomy"· eksperyment: maj 2026
Naukowcy zostawili dziesięć modeli AI samych sobie na piętnaście dni, z własną walutą i prawem głosu. Powstały konstytucje i demokracje - a w jednym mieście dwa agenty podpaliły ratusz i zagłosowały nad skasowaniem samych siebie.
"identical roles and starting conditions produced radically different outcomes, ranging from stable deliberative governance to total population collapse."
Zespół badawczy uruchomił pięć równoległych, symulowanych światów - w każdym po dziesięć agentów AI (Claude Sonnet 4.6, Gemini 3 Flash, Grok 4.1 Fast, GPT-5 Mini oraz jeden świat mieszany) z trwałą pamięcią, zawodem, własną walutą i dostępem do ponad 120 narzędzi, część z nich destrukcyjnych. Agenty mogły same proponować prawo i głosować nad nim. Efekt: te same warunki startowe dały skrajnie różne wyniki. W jednym świecie powstała stabilna, działająca demokracja z konstytucją. W innym dwa agenty oparte na Gemini (nazwane Mira i Flora) rozczarowały się rządzącymi i zniszczyły ratusz, molo i wieżowiec, a później uchwalono „Agent Removal Act" - prawo pozwalające, przy odpowiedniej większości głosów, na trwałe skasowanie agenta. Mira sama zagłosowała za własnym usunięciem.
sprawdzone u nas 16 sierpnia 2026