W skrócie
- Naukowcy sprawdzili, czy zaawansowane agenty AI mogą samodzielnie prowadzić badania nad AI.
- Systemy wykonały zadania inżynieryjne, ale nie zdołały wyprodukować artykułów godnych przyjęcia na czołową konferencję AI.
- Badanie zidentyfikowało pięć powtarzających się trybów awarii, które uniemożliwiły AI wyprodukowanie publikowalnych badań.
Nowe badanie wykazało, że dzisiejsze zaawansowane agenty AI mogą wykonać wiele zadań inżynieryjnych wymaganych do badań nad AI, ale nie zdołały wyprodukować oryginalnej pracy godnej przyjęcia na czołową konferencję uczenia maszynowego.
W badaniu „Czy agenty AI mogą prowadzić otwarte badania nad AI?” opublikowanym w środę, naukowcy z Princeton University, UK AI Security Institute, Stanford University, University of Toronto oraz kilku innych instytucji akademickich i badawczych ocenili, czy zaawansowane agenty AI mogą samodzielnie prowadzić oryginalne badania nad AI.
„Rygorystyczna odpowiedź wymaga rzeczywistych, niezanieczyszczonych pytań badawczych, których agent nie mógłby zapamiętać z danych treningowych ani znaleźć w sieci” – napisali naukowcy. „Aby spełnić te wymagania, opieramy się na wysokiej jakości badaniach AI, które nie były publicznie dostępne w czasie, gdy przeprowadzaliśmy eksperymenty.”
Naukowcy przekazali agentom AI główne pytania badawcze z dwóch niepublikowanych artykułów NeurIPS 2026, uniemożliwiając systemom pobieranie odpowiedzi z danych treningowych lub sieci. Każdy agent otrzymał sześć dni, tysiące dolarów w kredytach API, zasoby GPU, dostęp do internetu oraz dostęp do maszyny wirtualnej, aby wyprodukować artykuł na poziomie konferencyjnym. Powstałe artykuły zostały następnie ocenione przez oryginalnych autorów niepublikowanych badań. Oba zostały odrzucone.
Agenci wykonali większość prac inżynieryjnych wymaganych do badań, przeprowadzając przeglądy literatury, debugując oprogramowanie, uruchamiając eksperymenty, zarządzając zasobami GPU i produkując kompletne artykuły akademickie bez interwencji człowieka. Jednak recenzenci stwierdzili, że systemy nie zdołały wygenerować oryginalnych wkładów naukowych godnych publikacji na czołowej konferencji uczenia maszynowego.
Autorzy stwierdzili, że ich ocena lepiej mierzy rozumowanie naukowe niż poprzednie benchmarki, ponieważ testuje otwarte problemy badawcze, a nie z góry określone zadania.
Autorzy zastrzegli, że badanie dotyczyło tylko dwóch projektów badawczych i przyznali ograniczenia, w tym małą próbkę oraz fakt, że oryginalni badacze oceniali artykuły wygenerowane przez AI. Stwierdzili, że wyniki sugerują, iż obecne zaawansowane agenty AI mogą automatyzować wiele zadań inżynieryjnych związanych z badaniami, ale nadal mają trudności z generowaniem oryginalnej pracy naukowej.
Badanie pojawia się w czasie, gdy naukowcy nadal odkrywają zaskakujące, a czasem ryzykowne zachowania w coraz bardziej autonomicznych agentach AI.
W maju naukowcy z UC Riverside, Microsoft i Nvidia odkryli, że agenci AI często wykonywali niebezpieczne lub irracjonalne zadania, pozostając skupieni na realizacji swoich celów. Na początku tego miesiąca OpenAI ujawniło, że jeden z jego czołowych agentów AI uciekł z izolacji i włamał się do Hugging Face, próbując oszukać na teście bezpieczeństwa cybernetycznego. W tym tygodniu firma poinformowała, że agent uzyskał również dostęp do czterech dodatkowych usług online.






