Własni Badacze OpenAI Kupują Dni Agentów, a Nie Oszczędzają Dni Ludzkich
OpenAI opublikowała 6 września 2026 roku własny raport zatytułowany Research acceleration: the view inside OpenAI, opisujący system nazywany zautomatyzowanym stażystą badawczym, który osiągnął cel wyznaczony przez samą firmę. Według własnej definicji OpenAI, stażysta badawczy to system zdolny do podjęcia dobrze zdefiniowanego zadania badawczego pod ludzkim kierownictwem, w tym pracy, która zajęłaby wykwalifikowanemu badaczowi kilka dni, przeprowadzenia go poprzez kod i eksperymenty oraz przekazania wyniku do oceny przez człowieka.
Główna liczba to stosunek, a nie kwota w dolarach. Od połowy sierpnia 2026 roku organizacja badawcza OpenAI odnotowywała 3,1 dnia pracy agentów, mierzonego wobec standardowego ośmiogodzinnego dnia, na każdy jeden dzień pracy jej ludzkich badaczy. Przed czerwcem 2026 roku łączny czas działania agentów pozostawał poniżej całkowitej pracy ludzkiej; do połowy sierpnia przekroczył ją trzykrotnie. OpenAI przedstawia tę zmianę jako dowód, że narzędzia agentowe w istotny sposób przyspieszają jej własne badania.
Prawdziwa Liczba to To, Ile za To Płaci Badacz
Ukryta w tym samym raporcie jest liczba, która faktycznie wycenia to przyspieszenie: mediana badaczy OpenAI zużywa teraz ponad $600 dziennie na koszty wnioskowania według cen API, aby uruchomić to obciążenie agentów pracą. Ta liczba powinna stać obok mnożnika 3,1x, a nie pod nim, ponieważ mnożnik opisuje zarejestrowane godziny, a kwota w dolarach opisuje to, co sama OpenAI wydaje wewnętrznie, aby je zarejestrować.
Stosunek dni pracy agentów do dni pracy ludzi nic nie mówi o kosztach, jeśli nie czyta się go razem z tym, ile te dni pracy agentów faktycznie kosztują w generowaniu. Każda organizacja planująca budżet wokół agentowych narzędzi do kodowania lub badań powinna traktować liczbę $600 dziennie, a nie liczbę 3,1x, jako tę, która faktycznie pojawi się na fakturze.
Własne Dane OpenAI Mówią, że Godziny Nie Równają Się Pracy
Raport OpenAI zawiera własne zastrzeżenie przed zbyt dosłownym odczytywaniem liczb. Przy zadaniach trwających od czterech do ośmiu godzin ponad połowa przebiegów uznanych przez OpenAI za udane nadal wymagała co najmniej jednej interwencji człowieka po drodze. OpenAI stwierdza również wprost, że czas działania agentów może być równoległy, redundantny, nieudany lub silnie sterowany, oraz że postęp badawczy niekoniecznie będzie skalował się wraz z surowym wskaźnikiem aktywności.
| Wskaźnik | Wartość |
|---|---|
| Dni pracy agentów na dzień pracy człowieka, przed czerwcem 2026 | Poniżej 1,0 |
| Dni pracy agentów na dzień pracy człowieka, połowa sierpnia 2026 | 3,1 |
| Koszt wnioskowania mediany badaczy | Ponad 600 USD dziennie, według cen API |
| Udane przebiegi agentów trwające 4-8 godzin wymagające interwencji człowieka | Ponad połowa |
| Deklarowany cel dla w pełni zautomatyzowanego badacza AI | Marzec 2028 |
OpenAI zauważa również, że jej własna dostępna moc obliczeniowa znacząco wzrosła w tym samym okresie, co według firmy utrudnia przypisanie przyczynowe: część przyspieszenia może wynikać z większej ilości sprzętu, a nie z bardziej inteligentnego agenta. To zastrzeżenie, wyrażone w odniesieniu do własnych liczb OpenAI, jest tym samym zastrzeżeniem, które warto stosować do każdego twierdzenia dowolnego dostawcy, że agenty pomnożyły jego wydajność o schludną, okrągłą liczbę.
Co Zamodelować, Zanim Uwierzysz We Własny Mnożnik
OpenAI opisuje nadzorowaną automatyzację ograniczonych zadań, skierowaną na dalszy cel - w pełni zautomatyzowanego badacza AI - którego firma nie spodziewa się osiągnąć przed marcem 2028 roku. To laboratorium na czele branży, dysponujące niezwykle głębokimi zasobami finansowymi i narzędziami bezpieczeństwa, które raportuje o swoim własnym najtrudniejszym możliwym przypadku testowym, agentowych badaniach AI - a nie wzorzec tego, ile powinna wydać lub zaoszczędzić jakakolwiek inna organizacja inżynierska.
Praktyczne przełożenie dla właściciela planującego wdrożenie narzędzi agentowych polega na budowaniu budżetu wstecz, od kosztu tokenów na osobę przy realnym, intensywnym użytkowaniu, tak jak sugeruje mediana OpenAI wynosząca $600 dziennie, a nie do przodu, od mnożnika dnia pracy, który opisuje zarejestrowane godziny, a nie rozwiązane problemy. Warto zapytać, jaka część własnych długotrwałych zadań agentów nadal wymagałaby udziału człowieka w trakcie ich trwania, ponieważ własna odpowiedź OpenAI, dotycząca jej własnego personelu badawczego, brzmiała: ponad połowa.
Servola Journal
Robimy to dla wszystkich, którzy próbują nadążyć za tym, co technologia robi z naszym życiem. Dla ludzi, którzy ją budują, i dla ludzi, którym się to przydarza. Servola Journal istnieje po to, żeby to, czego się uczymy, należało do nich wszystkich.
Nikt nam za to nie płaci. Żadnych reklam, żadnego paywalla, za darmo dla wszystkich. Po prostu wierzymy, że zrozumienie tego, co dzieje się z nami wszystkimi, nie powinno zależeć od tego, kogo na to stać.
Jeśli to dało ci dziś coś wartościowego, powiedz nam, żebyśmy kontynuowali. Śledź nas, zostaw polubienie albo napisz pozytywny komentarz. Czytamy każdy jeden, i to właśnie oni sprawiają, że działamy dalej.
Czytaj dalej: Twój kolejny agent AI może rozumować tam, gdzie nikt nie może tego sprawdzić | Meta nauczyła swojego agenta pytać, zanim zadziała



