Co Claude naprawdę znalazł

Anthropic uruchomił niemal tysiąc kopii swojego modelu Claude na publicznej bazie sekwencji DNA, a po 21 godzinach poszukiwań model wskazał powtarzający się wzorzec genetyczny obok słabo zbadanego enzymu. Firma nazywa tę kombinację ART, od array-associated reverse transcriptase.

Zadanie wykorzystało około 950 agentów i 210 milionów tokenów, zawężając ponad 200 000 znanych enzymów odwrotnej transkryptazy do 20 mocnych kandydatów. Wzorzec występuje u bakteriofagów, wirusów atakujących bakterie, a jego seria równomiernie rozłożonych powtórzeń DNA przypomina strukturalnie powtórzenia stojące za edycją genów CRISPR. Wstępne testy sugerują, że układ wytwarza krótkie fragmenty RNA, dlatego Anthropic nazywa go programowalnym.

Luka między komunikatem prasowym a artykułem naukowym

Własny opis Anthropic jest ostrożniejszy niż jego nagłówek. Firma pisze wprost, że nie zna jeszcze funkcji ART, a dyrektor generalny Dario Amodei powiedział dziennikarzom, że dokładna funkcja, ewentualna przydatność biotechnologiczna i znaczenie tego odkrycia nie są jeszcze jasne.

Ustalenie opiera się na preprincie, a nie na artykule ocenionym przez niezależnych recenzentów, a jedyne laboratorium, które dotychczas je oceniło, należy do firmy, która zbudowała model stojący za tym twierdzeniem. Żaden zewnętrzny zespół nie powtórzył wyniku ani nie wykazał, że ART robi cokolwiek w żywej komórce.

Co naprawdę powiedzieli niezależni naukowcy

Dwóch wymienionych z nazwiska badaczy spoza Anthropic wprost zakwestionowało to ujęcie.

KtoCo powiedział
Anthropic (Dario Amodei, CEO)Dokładna funkcja ART, jej ewentualna przydatność biotechnologiczna i jej znaczenie nie są jeszcze jasne.
Kevin Blake, mikrobiolog, Washington UniversityNic nie wskazuje na to, że jest to konkurent technologii CRISPR ani że może powstać z tego jakiekolwiek zastosowanie terapeutyczne lub praktyczne.
Dimitri Perrin, informatyk, Queensland University of TechnologySam enzym był już znany wcześniej. ART przypomina CRISPR pod względem budowy, ale nie ma jeszcze dowodu, że przypomina go też pod względem funkcji.

Obaj badacze wskazują na to samo ryzyko: model wytrenowany do rozpoznawania wzorców może znaleźć taki, który wygląda na znaczący, nie będąc nim wcale, czyli rodzaj statystycznej apofenii. Feng Zhang z MIT, jeden z naukowców stojących za samą edycją genów CRISPR, nazwał te prace naprawdę intrygującą, choć jego opinia była wyjątkiem wśród pytanych badaczy.

Lekcja dla każdego oświadczenia dostawcy AI

Nic z tego nie oznacza, że Claude niczego nie znalazł. Wykrycie niezwykłego wzorca strukturalnego wśród 200 000 sekwencji w 21 godzin to realny wynik i może jeszcze doprowadzić do czegoś użytecznego, gdy zbada go niezależne laboratorium. Czego jeszcze nie potwierdza, to nagłówek o nowym odkryciu o nieznanym, lecz sugerowanym znaczeniu.

Wzorzec, na który warto zwracać uwagę, nie dotyczy tylko Anthropic. Własna narracja firmy AI o tym, co właśnie osiągnął jej model, to twierdzenie strony zainteresowanej, a nie zweryfikowany fakt. Zanim jakiekolwiek twierdzenie o możliwościach zmieni decyzję zakupową, pozycję budżetową czy tezę inwestycyjną, warto sprawdzić, czy ktoś spoza dostawcy to potwierdził. W tym przypadku dwóch naukowców, którzy to sprawdzili, tego nie potwierdziło.