Claudeovo otkriće enzima pokazuje da je provera pravi proizvod AI agenata
Anthropicov eksperiment sa 950 agenata nije argument za autonomnu nauku. To je nacrt za široku paralelnu pretragu koju kontroliše skupa i stroga provera.
Šta se promenilo
Anthropic je 23. septembra 2026. objavio da je oko 950 Claude agenata tokom 21 sata analiziralo genomske podatke i pronašlo ranije neopisan sistem enzima koji kompanija naziva ART. Agenti su prikupili više od 200.000 reverznih transkriptaza, izdvojili 3.500 kandidata i pripremili izveštaje za 20 najzanimljivijih.
Ljudi su obavili sav laboratorijski rad. Funkcija sistema još nije poznata, a tehnički rezultat je objavljen kao preprint, pa je ovo potvrđen trag vredan daljeg rada, a ne gotov alat za uređivanje gena.
Produkcijska pouka
Ovaj rezultat pokazuje gde je stvarno usko grlo agentskih sistema. Generisanje hiljada hipoteza može biti brzo; skupo je utvrditi koja je tačna, korisna i bezbedna.
Isti problem postoji u kodiranju, podršci i operacijama. Bez validatora, veliki broj agenata samo proizvodi veći red kandidata koje neko kasnije mora da pregleda.
Naš potez
Virtual Arc bi ovaj obrazac testirao tamo gde postoji ograničen skup mogućih odgovora i pouzdana završna provera: analiza regresija, klasifikacija incidenata, migracije sa testovima ili istraživanje dokumentacije sa obaveznim izvorima.
Uveli bismo budžetska ograničenja, evidenciju porekla svakog nalaza i nezavisnu proveru pre bilo kakve akcije. Ako ne možemo da izmerimo trošak po potvrđenom rezultatu, sistem još nije spreman za produkciju.
Za Virtual Arc, najvažniji deo ove priče nije poređenje sa CRISPR-om, jer funkcija pronađenog sistema još nije utvrđena. Važan je obrazac rada: veliki broj agenata široko pretražuje ograničen prostor, čuva tragove dokaza, odbacuje većinu kandidata i prosleđuje mali broj nalaza ljudima koji mogu stvarno da ih provere. To je mnogo korisniji model za produkcijski softver od obećanja o autonomnom agentu koji sam završava ceo posao. Mi ne bismo kopirali naslov o 950 agenata; kopirali bismo kontrolnu strukturu. Pokrenuli bismo probni sistem samo na zadacima sa jasnim granicama, potpunim tragom izvora, čvrstim budžetom i nezavisnim validatorom. Uspeh bismo merili troškom po potvrđenom korisnom rezultatu, a ne brojem paralelnih agenata, potrošenih tokena ili generisanih predloga. Dok ponovljena izvršavanja ne daju uporedive liste kandidata i dok svaka tvrdnja nema proverljiv dokaz, ovakav sistem ne bismo pustili da samostalno donosi produkcijske odluke.