29. septembar 2026.

Claude Sonnet 5.5 čini rutiranje važnijim od rang-liste modela

Anthropicov brži Sonnet po istoj ceni vredi odmah testirati, ali kao podrazumevani model za jasno ograničene zadatke, uz limit napora i Opus kao rezervu.

Virtual Arc · Urednička fotografija

Šta je objavljeno

Anthropic je 28. septembra objavio Sonnet 5.5 po istoj ceni kao Sonnet 5: 2 dolara za milion ulaznih i 10 dolara za milion izlaznih tokena. Kompanija navodi više od 30% brže generisanje i do 30% niži trošak po zadatku, uz trenutnu dostupnost preko Claude API-ja, AWS-a, Google Clouda i Microsoft Foundryja.

Cena zavisi od rute

Nezavisni rezultati pokazuju da je izbor nivoa napora važniji od reklamne poruke. CodeRabbitov test na 44 PR-a završen je za manje od polovine vremena i uz oko 40% troška modela Sonnet 5, dok je Artificial Analysis utvrdio da max troši izuzetno mnogo tokena i nema dobar odnos cene i rezultata.

Šta bismo uradili

Ovo nije prosta zamena oznake modela. Anthropic navodi pet nekompatibilnih promena: aplikacije koje su isključivale rezonovanje moraju da pređu na between_tools, menja se format teksta između poziva alata, a nestandardne vrednosti za temperature, top_p ili top_k vraćaju grešku 400.

Sonnet 5.5 bismo pustili kroz canary testove na jasno ograničenim tokovima rada, fiksirali nivo napora za svaku rutu i zadržali eskalaciju na Opus. Promenu rutiranja vredi isporučiti sada; potpunu migraciju treba sačekati dok produkcione evaluacije ne potvrde cenu završenog zadatka i ozbiljnost grešaka.

Naš stav

Claude Sonnet 5.5 je prvi Sonnet koji bismo ozbiljno postavili kao podrazumevanog kandidata za jasno ograničene produkcione zadatke, ali njime ne bismo zamenili svaki model. Virtual Arc bi ga prvo paralelno testirao, bez uticaja na korisnike, na ispravkama grešaka, prvom prolazu kroz pregled koda, nacrtima odgovora podrške i strukturisanom radu sa dokumentima. U produkciju bismo ga pustili samo tamo gde su trošak po završenom zadatku, kašnjenje i stopa grešaka bolji od postojeće rute. Za redovan saobraćaj ograničili bismo nivo napora na low, medium ili high, dok bi Opus 5.5 ostao za nejasne arhitektonske odluke, visokorizične izmene i zadatke kod kojih je propuštena greška skuplja od dodatnih tokena. Anthropic ističe do 30% niži trošak po zadatku, ali je Artificial Analysis pri max nivou izmerio oko 193.000 izlaznih tokena po zadatku svog indeksa i približno 50% viši trošak nego kod Sonnet 5. Zaključak nije „prebaciti sve“, već agresivno rutirati, meriti cenu završenog posla i ne dozvoliti max kao podrazumevanu opciju dok ga sopstvene evaluacije ne opravdaju.

Izvori
  1. Introducing Claude Sonnet 5.5
  2. Claude Sonnet 5.5 model documentation
  3. Claude Sonnet 5.5 on Amazon Bedrock
  4. Claude Sonnet 5.5 reaches number two on the Artificial Analysis Intelligence Index
  5. Sonnet 5.5 vs Opus 5.5 code review benchmarks

← Sve objave