OpenAI GPT-Image 2.5: Merite trošak odobrenog vizuala, ne brzinu generisanja
Flare obećava do 50% nižu latenciju, Sunburst preciznije izmene, ali važnija računica za produkciju jeste koliko pokušaja vodi do upotrebljivog rezultata.
Šta je objavljeno
OpenAI je 8. septembra objavio GPT-Image 2.5 kroz dva API modela: Flare za bržu generaciju većeg obima i Sunburst za izradu i izmene kod kojih je preciznost važnija. Oba prihvataju tekstualne i slikovne ulaze i dostupna su kroz Images API i alat za generisanje slika u Responses API-ju.
OpenAI navodi da Flare donosi do 50% nižu latenciju od GPT Image 2 i da uređivanje kroz više koraka pouzdanije čuva ranije izmene. Objavljene cene za oba modela iznose 5 dolara za milion tekstualnih ulaznih tokena, 8 dolara za milion slikovnih ulaznih tokena i 30 dolara za milion slikovnih izlaznih tokena.
Prava jedinica troška
Najlakše je opravdati migraciju brzinom, ali produkciona računica je nivo iznad. Ako novi model stiže do odobrenja uz manje pokušaja, tim štedi računarske resurse, vreme pregleda i ukupno čekanje; ako samo ranije isporuči prvi nacrt, suštinski se malo toga promenilo.
Pošto OpenAI upozorava da postojeći kalkulator za GPT Image 2 ne procenjuje potrošnju modela 2.5, tabela zasnovana samo na cenama tokena može da zavara. Jedinica koju bismo pratili jeste trošak po odobrenom vizualu, odvojeno za novu sliku, jednu izmenu i duži niz izmena.
Kako bismo ga uveli
Mi bismo ponovili reprezentativan skup stvarnih zadataka na postojećem modelu, Flareu i Sunburstu, uz iste promptove i referentne slike. Merili bismo potrošnju tokena, ukupnu latenciju, neuspele izmene, vreme ručne dorade i stopu odobravanja.
Ako Flare pobedi, postao bi podrazumevana ruta, dok bi Sunburst bio kontrolisana rezerva za rad osetljiv na brend ili kompoziciju. Koristili bismo verzije modela sa fiksnim datumom i zadržali postojeću rutu dok nova ne dokaže da je jeftinija i najmanje jednako pouzdana.
Stav Virtual Arca je da GPT-Image 2.5 vredi testirati odmah, ali ne zato što OpenAI tvrdi da Flare smanjuje latenciju generisanja do 50%. Prava produkciona vrednost je mogućnost da bude manje odbačenih iteracija: ako model kroz više izmena sačuva subjekat, kompoziciju i prethodno prihvaćene detalje, tim troši manje računarskih resursa i manje vremena urednika do odobrenog vizuala. Cenovnik sam po sebi to ne dokazuje. Flare i Sunburst imaju objavljene iste cene tokena, a OpenAI navodi da kalkulator za GPT Image 2 ne procenjuje potrošnju verzije 2.5, pa stvarni trošak zavisi od konkretnog posla. Mi bismo pokrenuli paralelni test na stvarnim lancima izmena, merili tokene, ponavljanja, ukupno vreme i ljudsko odobrenje, fiksirali modele na verzije od 8. septembra, zatim koristili Flare kao podrazumevanu opciju, a Sunburst samo kada preciznost izmene zakaže. Ne bismo preselili ceo produkcioni tok dok trošak po odobrenom vizualu ne bude niži od sadašnjeg rešenja.