Az OpenAI jelentős árcsökkentést jelentett be két GPT-5.6 mesterséges intelligencia alapú modelljének esetében, mindössze húsz nappal a hivatalos bevezetése után. A vállalat 80%-kal csökkentette a GPT-5.6 Luna és 20%-kal a GPT-5.6 Terra költségét , míg a zászlóshajó modelljéhez, a GPT-5.6 Solhoz egy gyorsabb API opciót vezetett be. Ezek a július 30-án hatályba lépett változások a költség, a sebesség és a kapacitás közötti egyensúly javítását célozzák, különösen a nagy mennyiségű mesterséges intelligencia által vezérelt automatizált feladatot kezelő vállalatok számára.
A vállalat magyarázata szerint az árcsökkentések a teljes szoftvercsomag optimalizálásának köszönhetők, beleértve a jobb hardverútválasztást, a továbbfejlesztett következtetési szoftvereket és az intelligensebb kontextus-gyorsítótárazási algoritmusokat. Valójában ezek közül a fejlesztések közül néhányat maguk a modellek vezéreltek: a felügyelt tesztelés során a GPT-5.6 Sol automatikusan átírta és optimalizálta a kritikus éles szoftvermagokat, 20%-kal csökkentve a szolgáltatási terhelést és több mint 15%-kal javítva a tokengenerálás hatékonyságát. Ez lehetővé teszi az OpenAI számára, hogy nagyobb teljesítményt hozzon ki meglévő szerverklasztereiből.
Új árak a GPT-5.6 Luna és Terra modellekhez
Az új árazással a GPT-5.6 Luna mostantól 0,20 dollárba kerül millió tokenenként bejövő , és 1,20 dollárba kimenő, szemben az 1 és 6 dolláros árakkal. Ez a modell, a család leggyorsabb és legköltséghatékonyabb tagja, nagy volumenű feladatokhoz, például ügyfél-interakciók osztályozásához, tömeges dokumentumelemzéshez és háttérautomatizáláshoz készült. Az OpenAI állítása szerint a teljesítménye összehasonlítható a körülbelül egy évvel ezelőtt élvonalbelinek tartott modellekével, de azok költségének töredékéért.
Eközben a mindennapi munkára tervezett GPT-5.6 Terra ára 2 dollár minden befektetett token után , és 12 dollár minden kibocsátott token után. Megközelítése az érvelés, a sebesség és a költségek közötti egyensúlyra törekszik az üzleti asszisztensek, a programozás és a munkaterülettel kapcsolatos lekérdezések terén. A stratégia lehetővé teszi a különböző modellek kombinálását ugyanazon folyamaton belül: például egy vállalat a Sol segítségével megoldhatja a bizonytalanságokat és kidolgozhat egy tervet, majd a Lunát megbízhatja a megvalósítással, a teszteléssel és az eredmények értékelésével.
Gyors mód: extra sebesség a GPT-5.6 Sol számára
Az OpenAI bevezette a GPT-5.6 Sol gyors módját is, amely felváltotta a korábbi prioritásos feldolgozást az API-ban. Ez a mód lehetővé teszi, hogy a zászlóshajó modell akár 2,5-szer gyorsabban fusson a standard feldolgozásnál, bár a használata kétszer annyiba kerül. A vállalat biztosítja, hogy a megnövekedett sebesség nem veszélyezteti a modell intelligenciáját. A prioritásként azonosított meglévő kérések automatikusan gyors módba kapcsolnak, megőrizve a kompatibilitást a jelenlegi implementációkkal.
Ezek az árváltozások a ChatGPT Work és a Codex felhasználóinak és szervezeteinek kredit- vagy időkorlátjait is érintik, ahol a Luna és a Terra használata kevesebb kreditet fogyaszt a havi előfizetési szintek megváltoztatása nélkül. Az OpenAI az X fiókján keresztül jelentette be a hírt, kijelentve, hogy „elkötelezettek a modellek határainak feszegetése iránt a költséghatékonyság, a kapacitás és a sebesség tekintetében” csökkentették az árakat. Az árcsökkentés az ágazatban fokozódó verseny idején történt, a kínai Moonshot AI startup Kimi K3-ához hasonló modellek megjelenésével.
Az új árképzés július 30. óta van érvényben, és bár a teljesítményadatok elsősorban az OpenAI belső értékelésein és kiválasztott ügyfeleken alapulnak, a vállalat bízik abban, hogy a megtakarítások fenntarthatóak lesznek a változatos és nagyméretű munkaterhelések esetében. Ezzel a stratégiával az OpenAI megerősíti a probléma összetettsége alapján történő következtetések szegmentálásának trendjét, lehetővé téve a szervezetek számára, hogy pontosan mérlegeljék a pénzügyi költségeket a működésükhöz szükséges számítási teljesítményhez képest.
