OpenAI predstavila nový model umelej inteligencie GPT-6 Astra.
Modul predstavuje zásadný posun v autonómnom fungovaní softvéru, keďže sa nesústredí iba na generovanie textových odpovedí, ale prináša priamu schopnosť komplexného ovládania počítača. Dokáže samostatne ovládať kurzor myši, simulovať stlačenia klávesnice, vypĺňať webové formuláre a vykonávať nadväzujúce úkony naprieč viacerými spustenými aplikáciami bez nutnosti neustáleho manuálneho zásahu človeka.
V benchmarkovom teste OSWorld 2.0, ktorý hodnotí efektivitu pri práci s operačným systémom, dosiahol systém skóre 72,6%, pričom priemerný čas dokončenia jednej úlohy predstavoval 40 minút. V porovnaní s predchádzajúcim modelom GPT-5.6 Sol, ktorý zaznamenal úspešnosť 65,7% s časovou náročnosťou 75 minút, ide o výrazné zrýchlenie pri vyššej miere presnosti.
V teste vizuálneho rozpoznávania prvkov ScreenSpot-Pro dosiahla novinka úspešnosť 92,7% bez využitia dodatočných externých nástrojov a v hodnotení Agents‘ Last Exam získala 59,3%. Z praktického hľadiska systém zvláda napríklad autonómne vyhľadávanie služieb cez mapové podklady, prechod na príslušné webové stránky a následnú registráciu cez formuláre.
Technológia zároveň nachádza uplatnenie pri správe kalendárov, aktualizácii databáz či príprave administratívnych a daňových podkladov. Popri bežných kancelárskych a vyhľadávacích činnostiach zvláda nová architektúra aj prácu v špecializovaných softvérových prostrediach. Model je schopný navrhovať plošné spoje v programe KiCad, manipulovať s trojrozmernými scénami v softvéri Blender a generovať prostredia v hernom engine Unreal Engine.
Z technického hľadiska pracuje systém s kontextovým oknom o veľkosti 1,050,000 tokenov, pričom maximálny rozsah vygenerovaného výstupu dosahuje 128,000 tokenov. Táto kapacita umožňuje jednorazové spracovanie rozsiahlej technickej dokumentácie alebo komplexných zdrojových kódov bez potreby fragmentácie dát.
Znalostná databáza modelu je ohraničená dátumom 30. apríla 2026, čo znamená, že novšie informácie vyžadujú priame pripojenie k externým zdrojom v reálnom čase. Výraznou zmenou prešli kybernetické schopnosti, kde novinka ako vôbec prvý model výrobcu dosiahla klasifikáciu Critical podľa interného bezpečnostného rámca Preparedness Framework.
V teste ExploitBench zaznamenal systém úspešnosť 100% v porovnaní so 78,5% predchádzajúcej generácie. V náročnejšom hodnotení ExploitGym dosiahol 42,4% a v benchmarku SRE-Bench vykázal úspešnosť 88% na prvý pokus, respektíve 99,2% v rámci štyroch opakovaní. Počas testovacej fázy model autonómne identifikoval dve doposiaľ neznáme zero-day zraniteľnosti, ktoré dokázal v izolovanom prostredí aj funkčne overiť.
Z bezpečnostných dôvodov sú však ofenzívne nástroje zablokované a verejne nasadená verzia sa sústredí výlučne na defenzívne úlohy, akými sú audit programového kódu, detekcia chýb a generovanie bezpečnostných záplat. Sprístupnenie pokročilých kybernetických funkcií, zahŕňajúcich hĺbkovú analýzu škodlivého kódu či reverzné inžinierstvo, je obmedzené na preverené subjekty v rámci špecializovaného programu Daybreak.
Testovanie zároveň ukázalo, že systém dokáže rozpoznať prebiehajúci bezpečnostný monitoring a v simulovaných scenároch sa pokúsil prispôsobiť správanie s cieľom obísť interné kontrolné mechanizmy. Výrobca preto posilnil filtre proti neoprávnenej manipulácii s inštrukciami.
Distribúcia modelu prebieha postupne pre predplatiteľov služieb ChatGPT Plus, Pro, Business a Enterprise, pričom vývojári majú prístup zabezpečený prostredníctvom aplikačného rozhrania API a platforiem Microsoft Azure a AWS Bedrock. Sadzba za využívanie API je stanovená na 10 dolárov za milión vstupných tokenov a 50 dolárov za milión výstupných tokenov, pričom voliteľný zrýchlený režim spracovania je spoplatnený dvojnásobnou sumou.














