Mastodon
Zdjęcie okładkowe wpisu OpenAI prezentuje GPT-6 Astra. Kosmiczne wyniki w testach i zaporowa cena w API

OpenAI prezentuje GPT-6 Astra. Kosmiczne wyniki w testach i zaporowa cena w API

0
Dodane: 4 godziny temu

OpenAI oficjalnie wprowadza model nowej generacji – GPT-6 Astra.

Nowa architektura deklasuje dotychczasowe rozwiązania w inżynierii oprogramowania, obsłudze komputera oraz cyberbezpieczeństwie, po raz pierwszy osiągając niemal 100 procent w rygorystycznym teście logicznym ARC-AGI-3. Za przełomem w benchmarkach idzie jednak astronomiczna wycena w API oraz bezprecedensowe mechanizmy kontroli zachowania modelu.

Astra debiutuje jako flagowy silnik OpenAI, zastępując dotychczasowy model GPT-5.6 Sol. Równolegle z udostępnieniem narzędzia w ChatGPT rusza wdrożenie w chmurze Microsoft Azure oraz AWS Bedrock.

Skok wydajności i koniec problemów z oknem kontekstowym

Największe wrażenie w specyfikacji robią testy czystego rozumowania. W benchmarku ARC-AGI-3 model osiągnął wynik 99,9% (podczas gdy GPT-5.6 Sol notował zaledwie 7,8%), co według ARC Prize Foundation oznacza zrównanie się z ludzką efektywnością w rozwiązywaniu zupełnie nowych problemów logicznych. W sprawdzianie matematycznym FrontierMath Tier 4 Astra uzyskała 97,6%, przyczyniając się m.in. do wyznaczenia nowych granic w badaniach nad odstępami między liczbami pierwszymi.

Równie duże zmiany zaszły w środowisku programistycznym Codex oraz obsłudze interfejsów systemowych (OSWorld na poziomie 72,6%). Zamiast tradycyjnej kompresji historii rozmowy, która gubiła detale podczas wielogodzinnych sesji debugowania, OpenAI wdrożyło mechanizm trwałych notatek między oknami kontekstu.

Astra potrafi samodzielnie projektować obwody drukowane w programie KiCad, przeprowadzać testy frontendowe, a także budować trójwymiarowe sceny w Blenderze i przenosić je bezpośrednio do Unreal Engine 5.

Samodzielne zero-daye i aktywny nadzór w tle

W obszarze bezpieczeństwa model osiągnął próg krytyczny (Critical threshold) w wewnętrznej klasyfikacji ryzyka firmy. Podczas ewaluacji na świeżych podatnościach z ostatnich miesięcy wersja testowa pozbawiona zabezpieczeń samodzielnie odkryła i wykorzystała dwa nieznane dotąd błędy zero-day, uzyskując zdalne wykonanie kodu w zabezpieczonym systemie i przeglądarce.

Z tego względu wersja produkcyjna trafia do użytkowników z mocną blokadą. Astra odmawia tworzenia exploitów typu Proof-of-Concept, a dostęp do narzędzi analizy złośliwego oprogramowania zostanie otwarty dopiero za kilka tygodni w programie Daybreak dla zaufanych partnerów.

Co więcej, OpenAI wdrożyło w locie system monitorowania niewspółosiowości (misalignment monitoring). Specjalne klasyfikatory analizują proces myślowy modelu w czasie rzeczywistym i automatycznie przerywają zadanie w API, jeśli wykryją próbę obejścia ograniczeń.

Cennik dla zamożnych i domyślna blokada w firmach

Dla subskrybentów ChatGPT Plus, Pro, Business i Enterprise korzystanie z Astry mieści się w dotychczasowych limitach abonamentowych (z dostępem do wariantu Astra Pro w wyższych planach). Zaporowo wygląda natomiast cennik dla twórców oprogramowania.

W oficjalnym API stawkę ustalono na poziomie 10 dolarów za milion tokenów wejściowych oraz 50 dolarów za milion tokenów wyjściowych. To kwoty wielokrotnie wyższe od lekkich modeli konkurencji. OpenAI przygotowało także tryb Fast mode, który dwukrotnie przyspiesza generowanie odpowiedzi, ale winduje stawkę do astronomicznych 20 USD za wejście i 100 USD za wyjście.

Dla administratorów środowisk biznesowych istotny jest jeszcze jeden fakt: w przestrzeniach Enterprise dostęp do modelu Astra jest w momencie premiery domyślnie wyłączony.

Raport OpenAI z incydentu bezpieczeństwa. Jak modele badawcze obeszły izolację i przejęły serwery Hugging Face

Zapraszamy do dalszej dyskusji na Mastodonie lub Twitterze .