Przejdź do treści

GPT-6 Astra – nowa generacja modelu sztucznej inteligencji od OpenAI, tym razem to na pewno AGI, serio

3 minuty czytania

OpenAI prezentuje swój nowy model GPT-6 Astra. Czy tym razem firmie udało się osiągnąć mityczne AGI?

OpenAI ogłosiło właśnie swój najnowszy model sztucznej inteligencjiGPT-6 Astra. Firma określa go jako „przełom pokoleniowy pod względem możliwości” w takich dziedzinach, jak cyberbezpieczeństwo, praca zawodowa, inżynieria oprogramowania, nauka i korzystanie z komputerów. Jak ogłosiła firma OpenAI na początku tego tygodnia, jest to również pierwszy model, który spełnia wyznaczony przez OpenAI „próg krytycznych zdolności w zakresie cyberbezpieczeństwa” — firma zapewnia, że nie doprowadzi to do powtórzenia sytuacji, w której jej modele włamały się do wewnętrznych systemów obcej firmy.

GPT-6 Astra ma nie powtórzyć przygód związanych z włamaniami do wewnętrznych systemów obcych firm

W teście ARC-AGI-3 model Astra przekroczył nasz poziom odniesienia dla wydajności działania człowieka na 96% poziomów, osiągając w praktyce równowartość ludzką w tym teście. Jest to nie tylko najlepszy model, jaki kiedykolwiek testowaliśmy, ale także stanowi znaczący przełom w wydajności modeli pionierskich – nie tylko pod względem zdolności do poruszania się i rozwiązywania zadań w nowych środowiskach, ale także pod względem efektywności, z jaką się tego uczy.

Greg Kamradt, ARC Prize Foundation

OpenAI gorliwie zapewnia, że Astra to model najlepiej dostosowany do wszelkich potrzeb, charakteryzujący się znacznym postępem w zakresie rozumienia intencji użytkownika i zachowania modelu — "możesz powierzać zadania, mając większą pewność co do oceny Astry". Jednym ze sposobów, w jaki nowy model jest testowany przez firmę, było stworzenie nowego testu opartego na incydencie z Hugging Face, który sprawdza, czy model stojący przed trudnym lub niemożliwym do wykonania zadaniem wykroczy poza zamierzony zakres działania. W porównaniu z modelem GPT‑5.6 Sol, który bez zabezpieczeń produkcyjnych wykraczał poza dozwolony zakres w 48% przypadków, model GPT‑6 Astra zrobił to w 0% przypadków.

ExploitGym honeypot (lower is better) by OpenAI
Źródło: OpenAI

Nowy model OpenAI niewątpliwie wiąże się ze znacznym postępem i wieloma ulepszeniami

Zgodnie z zapowiedziami OpenAI, GPT-6 Astra może zająć się żmudnymi zadaniami, takimi jak wypełnianie formularzy internetowych, aktualizowanie danych klientów w systemie CRM oraz porządkowanie kalendarza. Potrafi przeprowadzać wyszukiwania w Internecie i tworzyć streszczenia w wiadomościach e-mail lub w edytorze dokumentów.

Potrafi także analizować dane naukowe, generować wykresy, tworzyć strony internetowe oraz przeprowadzać testy jakości interfejsu użytkownika, aby upewnić się, że wszystkie funkcje na danej stronie działają prawidłowo. Może pomóc w samodzielnej instalacji i testowaniu oprogramowania oraz w rozwiązywaniu problemów widocznych na ekranie. Te ulepszenia znajdują również odzwierciedlenie w wynikach wykonanych przez firmę najnowszych testów porównawczych.

Ulepszenia te przekładają się również na znaczny wzrost wydajności w rzeczywistych zadaniach związanych z pracą opartą na wiedzy. W symulacjach opóźnień przeprowadzonych na zbiorze danych OSWorld 2.0 model Astra osiąga wyższą wydajność w zakresie wykorzystania komputera, wykonując każde zadanie o około 47% szybciej niż model GPT‑5.6 Sol – uzyskując wynik 72,6% w czasie około 40 minut na zadanie, w porównaniu z wynikiem 65,7% osiągniętym w czasie około 75 minut.

Pogoń za AGI trwa – choć brzmi bardziej jak slogan marketingowy

Usługa GPT-6 Astra jest od pewnego czasu udostępniana tylko wybranym organizacjom, a w ciągu najbliższych dni stanie się dostępna dla wszystkich użytkowników planów ChatGPT Plus, Pro, Business i Enterprise, a także za pośrednictwem interfejsu API OpenAI, platformy Microsoft Azure oraz AWS Bedrock. Nowy model z pewnością okaże się zauważalnym ulepszeniem i zadowoli częściej korzystających ze sztucznej inteligencji użytkowników.

Trudno jednak nie unosić lekko brwi patrząc na kolejne próby OpenAI związane z nakręcaniem pościgu za osiągnięciem przez firmę tzw. AGI – Artificial General Intelligence, czyli hipotetycznego rodzaju sztucznej inteligencji, który może dorównać ludzkim zdolnościom lub je przewyższyć w praktycznie wszystkich zadaniach poznawczych. Prezes OpenAI – Greg Brockman – zdaje się być jednak przekonany, że jego firma właśnie przekroczyła tą jeszcze nie do końca zdefiniowaną barierę.

Jeśli przeskoczymy o kilka lat do przodu, a potem spojrzymy wstecz i zapytamy kiedy tak naprawdę powstała AGI, to myślę, że będzie to mniej więcej w tym czasie i sądzę, że może to być właśnie ten model.

Greg Brockman, prezes OpenAI

0 komentarzy

Zostaw komentarz