OpenAI właśnie udostępniło dwa najnowocześniejsze modele językowe z otwartymi wagami: gpt-oss-120b i gpt-oss-20b. Oba zapewniają wysoką wydajność podczas rzeczywistego wykorzystania przy niskich kosztach i są dostępne na elastycznej licencji Apache 2.0. Modele te osiągają lepsze wyniki niż inne otwarte modele o podobnym rozmiarze w zadaniach rozumowania i charakteryzują się dużymi zdolnościami używania narzędzi. Zostały zoptymalizowane pod kątem efektywnego wdrażania na sprzęcie konsumenckim.
Modele gpt-oss zostały wytrenowane przy użyciu połączenia uczenia przez wzmacnianie oraz technik uwzględniających wnioski z najbardziej zaawansowanych wewnętrznych modeli firmy OpenAI, w tym o3 i innych pionierskich systemów. To pierwsze od czasów GPT-2 modele językowe OpenAI z otwartymi wagami!
Dwa rozmiary, jedna rewolucja
GPT-OSS pojawia się w dwóch wersjach:
- GPT-OSS 120B – model o 120 miliardach parametrów, osiągający wyniki zbliżone do modelu OpenAI o4-mini w podstawowych testach porównawczych rozumowania, działając wydajnie na jednej karcie graficznej z 80 GB pamięci.
- GPT-OSS 20B – mniejszy, 20-miliardowy model, który działa szybciej i na słabszym sprzęcie (wystarczy 16 GB VRAM), osiągając wyniki zbliżone do OpenAI o3-mini w popularnych testach porównawczych.
Oba modele są idealne do zastosowań na urządzeniach, lokalnego wnioskowania lub szybkiej iteracji bez drogiej infrastruktury. Oferują bardzo dobre wyniki dotyczące użycia narzędzi, wywoływania funkcji typu few-shot, rozumowania z użyciem łańcucha myśli oraz w testach takich jak HealthBench (lepsze nawet od modeli własnościowych, takich jak OpenAI o1 i GPT-4o).
Nowoczesna architektura i bezpieczeństwo
Każdy model to transformator z mieszanką ekspertów (mixture of experts, MoE), co pozwala na zmniejszenie liczby aktywnych parametrów wymaganych do przetworzenia danych wejściowych. Model gpt-oss-120b aktywuje 5,1 mld parametrów na token, a model gpt-oss-20b – 3,6 mld. Oba obsługują długość kontekstu do 128 tys. tokenów i zostały wytrenowane na wysokiej jakości danych, głównie w języku angielskim, z naciskiem na STEM, programowanie i wiedzę ogólną.
Modele zostały poddane kompleksowemu treningowi bezpieczeństwa i ocenie, a także testom z antagonistyczną konfiguracją precyzyjną zgodnie z Ramami gotowości OpenAI. Wyniki bezpieczeństwa są porównywalne z modelami własnościowymi firmy. Metodologia została zweryfikowana przez zewnętrznych ekspertów, a szczegóły opisano w karcie modelu.
Wydajność i benchmarki
Modele gpt-oss-120b i gpt-oss-20b osiągają lepsze wyniki niż OpenAI o3-mini i dorównują lub przewyższają o4-mini w zadaniach takich jak programowanie (Codeforces), ogólne rozwiązywanie problemów (MMLU, HLE), wywoływanie narzędzi (TauBench), zdrowie (HealthBench) i matematyka konkursowa (AIME 2024/2025). Nawet mniejszy model 20B potrafi przewyższyć większe, zamknięte modele w niektórych testach.
Elastyczność, wdrożenia i dostępność
Modele są zgodne z interfejsem Responses API i zaprojektowane do pracy w agentowych przepływach pracy. Obsługują pełny łańcuch myśli, funkcje Structured Outputs oraz różne poziomy wysiłku rozumowania (niski, średni, wysoki). Można je w pełni dostosować do własnych potrzeb i uruchamiać lokalnie, na urządzeniach brzegowych lub w chmurze.
Wagi modeli są dostępne do bezpłatnego pobrania w serwisie Hugging Face i mają natywną kwantyzację w formacie MXFP4. OpenAI udostępniło także narzędzia i referencyjne implementacje w PyTorch i Apple Metal oraz przykładowe narzędzia dla modelu. Microsoft udostępnia zoptymalizowane wersje gpt-oss-20b dla Windowsa, co ułatwia wdrożenia na tym systemie.
Bezpieczeństwo i odpowiedzialność
OpenAI przywiązuje ogromną wagę do bezpieczeństwa modeli open model. Przeprowadzono zaawansowane testy, w tym konfiguracje precyzyjne pod kątem najgorszego przypadku, a metodologia została zweryfikowana przez niezależnych ekspertów. Firma organizuje także konkurs Red Teaming Challenge z pulą nagród 500 000 USD, by zachęcić społeczność do testowania i poprawy bezpieczeństwa modeli.
Dlaczego to ważne?
Wydanie modeli gpt-oss-120b i gpt-oss-20b to ogromny krok naprzód dla otwartych modeli AI. Obniżają one bariery wejścia dla mniejszych firm, rynków wschodzących i wszystkich, którzy chcą korzystać z zaawansowanej AI bez wysokich kosztów i ograniczeń licencyjnych. Szeroki dostęp do zaawansowanych modeli z otwartymi wagami pozwala budować, eksperymentować i rozwijać innowacje na całym świecie.
Podsumowanie
GPT-OSS to otwarty, darmowy model AI, który możesz uruchomić offline na własnym komputerze. Oferuje wydajność zbliżoną do najlepszych zamkniętych modeli, a przy tym gwarantuje pełną prywatność i swobodę użytkowania. Jeśli interesujesz się AI – koniecznie przetestuj GPT-OSS!
Więcej informacji, dokumentację i wagi modeli znajdziesz na stronie OpenAI oraz w serwisie Hugging Face.
