OpenAI wypuszcza darmowy, otwarty model offline – GPT-OSS!

OpenAI właśnie udostępniło dwa najnowocześniejsze modele językowe z otwartymi wagami: gpt-oss-120b i gpt-oss-20b. Oba zapewniają wysoką wydajność podczas rzeczywistego wykorzystania przy niskich kosztach i są dostępne na elastycznej licencji Apache 2.0. Modele te osiągają lepsze wyniki niż inne otwarte modele o podobnym rozmiarze w zadaniach rozumowania i charakteryzują się dużymi zdolnościami używania narzędzi. Zostały zoptymalizowane pod kątem efektywnego wdrażania na sprzęcie konsumenckim.

Modele gpt-oss zostały wytrenowane przy użyciu połączenia uczenia przez wzmacnianie oraz technik uwzględniających wnioski z najbardziej zaawansowanych wewnętrznych modeli firmy OpenAI, w tym o3 i innych pionierskich systemów. To pierwsze od czasów GPT-2 modele językowe OpenAI z otwartymi wagami!


Dwa rozmiary, jedna rewolucja

GPT-OSS pojawia się w dwóch wersjach:

  • GPT-OSS 120B – model o 120 miliardach parametrów, osiągający wyniki zbliżone do modelu OpenAI o4-mini w podstawowych testach porównawczych rozumowania, działając wydajnie na jednej karcie graficznej z 80 GB pamięci.
  • GPT-OSS 20B – mniejszy, 20-miliardowy model, który działa szybciej i na słabszym sprzęcie (wystarczy 16 GB VRAM), osiągając wyniki zbliżone do OpenAI o3-mini w popularnych testach porównawczych.

Oba modele są idealne do zastosowań na urządzeniach, lokalnego wnioskowania lub szybkiej iteracji bez drogiej infrastruktury. Oferują bardzo dobre wyniki dotyczące użycia narzędzi, wywoływania funkcji typu few-shot, rozumowania z użyciem łańcucha myśli oraz w testach takich jak HealthBench (lepsze nawet od modeli własnościowych, takich jak OpenAI o1 i GPT-4o).


Nowoczesna architektura i bezpieczeństwo

Każdy model to transformator z mieszanką ekspertów (mixture of experts, MoE), co pozwala na zmniejszenie liczby aktywnych parametrów wymaganych do przetworzenia danych wejściowych. Model gpt-oss-120b aktywuje 5,1 mld parametrów na token, a model gpt-oss-20b – 3,6 mld. Oba obsługują długość kontekstu do 128 tys. tokenów i zostały wytrenowane na wysokiej jakości danych, głównie w języku angielskim, z naciskiem na STEM, programowanie i wiedzę ogólną.

Modele zostały poddane kompleksowemu treningowi bezpieczeństwa i ocenie, a także testom z antagonistyczną konfiguracją precyzyjną zgodnie z Ramami gotowości OpenAI. Wyniki bezpieczeństwa są porównywalne z modelami własnościowymi firmy. Metodologia została zweryfikowana przez zewnętrznych ekspertów, a szczegóły opisano w karcie modelu.


Wydajność i benchmarki

Modele gpt-oss-120b i gpt-oss-20b osiągają lepsze wyniki niż OpenAI o3-mini i dorównują lub przewyższają o4-mini w zadaniach takich jak programowanie (Codeforces), ogólne rozwiązywanie problemów (MMLU, HLE), wywoływanie narzędzi (TauBench), zdrowie (HealthBench) i matematyka konkursowa (AIME 2024/2025). Nawet mniejszy model 20B potrafi przewyższyć większe, zamknięte modele w niektórych testach.


Elastyczność, wdrożenia i dostępność

Modele są zgodne z interfejsem Responses API i zaprojektowane do pracy w agentowych przepływach pracy. Obsługują pełny łańcuch myśli, funkcje Structured Outputs oraz różne poziomy wysiłku rozumowania (niski, średni, wysoki). Można je w pełni dostosować do własnych potrzeb i uruchamiać lokalnie, na urządzeniach brzegowych lub w chmurze.

Wagi modeli są dostępne do bezpłatnego pobrania w serwisie Hugging Face i mają natywną kwantyzację w formacie MXFP4. OpenAI udostępniło także narzędzia i referencyjne implementacje w PyTorch i Apple Metal oraz przykładowe narzędzia dla modelu. Microsoft udostępnia zoptymalizowane wersje gpt-oss-20b dla Windowsa, co ułatwia wdrożenia na tym systemie.


Bezpieczeństwo i odpowiedzialność

OpenAI przywiązuje ogromną wagę do bezpieczeństwa modeli open model. Przeprowadzono zaawansowane testy, w tym konfiguracje precyzyjne pod kątem najgorszego przypadku, a metodologia została zweryfikowana przez niezależnych ekspertów. Firma organizuje także konkurs Red Teaming Challenge z pulą nagród 500 000 USD, by zachęcić społeczność do testowania i poprawy bezpieczeństwa modeli.


Dlaczego to ważne?

Wydanie modeli gpt-oss-120b i gpt-oss-20b to ogromny krok naprzód dla otwartych modeli AI. Obniżają one bariery wejścia dla mniejszych firm, rynków wschodzących i wszystkich, którzy chcą korzystać z zaawansowanej AI bez wysokich kosztów i ograniczeń licencyjnych. Szeroki dostęp do zaawansowanych modeli z otwartymi wagami pozwala budować, eksperymentować i rozwijać innowacje na całym świecie.


Podsumowanie

GPT-OSS to otwarty, darmowy model AI, który możesz uruchomić offline na własnym komputerze. Oferuje wydajność zbliżoną do najlepszych zamkniętych modeli, a przy tym gwarantuje pełną prywatność i swobodę użytkowania. Jeśli interesujesz się AI – koniecznie przetestuj GPT-OSS!


Więcej informacji, dokumentację i wagi modeli znajdziesz na stronie OpenAI oraz w serwisie Hugging Face.

Share:

Zostaw odpowiedź

You May Also Like

OpenAI oficjalnie zaprezentowało GPT-5 dnia 7 sierpnia 2025 roku, wprowadzając na rynek najnowocześniejszy model językowy, który stanowi znaczący krok naprzód...
W dynamicznie rozwijającym się świecie technologii informatycznych nieustannie pojawiają się nowe koncepcje i podejścia, które zmieniają sposób, w jaki tworzymy...
String.com reprezentuje przełomowe podejście do automatyzacji biznesowej, wprowadzając pierwszą na świecie platformę typu „text-to-agent”, która umożliwia tworzenie złożonych agentów AI za pomocą...