Wróć do laboratorium

JEVLAB NEWS Research & data

OpenAI wprowadza modele GPT-6 Sol i Luna

AI-assisted summaries and translations. Check original sources for context and performance claims.

OpenAI zaprezentowało modele GPT-6 Sol i Luna, oferujące obniżkę cen API o połowę względem poprzedników. Nowe jednostki kładą nacisk na lepsze dostosowanie (alignment) oraz wyższą efektywność kosztową w zadaniach automatyzacji.

Przetłumaczone podsumowanie · AI-assisted; check the original.

Otwórz oryginał

Cały wątek w skrócie

Własne podsumowania powiązanych wpisów CHOI z pomocą AI. Zdjęcia i filmy należą do ich twórców. Twierdzenia źródła nie zostały niezależnie zweryfikowane.

  1. Premiera nowych modeli
  2. Specyfikacja i ceny
  3. Historia obniżek cen
  4. Automatyzacja zadań
  5. Wydajność w programowaniu
  6. Obsługa komputera i fakty
  7. Niezależne oceny
  8. Jakość odpowiedzi
  9. Poprawa dostosowania
  10. Caching promptów
  11. Konkurencja rynkowa
  12. Modele open-weight
  13. Źródło

Premiera nowych modeli

OpenAI wprowadziło średnie i małe modele GPT-6 Sol i Luna, wyszkolone przy użyciu metodologii Astra. Ceny API stanowią połowę kosztów serii GPT-5.6.

@choi.openai · Oryginalny wpis ↗

Specyfikacja i ceny

Sol i Luna przenoszą usprawnienia z modelu Astra do tańszej i szybszej architektury. Ceny za milion tokenów wynoszą odpowiednio 2/10 USD dla Sol oraz 0,1/0,5 USD dla Luna.

Specyfikacja i ceny
@choi.openai · Oryginalny wpis ↗

Historia obniżek cen

To trzecia obniżka w ciągu trzech miesięcy. Cena wejściowa modelu Luna jest obecnie dziesięciokrotnie niższa niż trzy miesiące temu, a Sol cenowo dorównuje Claude Sonnet 5.

Automatyzacja zadań

Według Choi, GPT-6 Sol przewyższa Opus 5 w testach automatyzacji przy znacznie niższych kosztach. W teście Agents' Last Exam, Sol osiągnął lepsze wyniki niż Opus 5 przy 60% niższym koszcie.

Automatyzacja zadań
@choi.openai · Oryginalny wpis ↗
Automatyzacja zadań
@choi.openai · Oryginalny wpis ↗

Wydajność w programowaniu

W zadaniach programistycznych Sol i Luna oferują znacznie lepszy stosunek wydajności do ceny. Choć wyniki maksymalne są zbliżone do poprzedników, efektywność przy tym samym budżecie wzrosła.

Wydajność w programowaniu
@choi.openai · Oryginalny wpis ↗
Wydajność w programowaniu
@choi.openai · Oryginalny wpis ↗

Obsługa komputera i fakty

Sol osiąga wyniki równe Claude Opus 5 w teście OSWorld 2.0 przy 80% niższym koszcie. Wskaźniki błędów zostały zredukowane o połowę względem poprzedniej generacji.

Obsługa komputera i fakty
@choi.openai · Oryginalny wpis ↗
Obsługa komputera i fakty
@choi.openai · Oryginalny wpis ↗

Niezależne oceny

Artificial Analysis wskazuje, że OpenAI umocniło swoją pozycję w efektywności kosztowej. Mimo większego zużycia tokenów na zadanie, całkowite koszty operacyjne znacząco spadły.

Niezależne oceny
@choi.openai · Oryginalny wpis ↗
Niezależne oceny
@choi.openai · Oryginalny wpis ↗

Jakość odpowiedzi

Modele stały się bardziej zwięzłe, co sprzyja programowaniu, ale obniża oceny w zadaniach dokumentacyjnych. Wskaźniki halucynacji uległy ogólnej poprawie.

Jakość odpowiedzi
@choi.openai · Oryginalny wpis ↗
Jakość odpowiedzi
@choi.openai · Oryginalny wpis ↗

Poprawa dostosowania

Dzięki szkoleniu z modelu Astra, nowe modele rzadziej podają fałszywe informacje i skuteczniej blokują próby obejścia zabezpieczeń. Poprawa w testach bezpieczeństwa jest znacząca.

Poprawa dostosowania
@choi.openai · Oryginalny wpis ↗

Caching promptów

Usprawnienia w cache'owaniu promptów drastycznie obniżają koszty dla agentów AI wykonujących powtarzalne zadania. Pozwala to na dwukrotne wydłużenie czasu pracy w tym samym budżecie.

@choi.openai · Oryginalny wpis ↗

Konkurencja rynkowa

W odpowiedzi na ruch Anthropic z modelem Opus 5.5, OpenAI obniżyło ceny o 50%. Ceny modeli granicznych spadły obecnie poniżej połowy wartości sprzed trzech miesięcy.

Modele open-weight

Choć modele open-weight pozostają tańsze w utrzymaniu, Sol i Luna stanowią silną konkurencję dla firm korzystających z API. Zarządzanie własną infrastrukturą staje się mniej opłacalne.

Źródło

Szczegółowe informacje na temat premiery GPT-6 Sol i Luna znajdują się na oficjalnej stronie OpenAI.

Source notes

This is a linked resource, not an independent verification of performance, cost or results. Check the original for current details.

Collected
2026-09-23
Discovered via
www.threads.com

Top 10

Supporter

  1. Wallpets
  2. Walltank
  3. Chowder
  4. Falconer
  5. Lemonpod
  6. Menta
  7. Sway
  8. Peon-Ping
  9. Zeron
  10. Guideless
Supporters