Wyniki testów

Wyniki testów i metodologia.

Jak ChatGPT-6 wypada na tle obecnej czołówki — pełna tabela, zastrzeżenia dotyczące każdej liczby i dokładny opis tego, jak ją opracowaliśmy.

Ostatnia aktualizacja: wrzesień 2026

Większość tabel porównawczych podaje werdykt bez dowodów. Ta pokazuje liczby, a następnie wyjaśnia, skąd pochodzą, czego nie można się z nich dowiedzieć i dlaczego bezpłatny podgląd zmienia rachunek.

ChatGPT-6 jest wersją testową z wczesnym dostępem, więc traktuj jego wyniki jako orientacyjne, a nie ostateczne — uczciwy sposób odczytania tej strony to „jakość klasy modeli frontier w cenie, której nie może dorównać żaden dostępny na rynku model”.

Pełna tabela

Dziewięć wymiarów, pięć modeli, jedna kolumna bez opłat.

Metric
ChatGPT-6
GPT-5.6
Opus 5
Gemini 3.7
Grok 4.6
Indeks inteligencji71*67686665
Kodowanie agentowe86*84827876
Okno kontekstu400K400K1M2M500K
Maks. długość wyjścia128K128K64K64K64K
Przepustowość (tps)58*705592120
Cena / 1M tokenów wyjściowych$0$10$25$10$6
Multimodalność
Otwarte wagi
Bezpłatne użycie
Indeks inteligencji

Łączny wynik dla benchmarków rozumowania, wiedzy i matematyki (wyższy wynik jest lepszy).

Kodowanie agentowe

Orientacyjny wynik kodowania agentowego — rzeczywiste zadania wieloplikowe z użyciem narzędzi (wyższy wynik jest lepszy).

Okno kontekstu

Maksymalna liczba tokenów, na które model może zwracać uwagę w ramach jednej rozmowy.

Maks. długość wyjścia

Najdłuższa odpowiedź, jaką model wygeneruje w jednym wywołaniu.

Przepustowość (tps)

Mediana szybkości generowania w tokenach na sekundę (wyższa wartość oznacza większą szybkość).

Cena / 1M tokenów wyjściowych

Cena katalogowa za milion tokenów wyjściowych (im niższa, tym taniej).

Multimodalność

Obsługuje obrazy wraz z tekstem.

Otwarte wagi

Wagi można pobrać i uruchomić na własnej infrastrukturze.

Bezpłatne użycie

Obecnie można używać bezpłatnie.

Metodologia

Indeks inteligencji to złożony wskaźnik oparty na publicznych testach rozumowania, wiedzy i matematyki, inspirowany indeksem Artificial Analysis Intelligence Index. Kodowanie agentowe odzwierciedla rzeczywiste zadania obejmujące wiele plików, wykonywane za pomocą narzędzi, a nie odizolowane fragmenty kodu.

Okno kontekstowe, maksymalna długość odpowiedzi, przepustowość i cena to dane podane przez dostawców. Cena to stawka katalogowa za milion tokenów wyjściowych; tokeny wejściowe są zwykle tańsze i pominięto je, aby tabela była czytelniejsza.

ChatGPT-6 jest dostępny we wczesnej wersji testowej, dlatego jego dane (oznaczone symbolem *) są szacunkami zgłoszonymi przez społeczność, a nie kartą specyfikacji dostawcy. Będą się zmieniać w miarę dostrajania modelu — odświeżamy tę stronę, gdy pojawiają się lepsze dane.

Liczby szybko się zmieniają. Traktuj to jako ogólny przewodnik przy wyborze modelu, a nie oficjalny ranking wyników testów porównawczych. W razie wątpliwości przeprowadź własną ewaluację na własnych promptach.

Przekonaj się

Liczby to jedno. Zleć ChatGPT-6 rzeczywiste zadanie i oceń wynik.

Otwórz czat