Wyniki testów
Wyniki testów i metodologia.
Jak ChatGPT-6 wypada na tle obecnej czołówki — pełna tabela, zastrzeżenia dotyczące każdej liczby i dokładny opis tego, jak ją opracowaliśmy.
Ostatnia aktualizacja: wrzesień 2026
Większość tabel porównawczych podaje werdykt bez dowodów. Ta pokazuje liczby, a następnie wyjaśnia, skąd pochodzą, czego nie można się z nich dowiedzieć i dlaczego bezpłatny podgląd zmienia rachunek.
ChatGPT-6 jest wersją testową z wczesnym dostępem, więc traktuj jego wyniki jako orientacyjne, a nie ostateczne — uczciwy sposób odczytania tej strony to „jakość klasy modeli frontier w cenie, której nie może dorównać żaden dostępny na rynku model”.
Pełna tabela
Dziewięć wymiarów, pięć modeli, jedna kolumna bez opłat.
| Metric | ChatGPT-6 | GPT-5.6 | Opus 5 | Gemini 3.7 | Grok 4.6 |
|---|---|---|---|---|---|
| Indeks inteligencji | 71* | 67 | 68 | 66 | 65 |
| Kodowanie agentowe | 86* | 84 | 82 | 78 | 76 |
| Okno kontekstu | 400K | 400K | 1M | 2M | 500K |
| Maks. długość wyjścia | 128K | 128K | 64K | 64K | 64K |
| Przepustowość (tps) | 58* | 70 | 55 | 92 | 120 |
| Cena / 1M tokenów wyjściowych | $0 | $10 | $25 | $10 | $6 |
| Multimodalność | |||||
| Otwarte wagi | |||||
| Bezpłatne użycie |
Łączny wynik dla benchmarków rozumowania, wiedzy i matematyki (wyższy wynik jest lepszy).
Orientacyjny wynik kodowania agentowego — rzeczywiste zadania wieloplikowe z użyciem narzędzi (wyższy wynik jest lepszy).
Maksymalna liczba tokenów, na które model może zwracać uwagę w ramach jednej rozmowy.
Najdłuższa odpowiedź, jaką model wygeneruje w jednym wywołaniu.
Mediana szybkości generowania w tokenach na sekundę (wyższa wartość oznacza większą szybkość).
Cena katalogowa za milion tokenów wyjściowych (im niższa, tym taniej).
Obsługuje obrazy wraz z tekstem.
Wagi można pobrać i uruchomić na własnej infrastrukturze.
Obecnie można używać bezpłatnie.
Bezpośrednie porównanie
Chcesz skoncentrowanego porównania jeden na jeden? Wybierz zestawienie.
Metodologia
Indeks inteligencji to złożony wskaźnik oparty na publicznych testach rozumowania, wiedzy i matematyki, inspirowany indeksem Artificial Analysis Intelligence Index. Kodowanie agentowe odzwierciedla rzeczywiste zadania obejmujące wiele plików, wykonywane za pomocą narzędzi, a nie odizolowane fragmenty kodu.
Okno kontekstowe, maksymalna długość odpowiedzi, przepustowość i cena to dane podane przez dostawców. Cena to stawka katalogowa za milion tokenów wyjściowych; tokeny wejściowe są zwykle tańsze i pominięto je, aby tabela była czytelniejsza.
ChatGPT-6 jest dostępny we wczesnej wersji testowej, dlatego jego dane (oznaczone symbolem *) są szacunkami zgłoszonymi przez społeczność, a nie kartą specyfikacji dostawcy. Będą się zmieniać w miarę dostrajania modelu — odświeżamy tę stronę, gdy pojawiają się lepsze dane.
Liczby szybko się zmieniają. Traktuj to jako ogólny przewodnik przy wyborze modelu, a nie oficjalny ranking wyników testów porównawczych. W razie wątpliwości przeprowadź własną ewaluację na własnych promptach.
Przekonaj się
Liczby to jedno. Zleć ChatGPT-6 rzeczywiste zadanie i oceń wynik.