simpleHTML bench StatExplorer
260 wyników
simpleHTML bench · porównywarka

Pojedynek modeli

Wybierz dwa warianty i przeglądaj wyniki slajd po slajdzie. Mapa, ranking i tabela obejmują też pozostałe wybrane modele.

Modele na mapie, w rankingu i tabeli

Poziomy rozumowania i drogi dostępu

← → slajdy · R powtórz animację · Esc wyjście
Dane szczegółowePrzewijaj poziomo, aby zobaczyć kolejne warianty →

Wybierz test

—
Prędkość odpowiedzi
0.0t/s
Czas generacji
0.0s
Tokeny wyjściowe
0out
Reasoning
—
Linie kodu
—LOC
Koszt (cennik API)
$0.00
Ładowanie sceny…
Prompt, parametry i recenzja Luny Rozwiń
Prompt:
—
Środowisko: —
Tryb: Single-Shot CodePen/HTML
Data: —
Gotowe zestawy porównań
Zadanie po zadaniu
Model A — / 10 0 t/s 0s
Model B — / 10 0 t/s 0s
Szczegółowe dane i różnice oceny · tokeny · koszt · infrastruktura
Prędkość—
Czas generacji—
Linie kodu—
Różnica kosztu—
Parametr Metryki Model A Model B
Ranking modeli · oceny GPT-6 Luna Codex CLI · reasoning max

RANK Model / Dostawca Reasoning Ocena Luny 010203 040506 070809 1011 Koszt łączny
Punkty za dolara punkty ÷ koszt na test
# Model & Dostawca Reasoning Ocena Luny Koszt łączny Punkty / $1 na test Ocenione Łączny czas Wartość (skala)
Telemetria wszystkich wyników surowe dane z runnerów
# Model & Dostawca Reasoning Effort Zadanie / Prompt Prędkość (TPS) Czas Kod (LOC) Tokeny (In/Out/Reason) Koszt Akcje
Koszt, czas generacji i tokeny wyjściowe —
Grupuj
Miara

Koszt

tańsze wyżej

Według cennika API. Przy trasach z subskrypcji (Claude Code, Codex, OpenCode Go) to ekwiwalent, a nie realny wydatek.

Czas generacji

szybsze wyżej

Czas od wysłania promptu do pełnej odpowiedzi (z reasoningiem).

Tokeny wyjściowe

najwięcej wyżej

Tokeny odpowiedzi; bez tokenów reasoningu, które są w tabeli niżej.

Tabela porównawcza klik w nagłówek sortuje