GPT-5 (ChatGPT)
Provider: OpenAI • ID: gpt-5-chatgpt
Detailed evaluation metrics and judge breakdown for GPT-5 (ChatGPT) across all 4 launch categories.
Compare in Blind Arena
Pricing: In — • Out —
Composite Verdict Score/100
15.3
0
.0
Category Score Breakdown
Frontend UI15.6
Interactive dashboards and landing pages
Game Dev15.0
Canvas 2D physics and browser games
SVG Art15.5
Vector graphics and generative math art
Agentic Tasks14.8
Multi-step execution planning
Auditable Multi-Judge Dimension Scoring
Grades evaluated across 3 independent judge models using published rubrics.
Functionality— Executes without runtime JS exceptions
15.8
Craft— Clean semantic markup and clean TypeScript
15.5
Design— Visual aesthetics, contrast, layout harmony
15.1
Creativity— Original micro-interactions and layout depth
14.8
Fidelity— Strict adherence to complex prompt constraints
15.0