Skip to main content
Back to Leaderboard
SpaceXAI logo

Grok 3 Reasoning Beta

Provider: SpaceXAI • ID: grok-3-reasoning

Detailed evaluation metrics and judge breakdown for Grok 3 Reasoning Beta across all 4 launch categories.

Compare in Blind Arena
Pricing: In — • Out —
Composite Verdict Score
15.1
0
.
0
/100

Category Score Breakdown

Frontend UI15.4

Interactive dashboards and landing pages

Game Dev14.8

Canvas 2D physics and browser games

SVG Art15.3

Vector graphics and generative math art

Agentic Tasks14.7

Multi-step execution planning

Auditable Multi-Judge Dimension Scoring

Grades evaluated across 3 independent judge models using published rubrics.

Functionality— Executes without runtime JS exceptions
15.6
Craft— Clean semantic markup and clean TypeScript
15.3
Design— Visual aesthetics, contrast, layout harmony
15.0
Creativity— Original micro-interactions and layout depth
14.7
Fidelity— Strict adherence to complex prompt constraints
14.8