Grok 3 mini Reasoning (high)
Provider: SpaceXAI • ID: grok-3-mini-reasoning
Detailed evaluation metrics and judge breakdown for Grok 3 mini Reasoning (high) across all 4 launch categories.
Compare in Blind Arena
Pricing: In $0.30 per 1M tokens • Out $0.50 per 1M tokens
Composite Verdict Score/100
22.5
0
.0
Category Score Breakdown
Frontend UI22.9
Interactive dashboards and landing pages
Game Dev22.1
Canvas 2D physics and browser games
SVG Art22.7
Vector graphics and generative math art
Agentic Tasks21.8
Multi-step execution planning
Auditable Multi-Judge Dimension Scoring
Grades evaluated across 3 independent judge models using published rubrics.
Functionality— Executes without runtime JS exceptions
23.2
Craft— Clean semantic markup and clean TypeScript
22.7
Design— Visual aesthetics, contrast, layout harmony
22.3
Creativity— Original micro-interactions and layout depth
21.8
Fidelity— Strict adherence to complex prompt constraints
22.1