Winner

GPT-6.1 Sol Low

UX · October 9, 2026 · Difficulty: High

Final combined results in supplied rank order. Tied ranks remain tied.
ResultRank 1GPT-6.1 Sol LowRank 2GPT-6 Astra MediumRank 3GPT-6 Luna LowRank 4Composer 2.5 DefaultRank 5Grok 4.7 Extra HighRank 6Grok 4.7 Medium
Combined score84.1483.3176.8675.2870.3869.98
Judge
Judge score /10090.0090.0077.0080.0077.5076.50
Correctness /10998877
Coverage /109968109
Evidence /10999877
Actionability /10998878
Time47.15 s73.73 s6.59 s61.9 s533.68 s259.13 s
Estimated USD$0.137562$0.72789$0.0063873$0.0507535$0.386444$0.253236

Cost estimates are reference estimates, not billed charges.

Judge score uses recorded rubric metrics; final rank uses the combined score.

Component points
Final combined results in supplied rank order. Tied ranks remain tied.
ResultRank 1 GPT-6.1 Sol LowRank 2 GPT-6 Astra MediumRank 3 GPT-6 Luna LowRank 4 Composer 2.5 DefaultRank 5 Grok 4.7 Extra HighRank 6 Grok 4.7 Medium
Quality points818169.37269.7568.85
Test points000000
Speed points2.79992.24344.50492.4610.50530.94
Cost points0.33880.06783.05110.8230.12610.1899

Swipe, scroll or use Previous and More to compare configurations. Row labels stay visible.

Advanced results and scoring details

ux · 2026-10-09T08:50:38.375Z · Prospective evaluation. Equal transport and native system conditions are unverified.

Applied weights: quality 90%, tests 0%, speed 5%, cost 5%.

Displayed scores are rounded; pairwise outcomes use exact recorded fractions. Reference costs are estimates, not billed charges. Missing components follow the recorded assessment.

Pairwise results

  • GPT-6 Astra Medium vs GPT-6.1 Sol Low: Second configuration wins
  • GPT-6 Astra Medium vs Composer 2.5 Default: First configuration wins
  • GPT-6 Astra Medium vs Grok 4.7 Extra High: First configuration wins
  • GPT-6 Astra Medium vs Grok 4.7 Medium: First configuration wins
  • GPT-6 Astra Medium vs GPT-6 Luna Low: First configuration wins
  • GPT-6.1 Sol Low vs Composer 2.5 Default: First configuration wins
  • GPT-6.1 Sol Low vs Grok 4.7 Extra High: First configuration wins
  • GPT-6.1 Sol Low vs Grok 4.7 Medium: First configuration wins
  • GPT-6.1 Sol Low vs GPT-6 Luna Low: First configuration wins
  • Composer 2.5 Default vs Grok 4.7 Extra High: First configuration wins
  • Composer 2.5 Default vs Grok 4.7 Medium: First configuration wins
  • Composer 2.5 Default vs GPT-6 Luna Low: Second configuration wins
  • Grok 4.7 Extra High vs Grok 4.7 Medium: First configuration wins
  • Grok 4.7 Extra High vs GPT-6 Luna Low: Second configuration wins
  • Grok 4.7 Medium vs GPT-6 Luna Low: Second configuration wins