Winner

Grok 4.7 High

Quality · October 8, 2026 · Difficulty: Medium

Final combined results in supplied rank order. Tied ranks remain tied.
ResultRank 1Grok 4.7 HighRank 2GPT-6.1 Sol LowRank 3GPT-6.1 Sol HighRank 4Composer 2.5 DefaultRank 5Grok 4.7 LowRank 6GPT-6 Luna LowRank 7DeepSeek Flash N/ARank 8GPT-6 Luna Extra High
Combined score90.4183.0781.9570.5969.4668.0366.6665.86
Judge rank12254776
Judge score /100100.0087.5087.5073.5076.0066.0066.0068.00
Time1,370.56 s32.81 s70.5 s42.84 s475.71 s9.53 s11.86 s215.64 s
Estimated USD$0.238312$0.036052$0.045302$0.022827$0.089422$0.0015788$0.0062226$0.0039928

Estimated reference costs are not billed charges. Judge rank is derived from recorded rubric metrics across judged configurations; final rank uses the combined score.

Component points
Final combined results in supplied rank order. Tied ranks remain tied.
ResultRank 1 Grok 4.7 HighRank 2 GPT-6.1 Sol LowRank 3 GPT-6.1 Sol HighRank 4 Composer 2.5 DefaultRank 5 Grok 4.7 LowRank 6 GPT-6 Luna LowRank 7 DeepSeek Flash N/ARank 8 GPT-6 Luna Extra High
Quality points9078.7578.7566.1568.459.459.461.2
Test points00000000
Speed points0.20973.23252.29892.91730.564.3154.17481.0884
Cost points0.20141.08570.90411.52310.50294.31823.08213.5733

Swipe, scroll or use Previous and More to compare configurations. Row labels stay visible.

Advanced results and scoring details

quality · 2026-10-08T21:52:01.226Z · Prospective evaluation. Equal transport and native system conditions are unverified.

Applied weights: quality 90%, tests 0%, speed 5%, cost 5%.

Displayed scores are rounded; pairwise outcomes use exact recorded fractions. Reference costs are estimates, not billed charges. Missing components follow the recorded assessment.

Pairwise results

  • GPT-6 Luna Low vs Grok 4.7 Low: Second configuration wins
  • GPT-6 Luna Low vs GPT-6.1 Sol High: Second configuration wins
  • GPT-6 Luna Low vs GPT-6.1 Sol Low: Second configuration wins
  • GPT-6 Luna Low vs Grok 4.7 High: Second configuration wins
  • GPT-6 Luna Low vs GPT-6 Luna Extra High: First configuration wins
  • GPT-6 Luna Low vs DeepSeek Flash N/A: First configuration wins
  • GPT-6 Luna Low vs Composer 2.5 Default: Second configuration wins
  • Grok 4.7 Low vs GPT-6.1 Sol High: Second configuration wins
  • Grok 4.7 Low vs GPT-6.1 Sol Low: Second configuration wins
  • Grok 4.7 Low vs Grok 4.7 High: Second configuration wins
  • Grok 4.7 Low vs GPT-6 Luna Extra High: First configuration wins
  • Grok 4.7 Low vs DeepSeek Flash N/A: First configuration wins
  • Grok 4.7 Low vs Composer 2.5 Default: Second configuration wins
  • GPT-6.1 Sol High vs GPT-6.1 Sol Low: Second configuration wins
  • GPT-6.1 Sol High vs Grok 4.7 High: Second configuration wins
  • GPT-6.1 Sol High vs GPT-6 Luna Extra High: First configuration wins
  • GPT-6.1 Sol High vs DeepSeek Flash N/A: First configuration wins
  • GPT-6.1 Sol High vs Composer 2.5 Default: First configuration wins
  • GPT-6.1 Sol Low vs Grok 4.7 High: Second configuration wins
  • GPT-6.1 Sol Low vs GPT-6 Luna Extra High: First configuration wins
  • GPT-6.1 Sol Low vs DeepSeek Flash N/A: First configuration wins
  • GPT-6.1 Sol Low vs Composer 2.5 Default: First configuration wins
  • Grok 4.7 High vs GPT-6 Luna Extra High: First configuration wins
  • Grok 4.7 High vs DeepSeek Flash N/A: First configuration wins
  • Grok 4.7 High vs Composer 2.5 Default: First configuration wins
  • GPT-6 Luna Extra High vs DeepSeek Flash N/A: Second configuration wins
  • GPT-6 Luna Extra High vs Composer 2.5 Default: Second configuration wins
  • DeepSeek Flash N/A vs Composer 2.5 Default: Second configuration wins