Winner

Grok 4.7 High

Product · October 8, 2026 · Difficulty: Medium

Final combined results in supplied rank order. Tied ranks remain tied.
ResultRank 1Grok 4.7 HighRank 2Grok 4.7 LowRank 3Composer 2.5 DefaultRank 4GPT-6.1 Sol LowRank 5GPT-6 Luna Extra HighRank 6GPT-6 Luna LowRank 7DeepSeek Flash N/ARank 8GPT-6.1 Sol High
Combined score87.8185.7884.6183.0181.9172.8072.0169.14
Judge rank12345678
Judge score /10092.5090.0086.0084.0083.5072.0071.5070.50
Time1,692.95 s556.84 s40.59 s32.1 s52.73 s8.87 s13.95 s74.35 s
Estimated USDN/AN/AN/AN/AN/AN/AN/AN/A

Estimated reference costs are not billed charges. Judge rank is derived from recorded rubric metrics across judged configurations; final rank uses the combined score.

Component points
Final combined results in supplied rank order. Tied ranks remain tied.
ResultRank 1 Grok 4.7 HighRank 2 Grok 4.7 LowRank 3 Composer 2.5 DefaultRank 4 GPT-6.1 Sol LowRank 5 GPT-6 Luna Extra HighRank 6 GPT-6 Luna LowRank 7 DeepSeek Flash N/ARank 8 GPT-6.1 Sol High
Quality points87.631685.263281.473779.578979.105368.210567.736866.7895
Test points00000000
Speed points0.18010.51193.13953.42862.80124.58564.27042.3506
Cost points00000000

Swipe, scroll or use Previous and More to compare configurations. Row labels stay visible.

Advanced results and scoring details

product · 2026-10-08T21:29:48.064Z · Prospective evaluation. Equal transport and native system conditions are unverified.

Applied weights: quality 94.7368%, tests 0%, speed 5.2632%, cost 0%.

Cost was omitted for every configuration in this cohort. Active weights were normalized uniformly. Displayed scores are rounded; pairwise outcomes use exact recorded fractions. Reference costs are estimates, not billed charges. Missing components follow the recorded assessment.

Pairwise results

  • GPT-6.1 Sol Low vs Grok 4.7 High: Second configuration wins
  • GPT-6.1 Sol Low vs Grok 4.7 Low: Second configuration wins
  • GPT-6.1 Sol Low vs Composer 2.5 Default: Second configuration wins
  • GPT-6.1 Sol Low vs DeepSeek Flash N/A: First configuration wins
  • GPT-6.1 Sol Low vs GPT-6.1 Sol High: First configuration wins
  • GPT-6.1 Sol Low vs GPT-6 Luna Extra High: First configuration wins
  • GPT-6.1 Sol Low vs GPT-6 Luna Low: First configuration wins
  • Grok 4.7 High vs Grok 4.7 Low: First configuration wins
  • Grok 4.7 High vs Composer 2.5 Default: First configuration wins
  • Grok 4.7 High vs DeepSeek Flash N/A: First configuration wins
  • Grok 4.7 High vs GPT-6.1 Sol High: First configuration wins
  • Grok 4.7 High vs GPT-6 Luna Extra High: First configuration wins
  • Grok 4.7 High vs GPT-6 Luna Low: First configuration wins
  • Grok 4.7 Low vs Composer 2.5 Default: First configuration wins
  • Grok 4.7 Low vs DeepSeek Flash N/A: First configuration wins
  • Grok 4.7 Low vs GPT-6.1 Sol High: First configuration wins
  • Grok 4.7 Low vs GPT-6 Luna Extra High: First configuration wins
  • Grok 4.7 Low vs GPT-6 Luna Low: First configuration wins
  • Composer 2.5 Default vs DeepSeek Flash N/A: First configuration wins
  • Composer 2.5 Default vs GPT-6.1 Sol High: First configuration wins
  • Composer 2.5 Default vs GPT-6 Luna Extra High: First configuration wins
  • Composer 2.5 Default vs GPT-6 Luna Low: First configuration wins
  • DeepSeek Flash N/A vs GPT-6.1 Sol High: First configuration wins
  • DeepSeek Flash N/A vs GPT-6 Luna Extra High: Second configuration wins
  • DeepSeek Flash N/A vs GPT-6 Luna Low: Second configuration wins
  • GPT-6.1 Sol High vs GPT-6 Luna Extra High: Second configuration wins
  • GPT-6.1 Sol High vs GPT-6 Luna Low: Second configuration wins
  • GPT-6 Luna Extra High vs GPT-6 Luna Low: First configuration wins