Winner

Composer 2.5 Default

Architecture · October 8, 2026 · Difficulty: High

Final combined results in supplied rank order. Tied ranks remain tied.
ResultRank 1Composer 2.5 DefaultRank 2GPT-6.1 Sol LowRank 3Grok 4.7 LowRank 4GPT-6 Luna Extra HighRank 5GPT-6 Luna LowRank 6Grok 4.7 HighRank 7GPT-6.1 Sol HighRank 8DeepSeek Flash N/A
Combined score79.7075.7475.4675.3471.7268.5168.0962.82
Judge rank13247568
Judge score /10084.5080.0082.5079.5072.0075.5073.0064.00
Time49.27 s29.23 s263.62 s233.69 s18.67 s841.84 s85.09 s22.99 s
Estimated USD$0.0454075$0.124032$0.167454$0.0080753$0.0060853$0.213468$0.145082$0.0211998

Estimated reference costs are not billed charges. Judge rank is derived from recorded rubric metrics across judged configurations; final rank uses the combined score.

Component points
Final combined results in supplied rank order. Tied ranks remain tied.
ResultRank 1 Composer 2.5 DefaultRank 2 GPT-6.1 Sol LowRank 3 Grok 4.7 LowRank 4 GPT-6 Luna Extra HighRank 5 GPT-6 Luna LowRank 6 Grok 4.7 HighRank 7 GPT-6.1 Sol HighRank 8 DeepSeek Flash N/A
Quality points76.057274.2571.5564.867.9565.757.6
Test points00000000
Speed points2.74553.3620.9271.02153.81360.33272.06763.615
Cost points0.90240.3730.28182.76623.10840.22370.32241.6026

Swipe, scroll or use Previous and More to compare configurations. Row labels stay visible.

Advanced results and scoring details

architecture · 2026-10-08T21:20:38.963Z · Prospective evaluation. Equal transport and native system conditions are unverified.

Applied weights: quality 90%, tests 0%, speed 5%, cost 5%.

Displayed scores are rounded; pairwise outcomes use exact recorded fractions. Reference costs are estimates, not billed charges. Missing components follow the recorded assessment.

Pairwise results

  • Composer 2.5 Default vs Grok 4.7 Low: First configuration wins
  • Composer 2.5 Default vs Grok 4.7 High: First configuration wins
  • Composer 2.5 Default vs DeepSeek Flash N/A: First configuration wins
  • Composer 2.5 Default vs GPT-6 Luna Low: First configuration wins
  • Composer 2.5 Default vs GPT-6.1 Sol Low: First configuration wins
  • Composer 2.5 Default vs GPT-6 Luna Extra High: First configuration wins
  • Composer 2.5 Default vs GPT-6.1 Sol High: First configuration wins
  • Grok 4.7 Low vs Grok 4.7 High: First configuration wins
  • Grok 4.7 Low vs DeepSeek Flash N/A: First configuration wins
  • Grok 4.7 Low vs GPT-6 Luna Low: First configuration wins
  • Grok 4.7 Low vs GPT-6.1 Sol Low: Second configuration wins
  • Grok 4.7 Low vs GPT-6 Luna Extra High: First configuration wins
  • Grok 4.7 Low vs GPT-6.1 Sol High: First configuration wins
  • Grok 4.7 High vs DeepSeek Flash N/A: First configuration wins
  • Grok 4.7 High vs GPT-6 Luna Low: Second configuration wins
  • Grok 4.7 High vs GPT-6.1 Sol Low: Second configuration wins
  • Grok 4.7 High vs GPT-6 Luna Extra High: Second configuration wins
  • Grok 4.7 High vs GPT-6.1 Sol High: First configuration wins
  • DeepSeek Flash N/A vs GPT-6 Luna Low: Second configuration wins
  • DeepSeek Flash N/A vs GPT-6.1 Sol Low: Second configuration wins
  • DeepSeek Flash N/A vs GPT-6 Luna Extra High: Second configuration wins
  • DeepSeek Flash N/A vs GPT-6.1 Sol High: Second configuration wins
  • GPT-6 Luna Low vs GPT-6.1 Sol Low: Second configuration wins
  • GPT-6 Luna Low vs GPT-6 Luna Extra High: Second configuration wins
  • GPT-6 Luna Low vs GPT-6.1 Sol High: First configuration wins
  • GPT-6.1 Sol Low vs GPT-6 Luna Extra High: First configuration wins
  • GPT-6.1 Sol Low vs GPT-6.1 Sol High: First configuration wins
  • GPT-6 Luna Extra High vs GPT-6.1 Sol High: First configuration wins