| Result | Rank 1Grok 4.7 High | Rank 2Grok 4.7 Low | Rank 3Composer 2.5 Default | Rank 4GPT-6.1 Sol Low | Rank 5GPT-6 Luna Extra High | Rank 6GPT-6 Luna Low | Rank 7DeepSeek Flash N/A | Rank 8GPT-6.1 Sol High |
|---|---|---|---|---|---|---|---|---|
| Combined score | 87.81 | 85.78 | 84.61 | 83.01 | 81.91 | 72.80 | 72.01 | 69.14 |
| Judge rank | 1 | 2 | 3 | 4 | 5 | 6 | 7 | 8 |
| Judge score /100 | 92.50 | 90.00 | 86.00 | 84.00 | 83.50 | 72.00 | 71.50 | 70.50 |
| Time | 1,692.95 s | 556.84 s | 40.59 s | 32.1 s | 52.73 s | 8.87 s | 13.95 s | 74.35 s |
| Estimated USD | N/A | N/A | N/A | N/A | N/A | N/A | N/A | N/A |
Estimated reference costs are not billed charges. Judge rank is derived from recorded rubric metrics across judged configurations; final rank uses the combined score.
Component points
| Result | Rank 1 Grok 4.7 High | Rank 2 Grok 4.7 Low | Rank 3 Composer 2.5 Default | Rank 4 GPT-6.1 Sol Low | Rank 5 GPT-6 Luna Extra High | Rank 6 GPT-6 Luna Low | Rank 7 DeepSeek Flash N/A | Rank 8 GPT-6.1 Sol High |
|---|---|---|---|---|---|---|---|---|
| Quality points | 87.6316 | 85.2632 | 81.4737 | 79.5789 | 79.1053 | 68.2105 | 67.7368 | 66.7895 |
| Test points | 0 | 0 | 0 | 0 | 0 | 0 | 0 | 0 |
| Speed points | 0.1801 | 0.5119 | 3.1395 | 3.4286 | 2.8012 | 4.5856 | 4.2704 | 2.3506 |
| Cost points | 0 | 0 | 0 | 0 | 0 | 0 | 0 | 0 |
Swipe, scroll or use Previous and More to compare configurations. Row labels stay visible.
Advanced results and scoring details
product · 2026-10-08T21:29:48.064Z · Prospective evaluation. Equal transport and native system conditions are unverified.
Applied weights: quality 94.7368%, tests 0%, speed 5.2632%, cost 0%.
Cost was omitted for every configuration in this cohort. Active weights were normalized uniformly. Displayed scores are rounded; pairwise outcomes use exact recorded fractions. Reference costs are estimates, not billed charges. Missing components follow the recorded assessment.
Pairwise results
- GPT-6.1 Sol Low vs Grok 4.7 High: Second configuration wins
- GPT-6.1 Sol Low vs Grok 4.7 Low: Second configuration wins
- GPT-6.1 Sol Low vs Composer 2.5 Default: Second configuration wins
- GPT-6.1 Sol Low vs DeepSeek Flash N/A: First configuration wins
- GPT-6.1 Sol Low vs GPT-6.1 Sol High: First configuration wins
- GPT-6.1 Sol Low vs GPT-6 Luna Extra High: First configuration wins
- GPT-6.1 Sol Low vs GPT-6 Luna Low: First configuration wins
- Grok 4.7 High vs Grok 4.7 Low: First configuration wins
- Grok 4.7 High vs Composer 2.5 Default: First configuration wins
- Grok 4.7 High vs DeepSeek Flash N/A: First configuration wins
- Grok 4.7 High vs GPT-6.1 Sol High: First configuration wins
- Grok 4.7 High vs GPT-6 Luna Extra High: First configuration wins
- Grok 4.7 High vs GPT-6 Luna Low: First configuration wins
- Grok 4.7 Low vs Composer 2.5 Default: First configuration wins
- Grok 4.7 Low vs DeepSeek Flash N/A: First configuration wins
- Grok 4.7 Low vs GPT-6.1 Sol High: First configuration wins
- Grok 4.7 Low vs GPT-6 Luna Extra High: First configuration wins
- Grok 4.7 Low vs GPT-6 Luna Low: First configuration wins
- Composer 2.5 Default vs DeepSeek Flash N/A: First configuration wins
- Composer 2.5 Default vs GPT-6.1 Sol High: First configuration wins
- Composer 2.5 Default vs GPT-6 Luna Extra High: First configuration wins
- Composer 2.5 Default vs GPT-6 Luna Low: First configuration wins
- DeepSeek Flash N/A vs GPT-6.1 Sol High: First configuration wins
- DeepSeek Flash N/A vs GPT-6 Luna Extra High: Second configuration wins
- DeepSeek Flash N/A vs GPT-6 Luna Low: Second configuration wins
- GPT-6.1 Sol High vs GPT-6 Luna Extra High: Second configuration wins
- GPT-6.1 Sol High vs GPT-6 Luna Low: Second configuration wins
- GPT-6 Luna Extra High vs GPT-6 Luna Low: First configuration wins