| Result | Rank 1Grok 4.7 Medium | Rank 2GPT-6.1 Sol Low | Rank 3Grok 4.7 Extra High | Rank 4GPT-6 Astra Medium | Rank 5Composer 2.5 Default | Rank 6GPT-6 Luna Low |
|---|---|---|---|---|---|---|
| Combined score | 81.81 | 77.42 | 76.31 | 74.63 | 63.47 | 56.43 |
| Judge | ||||||
| Judge score /100 | 90.00 | 82.00 | 84.00 | 79.50 | 66.00 | 53.50 |
| Correctness /10 | 9 | 8 | 8 | 8 | 6 | 5 |
| Coverage /10 | 9 | 8 | 9 | 7 | 7 | 5 |
| Evidence /10 | 9 | 9 | 8 | 9 | 7 | 6 |
| Actionability /10 | 9 | 8 | 9 | 8 | 7 | 6 |
| Time | 419.98 s | 38.24 s | 491.21 s | 41.62 s | 44.27 s | 5.43 s |
| Estimated USD | $0.253216 | $0.078056 | $0.29958 | $0.39631 | $0.032084 | $0.003537 |
Cost estimates are reference estimates, not billed charges.
Judge score uses recorded rubric metrics; final rank uses the combined score.
Component points
| Result | Rank 1 Grok 4.7 Medium | Rank 2 GPT-6.1 Sol Low | Rank 3 Grok 4.7 Extra High | Rank 4 GPT-6 Astra Medium | Rank 5 Composer 2.5 Default | Rank 6 GPT-6 Luna Low |
|---|---|---|---|---|---|---|
| Quality points | 81 | 73.8 | 75.6 | 71.55 | 59.4 | 48.15 |
| Test points | 0 | 0 | 0 | 0 | 0 | 0 |
| Speed points | 0.625 | 3.0537 | 0.5443 | 2.9523 | 2.8773 | 4.5854 |
| Cost points | 0.19 | 0.5678 | 0.1615 | 0.1231 | 1.1881 | 3.6936 |
Swipe, scroll or use Previous and More to compare configurations. Row labels stay visible.
Advanced results and scoring details
ux · 2026-10-09T08:50:14.550Z · Prospective evaluation. Equal transport and native system conditions are unverified.
Applied weights: quality 90%, tests 0%, speed 5%, cost 5%.
Displayed scores are rounded; pairwise outcomes use exact recorded fractions. Reference costs are estimates, not billed charges. Missing components follow the recorded assessment.
Pairwise results
- GPT-6 Luna Low vs Grok 4.7 Medium: Second configuration wins
- GPT-6 Luna Low vs Composer 2.5 Default: Second configuration wins
- GPT-6 Luna Low vs Grok 4.7 Extra High: Second configuration wins
- GPT-6 Luna Low vs GPT-6 Astra Medium: Second configuration wins
- GPT-6 Luna Low vs GPT-6.1 Sol Low: Second configuration wins
- Grok 4.7 Medium vs Composer 2.5 Default: First configuration wins
- Grok 4.7 Medium vs Grok 4.7 Extra High: First configuration wins
- Grok 4.7 Medium vs GPT-6 Astra Medium: First configuration wins
- Grok 4.7 Medium vs GPT-6.1 Sol Low: First configuration wins
- Composer 2.5 Default vs Grok 4.7 Extra High: Second configuration wins
- Composer 2.5 Default vs GPT-6 Astra Medium: Second configuration wins
- Composer 2.5 Default vs GPT-6.1 Sol Low: Second configuration wins
- Grok 4.7 Extra High vs GPT-6 Astra Medium: First configuration wins
- Grok 4.7 Extra High vs GPT-6.1 Sol Low: Second configuration wins
- GPT-6 Astra Medium vs GPT-6.1 Sol Low: Second configuration wins