| Result | Rank 1GPT-6.1 Sol Low | Rank 2GPT-6 Astra Medium | Rank 3GPT-6 Luna Low | Rank 4Composer 2.5 Default | Rank 5Grok 4.7 Extra High | Rank 6Grok 4.7 Medium |
|---|---|---|---|---|---|---|
| Combined score | 84.14 | 83.31 | 76.86 | 75.28 | 70.38 | 69.98 |
| Judge | ||||||
| Judge score /100 | 90.00 | 90.00 | 77.00 | 80.00 | 77.50 | 76.50 |
| Correctness /10 | 9 | 9 | 8 | 8 | 7 | 7 |
| Coverage /10 | 9 | 9 | 6 | 8 | 10 | 9 |
| Evidence /10 | 9 | 9 | 9 | 8 | 7 | 7 |
| Actionability /10 | 9 | 9 | 8 | 8 | 7 | 8 |
| Time | 47.15 s | 73.73 s | 6.59 s | 61.9 s | 533.68 s | 259.13 s |
| Estimated USD | $0.137562 | $0.72789 | $0.0063873 | $0.0507535 | $0.386444 | $0.253236 |
Cost estimates are reference estimates, not billed charges.
Judge score uses recorded rubric metrics; final rank uses the combined score.
Component points
| Result | Rank 1 GPT-6.1 Sol Low | Rank 2 GPT-6 Astra Medium | Rank 3 GPT-6 Luna Low | Rank 4 Composer 2.5 Default | Rank 5 Grok 4.7 Extra High | Rank 6 Grok 4.7 Medium |
|---|---|---|---|---|---|---|
| Quality points | 81 | 81 | 69.3 | 72 | 69.75 | 68.85 |
| Test points | 0 | 0 | 0 | 0 | 0 | 0 |
| Speed points | 2.7999 | 2.2434 | 4.5049 | 2.461 | 0.5053 | 0.94 |
| Cost points | 0.3388 | 0.0678 | 3.0511 | 0.823 | 0.1261 | 0.1899 |
Swipe, scroll or use Previous and More to compare configurations. Row labels stay visible.
Advanced results and scoring details
ux · 2026-10-09T08:50:38.375Z · Prospective evaluation. Equal transport and native system conditions are unverified.
Applied weights: quality 90%, tests 0%, speed 5%, cost 5%.
Displayed scores are rounded; pairwise outcomes use exact recorded fractions. Reference costs are estimates, not billed charges. Missing components follow the recorded assessment.
Pairwise results
- GPT-6 Astra Medium vs GPT-6.1 Sol Low: Second configuration wins
- GPT-6 Astra Medium vs Composer 2.5 Default: First configuration wins
- GPT-6 Astra Medium vs Grok 4.7 Extra High: First configuration wins
- GPT-6 Astra Medium vs Grok 4.7 Medium: First configuration wins
- GPT-6 Astra Medium vs GPT-6 Luna Low: First configuration wins
- GPT-6.1 Sol Low vs Composer 2.5 Default: First configuration wins
- GPT-6.1 Sol Low vs Grok 4.7 Extra High: First configuration wins
- GPT-6.1 Sol Low vs Grok 4.7 Medium: First configuration wins
- GPT-6.1 Sol Low vs GPT-6 Luna Low: First configuration wins
- Composer 2.5 Default vs Grok 4.7 Extra High: First configuration wins
- Composer 2.5 Default vs Grok 4.7 Medium: First configuration wins
- Composer 2.5 Default vs GPT-6 Luna Low: Second configuration wins
- Grok 4.7 Extra High vs Grok 4.7 Medium: First configuration wins
- Grok 4.7 Extra High vs GPT-6 Luna Low: Second configuration wins
- Grok 4.7 Medium vs GPT-6 Luna Low: Second configuration wins