| Result | Rank 1GPT-6.1 Sol High | Rank 2GPT-6.1 Sol Low | Rank 3GPT-6 Luna Extra High | Rank 4Composer 2.5 Default | Rank 5Grok 4.7 Low | Rank 6Grok 4.7 High | Rank 7GPT-6 Luna Low | Rank 8DeepSeek Flash N/A |
|---|---|---|---|---|---|---|---|---|
| Combined score | 88.95 | 88.10 | 84.57 | 82.11 | 76.09 | 75.97 | 62.68 | 49.36 |
| Judge rank | 1 | 2 | 3 | 4 | 5 | 5 | 7 | 8 |
| Judge score /100 | 92.50 | 90.00 | 87.50 | 84.00 | 80.00 | 80.00 | 62.00 | 48.00 |
| Time | 179.4 s | 51.28 s | 128.11 s | 64.89 s | 992 s | 1,717.92 s | 20.13 s | 21.27 s |
| Estimated USD | N/A | N/A | N/A | N/A | N/A | N/A | N/A | N/A |
Estimated reference costs are not billed charges. Judge rank is derived from recorded rubric metrics across judged configurations; final rank uses the combined score.
Component points
| Result | Rank 1 GPT-6.1 Sol High | Rank 2 GPT-6.1 Sol Low | Rank 3 GPT-6 Luna Extra High | Rank 4 Composer 2.5 Default | Rank 5 Grok 4.7 Low | Rank 6 Grok 4.7 High | Rank 7 GPT-6 Luna Low | Rank 8 DeepSeek Flash N/A |
|---|---|---|---|---|---|---|---|---|
| Quality points | 87.6316 | 85.2632 | 82.8947 | 79.5789 | 75.7895 | 75.7895 | 58.7368 | 45.4737 |
| Test points | 0 | 0 | 0 | 0 | 0 | 0 | 0 | 0 |
| Speed points | 1.3191 | 2.8378 | 1.6787 | 2.5285 | 0.3002 | 0.1776 | 3.9412 | 3.8857 |
| Cost points | 0 | 0 | 0 | 0 | 0 | 0 | 0 | 0 |
Swipe, scroll or use Previous and More to compare configurations. Row labels stay visible.
Advanced results and scoring details
platform · 2026-10-08T21:36:46.386Z · Prospective evaluation. Equal transport and native system conditions are unverified.
Applied weights: quality 94.7368%, tests 0%, speed 5.2632%, cost 0%.
Cost was omitted for every configuration in this cohort. Active weights were normalized uniformly. Displayed scores are rounded; pairwise outcomes use exact recorded fractions. Reference costs are estimates, not billed charges. Missing components follow the recorded assessment.
Pairwise results
- GPT-6.1 Sol Low vs GPT-6 Luna Extra High: First configuration wins
- GPT-6.1 Sol Low vs Composer 2.5 Default: First configuration wins
- GPT-6.1 Sol Low vs DeepSeek Flash N/A: First configuration wins
- GPT-6.1 Sol Low vs GPT-6.1 Sol High: Second configuration wins
- GPT-6.1 Sol Low vs Grok 4.7 Low: First configuration wins
- GPT-6.1 Sol Low vs GPT-6 Luna Low: First configuration wins
- GPT-6.1 Sol Low vs Grok 4.7 High: First configuration wins
- GPT-6 Luna Extra High vs Composer 2.5 Default: First configuration wins
- GPT-6 Luna Extra High vs DeepSeek Flash N/A: First configuration wins
- GPT-6 Luna Extra High vs GPT-6.1 Sol High: Second configuration wins
- GPT-6 Luna Extra High vs Grok 4.7 Low: First configuration wins
- GPT-6 Luna Extra High vs GPT-6 Luna Low: First configuration wins
- GPT-6 Luna Extra High vs Grok 4.7 High: First configuration wins
- Composer 2.5 Default vs DeepSeek Flash N/A: First configuration wins
- Composer 2.5 Default vs GPT-6.1 Sol High: Second configuration wins
- Composer 2.5 Default vs Grok 4.7 Low: First configuration wins
- Composer 2.5 Default vs GPT-6 Luna Low: First configuration wins
- Composer 2.5 Default vs Grok 4.7 High: First configuration wins
- DeepSeek Flash N/A vs GPT-6.1 Sol High: Second configuration wins
- DeepSeek Flash N/A vs Grok 4.7 Low: Second configuration wins
- DeepSeek Flash N/A vs GPT-6 Luna Low: Second configuration wins
- DeepSeek Flash N/A vs Grok 4.7 High: Second configuration wins
- GPT-6.1 Sol High vs Grok 4.7 Low: First configuration wins
- GPT-6.1 Sol High vs GPT-6 Luna Low: First configuration wins
- GPT-6.1 Sol High vs Grok 4.7 High: First configuration wins
- Grok 4.7 Low vs GPT-6 Luna Low: First configuration wins
- Grok 4.7 Low vs Grok 4.7 High: First configuration wins
- GPT-6 Luna Low vs Grok 4.7 High: Second configuration wins