| Artificial Analysis | Qwen3.8 27B (Xhigh) Intelligence Index | 33.7 |
| Artificial Analysis | Qwen3.8 27B (Xhigh) Coding Index | 68.1 |
| Artificial Analysis | Qwen3.8 27B (Xhigh) Agentic Index | 45.8 |
| Artificial Analysis | Qwen3.8 27B (Xhigh) GPQA Diamond | 90.5% |
| Artificial Analysis | Qwen3.8 27B (Xhigh) HLE | 33.9% |
| Artificial Analysis | Qwen3.8 27B (Xhigh) AA-LCR | 82.0% |
| Artificial Analysis | Qwen3.8 27B (Xhigh) τ-Bench Banking | 48.0% |
| Artificial Analysis | Qwen3.8 27B (Xhigh) GDPval-AA | 46.2% |
| Artificial Analysis | Qwen3.8 27B (Xhigh) CritPt | 5.4% |
| Artificial Analysis | Qwen3.8 27B (Xhigh) SciCode | 46.6% |
| Artificial Analysis | Qwen3.8 27B (Xhigh) Terminal-Bench 4.0 | 5.6% |
| Artificial Analysis | Qwen3.8 27B (Xhigh) Terminal-Bench 2.1 | 79.8% |
| Artificial Analysis | Qwen3.8 27B (Xhigh) AA-Omniscience Accuracy | 15.6% |
| Artificial Analysis | Qwen3.8 27B (Xhigh) AA-Omniscience Non-Hallucination Rate | 69.7% |
| Artificial Analysis | Qwen3.8 27B (Medium) Intelligence Index | 27.6 |
| Artificial Analysis | Qwen3.8 27B (Medium) Coding Index | 56.1 |
| Artificial Analysis | Qwen3.8 27B (Medium) Agentic Index | 44.4 |
| Artificial Analysis | Qwen3.8 27B (Medium) GPQA Diamond | 84.5% |
| Artificial Analysis | Qwen3.8 27B (Medium) HLE | 14.1% |
| Artificial Analysis | Qwen3.8 27B (Medium) AA-LCR | 79.7% |
| Artificial Analysis | Qwen3.8 27B (Medium) τ-Bench Banking | 47.4% |
| Artificial Analysis | Qwen3.8 27B (Medium) GDPval-AA | 44.2% |
| Artificial Analysis | Qwen3.8 27B (Medium) CritPt | 0.0% |
| Artificial Analysis | Qwen3.8 27B (Medium) SciCode | 39.0% |
| Artificial Analysis | Qwen3.8 27B (Medium) Terminal-Bench 4.0 | 5.1% |
| Artificial Analysis | Qwen3.8 27B (Medium) Terminal-Bench 2.1 | 65.2% |
| Artificial Analysis | Qwen3.8 27B (Medium) AA-Omniscience Accuracy | 18.3% |
| Artificial Analysis | Qwen3.8 27B (Medium) AA-Omniscience Non-Hallucination Rate | 33.3% |
| Artificial Analysis | Qwen3.8 27B (Low) Intelligence Index | 26.2 |
| Artificial Analysis | Qwen3.8 27B (Low) Coding Index | 58.2 |
| Artificial Analysis | Qwen3.8 27B (Low) Agentic Index | 38.9 |
| Artificial Analysis | Qwen3.8 27B (Low) GPQA Diamond | 84.5% |
| Artificial Analysis | Qwen3.8 27B (Low) HLE | 14.0% |
| Artificial Analysis | Qwen3.8 27B (Low) AA-LCR | 77.3% |
| Artificial Analysis | Qwen3.8 27B (Low) τ-Bench Banking | 32.2% |
| Artificial Analysis | Qwen3.8 27B (Low) GDPval-AA | 43.2% |
| Artificial Analysis | Qwen3.8 27B (Low) CritPt | 0.0% |
| Artificial Analysis | Qwen3.8 27B (Low) SciCode | 40.0% |
| Artificial Analysis | Qwen3.8 27B (Low) Terminal-Bench 4.0 | 2.5% |
| Artificial Analysis | Qwen3.8 27B (Low) Terminal-Bench 2.1 | 67.4% |
| Artificial Analysis | Qwen3.8 27B (Low) AA-Omniscience Accuracy | 17.1% |
| Artificial Analysis | Qwen3.8 27B (Low) AA-Omniscience Non-Hallucination Rate | 47.1% |
| Artificial Analysis | Qwen3.8 27B (Non-reasoning) Intelligence Index | 20.2 |
| Artificial Analysis | Qwen3.8 27B (Non-reasoning) Coding Index | 44.6 |
| Artificial Analysis | Qwen3.8 27B (Non-reasoning) Agentic Index | 22.4 |
| Artificial Analysis | Qwen3.8 27B (Non-reasoning) GPQA Diamond | 81.8% |
| Artificial Analysis | Qwen3.8 27B (Non-reasoning) HLE | 12.1% |
| Artificial Analysis | Qwen3.8 27B (Non-reasoning) AA-LCR | 69.3% |
| Artificial Analysis | Qwen3.8 27B (Non-reasoning) τ-Bench Banking | 20.0% |
| Artificial Analysis | Qwen3.8 27B (Non-reasoning) GDPval-AA | 28.7% |
| Artificial Analysis | Qwen3.8 27B (Non-reasoning) CritPt | 0.3% |
| Artificial Analysis | Qwen3.8 27B (Non-reasoning) SciCode | 36.2% |
| Artificial Analysis | Qwen3.8 27B (Non-reasoning) Terminal-Bench 4.0 | 0.0% |
| Artificial Analysis | Qwen3.8 27B (Non-reasoning) Terminal-Bench 2.1 | 49.1% |
| Artificial Analysis | Qwen3.8 27B (Non-reasoning) AA-Omniscience Accuracy | 8.6% |
| Artificial Analysis | Qwen3.8 27B (Non-reasoning) AA-Omniscience Non-Hallucination Rate | 81.9% |
| Vals AI | Qwen 3.8 27B Code Migration | 14.2% |
| Vals AI | Qwen 3.8 27B CyberBench v1.1 | 67.8% |
| Vals AI | Qwen 3.8 27B EMB | 59.7% |
| Vals AI | Qwen 3.8 27B Finance Agent (v2) | 48.6% |
| Vals AI | Qwen 3.8 27B GPQA Diamond | 88.9% |
| Vals AI | Qwen 3.8 27B Harvey's Legal Agent Benchmark | 11.3% |
| Vals AI | Qwen 3.8 27B IOI | 39.1% |
| Vals AI | Qwen 3.8 27B LiveCodeBench | 84.0% |
| Vals AI | Qwen 3.8 27B LegalBench | 82.4% |
| Vals AI | Qwen 3.8 27B Legal Research Bench | 36.1% |
| Vals AI | Qwen 3.8 27B MedCode | 28.7% |
| Vals AI | Qwen 3.8 27B MedScribe | 83.8% |
| Vals AI | Qwen 3.8 27B MMLU Pro | 84.3% |
| Vals AI | Qwen 3.8 27B MMMU Pro | 83.9% |
| Vals AI | Qwen 3.8 27B MortgageTax | 64.9% |
| Vals AI | Qwen 3.8 27B ProgramBench | 0.0% |
| Vals AI | Qwen 3.8 27B ProofBench v1.1 | 16.0% |
| Vals AI | Qwen 3.8 27B SAGE | 52.4% |
| Vals AI | Qwen 3.8 27B SkillsBench | 38.1% |
| Vals AI | Qwen 3.8 27B SWE-bench | 86.0% |
| Vals AI | Qwen 3.8 27B Tax Agent Bench | 60.0% |
| Vals AI | Qwen 3.8 27B TaxEval v2 | 70.8% |
| Vals AI | Qwen 3.8 27B Terminal-Bench 2.1 | 58.4% |
| Vals AI | Qwen 3.8 27B Vibe Code Bench v1.1 | 64.8% |