Key implications
Limited shared-metric coverage. Each finding is tied to a published metric, price, context, or modality fact.
- On Agentic, Claude Mythos 5 has a higher supported BenchLM score (75.79 vs 39.47).
- On Overall, Claude Mythos 5 has a higher supported BenchLM score (83.4 vs 59.14).
- Input API price: Kimi K2.5 has the lower verified rate ($0.6 / 1M tokens vs $10 / 1M tokens).
- Output API price: Kimi K2.5 has the lower verified rate ($3 / 1M tokens vs $50 / 1M tokens).
Shared metric view
A radar is shown only when at least four compatible supported score metrics are published.
Comparable metric detail
- AgenticClaude Mythos 5: 75.79 · Kimi K2.5: 39.47
- CodingClaude Mythos 5: 81.66 · Kimi K2.5: 56.8
- InstructionFollowingClaude Mythos 5: Unavailable · Kimi K2.5: 91.2
- KnowledgeClaude Mythos 5: 97.4 · Kimi K2.5: 54.6
- MathClaude Mythos 5: Unavailable · Kimi K2.5: 62.5
- MultilingualClaude Mythos 5: Unavailable · Kimi K2.5: 38.2
- MultimodalGroundedClaude Mythos 5: 84.8 · Kimi K2.5: 60.7
- ReasoningClaude Mythos 5: Unavailable · Kimi K2.5: 44.9
- OverallClaude Mythos 5: 83.4 · Kimi K2.5: 59.14
Source metrics
Friendly metric names and published units stay visible. Missing measurements remain unavailable rather than becoming a score.
Source metric comparison| Metric | Unit | Claude Mythos 5 | Kimi K2.5 |
|---|
| Agentic | score | 75.79 | 39.47 |
|---|
| Coding | score | 81.66 | 56.8 |
|---|
| InstructionFollowing | score | Unavailable | 91.2 |
|---|
| Knowledge | score | 97.4 | 54.6 |
|---|
| Math | score | Unavailable | 62.5 |
|---|
| Multilingual | score | Unavailable | 38.2 |
|---|
| MultimodalGrounded | score | 84.8 | 60.7 |
|---|
| Reasoning | score | Unavailable | 44.9 |
|---|
| Overall | score | 83.4 | 59.14 |
|---|
Agentic
- Unit
- score
- Claude Mythos 5
- 75.79
- Kimi K2.5
- 39.47
Coding
- Unit
- score
- Claude Mythos 5
- 81.66
- Kimi K2.5
- 56.8
InstructionFollowing
- Unit
- score
- Claude Mythos 5
- Unavailable
- Kimi K2.5
- 91.2
Knowledge
- Unit
- score
- Claude Mythos 5
- 97.4
- Kimi K2.5
- 54.6
Math
- Unit
- score
- Claude Mythos 5
- Unavailable
- Kimi K2.5
- 62.5
Multilingual
- Unit
- score
- Claude Mythos 5
- Unavailable
- Kimi K2.5
- 38.2
MultimodalGrounded
- Unit
- score
- Claude Mythos 5
- 84.8
- Kimi K2.5
- 60.7
Reasoning
- Unit
- score
- Claude Mythos 5
- Unavailable
- Kimi K2.5
- 44.9
Overall
- Unit
- score
- Claude Mythos 5
- 83.4
- Kimi K2.5
- 59.14
Pricing and context
Verification is shown beside each selected route. Missing facts remain Not verified.
Route pricing and context comparison| Field | Unit | Claude Mythos 5 | Kimi K2.5 |
|---|
| Input API price | USD / 1M tokens | $10 | $0.6 |
|---|
| Cached input API price | USD / 1M tokens | $1 | Not verified |
|---|
| Output API price | USD / 1M tokens | $50 | $3 |
|---|
| Route context | tokens | 1,000,000 | 256,000 |
|---|
| Input modalities | published list | Not verified | Not verified |
|---|
| Output modalities | published list | Not verified | Not verified |
|---|
Input API price
- Unit
- USD / 1M tokens
- Claude Mythos 5
- $10
- Kimi K2.5
- $0.6
Cached input API price
- Unit
- USD / 1M tokens
- Claude Mythos 5
- $1
- Kimi K2.5
- Not verified
Output API price
- Unit
- USD / 1M tokens
- Claude Mythos 5
- $50
- Kimi K2.5
- $3
Route context
- Unit
- tokens
- Claude Mythos 5
- 1,000,000
- Kimi K2.5
- 256,000
Input modalities
- Unit
- published list
- Claude Mythos 5
- Not verified
- Kimi K2.5
- Not verified
Output modalities
- Unit
- published list
- Claude Mythos 5
- Not verified
- Kimi K2.5
- Not verified
Evidence provenance
Source records, route identity, timestamps, and methodology are consolidated here without declaring either model a winner.
- Publication time
- Aug 30, 2026, 2:15 AM UTC
- Freshness
- Stale — Published weekly benchmark evidence has not refreshed within 8 days.
- Methodology
- benchlm: benchlm_raw_composite
- Model records
- Claude Mythos 5 — source benchlm · artifact models · model claude-mythos-5
- Kimi K2.5 — source benchlm · artifact models · model kimi-k2-5
- Selected price routes
- Claude Mythos 5 — route benchlm:claude-mythos-5 · source benchlm · provider anthropic
- Kimi K2.5 — route benchlm:kimi-k2-5 · source benchlm · provider moonshot-ai
Switch model pair
Choose from this result’s current and reviewed related models. Switching opens a reviewed comparison; it does not change this result’s evidence.