| Intelligence Index AA · index Text · Chat / text | 2472%exact aliasverified runtime Row details- Raw value
- 24
- Percentile
- 72%
- Last updated
- recent
- Eligibility
- headline eligible
- Identity
- provider alias (0.94)
- Source label
- Claude 4.5 Haiku (Non-reasoning)
Source row | 35n/aexact aliasverified runtimeContext only Row details- Raw value
- 35
- Percentile
- n/a
- Last updated
- recent
- Eligibility
- benchmark_derived_model
- Identity
- provider alias (0.94)
- Source label
- A.X-K2
Source row | |
| Coding Index AA · index Code · Coding | 16n/aproxy backfilledbackfilledContext only Row details- Raw value
- 16
- Percentile
- n/a
- Last updated
- recent
- Eligibility
- Fallback benchmark identity is visible for context but excluded from default ranking.
- Identity
- benchmark proxy (0.58)
- Source label
- Claude 3.5 Haiku
Source row | 39n/aexact aliasverified runtimeContext only Row details- Raw value
- 39
- Percentile
- n/a
- Last updated
- recent
- Eligibility
- benchmark_derived_model
- Identity
- provider alias (0.94)
- Source label
- A.X-K2
Source row | |
| Openness Index AA · index Text · Chat / text | 1111.3%exact aliasverified runtime Row details- Raw value
- 11
- Percentile
- 11.3%
- Last updated
- recent
- Eligibility
- headline eligible
- Identity
- provider alias (0.94)
- Source label
- Claude 4.5 Haiku (Non-reasoning)
Source row | 50n/aexact aliasverified runtimeContext only Row details- Raw value
- 50
- Percentile
- n/a
- Last updated
- recent
- Eligibility
- benchmark_derived_model
- Identity
- provider alias (0.94)
- Source label
- A.X-K2
Source row | |
| GPQA AA · % Text · Reasoning / math / science | 64.6%49.4%exact aliasverified runtime Row details- Raw value
- 64.6%
- Percentile
- 49.4%
- Last updated
- recent
- Eligibility
- headline eligible
- Identity
- provider alias (0.94)
- Source label
- Claude 4.5 Haiku (Non-reasoning)
Source row | 85.7%n/aexact aliasverified runtimeContext only Row details- Raw value
- 85.7%
- Percentile
- n/a
- Last updated
- recent
- Eligibility
- benchmark_derived_model
- Identity
- provider alias (0.94)
- Source label
- A.X-K2
Source row | |
| Humanity's Last Exam AA · % Text · Reasoning / math / science | 4.2%23.3%exact aliasverified runtime Row details- Raw value
- 4.2%
- Percentile
- 23.3%
- Last updated
- recent
- Eligibility
- headline eligible
- Identity
- provider alias (0.94)
- Source label
- Claude 4.5 Haiku (Non-reasoning)
Source row | 29.6%n/aexact aliasverified runtimeContext only Row details- Raw value
- 29.6%
- Percentile
- n/a
- Last updated
- recent
- Eligibility
- benchmark_derived_model
- Identity
- provider alias (0.94)
- Source label
- A.X-K2
Source row | |
| CritPt AA · % Text · Reasoning / math / science | 0%60.3%exact aliasverified runtime Row details- Raw value
- 0%
- Percentile
- 60.3%
- Last updated
- recent
- Eligibility
- headline eligible
- Identity
- provider alias (0.94)
- Source label
- Claude 4.5 Haiku (Non-reasoning)
Source row | 8.9%n/aexact aliasverified runtimeContext only Row details- Raw value
- 8.9%
- Percentile
- n/a
- Last updated
- recent
- Eligibility
- benchmark_derived_model
- Identity
- provider alias (0.94)
- Source label
- A.X-K2
Source row | |
| SciCode AA · % Code · Coding | 34.4%58.8%exact aliasverified runtime Row details- Raw value
- 34.4%
- Percentile
- 58.8%
- Last updated
- recent
- Eligibility
- headline eligible
- Identity
- provider alias (0.94)
- Source label
- Claude 4.5 Haiku (Non-reasoning)
Source row | 38.5%n/aexact aliasverified runtimeContext only Row details- Raw value
- 38.5%
- Percentile
- n/a
- Last updated
- recent
- Eligibility
- benchmark_derived_model
- Identity
- provider alias (0.94)
- Source label
- A.X-K2
Source row | |
| AA-Omniscience accuracy AA · % Text · Chat / text | 14.4%29%exact aliasverified runtime Row details- Raw value
- 14.4%
- Percentile
- 29%
- Last updated
- recent
- Eligibility
- headline eligible
- Identity
- provider alias (0.94)
- Source label
- Claude 4.5 Haiku (Non-reasoning)
Source row | 18.6%n/aexact aliasverified runtimeContext only Row details- Raw value
- 18.6%
- Percentile
- n/a
- Last updated
- recent
- Eligibility
- benchmark_derived_model
- Identity
- provider alias (0.94)
- Source label
- A.X-K2
Source row | |
| AA-Omniscience non-hallucination AA · % Text · Chat / text | 74.3%97.5%exact aliasverified runtime Row details- Raw value
- 74.3%
- Percentile
- 97.5%
- Last updated
- recent
- Eligibility
- headline eligible
- Identity
- provider alias (0.94)
- Source label
- Claude 4.5 Haiku (Non-reasoning)
Source row | 67%n/aexact aliasverified runtimeContext only Row details- Raw value
- 67%
- Percentile
- n/a
- Last updated
- recent
- Eligibility
- benchmark_derived_model
- Identity
- provider alias (0.94)
- Source label
- A.X-K2
Source row | |
| GDPval-AA AA · rating Text · Professional reasoning | 457n/aproxy backfilledbackfilledContext only Row details- Raw value
- 457
- Percentile
- n/a
- Last updated
- recent
- Eligibility
- Fallback benchmark identity is visible for context but excluded from default ranking.
- Identity
- benchmark proxy (0.58)
- Source label
- Claude 3.5 Haiku
Source row | 1,109n/aexact aliasverified runtimeContext only Row details- Raw value
- 1,109
- Percentile
- n/a
- Last updated
- recent
- Eligibility
- benchmark_derived_model
- Identity
- provider alias (0.94)
- Source label
- A.X-K2
Source row | |
| Long Context Reasoning AA · % Document · Long context | 48.3%61.7%exact aliasverified runtime Row details- Raw value
- 48.3%
- Percentile
- 61.7%
- Last updated
- recent
- Eligibility
- headline eligible
- Identity
- provider alias (0.94)
- Source label
- Claude 4.5 Haiku (Non-reasoning)
Source row | 66%n/aexact aliasverified runtimeContext only Row details- Raw value
- 66%
- Percentile
- n/a
- Last updated
- recent
- Eligibility
- benchmark_derived_model
- Identity
- provider alias (0.94)
- Source label
- A.X-K2
Source row | |