Examenos

Intelligence Index · Artificial Analysis Results Across LLMs

Independent evaluator Intelligence Index · Artificial Analysis results across showcased LLMs. Recorded Intelligence Index measurements from Artificial Analysis, with source links, evaluation dates and available effort or harness records. Vendor results remain separate.

Independent evaluator Higher is better · unit: index

What this table contains

Recorded Intelligence Index measurements from Artificial Analysis, with source links, evaluation dates and available effort or harness records. Vendor results remain separate.

22 models with results · 8 missing · 30 showcased models. Missing scores are not zero or failed tests. Headline selection is the default; source dates and setups can differ.

Interactive results & effort preference → · Results over time → · Methodology

Intelligence Index · Artificial Analysis: independent evaluator results only
ModelHeadline scoreSource/record dateEvidence
Claude Opus 5.5Anthropic58max effort2026-10-03
All 5 recorded results & sources

58 · raw 58 index

Headline · max effort · Independent evaluator

Source/record date: 2026-10-03

Current AA model leaderboard; with fallback reasoning configuration.

https://artificialanalysis.ai/models/claude-opus-5-5

56 · raw 56 index

Alternative · xhigh effort · Independent evaluator

Source/record date: 2026-10-03

Current AA model leaderboard; with fallback reasoning configuration.

https://artificialanalysis.ai/models/claude-opus-5-5-xhigh

54 · raw 54 index

Alternative · high effort · Independent evaluator

Source/record date: 2026-10-03

Current AA model leaderboard; with fallback reasoning configuration.

https://artificialanalysis.ai/models/claude-opus-5-5-high

51 · raw 51 index

Alternative · medium effort · Independent evaluator

Source/record date: 2026-10-03

Current AA model leaderboard; with fallback reasoning configuration.

https://artificialanalysis.ai/models/claude-opus-5-5-medium

42 · raw 42 index

Alternative · low effort · Independent evaluator

Source/record date: 2026-10-03

Current AA model leaderboard; with fallback reasoning configuration.

https://artificialanalysis.ai/models/claude-opus-5-5-low
Claude Sonnet 5.5Anthropic56max effort2026-10-03
All 5 recorded results & sources

56 · raw 56 index

Headline · max effort · Independent evaluator

Source/record date: 2026-10-03

Current AA model leaderboard; with fallback reasoning configuration.

https://artificialanalysis.ai/models/claude-sonnet-5-5

52 · raw 52 index

Alternative · xhigh effort · Independent evaluator

Source/record date: 2026-10-03

Current AA model leaderboard; with fallback reasoning configuration.

https://artificialanalysis.ai/models/claude-sonnet-5-5-xhigh

47 · raw 47 index

Alternative · high effort · Independent evaluator

Source/record date: 2026-10-03

Current AA model leaderboard; with fallback reasoning configuration.

https://artificialanalysis.ai/models/claude-sonnet-5-5-high

41 · raw 41 index

Alternative · medium effort · Independent evaluator

Source/record date: 2026-10-03

Current AA model leaderboard; with fallback reasoning configuration.

https://artificialanalysis.ai/models/claude-sonnet-5-5-medium

36 · raw 36 index

Alternative · low effort · Independent evaluator

Source/record date: 2026-10-03

Current AA model leaderboard; with fallback reasoning configuration.

https://artificialanalysis.ai/models/claude-sonnet-5-5-low
Claude Fable 5.1Anthropic53max effort2026-10-03
All 5 recorded results & sources

53 · raw 53 index

Headline · max effort · Independent evaluator

Source/record date: 2026-10-03

Current AA model leaderboard; with fallback reasoning configuration.

https://artificialanalysis.ai/models/claude-fable-5-1

53 · raw 53 index

Alternative · xhigh effort · Independent evaluator

Source/record date: 2026-10-03

Current AA model leaderboard; with fallback reasoning configuration.

https://artificialanalysis.ai/models/claude-fable-5-1-xhigh

51 · raw 51 index

Alternative · high effort · Independent evaluator

Source/record date: 2026-10-03

Current AA model leaderboard; with fallback reasoning configuration.

https://artificialanalysis.ai/models/claude-fable-5-1-high

49 · raw 49 index

Alternative · medium effort · Independent evaluator

Source/record date: 2026-10-03

Current AA model leaderboard; with fallback reasoning configuration.

https://artificialanalysis.ai/models/claude-fable-5-1-medium

47 · raw 47 index

Alternative · low effort · Independent evaluator

Source/record date: 2026-10-03

Current AA model leaderboard; with fallback reasoning configuration.

https://artificialanalysis.ai/models/claude-fable-5-1-low
Gemini 4 ArgonGoogle53high effort2026-10-03
All 1 recorded result & sources

53 · raw 53 index

Headline · high effort · Independent evaluator

Source/record date: 2026-10-03

Current AA model leaderboard;

https://artificialanalysis.ai/models/gemini-4-argon
GPT-6 AstraOpenAI53max effort2026-10-03
All 5 recorded results & sources

53 · raw 53 index

Headline · max effort · Independent evaluator

Source/record date: 2026-10-03

Current AA model leaderboard;

https://artificialanalysis.ai/models/gpt-6-astra

52 · raw 52 index

Alternative · xhigh effort · Independent evaluator

Source/record date: 2026-10-03

Current AA model leaderboard;

https://artificialanalysis.ai/models/gpt-6-astra-xhigh

51 · raw 51 index

Alternative · high effort · Independent evaluator

Source/record date: 2026-10-03

Current AA model leaderboard;

https://artificialanalysis.ai/models/gpt-6-astra-high

50 · raw 50 index

Alternative · medium effort · Independent evaluator

Source/record date: 2026-10-03

Current AA model leaderboard;

https://artificialanalysis.ai/models/gpt-6-astra-medium

46 · raw 46 index

Alternative · low effort · Independent evaluator

Source/record date: 2026-10-03

Current AA model leaderboard;

https://artificialanalysis.ai/models/gpt-6-astra-low
GPT-6.1 SolOpenAI52max effort2026-10-03
All 5 recorded results & sources

52 · raw 52 index

Headline · max effort · Independent evaluator

Source/record date: 2026-10-03

Current AA model leaderboard;

https://artificialanalysis.ai/models/gpt-6-1-sol

51 · raw 51 index

Alternative · xhigh effort · Independent evaluator

Source/record date: 2026-10-03

Current AA model leaderboard;

https://artificialanalysis.ai/models/gpt-6-1-sol-xhigh

50 · raw 50 index

Alternative · high effort · Independent evaluator

Source/record date: 2026-10-03

Current AA model leaderboard;

https://artificialanalysis.ai/models/gpt-6-1-sol-high

48 · raw 48 index

Alternative · medium effort · Independent evaluator

Source/record date: 2026-10-03

Current AA model leaderboard;

https://artificialanalysis.ai/models/gpt-6-1-sol-medium

42 · raw 42 index

Alternative · low effort · Independent evaluator

Source/record date: 2026-10-03

Current AA model leaderboard;

https://artificialanalysis.ai/models/gpt-6-1-sol-low
Muse Spark 1.3Meta48max effort2026-10-03
All 2 recorded results & sources

48 · raw 48 index

Headline · max effort · Independent evaluator

Source/record date: 2026-10-03

Current AA model leaderboard;

https://artificialanalysis.ai/models/muse-spark-1-3

45 · raw 45 index

Alternative · xhigh effort · Independent evaluator

Source/record date: 2026-10-03

Current AA model leaderboard;

https://artificialanalysis.ai/models/muse-spark-1-3-xhigh
Grok 4.7xAI46xhigh effort2026-10-03
All 3 recorded results & sources

46 · raw 46 index

Headline · xhigh effort · Independent evaluator

Source/record date: 2026-10-03

Current AA model leaderboard;

https://artificialanalysis.ai/models/grok-4-7

46 · raw 46 index

Alternative · high effort · Independent evaluator

Source/record date: 2026-10-03

Current AA model leaderboard;

https://artificialanalysis.ai/models/grok-4-7-high

42 · raw 42 index

Alternative · low effort · Independent evaluator

Source/record date: 2026-10-03

Current AA model leaderboard;

https://artificialanalysis.ai/models/grok-4-7-low
MiMo-V2.6-ProXiaomi46unknown effort2026-10-03
All 1 recorded result & sources

46 · raw 46 index

Headline · unknown effort · Independent evaluator

Source/record date: 2026-10-03

Current AA model leaderboard;

https://artificialanalysis.ai/models/mimo-v2-6-pro
GLM-5.3Z.ai45max effort2026-10-03
All 2 recorded results & sources

45 · raw 45 index

Headline · max effort · Independent evaluator

Source/record date: 2026-10-03

Current AA model leaderboard;

https://artificialanalysis.ai/models/glm-5-3

34 · raw 34 index

Alternative · low effort · Independent evaluator

Source/record date: 2026-10-03

Current AA model leaderboard;

https://artificialanalysis.ai/models/glm-5-3-low
Qwen3.8 Max (0902)Alibaba (Qwen)45max effort2026-10-03
All 1 recorded result & sources

45 · raw 45 index

Headline · max effort · Independent evaluator

Source/record date: 2026-10-03

Current AA model leaderboard;

https://artificialanalysis.ai/models/qwen3-8-max
Kimi K3Moonshot AI44max effort2026-10-03
All 2 recorded results & sources

44 · raw 44 index

Headline · max effort · Independent evaluator

Source/record date: 2026-10-03

Current AA model leaderboard;

https://artificialanalysis.ai/models/kimi-k3

30 · raw 30 index

Alternative · low effort · Independent evaluator

Source/record date: 2026-10-03

Current AA model leaderboard;

https://artificialanalysis.ai/models/kimi-k3-low
GLM-5.3-FlashZ.ai42unknown effort2026-10-03
All 1 recorded result & sources

42 · raw 42 index

Headline · unknown effort · Independent evaluator

Source/record date: 2026-10-03

Current AA model leaderboard;

https://artificialanalysis.ai/models/glm-5-3-flash
GPT-5.6 TerraOpenAI42max effort2026-10-03
All 6 recorded results & sources

42 · raw 42 index

Headline · max effort · Independent evaluator

Source/record date: 2026-10-03

Current AA model leaderboard;

https://artificialanalysis.ai/models/gpt-5-6-terra

38 · raw 38 index

Alternative · xhigh effort · Independent evaluator

Source/record date: 2026-10-03

Current AA model leaderboard;

https://artificialanalysis.ai/models/gpt-5-6-terra-xhigh

34 · raw 34 index

Alternative · high effort · Independent evaluator

Source/record date: 2026-10-03

Current AA model leaderboard;

https://artificialanalysis.ai/models/gpt-5-6-terra-high

30 · raw 30 index

Alternative · medium effort · Independent evaluator

Source/record date: 2026-10-03

Current AA model leaderboard;

https://artificialanalysis.ai/models/gpt-5-6-terra-medium

27 · raw 27 index

Alternative · low effort · Independent evaluator

Source/record date: 2026-10-03

Current AA model leaderboard;

https://artificialanalysis.ai/models/gpt-5-6-terra-low

21 · raw 21 index

Alternative · none effort · Independent evaluator

Source/record date: 2026-10-03

Current AA model leaderboard;

https://artificialanalysis.ai/models/gpt-5-6-terra-non-reasoning
Gemini 3.8 FlashGoogle41high effort2026-10-03
All 3 recorded results & sources

41 · raw 41 index

Headline · high effort · Independent evaluator

Source/record date: 2026-10-03

Current AA model leaderboard;

https://artificialanalysis.ai/models/gemini-3-8-flash

40 · raw 40 index

Alternative · medium effort · Independent evaluator

Source/record date: 2026-10-03

Current AA model leaderboard;

https://artificialanalysis.ai/models/gemini-3-8-flash-medium

33 · raw 33 index

Alternative · low effort · Independent evaluator

Source/record date: 2026-10-03

Current AA model leaderboard;

https://artificialanalysis.ai/models/gemini-3-8-flash-low
Qwen3.8 FlashAlibaba (Qwen)40unknown effort2026-09-23
All 1 recorded result & sources

40 · raw 40 index

Headline · unknown effort · Independent evaluator

Source/record date: 2026-09-23

Qwen3.8-Flash-Next AA model page

https://artificialanalysis.ai/models/qwen3-8-flash-next
DeepSeek V4.1 FlashDeepSeek39max effort2026-10-03
All 2 recorded results & sources

39 · raw 39 index

Headline · max effort · Independent evaluator

Source/record date: 2026-10-03

Current AA model leaderboard;

https://artificialanalysis.ai/models/deepseek-v4-1-flash

25 · raw 25 index

Alternative · none effort · Independent evaluator

Source/record date: 2026-10-03

Current AA model leaderboard;

https://artificialanalysis.ai/models/deepseek-v4-1-flash-non-reasoning
GPT-6 LunaOpenAI38max effort2026-10-03
All 6 recorded results & sources

38 · raw 38 index

Headline · max effort · Independent evaluator

Source/record date: 2026-10-03

Current AA model leaderboard;

https://artificialanalysis.ai/models/gpt-6-luna

35 · raw 35 index

Alternative · xhigh effort · Independent evaluator

Source/record date: 2026-10-03

Current AA model leaderboard;

https://artificialanalysis.ai/models/gpt-6-luna-xhigh

33 · raw 33 index

Alternative · high effort · Independent evaluator

Source/record date: 2026-10-03

Current AA model leaderboard;

https://artificialanalysis.ai/models/gpt-6-luna-high

30 · raw 30 index

Alternative · medium effort · Independent evaluator

Source/record date: 2026-10-03

Current AA model leaderboard;

https://artificialanalysis.ai/models/gpt-6-luna-medium

22 · raw 22 index

Alternative · low effort · Independent evaluator

Source/record date: 2026-10-03

Current AA model leaderboard;

https://artificialanalysis.ai/models/gpt-6-luna-low

18 · raw 18 index

Alternative · none effort · Independent evaluator

Source/record date: 2026-10-03

Current AA model leaderboard;

https://artificialanalysis.ai/models/gpt-6-luna-non-reasoning
MiMo-V2.6-FlashXiaomi38unknown effort2026-10-03
All 1 recorded result & sources

38 · raw 38 index

Headline · unknown effort · Independent evaluator

Source/record date: 2026-10-03

Current AA model leaderboard;

https://artificialanalysis.ai/models/mimo-v2-6-flash
Qwen3.8 27BAlibaba (Qwen)34xhigh effort2026-10-03
All 4 recorded results & sources

34 · raw 34 index

Headline · xhigh effort · Independent evaluator

Source/record date: 2026-10-03

Current AA model leaderboard;

https://artificialanalysis.ai/models/qwen3-8-27b

28 · raw 28 index

Alternative · medium effort · Independent evaluator

Source/record date: 2026-10-03

Current AA model leaderboard;

https://artificialanalysis.ai/models/qwen3-8-27b-medium

26 · raw 26 index

Alternative · low effort · Independent evaluator

Source/record date: 2026-10-03

Current AA model leaderboard;

https://artificialanalysis.ai/models/qwen3-8-27b-low

20 · raw 20 index

Alternative · none effort · Independent evaluator

Source/record date: 2026-10-03

Current AA model leaderboard;

https://artificialanalysis.ai/models/qwen3-8-27b-non-reasoning
Ling 3.0 Flash VLinclusionAI25unknown effort2026-10-03
All 1 recorded result & sources

25 · raw 25 index

Headline · unknown effort · Independent evaluator

Source/record date: 2026-10-03

Current AA model leaderboard;

https://artificialanalysis.ai/models/ling-3-0-flash-vl
Mercury 2.5Inception12unknown effort2026-10-03
All 1 recorded result & sources

12 · raw 12 index

Headline · unknown effort · Independent evaluator

Source/record date: 2026-10-03

Current AA model leaderboard;

https://artificialanalysis.ai/models/mercury-2-5
Hy4 previewTencent——No recorded result
Kolibri-1Aleph Alpha——No recorded result
Ling 3.1 FlashinclusionAI——No recorded result
MiMo-V2.6-Distill-Qwen-9BXiaomi——No recorded result
Naive-N0.5-FlashNaiveAI——No recorded result
Nex-N2.5-ProNex AGI——No recorded result
Pareto 26.10 PreviewUnbiased——No recorded result
Qwen3.8 Omni FlashAlibaba (Qwen)——No recorded result

Use the fair-comparison guide before interpreting results from different configurations.