Reasoning

Weighted toward multi-step reasoning and knowledge depth.

Reasoning ranking, formula version 1.0.0, calculated 2026-09-21
RankModelScoreConfidenceEvidenceReasoningKnowledgeInstruction Following
1Claude Sonnet · Anthropic93.7100%1,23010076100
2GPT Frontier · OpenAI85.5100%1,230878881
3Gemini Pro · Google DeepMind78.2100%1,2307310069
4Llama Open · Meta AI7.085%220000

Scores are based on sample data for demonstration purposes.

Formula version 1.0.0 · weights v1.0.0 · calculated 2026-09-21. See the methodology page for how scores, confidence and evidence are combined.