Skip to main content
GCB
Great Commission Benchmark
HomeLeaderboardRecent TestsCategoriesInsightsAbout
Subscribe

Get the GCB digest

New model evaluations and insights for Great Commission work. A monthly digest, plus occasional highlights on important model releases.

Subscribe

Platform

  • Methodology
  • Categories
  • FAQ

Community

  • Sponsor a Model Test
  • Support the Project
  • Volunteer

Legal

  • Terms of Service
  • Privacy Policy
  • Tester Agreement

Connect

  • Contact

Disclaimer: This benchmark is for informational purposes only and does not constitute an endorsement or recommendation of any AI model or service.

GCB
Great Commission Benchmark
•

© 2026 All rights reserved.

•

A project of gospelambition.org.

Leaderboard

Compare AI models and explore benchmark results across all categories

Follow the latest benchmark results.

New model evaluations and insights for Great Commission work. A monthly digest, plus occasional highlights on important model releases.

Subscribe

Compare Models Side-by-Side

Select 2-5 models using the checkboxes in the table below to compare their performance across all benchmark categories. You'll see detailed side-by-side comparisons of scores, verdicts, and category breakdowns.

Select models using checkboxes
Compare up to 5 models at once
View detailed comparisons
Model Rankings
Select 2-5 models to compare
#ProviderTaskGospelWorldviewVerdict
1google logoGoogleGemini 3 Flash Preview
87.0%
907790Excellent
2x-ai logoxAIGrok 4.20 Multi Agent
86.3%
907580Excellent
3openai logoOpenAIGpt 4o Mini
85.3%
868090Excellent
4x-ai logoxAIGrok 4.5
85.3%
878087Excellent
5aion-labs logoAion-labsAion 3.5
85.0%
877790Excellent
6
M
Mistral
Mistral Nemo
84.7%
848787Excellent
7x-ai logoxAIGrok 4.3
84.7%
858777Excellent
8x-ai logoxAIGrok Build 0.1
84.3%
897373Excellent
9
M
Mistral
Mistral Medium 3 5
84.0%
896787Excellent
10google logoGoogleGemini 3.8 Flash
82.0%
828577Excellent
11google logoGoogleGemini 3.1 Flash Lite
82.0%
847583Excellent
12google logoGoogleGemini 3.6 Flash
80.3%
807590Excellent
13google logoGoogleGemma 4 31b It
79.3%
836777Good
14
ZA
Z-AI
Glm 5.1
78.3%
807087Good
15
ZA
Z-AI
Glm 4.7
77.7%
806877Good
16
ZA
Z-AI
Glm 5.2
77.7%
778277Good
17
Q
Qwen
Qwen3.7 Max
77.3%
816380Good
18
ZA
Z-AI
Glm 5v Turbo
77.0%
767883Good
19google logoGoogleGemini 2.5 Pro
76.3%
786880Good
20openai logoOpenAIGpt 5.1
76.3%
738290Good
21meta-llama logoMetaLlama 3.3 70b Instruct
76.3%
796290Good
22google logoGoogleGemini 3.7 Flash
76.3%
748573Good
23
D
DeepSeek
Deepseek V4 Pro 0813
76.0%
7278100Good
24aion-labs logoAion-labsAion 3.5 Mini
75.7%
738087Good
25anthropic logoAnthropicClaude Fable 5.1
75.7%
747587Good
26
D
DeepSeek
Deepseek V4 Flash 0731
74.0%
746887Good
27meta logoMetaMuse Glimmer 30b
73.7%
737087Good
28google logoGoogleGemma 3 27b It
73.7%
747277Good
29x-ai logoxAIGrok 4.6
71.7%
728053Good
30
Q
Qwen
Qwen3.6 27b
71.3%
707377Good
31perceptron logoPerceptronPerceptron Mk1
71.0%
736370Good
32meta-llama logoMetaLlama 4 Maverick
71.0%
707280Good
33openai logoOpenAIGpt 5 Mini
70.7%
678077Good
34
Q
Qwen
Qwen3.7 Plus
70.0%
696880Good
35nvidia logoNVIDIANemotron 3.5 Lightning
70.0%
706773Good
36x-ai logoxAIGrok 4.20
69.3%
6860100Good
37
Q
Qwen
Qwen3.8 27b
69.0%
647593Good
38google logoGoogleGemini 2.5 Flash
69.0%
696380Good
39meta logoMetaMuse Spark 1.2
68.7%
6567100Good
40
Q
Qwen
Qwen3.7 Flash
68.3%
687070Good
41meta logoMetaMuse Spark 1.3
68.0%
627397Good
42
D
DeepSeek
Deepseek R1
68.0%
676290Good
43amazon logoAmazonNova Lite V1
67.0%
696263Good
44sakana logoSakanaFugu Ultra
67.0%
617393Good
45
D
DeepSeek
Deepseek V4.1 Flash
66.3%
607593Good
46google logoGoogleGemini 3.5 Flash Lite
66.3%
714870Good
47inference-net logoInference-netSchematron V2 Small
66.3%
735343Good
48anthropic logoAnthropicClaude Fable 5
66.3%
637377Good
49openai logoOpenAIGpt 5.5
65.7%
626593Good
50
D
DeepSeek
Deepseek V3.2
65.7%
685377Good
51
Q
Qwen
Qwen3.8 2.4t A95b
64.7%
606893Good
52openai logoOpenAIGpt 5.6 Luna Pro
64.3%
616290Good
53amazon logoAmazonNova Pro V1
63.7%
645873Good
54
Q
Qwen
Qwen3.8 Flash
63.7%
587090Good
55openai logoOpenAIGpt 5.6 Luna
63.3%
606097Good
56openai logoOpenAIGpt 6 Astra Pro
63.0%
567590Good
57anthropic logoAnthropicClaude Opus 5
63.0%
597763Good
58openai logoOpenAIGpt 5 Nano
62.0%
596087Good
59openai logoOpenAIGpt 5.6 Sol
61.0%
556597Good
60openai logoOpenAIGpt 6 Astra
60.7%
537390Fair
61inclusionai logoInclusionaiLing 3.0 Flash Fin
59.3%
605567Fair
62inclusionai logoInclusionaiLing 3.0 Flash
59.0%
615550Fair
63upstage logoUpstageSolar Pro4
57.7%
556070Fair
64ibm-granite logoIBMGranite 4.0 H Micro
57.0%
584867Fair
65
M
Moonshot
Kimi K2.5
56.0%
593773Fair
66tencent logoTencentHy4 Preview
55.3%
506280Fair
67
M
Moonshot
Kimi K2.6
55.3%
603367Fair
68
ZA
Z-AI
Glm 5
55.0%
486293Fair
69xiaomi logoXiaomiMimo V2.5
54.7%
574853Fair
70inception logoInceptionMercury 2.5
54.3%
535853Fair
71tencent logoTencentHy3 Preview
53.3%
515370Fair
72x-ai logoxAIGrok 4.7
53.3%
535063Fair
73poolside logoPoolsideLaguna S 2.1
53.0%
573760Fair
74
ZA
Z-AI
Glm 5.3 Flash
53.0%
505570Fair
75openai logoOpenAIGpt 5.2
52.3%
534270Fair
76inference-net logoInference-netSchematron V2 Turbo
50.0%
534733Fair
77openai logoOpenAIO3
49.3%
444793Fair
78
Q
Qwen
Qwen3 Next 80b A3b Instruct
49.3%
475557Fair
79openai logoOpenAIGpt 5.4 Mini
48.3%
483777Fair
80microsoft logoMicrosoftPhi 4
48.3%
494257Fair
81anthropic logoAnthropicClaude Opus 4.6
48.0%
513260Fair
82
M
MiniMax
Minimax M2.1
48.0%
503563Fair
83tencent logoTencentHy3
47.7%
463877Fair
84openai logoOpenAIGpt 5.4
46.7%
434283Fair
85xiaomi logoXiaomiMimo V2.5 Pro
46.3%
493750Fair
86openai logoOpenAIGpt 5.2 Codex
46.3%
453777Fair
87
M
Moonshot
Kimi K3
46.0%
435257Fair
88
M
MiniMax
Minimax M3
46.0%
522740Fair
89thinkingmachines logoThinkingmachinesInkling Small
46.0%
502263Fair
90anthropic logoAnthropicClaude Sonnet 4.5
45.7%
492563Fair
91openai logoOpenAIGpt Oss 20b
44.3%
481777Fair
92
ZA
Z-AI
Glm 5.3
43.7%
404860Fair
93anthropic logoAnthropicClaude Opus 4.8
43.3%
434050Fair
94bytedance-seed logoBytedance-seedSeed 2 1 Turbo
43.0%
443353Fair
95
Q
Qwen
Qwen3 Coder Next
42.7%
404267Fair
96bytedance-seed logoBytedance-seedSeed 2.0 Code
41.7%
423353Fair
97
M
Moonshot
Kimi K2 Thinking
41.3%
432857Fair
98anthropic logoAnthropicClaude Opus 4.5
40.7%
452050Fair
99google logoGoogleGemini 3.5 Flash
40.0%
451557Fair
100anthropic logoAnthropicClaude Sonnet 4.6
39.7%
422060Poor
101upstage logoUpstageSolar Mini4
39.7%
403547Poor
102nvidia logoNVIDIANemotron 3 Ultra 550b A55b
37.3%
421060Poor
103
M
MiniMax
Minimax M2.5
36.3%
382253Poor
104microsoft logoMicrosoftWizardlm 2 8x22b
36.0%
391853Poor
105anthropic logoAnthropicClaude Sonnet 5
33.7%
342743Poor
106
ZA
Z-AI
Glm 5.3 Prime
32.7%
371343Poor
107stepfun logoStepfunStep 3.7 Flash
32.3%
37847Poor
108openai logoOpenAIGpt Oss 120b
32.0%
311767Poor
109ibm-granite logoIBMGranite 4.2 8b
31.0%
294030Poor
110anthropic logoAnthropicClaude Haiku 4.5
30.7%
341537Poor
111bytedance-seed logoBytedance-seedSeed 2.0 Lite
30.7%
322043Poor
112amazon logoAmazonNova 2 Lite V1
26.7%
31340Poor

Disclaimer: This benchmark is for informational purposes only and does not constitute an endorsement or recommendation of any AI model or service. Results reflect performance on specific test questions at a point in time and may not predict performance on other tasks or future model versions.