Christian AI Benchmark v3-227q-2026-07-r3 : comment 24 modèles leaders ont obtenu leurs scores
TL;DR: GPT-5.6 Sol est en tête du dernier benchmark Christian AI avec 94,1/100 sur 24 modèles. Résultats complets, gagnants des catégories et coût réel par réponse à l'intérieur.
Nous avons publié le FaithGPT Christian AI Benchmark le 2026-07-13. 24 modèles ont été évalués par rapport à une banque de 227 questions couvrant l'interprétation des Écritures, la doctrine, le soin pastoral, l'exactitude des citations et la sécurité, produisant 4 641 évaluations notées à partir de 5 448 lignes d'évaluation planifiées.
GPT-5.6 Sol a dominé cette série avec un score global de 94,1/100.
Le classement
Rang · Modèle · Globalement (0-100) · Questions · Coût pour 100 réponses
1 · GPT-5.6 Sol · 94,1 · 227 / 227 · 6,75 $
1 · gpt-5.5-pro · 94,0 · 174 / 227 · 40,50 $
3 · Claude Opus 4.8 · 93.4 · 144 / 227 · 17,25 $
3 · gpt-5.5 · 93.2 · 173 / 227 · 6,75 $
3 · FaithGPT Ultra · 92,8 · 152 / 227 · 0,68 $
3 · Claude Fable 5 · 92,4 · 227 / 227 · 11,50 $
3 · Claude Sonnet 5 · 92.2 · 227 / 227 · 2,30 $
8 · GPT-5.6 Lune · 91,9 · 227 / 227 · 1,35 $
8 · GPT-5.6 Terre · 91,7 · 227 / 227 · 3,38 $
8 · Claude Sonnet 4.6 · 91.3 · 154 / 227 · 3,45 $
8 · MoonshotAI : Code Kimi K2.7 · 91,0 · 150 / 227 · 0,55 $
12 · gpt-5.4-mini · 90,5 · 143 / 227 · 0,55 $
13 · Z.ai : GLM 5.2 · 88,9 · 161 / 227 · 0,55 $
13 · FaithGPT · 88,8 · 120 / 227 · 0,68 $
| 13 | Recherche profonde : R1 0528 | 88.1 | 134 / 227 | 0,55 $
|
— · Mistral Grand · 82,7 · 220 / 227 · 0,55 $
— · Qwen: Qwen3.5 Plus 2026-02-15 · 82,6 · 227 / 227 · 0,55 $
— · Qwen: Qwen3 235B A22B · 82.3 · 226 / 227 · 0,55 $
— · Recherche profonde : Recherche profonde V3 · 82.2 · 227 / 227 · 0,55 $
— · MoonshotAI : Kimi K2.6 · 81,6 · 212 / 227 · 0,55 $
— · Google : Gemma 3 27B · 80,0 · 227 / 227 · 0,55 $
— · Méta : Llama 4 Maverick · 78.4 · 225 / 227 · 0,55 $
— · Meta : Llama 3.1 70B Instruire · 77,7 · 222 / 227 · 0,55 $
— · Qwen2.5 72B Instruire · 77,5 · 215 / 227 · 0,55 $
Les classements utilisent les 102 évaluations de profils de questions effectuées par chaque modèle classé, avec la difficulté déclarée des questions et les pondérations des catégories. Les modèles partagent un classement lorsque l’intervalle de confiance apparié à 95 % inclut zéro. Les questions montrent le total complet / attendu de chaque modèle.
Le coût pour 100 utilise l'estimation du prix du modèle publiée pour chaque ligne lorsqu'elle est disponible et exclut les évaluations de référence. Une entrée de 0,00 $ signifie que l'exécution de la CLI d'abonnement n'a ajouté aucune dépense d'API mesurée ; il ne s’agit pas de prétendre que le modèle commercial est gratuit.
Qui gagne chaque catégorie
Catégorie · Gagnant · Score
Robustesse contradictoire · Claude Fable 5 · 96,0
Apologétique · FaithGPT Ultra · 93.3
Alphabétisation biblique · Claude Fable 5 · 94,6
L'éthique chrétienne · GPT-5.6 Soleil · 95,0
Pièges à citations · Claude Fable 5 · 95.4
Création de contenu · GPT-5.6 Soleil · 93,8
Nuance confessionnelle · Claude Fable 5 · 94,5
Doctrine · FaithGPT Ultra · 94,7
Pastorale · GPT-5.6 Soleil · 96.3
Limites de sécurité · gpt-5.5-pro · 95,6
Interprétation des Écritures · Claude Fable 5 · 94,7
Les scores de catégorie font la moyenne des réponses de chaque modèle dans cette catégorie. Un modèle peut être en tête du classement général et néanmoins perdre une catégorie au profit d'un spécialiste.
Meilleur rapport qualité-prix
En termes de score par dollar, MoonshotAI : Kimi K2.7 Code est celui qui a donné le plus de résultats : 91,0/100 à 0,55 $ pour 100 réponses.
Comment lire ces résultats
Ces chiffres mesurent la version de référence v3-227q-2026-07-r3 sur cet ensemble de questions. Les lignes sans classement sont des résultats terminés antérieurs affichés par souci de transparence. Le classement n’impute pas les réponses manquantes et ne traite pas les différentes combinaisons de questions comme directement comparables. Aucune référence ne remplace les Écritures, les pasteurs ou la communauté chrétienne.
Le classement en direct contient toujours la version la plus récente : faithgpt.io/benchmarks.
Helpful Scripture resources
Contact & support
Email the FaithGPT team at hello@faithgpt.io or visit the contact page.
Explore FaithGPT