Lancement bêta : 488 licences Full Moon gratuites restantes. Aidez-nous à trouver des bugs.
Réclamez votre accès gratuit

Meilleurs tests de personnalité gratuits pour équipes 2026

Des dizaines de tests gratuits existent, peu ont un socle scientifique. Le classement 2026 des outils Big Five valides, et de ceux qui ne le sont pas.

Miquel Matoses·21 min de lecture

Le paysage de l'évaluation de la personnalité a beaucoup changé. Des outils psychométriques validés, longtemps réservés aux laboratoires universitaires et aux cabinets cliniques sous licence, sont aujourd'hui accessibles librement en ligne. Dans le même temps, le marché déborde de questionnaires à l'allure professionnelle qui reposent sur des fondements scientifiques minces, voire inexistants.

Ce classement applique une même grille de critères aux tests de personnalité pour équipes les plus utilisés en 2026 et les ordonne selon la solidité des preuves publiées, pas selon leur popularité. Chaque chiffre ci-dessous est rattaché à l'article dont il provient. Lorsqu'aucune source publiée n'a pu être trouvée pour un chiffre, ce chiffre n'est pas imprimé.

TestItemsCe que montrent les preuves publiéesGratuit ?Idéal pour
Cèrcol de Premier Quartier (IPIP-NEO-60)60Bonne fiabilité et validité convergente avec le NEO PI-RÉquipes, profilage au niveau des facettes
IPIP-NEO-120120Des propriétés qui soutiennent avantageusement la comparaison avec l'IPIP-NEO en 300 itemsRecherche, référentiels RH
TIPI, le Big Five en dix items10Adéquat, mais psychométriquement appauvri par constructionCriblage rapide uniquement
MBTI Form M93Cohérence interne élevée, aucune étude de retest ni de validité structurelle recensée dans une synthèse sur 25 ansCoaching de type, jamais la sélection
DISCVariable selon l'éditeurValidité scientifique non démontréeGratuit chez certains éditeurs, payant pour les principales versions commercialesBrise-glace en atelier

Chaque ligne est sourcée dans la section qui la traite, et chaque travail cité figure dans la liste des sources à la fin.


Découvrez-vous en cinq dimensions.

Commencer le test gratuit

Comment nous avons évalué les tests de personnalité gratuits : les critères de validité

ρ = 0,22 Conscientiousness (Conscienciosité) et performance professionnelle, corrélation des scores vrais, méta-analytique
ρ = 0,816 Médiane de la fiabilité test-retest à court terme des échelles Big Five
Gratuit Cèrcol de Premier Quartier : 60 items IPIP-NEO, 30 facettes, sans frais

Le premier chiffre vient de la méta-analyse qui a fait de la personnalité un prédicteur légitime en sélection du personnel. Barrick et Mount rapportent une corrélation des scores vrais estimée à ρ = 0,22 entre la Conscienciosité et la performance professionnelle, en moyenne sur les types de critères, et le même ρ = 0,22 en moyenne sur cinq groupes professionnels doi:10.1111/j.1744-6570.1991.tb00688.x. Il faut bien voir ce que cette valeur est et ce qu'elle n'est pas : c'est une corrélation corrigée pour un seul trait, pas pour le Big Five pris comme ensemble, et la moyenne observée non corrigée, dans le même tableau, est de r = 0,13.

Le deuxième chiffre est l'étalon de fiabilité auquel tout instrument devrait être comparé. Gnambs a méta-analysé 682 corrélations test-retest issues de 74 échantillons (N total = 14 923), recueillies sur des intervalles allant jusqu'à deux mois, et rapporte une estimation médiane de fiabilité (dependability) de ρtt = 0,816 sur les cinq traits doi:10.1016/j.jrp.2014.06.003.

La troisième carte est un fait à propos de ce site, pas un résultat de recherche : le Cèrcol de Premier Quartier fait passer l'IPIP-NEO-60, soit 60 items, et renvoie 30 scores de facettes sans frais. L'instrument lui-même est documenté dans Maples-Keller et al. (2019).

Chaque outil de ce classement est évalué sur cinq dimensions :

  1. Validation à comité de lecture : l'instrument a-t-il été validé de façon indépendante dans des recherches publiées à comité de lecture, et pas seulement par son éditeur ?
  2. Domaine public / open source : les items et les algorithmes de calcul sont-ils publiquement inspectables, ou la méthodologie est-elle propriétaire ?
  3. Fiabilité test-retest : les scores restent-ils stables sur des semaines et des mois, comme la théorie de la personnalité le prédit ?
  4. Validité prédictive : les scores prédisent-ils des résultats qui comptent, performance professionnelle, efficacité d'équipe, bien-être ?
  5. Gratuité : une équipe peut-elle l'utiliser sans coût de licence par personne ?

Pour une introduction à ce que ces critères signifient statistiquement, voir fiabilité et validité dans les tests de personnalité.


Les meilleurs tests de personnalité gratuits pour les équipes en 2026, classés par la science

1. Les évaluations fondées sur l'IPIP : les preuves les plus solides, gratuites, ouvertes

Ce qu'il mesure : les cinq dimensions du Big Five (Openness, Conscientiousness, Extraversion, Agreeableness, Neuroticism, soit l'Ouverture, la Conscienciosité, l'Extraversion, l'Amabilité et le Névrosisme) sous forme de scores continus, avec une transparence au niveau des items.

Base scientifique : l'International Personality Item Pool est une bibliothèque d'items de personnalité en domaine public, développée par Lewis Goldberg et hébergée aujourd'hui par l'Oregon Research Institute. Les échelles IPIP ont été construites comme des équivalents en domaine public des inventaires commerciaux, et la convergence est documentée : Johnson rapporte que les échelles IPIP-NEO corrèlent en moyenne à r = 0,73 avec les échelles du NEO PI-R sur lesquelles elles sont calquées, et jusqu'à r = 0,94 une fois corrigée l'atténuation due à la fiabilité imparfaite des échelles doi:10.1016/j.jrp.2014.05.003. La structure en cinq facteurs se réplique elle-même d'une langue à l'autre : McCrae et Costa ont comparé six traductions du NEO PI-R à la structure factorielle américaine (N = 7 134, cinq familles de langues distinctes) et concluent que les données suggèrent fortement que la structure des traits de personnalité est universelle doi:10.1037/0003-066X.52.5.509. Pour comprendre comment ces items sont devenus la norme scientifique, voir qu'est-ce que l'IPIP et pourquoi est-il important ? et l'histoire du Big Five d'Allport à Goldberg.

Fiabilité test-retest : élevée. L'estimation médiane méta-analytique de fiabilité des échelles Big Five s'établit à ρtt = 0,816 sur des intervalles allant jusqu'à deux mois, l'erreur transitoire représentant environ 10 % de la variance observée des scores de traits doi:10.1016/j.jrp.2014.06.003.

Validité prédictive pour la performance professionnelle : en sélection du personnel, les preuves les plus solides concernent la Conscienciosité. Barrick et Mount concluent qu'« une dimension de la personnalité, la Conscienciosité, entretient des relations constantes avec tous les critères de performance professionnelle, dans tous les groupes professionnels », à ρ = 0,22 doi:10.1111/j.1744-6570.1991.tb00688.x. Dans la même analyse, l'Extraversion est un prédicteur valide pour les postes d'encadrement et de vente (ρ = 0,18 et 0,15), et l'Ouverture comme l'Extraversion prédisent la réussite en formation (ρ = 0,25 et 0,26).

Gratuité : oui. L'IPIP indique que ses items et ses échelles sont dans le domaine public et peuvent être copiés, modifiés, traduits ou utilisés à n'importe quelle fin, sans autorisation ni redevance.

Prêt pour les équipes : avec une présentation et une interprétation adaptées, oui, mais l'administration brute de l'IPIP demande un peu de mise en place.


2. Cèrcol : des instruments IPIP et l'évaluation par les pairs Témoins

Ce qu'il mesure : les cinq dimensions du Big Five (sous les noms de Présence, Lien, Vision, Discipline et Profondeur) en auto-rapport, plus des évaluations structurées confiées à des Témoins que chaque participant choisit lui-même.

Base scientifique : construit directement sur les items IPIP. Le Cèrcol de Premier Quartier est l'IPIP-NEO-60, en 60 items, dont les scores ont montré une bonne fiabilité et une bonne validité convergente avec le NEO PI-R et l'IPIP-NEO-300, et dont le réseau nomologique coïncide avec celui du NEO-FFI sur un large éventail de variables externes doi:10.1080/00223891.2017.1381968. Le Cèrcol de Pleine Lune utilise l'IPIP-NEO-120, en 120 items, dont Johnson estime que les propriétés psychométriques « soutiennent avantageusement la comparaison avec celles de la forme longue » doi:10.1016/j.jrp.2014.05.003. Le Cèrcol de Nouvelle Lune est un questionnaire de repérage en dix items fondé sur le TIPI, que ses auteurs décrivent comme un peu inférieur aux instruments standard à items multiples, tout en atteignant des niveaux adéquats de convergence et de fiabilité test-retest doi:10.1016/S0092-6566(03)00046-1. À prendre comme une orientation, pas comme un profil.

La couche d'évaluation par les pairs Témoins ajoute un second point de vue que l'auto-rapport seul ne peut pas capter. Ce n'est pas une affirmation en l'air : dans une intégration méta-analytique portant sur 44 178 personnes évaluées dans 263 échantillons, Connelly et Ones ont trouvé que, lorsque le critère était la réussite scolaire ou la performance professionnelle, les notations par autrui atteignaient des validités prédictives nettement supérieures à celles des auto-évaluations, et s'y ajoutaient doi:10.1037/a0021212. Voir pourquoi l'autoévaluation seule n'est pas suffisante pour la base de preuves plus large.

Fiabilité test-retest : hérite de la stabilité de la base IPIP Big Five décrite plus haut.

Validité prédictive : les instruments d'auto-rapport portent la validité des échelles IPIP-NEO qu'ils mettent en œuvre. La couche Témoin relève du type de dispositif de notation par les pairs auquel Connelly et Ones attribuent un apport prédictif supplémentaire, même si Cèrcol n'a pas encore publié de données de validité critérielle qui lui soient propres.

Gratuité : le Cèrcol de Nouvelle Lune et le Cèrcol de Premier Quartier sont gratuits. Le Cèrcol de Pleine Lune, qui ajoute l'instrument en 120 items et les évaluations de Témoins, est un achat payant, réglé une seule fois, et il est gratuit pour les nouveaux comptes pendant la bêta ouverte.

Prêt pour les équipes : oui, il est conçu spécifiquement pour un usage en équipe. Les résultats comprennent une vue au niveau de l'équipe, qui montre la distribution des traits dans le groupe. Voir ce que mesure l'instrument Témoin de Cèrcol pour la description complète de l'instrument.


3. Open Source Psychometrics Project

Ce qu'il mesure : plusieurs instruments disponibles gratuitement, dont un test Big Five construit à partir des échelles en domaine public de l'International Personality Item Pool.

Base scientifique : l'Open Source Psychometrics Project héberge des instruments de personnalité bien documentés et publie les données de réponse brutes et anonymisées qui les sous-tendent. Son seul jeu de données IPIP Big Five Factor Markers compte 1 015 342 réponses, et le site indique que ses jeux de données ont servi à plus de 25 articles publiés. Ce niveau de transparence est rare, et c'est la principale raison de la place du projet dans ce classement.

Fiabilité test-retest : variable selon l'instrument ; les mesures fondées sur l'IPIP héritent des estimations de fiabilité du Big Five données plus haut.

Validité prédictive : portée par les échelles IPIP sous-jacentes, et non établie pour le site lui-même.

Gratuité : oui, entièrement gratuit.

Prêt pour les équipes : les résultats sont individuels ; les agréger en profils d'équipe demande un travail supplémentaire. Convient aux équipes à l'aise avec une part d'interprétation en autonomie.


4. 16Personalities : populaire, validation indépendante limitée

Ce qu'il mesure : cinq échelles, que l'éditeur présente sous les noms d'Énergie, Esprit, Nature, Tactique et Identité, Identité étant l'axe Assertif/Turbulent. Les quatre premières sont restituées en lettres, à la manière du MBTI, ce qui produit 16 types nommés.

Base scientifique : l'éditeur indique que son NERIS Type Explorer conserve le format de l'acronyme en quatre lettres, mais fonde le modèle sur des traits en cinq facteurs plutôt que sur les fonctions cognitives jungiennes. La correspondance entre les lettres et les cinq facteurs a été étudiée directement pour le MBTI : McCrae et Costa n'ont trouvé « aucun appui à l'idée que le MBTI mesurerait des préférences véritablement dichotomiques ou des types qualitativement distincts », tandis que les quatre indices mesuraient bien des aspects de quatre des cinq grandes dimensions de la personnalité normale doi:10.1111/j.1467-6494.1989.tb00759.x. C'est le problème de fond de toute restitution par types : la variation sous-jacente est continue, et ranger les gens dans des cases jette la part du score qui porte l'information. Aucune validation indépendante à comité de lecture de l'instrument NERIS lui-même n'a été trouvée pour cette revue. Pour une analyse approfondie, voir 16Personalities vs Big Five : le test viral qui n'a raison qu'à moitié.

Fiabilité test-retest : non établie dans des recherches indépendantes publiées que nous ayons pu localiser pour cet instrument.

Validité prédictive : pas davantage établie dans des recherches indépendantes.

Gratuité : oui. L'éditeur indique que le test est gratuit et ne demande aucune inscription.

Prêt pour les équipes : très utilisé comme brise-glace et amorce de conversation. Ne devrait pas servir à des décisions à enjeux élevés sur les rôles ou le développement.


5. MBTI : commercial, et désavoué pour la sélection par son propre éditeur

Ce qu'il mesure : quatre dichotomies qui produisent un type en quatre lettres. La Form M, la forme standard, comporte 93 items à choix forcé.

Base scientifique : la théorie des types de Jung, opérationnalisée par Myers et Briggs. Deux revues de Pittenger concluent que la littérature disponible n'apporte pas de preuves suffisantes pour étayer les principes du test ni les affirmations sur son utilité doi:10.3102/00346543063004467, et que l'instrument « n'est peut-être pas encore en mesure d'étayer les affirmations de ceux qui en font la promotion » doi:10.1037/1065-9293.57.3.210. La synthèse la plus récente est plus brutale sur ce qui manque : en agrégeant 193 études publiées entre 1999 et 2024, Erford et ses collègues relèvent une cohérence interne de 0,845 à 0,921 selon les sous-échelles et les scores totaux, mais rapportent que « les études de validité structurelle et de test-retest étaient absentes de l'échantillon de littérature couvrant 25 ans » doi:10.1002/jcad.70006. Un instrument peut être cohérent en interne sans montrer pour autant que sa structure en quatre cases existe, ni que le type d'une personne tient en place.

Gratuité : non. La Form M est vendue par des distributeurs agréés, au Canada à 382 USD le lot de dix pour la version papier, et son achat est réservé à des acquéreurs qualifiés.

Prêt pour les équipes : pour la discussion, oui. Pour la sélection, l'éditeur lui-même dit non : « L'évaluation MBTI ne devrait jamais être utilisée en recrutement ou en sélection, parce qu'elle ne mesure ni les compétences ni les aptitudes d'une personne. »


6. DISC : propriétaire, validation indépendante limitée

Ce qu'il mesure : quatre styles de comportement (Dominance, Influence, Stabilité, Conscienciosité), présentés comme des types en quadrants.

Base scientifique : la théorie DISC descend du livre que Marston publie en 1928, Emotions of Normal People. Marston n'en a jamais tiré d'outil d'évaluation formel ; les instruments sont venus plus tard et d'autres mains, ce qui explique qu'il existe aujourd'hui plusieurs versions commerciales concurrentes, avec des items différents, des normes différentes et des nombres d'items différents. Les travaux indépendants à comité de lecture sont rares : la principale tentative publiée de relier un instrument à quatre quadrants à un instrument à cinq facteurs est une comparaison corrélationnelle de Jones et Hartley doi:10.19030/ajbe.v6i4.7945, et aucune méta-analyse des scores DISC face à la performance professionnelle n'a été trouvée pour cette revue. La position de synthèse dans la littérature de référence est que la validité scientifique de l'évaluation DISC n'a pas été démontrée. À noter aussi que l'étiquette Conscienciosité du DISC ne veut pas dire ce que la Conscienciosité veut dire dans le Big Five. Voir DISC vs Big Five : pourquoi quatre styles ne suffisent pas pour une comparaison scientifique détaillée, et Big Five vs DISC vs Belbin pour un face-à-face à trois.

Fiabilité test-retest : variable selon l'éditeur, et rapportée pour l'essentiel dans les manuels techniques des éditeurs plutôt que dans des recherches indépendantes.

Validité prédictive : non établie pour la performance professionnelle au niveau documenté pour les instruments Big Five.

Gratuité : en partie. Les versions commerciales les plus connues sont propriétaires et payantes, mais il existe des tests de type DISC gratuits : Truity, par exemple, propose une évaluation DISC de 38 items avec des résultats de base gratuits et un rapport complet payant en option. Ce qui n'est gratuit nulle part, c'est la méthodologie sous-jacente, qui n'est pas publiée pour inspection indépendante.

Prêt pour les équipes : très utilisé en formation ; efficace comme cadre de communication. Pas approprié pour une évaluation à enjeux élevés.


7. Ennéagramme : preuves mitigées, et les neuf types en sont la partie la plus faible

Ce qu'il mesure : neuf types de personnalité, très utilisés en coaching et dans les contextes de formation spirituelle.

Base scientifique : plus faible que celle du Big Five, mais le verdict honnête est « mitigé », pas « inexistant ». Hook et ses collègues ont passé en revue de façon systématique 104 échantillons indépendants et ont trouvé des preuves mitigées de fiabilité et de validité : certains travaux d'analyse factorielle montrent un alignement partiel avec la théorie de l'Ennéagramme, et les sous-échelles entretiennent avec d'autres construits, dont le Big Five, des relations conformes à la théorie. Les échecs sont structurels. Les analyses factorielles retrouvent en général moins de neuf facteurs, aucune étude n'a employé de techniques de classification automatique pour dériver les neuf types, et peu de recherches soutiennent les parties secondaires de la théorie, comme les ailes et les mouvements entre types doi:10.1002/jclp.23097. Autrement dit, les parties de l'Ennéagramme qui se comportent comme des traits continus se comportent raisonnablement ; c'est la taxonomie en neuf types posée par-dessus qui n'a pas été démontrée. Pour en savoir plus sur les mythes qui entourent les tests de personnalité, voir cinq mythes tenaces sur la science de la personnalité.

Fiabilité test-retest : mitigée d'une étude à l'autre dans la revue systématique ci-dessus.

Validité prédictive : non établie pour la performance professionnelle.

Gratuité : partielle ; certaines versions sont gratuites, des versions payantes existent.

Prêt pour les équipes : peut nourrir une réflexion personnelle et des échanges utiles, mais devrait servir d'exercice de réflexion plutôt que de données psychométriques.


Tests de personnalité gratuits comparés : le tableau de classement complet 2026

RangOutilPreuves indépendantes à comité de lectureDomaine ouvertFiabilité test-retestValidité prédictiveGratuit
1Évaluations fondées sur l'IPIPSolidesOuiρtt ≈ 0,82 pour les échelles Big FiveConscienciosité ρ = 0,22 pour la performance professionnelleOui
2CèrcolHérite des preuves IPIPOui (IPIP)Hérite des preuves IPIPHérite des preuves IPIP, plus les notations par les pairsNouvelle Lune et Premier Quartier gratuits, Pleine Lune payant (gratuit pendant la bêta ouverte)
3Open Source PsychometricsSolides pour les outils IPIPOuiHérite des preuves IPIPHérite des preuves IPIPOui
416PersonalitiesNon trouvéesNonNon trouvéeNon trouvéeOui
5MBTILes revues jugent les preuves insuffisantesNonAucune étude de retest dans une synthèse de 193 étudesL'éditeur exclut l'usage en sélectionNon
6DISCRaresNonRapportée par les éditeursNon établieVariable
7EnnéagrammeMitigées sur 104 échantillonsVariableMitigéeNon établiePartielle

Comment choisir le bon test de personnalité gratuit pour votre équipe

Pour la plupart des équipes qui partent de zéro, une approche en deux temps fonctionne bien :

  1. Commencez par une auto-évaluation gratuite fondée sur l'IPIP, via Open Source Psychometrics ou le Cèrcol de Premier Quartier, pour établir une base de référence du profil Big Five de chaque personne.
  2. Ajoutez l'évaluation par les pairs (les Témoins) pour voir où la perception de soi et l'expérience des autres divergent. C'est souvent dans cet écart que se tiennent les conversations de développement les plus utiles, et c'est la partie qui dispose d'un appui méta-analytique doi:10.1037/a0021212.

Si votre équipe s'est habituée au DISC ou à 16Personalities comme langage commun, vous n'avez pas à renoncer à ce vocabulaire. Mais y superposer un vrai instrument Big Five vous donnera la résolution dimensionnelle et les preuves de validité publiées qui manquent à ces outils.

Pour approfondir ce que vous payez, ou ne payez pas, quand vous comparez les options open source et commerciales, voir tests de personnalité : open source ou commercial.


Essayez une évaluation de personnalité d'équipe gratuite et sourcée

Si Cèrcol occupe cette place, c'est parce que c'est une implémentation de l'IPIP, pas parce que c'est le nôtre. Les items sont dans le domaine public, le calcul des scores est inspectable, et les chiffres de cette page sont ceux que rapportent réellement les articles sous-jacents.

Le Cèrcol de Premier Quartier compte 60 items et prend une dizaine de minutes ; il renvoie cinq scores de dimensions et 30 scores de facettes. Le Cèrcol de Nouvelle Lune est une orientation de dix items, en deux minutes. L'évaluation par les pairs Témoins, incluse dans le Cèrcol de Pleine Lune, gratuit pour les nouveaux comptes pendant la bêta ouverte, invite jusqu'à douze personnes qui vous connaissent à réaliser une tâche d'adjectifs à choix forcé de cinq minutes. Le choix forcé compte pour une raison mesurable : dans une méta-analyse de l'évaluation à enjeux élevés, les mesures de personnalité à choix forcé présentaient un effet global d'inflation des scores de 0,06, très en deçà de l'inflation rapportée pour les mesures de Likert à énoncé unique doi:10.1037/apl0000414. Voir comment Cèrcol traite le biais de désirabilité sociale et pourquoi 120 items valent mieux que 10 pour le raisonnement de conception de la mesure.

Démarrez l'évaluation de votre équipe sur cercol.team. Lisez le fondement scientifique pour voir exactement ce que vous mesurez et pourquoi.

Sources

Lectures complémentaires

Cèrcol

Découvrez-vous en cinq dimensions.

Soixante items, une dizaine de minutes. Cinq dimensions et 30 facettes. Gratuit, sans compte.

Commencer le test de 60 itemsVoir un rapport d'exemple

Articles liés

Cèrcol utilise uniquement des cookies fonctionnels, sans analytiques, sans traqueurs publicitaires. Politique de confidentialité