Démarrage Rapide
Bienvenue dans AI Recruteur Pro V80 !
V80-Full (build février 2026, 54 000+ lignes, 3 000+ marqueurs) intègre : Authentification multi-tenant (login bcrypt, panel admin, gestion des comptes utilisateurs), Modèle BYOK (Bring Your Own Key — le client paie sa propre consommation API Anthropic), 3 forfaits (🌱 Essentiel 99€ · 🚀 Pro 299€ · 🏢 Expert 799€/mois) avec feature gating granulaire par module, test de charge API en sidebar (5 modèles : Haiku 4.5, Sonnet 4.5, Sonnet 4.6, Opus 4.5, Opus 4.6), anti-fraude PDF (détection texte blanc, micro-polices, mots-clés ATS cachés), Score Authenticité CV algorithmique (5 axes), Réconciliation concordance→profiler (boucle de rétro-correction automatique LLM), NeuroProfiler V7.3 (38 dimensions + Dark Triad, PANAS/DASS-21, Stroop Cognitif — gating par plan), retry API amélioré (5 tentatives, 220s total), rapports HTML brandés (logo, couleurs société), sélecteur de modèle par forfait. Plus toutes les fonctionnalités historiques : Analyse 360° FdP, modules sélectifs, concordance hybride, ML supervisé + croisements 4D, Executive Summary, Portfolio Dashboard, dual extraction, anti-hallucination, API SIRENE/INSEE.
📱 Les 2 Onglets Principaux
Onglet STANDARD
Quand ? Vous avez une fiche de poste et voulez comparer des CVs.
Résultat : Score de matching, alertes CV, classement.
Onglet PROFILER
Quand ? Vous voulez comprendre un candidat en profondeur, sans poste précis.
Résultat : Profil psychométrique, métiers, compatibilité.
⚡ Démarrage Express — 3 Minutes
Choisissez votre onglet
Standard (avec fiche de poste) ou Profiler (sans fiche de poste)
Glissez-déposez vos fichiers
PDF, DOCX, TXT acceptés. Jusqu'à 150 CVs.
Lancez l'analyse
15-30 sec/CV. Patientez et consultez les résultats.
📁 Formats Acceptés
| Format | Qualité | Conseil |
|---|---|---|
| PDF (texte) | ⭐⭐⭐⭐⭐ | Format recommandé |
| Word (.docx) | ⭐⭐⭐⭐⭐ | Fonctionne très bien |
| Texte (.txt) | ⭐⭐⭐⭐ | Perte de mise en forme |
| OpenDocument (.odt) | ⭐⭐⭐⭐ | Bien supporté |
| PDF (scanné) | ⭐⭐⭐ | OCR auto avec PyMuPDF |
Pour de meilleurs résultats
Privilégiez les PDF avec texte sélectionnable. Test : ouvrez le PDF et essayez de sélectionner du texte.
🔢 Limites
150 CVs max
Par session simultanée.
150 Tests max
Tests de personnalité associables aux CVs.
15-30 sec/CV
Temps d'analyse moyen avec Claude AI.
Onglet Standard — Étape par Étape
Idéal quand vous avez une fiche de poste et voulez évaluer l'adéquation de candidats.
📋 Les 7 Étapes
📋 Charger la Fiche de Poste
Zone d'upload HAUT GAUCHE. Glissez-déposez ou cliquez. PDF/DOCX/TXT.
📄 Charger les CVs
Zone HAUT DROITE. Jusqu'à 150 fichiers. Ctrl+clic pour sélection multiple.
🎯 Vérifier le Métier Détecté
Détection auto depuis la fiche. Corrigez si nécessaire via le menu déroulant (969 métiers).
🏢 Infos Société (Sidebar gauche)
Nom, logo, coordonnées, secteur — pour personnaliser les rapports HTML.
🧠 Tests de Personnalité (Optionnel)
AssessFirst, DISC, MBTI, Big Five/MyPrint. Association automatique par nom.
🏢 Contexte Société + Attentes Candidats
Zones texte en bas : culture, taille équipe, soft skills prioritaires, points de vigilance.
▶️ Lancer l'Analyse
Bouton 🚀 — 15-30 sec/CV. Ne fermez pas l'onglet !
📊 Comprendre les Résultats
Score Global (0-100%)
Vert >70% · Orange 50-70% · Rouge <50%
30 Types d'Alertes
Gaps, incohérences, red flags, surqualification, sous-qualification...
Ranking Candidats
Classement auto par score décroissant + médailles 🥇🥈🥉
⚠️ Catégories d'Alertes
| Catégorie | Exemples | Niveau |
|---|---|---|
| Chronologie | Gaps, chevauchements | Suspect |
| Cohérence | Titres vs responsabilités | Modéré |
| Qualification | Sur/sous-qualification | Info |
| Red Flags | Changements fréquents | Critique |
Profiler Prédictif — Étape par Étape
Analyse sans fiche de poste : profil psychométrique, métiers recommandés, compatibilité équipe.
📋 Les 6 Étapes
📄 Charger les CVs
Jusqu'à 150 CVs. PDF/DOCX/TXT. CVs détaillés = meilleurs résultats.
✅ Sélectionner les CVs
Cochez les CVs à analyser. "Tout sélectionner" disponible.
🧠 Tests de Personnalité (Recommandé)
Fiabilité ~65% sans test → ~85-90% avec test. AssessFirst, DISC, MBTI, Big Five.
⚙️ Configurer les Modules V80
6 checkboxes : NeuroProfiler, Profiler IA, Marché, Portrait LLM, Fiabilité, Maturité.
🩺 Vérifier le Diagnostic Pré-Analyse (V80)
Dans la section 📥 Exporter la Pré-Analyse, un tableau récapitulatif affiche pour chaque CV :
| Colonne | Description |
|---|---|
| 🩺 Verdict | ✅ BON — 🟡 POSSIBLE — 🟠 MODÉRÉ — 🔴 RISQUÉ |
| 📐 Format | Type de CV détecté : standard, multi-colonnes (Canva/Figma), graphique éclaté (PowerPoint), polices non standard (Illustrator/Photoshop) |
| 🌐 Langue | FR, EN ou MIX — détection automatique |
| ⚠️ Alertes | Titre absent, contact manquant, peu de dates, section XP absente, CV trop court/long, extrait par OCR |
▶️ Lancer le Profiler
Bouton 🔮. Chronomètre rouge ⏱️ pendant l'analyse, vert ✅ à la fin.
📋 Fiabilité CV: 72% — ✅ BON POUR ANALYSE📊 Ce que Produit le Profiler
Métiers Actuels (Top 5)
Score compatibilité + justification détaillée.
Métiers avec Formation
Accessibles avec 3-12 mois de formation.
Métiers du Futur
Horizons 2025-2030, émergents et IA-augmentés.
Offres Emploi
Recherche auto France Travail avec matching.
Compatibilité Équipe
20 types de relations professionnelles.
Test 3 Entreprises
Matching culture sur 6 dimensions.
V80 — Modules, Dual Extraction & Pré-Analyse
Le recruteur reprend le contrôle
Avant V80 : toutes les analyses (~60-80s/CV). Depuis V80 : vous choisissez. Juste le NeuroProfiler local ? 2s/CV. Rapport complet ? Activez tout.
⚙️ Les 6 Modules
| Module | Type | Temps | Description | Dépend. |
|---|---|---|---|---|
| 🧬 NeuroProfiler | Local | ~2s | 40+ dimensions, Big Five, RIASEC, HPI/TDAH/TSA | — |
| 🤖 Profiler IA | API | ~30-40s | Analyse sémantique Claude Sonnet complète | — |
| 🇫🇷 Positionnement Marché | API | ~10-15s | Employabilité, salaire, entreprises cibles | Profiler IA |
| 🎭 Portrait LLM | API | ~15-20s | Synthèse narrative enrichie | Profiler IA |
| 📋 Fiabilité + Concordance | Local+API | ~2-8s | 13 sections regex + audit LLM optionnel | — |
| 🌳 Maturité | Local | ~2s | Niveau de maturité professionnelle | — |
Règles de dépendance
Marché et Portrait LLM nécessitent le Profiler IA. Au minimum, NeuroProfiler OU Profiler IA doit être coché.
🆕 V80 — Extraction Robuste Multi-Format
V80 ajoute une cascade d'extraction à 5 niveaux + une dual extraction intelligente pour gérer tous les types de CV :
Dual Extraction (V80)
Chaque PDF est traité en parallèle par extraction texte ET OCR. Un diagnostic qualité compare les deux résultats et sélectionne automatiquement le meilleur. Détecte : CHARABIA (polices CJK), FRACTURED (layout éclaté), COLUMN_MIX (colonnes mélangées), CV scannés/images.
pdfplumber
Extraction texte native. Fonctionne pour 75% des CV (Word, Google Docs, LaTeX).
pypdf
Fallback si pdfplumber échoue ou donne un texte trop court (<100 chars).
Diagnostic Qualité
Détecte CHARABIA (polices CJK), FRACTURED (layout éclaté), COLUMN_MIX (colonnes mélangées).
OCR Adaptatif
Tesseract via fitz ou pdf2image. Langue auto-détectée (fra/eng/fra+eng).
Claude PDF Direct
Fallback ultime : Claude lit le PDF comme une image. Gère les colonnes séparément.
⏱️ Timer Temps Réel
En cours
Bandeau rouge, chrono MM:SS, mis à jour par étape.
Estimation dynamique
Après le 1er CV, recalcul du temps restant.
Résumé final
Bandeau vert : temps total + moyenne/CV.
Pipeline
Affichage 🧬→🤖→🇫🇷→🎭→📋→🌳 + estimation.
V80 — BYOK, 3 Forfaits & Test de Charge API
Nouveau en V80 — Modèle BYOK
Bring Your Own Key : chaque client utilise sa propre clé API Anthropic. La consommation de tokens est facturée directement par Anthropic sur le compte du client. TDJ Solutions ne paie pas et ne voit pas la consommation.
💰 Coût API par CV (BYOK)
Essentiel : $0.35→0.80 / CV
6 modules actifs. Modèle Sonnet 4.6. 10 CV Standard/mois.
Pro : $0.50→0.90 / CV
9 modules actifs. Opus 4.5 + Sonnet 4.6. 50 CV Standard + 15 Profiler/mois.
Expert : $0.90→1.60 / CV
16 modules actifs. Opus 4.5 + Sonnet 4.6. 150 CV Standard + 150 Profiler/mois.
📋 Les 3 Forfaits
| Forfait | Prix | Modèle IA | CV/mois | Features clés |
|---|---|---|---|---|
| 🌱 Essentiel | 99€/mois HT | Sonnet 4.6 | 10 Standard | Analyse CV, contrôles qualité, détection IA (182 marqueurs), Big Five/RIASEC, Portrait candidat, PDF brandé |
| 🚀 Pro | 299€/mois HT | Opus 4.5 + Sonnet 4.6 | 50 Standard + 15 Profiler | + Anti-Fraude PDF, Profiler Prédictif IA, Concordance, Dark Triad, HPI/TDAH/DYS, Rapport individuel |
| 🏢 Expert | 799€/mois HT | Opus 4.5 + Sonnet 4.6 | 150 Standard + 150 Profiler | + Portrait LLM, PANAS/DASS/Stroop, §5/§6/§7, Marché, Compatibilité, Portfolio ∞, Executive Summary, White-label, API SIRENE, Support dédié 24/7 |
Feature Gating par Module (V80)
Chaque module est contrôlé individuellement. Par exemple : Big Five/RIASEC sont accessibles dès Essentiel, mais Dark Triad nécessite Pro, et PANAS/DASS/Stroop nécessitent Expert. Le système affiche un badge 🔒 avec le plan requis quand une feature est verrouillée. 16 modules au total, 6 activés en Essentiel, 9 en Pro, 16 en Expert.
🩺 Test de Charge API (Sidebar)
Bouton 🩺 Tester la disponibilité API dans la sidebar. Envoie un micro-prompt de 5 tokens à chaque modèle et affiche l'état en temps réel :
| Modèle testé | Résultat possible | Signification |
|---|---|---|
| ⚡ Haiku 4.5 | 🟢 OK — 1.2s | Disponible, temps normal |
| 🎯 Sonnet 4.5 | 🟡 Lent — 5.3s | Charge modérée, passera mais plus lent |
| 🚀 Sonnet 4.6 | 🟠 Très lent — 12s | Charge élevée, risque de timeout |
| 👑 Opus 4.5 | 🔴 SURCHARGÉ (529) | Overload Anthropic — ne pas lancer |
| 💎 Opus 4.6 | 🔑 Clé invalide | Problème d'authentification |
Suggestions de fallback intelligentes
Si Opus 4.5 est surchargé mais Sonnet 4.6 répond, le système vous propose automatiquement de basculer. Coût du test : ~$0.004 (quasi gratuit). Le badge ACTIF indique quel modèle est utilisé par votre forfait.
🔄 Retry API Amélioré (V80)
5 tentatives
Délais exponentiels : 10s → 20s → 40s → 70s → 80s (total 220s max).
Gestion 529/503/500
Overload, maintenance, erreurs serveur — retry automatique avec backoff.
Inventaire API
20 appels API répartis en 6 phases. 13/20 respectent le choix de modèle du forfait.
V80 — Authentification Multi-Tenant & Panel Admin
Nouveau en V80-Full — Architecture Multi-Tenant
Chaque utilisateur dispose d'un compte authentifié avec un plan associé (Essentiel, Pro, Expert). L'accès aux fonctionnalités est contrôlé par feature gating granulaire. Un panel admin permet de créer, modifier et supprimer des comptes.
🔑 Page de Connexion
Sélection de profil
Liste déroulante des utilisateurs enregistrés. Mot de passe hashé en bcrypt (fallback SHA-256 si bcrypt absent).
Hashage bcrypt
Les mots de passe en clair sont automatiquement migrés au premier lancement. Aucun mot de passe stocké en clair après initialisation.
Tenant ID
Chaque utilisateur reçoit un identifiant unique (tenant-nom-uuid) pour l'isolation des données.
Session persistante
Plan, rôle, display_name et tenant_id stockés en session Streamlit.
🛡️ Panel Administration
Accessible uniquement par l'administrateur (authentification requise avec mot de passe admin).
Créer un compte
Nom d'utilisateur, mot de passe (6 chars min), display name, choix du plan. Le tenant_id est généré automatiquement avec UUID.
Changer de plan
Upgrade/downgrade instantané. Les limites et le feature gating s'appliquent immédiatement.
Supprimer un compte
Protection : le compte admin ne peut pas se supprimer lui-même.
Tableau de bord
Vue complète : utilisateur, plan, tenant_id, rôle. Comptage par plan avec limites max (Essentiel: 20, Pro: 40, Expert: 50 comptes).
🔒 Matrice d'Accès par Plan
| Module | 🌱 Essentiel | 🚀 Pro | 🏢 Expert |
|---|---|---|---|
| Analyse CV Standard | ✅ (10/mois) | ✅ (50/mois) | ✅ (150/mois) |
| Anti-Fraude PDF | ❌ | ✅ | ✅ |
| Profiler Prédictif IA | ❌ | ✅ (15/mois) | ✅ (150/mois) |
| Concordance CV ↔ Profiler | ❌ | ✅ | ✅ |
| Big Five / RIASEC | ✅ | ✅ | ✅ |
| Dark Triad | ❌ | ✅ | ✅ |
| PANAS/DASS + Stroop | ❌ | ❌ | ✅ |
| Détection HPI/TDAH/DYS | ❌ | ✅ | ✅ |
| §5 Atypique / §6 Future / §7 Crash | ❌ | ❌ | ✅ |
| Marché / Compatibilité / Veille | ❌ | ❌ | ✅ |
| Portfolio + Executive Summary | ❌ | ❌ | ✅ |
| White-label + SIRENE | ❌ | ❌ | ✅ |
| Utilisateurs max | 1 | 3 | Illimité |
Note production
En production, les utilisateurs doivent être migrés vers PostgreSQL/Supabase. Le stockage actuel (session_state) est adapté au prototypage et aux démos. Les mots de passe sont hashés mais la persistence nécessite un backend.
V80 — Anti-Fraude PDF & Score Authenticité CV
Pourquoi ?
44% des candidats mentent lors du recrutement (Resume Builder 2025). 73.4% utiliseraient l'IA pour embellir leur CV. Les outils comme TailoredCV, Jobscan, Rezi génèrent des CV sur-optimisés pour les ATS. V80 détecte ces fraudes sans appel API supplémentaire.
🔍 Anti-Fraude PDF — Détection Technique
Analyse le fichier PDF brut pour détecter les manipulations techniques :
Texte blanc / invisible
Mots-clés en police blanche (rgb 255,255,255) ou transparente, invisibles à l'œil mais lus par les ATS.
Micro-polices (1-2pt)
Texte en taille 1-2pt, illisible mais parsé par les systèmes automatiques.
Mots-clés ATS cachés
Liste de keywords professionnels injectés hors zone visible pour gonfler le matching.
Métadonnées suspectes
Templates Europass/Canva avec couches cachées dans les métadonnées PDF.
| Niveau | Score | Impact |
|---|---|---|
| 🟢 LOW | 0-2 | RAS — CV propre |
| 🟠 MEDIUM | 3-5 | Éléments suspects — vérifier |
| 🔴 HIGH | 6+ | Fraude probable — pénalité score |
🎯 Score Authenticité CV — 5 Composantes (0 appel API)
Score de 0 à 100 (100 = authentique). 100% algorithmique, aucun appel API supplémentaire. Intégré dans le pipeline d'analyse standard.
| # | Composante | Max pénalité | Ce qu'il détecte |
|---|---|---|---|
| 1 | 📐 Similarité CV ↔ JD | -40 pts | CV sur-taillé pour l'offre (cosine-like : unigrams, bigrams, séquences copiées). Seuils : >90% coverage = -30pts, >80% = -20pts |
| 2 | 🤖 Détection langage IA | -25 pts | 24 buzzwords FR/EN (passionné par, force de proposition, orientation résultats, environnement dynamique…), uniformité syntaxique, chiffres ronds, 5 patterns structurels IA |
| 3 | 👻 Ghost Skills | -15 pts | Hard skills listées dans l'offre mais introuvables dans le CV (matching 3 niveaux : phrase exacte → mots significatifs → mot long en contexte) |
| 4 | 📈 Indice d'inflation | -15 pts | Intègre indice_sincérité (1-10) et parcours_atypique (INCOHERENT/DESCENDANT). Sincérité ≤4 = -20pts |
| 5 | 📄 Score Fraude PDF | -30 pts | Intègre le score anti-fraude PDF (texte blanc, micro-polices, mots-clés ATS cachés). HIGH = -25pts |
🏷️ Niveaux d'Authenticité
| Niveau | Score | Verdict |
|---|---|---|
| ✅ AUTHENTIQUE | ≥ 80 | CV naturel, pas de manipulation détectée |
| 🟡 ACCEPTABLE | 60-79 | Quelques signaux — vérifier en entretien |
| 🟠 SUSPECT | 40-59 | CV probablement retouché/IA — vigilance requise |
| 🔴 ALERTE | < 40 | CV massivement taillé ou généré par IA |
📊 Validation — Discrimination Authentique vs IA
CV authentique + JD matching
Score : 92/100 — Coverage 42%, 2 buzzwords, 0 pattern IA
CV IA + même JD matching
Score : 67/100 — Coverage 50%, 9 buzzwords, 2 patterns IA
Delta discrimination
25 points d'écart sur profil matching, 52 points sur profil non-lié
⚖️ Cadre Juridique (France)
Faux et usage de faux (Code pénal 441-1)
3 ans de prison + 45 000€ d'amende. Professions réglementées : 2-5 ans + 30 000-75 000€. Licenciement pour faute grave si le mensonge a été déterminant pour l'embauche.
🔒 Gating — Forfait Pro+ uniquement
L'anti-fraude PDF et le Score Authenticité CV sont disponibles à partir du forfait Pro. Les forfaits Essentiel n'y ont pas accès. Le score est affiché dans un expander dédié dans Streamlit et intégré dans le rapport HTML.
V80 — Analyse 360° de la Fiche de Poste
Nouveau en V80
Dès le chargement de la fiche de poste, Claude l'analyse en profondeur avant même de toucher un CV. Résultat : un diagnostic complet avec score, forces, faiblesses et recommandations d'amélioration.
🔍 Détection Automatique du Type de Document
L'analyse identifie automatiquement si le document uploadé est :
Fiche de Poste
Titre, missions, compétences requises, profil recherché → analyse 360° lancée.
CV détecté
Parcours personnel détecté → alerte : « Ce document ressemble à un CV, pas une fiche de poste ».
Autre document
Lettre de motivation, rapport, etc. → message d'erreur adapté.
📊 Les 7 Axes d'Analyse
| Axe | Éléments vérifiés | Impact score |
|---|---|---|
| A) Informations Générales | Intitulé, entreprise, localisation, type contrat, télétravail | Élevé |
| B) Définition du Poste | Missions, responsabilités, périmètre, objectifs, KPIs, reporting | Élevé |
| C) Profil Recherché | Niveau d'XP, formation requise, hard skills, soft skills, langues, certifications | Élevé |
| D) Conditions & Rémunération | Fourchette salariale, avantages, horaires, déplacements | Moyen |
| E) Processus de Recrutement | Étapes, délais, contact RH identifié | Faible |
| F) Attractivité | Valeurs, culture, perspectives, différenciation marché | Moyen |
| G) Inclusivité | Langage non genré, mention handicap, diversité | Faible |
📋 Ce que Produit l'Analyse 360°
Score Global (/100)
Note de qualité de la fiche. Adapté au type de contrat (CDI plus exigeant que CDD).
Points Forts
Ce qui est bien rédigé et complet dans la fiche.
Points Manquants
Informations absentes ou insuffisantes.
Recommandations
Suggestions concrètes pour améliorer la fiche avant diffusion.
📥 Export HTML
Bouton 📥 Télécharger l'Analyse 360° disponible sous l'analyse. Génère un rapport HTML professionnel avec le branding société (logo, couleurs) exportable et partageable.
🔒 Protection du Cache
Hash-based protection
V80 utilise un hash MD5 du fichier pour éviter de relancer l'analyse 360° à chaque rechargement Streamlit. Tant que le même fichier est chargé, l'analyse est conservée. Si vous changez de fichier, une nouvelle analyse est lancée automatiquement.
📋 Analyse de la FdP Seule (sans CV)
🆕 V80 permet d'analyser uniquement la fiche de poste, sans charger aucun CV. Utile pour les RH qui veulent valider la qualité de leur fiche avant publication. Le bouton 🔍 Analyser la Fiche de Poste apparaît si aucun CV n'est chargé.
V80 — Executive Summary & Portfolio Dashboard
Pour le DRH pressé
Deux nouvelles vues : l'Executive Summary condense chaque candidat en « 1 page décision », le Portfolio Dashboard agrège N candidats en un tableau comparatif instantané.
⚡ Executive Summary — Vue « 1 Page Décision »
Affiché en premier dans l'onglet Synthèse RH, pour chaque candidat analysé :
Score Global Unique
Un seul chiffre synthétique intégrant toutes les dimensions analysées.
Catégorisation
PRÊT · À SURVEILLER · À RISQUE
3 Signaux Clés
Les 3 informations les plus importantes à retenir sur ce candidat.
Phrase Décisionnelle
Une recommandation unique et actionnable calibrée sur le profil.
📊 Portfolio Dashboard — Agrégation Multi-CV
Quand vous analysez plusieurs candidats, le Portfolio Dashboard offre une vue agrégée :
Tableau Catégorisé
Tri automatique : PRÊT / À SURVEILLER / À RISQUE avec médailles 🥇🥈🥉.
Métriques Globales
Score moyen, écart-type, répartition par catégorie, temps d'analyse total.
Comparaison Rapide
Vue en colonnes des dimensions clés pour chaque candidat, côte à côte.
🛡️ Protections Anti-Rétro-Ingénierie (V80)
Watermarks invisibles dans les rapports HTML
V80 intègre des watermarks invisibles dispersés dans le code HTML des rapports candidats. Le texte est fragmenté en spans avec du contenu invisible intercalé. Objectif : empêcher le copier-coller brut des analyses pour réutilisation frauduleuse tout en préservant la lisibilité à l'écran.
🎭 Portrait Standard Intégré (V80)
🆕 Dans l'onglet Analyse Standard, un Portrait Profiler complet est désormais intégré directement dans le rapport HTML de chaque candidat. Plus besoin de basculer sur le Profiler pour obtenir la synthèse narrative — elle est générée automatiquement si le module Portrait LLM est activé.
V80 — Pré-Analyse CV & Diagnostic Extraction
🆕 Nouveau en V80
Avant de lancer le Profiler, V80 analyse automatiquement chaque CV pour détecter les problèmes d'extraction (colonnes mélangées, texte illisible, layout fracturé) et produit un verdict pré-analyse indiquant si le CV est prêt pour une analyse fiable.
🩺 Les 4 Verdicts
| Verdict | Signification | Action |
|---|---|---|
| ✅ BON POUR ANALYSE | CV bien structuré, texte proprement extrait, toutes les sections détectées | Lancez le Profiler en confiance |
| 🟡 ANALYSE POSSIBLE | 1-2 points d'attention mineurs (titre absent, CV court) | Lancez le Profiler, résultats fiables avec réserves mineures |
| 🟠 DISCORDANCES MODÉRÉES | Problèmes d'extraction ou de structure (colonnes mélangées, peu de dates) | Vérifiez le rapport manuellement après analyse |
| 🔴 DISCORDANCES FORTES | Texte illisible, section XP absente, cumul de défauts | Demandez un CV au format texte avant de lancer |
📐 Détection de Layout
| Layout | Description | Cascade d'extraction V80 |
|---|---|---|
| STANDARD | CV 1 colonne (Word, Google Docs, LaTeX) | pdfplumber → extraction directe |
| COLUMN_MIX | CV 2-3 colonnes (Canva, Figma, Zety, CV Designr) | pdfplumber → OCR → Claude PDF Direct |
| FRACTURED | Layout graphique éclaté (PowerPoint, infographies) | pdfplumber → OCR (fitz/Tesseract) |
| CHARABIA | Polices custom (Illustrator, Photoshop aplati) | OCR → Claude PDF Direct |
🔧 Corrections Concordance V80-FIX
17 patches chirurgicaux corrigent les faux positifs de la concordance Phase 1 :
| Patch | Bug corrigé | Impact |
|---|---|---|
| P1 | ong sans word boundary | Mots contenant "ong" (strong, long) ne déclenchent plus "Volontariat" |
| P2 | via trop permissif | "via" comme préposition ne déclenche plus "VIE/VIA" |
| P3 | freelance = gap emploi | Activité freelance/startup en cours ≠ trou de carrière |
| P4 | Congé maternité inversé | "CDD remplacement congé maternité" ≠ congé du candidat |
| P5 | internship dans langues | "internship in Hamburg" dans section langues ≠ formation |
| P6-P8 | Détection COLUMN_MIX | CV multi-colonnes : diagnostic + cascade OCR/Claude |
| P9 | Tag [EXTRAIT PAR...] polluant | Nettoyé avant concordance regex (ne pollue plus les 800 premiers chars) |
| P10 | Prompt Claude PDF trop restrictif | Claude lit maintenant les CV ET les tests de personnalité |
| P11-P12 | Langue OCR fixe | Détection auto fra/eng/fra+eng pour OCR Tesseract adaptatif |
| P13-P14 | Verdict pré-analyse absent | Diagnostic extraction + verdict BON/DISCORDANCES dans readiness |
| P15-P17 | Verdict non affiché | Verdict visible dans le tableau récap, le run et le rapport HTML |
📥 Tableau Récap dans la Section Export
Dans la section 📥 Exporter la Pré-Analyse de l'onglet Profiler, un tableau Streamlit récapitule tous les CV avec :
Ligne résumé : Diagnostic pré-analyse : ✅ 15 bon(s) — 🔴 2 risqué(s) — 📐 3 CV graphique(s)
Colonnes du tableau :
- 📄 CV — nom du fichier
- 🩺 Verdict — ✅ BON / 🟡 POSSIBLE / 🟠 MODÉRÉ / 🔴 RISQUÉ
- 🎯 Score — score de fiabilité Profiler (%)
- 📐 Format — détail du type de CV : standard, multi-colonnes (Canva/Figma), graphique (Illustrator/PowerPoint)
- 🌐 Langue — FR / EN / MIX
- ⚠️ Alertes — titre absent, contact manquant, OCR utilisé, etc.
Alertes automatiques :
- 🔴 Bannière rouge si des CV ont des discordances fortes
- 📐 Bannière bleue si des CV graphiques ont été détectés
👁️ Où Voir le Verdict
Pendant le Run
Chaque CV analysé affiche : 📋 Fiabilité CV: 72% — ✅ BON POUR ANALYSE
Tableau Récap
Expander "📊 Détail Compatibilité" : colonne 🩺 VERDICT + Layout + Langue + Alertes
Alertes Streamlit
Bannières 🔴/🟠/✅ automatiques si des CV posent problème
Rapport HTML
Le verdict est intégré dans chaque fiche candidat du rapport exportable
Section 📥 Export
Tableau récap complet avec format CV (graphique/standard), langue et alertes détaillées
🌐 Détection de Langue
V80 détecte automatiquement la langue du CV (FR, EN, MIX) en comptant les marqueurs linguistiques. L'OCR Tesseract s'adapte : fra pour les CV français, eng pour les CV anglais, fra+eng pour les bilingues. Cela améliore significativement la qualité d'extraction sur les CV internationaux.
V80 — Réconciliation Concordance → Profiler
Nouveau en V80 — Rétro-correction automatique
Quand la concordance CV ↔ Profiler est inférieure à 80%, V80 lance une boucle de correction automatique via LLM. Le Profiler corrige ses propres divergences en s'appuyant sur le texte brut du CV. Résultat : le score de concordance passe typiquement de ~48-60% à >90%.
⚙️ Comment ça Fonctionne
Détection divergences
Le score de concordance est calculé (Phase 1 regex + Phase 2 LLM optionnel). Si score < 80% → la réconciliation se déclenche.
V80_RECONCILIATION_THRESHOLD (défaut : 80%).Prompt chirurgical
Un prompt Sonnet ciblé (~800 tokens in, ~500 tokens out, ~3-5 secondes) analyse les divergences détectées par rapport au CV brut.
Patches structurés
Le LLM produit des patches au format structuré : SET (remplacer), APPEND (ajouter), REPLACE (substituer), DELETE (supprimer) — appliqués sur le dictionnaire Profiler.
Recalcul et validation
Après application des patches, la concordance est recalculée. Les sous-pipelines identité/audit/psycho/compétences sont ré-exécutés pour cohérence complète du pipeline.
📊 Résultats Typiques
Avant réconciliation
Score concordance : 48-60%. Divergences sur les hard skills, langues, certifications non détectées.
Après réconciliation
Score concordance : >90%. Les compétences manquantes sont ajoutées, les faux positifs corrigés.
Badge HTML
Badge + détail intégrés dans l'onglet Concordance du rapport. Score original → score final visible.
🛡️ Kill Switch
Contrôle total
La réconciliation peut être désactivée ou son seuil ajusté. Si le score est déjà ≥ 80%, elle ne se déclenche pas (économie d'un appel API). Le coût additionnel est d'environ ~$0.01-0.02 par CV réconcilié (prompt court sur Sonnet).
V80-AH — Anti-Hallucination
Pourquoi ?
Les LLM peuvent inventer des compétences, surestimer des scores. Le V80-AH détecte et corrige avant le rapport final. Badge de Fidélité CV sur chaque rapport.
🔧 Les 10 Patches
P1 — Hard Skills
Vérification dans le texte brut. Skills hallucinées retirées.
P2 — Langues
40+ langues, extraction CECRL. Langues manquées ajoutées.
P3 — Certifications
Vérification CV brut. Non retrouvées = signalées.
P4 — QE
Calibration croisée NeuroProfiler + marqueurs émotionnels.
P5 — Scores Extrêmes
Recalibration apprentissage/plasticité si aberrant.
P6 — Identité
Nom + expérience croisés LLM vs NeuroProfiler.
P7 — Métiers Suggérés
Vérification : métiers basés sur skills hallucinées = avertissement.
P8 — Big Five Cross
Divergences >30pts LLM vs NeuroProfiler signalées.
P9 — DISC Cross
Comparaison profil DISC dominant LLM vs Neuro.
P10 — Score Fidélité
Composite pondéré → badge 🟢🟡🟠🔴
🏷️ Badge de Fidélité CV
| Badge | Score | Interprétation | Action |
|---|---|---|---|
| 🟢 Haute | ≥ 85% | Très cohérent avec le CV brut | Confiance élevée |
| 🟡 Correcte | 65-84% | Ajustements mineurs | Vérifier sections signalées |
| 🟠 Modérée | 50-64% | Plusieurs corrections | Relire attentivement |
| 🔴 Faible | < 50% | Divergences majeures | CV mal extrait ou atypique |
France Travail, La Bonne Boîte & Métiers Prédictifs
🔍 Recherche Emploi — Mode CV Brut
Sans Profiler. L'app détecte les codes ROME depuis le CV → filtres géo/contrat/expérience → résultats matchés.
🧠 Recherche Emploi — Mode Profil Analysé
Après le Profiler : matching sémantique avancé sur toutes les dimensions (40% compétences, 25% expérience, 20% secteur, 15% soft skills).
🏢 La Bonne Boîte
C'est quoi ?
Service France Travail qui prédit les entreprises qui recruteront prochainement, même sans offre publiée. Idéal candidatures spontanées.
Sélectionnez un code ROME + zone géo → liste d'entreprises avec score de recrutement (0-5 étoiles), secteur NAF, taille, coordonnées complètes.
🔮 Métiers Prédictifs
Top 5 Actuels
Métiers les plus adaptés au profil actuel avec score + justification.
Horizon 2025-2027
Métiers émergents + prérequis à développer.
Horizon 2028-2030
Métiers de demain + transformation nécessaire.
IA-Augmentés
Postes où l'IA amplifie les compétences du candidat.
📍 Positionnement Marché
Top 10 Régions
Régions les plus porteuses pour le profil.
Top 10 Entreprises
Entreprises compatibles : compétences, culture, géo.
Stratégie d'Approche
Timing optimal, top 3 meilleure symbiose.
🏢 Test 3 Entreprises
Entrez 3 noms d'entreprises → matrice de symbiose sur 6 dimensions : Personnalité vs Culture, Valeurs, Management, Autonomie, Rythme, Reconnaissance (scores 40-95).
Compatibilité Équipe & Top 10
🎛️ 3 Modes d'Analyse
Mode Rapide
2 candidats + 1 type de relation. Résultat en secondes.
Mode Exhaustif
20 types de relations analysés entre 2 candidats.
Mode Avancé
Multi-paires CV/relation configurables.
🤝 20 Types de Relations
📊 6 Dimensions de Compatibilité
| Dimension | Analyse |
|---|---|
| 🧩 MBTI | Combinaison des types (ex: INTJ + ENFP) |
| 🎨 DISC | Profils croisés avec logique optimisée |
| 🎯 Motivations | Alignées, complémentaires ou divergentes |
| 👔 Management | Style offert vs recherché |
| ⚡ Rythme | Compatibilité intensité de travail |
| 💬 Communication | Direct/indirect, formel/informel |
🏆 Top 10 Meilleures Compatibilités
Classement auto avec médailles 🥇🥈🥉 + scores colorés + verdict + scénario idéal. Inclus dans les rapports HTML.
NeuroProfiler V7.3 — 38+ Dimensions Psychométriques
Gating par Plan (V80)
Essentiel : Big Five/OCEAN + RIASEC + Portrait candidat. Pro : + Dark Triad + HPI/TDAH/DYS. Expert : + PANAS/DASS-21 + Stroop Cognitif + Synthèse RH Pro (batterie complète 38 dimensions).
🧠 Profil Cognitif
- Potentiel Analytique (indicateur HPI)
- Dynamisme Cognitif (indicateur TDAH)
- Focus Spécialisé (indicateur TSA)
- Complexité Cognitive
- Learning Agility
🎭 Big Five (OCEAN)
- Ouverture / Curiosité
- Conscience / Rigueur
- Extraversion / Sociabilité
- Agréabilité / Empathie
- Stabilité Émotionnelle
🎯 RIASEC
- Réaliste / Investigateur / Artistique
- Social / Entreprenant / Conventionnel
- 9 Priorités Professionnelles
🎨 DISC Optimisé
- D — Dominant (Rouge) : leadership
- I — Influent (Jaune) : communication
- S — Stable (Vert) : équipe, harmonie
- C — Consciencieux (Bleu) : analyse
Indicateurs HPI/TDAH/TSA : Usage Responsable
Indicateurs exploratoires uniquement. PAS un diagnostic médical. JAMAIS un critère de sélection ou d'exclusion.
📥 Tests Supportés
AssessFirst
Shape, Drive, Brain — extraction complète.
DISC
D/I/S/C — règles BLEU analytique / VERT coopératif.
MBTI
16 types — mapping automatique.
Big Five / MyPrint
Scores OCEAN directs.
V71 — Aide à la Décision
Du descriptif au prescriptif
Écran décisionnel lisible en 3 secondes, recommandations actionnables, sparring recruteur.
⚡ Écran Décisionnel
Lisibilité Marché (/10)
Facilité de lecture du profil par un recruteur standard. ≠ valeur du profil. 7 critères pondérés.
Bandeau Lecture Rapide
3 indicateurs : cohérence ✔/⚠/🔴, focalisation ✔/⚠, risque sous-exploitation.
Phrase Actionnable
Une seule recommandation calibrée sur le profil.
📊 3 Curseurs Simplifiés (Mode RH)
| Curseur | Échelle | Mesure |
|---|---|---|
| 🧠 Complexité | Opérationnel ↔ Stratégique | Raisonnements complexes + HPI |
| 📏 Norme | Conforme ↔ Atypique | Sigma, authenticité, flexibilité |
| 👥 Influence | Support ↔ Leadership | Alpha, extraversion, Beta inverse |
🔍 Angles Morts
Ce que le profiler ne peut pas capter à partir du seul CV. Fiches standardisées : Indicateur → Score → Cause UX → Risque business → Recommandation → Niveau écart.
📋 Maturité Managériale (/20)
Lucidité (/5)
Capacité à nommer ses angles morts.
Humilité (/5)
Reconnaître les limites, valoriser le collectif.
Résilience (/5)
Assumer les coûts et rebondir.
Vision (/5)
Projection constructive à moyen terme.
🎙️ Sparring Recruteur (12 Questions)
Bloc A — Cohérence
Positionnement, lucidité, patterns toxiques.
Bloc B — Valeur ajoutée
Anticipation, positionnement en crise.
Bloc C — Risques
Angles morts, lignes rouges, prix personnel.
Bloc D — Projection
Onboarding, KPI, contribution invisible à 12 mois.
🏷️ 3 Niveaux d'Offre
| Niveau | Quand | Cible |
|---|---|---|
| ⚡ EXPRESS | Lisibilité ≥7/10, profil focalisé | Tri rapide |
| 🔍 AUGMENTÉ | Lisibilité 4.5-7/10, Sigma modéré | Profils complexes |
| 🎯 STRATÉGIQUE | Lisibilité <4.5/10, atypique | Cadres dirigeants |
PIPO Detector — 5 Couches
Détection des CV gonflés, mensongers ou générés par IA. Le PIPO ne dit pas "ce candidat ment" — il dit "voici les points à vérifier, et comment".
🔍 Les 5 Couches
L1 — Linguistique
98 marqueurs de vocabulaire flou. Calibré par expérience.
L2 — Chronologique
Gaps, chevauchements, inflation temporelle, dates impossibles.
L3 — Sur-dimensionnement
Budget incohérent, titre C-level sans vocabulaire stratégique.
L4 — IA Renforcée
182+ marqueurs ChatGPT, homogénéité de style, absence d'idiolect.
L5 — Questions Recruteur
Chaque alerte → question d'entretien ciblée + méthode vérification.
🚦 Niveaux de Vigilance
| Niveau | Score | Action |
|---|---|---|
| 🟢 RAS | < 5 | Procéder normalement |
| 🟡 À vérifier | 5-14 | Questions ciblées en entretien |
| 🟠 Vigilance | 15-29 | Vérifier diplômes + références |
| 🔴 Alerte | ≥ 30 | Vérification complète obligatoire |
⚖️ Base Juridique
Art. L1221-6 : Le candidat est "tenu de répondre de bonne foi". Présenter son CV "sous un jour flatteur" n'est PAS frauduleux. Seul mensonge DÉCISIF + incompétence PROUVÉE = licenciement.
V80 — ML Supervisé, Croisements 2D/3D/4D, SIRENE, Industriel
🤖 PipoMLScorer
RandomForest (200 arbres)
Scoring ensemble : 60% règles + 40% ML. max_depth=12. Cross-validation 5-fold avec MAE.
30+ Features + 5 dérivées
Métriques V80 + features croisées. Feature importance + explainability humaine.
IsolationForest
Détection outliers (5% contamination). Auto-calibration seuils par percentiles (P75/P85/P92/P97).
Save/Load & Model Card
Export modèle pickle. Model card intégrée pour transparence et audit. Fallback graceful si sklearn absent.
🔗 Croisements 4D
| # | Dimensions | Détecte |
|---|---|---|
| 4D #1 | Secteur × Génération × Géo × PIPO | Patterns sectoriels suspects |
| 4D #2 | Géo × Secteur × AI × Entreprises | CV fabriqué de A à Z |
| 4D #3 | Niveau × Secteur × SIRENE × PIPO | Parcours senior fabriqué |
| 4D #4 | HPI × Génération × Style × Secteur | CV rédigé par un tiers |
| 4D #5 | Géo × Génération × XP × Secteur | Consultant permanent suspect |
🔗 Croisements 3D
| # | Dimensions | Détecte |
|---|---|---|
| 3D #1 | Secteur × Génération × PIPO | Junior tech + PIPO = suspect ×3 |
| 3D #2 | Géo × Secteur × Style | Québécois startup + anglo = normal ×2 |
| 3D #3 | Neuro × Secteur × Niveau | HPI dirigeant R&D = archi-normal |
🔗 Croisements 2D (8 axes)
8 croisements double-axe incluant : Parcours × Génération, Géo-Culturel × Style, Neuroatypique × Fonction, et 5 autres combinaisons calibrées. Ces croisements atténuent les faux positifs en contextualisant les scores PIPO selon les paramètres du candidat.
🏢 API SIRENE / INSEE
Vérification automatique : existence SIREN, état (active/cessée), cohérence NAF + effectifs vs management revendiqué.
🏭 Compétences Industrielles (200+)
Automation & SCADA
SCADA, DCS, PLC, Siemens, Modbus, MES...
Maintenance
GMAO, AMDEC, TPM, Lean, Six Sigma, PDCA...
HVAC & Énergie
CVC, PAC, RE2020, chaudières, biomasse...
Normes
ISO, ATEX, ICPE, Seveso, HACCP, IFS...
🌍 Profils Géo-Culturels
| Profil | Ajustement |
|---|---|
| 🇨🇦 Québec | Tolérance anglicismes +50% |
| 🇲🇦 Afrique du Nord | Bi/trilinguisme attendu |
| 🇨🇭 Suisse | Formalisme élevé, multi-langues |
| 🇧🇪 Belgique | Bilinguisme FR/NL attendu |
| 🌍 Afrique subsaharienne | Formalisme +8, parcours internationaux |
Exports HTML
📊 Boutons d'Export
| Onglet | Bouton | Destinataire | Contenu |
|---|---|---|---|
| Standard | Recruteur | RH | Analyse complète + alertes |
| Standard | Candidat | Candidat | Version sans infos sensibles |
| Profiler | Recruteur | RH | Profil psychométrique complet |
| Profiler | Candidat | Candidat | Profil adapté |
| Profiler | Pré-Analyse | RH | Fiches candidats + synthèse |
| Profiler | Compatibilité | RH | Matrice + Top 10 |
| France Travail | Offres | Tous | Offres matchées |
| Bonne Boîte | Entreprises | Tous | Fiches entreprises |
| Standard | Analyse 360° FdP | RH | 🆕 Diagnostic complet fiche de poste avec score et recommandations |
| Standard | Anti-Fraude PDF | RH | 🆕 V80 : Détection texte blanc, micro-polices, mots-clés ATS cachés |
| Standard | Score Authenticité | RH | 🆕 V80 : Score 0-100 avec 5 composantes (similarité, IA, ghost skills, inflation, fraude PDF) |
🔒 Protections Anti-Copie
- Watermarks uniques (NP68-XXXX-HASH)
- 5 variantes de termes par dimension
- Codes profils dynamiques
- Filigrane invisible à l'impression
- 🆕 V80 : Watermarks invisibles dispersés dans le HTML
- 🆕 V80 : Texte fragmenté en spans avec contenu invisible intercalé
- 🆕 V80 : Anti-rétro-ingénierie des rapports candidats
- 🆕 V80 : Rapports HTML brandés avec logo et couleurs société
- 🆕 V80 : Score Anti-Fraude PDF intégré dans chaque rapport
- 🆕 V80 : Score Authenticité CV avec diagnostic 5 axes
Messages d'Erreur & Solutions
🔴 Onglet Standard
❌ FICHE DE POSTE MANQUANTE
Vous avez cliqué "Analyser" sans fiche de poste.
❌ MÉTIER NON SÉLECTIONNÉ
Pas de métier détecté ou sélectionné.
❌ AUCUN CV CHARGÉ
🔴 Onglet Profiler
❌ AUCUN CV SÉLECTIONNÉ
🔴 France Travail
❌ ERREUR CONNEXION API
❌ AUCUN RÉSULTAT
🟡 Avertissements (non bloquants)
| Message | Signification | Action |
|---|---|---|
| ⚠️ Texte trop court | PDF probablement scanné | Utilisez un PDF texte |
| ⚠️ CVs >25000 car. | CVs longs tronqués | Normal, analyse correcte |
| ⚠️ Sans test, ~65% | Pas de test associé | Ajoutez des tests |
| ⚠️ OCR activé | PDF image détecté | Patientez, traitement plus long |
RGPD & AI Act
📜 Code du Travail
Art. L1221-6 : Informations "lien direct et nécessaire" avec l'emploi. Candidat tenu de bonne foi.
Art. L1221-9 : Candidat informé préalablement des méthodes de recrutement.
🔒 RGPD
Base légale
Intérêt légitime (Art. 6.1.f), PAS consentement.
Conservation
2 ans max pour CV non retenus (CNIL 2023).
Droits candidat
Accès, rectification, suppression, explication.
Art. 22 RGPD
Aucune décision automatisée. Recruteur = dernier mot.
🇪🇺 EU AI Act
Classification : HIGH-RISK (Annexe III, 4a)
Systèmes IA de recrutement. Deadline : 2 août 2026.
✅ Respecté : Supervision humaine, transparence, documentation technique (54 000+ lignes).
🔄 En cours : Audit biais/non-discrimination, AIPD, Marquage CE + inscription EU.
🚫 Pratiques Interdites (depuis fév. 2025)
| Pratique | Statut |
|---|---|
| Reconnaissance d'émotions | ✅ NON CONCERNÉ — Texte uniquement |
| Catégorisation biométrique | ✅ NON CONCERNÉ — Pas de biométrie |
| Scoring social | ✅ NON CONCERNÉ — Scoring pro |
📊 Limites Connues
Ne détecte pas les mensonges factuels
PIPO = signaux de risque, pas preuve.
Ne remplace pas l'entretien
Premier filtre lexical uniquement.
Sensible au format
PDF scan < PDF texte. OCR disponible mais imparfait.
Biais longueur/vocabulaire
CV long et bien rédigé → score plus haut. Calibration atténue mais n'élimine pas.
FAQ
150 CVs + 150 tests par session.
PDF, DOCX, DOC, TXT, ODT. PDF texte recommandé. OCR PyMuPDF pour scans.
BLEU = analytique/méthodique (process, documentation). VERT = stable/coopératif (équipe, harmonie). Évite 85% des confusions.
API officielle. Mode CV Brut (codes ROME auto) ou Profil Analysé (matching sémantique avancé).
Prédit les entreprises qui recruteront dans les 6 mois, même sans offre. Signaux faibles : croissance, turnover.
Personne n'a 0% d'extraversion. Les baselines reflètent mieux la réalité et sont cohérentes avec les tests standardisés.
Non. Aide à la décision uniquement. Le Sparring V71 fournit 12 questions calibrées pour l'entretien.
Score /10 de lecture rapide du profil. PAS la valeur. Un T-shaped a une lisibilité basse mais une valeur haute.
6 checkboxes. Marché et Portrait nécessitent Profiler IA. Minimum : NeuroProfiler OU Profiler IA doit être coché. L'accès dépend du plan : Essentiel = 6 modules, Pro = 9, Expert = 16.
Analyse en cours (MM:SS temps réel). Passe en vert ✅ à la fin avec temps total et moyenne/CV.
Oui. Décochez tout sauf NeuroProfiler. ~2s/CV, local, Big Five, RIASEC, PIPO. Pas de profiler IA ni marché.
10 patches de validation LLM vs CV brut. Score fidélité pondéré : 🟢≥85% 🟡65-84% 🟠50-64% 🔴<50%.
Phase 1 regex (13 sections, 10 catégories, ~2s) avec filtres contextuels V80-FIX (congé maternité, freelance, via/ong, internship). Phase 2 LLM optionnel (audit sémantique, ~8s). Extraction dates unifiée 50+ formats FR/EN. 10 faux positifs éliminés sur le corpus de test.
Avant de lancer le Profiler, V80 analyse le CV brut pour détecter les problèmes d'extraction (colonnes mélangées, texte illisible, dates absentes). Un tableau récapitulatif dans la section 📥 Export affiche le verdict (✅ BON / 🟡 POSSIBLE / 🟠 MODÉRÉ / 🔴 RISQUÉ), le type de format détecté (standard, Canva, Illustrator...) et les alertes détaillées par CV.
Demandez au candidat un CV au format Word ou PDF texte. Les CV créés avec Photoshop/Illustrator (texte aplati) ou les CV très graphiques multi-colonnes posent problème. Si Tesseract est installé, l'OCR peut récupérer le contenu. Sinon, le fallback Claude PDF Direct tente de lire le document.
Les CV Canva/Figma/Zety à 2-3 colonnes. pdfplumber extrait le texte mais mélange les colonnes (la section Expérience et la section Compétences se retrouvent entrelacées). V80 détecte ce cas et bascule sur OCR ou Claude PDF Direct pour un meilleur ordre de lecture.
Un CV mentionnant "CDD remplacement congé maternité" déclenchait le détecteur de trous. Mais c'est le congé de la personne remplacée, pas du candidat. V80-FIX vérifie le contexte autour du match (remplacement, CDD, intérim) et filtre les faux positifs.
Dès le chargement du fichier, Claude analyse la fiche en profondeur : détection du type de document (FdP vs CV), score qualité /100, 7 axes d'analyse (informations, missions, profil, rémunération, process, attractivité, inclusivité), forces/faiblesses, recommandations. Export HTML avec branding. Cache protégé par hash MD5.
Vue « 1 page décision » pour DRH pressé. Score global unique + catégorisation PRÊT/À SURVEILLER/À RISQUE + 3 signaux clés + phrase décisionnelle. Affiché en premier dans la synthèse RH.
Agrégation multi-CV : tableau catégorisé avec médailles, métriques globales (moyenne, écart-type, répartition), comparaison côte à côte. Préparation logique B2B/SaaS.
Chaque PDF est traité en parallèle par extraction texte (pdfplumber/pypdf) ET OCR (fitz/tesseract). Un diagnostic qualité compare les deux résultats et sélectionne automatiquement le meilleur. Détecte : CHARABIA, FRACTURED, COLUMN_MIX, CV scannés.
Les rapports HTML candidats contiennent des watermarks invisibles et du texte fragmenté en spans avec contenu invisible intercalé. Empêche le copier-coller brut pour réutilisation frauduleuse. Invisible à l'écran.
Le Portrait Profiler est désormais intégré directement dans le rapport HTML de l'onglet Standard. Plus besoin de basculer sur le Profiler. Activé automatiquement si le module Portrait LLM est coché.
Oui, V80 permet d'analyser uniquement la fiche de poste sans charger de CV. Utile pour valider la qualité avant publication.
Bring Your Own Key. Vous créez un compte sur console.anthropic.com, générez une clé API, et la collez dans la sidebar. C'est vous qui payez directement Anthropic. TDJ Solutions n'a aucun accès à votre consommation.
Variable selon le plan : Essentiel $0.35→0.80 (6 modules), Pro $0.50→0.90 (9 modules), Expert $0.90→1.60 (16 modules). Le NeuroProfiler seul est gratuit (100% local). Sans clé API, seul le mode regex fonctionne (3 000+ marqueurs, 0€).
Bouton 🩺 dans la sidebar. Envoie "Réponds OK" (5 tokens) à 5 modèles : Haiku 4.5, Sonnet 4.5, Sonnet 4.6, Opus 4.5, Opus 4.6. Affiche latence + état (🟢/🟡/🟠/🔴). Coût ~$0.004. Propose des fallbacks si un modèle est surchargé.
Non, c'est complémentaire. PIPO détecte le langage flou et les incohérences (5 couches, 182+ marqueurs). Le Score Authenticité détecte le sur-tailoring IA : CV copié-collé depuis la JD, buzzwords ChatGPT, ghost skills, fraude PDF. Les deux scores sont indépendants.
Texte blanc/invisible (rgb 255,255,255), micro-polices 1-2pt, mots-clés ATS cachés hors zone visible. Ce sont des techniques utilisées pour tromper les ATS automatiques. Le score fraude est intégré dans le Score Authenticité global.
Essentiel (99€/mois) = analyse CV Standard via Sonnet 4.6, Big Five/RIASEC, contrôles qualité, portrait candidat. Pro (299€/mois) = + anti-fraude PDF, authenticité, Profiler Prédictif IA, concordance, Dark Triad, HPI/TDAH/DYS, rapport individuel, Opus 4.5. Expert (799€/mois) = tout illimité + Portrait LLM, PANAS/DASS/Stroop, §5/§6/§7, marché, compatibilité, portfolio ∞, executive summary, white-label, SIRENE, support dédié 24/7.
Non. Les surcharges Anthropic (erreur 529) sont fréquentes aux heures de pointe. 5 tentatives avec backoff exponentiel (10s→20s→40s→70s→80s = 220s max) permettent de passer la plupart des pics sans échec. Le test de charge en sidebar vous prévient avant de lancer.
Page de connexion avec sélection de profil et mot de passe hashé bcrypt. Chaque utilisateur a un plan (Essentiel/Pro/Expert), un tenant_id unique et un rôle (user/admin). Le panel admin permet de créer, modifier et supprimer des comptes. Limites par plan : 20 comptes Essentiel, 40 Pro, 50 Expert.
Quand le score concordance CV ↔ Profiler est < 80%, un appel LLM chirurgical (~3-5s, ~$0.01) détecte et corrige les divergences. Le Profiler est patchté automatiquement (hard skills, langues, certifications manquantes). Le score passe typiquement de ~48% à >90%. Kill switch configurable.
Essentiel : Big Five/OCEAN + RIASEC + Portrait candidat. Pro : + Dark Triad + HPI/TDAH/DYS. Expert : + PANAS/DASS-21 + Stroop Cognitif + Synthèse RH Pro. Soit 38 dimensions psychométriques au total pour Expert.
Oui. C'est l'intégralité du moteur en un seul fichier Python : NeuroProfiler (3 000+ marqueurs, 38 dimensions), Profiler IA (7 sections Claude), ML supervisé (RandomForest 200 arbres), anti-fraude (5 couches + fraude PDF), concordance hybride (regex + LLM + réconciliation), marché (France Travail + Adzuna + La Bonne Boîte), multi-tenant auth, feature gating, 16 types de rapports HTML. Architecture monolithique volontaire pour faciliter le déploiement Streamlit Cloud.
RandomForest 200 arbres. 60% règles + 40% ML. IsolationForest pour outliers. Fallback si sklearn absent.
API INSEE : existence SIREN, état actif/cessé, NAF vs profil, effectifs vs management revendiqué.
Oui. Aucun stockage. Tout effacé à la fermeture. Aide à la décision avec supervision humaine.
Oui. High-risk mais respecte : supervision humaine, transparence, documentation technique.
Non. Exploratoires uniquement. PAS un diagnostic. JAMAIS un critère de sélection.
MBTI, DISC, Big Five, RIASEC reconnus. ~65% sans test, 85-90% avec test. Validation terrain.
Mentionner l'IA dans la politique recrutement, mettre à jour le registre des traitements, informer les candidats, former les utilisateurs RH aux limites.