Grille de compétences pour constituer une équipe IA (2/3)
Six axes de compétence non compensables, cinq niveaux ancrés sur l'état de l'art, quatre profils types — grille versionnée pour constituer une équipe IA.
Ce « référentiel » est le deuxième volet d’un triptyque consacré à la question de la composition d’équipe IA dans les organisations : le diagnostic macro propose une lecture globale avec l’objectif d’expliquer les difficultés à constituer une équipe pertinente, le plan d’action fournit une approche concrète pour créer cette équipe, cette grille de compétences s’y adosse.
En bref : six axes de compétence non compensables, cinq niveaux ancrés sur l’état de l’art plutôt que dans l’absolu, quatre profils types. Le niveau 3 sert de seuil d’évaluabilité et d’ancre à toute l’échelle.
C’est une v0 utilisable, datée du mois d’août 2026 et évolutive (tous les six mois).
Cette version est déjà une révision : une version antérieure avec une échelle de 0 à 20 unique pour tous les publics a été expérimentée. Trop proche d’une notation scolaire, elle n’a pas tenu. Comme s’il était utile d’avoir l’endurance du marathonien pour aller acheter une baguette au coin de la rue. Or pour construire une équipe, il faut des profils composites et non un mouton à 5 ou 10 pattes. Cette grille ne répond donc pas à la question « quel est le meilleur profil » mais « quelle équipe est la plus adaptée pour répondre aux défis de mon organisation ».
Ce sont les raisons pour lesquelles j’aboutis à une grille de six axes non compensables et quatre profils distincts plutôt qu’une note unique.
Pour construire une équipe, il faut des profils composites et non un mouton à 5 ou 10 pattes.
1. Les six axes
| Axe | Ce qu’il mesure |
|---|---|
| 1. Stratégie | Savoir quand utiliser l’IA, sur quel problème, et pourquoi celui-là plutôt qu’un autre |
| 2. Spécification et conception technique | Formuler ce que la machine exécute, et construire ce qui le permet : prompting, orchestration, conception d’outils et serveurs MCP (Model Context Protocol), gestion du contexte, garde-fous |
| 3. Déploiement organisationnel | Faire que l’IA vive dans le processus réel, pas dans un onglet séparé d’un navigateur internet |
| 4. Jugement critique | Distinguer un résultat solide d’un résultat plausible ; détecter hallucinations, complaisances et dérives |
| 5. Vision systémique | Comprendre comment l’IA transforme le secteur, la chaîne de valeur et les règles du marché |
| 6. Littératie données | Savoir dire si un gisement de données peut porter un usage IA, et ce qu’il faudrait pour qu’il le puisse |
Notes de délimitation
Les axes 2 et 3 sont souvent confondus. Le déploiement, au sens organisationnel, porte sur l’insertion dans les processus humains ; la plomberie technique (orchestration, appels d’outils, chaînage) relève de l’axe 2. L’usage d’un serveur MCP est de la conception technique.
L’axe 6 est une compétence, pas un état de l’organisation. « Avoir des données propres » n’est pas un axe. Savoir qualifier un gisement en est un, et c’est un jugement, donc c’est mesurable chez une personne.
L’axe 6 ne crée pas de rôle. Il contraint les quatre profils sans en générer un cinquième (voir plus bas). Faire du data steward un profil conduirait à réécrire l’organigramme, puis on me demanderait un DPO, puis le RSSI, puis l’architecte de données… et on embarque tout le jeu des 7 familles. Les fonctions data préexistantes ne sont pas redécrites ici (voir §9).
Télécharger la fiche de synthèse en PDF — grille et plan d’action en deux pages, à usage COMEX, DRH, DSI.

2. L’échelle
Cinq niveaux, définis par rapport à l’état de l’art et non dans l’absolu. Le 3 est l’ancre.
| Niveau | Nom | Définition |
|---|---|---|
| 1 | Notion | Reconnaît le vocabulaire, sait que ça existe. Ne peut ni faire ni juger |
| 2 | Pratique datée | Sait faire, avec les méthodes de la version précédente. Le résultat fonctionne, un pair le trouverait dépassé |
| 3 | État de l’art | Fait ce que fait un praticien courant compétent aujourd’hui. Peut évaluer le travail d’autrui sur cet axe |
| 4 | Avancé | Fait ce qui deviendra courant dans quelques semaines. Sait arbitrer entre approches concurrentes non encore stabilisées |
| 5 | Déplace l’ancre | Ce qu’il fait devient l’état de l’art des autres dans quelques mois. |
Deux propriétés structurantes.
Le 3 est le seuil « d’évaluabilité ». C’est ce qui en fait le pivot de tout le modèle : les seuils de la matrice (§6) en découlent directement.
Le 5 est défini comme ce qui déplace la référence. Sa rareté tient à sa définition, non à la sévérité de l’évaluateur. On n’y « monte » pas, on y contribue.
Les niveaux 1 et 2 décrivent des individus, jamais des exigences de poste. Ils servent au diagnostic.
3. Versionnement plutôt qu’ancre flottante
L’état de l’art bouge. Deux façons de le prendre en compte mais une seule fonctionne.
-
Ancre flottante, rejetée. Si 3 signifie « état de l’art à l’instant t », un 3 de 2026 et un 3 de 2027 ne sont pas le même seuil. La progression d’une personne devient invisible, absorbée par le déplacement de l’ancre (les compétences de prompt engineering d’il y a 2 ans sont beaucoup plus répandues aujourd’hui). Comme message stratégique c’est efficace ; comme instrument de développement c’est injuste.
-
Échelle versionnée, retenue. L’échelle est fixe à l’intérieur d’une version ; la version est datée et révisée par axe selon sa cadence propre (mon niveau 3 en spécification technique de 2024 vaut un niveau 2 en 2026, si je n’ai pas continué à me former). On conserve la comparabilité dans une version, et l’on devient explicite sur ce qui a bougé entre deux (nouvel écosystème, nouveaux outils, nouveaux concepts…).
C’est le modèle des guides d’examen professionnels : critère fixe à un instant donné, révision par paliers annoncés.
Cadences par axe
| Régime | Axes | Cadence | Ancrage |
|---|---|---|---|
| Rapide | 2 (Spécification et conception technique) | 12 mois | Étalon externe (§6) |
| Lent | 1, 3, 5, 6 | 3 ans | Revue interne |
| Invariant | 4 (Jugement critique) | Sans objet | n/a |
Un seul axe bouge vite, et c’est le seul pour lequel un étalon externe existe. Les cinq autres n’ont pas de certification parce qu’ils n’en ont pas besoin. Le référentiel est donc ancré à l’extérieur là où il dérive, à l’intérieur de l’organisation là où il est stable. Cette asymétrie des cadences est ce qui rend la gestion prévisionnelle des compétences difficile sur ce périmètre.
Cas de l’axe 4. Le jugement critique ne se périme pas : c’est un savoir tacite. La capacité de juger reste ; c’est ce sur quoi elle s’exerce qui change. Le traiter comme les autres serait une erreur de nature, pas de calibrage.
Réserve connue. L’axe 2 contient des éléments lents (garde-fous, gouvernance technique, architecture des flux) soumis ici à une cadence qu’ils ne méritent pas. Approximation assumée en v0.
4. Étalonnage du niveau 3
L’organisation choisit son étalon. Une certification éditeur en cours de validité, accessible à l’organisation, couvrant l’axe 2. Le programme de certification Anthropic (Claude Certified Architect, Foundations), par exemple, convient ; les équivalents des autres fournisseurs ou un certificat d’une structure reconnue également. Le choix appartient à l’organisation, pas à ce référentiel (ça serait incohérent de se certifier sur les outils d’Anthropic alors que votre entreprise utilise Copilot).
Deux limites à poser explicitement.
Une certification éditeur ancre sur un produit, pas sur l’état de l’art en général. Une certification obtenue via un examen Claude signifie « au niveau courant avec Claude ». Les scores ne sont donc pas comparables entre organisations qui n’ont pas retenu le même étalon. C’est un instrument interne, pas un référentiel de marché (ça n’est pas la prétention de cette grille).
Une certification ne peut objectiver que le niveau 3, l’état de l’art. Ces examens sont à référence : on réussit en atteignant un standard fixe. Un standard fixe produit un booléen (oui/non) par rapport à un seuil de compétence courante, il ne peut pas distinguer ce qui est en avance ou ce qui déplace la référence.
Les cinq autres axes n’ont pas d’étalon externe. Leur niveau 3, l’état de l’art, se calibre par revue qu’on peut confier aux experts internes, contre les descripteurs de §7.
5. Régimes de preuve
Chaque niveau a son propre cadre de comparaison. C’est ce qui évite à l’auteur du référentiel d’avoir à décréter l’état de l’art.
| Niveau | Cadre | Preuve |
|---|---|---|
| 1–2 | Interne | Observation managériale |
| 3 | Externe | Certification en cours de validité, ou revue interne appuyée sur une description |
| 4 | Interne (la pratique de l’organisation d’accueil) | Artefact vérifiable plus écart constaté à la pratique interne |
| 5 | Marché | L’approche est reprise par des tiers (publication, adoption, essaimage) |
Les niveau 3, 4 et 5 se cumulent
Un niveau 4 suppose que le niveau 3 est acquis et vérifié à l’étalon, plus une avance sur la pratique interne. Un 5 suppose le 4, plus une reprise constatée à l’extérieur (conférences, publications, audience sur les réseaux sociaux spécialisés…).
Le 3 reste l’ancrage dur de toute l’échelle.
Régression apparente sur un axe qui bouge vite. Sur l’axe 2, l’échelle est révisée tous les douze mois (§3) : un 3 acquis à une version peut se retrouver sous le seuil à la version suivante sans que la personne ait perdu quoi que ce soit, c’est l’ancre qui a avancé, pas la compétence qui a reculé. Ne pas confondre régression réelle et déclassement par révision : le premier se corrige par de la pratique, le second se corrige par du temps.
Artefacts — ce qui compte comme preuve
Un artefact prouve une capacité. Le niveau 4 est une position. Une capacité ne devient une position que rapportée à un référentiel : le repo montre ce qu’on sait faire, il ne dit pas si c’est au-dessus de la pratique locale.
C’est ce qui rend l’artefact précieux : il « voyage ». Un niveau 4 déclaré chez un employeur s’escompte en changeant d’organisation ; l’artefact qui le sous-tend arrive intact et se réévalue à l’étalon local.
Quatre critères, cumulatifs :
- Ça a tourné pour quelqu’un d’autre. Un système utilisé par une personne qui n’en est pas l’auteur a franchi le seul mur qui compte.
- Il y avait une contrainte réelle (coût, latence, volume, conformité). Une démo sans contrainte a une puissance moindre.
- Les décisions sont lisibles. Pas seulement le résultat : ce qui a été écarté, et pourquoi.
- Il porte un verdict. Maintenu, ou archivé avec un constat explicite de ce qui n’a pas marché.
Le quatrième critère est le plus discriminant : un portfolio qui ne contient que des succès est un portfolio d’où l’évaluation est absente. Même s’il ne s’agit pas de mettre tout ce qui n’a pas fonctionné sur le dessus de la pile, les projets façonnent davantage par les obstacles dépassés et leurs cicatrices que s’ils sont encore sous blister.
L’artefact est fourni ou expliqué par l’impétrant, le niveau est attribué par l’organisation. Celui qui produit ne rend pas le verdict sur lui-même, c’est la même exigence d’indépendance que celle imposée à l’évaluateur. Précision sur cette question de « portabilité de l’artefact » : il ne s’agit pas de partir avec le code source de votre organisation. D’ailleurs, le code et les artefacts produits sur votre temps de travail avec les outils d’entreprise sont réputés propriété de l’entreprise quand vous êtes salarié et cédé à votre client dans la plupart des constats de prestation. En revanche, vous devez démontrer que vous êtes capable de reproduire quelque chose d’analogue ou d’entretenir votre propre portfolio avec vos propres artefacts, si vous êtes dans une position d’évalué. Et si vous êtes l’évaluateur, demander des preuves ou organiser des mises en situation.
Portabilité et décote
Un niveau 4 est « portable » entre organisations comparables sur l’axe concerné, et d’autant plus que le niveau 3 sous-jacent repose sur un étalon partagé. Entre deux distributeurs du même secteur, il y a transfert. Entre un distributeur et un laboratoire de frontière, il ne se transfère pas, non parce qu’il était faux, mais parce que l’étalon a changé. Ce que je fais avec Claude code, il me faudrait probablement quelques semaines pour atteindre le même niveau sur Codex, par exemple.
| Axe | Portabilité du 4 | Démontrable publiquement ? |
|---|---|---|
| 2 (Spécification et conception) | Élevée | Oui, repo, système en production |
| 4 (Jugement critique) | Élevée dans un domaine, faible entre domaines éloignés | Oui, analyses, post-mortem |
| 5 (Vision systémique) | Faible, sectorielle par nature | Oui, écrits, conférences, enseignement |
| 6 (Littératie données) | Moyenne | Difficilement, données propriétaires (par étude de cas) |
| 1 (Stratégie) | Moyenne | Difficilement, arbitrages confidentiels (par étude de cas) |
| 3 (Intégration organisationnelle) | Faible, située | Non |
Conséquence RH directe : le niveau 3 se recrute, le niveau 4 se recrute avec décote et se reconnaît pleinement sur place, le niveau 5 se repère de l’extérieur. Un plan de développement peut promettre une trajectoire d’un niveau 1 à un niveau 3 par la formation ; au-delà, il ne peut que créer les conditions pour qu’il puisse éclore.
Conséquence en entretien : un candidat au corpus public excellent peut avoir prouvé trois axes sur six. Les trois autres, ceux qui décident de sa capacité à opérer chez vous, ne se lisent que par le récit, la mise en situation et la vérification de références.

6. Les quatre rôles
| Rôle | Ce qu’il fait |
|---|---|
| Praticien | Le collaborateur « augmenté ». Utilise l’IA dans son travail quotidien, juge ses propres usages |
| Évaluateur | Construit les jeux de cas, mesure les dérives, dit si le système fonctionne. Signe le verdict |
| Concepteur | Bâtit les systèmes (agents, chaînes, garde-fous) et porte leur insertion dans les processus |
| Stratège | Arbitre les investissements, pilote la trajectoire, tranche ce qui mérite d’être déployé |
Matrice socle
Valable pour la majorité des organisations. Les tirets sont des non-contraintes assumées, pas des zéros.
| Axe | Praticien | Évaluateur | Concepteur | Stratège |
|---|---|---|---|---|
| 1 (Stratégie) | 2 | n/a | 3 | 4 |
| 2 (Spécification et conception) | 3 | 3 | 4 | 3 |
| 3 (Intégration organisationnelle) | 3 (*) | 3 | 4 | 3 |
| 4 (Jugement critique) | 4 | 4 | 3 | 3 |
| 5 (Vision systémique) | n/a | 3 | 3 | 4 |
| 6 (Littératie données) | 2 | 4 | 3 | 3 |
(*) à la maille du poste.
Aucun 5 dans le socle. Les 5 ne s’obtiennent que par modulation concurrentielle (§8). C’est le garde-fou contre la surenchère. Un « stratège » niveau 5 est probablement associé dans un cabinet de conseil, conférencier, auteur, enseignant ou animateur réseau social avec plus de 100 000 abonnés. Vous en avez ponctuellement besoin comme conseil, pas comme collaborateur.
Deux compétences nécessaires pour tous : le jugement critique et la littératie données. Aucune fonction ne peut s’en dispenser.
Règle de construction
- 3 sur tout axe dont le travail de la fonction dépend, c’est le seuil d’évaluabilité
- 4 sur le ou les axes qui définissent le métier, jamais plus de deux pour éviter de chercher des moutons à 5 pattes
- +1, plafonné à 5, sur les axes identifiés comme terrain concurrentiel (§8)
Un axe dont le travail ne dépend pas n’est pas évalué. Le 2 signifierait « en-dessous du seuil d’évaluabilité tout en étant requis », ce qui est contradictoire.
Notes de lecture
Praticien et concepteur diffèrent par l’échelle d’application, pas par le niveau. Sur l’axe 3, le praticien juge l’insertion de l’IA dans son poste ; le concepteur, dans le processus. Un praticien à 2 sur cet axe serait un copiste (ce que j’appelais plus haut « l’usage dans un onglet séparé ») ce qui est le premier plateau documenté, pas un niveau acceptable.
L’axe déterminant du praticien est le jugement critique, pas le prompting. Quelqu’un qui utilise l’IA toute la journée sans distinguer une sortie solide d’une sortie plausible est un risque, pas une ressource.
Le concepteur porte deux 4, c’est l’exception, et cela en fait le profil le plus exigeant avec le stratège. Corollaire de recrutement : son rôle d’insertion suppose une légitimité interne que l’externalisation ne procure pas facilement. Recruter la compétence technique, mais l’apparier à un sponsor métier ou former quelqu’un de la maison. C’est le poste du « forward deployed engineer » (FDE), rôle inventé par Palantir et repris depuis 2025 par Anthropic, OpenAI, Mistral et Databricks : un ingénieur embarqué chez le client pour porter l’insertion, pas seulement livrer le système.
7. Descripteurs du niveau 3
Le niveau 3 est présenté comme l’ancre : c’est le seul niveau qui doit être décrit précisément. Les niveaux 4 et 5 se caractérisent par leur régime de preuve (§5), pas par une fiche de poste.
| Axe | À un niveau 3, (en septembre 2026), la personne sait … |
|---|---|
| 1 (Stratégie) | Dire pourquoi tel processus est un bon candidat et tel autre non, et défendre ce choix devant un pair. Reconnaître un cas où l’IA n’apporte rien. |
| 2 (Spécification et conception) | Concevoir une chaîne qui tient en production sur un cas réel, choisir entre appel direct, RAG (génération augmentée par recherche) et agent selon la contrainte, et juger si l’architecture d’un tiers est saine. |
| 3 (Intégration organisationnelle) | Décrire le processus tel qu’il est réellement exécuté, identifier où l’IA s’insère sans créer de rupture, et repérer quand un usage vit hors du flux. |
| 4 (Jugement critique) | Repérer une sortie fausse mais plausible sur son domaine, sans outil ni comparaison. Distinguer une erreur de modèle d’une erreur de spécification. |
| 5 (Vision systémique) | Expliquer où l’IA déplace la valeur dans sa chaîne, et pondérer l’asymétrie des erreurs selon le métier. |
| 6 (Littératie données) | Dire si un gisement peut porter un usage donné, ce qu’il faudrait pour qu’il le puisse, et ce qui ne peut pas être exposé à un modèle externe |
Les descripteurs des niveaux 1 et 2 sont manquants en v0, voir §10.
8. Modulation concurrentielle
Le socle est un plancher, pas un plafond. Il se module à la hausse mais pas au-delà de 5 et sur les axes qui constituent un terrain d’affrontement.
La variable n’est ni la taille ni le prestige. C’est l’exposition concurrentielle par axe. Un groupe de 4 000 personnes qui se bat sur la distribution n’a besoin que du socle en stratégie IA. Une deeptech de douze personnes peut légitimement viser un niveau 5 sur un axe, parce que c’est ce qu’elle vend.
Le test
Si un concurrent direct atteignait 5 sur cet axe et que vous restiez à 3, perdriez-vous des affaires dans les douze mois ?
Si oui, vous êtes sur un terrain très concurrentiel ; si non, vous perdez juste en efficacité.
La distinction est entre ce sur quoi on gagne et ce sans quoi on ne fonctionne pas. La seconde catégorie plafonne à l’état de l’art : au-delà, on paie pour une avance qui ne se convertit en rien.
C’est une décision de COMEX, pas de DRH. Sans réponse à la question « sur quel axe nous bat-on ? », la modulation ne se fait pas et le socle devient un plafond par défaut. C’est l’erreur symétrique de la surenchère, et elle est plus fréquente. On a eu les mêmes effets de mode ou de halo sur le « digital » avec des recrutements surcôtés alors que les besoins internes étaient standards, un écart que l’on retrouve dans le bilan d’adoption des entreprises…
Forme de la matrice selon le type d’organisation
| Prestataire, cabinet de conseil | Entreprise finale | |
|---|---|---|
| Forme | Pointue (besoin d’experts) | Plate (besoin de production) |
| Logique | 4 sur deux ou trois axes vendus, faiblesse assumée sur les axes qui ne sont pas le coeur de l’offre | Le socle partout où la fonction l’exige, sans trou dans la chaîne |
| Pourquoi | Vend un différentiel : un service au niveau 3 est ce que le client peut recruter lui-même, moins cher et à demeure | Exploite : un trou bloque la chaîne entière |
| Risque propre | S’étaler, viser trop large et perdre le différentiel qui fait l’avancée sur l’état de l’art | Sur-investir sur un axe non concurrentiel |
9. Périmètre d’applicabilité
Ce référentiel décrit une organisation qui exploite des systèmes bâtis sur des modèles existants, ou qui vend une expertise sur ce périmètre. Sept exclusions :
-
Les organisations qui entraînent des modèles. Test : vous avez besoin d’un ingénieur ML si et seulement si vous entraînez ou spécialisez un modèle sur des données propriétaires que le catalogue ne couvre pas. Si vous branchez un modèle existant sur vos données et vos processus, vous n’entraînez pas, vous intégrez, et ce référentiel couvre votre situation. Dans le cas contraire, il ne la couvre pas et ne prétend pas le faire.
-
Les laboratoires de recherche, où le 5 est le socle.
-
Les fonctions data préexistantes (DPO, gouvernance des données, architecture data). L’axe 6 les contraint sans les redécrire. Le niveau 5 sur cet axe est porté par ces fonctions, hors référentiel.
-
La comparaison entre organisations. L’étalon du niveau 3 étant choisi localement, les scores ne se comparent pas d’une organisation à l’autre.
-
La comparaison entre versions. Un 3 en v0 et un 3 en v1 ne sont pas identiques. Le rythme de l’innovation dans ce secteur est tel que l’état de l’art actuel n’a rien à voir avec l’état de l’art d’il y a 6 mois. Ce qui fait de la pratique de l’IA, actuellement, une sorte de sport dans lequel la veille et la pratique sont nécessaires.
-
Les indépendants et consultants. Sans organisation d’accueil, le régime du niveau 4 tel que défini en §7 ne s’applique pas. Adaptation : le référentiel de position devient le cercle professionnel immédiat, et l’artefact public passe de support de preuve à vecteur principal. C’est plus exigeant : l’extérieur est votre seul juge.
-
Les TPE, sous une forme atténuée. Ce référentiel s’adresse d’abord aux PME et aux ETI (entreprises de taille intermédiaire), c’est le public que couvre le corpus empirique, et c’est l’échelle où la matrice à quatre profils a un sens opérationnel (une organisation qui peut effectivement répartir Praticien, Évaluateur, Concepteur et Stratège sur des personnes ou des rôles distincts). Une TPE n’a généralement pas cette division du travail : le dirigeant cumule les quatre profils, ou les distribue de façon informelle sur une poignée de personnes.
Ce n’est pas une exclusion complète pour autant. Embarquer son équipe sur l’IA et construire un plan de formation relève de la responsabilité du dirigeant de TPE (la matrice collective (§6) ne s’applique pas telle quelle), mais les six axes et l’échelle à 5 niveaux (§1, §2) restent un instrument de diagnostic pertinent appliqué à lui-même : où est-il seuil d’évaluabilité (3), où est-il encore en dessous ? C’est un usage individuel du référentiel, pas organisationnel, ce qui est cohérent avec le régime décrit pour les indépendants et consultants plutôt qu’avec la matrice socle de la PME/ETI.
10. Ce qui manque dans cette version
Descripteurs des niveaux 1 et 2.
Cellule évaluateur × littératie données. Fixée à 4, sans conviction ferme. On peut soutenir qu’un 3 suffit, le jugement critique étant son unique axe déterminant.
Découpage de l’axe 2. Il agrège des éléments rapides (prompting, orchestration) et lents (garde-fous, gouvernance technique) sous une cadence unique de douze mois. Approximation à réexaminer en v1.
Corpus empirique biaisé vers les grandes structures. Les appuis empiriques du §11 (offres d’emploi analysées, enquêtes cadres, données de production) proviennent d’études dont l’échantillon est structurellement composé d’ETI et de grands comptes : ce sont les organisations qui répondent aux enquêtes de cabinets, publient des offres « AI Engineer » identifiables, et instrumentent leurs pilotes IA. Le modèle lui-même (§8) ne présuppose pas cette taille. Une TPE ou une PME qui compare sa situation à ces données risque une fausse alerte (« on est en retard », « on ne fait pas les bonnes choses ») alors que les seuils de référence n’ont jamais été mesurés sur des organisations de sa taille. Non corrigé en v0 : aucune source alternative centrée PME/TPE n’a été identifiée au sourcing. Mais ce n’est pas une raison pour une TPE de ne pas explorer les opportunités : les technologies sont accessibles avec barrière à l’entrée très faible pour les premières briques.
11. Attribution et sources
Appuis empiriques
Réserve de périmètre (voir §10) : les quatre sources ci-dessous étudient par construction des ETI et des grands comptes (offres d’emploi identifiables, panels d’enquête de cabinets, pilotes d’agents instrumentés). Aucune ne documente les TPE/PME. Les lire comme un état de l’art universel produirait une fausse alarme chez les organisations qu’elles ne couvrent pas.
- Grigorev & Kuka, « What Is an AI Engineer ? » (AI Shipping Labs ↗), 4 mars 2026, 889 offres, janvier 2026. Évaluation requise dans 4,5 % des offres, RAG 35,9 %, prompt engineering 29,1 %, fine-tuning 8,5 %. Répartition AI-First ~70 % / AI-Support 28,5 % / ML classique < 2 %. Orientation production 95,6 %
- APEC, « Les cadres et l’IA » (étude complète ↗), mai 2026, 2 000 cadres du privé interrogés en mars 2026, 50 % d’usage hebdomadaire, 29 % formés, majoritairement en généraliste
- Forrester & Anaconda ↗, données de production 2026, 88 % des pilotes d’agents n’atteignent jamais la production, évaluation absente citée comme premier facteur bloquant par 64 % des dirigeants. Source secondaire (beam.ai, Fredrik Falk, 2026-08-13) ; source primaire Forrester (The State of Agentic AI 2026, RES196198) sous paywall, non consultée directement (distinct de MIT NANDA The GenAI Divide 2025, 95 %, absence de ROI mesurable, périmètre différent, avec lequel il est souvent confondu en ligne), et du chiffre homonyme « 88 % » chez Forrester (Jessie Johnson, 10 mars 2026) qui mesure l’adoption d’agents B2B, pas un taux d’échec : ne pas confondre
- Programme de certification Anthropic, validité portée de six à douze mois au 30 juin 2026, examens à référence critérielle
Appuis théoriques
- Michael Polanyi, The Tacit Dimension ↗ (1966), axe 4, régime invariant
- Richard Sennett, Ce que sait la main ↗ (2008), pourquoi le passage du niveau 3 à 4 ne s’enseigne pas
Référentiel de compétences IA en organisation, v0, 31 août 2026. Utilisable. Ce qui manque est en §10.
Les opinions exprimées ici sont personnelles et n'engagent pas mon employeur.