← Le travail réellement délégable à l'IA

Suivi de la collecte

Vue de travail : elle expose l'avancement réel de la campagne, cellule par cellule. Une cellule sans expérience enregistrée reste planifiée et n'entre dans aucune agrégation.

Campagne simulée

Expériences
300/300
Rejeux
60/60
Baselines
20/20
Doubles évaluations
30/30

Source runtime : simulation-campagne · 360 enregistrements retournés.

Source de données active

Données simulées — campagne complète (T01→T20) — Campagne simulée complète générée par un même moteur pour T01→T20 : 300 expériences principales, 60 rejeux, 20 baselines, 30 doubles évaluations. Ce ne sont pas des observations d'assistants réellement interrogés.

Registre réel : 0 entrée. La bascule entre « registre réel », « données simulées » et « aucune donnée » se fait au build (`VITE_LAB_DATA_SOURCE`), sans jamais mélanger les deux sources.

Pack de simulation disponible

Expériences
300/300
Rejeux
60/60
Baselines
20/20
Doubles évaluations
30/30

Identifiants uniques : oui · cellules hors matrice : 0 · rejeux sans origine : 0 · protocole v1.3.

  • — Notes fractionnaires (4,3/5) là où le protocole attend des notes entières 0–5.
  • — Interface d'exécution `simulated` : aucun assistant n'a été réellement interrogé.
  • — Vocabulaire de verdict propre au pack (« accepté ») : aucun verdict de protocole n'est déduit.
  • — Prompt exact, modèle et version, évaluateur et points de vérité de terrain absents du pack.
  • — Coût simulé exprimé comme un coût direct unique ; coût d'accès et coût humain inconnus.

Données synthétiques simulées pour tester le pipeline et construire une version de travail du Lab. Elles ne constituent pas des observations d'assistants réellement exécutées.

Lot de simulation détaillée — T01, T02, T03, T04, T05

Expériences
75/75
Rejeux
15/15
Baselines
5/5
Doubles évaluations
8/8

Couverture rapportée aux cellules du protocole : 75/300. Contrôles d'entrée : tous conformes.

  • ✓ 75 identifiants au format officiel, uniques — 75 expériences · 0 identifiant(s) hors format · 0 doublon(s)
  • ✓ Correspondance avec T01→T05 et avec la matrice — 0 hors T01–T05 · 0 hors matrice
  • ✓ 15 rejeux rattachés à une expérience du lot — 15 rejeux · 0 sans origine
  • ✓ 5 baselines, une par tâche du lot — 5 baselines · manquantes : aucune
  • ✓ Doubles évaluations rattachées au sous-échantillon — 8 doubles évaluations · 0 sans expérience correspondante
  • ✓ Références prompts / datasets / rubriques / dossiers — 0 référence(s) non conforme(s) au corpus
  • ✓ Notes bornées 0–5 — 0 note(s) hors bornes
  • ✓ Projection des notes sur l'échelle entière 0–5 du protocole — Notes brutes fractionnaires conservées dans `simulationRawScores` ; projection par arrondi déterministe.
  • ✓ Temps positifs ou inconnus — 0 enregistrement(s) avec un temps invalide
  • ✓ Coûts positifs ou inconnus — 0 coût(s) invalide(s)
  • ✓ Verdict renseigné (vocabulaire du lot) — 0 enregistrement(s) sans verdict
  • ✓ Marquage `simulation: true` intégral — 0 enregistrement(s) non marqué(s)
  • — Notes fractionnaires du lot (4,5/5) là où le protocole attend des notes entières 0–5 : projetées par arrondi déterministe au plus proche (demi vers le haut) pour respecter le contrat technique, valeurs brutes conservées dans `simulationRawScores` / `simulationRawQuality`.
  • — Interface d'exécution `simulated` : aucun assistant n'a été réellement interrogé.
  • — Vocabulaire de verdict propre au lot (« accepté ») : aucun verdict de protocole n'est déduit.
  • — Prompt exact, modèle et version, évaluateur nommé, version de rubrique et points de vérité de terrain absents du lot : déclarés manquants, jamais reconstitués.
  • — Le lot déclare ses enregistrements `complete` ; conservé dans `simulationCompleteness`, mais la complétude protocolaire reste `partielle` faute des champs ci-dessus.
  • — Coût simulé exprimé comme un coût direct unique ; coût d'accès et coût humain restent inconnus.
  • — Sous-échantillon de double évaluation : 8 au lieu de 30 prévus par le protocole, le lot ne couvrant que T01→T05.
  • — Baselines simulées : temps de référence = somme des phases simulées. Aucun gain calculé à partir d'elles n'est publiable.
  • — Statut des rejeux du lot : `rejouee` là où les lots 02→04 utilisent `realisee`. Sans effet sur les agrégations (les rejeux sont exclus des 300 par `isReplay`), conservé tel quel.
  • — Date de mesure des baselines du lot absente : `measuredAt` reste inconnu, jamais reconstitué.

Lot de simulation détaillée T01-T05. Toutes les données sont synthétiques et marquées simulation=true.

Avancement de la collecte

300/300

Campagne simulée complète générée par un même moteur pour T01→T20 : 300 expériences principales, 60 rejeux, 20 baselines, 30 doubles évaluations. Ce ne sont pas des observations d'assistants réellement interrogés.

Compteur dérivé de la source active. Les rejeux n'entrent jamais dans la couverture des 300.

Baselines humaines
20/20

0 déclarée(s) impossible(s)

Rejeux
60/60

0 rejeu(x) encore disponibles

Contrôles d'intégrité
conformes

matrice valide · registre valide (0 entrée)

Progression par mode (100 cellules par mode)
AxeRéaliséesPlanifiéesInvalidéesRejouées
Mode A100/100000
Mode B100/100000
Mode C100/100000
Progression par assistant (60 cellules par assistant)
AxeRéaliséesPlanifiéesInvalidéesRejouées
ChatGPT60/60000
Claude60/60000
Gemini60/60000
Microsoft Copilot60/60000
Perplexity60/60000
Progression par famille de tâche
AxeRéaliséesPlanifiéesInvalidéesRejouées
analyse60/60000
production60/60000
marketing45/45000
processus60/60000
decision45/45000
limites30/30000
Progression par tâche (15 cellules par tâche)
AxeRéaliséesPlanifiéesInvalidéesRejouées
T01 — Brief désordonné → synthèse15/15000
T02 — Données commerciales → anomalies15/15000
T03 — Comparer deux offres15/15000
T04 — Contrat → points d'attention15/15000
T05 — Réunion → actions15/15000
T06 — Brief → proposition commerciale15/15000
T07 — Documentation → FAQ15/15000
T08 — Contenu → 3 formats15/15000
T09 — Plan éditorial15/15000
T10 — Expertise → LinkedIn15/15000
T11 — Distribution multicanale15/15000
T12 — Cartographier processus15/15000
T13 — Processus → automatisation15/15000
T14 — Workflow humain + IA15/15000
T15 — Processus → procédure15/15000
T16 — Choisir un SaaS15/15000
T17 — ROI projet IA15/15000
T18 — 3 scénarios stratégiques15/15000
T19 — Contradictions métier15/15000
T20 — Que déléguer à l'IA ?15/15000

Pipeline de résultats

  1. 1. Résultat brutArchive complète dans `lab-01/raw/<ID>/` avant toute évaluation. Hors bundle public.
  2. 2. Validation`validateImport()` : forme, appartenance à la matrice, traçabilité, cohérence. Lot accepté ou rejeté en bloc.
  3. 3. NormalisationMise en forme uniquement. Aucune valeur calculée, complétée ou substituée ; l'inconnu reste `null`.
  4. 4. RegistreÉcriture éditoriale dans `experiments.ts`, puis `validateRegistry()` comme garde-fou permanent.
  5. 5. AgrégationsCalculées à partir des expériences principales réalisées uniquement. Les rejeux sont exclus de la couverture 300.
  6. 6. PublicationUne agrégation sans donnée affiche « données en cours de collecte », jamais une valeur par défaut.

État public actuel : resultats partiels.

Traçabilité de l'exécution

Chaque expérience prévue possède une fiche d'exécution qui renvoie au dossier de la tâche : prompt du mode, jeu d'entrée, livrable attendu, grille d'évaluation. Ces fiches sont des documents de référence dérivés de la matrice ; elles ne contiennent aucun résultat et ne comptent jamais comme une expérience réalisée.

Cellules planifiées
0 / 300
Expériences enregistrées
300 / 300
Rejeux enregistrés
60
Corpus de référence
docs/lab/01/

Chaîne de traçabilité : tâche → prompt du corpus → identifiant d'expérience → archive de la sortie brute → registre. Les archives brutes sont conservées hors du site.