Snorkel AI vend des environnements de travail simulés pour entraîner des agents. Ils contiennent des dossiers, des outils et des règles d’entreprise, et évaluent les actions de l’agent ainsi que leurs résultats.
Le 22 septembre, Snorkel a annoncé une série E de 350 millions de dollars, sur une valorisation de 3,5 milliards. Ce financement est nouveau, mais pas l’orientation du produit. Snorkel a décrit sa méthode de création d’environnements en 2025, et sa Data Series actuelle recense des simulations de souscription en assurance dommages et de finance. Cette levée soutient une activité existante qui transforme les connaissances expertes du travail en infrastructure d’entraînement et d’évaluation.
Le grand changement
- Ce qui change : Un fournisseur de données d’entraînement peut vendre une simulation opérationnelle d’un processus d’entreprise. Pour réussir, il faut utiliser les outils et les dossiers disponibles afin de terminer le flux de travail.
- Pourquoi c’est important : Les personnes qui construisent l’environnement contribuent à définir ce qu’est un travail compétent. Un seuil fixé par une politique, une approbation requise ou une mise à jour de base de données devient un signal qui récompense un comportement et en rejette un autre. Le jugement métier intervient donc dès l’entraînement, et pas seulement lors de la vérification finale.
- À surveiller : Snorkel indique qu’elle élargira son programme de subventions pour les benchmarks ouverts. Pour les environnements commerciaux, la question centrale est leur degré de fidélité aux outils, règles et exceptions de l’activité de l’acheteur, car la réussite simulée est mesurée par rapport à cette version construite du travail.
Ce que contient une entreprise simulée
Un jeu de données statique peut associer une question à une réponse attendue. Un environnement ajoute des actions et leurs conséquences. L’agent choisit un outil, observe le résultat et décide de la suite. Une base de données peut changer, un utilisateur simulé peut fournir l’information manquante et une politique peut imposer une escalade.
Dans sa présentation d’août sur les environnements d’entreprise, Snorkel explique que l’évaluation vérifie la réponse, l’état résultant du système, les autorisations, les approbations et le processus de collecte des éléments probants. Une tâche peut donc échouer même si l’agent affirme l’avoir terminée, lorsque l’enregistrement sous-jacent n’a pas changé.
La page produit actuelle Enterprise Environments propose des environnements de souscription et de finance, chacun avec des milliers de tâches et des utilisateurs simulés. Il s’agit d’artefacts d’entraînement.
Un même artefact peut servir deux objectifs liés. Une équipe peut évaluer un agent à l’aide de tâches répétables. Elle peut aussi intégrer les tâches et signaux de récompense à une boucle d’apprentissage par renforcement, afin que les comportements réussis influencent les actions ultérieures.
Les règles font partie du produit
Snorkel indique que les experts définissent le flux de travail et les critères de réussite, tandis que les ingénieurs construisent les outils et les données. Des vérificateurs notent le travail et un agent oracle vérifie qu’un parcours valide existe.
Les règles propres à l’entreprise obligent l’agent à examiner l’environnement plutôt qu’à se fier aux connaissances générales du secteur.
Les auteurs de l’environnement décident quelles exceptions comptent, ce qui constitue une tâche terminée et quels autres parcours sont acceptables. Les acheteurs et experts métier doivent vérifier que ces choix reflètent le travail réel.
Un test contrôlé a ses limites
Dans son explication technique de 2025, Snorkel indique que ses environnements utilisent des services et schémas représentatifs, et que des données synthétiques ou anonymisées remplacent les systèmes réels. Ce contrôle permet de répéter les tâches, d’examiner les changements de base de données et de tester les actions interdites sans toucher aux dossiers clients.
Les résultats renseignent sur les performances dans le flux de travail encodé. Les pages sources expliquent comment Snorkel construit et vérifie les tâches, mais ne présentent pas d’étude indépendante reliant les scores de ces simulations commerciales à la fiabilité d’une activité réelle de souscription ou de finance. L’usage en production dépend toujours de la fidélité de la simulation aux outils, données et cas limites réels.
Ce que finance la levée
Snorkel a commencé comme un système de création de jeux de données étiquetés. Son offre plus récente transforme les connaissances expertes en environnements, évaluateurs et tâches d’entraînement. Cette évolution ajoute un élément distinct à la pile d’IA : une version construite du travail, avec les règles qui déterminent si l’agent l’a correctement accompli.
Pour les experts métier, la définition et la vérification des tâches se rapprochent du développement des modèles. Pour les acheteurs, la qualité de la spécification devient un élément de l’achat. Snorkel a annoncé l’élargissement de son programme Open Benchmarks Grants, qui pourrait ouvrir à l’examen davantage de travaux de construction et de notation des environnements ; l’annonce du financement ne précise toutefois ni les prochaines subventions ni leurs conditions.



