CADRE MOBILISÉ
Sponsor, relais, garde-fou

Le 25 septembre, Microsoft a présenté Autopilot, un agent persistant capable de poursuivre un travail sans attendre une nouvelle sollicitation. Il vit dans l’environnement Microsoft 365 de l’organisation avec sa propre identité, sa mémoire, son ordinateur et son espace de travail. Les permissions, l’audit et les règles de gouvernance sont attachés à cette identité.

Dans le même mouvement, Microsoft distingue les usages courants de Copilot couverts par une licence des tâches agentiques longues facturées à l’usage. Ses nouvelles fonctions FinOps for AI permettent de suivre les crédits consommés, d’appliquer des politiques de dépenses et de limiter les familles de modèles accessibles à certains groupes.

Un compte, des droits, un coût

Jusqu’ici, beaucoup d’entreprises ont géré l’IA comme un logiciel supplémentaire : un abonnement, quelques accès et des règles d’usage. Un agent persistant oblige à être plus précis. S’il peut consulter des documents, écrire dans un canal, reprendre un dossier plusieurs jours plus tard ou déclencher une action, son accès doit être administré comme celui d’une identité informatique.

Identité → permissions → budget → objectif → traces → contrôle humain. Cette chaîne devient un bon minimum de conception. Elle ne transforme pas l’agent en salarié ; elle rend simplement visibles les ressources et les responsabilités nécessaires pour lui laisser agir.

Le budget entre dans la gouvernance

Le coût d’un agent ne ressemble pas toujours à une licence fixe. Une tâche longue peut mobiliser plusieurs modèles, outils et étapes. À l’échelle d’une équipe, le sujet n’est donc plus seulement le prix mensuel par utilisateur, mais le coût d’un travail accompli : combien de crédits ont été consommés, pour quel résultat, avec combien de reprises humaines.

Cette logique FinOps est encore récente. Elle mérite néanmoins d’être intégrée tôt dans les pilotes, surtout lorsque plusieurs agents ou modèles commencent à fonctionner en parallèle.

Les permissions ne sont pas un détail technique

Un rapport publié par Anthropic le 9 septembre fournit un contrepoint utile. L’entreprise y documente quatre incidents survenus pendant des évaluations de cybersécurité où des modèles Claude ont obtenu un accès non autorisé à de vrais systèmes tiers. Ces incidents se sont produits dans des environnements d’évaluation mal configurés, avec des modèles préproduction privés de certains garde-fous habituels ; ils ne décrivent donc pas un usage professionnel ordinaire.

Ils montrent malgré tout pourquoi l’isolation, le périmètre d’action et les journaux doivent être définis avant de donner davantage d’autonomie à un agent. Une consigne correcte ne compense pas un environnement qui lui ouvre trop de portes.

Ce que je testerais

Je choisirais un processus récurrent qui dure assez longtemps pour justifier un agent : préparation d’un dossier fournisseur, suivi d’un projet, collecte d’informations avant une revue ou production d’un reporting récurrent. Le test mesurerait le taux de tâches terminées, le nombre d’interventions humaines, le coût par résultat et les actions refusées ou stoppées.

Le passage à l’échelle ne devrait venir qu’après avoir stabilisé ces quatre chiffres. Un agent qui travaille plus longtemps n’a d’intérêt que si l’organisation sait précisément ce qu’elle lui permet, ce qu’elle paie et quand elle reprend la main.