
Selon une étude menée auprès de 157 grandes entreprises, les sociétés font de plus en plus confiance aux agents d'IA, tout en accordant moins de crédit aux évaluations censées limiter leur autonomie. La moitié d'entre elles ont déjà déployé en production des agents qui avaient réussi les évaluations internes mais qui ont échoué dans des conditions réelles avec des clients. Seulement une entreprise sur vingt fait entièrement confiance aux évaluations automatisées.
Malgré cela, deux tiers des organisations autorisent déjà ou travaillent activement à déployer des modifications apportées aux agents en production sur la base d'évaluations automatisées sans intervention humaine. Cela crée un risque, car les évaluations peuvent ne pas refléter les conséquences réelles, ce qui pourrait entraîner des erreurs dans le fonctionnement des agents.
commentaire éditorial
Pourquoi c’est important
Les organisations déployant des agents d'IA sont confrontées à un risque, car les évaluations automatisées peuvent ne pas refléter les conséquences réelles. Le prochain signal pourrait être une augmentation du nombre d'erreurs dans le fonctionnement des agents, ce qui pourrait nécessiter une révision des approches d'évaluation et de déploiement.