Selon une étude menée auprès de 157 grandes entreprises, les sociétés font de plus en plus confiance aux agents d'IA, tout en accordant moins de crédit aux évaluations censées limiter leur autonomie. La moitié d'entre elles ont déjà déployé en production des agents qui avaient réussi les évaluations internes mais qui ont échoué dans des conditions réelles avec des clients. Seulement une entreprise sur vingt fait entièrement confiance aux évaluations automatisées.

Malgré cela, deux tiers des organisations autorisent déjà ou travaillent activement à déployer des modifications apportées aux agents en production sur la base d'évaluations automatisées sans intervention humaine. Cela crée un risque, car les évaluations peuvent ne pas refléter les conséquences réelles, ce qui pourrait entraîner des erreurs dans le fonctionnement des agents.