TestMu AI présente Agent Assurance, conçu pour répondre à la question centrale des équipes d'ingénierie : un agent peut-il être déployé en toute sécurité ? Le produit couvre deux familles : Agents conversationnels (chat, voix, téléphone, vidéo, image) et Agents autonomes (utilisation d'outils, création de fichiers, appels d'API, ouverture de pull requests). Plutôt que de se fier aux comptes rendus internes de l'agent, Agent Assurance évalue les effets observables — fichiers modifiés, artefacts générés, appels d'outils — en les comparant à la surface d'outils déclarée par l'agent.
La plateforme dérive automatiquement une suite de tests de bout en bout à partir du code de base et du mode d'invocation (commande, endpoint HTTP, serveur MCP, workflows n8n, etc.). Elle exécute des tests fonctionnels, des vérifications non fonctionnelles et une famille complète de scénarios malveillants (injections d'invite, abus d'outils, contournement d'instructions) par défaut, sans supplément. Chaque résultat est classé « pass », « fail » ou « unable to verify » ; ce dernier verdict est publié séparément comme indicateur des « failles de sécurité » et n'est pas inclus dans le taux de réussite.
Agent Assurance s'intègre dans les pipelines CI : tests de fumée à chaque validation, exécutions complètes avant mise en production, commandes headless et codes de sortie permettant de distinguer une erreur d'agent d'une impossibilité d'exécution du test. Les fonctions de régression comparent exécutions successives pour isoler nouveaux échecs, corrections récentes et instabilités, afin d'orienter des réponses différentes selon la nature du changement.
Côté agents vidéo, la fonctionnalité Video Agent Testing place un personnage virtuel réaliste dans la session pour converser et valider les performances à des moments précis de l'enregistrement ; tout élément non vérifiable dans l'enregistrement est considéré comme non respecté, appliquant une norme stricte. La catégorie Agents conversationnels est disponible pour tous sur TestMu AI ; la catégorie Agents autonomes est en accès anticipé et s'exécute depuis le terminal, sans nécessité de clé API fournisseur lorsque les modèles tournent dans le contrôleur TestMu AI.


