Das neue Produkt verifiziert sowohl die KI-Agenten, die mit Kunden kommunizieren, als auch jene, die auf Systemen agieren; dabei generiert es Testszenarien direkt aus dem Code, bewertet jede Aktion anhand realer Belege und meldet eine Verifizierungslücke für alle Vorgänge, die nicht überprüft werden konnten
SAN FRANCISCO und NOIDA, Indien, 19. August 2026 /PRNewswire/ -- TestMu AI (ehemals LambdaTest), die weltweit erste Plattform für Quality Engineering auf Basis von agentenbasierter KI, kündigt Agent Assurance an – ein Produkt, das entwickelt wurde, um die Frage zu beantworten, vor der heute jedes Entwicklungsteam steht, das KI-Agenten bereitstellt: Kann dieser Agent sicher versendet werden? Agent Assurance deckt beide Arten von Agenten in einem Produkt ab: die Kategorie Konversationsagent – in der Agenten für die Interaktion mit Menschen über Chat, Sprache, Telefon, Video und Bilder bewertet werden – sowie die neue Kategorie Autonomer Agent, in der Agenten überprüft werden, die in Systemen agieren: Aufrufe von Tools, das Schreiben vo n Dateien, der Aufruf von APIs und das Erstellen von Pull-Requests.
Die meisten Teams testen autonome Agenten heute, indem sie den eigenen Bericht des Agenten über seine Aktivitäten lesen: ein Protokoll oder die Bewertung eines Prüfers zu seiner letzten Nachricht. Agent Assurance bewertet stattdessen die tatsächliche Wirkung. Auf eine Codebasis ausgerichtet, ermittelt es, was der Agent tut, generiert eine End-to-End-Testsuite für den Agenten, die funktionale Tests, nicht-funktionale Prüfungen und Angriffsszenarien umfasst, ruft den Agenten tatsächlich auf und bewertet jedes Kriterium anhand der beobachteten Beweise: Dateien, die sich auf der Festplatte geändert haben, erzeugte Artefakte und Tool-Aufrufe, die anhand der vom Agenten selbst deklarierten Tool-Oberfläche verifiziert werden.
Neben „bestanden" und „nicht bestanden" meldet Agent Assurance ein drittes Urteil: nicht überprüfbar – dieses wird aus der Erfolgsquote ausgeschlossen und als Zahl veröffentlicht: Die Assurance-Lücke. Jedes Ergebnis in einem Bericht ist tatsächlich beobachtet worden, und da die Lücke widerspiegelt, inwieweit ein Agent seine eigenen Aktionen protokolliert, können Teams sie verringern, indem sie ihre Agenten besser beobachtbar machen.
„Entwicklungsteams häufen Validierungsschulden genau auf der Ebene an, auf der am meisten auf dem Spiel steht. Die Schilderung eines Agenten darüber, was er getan hat, ist der schwächste verfügbare Beweis dafür – er ist die einzige Partei, die einen Grund hat, sich zu irren", sagte Vipul Verma, Group SVP of Engineering bei TestMu AI. „Jedes Tool in diesem Bereich meldet eine Erfolgsquote. Agent Assurance meldet sowohl die Erfolgsquote als auch die Größe seines eigenen blinden Flecks, denn nur so wird diese Zahl zu einer, auf die man sich verlassen kann, um voranzukommen."
Mit Agent Assurance können Teams:
Die Kategorie der Konversationsagenten erweitert sich zudem auf die neueste Schnittstelle, an der Software auf Menschen trifft: Agenten, die vor der Kamera erscheinen. Mit der neuen Funktion Video Agent Testing (Link) der Plattform nimmt ein simulierter Mensch mit realistischem Gesicht und realistischer Stimme an der Sitzung eines Live-Video-Agenten teil, führt ein echtes Gespräch und bewertet den Agenten anhand von teamdefinierten Erfolgskriterien, wobei jedes Urteil auf den genauen Moment in der Aufzeichnung zurückverfolgt werden kann, der dazu geführt hat. Alles, was anhand der Aufzeichnung nicht überprüfbar ist, wird bewusst als nicht erfüllt gewertet – ein strenger Standard für eine Kategorie, in der die Aufzeichnung den Beweis darstellt: Ein Video-Agent erhält niemals Anerkennung für einen Moment, den der Bewerter nicht beobachten konnte.
Die Kategorie Konversationsagent ist ab heute allgemein auf der TestMu-AI-Plattform verfügbar. Die Kategorie Autonomer Agent ist im Early-Access-Zugang verfügbar und wird vom Terminal aus als „rook" ausgeführt, wobei die Modelle im TestMu-AI-Controller laufen, sodass lokal keine API-Schlüssel von Anbietern benötigt werden. Um loszulegen, gehen Sie zu Link.
Informationen zu TestMu AI
TestMu AI ist die weltweit erste agentenbasierte, KI-native Quality-Engineering-Plattform, die es Unternehmen ermöglicht, Tests auf der Grundlage künstlicher Intelligenz zu automatisieren und zu skalieren. Durch die Kombination autonomer Fähigkeiten mit einer nahtlosen Integration in moderne Entwicklungsworkflows versetzt TestMu AI Teams in die Lage, in einer „AI-first"-Welt schnellere, zuverlässigere und sicherere Software bereitzustellen.
Weitere Informationen finden Sie unter TestMu AI
KONTAKT: Nikhil Saxena, Leiter Unternehmenskommunikation, TestMu AI, nikhils@testmuai.com, +919870981968
View original content to download multimedia:https://www.prnewswire.com/news-releases/testmu-ai-startet-agent-assurance-zur-uberprufung-von-ki-agenten-vor-deren-bereitstellung-302855033.html