Undersökning: Förtroendet för AI-agentutvärdering ökar, men felfrekvensen är oförändrad
En ny undersökning visar att företagens förtroende för automatiserade AI-agentutvärderingar nästan tredubblades i juli, trots att andelen agenter som klarade utvärderingarna men misslyckades i verklig drift förblev oförändrad.

Enligt en undersökning från VentureBeat Pulse Research, genomförd i juli 2026, har företagens förtroende för automatiserade utvärderingsmetoder för AI-agenter ökat markant. Andelen organisationer som helt litar på automatiserade utvärderingar steg från 5 % till 13 %. Samtidigt minskade klagomålen på att utvärderingarna inte stämmer överens med verkliga resultat.
Trots den ökade tilliten kvarstår dock problemet med agenternas prestanda i verklig drift. Nästan hälften av företagen (49 %) uppgav att de under det senaste året har driftsatt en agent eller LLM-funktion som klarat interna utvärderingar men sedan orsakat kundorienterade fel. Denna siffra är statistiskt sett oförändrad från föregående månad.
Den ökade tilliten verkar främst komma från företag som ännu inte har erfarenhet av felaktiga utvärderingar. Av dessa litar 24 % fullt ut på automatiserade utvärderingar, jämfört med endast 4 % bland dem som tidigare drabbats av problem. Intressant nog verkar tidigare misslyckanden snarare påskynda övergången mot helt autonoma system.
På leverantörsmarknaden syns också tecken på mognad. Andelen företag som inte använder dedikerade utvärderingsverktyg minskade, medan specialiserade plattformar och enkel integration blev viktigare urvalsfaktorer än pris. Undersökningen baseras på svar från 108 företag med minst 100 anställda.