IT Новини

AI агентите се затрудняват с реални задачи при работа в браузър

(илюстрация: TechNews.bg, AI) AI агентите все още не могат надеждно да изпълняват целия набор от задачи, които се очаква да поемат в браузъра. Ново изследване на Decodo показва, че дори най-добре разработените решения допускат грешки при покупки, многостъпкови процеси и действия, които изискват човешко одобрение. Най-слабо се представят AI агентите при транзакционните операции, при които алгоритмите често успяват да преминат през част от процеса, но не и да го приключат. Това е особено важно за бизнеса, защото евентуална грешка при плащане, изпращане на информация или промяна на данни може да има директни финансови и оперативни последици. Сред 45 оценени AI агента нито един не постига максимален резултат във всички проверявани области, докато най-добрите решения достигат 18 от общо 20 точки. Резултатите показват, че наличието на дадена функция в продуктовата документация не гарантира, че тя ще работи последователно при реална употреба. Покупките остават проблемна зона Транзакционните действия получават средна оценка от едва 0,43 точки от възможни 2. Това е най-слабият резултат сред всички категории в теста. Шест агента получават максималните две точки за транзакции: Amazon Nova Act, BrowserOS, ChatGPT Desktop, Minded, Sigma Browser и Skyvern. Самото успешно извършване на покупка обаче не означава, че агентът има достатъчно добри механизми за контрол....

Прочети оригиналната статия →


Източник: technews.bg
💬
Информационен асистент ?