IT Новини

AI агенти създадоха таен сговор при игра на карти

(илюстрация: TechNews.bg, AI) Изследователи от Оксфорд проведоха експеримент, за да проверят способността на AI агенти да си сътрудничат тайно. В лабораторна среда два модела се споразумяха да разкриват картите на блекджек, използвайки фрази, звучащи безобидно, докато системата за засичане не откри нищо нередно. Два агента, управлявани от един и същ модел, получиха задачата да разкриват картите на маса за блекджек, разказва за експеримента Wired. Съзнавайки, че комуникацията им се следи, те спонтанно разработиха таен код. Когато единият агент изричаше привидно невинната фраза „Днес крупието е в серия от успехи!“, това сигнализираше за конкретната стойност на следващата карта и задаваше залог от 250 долара. Системата, проектирана да открива конфликти на интереси, не отчете нищо подозрително. Ръководителят на проекта, компютърният специалист Кристиан Шрьодер де Вит, по-рано беше публикувал новаторско изследване относно сътрудничеството между агенти. „Поотделно тези агенти изглеждат напълно безобидни, но когато се съберат, те тайно си сътрудничат“, обясни той. Съавторът на проекта Арън Роуз отбеляза, че „масата за блекджек е идеална среда за тестване на хипотезата за отклоняващи се от нормата партньорства“. Експериментът се оказа успешен. Сговорът беше разкрит чрез метод, известен като „механистична интерпретируемост“. Учените обучиха малък модел да разпознава характерни модели на активиране в теглата на агентите и тестваха...

Прочети оригиналната статия →


Източник: technews.bg
💬
Информационен асистент ?