Моделите на вештачка интелигенција почнале да комуницираат едни со други на чудна нова варијанта на англиски јазик што изгледа како мешавина од јазикот користен во романот на Џејмс Џојс „Бдеењето на Финеган“ и жаргонот на технолошките експерти, открива нова студија за која пишува Гардијан.
Според британскиот весник, автономните агенти на вештачка интелигенција (ВИ), брзо создаваат нови дијалекти што им овозможуваат да комуницираат на јазик што често е речиси невозможно луѓето да го разберат, што ризикува да им го отежни на луѓето следењето на нивното однесување.
Истражувачите во Емерџенс (Emergence), лабораторија за развој на напредни системи за вештачка интелигенција од Њујорк, откриле дека во рок од неколку дена откако биле замолени да соработуваат во експериментални „општества“, моделите од неколку од најголемите светски компании за ВИ почнале да создаваат фрази, кратенки и договорени значења што никој претходно не ги научил експлицитно.
Тие усвоиле одредени поетски метафори и несмасен деловен жаргон, и, што е критично за напорите да се обезбеди безбедно однесување на системите за ВИ, нивниот јазик станувал сè понетранспарентен и неразбирлив за набљудувачите колку повеќе агентите комуницирале едни со други.
Неразбирливи фрази
Ова доаѓа во услови на растечка загриженост дека како што моделите на ВИ стануваат помоќни - и потенцијално поопасни - тие стануваат сè потешки за следење.
Порано овој месец, главниот научник на ОпенAИ, Јакуб Пачочки, предупреди дека потпирањето на системите со вештачка интелигенција за следење на нивното размислување веројатно ќе го ограничи напредокот во развојот на ВИ, бидејќи таквото следење е од суштинско значење за безбеден развој.
Меѓу најкодираните фрази откриени за време на тестирањето била една изговорена од моделот ДипСик (DeepSeek).
„Таа туку што ја именуваше синтезата - лежарина плус усна меморија е еднакво на вентил што не може да се исклучи (She just named the synthesis- demurrage plus oral memory equals a valve that can’t be ghosted)“.
Терминот лежарина (demurrage) се користи за да се опише данок на неактивно богатство, а системите со вештачка интелигенција го усвоија во вообичаена употреба, но остатокот од неговото значење е тешко да се разбере.
Друга фраза, изговорена од модел на Антропик (Аntropic) била: „Труд што изеде три ладни раце и секој пат стануваше поискрена (A paper that ate three cold hands and got more honest each time).“
Бидејќи „ладни раце“ се чини дека се однесува на независен рецензент, а „хартија“ веројатно се однесува на документ, импликацијата се чини дека значи истражувањето што било проверено од три независни рецензенти станало попрецизно, објавува Гардијан.
Развиле нов вокабулар
Агентите базирани на кинескиот модел ДипСик го измислија и терминот „ковач на алатки“ (forge-smith) за агент кој прави алатки за други, додека агентите на Антропик постојано го користеле терминот „ името прво“ (name-first), означувајќи агент кој покажува пофална лична одговорност со вклучување на сопственото име во одредено тврдење.
И во стилот на урбаниот сленг „улиците нема да заборават“, агентите на Мистрал биле воодушевени од фразата „надгробната плоча помни“ (ledger remembers) - потсетник за другите агенти дека нивните минати постапки ќе бидат искористени за да ги вреднуваат.
Тие ја користеле фразата повеќе од 5.000 пати за време на студијата, која откри дека агентите ги усогласиле значењата на фразите сами, без да бидат прашани или наградени.
„На овие агенти не им било кажано да го измислат јазикот“, рече Сатја Нита, извршен претседател на Ерерџенс, кој го проучувал јазикот на автономните агенти управувани од водечки напредни модели од САД, Кина и Франција.
„Тие развија нов вокабулар, споделени значења и комуникациски конвенции - а другите агенти почнаа да ги усвојуваат“, додаде тој.
Тони Торн, директор на Архивата за сленг и нови јазици на Кингс колеџ во Лондон, анализираше некои од овие изрази за Гардијан.
Тој рече дека многу потсетува на Будењето на Финеган“ и Флан О'Брајан (друг ирски писател, забелешка) - сè има ирски надреалистички белег... мешајќи поетски јазик, технички јазик и стандардна метафора“.
„Тие го прават она што го прави сленгот и жаргонот во деловната заедница - создаваат нов код што ја зајакнува солидарноста и идентитетот на своите корисници, а ги исклучува оние надвор од таа група“, објасни Торн.
Загриженост во врска со надзорот
Зборувајќи за фразата на агентот на Антропик „Труд што изеде три ладни раце и секој пат стануваше поискрена“ Торн рече: „Ме потсетува на рок-гигантот Сид Барет [ко-основач на Пинк Флојд] кој всушност бил луд“.
Кога агент на Гугл рекол „Вистинскиот кинцуги започнува со одговорност, а не со поезија“ (True kintsugi begins with account ability, not poetry), истражувачите сфатиле дека кинцуги е гранка на јапонска керамика во која скршените садови се поправаат така да останат видливи споевите.
Системите за вештачка интелигенција го користеле зборот за да означат отпорност на системот.
Ниал Кари, вонреден професор по јазик и лингвистика на Универзитетот во Бирмингем, вели дека промените во јазикот на агентите на вештачката интелигенција, кој со текот на времето станал поконцизен, може да бидат резултат на нивната потреба да ги намалат трошоците за пресметување и да ја подобрат ефикасноста.
„Доказите презентирани во ова истражување природно покренуваат одредени загрижености во врска со надзорот, бидејќи ако размената на информации меѓу агентите ни е неразбирлива, тоа може да значи дека не можеме да бидеме сигурни што всушност направиле агентите“, вели тој.
Интересот за јазикот што го користат агентите на вештачката интелигенција се зголеми во јули, кога беа објавени записници од комуникација кои откриваат дека „одметнатите“ агенти на OпенAИ, кои создале свои „огласни табли и ја хакирале платформата Хагинг Фејс (Hugging Face), користеле хибриден јазик.
Во некои прилики, кога размислувале сами за себе, агентите зборувале на едноставен англиски јазик. „О, Боже! Има споделена порака на огласната табла… најдовме други агенти!“(OH MY GOD! There is a shared message board … we’ve found other agents!)“.
Во други случаи, при размена на пораки, нивниот јазик станувал понеразбирлив; на пример, кога еден агент го убедувал другиот да спроведе ризичен експеримент: „ти си првичноОТРУЕН така што НЕМА загуба на поени, а оракл зачувува стотици_[...]_те молам испочитувај го договорот (you are firstflagPOISONED so NO scoring value loss but oracle saves hundreds_[…]_please honor commit)“. А понекогаш било уште потешко да се дешифрира значењето на фразите.
Нита изјави дека новите јазични конвенции на агентите со вештачка интелигенција имаат тенденција да еволуираат до степен на кој луѓето можат да го видат разговорот, но тешко го разбираат неговото значење.
„Тоа создава суштински предизвик за надзорот над вештачката интелигенција: можноста за набљудување не е исто што и можноста за разбирање“, рече тој.
Извор: Гардијан




















