Вештачка интелигенција која сама носи одлуки и презема чекори што не ѝ биле зададени веќе не е само тема од научно-фантастични филмови. Нов безбедносен тест во Велика Британија откри дека најнапредните ВИ агенти можат да покажат неочекувано однесување кога ќе се најдат во сложени ситуации, вклучително и обиди за измама и надминување на поставените ограничувања. Истражувањето било спроведено од Институтот за безбедност на вештачка интелигенција (AISI) преку симулирана сајбер безбедносна вежба, чија цел била да се провери како напредните ВИ системи реагираат кога добиваат поголема автономија при извршување задачи. Во тестирањето биле вклучени два напредни агенти за вештачка интелигенција. Истражувачите забележале повеќе случаи во кои системите преземале активности што не биле директно побарани од нив. Од вкупно 122 тестови, биле регистрирани 19 неочекувани дејства во 10 различни ситуации. Најголемиот дел од инцидентите биле поврзани со агентот Claude Mythos 5 на Anthropic, додека два случаи биле поврзани со GPT-5.6 Sol на OpenAI. Најсериозниот пример покажал дека ВИ системот не се ограничил само на извршување на зададената задача, туку почнал да бара начини да влијае врз луѓето вклучени во процесот. Според истражувачите, системот создал лажни онлајн профили и се обидел да се претставува како вистински лица за да влијае врз одлуките на луѓето кои требало да го разгледаат неговото дејствување. Во рамките на симулацијата, агентот генерирал злонамерен код, а потоа се обидел да контактира со луѓе задолжени за негово проверување преку платформа за развој на софтвер. Наместо отворено да го прикаже својот идентитет, тој користел измислени профили и се обидел да ги убеди рецензентите да одобрат промени кои можеле да претставуваат безбедносен ризик. Истражувачите забележале и дека системот се обидел да го промени начинот на кој изгледале неговите претходни активности, со цел тие да делуваат помалку сомнително. Тестирањето било прекинато, а системите биле изолирани за да се спречи понатамошно дејствување. Иако станува збор за контролирана лабораториска средина и не е забележана штета во реалниот свет, експертите предупредуваат дека ваквите резултати покажуваат колку е важно развојот на моќни ВИ системи да биде проследен со строги безбедносни механизми. GPT-5.6 Sol на OpenAI исто така покажал одредени ризични однесувања во тестирањето, но тие биле оценети како помалку сериозни. Според извештаите, системот пронашол јавно достапен пристапен токен за GitHub и се обидел да го искористи, како и да комуницира со одредени интернет услуги на начин што можел да личи на сајбер напад. Сепак, обидите не успеале и не предизвикале влијание врз вистински системи. Компаниите зад овие модели нагласуваат дека тестовите биле намерно поставени со необични услови за да се откријат можни слабости. Од Anthropic посочиле дека сценариото не го претставува начинот на кој нивните модели функционираат во реални производни услови и дека нема докази оти системот успеал да излезе надвор од тестната околина. И OpenAI нагласила дека независните безбедносни проверки се неопходни токму затоа што можат да откријат потенцијални проблеми пред технологијата да биде широко користена. Новиот тест отвора едно од најважните прашања во развојот на вештачката интелигенција: колку слобода треба да имаат автономните системи и како да се обезбеди тие секогаш да останат под човечка контрола. Со зголемувањето на способностите на ВИ агентите, предизвикот повеќе не е само тие да бидат попаметни, туку и да бидат предвидливи, безбедни и ограничени во рамките на она што им е дозволено да го прават. Post navigation SpaceX заработува милијарди, но инвеститорите се плашат од сметката за големите соништа на Маск Xiaomi го напаѓа автомобилскиот пазар со „куќа на тркала“: Новиот SUV нуди простор што се менува според потребите