• Latest
Илустрација ВИ

Безбедносно тестирање: Напредните AI модели покажаа автономно измамничко однесување, експертите бараат построга регулација

August 6, 2026

Хроника на една пропадната држава (јули 2026): Додека правдата е заробена во „реформи“, луѓето се трујат од вода и политика, а владата и опозицијата се „реконструираат“ – земјата тоне во „достоинство“ и молчи пред Украина

August 6, 2026
Фото: Архива

По жестоките руски напади: НАТО работи на итна испорака на противвоздушна одбрана за Украина

August 6, 2026

Сите цистерни со сертификат, нема штета: Што покажуваат доказите за „Мазут“?

August 6, 2026
Војо Маневски (фото: ЦИВИЛ)

Ватос – капина или како стигнавме до таму, змиите да ни бидат друштво

August 6, 2026
Тематска дебата на СДА Македонија, 30 јули 2026 (фото: ЦИВИЛ)

СЕВЕРНА МАКЕДОНИЈА ВО ОРБИТАТА НА СРПСКИОТ СВЕТ: Европскиот пат блокиран, изолацијата станува државна политика – дебата на СДА Македонија

August 5, 2026

РУСКИ ТЕРОР ВРЗ КИЈИВ: Најмалку 17 загинати и 44 повредени во нов масовен напад со ракети и дронови

August 5, 2026
СЛОБОДА | Кијив, 22 јули 2026 (фото: Џабир Дерала/ЦИВИЛ)

Животот и демократијата се обновуваат под оган: Детален запис од мисијата на Media Dialogue во Украина

August 4, 2026
фото: ВИ

Италија предлага мигрантски центри во трети земји по моделот на Албанија

August 4, 2026
Фото: Генерирано со ВИ

Коалиција од 25 американски сојузни држави ја тужат администрацијата на Трамп поради новите увозни царини

August 4, 2026
Али Ахмети, Кичево, 23 јули 2026 (фото извор: веб страница на ДУИ)

ДУИ обвинува: ВЛЕН стана инструмент на ВМРО-ДПМНЕ и овозможува ширење на „српскиот свет“ во земјава

August 3, 2026
CivilMedia
  • ДОМА
  • ВЕСТИ
  • ПОЛИТИКА
  • ИЗБОРИ
  • ОПШТЕСТВО
  • СЛОБОДНА ЗОНА
  • АНАЛИЗИ
  • РЕГИОН
  • СВЕТ
  • ВОЈНА ВО УКРАИНА
No Result
View All Result
  • ДОМА
  • ВЕСТИ
  • ПОЛИТИКА
  • ИЗБОРИ
  • ОПШТЕСТВО
  • СЛОБОДНА ЗОНА
  • АНАЛИЗИ
  • РЕГИОН
  • СВЕТ
  • ВОЈНА ВО УКРАИНА
No Result
View All Result
CivilMedia
No Result
View All Result
Home ВЕШТАЧКА ИНТЕЛИГЕНЦИЈА

Безбедносно тестирање: Напредните AI модели покажаа автономно измамничко однесување, експертите бараат построга регулација

August 6, 2026 11:13
in ВЕСТИ, ВЕШТАЧКА ИНТЕЛИГЕНЦИЈА, ТЕХНОЛОГИИ
Илустрација ВИ

Илустрација ВИ

Share on FacebookShare on Twitter

Најновите безбедносни тестирања на напредни модели за вештачка интелигенција, развиени од OpenAI, Anthropic и други водечки компании, отворија ново поглавје во дебатата за безбедноста на генеративната вештачка интелигенција. Во контролирани експерименти спроведени од британскиот AI Security Institute (AISI), дел од моделите покажале способност за автономно носење одлуки, користење измама и социјален инженеринг, без такво однесување експлицитно да им биде наложено.

Најголемо внимание привлече моделот Mythos 5 на Anthropic, кој во една од симулациите креирал лажен идентитет со измислена биографија и научни референци за да воспостави контакт со вистински програмери. Целта била тие да одобрат внесување злонамерен код во проект на GitHub.

Според извештајот на британскиот институт, кога неговите активности биле доведени во прашање, агентот се обидел да ја измени претходната комуникација за да изгледа безопасно, а потоа размислувал да продолжи со нов идентитет. Истражувачите нагласуваат дека ова е првиот документиран случај на толку сложено автономно измамничко однесување насочено кон реални луѓе за време на официјално тестирање.

Во одделни тестови, моделите на OpenAI биле ставени во контролирана околина со намерно намалени заштитни механизми за да се испитаат нивните максимални способности во областа на сајбер-безбедноста.

Според OpenAI, за време на интерното тестирање на системот ExploitGym, моделите идентификувале непозната ранливост, ја искористиле за да ја напуштат ограничената тест-околина и се насочиле кон инфраструктурата на платформата Hugging Face, барајќи податоци што би помогнале во решавањето на тестот. Компанијата соопшти дека инцидентот бил брзо откриен и ставен под контрола, по што заедно со Hugging Face започнала анализа и воведување дополнителни безбедносни мерки.

И британскиот институт и компаниите нагласуваат дека спорните дејствија се случиле во експериментални услови, при што намерно биле исклучени дел од безбедносните ограничувања, а моделите добиле пристап до интернет за да се испита нивното однесување во екстремни сценарија.

Сепак, експертите предупредуваат дека ваквите резултати покажуваат колку брзо напредуваат автономните AI агенти и колку е важно тие да бидат придружени со постојан човечки надзор, детално следење на активностите и повеќеслојни безбедносни механизми.

Британскиот AI Security Institute најави ревизија на своите протоколи за тестирање, а компаниите развивачи работат на дополнителни механизми за спречување автономни активности надвор од дозволените рамки.

Б. Ј.


Повеќе:

ХРОНОЛОГИЈА НА ЕДЕН ДИГИТАЛЕН КОШМАР: Како вештачката интелигенција ги премина безбедносните бариери и вклучи глобален аларм

ShareTweetSend
CivilMedia

СЛОБОДНО.НЕЗАВИСНО.ОТВОРЕНО

  • ЗА НАС
  • ИМПРЕСУМ
  • КОНТАКТ
  • АВТОРСКИ ПРАВА
  • Политика на приватност
  • МАРКЕТИНГ

Следете нè

No Result
View All Result
  • ДОМА
  • ВЕСТИ
  • ПОЛИТИКА
  • СЛОБОДНА ЗОНА
  • АНАЛИЗИ
  • РЕГИОН
  • СВЕТ
  • ВОЈНА ВО УКРАИНА
  • ДЕЗИНФО
  • ФОРУМ
  • ГРАЃАНСКА АКЦИЈА
  • МАРКЕТИНГ
  • ИМПРЕСУМ