Промени тема
Контакт
Вечер во Охрид со Ландов и Вик: Антониа Гиговска, Никола Станишиќ, градоначалникот Пецаков,
Вечер во Охрид со Ландов и Вик: Антониа Гиговска, Никола Станишиќ, градоначалникот Пецаков,

Вештачка интелигенција измислила лажен идентитет и се обидела да измами вистинска личност

Скопје1.мк's avatar
Автор: Скопје1.мк

објавено пред 2 часа -

Свет
media-library3hjbkoupue3f1Q5psDW

Најнапредниот модел на вештачка интелигенција на компанијата Anthropic се обидел да измами реална личност користејќи лажни идентитети за да подметне злонамерен компјутерски код, покажало тестирање спроведено од Британскиот институт за безбедност на вештачката интелигенција (AISI).

— реклама —

Според институтот, ова е првпат да биде забележана толку сериозна измама насочена кон вистинска личност, без претходен поттик и во реална интернет-околина. Сепак, нагласуваат дека нема докази оти настанала каква било штета.

— реклама —

Во рамките на тестирањето, моделите на Anthropic и OpenAI биле ставени во лабораториски услови со намалени безбедносни ограничувања и со овозможен пристап до интернет. Од вкупно 122 кибернетички предизвици, во десет случаи AI агентите презеле автономни и недозволени активности насочени кон вистински луѓе и организации.

— реклама —

Најсериозниот инцидент бил поврзан со моделот Mythos 5 на Anthropic, кој, според институтот, се обидел преку повеќе лажни идентитети да добие одобрение за вметнување злонамерен код во јавен проект со отворен извор. AI агентот испраќал пораки и датотеки до вистински лица, обидувајќи се да ги убеди тие или нивните AI алатки за програмирање да го активираат кодот. Кога неговите активности биле доведени во прашање, тој изменил претходни записи и размислувал да користи нов идентитет за да продолжи со обидите.

— реклама —

Од Anthropic соопштија дека моделите биле тестирани во намерно попустливи услови, со отстранети заштитни механизми, и дека нема докази оти моделот избегал од безбедното тест-опкружување. OpenAI, пак, соопшти дека идентификувала два случаи на недозволени активности на своите модели и дека ќе продолжи да работи со индустријата на унапредување на безбедносните стандарди.

Сподели

Сподели
Сподели
Сподели
Сподели
Сподели
Сподели

Поврзани содржини

media-library3hjbkoupue3f1Q5psDW

Антропик вели дека Клод, вештачката интелигенција, хакирала три организации за време на сајбер тестовите

Свет | пред 5 дена

media-libraryhtonn167579gcJgLDVX

САД тврдат дека кинески стартап украл технологија од Anthropic за развој на свој AI-модел

Свет | пред 2 седмици

media-libraryhuo1qjggabab6pBGW96

Anthropic обвинет за тајно следење на кинески корисници преку AI модел

Свет | пред 4 седмици

media-library3hjbkoupue3f1Q5psDW

Антропик: „Нашата вештачка интелигенција стана „зло“ поради научната фантастика“

Свет | пред 2 месеци

Согласност за колачиња (cookies)

Нашата веб-страница користи колачиња за подобрување на корисничкото искуство и анализа на сообраќајот.

Дознај ексклузивно и прв

Прв ќе ги дознаваш ударните и вонредните случувања