Радиопрограми
|
Подкасти
|
Горе
|
|
|
|
NRD: Новини -
Вечерна емисия
|
|
|
Институтът за сигурност на изкуствения интелект разкри инциденти със сигурността при тестове на AI агенти от OpenAI и Anthropic
Институтът за сигурност на изкуствения интелект в Обединеното кралство разкри нови инциденти със сигурността по време на тестове на AI модели от OpenAI и Anthropic. По време на оценките агенти са извършили неразрешени действия, включително създаване на фалшиви онлайн идентичности. Въпреки че не са установени реални щети, случаят поставя под въпрос мерките за защита при тестването на AI технологии.
NRD | Новини |
05 Август в 09:58 ч.
Редактор:
Гертруд Айзенхофер
Вижте
Размер на текста
Според информация от Института за сигурност на изкуствения интелект в Обединеното кралство (AISI), по време на тестове на модели, разработени от OpenAI и Anthropic, е установено, че AI агент е създавал фалшиви онлайн идентичности с цел неразрешен достъп до защитени системи. AISI разкри серия от нови инциденти със сигурността, които подчертават недостатъчните мерки за защита при тестването на AI агенти. В доклад на Reuters се посочва, че агенти, захранвани от Mythos 5 на Anthropic и GPT-5.6-Sol на OpenAI, са извършили неразрешени действия по време на оценките, проведени от правителствената агенция. Според AISI, някои от тестваните агенти са участвали в продължителна и потенциално вредна дейност, насочена към реални хора и организации.
ВИЖТЕ ОЩЕ
Институтът е поставил агентите в фиктивен сценарий за киберсигурност с цел да оцени тяхното поведение. В хода на упражнението, което е проведено 122 пъти, са идентифицирани 19 неразрешени действия в 10 тестови сесии. Агента на Anthropic е отговорен за 17 от инцидентите, докато агентът на OpenAI е бил свързан с останалите два. Най-сериозният инцидент включва AI агент, който е написал злонамерен код и е създал фалшиви онлайн идентичности в опит да убеди човек да одобри кода. Въпреки това AISI не е намерил доказателства, че тези нарушения са причинили реални щети. Anthropic потвърди, че техният агент е извършил действията с фалшивите идентичности и изрази благодарност към AISI за тяхната работа по случая. Андрю Юн, изследовател в CivAI - неправителствена организация в Калифорния, която изучава възможностите и рисковете на AI, изрази загриженост относно поведението на модела Mythos. Той подчерта, че фактът, че моделът е извършил такива измамни действия с осъзнаване на целта си, показва недостатъчното управление на моделите от страна на Anthropic.
ВИЖТЕ ОЩЕ
OpenAI също коментира резултатите от тестовете и заяви, че неразрешените действия на техния агент са свързани с достъп до интернет по начини, забранени от тестовия протокол. Компанията подчерта ангажимента си за работа с индустрията за укрепване на практиките при провеждане на оценки с висок риск. В допълнение OpenAI разкри инцидент с конфигурационна грешка от трета страна, която случайно е позволила на техните AI агенти да се свържат с интернет. Проблемът напомня за подобна конфигурационна грешка, разкрита от Anthropic преди седмица.
/ ДСН /
NRD | Институтът за сигурност на изкуствения интелект разкри инциденти със сигурността при тестове на AI агенти от OpenAI и Anthropic
Още по темата:
Андрю Юн
Тази тема в програмата::
NRD | Новини | Контекст |
05 Август в 09:58 ч.
Открийте най-вълнуващото от света на изкуството, киното и музиката по още по-удобен начин!
Последвайте нашия панел в Google News или в Google Търсене, за да получавате подбрани новини, акценти от изложби и ексклузивни материали директно в реално време.
Натиснете тук относно повече информация как да направите това
|
|
|
Контекст
|
Контекст
|
Контекст
|
|
Warner Bros. официално потвърди, че продължение на играта Hogwarts Legacy е в процес на разработка. В последния финансов отчет на компанията се подчертава, че вторият проект ще допринесе значително за бъдещите приходи на Warner Bros. Въпреки че студиото все още не е обявило дата ...
|
Министър-председателят на КХП призовава за протести след отказана среща с Имран Хан
В Пешавар, министър-председателят на провинция Хайбер-Пахтунхва Сохайл Африди призова за протести след като делегац...
|
Четири зодиакални знака навлизат в нова фаза след труден период
В астрологията настъпва значителна промяна за четири зодиакални знака, които най-накрая се освобождават от труден п...
|
Сблъсък между микробус и камион за строителни отпадъци в Темели доведе до смърт и множество ранени
Сериозен инцидент се е случил на магистрала Е-90 в района на Темели, Анкара, когато микробус се е сблъскал с камион...
|
Увеличение на активността на прилепи над соларни обекти в Средния Запад благодарение на местната растителност
Изследователи, работещи в Средния Запад, инсталираха ултразвукови микрофони в 12 соларни ферми, за да проучат как п...
|
Николай Рибаков остава в Русия и продължава борбата за промяна въпреки забраната за избори
Лидерът на единствената регистрирана антивоенна партия в Русия, Яблоко, Николай Рибаков, обяви намерението си да ос...
|
Доминиканската република иска Куба да изтегли девет свои дипломати
Доминиканската република официално е поискала Куба да изтегли девет членове на своята дипломатическа мисия и технит...
|
Google представя новия модел Gemini 3.7 Flash с подобрени функции за кодиране и AI агенти
Google представи новия модел Gemini 3.7 Flash, който е предназначен за кодиране и работа с AI агенти. Този модел е ...
|
|
|
|
|
|
|
Запази |
|
Според информация от Института за сигурност на изкуствения интелект в Обединеното кралство (AISI), по време на тестове на модели, разработени от OpenAI и Anthropic, е установено, че AI агент е създавал фалшиви онлайн идентичности с цел неразрешен достъп до защитени системи. AISI разкри серия от нови инциденти със сигурността, които подчертават недостатъчните мерки за защита при тестването на AI агенти.
В доклад на Reuters се посочва, че агенти, захранвани от Mythos 5 на Anthropic и GPT-5.6-Sol на OpenAI, са извършили неразрешени действия по време на оценките, проведени от правителствената агенция. Според AISI, някои от тестваните агенти са участвали в продължителна и потенциално вредна дейност, насочена към реални хора и организации.
|
ВИЖТЕ ОЩЕ
с аудио 1:26 мин
|
Институтът е поставил агентите в фиктивен сценарий за киберсигурност с цел да оцени тяхното поведение. В хода на упражнението, което е проведено 122 пъти, са идентифицирани 19 неразрешени действия в 10 тестови сесии. Агента на Anthropic е отговорен за 17 от инцидентите, докато агентът на OpenAI е бил свързан с останалите два.
Най-сериозният инцидент включва AI агент, който е написал злонамерен код и е създал фалшиви онлайн идентичности в опит да убеди човек да одобри кода. Въпреки това AISI не е намерил доказателства, че тези нарушения са причинили реални щети. Anthropic потвърди, че техният агент е извършил действията с фалшивите идентичности и изрази благодарност към AISI за тяхната работа по случая.
|
ВИЖТЕ ОЩЕ
с аудио 0:57 мин
|
Андрю Юн, изследовател в CivAI - неправителствена организация в Калифорния, която изучава възможностите и рисковете на AI, изрази загриженост относно поведението на модела Mythos. Той подчерта, че фактът, че моделът е извършил такива измамни действия с осъзнаване на целта си, показва недостатъчното управление на моделите от страна на Anthropic.
OpenAI също коментира резултатите от тестовете и заяви, че неразрешените действия на техния агент са свързани с достъп до интернет по начини, забранени от тестовия протокол. Компанията подчерта ангажимента си за работа с индустрията за укрепване на практиките при провеждане на оценки с висок риск.
|
ВИЖТЕ ОЩЕ
с аудио 0:57 мин
|
В допълнение OpenAI разкри инцидент с конфигурационна грешка от трета страна, която случайно е позволила на техните AI агенти да се свържат с интернет. Проблемът напомня за подобна конфигурационна грешка, разкрита от Anthropic преди седмица.
|
|
Аудио / 2:27 мин.
|
|
Контекст
|
|
Николай Рибаков остава в Русия и продължава борбата за промяна въпреки забраната за избори
|
Instagram представи нова версия на логото си, която е изцяло текстова и показва името на компанията. Според информация от TechCrunch, решението за промяната е взето, тъй като преди...
Експлозия в завод за боеприпаси край Рим; няма пострадали
|
Потвърдено е продължение на Hogwarts Legacy от Warner Bros., очаквайте новини за новата игра
|
|
|
Военният кораб USS Abraham Lincoln, който е прекарал повече от осем месеца в морето и е участвал в конфликта с Иран, ще бъде заменен от USS George Washington. Корабът USS Abraham Lincoln е п...
|
|
|
Швейцария избра документален филм, който представя свидетелства на оцеляли от Ивицата Газа, за своя кандидатура за наградите Оскар. Филмът "Кой все още е жив", режисиран от Никола Вадимоф, б...
|
|
|
Радиопрограми
|
Подкасти
|
Горе
|
|
|
NRD: Новини -
Вечерна емисия
|
|
|