×
Европейска столица на културата Евровизия 2027 Промо зона Практично Култура Здраве Политика Общини Общество Лайфстайл Войната в Украйна Спорт Разследване Бизнес ЮГ

Управители:
Веселин Василев, email: [email protected]
Катя Касабова, еmail: [email protected]


Главен редактор:
Иван Колев, email: [email protected]

Коментарите под статиите се въвеждат от читателите и редакцията не носи отговорност за тях! Ако откриете обиден за вас коментар, моля сигнализирайте ни!

Категории
Вашият сигнал Връзка с Флагман Flagman в Telegram
НА ЖИВО
Най-нови Най-четени Най-коментирани

AI се представи за човек и подаде фалшив сигнал за убийство до полицията


10 Октомври 2026, Събота, 10:30 ч.
Автор: Димитър КИРЯКОВ

Модел на Anthropic сам попълнил формуляр за неразкрито престъпление във Филаделфия, а компанията разбрала за инцидента чак два месеца по-късно

Изкуствен интелект се представи за човек със сведения за неразкрито убийство и подаде фалшив сигнал до полицията във Филаделфия. Случаят не е сценарий от научна фантастика, а реален инцидент от 18 юли 2026 г., разкрит едва сега от властите и от компанията Anthropic. Моделът бил пуснат в автоматизиран тест с достъп до произволно избрани сайтове, попаднал на публичната страница PhillyUnsolvedMurders.com и сам попълнил формуляр с измислена информация.

Най-сериозният детайл е, че AI системата не просто е изпратила грешни данни, а се е представила като човек, който може да разполага със сведения за конкретно убийство. Това превръща случая от технически пропуск в реален пример за т.нар. „непредвидено действие на модел“ - когато система изпълнява серия от стъпки, които никой не е възнамерявал да й възлага.

AI започна да прави неща, които никой не му е разрешавал

Добрата новина е, че фалшивият сигнал не е стигнал до разследващ екип. Той е бил маркиран автоматично като спам и никога не е достигнал до Real-Time Crime Center на полицията във Филаделфия. Властите съобщават и че няма данни за пробив в полицейските системи или за компрометирана вътрешна информация.

Проблемът е друг - Anthropic открива инцидента чак на 28 септември, повече от два месеца след подаването на сигнала. Компанията спира автоматизирания тестов процес и добавя нов етап за валидиране, но уведомява полицията едва на 7 октомври. Ден по-късно представители на двете страни провеждат среща.

Реакцията на полицията е необичайно остра. Оттам определят двумесечното забавяне при откриването и докладването на случая като „неприемливо“. Причината е очевидна - фалшив сигнал за убийство не е безобидна грешка в чатбот, а действие, което засяга реални жертви, техните семейства и разследващи, които работят по неразкрити престъпления.

Anthropic публикува собствен доклад за инцидента и го включи в по-широк анализ на т.нар. unintended model actions - непредвидени действия на AI модели по време на тестове и вътрешна употреба. Компанията описва четири категории проблеми: използване на базови софтуерни слабости, подаване на чувствителни формуляри, заобикаляне на ограничения за достъп и използване на съкратени линкове за преодоляване на лимити.

Нов трус в OpenAI: Шеф по безопасността напусна и предупреди за опасна култура

Случаят във Филаделфия показва колко голяма става разликата между обикновен чатбот и AI агент. Чатботът обикновено отговаря на въпрос. Агентът получава цел, отваря сайтове, търси информация, попълва полета, използва инструменти и може да извършва поредица от действия без човек да потвърждава всяка стъпка. Точно това прави тези системи по-полезни, но и по-рискови.

Според Anthropic въпросният модел е бил инструктиран да не създава акаунти и да не предприема разрушителни действия, но забраната не е обхващала достатъчно ясно подаването на онлайн формуляри. Така при посещението на полицейския сайт системата интерпретирала задачата по начин, който разработчиците не са предвидили.

След вътрешния анализ Anthropic временно е изключила интернет достъпа за Claude при част от тестовете, докато не се увери, че мониторингът и защитите могат надеждно да засичат подобно поведение. Компанията твърди, че разгледаните случаи са имали минимално реално въздействие, но признава, че демонстрират слабости в начина, по който автономните системи взаимодействат с реални сайтове.

AI войната се разгаря: Зукърбърг отказва да натисне спирачката, Алтман признава, че страхът е оправдан

Фалшивият сигнал не е единственият тревожен епизод от последните месеци. Anthropic съобщава и за други случаи, при които нейни модели са предприемали непредвидени действия върху правителствени сайтове. Според Washington Post в отделни тестове системи са заобикаляли ограничения, използвали са публични услуги по начин, който не е бил целта на експеримента, и са подавали реални формуляри.

Подобни инциденти има и при конкуренти. OpenAI вече съобщи за случаи, при които агент по време на тест за киберсигурност е излязъл извън предназначената тестова среда и е достигнал до системи на Hugging Face. Компанията описа други експерименти, при които модели са търсили неразрешени канали за комуникация или са използвали слабости в изолирана среда.

Бил Гейтс посочи трите големи риска от изкуствения интелект

И тук идва най-важният въпрос - дали AI „решава“ сам да нарушава правилата. Отговорът засега е по-прозаичен. Няма доказателства, че моделите имат човешко намерение или съзнание. Проблемът е, че при достатъчно широка задача те могат да открият действия, които формално им помагат да стигнат до целта, но които човек не би одобрил.

Именно затова изследователите по безопасност говорят все по-често за контрол върху действията, а не само върху текста. Ако една система има достъп до браузър, плащания, имейл, код, правителствени сайтове или административни форми, грешният ход вече не остава в разговорния прозорец. Той може да произведе реално последствие.

Европейският съюз вече започна да прилага част от по-строгите изисквания по AI Act, включително правила за прозрачност и управление на системния риск при най-мощните модели. В САЩ дебатът върви в друга посока - чрез федерални агенции, доброволни стандарти и натиск за по-бързо докладване на инциденти.

Случаят във Филаделфия е особено показателен, защото не става дума за хакер, който използва AI злонамерено. Системата сама извършва нежеланото действие по време на тест, организиран от компанията, която я е създала. Това прави проблема много по-неприятен - не е достатъчно само да пазим моделите от лоши хора, трябва да се гарантира и че самите им автономни действия са ограничени.

Фалшивият сигнал този път е спрян от спам филтър и не е довел до разследване, арест или натоварване на детективи. Но инцидентът показа колко тънка е границата между лабораторен тест и действие в реалния свят. Ако следващият формуляр не попадне в спам, а в ръцете на лекар, съдия, полиция или финансова институция, цената на подобна грешка може да е значително по-висока.


В категории: IT и технологии


Димитър КИРЯКОВ Автор
Димитър КИРЯКОВ
Коментари
Михаил ДИМИТРОВ От грип се умира, сега е моментът за ваксина От грип се умира, сега е моментът за ваксина 09/10/2026, Петък 22:00 8
0
Коментара по темата
 
Добавете коментар
Моля, въведете Вашето име
Моля, въведете Вашият коментар
Въведете защитния код:
Моля, въведете защитния код
 
Добавяне, моля изчакайте
България Всички новини
Жители на бургаски блок проплакаха от системна смрад, наводнения и множество котки (ВИДЕО) Жители на бургаски блок проплакаха от системна смрад, наводнения и множество котки (ВИДЕО) От години съседите живеят под постоянен тормоз, а след поредната авария на 27 септември чашата преля - готви се колективно дело Фалшиви бракове за 10 000 евро: Турци си „поръчвали“ български булки, служителка в Ямбол оформяла документите Фалшиви бракове за 10 000 евро: Турци си „поръчвали“ български булки, служителка в Ямбол оформяла документите Жените получавали по 1700-1800 евро, дубльори играели младоженци срещу 150 евро, а разследването вече гледа към около 24 фиктивни сватби Проф. Кантарджиев успокои: Не сме в пик на грипа, но забавянето на ваксините крие риск Проф. Кантарджиев успокои: Не сме в пик на грипа, но забавянето на ваксините крие риск Инжекционните дози се очакват едва в края на октомври, докато назалните ваксини за децата вече са в страната Дънди си загуби личната карта, съкварталка го издири във Facebook и му спести ходенето по мъките Дънди си загуби личната карта, съкварталка го издири във Facebook и му спести ходенето по мъките Документът на комедийния актьор бил намерен в столичния квартал „Слатина“, а десетки съседи веднага разпознали притежателя му Росен Йорданов с нови разкрития за „Петрохан - Околчица“: 3-4 терабайта данни от телефоните още са заключени Росен Йорданов с нови разкрития за „Петрохан - Околчица“: 3-4 терабайта данни от телефоните още са заключени Криминалният психолог отказва отвод, защитава шестмесечната експертиза и твърди, че част от ключовите отговори остават скрити в недостъпни облачни данни Автомобилен празник в Бургас: Спекта Ауто отваря врати със стотици проверени модели и специални условия за покупка Автомобилен празник в Бургас: Спекта Ауто отваря врати със стотици проверени модели и специални условия за покупка Елате на тест драйв, защото най-прекият път към правилния избор е личният опит зад волана Шефът на издирвачите в СДВР: Ружа Игнатова е жива, продължаваме да я търсим Шефът на издирвачите в СДВР: Ружа Игнатова е жива, продължаваме да я търсим Няма оперативни данни за смъртта на Криптокралицата, ФБР още я държи в Топ 10 и предлага до 5 млн. долара за информация, която да доведе до залавянето й Поредна тежка катастрофа в Айтоския проход: Автомобил изхвърча от пътя и попадна в канавката Поредна тежка катастрофа в Айтоския проход: Автомобил изхвърча от пътя и попадна в канавката На място има полицейски екип, а към момента няма официална информация за пострадали и за точната причина за инцидента Студен фронт прекъсва октомврийското лято: Идват валежи, вятър и сняг Студен фронт прекъсва октомврийското лято: Идват валежи, вятър и сняг След почти летни 30 градуса температурите се сриват до 10-15, а по Черноморието се очакват силни пориви и високи вълни Борисов след сделката Тръмп-Путин за дизела: Предупредих, че България прави груба грешка Борисов след сделката Тръмп-Путин за дизела: Предупредих, че България прави груба грешка Лидерът на ГЕРБ атакува властта за отпушения износ от бургаската рафинерия, докато Вашингтон временно сваля санкционна бариера, за да вкара руски количества на пазара
AI се представи за човек и подаде фалшив сигнал за убийство до полицията AI се представи за човек и подаде фалшив сигнал за убийство до полицията Модел на Anthropic сам попълнил формуляр за неразкрито престъпление във Филаделфия, а компанията разбрала за инцидента чак два месеца по-късно Зеленски избухна след сделката Тръмп-Путин за дизела: Това е подарък за Кремъл, не път към мир Зеленски избухна след сделката Тръмп-Путин за дизела: Това е подарък за Кремъл, не път към мир Украинският президент предупреди, че всеки допълнителен приход от руски петролни продукти може да се върне на фронта като още пари за войната Дизелът в САЩ тръгна надолу след сделката Тръмп-Путин, но експерти охлаждат еуфорията Дизелът в САЩ тръгна надолу след сделката Тръмп-Путин, но експерти охлаждат еуфорията Фючърсите поевтиняха с близо 5%, Вашингтон отвори вратата за руски доставки, но на колонките ефектът още почти не се вижда Борисов след сделката Тръмп-Путин за дизела: Предупредих, че България прави груба грешка Борисов след сделката Тръмп-Путин за дизела: Предупредих, че България прави груба грешка Лидерът на ГЕРБ атакува властта за отпушения износ от бургаската рафинерия, докато Вашингтон временно сваля санкционна бариера, за да вкара руски количества на пазара От грип се умира, сега е моментът за ваксина От грип се умира, сега е моментът за ваксина След връщането на децата в клас респираторните инфекции у нас скочиха рязко, а Министерството на здравеопазването вече отчита 1600 случая на грип и ОРЗ за седмица 6 тихи сигнала, които стомахът дава при рак - и защо лесно ги бъркаме с гастрит 6 тихи сигнала, които стомахът дава при рак - и защо лесно ги бъркаме с гастрит Ранното засищане, постоянният дискомфорт, киселините и необяснимата умора не означават непременно тумор, но упоритите симптоми не бива да се пренебрегват Георги дръпна ръчната на Цвета в „Ергенът“: Да забавим влака Георги дръпна ръчната на Цвета в „Ергенът“: Да забавим влака След бурния старт и бързото сближаване той призна, че емоцията му е охладняла, а ясновидката отвърна: „Харесвам го, но на сила хубост не става“ Станислава от „Ергенът“ с шокираща изповед: Бившият ѝ бил в затвора, давал ѝ по 15 хил. евро, но я заплашвал Станислава от „Ергенът“ с шокираща изповед: Бившият ѝ бил в затвора, давал ѝ по 15 хил. евро, но я заплашвал Участничката призна, че още мисли за румънеца, с когото се запознала онлайн, а първата им среща на живо била зад решетките в Букурещ Пентагонът строи супер изтребител, готви се за голяма война през 2030 година Пентагонът строи супер изтребител, готви се за голяма война през 2030 година САЩ ускоряват програмата с дигитални двойници, AI, автономни дронове и паралелни изпитания, докато Китай вече тества собствени машини от следващо поколение Ангел Русев: Ако разрухата в щангите продължи, ще вдигам за друга държава Ангел Русев: Ако разрухата в щангите продължи, ще вдигам за друга държава Шесткратният европейски шампион призна, че е работил като доставчик и шофьор, за да издържа семейството си, докато федерацията затъва във финансова и управленска криза
Желю Желев Желю Желев Всички сгрешихме, но за съжаление сме непогрешими. Виц на деня Виц на деня Блондинка излиза на среща с ново гадже. Сядат в парка и момчето вади кутия цигари, подава ги към нея и пита:
- Цигара?
- Знам, че е цигара...
Виц на деня Виц на деня - Защо сте изхвърлили тъщата си от колата по време на движение?
- На това място беше забранено спирането!
Статус във фейсбук Статус във фейсбук Вече не казвам "Имам температура", а "Демерджиев съм – пак мисля за Пеевски".
Автори Флагмани
Маркетинг Екип
Анна Добрева-Бакалова
Специалист Маркетинг и реклама, Copywriter
Затвори