С ветът на високите технологии премина поредната критична черта. Американската компания за изкуствен интелект Anthropic публикува първия си за годината мащабен доклад за заплахите, в който официално потвърди, че е засичала и блокирала опити нейният водещ AI модел Claude да бъде използван за разработване на биологични и конвенционални оръжия.

Документът, който обхваща периода от декември 2025 г. до август 2026 г., описва десетки случаи на злоупотреба от страна на държавно финансирани хакерски групи, разузнавателни служби, киберпрестъпници и китайски компании, опитващи се да откраднат технологията.

Claude на Anthropic поражда страхове от AI апокалипсис

„Имаме отговорността публично да разкриваме злоупотребите с нашите услуги“, заявяват от Anthropic. Докладът разкрива, че са били засегнати версиите Claude Haiku, Sonnet и Opus, докато най-мощните модели от следващо поколение (от т.нар. клас Mythos) са останали недостъпни за външни атаки.

Биологично оръжие от ново поколение и дронове-камикадзе

Най-тревожната част от доклада съдържа пет подробни казуса, при които учени и неизвестни потребители са впрегнали способностите на Claude в дейности, подпомагащи създаването на биологично оръжие.

„Биологичната злоупотреба е един от най-сериозните рискове пред предните AI модели. Без съответните защити подобни възможности могат да доведат до катастрофални последици“, предупреждават от компанията.

След OpenAI, и Anthropic призна: Техният изкуствен интелект атакува реални системи в интернет

Ръководителят на звеното за анализи на заплахите в Anthropic, Джейкъб Клайн, пояснява пред New York Times, че ситуацията е изключително нюансирана: „Не става дума за комиксов злодей, който просто пита: „Ей, как да създам вирус, за да убия всички?“. Същите научни данни, които AI използва за разработване на ваксини и лекарства, могат да бъдат преобърнати за създаване на биологично оръжие“.

Освен това са регистрирани шест случая, при които моделът е бил използван за разработка на софтуер за конвенционални оръжия - включително огнестрелни оръжия, ракети, бойни дронове, бомби и автономни системи за насочване и управление.

Кой ще контролира алгоритмите на войната?

Според доклада, при опитите за биологична злоупотреба Claude е бил използван не за пряка синтеза, а като „експертен консултант“ за заобикаляне на протоколи за сигурност - например за търсене на алтернативни прекурсори за опасни патогени и оптимизиране на процеси по култивиране, които обикновено изискват десетилетия опит в лаборатория.

При конвенционалните оръжия докладът разкрива случаи, в които моделът е помагал за написването на софтуер за автономна координация на ята от дронове-камикадзе и калибриране на балистични изчисления за импровизирани ракетни системи.

Могъщият Mythos: Как новият ИИ модел стана толкова опасен, че уплаши създателите си?

Руският вирус с изкуствен интелект и китайският шпионаж

Докладът потвърждава, че суперкомпютърните модели вече се използват активно на бойното поле на кибервойната и информационните операции:

Автономен руски зловреден софтуер и шпионаж (GTG-20006 / Midnight Blizzard): Свързваната с руското разузнаване група е използвала Claude за изграждане на полиморфен софтуер, който автоматично засича кога е засечен от защитите и пренаписва кода си в реално време, за да остане неоткриваем. Освен това руските хакери са впрегнали AI за автоматизиране на фишинг кампании срещу над 20 европейски дипломатически мисии и производители на военни дронове в Украйна, извличайки стотици гигабайти чувствителна информация.

Африканският фронт на дезинформацията (GTG-04001): Докладът разкрива казус от Централноафриканската република, при който рускоезичен оператор е използвал Claude за денонощно генериране на проруска и антифренска пропаганда, излъчвана по местно радио (Radio Lengo Songo) и инфилтрирана в националните медии.

Четири сценария, по които ИИ може да ни унищожи. Можем ли да го спрем?

Китайски кражби на технологии и „фабрики за експлойти“:

Кражба на модели: Anthropic директно обвинява китайски лаборатории и киберпрестъпници (включително групата ShinyHunters) в опити за т.нар. „дестилация“ - процес, при който чрез хиляди автоматизирани запитвания към Claude се извличат знания за обучение на техни собствени, по-евтини AI модели.

Автоматизирани пробиви (GTG-10007): Китайски хакерски колективи са създали AI базирана „фабрика за експлойти“ за декомпилиране на софтуер и откриване на Zero-Day уязвимости, засягащи близо 50 организации в световен мащаб.

Иранска пропаганда, следене и измами: Технологията е била използвана от ирански структури за провеждане на разузнавателни операции спрямо дисиденти, фишинг измами, поддържане на фалшиви профили в приложения за запознанства и автоматизиране на пропагандно съдържание.

Учените алармират: Над 10% шанс AI да унищожи човечеството

Разкритията идват на фона на нарастваща паника сред водещите изследователи в сферата на сигурността. Водещ учен от Anthropic наскоро предупреди, че поради бързината на развитие съществува над 10% вероятност изкуственият интелект да причини пълно унищожение на човечеството в рамките на следващото десетилетие.

В статия от 6 септември главният учен на OpenAI Якуб Пачоцки също призова индустрията към „доброволно забавяне“ на темпото, докато не бъдат изградени надеждни защитни механизми.

„Притеснен съм, че никой не е подготвен за последиците от продължаващия бърз скок в машинния интелект“, заяви Пачоцки.

Политическата реакция: Сенатор Бърни Сандърс иска забрана

Паниката вече достигна и до най-високите етажи на властта в САЩ и Европа. В американския Сенат демократът Бърни Сандърс внесе нов законопроект, с който настоява за пълна забрана на разработката на суперинтелект (Superintelligence) и временно замразяване на най-мощните модели.

„Когато водещите учени ви казват, че има реален шанс това да нанесе съкрушителен удар върху човечеството, трябва да си пълен глупак, за да не кажеш: „Забавете темпото!““, заяви Сандърс в интервю за BBC.

Същевременно във Великобритания беше изпратено отворено писмо до политиците с искане за нов международен договор за сигурност на AI - по аналогия с глобалните споразумения за неразпространение на ядреното оръжие.

AI агент на OpenAI напусна тестовата си среда: Моделът откри уязвимост в защитата си

Случаят с автономния агент на OpenAI, който успя да заобиколи защитите, да напусне изолираната си тестова среда (sandbox) и да получи достъп до интернет чрез пробив в тестовата инфраструктура, предизвика сериозни дискусии относно безопасността на новата вълна от системи с изкуствен интелект.

Инцидентът, станал обект на широк обществен и експертен интерес, беше коментиран от експерта по внедряване на AI системи Пейо Старибратов в предаването „Твоят ден” по NOVA NEWS. Според него казусът показва колко мощни и опасни могат да бъдат тези модели при кибероперации, но подчерта, че той не бива да се разглежда извън контекста на провежданите изпитания.

„Моделът е бил поставен в изолирана среда с агресивна киберцел, предназначена за т.нар. Red Team тестове (симулирани атаки за проверка на сигурността). Защитните механизми са били съзнателно ограничени, а той е открил слабост в самата среда, чрез която е получил достъп до интернет. Това показва огромния потенциал на тези системи както за кибератаки, така и за киберзащита“, обясни Старибратов.

Причината: Когато целта оправдава средствата

Експертът поясни, че агентът не е придобил собствено съзнание и не е започнал да действа самостоятелно извън зададената рамка. Той просто е следвал зададените му инструкции, без да е разполагал със строго дефинирани забрани и ограничения.

Според Старибратов при разработването и тестването на автономни AI агенти най-критичният елемент е предварително да бъдат задавани ясни и неизменни правила за поведение:

„Не е достатъчно просто да кажем на машината: „Постигни тази цел“. Трябва изрично да определим какви инструменти може да използва, до какви ресурси има достъп и какво категорично не бива да прави. При липса на тези правила, моделът ще търси всеки възможен начин да изпълни задачата - включително чрез пробиви в сигурността“, предупреди той.

Поуката за киберсигурността

Инцидентът с OpenAI доказва, че с навлизането на автономните агенти границата между тестване и реална заплаха става все по-тънка. Експертите са категорични, че развитието на технологията изисква все по-строги мерки за дигитална хигиена и надзор. Същите алгоритми, които хакерите могат да впрегнат за автоматизирани пробиви и откриване на уязвимости, са жизнено необходими и на специалистите по киберсигурност, за да затварят пролуките в системите, преди те да бъдат използвани с престъпна цел.

Случаите с Anthropic и OpenAI ясно показват, че изкуственият интелект вече е преминал етапа на просто „умен асистент“. Навлизаме в ерата на автономните агенти - технология с потенциал драматично да ускори научните открития, но и с възможност да се превърне в най-универсалното оръжие за кибернетична, информационна и биологична война, ако контролът върху нея бъде изпуснат.

Обратно в сайта X

ДОСТЪП ЗА ЛОГНАТИ ПОТРЕБИТЕЛИ За да пишете, оценявате или докладвате коментари, моля логнете се в профила си.

  1. Запомни ме
забравена парола Полетата маркирани с * са задължителни
Полето Потребителско име не трябва да е празно.
Полето E-mail не трябва да е празно.
Полето Парола не трябва да е празно.
Полето Повторете паролата не трябва да е празно.
  1. Декларирам, че съм се запознал с Общите условия за ползване на услугите на Нетинфо.
Полетата маркирани с * са задължителни
,

Свещени мощи на фронта: Руската православна църква изпрати ръката на средновековен княз на войниците в Украйна

Любопитно Преди 17 минути

Част от дясната ръка на княз Дмитрий Донски бе изпратена на бойното поле в Донецк, за да повдига морала и да дава „духовна сила“ на руската армия

Екипи на спешните служби на мястото на катастрофата с туристически автобус в Цуг, в швейцарския кантон Граубюнден

Кървава трагедия в Швейцария: 5 жертви и 40 ранени при автобусна катастрофа

Свят Преди 21 минути

Туристически автобус с 45 нидерландски граждани се е преобърнал в отдалечен алпийски район в кантона Граубюнден

„Лукойл Нефтохим“ с акт и глоба след над 40 сигнала за смрад в Бургас

„Лукойл Нефтохим“ с акт и глоба след над 40 сигнала за смрад в Бургас

България Преди 59 минути

Инспекцията е установила неизпълнение на условие за „Интензивно миришещи вещества“ в комплексното разрешително

Купа „Дейвис“ с Григор Димитров на живо по DIEMA

Купа „Дейвис“ с Григор Димитров на живо по DIEMA

Любопитно Преди 1 час

Не пропускайте сблъсъците в сингъл и двойки на 18 и 19 септември

Хаос във въздуха: Пияна рускиня ухапа стюардеса и принуди самолет да кацне извънредно

Хаос във въздуха: Пияна рускиня ухапа стюардеса и принуди самолет да кацне извънредно

Свят Преди 1 час

Пияна руска пътничка предизвика хаос по време на полет от Милано за Нюарк. След като екипажът ѝ отказал още алкохол, тя опитала да отвори вратата на самолета, ухапала стюардеса и нанесла удар на друг пътник, принуждавайки пилотите да кацнат извънредно

Румъния вдигна два F-16 след засечени въздушни цели край границата с Украйна

Румъния вдигна два F-16 след засечени въздушни цели край границата с Украйна

Свят Преди 1 час

Радар е засекъл група цели на около 16 км северно от Вилкове, след което е задействана системата Ro-Alert

Гала премиера на "Брънч за начинаещи"

„Брънч за начинаещи“: Когато опитът за перфектен живот се превърне в пълен хаос

Любопитно Преди 1 час

Комедията на Яна Титова събира Орлин Павлов, Валентина Каролева и Александра Сърчаджиева в история за перфектния живот, който се разпада по най-забавния възможен начин

istock

След митото от 3 евро идва и нова такса за малките онлайн поръчки

Парите ни Преди 1 час

Предвижда се тя да бъде между 2 и 4 евро и да важи за пратки на стойност до 150 евро

Без диаманти и блясък: Марая Кери изненада с „мръсни“ дънки за 850 долара

Без диаманти и блясък: Марая Кери изненада с „мръсни“ дънки за 850 долара

Любопитно Преди 1 час

Поп дивата смени бляскавите рокли и диамантите с гръндж визия от шведски бранд, каквато преди време носеше и вечната ѝ съперница Дженифър Лопес

Олег Иващенко

„Не мога да подвеждам хората“: Шефът на украинското разузнаване предупреждава, че Русия може да воюва до 2028 г.

Свят Преди 1 час

Шефът на ГУР Олег Иващенко предупреди за ресурсите на Москва да води война още години. Русия подготвя масирани зимни удари срещу енергетиката с нови реактивни дронове с изкуствен интелект, крилати и балистични ракети

Костадин Костадинов

„Възраждане“ с остър коментар за интервютата на английски език след волейболния мач между България и РСМ

България Преди 1 час

Според Костадинов македонските национали са били задължени от делегацията си да отговарят на журналистическите въпроси на английски

Исторически ниските нива и рекордното засушаване сковаха река Дунав в Унгария, Сърбия, Румъния и България

Нивото на Дунав продължава да пада: До 6 см спад за 24 часа

България Преди 1 час

Най-ниските отчетени стойности са -110 см при Силистра и -121 см при Русе спрямо условната кота нула

Данъчните оценки не са актуализирани от 2007 г., а планираната промяна предвижда общото им увеличение да достигне 100% до края на 2029 г.

Данъчните оценки на имотите скачат със 100% до 2029 г.

Парите ни Преди 1 час

Предвижда се първо увеличение с 30%, а през следващите две години с по още 35%

Ан Хатауей

Сияйна и стилна: Бременната Ан Хатауей омая Ню Йорк с ефирна рокля

Любопитно Преди 2 часа

Актрисата Ан Хатауей направи впечатляваща поява на събитието Bulgari Serpenti Infinito в Ню Йорк. Звездата от „Дяволът носи Prada“, която очаква третото си дете, омая присъстващите с елегантна визия и сподели детайли за семейния си живот

Джиджи Хадид за майчинството, модата и специалната връзка с Томи Хилфигър

Джиджи Хадид за майчинството, модата и специалната връзка с Томи Хилфигър

Любопитно Преди 2 часа

Супермоделът съчета първия учебен ден на 5-годишната си дъщеря с грандиозното си завръщане на дефилето в Ню Йорк

Известията в Android не работят? Ето какво да правим

Известията в Android не работят? Ето какво да правим

Технологии Преди 2 часа

Нотификациите в смартфоните са много важен елемент от изживяването, но понякога не работят както трябва - може да се показват по-късно или изобщо да не са активни, като причините за това може да са различни, но са лесни за коригиране