Альянс Open Secure AI Alliance планує відкрити код захисних механізмів для безпеки штучного інтелекту

Альянс Open Secure AI Alliance намагається змінити підхід до безпеки AI: як це вплине на майбутнє технологій

Нещодавно сформований альянс Open Secure AI Alliance має на меті створення інструментів AI з відкритим вихідним кодом для всебічного захисту. До його складу входять такі провідні компанії, як Nvidia, Adobe, Cisco, Cloudflare, CrowdStrike, IBM, Microsoft, Palo Alto Networks, Red Hat, Salesforce, SAP та ServiceNow. У проекті також беруть участь провайдери хмарних і інфраструктурних рішень, включаючи Dell Technologies, HPE, NetApp, і Snowflake, а також AI-лабораторії, такі як Hugging Face, Cognition, Nous Research і Thinking Machines Lab.

Не минуло без глобальних новинних заголовків, які виникли після інциденту в компанії Hugging Face. Їх закрита AI-система не змогла відрізнити дії зловмисників від коректних дій захисників, що призвело до блокування необхідних аналізів. Щоб подолати цю проблему, Hugging Face прийняла модель GLM 5.2 з відкритим вихідним кодом, що дозволила здійснити більш ніж 17,000 дій з обробки вторгнення.

Відкрита модель як новий стандарт безпеки

Альянс Open Secure AI вважає, що підхід з відкритими моделями може стати складовою частиною захисної інфраструктури. Це дозволяє уникнути обмежень, які притаманні моделям однойменного вендора, де проблеми безпеки іноді перетворюються на замкнуте коло. Альянс не заперечує, що відкриті ваги можуть бути вразливі для маніпуляцій зловмисниками. Проте, на їхню думку, закриті моделі також не усувають ризику, а лише приховують його за контролем доступу вендора.

Складність та гнучкість AI

AI-система для використання в питаннях безпеки безліч складових частин – це не просто модель. Включаючи перевірку ідентичності та обмеження прав доступу, ця складна екосистема дозволяє ефективно управляти безпекою. Наприклад, Nvidia працює над проектом NOOA, який повинен покращити моніторинг і аудит поведінки агентів.

Інші члени Альянсу також роблять важливі внески: HPE бере участь у розвитку SPIFFE/SPIRE для верифікації AI-агентів, а Hugging Face передав свій формат Safetensors фонду PyTorch, щоб усунути ризики виконання коду з віддаленням. IBM та Red Hat розробляють Lightwell для застосування цифрових підписів у відкритих програмних ланцюжках.

Вплив на політику та майбутні виклики

Альянс виступає за визнання відкритих моделей та інструментів безпеки як важливих активів, від яких залежить безпека AI. Проте, наразі їх публічний аргумент ґрунтується лише на одиничних випадках на кшталт інциденту в Hugging Face та нечисленні релізи. Члени Альянсу прагнуть реалізувати більше успішних кейсів, щоб довести ефективність цього підходу та дозволити відкритим агентам бути пріоритетним рішенням, а не резервним варіантом.