OpenAI представила Private Safety Processing — новий підхід до моніторингу потенційно небезпечного використання AI без збереження даних корпоративних клієнтів. Система має аналізувати активність у кількох сесіях і виявляти підозрілі сценарії без передачі вмісту розмов людям для перевірки.
Повідомляє видання GALERANEWS, посилаючись на TechCrunch.
Private Safety Processing поки перебуває на етапі попереднього запуску для обмеженого кола клієнтів. OpenAI позиціонує технологію як розширення підходу Zero Data Retention, за якого дані запитів і відповідей не зберігаються після їх обробки.
Головна відмінність нової системи полягає в тому, що вона може аналізувати не лише одну окрему сесію, а послідовність взаємодій упродовж тривалішого часу. Це потрібно для виявлення випадків, коли користувач навмисно розбиває небезпечне завдання на кілька запитів, щоб уникнути стандартних механізмів контролю.
Наприклад, потенційно шкідлива активність може бути розподілена між кількома сесіями. Private Safety Processing має автоматично зіставляти такі взаємодії та визначати, чи формують вони підозрілий сценарій, не відкриваючи самі розмови співробітникам OpenAI.
Якщо система виявить можливе порушення, вона передасть OpenAI лише обмежений сигнал про конкретний тип активності. Після цього компанія зможе вирішити, чи потрібно застосовувати обмеження або звернутися до клієнта за додатковим контекстом. Передача самих даних у такому разі залежатиме від рішення клієнта.
Новий підхід також підкреслює конкуренцію між OpenAI та Anthropic за корпоративних замовників. Anthropic у липні запровадила окрему політику для частини найпотужніших моделей, яка передбачає збереження даних до 30 днів для цілей безпеки. Це викликало занепокоєння серед компаній, які працюють із конфіденційною інформацією.
Водночас OpenAI вже пропонує корпоративним клієнтам механізми Zero Data Retention, а також заявляє, що бізнес-дані за замовчуванням не використовуються для навчання моделей без окремої згоди клієнта. Для відповідних організацій також доступне налаштування термінів зберігання даних.
Private Safety Processing покликаний вирішити одну з ключових проблем корпоративного AI: як одночасно виявляти потенційно небезпечне використання моделей і не накопичувати чутливі дані клієнтів. Наразі OpenAI не повідомила, коли технологія стане доступною ширшому колу користувачів.