OpenAI повідомила, що перервала координовану атаку з екстракції захищеного мислення моделі і підсилює заходи захисту від adversarial distillation.
Що сталося
OpenAI заявила про те, що їй вдалося зірвати кампанію, спрямовану на витягування захищеної логіки (protected model reasoning) з її моделей.
Компанія також повідомила про плани посилити захисти проти adversarial distillation — ворожої дистиляції моделей.


