Preparedness Framework OpenAI
18 грудня 2023 року OpenAI оприлюднила бета-версію Preparedness Framework — порядок відстеження катастрофічних ризиків у чотирьох категоріях: кібербезпека, CBRN, переконання й автономія моделі. Кожну оцінюють як низький, середній, високий чи критичний ризик до й після заходів.
Чому це важливо
Друга велика лабораторія після Anthropic записала пороги, що зупиняють роботу: розгортати можна лише модель із ризиком після заходів «середній» або нижче, а далі розвивати — лише «високий» або нижче. Через дев'ять місяців системна картка o1 уже звітує за цими категоріями, тобто рамку застосовано до конкретного випуску.
Рамка має п'ять елементів, зокрема картку оцінок із ризиком до й після заходів і прогнозування. Рекомендації дає Safety Advisory Group, рішення ухвалює керівництво, а рада директорів може його скасувати. Про інших документ каже лише, що організації публікують Responsible Scaling Policies; Anthropic не названо. Застосування: системна картка o1 від 12 вересня 2024 року каже, що o1-preview і o1-mini оцінено «in accordance with our Preparedness Framework», і Safety Advisory Group віднесла обидві до загального середнього ризику — середнього для переконання й CBRN, низького для автономії й кібербезпеки, так само після заходів. Обидва документи від OpenAI; незалежної перевірки оцінок не знайдено.