OpenAI планира да позволи на независими организации да проверяват безопасността на новите ИИ модели, докато те се разработват. Преди това външни експерти получаваха достъп до моделите най-вече с приближаване на пускането им. Сега компанията иска да провежда подобни проверки по-рано в етапите на обучение и тестване.

OpenAI обясни промяната в подхода с необходимостта от по-ранно идентифициране на потенциално опасните възможности на моделите. Външни екипи ще могат да извършват технически оценки и да проверяват колко ефективно работят системите за защита. Компанията набляга на четири принципа на такава работа – независимост, научна точност, безопасност и ясно разделение на отговорностите.

Сред организациите, с които OpenAI води преговори, са METR и Redwood Research. И двете имат опит в работата с компанията. По-специално, те са участвали в разследването на случай, при който модели на OpenAI са получили неоторизиран достъп до системите на Hugging Face по време на тестове.

OpenAI вече е използвала услугите на трети страни относно тестване на предишни модели. Компанията твърди, че независимите рецензенти помагат за откриване на проблеми, които биха могли да останат незабелязани по време на вътрешно тестване. За по-сложните прегледи, на експертите може да бъде предоставен достъп до по-ранните версии на моделите и допълнителна техническа информация, като са въведени предпазни мерки.

Новият подход има за цел да направи тестването на ИИ по-безпроблемно, от обучението на модела до стартирането. Въпреки че OpenAI все още не е посочила конкретни партньори за новата програма, нито е обявила точните условия за достъп, компанията заявява, че иска да разшири сътрудничеството си с независими експерти, докато разработва по-мощни AI-модели.