OpenAI осознанно замедлила разработку и испытания новейшей модели искусственного интеллекта Astra из-за ее киберугроз.
Внутренние испытания будущей модели ИИ Astra показали серьезный прогресс в программировании без участия человека и в задачах, связанных с кибербезопасностью.
В OpenAI решили не форсировать дальнейшую разработку модели и провести дополнительное тестирование ее безопасности.
Лаборатория решила публично рассказать об этом, чтобы предупредить специалистов по безопасности и общественность о возможном скачке возможностей искусственного интеллекта.
Компания напомнила, что еще в декабре 2023 года создала специальную систему оценки, которая должна заранее показывать, когда ИИ начинает приобретать потенциально опасные способности.
Предыдущие модели, в том числе GPT-5.6-Sol, достигали высокого уровня в плане кибербезопасности, но не переходили на критический уровень.
По правилам OpenAI, модель считается достигшей критического уровня, если она способна сама находить уязвимости в защищенных компьютерных системах и создавать работающие программы для их взлома — причем без помощи человека.
Еще один вариант — если ИИ способен самостоятельно придумать и провести кибератаку на хорошо защищенную цель.
