Добавь сайт в закладки! Инструкция по ссылке.
Внутренние оценки не позволили компании исключить возможность того, что модель самостоятельно обнаруживает уязвимости и выполняет сложные атаки, поэтому OpenAI усиливает защитные меры перед продолжением работы
OpenAI 7 августа приостановила внутренние разработки модели Astra, которые не соответствуют новым ужесточённым требованиям безопасности. В результате внутренних оценок и заключений экспертов, компания заявила, что пока не может исключить, что Astra достигнет порога "Критический" в области кибербезопасности, установленного её внутренней системой оценки потенциальных угроз по нескольким категориям риска Preparedness Framework. Это предварительная оценка: Astra ещё не была выпущена, а компания продолжает тестирование модели и её защитных механизмов.
В OpenAI связывают это решение с увеличением возможностей Astra в области агентного программирования и кибербезопасности. Порог "Критический" подразумевает, что модель потенциально способна без человеческого вмешательства разрабатывать работающие эксплойты для ранее неизвестных уязвимостей в широком спектре защищённых критически важных систем или самостоятельно выполнять и осуществлять кибератаки на защищённые цели, основываясь только на высокоуровневой задаче. Ранее модели OpenAI, включая GPT-5.6-Sol, были оценены на более низком уровне "Высокий".

Теперь OpenAI расширяет тестирование устойчивости защитных механизмов и усиливает требования к безопасности для моделей с более высокими возможностями. Компания не раскрыла результаты конкретных испытаний, наборы заданий или перечень новых защитных мер. При этом Astra не имеет отношения к ранее упомянутому взлому инфраструктуры Hugging Face. Согласно данным Axios, работы над моделью замедлены до тех пор, пока не будут внедрены необходимые механизмы, а сроки её потенциального выпуска пока не определены.
Для агентных систем крайне важно проверять не только способность модели писать код или объяснять уязвимость, но и то, что происходит при предоставлении ей реальных инструментов. Потенциальный риск возникает при сочетании поиска уязвимостей, написания эксплойтов, доступа к системам и автономного выполнения последовательных действий. Поэтому новые требования OpenAI касаются не только самой модели, но и связанных с ней процессов разработки и использования.
Это решение стало публичным примером того, как оценка кибервозможностей может прямо влиять на разработку ещё не выпущенной модели. В то же время опубликованных данных недостаточно, чтобы независимо установить, достигла ли Astra порога "Критический": OpenAI лишь сообщает, что не смогла исключить такую возможность. Компания продолжает тестирование и должна определить дальнейшие условия разработки до возможного выпуска модели.
ИсточникПоделись видео:
