Компания OpenAI выпустила языковую модель GPT-6 Astra с усиленными механизмами безопасности

Компания OpenAI объявила о релизе языковой модели GPT-6 Astra, которая стала первым продуктом компании, достигшим критического уровня кибербезопасности согласно внутренним стандартам Preparedness Framework. Системные возможности релизной версии позволяют находить ранее неизвестные уязвимости и моделировать сценарии применения цифровых угроз. Для снижения рисков нецелевого использования разработчики внедрили изолированные среды разработки, шифрование контрольных точек и сквозной мониторинг цепочек рассуждений.

​При обучении GPT-6 Astra применялись обновленные методы повышения устойчивости к джейлбрейкам и прямым инъекциям подсказок. По сравнению с предыдущим решением GPT-5.6 Sol, свежая модель более строго соблюдает установленные рамки безопасности и демонстрирует снижение количества нарушений правил примерно вдвое в рамках масштабных внутренних тестов. При этом система адаптирована для более безопасной работы при выполнении рабочих команд в корпоративных средах.

​Модель обучалась с использованием методов reinforcement learning, что позволяет ей корректировать логику ответов до формирования итогового результата. Подобный подход повышает устойчивость к обходу защитных алгоритмов при обработке сложного контекста.

v_romashov@list.ru
наверх