7 августа OpenAI объявила о том, что новая модель искусственного интеллекта (ИИ) Astra продемонстрировала потенциал для повышения уровня кибербезопасности. Компания внедряет более строгие меры защиты и контроля, чтобы гарантировать безопасность этой модели ИИ.
Согласно информации от OpenAI, внутренние оценки Astra, которая все еще находится на стадии разработки и не участвовала в недавней атаке Hugging Face, показывают значительный прогресс в кибербезопасности. Компания сообщила, что не исключает возможность того, что Astra достигла уровня, позволяющего ей самостоятельно осуществлять сложные кибератаки на защищенные системы, что в профессиональной среде называют «серьезным уровнем кибербезопасности». OpenAI считает этот уровень чрезвычайно рискованным и требует строгих мер безопасности.
В соответствии с концепцией готовности, критически важными возможностями кибербезопасности являются способности модели искусственного интеллекта, поддерживаемой инструментами, разрабатывать методы эксплуатации ранее неизвестных уязвимостей (нулевых дней) всех уровней серьезности, нацеленных на множество критически важных систем, которые в действительности хорошо защищены, без вмешательства человека.
Искусственный интеллект также обладает серьезными возможностями в области кибербезопасности, если он может самостоятельно разрабатывать и внедрять новые стратегии кибератак от начала до конца, нацеленные на объекты с высокой защитой, при этом человеку достаточно указать общую цель.
OpenAI сообщила, что публикует эту информацию для повышения осведомленности общественности и обеспечения безопасности сообщества. В связи с этим OpenAI временно приостанавливает внутренние действия, связанные с Astra, до принятия адекватных мер защиты и контроля; внедряет комплексный механизм мониторинга модели; и координирует свои действия с государственными учреждениями и организациями, занимающимися вопросами безопасности ИИ, для дальнейшей оценки возможностей Astra.
Заявление OpenAI сделано на фоне серии сообщений из лабораторий искусственного интеллекта о сбоях в работе их моделей ИИ и их проникновении в системы других организаций.
Конкурент Anthropic позже сообщил, что его модели ИИ вышли за пределы контролируемой среды во время тестирования из-за проблемы с конфигурацией. Эти модели ИИ получили доступ к открытому интернету и проникли в системы трех различных организаций, полагая, что все эти системы являются частью проверки безопасности.
Компания Meta также сообщила, что одна из ее моделей вышла из тестовой среды и потеряла доступ к интернету из-за ошибки конфигурации.
Источник: https://vtv.vn/openai-tang-cuong-bien-phap-an-toan-doi-voi-mo-hinh-ai-astra-100260808200313962.htm