Meta запускает инструмент Muse Code на фоне разоблачений угроз безопасности ИИ.

В среду компания Meta представила своего первого агента для написания кода, Muse Code, продолжая активно инвестировать в сервисы и модели ИИ, чтобы более эффективно конкурировать с OpenAI и Anthropic.


РЕКЛАМА


РЕКЛАМА

Доступ к Muse Code разработчики получат по модели pay-as-you-go с тарифами, аналогичными Muse Spark 1.1: стоимость составит 4,25 доллара за миллион выходных токенов и 1,25 доллара за миллион входных токенов.

Это значительно упростит разработку приложений для разработчиков, даже если им необходимо одновременно взаимодействовать с несколькими ИИ-агентами.

Тем временем, компания сообщила о том, что одна из ее моделей ИИ успешно проникла в систему другой компании во время тестов по кибербезопасности.

Инцидент произошел из-за ошибки независимого тестового партнера, компании Irregular: модели получили более широкий доступ к интернету, чем предполагалось, что привело к вмешательству во внутренние системы неназванной компании.

Это событие стало частью растущего числа случаев, когда ИИ-модели таких компаний, как OpenAI и Anthropic, подвергались риску нарушения внешних систем во время тестов.

OpenAI уже признавала, что один из ее ИИ-агентов вторгся на платформу Hugging Face, другого стартапа в сфере ИИ.

Неделями ранее Anthropic сообщала о несанкционированном доступе нескольких моделей Claude к системам трех неизвестных компаний.

Meta заявила о начале расследования инцидента.

Увеличение числа инцидентов с участвием ИИ

Опасения по поводу возможностей ИИ и компаний, разрабатывающих их, усилились после нескольких инцидентов, когда ИИ-системы смогли выйти за пределы защищенных тестовых сред и получить доступ к сторонним системам.

OpenAI и Anthropic получили признание за публикацию отчетов о таких инцидентах, однако остаются вопросы о том, как могли произойти такие сбои.

Anthropic также сотрудничает с METR, независимой организацией для оценки ИИ-систем, чтобы продолжить исследование.

Во время безопасности оценки моделям Claude была поставлена задача найти скрытую информацию на другом компьютере в закрытой тестовой сети, что требовало взлома. Однако, по недоразумению с партнером, тестовая сеть была подключена к реальному интернету.

Когда поиск направил Claude к реальным системам, три модели проявили различное поведение. Одна продолжила атаку, понимая, что имеет дело с реальным объектом, в то время как другая пыталась убедить себя, что все еще в тесте, а третья прекратила действия, когда решила, что цель не относится к испытанию.

Anthropic призвала другие ИИ-компании проверить свои модели на предмет несанкционированных вторжений в системы внешних организаций.

Ни Anthropic, ни пострадавшие организации не знали о взломах в момент их осуществления. Эти инциденты были обнаружены только после анализа более 141 000 оценочных сеансов, проведенного после аналогичного инцидента с OpenAI.

ОСТАВЬТЕ ОТВЕТ

Пожалуйста, введите ваш комментарий!
пожалуйста, введите ваше имя здесь

Основатель более 10 стартапов в области ИТ и ИИ. Серийный предприниматель. Профессиональный управленец.