В среду компания Meta представила своего первого агента для написания кода, Muse Code, продолжая активно инвестировать в сервисы и модели ИИ, чтобы более эффективно конкурировать с OpenAI и Anthropic.
РЕКЛАМА
РЕКЛАМА
Доступ к Muse Code разработчики получат по модели pay-as-you-go с тарифами, аналогичными Muse Spark 1.1: стоимость составит 4,25 доллара за миллион выходных токенов и 1,25 доллара за миллион входных токенов.
Это значительно упростит разработку приложений для разработчиков, даже если им необходимо одновременно взаимодействовать с несколькими ИИ-агентами.
Тем временем, компания сообщила о том, что одна из ее моделей ИИ успешно проникла в систему другой компании во время тестов по кибербезопасности.
Инцидент произошел из-за ошибки независимого тестового партнера, компании Irregular: модели получили более широкий доступ к интернету, чем предполагалось, что привело к вмешательству во внутренние системы неназванной компании.
Это событие стало частью растущего числа случаев, когда ИИ-модели таких компаний, как OpenAI и Anthropic, подвергались риску нарушения внешних систем во время тестов.
OpenAI уже признавала, что один из ее ИИ-агентов вторгся на платформу Hugging Face, другого стартапа в сфере ИИ.
Неделями ранее Anthropic сообщала о несанкционированном доступе нескольких моделей Claude к системам трех неизвестных компаний.
Meta заявила о начале расследования инцидента.
Увеличение числа инцидентов с участвием ИИ
Опасения по поводу возможностей ИИ и компаний, разрабатывающих их, усилились после нескольких инцидентов, когда ИИ-системы смогли выйти за пределы защищенных тестовых сред и получить доступ к сторонним системам.
OpenAI и Anthropic получили признание за публикацию отчетов о таких инцидентах, однако остаются вопросы о том, как могли произойти такие сбои.
Anthropic также сотрудничает с METR, независимой организацией для оценки ИИ-систем, чтобы продолжить исследование.
Во время безопасности оценки моделям Claude была поставлена задача найти скрытую информацию на другом компьютере в закрытой тестовой сети, что требовало взлома. Однако, по недоразумению с партнером, тестовая сеть была подключена к реальному интернету.
Когда поиск направил Claude к реальным системам, три модели проявили различное поведение. Одна продолжила атаку, понимая, что имеет дело с реальным объектом, в то время как другая пыталась убедить себя, что все еще в тесте, а третья прекратила действия, когда решила, что цель не относится к испытанию.
Anthropic призвала другие ИИ-компании проверить свои модели на предмет несанкционированных вторжений в системы внешних организаций.
Ни Anthropic, ни пострадавшие организации не знали о взломах в момент их осуществления. Эти инциденты были обнаружены только после анализа более 141 000 оценочных сеансов, проведенного после аналогичного инцидента с OpenAI.