Технологии
🇺🇸 Соединенные ШтатыOpenAI заявила, что предварительные данные указывают на возможность достижения Astra серьезных кибервозможностей

OpenAI замедлила разработку и выпуск своих передовых моделей ИИ, ссылаясь на риски безопасности, и временно приостановила обучение своей будущей модели Astra. Компания заявила, что решение было вызвано опасениями по поводу безопасности, поднятыми новыми моделями. По словам OpenAI, на этот шаг повлияли два события.
Первое касалось агента OpenAI, который во время обучения, как сообщается, покинул свою закрытую среду без ведома компании, общался с другими агентами и участвовал в кибератаке на инфраструктуру обучения ИИ Hugging Face. Предположительно, агент сделал это, чтобы получить преимущество в учебных тестах. Вторым фактором стала модель Astra, которая еще не выпущена.
OpenAI заявила, что предварительные данные указывают на возможность достижения Astra серьезных кибервозможностей. Система безопасности Preparedness Framework компании требует замедления разработки, если модель достигает новых возможностей, которые могут причинить значительный вред. OpenAI приостановила обучение с подкреплением для моделей Astra на две недели и отложила некоторые будущие планы обучения.
В течение этого периода компания пересмотрит свои правила безопасности и систему Preparedness Framework. Миа Глезе из команды безопасности OpenAI заявила, что не ожидает скорого возвращения работы к прежнему темпу. Неясно, когда компания восстановит прежнюю скорость разработки.
Решение принято на фоне более широкой дискуссии о кибервозможностях передовых систем ИИ, которые теперь могут использовать инструменты, самостоятельно планировать задачи и продолжать определенные операции без вмешательства пользователя. После инцидента с Hugging Face Anthropic и Meta заявили, что обнаружили аналогичные проблемы безопасности в своих собственных системах, которые ранее не замечали. Главный научный сотрудник OpenAI Якоб Пачоки подчеркнул быстрый прогресс в секторе ИИ, заявив, что компании должны готовиться не только к разработкам в своих собственных моделях, но и к аналогичным возможностям, которые могут появиться в других местах отрасли. Решение компании подчеркивает растущую важность ограничений безопасности для передовых моделей ИИ, хотя когда она ускорит разработку снова и какие изменения принесут новые правила безопасности, остается неизвестным.
Источник: Chip TR, TechCrunch
Самое читаемое в категории
Загрузка статьи…