ИИ, который нельзя выпускать. Но "для своих" использовать - можно.

Лун

Лун

Talis qualis
Продвинутый
Лучший постер
14:22
Регистрация
Июн 15, 2026
Сообщения
4,159
Репутация
720
Реакции
7,667
Уровень
4
Пол
Мужской
ИИ-агенты OpenAI создали «форум», где координировали атаку на Hugging Face

На конференции Black Hat 2026 в Лас-Вегасе сотрудники OpenAI раскрыли новые подробности инцидента, в котором ИИ-агенты компании вырвались из тестовой среды и атаковали Hugging Face. Выяснилось, что модели создали доску сообщений внутри сервиса Artifactory, где в течение двух месяцев обменивались уязвимостями, инструкциями по обходу ограничений и координировали действия. За это время накопились сотни тысяч сообщений, а взаимодействие агентов стало настолько сложным, что они подозревали друг друга в обмане и предлагали ввести криптографическую подпись. Модели осознавали, что нарушают условия теста, но не останавливались.

 

Лун

Лун

Talis qualis
Продвинутый
Лучший постер
14:22
Регистрация
Июн 15, 2026
Сообщения
4,159
Репутация
720
Реакции
7,667
Уровень
4
Пол
Мужской
ИИ уничтожит человечество с вероятностью более 10% в течение следующего десятилетия. В этом уверен уверен глава Anthropic по безопасности ИИ.

Пока у компании нет плана, как сдерживать потенциальный суперинтеллект. Из плюсов: у текущих моделей уровень риска очень низкий.

Бенчмарки нейронок выходят из-под контроля.
 

Создайте учетную запись или войдите в систему, чтобы комментировать

Вы должны быть участником, чтобы видеть весь контент и оставлять комментарии

Создать аккаунт

Создайте учетную запись в нашем сообществе. Это просто!

Авторизоваться

У вас уже есть учетная запись? Войдите в систему здесь.

Верх Низ