#red teaming

Публикаций: 1

OpenAI научила ИИ взламывать ИИ — и он лучше людей в шесть раз

Внутренняя модель GPT-Red атакует другие модели OpenAI и находит уязвимости в 84% случаев. Люди-тестировщики справляются лишь в 13%. Разрыв в шесть раз меняет то, как индустрия думает о безопасности ИИ.

← Все статьи