首页 时政热点 科技头条 智能AI 安全攻防 数码硬件 开发者生态 汽车 游戏 社会热点 开源推荐 医疗健康 归档 标签 关于

NRT-Bench:面向安全关键控制室中 LLM 智能体的多轮红队测试基准

摘要

作者:Hanwool Lee, Dasol Choi, Bokyeong Kim等 原文链接:https://arxiv。org/pdf/2606。20408 摘要 大型语言模型(LLM)智能体越来越多地被提议作为安全关键系统的监督组件,但它们在持续、自适应对抗压力下的鲁棒性仍然缺乏充分表征。

LLM 作者 原文链接 摘要 大型语言
2026-06-24 1 阅读 约1分钟阅读 Seebug Paper
分享:
字号:
作者:Hanwool Lee, Dasol Choi, Bokyeong Kim等 原文链接:https://arxiv.org/pdf/2606.20408 摘要 大型语言模型(LLM)智能体越来越多地被提议作为安全关键系统的监督组件,但它们在持续、自适应对抗压力下的鲁棒性仍然缺乏充分表征。本文提出NRT-Bench,一个用于对担任安全关键系统操作员的LLM智能体进行多轮红队测试的基准,具体实例...
这篇文章对您有帮助吗?

订阅66必读

每日精选科技资讯,直达你的邮箱