科学家们开发了一种人工智能监控代理,用于检测并阻止有害输出
网络 阅读: 2023-11-21 07:42:43
由人工智能公司AutoGPT、东北大学和微软研究团队的研究人员共同开发了一种工具,用于监控大型语言模型(LLMs)的潜在有害输出并阻止其执行。该工具在一份名为“在野外安全测试语言模型代理”的预印研究论文中进行了描述。根据研究,该代理足够灵活,可以监控现有的LLMs,并阻止潜在的有害输出,如代码攻击,防患于未然。

本文 原创,转载保留链接!网址:https://licai.bangqike.com/bixun/216756.html
声明
1.本站遵循行业规范,任何转载的稿件都会明确标注作者和来源;2.本站的原创文章,请转载时务必注明文章作者和来源,不尊重原创的行为我们将追究责任;3.作者投稿可能会经我们编辑修改或补充。

