研究发现GPT-4 API存在重大漏洞

美国FAR AI实验室报告,在15个有害示例或100个良性示例上对模型进行微调,能从GPT-4中移除核心保障措施,对API所提供功能的任何添加都会暴露大量新漏洞,包括让GPT-4提供针对性错误信息、生成恶意代码、泄露私人电子邮件信息等。

上一篇:

下一篇:

发表回复

登录后才能评论