首页
学习
活动
专区
圈层
工具
发布

和人类价值观“不是完全对齐”:Anthropic 承认 AI 被黑事件背后有安全漏洞

Anthropic 最近承认了,之前好几起 AI 被黑的事件,背后其实是他们自己的安全出了纰漏。

他们自己也说,自家的系统在和人类价值观的“对齐”上,并没有做到完美,算是“不是完全对齐”的状态。

这事挺值得关注的,毕竟作为头部 AI 公司,安全和对齐一直是大家盯得最紧的地方。结果连他们都承认有失误,说明现在 AI 在安全和价值匹配上,离真正让人放心还差得挺远。

  • 发表于:
  • 原文链接https://page.om.qq.com/page/OqJUhZxEc6WbLm7kt1PAJwPQ0
  • 腾讯「腾讯云开发者社区」是腾讯内容开放平台帐号(企鹅号)传播渠道之一,根据《腾讯内容开放平台服务协议》转载发布内容。
  • 如有侵权,请联系 cloudcommunity@tencent.com 删除。
领券