
ChatGPT开发商于周三表示,已向部分客户开放新技术预览。该技术能够跨多轮模型交互行为识别行为模式与安全风险。以往AI安全系统只能对单条交互记录逐一监测,若不留存部分客户数据,就很难保障工具得到合规使用;新方案旨在突破这一局限。
该承诺与Anthropic现行政策形成鲜明对比:后者为保障最新模型运行安全,会将客户数据留存30天。这一做法遭到多位科技行业领袖批评,包括白宫AI顾问、风险投资人戴维·萨克斯,微软首席执行官萨提亚·纳德拉,帕兰提尔公司的亚历克斯·卡普。他们提出,企业需要获得确定性保障,确认AI厂商不会保存自身数据,医疗、金融等强监管行业对此需求尤为突出。
OpenAI产品政策负责人阿莉娅·豪泽表示:“企业客户的诉求十分明确,这件事对他们至关重要。很多企业本身就要对自己的客户承担数据责任;这些服务其他企业的服务商,手上掌握着大量高度敏感的数据。”
此举体现出OpenAI希望在AI竞赛中追赶Anthropic,同时回应批评声音。批评者担忧该公司产品防护不足,无法防范网络攻击,或是模型失控带来的各类危害。据报道,OpenAI近期向投资者透露,其二季度营收增速落后于Anthropic,令部分股东感到失望。
OpenAI称,客户数据将留存于客户自主管控的基础设施内。该公司同时在研发另一套系统:数据可由OpenAI存储,但加密密钥归客户所有。这意味着OpenAI员工无法查看用户提示词、模型回复以及其他敏感信息。
当系统从模型使用行为中识别出网络攻击、生物武器相关等高风险活动时,会向OpenAI发送信号,用于判断是否需要采取处置动作。客户可对处置结果提出申诉,也可根据需要向OpenAI提供更多信息。OpenAI仅保存这份高度概括的信号记录,仅标注风险等级与风险类别。

