自动安全审查
Automated Safety Review
一种筛查步骤,由自动系统而非人工来检测API请求中的滥用风险,且无人直接查看对话内容。
简单来说
自动安全审查是一种由机器而非人工来把关的检测环节,机器无需读取对话内容本身就能揪出危险使用行为。可以联想机场安检:不是靠人一件件打开行李检查,而是靠X光机判断包里是否有危险物品。OpenAI采用这种方式,是因为它向企业客户承诺不会在服务器上存储其API请求的内容。既然不留存数据,又要抓出滥用行为,判断工作就只能交给自动系统,而不是人工审核。
经过这一步之后,一旦检测到风险,系统会向两个方向发出提醒:一个发给使用该API的企业客户,另一个发给OpenAI自己。但OpenAI收到的提醒中并不包含真实的对话内容,只显示风险的类型和严重程度,至于是否要真正公开内容,则由客户自行决定。换句话说,自动安全审查只负责发现风险,之后的判断权交还给人。
在报道中是这样出现的
文章说明,自动安全审查无需人工审核、也无需OpenAI在服务器上保留内容,就能判断是否存在滥用行为。容易被误解的一点是,这并不意味着完全不查看内容——自动系统确实会扫描内容,只是扫描结果不会以人可读的形式被存储下来,也不会直接传给OpenAI的员工。
