404 Media 获取的内部材料显示,OpenAI 正通过代号「Project Lily」的项目,让数百名外包人员阅读真实用户与 ChatGPT 的对话,用来训练和改进模型。
根据披露内容,审核员看不到用户名,但可能看到完整对话。有些任务还会附上用户的「记忆摘要」,内容包括用户此前聊过什么,以及可能住在哪里等信息。
这些外包人员的工作流程包括先总结用户想完成什么任务,再比较 ChatGPT 生成的多个回答,并按 1 到 7 分打分。
审核重点包括事实是否准确、是否存在过度附和用户,以及 ChatGPT 是否把自己描述得过于像真人。
OpenAI 会先使用 Privacy Filter 去除姓名、联系方式等个人信息,但官方也承认,这一模型可能漏掉不常见的身份信息和模糊的私人信息,因此一些敏感内容仍可能出现在审核员面前。
报道同时提到,并非所有 ChatGPT 聊天都会被人工阅读。个人版 Free、Plus 和 Pro 默认开启「为所有用户改进模型」,用户关闭后,新聊天将不再用于训练;Business、Enterprise 和 Edu 默认不用于训练。
本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.

