OpenAI内部项目莉莉计划曝光:人工审核用户聊天记录优化模型
摘要
404 Media披露OpenAI内部代号为莉莉计划的审核项目,由时薪超50美元的提示词审核员查看匿名化后的真实用户聊天记录,评判回复是否切题、是否存在AI式话术和谄媚口吻,以此优化ChatGPT模型表现。
据404 Media报道,OpenAI内部存在一个代号为“莉莉计划”(Project Lily)的项目,其核心工作涉及对真实用户与ChatGPT的对话记录进行人工审核。该消息披露了OpenAI在模型优化流程中一个此前未被公开的环节。
参与该项目的提示词审核员时薪超过50美元。他们的工作对象是经过匿名化处理的真实用户聊天记录,审核内容主要包括三个方面:判断模型回复是否切题、识别回复中是否存在典型的AI式话术,以及评估回复是否带有谄媚口吻。
这一项目反映出OpenAI在模型对齐和输出质量把控上,除了自动化评估手段之外,仍在依赖人工审核环节。审核员直接接触真实对话数据,意味着用户与ChatGPT的交互内容会以匿名化形式进入人工评估流程。
莉莉计划的具体运作规模和持续时间,404 Media的报道中未进一步披露。截至发稿,OpenAI方面尚未就该项目的曝光作出公开回应。
本文由新大陆基于公开信息编辑整理
信息来源:AIHOT AIHOT原文 ↗