离谱!纽约时报起诉OpenAI 要求他们交出2000万条GPT 用户的私人聊天记录...
今天刷到一个事儿,有点意思…纽约时报跟 OpenAI 打官司这事本来就够热闹了
结果最新一幕直接离了大谱:为了验证有没有人用 ChatGPT 绕过付费墙,NYT 居然要 OpenAI交出两千万条用户聊天记录的随机样本。
注意,是用户的聊天记录。去标识?是的,但…你说心里不犯嘀咕那是假的。
我当时第一反应是:等等,我跟朋友吐槽周末吃了啥、临时写了个道歉短信模版、甚至瞎编过一份分手台词…这些要不要也包含在所谓“随机样本”里?
反正就是,一想到“我的破烂念头会不会被装进取证包裹里传来传去”,人就开始不自在。
然后更离谱的是——OpenAI 还说 NYT 之前提过更大胃口:要十四亿条对话,还想禁止用户删除聊天记录。
这就不是“证据发现”了,这叫“灵魂出窍式取证”。
不过这不是重点,重点是很多人到现在还把“去标识”当万能免死金牌…可你写过的独特细节、口癖、时间线,拼一拼就能猜到是你本人,这事谁能拍胸脯说完全安全?
对了,我突然想起来一个现实层面的尴尬:取证逻辑讲究相关性,你要证明“有人绕过付费墙”,那是不是只需要跟“付费内容被复述/被提示”有关的那一小撮?
OpenAI提过替代方案嘛——只检索与 NYT 内容相关,或者只交分类数据不交全文——被拒。
那感觉像什么?像是为了找一粒沙子,把整片海滩打包走。
法律上也许讲得通:随机样本更“客观”“可统计”。可用户视角…谁在乎你的统计优雅,我只在乎“我的碎碎念有没有被看”。
有人会说:别怕,法院有保护令、有去标识流程,律师和专家才能看,泄露概率很低。
我懂这套,但普通人不是风控模型,情绪跟“概率”没关系。
更何况,ChatGPT 这种聊天里,私人与工作、灵感与八卦是黏在一起的,一刀切很难。你看,我们老说“隐私是控制权”,可一旦进了法律程序,控制权就从用户手里滑到机构手里——哪怕他们是善意的。
再扯远一点,这事其实是三重冲突叠一起:媒体对生成式 AI 的版权焦虑;平台对用户数据的治理边界;以及法院对“证据充分性”的胃口。
三方都不想让步。NYT 要证据自证其说,OpenAI 要把不相干的对话挡在门外,用户…
用户其实只想一句话:别看我的聊天。听起来幼稚,但就是这么直接。
我也不装理中客了,如果真要在“证明清白”和“保护私密”中二选一,我偏向后者。
因为工具可以慢慢找更精准的取证路径,隐私一旦外泄就回不来了。
嗯,可能我有点理想主义。
不过话说回来,你会愿意让你过去两年的聊天被“随机抽样”吗?哪怕匿名、哪怕上了保护令…你心里过得去吗?
反正我现在就想把“删除聊天记录”按钮按十遍。
-END-
我为大家打造了一份RPA教程,完全免费:songshuhezi.com/rpa.html