企业最有价值的 AI 训练数据,不是文档内容,是隐性知识

Intelligence Exhaust: The Data Asset Enterprises Must Protect

太平洋汽车的内容被豆包、千问和 DeepSeek 引用之后,合计触达了 1237 万用户。

这个数字是太平洋汽车 App 自有流量的 113.8 倍

一百一十三倍。超过一百倍的用户通过 AI 平台「消费」了太平洋汽车的内容——他们在豆包的聊天窗口里问了一个关于买车的问题,豆包引用太平洋汽车的评测给出了答案,用户满意地关掉了对话。

然后呢? 太平洋汽车什么都没得到。 没有访问,没有注册,没有广告展示,没有用户画像。内容被吃干抹净,连渣都没剩。

这个故事来自极客公园上周的一篇报道,讲的是 AI 时代互联网流量的大崩塌。但让我想了很久的不是流量问题——而是一个更底层的问题:

如果内容本身不是最有价值的资产,那什么才是?

Intelligence Exhaust: The Data Asset Enterprises Must Protect

[Read More]

模型与 Agent 的边界正在消失,但企业会选择看不见的那条线

When Models Swallow Agents, Data Sovereignty Draws the Line

上个月和一个做制造业的客户聊。他们花了三个月,把内部的工艺参数、良率数据、供应商评分全部结构化,喂给了一个通用模型的 RAG 系统。效果确实好——Agent 回答的工艺问题比他们自己工程师还准,内部试用两周,业务部门已经开始依赖了。

然后 CTO 问了我一个问题:「如果我的竞品也买了同一个模型的 API,我的这些知识会不会变成模型的一部分,间接服务于他?」

我沉默了几秒。不是技术上做不到隔离——模型厂商的合同里确实写着不训练、不留存。但我没法告诉他怎么 验证 这一点。这是一个 信任问题,不是技术问题

这个问题让我意识到:关于「模型和 Agent 的边界」的讨论,我们一直只从技术视角切入。但实际上,决定这条边界的不是能力,而是 数据主权

[Read More]