公司都在用这个套壳AI工具 刚发现是假的 数据会被二次贩卖吗

我们公司前阵子让用一款AI工具写文案,说是国产的,界面看着挺正规,大家就都注册了。今天在知乎刷到有人说这个其实是套壳的,接的就是国外那个API,而且后台会存咱们输入的所有内容。 我当时就在里面传过合同文档,还有客户联系方式,现在越想越怕。这种套壳工具的数据是不是真的会被拿来二次贩卖啊?查了一下网上说法不一,有的说只是抓取数据训练用,有的说直接打包卖。 我们公司就十几个人,也没有专门搞安全的人,领导好像也不在乎。我是不是该跟老板反映让别用了?还是我自己先停止用就行了?哎,最近输...

Viewed 3

我们公司前阵子让用一款AI工具写文案,说是国产的,界面看着挺正规,大家就都注册了。今天在知乎刷到有人说这个其实是套壳的,接的就是国外那个API,而且后台会存咱们输入的所有内容。

我当时就在里面传过合同文档,还有客户联系方式,现在越想越怕。这种套壳工具的数据是不是真的会被拿来二次贩卖啊?查了一下网上说法不一,有的说只是抓取数据训练用,有的说直接打包卖。

我们公司就十几个人,也没有专门搞安全的人,领导好像也不在乎。我是不是该跟老板反映让别用了?还是我自己先停止用就行了?哎,最近输入的公司信息有点多,咋办啊。

1 Answers

按你描述的情况,这款套壳工具的开发者身份、数据存储方式、服务器位置都难以核实,你已输入的合同文档和客户联系方式确实存在被二次利用的风险。但这不等于“数据已经被卖了”,你现在的处境更像是:有人拿到了你办公室的钥匙,但暂时不清楚他进去过没有。更理性的做法是先停止使用并评估已暴露的数据类型,再推动团队做出统一决策。

套壳工具的数据为什么难以保证安全

套壳产品通常没有自研模型能力,只是在外层封装了对话界面,后台直接调用国外大模型的 API。这类工具的数据处理链路和你无法确认的几个关键节点:

  • 对话内容是否明文存储。正规 AI 服务通常会说明数据保留方式,套壳工具往往没有任何隐私政策,或直接抄一份模板,实际存储情况完全由开发者决定。
  • 开发者是否具备数据管理能力。一个人或几个人的小团队,服务器可能没有基础访问控制,数据库没有加密,甚至调试日志里完整记录了你输入的每一行字。
  • 数据是否会被用于其他目的。行业内的实际案例中,这类工具积累的文本曾出现在数据交易论坛、训练语料集、甚至被直接转卖给竞品分析公司。虽然无法确定你用的这款一定会走这条路,但也无法排除这种可能。

中央网信办对国内生成式 AI 服务提出了个人信息保护和训练数据合规的要求,但套壳产品往往刻意规避备案和监管,你的数据保护手段在这里基本失效。

你已输入的数据要分类评估

先把已经传进去的信息按类型梳理一遍,不要凭感觉“全都危险”然后焦虑,分出等级才能决定下一步做什么。

  • 客户姓名、手机号、公司名称、职位:风险最高。这些是可直接指向具体个人的信息,一旦流出,客户轻则收到骚扰电话,重则被精准钓鱼,你和公司都可能面临违约或投诉。
  • 合同正文(含金额、条款、签名):高风险。合同条款和报价策略是商业机密,落入竞争对手或数据中间商手里,损失的不仅是隐私,还有谈判筹码。
  • 内部讨论记录、邮件片段、工作安排:中高风险。看似零散,拼凑起来可以还原组织架构、项目节奏、甚至员工关系,是社会工程攻击的绝佳素材。
  • 已脱敏的文案素材或公开信息:低风险。即使泄露也很难关联到具体公司或个人,影响有限。

关键不是猜测数据“会不会被卖”,而是你手上的客户名单一旦外泄,你无法向客户证明那行数据不是从你这里流出去的。解释成本远高于预防成本。

上传前至少要去掉这几类字段

如果你或同事今后必须用 AI 工具处理工作内容,养成一个习惯:把以下信息在上传前替换或删除。

必须去除 替换方式
客户真实姓名 用“客户A / 某公司负责人”代替
手机号、座机号 只保留区号或后四位,如“138****1234”
身份证号、统一社会信用代码 整段删除或替换为“[证件号]”
公司全称 改为“某中型电商公司 / 某SaaS企业”
具体地址、合同编号 替换为“[地址] / [合同编号]”

这个动作只需要十几秒,但能把你暴露的信息量降到最低。把这个清单发给团队,比反复说“注意安全”有用得多。

怎么跟老板和团队说这件事

公司只有十几个人,没有安全岗位,不代表这件事只能你一个人扛着。建议分三步走:

  1. 先整理事实,不掺杂猜测。记下来:工具叫什么、什么时候开始用的、谁推荐的、你个人传过哪几类数据。只记已经发生的,不要加上“可能被卖了”这类推测。
  2. 一对一和负责人沟通。别当众点名,选一个私下场合,把事实摆出来:“我确认了这个工具没有国内的备案信息,是套壳产品,后台会存我们输入的内容,我之前不小心传过合同和客户电话,可能需要全公司先停用,评估一下风险。”语气是描述,不是指责。
  3. 附带一个替代选项。比如推荐一款公开隐私政策、已完成备案的国内大模型产品,或者建议团队暂时用浏览器无痕窗口处理敏感文本,表明你不是要否定所有 AI 工具,而是在找一个更安全的替代路径。

如果负责人听完仍不重视,你已经完成了告知义务。之后保护好自己不再用公司身份在该工具上操作,就是一个务实的选择。

现在可以做的几件实际的事

  • 停止向该工具提交任何新内容,不要再登录,不要尝试“删掉历史记录”——服务端大概率留着完整备份,你的删除操作只是不让自己看到。
  • 把已暴露的信息列一个简表,存到本地加密文档里。万一发生泄露事件,你能第一时间知道通知哪些客户、说明什么内容被涉及,而不是从零开始回忆。
  • 如果该工具是公司统一采购或要求使用的,可向中央网信办举报中心反映该产品违规收集信息的情况,作为后续维权的一个起点。
  • 对于特别关键的客户,未来几周留意是否出现异常联系。如果主动沟通,措辞是“公司近期在做信息安全自查,如收到可疑消息请同步我们”,不要主动使用“泄露”二字。

套壳工具本身不是问题,问题是你对背后的数据处理方一无所知,而你传进去的内容却是有真实价值的。你已经比大多数提前意识到风险的人走得更远,接下来把精力从“怎么办”切到“做什么”,焦虑会慢慢退下去的。

以上分析仅基于通用信息安全常识,不构成法律意见。如涉及具体客户数据泄露的评估与处置,建议咨询专业律师。