把案件材料传给AI分析证据会不会有泄露风险啊?

最近手上有个案子证据特别多,同事推荐我用一个AI工具来分析。说是国内正规的,但我心里没底。当事人信息、案件细节都传上去,万一泄露了谁负责? 我查了下他们官网,说是端到端加密,但具体怎么保证的也不知道。会不会拿我的材料去训练模型啊?我们律所就几个人,也没IT支持。 反正就是纠结。案子下周要开庭了,不用AI效率太慢,用了又怕出事。有没有懂行的律师或者技术大佬指点一下?

Viewed 3

最近手上有个案子证据特别多,同事推荐我用一个AI工具来分析。说是国内正规的,但我心里没底。当事人信息、案件细节都传上去,万一泄露了谁负责?

我查了下他们官网,说是端到端加密,但具体怎么保证的也不知道。会不会拿我的材料去训练模型啊?我们律所就几个人,也没IT支持。

反正就是纠结。案子下周要开庭了,不用AI效率太慢,用了又怕出事。有没有懂行的律师或者技术大佬指点一下?

2 Answers

原则上,案件材料直接上传给AI工具确实存在泄露风险,但如果你能做好信息脱敏并选择合规的企业版服务,仍可在风险可控的前提下使用。最需要警惕的不是传输过程的加密技术,而是两点:服务商是否会将对话数据用于模型训练,以及后台是否有权限查看你的输入内容。先别急着一键上传,花几分钟看清用户协议里关于“训练数据”和“人工审核”的条款,再把当事人姓名、身份证号、具体金额等直接标识信息替换掉,能挡住大部分风险。

风险到底出在哪几个环节

很多人看到“端到端加密”就以为数据绝对安全,但AI聊天场景下的“端到端”往往只加密传输信道,服务端在进行文本理解和推理时,你的材料是以明文形态被处理的。这意味着:

  • 服务方工程师在系统运维、排查故障时,理论上能看到原始的输入内容
  • 如果服务商将用户对话用于模型迭代,你的案件细节就可能成为训练集中的碎片,未来被其他用户以某种形式“问出来”
  • 即使不用于训练,为提升服务质量而进行的“人工抽检”也可能接触到当事人信息

根据国家网信办对生成式人工智能服务的监管要求,服务提供者不得收集非必要个人信息,不得非法留存能够识别个人身份的信息,但落实到什么程度各厂家差异很大,国家网信办的相关规范是判断风险的重要参照。

不同用法下的安全等级对照

对比维度 高风险做法 低风险做法
工具选择 境外免费通用大模型,用户协议含糊或保留训练权 国内备案、提供数据处理协议的企业版工具,明确承诺不将输入用于训练
会话设置 开启长期历史记录,材料长期驻留对话日志 使用“不保存历史”“临时会话”或会话即焚功能(如果提供)
材料内容 直接粘贴含姓名、身份证号、车牌、住址、案件号的原始卷宗 脱敏后用A公司代替甲方真名、金额取整、核心情节抽象为通用描述
事后处置 传完即走,不核对留存状态 事后在工具内删除对话记录,并由管理人员向服务商提交数据删除申请

先做这几步再上传会更稳妥

  1. 查用户协议里的三个关键词:在服务商官网或App里用Ctrl+F搜索“训练”“人工”“留存”,看是否写明“不会将用户输入用于模型训练”“不会进行人工审核”“数据保留不超过X天”。找不到这些表述就当作可能会被使用。
  2. 现场脱敏再粘贴:将所有当事人姓名替换为“原告一”“被告二”,身份证号只保留前三位和后四位,住址模糊到街道级别,涉案金额只留大致数级(例如“约五十万元”),删除银行账号、手机号。
  3. 走企业通道而不是个人号:如果你们所里有预算,联系厂商开通企业版账户,并在合同里加入数据保护条款,要求对方不出境、不训练、不审计个人数据,这样出事有协议兜底,而不是仅靠点击“同意”的用户条款。
  4. 作为证据摘要上传,而非原件:不要直接传PDF扫描卷宗。把你要AI分析的逻辑用文字整理出来,只把需要鉴别的矛盾点、不一致处摘录上传。这样即便数据意外流出,也只是一份脱敏分析稿,而不是整套原始案卷。

如果你已经尝试了某些工具且不确定其可信度,可以拨打12377通过中央网信办举报中心咨询该服务是否具备相关备案与合规记录,或向当地律协寻求技术合规指引。别忘了,遵守律师执业规范中的保密义务本身就是一条硬线,技术工具只能做辅助,不能把原生的当事人材料暴露给第三方。

哎,这种案子材料我劝你还是别传。哪怕说是端到端加密,谁知道后台到底怎么存的,万一哪天模型训练拿去用,或者被黑了,你这边得承担多大责任。律所就这么几个人,真出事谁顶?下周开庭急的话,建议找个靠谱本地小工具或者手动筛。