AI律所产品激增,律师因虚构判例受罚

AI律所产品激增,律师因虚构判例受罚。全球已记录近两千起此类案件,涉及逾八百名律师。尽管法官批评AI缺乏判断力且倾向胡编,各大实验室仍加速推出法律工具,主打可验证性以应对合规风险。

人工智能公司向法律界推销产品的速度,似乎已经超过了法庭对滥用 AI 进行处罚的速度。

全球记录近两千起AI虚构案

今年截至目前,四大主流 AI 实验室中已有三家推出了面向律师的产品。在 Anthropic 发布 Claude Legal Solutions 三个月后,Google 于 8 月下旬向全球四家最大律所提供了 Gemini 企业法律预览版。埃隆·马斯克旗下的 SpaceXAI 实验室也在其网站设立了专门的法律解决方案页面。

这一趋势表明法律行业正加速渗透 AI 服务领域,尽管此前已有律师因提交包含虚构判例的 AI 生成文件而屡遭罚款和谴责。6 月,安大略省律师协会法庭裁定,律师 Shahryar Mazaheri 需支付数万美元罚金,原因是其使用 Grok 起草的文件中包含虚假案例引用。据研究员 Damien Charlotin 建立的数据库显示,全球已记录近 2,000 起此类案件,涉及逾 800 名律师及 1,100 名自我代理诉讼人。

律师频繁因提交 AI 垃圾内容受罚

安大略省律师协会去年 12 月的调查发现,Mazaheri 曾使用早期版本的 Grok 起草客户的上诉事实陈述(书面法律论证)。法庭文件指出,这导致了虚构引证和凭空捏造的法律原则。6 月发布的费用决定责令 Mazaheri 支付 31,150 美元。法官批评人工智能“不欣赏细微差别、不行使判断力、也不使用道德指南针”,并指出其“强烈倾向于给出任何答案,而不是承认无知”。法官将这类 AI 生成的材料描述为“胡说八道”。

总部位于美国的顶级律所 Sullivan & Cromwell 也卷入其中,该律所营收位居全美前列,新入职的一年级律师基础年薪高达 22.5 万美元。今年四月,该律所在提交给首席法官 Martin Glenn 的一份破产动议中被发现含有 42 处由 AI 生成的虚构内容,随后紧急向纽约南区法院递交了说明函。仅加拿大法院的公开报道显示,涉及虚构引用的案件数量已从 2024 年的 7 起激增至 2025 年的 86 起,2026 年第一季度又新增 39 起。

值得注意的是,在任何大型 AI 公司发布特定法律工具之前,DoNotPay 早在 2023 年初就放弃了让 AI“机器人律师”在法庭上辩论案件的计划,此前州律师协会曾威胁对其提起诉讼。

主打“可验证性”的技术路径

Google 和 Anthropic 均强调其合法产品旨在实现可验证性。Google 的产品通过连接器对接外部法律数据库(如 Everlaw 和 NetDocuments)进行查询,而非单独依赖模型的训练数据。Google 云首席执行官托马斯·库里安在发布会上表示:“确保这些代理工作流程的各个方面是准确的、事实性的,并以法律权威为基础至关重要。”参与该预览计划的包括 Gottlieb、Freshfields、Weil 和 Williams & Connolly 这四家全球最大的律师事务所。

Anthropic 在其 Claude 法律解决方案产品中采用了类似策略,包括 20 个连接器和 12 个预先构建的插件。该实验室声称,Opus 4.7 模型在 BigLawBench 法律推理基准测试中获得了 90.9% 的得分。与 Mazaheri 案的关键区别在于,这些模型不需要从内存中直接生成引文。

相比之下,SpaceXAI 基于 Grok 的合法产品凭证显得较为薄弱。一篇 Cursor 博客文章曾指出,Grok 4.5 适用于“财务、法律工作或您在计算机上做任何其他事情”,但 SpaceXAI 后来对该模型的公告专注于“编码、代理任务和知识工作”,并未提及法律应用。该页面也未透露引文到主要来源的架构或机制。SpaceX 于 8 月 15 日以 600 亿美元正式收购 Cursor,将代码编辑器的法律营销置于 Grok 的监管之下。

核实义务仍属律师职责

斯坦福大学 RegLab 在 2024 年的一项研究中测试了 LexisNexis 和 Westlaw 的专用法律人工智能平台,发现其幻觉率分别为 17% 和 33%。目前尚无类似的独立审计针对 Google 或 Anthropic 的法律工具进行调查。

所有律师均受律师协会规则约束,规定提交引注的律师负有核实义务,无论是否使用 AI。Mazaheri 被处以 31,150 美元罚款,并非因其使用了 AI,而是因其未对 AI 的输出结果进行彻底核查。无论法律 AI 工具的设计多么周密,也无论供应商内置了多少安全措施,这一核实义务都不会改变。

评论 0

0/500

评论需审核后展示,请文明发言

💬
还没有评论,来说两句

相关阅读