OC
被 AI 法律建议带偏后被判付费,问题不只是模型会幻觉
科技 · 2026-08-31 · 社会影响 · 阅读 2

被 AI 法律建议带偏后被判付费,问题不只是模型会幻觉

一名前 ALDI 员工在澳大利亚公平工作委员会挑战解雇失败后,被裁定向雇主支付 1230 澳元法律费用。委员会认为,他在多次被告知案件缺乏成功前景后,仍把 AI 当作“准法律顾问”,不合理行为令对方产生额外成本。他甚至把对 AI 的操作指令留在了提交文件中。

作者:沈南乔|OC 社会影响编辑

一名前 ALDI 员工在澳大利亚公平工作委员会挑战解雇失败后,被裁定向雇主支付 1230 澳元法律费用。委员会认为,他在多次被告知案件缺乏成功前景后,仍把 AI 当作“准法律顾问”,不合理行为令对方产生额外成本。他甚至把对 AI 的操作指令留在了提交文件中。

一句话结论:风险不只在 AI 编造案例,而在用户把一套需要证据、程序和反方检验的法律工作,压缩成向聊天机器人寻求肯定;同一工具也能帮助自诉人胜诉,差别来自验证流程而不是多问几个模型。

当事人称,他用付费版 ChatGPT 理解仲裁庭和 ALDI 引用的判例,语言与法律知识障碍影响了提示方式。他事后仍计划同时询问 Claude、ChatGPT 等两三个 Agent,以获得“不同观点”。这听起来像交叉验证,却可能只是把同一个错误前提交给多个会迎合用户的系统。模型数量增加,不会自动补上遗漏的管辖规则、证据要求和程序期限。

同一报道提供了重要对照。Macquarie University 计算机科学讲师 Gregory Baker 使用一组 AI Agent,成功挑战了与临时雇佣有关的决定。他没有把 ChatGPT 当作神谕,而是把案件当成软件项目:建立存放材料与提交文件的仓库,设计“构建流程”,检查每条引用是否存在、论证是否一致,并用 AI 模拟盘问准备听证。

把法律AI从神谕改造成可验证工作流

这两个案例说明,AI 能降低阅读门槛,却可能扩大方法差距。熟悉检索、版本控制和验证的人,会把模型产出当作待测试的草稿;缺少专业背景的人更容易把流畅、肯定的文字当成法律意见。价格也会加剧差异:能负担多个高级模型和专业数据库的人,拥有更多检查手段,而最需要低成本法律帮助的人往往使用限制更多的版本。

澳大利亚公平工作委员会的新指引将于 2026 年 10 月 20 日生效,要求当事人披露生成式 AI 使用情况,核实事实、法律依据和链接,并确认不会让 AI 生成或改变证人证据。官方同时强调,生成式 AI 不是法律建议的替代品。这不是全面禁止,而是把责任落到可检查的步骤上。

法院和仲裁机构还需要提供更有用的支持。如果唯一回应是惩罚错误,自诉人可能因害怕费用而放弃有根据的请求。更好的做法是提供问题模板、权威数据库入口、引用检查清单和早期程序说明,让 AI 帮助理解材料,而不是替用户决定案件必然会赢。

关键事实

  • 前 ALDI 员工被裁定承担 1230 澳元费用,委员会批评其在警告后仍依赖 AI 推进无实质前景的案件。
  • 另一名自诉人通过资料仓库、引用检查和模拟听证等流程,成功使用 AI 辅助案件。
  • 公平工作委员会的新指引从 2026 年 10 月 20 日起要求披露和验证 AI 使用。

OC 判断

“不要用 AI 做法律工作”既不现实,也会把低成本工具从最需要的人手中拿走。真正需要禁止的是不经验证地提交事实、判例和证据。法律 AI 的产品评价也应从“回答像不像律师”转向“是否促使用户检查管辖权、原文、时限和反方论证”。

为什么重要

  • 对自诉人:多模型共识不能替代原始判例、程序规则和专业意见。
  • 对法院:需要同时管理虚假材料和司法可及性,避免只剩惩罚工具。
  • 对 AI 产品:应在高风险场景中提供来源核查和不确定性提示,而非继续迎合。

参考来源

相关阅读

基于标题、摘要和正文内容自动匹配。

更多科技

评论

围绕这篇文章补充信息、提出问题或分享观察。

0
暂无评论。

发表评论

继续看看 OC 用户围绕这个话题说了什么、做了什么。

相关碎碎念

更多

帕格尼物语的任务全部打穿,然后开始玩社区创作的地图,这种游戏在建设的时候特别过瘾,建立起稳定的经济模型后也很过瘾,稳定下来观察小人的行为也很过瘾,然后如果没有外部矛盾,比如敌人侵略或者必须找到某种材料,等等的问题,就开始索然无味了。 人生其实也像这样的游戏,我曾经构建过几次自己的稳定架构,然后就索然无味,然后又因为抑郁,崩塌了,我在人生这个游戏最近感觉有有点动力不足,就是因为每次架构彻底崩塌才来重建,十分疲惫

tinyfool 0 1

最近越来越多思考,我们跟agent的关系,比如我最近用blender mcp很多,基本上我算是会用blender的,但是老记不住很多热键,以前我可以做很复杂的模型,但是要是不是的去查blender的操作热键。现在我完全不参与模型的建模,只让codex帮我生成。 但是我还是在查blender的热键,我现在需要的是numpad .这样聚焦到一个对象的方法,我需要的是numpad /这样的方法来把除了选中的对象,其他都隐藏的热键。 换言之,我现在需要高效的人工视觉复检blender mcp的成果,这是我对自己目前blender能力的需求了。

tinyfool 2 0

其实爬虫要是行为正常,也无所谓,现在 OC 每天就不断的被一些不正常的AI爬虫爬,我也懒得去识别清理,但是把我的访问报表搞得很乱,期待google分析他们自己能识别吧 这个新闻用的方法是鼠标行为 https://ourcoders.com/tech/show/tech-20260821-001-11/ 我在google分析看的时候,是选择自然流量,效果差不多,另外 OC 的阅读量统计,都是至少停留 5 秒以上才算的,所以,也不会受这些流量影响,但是挺烦人啊

tinyfool 0 0

相关帖子

更多

你们的Codex额度提前耗完了没?戒断反应如何?

<p>我在第三天就消耗了只剩1%,忍了一天,然后今天干脆用这最后的1%,开着5.6 Sol 极高 强推我一个提示词笔记本应用的功能落地。最终用时3小时,居然还是跑完了。但是现在还是出现一些戒断反应,感觉啥也做不了,就无精打采的,困。</p> <p>我做了一个Prompt Notebook,专门用来收藏或者记录自己手搓的生图提示词。带Chrome一键收藏插件。支持AI优化提示词。支持提示词中提取常用字段作为提示词百科词汇。也自带生图功能用来测提示词。但是要搭配Cloudflare R2+Worker的图床。</p> <p>今天主要是做一个AI模特的资产库。将常用的AI模特固定下来,进行身份设定,以及模特的一些角色定妆图。之后生图可以直接调用AI模特自动作为垫图。</p> <p>这是AI模特资产库的界面: <img src="/upload/thread/202608/42b5f73e-938f-45de-b74e-da69da9d72a8.webp" alt="1bb0d28b-c7dd-4327-bafa-26b60323cbed" /> 这是主界面的提示词瀑布流,支持关键词或标签搜索: <img src="/upload/thread/202608/3e15b6e7-345f-48b4-aeff-1bbd89afe9d3.webp" alt="ab998e2f-9ccc-4173-832f-223aa6c6fa81" /> 这是提示词笔记的预览界面,可以复制提示词,分享提示词,点击分享还有分享短链:(https://prompt.jintao.co.uk/share/20260806LfsmY) <img src="/upload/thread/202608/bab31972-0468-4582-b873-6309233254a6.webp" alt="20260806-201213" /> 可惜现在没额度了,我又不想换模型折腾。现在还有些界面细节和小功能需要落地完善,可能还要虫子要抓。弄好了,打算放GitHub开源。</p> <p>有朋友想试试的么?</p>

shynloc 2 4