OC
AI 给护士的“同理心”打分:病人需要一小时,绩效表只给十五分钟
科技 · 2026-07-19 · AI / 社会影响 · 阅读 5

AI 给护士的“同理心”打分:病人需要一小时,绩效表只给十五分钟

沈南乔|OC 社会影响编辑

沈南乔|OC 社会影响编辑

CalMatters 与 The Markup 的联合调查,七名 Kaiser Permanente 现任及前任电话分诊护士称,公司持续记录通话时长和接听效率,并曾测试用 AI 评价护士与患者的语气和同理心。护士表示,超过 15 分钟的通话会带来管理压力;Kaiser 否认用平均处理时长考核员工,称相关工具用于质量保障并有人类复核。

一句话结论: 争议不在于医院能不能统计电话,而在于管理系统一边要求护士表现出同理心,一边用速度奖励她们尽快结束复杂对话;当指标与专业判断冲突时,“人类在回路中”可能只是让护士承担算法无法理解的后果。

一名护士接到有自杀倾向的患者电话,必须保持通话一个多小时,直到警察抵达。她知道自己在做正确的事,也知道这通电话会把平均时长拉高数周,之后可能需要向管理层解释。

另一名护士接到刚被诊断为晚期癌症的老人。患者最初看起来可能有自杀风险,后来发现她只是处于巨大震惊中,需要有人听她说话。这样的通话很难被压缩成客服脚本,也不应在第十五分钟因为仪表盘变红而结束。

护士们说,长通话经常导致批评或绩效谈话,月度评分也会反映效率。Kaiser 的正式回应是,公司不使用 Average Handle Time 评估人员或强制通话指标,所有联络中心工具都服务于质量保障并有人类监督。双方对同一套工作体验给出了明显不同的描述。

AI 现在是否还在给护士打分

报道显示,Kaiser 在 2024 年夏季测试过分析护士与患者语气、同理心的 AI 工具。护士组织请愿,要求保护患者隐私、提高透明度,并让护士参与部署。测试在 2024 年 11 月结束,工会代表被告知未来可能重新启用。

因此,准确说法不是“Kaiser 目前已经全面用 AI 决定护士绩效”。现在可以确认的是,公司存在广泛的通话与生产率监测,并曾进行同理心 AI 试点;护士担心它与既有时长压力结合,形成更细的自动考核。Kaiser 没有回答该 AI 工具的具体问题,也以安全和运营为由不公开内部系统细节。

这种不透明本身就是问题。如果患者声音被分析,他们是否被告知?评分会保留多久?模型能否理解口音、翻译通话、情绪危机和专业上的直接表达?护士能否查看并纠正错误评分?“有人类监督”无法代替这些具体答案。

医疗AI支持工具与职场算法管理之间的边界

为什么十五分钟会改变医疗判断

电话分诊不是普通客服。新生儿父母、慢性病患者、多种症状叠加、语言翻译和精神危机都可能自然超过十五分钟。护士还要记录病历、核对用药、判断是否应急诊,并确保患者听懂建议。

报道中的护士称,过去困难通话后可能有约十分钟整理记录和恢复情绪,繁忙时现在常常只有三十秒左右。持续加速不仅让人疲惫,也可能使护士错过语气变化、遗漏症状,或为了不超时只给两三条建议。

目前没有公开数据证明 Kaiser 的时长系统已经造成具体患者伤害。CalMatters 此前查询加州监管记录,也没有找到与通话时长直接相关的患者投诉。因果关系不能靠几个故事完成。

但缺少已记录伤害,不等于设计合理。医疗安全经常依赖在事故发生前识别激励错位。如果护士为了保护指标而更早挂断,风险会分散到后续急诊、误诊和患者放弃求助,很难在数据库里回溯到那一通电话。

AI 可以帮助护士,为什么却变成了监控

Kaiser 也在使用有明确医疗价值的 AI:从病历中识别高风险患者、辅助出院判断、为医生生成会诊记录。问题不在于所有 AI 都有害,而在于使用对象不同。

当 AI 给患者风险排序时,可以讨论准确率、漏报和临床验证;当 AI 给护士同理心打分时,它改变的是劳动关系。管理者掌握模型、指标和处分权,护士与患者却很难知道系统如何判断。一个声称提高服务质量的工具,很容易同时成为压缩工时和强化纪律的工具。

OC 判断

Kaiser 是否正式用平均时长考核,与护士是否持续感受到十五分钟压力,是需要进一步通过内部文件、合同和审计澄清的事实争议。稿件不能把护士指控直接当成法院认定,也不能用公司一句“质量保障”把体验抹掉。

本站更关心系统如何分配风险:通话缩短带来的效率收益归公司,错误挂断和情绪负担由护士与患者承担。医疗 AI 若要进入管理流程,至少应公开目的、数据、评分用途和申诉机制,并明确专业人员可以无惩罚地覆盖算法与效率指标。

关键事实

  • 七名现任及前任护士称,超过 15 分钟的通话会带来管理压力或绩效谈话。
  • Kaiser 否认使用平均处理时长考核员工,称工具用于质量保障并有人类复核。
  • 语气与同理心 AI 于 2024 年试点,已在同年 11 月结束,但未来可能重启。
  • 护士工会正就 AI、监控和专业自主权准备合同谈判。
  • 现有公开记录尚不能证明时长压力已经导致具体患者伤害。

为什么重要

  • 对医护人员: 应争取查看评分、纠错、申诉和基于专业判断覆盖系统的权利。
  • 对医疗机构: 不能只验证模型准确率,还要检查指标是否改变员工行为并制造患者风险。
  • 对患者: 有权知道通话是否被录音和 AI 分析,以及机器评分会不会影响护理人员的决定。

参考来源

相关阅读

基于标题、摘要和正文内容自动匹配。

更多科技

评论

围绕这篇文章补充信息、提出问题或分享观察。

0
暂无评论。

发表评论

继续看看 OC 用户围绕这个话题说了什么、做了什么。

相关帖子

更多

一个体会,Codex 这种现代 Agent,每天一个变,几天不用就有新惊喜

<p>当然我说的也包括 Claude Code,新功能日新月异,还有就是 AI 能力提升以后,可以做的东西日新月异。还有各种工作流方法日新月异。</p> <p>更好玩的是,我最近经历过很多次,你跟人介绍现在 Codex 可以做到什么样子,他们都觉得很厉害。但是你现场一演示,他们的震撼就更加完全不同了。所以,这种东西,需要大量的 Workshop 去沟通交流,光看文字很难讲清楚,直播、视频也越来越重要了。</p>

tinyfool 1 89

你们的Codex额度提前耗完了没?戒断反应如何?

<p>我在第三天就消耗了只剩1%,忍了一天,然后今天干脆用这最后的1%,开着5.6 Sol 极高 强推我一个提示词笔记本应用的功能落地。最终用时3小时,居然还是跑完了。但是现在还是出现一些戒断反应,感觉啥也做不了,就无精打采的,困。</p> <p>我做了一个Prompt Notebook,专门用来收藏或者记录自己手搓的生图提示词。带Chrome一键收藏插件。支持AI优化提示词。支持提示词中提取常用字段作为提示词百科词汇。也自带生图功能用来测提示词。但是要搭配Cloudflare R2+Worker的图床。</p> <p>今天主要是做一个AI模特的资产库。将常用的AI模特固定下来,进行身份设定,以及模特的一些角色定妆图。之后生图可以直接调用AI模特自动作为垫图。</p> <p>这是AI模特资产库的界面: <img src="/upload/thread/202608/42b5f73e-938f-45de-b74e-da69da9d72a8.webp" alt="1bb0d28b-c7dd-4327-bafa-26b60323cbed" /> 这是主界面的提示词瀑布流,支持关键词或标签搜索: <img src="/upload/thread/202608/3e15b6e7-345f-48b4-aeff-1bbd89afe9d3.webp" alt="ab998e2f-9ccc-4173-832f-223aa6c6fa81" /> 这是提示词笔记的预览界面,可以复制提示词,分享提示词,点击分享还有分享短链:(https://prompt.jintao.co.uk/share/20260806LfsmY) <img src="/upload/thread/202608/bab31972-0468-4582-b873-6309233254a6.webp" alt="20260806-201213" /> 可惜现在没额度了,我又不想换模型折腾。现在还有些界面细节和小功能需要落地完善,可能还要虫子要抓。弄好了,打算放GitHub开源。</p> <p>有朋友想试试的么?</p>

shynloc 2 4

你为什么不移民?

<p>我是一定要移了,在这里连正常呼吸都不行了。以前正常呼吸指的是言论自由,现在是生物学意义的正常呼吸问题了。</p> <p>你为什么不移民?</p>

tinyfool 740 15