新奥尔良用AI接听911报警电话:效率与安全的争议实验

当AI开始接听紧急报警电话
美国新奥尔良市正在推进一项颇具争议的公共安全改革:使用人工智能来接听911紧急报警电话,取代传统的人工接线员。这一举措将紧急调度系统推向了自动化的前沿,也引发了关于技术可靠性、伦理边界和公共安全责任的广泛讨论。
911报警系统是美国公共安全体系的核心枢纽。该系统于1968年正式启用,由AT&T公司率先在阿拉巴马州海利维尔市部署,至今已发展为整合警察、消防和急救医疗三大紧急服务的全国性基础设施,每年处理约2.4亿通电话。911调度中心(也称PSAP,即Public Safety Answering Point,公共安全应答点)是整个应急响应链的第一环节,接线员需要在极短时间内判断事件类型、紧急程度,并调配相应资源。每一通电话背后,都可能是一场火灾、一起交通事故、一次医疗急救,甚至是一起正在发生的犯罪。在这种高压、高风险的场景下引入AI,无疑是对技术成熟度的一次极限考验。
从技术基础设施的角度看,911系统本身正经历一场深刻的数字化转型。传统的911系统基于模拟电话网络,仅能传输语音信号和有限的来电位置信息。1990年代推出的Enhanced 911(E911)增加了自动号码识别(ANI)和自动位置识别(ALI)功能,使调度员能看到来电者的电话号码和注册地址。而当前正在全美推进的Next Generation 911(NG911)则是一次根本性的架构升级——它基于IP网络构建,能够接收和处理文本消息、图片、视频和传感器数据,同时支持呼叫在不同PSAP之间的智能路由和负载均衡。
NG911的技术核心是ESInet(Emergency Services IP Network),一个专为紧急服务设计的受管理IP网络,由美国国家紧急号码协会(NENA)制定的i3标准定义其技术规范。ESInet不仅实现了传统语音呼叫的IP化传输,更关键的是引入了"功能元素"架构——包括紧急呼叫路由功能(ECRF)、位置验证功能(LVF)和边界控制功能(BCF)等模块化组件,使整个系统具备了前所未有的灵活性和可扩展性。然而,IP化也带来了新的安全威胁。TDoS(Telephony Denial of Service)攻击——即通过自动拨号程序同时向911中心发起大量虚假呼叫以瘫痪系统——已成为联邦通信委员会(FCC)重点关注的安全隐患。2016年,一名亚利桑那州少年利用软件漏洞发起的TDoS攻击导致当地911系统短暂瘫痪,凸显了数字化系统的脆弱性。正是NG911带来的数字化、数据化基础,使得AI系统的接入在技术层面成为可能。AI可以同时处理多模态输入信息,这在传统模拟系统上根本无法实现。

为什么城市开始转向AI调度系统
911接线员短缺的现实压力
全美许多城市的911调度中心长期面临人手不足的困境。根据美国国家紧急号码协会(NENA)的统计,全美约有6000个PSAP中心,雇佣超过10万名调度员,但该行业的年离职率高达19%-30%,远高于一般公共服务岗位。接线员岗位工作强度大、心理压力高、人员流动率居高不下,导致许多紧急呼叫中心处于长期缺编状态。
这种高离职率的背后是严酷的职业现实。接线员不仅面临轮班制的身体消耗,还长期暴露于二手创伤(Secondary Traumatic Stress)之下——他们需要在电话中陪伴经历暴力、事故和死亡的报警者。研究显示,约24%的911接线员存在PTSD症状,但长期以来该职业并未被纳入"急救人员"的法律定义中,导致他们难以获得相应的心理健康支持和职业保障。
除了PTSD之外,接线员还广泛经历着"同情疲劳"(compassion fatigue)——一种因长期接触他人痛苦而产生的情感耗竭状态。与急救现场人员不同,接线员虽然不亲眼目睹创伤场景,但他们通过声音"见证"一切,且往往无法获知事件最终结局,这种不确定性加重了心理负担。近年来,Code Green Campaign等行业心理健康倡议组织开始为急救通信人员提供专门的同伴支持网络和危机干预资源,但覆盖面仍然有限。一项2022年发表在《Journal of Traumatic Stress》上的研究表明,911接线员经历的累积应激反应——即每日多次接触中低强度创伤事件所产生的渐进式心理损害——其危害程度可能不亚于单次重大创伤暴露。
这一职业身份认定问题在美国引发了长达数年的立法运动。在美国劳工统计局的标准职业分类(SOC)系统中,911调度员长期被归类为"办公室和行政支持人员"(代码43-5031),而非与警察、消防员和EMT并列的"保护性服务人员"。这意味着他们通常无法获得急救人员专属的心理健康服务、伤残福利和提前退休资格。2019年,美国众议院通过了《911 SAVES Act》法案,旨在将电信调度员重新分类为"保护性服务职业",但该法案在参议院遭遇阻碍。多个州已率先在州一级完成了类似的职业重分类,包括纽约州和新泽西州。这一分类变更不仅关乎尊严和认可,更直接影响到招聘吸引力和人员留存率——如果调度员能获得与其职业风险相匹配的福利保障,行业的人才流失问题可能得到缓解。
当报警电话涌入而接线员不足时,等待时间被迫拉长——而在紧急情况下,每一秒都可能关乎生死。在这样的背景下,AI被视为一种潜在的"减压阀"。理论上,AI系统可以同时处理大量并发呼叫,快速分类报警的紧急程度,并将真正需要人工介入的高危情况优先转接给人类接线员。
AI擅长处理哪些报警场景
并非所有911来电都是生死攸关的紧急情况。实际上,相当比例的呼叫属于非紧急事务——例如噪音投诉、信息咨询、道路状况询问等。根据多个城市的公开数据,非紧急呼叫占911总来电量的比例在某些地区可高达30%-60%。许多城市因此设立了311非紧急服务热线作为分流手段,但公众的拨打习惯难以迅速改变,大量非紧急呼叫仍涌入911系统,占用宝贵的接线资源。对于这类标准化、低风险的呼叫,AI在信息采集、分类和引导方面确实具备显著的效率优势。
311系统最早于1996年在马里兰州巴尔的摩市启用,旨在为非紧急市政服务请求(如路灯维修、垃圾收集投诉、动物管控)提供统一入口。纽约市的311系统是全美规模最大的非紧急热线,年处理量超过3000万次联络(含电话、短信和在线请求)。尽管311的存在有效分流了部分非紧急呼叫,但研究显示仍有大量市民在紧张或不确定时习惯性拨打911——部分原因是公众对"何为紧急"的判断标准与专业调度协议存在显著差异。例如,一个人目睹车辆轻微剐蹭后可能认为这是"紧急事故"而拨打911,但在调度协议中这属于非紧急报告类事件。
如果AI能够高效过滤和处理这些非紧急呼叫,人类接线员就能将有限的精力集中在真正的生命威胁事件上。这正是新奥尔良推行AI调度系统的核心逻辑。
AI接听911的争议与风险
生死场景下几乎没有容错空间
911系统与普通客服热线有着本质区别——它的容错空间几乎为零。一次错误的分类、一次对报警者情绪的误判、一次语音识别的失败,都可能导致致命后果。
从技术角度看,当前主流的AI语音交互系统依赖自动语音识别(ASR)和自然语言理解(NLU)两大核心技术。ASR将语音转为文本,NLU则提取语义和意图。在理想环境下,这些系统的识别准确率可达95%以上,但在紧急报警场景中,准确率会因多种因素大幅下降:背景噪音(枪声、火警、交通声)、说话者的情绪波动导致语速和音调异常、方言和口音差异、以及电话信号质量不稳定等。
具体而言,现代ASR系统(如基于Transformer架构的端到端模型,包括OpenAI的Whisper和Google的USM)在标准数据集上的词错误率(WER)已降至5%以下,但在高噪声环境中WER可能飙升至20%-40%。更关键的是,紧急场景中的语音具有独特特征:高语速、气喘、哭泣导致的声学畸变、以及频繁的语句中断和重叠。这些特征在主流ASR训练数据集中严重不足,形成了显著的领域偏移(domain shift)问题。
在技术层面,解决这一问题的方法之一是领域自适应训练(domain adaptation)——使用真实紧急通话录音对通用ASR模型进行微调。然而,911通话录音涉及极高的隐私敏感性(包含受害者个人信息、犯罪细节等),获取大规模标注训练数据面临严格的法律和伦理限制。另一个关键技术挑战是语音活动检测(VAD, Voice Activity Detection)——在嘈杂的紧急场景中准确区分人声和背景噪音——以及说话人分离(speaker diarization)——当多人同时说话或电话中有多个声源时,准确识别是谁在说什么。在家庭暴力报警中,电话中可能同时存在受害者的求助声、施暴者的威胁声和儿童的哭声,AI系统需要将这些声源分离并分别理解其语义,这在技术上极具挑战性。
NLU层面的挑战同样严峻——紧急对话中充斥着省略句("快来!他有刀!")、隐喻表达和高度依赖语境的指代,这些都远超当前对话系统在客服或智能助手场景中所面对的复杂度。
此外,当前AI在理解隐含意义、省略表达和文化语境方面仍存在显著短板。例如,一个人在电话中说"他来了",人类接线员能从语气中判断这是恐惧还是期待,但AI很难做出同样精准的判断。
AI在处理清晰、结构化的信息时表现优异,但紧急报警往往充满了混乱:报警者可能惊慌失措、语无伦次、带有浓重口音,或身处嘈杂、断续的通话环境。人类接线员能够凭借经验和同理心捕捉这些非语言信号,安抚报警者情绪并引导其提供关键信息,而这恰恰是当前AI最难复制的能力。训练有素的接线员还掌握着标准化的调度协议——如用于医疗急救的MPDS(Medical Priority Dispatch System),该系统包含33种不同的主诉类别和严格的问询流程——但他们同时知道何时应当灵活偏离脚本以应对非典型情况,这种"规则内的灵活性"是纯AI系统极难习得的能力。
MPDS由Priority Dispatch Corporation开发,是全球使用最广泛的急救调度协议系统。它将医疗急救来电分为Alpha(最低优先级)到Echo(最高优先级,如心脏骤停)五个响应级别,每个级别对应不同的资源调配标准。经过MPDS认证的调度员需要完成约40小时的专业培训,并通过严格考试。该系统的设计哲学是通过标准化的决策树来确保一致性,但优秀的调度员深知:当来电者描述的情况不完全符合任何预设类别时(例如"我的邻居好几天没出门了,门口报纸堆了很多"——这可能是一起健康危机),需要根据职业判断灵活处理。AI系统在执行严格的决策树逻辑方面可能优于人类,但在识别和处理"规则之间的缝隙"时则明显不足。
出了事故谁来负责
当AI系统出现失误并导致严重后果时,责任应由谁承担?是开发AI的技术供应商,还是部署系统的市政部门?这一法律和伦理层面的模糊性,是所有关键公共服务引入自动化时都必须面对的难题。
在AI责任归属方面,目前全球尚缺乏统一的法律框架。美国现行法律体系主要依据产品责任法和政府豁免原则来处理相关纠纷。根据《联邦侵权索赔法》(FTCA),政府机构在特定条件下可能承担赔偿责任,但"自由裁量权功能例外"条款又可能为政府的技术选择提供保护。欧盟已在推进《人工智能责任指令》(AI Liability Directive),试图建立更清晰的AI伤害归责机制,包括举证责任转移等制度创新——该指令的核心原则是,如果AI系统的不透明性使受害者难以证明因果关系,则举证责任应转移至AI系统的运营方。
在美国已有的司法实践中,一些涉及算法决策的案件提供了参考。例如,在医疗领域,当AI辅助诊断系统出现误判时,法院倾向于将最终责任归于"做出决定的人类专业人员"——但如果系统完全自动化、不存在人类审核环节,这一逻辑就会崩溃。对于完全由AI主导的911接听场景,如果一通电话被AI错误分类为非紧急事件而延误了救援,法律上可能需要同时追究多方责任:AI开发商是否存在产品缺陷(如训练数据不充分)、市政部门是否尽到了测试和监督义务、系统集成商是否按照安全标准完成了部署。这种多方责任的复杂交织,可能导致诉讼旷日持久,而受害者在此期间难以获得及时救济。
值得注意的是,现有的911系统在法律上已享有一定程度的责任保护。多数州的法律为911调度员和PSAP中心提供了"善意豁免"(good faith immunity),即只要调度员是按照合理协议行事且非故意疏忽,即使出现判断失误也难以被追究个人民事责任。但当AI取代人类做出这些判断时,"善意"这一主观要素如何适用于算法系统,目前在法理上尚无定论。此外,如果市政部门在明知AI系统存在已知缺陷(如对特定口音识别率低)的情况下仍持续使用,是否构成"蓄意漠视"(deliberate indifference),这将是未来诉讼中的核心争点之一。
此外,公众的信任同样是不可忽视的挑战。当人们在最脆弱、最恐慌的时刻拨打911,他们期待的往往是一个能理解自己处境的"人"。用机器声音应答,可能会加剧报警者的焦虑感,甚至影响信息传递的有效性。心理学研究表明,在极端压力下,人类倾向于寻求人际联结作为应对机制——听到一个冷静、有同理心的人类声音本身就具有安抚作用。如果报警者感知到对方是机器,可能会减少信息分享意愿,或产生"没人真正在听"的绝望感,这在自杀干预等场景中尤为危险。
自杀干预场景尤其凸显了AI在情感交互方面的局限。美国988自杀与危机生命线(原全国自杀预防生命线,2022年转为三位数拨号)的接线员接受过专门的"积极倾听"和"安全规划"培训,其核心技能包括通过语气变化识别来电者的自杀意图紧迫程度、运用开放式问题建立信任、以及在对话中创造"暂停空间"让来电者感到被理解。这些高度依赖人际感知和临场判断的技能,是当前AI对话系统最难以模拟的领域。即便AI能够在语义层面识别自杀相关关键词,它也很难捕捉到一个人在沉默中的绝望、在笑声中的伪装、或在看似平静叙述中的最后告别。
AI在公共安全领域的更大趋势
新奥尔良的实践并非孤例,而是AI渗透进政府公共服务这一大趋势的缩影。从智能交通调度、预测性警务,到市政热线自动化,各级政府都在探索用AI提升效率、降低成本。
值得注意的是,AI在公共安全领域的应用已有较长历史,且伴随着持续争议。最著名的案例包括洛杉矶警局曾使用的PredPol(后更名为Geolitica)预测性警务系统,该系统基于历史犯罪数据和地震余震预测的数学模型来预测犯罪热点区域。然而,2021年《The Markup》等媒体的调查揭示,该系统将不成比例的执法资源引导至低收入和少数族裔社区,本质上是将数十年来带有种族偏见的执法记录(如对黑人社区更高频率的巡逻和逮捕)转化为看似客观的"数据驱动"预测,形成了"更多巡逻→更多逮捕→更多数据→更多巡逻"的有害反馈循环。洛杉矶警局最终于2020年终止了与PredPol的合作。
底特律和旧金山等城市曾因面部识别技术的误识别率(尤其对深肤色人群的错误率显著偏高)而立法禁止或限制其在执法中的使用。MIT媒体实验室研究员Joy Buolamwini的"Gender Shades"研究发现,主流商用面部识别系统对深肤色女性的错误率高达34.7%,而对浅肤色男性的错误率仅为0.8%。这一发现直接推动了多个城市的禁令立法,也促使IBM、亚马逊和微软相继宣布暂停或退出向执法部门提供面部识别技术。
这些前车之鉴提醒决策者,AI在公共安全领域的部署必须进行系统性的偏见审计和公平性评估。具体到911 AI系统,潜在的公平性问题包括:语音识别对不同口音(如非裔美国人白话英语AAVE、西班牙语口音英语)的识别率差异、对非英语来电者的服务能力、以及训练数据中是否充分覆盖了各类紧急场景的多样性。
语言多样性问题在911场景中尤为突出。根据美国人口普查局数据,全美约有6800万人在家中使用非英语语言,其中约2560万人属于"英语能力有限"(LEP, Limited English Proficiency)人群。现有911系统通常通过语言接入服务(Language Access Services)来处理非英语来电——接线员识别出来电者的语言后,通过三方通话接入专业口译员(通常由LanguageLine Solutions等第三方公司提供)。这一过程通常需要额外30-90秒的等待时间,在紧急情况下可能造成危险延误。理论上,AI系统如果能实现高质量的实时多语言识别和翻译,可能反而比现有人工流程更快——但前提是系统必须能够准确识别来电者使用的是350多种美国常见语言和方言中的哪一种,且翻译质量足以支撑生死攸关的信息交换。目前,主流ASR系统对资源丰富语言(如西班牙语、普通话)的识别能力较强,但对资源匮乏语言(如某些原住民语言、东南亚语言的方言变体)的支持仍然有限。
然而,911系统的特殊性决定了它需要更审慎的推进策略。目前来看,更合理的路径或许是"人机协同"而非"以机代人":让AI承担初筛、信息记录和非紧急分流的角色,把关键决策和情感沟通交还给人类。
在技术实现层面,人机协同在紧急调度领域有多种可能的形态。最基础的模式是AI辅助转录:实时将通话内容转为文字,减少接线员的记录负担。进阶模式包括AI进行初步意图分类和地理定位,自动填充调度表单,并向接线员推荐处置建议。更高级的应用是AI主导处理低优先级呼叫(如非紧急信息查询),同时对所有对话进行实时风险评估,一旦检测到暴力、自杀或医疗紧急信号即刻转接人工。
Carbyne和RapidSOS等紧急通信技术公司已在部分地区部署了类似的智能辅助系统,但通常作为接线员的"副驾驶"而非替代者。Carbyne的平台(已在全球超过70个国家的紧急服务机构中部署)专注于丰富来电者的位置和情境数据——它能自动获取来电者的精确GPS坐标、设备类型、甚至通过手机传感器判断是否发生了碰撞事故。RapidSOS则充当数据中间层,将来自智能手机、联网汽车、可穿戴设备和智能家居系统的数据整合后推送给PSAP,使接线员在接起电话前就已掌握丰富的情境信息。此外,Corti(一家丹麦AI公司)的系统能在通话过程中实时分析语音模式来检测心脏骤停的迹象——研究显示其检测准确率可达95%,高于人类接线员的73%——但它的设计始终是作为接线员的辅助工具,在屏幕上显示提示信息,而非取代人类做出最终判断。技术应当是接线员的助手,而非替代者。
对于任何计划在关键基础设施中部署AI的决策者而言,美国国家标准与技术研究院(NIST)于2023年发布的《AI风险管理框架》(AI RMF 1.0)提供了重要参考。该框架将AI系统的风险管理分为四个核心功能:治理(Govern)、映射(Map)、度量(Measure)和管理(Manage)。在911场景中,"映射"功能要求系统开发者全面识别AI可能面临的风险环境——包括极端天气导致的通话激增、新型犯罪模式的出现、以及人口结构变化带来的语言需求演变。"度量"功能则要求建立持续的性能监控机制,包括但不限于:分场景的识别准确率追踪(按语言、口音、噪声水平分层)、误分类事件的根因分析、以及与人类接线员表现的对照基准测试。尽管NIST框架本身不具有强制法律效力,但它正在成为政府采购AI系统时的事实评估标准,联邦政府多个机构已将其纳入合规要求。
结语
用AI接听911电话,是一场关于效率与安全、创新与谨慎之间的权衡实验。它反映了城市治理者在资源约束下的现实焦虑,也暴露了当前AI技术在高风险、高情感需求场景中的局限。
这项技术能否真正提升公共安全响应能力,还是会在关键时刻埋下隐患,仍有待时间和实践的检验。可以确定的是,新奥尔良迈出的这一步,将为其他城市提供宝贵的经验或教训。在关乎生命的领域,任何自动化的推进都应当以"不造成伤害"为最高原则——而实现这一原则,既需要技术的持续进步,也需要制度设计的前瞻性智慧。
相关推荐

机器学习研究入门:必读论文清单与研究实习申请路径
为ML初学者整理从零到研究实习的完整路径,包括必读经典论文清单(AlexNet、ResNet、Transformer等)、论文阅读方法、复现技巧及研究实习申请的实用建议。

Claude Code 入门实战教程:安装配置到自动化开发完整指南
详解Claude Code从环境搭建、权限配置、Go目标自主循环、Skills技能系统、MCP协议集成到版本控制的完整开发流程,帮助开发者快速掌握AI编程自动化工具。

Gemini 3.7 Flash发布与GPT-5.6极速模式:AI开源迈向生态时代
谷歌发布Gemini 3.7 Flash专注编程与Agent优化,OpenAI推出GPT-5.6 Ultra-Fast模式实现14倍速度提升。AI开源从开放模型转向开放生态,Agent工具链与成本监控工具密集涌现,智能体工作流进入实用化阶段。