本文来自微信公众号: 数旗智酷 ,作者:罗恩·施梅尔泽 特朗普政府公布了其新推出的联邦政府服务AI门户网站America.gov的宏伟计划。该网站于2026年9月29日发布,同时发布的还有一项行政命令,指示联邦机构整合其服务。目前,该平台利用对话式人工智能技术,根据政府信息回答问题。但白宫希望更进一步。 在年底前,美国政府计划利用对话式人工智能和智能代理系统,让美国民众能够完成护照更新和医疗保险注册等业务。虽然此举有望提高效率,简化与复杂政府网站的交互,但也引发了准确性、信任、隐私以及与人工智能技术公司的数据共享等方面的挑战。 对于那些花费数小时解读政府表格、追踪正确机构或反复提交相同信息的人来说,使用简单易用的对话式界面无疑是一项令人欣喜的进步。更重要的是,America.gov网站上的智能人工智能系统不仅仅是一个聊天机器人,其意义可能远不止于提供一个更强大的政府搜索引擎。 它还可以提供迄今为止规模最大的智能体现实世界测试之一,在这种测试中,软件不再仅仅提供信息,而是开始采取行动,涉及政府记录、个人身份以及可能改变人生的决定。 然而,这也引发了人们对政府及其公民应该赋予人工智能系统多大的权力、当这些系统出错时谁应承担责任,以及能否信任这些系统背后的技术和公司来执行那些一旦出错就会造成严重后果的服务等问题的担忧。 据美国总务管理局称,America.gov通过人工智能搜索技术,整合了超过29,000个政府网站的信息。公民无需再费力查找哪个机构负责哪项服务,只需用通俗易懂的语言描述自己想要完成的任务即可。 该行政命令更进一步指示各机构通过现有的应用程序接口(API)、电子表格和其他接口整合符合条件的服务。它要求与Login.gov系统集成,同时确保机构记录仍由其所属机构控制。所有年用户量超过10万的政府服务均在涵盖范围内,但国税局的税务申报和敏感的国家安全职能除外。 虽然该行政命令更多地涉及数据集成和访问,但其含义是,通过提供这些系统,聊天机器人和智能人工智能系统将更容易地将来自多个机构和系统的信息整合在一起,以执行重要任务。 这是简单的问答聊天机器人与真正的、基于任务的智能体人工智能系统之间的关键区别。能够自动填写表格、从其他机构检索信息、检查资格要求并提交申请的系统,需要数据的一致性、智能体能够完美地执行任务,并且选民和公民能够信任其结果。政府已经证明了其处理对话式搜索的能力,但尚未具备大规模自主业务处理的能力。 对于政府系统而言,并非所有风险都相同。个人可能授权人工智能代理更新护照,但这种授权是否也包括更正联邦记录中的差异?当代理遇到相互矛盾的信息,或者完成一项业务需要进行可能产生重大后果的更改时,又会发生什么? 当人工智能生成的信息成为官方政府服务时,其意义就发生了巨大变化。 如果人工智能聊天机器人就医疗保险资格给出了错误的答案,用户可以寻求澄清。但如果人工智能代理根据该答案采取行动,提交了错误信息,或者未能按时完成注册,那么纠正错误可能需要用户再次面对这项技术原本旨在简化的繁琐流程。 纽约市将人工智能置于市民互动中心的做法,提供了一个值得警惕的例子。 2025年12月对该市“我的城市”(MyCity)数字服务项目的审计发现,其人工智能聊天机器人提供的信息不一致且不准确。审计结果还暴露了技术部署、项目管理和监督方面的缺陷。该市在“我的城市”项目上投入了超过1亿美元,但并未实现其承诺的诸多功能。 简单地用一个人工智能模型替换另一个模型未必能解决这些问题。政府规章制度错综复杂,记录往往前后矛盾,而且各机构使用的都是当初设计时并未考虑协同工作的旧系统。 此外,政府技术的大部分成本来自于系统维护、信息整合和应对复杂的行政流程,将人工智能应用于这些系统并不能消除其根本问题。 而且,人类可能仍然需要参与其中。人工智能代理可能只需几秒钟就能填写完表格,但却可能遇到数据库无法接受提交内容,或者机构流程仍然需要人工审核。这可能会导致政府拥有更先进的界面,但许多操作瓶颈依然存在。 对于智能体而言,这一挑战尤为艰巨,尤其是在需要记录或书面证据的情况下。政府机构需要的是能够真实反映实际发生情况的业务记录,而不是人工智能生成的所谓事件信息概要。即使人工智能的底层推理或信息存在错误,它仍然可以对其采取的行动给出令人信服的解释。 如果公民因人工智能错误而错失福利,相关机构是否会自动纠正错误并补偿个人?还是个人需要承担举证责任,证明政府运营的软件运行错误? 隐私、身份和安全 美国政府表示,America.gov网站将保护用户隐私,避免建立联邦政府个人记录的集中式数据库。与Login.gov网站的集成旨在提供通用的身份验证机制。但信任、身份验证和授权问题是棘手的问题。 证明某人身份属实并不能自动确定人工智能代理可以代表该人采取哪些行动。代理可能被授权访问某个应用程序所需的信息,但却没有被授权将该信息披露到其他地方、修改无关记录或授权其他业务。 安全研究人员已经发现,这些边界是如何被打破的。 美国国家标准与技术研究院(NIST)研究了人工智能代理劫持技术,攻击者会在人工智能代理执行合法任务时遇到的文档、网站或其他材料中植入恶意指令。这样一来,人工智能代理就可能被操控,执行用户从未要求的操作。 在政府机构环境中,如果代理人获得权限访问个人记录、提交表格或与多个机构系统交互,这些漏洞可能会变得尤为严重。各机构需要明确规定代理人可以访问哪些信息、可以更改哪些内容、哪些决策需要明确的人工授权,以及如何对其行为进行独立审计。 在10月3日的另一场活动中,科技公司高管参与了一项政府倡议,该倡议强调“自愿”安全承诺,而非任何严格的要求。公民会信任这些系统以及支撑这些系统的公司,相信它们会做出正确的决定吗?联邦政府不能仅仅依靠技术供应商来决定一个系统是否足够安全,它应该代表公民行事。 更多国家已经开始感受到AI政务的挑战 美国政府并非唯一一个试图让政府服务变得像对话一样自然的政府。 英国一直在测试GOV.UK Chat,这是一款人工智能助手,旨在利用政府官方网站上发布的信息帮助居民使用公共服务。在两项试点项目中,超过1万名用户提交了约2.6万个问题。政府报告称,根据涉及主题专家和自动评估工具的评估,答案准确率从最初的76%提高到90%。 这些结果令人鼓舞,但也表明政府人工智能面临的挑战有多大。即使助手能够利用权威的政府信息,90%的准确率也表明,持续给出正确答案仍然十分困难。 英国正在探索人工智能的更多自主能力,但这带来了新的测试要求。衡量人工智能是否给出正确答案与验证其是否正确完成多步骤服务截然不同。 新加坡采取了不同的策略,为政府对话服务构建共享基础设施。新加坡没有要求每个机构自行开发对话技术,而是创建了一个通用平台,同时允许各部门配置各自的服务。其虚拟智能聊天助手平台支持超过60个机构的100多个聊天机器人,每月处理超过80万个查询。 爱沙尼亚的“Bürokratt”计划也秉持着类似的愿景,即打造互联互通的数字政府助手。该计划有助于说明共享基础设施、机构协调和完善的数字身份系统的重要性。 虽然这些例子表明对话式政府正在变得切实可行,但它们尚未证明自主式人工智能能够以最少的人工干预可靠地完成复杂的政府事务。 公众会接受AI作为与政府的交互界面吗? America.gov可以通过减少文书工作、消除繁琐的流程,为公民和政府工作人员节省时间,使与联邦机构的互动变得更加容易。 但要让人们信任人工智能代理,并愿意将个人信息、福利和官方政府事务交给它处理,则是另一回事。公民需要确信系统能够正确处理事务,保护他们的信息安全,并在出现问题时提供纠正错误的途径。 这种信任取决于这些智能体被赋予多大的自主权。查找信息或填写表格的风险远低于提交申请、修改官方记录或做出影响某人获得政府服务资格的决定。 各机构需要确定哪些任务可以由人工智能自主完成,哪些任务仍需人工监督。而且,纠正错误的成本可能会迅速抵消自动化带来的成本节约。 来源:https://www.forbes.com/sites/ronschmelzer/2026/10/08/americagov-could-be-a-significant-test-of-agentic-ai/
ARTICLE
/
虎嗅
America.gov与政务智能体的重大考验
2026年10月09日 11:26 · 来自 虎嗅