你的AIAgent正在替公司做决定,但它一个“为什么”都说不清
你的AI Agent正在替公司做决定,但它一个"为什么"都说不清
2026年8月2日,欧盟《人工智能法案》(EU AI Act)的主体义务正式生效。
大多数工程师没有感觉到。他们的代码照常跑,监控照常亮,没人跑过来通知"你的系统从今天起多了一条法律义务"。
但恰恰是这个月,AI Agent 的角色完成了最后一次切换——它不再只是"回答问题",而是开始"替公司做决定"。
审批一笔支出、给服务器扩缩容、路由一条理赔、拒绝一个贷款申请人、放行一次版本发布。这些事,越来越多公司已经交给了 Agent。
然后问题来了:如果哪天出事,监管或客户问你——"这个决定当时为什么这么做?"
多数团队的回答会是:不知道。查不到。甚至没想过要查。
这不是我吓唬你。这是最近一篇刷屏的工程复盘里,作者给欧盟AI法案第12条下的判词:"你的AI Agent活不过Article 12。"
Article 12 到底要求什么
先把法条翻译成人话。
第12条要求:高风险AI系统,必须在技术上支持全生命周期自动记录事件,也就是日志能力。而且这些日志不是给你调试用的,是为了三件事——识别系统可能出风险的情形、支撑上市后监测、让部署方盯住系统运行。
第26条把另一半义务压在使用方身上:这些自动生成的日志,至少保留6个月。如果别的法律(比如GDPR)要求更久,按更久的来。
注意一个关键词:高风险AI系统。招聘筛人、信贷审批、教育评分、医疗分诊、执法辅助……这些场景的AI,都在清单上,分批适用,最晚到2027年底全部生效。
换句话说:法律给了时间,但没给侥幸。
为什么说"痕迹不是记录"
这篇复盘最扎心的一句是:Trace is not a record。痕迹不是记录。
你可能觉得:"我们有日志啊,Agent每步调用都记着呢。"
作者说:你记的那些,法律上约等于没有。
为什么?因为第12条真正要的东西,是事后重建单个决策——某个具体的人,某一天,被某个AI系统拒绝了,你得能还原:当时输入了什么、系统依据哪个版本的模型和哪份参考数据、中间经过了什么推理、有没有人复核、谁复核的、几点几分。
你手里的"痕迹"是什么?
Agent的trace(调用链):记了"它做了什么",没记"它为什么选A不选B",更没锁定"当时依据的是哪个数据版本"。
APM(应用性能监控):那是给系统健康看的,它不懂"拒绝贷款"和"正常风控"的语义差别。
向量库/知识库日志:只记录了"检索过什么",没记录"这次检索如何参与了一个决定"。
Prompt日志:记了输入输出,但没记模型版本、没记人工复核、没记上下文里那份可能已经更新的制度文件。
一句话:你记录的是"发生了什么",法律要的是"这个决定是怎么发生的"。 这两者之间的差距,就是事故发生时你要付的学费。
一个场景你就懂了
假设你们是一家欧洲做招聘SaaS的公司,用Agent筛选简历。候选人落选,怀疑是年龄或性别歧视,一封投诉信过来,依据GDPR要求"解释自动化决策"。
这时候你需要拿出什么?不是聊天记录,是一份能证明"这个决定不是歧视"的档案:当时的筛选标准版本、Agent依据的岗位JD版本、候选人的特征输入、系统的决策日志、人工复核记录。
在欧盟这套法律下,"我们用的是大模型,黑箱,没法解释"——这不是挡箭牌,这是认罪书。
再想想国内做跨境生意的团队:只要你服务欧盟客户、处理欧盟居民数据,这套规则就顺着业务摸过来了。这不是"欧洲的事",这是所有跟欧盟市场沾边的事。
别急着骂,也别急着抄
有两种反应都不可取。
一种是"欧盟又搞合规恐怖主义,关我屁事"。现实是:欧盟AI法案是2026年全球监管最强的一次出手,而且它叫"布鲁塞尔效应"——规则一旦立住,会顺着全球供应链扩散,就像当年的GDPR,把"隐私条款"逼进了每一家中国出海公司的用户协议。
另一种是"赶紧上一套Agent日志工具"。工具解决不了问题——你先得想清楚:什么算一个'决定'?谁为它负责? 这是产品定义问题,不是日志框架问题。
我反而觉得,这件事对国内团队是个提醒:当所有人都在卷Agent能干多少活的时候,很少有人问:Agent干完活,留下的东西够不够让人放心。
能直接带走的四件事
第一,用"能否事后重建单个决定"当标尺。 拿最近一个Agent做的真实决定试一下:输入、模型版本、数据版本、推理依据、复核人、时间,六样你能凑齐几样?凑不齐的,就是债。
第二,把日志从"发生了什么"升级到"为什么发生"。 加四组字段:决策上下文(当时读了哪份文档、哪个版本)、模型与参数指纹、人工复核痕迹、结果与预期偏差。这比买任何"AI合规工具"都实在。
第三,给高风险场景留人工闸门。 AI法案从头到尾没禁止AI做决定,它要求的是"人能在事后看懂并复核"。招聘、信贷、医疗这类场景,设计时就留一道"人确认"的关卡,既是合规,也是产品底线。
第四,别等法律来敲你的门才开始记。 日志能力是工程债,越晚还越贵——因为到时候你要补的不是日志,是历史。
欧盟这记重锤最妙的地方在于:它没有要求AI"别犯错",只要求AI"能解释"。
而"能解释"这件事,恰恰是2026年绝大多数Agent最不擅长、也最没人愿意花钱做的事。
等到监管替你发现这一点,账单就不是工程师加班能付得起的了。
---
本文基于 Level Up Coding《Your AI Agent Will Not Survive Article 12》(Gursimar Singh, 2026-09) 及 EU AI Act 官方条文、Practical AI Act 工程指引整理,原文链接:https://medium.com/@gursimarsm/your-ai-agent-will-not-survive-article-12-ae6c908d5bef