AI网关敏感调用二次确认与人工审批卡点落地

日期:2026-09-11

一、项目背景

某金融客户在我们的 AI 网关上跑业务,其中有一类调用是对外发送通知和涉及资金变动,一旦通过就不可逆,发出去收不回、动账了改不了。纯自动化是快,但怕错,一次误发或错账就是资损加合规事故,监管那边还得写说明。全人工审批又太慢,客服实时场景等不了,卡在中间两头不讨好,业务和风控天天吵架,业务嫌风控卡脖子、风控嫌业务冒进。我们进场时,他们正为一次手动群发填错号码闹得不可开交,风控坚持全人工、业务坚持全自动,谁也说服不了谁,问题卡在"能不能既快又稳"上。

二、落地场景

这个项目给敏感调用加了识别层和卡点。网关按调用类型打标,标记高危的走二次确认加人工审批;标记普通的仍自动过。二次确认要求调用方在请求里带确认令牌,且令牌和本次请求参数绑定,防止确认一次到处用。人工审批在管控台里卡点,审批人看到的是脱敏后的关键参数和风险提示,确认后才放行,全程留痕可审计。我们把审批做成了移动端,风控人不在电脑前也能秒批,实时业务基本感知不到卡点的存在,安全和体验终于不打架了。

三、关键技术挑战与解决思路

难点是敏感识别别误伤。太宽,普通调用也被卡,业务慢死;太窄,高危漏过去,出了事。我们用调用类型、目标域、金额阈值三维判定,比如对外发送且目标含外部域、资金变动且金额超阈值才标记高危,普通内部调用不进卡点,日常流量畅通无阻。第二是确认令牌防复用,早期只验有没有确认过,结果一个令牌反复用,我们改成令牌绑定本次请求的参数哈希,参数一变令牌失效,等于每次敏感操作都得重新确认,杜绝了"确认一次管一生"。第三是审批时效,卡太死实时业务崩,我们设了分级,超紧急的走快速审批通道,风控手机端秒批,兼顾安全和体验,不把实时请求晾在队列里。

案例片段(已脱敏): 敏感调用识别与卡点配置片段: 规则 risk_level = HIGH if (action in ["send_external","fund_move"] and (target_domain!="internal" or amount>10000)),命中则要求 confirm_token=hash(req_params+salt),令牌单次绑定,参数变更即失效。 审批日志(脱敏):单 fund_move 金额 50,000 触发卡点,风控移动端 8 秒审批通过,留痕 approver=risk-03,未走自动放行。

四、效果数据

敏感卡点上线后,高危误调用拦截率接近 100%,试运行期间拦下 3 次参数填错的对外发送,其中有一次号码填错会把通知发到外部无关方,真发出去就是一次合规事故。人工审批平均时长压到 15 秒以内(移动端快速通道),实时业务基本无感,业务侧不再抱怨卡脖子。误操作导致的资损事故归零,风控也敢放手让业务跑了。审计覆盖率达到 100%,每笔高危调用都有审批人留痕,监管来检查直接导出就行。文中数据为项目复盘口径,已做脱敏。

卡点上线后,我们把它做成可配置的,不同业务方可以按自己的风险偏好设阈值和审批人,风控不用再一刀切。后续接新的对外动作类型,只要往识别规则里加一条就行,卡点能力跟着业务长。我们还给审批留了应急通道,真遇到大面积高危又审批人不在,可以临时授权自动放行但全程加倍留痕,安全网不漏也不卡死。合规那边拿这套留痕去应对检查很顺,每次高危调用都有审批人和时间戳,省了不少解释成本,风控和业务这场架也就此消停,两边各取所需。

三维识别规则跑了一阵,我们按真实拦截记录做了一次校准,把误伤和漏报都摊开看,阈值松紧调得更贴合业务。比如对外发送我们原以为只卡外部域,后来发现内部但跨部门的群发也可能外泄,就加了部门边界维度。风控那边的误报从一开始每天几十条降到个位数,他们才真正信这套卡点。审批移动端上线后,风控人不在电脑前也能秒批,实时业务的卡顿感基本消失,安全和体验终于不再互相牺牲,业务和风控这场架也就此消停,两边各取所需。

卡点这事我们后来在好几个金融客户那里复用了同一套思路,只是阈值和审批人不同,配置化带来的红利就体现在这种地方。

五、可复用经验总结

不可逆的调用不能全交给自动化,一次资损够喝一壶,我们给高危动作加人工卡点,慢那十几秒换来睡得着觉,风控和业务这场架也就此消停。敏感识别的阈值要三维定,别靠单一标签,太宽太窄都出事,这平衡点我们调了不少轮才稳,单看金额会漏掉对外发送、单看类型会错杀内部调用。确认令牌必须绑本次请求,否则确认一次到处用等于没确认,这坑我们实打实踩过。这套卡点现在成了金融客户的标配,但我也清楚,它牺牲的时延只在高危场景才值,普通调用千万别乱加,否则就是为稳而稳、把效率拖死。