本文探讨自进化LLM代理在信贷流程中的合规边界问题。作者指出,若代理直接改写自身,将破坏监管者所审查的可追溯证据,因此主张自我进化只能局限于运行时“框架”层(指令文本、工具调用逻辑与基本组件组合),模型权重保持固定,使每次调整都成为附带原因与测试的差异记录。基于此边界,作者构建了双环引擎,并设置一个在部署前写入哈希链记录的准入闸门,在模拟环境中以模拟代理和种子搜索提案器进行测量。结果显示,在三种监管再解释类型、三种严重程度、每种十个种子的条件下,带闸门的循环从7449个候选变更中仅接纳144个,且均未在留出历史上加剧错误,并在所有低、中严重度单元中将误报率恢复至理想水平而未增加漏报。若以无界系统所用的检查替代闸门,同样循环接纳了309个有害变更,90次运行中有49次漏报率超过10%。作者还将机制映射至欧盟《人工智能法案》高风险信贷评分条款,并指出2026年4月美国模型风险指引将代理式AI排除在适用范围之外。
| 运行时框架 | 指LLM智能体运行时可变的部分,包括指令文本、工具调用逻辑和原语组合,区别于固定的模型权重。 |
| 准入闸门 | 一种在部署前对候选变更进行审查的机制,通过写入哈希链记录来确保变更的可追溯性和安全性。 |
| 双环引擎 | 一种基于运行时框架界限构建的自我进化引擎,包含两个循环,可能分别负责提议和审查变更。 |
| 监督重新解释 | 指在信贷流程中,对监督规则或标签的重新解释,可能涉及参数、范围或结构性的变化。 |
| 哈希链记录 | 一种使用哈希链技术存储的记录,确保变更历史的不可篡改性和可验证性。 |
📱 每天一份 AI 前沿日报
关注公众号,每天 09:00 推送 · 不错过任何重磅