这89条提交的核心改变:Agent开始不乱编了。系统给它装了查证纪律——交叉确认最多一次,检索预算封顶,找不到就直说找不到,不再编个答案糊弄人。

同时,外部工具可以参与工具调用闭环了,默认执行图更短了,会话重开更稳了。

一、外部工具直通:AI可以调用外部的AI

这一轮新上线了一个能力——外部工具直通。简单说,外部客户端可以提交工具调用请求,编排层暂停并把意图传给外部调用方,外部完成后再通过工具结果回灌,恢复任务执行。

完整处理finish_reason=tool_calls,增加入口参数、权限和执行边界检查。外部Agent可以参与工具调用闭环,而不只是调用内部Agent。

系统不再是封闭的,外部工具可以接进来,AI可以调用外部的AI。

二、执行图收敛:路径更短,成本更低

默认执行图收敛为三个节点:记忆读取 → Agent执行 → 记忆写入。知识类意图不再先经过专门的检索节点,直接进入Agent执行。没有自定义子图的组织跳过分类LLM,减少不必要的延迟和成本。

多个工具额度中间件合并为单一节点,子图执行核心统一封装。默认图、数据迁移、初始数据全部同步更新。

执行路径更短、更稳定,不必要的LLM调用和中间件层级被砍掉了。

三、事实查证纪律:找不到就直说

这一轮在所有Agent的系统提示词里统一注入了事实查证规则。交叉确认最多一次,单个检索点最多三次。Provider级别的熔断:确定性的失败直接短路,冷却期满自动恢复。

抓取链每一级fallback都写入执行记录。所有fallback失败时仍保留已经抓到的短正文。之前默认开启的某个网页内容抓取工具,因为在可测环境中成功次数为零,本轮默认关闭了。网关并发限制错误进入重试路径。

Agent被明确告知:查不到就承认查不到,不要编。 这是一条硬约束。

四、会话重开更稳了

之前有一个隐蔽问题:会话不可重开,但系统只说“attempt session is terminal”,不说为什么。这一轮修复了具体原因:artifacts目录的时间变化不会再导致Session无法重开;宿主状态指纹不再包含平台自身的临时文件;工作区范围被拒绝时,工具给出改道建议,而不是重复失败到没有产物。

会话重开失败现在会记录细分原因,排查时能直接定位。

Session能重开了,失败有原因了,被拒有出路了。

五、失败归因与敏感信息保护

第三方检索的原始响应进入异常和日志前必须脱敏,URL中的用户名、密码、Token不再写入日志。Trace和Span不再写死空身份,审批审计可以归因到具体组织、用户和Agent。

节点异常向用户展示登记过的安全文案,不透传内部异常原文。

同时修复了日志重复打印的问题,测试不再污染共享环境,FakeAgent与真实调用契约保持一致。新增14页客户案例销售材料。

AI开始有查证纪律了——不知道就承认不知道,不再编答案。外部工具可以接入闭环,执行图更短,会话重开更稳,敏感信息不再泄漏。

系统在变诚实。这是一个好的方向。

这,是第九十一天。

《从0到1:企业级AI项目迭代日记》记录一个企业级 AI 项目从创意、架构到落地的真实过程。不讲神话,只记录进化。


如果你也在做企业 AI 落地,欢迎留言来聊。或者,把这篇转发给一个正在踩同样坑的朋友。

Logo

有“AI”的1024 = 2048,欢迎大家加入2048 AI社区

更多推荐