OpenAI公布GPT-5.6自进化秘籍,新的左脚踩右脚已经出现(4)

2026-07-30 16:43  网易


假如一个任务需要调用模型30次,每次只额外浪费1秒,累计起来就是30秒。

上下文、工具说明和历史结果也会在每轮循环中反复传输和计算。

为此,OpenAI搭建了一层由Rust编写的Agent Harness,连接模型、工具和用户环境,专门减少Agent循环里的重复工作。

这里最关键的有两项优化。

1、延迟发现:别一上来就把所有工具塞给模型

今天的Agent可以使用大量工具、Skill、插件和自定义MCP,但单个任务通常只需要其中很少一部分。

OpenAI不再一开始就把所有说明书塞进上下文,而是在真正需要时,才向模型展示对应工具。

工具返回的内容默认也被限制在1万Token以内,需要更多时,再由模型主动申请。

2、只追加、不回写:让Prompt缓存一直有效

Prompt缓存可以复用已经计算过的上下文前缀,但前提是这段前缀必须原样不动。

因此,新的消息和工具结果只会接在上下文末尾,不再插回旧内容;工具保持固定顺序,审批和权限设置则留到执行阶段处理。