为什么我们把 Context 当成界面,而不是隐藏的 Prompt
一个 Agent 真正看到什么,决定了它能做什么。ActSpace 如何让 Context 可观察、可干预并保持可缓存。
Ideas from the runtime
Context、工具、权限、产品设计与真实开发过程。不是公告的延长版,而是把取舍讲清楚。
7 篇
一个 Agent 真正看到什么,决定了它能做什么。ActSpace 如何让 Context 可观察、可干预并保持可缓存。
在构建Agent的时候,我们首先会更多从感觉出发,或者说从经验出发
最近在实践多智能体的设计方式,也准备考虑给ActSpace添加多智能体的功能,主要是多智能体如果设计得当的话,是可以在提高效果的同时节省成本的,这对于很多做应用的团队来说,成本的控制是可以带来极好的用户体验的,我觉得这也是Harness Enginneering的概念之一
让Agent控制浏览器,其实有很多的实现方式,你可以在应用中内嵌一个浏览器,像cursor、codex那样,在应用中就可以打开网页,内部就可以使用tool工具定义实现,然后进行控制读取,但是这种方式是无法继承用户完整的浏览器权限的,无法完整模拟用户去操作浏览器
在上一篇文章中,我们对于Bash工具的简单设计做了一个整理,这种思路设计出来的Bash工具,只能跑一跑demo或者在项目前期的构建阶段“性价比很高”,但是如果要追求线上级的Agent的运行稳定,那么Bash工具最重要的两环是必不可少的:后台运行和沙盒设计
PI这个项目中,对于LLM模块的设计,尤其是多供应商的设计是比较出色的,还有它的模型配置文件的字段设计和对于上下文的理解都很不错,在设计层面是考虑到上下文的重要性的。
为自己开发的Agent添加Skill支持时,开发的核心步骤:发现、解析、使用、管理