#Agent

36 篇文章

Harness Agent 的组成要素:从七层到八层横切面的完整模型

从 Harness Engineering 的实践出发,讨论 Harness Agent 的完整组成要素。将初始的七层体系演进为八层加横切控制面的模型,逐一分析每层的职责、现有覆盖和缺失,重点讨论状态/记忆/产物/技能的区分、在线验证与离线评测的分离、以及 AHE 作为独立演进回路的定位。

Pi 源码拆解(二): Agent 运行时机制

拆 pi 的 agent 主循环:为什么 StreamFn 契约禁止抛异常、失败如何编码成 stopReason=error 的 assistant 消息进入会话历史、截断的 tool call 为什么整批拒绝执行、并行工具调度如何保证 transcript 确定性,以及工具输出截断的工程细节。

AI开发助手

22年chatgpt3.5 刚出来的时候,体验了一下,实现了一个PR审阅的工具,接入到代码仓库中,当时团队同学反响非常不错,但是继续往下研究的时候,发现模型的能力不太够,当时的结论是除了目标明确,耦合较少的任务(如:单元测试&类型文件转换)外,很难在研发流程上有较大的提升。 后续因为业务调整主要尝试将LLM在私域业务…

迁移知识库的 embedding 召回评测方法

RAG 接入前应评测 embedding。本文说明如何从真实迁移任务整理查询集、定义召回判据、对比多个 embedding 模型,以及为什么平均相似度和公开榜单不足以替代本地评测。

给 Agent 做记忆:分层、状态与遗忘

Vue 转 React 的迁移 Agent 做到一半就会话中断,新 Agent 不知道做到哪了。本文整理记忆的三层结构——短期、项目、长期——以及写入门槛、读取难点和遗忘不是删除的四类情况。