← QQ星
AI 落地实战 · 企业知识基础层

Enterprise Knowledge Harness

让企业经验成为 Agent 可复用的判断力

让多个 Agent 与产品经理基于同一事实工作

知识产生 · 按任务交付 · 评测演进 · 工作流结果

产品设计与架构负责人 · 2026.04–至今 · 企业复用 / 持续演进

↓ 滚动进入平台
02 · 企业问题

知识存在,不等于 Agent 能正确使用

问题

规范、项目经验和业务材料分散,来源权威并不一致。

后果

全量加载造成上下文膨胀;冲突与过期材料会静默进入回答;规则写死在 Skill 中又让知识与流程耦合。

判断

先治理什么能进入任务、由谁裁决、如何失败,再谈检索能力。

源码方法论篇
分散知识进入 Agent 前的系统风险
企业规范
历史项目经验
业务文档
未经治理的输入
上下文膨胀
来源冲突
材料过期
加载成本
  • 门禁:需要治理的风险
Skill 耦合是技术注释;业务风险首先来自缺少权威、预算与失效处理规则。
03 · 知识产生

先捕获候选,再决定什么值得成为知识

触发

即时捕获不是每个对话都触发:只有可能改变未来跨任务行为,并有用户原话或可定位证据时才登记候选。

边界

它不是会话结束 Hook;纯 Agent 推断、当前 TODO、项目进度和一次性 Bug 不进入候选队列。

双门

候选可以先去重或追加证据,显式沉淀、复现或周度复盘再触发五问裁决,决定是否进入正式知识。

候选捕获与正式入库是两道门
任务内语义信号
用户显式 digest
复现 / 周度复盘
候选队列去重 · 追加证据 · 不要求立即转正
↓ 显式沉淀 / 复现 / 周度复盘
入库五问复用 · 判断改变 · 可路由 · 可承接 · 不污染
新增追加合并暂缓丢弃留原文层
原文层
正式知识域
能力层 / shared Skill
  • 候选:可追加证据
  • 门禁:正式入库五问
  • 已裁决:进入唯一知识层
即时捕获由 Agent 语义规则触发并由确定性脚本持久化;它不是宿主生命周期 Hook。
04 · V1 起点

V1:用人工索引建立第一个稳定基线

优势

小语料阶段,人工权威索引用较低复杂度稳定完成任务路由。

预算

V1 最多返回 5 个文件,没有 Token 硬上限。

问题

文件长度不一会造成上下文波动;知识、角色和跨项目材料增加后,维护与覆盖成本开始上升。

人工权威索引的稳定路径
Task
根 / 领域索引
任务索引
项目记忆索引
最多 5 个文件文件长度仍可能波动
Context-Pack
  • V1:首个稳定基线
V1 控制文件数量而不是 Token:最多 5 个文件,没有 Token 硬上限。
05 · V2 Shadow

V2:为规模化问题设计影子实验

规模信号

知识角色、跨项目材料和文件长度同时增长,V1 的文件数量控制开始出现波动。

实验假设

用更强的检索、排序、质量门和 RetrievalTrace 验证规模化能力,但不直接接管生产流量。

状态

V1 保持 stable,V2 只作为 Shadow 旁路进入同题验证。

查找与审查组装的影子链路
查找
Query Planner
RoleRetrieverExact · Lexical · Metadata
RRF · Reranker
审查组装
去重 · 冲突分组
Selector · Quality Gate
Composer · Renderer
RetrievalTrace
Envelope300
Current Task1,400
Control800
Formal + Legacy2,600
Evidence900
硬上限6,000 Token
  • V2:影子实验
  • 确定性选择与质量门
最终字符串硬上限为 6,000 Token;RetrievalTrace 记录候选、排序、门禁与选择结果。
06 · 人工评测

工程能力更完整,为什么仍然没有切流?

事实

V2 把查找、排序、冲突处理与组装拆成可观察的分层链路。

验证

第一次明显退化;第二次返修缩小差距,但仍有 6 个完成输出回归。

决策

activation=false:保留 V1 生产基线,V2 保持 Shadow,把有效机制收敛进 V1.5。

V2 影子实验的分层链路与两轮报告
Task & Profile任务意图解析 · 角色画像 · 门票元数据查询需求结构
Query PlanningQuery Planner · RoleRetriever优化检索计划
Retrieval & RankingExact · Lexical · Metadata · RRF · Reranker候选内容列表
Quality Gate & Conflict Handling去重 · 冲突分组 · Selector · Quality Gate审查与失败处理
Context-Pack & RetrievalTraceComposer · Renderer · 选择原因与门禁记录上下文包与追踪
Envelope 300Current Task 1,400Control 800Formal + Legacy 2,600Evidence 900硬上限 6,000 Token
  1. 第一次验证8/20扩展方案明显退化,返回检索与覆盖返修。
  2. 第二次验证16/20差距缩小,但 activation=false,V2 保持 Shadow。
第一次验证V2 影子实验评测报告(轮次 1)20 组同题
V1 16/20V2 8/20
上下文精度
31.9%
必需角色覆盖
1/20

扩展方案明显退化,返回检索与覆盖返修。

第二次验证V2 影子实验评测报告(轮次 2)20 组同题
V1 18/20V2 16/20
上下文相关性
87.2%
必需角色覆盖
19/20
完成输出回归
6 个

差距缩小,但 activation=false,V2 保持 Shadow。

V2 保持 Shadow
不切流activation=false
有效机制收敛进 V1.5
  • V2:影子实验
  • 激活门:未通过
  • V1:生产基线保持
工程完整度不是切流理由;两轮报告均来自冻结评测,本页只解释当时的不切流决策。
07 · V1.5 收敛

V1.5:把有效性与可扩展性收敛在一起

收敛

V1.5 保留人工权威索引,用 Profile 固定任务、角色与知识边界,再分两阶段查找和审查组装。

返修

第一次冻结检索契约只通过 11/20;九题失败推动候选与覆盖判断返修。

当前

第二次纯检索契约达到 20/20,但模型答案与人工盲评未形成最终结论,整体仍为 incomplete。

Profile 驱动的两阶段 V1.5 与两轮检索验证
Task
Profile任务 · 角色 · 知识边界
阶段一:查找候选可替换检索接口
阶段二:审查与组装RetrievalTrace
Context-Pack
Task → Profile任务 · 角色 · 知识边界
阶段一:查找候选可替换检索接口
阶段二:审查与组装 → Context-PackRetrievalTrace
弱相关不加载
冲突保留冲突组
过期标记复核
关键缺失insufficient / escalation
6,000 Token 安全硬上限同题评测:工作价值不降低 · 中位数低于 V2 · P90 低于 V2满足后再决定是否下调
第一次检索验证V1.5 冻结检索契约(轮次 1)20 题
V1.5 11/20
契约失败
9 题
Gate
fail

候选和覆盖判断未满足冻结 Gold,返回修复。

第二次检索验证V1.5 覆盖返修验证(轮次 2)20 题
V1.5 20/20
契约失败
0 题
Gate
incomplete

纯检索契约通过;模型答案与人工盲评尚未形成最终结论。

Gate incomplete纯检索契约通过;模型答案与人工盲评尚未形成最终结论。
  • 保留:V1 有效性
  • 吸收:V2 可扩展接口
  • 门禁:待同题评测后再下调预算
V1.5 保留 6,000 Token 安全硬上限;20/20 只表示第二轮纯检索契约通过,不代表整体工作价值或生产切流已经验证。
08 · 真实结果

从知识治理进入真实产品交付

接入

PRD Writer 与独立 Reviewer 使用同一知识事实基线。

覆盖

产品部门全员覆盖,渗透率 100%;历史文档缺失的产品优化需求除外。

结果

规则、案例和项目记忆可以独立维护、按任务加载并版本化演进。

企业知识进入真实产品交付
企业规则历史案例项目记忆
Enterprise Knowledge Harness
PRD Writer
独立 Reviewer
产品部门全员覆盖 · 渗透率 100%规则、案例与项目记忆独立维护并按任务加载
  • 已验证:工作流接入与团队结果
这里仅展示已验证的工作流接入和团队覆盖;历史文档缺失的产品优化需求除外,不把 V2 技术门指标当业务结果。