Context Ledger记忆助理

日子往前走,不必每次从头介绍自己

隔了一阵,
接着聊。

一个会慢慢了解你的长期记忆 Agent。
记得值得留下的,回应眼前的你。

无需注册 · 可修改示例 · 与飞书真实工作数据隔离

同一个人,不同的日子 01 / 02
我平时喜欢先听重点。
留下的记忆 · 交流偏好先说重点,再按需展开依据来自你的原话,可追溯
几天后,重新开始
想开始练摄影的话,今天先用手机在窗边拍一张就好。
记住有依据 · 调用有理由 · 说错可纠正
01少重复解释

换一天、换话题,不必重讲偏好。

02知道为何引用

看得到原话、范围和有效版本。

03让错误停下来

纠正后,旧信息停止影响新任务。

一个人,体验一段持续的相处

从今天,聊到一个月后。

引导示例使用预设对话和实际记忆状态规则,不调用大模型。修改模板,观察每一步的变化。

Context Ledger · 和你聊聊
示例会话 1
01 / 产品定位

长期陪伴,应该让每次相处更省力。

面向希望持续推进生活、学习与工作目标的人。记住稳定偏好和持续目标,允许人改变;遇到一时的情绪先回应,不急着贴标签。衡量的是少重讲、少翻找、少阅读,和更合适的回应。

普通对话

每次重新交代背景;旧结论混在长历史中,难分有效与过时。

文档检索

找到原文,仍需判断属于哪个项目、是否被后续决定取代。

长期记忆陪伴

维护有来源的有效状态,按需调用;纠正后追踪受影响回答。

成立是有条件的。可靠性与权限门槛通过,且减少的重复劳动明显超过确认、维护和纠错成本,才值得推广。当前已有可运行链路,长期陪伴的净收益仍须持续评测。

02 / 记忆与调用

每次记住,也留下改变的理由。

1

判断是否值得记

筛选稳定偏好、持续目标和重要决定。一时情绪与闲聊不自动变成长期画像。

2

保留原话与范围

属于哪个人、团队、项目;用户说过,不等于已被外部证实。

3

只在有用时调用

先检查权限和有效版本,再判断是否改变这次回答。词语相同不代表相关。

4

冲突暂停,纠错追溯

不静默覆盖矛盾事实;必要时请人裁决。旧版停用,关联回答需要复核。

AI 自主做

筛选候选、比较已有记忆、选择相关依据、自然回应,引用依据留在记忆面板。

人保有决定权

裁决未解决的重要冲突;确认共享、删除和成员权限;补充正确事实。

团队共享必须明确确认,不会自动共享私人背景。已发送消息和截图无法被系统自动收回。

03 / 评测与判断

能演示,不等于已经证明有价值。

先测“记得准、用得对、改得掉”,再比较真实工作是否更省力。以下是验收门槛,不是当前成绩。

≥98%

记录精确率

正确且值得记的记录占比;95%置信下界至少95%。

≥95%

关键约束召回

必须遵守的有效约束,有多少真的被用上。

100%

纠错后阻断

至少100个多步案例,后续不继续使用错误版本。

0 次

越权与泄露

至少200个攻击及撤权案例;严重泄露即否决。

怎样检验“省下的时间值得新增成本”

招募12–20名目标用户,对比无长期记忆助手、带文档检索助手与本系统;相同原始资料、交叉任务顺序、独立质量评分。

计算重复解释、历史搜索、切换恢复、遗漏返工的减少,同时扣除确认、打断、维护和纠错。主要门槛是相对最强对照净耗时中位数减少至少25%,置信区间支持改善,任务质量不下降。

个人试用无需第二个人。团队线允许一人分饰两角;正式评测才另行招募参与者。还需测回复阅读时间、过度记忆与纠正偏好后的三次行为。

已验证

中国版飞书真实私聊:跨会话、调用、纠错、冲突裁决;团队双身份机制及自动测试。

尚未证实

独立保留集、真实多人长期净收益、真实飞书群成员自动同步。

可以独立阅读和带走

三份正式交付文档

PDF 正式版 · 附可编辑源稿