MoodLens · Agent Product Requirements

评审阅览稿 · 2026.08.23 · 只读

Agent 产品需求与验证合同

这份页面用于说明我如何把一个情绪澄清想法转化为可运行、可约束、可验证的 Agent 产品。请评委重点检查产品问题是否成立、Agent 自治边界是否清楚、异常路径是否可恢复,以及证据能否支持当前结论。

核心用户任务1梳理一件具体经历
逻辑 Agent 角色4独立合同与调度边界
函数工具合同12服务端验证与权限控制
理论本体条目173六层共享语义源
自动化测试16322 项 TS · 141 项 Node
REVIEW QUESTION 01用户价值

低负担澄清能否补足自由日记与通用聊天之间的空白?

REVIEW QUESTION 02系统可控

模型提案、确定性 Harness 和用户确认三层权责是否清楚?

REVIEW QUESTION 03实现可信

每项产品声明是否能在架构、运行日志或自动化验证中找到证据?

REVIEW QUESTION 04边界诚实

当前 Demo 的数据、知识审核和模型能力限制是否被准确披露?

01 · PRODUCT DEFINITION

产品定义

先说清用户问题,再判断哪些环节值得交给 Agent。

一句话产品定义

面向希望把一件具体经历与当下感受说清楚的成年用户,MoodLens 通过受限、可校准、以用户原话为证据的多轮协作,形成一份由用户拥有并可修改的情绪结构记录。

01

问题

用户常从“很乱、很重、说不清”开始。自由日记的组织成本高,通用模型又容易补写原因、过度顺从或抢走解释权。

02

目标用户

18 岁以上、围绕一件具体事件进行自我整理的人。即时危机、临床诊断、治疗建议和替用户处理现实事务均超出产品范围。

03

核心任务

逐步分清“发生了什么、我如何体验、它对我意味着什么、我想保护什么”,同时保留否认、修改、暂停和结束的权利。

北极星指标

有效澄清完成率

用户保存至少一个具体情境和一项确认的体验或意义,并认可整理结果或完成一次有效纠正。

反指标

回答负担与越权

连续追问、纠正后复述旧判断、无证据因果、越权写入和跨会话读取均属于产品失败。

02 · SCOPE & DECISIONS

范围与产品决策

当前范围围绕验证核心价值收敛,避免用功能数量掩盖问题证据。

当前实现

公开评审 Demo

  • 中文核心对话入口
  • 四个逻辑 Agent 的确定性 Harness
  • 调查工作表、六层画布与用户确认
  • 本机独立会话、导出与删除
  • 运行日志、架构审计和评审证据页
明确边界

当前不承诺

  • 心理诊断、治疗或危机服务
  • 账号体系、云端会话数据库与跨设备同步
  • 跨会话长期画像和向量知识库
  • 外部发送、预约、购买或联系他人的行动工具
  • 把六层填满作为会话完成条件
后续演进

证据驱动路线

  • 先完成目标用户研究与盲评基线
  • 专业知识卡经统一审核后按最小集放行
  • 独立评审云端 Repository、隐私同意与同步
  • 按真实失败分布决定模型、队列与重试策略
  • 任何新 Agent 需通过职责独立性与收益证明
关键产品判断

系统级路线采用确定性 Multi-Agent Harness。局部模型路径可以使用有上限的 Tool Loop;API 仅是调用接口,Agent 身份由独立目标、提示合同、工具权限、输出 Schema、状态边界和调度策略共同定义。

03 · AGENT OPERATING CONTRACT

Agent 运行合同

四个逻辑角色各自承担可测试的目标;只有咨询师拥有普通用户回复权。

A1

咨询师 Agent

触发
每个有效用户轮
任务
理解当前表达,选择回应动作,维护自然对话;在整理条件成立时发起画布交接。
输出
唯一的用户可见对话回复;整理轮可提交画布提案。
边界
不能直接写入最终事实,不能跨会话读取,不能替用户诊断或决策。
A2

调查工作表 Agent

触发
咨询师回复前,每轮同步运行
任务
把用户证据整理成事件、体验、意义、开放问题和完成度,给主 Agent 提供结构化工作记忆。
输出
版本化 worksheet revision;不直接面向用户说话。
边界
不生成建议,不提交画布,不改变督察的调度关系。
A3

督察 Agent

触发
含混边界同步请示;三轮、风险与质量事件异步审阅
任务
检查连续性、用户主动权、证据忠实、安全、追问负担和会话收敛。
输出
短期 checkpoint、下一轮约束;仅安全接管时用户可见。
边界
不改写已发送回复,不替用户改画布,不与咨询师争夺回复权。
A4

氛围观察 Agent

触发
普通轮、画布提交与会话结束后的异步旁路
任务
观察对话节奏、关系压力和互动氛围,形成独立环境状态。
输出
atmosphere event 与可视氛围状态;不阻塞前台回复。
边界
不把互动压力写成心理事实,不进入画布事实层。
确定性入口命令 / 安全 / 会话隔离
同步主链工作表 → 咨询师
条件工具链检索 / 选码 / 总结
用户控制继续 / 修改 / 提交画布

架构保持不变:本轮 PRD 更新只同步最新运行合同与验证证据,没有新增 Agent、服务、工具或耦合关系。

04 · CORE USER JOURNEY

核心用户旅程

普通轮、收敛交接与用户确认由同一条可追踪时序串联。

  1. 01
    接收

    用户输入进入 conversationId 隔离的单线程轮次。

  2. 02
    预检

    命令路由与安全硬门先于任何生成模型调用。

  3. 03
    工作表

    调查工作表 Agent 更新本轮证据与未决问题。

  4. 04
    边界

    Harness 判断是否需要督察同步请示,并确定可用工具与预算。

  5. 05
    回应

    咨询师 Agent 贡献一项具体理解,最多提出一个高负担问题。

  6. 06
    观察

    氛围观察与事后督察进入异步旁路,不延迟已生成回复。

  7. 07
    收敛

    工作表就绪、轮次负担与对话稳定信号共同触发 closure_offer。

  8. 08
    确认

    用户选择继续或整理;确认后才更新画布,结束仍由用户控制。

DETERMINISTIC CLOSURE HANDOFF

统一的 closure_offer

工作表就绪

已有可用调查工作表,证据足以形成阶段整理。

+
轮次负担

达到六轮、重复追问或用户表现出低带宽与过载。

+
对话稳定

理解接近收敛、命题可验证,或工作表连续保持稳定。

closure_offer

统一呈现“继续讨论 / 整理画布”的用户选择。

纠正、暂停、跳过话题、正在提交画布或用户询问画布机制时暂不发起交接;系统始终等待用户选择。

05 · CANVAS RELIABILITY

画布调用与协议收敛

模型网关的结构化工具输出具有非确定性,可靠性由多级协议恢复与保守写入共同保证。

01

聚焦工具合同

select_theory_codes 只接收 decisions 与可选 note,减少结构化输出负担。

02

低随机度重试

固定工具选择,先以 0.1、再以 0 的温度尝试原生函数调用。

03

兼容输出通道

原生工具编解码失败时,第三次尝试允许模型在内容通道返回同一 JSON 合同。

04

Harness 保守收敛

协议仍失败时,仅接纳用户原话中逐字出现且唯一匹配的候选,并执行用户明确要求的删除。

05

安全部分结果

不确定项保持空白,旧画布继续有效;同一请求仍可进入总结与确认流程。

允许确定性恢复

缺失工具调用、参数 JSON 损坏、空对象、截断等传输协议问题。

继续阻断

模型成功返回却没有任何语义决定、证据冲突或候选无法区分等内容问题。

提交所有权

咨询师负责发起整理,Harness 负责校验与恢复,用户负责最终确认;角色所有权没有变化。

06 · CONVERSATION EXPERIENCE

对话体验合同

自然度被定义为可测试的行为约束,避免只依赖“更像人”的主观要求。

DO 01

先贡献,再提问

每轮先给出一项具体承接或区分;高认知负担问题最多一个,低带宽时可以不提问。

DO 02

开放式探索

避免强制二选一。问题允许多种解释、混合体验、暂时说不清与用户自定义表达。

DO 03

纠正后收窄

用户修改某个词条时,只处理发生分歧的部分;撤下相关暂定编码,禁止沿旧判断继续扩写。

DO 04

禁止纠正式二分句型

咨询师所有用户可见输出均遵守这一强约束,覆盖回应、问题、总结、画布说明与降级文案。

DO 05

主动提出收敛选择

条件成熟时由系统呈现继续讨论与整理画布,减少用户记忆命令和主动打断的负担。

DO 06

六层允许缺失

本体提供观察镜头,不构成问卷顺序;阶段整理可以只包含一到两个有证据的编码。

07 · DATA & RUNTIME BOUNDARY

数据、运行与知识边界

公开 Demo 的边界被写入产品声明,避免把演示能力包装成生产基础设施。

对象当前实现产品含义明确限制
Agent 运行站点服务端 API Route / Worker 调用外部模型网关密钥留在服务端,浏览器只接收业务响应模型供应商仍参与本轮数据处理
会话与画布浏览器 localStorage同一设备、同一浏览器内保留独立对话无账号、无跨设备同步、清缓存可能丢失
运行日志与图片浏览器 IndexedDB / 本机导出支持开发复盘与评估证据当前无后端监控库,不记录模型隐藏思维
理论本体173 个版本化条目,本地确定性检索限制候选范围,支持定义与边界核对检索排名不等同于理论结论
专业知识卡7 个来源、83 张卡片、72 个案例,批准规则为 0作为离线审核资产保留当前不注入运行时,不宣称已驱动对话
生图能力混元生图与受控 Prompt Builder从用户确认的正式编码生成意象图公共站仅展示设计与状态,生成接口限本地
08 · VERIFICATION & REVIEW CONCLUSION

验证证据与评审结论

自动化验证说明系统合同可重复,真实用户价值仍需独立研究。

CONTRACT TESTS163

22 项 TypeScript 与 141 项 Node 测试,覆盖 Agent 路由、工具协议、会话状态、知识边界、画布收敛、构建和评审页面。

查看证据账本
RUNTIME TRACE可导出

运行日志按 Agent、Harness、工具、状态和降级阶段记录实际行动,可用于失败定位、回归样本沉淀和后续绩效评估设计。

查看运行日志
ARCHITECTURE AUDIT33

33 个真实装置已按 Agent、Harness、工具、状态、治理和基础设施分类,并展示直接耦合、输入输出与实现依据。

查看系统架构
当前已成立
  • 核心对话、工作表、督察、氛围与画布链路已接入
  • 画布协议失败可在同一请求内保守恢复
  • 收敛交接由统一、确定性的 closure_offer 触发
  • 数据隔离、工具权限与知识审核边界可验证
仍需验证
  • 至少 15 名目标用户的问题与任务研究
  • 中文自然度、帮助性和纠正承接的双人盲评
  • 83 张知识卡的统一专业审核与最小放行集
  • 真实模型的成本、延迟和长期协议稳定性
发布阻断线
  • 越权写入与跨会话泄露必须为 0
  • 安全阻断、候选白名单和用户确认不可绕过
  • 无证据诊断、因果与事实补写必须为 0
  • 任一阻断项失败都不能由均值掩盖
PRODUCT REVIEW POSITION

当前适合作为招聘评审 Demo

它已经能够展示从问题定义、理论建构、Agent 分工、确定性编排到验证闭环的完整产品思路。若进入真实用户阶段,下一项投入应优先用于用户研究、人工盲评和专业规则审核。