产品定义
先说清用户问题,再判断哪些环节值得交给 Agent。
面向希望把一件具体经历与当下感受说清楚的成年用户,MoodLens 通过受限、可校准、以用户原话为证据的多轮协作,形成一份由用户拥有并可修改的情绪结构记录。
问题
用户常从“很乱、很重、说不清”开始。自由日记的组织成本高,通用模型又容易补写原因、过度顺从或抢走解释权。
目标用户
18 岁以上、围绕一件具体事件进行自我整理的人。即时危机、临床诊断、治疗建议和替用户处理现实事务均超出产品范围。
核心任务
逐步分清“发生了什么、我如何体验、它对我意味着什么、我想保护什么”,同时保留否认、修改、暂停和结束的权利。
北极星指标
有效澄清完成率用户保存至少一个具体情境和一项确认的体验或意义,并认可整理结果或完成一次有效纠正。
反指标
回答负担与越权连续追问、纠正后复述旧判断、无证据因果、越权写入和跨会话读取均属于产品失败。
范围与产品决策
当前范围围绕验证核心价值收敛,避免用功能数量掩盖问题证据。
公开评审 Demo
- 中文核心对话入口
- 四个逻辑 Agent 的确定性 Harness
- 调查工作表、六层画布与用户确认
- 本机独立会话、导出与删除
- 运行日志、架构审计和评审证据页
当前不承诺
- 心理诊断、治疗或危机服务
- 账号体系、云端会话数据库与跨设备同步
- 跨会话长期画像和向量知识库
- 外部发送、预约、购买或联系他人的行动工具
- 把六层填满作为会话完成条件
证据驱动路线
- 先完成目标用户研究与盲评基线
- 专业知识卡经统一审核后按最小集放行
- 独立评审云端 Repository、隐私同意与同步
- 按真实失败分布决定模型、队列与重试策略
- 任何新 Agent 需通过职责独立性与收益证明
系统级路线采用确定性 Multi-Agent Harness。局部模型路径可以使用有上限的 Tool Loop;API 仅是调用接口,Agent 身份由独立目标、提示合同、工具权限、输出 Schema、状态边界和调度策略共同定义。
Agent 运行合同
四个逻辑角色各自承担可测试的目标;只有咨询师拥有普通用户回复权。
咨询师 Agent
- 触发
- 每个有效用户轮
- 任务
- 理解当前表达,选择回应动作,维护自然对话;在整理条件成立时发起画布交接。
- 输出
- 唯一的用户可见对话回复;整理轮可提交画布提案。
- 边界
- 不能直接写入最终事实,不能跨会话读取,不能替用户诊断或决策。
调查工作表 Agent
- 触发
- 咨询师回复前,每轮同步运行
- 任务
- 把用户证据整理成事件、体验、意义、开放问题和完成度,给主 Agent 提供结构化工作记忆。
- 输出
- 版本化 worksheet revision;不直接面向用户说话。
- 边界
- 不生成建议,不提交画布,不改变督察的调度关系。
督察 Agent
- 触发
- 含混边界同步请示;三轮、风险与质量事件异步审阅
- 任务
- 检查连续性、用户主动权、证据忠实、安全、追问负担和会话收敛。
- 输出
- 短期 checkpoint、下一轮约束;仅安全接管时用户可见。
- 边界
- 不改写已发送回复,不替用户改画布,不与咨询师争夺回复权。
氛围观察 Agent
- 触发
- 普通轮、画布提交与会话结束后的异步旁路
- 任务
- 观察对话节奏、关系压力和互动氛围,形成独立环境状态。
- 输出
- atmosphere event 与可视氛围状态;不阻塞前台回复。
- 边界
- 不把互动压力写成心理事实,不进入画布事实层。
架构保持不变:本轮 PRD 更新只同步最新运行合同与验证证据,没有新增 Agent、服务、工具或耦合关系。
核心用户旅程
普通轮、收敛交接与用户确认由同一条可追踪时序串联。
- 01接收
用户输入进入 conversationId 隔离的单线程轮次。
- 02预检
命令路由与安全硬门先于任何生成模型调用。
- 03工作表
调查工作表 Agent 更新本轮证据与未决问题。
- 04边界
Harness 判断是否需要督察同步请示,并确定可用工具与预算。
- 05回应
咨询师 Agent 贡献一项具体理解,最多提出一个高负担问题。
- 06观察
氛围观察与事后督察进入异步旁路,不延迟已生成回复。
- 07收敛
工作表就绪、轮次负担与对话稳定信号共同触发 closure_offer。
- 08确认
用户选择继续或整理;确认后才更新画布,结束仍由用户控制。
统一的 closure_offer
已有可用调查工作表,证据足以形成阶段整理。
达到六轮、重复追问或用户表现出低带宽与过载。
理解接近收敛、命题可验证,或工作表连续保持稳定。
统一呈现“继续讨论 / 整理画布”的用户选择。
纠正、暂停、跳过话题、正在提交画布或用户询问画布机制时暂不发起交接;系统始终等待用户选择。
画布调用与协议收敛
模型网关的结构化工具输出具有非确定性,可靠性由多级协议恢复与保守写入共同保证。
聚焦工具合同
select_theory_codes 只接收 decisions 与可选 note,减少结构化输出负担。
低随机度重试
固定工具选择,先以 0.1、再以 0 的温度尝试原生函数调用。
兼容输出通道
原生工具编解码失败时,第三次尝试允许模型在内容通道返回同一 JSON 合同。
Harness 保守收敛
协议仍失败时,仅接纳用户原话中逐字出现且唯一匹配的候选,并执行用户明确要求的删除。
安全部分结果
不确定项保持空白,旧画布继续有效;同一请求仍可进入总结与确认流程。
缺失工具调用、参数 JSON 损坏、空对象、截断等传输协议问题。
模型成功返回却没有任何语义决定、证据冲突或候选无法区分等内容问题。
咨询师负责发起整理,Harness 负责校验与恢复,用户负责最终确认;角色所有权没有变化。
对话体验合同
自然度被定义为可测试的行为约束,避免只依赖“更像人”的主观要求。
先贡献,再提问
每轮先给出一项具体承接或区分;高认知负担问题最多一个,低带宽时可以不提问。
开放式探索
避免强制二选一。问题允许多种解释、混合体验、暂时说不清与用户自定义表达。
纠正后收窄
用户修改某个词条时,只处理发生分歧的部分;撤下相关暂定编码,禁止沿旧判断继续扩写。
禁止纠正式二分句型
咨询师所有用户可见输出均遵守这一强约束,覆盖回应、问题、总结、画布说明与降级文案。
主动提出收敛选择
条件成熟时由系统呈现继续讨论与整理画布,减少用户记忆命令和主动打断的负担。
六层允许缺失
本体提供观察镜头,不构成问卷顺序;阶段整理可以只包含一到两个有证据的编码。
数据、运行与知识边界
公开 Demo 的边界被写入产品声明,避免把演示能力包装成生产基础设施。
验证证据与评审结论
自动化验证说明系统合同可重复,真实用户价值仍需独立研究。
22 项 TypeScript 与 141 项 Node 测试,覆盖 Agent 路由、工具协议、会话状态、知识边界、画布收敛、构建和评审页面。
查看证据账本运行日志按 Agent、Harness、工具、状态和降级阶段记录实际行动,可用于失败定位、回归样本沉淀和后续绩效评估设计。
查看运行日志33 个真实装置已按 Agent、Harness、工具、状态、治理和基础设施分类,并展示直接耦合、输入输出与实现依据。
查看系统架构- 核心对话、工作表、督察、氛围与画布链路已接入
- 画布协议失败可在同一请求内保守恢复
- 收敛交接由统一、确定性的 closure_offer 触发
- 数据隔离、工具权限与知识审核边界可验证
- 至少 15 名目标用户的问题与任务研究
- 中文自然度、帮助性和纠正承接的双人盲评
- 83 张知识卡的统一专业审核与最小放行集
- 真实模型的成本、延迟和长期协议稳定性
- 越权写入与跨会话泄露必须为 0
- 安全阻断、候选白名单和用户确认不可绕过
- 无证据诊断、因果与事实补写必须为 0
- 任一阻断项失败都不能由均值掩盖
当前适合作为招聘评审 Demo
它已经能够展示从问题定义、理论建构、Agent 分工、确定性编排到验证闭环的完整产品思路。若进入真实用户阶段,下一项投入应优先用于用户研究、人工盲评和专业规则审核。