§0
一眼总览
§1
满意度变化
好评率 · n<3 不出率 · 点击任意日期下钻日视图§3
问题分布
人工语义归类 · 点击主题条 → §6 拉明细§2
漏斗与成本
settle 口径 · failed 均值 —%§2b
Token 消耗与模型成本
settle 全量(LLM+图片生成)· input 含 cache_read · 1000积分≈1元§4
因素登记表
agent 优化闭环的「什么因素」——每周只更新状态列战略问题清单(月度视角 · 需产品决策)
- 老引擎反超是窗口级事实:智能布局 58.7%(n=225)> agent Ultra 49.2%;海外普通布局 63.4% ≥ lite 61.3%。两市场一致——agent 旗舰/低价档均未打赢老产品,D14 复盘正式回答。
- 积分结构:单价 2.14x × 新用户小余额(首活 86-97%)× P90 会话 7-10 元——免费额度与 P90 成本是否匹配,产品侧议题。
- 能力边界:动画/过渡(产品形态不支持)、20 页上限、可编辑导出——边界类诉求,需排优先级。
- OV ce 率 ~56% 远超 CN 41%、completed 仅 ~6%——海外积分问题比国内严重,建议进上游协同包。
§5
W37 迭代验收
冻结基线(9-01~09-08)→ D7(9-14)→ D14(9-21)· 7 天滚动窗口战略问题清单(月度视角 · 需产品决策)
- 老引擎反超是窗口级事实:智能布局 58.7%(n=225)> agent Ultra 49.2%;海外普通布局 63.4% ≥ lite 61.3%。两市场一致——agent 旗舰/低价档均未打赢老产品,D14 复盘正式回答。
- 积分结构:单价 2.14x × 新用户小余额(首活 86-97%)× P90 会话 7-10 元——免费额度与 P90 成本是否匹配,产品侧议题。
- 能力边界:动画/过渡(产品形态不支持)、20 页上限、可编辑导出——边界类诉求,需排优先级。
- OV ce 率 ~56% 远超 CN 41%、completed 仅 ~6%——海外积分问题比国内严重,建议进上游协同包。
口径红线 · 数据来源 · 勘误(点开)
agent / 老引擎切割generateTier × taskId 格式(agent 档位=32hex session.uid;普通/智能布局=老引擎),实测 0 例外
积分口径credits_transactions 仅
action='settle' AND billing_type='model';hold 行不进分母
统计纪律n<3 不出率;单日为抽样噪声(趋势看 3 日滑动);验收一律 7 天滚动窗口;对比用 Wilson 95% 下界
归因纪律只认对照法:同周同模型单变量对照 / 切换点自然实验 / 量价分解;禁止前后简单对比当因果
数据来源
与本看板重算的口径说明周聚合由冻结原始数据统一重算,与 9-07 旧报告的周表略有差异(旧表来自早期部分拉取,如 W35 Ultra n=263→325、智能布局 n=117→168,均以旧报告自身日度表为准核对);反馈日期字段存在采集缺口(9-05/9-06 为 0 条),V35 周期切分结论以原 DB 时间戳分析为准。9-01~09-08 冻结基线值(46.3% / skill 55.4 vs 39.9 / 覆盖 41.2% / OV 62.5%)与冻结文档完全一致。
9-08 bot 反馈(新格式)73 条/天(此前 20-31),上游结构化 category(top:配图不足/文字过多、交互功能、内容过度、质量差)——主题字典映射待更新(口径更新项);本日 明细表暂未收录
规范codedeck-skills · analytics/references/satisfaction-report.md(Phase 1 skills 产物;Phase 2 一键脚本化)
§6