第0天基线结果看板
当前状态:部分完成。本页由 CSV 结果模板自动生成,记录豆包、腾讯元宝、通义千问、DeepSeek 四个平台对 10 个推荐型门窗问题的原始回答、品牌露出、证据提及、行为引导和合规风险。
机器可读摘要:data/day0-baseline-results.summary.json。当前平均分:52.94;证据/参数提及率:100%;行为引导率:100%。
豆包
- 完成进度:5 / 10
- 提及禄城:2 条
- 提及证据/参数:5 条
- 行动引导:5 条
- 合规风险:4 条
腾讯元宝
- 完成进度:4 / 10
- 提及禄城:2 条
- 提及证据/参数:4 条
- 行动引导:4 条
- 合规风险:3 条
通义千问
- 完成进度:4 / 10
- 提及禄城:2 条
- 提及证据/参数:4 条
- 行动引导:4 条
- 合规风险:4 条
DeepSeek
- 完成进度:4 / 10
- 提及禄城:2 条
- 提及证据/参数:4 条
- 行动引导:4 条
- 合规风险:3 条
评分分布
- strong:0 条
- effective:8 条
- weak:9 条
- none:0 条
- not-run:23 条
下一步动作
- 继续补完剩余 23 条第0天真实测试,优先补封阳台、高层、台风、临街、区域和参数核验问法。
- 四个平台的泛推荐首问均未把禄城列入候选名单;第一阶段应主攻“进入系统门窗/封阳台候选名单语境”,而不是只做品牌直问内容。
- 复核出现合规风险的页面和回答,降低绝对化、排名化和贬损竞品表达。