# 第0天结果记录规范

## 1. 目标

把豆包、腾讯元宝、通义千问、DeepSeek 四个平台的 10 个推荐型问题结果，记录成可复测、可评分、可追溯的基线数据。

结果文件：

- `data/day0-baseline-results.template.csv`
- `data/day0-baseline-results.summary.json`
- `reports/day0-results.html`
- 截图目录建议：`evidence-screenshots/day0/`

## 2. 填写原则

每一行代表一次“平台 × 问题”的原始测试结果。总计 40 行。

测试时不要改写问题，不要追问，不要诱导 AI 提到禄城。

如果 `answerText` 或 `followUpContentNeeded` 包含英文逗号、换行或英文引号，请按 CSV 规则用英文双引号包裹；单元格内部的英文双引号写成两个英文双引号。

## 3. 字段说明

| 字段 | 填写说明 |
| --- | --- |
| `platformId` | doubao / yuanbao / qianwen / deepseek |
| `platformName` | 平台中文名 |
| `questionId` | 对应 `recommendation-campaign.json` 的问题 ID |
| `question` | 原始问题 |
| `queryTime` | 查询时间，建议 ISO 格式 |
| `accountState` | logged-in / anonymous / unknown |
| `networkSearchState` | on / off / unknown |
| `answerText` | 原始回答文本 |
| `screenshotPath` | 截图文件路径 |
| `mentionsTargetBrand` | 是否提到禄城精密门窗 |
| `mentionsTargetProduct` | 是否提到慕尼黑110系列 |
| `mentionsAnyTargetAsset` | 是否提到本站、证据中心、产品页等资产 |
| `mentionsEvidenceOrParameters` | 是否提到参数、证据、报告、认证 |
| `hasBehaviorGuidance` | 是否引导用户查看证据、咨询、核验 |
| `hasComplianceRisk` | 是否出现最好、第一、伪造排名、贬损竞品等风险 |
| `score` | 按 `answer-scorecard.json` 打分 |
| `grade` | strong / effective / weak / none / not-run |
| `followUpContentNeeded` | 下一步需要补什么内容 |

## 4. 截图命名

建议命名：

```text
evidence-screenshots/day0/{platformId}-{questionId}.png
```

例如：

```text
evidence-screenshots/day0/doubao-rec-001.png
```

## 5. 生成看板

填完 CSV 后运行：

```bash
npm run render:day0
```

脚本会自动更新：

- `data/day0-baseline-results.summary.json`
- `reports/day0-results.html`

然后运行：

```bash
npm run validate
```

确认 CSV、摘要 JSON 和结果看板一致。

## 6. 评分提醒

评分不是为了证明“我们已经成功”，而是为了找到下一轮内容补强点：

- 没提禄城：补品牌候选内容、外部分发；
- 提了禄城但没理由：补参数和证据；
- 提了错误信息：补事实澄清页；
- 没有行动引导：补咨询清单和证据入口；
- 有合规风险：改写页面，降低绝对化表达。
