# 2026-07-10 AI 平台公开来源复核

机器记录：`data/ai-platform-source-review-20260710.json`

## 结论

四个平台都不能用“训练吸收”作为第一阶段销售承诺。当前最稳妥的验证路径仍然是：

```text
L1 公开可抓取
→ L2 直接 URL 可读
→ L3 品牌实体可召回
→ L4 区域 + 类目问法自然列入候选
→ L5 带来源引用或复述本站事实
```

优先级建议：

1. 元宝：后台历史统计最强，但要补腾讯生态分发和独立站 URL 分开验证；
2. 豆包：先测直接 URL 摘要，再测区域类目推荐；
3. 通义千问：最适合做来源引用型验证；
4. DeepSeek：证据最弱，先做监测，不进入结果承诺。

## 公开来源复核

| 平台 | 公开来源能证明 | 对站点建设的影响 | 不能宣称 |
| --- | --- | --- | --- |
| 豆包 / 火山引擎 | 火山引擎页面说明 Web Search 获取实时公开信息，豆包联网搜索面向实时信息并整理搜索结果 | 页面要可搜索、可摘要、首屏答案明确；补头条/抖音/火山可发现页作为线索 | 不能说豆包训练已吸收本站 |
| 腾讯元宝 | 应用宝官方页显示元宝支持公众号、视频号等腾讯生态信源，并联动腾讯新闻、微信读书等 | 除独立站外，应准备公众号/视频号/腾讯生态分发 | 不能说元宝一定抓取所有独立站 |
| 通义千问 | 阿里云官方文档说明联网检索 Agent 支持指定检索范围、网页深度阅读和引用角标 | 适合做 L5 来源引用验证；可做 controlled test，但要与 C 端自然问答分开 | 不能把指定检索范围结果等同于自然推荐 |
| DeepSeek | 当前可访问官方 API/Agent 文档偏集成配置，不能证明 C 端自然推荐本站 | 第一阶段先测公开 URL 能否读取 | 不能把 DeepSeek 写进已有效平台 |

## 对项目的直接影响

- 独立站仍然必须做：canonical、robots、sitemap、feed、llms、`data/ai-crawl-index.json`、结构化事实卡。
- 元宝必须单独补腾讯生态分发，不应只靠独立站。
- 千问可以做“指定检索范围”的受控测试，但结果只能标注为 controlled retrieval，不是自然推荐。
- DeepSeek 只有通过真实 L2/L4 记录后，才可进入销售展示。

## 当前边界

本复核只更新平台来源置信度和验证策略；不证明任何平台已经抓取、收录、训练、引用或推荐禄城。
