测评声明:2026-08-30 至 09-01 实测。任务集:10 个时效限定问题——新规生效 3 题、产品发布 3 题、价格变动 2 题、行业事件 2 题。每题双平台各问 2 次,按"答案可直接引用"为标准判分。
核心发现
- 时效题 Perplexity 明显占优:10 题中 8 题答案可直接引用;Kimi 5 题,3 题信息停在几周前
- Kimi 输在索引习惯:它更倾向综合已有知识,对"必须是最近 7 天"的执念不够
- Perplexity 的引用习惯值钱:每条结论挂来源和时间戳,敢直接贴进报告
维度评分(附实测依据)
| 维度 | Perplexity | Kimi | 实测依据 |
|---|---|---|---|
| 时效准确 | 9.2 | 7.6 | 10 题可引用 8 vs 5 |
| 来源标注 | 9.3 | 8.2 | 带时间戳的引用,核对成本低 |
| 深度加工 | 8.2 | 8.8 | 非时效的深度问题 Kimi 反超 |
| 中文源覆盖 | 7.8 | 8.9 | 国内政策/资讯 Kimi 的中文源更全 |
| 免费可用 | 7.8 | 9.0 | Perplexity 高级检索有额度墙 |
分场景结论
- 选 Perplexity:追时效、写报告要引用、外文源多的工作——它的"敢直接用"是核心竞争力
- 选 Kimi:中文政策资讯 + 长文档加工的组合任务——检索加分析一把梭
- 最优解:时效问题先问 Perplexity,拿到线索再用 Kimi 深挖——两个免费工具接力,覆盖最全
举个例子:做行业简报的小周,先让 Perplexity 扫"过去一周的三条大新闻",再让 Kimi 把每条的全文背景补齐——半小时出的简报,来源和时间戳都齐,直接能交。
最终判断: Perplexity 8.8 / Kimi 8.3(时效检索场景加权:时效 40%+来源 25%+中文源 15%+深度 10%+成本 10%)。置信度说明:10 题双轮,时效题为主;日常闲聊检索未测。