一级市场的朋友都有同款痛苦:尽调季一摞两三百页的年报和招股书,读完一轮眼睛先报废。长文档理解是国产大模型的主场,通义千问和 Kimi 又是里面声量最大的两个,到底谁更适合当读报告搭子,我们拿同一份 200 页年报实测了一轮。
测评声明
时间:2026 年 9 月 5-8 日。环境:网页版,两平台均为免费档账号(未开会员)。任务集:同一份 200 页 A 股公司年报 PDF,10 个固定问题——营收增速、前五大客户占比、关联交易金额、风险因素归纳、募投项目明细等,逐题核对原文。
核心发现
①数字核对,两者准确率都高,但 Kimi 会给页码。十道数字题 Kimi 对九道,且每处数字附带页码引用,点过去就能核原文;通义千问也对九道,答案直接给数,核对要自己翻。
②归纳能力通义更报告腔,Kimi 更人话。风险因素归纳题,通义的输出结构更像研报摘要,直接贴进内部纪要毫无违和;Kimi 的表述更口语,适合先自己消化再转述。
③免费额度是现实变量。200 页 PDF 上传后,Kimi 免费档的追问次数明显更宽裕,通义在高峰时段出现过排队。
维度评分
| 维度 | 通义千问 | Kimi | 实测依据 |
|---|---|---|---|
| 数字准确性 | 9.0 | 9.0 | 10 题各对 9 题,错题均为表格跨页识读 |
| 引用可核查 | 7.5 | 9.2 | Kimi 全程给页码,通义仅部分回答附来源 |
| 归纳表达 | 9.0 | 8.6 | 通义结构化更完整,Kimi 口语化更易读 |
| 响应速度 | 8.2 | 8.6 | 长文档首轮分析约 90 秒对 70 秒 |
| 免费额度 | 7.8 | 8.8 | 同一文档追问 20 轮,Kimi 未触顶 |
分场景结论
要出正式报告、数字必须逐条可溯源——Kimi 的页码引用是刚需;要快速消化再口头转述、或写内部纪要——通义的报告腔拿来就用。投资机构分析师小何的用法是:Kimi 负责精读给页码,通义负责出结构化摘要,交叉着用,两个模型互相批改,比单信任何一个踏实。
横向对比
顺带一句 Chatdoc 这类文档专用工具:定位是问答机,抽取单点信息快,但整卷归纳的完整度不及两家通用模型,适合当补充而非主力。
最终判断
一句话:读报告要可核查选 Kimi,要成稿选通义,免费额度足够个人把两个都用成日常。置信度说明:基于 4 天一份年报 10 题实测,样本有限;不同行业年报版式差异大,建议拿自己手头最厚的 PDF 跑一轮再下结论。