qwen3.8-Max的参数表我看了不下五遍,但参数好看不等于好用。干脆拿一份200页的年报PDF,在同一份文档上连压四轮,强项和边界都记下来。
【版本与环境】
qwen3.8-Max,2.4万亿总参数,采用稀疏MoE与混合注意力架构,单次激活约950亿参数,100万token上下文,原生多模态(2026年8月)。PC端手动选Qwen3.8-Max,开启思考研究,同一prompt只跑一轮,耗时照实记。
【评分标准】A可直接用/B小改可用/C需返工
①整份丢进去|200页PDF不拆包
指令:读完全文,先用三句话给结论,再按业务板块拆开讲。
结果A,约4分钟。它先完成思考,再给三句话结论,营收、亮点、风险各占一句。敢不拆包是因为:100万token对这类200页级PDF基本够用,能减少人工切片带来的跳章节信息断裂风险。
②带页码取数|每个数字都要有出处
指令:按年份提取营收、毛利率、研发费用,每个数字标页码,找不到写未披露,不要推算。
结果B,约3分钟。数字都标到了第50页,毛利率三年全写了未披露——年报确实没披露,它没凑数。但我抽查5处页码错了1处,财报取数的引用必须能复核,所以只能给B。
③大海捺针|藏在附注里的细节
指令:挑一个只在财务附注里出现的细节去问,前面已隔了好几轮对话。
结果A,约90秒。三年的数全给了,还指到具体哪节的哪张表;页码可能有偏差它也直说,没编一个确切页码。
④口径对齐算同比|先对齐,再计算
指令:先把两年口径对齐,口径不一致或数据有缺的直接标出来,不要硬算。
结果A,约2分钟。三项指标逐一核口径,毛利率直接标了无法计算。该算的算,缺数据的停住。
【失败项复测】
②把要求写得更明确(页码必须落到具体页、不确定就标注)之后提到了A,有一部分是我prompt约束不足。
【边界】
适合:长上下文、带出处取数、跳章节细节回查。
不适合:实时私有数据,以及严格法务财务定性的场景,还得人工复核。
背景数据:阿里8月披露,qwen半年全球下载超30亿次、衷生模型超30万个;Hugging Face同期报告也把Qwen列为社区常用的基础模型之一。没人会在不好用的底座上花时间,这是千问技术路线最实在的注脚。
#qwen#大模型#ai#模型测试#aigc#千问ai




