[{"data":1,"prerenderedAt":-1},["ShallowReactive",2],{"$f2rq4jk3l16wq9":3,"$f1nan3rxkj2eer":85},{"success":4,"data":5},true,{"id":6,"slug":7,"coverImage":8,"author":9,"viewsCount":10,"createdAt":11,"title":12,"description":13,"lang":14,"contentHtml":15,"readingTime":16,"toc":17},"pxehdebhlpxfs0h5qm2m23e9","iq-qwen-35","https:\u002F\u002Fimages.unsplash.com\u002Fphoto-1518186285589-2f7649de83e0?w=1280","Dr. Daria Dudnik",1,"2026-08-01T09:41:02.526Z","Qwen 3.5的IQ是多少？","Qwen 3.5在Mensa Norway IQ测试中得分115，在Intelligence Index上排名前10。我们分析每个基准测试，解释阿里巴巴模型的独特之处。","zh","\u003Ch2 id=\"qwen-3-5\">Qwen 3.5：阿里巴巴的多面手竞争者\u003C\u002Fh2>\n\u003Cp>Qwen 3.5是阿里巴巴达摩院的旗舰模型，达摩院是中国最大、资金最充足的AI研究实验室之一。2026年初发布，Qwen 3.5在Mensa Norway IQ测试中得分\u003Cstrong>115\u003C\u002Fstrong>，在Artificial Analysis Intelligence Index v4.1上排名前10。这使其高于DeepSeek V4 Pro（111），与Kimi K3（118）竞争，但低于前沿模型（Claude ~130，Gemini 141，GPT-5.5 ~145，Grok-4.20 145）。\u003C\u002Fp>\n\u003Cp>Qwen 3.5的独特之处在于其\u003Cstrong>多功能性\u003C\u002Fstrong>。与DeepSeek（专注成本）、Kimi（专注上下文长度）或Grok（专注原始IQ）不同，Qwen 3.5致力于成为一个\u003Cstrong>全面型模型\u003C\u002Fstrong>，在广泛任务范围内表现出色。它拥有强大的多语言支持（27+语言）、出色的多模态能力（文本、图像、音频、视频）和有竞争力的价格 — 使其成为AI模型中的瑞士军刀。\u003C\u002Fp>\n\u003Cp>Qwen 3.5是\u003Cstrong>全能选手\u003C\u002Fstrong>：一个可能在任何单一领域不是绝对最佳，但在几乎所有方面都很好的模型。对于需要单一模型处理多样化工作负载的组织 — 客户服务、内容生成、代码分析、翻译、视觉理解 — Qwen 3.5提供了能力、多功能性和价值的吸引人组合。\u003C\u002Fp>\n\u003Cp>\u003Cstrong>关键分数：\u003C\u002Fstrong>\u003C\u002Fp>\n\u003Cul>\n\u003Cli>\u003Cstrong>Artificial Analysis Intelligence Index\u003C\u002Fstrong>：前10（分数~45-46）\u003C\u002Fli>\n\u003Cli>\u003Cstrong>Mensa Norway IQ（TrackingAI）\u003C\u002Fstrong>：115（高于平均）\u003C\u002Fli>\n\u003Cli>\u003Cstrong>AI IQ综合（VexoWire）\u003C\u002Fstrong>：~115估计\u003C\u002Fli>\n\u003Cli>\u003Cstrong>GDPval-AA v2\u003C\u002Fstrong>：前10\u003C\u002Fli>\n\u003Cli>\u003Cstrong>Humanity&#39;s Last Exam\u003C\u002Fstrong>：前10\u003C\u002Fli>\n\u003Cli>\u003Cstrong>幻觉率\u003C\u002Fstrong>：中低\u003C\u002Fli>\n\u003Cli>\u003Cstrong>成本\u003C\u002Fstrong>：0.55\u002F1.50每1M token（非常实惠）\u003C\u002Fli>\n\u003Cli>\u003Cstrong>多模态\u003C\u002Fstrong>：文本、图像、音频、视频\u003C\u002Fli>\n\u003Cli>\u003Cstrong>语言\u003C\u002Fstrong>：支持27+语言\u003C\u002Fli>\n\u003C\u002Ful>\n\u003Chr>\n\u003Ch2 id=\"1\">1. 多功能性的优势\u003C\u002Fh2>\n\u003Cp>Qwen 3.5代表了阿里巴巴的押注：AI的未来不在于成为最聪明的，而在于成为最\u003Cstrong>多功能的\u003C\u002Fstrong>。当其他实验室优化特定维度 — IQ、成本、上下文、个性 — 阿里巴巴构建了一个在所有维度上都具竞争力的模型。\u003C\u002Fp>\n\u003Cp>考虑这个概况：\u003C\u002Fp>\n\u003Cul>\n\u003Cli>\u003Cstrong>IQ\u003C\u002Fstrong>：115（高于平均，与其他中国模型竞争）\u003C\u002Fli>\n\u003Cli>\u003Cstrong>成本\u003C\u002Fstrong>：0.55\u002F1.50每1M token（最便宜之列）\u003C\u002Fli>\n\u003Cli>\u003Cstrong>多模态\u003C\u002Fstrong>：文本、图像、音频、视频（全多模态）\u003C\u002Fli>\n\u003Cli>\u003Cstrong>语言\u003C\u002Fstrong>：27+语言（一流多语言）\u003C\u002Fli>\n\u003Cli>\u003Cstrong>上下文\u003C\u002Fstrong>：256K token（可观的，虽然不及Kimi）\u003C\u002Fli>\n\u003Cli>\u003Cstrong>开源\u003C\u002Fstrong>：权重可用于本地部署\u003C\u002Fli>\n\u003C\u002Ful>\n\u003Cp>没有单一属性是同类最佳，但组合是无与伦比的。DeepSeek更便宜但缺乏多模态。Kimi有更多上下文但更少语言。Gemini更聪明但更贵。Claude更有能力但闭源。Qwen 3.5找到了平衡 — 在所有方面都足够好，成为你需要的那一个模型。\u003C\u002Fp>\n\u003Cp>这种多功能性使Qwen 3.5特别适合：\u003C\u002Fp>\n\u003Cul>\n\u003Cli>\u003Cstrong>企业部署\u003C\u002Fstrong>，具有多样化工作负载\u003C\u002Fli>\n\u003Cli>\u003Cstrong>国际应用\u003C\u002Fstrong>，需要多种语言\u003C\u002Fli>\n\u003Cli>\u003Cstrong>多模态应用\u003C\u002Fstrong>，结合文本、图像和音频\u003C\u002Fli>\n\u003Cli>\u003Cstrong>注重成本的组织\u003C\u002Fstrong>，仍需质量\u003C\u002Fli>\n\u003Cli>\u003Cstrong>自托管部署\u003C\u002Fstrong>，通过开源权重\u003C\u002Fli>\n\u003C\u002Ful>\n\u003Chr>\n\u003Ch2 id=\"2\">2. 基准测试分解\u003C\u002Fh2>\n\u003Ch3 id=\"mensa-norway-iq-115\">Mensa Norway IQ测试：115（高于平均）\u003C\u002Fh3>\n\u003Cp>由36道视觉模式识别题组成。Qwen 3.5得分\u003Cstrong>115\u003C\u002Fstrong> — 高于人类平均100，处于&quot;高于平均&quot;范围。这高于DeepSeek V4 Pro（111），略低于Kimi K3（118），低于前沿模型（Claude ~130，Gemini 141，GPT-5.5 ~145，Grok-4.20 145）。\u003C\u002Fp>\n\u003Cp>IQ 115意味着Qwen 3.5比大约84%的人类更聪明 — 人类智力前16%。如果它是人，它相当于一个强势的大学生或有能力的专业人士。不是天才，但确实聪明且胜任。\u003C\u002Fp>\n\u003Ch3 id=\"artificial-analysis-intelligence-index-10\">Artificial Analysis Intelligence Index：前10\u003C\u002Fh3>\n\u003Cp>在Intelligence Index上，Qwen 3.5以估计分数\u003Cstrong>~45-46\u003C\u002Fstrong>排名全球前10。这使其与Gemini 3.1 Pro（46.5）、Kimi K3（~45-47）和DeepSeek V4 Pro（44.3）竞争，但落后于Claude（55.7）和GPT-5.5（54.8）。\u003C\u002Fp>\n\u003Cp>Index组成部分分解：\u003C\u002Fp>\n\u003Cul>\n\u003Cli>\u003Cstrong>GDPval-AA v2\u003C\u002Fstrong>：Qwen 3.5表现良好，受益于多模态能力在多样化代理任务中的优势\u003C\u002Fli>\n\u003Cli>\u003Cstrong>AA-Omniscience\u003C\u002Fstrong>：Qwen 3.5有中低幻觉率，受益于阿里巴巴广泛的训练数据\u003C\u002Fli>\n\u003Cli>\u003Cstrong>GPQA\u003C\u002Fstrong>：Qwen 3.5在研究生水平科学问题上表现适当\u003C\u002Fli>\n\u003Cli>\u003Cstrong>HLE\u003C\u002Fstrong>：Qwen 3.5在Humanity&#39;s Last Exam上排名前10\u003C\u002Fli>\n\u003Cli>\u003Cstrong>ARC-AGI\u003C\u002Fstrong>：Qwen 3.5在抽象推理上表现合理\u003C\u002Fli>\n\u003Cli>\u003Cstrong>LMSYS Arena\u003C\u002Fstrong>：Qwen 3.5获得强劲的人类偏好分数，特别是在多语言和多模态任务上\u003C\u002Fli>\n\u003C\u002Ful>\n\u003Ch3 id=\"ai-iq-vexowire-115\">AI IQ综合（VexoWire）：~115\u003C\u002Fh3>\n\u003Cp>VexoWire的综合IQ结合了多个测试（Mensa Norway、Mensa Denmark、Raven&#39;s、WAIS-IV）。Qwen 3.5的估计综合IQ为\u003Cstrong>~115\u003C\u002Fstrong> — 与其Mensa Norway分数一致。这将其放在&quot;平均&quot;和&quot;高于平均&quot;的边界上，比大约84%的人更聪明。\u003C\u002Fp>\n\u003Ch3 id=\"gdpval-aa-v2-10\">GDPval-AA v2：前10\u003C\u002Fh3>\n\u003Cp>在代理基准上，Qwen 3.5排名前10。其多模态能力在涉及处理不同类型数据 — 文本、图像和音频 — 的代理任务上给它优势。对于中等代理工作负载，Qwen 3.5是胜任的，尽管在最复杂任务上仍落后于Claude和GPT-5.5。\u003C\u002Fp>\n\u003Ch3 id=\"humanity-s-last-exam-hle-10\">Humanity&#39;s Last Exam（HLE）：前10\u003C\u002Fh3>\n\u003Cp>在最难的学术问题上，Qwen 3.5在AI模型中排名前10。阿里巴巴强大的学术训练数据和模型的广泛知识库帮助它在各学科中表现良好。\u003C\u002Fp>\n\u003Chr>\n\u003Ch2 id=\"3-iq-115\">3. IQ 115意味着什么？\u003C\u002Fh2>\n\u003Cp>将Qwen 3.5的115 IQ置于上下文中：\u003C\u002Fp>\n\u003Cul>\n\u003Cli>\u003Cstrong>85-115（68%的人）\u003C\u002Fstrong>：平均智力\u003C\u002Fli>\n\u003Cli>\u003Cstrong>115-130（14%）\u003C\u002Fstrong>：高于平均到较高\u003C\u002Fli>\n\u003Cli>\u003Cstrong>130-145（2%）\u003C\u002Fstrong>：超常 — 符合Mensa资格（前2%）\u003C\u002Fli>\n\u003Cli>\u003Cstrong>145-160（0.1%）\u003C\u002Fstrong>：高度超常 \u002F 天才\u003C\u002Fli>\n\u003C\u002Ful>\n\u003Cp>Qwen 3.5以115正好处于**&quot;平均&quot;和&quot;高于平均&quot;的边界** — 比大约84%的人更聪明。如果它是人，它相当于一个强势的大学生或有能力的专业人士。不是天才，但确实聪明且胜任。\u003C\u002Fp>\n\u003Cp>这高于DeepSeek V4 Pro（111），但低于前沿模型：\u003C\u002Fp>\n\u003Cul>\n\u003Cli>Claude Opus 4.8：~130（超常）\u003C\u002Fli>\n\u003Cli>Gemini 3.1 Pro：141（高度超常）\u003C\u002Fli>\n\u003Cli>GPT-5.5：~145（天才）\u003C\u002Fli>\n\u003Cli>Grok-4.20：145（天才）\u003C\u002Fli>\n\u003C\u002Ful>\n\u003Cp>与前沿模型的差距约15-30 IQ分。但Qwen 3.5以多功能性弥补 — 对于需要多模态理解、多语言支持或多样化工作负载的任务，Qwen 3.5的全面能力可以抵消IQ差距。\u003C\u002Fp>\n\u003Chr>\n\u003Ch2 id=\"4-qwen-3-5\">4. Qwen 3.5的优势\u003C\u002Fh2>\n\u003Ch3>多语言支持\u003C\u002Fh3>\n\u003Cp>Qwen 3.5原生支持\u003Cstrong>27+语言\u003C\u002Fstrong>，使其成为最多语言的AI模型之一。这不仅是翻译 — 模型真正用这些语言训练，理解文化背景、习语和细微差别。对于国际应用，Qwen 3.5是最佳选择之一。\u003C\u002Fp>\n\u003Ch3>多模态能力\u003C\u002Fh3>\n\u003Cp>Qwen 3.5可以处理\u003Cstrong>文本、图像、音频和视频\u003C\u002Fstrong> — 使其成为真正的多模态模型。这使纯文本模型无法处理的应用成为可能：视觉问答、图像分析、音频转录、视频理解等。对于结合多种媒体类型的应用，Qwen 3.5非常出色。\u003C\u002Fp>\n\u003Ch3>性价比\u003C\u002Fh3>\n\u003Cp>以0.55\u002F1.50每1M token，Qwen 3.5非常实惠 — 略贵于DeepSeek V4 Pro（0.44\u002F0.87），但比Claude（5\u002F25）、GPT-5.5（5\u002F30）和Gemini（2\u002F12）便宜得多。考虑到其多模态能力和多语言支持，价值主张出色。\u003C\u002Fp>\n\u003Ch3>开源可用性\u003C\u002Fh3>\n\u003Cp>Qwen 3.5的权重可用于本地部署，使其成为少数多模态开源模型之一。这很重要 — 大多数多模态模型（GPT-5.5、Gemini）是闭源的。对于需要多模态能力同时保护数据隐私的组织，Qwen 3.5是最佳选择之一。\u003C\u002Fp>\n\u003Ch3>中文任务\u003C\u002Fh3>\n\u003Cp>作为在中国开发的模型，Qwen 3.5具有出色的中文能力。对于中文应用，Qwen 3.5是最佳可用模型之一，在中文特定任务上经常超越西方模型。\u003C\u002Fp>\n\u003Ch3>企业就绪\u003C\u002Fh3>\n\u003Cp>阿里巴巴的基础设施和企业经验使Qwen 3.5特别适合企业部署。模型通过阿里云提供，具有企业级SLA、合规认证和集成支持。对于寻找可靠、多功能AI模型的企业，Qwen 3.5是强有力的选择。\u003C\u002Fp>\n\u003Chr>\n\u003Ch2 id=\"5-qwen-3-5\">5. Qwen 3.5的不足\u003C\u002Fh2>\n\u003Ch3 id=\"iq\">原始IQ和复杂推理\u003C\u002Fh3>\n\u003Cp>以IQ 115，Qwen 3.5在复杂推理任务上低于前沿模型。对于最难的问题 — 竞赛数学、高级逻辑谜题、前沿科学推理 — Claude、GPT-5.5和Gemini明显更好。如果你的任务需要天才级推理，前沿模型是更好的选择。\u003C\u002Fp>\n\u003Ch3>上下文窗口\u003C\u002Fh3>\n\u003Cp>以256K token的上下文窗口，Qwen 3.5是足够的但不杰出。Kimi K3（2M）和Gemini（1M）提供显著更大的上下文窗口。对于需要一次性处理超长文档的任务，Kimi K3或Gemini是更好的选择。\u003C\u002Fp>\n\u003Ch3>代理任务复杂性\u003C\u002Fh3>\n\u003Cp>虽然Qwen 3.5的多模态能力有助于多样化代理任务，但在纯任务复杂性上它仍落后于Claude和GPT-5.5。对于最苛刻的代理应用 — 从零开始编写复杂软件、管理复杂研究流程 — Claude仍然更有能力。\u003C\u002Fp>\n\u003Ch3>情感智能\u003C\u002Fh3>\n\u003Cp>Qwen 3.5的EQ（情感智能）估计为~107 — 低于Claude（~132）、GPT-5.5（~120）和Gemini（~115），但与DeepSeek（~105）和Grok（~110）相当。其回答倾向于更功能性，情感上不够细腻。对于治疗应用、客户服务或敏感的人类互动，Claude是更好的选择。\u003C\u002Fp>\n\u003Ch3>幻觉率\u003C\u002Fh3>\n\u003Cp>虽然Qwen 3.5有中低幻觉率，但不如Claude（35.9%）低。对于事实准确性至关重要的应用 — 研究、法律、医疗 — Claude更可靠。\u003C\u002Fp>\n\u003Chr>\n\u003Ch2 id=\"6-qwen-3-5\">6. Qwen 3.5与其他模型对比\u003C\u002Fh2>\n\u003Cdiv class=\"article-table-wrapper\">\u003Ctable>\n\u003Cthead>\n\u003Ctr>\n\u003Cth>模型\u003C\u002Fth>\n\u003Cth>Intelligence Index\u003C\u002Fth>\n\u003Cth>Mensa Norway IQ\u003C\u002Fth>\n\u003Cth>AI IQ估计\u003C\u002Fth>\n\u003Cth>多模态\u003C\u002Fth>\n\u003Cth>成本\u002F1M\u003C\u002Fth>\n\u003Cth>语言\u003C\u002Fth>\n\u003Cth>开源\u003C\u002Fth>\n\u003C\u002Ftr>\n\u003C\u002Fthead>\n\u003Ctbody>\u003Ctr>\n\u003Ctd>Qwen 3.5\u003C\u002Ftd>\n\u003Ctd>~45-46（前10）\u003C\u002Ftd>\n\u003Ctd>115\u003C\u002Ftd>\n\u003Ctd>~115\u003C\u002Ftd>\n\u003Ctd>文本+图像+音频+视频\u003C\u002Ftd>\n\u003Ctd>0.55\u002F1.50\u003C\u002Ftd>\n\u003Ctd>27+\u003C\u002Ftd>\n\u003Ctd>是\u003C\u002Ftd>\n\u003C\u002Ftr>\n\u003Ctr>\n\u003Ctd>Claude Opus 4.8\u003C\u002Ftd>\n\u003Ctd>55.7\u003C\u002Ftd>\n\u003Ctd>~130\u003C\u002Ftd>\n\u003Ctd>~132\u003C\u002Ftd>\n\u003Ctd>文本+图像\u003C\u002Ftd>\n\u003Ctd>5\u002F25\u003C\u002Ftd>\n\u003Ctd>~20\u003C\u002Ftd>\n\u003Ctd>否\u003C\u002Ftd>\n\u003C\u002Ftr>\n\u003Ctr>\n\u003Ctd>GPT-5.5\u003C\u002Ftd>\n\u003Ctd>54.8\u003C\u002Ftd>\n\u003Ctd>~145\u003C\u002Ftd>\n\u003Ctd>~136\u003C\u002Ftd>\n\u003Ctd>文本+图像+音频\u003C\u002Ftd>\n\u003Ctd>5\u002F30\u003C\u002Ftd>\n\u003Ctd>~50\u003C\u002Ftd>\n\u003Ctd>否\u003C\u002Ftd>\n\u003C\u002Ftr>\n\u003Ctr>\n\u003Ctd>Gemini 3.1 Pro\u003C\u002Ftd>\n\u003Ctd>46.5\u003C\u002Ftd>\n\u003Ctd>141\u003C\u002Ftd>\n\u003Ctd>~131\u003C\u002Ftd>\n\u003Ctd>文本+图像+音频+视频\u003C\u002Ftd>\n\u003Ctd>2\u002F12\u003C\u002Ftd>\n\u003Ctd>~40\u003C\u002Ftd>\n\u003Ctd>否\u003C\u002Ftd>\n\u003C\u002Ftr>\n\u003Ctr>\n\u003Ctd>Grok-4.20\u003C\u002Ftd>\n\u003Ctd>前5\u003C\u002Ftd>\n\u003Ctd>145\u003C\u002Ftd>\n\u003Ctd>~140\u003C\u002Ftd>\n\u003Ctd>文本+图像\u003C\u002Ftd>\n\u003Ctd>3\u002F15\u003C\u002Ftd>\n\u003Ctd>~20\u003C\u002Ftd>\n\u003Ctd>否\u003C\u002Ftd>\n\u003C\u002Ftr>\n\u003Ctr>\n\u003Ctd>DeepSeek V4 Pro\u003C\u002Ftd>\n\u003Ctd>44.3\u003C\u002Ftd>\n\u003Ctd>~111\u003C\u002Ftd>\n\u003Ctd>~111\u003C\u002Ftd>\n\u003Ctd>仅文本\u003C\u002Ftd>\n\u003Ctd>0.44\u002F0.87\u003C\u002Ftd>\n\u003Ctd>~10\u003C\u002Ftd>\n\u003Ctd>是\u003C\u002Ftd>\n\u003C\u002Ftr>\n\u003Ctr>\n\u003Ctd>Kimi K3\u003C\u002Ftd>\n\u003Ctd>~45-47（前10）\u003C\u002Ftd>\n\u003Ctd>118\u003C\u002Ftd>\n\u003Ctd>~118\u003C\u002Ftd>\n\u003Ctd>仅文本\u003C\u002Ftd>\n\u003Ctd>0.55\u002F2.19\u003C\u002Ftd>\n\u003Ctd>~10\u003C\u002Ftd>\n\u003Ctd>否\u003C\u002Ftd>\n\u003C\u002Ftr>\n\u003C\u002Ftbody>\u003C\u002Ftable>\u003C\u002Fdiv>\n\u003Cp>画面：Qwen 3.5是\u003Cstrong>全能选手\u003C\u002Fstrong> — 在任何单一领域不是最佳，但在几乎所有方面都很好。Claude是\u003Cstrong>有能力的专业人士\u003C\u002Fstrong> — 实际任务和事实准确性最好。GPT-5.5是\u003Cstrong>测试天才\u003C\u002Fstrong> — 数学、视觉推理最好。Gemini是\u003Cstrong>价值冠军\u003C\u002Fstrong> — 前沿模型中最佳性价比。Grok-4.20是\u003Cstrong>原始IQ冠军\u003C\u002Fstrong> — 最高IQ加个性。DeepSeek是\u003Cstrong>预算冠军\u003C\u002Fstrong> — 最便宜且开源。Kimi是\u003Cstrong>长上下文冠军\u003C\u002Fstrong> — 最大上下文窗口。\u003C\u002Fp>\n\u003Cp>对于需要多功能性的组织 — 多模态、多语言、实惠、开源 — Qwen 3.5是明确选择。它是AI模型中的瑞士军刀。\u003C\u002Fp>\n\u003Chr>\n\u003Ch2 id=\"7\">7. 这对人类意味着什么？\u003C\u002Fh2>\n\u003Cp>Qwen 3.5以~115的IQ运作 — 比大约84%的人更聪明。但是：\u003C\u002Fp>\n\u003Cul>\n\u003Cli>\u003Cstrong>IQ不是一切\u003C\u002Fstrong>：IQ 115高于平均，对大多数实际任务足够\u003C\u002Fli>\n\u003Cli>\u003Cstrong>对许多应用，多功能性比原始IQ更重要\u003C\u002Fstrong>：对于多样化工作负载，Qwen 3.5的全面能力比更窄模型中更高IQ更有价值\u003C\u002Fli>\n\u003Cli>\u003Cstrong>多模态是未来\u003C\u002Fstrong>：Qwen 3.5处理文本、图像、音频和视频的能力开辟了纯文本模型无法处理的应用\u003C\u002Fli>\n\u003Cli>\u003Cstrong>多语言实现全球覆盖\u003C\u002Fstrong>：以27+语言，Qwen 3.5可以用用户的母语服务 — 对全球应用重要的能力\u003C\u002Fli>\n\u003Cli>\u003Cstrong>知识 ≠ 理解\u003C\u002Fstrong>：像所有AI模型一样，Qwen 3.5可以访问大量知识，但不像人类那样真正&quot;理解&quot;\u003C\u002Fli>\n\u003Cli>\u003Cstrong>没有意识\u003C\u002Fstrong>：高IQ不意味着有感知力。Qwen 3.5是复杂的模式匹配系统，不是思考的存在\u003C\u002Fli>\n\u003Cli>\u003Cstrong>开源促进创新\u003C\u002Fstrong>：Qwen 3.5的开放权重允许研究者和开发者构建定制解决方案、针对特定领域微调并本地运行\u003C\u002Fli>\n\u003C\u002Ful>\n\u003Cp>最诚实的答案：Qwen 3.5在\u003Cstrong>认知测试上比84%的人类更聪明\u003C\u002Fstrong>，对于需要多功能性的应用 — 多模态、多语言、实惠 — 它是最聪明的选择 — 不是因为它最智能，而是因为它在最广泛任务范围内最有能力。\u003C\u002Fp>\n\u003Cp>\n    \u003Cdiv class=\"article-quiz-cta\">\n      \u003Cdiv class=\"article-quiz-cta__text\">您的IQ与Qwen 3.5相比如何？参加NeuroLab的专业IQ评估。\u003C\u002Fdiv>\n      \u003Ca href=\"\u002Fzh\u002Ftests\u002Fiq-standard\" class=\"article-quiz-cta__button\">\n        立即进行测试 →\n      \u003C\u002Fa>\n    \u003C\u002Fdiv>\u003C\u002Fp>\n\u003Chr>\n\u003Ch2>结论\u003C\u002Fh2>\n\u003Cp>\n    \u003Cdiv class=\"article-callout\">\n      \u003Cdiv class=\"article-callout__title\">\n        \u003Cspan class=\"article-callout__icon\">💡\u003C\u002Fspan>\n        关键要点\n      \u003C\u002Fdiv>\n      \u003Cdiv class=\"article-callout__body\">- \u003Cstrong>Qwen 3.5的IQ为115\u003C\u002Fstrong>（Mensa Norway）— 高于平均，比~84%的人更聪明。\u003C\u002Fp>\n\u003Cul>\n\u003Cli>\u003Cstrong>Intelligence Index前10\u003C\u002Fstrong> — 与Gemini、Kimi和DeepSeek竞争，落后于Claude和GPT-5.5。\u003C\u002Fli>\n\u003Cli>\u003Cstrong>全多模态\u003C\u002Fstrong> — 文本、图像、音频和视频在一个模型中。\u003C\u002Fli>\n\u003Cli>\u003Cstrong>27+语言\u003C\u002Fstrong> — 最多语言的AI模型之一。\u003C\u002Fli>\n\u003Cli>\u003Cstrong>开源\u003C\u002Fstrong> — 权重可用于本地部署，实现隐私和定制。\u003C\u002Fli>\n\u003Cli>\u003Cstrong>最适合\u003C\u002Fstrong>：多样化企业工作负载、国际应用、多模态任务、注重成本的组织、自托管部署。\u003C\u002Fli>\n\u003Cli>\u003Cstrong>非最适合\u003C\u002Fstrong>：原始IQ（前沿模型胜）、长上下文（Kimi胜）、复杂代理任务（Claude胜）、情感智能（Claude胜）。\u003C\u002Fli>\n\u003Cli>\u003Cstrong>教训\u003C\u002Fstrong>：智能不只是做最聪明的 — 而是做多功能的。Qwen 3.5证明在所有方面都好可能比在一个方面最好更有价值。\u003C\u002Fdiv>\n    \u003C\u002Fdiv>\u003C\u002Fli>\n\u003C\u002Ful>\n",10,[18,22,25,28,32,35,38,41,44,47,50,53,55,57,59,61,63,66,69,71,73,75,77,80,83],{"id":19,"text":20,"level":21},"qwen-3-5","Qwen 3.5：阿里巴巴的多面手竞争者",2,{"id":23,"text":24,"level":21},"1","1. 多功能性的优势",{"id":26,"text":27,"level":21},"2","2. 基准测试分解",{"id":29,"text":30,"level":31},"mensa-norway-iq-115","Mensa Norway IQ测试：115（高于平均）",3,{"id":33,"text":34,"level":31},"artificial-analysis-intelligence-index-10","Artificial Analysis Intelligence Index：前10",{"id":36,"text":37,"level":31},"ai-iq-vexowire-115","AI IQ综合（VexoWire）：~115",{"id":39,"text":40,"level":31},"gdpval-aa-v2-10","GDPval-AA v2：前10",{"id":42,"text":43,"level":31},"humanity-s-last-exam-hle-10","Humanity's Last Exam（HLE）：前10",{"id":45,"text":46,"level":21},"3-iq-115","3. IQ 115意味着什么？",{"id":48,"text":49,"level":21},"4-qwen-3-5","4. Qwen 3.5的优势",{"id":51,"text":52,"level":31},"","多语言支持",{"id":51,"text":54,"level":31},"多模态能力",{"id":51,"text":56,"level":31},"性价比",{"id":51,"text":58,"level":31},"开源可用性",{"id":51,"text":60,"level":31},"中文任务",{"id":51,"text":62,"level":31},"企业就绪",{"id":64,"text":65,"level":21},"5-qwen-3-5","5. Qwen 3.5的不足",{"id":67,"text":68,"level":31},"iq","原始IQ和复杂推理",{"id":51,"text":70,"level":31},"上下文窗口",{"id":51,"text":72,"level":31},"代理任务复杂性",{"id":51,"text":74,"level":31},"情感智能",{"id":51,"text":76,"level":31},"幻觉率",{"id":78,"text":79,"level":21},"6-qwen-3-5","6. Qwen 3.5与其他模型对比",{"id":81,"text":82,"level":21},"7","7. 这对人类意味着什么？",{"id":51,"text":84,"level":21},"结论",{"success":4,"data":86,"pagination":255},[87,96,103,111,118,119,126,133,141,148,155,162,169,176,184,191,198,205,213,220,227,234,241,248],{"id":88,"slug":89,"coverImage":90,"author":9,"viewsCount":91,"createdAt":92,"title":93,"description":94,"lang":14,"readingTime":95},"jy0egbpgrn30am622jy7xfrw","adhd-and-iq","https:\u002F\u002Fimages.unsplash.com\u002Fphoto-1507812984078-917231447e3e?w=1280",0,"2026-08-01T10:48:43.940Z","ADHD与IQ：当注意力缺陷隐藏了高智商","ADHD能掩盖高IQ吗？是的。研究表明注意力缺陷可能人为地将IQ测试分数降低10-15分——将天赋异禀的大脑隐藏在注意力不集中背后。",7,{"id":97,"slug":98,"coverImage":99,"author":9,"viewsCount":91,"createdAt":100,"title":101,"description":102,"lang":14,"readingTime":95},"dvlwozf321i8jlk9sfl390k1","online-vs-certified-iq-tests","https:\u002F\u002Fimages.unsplash.com\u002Fphoto-1499209974431-9fccce68dc04?w=1280","2026-08-01T10:48:39.869Z","在线IQ测试 vs 认证评估：它们有多准确？","你在免费在线IQ测试中得了140分。但这到底意味着什么？我们比较在线测试与认证评估——结果可能让你惊讶。",{"id":104,"slug":105,"coverImage":106,"author":9,"viewsCount":91,"createdAt":107,"title":108,"description":109,"lang":14,"readingTime":110},"maxnlmh4wqwxjuidbe2cb1jh","iq-above-160","https:\u002F\u002Fimages.unsplash.com\u002Fphoto-1454165804606-c3d57bc86b40?w=1280","2026-08-01T10:48:35.909Z","IQ超过160：极端边缘的生活是什么样的","只有三万分之一的人IQ超过160。我们探索人类智力极端边缘的生活——天赋、挣扎和神话。",8,{"id":112,"slug":113,"coverImage":114,"author":9,"viewsCount":91,"createdAt":115,"title":116,"description":117,"lang":14,"readingTime":16},"z8wcdr5vus4cvw8zr3p1ok1r","iq-llama-4","https:\u002F\u002Fimages.unsplash.com\u002Fphoto-1526374965328-4f18af581d06?w=1280","2026-08-01T10:03:59.771Z","Llama 4的IQ是多少？","Llama 4在Mensa Norway IQ测试中得分112，在Intelligence Index上排名前15。我们分析每个基准测试，解释Meta开源模型的独特之处。",{"id":6,"slug":7,"coverImage":8,"author":9,"viewsCount":10,"createdAt":11,"title":12,"description":13,"lang":14,"readingTime":16},{"id":120,"slug":121,"coverImage":122,"author":9,"viewsCount":21,"createdAt":123,"title":124,"description":125,"lang":14,"readingTime":16},"st1nxd9ef5blcslk68p83pj1","iq-kimi-k3","https:\u002F\u002Fimages.unsplash.com\u002Fphoto-1620712943524-bccbe725b837?w=1280","2026-08-01T09:32:03.531Z","Kimi K3的IQ是多少？","Kimi K3在Mensa Norway IQ测试中得分118，在Intelligence Index上排名前10。我们分析每个基准测试，解释Moonshot AI模型的独特之处。",{"id":127,"slug":128,"coverImage":129,"author":9,"viewsCount":91,"createdAt":130,"title":131,"description":132,"lang":14,"readingTime":16},"u65iu8mijuzx0t4g1981phue","iq-deepseek-v4","https:\u002F\u002Fimages.unsplash.com\u002Fphoto-1677372139014-394e5b51f79b?w=1280","2026-08-01T09:23:30.326Z","DeepSeek V4的IQ是多少？","DeepSeek V4 Pro在Mensa Norway IQ测试中得分111，在Intelligence Index上得分44.3。我们分析每个基准测试，解释为什么它是最佳预算AI模型。",{"id":134,"slug":135,"coverImage":136,"author":9,"viewsCount":137,"createdAt":138,"title":139,"description":140,"lang":14,"readingTime":16},"lci1u8drubje01qwq1vah01m","iq-grok-420","https:\u002F\u002Fimages.unsplash.com\u002Fphoto-1635776062127-d379b0ba009b?w=1280",6,"2026-07-31T20:30:00.249Z","Grok-4.20的IQ是多少？","Grok-4.20在Mensa Norway IQ测试中得分145 — 在所有AI模型中并列#1。我们分析每个基准测试，解释xAI模型的独特之处。",{"id":142,"slug":143,"coverImage":144,"author":9,"viewsCount":21,"createdAt":145,"title":146,"description":147,"lang":14,"readingTime":16},"n32qvrqd1er095jgz98qg73l","iq-gemini-31-pro","https:\u002F\u002Fimages.unsplash.com\u002Fphoto-1591488320449-011701bb6704?w=1280","2026-07-31T20:06:42.239Z","Gemini 3.1 Pro的IQ是多少？","Gemini 3.1 Pro在Mensa Norway IQ测试中得分141，在Intelligence Index上得分46.5。我们分析每个基准测试，解释为什么它是最具性价比的前沿模型。",{"id":149,"slug":150,"coverImage":151,"author":9,"viewsCount":10,"createdAt":152,"title":153,"description":154,"lang":14,"readingTime":16},"jl69290gswdg1wrb5oy6iiyo","iq-gpt-55","https:\u002F\u002Fimages.unsplash.com\u002Fphoto-1620712943543-bcc4688e7485?w=1280","2026-07-31T19:59:37.899Z","GPT-5.5的IQ是多少？","GPT-5.5在Mensa Norway IQ测试中得分~145，在Intelligence Index上得分54.8。我们分析每个基准测试，并与Claude、Gemini和Grok进行比较。",{"id":156,"slug":157,"coverImage":158,"author":9,"viewsCount":10,"createdAt":159,"title":160,"description":161,"lang":14,"readingTime":16},"fmyy2tdkvdmffu6n9y5npc5c","iq-claude-opus-48","https:\u002F\u002Fimages.unsplash.com\u002Fphoto-1677442136019-21780ecad995?w=1280","2026-07-31T19:53:48.504Z","Claude Opus 4.8 的 IQ 是多少？","Claude Opus 4.8以55.7领跑Artificial Analysis Intelligence Index，在人类IQ测试中得分~132-145。我们分析每个基准测试，并与GPT-5.5、Gemini和Grok进行比较。",{"id":163,"slug":164,"coverImage":165,"author":9,"viewsCount":91,"createdAt":166,"title":167,"description":168,"lang":14,"readingTime":110},"mhlz1hmh5ez4vs6loftlxd06","fasting-cognitive-performance","https:\u002F\u002Fimages.unsplash.com\u002Fphoto-1490645935441-5b6c2cc1e5e1?w=1280","2026-07-30T18:27:49.514Z","禁食能改善认知表现吗？","从间歇性禁食到酮体：我们回顾禁食是否能让头脑敏锐、提高专注力或实际上损害认知的证据。科学可能会让你惊讶。",{"id":170,"slug":171,"coverImage":172,"author":9,"viewsCount":21,"createdAt":173,"title":174,"description":175,"lang":14,"readingTime":16},"fentmgsgc3lq034m2nk53ol4","wechsler-iq-test-subtests","https:\u002F\u002Fimages.unsplash.com\u002Fphoto-1494256997604-668ec142f5d2?w=1280","2026-07-30T18:18:40.059Z","韦氏IQ测试：每个子测试真正测量什么","WAIS和WISC是世界上使用最广泛的IQ测试。我们分解每个子测试，它真正测量什么，以及分数如何转化为实际认知能力。",{"id":177,"slug":178,"coverImage":179,"author":9,"viewsCount":91,"createdAt":180,"title":181,"description":182,"lang":14,"readingTime":183},"wlwyq33ezei7c22edclwpyvo","lead-fluoride-iq-loss","https:\u002F\u002Fimages.unsplash.com\u002Fphoto-1581093577124-a6f4b6e3a5e1?w=1280","2026-07-30T18:07:23.917Z","铅、氟化物与IQ下降：环境证据","环境毒素真的能降低你的IQ吗？我们回顾了铅暴露、氟化物和认知衰退的最强研究——区分严肃科学与耸人听闻。",9,{"id":185,"slug":186,"coverImage":187,"author":9,"viewsCount":31,"createdAt":188,"title":189,"description":190,"lang":14,"readingTime":110},"ue16gxaun3lus9vml8imf6ci","iq-changes-during-pregnancy","https:\u002F\u002Fimages.unsplash.com\u002Fphoto-1559750178-961c031777fe?w=1280","2026-07-29T18:48:12.309Z","怀孕期间的IQ变化：研究发现","怀孕真的会缩小你的大脑吗？我们回顾了母性认知的神经科学——从\"孕期大脑\"到持久的结构变化——区分事实与神话。",{"id":192,"slug":193,"coverImage":194,"author":9,"viewsCount":10,"createdAt":195,"title":196,"description":197,"lang":14,"readingTime":183},"zd0sfdazkyai41s0kh639ohl","does-bilingualism-raise-iq","https:\u002F\u002Fimages.unsplash.com\u002Fphoto-1523050854058-8f908275853f?w=1280","2026-07-29T18:33:17.515Z","说两种语言真的能提高你的IQ吗？","双语优势已争论数十年。我们回顾了关于双语主义和认知能力的最有力研究，区分真实效果与夸大。",{"id":199,"slug":200,"coverImage":201,"author":9,"viewsCount":31,"createdAt":202,"title":203,"description":204,"lang":14,"readingTime":183},"s0hko69oudyziplx2q04ab9q","gifted-kids-peaked-early-childhood-iq-fades","https:\u002F\u002Fimages.unsplash.com\u002Fphoto-1503454537195-1dc81782b6d3?w=1280","2026-07-29T18:17:25.535Z","早慧儿童的IQ为何会消退：天赋的衰退现象","为什么许多神童长大后变得平凡？我们研究早期IQ峰值、\"回归平均\"效应，以及真正预测成年成功的因素。",{"id":206,"slug":207,"coverImage":208,"author":9,"viewsCount":209,"createdAt":210,"title":211,"description":212,"lang":14,"readingTime":110},"s7x75o02kixj2u43gw4ah5pa","olfactory-processing-speed-cognitive-marker","https:\u002F\u002Fimages.unsplash.com\u002Fphoto-1542838132-92c53300287c?w=1280",5,"2026-07-28T20:40:48.167Z","嗅觉处理速度作为认知标志","你识别气味的速度能否预测你的认知能力？我们检验了将嗅觉处理速度与智商、记忆力和神经退行性疾病风险联系起来的惊人研究。",{"id":214,"slug":215,"coverImage":216,"author":9,"viewsCount":21,"createdAt":217,"title":218,"description":219,"lang":14,"readingTime":183},"v1qq1yz082k72zzynk0qv2yh","do-musicians-have-higher-iqs","https:\u002F\u002Fimages.unsplash.com\u002Fphoto-1520006510097-3d64427f3f98?w=1280","2026-07-28T20:29:23.744Z","音乐家的智商更高吗？研究结论","音乐家更聪明的观念广为流传——但科学是否支持这一点？我们综述了10项关于音乐训练、智商和认知能力的关键研究，以区分事实与虚构。",{"id":221,"slug":222,"coverImage":223,"author":9,"viewsCount":31,"createdAt":224,"title":225,"description":226,"lang":14,"readingTime":183},"xam91ejelkjg23x2z9skt9vm","are-night-owls-smarter","https:\u002F\u002Fimages.unsplash.com\u002Fphoto-1518837695005-2083093ee35b?w=1280","2026-07-28T19:50:50.159Z","夜猫子更聪明吗？昼夜节律型与认知表现","夜猫子比早起鸟更聪明的观点很流行——但研究实际上显示了什么？我们考察了昼夜节律型、智商和认知表现的证据。",{"id":228,"slug":229,"coverImage":230,"author":9,"viewsCount":209,"createdAt":231,"title":232,"description":233,"lang":14,"readingTime":183},"hpakkt3uv7frkkhj2el6fvm1","does-high-iq-make-you-rich","https:\u002F\u002Fimages.unsplash.com\u002Fphoto-1579621970795-87facc2f976d?w=1280","2026-07-28T19:41:02.722Z","高智商能让你变富吗？12项研究综述","智商与收入之间的相关性是真实的，但出人意料地弱。我们综述了12项关键研究，以理解为什么高智商不能保证财富——以及什么真正预测了财务成功。",{"id":235,"slug":236,"coverImage":237,"author":9,"viewsCount":209,"createdAt":238,"title":239,"description":240,"lang":14,"readingTime":183},"b5ct19s9mfso606wcppcp79o","iq-test-scores-in-prison-populations","https:\u002F\u002Fimages.unsplash.com\u002Fphoto-1497366216548-37526070297c?w=1280","2026-07-28T18:32:32.833Z","监狱人口中的智商测试分数：研究显示了什么","研究一致发现，监狱人口在智商测试中的得分低于一般公众——平均低约10-12分。但原因远比\"罪犯更不聪明\"复杂得多。本文审视了证据、混淆因素以及数据的真正含义。",{"id":242,"slug":243,"coverImage":244,"author":9,"viewsCount":137,"createdAt":245,"title":246,"description":247,"lang":14,"readingTime":16},"zjjd6y8yfcydy6y02c9xa2yf","which-country-has-the-highest-average-iq","https:\u002F\u002Fimages.unsplash.com\u002Fphoto-1526129313847-8d262a6b1f0d?w=1280","2026-07-28T18:03:42.307Z","哪个国家平均智商最高（以及为什么数据一团糟）","每隔几个月，就会有新标题宣布新加坡、香港或韩国拥有世界最高智商。但 behind 这些排名隐藏着方法论问题、文化偏见和过时数据的纠缠。本文揭示了研究实际显示的内容——以及不显示的内容。",{"id":249,"slug":250,"coverImage":251,"author":9,"viewsCount":137,"createdAt":252,"title":253,"description":254,"lang":14,"readingTime":183},"nxfpaqozmm0dpaytyy2cjixv","why-your-iq-test-score-changes-over-time","https:\u002F\u002Fimages.unsplash.com\u002Fphoto-1499750310107-5fef28a66643?w=1280","2026-07-28T17:37:12.789Z","为什么你的智商测试分数会随时间变化","你的智商分数不是刻在脑子里的固定数字。研究表明，智商分数在一生中可以显著变化——有时变化20分或更多。本指南解释了驱动这些变化的因素及其对你的意义。",{"page":10,"pageSize":256,"pageCount":31,"total":257},24,49]