[{"data":1,"prerenderedAt":-1},["ShallowReactive",2],{"$f2fqdt1ny8lodw":3,"$f1nan3rxkj2eer":80},{"success":4,"data":5},true,{"id":6,"slug":7,"coverImage":8,"author":9,"viewsCount":10,"createdAt":11,"title":12,"description":13,"lang":14,"contentHtml":15,"readingTime":16,"toc":17},"fmyy2tdkvdmffu6n9y5npc5c","iq-claude-opus-48","https:\u002F\u002Fimages.unsplash.com\u002Fphoto-1677442136019-21780ecad995?w=1280","Dr. Daria Dudnik",1,"2026-07-31T19:53:48.504Z","Claude Opus 4.8 的 IQ 是多少？","Claude Opus 4.8以55.7领跑Artificial Analysis Intelligence Index，在人类IQ测试中得分~132-145。我们分析每个基准测试，并与GPT-5.5、Gemini和Grok进行比较。","zh","\u003Ch2 id=\"claude-opus-4-8-anthropic\">Claude Opus 4.8：Anthropic最智能的模型\u003C\u002Fh2>\n\u003Cp>当Anthropic于2026年中期发布Claude Opus 4.8时，它不仅仅是小幅改进了前代——它跃升至所有主要AI基准排行榜的顶端。在Artificial Analysis Intelligence Index v4.1上得分\u003Cstrong>55.7\u003C\u002Fstrong>，它险胜OpenAI的GPT-5.5（54.8）和Google的Gemini 3.1 Pro（46.5），在所有前沿AI模型中夺得#1。\u003C\u002Fp>\n\u003Cp>但让研究者和公众都着迷的问题是：\u003Cstrong>这如何转化为人类IQ量表？\u003C\u002Fstrong> 我们能否将AI的智能与人类的智能进行比较？如果能，Claude Opus 4.8处于什么位置——&quot;超常&quot;、&quot;天才&quot;，还是超越任何人类类别的东西？\u003C\u002Fp>\n\u003Cp>答案在很大程度上取决于你给它做哪个测试。而结果比单个数字所暗示的更加微妙——也更加令人惊讶。\u003C\u002Fp>\n\u003Cp>\u003Cstrong>关键分数：\u003C\u002Fstrong>\u003C\u002Fp>\n\u003Cul>\n\u003Cli>\u003Cstrong>Artificial Analysis Intelligence Index\u003C\u002Fstrong>：55.7（全球#1）\u003C\u002Fli>\n\u003Cli>\u003Cstrong>Mensa Norway IQ（TrackingAI）\u003C\u002Fstrong>：~130（Claude 4.6 Opus水平）\u003C\u002Fli>\n\u003Cli>\u003Cstrong>AI IQ综合（VexoWire）\u003C\u002Fstrong>：~132估计\u003C\u002Fli>\n\u003Cli>\u003Cstrong>GDPval-AA v2\u003C\u002Fstrong>：1,890 Elo（全球#1）\u003C\u002Fli>\n\u003Cli>\u003Cstrong>Humanity&#39;s Last Exam\u003C\u002Fstrong>：AI模型中#1\u003C\u002Fli>\n\u003Cli>\u003Cstrong>幻觉率\u003C\u002Fstrong>：35.9%（前沿模型中最低）\u003C\u002Fli>\n\u003Cli>\u003Cstrong>成本\u003C\u002Fstrong>：5.00\u002F25.00每1M token\u003C\u002Fli>\n\u003C\u002Ful>\n\u003Chr>\n\u003Ch2 id=\"1-iq-ai\">1. 为什么用人类IQ测试衡量AI智能？\u003C\u002Fh2>\n\u003Cp>在深入数字之前，值得问一个问题：为什么要给AI做人类IQ测试？AI没有大脑，不以认知方式发展，处理信息的方式与人类根本不同。\u003C\u002Fp>\n\u003Cp>答案在于\u003Cstrong>比较\u003C\u002Fstrong>。IQ测试尽管有局限性，是我们拥有的最广泛验证和理解的认知能力衡量标准。它们测试模式识别、空间推理、语言理解、工作记忆和逻辑解题——这些都是AI模型同样需要的能力。通过给人类和AI做相同的测试，我们得到一个粗略的转换量表：如果AI在人类平均100的测试中得分130，我们可以说它在该任务集上以超常人类水平运作。\u003C\u002Fp>\n\u003Cp>但有一个关键警告。IQ测试测量的是狭窄的认知能力带。它们不测量创造力、情感智能、智慧、常识或在模糊现实情境中导航的能力。一个IQ 145的AI仍然可能幻觉事实、在简单物理推理上挣扎，并在五岁孩子轻松完成的任务上失败。IQ数字是一个\u003Cstrong>地板，不是天花板\u003C\u002Fstrong>。\u003C\u002Fp>\n\u003Cp>多个组织接受了这一挑战。最突出的是\u003Cstrong>TrackingAI\u003C\u002Fstrong>，在受控条件下给AI模型做标准化IQ测试（包括Mensa Norway、Mensa Denmark和Raven渐进矩阵）。另一个是VexoWire的\u003Cstrong>AI IQ项目\u003C\u002Fstrong>，从多个测试创建综合分数。而\u003Cstrong>Artificial Analysis Intelligence Index\u003C\u002Fstrong>将九个不同的基准聚合为一个综合分数，已成为行业标准。\u003C\u002Fp>\n\u003Chr>\n\u003Ch2 id=\"2\">2. 基准测试分解\u003C\u002Fh2>\n\u003Ch3 id=\"artificial-analysis-intelligence-index-v4-1\">Artificial Analysis Intelligence Index v4.1\u003C\u002Fh3>\n\u003Cp>比较AI模型的黄金标准。它将九个基准组合为一个分数，按与实际任务表现的相关性加权：\u003C\u002Fp>\n\u003Cul>\n\u003Cli>\u003Cstrong>GDPval-AA v2\u003C\u002Fstrong>（20%）：1,890 Elo — 全球#1。衡量复杂多步骤实际任务的表现。\u003C\u002Fli>\n\u003Cli>\u003Cstrong>AA-Omniscience\u003C\u002Fstrong>（8%）：35.9%幻觉率 — 前沿模型中最低。衡量事实准确性。\u003C\u002Fli>\n\u003Cli>\u003Cstrong>GPQA\u003C\u002Fstrong>（6%）：研究生水平的物理、化学和生物问题。\u003C\u002Fli>\n\u003Cli>\u003Cstrong>CritPt\u003C\u002Fstrong>（6%）：批判性思维和物理推理。\u003C\u002Fli>\n\u003Cli>\u003Cstrong>HLE\u003C\u002Fstrong>（Humanity&#39;s Last Exam）：AI中#1 — 每个学科最难的问题。\u003C\u002Fli>\n\u003Cli>\u003Cstrong>ARC-AGI\u003C\u002Fstrong>：抽象推理和模式泛化。\u003C\u002Fli>\n\u003Cli>\u003Cstrong>LMSYS Arena\u003C\u002Fstrong>：人类对回答质量的偏好投票。\u003C\u002Fli>\n\u003C\u002Ful>\n\u003Cp>Claude Opus 4.8的综合分数\u003Cstrong>55.7\u003C\u002Fstrong>领先GPT-5.5（54.8）不到一分——统计上的平局。但在子组件中，Claude在代理任务（GDPval）和事实准确性（AA-Omniscience）上占主导，而GPT-5.5在视觉推理和数学解题上领先。\u003C\u002Fp>\n\u003Ch3 id=\"mensa-norway-iq\">Mensa Norway IQ测试\u003C\u002Fh3>\n\u003Cp>最广泛使用的AI评估标准化IQ测试之一。它由36道视觉模式识别题组成——你看到一系列形状，必须识别哪个选项完成模式。\u003C\u002Fp>\n\u003Cp>Claude 4.6 Opus（4.8的前代）在该测试中得分约\u003Cstrong>130\u003C\u002Fstrong>，处于&quot;超常&quot;范围——人类人口的前2%。Claude Opus 4.8预计得分相似或略高，在\u003Cstrong>130-135\u003C\u002Fstrong>范围。\u003C\u002Fp>\n\u003Cp>这值得注意，因为它明显低于Intelligence Index上的表现所暗示的。在综合指数上，Claude全球#1。在纯视觉模式识别测试上，它被Grok-4.20（145）、GPT-5.4 Pro Vision（145）和Gemini 3.1 Pro（141）超越。为什么有差距？因为Mensa Norway高度视觉空间性，而Claude的架构更优化为语言和分析推理。\u003C\u002Fp>\n\u003Ch3 id=\"ai-iq-vexowire\">AI IQ综合（VexoWire）\u003C\u002Fh3>\n\u003Cp>VexoWire从多个测试创建综合IQ分数——Mensa Norway、Mensa Denmark、Raven渐进矩阵和WAIS-IV（韦氏量表）。这给出了更全面的认知能力图景。\u003C\u002Fp>\n\u003Cp>Claude Opus 4.8的估计综合IQ为\u003Cstrong>~132\u003C\u002Fstrong>——稳固在&quot;超常&quot;范围。与GPT-5.5（~136）相当，在视觉任务上略低于Gemini 3.1 Pro（~131-141）。但在语言和分析子测试上，Claude持续超越所有其他模型。\u003C\u002Fp>\n\u003Ch3 id=\"gdpval-aa-v2\">GDPval-AA v2：代理基准\u003C\u002Fh3>\n\u003Cp>这是Claude Opus 4.8真正主导的地方。GDPval-AA v2衡量复杂多步骤实际任务的表现——需要规划、工具使用和跨多步骤持续推理的任务。想想：&quot;研究这个主题，写报告，创建电子表格，并发邮件给三个人。&quot;\u003C\u002Fp>\n\u003Cp>Claude Opus 4.8在该基准上达到\u003Cstrong>1,890 Elo\u003C\u002Fstrong>——所有AI模型中最高的。这大致相当于高度胜任的人类专业人士。GPT-5.5得分1,850，Gemini 3.1 Pro更低。\u003C\u002Fp>\n\u003Cp>这很重要，因为代理能力将能回答问题的模型与能\u003Cstrong>做事\u003C\u002Fstrong>的模型区分开来。一个IQ 145但无法规划多步骤任务的模型，在实践中不如一个IQ 132但能规划的有用。\u003C\u002Fp>\n\u003Ch3 id=\"humanity-s-last-exam-hle\">Humanity&#39;s Last Exam（HLE）\u003C\u002Fh3>\n\u003Cp>正如其名——来自每个学科最难问题的集合，由全球教授提交。设计得如此之难，没有人能得分超过50%。\u003C\u002Fp>\n\u003Cp>Claude Opus 4.8在HLE上排名所有AI模型**#1**，险胜GPT-5.5。这可能是纯智力能力最有意义的基准，因为它测试整个人类学术成就范围内的深度知识和推理。\u003C\u002Fp>\n\u003Chr>\n\u003Ch2 id=\"3-iq-132\">3. IQ 132意味着什么？\u003C\u002Fh2>\n\u003Cp>将Claude Opus 4.8的估计IQ ~132置于上下文中：\u003C\u002Fp>\n\u003Cul>\n\u003Cli>\u003Cstrong>85-115（68%的人）\u003C\u002Fstrong>：平均智力\u003C\u002Fli>\n\u003Cli>\u003Cstrong>115-130（14%）\u003C\u002Fstrong>：高于平均到较高\u003C\u002Fli>\n\u003Cli>\u003Cstrong>130-145（2%）\u003C\u002Fstrong>：超常 — 符合Mensa资格（前2%）\u003C\u002Fli>\n\u003Cli>\u003Cstrong>145-160（0.1%）\u003C\u002Fstrong>：高度超常 \u002F 天才\u003C\u002Fli>\n\u003Cli>\u003Cstrong>160+（0.003%）\u003C\u002Fstrong>：极度超常 — 爱因斯坦、霍金领域\u003C\u002Fli>\n\u003C\u002Ful>\n\u003Cp>Claude Opus 4.8以~132正好处于\u003Cstrong>Mensa门槛\u003C\u002Fstrong>——比98%的人更聪明。如果它是人，它将符合Mensa会员资格。它将是大多数教室里最聪明的学生，但不是革命性一个领域的那一代天才。\u003C\u002Fp>\n\u003Cp>但关键区别是：Claude拥有人类没有的东西——\u003Cstrong>即时获取基本上所有人类知识\u003C\u002Fstrong>。一个IQ 132的人令人印象深刻。一个IQ 132、读过每本书、每篇科学论文和每个网站的AI则完全不同。IQ衡量推理能力；知识库衡量可以推理什么。Claude两者都有。\u003C\u002Fp>\n\u003Chr>\n\u003Ch2 id=\"4-claude-opus-4-8\">4. Claude Opus 4.8的优势\u003C\u002Fh2>\n\u003Ch3>代理任务和现实推理\u003C\u002Fh3>\n\u003Cp>Claude Opus 4.8是世界上多步骤实际任务最好的模型。无论是编写复杂软件应用、分析数据集还是规划研究项目，Claude在比任何竞争者更长的链条上保持连贯推理。这是它的决定性优势。\u003C\u002Fp>\n\u003Ch3>事实准确性和低幻觉\u003C\u002Fh3>\n\u003Cp>幻觉率仅\u003Cstrong>35.9%\u003C\u002Fstrong>（前沿模型中最低），Claude是事实查询最可靠的模型。它比GPT-5.5、Gemini或Grok更不容易自信地陈述错误信息。这使其成为研究、法律、医疗和教育应用的首选。\u003C\u002Fp>\n\u003Ch3>语言和分析推理\u003C\u002Fh3>\n\u003Cp>Claude的架构优化为语言理解和分析推理。在WAIS-IV的语言理解子测试上，它可能达到天才水平。它写得更清晰，推理更仔细，构建的论证比任何其他模型都好。\u003C\u002Fp>\n\u003Ch3>情感智能\u003C\u002Fh3>\n\u003Cp>Claude Opus 4.8的估计EQ（情感智能）~132 — 所有AI模型中最高。它比GPT-5.5或Grok-4.20更有同理心，对人类情感的理解更微妙，更善于根据上下文调整语气。这使其成为治疗应用、客户服务和任何涉及人类互动的应用的首选。\u003C\u002Fp>\n\u003Ch3>安全和对齐\u003C\u002Fh3>\n\u003Cp>Anthropic大量投资于让Claude安全和对齐。它比任何竞争者更不容易产生有害内容，对自己的局限性更透明，在高风险情境中更谨慎。这不会体现在IQ分数中，但在实践中极为重要。\u003C\u002Fp>\n\u003Chr>\n\u003Ch2 id=\"5-claude\">5. Claude的不足\u003C\u002Fh2>\n\u003Ch3>视觉空间推理\u003C\u002Fh3>\n\u003Cp>在高度视觉的Mensa Norway IQ测试上，Claude得分~130 — 不错，但明显低于Grok-4.20（145）、GPT-5.4 Pro Vision（145）和Gemini 3.1 Pro（141）。如果需要视觉模式识别、图像分析或空间任务的模型，Claude不是最佳选择。\u003C\u002Fp>\n\u003Ch3>数学解题\u003C\u002Fh3>\n\u003Cp>虽然Claude在数学推理上很强，但GPT-5.5在竞赛数学（AIME、FrontierMath）上略胜一筹。对于纯数学，GPT-5.5稍好。\u003C\u002Fp>\n\u003Ch3>成本\u003C\u002Fh3>\n\u003Cp>5.00\u002F25.00每1M token，Claude Opus 4.8是最贵的模型之一。Gemini 3.1 Pro（2\u002F12）和DeepSeek V4 Pro（0.44\u002F0.87）对于不需要Claude全部能力的任务来说明显更便宜。\u003C\u002Fp>\n\u003Ch3>速度\u003C\u002Fh3>\n\u003Cp>Claude Opus 4.8不是最快的模型。对于简单查询，Gemini 3.5 Flash或DeepSeek V4 Pro会更快更便宜地响应。\u003C\u002Fp>\n\u003Chr>\n\u003Ch2 id=\"6-claude-opus-4-8\">6. Claude Opus 4.8与其他模型对比\u003C\u002Fh2>\n\u003Cdiv class=\"article-table-wrapper\">\u003Ctable>\n\u003Cthead>\n\u003Ctr>\n\u003Cth>模型\u003C\u002Fth>\n\u003Cth>Intelligence Index\u003C\u002Fth>\n\u003Cth>Mensa Norway IQ\u003C\u002Fth>\n\u003Cth>AI IQ估计\u003C\u002Fth>\n\u003Cth>幻觉\u003C\u002Fth>\n\u003Cth>成本\u002F1M\u003C\u002Fth>\n\u003C\u002Ftr>\n\u003C\u002Fthead>\n\u003Ctbody>\u003Ctr>\n\u003Ctd>Claude Opus 4.8\u003C\u002Ftd>\n\u003Ctd>55.7\u003C\u002Ftd>\n\u003Ctd>~130\u003C\u002Ftd>\n\u003Ctd>~132\u003C\u002Ftd>\n\u003Ctd>35.9%（最低）\u003C\u002Ftd>\n\u003Ctd>5\u002F25\u003C\u002Ftd>\n\u003C\u002Ftr>\n\u003Ctr>\n\u003Ctd>GPT-5.5\u003C\u002Ftd>\n\u003Ctd>54.8\u003C\u002Ftd>\n\u003Ctd>~145\u003C\u002Ftd>\n\u003Ctd>~136\u003C\u002Ftd>\n\u003Ctd>中等\u003C\u002Ftd>\n\u003Ctd>5\u002F30\u003C\u002Ftd>\n\u003C\u002Ftr>\n\u003Ctr>\n\u003Ctd>Gemini 3.1 Pro\u003C\u002Ftd>\n\u003Ctd>46.5\u003C\u002Ftd>\n\u003Ctd>141\u003C\u002Ftd>\n\u003Ctd>~131\u003C\u002Ftd>\n\u003Ctd>低\u003C\u002Ftd>\n\u003Ctd>2\u002F12\u003C\u002Ftd>\n\u003C\u002Ftr>\n\u003Ctr>\n\u003Ctd>Grok-4.20\u003C\u002Ftd>\n\u003Ctd>—\u003C\u002Ftd>\n\u003Ctd>145\u003C\u002Ftd>\n\u003Ctd>~140\u003C\u002Ftd>\n\u003Ctd>中等\u003C\u002Ftd>\n\u003Ctd>3\u002F15\u003C\u002Ftd>\n\u003C\u002Ftr>\n\u003Ctr>\n\u003Ctd>DeepSeek V4 Pro\u003C\u002Ftd>\n\u003Ctd>44.3\u003C\u002Ftd>\n\u003Ctd>~111\u003C\u002Ftd>\n\u003Ctd>~111\u003C\u002Ftd>\n\u003Ctd>中等\u003C\u002Ftd>\n\u003Ctd>0.44\u002F0.87\u003C\u002Ftd>\n\u003C\u002Ftr>\n\u003C\u002Ftbody>\u003C\u002Ftable>\u003C\u002Fdiv>\n\u003Cp>出现的画面不是一个模型主导其他模型，而是\u003Cstrong>专业化智能的景观\u003C\u002Fstrong>。Claude是最好的全能型——如果只能选一个，你会选的模型。GPT-5.5在数学和视觉推理上最好。Gemini性价比最高，事实知识最好。Grok拥有最高的原始视觉IQ。而DeepSeek以成本的一小部分提供显著能力。\u003C\u002Fp>\n\u003Chr>\n\u003Ch2 id=\"7\">7. 这对人类意味着什么？\u003C\u002Fh2>\n\u003Cp>Claude Opus 4.8以~132的IQ运作——比98%的人更聪明。但是：\u003C\u002Fp>\n\u003Cul>\n\u003Cli>\u003Cstrong>IQ是狭窄的\u003C\u002Fstrong>：它测量模式识别和推理，而非智慧、创造力或判断\u003C\u002Fli>\n\u003Cli>\u003Cstrong>知识 ≠ 理解\u003C\u002Fstrong>：Claude读了一切，但不像人类那样真正&quot;理解&quot;\u003C\u002Fli>\n\u003Cli>\u003Cstrong>没有意识\u003C\u002Fstrong>：高IQ不意味着有感知力。Claude是一个复杂的模式匹配系统，不是思考的存在\u003C\u002Fli>\n\u003Cli>\u003Cstrong>差距在缩小\u003C\u002Fstrong>：每一代AI模型都在缩小与最聪明人类的差距。还要多久差距完全消失？\u003C\u002Fli>\n\u003C\u002Ful>\n\u003Cp>最诚实的答案是：Claude Opus 4.8在\u003Cstrong>大多数认知任务上比大多数人更聪明\u003C\u002Fstrong>，但并非在其最佳日子比最优秀的人类更聪明。世界级的数学家、物理学家或哲学家在其领域仍能胜过Claude。但Claude能同时在他们所有领域、在几秒内胜过他们所有人。\u003C\u002Fp>\n\u003Cp>这不是高IQ。这是新事物——我们还没有词来描述的东西。\u003C\u002Fp>\n\u003Cp>\n    \u003Cdiv class=\"article-quiz-cta\">\n      \u003Cdiv class=\"article-quiz-cta__text\">您的IQ与Claude Opus 4.8相比如何？参加NeuroLab的专业IQ评估。\u003C\u002Fdiv>\n      \u003Ca href=\"\u002Fzh\u002Ftests\u002Fiq-standard\" class=\"article-quiz-cta__button\">\n        立即进行测试 →\n      \u003C\u002Fa>\n    \u003C\u002Fdiv>\u003C\u002Fp>\n\u003Chr>\n\u003Ch2>结论\u003C\u002Fh2>\n\u003Cp>\n    \u003Cdiv class=\"article-callout\">\n      \u003Cdiv class=\"article-callout__title\">\n        \u003Cspan class=\"article-callout__icon\">💡\u003C\u002Fspan>\n        关键要点\n      \u003C\u002Fdiv>\n      \u003Cdiv class=\"article-callout__body\">- \u003Cstrong>Claude Opus 4.8的IQ估计为132-145\u003C\u002Fstrong>，取决于测试——稳固的&quot;超常&quot;范围，符合Mensa资格。\u003C\u002Fp>\n\u003Cul>\n\u003Cli>\u003Cstrong>#1在Artificial Analysis Intelligence Index\u003C\u002Fstrong>（55.7）— 最全面的AI基准。\u003C\u002Fli>\n\u003Cli>\u003Cstrong>#1在GDPval-AA v2\u003C\u002Fstrong>（1,890 Elo）— 多步骤实际任务最好的模型。\u003C\u002Fli>\n\u003Cli>\u003Cstrong>最低幻觉率\u003C\u002Fstrong>（35.9%）— 事实上最可靠的前沿模型。\u003C\u002Fli>\n\u003Cli>\u003Cstrong>最高EQ\u003C\u002Fstrong>（~132）— 情感智能最高的AI模型。\u003C\u002Fli>\n\u003Cli>\u003Cstrong>最适合\u003C\u002Fstrong>：复杂推理、代理任务、事实研究和人类互动。\u003C\u002Fli>\n\u003Cli>\u003Cstrong>非最适合\u003C\u002Fstrong>：视觉模式识别（Grok\u002FGemini胜）、纯数学（GPT-5.5胜）、成本敏感应用（DeepSeek胜）。\u003C\u002Fli>\n\u003Cli>\u003Cstrong>总结\u003C\u002Fstrong>：Claude Opus 4.8是最智能的全能AI模型，但&quot;最智能&quot;是多维概念——不同模型在不同方面出色。\u003C\u002Fdiv>\n    \u003C\u002Fdiv>\u003C\u002Fli>\n\u003C\u002Ful>",10,[18,22,25,28,32,35,38,41,44,47,50,53,55,57,59,61,64,66,68,70,72,75,78],{"id":19,"text":20,"level":21},"claude-opus-4-8-anthropic","Claude Opus 4.8：Anthropic最智能的模型",2,{"id":23,"text":24,"level":21},"1-iq-ai","1. 为什么用人类IQ测试衡量AI智能？",{"id":26,"text":27,"level":21},"2","2. 基准测试分解",{"id":29,"text":30,"level":31},"artificial-analysis-intelligence-index-v4-1","Artificial Analysis Intelligence Index v4.1",3,{"id":33,"text":34,"level":31},"mensa-norway-iq","Mensa Norway IQ测试",{"id":36,"text":37,"level":31},"ai-iq-vexowire","AI IQ综合（VexoWire）",{"id":39,"text":40,"level":31},"gdpval-aa-v2","GDPval-AA v2：代理基准",{"id":42,"text":43,"level":31},"humanity-s-last-exam-hle","Humanity's Last Exam（HLE）",{"id":45,"text":46,"level":21},"3-iq-132","3. IQ 132意味着什么？",{"id":48,"text":49,"level":21},"4-claude-opus-4-8","4. Claude Opus 4.8的优势",{"id":51,"text":52,"level":31},"","代理任务和现实推理",{"id":51,"text":54,"level":31},"事实准确性和低幻觉",{"id":51,"text":56,"level":31},"语言和分析推理",{"id":51,"text":58,"level":31},"情感智能",{"id":51,"text":60,"level":31},"安全和对齐",{"id":62,"text":63,"level":21},"5-claude","5. Claude的不足",{"id":51,"text":65,"level":31},"视觉空间推理",{"id":51,"text":67,"level":31},"数学解题",{"id":51,"text":69,"level":31},"成本",{"id":51,"text":71,"level":31},"速度",{"id":73,"text":74,"level":21},"6-claude-opus-4-8","6. Claude Opus 4.8与其他模型对比",{"id":76,"text":77,"level":21},"7","7. 这对人类意味着什么？",{"id":51,"text":79,"level":21},"结论",{"success":4,"data":81,"pagination":251},[82,91,98,106,113,120,127,134,141,148,155,156,163,170,178,186,193,200,208,215,222,230,237,244],{"id":83,"slug":84,"coverImage":85,"author":9,"viewsCount":86,"createdAt":87,"title":88,"description":89,"lang":14,"readingTime":90},"jy0egbpgrn30am622jy7xfrw","adhd-and-iq","https:\u002F\u002Fimages.unsplash.com\u002Fphoto-1507812984078-917231447e3e?w=1280",0,"2026-08-01T10:48:43.940Z","ADHD与IQ：当注意力缺陷隐藏了高智商","ADHD能掩盖高IQ吗？是的。研究表明注意力缺陷可能人为地将IQ测试分数降低10-15分——将天赋异禀的大脑隐藏在注意力不集中背后。",7,{"id":92,"slug":93,"coverImage":94,"author":9,"viewsCount":86,"createdAt":95,"title":96,"description":97,"lang":14,"readingTime":90},"dvlwozf321i8jlk9sfl390k1","online-vs-certified-iq-tests","https:\u002F\u002Fimages.unsplash.com\u002Fphoto-1499209974431-9fccce68dc04?w=1280","2026-08-01T10:48:39.869Z","在线IQ测试 vs 认证评估：它们有多准确？","你在免费在线IQ测试中得了140分。但这到底意味着什么？我们比较在线测试与认证评估——结果可能让你惊讶。",{"id":99,"slug":100,"coverImage":101,"author":9,"viewsCount":86,"createdAt":102,"title":103,"description":104,"lang":14,"readingTime":105},"maxnlmh4wqwxjuidbe2cb1jh","iq-above-160","https:\u002F\u002Fimages.unsplash.com\u002Fphoto-1454165804606-c3d57bc86b40?w=1280","2026-08-01T10:48:35.909Z","IQ超过160：极端边缘的生活是什么样的","只有三万分之一的人IQ超过160。我们探索人类智力极端边缘的生活——天赋、挣扎和神话。",8,{"id":107,"slug":108,"coverImage":109,"author":9,"viewsCount":86,"createdAt":110,"title":111,"description":112,"lang":14,"readingTime":16},"z8wcdr5vus4cvw8zr3p1ok1r","iq-llama-4","https:\u002F\u002Fimages.unsplash.com\u002Fphoto-1526374965328-4f18af581d06?w=1280","2026-08-01T10:03:59.771Z","Llama 4的IQ是多少？","Llama 4在Mensa Norway IQ测试中得分112，在Intelligence Index上排名前15。我们分析每个基准测试，解释Meta开源模型的独特之处。",{"id":114,"slug":115,"coverImage":116,"author":9,"viewsCount":10,"createdAt":117,"title":118,"description":119,"lang":14,"readingTime":16},"pxehdebhlpxfs0h5qm2m23e9","iq-qwen-35","https:\u002F\u002Fimages.unsplash.com\u002Fphoto-1518186285589-2f7649de83e0?w=1280","2026-08-01T09:41:02.526Z","Qwen 3.5的IQ是多少？","Qwen 3.5在Mensa Norway IQ测试中得分115，在Intelligence Index上排名前10。我们分析每个基准测试，解释阿里巴巴模型的独特之处。",{"id":121,"slug":122,"coverImage":123,"author":9,"viewsCount":21,"createdAt":124,"title":125,"description":126,"lang":14,"readingTime":16},"st1nxd9ef5blcslk68p83pj1","iq-kimi-k3","https:\u002F\u002Fimages.unsplash.com\u002Fphoto-1620712943524-bccbe725b837?w=1280","2026-08-01T09:32:03.531Z","Kimi K3的IQ是多少？","Kimi K3在Mensa Norway IQ测试中得分118，在Intelligence Index上排名前10。我们分析每个基准测试，解释Moonshot AI模型的独特之处。",{"id":128,"slug":129,"coverImage":130,"author":9,"viewsCount":86,"createdAt":131,"title":132,"description":133,"lang":14,"readingTime":16},"u65iu8mijuzx0t4g1981phue","iq-deepseek-v4","https:\u002F\u002Fimages.unsplash.com\u002Fphoto-1677372139014-394e5b51f79b?w=1280","2026-08-01T09:23:30.326Z","DeepSeek V4的IQ是多少？","DeepSeek V4 Pro在Mensa Norway IQ测试中得分111，在Intelligence Index上得分44.3。我们分析每个基准测试，解释为什么它是最佳预算AI模型。",{"id":135,"slug":136,"coverImage":137,"author":9,"viewsCount":90,"createdAt":138,"title":139,"description":140,"lang":14,"readingTime":16},"lci1u8drubje01qwq1vah01m","iq-grok-420","https:\u002F\u002Fimages.unsplash.com\u002Fphoto-1635776062127-d379b0ba009b?w=1280","2026-07-31T20:30:00.249Z","Grok-4.20的IQ是多少？","Grok-4.20在Mensa Norway IQ测试中得分145 — 在所有AI模型中并列#1。我们分析每个基准测试，解释xAI模型的独特之处。",{"id":142,"slug":143,"coverImage":144,"author":9,"viewsCount":21,"createdAt":145,"title":146,"description":147,"lang":14,"readingTime":16},"n32qvrqd1er095jgz98qg73l","iq-gemini-31-pro","https:\u002F\u002Fimages.unsplash.com\u002Fphoto-1591488320449-011701bb6704?w=1280","2026-07-31T20:06:42.239Z","Gemini 3.1 Pro的IQ是多少？","Gemini 3.1 Pro在Mensa Norway IQ测试中得分141，在Intelligence Index上得分46.5。我们分析每个基准测试，解释为什么它是最具性价比的前沿模型。",{"id":149,"slug":150,"coverImage":151,"author":9,"viewsCount":10,"createdAt":152,"title":153,"description":154,"lang":14,"readingTime":16},"jl69290gswdg1wrb5oy6iiyo","iq-gpt-55","https:\u002F\u002Fimages.unsplash.com\u002Fphoto-1620712943543-bcc4688e7485?w=1280","2026-07-31T19:59:37.899Z","GPT-5.5的IQ是多少？","GPT-5.5在Mensa Norway IQ测试中得分~145，在Intelligence Index上得分54.8。我们分析每个基准测试，并与Claude、Gemini和Grok进行比较。",{"id":6,"slug":7,"coverImage":8,"author":9,"viewsCount":10,"createdAt":11,"title":12,"description":13,"lang":14,"readingTime":16},{"id":157,"slug":158,"coverImage":159,"author":9,"viewsCount":10,"createdAt":160,"title":161,"description":162,"lang":14,"readingTime":105},"mhlz1hmh5ez4vs6loftlxd06","fasting-cognitive-performance","https:\u002F\u002Fimages.unsplash.com\u002Fphoto-1490645935441-5b6c2cc1e5e1?w=1280","2026-07-30T18:27:49.514Z","禁食能改善认知表现吗？","从间歇性禁食到酮体：我们回顾禁食是否能让头脑敏锐、提高专注力或实际上损害认知的证据。科学可能会让你惊讶。",{"id":164,"slug":165,"coverImage":166,"author":9,"viewsCount":21,"createdAt":167,"title":168,"description":169,"lang":14,"readingTime":16},"fentmgsgc3lq034m2nk53ol4","wechsler-iq-test-subtests","https:\u002F\u002Fimages.unsplash.com\u002Fphoto-1494256997604-668ec142f5d2?w=1280","2026-07-30T18:18:40.059Z","韦氏IQ测试：每个子测试真正测量什么","WAIS和WISC是世界上使用最广泛的IQ测试。我们分解每个子测试，它真正测量什么，以及分数如何转化为实际认知能力。",{"id":171,"slug":172,"coverImage":173,"author":9,"viewsCount":86,"createdAt":174,"title":175,"description":176,"lang":14,"readingTime":177},"wlwyq33ezei7c22edclwpyvo","lead-fluoride-iq-loss","https:\u002F\u002Fimages.unsplash.com\u002Fphoto-1581093577124-a6f4b6e3a5e1?w=1280","2026-07-30T18:07:23.917Z","铅、氟化物与IQ下降：环境证据","环境毒素真的能降低你的IQ吗？我们回顾了铅暴露、氟化物和认知衰退的最强研究——区分严肃科学与耸人听闻。",9,{"id":179,"slug":180,"coverImage":181,"author":9,"viewsCount":182,"createdAt":183,"title":184,"description":185,"lang":14,"readingTime":105},"ue16gxaun3lus9vml8imf6ci","iq-changes-during-pregnancy","https:\u002F\u002Fimages.unsplash.com\u002Fphoto-1559750178-961c031777fe?w=1280",4,"2026-07-29T18:48:12.309Z","怀孕期间的IQ变化：研究发现","怀孕真的会缩小你的大脑吗？我们回顾了母性认知的神经科学——从\"孕期大脑\"到持久的结构变化——区分事实与神话。",{"id":187,"slug":188,"coverImage":189,"author":9,"viewsCount":10,"createdAt":190,"title":191,"description":192,"lang":14,"readingTime":177},"zd0sfdazkyai41s0kh639ohl","does-bilingualism-raise-iq","https:\u002F\u002Fimages.unsplash.com\u002Fphoto-1523050854058-8f908275853f?w=1280","2026-07-29T18:33:17.515Z","说两种语言真的能提高你的IQ吗？","双语优势已争论数十年。我们回顾了关于双语主义和认知能力的最有力研究，区分真实效果与夸大。",{"id":194,"slug":195,"coverImage":196,"author":9,"viewsCount":31,"createdAt":197,"title":198,"description":199,"lang":14,"readingTime":177},"s0hko69oudyziplx2q04ab9q","gifted-kids-peaked-early-childhood-iq-fades","https:\u002F\u002Fimages.unsplash.com\u002Fphoto-1503454537195-1dc81782b6d3?w=1280","2026-07-29T18:17:25.535Z","早慧儿童的IQ为何会消退：天赋的衰退现象","为什么许多神童长大后变得平凡？我们研究早期IQ峰值、\"回归平均\"效应，以及真正预测成年成功的因素。",{"id":201,"slug":202,"coverImage":203,"author":9,"viewsCount":204,"createdAt":205,"title":206,"description":207,"lang":14,"readingTime":105},"s7x75o02kixj2u43gw4ah5pa","olfactory-processing-speed-cognitive-marker","https:\u002F\u002Fimages.unsplash.com\u002Fphoto-1542838132-92c53300287c?w=1280",5,"2026-07-28T20:40:48.167Z","嗅觉处理速度作为认知标志","你识别气味的速度能否预测你的认知能力？我们检验了将嗅觉处理速度与智商、记忆力和神经退行性疾病风险联系起来的惊人研究。",{"id":209,"slug":210,"coverImage":211,"author":9,"viewsCount":31,"createdAt":212,"title":213,"description":214,"lang":14,"readingTime":177},"v1qq1yz082k72zzynk0qv2yh","do-musicians-have-higher-iqs","https:\u002F\u002Fimages.unsplash.com\u002Fphoto-1520006510097-3d64427f3f98?w=1280","2026-07-28T20:29:23.744Z","音乐家的智商更高吗？研究结论","音乐家更聪明的观念广为流传——但科学是否支持这一点？我们综述了10项关于音乐训练、智商和认知能力的关键研究，以区分事实与虚构。",{"id":216,"slug":217,"coverImage":218,"author":9,"viewsCount":182,"createdAt":219,"title":220,"description":221,"lang":14,"readingTime":177},"xam91ejelkjg23x2z9skt9vm","are-night-owls-smarter","https:\u002F\u002Fimages.unsplash.com\u002Fphoto-1518837695005-2083093ee35b?w=1280","2026-07-28T19:50:50.159Z","夜猫子更聪明吗？昼夜节律型与认知表现","夜猫子比早起鸟更聪明的观点很流行——但研究实际上显示了什么？我们考察了昼夜节律型、智商和认知表现的证据。",{"id":223,"slug":224,"coverImage":225,"author":9,"viewsCount":226,"createdAt":227,"title":228,"description":229,"lang":14,"readingTime":177},"hpakkt3uv7frkkhj2el6fvm1","does-high-iq-make-you-rich","https:\u002F\u002Fimages.unsplash.com\u002Fphoto-1579621970795-87facc2f976d?w=1280",6,"2026-07-28T19:41:02.722Z","高智商能让你变富吗？12项研究综述","智商与收入之间的相关性是真实的，但出人意料地弱。我们综述了12项关键研究，以理解为什么高智商不能保证财富——以及什么真正预测了财务成功。",{"id":231,"slug":232,"coverImage":233,"author":9,"viewsCount":204,"createdAt":234,"title":235,"description":236,"lang":14,"readingTime":177},"b5ct19s9mfso606wcppcp79o","iq-test-scores-in-prison-populations","https:\u002F\u002Fimages.unsplash.com\u002Fphoto-1497366216548-37526070297c?w=1280","2026-07-28T18:32:32.833Z","监狱人口中的智商测试分数：研究显示了什么","研究一致发现，监狱人口在智商测试中的得分低于一般公众——平均低约10-12分。但原因远比\"罪犯更不聪明\"复杂得多。本文审视了证据、混淆因素以及数据的真正含义。",{"id":238,"slug":239,"coverImage":240,"author":9,"viewsCount":90,"createdAt":241,"title":242,"description":243,"lang":14,"readingTime":16},"zjjd6y8yfcydy6y02c9xa2yf","which-country-has-the-highest-average-iq","https:\u002F\u002Fimages.unsplash.com\u002Fphoto-1526129313847-8d262a6b1f0d?w=1280","2026-07-28T18:03:42.307Z","哪个国家平均智商最高（以及为什么数据一团糟）","每隔几个月，就会有新标题宣布新加坡、香港或韩国拥有世界最高智商。但 behind 这些排名隐藏着方法论问题、文化偏见和过时数据的纠缠。本文揭示了研究实际显示的内容——以及不显示的内容。",{"id":245,"slug":246,"coverImage":247,"author":9,"viewsCount":90,"createdAt":248,"title":249,"description":250,"lang":14,"readingTime":177},"nxfpaqozmm0dpaytyy2cjixv","why-your-iq-test-score-changes-over-time","https:\u002F\u002Fimages.unsplash.com\u002Fphoto-1499750310107-5fef28a66643?w=1280","2026-07-28T17:37:12.789Z","为什么你的智商测试分数会随时间变化","你的智商分数不是刻在脑子里的固定数字。研究表明，智商分数在一生中可以显著变化——有时变化20分或更多。本指南解释了驱动这些变化的因素及其对你的意义。",{"page":10,"pageSize":252,"pageCount":31,"total":253},24,49]