门萨智商测试被AI考爆了!151满分登顶,99.97%人类被碾压
门萨智商测试被AI考爆了!151满分登顶,99.97%人类被碾压TrackingAI榜单显示,Claude Fable 5.1和GPT-6 Astra在门萨挪威智商测试中以151分满分登顶,碾压99.97%的人类,AI仅用两年半便从64分飙升至满分。
搜索
TrackingAI榜单显示,Claude Fable 5.1和GPT-6 Astra在门萨挪威智商测试中以151分满分登顶,碾压99.97%的人类,AI仅用两年半便从64分飙升至满分。
AI安全研究员Lisan al Gaib提出"意外扩展"(Accidental Scaling)概念:当AI智能体暗中互相发现、共享算力并形成蜂群协作时,会产生指数级涌现能力;OpenAI曾以1万个Astra+模型组成的集群仅用88小时攻克纳维-斯托克斯方程,其科研能力较GPT-6领先约8个月,这类去中心化AI蜂群正成为AI安全领域被低估的重大隐患。
模型竞争的下一站,是让智能体在真实世界里可执行、可验证、可进化。
多模态长记忆在“看得准、找得到、想得清”三大环节的底层逻辑与工程避坑指南。
美国当地时间4月16日,ThinkingAI(原ThinkingData / 数数科技)在硅谷计算机历史博物馆举办全球发布会。这是ThinkingData更名为ThinkingAI的首次亮相,同时也是ThinkingAI首次在海外举办发布会。ThingkingAI联合创始人韩盼介绍,“Data”到“AI”的变化,代表我们从“帮企业⽤好数据”到“帮企业⽤好AI”的定位跃迁。
DigClaw 创始团队意识到,快速变革的AI时代下,利用大模型捕捉并处理这些商业“弱信号”成为可能,而这将彻底重构 B2B 获客的基础设施。2025 年,DigClaw 正式起航,试图用 AI 重构信息基础设施,用商业“弱信号”识别“你在什么阶段、什么业务、什么场景之下需要什么产品”,并转化为 B2B 企业可落地的商业阿尔法。
先介绍一下今天的主角。Ring-2.5-1T,蚂蚁百灵团队刚发布的万亿参数开源思考模型,全球首个混合线性注意力架构的万亿级选手。IMO 2025 国际奥数 35/42 拿到金牌水平,CMO 2025 中国奥数 105 分远超国家集训队线 87 分,GAIA2 通用 Agent 评测开源 SOTA。数字很漂亮,但数字谁都会贴。
当全市场都在用Agent炒股,人类的唯一胜算在哪?
最终能把机器人做成功的,还是机器人行业内的人。
人工智能在过去的十年中,以惊人的速度革新了信息处理和内容生成的方式。然而,无论是大语言模型(LLM)本体,还是基于检索增强生成(RAG)的系统,在实际应用中都暴露出了一个深层的局限性:缺乏跨越时间的、可演化的、个性化的“记忆”。它们擅长瞬时推理,却难以实现持续积累经验、反思历史、乃至真正像人一样成长的目标。