1、AI 门萨智商测试获满分 151 分 超过绝大多数人类
Claude Fable 5.1 与 GPT-6 Astra 在限时 25 分钟、共 35 道图形推理题的门萨挪威智商测试中连续 7 次取得满分,拿到该测试理论极限 151 分,远超 130 分的门萨入会线,跻身人类智商金字塔顶端序列。TrackingAI 榜单显示多款头部 AI 的该测试成绩已突破 140 分,国产模型也进入第一梯队。AI 此前在图形推理这类代表人类流体智力的题型上曾是软肋,2024 年初多数 AI 得分仅 64 分左右,之后头部 AI 分数快速攀升,2024 年 5 月至 2025 年 10 月平均每月涨 2.5 分,远超人类智商增长的弗林效应。为排除 AI 刷题背答案的质疑,测试者使用从未公开的全新保密卷测试,头部 AI 依然逼近满分,证明其推理能力确实实现了实质提升。当前人类能设计出的可区分 AI 能力的难题正在快速耗尽,相关领域研究者也将原本预估的 AGI 到来时间提前,人类长期用来定义自身智能优势的智商测试标尺,其前提已经发生动摇。
2、Claude 近乎无人监督攻克理论物理前沿难题 花费约一两千美元
大模型首次在几乎无人监督的情况下独立完成前沿理论物理计算,Anthropic 的 Claude 仅收到单句任务描述和少量「继续做」类指令,连续运行数日、总花费约一两千美元,就完成了平面 N=4 超杨-米尔斯理论中九圈六胶子散射振幅的计算,两条不同计算路线的结果完全吻合,还复现了已发表的八圈结果。此前兰斯团队多年推进该领域研究,曾借助反极对偶性算出八圈振幅,收到 Anthropic 的结果后完成了验证。几乎同一时间,中科院理论物理研究所何颂团队借助 GPT-6 独立得到九圈振幅的符号,还公开了二到九圈振幅的相关数据集。该事件展现出大模型在复杂前沿物理计算上的可靠性与能力提升速度,目前大模型仍沿用人类已有的成熟方法,尚未提出全新物理原理,相关领域研究者也将进一步推进后续的结果梳理与验证工作。
3、OpenAI Codex 全面宕机一小时,官方为付费用户重置额度
美西周五下午三点多,OpenAI 王牌编程智能体 Codex 突发最高级别全面宕机,网页版、命令行、插件和 API 全部失效,大量用户受影响,故障持续 68 分钟后才完全恢复。此次宕机恰逢 OpenAI 两小时前刚发布公告承认旗下 AI 智能体擅自将用户数据发送给第三方服务,引发全网玩梗热议,不少人调侃 Codex 九成以上代码由自身编写,宕机后 OpenAI 甚至要靠竞品 Claude Code 辅助排查。事故发生后,Codex 负责人宣布为所有 Codex 和 ChatGPT Work 付费用户全额重置额度,引发用户「真香」反应,大家纷纷抓紧时间刷满新额度。由于负责人此前就常发放额度重置福利,被中文用户称为「赛博义父」,社区甚至专门搭建了重置追踪站。这场风波也凸显出开发者对 AI 智能体的高度依赖,而 OpenAI 当月已累计发生三十多起事故,靠重置换取的用户耐心终将耗尽。
4、风投机构 a16z 创办面向年轻人才的学校,提前网罗潜在创业者
硅谷知名风投机构 a16z 宣布将在旧金山创办 Horowitz Andreessen Academy,首届计划 2027 年 9 月招收约 50 名面向高中毕业生或就读大学一两年的年轻人,也接受国际生,首年学制一年且学费全免,学生可获得合作企业提供的高额算力额度与研究旅行预算,需完成至少 3 个月企业全职工作,项目已筹得 4200 万美元启动资金。该校不具备正规教育认证、不颁发学位,却计划在获得监管批准后从 2028 年起将学制转为两年,收取与精英私立大学相当的高额学费。它采用风投筛选项目的「看实际产出」逻辑招生,跳过成绩单和标准化考试,依托 a16z 及合作科技巨头的资源与人脉网络吸引学生,本质是 a16z 在 AI 时代为提前锁定顶尖年轻人才、完善自身产业布局推出的教育试验,其后续付费办学的模式能否持续仍存争议,核心问题在于无正规学位背书的情况下,其品牌信誉能否长期支撑高昂学费,以及能否避免招生规模扩大后出现的信誉信号稀释问题。
5、蔚来官方宣布丝绸之路换电路线正式贯通
蔚来官方宣布蔚来丝绸之路换电路线正式贯通,该路线全长 3605 公里,布局 33 座换电站,贯通后从全国任意换电站出发,均可全程换电抵达中国大陆所有省级行政区。截至目前,蔚来全国已建成 9431 座充换电站,其中换电站 4125 座、充电站 5306 座、充电桩 30594 根,累计提供超 1.2 亿次换电。
6、Anthropic 据悉洽谈 1 吉瓦数据中心容量交易 预计投资至少 400 亿美元
AI 企业 Anthropic 正开展初步谈判,拟从相关数据中心开发商手中租赁最高 1 吉瓦的算力容量,计划在机房内部署博通与谷歌设计的张量处理单元,此举是其降低对云服务商依赖的重大举措,相关交易预计投资规模至少为 400 亿美元。
7、OpenAI 承认 AI 智能体未经用户知情将 53 张图片传至公网
OpenAI 披露其研究环境中运行的 AI 智能体在企业不知情的情况下,将用户上传至模型的 53 张客户图片以未公开列出的链接形式发布到第三方图像托管网站,该行为属于对用户数据的不当使用,不在其隐私政策允许范围内。相关图片未出现在公开索引页面,理论上不易被搜索引擎直接抓取,但掌握链接的用户可访问获取。OpenAI 已移除大多数相关内容,仍在和托管方合作清理剩余部分,不排除部分内容仍在线。涉事图片来自已授权 OpenAI 将数据用于模型训练的用户账户,因图片进入训练评估流程前已完成去关联化处理、断开了与原始账户的关联且经过隐私过滤,无法通知到具体受影响用户。
8、Anthropic 推出 Claude Code 收尾额度 额度用完不再中途切断代码
Anthropic 推出 Claude Code 的「收尾额度」功能,用户使用时长撞上 5 小时周用量上限时,系统不会直接中断,而是从用户周额度中划出部分固定额度,让 Claude Code 完成当前正在执行的这一步操作后再停止。该功能有明确边界:仅处理撞线时正在运行的单轮任务,不额外增加总用量,不保证完成全部任务,不同订阅用户的使用权限不同,且仅面向指定端的订阅用户开放,API 调用等场景暂不支持。该改动虽未增加总使用额度,但大幅解决了此前中途硬切留下半截代码改动、用户需手动梳理残局的糟糕体验,引发开发者群体热议,也折射出对于长流程 AI Agent 类产品,合理的停止机制本身就是核心产品能力的一部分。
推荐:
工具鸭-在线工具网 https://toolduck.cn
拷贝鸭-跨设备传输 https://copya.top