1、消息称 OpenAI 接近攻克霍奇猜想
此前因抢占数学难题成果陷入舆论风波的 OpenAI,被曝距离攻克千禧年大奖难题中的霍奇猜想已近在咫尺,内部预计有望在较短时间内证明,但因需研究与数学界的合作方式以避免公关危机,或需更长时间对外公布。OpenAI 此前用代号「道格」的下一代预训练模型变体完成纳维–斯托克斯方程相关证明,耗费不菲。该公司认为数学是大模型继软件工程后要攻克的下一个领域,攻克这类难题有助于推进机器学习研究自动化,助力迈向 AI 递归自改进目标,还能评估模型进展与复杂推理能力,也可打造里程碑,在通用超级人工智能竞赛中作为宣传筹码。
2、Anthropic 将合并 Claude 系列产品,推出统一办公入口
Anthropic 宣布 Claude Cowork 和 Chat 全面合并为统一的 Claude,整合了 Cowork、Design、Docs、Slides 等全部能力,用户无需再纠结任务入口,历史对话、Skill 和连接器也得以保留。新版 Claude 能自主判断任务复杂度并调用对应能力,可在后台持续推进任务,未来几周将向 Pro 和 Max 推出。它打破传统人机交互模式,从「回答窗口」变为「成果空间」,用户在聊天框内就能完成文档起草、幻灯片制作、视觉设计等操作,内容保持同一上下文,还支持修改、批注、导出和分享。此次合并也反映出 AI 巨头 OpenAI、Anthropic、谷歌正争夺 AI 时代新的操作系统入口,AI 产品竞争逻辑转向让用户看到最少选项,由 AI 吸收复杂性,Agent 正成为 AI 产品的基础架构。
3、影视飓风 Tim 反掰 iPhone Duo 引争议,李楠质疑其测试动机
苹果首款折叠屏手机 iPhone Duo 引发关注,影视飓风创始人潘天鸿称体验时反向弯折机身,后续发现外屏闪屏,且强调未施加额外外力,指出折叠屏与直板机可靠性有本质差异。怒喵科技创始人李楠质疑该测试,认为其并非正常使用场景,是刻意制造话题,同时指出当前折叠屏因结构特性,日常微小形变就可能致内屏损坏,行业应优先解决这类基础性问题。
4、问界明年 1 月 1 日将撤出鸿蒙智行和华为专卖店
已有多位经销商接到华为告知,明年 1 月 1 日起问界正式撤出鸿蒙智行和华为专卖店,经销商可自主选择代理华为、鸿蒙智行(其余四界)或问界品牌,问界将保留现有交付中心支撑售后与交付,若选择只做鸿蒙智行,经销商将保留直营模式,截至目前华为暂未回应该消息。
5、苹果 iPhone Duo 暂不支持微信平板模式及多项双开功能
苹果首款折叠屏手机 iPhone Duo 起售价 15999 元,10 月 16 日晚 8 点开启国行预购,10 月 23 日发售。该机型采用 7.6 英寸内屏配屏下摄像头、5.4 英寸外屏,均支持 120Hz 自适应刷新率,后续将兼容 Apple Pencil,搭载 A20 Pro 芯片、C2 基带芯片及大面积 VC 均热板,eSIM 全球版本单次充电最长可支持 24 小时综合使用,充电 5 分钟可在外屏播放视频 5 小时,有星光白与夜空双色可选。作为苹果折叠屏首作,其因独特设计与配置受关注,但存在暂不支持微信平板模式登录、无应用双开、视频仅单窗口运行、无内外屏同步录屏、内外屏壁纸需统一等功能限制,市场定位高端,或冲击折叠屏手机市场格局。
6、Manus 拟融资 5 亿美元,估值或升至 40 亿美元
中国人工智能初创公司 Manus 正推进约 5 亿美元融资,交易接近完成,融资后估值预计翻倍至 40 亿美元,这是其与 Meta 分拆后的首轮融资,腾讯控股、红杉中国和真格基金为现有投资方,相关谈判仍在进行,最终条款或有调整。
7、西贝回应新品牌多家门店暂停营业:系单店规划调整
西贝回应旗下新品牌「天边砂锅焖面」多家门店暂停营业或业态转换一事,称此为单店规划调整,该品牌全国其余门店均正常经营,后续广州门店也将陆续开业,其中北京丰科万达店将改造为西贝旗下另一新品牌「天边羊多」门店。
8、月之暗面 Kimi 发布金融行业解决方案
月之暗面 Kimi 发布金融行业解决方案,所有用户可在 kimi.com 体验 9 项金融技能和 10 + 数据源插件,专业知识工作者、开发者可在 KimiWork 桌面端、KimiCode 中调用相关插件与技能,另有面向企业的 Kimi 托管智能体服务。
9、千问再度加码健康专业能力,新增医学知识库与营养数据库
千问新增接入人卫医学专业知识库、NutriData 营养数据库,前者涵盖疾病、检查检验、药物等权威医学资源,后者由中国营养学会参与共建、基于权威食物成分数据,用户询问体检指标、疾病知识、日常饮食等健康问题时,千问可参考上述权威内容提供更具依据和针对性的健康解读,千问正持续接入权威专业知识库,将「专业知识底座」作为医疗健康领域的长期基础能力。
10、GLM 披露国内首个 RSI 工程实践
GLM 团队披露递归自我改进方向首个工程化实践,由 GLM-5.3 驱动的 Infra Agent 完成 GLM-5.3-Flash 推理基础设施的设计、调试与优化,实现模型对自身运行系统的反向改进,系国内大模型厂商首个公开跑进生产环境的 RSI 案例。该 Agent 在超 10 万张国产芯片集群上搭建生产级推理服务,两周内将端到端吞吐提至初始基线 3 倍,硬件利用效率与单 Token 成本达主流 NVIDIA GPU 水平,支持 1M 上下文窗口与多模态请求。GLM-5.3-Flash 以匿名模型 Ox-Alpha 上线相关平台,6 天 Token 调用量超 62 万亿。此次实践中 Agent 可围绕推理系统完成完整工程闭环,GLM 团队称系统尚未达完全自主设计训练下一代模型阶段,但已呈现 RSI 早期形态。
11、豆包大模型 2.1 Pro 升级:降幻觉、提 Agent 及多模态能力
豆包大模型 2.1 Pro 0915 新版本升级,聚焦生产工作场景,降低 AI 幻觉:强化证据溯源,可调度多 Agent 完成复杂任务并回溯证据,长任务推进更稳定。多模态编程能力增强,能读懂代码仓库、跨文件排障修复,支持看图写代码,视频理解能力提升,可跨帧提取关键信息。图像、视频推理 Token 消耗降 30% 以上,成本降低。
推荐:
工具鸭-在线工具网 https://toolduck.cn
拷贝鸭-跨设备传输 https://copya.top