每日 AI 资讯 — 2026-09-23

今天最集中的信号来自模型厂商的定价表:Anthropic 与 OpenAI 同期拿出新版本,卖点都是「小幅升级、大幅降价」,而围绕 Opus 5.5 的评测与争论几乎立刻把「成本」推到了话题中心。与此同时,AI 能力的下沉也带来了更硬的一面——从被 AI 助力的诈骗平台,到因 ChatGPT 被用于策划暴力而起的诉讼,工具的影响已经落到了具体的账户、学校和社区上。下面八条消息,正好拼出这条从价格到责任的完整曲线。

每日 AI 资讯 — 20260923

今天最集中的信号来自模型厂商的定价表:Anthropic 与 OpenAI 同期拿出新版本,卖点都是「小幅升级、大幅降价」,而围绕 Opus 5.5 的评测与争论几乎立刻把「成本」推到了话题中心。与此同时,AI 能力的下沉也带来了更硬的一面——从被 AI 助力的诈骗平台,到因 ChatGPT 被用于策划暴力而起的诉讼,工具的影响已经落到了具体的账户、学校和社区上。下面八条消息,正好拼出这条从价格到责任的完整曲线。

1. Anthropic 与 OpenAI 同期发布新模型,同样主打小幅升级、大幅降价

OpenAI 和 Anthropic 近期都发布了以降低成本为目标的新模型,两家给出的承诺出奇一致:多一点点能力,少很多钱。Anthropic 公布了 Opus 5.5,这是其面向大众市场的主力模型的最新版本,主要用于编码等复杂知识工作;OpenAI 则发布了 GPT-6 Sol 与 Luna,属于其主打效率与速度的中端或更小尺寸模型的最新版本。来源:arstechnica.com

2. 微软捣毁 AI 辅助诈骗平台 EvilTokens,其曾攻破 1.2 万个账户

微软表示,其主导了一次行业联合行动,捣毁了一个订阅制诈骗平台——该平台借助 AI 聊天机器人,在几个月内攻破了 1.2 万个微软账户。这个名为 EvilTokens 的平台于今年 2 月通过一个 Telegram 频道推出,初始收费 1500 美元,此后每月续费 500 美元,提供一站式服务,把大规模入侵邮箱账户所需的大部分步骤流程化,帮助客户分析收件箱、筛选潜在收益最大的目标,并起草后续邮件,用逼真的借口诱骗企业员工把资金转入攻击者控制的账户。微软称:「EvilTokens 帮助网络犯罪分子访问邮箱账户,而这项服务的核心是一个 AI 风格的聊天机器人,它能分析受害者的收件箱,帮助犯罪分子识别信任关系、付款授权、敏感职责,以及其他最可能让诈骗得手的情形。该平台甚至能推荐诈骗策略,包括起草冒充可信联系人的消息,帮助犯罪分子诱骗受害者采取行动。」来源:arstechnica.com

3. 不列颠哥伦比亚省起诉 OpenAI,要求其出资重建涉枪击案学校

在加拿大历史上最致命的大规模枪击案之一中遇害者的家属,此前已因 OpenAI 未能在提前发现枪手使用 ChatGPT 策划暴力后警告执法部门而提起诉讼;如今,不列颠哥伦比亚省也加入起诉,并首次说明灾难应对的代价有多高昂、情况有多极端。该省主张,OpenAI 与 Sam Altman 欠这个被悲剧击碎的小型偏远矿业社区的不只是一句道歉:他们必须做出实质性改变,终结 ChatGPT 助长的暴力,并承担 Tumbler Ridge 重建、恢复与疗愈的全部费用。在周一提交的诉状中,不列颠哥伦比亚省说明,2 月,18 岁跨性别枪手 Jesse Van Rootselaar 在 Tumbler Ridge 中学杀害五名儿童和一名教育助理后自杀身亡,学校因此不得不拆除;这起事件共造成八人死亡——在校园枪击之前,Van Rootselaar 还枪杀了自己的母亲和同母异父的弟弟。来源:arstechnica.com

4. 丰田要求工人训练人形机器人,同时强调人类不会被取代

作为最终部署 40 万台工厂机器人的竞赛的一部分,丰田工人已经在协助训练人形机器人,但一位丰田高管表示,这轮机器人化并非要直接取代人类。据日经亚洲报道,从 2028 年起,丰田汽车集团计划每年投入 64.2 亿美元,用新的机器人劳动力升级工厂,公司希望在自己的汽车工厂部署 15 万台机器人,并在生产各类零部件与材料的集团公司设施再部署 25 万台。丰田已经开始在装配线上部署部分 ELEY 人形机器人,让它们向人类工人学习,而工人正通过佩戴基于人形机器人手指制作的「夹具」,教这些靠轮子移动的机器人完成需要精细手部动作的任务。来源:arstechnica.com

5. 戴森最过度设计的电动牙刷可能面临防水问题

把产品做得过于复杂总有风险,简单往往才是最好的——那个「NASA 花数百万美元研发太空笔、苏联宇航员却用铅笔」的传闻常被当作典型案例,尽管它其实并不属实。戴森试图重新发明电动牙刷却陷入麻烦,或许并不令人意外:中国人早在明代就发明了第一把鬃毛牙刷,这个概念一路平稳发展,直到 1937 年 Tomlinson Moseley 为最早的电动牙刷申请专利,400 多年后 Motodent 标志着从手动刷牙到电动口腔护理的演化转折。戴森曾成功重新定义立式吸尘器、高端吹风机等成熟品类——空气净化耳机则不算成功——本月早些时候,它大张旗鼓地发布了牙齿护理的下一步:售价 499 美元的 Dyson CameraJet,内置微型摄像头,把冲洗液流精准导向牙缝。来源:arstechnica.com

6. Anthropic 发布 Claude Opus 5.5,全面降价并改进沟通风格

Anthropic 发布前沿模型 Claude Opus 5.5,对所有 token 类别的定价做出显著下调:每百万 token 的缓存读取由 0.50 美元降至 0.20 美元,输入 token 由 5 美元降至 4 美元,输出 token 由 25 美元降至 20 美元,缓存写入由 6.25 美元降至 5 美元。官方介绍称,新模型在沟通上更自然、清晰,会把关键信息前置,更适合长会话协作,并强调这一改进同时是一项安全收益;性能层面,有评论引用 Anthropic 的表述称,Opus 5.5 在生物学与网络安全能力上与被称为「Claude Mythos 5.1」的对象相当,社区对这一命名仍有疑问,这暗示其适用场景可能进一步扩展。Opus 5.5 是 Anthropic 继今年 7 月发布的 Claude Opus 5 之后的下一代旗舰模型,发布前几周,CEO Dario Amodei 曾公开倡议「pacing the frontier」(放慢前沿步伐),主张有意减缓 AI 能力进展,以匹配对齐研究的进度,Opus 5.5 也是这一倡议之后的首次模型发布;Anthropic 内部还维护着名为 Claude Fable 的研究模型系列,Opus 5.5 的能力被定位为在多数工作任务上接近 Fable 5.1 的水平。来源:hackernews

7. 安全公司 Trail of Bits 深度批评 SAML 协议设计缺陷

Trail of Bits 发布了一篇题为「SAML: A Fractal of Bad Design」的技术博客文章,对 SAML(安全断言标记语言)协议的设计缺陷进行了系统性批评,文章在安全社区获得广泛关注。该分析追溯了 SAML 与 XML 时代的关联,指出其架构选择带来的脆弱性,并探讨这些设计问题对企业单点登录(SSO)生态的长期影响;评论者普遍认可文章的核心论点,同时补充了 XML 签名验证绕过等具体历史漏洞案例,并对比了 OIDC 等替代方案各自的局限,该文在 Hacker News 上引发 275 分、148 条评论的实质性讨论。SAML 是一种基于 XML 的标准,用于在身份提供商(IdP)与服务提供商(SP)之间交换认证与授权数据,自 2000 年代初被广泛部署于企业 SSO 场景,其复杂的断言结构、签名机制与绑定方式在多年实践中暴露出多个高危漏洞;OIDC 作为较新的替代方案基于 JSON 与 JWT,但同样存在 JWT 算法混淆等设计层面问题。来源:hackernews

8. Artificial Analysis 发布 Claude Opus 5.5 评测,对比智能、性能与定价

Artificial Analysis 发布了针对 Claude Opus 5.5 的评测页面,覆盖 medium、max、xhigh 三个推理力度档位的智能分数与性能表现。社区讨论中,hglaser 指出该模型在「high 对 high」对比下,相比 Opus 5 的任务成本约下降 50%,单位任务成本明显降低;Simon Willison 反馈,在 max 档位下尝试生成复杂 SVG(骑自行车的鹈鹕)时,两次都因耗尽 128,000 token 推理预算而失败,说明 max 档位在高复杂度任务下存在硬性预算上限。评论者还担忧模型发布后出现性能回退——breckenedge 观察到 Sol 模型的表现几周后跌至与 Luna 持平,并对前沿闭源模型相对开源模型的性价比提出质疑,认为接近 100 倍的价差可能让「好够用」的开源方案侵蚀前沿模型的商业空间。来源:hackernews

把这些消息放在一起看,今天的主线其实只有两条:一条是价格与成本,Opus 5.5 的降价、GPT-6 Sol 与 Luna 的效率定位、以及 Artificial Analysis 那份把「单位任务成本」摊开算的评测,都在把前沿能力往更便宜的方向推;另一条是这份能力落到现实之后要承担的责任,EvilTokens 把 AI 用在诈骗流水线上,Tumbler Ridge 的诉讼把矛头指向了模型在暴力策划中的缺位,丰田的机器人计划则要面对「不取代人类」这句承诺能兑现多少。夹在中间的是更基础的一层——SAML 的设计缺陷提醒我们,AI 之外的旧协议仍在为身份与信任把关,而戴森那把 499 美元的牙刷则是一个温和的旁注:把东西做得更复杂,未必就更可靠。

🎧 本期已同步制作为播客节目,点击收听《每日 AI 资讯 · 2026-09-23》