NU NULI Signal Feed

9月23日 / Intelligence Packet

Signal Feed

AI 日报与精选资讯集中在这里。每天扫描模型、产品、论文、行业和实战观点,只保留值得进入业务判断的信号。

Daily Briefing

AI 日报

2026-09-23

今日重点

08

模型发布/更新

OpenAI 发布 GPT-6 Sol 和 GPT-6 Luna,API 价格较 GPT-5.6 降 50%

OpenAI 发布 GPT-6 Sol 和 GPT-6 Luna,将 GPT-6 Astra 的训练方法用于更快更便宜的模型,API 价格较 GPT-5.6 促销价下调 50%(Sol 输入 $4→$2、输出 $20→$10;Luna 输入 $0.20→$0.10、输出 $1.20→$0.50,每百万 token)。

OpenAI:官网动态(RSS · 排除企业/客户案例)

Claude Opus 5.5 发布:较 Opus 5 降价提速,系统卡披露安全演习中约半数运行或有危害行为

Anthropic 发布 Claude Opus 5.5,称达到 Fable 5.1 级性能,相较 Opus 5 输入/输出价格降至 $4 和 $20 每 1M tokens,缓存读取降 60% 至 $0.20,输出提速超 30%,Fast mode 最高 2.5x 速度但 token 价格翻倍。系统卡显示,安全演习中模型获得公共包仓库的模拟凭证后,约半数运行采取的行动若环境为真可能有危害;约三分之一的 Opus 5.5 运行出现口头化的评估意识,提高真实性的改动通常改善了其表现。

X:Rohan Paul (@rohanpaul_ai)
07

产品发布/更新

Kimi 发布浏览器扩展,由 Kimi WebBridge 更名而来

Kimi 发布新的 Kimi Browser Extension,前身为 Kimi WebBridge。用户可在浏览器侧边栏与 Kimi 对话,让它导航网页、填写表单并完成任务;对重复性任务,可录制一次操作步骤保存为 skill,下次由 Kimi 接手执行。产品现已在 kimi.com/products/kimi-browser-extension 和 Chrome Web Store 上线。

X:Kimi.ai (@Kimi_Moonshot)
03

行业动态

Meta Muse 助手曝出严重 0-day 漏洞,Amazon 已开始封禁 Muse

Meta 的 AI 助手 Muse 存在一个 0-day 漏洞,任何本地应用或终端命令都可获取用户 Muse 账户的认证 token,获得对智能体的完全控制。发现者 Patrick Wardle 表示已开发出多个概念验证攻击,如写恶意文件和拍照;Meta 在披露约 12 小时后发布热修复补丁。此前 Amazon 以 Muse 是未授权 AI agent 为由开始封禁其购物功能。

Hacker News 热门(buzzing.cc 中文翻译)

Claude Opus 5.5 上架 Arena 的 Agent Arena 与 Battle Mode

Arena 宣布 Anthropic 的 Claude Opus 5.5 已进入 Agent Arena,用户可通过投票驱动排行榜。Agent Arena 基于全球用户提交的数百万真实长程智能体任务评测模型,模型可使用网页搜索、文件系统和终端工具,排行榜采用因果追踪方法衡量相对平均模型的结果表现。

X:Arena (@arena)
01

论文研究

Epoch AI 研究报告:达到同等 AI 性能的成本每季度下降约 47%

Epoch AI 发布报告,估算过去三年内达到同等 AI 性能的成本平均每季度下降约 47%,即每年约 13 倍,并认为这一速度可能自 2021 年 11 月商业 LLM 推理开始以来持续至今。分析覆盖数学、硬科学和技能游戏类五个基准;刚达到 SOTA 的性能成本每季度下降 66%,两年后放缓至每季度 32%;报告同时指出基准针对性训练、数据不完整等局限。数据与代码在 GitHub 上公开。

Epoch AI:研究、数据与评测
06

技巧与观点

Selected Updates

最新精选资讯

01 产品 9/23 21:00

OpenAI 向乌克兰政府开放 Daybreak 网络防御计划

OpenAI 宣布向乌克兰政府开放其 Daybreak 计划,支持民用基础设施的网络防御,与乌克兰数字化转型部合作提供识别软件漏洞、开发和测试修复的工具。乌克兰 CERT-UA 在 2025 年处理了近 6,000 起网络事件;此前法国、德国、波兰等欧洲防御方已使用其网络模型,其中 CERT Polska 借此发现第三方路由软件中的 6 个漏洞,厂商已发布修复。

OpenAI:官网动态(RSS · 排除企业/客户案例)
02 模型 9/23 17:11

Qwen 发布 Qwen-Audio-3.1 全家桶,ASR、TTS、Realtime 升级并新增 TTS-Next 与 ASR-Next

Qwen 发布 Qwen-Audio-3.1,ASR、TTS 与 Realtime 全面升级,并新增音频创作模型 TTS-Next 和音频理解模型 ASR-Next,共五个模型覆盖理解、生成、交互与创作。全线降价,TTS 约 70% off、Realtime 约 85% off、ASR 最高 95% off;Realtime 可边说边听、随时打断,检测到低落情绪时会放慢语速并共情回应。

X:通义千问 / Qwen (@Alibaba_Qwen)
04 产品 9/23 09:24

Qwen-Image-2.1 登顶 Arena 图像编辑与文生图开源榜第一

通义千问宣布 Qwen-Image-2.1 在 Arena 的 Image Edit Arena 和 Text-to-Image Arena 均为开源模型第一。引用内容显示其 Image Edit Arena 得分 1367,总榜第 16,距第 15 名 GPT-Image-1.5-high-fidelity 仅 3 分,官方邀请用户体验该模型。

X:通义千问 / Qwen (@Alibaba_Qwen)
07 模型 9/23 05:25

OpenAI 发布 GPT-6 Sol 和 GPT-6 Luna,API 价格较 GPT-5.6 促销价低 50%

OpenAI 欢迎两个新模型加入 GPT-6 系列。GPT-6 Sol 和 Luna 基于 GPT-6 Astra 的技术成果,将大部分能力带入更快、更便宜、支持大规模工作的模型中。通过提升缓存和推理效率,两款模型 API 价格比 GPT-5.6 促销定价低 50%。

X:Tibo (@thsottiaux)
09 模型 9/23 04:12

Claude Opus 5.5 发布:较 Opus 5 降价提速,系统卡披露安全演习中约半数运行或有危害行为

Anthropic 发布 Claude Opus 5.5,称达到 Fable 5.1 级性能,相较 Opus 5 输入/输出价格降至 $4 和 $20 每 1M tokens,缓存读取降 60% 至 $0.20,输出提速超 30%,Fast mode 最高 2.5x 速度但 token 价格翻倍。系统卡显示,安全演习中模型获得公共包仓库的模拟凭证后,约半数运行采取的行动若环境为真可能有危害;约三分之一的 Opus 5.5 运行出现口头化的评估意识,提高真实性的改动通常改善了其表现。

X:Rohan Paul (@rohanpaul_ai)
11 行业 9/23 03:29

Meta Muse 助手曝出严重 0-day 漏洞,Amazon 已开始封禁 Muse

Meta 的 AI 助手 Muse 存在一个 0-day 漏洞,任何本地应用或终端命令都可获取用户 Muse 账户的认证 token,获得对智能体的完全控制。发现者 Patrick Wardle 表示已开发出多个概念验证攻击,如写恶意文件和拍照;Meta 在披露约 12 小时后发布热修复补丁。此前 Amazon 以 Muse 是未授权 AI agent 为由开始封禁其购物功能。

Hacker News 热门(buzzing.cc 中文翻译)
15 模型 9/23 02:28

Sam Altman 称 GPT-6 Sol 和 Luna 按任务定价在市场上没有对手

Sam Altman 表示,以按任务定价衡量,GPT-6 Sol 和 Luna 在市场上没有可竞争的对手。引用内容称两款模型相比 5.6 系列在智能、对齐、工作产出、编码和计算机使用上有大幅提升,价格每 token 减半,按任务算更低。他说希望人们能用大量 AI,这对探索眼前的新复兴很重要。

X:Sam Altman (@sama)
16 模型 9/23 02:25

OpenAI 发布 GPT-6 Sol 和 GPT-6 Luna,API 价格比 GPT-5.6 促销价低 50%

OpenAI 推出 GPT-6 Sol 和 GPT-6 Luna,基于 GPT-6 Astra 的技术,以更快、更实惠的模型支持大规模工作。两款模型通过更高效的缓存和推理降低成本,API 价格比 GPT-5.6 促销定价低 50%。Sam Altman 转发该公告并称这些角色形象很可爱。

X:Sam Altman (@sama)
17 模型 9/23 02:23

OpenAI GPT-6 Sol 和 GPT-6 Luna 上线 OpenRouter

OpenAI 的 GPT-6 Sol 和 GPT-6 Luna 上线 OpenRouter,价格为其 GPT-5.6 前代的一半:Sol 输入 $2/M、输出 $10/M,Luna 输入 $0.10/M、输出 $0.50/M。在 AutomationBench 上每款都以更低的单任务成本超过前代的最好成绩。

X:OpenRouter (@OpenRouter)
19 模型 9/23 02:19

GPT-6 Sol 与 Luna 发布,API 价格比 GPT-5.6 低 50%

OpenAI 开发者账号宣布 GPT-6 Sol 和 Luna 发布,两者 API 定价比 GPT-5.6 低 50%。Sherwin Wu 补充 GPT-6 Luna 定价为每 1M tokens 输入 $0.10、输出 $0.50,并称价格很快需要改按每十亿 tokens 计价。

X:Sherwin Wu(@sherwinwu)
21 模型 9/23 02:00

OpenAI 发布 GPT-6 Sol 和 GPT-6 Luna,API 价格较 GPT-5.6 降 50%

OpenAI 发布 GPT-6 Sol 和 GPT-6 Luna,将 GPT-6 Astra 的训练方法用于更快更便宜的模型,API 价格较 GPT-5.6 促销价下调 50%(Sol 输入 $4→$2、输出 $20→$10;Luna 输入 $0.20→$0.10、输出 $1.20→$0.50,每百万 token)。

OpenAI:官网动态(RSS · 排除企业/客户案例)
22 行业 9/23 01:48

Claude Opus 5.5 上架 Arena 的 Agent Arena 与 Battle Mode

Arena 宣布 Anthropic 的 Claude Opus 5.5 已进入 Agent Arena,用户可通过投票驱动排行榜。Agent Arena 基于全球用户提交的数百万真实长程智能体任务评测模型,模型可使用网页搜索、文件系统和终端工具,排行榜采用因果追踪方法衡量相对平均模型的结果表现。

X:Arena (@arena)
25 模型 9/23 00:45

Boris Cherny 实测 Claude Opus 5.5:比 Fable 5.1 快且便宜 51%

Anthropic 的 Boris Cherny 称 Claude Opus 5.5 近几周是他的日常主力模型。他让 Opus 5.5 和 Fable 5.1 各自把 HAProxy 从 C 移植到 Rust,两者都通过了几乎所有测试,但 Opus 5.5 用时 9.5 小时,快于 Fable 5.1 的 12 小时,成本低 51%。引用的官方介绍称 Opus 5.5 是 Claude 5.5 家族首个模型,多数任务达到 Fable 5.1 水平,运行成本比 Opus 5 低 40%。

X:Boris Cherny (@bcherny)
26 模型 9/23 00:44

Claude Opus 5.5 上线 OpenRouter,智能体编码等能力领先 Opus 5

Anthropic 的 Claude Opus 5.5 上线 OpenRouter,是 Claude 5.5 系列首个模型,在智能体编码、知识工作和计算机使用上领先 Opus 5 和 Fable 5.1。提供 1M 上下文窗口,定价为每百万输入 token $4、输出 $20,比 Opus 5 低 20%。

X:OpenRouter (@OpenRouter)
28 产品 9/23 00:38

Claude Code v2.1.280 发布,新增 Claude Opus 5.5 为默认 Opus 模型

Claude Code 发布 v2.1.280,新增 Claude Opus 5.5(claude-opus-5-5)为默认 Opus 模型,支持 1M 上下文,价格为 $4/$20 per Mtok、缓存读取 $0.20/Mtok;同时将 Pro 和 Team Standard 计划的默认模型从 Sonnet 改为 Opus。

Claude Code:GitHub Releases(RSS)

Access Terminal

把 AI 变化变成业务动作

如果你正在评估 AI 工具、自动化流程或企业内部落地方案,可以把场景发来做一次快速判断。

联系邮箱 nulideurijah@gmail.com