OPC 中国 · AI 日报
10月2日AI日报:Claude Code开放Mods,Gemini视觉引导与Suno口播配乐
15条AI新闻,头条Claude Code Mods;更新Gemini、Suno、决策模型和DeepSeek服务状态。

AI配音与数字形象;原始素材与来源逐条标明。
本期目录 · 先国外,后国内
国外新闻
01 / 今日头条
Claude Code 开放 Mods
官方10月1日上线 Mods:可改提示词、工具调用、权限处理和界面,随插件在CLI与桌面端分发;/diff已采用该机制。Mods具备与Claude Code相同的本机权限、没有沙箱,安装需看来源。Team/Enterprise及受管理设备有默认安全mod。
先看今天的头条。Anthropic 在十月一日推出 Claude Code Mods,让开发者用一小段 TypeScript,改变工具的行为和界面。比如改写发给模型的提示词、拦截工具调用,或者换掉内置的代码差异视图。它跟随插件安装,命令行和桌面端都能用。团队还可以加入生产环境操作确认和审计记录。要特别看清权限:Mods 和 Claude Code 拥有相同的本机访问能力,没有独立沙箱,因此只安装可信来源。对经常使用编程助手的人,这次更新把工作台的定制空间又打开了一层。
来源:Anthropic / Claude Code。原文发布时间:2026-10-01T18:08:09+00:00。

02 / 产品更新
Gemini Live 上线视觉引导
Guided Vision可在共享摄像头时描述环境并给出转动、倾斜等取景提示,适合盲人、低视力及读细字场景。支持Android 9及以上、Gemini Live支持的地区和语言,可经Gemini设置、无障碍快捷方式或TalkBack启动;不用于导航或替代手杖。
从开发工作台转到日常生活。Google 为 Gemini Live 上线 Guided Vision,面向盲人、低视力人士,也帮助需要辨认细字的用户。共享摄像头后,它不只描述看到的内容,还会提示你向右转、往下倾斜或后退一点,让目标进入画面。找掉落的耳机、读食品标签,都是官方列出的场景。功能支持安卓九及以上,并受 Gemini Live 的地区和语言范围限制。这是一项视觉辅助工具,不能替代手杖,也不用于导航或障碍物检测。
来源:Google Gemini。原文发布时间:Thu, 01 Oct 2026 16:00:00 +0000。

原始来源:Google Gemini ↗
03 / 产品更新
Suno Speech 开放公测
Suno官方10月1日介绍Speech beta:输入文本并描述声音和音乐风格,生成口语音频与原创背景音乐组成的一条音轨。公测向所有人开放,仍可能出现口音漂移与夸张停顿;未将厂商“首个”说法当独立结论。
做音频内容的人可以关注 Suno 的新功能。Speech 已经开放公测,把口语声音和原创背景音乐合成一条音轨。输入一段文字,再描述想要的声音和音乐风格,就能做诗歌朗读、睡前故事或冥想音频。Suno 表示,经过一个月的小范围测试,现在向所有人开放测试版。不过官方也提到,口音偶尔会漂移,戏剧化停顿可能过长。它适合先验证创意,正式交付仍要逐段听效果。
来源:Suno。原文发布时间:2026-10-01T22:15:58+00:00。

原始来源:Suno ↗
04 / 产品更新
Perplexity 开源决策模型
官方发布pplx-decider-v1-27b及Decisions API,面向固定答案集合输出概率分布,输入0.04美元/百万tokens、输出免费,并宣布开源。85.71%是厂商汇总评测,不能当通用正确率。
再看帮智能体做选择的小模型。Perplexity 发布 Decisions API,并宣布开源二百七十亿参数的决策模型。它的任务不是写长文章,而是针对预先给定的答案集合,输出概率分布。比如让工作流判断下一步该走哪个分支。官方公布的接口价格,是每百万输入 token 零点零四美元,输出 token 免费。帖文中的百分之八十五点七一,是厂商汇总评测成绩,不能直接理解为所有场景的正确率。
来源:Perplexity。原文发布时间:2026-10-01T18:24:39+00:00。

原始来源:Perplexity ↗
05 / 产品更新
ChatGPT Sites 托管 MCP 服务
OpenAI开发者宣布Sites可创建和部署含扩展的MCP服务器,再转为插件并安装到网页、移动和桌面ChatGPT。此前已播平台与市场发布,本卡只讲新增后端托管能力;不推断生产SLA。
ChatGPT Sites 也新增了后端能力。OpenAI 的 Max Stoiber 介绍,现在可以在 Sites 创建并托管 MCP 服务器,包括插件扩展。他用待办清单举例:提出需求后,系统创建服务、部署到 Sites,再把它转成插件,安装到网页版、移动端和桌面版 ChatGPT。对想做小工具的人,这意味着从生成界面到连接功能的流程更完整。这次新增重点是服务托管,具体生产环境保障仍要以产品文档为准。
来源:OpenAI。原文发布时间:2026-09-30T22:43:43+00:00。

原始来源:OpenAI ↗
06 / 产品更新
Sonnet 5.5 xHigh 网页开发第三
Arena 新增xHigh推理档,WebDev1786分第三;当前第二的GPT-6 Astra为1788分。8美元/百万tokens是榜单混合价格口径。不是重复报道此前High档1699分、第四名。
模型评测方面,Arena 将 Claude Sonnet 五点五的 xHigh 推理档加入网页开发榜,以一千七百八十六分排在第三。第二名 GPT 六 Astra 是一千七百八十八分,两者相差两分。榜单还给出每百万 token 八美元的混合价格,这是评测比较采用的计价口径。这里讲的是新加入的 xHigh 档,不是此前 High 档的旧成绩;网页开发表现也需要和日常任务分别看。
来源:Arena。原文发布时间:2026-10-01T16:51:02+00:00。

原始来源:Arena ↗
07 / 产品更新
Cloudflare Clef 开放模型权重
Clef与Clef-flash上线Workers AI,采用Qwen底座、支持图像输入和64k上下文,Apache 2.0开放权重并兼容Jev API。官方测试中位延迟209.3与38.8ms;定制先通过工程团队合作,未来自助平台仍在开发。
同样围绕决策模型,Cloudflare 发布 Clef 和 Clef flash,已经接入 Workers AI。两款模型采用千问底座,支持图像输入和六万四千 token 上下文,并以 Apache 二点零许可开放权重。接口兼容 Jev,便于已有工作流尝试切换。Cloudflare 还推出面向具体业务的强化学习定制服务,现阶段先由工程团队协作,后续自助训练平台仍在开发。这条路线更关注快速分类和流程判断。
来源:Cloudflare。原文发布时间:Thu, 01 Oct 2026 16:18:57 +0000。

原始来源:Cloudflare ↗
08 / 产品更新
fal Recast 替换视频角色
上传现有视频和新人参考照片,Recast改变出镜人物并保留动作、镜头、剪辑和声音,基于H3 Max。与此前已播Video Insert不同,这是角色替换入口;官方“第一”质量宣传未作独立结论。
视频创作这边,fal 推出 Recast。上传一段现有视频,再提供新人物的参考照片,就能替换画面里的出镜角色。按照官方演示,原来的动作、镜头移动、剪辑和声音会保留,底层使用 H3 Max。它可以用来制作不同人物版本,或者为不同受众调整同一段内容。和此前往视频里插入元素的功能相比,这次重点是更换角色;实际一致性可以直接看右侧的官方示例。
来源:fal。原文发布时间:2026-10-01T20:33:53+00:00。

原始来源:fal ↗
09 / 产品更新
Gemini 4 Argon 文本榜第一
Arena 的新评测:Argon High 文本榜1525分居第一,WebDev1679分第八;Agent Arena 每任务0.62美元。各榜口径不同,不能把文本第一说成所有任务第一。模型的受信测试者开放范围沿用昨天官方发布,未证实全民开放。
继续看昨天发布的 Gemini 四 Argon,今天跟进它的榜单表现。Arena 公布,High 档以一千五百二十五分登上文本榜第一,在网页开发榜则是一千六百七十九分,排第八。另一项 Agent Arena 评测给出的成本是每任务零点六二美元。几个数字来自不同测试,适合分别比较。文本回答领先,不等于网页制作也排名第一;实际选择仍要看自己最常做的任务。
来源:Arena。原文发布时间:2026-09-30T20:30:24+00:00。



原始来源:Arena ↗
10 / 产品更新
Grok Bot 开始主动建议
Grok Bot官方宣布不必先提出请求,也可主动建议可以做的事。本卡不扩写为未经授权自动执行,也不凭二手帖断言所有账号已完成推送。
Grok Bot 增加了更主动的交互。官方宣布,用户不用先开口请求,它也能建议有哪些事情可以帮忙。这个变化把助手的起点,从等待指令推进到主动发现可能的工作。官方帖文目前公布的是建议能力,具体账号开放进度没有逐一说明。对于日常协作,值得观察的是建议是否贴合手头任务,以及接下来的操作怎样让用户确认。
来源:SpaceXAI / Grok。原文发布时间:2026-10-01T17:35:33+00:00。

原始来源:SpaceXAI / Grok ↗
11 / 产品更新
GPT-6 Luna 图像编码修复
AA报告OpenAI修复Luna与Sol图像编码问题;Luna max总指数提高1分,视觉相关评测提升,Sol提升很小。同帖给出Sol 6.1每任务0.72美元、Sol 6为1.04美元,限定AA测试口径。
Artificial Analysis 更新了 OpenAI 模型评测。该机构报告,OpenAI 修复了 Luna 和 Sol 的图像编码问题,GPT 六 Luna 的最高推理档在智能指数中提高一分,改善集中在需要视觉理解的项目。Sol 的提升则很小。同一份测试还显示,GPT 六点一 Sol 每任务成本为零点七二美元,上一代 GPT 六 Sol 为一点零四美元。这些是该机构测试口径下的结果。
来源:Artificial Analysis。原文发布时间:2026-10-01T02:55:54+00:00。

12 / 产品更新
OpenRouter 上线安全中心
Security Center展示工作区内API keys及风险原因,并可一次停用、归档或设限最多500个。官方以自身85名员工、1000多个活跃keys为例,本卡不展示任何凭据。
使用多个模型接口的团队,可以留意 OpenRouter 的安全中心。它集中展示各工作区的 API 密钥,并标出哪些存在风险、风险在哪里。管理员可以批量停用、归档或设置上限,一次最多处理五百个。官方说,这个功能来自他们对自身账号的审计:八十五名员工,对应一千多个活跃密钥,其中不少已经数月未使用。把闲置凭据和使用额度集中清理,是这次更新的直接用途。
来源:OpenRouter。原文发布时间:2026-10-01T15:45:05+00:00。

原始来源:OpenRouter ↗
13 / 产品更新
Sol 6.1 增加服务容量
OpenAI负责人10月1日说ChatGPT和Codex负载高,已增加容量,预计接下来数小时速度改善、接近前一天的两倍。速度是官方预期,未做本机对比测试,不表述为已经翻倍。
再补一条 OpenAI 的服务进展。负责人 Thibault Sottiaux 在十月一日表示,GPT 六点一 Sol 的需求很高,ChatGPT 和 Codex 一度承受较重负载。团队已经增加容量,预计之后数小时速度会明显改善,接近前一天所提供速度的两倍。这里的提速幅度是负责人当时的预期,我们没有做前后对比测试。关注这个模型的用户,可以结合自己的实际等待时间观察。
来源:OpenAI。原文发布时间:2026-10-01T01:06:15+00:00。

原始来源:OpenAI ↗
14 / 产品更新
Grokipedia v0.3 已发布
Elon Musk官方原帖确认Grokipedia v0.3发布。未得到足够功能变更详情,不把版本号写成重大能力突破。
一条简讯:马斯克在官方账号确认,Grokipedia 零点三版已经发布。原帖没有展开充分的功能变更说明,因此这次只确认版本上线。后续如果补出明确的新能力和使用变化,再继续跟进。
来源:Elon Musk / Grok。原文发布时间:2026-10-01T06:20:45+00:00。

原始来源:Elon Musk / Grok ↗
国内新闻
15 / 服务状态
DeepSeek 凌晨 故障已恢复
官方状态页:北京时间10月2日03:40至05:34,V4 Pro API、V4.1 Flash API及对话服务性能下降,持续1小时54分钟,现已恢复。是今日新的事故,不重复旧公告。
最后看国内服务动态。DeepSeek 官方状态页记录,北京时间十月二日凌晨三点四十分,到五点三十四分,网页和接口出现性能下降,持续一小时五十四分钟。受影响的包括 V 四 Pro 接口、V 四点一 Flash 接口,以及对话服务。状态页已经标记为解决、服务恢复。如果你今天凌晨遇到了请求变慢或对话异常,可以对照这段具体时间。
来源:DeepSeek Status。原文发布时间:Fri, 02 Oct 2026 03:40:05 +0800。

原始来源:DeepSeek Status ↗