OPC 中国专业的人 让好的工作发生

OPC 中国 · AI 日报

10月2日AI日报:Claude Code开放Mods,Gemini视觉引导与Suno口播配乐

· 酷恩 · 15 条新闻 · 8 分 13 秒

15条AI新闻,头条Claude Code Mods;更新Gemini、Suno、决策模型和DeepSeek服务状态。

2026年10月2日OPC中国AI日报,15条新闻,酷恩02与Claude Code开放Mods主题

AI配音与数字形象;原始素材与来源逐条标明。

本期目录 · 先国外,后国内
  1. Claude Code 开放 Mods
  2. Gemini Live 上线视觉引导
  3. Suno Speech 开放公测
  4. Perplexity 开源决策模型
  5. ChatGPT Sites 托管 MCP 服务
  6. Sonnet 5.5 xHigh 网页开发第三
  7. Cloudflare Clef 开放模型权重
  8. fal Recast 替换视频角色
  9. Gemini 4 Argon 文本榜第一
  10. Grok Bot 开始主动建议
  11. GPT-6 Luna 图像编码修复
  12. OpenRouter 上线安全中心
  13. Sol 6.1 增加服务容量
  14. Grokipedia v0.3 已发布
  15. DeepSeek 凌晨 故障已恢复

国外新闻

01 / 今日头条

Claude Code 开放 Mods

官方10月1日上线 Mods:可改提示词、工具调用、权限处理和界面,随插件在CLI与桌面端分发;/diff已采用该机制。Mods具备与Claude Code相同的本机权限、没有沙箱,安装需看来源。Team/Enterprise及受管理设备有默认安全mod。

先看今天的头条。Anthropic 在十月一日推出 Claude Code Mods,让开发者用一小段 TypeScript,改变工具的行为和界面。比如改写发给模型的提示词、拦截工具调用,或者换掉内置的代码差异视图。它跟随插件安装,命令行和桌面端都能用。团队还可以加入生产环境操作确认和审计记录。要特别看清权限:Mods 和 Claude Code 拥有相同的本机访问能力,没有独立沙箱,因此只安装可信来源。对经常使用编程助手的人,这次更新把工作台的定制空间又打开了一层。

来源:Anthropic / Claude Code。原文发布时间:2026-10-01T18:08:09+00:00。

官方原图 / 原页面 / 演示视频(静音)
官方原图 / 原页面 / 演示视频(静音)

原始来源:Anthropic / Claude Code ↗

02 / 产品更新

Gemini Live 上线视觉引导

Guided Vision可在共享摄像头时描述环境并给出转动、倾斜等取景提示,适合盲人、低视力及读细字场景。支持Android 9及以上、Gemini Live支持的地区和语言,可经Gemini设置、无障碍快捷方式或TalkBack启动;不用于导航或替代手杖。

从开发工作台转到日常生活。Google 为 Gemini Live 上线 Guided Vision,面向盲人、低视力人士,也帮助需要辨认细字的用户。共享摄像头后,它不只描述看到的内容,还会提示你向右转、往下倾斜或后退一点,让目标进入画面。找掉落的耳机、读食品标签,都是官方列出的场景。功能支持安卓九及以上,并受 Gemini Live 的地区和语言范围限制。这是一项视觉辅助工具,不能替代手杖,也不用于导航或障碍物检测。

来源:Google Gemini。原文发布时间:Thu, 01 Oct 2026 16:00:00 +0000。

官方原图 / 原页面 / 演示视频(静音)
官方原图 / 原页面 / 演示视频(静音)

原始来源:Google Gemini ↗

03 / 产品更新

Suno Speech 开放公测

Suno官方10月1日介绍Speech beta:输入文本并描述声音和音乐风格,生成口语音频与原创背景音乐组成的一条音轨。公测向所有人开放,仍可能出现口音漂移与夸张停顿;未将厂商“首个”说法当独立结论。

做音频内容的人可以关注 Suno 的新功能。Speech 已经开放公测,把口语声音和原创背景音乐合成一条音轨。输入一段文字,再描述想要的声音和音乐风格,就能做诗歌朗读、睡前故事或冥想音频。Suno 表示,经过一个月的小范围测试,现在向所有人开放测试版。不过官方也提到,口音偶尔会漂移,戏剧化停顿可能过长。它适合先验证创意,正式交付仍要逐段听效果。

来源:Suno。原文发布时间:2026-10-01T22:15:58+00:00。

官方原图 / 原页面 / 演示视频(静音)
官方原图 / 原页面 / 演示视频(静音)

原始来源:Suno ↗

04 / 产品更新

Perplexity 开源决策模型

官方发布pplx-decider-v1-27b及Decisions API,面向固定答案集合输出概率分布,输入0.04美元/百万tokens、输出免费,并宣布开源。85.71%是厂商汇总评测,不能当通用正确率。

再看帮智能体做选择的小模型。Perplexity 发布 Decisions API,并宣布开源二百七十亿参数的决策模型。它的任务不是写长文章,而是针对预先给定的答案集合,输出概率分布。比如让工作流判断下一步该走哪个分支。官方公布的接口价格,是每百万输入 token 零点零四美元,输出 token 免费。帖文中的百分之八十五点七一,是厂商汇总评测成绩,不能直接理解为所有场景的正确率。

来源:Perplexity。原文发布时间:2026-10-01T18:24:39+00:00。

官方原图 / 原页面 / 演示视频(静音)
官方原图 / 原页面 / 演示视频(静音)

原始来源:Perplexity ↗

05 / 产品更新

ChatGPT Sites 托管 MCP 服务

OpenAI开发者宣布Sites可创建和部署含扩展的MCP服务器,再转为插件并安装到网页、移动和桌面ChatGPT。此前已播平台与市场发布,本卡只讲新增后端托管能力;不推断生产SLA。

ChatGPT Sites 也新增了后端能力。OpenAI 的 Max Stoiber 介绍,现在可以在 Sites 创建并托管 MCP 服务器,包括插件扩展。他用待办清单举例:提出需求后,系统创建服务、部署到 Sites,再把它转成插件,安装到网页版、移动端和桌面版 ChatGPT。对想做小工具的人,这意味着从生成界面到连接功能的流程更完整。这次新增重点是服务托管,具体生产环境保障仍要以产品文档为准。

来源:OpenAI。原文发布时间:2026-09-30T22:43:43+00:00。

官方原图 / 原页面 / 演示视频(静音)
官方原图 / 原页面 / 演示视频(静音)

原始来源:OpenAI ↗

06 / 产品更新

Sonnet 5.5 xHigh 网页开发第三

Arena 新增xHigh推理档,WebDev1786分第三;当前第二的GPT-6 Astra为1788分。8美元/百万tokens是榜单混合价格口径。不是重复报道此前High档1699分、第四名。

模型评测方面,Arena 将 Claude Sonnet 五点五的 xHigh 推理档加入网页开发榜,以一千七百八十六分排在第三。第二名 GPT 六 Astra 是一千七百八十八分,两者相差两分。榜单还给出每百万 token 八美元的混合价格,这是评测比较采用的计价口径。这里讲的是新加入的 xHigh 档,不是此前 High 档的旧成绩;网页开发表现也需要和日常任务分别看。

来源:Arena。原文发布时间:2026-10-01T16:51:02+00:00。

官方原图 / 原页面 / 演示视频(静音)
官方原图 / 原页面 / 演示视频(静音)

原始来源:Arena ↗

07 / 产品更新

Cloudflare Clef 开放模型权重

Clef与Clef-flash上线Workers AI,采用Qwen底座、支持图像输入和64k上下文,Apache 2.0开放权重并兼容Jev API。官方测试中位延迟209.3与38.8ms;定制先通过工程团队合作,未来自助平台仍在开发。

同样围绕决策模型,Cloudflare 发布 Clef 和 Clef flash,已经接入 Workers AI。两款模型采用千问底座,支持图像输入和六万四千 token 上下文,并以 Apache 二点零许可开放权重。接口兼容 Jev,便于已有工作流尝试切换。Cloudflare 还推出面向具体业务的强化学习定制服务,现阶段先由工程团队协作,后续自助训练平台仍在开发。这条路线更关注快速分类和流程判断。

来源:Cloudflare。原文发布时间:Thu, 01 Oct 2026 16:18:57 +0000。

官方原图 / 原页面 / 演示视频(静音)
官方原图 / 原页面 / 演示视频(静音)

原始来源:Cloudflare ↗

08 / 产品更新

fal Recast 替换视频角色

上传现有视频和新人参考照片,Recast改变出镜人物并保留动作、镜头、剪辑和声音,基于H3 Max。与此前已播Video Insert不同,这是角色替换入口;官方“第一”质量宣传未作独立结论。

视频创作这边,fal 推出 Recast。上传一段现有视频,再提供新人物的参考照片,就能替换画面里的出镜角色。按照官方演示,原来的动作、镜头移动、剪辑和声音会保留,底层使用 H3 Max。它可以用来制作不同人物版本,或者为不同受众调整同一段内容。和此前往视频里插入元素的功能相比,这次重点是更换角色;实际一致性可以直接看右侧的官方示例。

来源:fal。原文发布时间:2026-10-01T20:33:53+00:00。

官方原图 / 原页面 / 演示视频(静音)
官方原图 / 原页面 / 演示视频(静音)

原始来源:fal ↗

09 / 产品更新

Gemini 4 Argon 文本榜第一

Arena 的新评测:Argon High 文本榜1525分居第一,WebDev1679分第八;Agent Arena 每任务0.62美元。各榜口径不同,不能把文本第一说成所有任务第一。模型的受信测试者开放范围沿用昨天官方发布,未证实全民开放。

继续看昨天发布的 Gemini 四 Argon,今天跟进它的榜单表现。Arena 公布,High 档以一千五百二十五分登上文本榜第一,在网页开发榜则是一千六百七十九分,排第八。另一项 Agent Arena 评测给出的成本是每任务零点六二美元。几个数字来自不同测试,适合分别比较。文本回答领先,不等于网页制作也排名第一;实际选择仍要看自己最常做的任务。

来源:Arena。原文发布时间:2026-09-30T20:30:24+00:00。

官方原图 / 原页面 / 演示视频(静音)
官方原图 / 原页面 / 演示视频(静音)
官方原图 / 原页面 / 演示视频(静音)
官方原图 / 原页面 / 演示视频(静音)
官方原图 / 原页面 / 演示视频(静音)
官方原图 / 原页面 / 演示视频(静音)

原始来源:Arena ↗

10 / 产品更新

Grok Bot 开始主动建议

Grok Bot官方宣布不必先提出请求,也可主动建议可以做的事。本卡不扩写为未经授权自动执行,也不凭二手帖断言所有账号已完成推送。

Grok Bot 增加了更主动的交互。官方宣布,用户不用先开口请求,它也能建议有哪些事情可以帮忙。这个变化把助手的起点,从等待指令推进到主动发现可能的工作。官方帖文目前公布的是建议能力,具体账号开放进度没有逐一说明。对于日常协作,值得观察的是建议是否贴合手头任务,以及接下来的操作怎样让用户确认。

来源:SpaceXAI / Grok。原文发布时间:2026-10-01T17:35:33+00:00。

官方原图 / 原页面 / 演示视频(静音)
官方原图 / 原页面 / 演示视频(静音)

原始来源:SpaceXAI / Grok ↗

11 / 产品更新

GPT-6 Luna 图像编码修复

AA报告OpenAI修复Luna与Sol图像编码问题;Luna max总指数提高1分,视觉相关评测提升,Sol提升很小。同帖给出Sol 6.1每任务0.72美元、Sol 6为1.04美元,限定AA测试口径。

Artificial Analysis 更新了 OpenAI 模型评测。该机构报告,OpenAI 修复了 Luna 和 Sol 的图像编码问题,GPT 六 Luna 的最高推理档在智能指数中提高一分,改善集中在需要视觉理解的项目。Sol 的提升则很小。同一份测试还显示,GPT 六点一 Sol 每任务成本为零点七二美元,上一代 GPT 六 Sol 为一点零四美元。这些是该机构测试口径下的结果。

来源:Artificial Analysis。原文发布时间:2026-10-01T02:55:54+00:00。

官方原图 / 原页面 / 演示视频(静音)
官方原图 / 原页面 / 演示视频(静音)

原始来源:Artificial Analysis ↗

12 / 产品更新

OpenRouter 上线安全中心

Security Center展示工作区内API keys及风险原因,并可一次停用、归档或设限最多500个。官方以自身85名员工、1000多个活跃keys为例,本卡不展示任何凭据。

使用多个模型接口的团队,可以留意 OpenRouter 的安全中心。它集中展示各工作区的 API 密钥,并标出哪些存在风险、风险在哪里。管理员可以批量停用、归档或设置上限,一次最多处理五百个。官方说,这个功能来自他们对自身账号的审计:八十五名员工,对应一千多个活跃密钥,其中不少已经数月未使用。把闲置凭据和使用额度集中清理,是这次更新的直接用途。

来源:OpenRouter。原文发布时间:2026-10-01T15:45:05+00:00。

官方原图 / 原页面 / 演示视频(静音)
官方原图 / 原页面 / 演示视频(静音)

原始来源:OpenRouter ↗

13 / 产品更新

Sol 6.1 增加服务容量

OpenAI负责人10月1日说ChatGPT和Codex负载高,已增加容量,预计接下来数小时速度改善、接近前一天的两倍。速度是官方预期,未做本机对比测试,不表述为已经翻倍。

再补一条 OpenAI 的服务进展。负责人 Thibault Sottiaux 在十月一日表示,GPT 六点一 Sol 的需求很高,ChatGPT 和 Codex 一度承受较重负载。团队已经增加容量,预计之后数小时速度会明显改善,接近前一天所提供速度的两倍。这里的提速幅度是负责人当时的预期,我们没有做前后对比测试。关注这个模型的用户,可以结合自己的实际等待时间观察。

来源:OpenAI。原文发布时间:2026-10-01T01:06:15+00:00。

官方原图 / 原页面 / 演示视频(静音)
官方原图 / 原页面 / 演示视频(静音)

原始来源:OpenAI ↗

14 / 产品更新

Grokipedia v0.3 已发布

Elon Musk官方原帖确认Grokipedia v0.3发布。未得到足够功能变更详情,不把版本号写成重大能力突破。

一条简讯:马斯克在官方账号确认,Grokipedia 零点三版已经发布。原帖没有展开充分的功能变更说明,因此这次只确认版本上线。后续如果补出明确的新能力和使用变化,再继续跟进。

来源:Elon Musk / Grok。原文发布时间:2026-10-01T06:20:45+00:00。

官方原图 / 原页面 / 演示视频(静音)
官方原图 / 原页面 / 演示视频(静音)

原始来源:Elon Musk / Grok ↗

国内新闻

15 / 服务状态

DeepSeek 凌晨 故障已恢复

官方状态页:北京时间10月2日03:40至05:34,V4 Pro API、V4.1 Flash API及对话服务性能下降,持续1小时54分钟,现已恢复。是今日新的事故,不重复旧公告。

最后看国内服务动态。DeepSeek 官方状态页记录,北京时间十月二日凌晨三点四十分,到五点三十四分,网页和接口出现性能下降,持续一小时五十四分钟。受影响的包括 V 四 Pro 接口、V 四点一 Flash 接口,以及对话服务。状态页已经标记为解决、服务恢复。如果你今天凌晨遇到了请求变慢或对话异常,可以对照这段具体时间。

来源:DeepSeek Status。原文发布时间:Fri, 02 Oct 2026 03:40:05 +0800。

官方原图 / 原页面 / 演示视频(静音)
官方原图 / 原页面 / 演示视频(静音)

原始来源:DeepSeek Status ↗

← 返回日报归档