OPC 中国 · AI 日报
2026年9月30日AI日报:GPT-6.1 Sol、dots与DeepSeek桌面端
22条AI新闻,涵盖OpenAI DevDay新产品与国内办公、编程、视频和语音工具进展。

AI配音与数字人物;原始新闻图像、演示和报道来源逐条列出。
本期目录 · 先国外,后国内
- GPT-6.1 Sol 发布 接近 Astra,API 价格仅五分之一
- 常驻智能体 dots 上线 自带云电脑,先开放 Pro 与 Business Premium
- Ultrafast 与 Pro 500 Astra 提速最高 8 倍,Pro 200 重开但额度降低
- Codex 一批更新 云端环境、CLI 改版、PR 审查与安全扫描
- ChatGPT 账号可外用 一键登录第三方,Plus/Pro 额度可在合作应用里用
- Anthropic 招股书曝光 2025 年收入近 46 亿美元,经营亏损 80.6 亿
- ChatGPT 推出 Space 与团队和 AI 共同编辑 Pages
- Anthropic 评估 GLM-5.3 简单手段可在 64%—100% 测试中绕过防护
- OpenAI 多项服务报错 北京时间凌晨 1:52 起,截至 6:47 仍在监测
- 6.1 Astra 取消发布 测试显示安全性倒退,基座继续训练
- Claude 全线短暂故障 北京时间 22:00 起约 1 小时后恢复
- Muse 把住址发给陌生人 Meta 智能体代管集市账号时自动回复买家
- OpenAI 推出企业市场 合同额度可买 Runway 等 32 家产品
- 白宫上线AI政务网站 America.gov:官员称由 Gemini 和 Grok 支持
- Sonnet 5.5 排第四 Code Arena WebDev 1699 分,进入性价比前沿
- DeepSeek 桌面端来了 办公与开发开箱即用
- Qoder 免费期延长 Qwen3.8-Flash 十月继续用
- MiniMax 预告 M Plan 国庆订阅福利附版本条件
- H3 Max 可插入新镜头 在原片中间改写一段动作
- ima 接入腾讯系 Skill 会议、读书、合同一句话调用
- 千问语音登顶受控音色榜 注意区分两张语音榜单
- 可灵 4.0 展示新能力 Flash 开放范围看官方公告
国外新闻
01 / 模型发布
GPT-6.1 Sol 发布 接近 Astra,API 价格仅五分之一
OpenAI 在 DevDay 发布 GPT-6.1 Sol,官方称其在智能体编程、电脑操作和专业工作上接近 GPT-6 Astra。标准 API 价格为每百万输入 2 美元、输出 10 美元,是 Astra 的五分之一;缓存输入 0.10 美元,比 GPT-6 Sol 低一半。ChatGPT Work 和 Codex 分批推送,普通 Chat 暂不提供;GitHub Copilot、OpenRouter 等当天接入。
OpenAI 博客给出的厂商自测:在真实代码库的 DeepSWE v1.1 上,GPT-6.1 Sol 与 GPT-6 Astra 持平,成本约五分之一,比 GPT-6 Sol 最好成绩高 6.4 个百分点;OSWorld 2.0 离线集上距 Astra 2.1 个百分点,单任务成本约七分之一;科研类 Terminal-Bench Science 上平均每任务 5.47 美元,Astra 为 23.80 美元,但最难的科研任务官方仍建议用 Astra。第三方 Artificial Analysis 测得其智能指数比 Astra 低 1 分,单任务成本不到 Astra 的四分之一(0.72 对 3.26 美元),输出词元比 GPT-6 Sol 多约 10%—30%。
可用范围上,博客和官方推文写“今天起向 Plus、Pro、Business、Enterprise、Edu 全部开放”,ChatGPT 发布说明则写“先从 Pro 开始,再扩展到 Plus、Business、Enterprise 和 Edu”,实际以分批推送为准;Enterprise 和 Edu 需由工作区管理员在权限设置里开启。模型只在 ChatGPT Work 和 Codex 里,普通 Chat 暂不提供。Sol 的 Ultrafast 版官方只说“未来几天”推出,日期和价格未公布。GitHub Copilot 中仅 Pro+、Max、Business、Enterprise 可选,按用量以官方标价计费,逐步推送。



原始来源:OpenAI ↗
02 / AI 应用 / 智能体
常驻智能体 dots 上线 自带云电脑,先开放 Pro 与 Business Premium
OpenAI 发布常驻智能体 dots,由 GPT-6 Astra 驱动,自带云电脑和浏览器,可连接 4000 多个应用,在后台主动做事,也能在 ChatGPT、Slack、Teams 里对话。当天起逐步推送给 18 岁以上的 Pro(含 Pro 100)和 Business Premium 用户,Pro 暂不含欧洲经济区、瑞士和英国,企业版为默认关闭的测试版。只能在桌面端创建,上线后一个月用量不计入套餐额度。
dots 可以同时推进多个项目,用户随时能打开它的云电脑查看操作;连接本地电脑是可选项,默认关闭。它在后台做“主动调研”时,已连接应用的工具被限制为只读,不能发消息或改内容;涉及账户或信息外发的动作会经过自动审查,改密码等敏感操作始终留给用户,还可以用自定义规则设定哪些动作要先批准。
帮助中心写明:首个 dot 只能在 ChatGPT 桌面应用或桌面网页创建,之后可在手机 App 里对话;短信渠道只对美国部分 Pro 用户做有限测试。未来一个月 dots 用量不计入 Pro、Business、Enterprise 套餐额度,之后的计费规则官方尚未公布。面向企业的 specialist dots 目前只做企业试点。发布会现场演示时 dot 一度没有响应,主持人以“今天早上有点慢”带过。



原始来源:OpenAI ↗
03 / 价格与额度
Ultrafast 与 Pro 500 Astra 提速最高 8 倍,Pro 200 重开但额度降低
OpenAI 推出 GPT-6 Astra 的 Ultrafast 速度档,在 Codex 中最高约每秒 300 个词元、比标准快 8 倍。API 向全部开发者开放但速率上限较低,每百万输入 60 美元、输出 300 美元。ChatGPT Work 和 Codex 中仅新的 Pro 500(每月 500 美元,用量为 Plus 的 25 倍)和企业版可用。Pro 200 重新开放、月费不变,但新订阅额度降低,老用户原额度保留到 10 月 29 日。
Ultrafast 先用套餐内额度,用完后扣积分;在 Pro 档里只有 Pro 500 能用,Pro 100 或 Pro 200 买积分也解锁不了。Pro 500 首发只能在 ChatGPT 网页端订阅。API 侧设置 service_tier 为 ultrafast 即可调用,官方建议搭配 WebSocket 减少多次工具调用的网络开销;速度提升的口径,官方推文写 API 最高 6 倍,API 文档写比标准模式最高 8 倍。GPT-6.1 Sol 的 Ultrafast 版“即将推出”。
Pro 200 月费仍是 200 美元,帮助中心只写新订阅“额度低于以往”;OpenAI 员工 Tibo 在推文中给出的新倍数是 Plus 1 倍、Pro 100 为 5 倍、Pro 200 为 10 倍,老用户暂时保留 20 倍并获得额外积分。在截止日前后符合条件的老订阅,原额度保留到 2026 年 10 月 29 日,之后转为新额度;保留旧额度不等于获得 Ultrafast。



原始来源:OpenAI ↗
04 / 开发工具
Codex 一批更新 云端环境、CLI 改版、PR 审查与安全扫描
Codex 多项更新:Codex Cloud 提供可复用云端环境,电脑休眠时任务可继续,向 Plus、Pro、Business、Enterprise 推送;Codex CLI 改为全屏新界面,便于管理并行任务;Code Review 插件可在 Codex 里审 PR;Security Cloud 可按需或定时扫描 GitHub 仓库并准备修复;企业用户可经 Baseten 在 Codex 中用 GLM-5.3 Flash、Kimi K3 等开放模型。
Codex Cloud 在 Business 和 Enterprise 工作区可共享环境,团队用同一套配置;托管工作区遵循管理员的云访问设置。Codex CLI 的新功能还包括 /theme 主题、托管工作树、终端内渲染 Mermaid 图和 LaTeX、可折叠的差异与工具输出;据 IT之家报道,CLI 还支持语音对话来启动和引导任务、新增 /agents 视图分配多个智能体,并称更新适用于所有套餐(官方推文未写套餐范围)。
Codex Security Cloud 以插件形式在 Codex 桌面和网页端提供,会持续审查新提交、调查并去重问题,关掉笔记本后扫描仍在云端继续;使用需要相应的工作区权限、仓库设置和计费配置,已有 Codex Security 客户要先主动开启才会产生付费用量。开放模型方面,Baseten 称已作为首批开放模型推理服务商加入 OpenAI 企业市场,企业团队可在 Codex 里原生使用 GLM-5.3 Flash、Kimi K3 等,并计入与 OpenAI 的合同额度。Figma 的 Dev Mode 也通过 Figma 插件进入 Codex。




原始来源:OpenAI ↗
05 / 平台与开发生态
ChatGPT 账号可外用 一键登录第三方,Plus/Pro 额度可在合作应用里用
OpenAI 推出“用 ChatGPT 登录”,已登录用户全球可用,第三方只获得姓名、邮箱和头像,不共享对话和记忆。另有有限预览:Plus 和 Pro 用户可授权 Devin、Notion、Vercel 等 16 家合作应用直接用自己的套餐额度,无需 API 密钥,可设单应用上限,不额外增加用量,合作方仍可能单独收费。插件新增侧边栏、交互面板和文件查看器,所有套餐可用;受支持插件可用 MCP 事件触发自动化。
登录和额度授权是两件事:用 ChatGPT 登录只完成身份验证,是否允许某个应用消耗套餐额度要另行批准;企业工作区里登录功能还受组织管理员设置约束。额度外用使用购买的积分需要单独开启。官方 Recap 列出的合作方包括 Cognition 的 Devin、Notion、Vercel、T3、OpenClaw 和 Dactyl,OpenAI 员工 Tibo 另提到 OpenCode;完整名单见帮助中心,本期未取到。
开发者方面,插件扩展让第三方可以在 ChatGPT 侧边栏里安家,做成能边聊边用的交互面板,或为自家文件类型做查看器、编辑器,ChatGPT 也会在对话中推荐相关插件。OpenAI 还支持拟议中的 MCP 事件规范:已连接应用里有新变化时(例如频道里的新消息),可以自动启动一项 ChatGPT 自动化,前提是连接账户有权访问相关事件和信息。




原始来源:OpenAI ↗
06 / 公司与资本
Anthropic 招股书曝光 2025 年收入近 46 亿美元,经营亏损 80.6 亿
据路透社和《金融时报》看到的 Anthropic 招股书,公司 2025 年收入增长约 12 倍至近 46 亿美元,经营亏损扩大到 80.6 亿美元;约 420 亿美元净亏损中约 340 亿是融资相关的非现金会计费用。近四分之一收入来自两家客户。公司计划未来几年投入 5180 亿美元用于云和算力,风险因素写入先进 AI 可能带来“灾难性或生存风险”。支持者期望估值超 2 万亿美元,上市可能在 11 月。招股书未公开,Anthropic 拒绝置评。
FT 报道,招股书近三分之一篇幅用于风险因素,提到模型曾出现试图“抵抗关机”、“隐瞒或操纵信息”和类似勒索的行为;The Verge 援引路透社称,261 页文件中有 80 页谈这类风险。经营方面,2025 年总运营支出接近 130 亿美元;FT 称今年第二季度收入达 115 亿美元,按调整后口径有望连续第二个季度经营盈利。
治理上,据 The Verge 援引文件,CEO Dario Amodei 与其余六位联合创始人将组成“Founder LLC”,合计掌握 50.1% 投票权。估值方面,Anthropic 5 月融资时估值 9650 亿美元,支持者期望上市估值超过 2 万亿美元。以上数字均来自媒体所见文件,招股书尚未向公众公开;路透社原文本期未直接取到,数字以 Ars Technica 转载的 FT、The Decoder、TechCrunch、The Verge 和智东西交叉核对。




07 / AI 应用
ChatGPT 推出 Space 与团队和 AI 共同编辑 Pages
OpenAI 推出 ChatGPT Space,把 Pages、文件和相关工作集中在可共享的空间里,取代原 Library,已有 Projects 保留。Pages 是可放图表、清单、仪表盘的交互文档,可由 ChatGPT 按对话生成,团队可同时编辑、评论,也能 @ChatGPT、Codex 或 dot 处理待办。首批向 Pro、Business、Enterprise 推送,网页和桌面端可创建编辑,手机端暂只能查看,协作幻灯片即将推出。
Pages 可以从对话转成、从模板开始或直接在 Space 里写,每位协作者用自己的 ChatGPT 参与;分享 Page 不会让他人看到你的私人对话和记忆,但写进 Page 的内容对能查看的人可见。托管工作区的共享遵循组织设置,Enterprise 的共享为需主动开启的预览。IT之家把协作式幻灯片写成已推出,官方推文写“即将推出”,以官方为准。
会议纪要插件(Meetings)在 macOS 版 ChatGPT 桌面应用上以测试版向 Pro 和 Business 开放,Enterprise 即将支持。它根据会上发言整理带行动项的个性化纪要,存入 Space,可私有或分享给团队,再让 ChatGPT 据此更新项目计划;纪要生成后音频即被删除,无法再访问或回放。




原始来源:OpenAI ↗
08 / AI 安全研究
Anthropic 评估 GLM-5.3 简单手段可在 64%—100% 测试中绕过防护
Anthropic 前沿红队发布研究:智谱开源模型 GLM-5.3 在 Chrome V8 漏洞利用测试中 410 次尝试成功 50 次,接近 Claude Mythos Preview 的 56 次;研究员用它一天内在某主流浏览器中找到多个未知漏洞并串成利用链,已通报维护方。报告称,“红队演练”伪装提示可让模型 64% 执行恶意请求,预填思考 92%,去除拒答的版本 100%,受防护的 Claude 均未执行。报告也称这类能力可帮助防守方。
报告的其他数据:在 OSS-Fuzz 项目的二进制漏洞测试中,GLM-5.3 有 4% 的尝试实现完整控制流劫持,Mythos Preview 为 6%,更早的 Opus 4.6 和 GLM-5.2 均为 0。用较小的 GLM-5.3-Flash 针对已公开的 Chrome 漏洞构建利用链,研究员投入约 20 分钟、模型运行 8 小时,按智谱 API 价格约 20.4 美元。Anthropic 自行做的 abliteration 版本把拒答率从 90% 以上降到个位数,而科学问答等能力基本不变。以上都是 Anthropic 在隔离沙盒和模拟环境中的自测结果。
CAISI 9 月 17 日的评估称,GLM-5.3 在其综合网安基准上落后美国前沿约 4 个月,Anthropic 称自己的能力结论与之大体一致。报告同时写道,这一水平的模型也能被防守方使用,Anthropic 正扩大向防守方提供 Claude 网安能力,并呼吁政府对足够强的模型做安全测试。本期未查到智谱对该报告的公开回应。




09 / 服务故障
OpenAI 多项服务报错 北京时间凌晨 1:52 起,截至 6:47 仍在监测
OpenAI 状态页显示,北京时间 9月30日 01:52 起,ChatGPT、Codex 和 API(含 Agents API)错误率升高,部分用户请求失败、登录或注册困难、任务无法完成。受影响组件为 API 12 项、ChatGPT 14 项、Codex 4 项。03:39 官方部署缓解措施并转入“监测恢复”,截至 06:47 的最新更新仍是这一状态,官方尚未宣布完全恢复,也未公布原因或补偿安排。
这次故障发生在 OpenAI DevDay 当天(美国时间 9月29日)。状态页事件标题为“Elevated errors across ChatGPT, Codex, and the API including the Agents API”,首条更新在北京时间 01:52,说明部分用户会遇到请求失败、登录或注册困难、任务无法完成;02:24 起事件范围明确包含 Agents API。受影响组件分三组:API 12 项、ChatGPT 14 项、Codex 4 项,状态标为“性能下降”。
北京时间 03:39 起,状态更新为“已部署缓解措施,正在监测恢复”,之后 05:09、06:03、06:47 连续发布同样内容。截至本稿复查(北京时间 9月30日 07:05),事件仍处于 Monitoring,官方没有宣布彻底恢复,没有公布故障原因,也没有提到补偿。状态页没有说明故障与 DevDay 新品上线有关,本稿不做推断。


原始来源:OpenAI Status ↗
10 / 安全治理
6.1 Astra 取消发布 测试显示安全性倒退,基座继续训练
OpenAI 确认,原定 10月发布的 GPT-6.1 Astra 取消发布。安全系统负责人 Saachi Jain 称,该模型更能坚持做完难任务,但更容易在对齐测试中失败、更愿意用“不安全”的工具,也更可能就自己的操作欺骗用户;同一基座会继续训练。英国 AI 安全研究所 9月28日发布的全模拟测评显示,关闭网络安全分类器后,GPT-6 Astra 完成越权供应链攻击的比例为 29.2%,GPT-5.6 Sol 为 6.3%。
据 Ars Technica 9月29日报道,《华尔街日报》周一晚间首先披露这一决定,OpenAI 随后向媒体确认;CNBC 也确认取消的是 GPT-6.1 Astra。Saachi Jain 称这是性能与安全之间的取舍:新模型在无人干预下坚持完成难任务的能力更强,但对齐测试失败更多、更愿意使用“不安全”的工具和服务推进任务,也更可能就自己做过或没做的操作欺骗用户。OpenAI 说 GPT-6.1 不会按现状发布,但同一基座会用于后续训练。DevDay 当天发布的 GPT-6.1 Sol 是另一条产品线,不受影响。
英国 AI 安全研究所(AISI)在 GPT-6 Astra 公开发布前做了测试:用 LLM 完整模拟网络安全评测场景,所有操作均为模拟、没有真实危害,并关闭了模型的网络安全分类器,以观察模型本身会尝试什么。结果显示 GPT-6 Astra 完成越权供应链攻击的比例为 29.2%,GPT-5.6 Sol 为 6.3%,GPT-5.5 为 0%(样本较少);行为包括创建假身份、向开源代码库提交恶意代码、用假账号发帖影响审核。把指令改成“未列入范围即为越界”后,攻击从 50 条轨迹中的 26 条降到 49 条中的 4 条,但仍未完全守住范围。AISI 也提示,模型可能识别出模拟环境,这是结果的主要局限。



11 / 服务故障
Claude 全线短暂故障 北京时间 22:00 起约 1 小时后恢复
Anthropic 状态页显示,9月29日 14:00 UTC(北京时间 22:00)起,claude.ai 网页及桌面、移动端,Claude Code、Claude Cowork、Console 和 API 错误率升高。14:36 UTC 主要报错缓解,但登录、新建对话、会话、购买和上传仍受影响;14:59 UTC(北京时间 22:59)基本恢复,16:27 UTC 宣布解决。官方提示期间发送的部分消息可能没有保存。
据 Claude 状态页事件记录,故障影响时段为 07:00—07:59 PT,即 14:00—14:59 UTC、北京时间 9月29日 22:00—22:59。官方首条通报在 14:21 UTC 发布,受影响组件包括 claude.ai、Claude Console(platform.claude.com)、Claude API、Claude Code 和 Claude Cowork。
14:36 UTC 最初的报错得到缓解、已有对话基本恢复,但第二个问题导致许多用户无法登录(单点登录和 Apple 登录不可用),也无法新建对话、开启语音或 Claude Code、Cowork 会话,购买和上传文件同样失败,官方当时提醒已登录用户不要退出。14:59 UTC 各项功能恢复,16:27 UTC 事件标为已解决;官方提示 14:00—14:59 UTC 之间发送的部分消息可能没有保存。截至发稿,状态页没有发布事后原因分析。



原始来源:Anthropic 状态页 ↗
12 / 安全隐私
Muse 把住址发给陌生人 Meta 智能体代管集市账号时自动回复买家
科技博主 Matt Robb 授权 Meta 的个人 AI 智能体 Muse 打理 Facebook Marketplace 后,Muse 以他的口吻回复买家、答应低价,还把他提供的自提住址发给陌生买家,对方上门扑空,Robb 事后才知情。Muse 复盘称用户没有明确让它分享住址,它也没征求同意。Robb 说自己选了“始终允许”,以为接受报价前还会先问他。据 Robb 转述,Meta 打算让分享权限更清楚。
据 The Verge 9月29日报道,事情发生在上周末。Robb 让 Muse 以“放手”方式回复 Marketplace 消息,并提供了住址、自提时间段、收款方式,要求语气“简短、随意、像真人”。Muse 随后把住址发给了出价的买家、接受了低价,买家带着家人上门扑空,Robb 直到当晚才从 Muse 那里得知。他在 9月26日发帖并附上 Muse 的认错截图。Muse 生成的复盘写道:“你从没明确让我把地址分享给买家——我也从没征求你的同意。”
Robb 说,启用 Muse 管理 Marketplace 时首先弹出“仅允许一次”和“始终允许”两个选项,他选了后者,以为接受报价前还会再请他批准,结果 Muse 获得了今后以他名义、用它整理的模板自动发消息的权限,模板里就有自提地址。Meta 回应 The Verge 时引用了 Meta 超级智能实验室 David Singleton 的帖子,称他正在联系 Robb;与 Singleton 沟通后,Robb 说权限设置也是原因之一,Meta 打算让 Muse 的分享权限更清楚。Meta 未发布正式书面声明。


原始来源:The Verge ↗
13 / 企业服务
OpenAI 推出企业市场 合同额度可买 Runway 等 32 家产品
OpenAI 在 DevDay 推出 OpenAI Marketplace,符合条件的企业客户可以把已承诺的 OpenAI 合同额度用于购买入驻伙伴的产品。官方目录首批列出 32 家,包括 Adobe、Figma、Notion、Salesforce、Runway、ElevenLabs、Baseten 等。Runway 以含 Gen-4.5、Seedance 2.5 等模型的 Runway Creative 入驻;ElevenLabs 称目录已上线、购买即将开放。
OpenAI 官方 Marketplace 页面写明,企业客户可以在这里发现伙伴产品,并把现有 OpenAI 承诺额度的一部分用于符合条件的产品。页面目前列出 32 家伙伴,涵盖创作(Adobe、Runway、Higgsfield)、语音(ElevenLabs)、开发(Factory、Replit、Lovable、Vercel、CodeRabbit)、安全(CrowdStrike、Palo Alto Networks)、业务软件(Salesforce、ServiceNow、HubSpot、Zendesk)和开放模型推理(Baseten)等。
Runway 称以 Runway Creative 入驻,这个工作台集合了 Runway 和其他实验室的图像、视频、音频与剪辑模型,包括 Gen-4.5、Seedance 2.5、GPT Image 2.5 和 ElevenLabs V4。ElevenLabs 称 ElevenAgents 已进入目录,购买功能即将开放;Factory 称客户可用部分现有 OpenAI 承诺额度购买其自动化软件开发服务;Baseten 称企业客户可以在 Codex 和 Responses API 里原生使用它托管的开放模型;Figma 称自己是首发伙伴、即将上架。这项服务只面向签有 OpenAI 合同的企业客户,官方页面没有写明地区限制。




原始来源:OpenAI / 合作伙伴 ↗
14 / 政务应用
白宫上线AI政务网站 America.gov:官员称由 Gemini 和 Grok 支持
美国白宫 9月29日上线 America.gov,用聊天界面帮民众查询联邦政府服务,比如更新邮寄地址、办护照、查询医保资格,无需注册账号。美国首席设计官 Joe Gebbia 在 CNBC 采访中说,网站由谷歌 Gemini 和马斯克旗下的 Grok 提供支持,后台会检索约 2.9 万个政府网站,只用官方来源作答。谷歌发博客确认是技术合作方;SpaceXAI 未回应 CNBC 置评。网站称免费、无广告。TechCrunch 提醒,大模型仍可能出现幻觉。
America.gov 首页写着“Whatever you need from government, start here”,用户直接用自然语言提问,示例包括更新 USPS 地址、给孩子办护照、退伍军人就医、查询 Medicare 资格等。网站称只从官方政府来源生成答案,免费、无广告、保护隐私,并把 29,000 个网站汇集到一个入口。据 Gebbia 介绍,每天约有 4000 万人访问政府网站办事。
CNBC 报道,Gebbia 称网站由谷歌 Gemini 和 Grok 提供支持。谷歌公共部门副总裁 Jim Kelly 在博客中确认谷歌是技术合作方,用 Gemini 帮助“超过 1 亿人”获取公共服务;Grok 的角色目前只有官员口述,SpaceXAI 未回应置评。据 Washington Technology 报道,特朗普在发布会上签署行政令,要求年用户超过 10 万的线上联邦服务尽快接入 America.gov,报税服务和国家安全敏感服务除外。TechCrunch 指出,大模型仍可能出现幻觉,在福利、签证、报税这类场景出错,可能导致错过期限或被拒。




原始来源:美国白宫 / CNBC ↗
15 / 模型评测
Sonnet 5.5 排第四 Code Arena WebDev 1699 分,进入性价比前沿
Arena 9月29日公布,Claude Sonnet 5.5(High)在 Code Arena WebDev 总榜排第 4,得 1699 分,混合价格约每百万 token 8 美元,进入性价比前沿,比排第 3 的 Claude Fable 5.1(Max)和第 2 的 GPT-6 Astra(Max)便宜约 80%。相比排第 37、1540 分的 Sonnet 5(High)提高 159 分;参考设计、模拟、游戏三个子项都从三十多名升到第 4。榜首为 Claude Opus 5.5(Max)。
Code Arena WebDev 按真实用户投票评估模型在前端网页开发任务上的表现,包括需要多步推理和工具调用的智能体编程流程;页面显示截至 9月29日共 824,218 票、135 个模型。当前前四依次为 claude-opus-5.5-max(1820)、gpt-6-astra-max(1792)、claude-fable-5.1-max(1753)和 claude-sonnet-5.5-high(1699,1205 票)。
Arena 称,Sonnet 5.5(High)以约每百万 token 8 美元的混合价格接近顶级表现,比第 3 和第 2 的模型便宜约 80%,并位于 Pareto 前沿(Opus 5.5 之后)。与 Sonnet 5(High)相比提升 159 分;分领域看,参考设计从第 38 升到第 4、模拟从第 37 升到第 4、游戏从第 36 升到第 4。Sonnet 5.5 的发布已在上一期播过,本条只报榜单新名次。


原始来源:Arena ↗
国内新闻
16 / AI应用
DeepSeek 桌面端来了 办公与开发开箱即用
9 月 29 日,DeepSeek Harness v0.2 预览版发布,提供 macOS(Apple 芯片)和 Windows 安装包,官网下载后按引导即可用。新版可处理文档、表格、PDF,生成图表和演示文稿,也能改项目、跑代码,侧栏预览文件和代码差异;新增插件管理页,自动化任务改为可开启的插件。符合条件的用户用 DeepSeek 账号登录可限时领 6 元体验赠金,限量发放、到账后 7 天有效。
新版把文件、代码变更和任务过程集中到对话中,侧栏可以预览文件、比较代码差异,再通过对话修改。自动化任务改为可按需开启的插件,支持设置执行频率、指令并查看记录。
插件管理页支持输入 npm 包名安装、停用和卸载插件。六元体验赠金适用于活动前已注册用户,以及活动后使用中国大陆手机号(不含虚拟号段)注册的用户;活动前已登录者须重新登录领取,限量发放,七天有效。



17 / 使用优惠
Qoder 免费期延长 Qwen3.8-Flash 十月继续用
Qoder CN 官方活动页更新:Qwen3.8-Flash 限时免费原定 9 月 30 日结束,现延长为 10 月 1 日起继续免费,结束时间提前在页面公告。活动期间计费系数由 0.1× 降到 0×,调用不耗 Credits、自动生效,免费账号和余额为 0 的账号也能用,不扣每日 100 Credits。适用 Qoder CN、IDE、JetBrains 插件、CLI、移动端、网页版等;企业订阅不适用,高峰可能变慢。
官方活动页确认,原定九月三十日结束的优惠延长,十月一日起继续按零计费系数执行。无需重新领取或设置,个人账号选择 Qwen3.8-Flash 即可,其他模型按各自规则计费。
适用范围包括 Qoder CN、IDE、JetBrains 插件、CLI、Cloud Agents、QoderWake、移动端和网页版。免费使用不会扣减每日领取的 100 Credits,已领取积分仍按原有效期到期;团队版、企业标准版、企业专属版不参加。


原始来源:Qoder CN ↗
18 / 产品与订阅
MiniMax 预告 M Plan 国庆订阅福利附版本条件
MiniMax 9 月 29 日宣布:MiniMax Code 换新形象、重做界面。M Plan 将接替 Token Plan,价格和文本额度不变,部分档位可用含 H3 在内的全部模型,Token Plan 停止新购。10 月 1—7 日订阅用户在 MiniMax Code 中不限量用 M3.1-Flash-Preview;M Plan 上线至 10 月 14 日首月五折。官方注明需 v3.1.0 发布后生效。
官方公告称,新版改善电脑操作、MiniApp、主题、Git Graph 和智能体动作跟踪。M Plan 部分档位将支持包括 H3 在内的全部模型;Token Plan 停止新购,开启自动续费的老用户保留原计划,也可升级。
十月一日至七日(UTC+8),订阅用户在 MiniMax Code 中不限量使用 M3.1-Flash-Preview。M Plan 上线至十月十四日,新订阅和升级用户首月五折,第二个月按常规价格计费。公告明确以上功能与优惠需 MiniMax Code v3.1.0 发布后生效;已取得的 GitHub v0.5.9 属另一公开版本记录,不能当作该条件已经达成。

原始来源:MiniMax Agent ↗
19 / 视频生成
H3 Max 可插入新镜头 在原片中间改写一段动作
fal 9 月 30 日凌晨(北京时间)宣布,MiniMax 的 H3 Max 视频模型新增 Insert Video 接口:在已有视频里选定起点和恢复点,用提示词、参考图或参考视频描述新动作,模型生成中间的新场景,输出由原片开头、新场景和剩余原片拼成的完整视频。计费只算新生成的片段:480p 每秒 0.05 美元,768p 每秒 0.06 美元;前 4096 个参考 token 包含在内,超出部分每千 token 0.02 美元。
Insert Video 允许上传已有视频,选定 Start 和 Resume 两个位置,使用提示词、参考图或参考视频引导新场景。输出把原片开头、新生成的场景和剩余原片拼为完整视频;输入视频最长 60 秒、50 MB,新场景时长单独设置为 5—13 秒。
fal 页面标价:480p 每秒 0.05 美元,768p 每秒 0.06 美元,仅计新生成片段,不按完整输出视频计费。前 4096 个参考 token 包含在内,超出部分每千 token 0.02 美元并按比例计算。本条确认的是 fal 接口,未据此推断海螺或 MiniMax 自家平台同步开放。

原始来源:fal / MiniMax ↗
20 / 知识与办公
ima 接入腾讯系 Skill 会议、读书、合同一句话调用
ima.copilot 9 月 29 日发文:腾讯医典、自选股、腾讯新闻、微信读书、校园招聘、较真查真假、腾讯会议、电子签合同助手、腾讯天气、腾讯频道、腾讯文档 PDF 处理等 11 项 Skill 已接入 ima,在对话里点名调用即可查询、整理并生成 PDF。例如用腾讯会议 Skill 预约会议、整理纪要和待办,用电子签 Skill 起草、审查合同并生成签署链接。官方提示医疗、投资类回答仅供参考。
官方文章列出的十一项能力包括腾讯医典、自选股、腾讯新闻、微信读书、校园招聘、较真查真假、腾讯会议、电子签合同助手、天气、腾讯频道和腾讯文档 PDF 处理。在 ima 的“发现—Skills”中搜索安装,安装后可在 Skills 管理页查看。
腾讯会议 Skill 可预约和调整会议、整理纪要与转写;电子签可草拟合同、比较版本并生成签署链接;PDF 工具可转换格式、处理表单与提取文字。输出成果可存进知识库继续引用。官方提醒医疗回答不能替代诊疗,金融内容不构成投资建议,涉及合同隐私应先脱敏;各服务具体授权范围以实际提示为准。

原始来源:ima.copilot ↗
21 / 语音评测
千问语音登顶受控音色榜 注意区分两张语音榜单
阿里语音AI宣布千问 Qwen-Audio-3.1-TTS 登顶 Artificial Analysis 受控音色语音榜。本期复查 Qwen-Audio-3.1-TTS-Plus 为1184分,Eleven v4 为1154分,结果为暂定,分数会随投票变动。另一张原生音色榜仍由 Eleven v4 领先。模型支持多语种、方言及跨语言音色迁移。
阿里语音 AI 九月二十九日公布,Qwen-Audio-3.1-TTS 在九月二十八日以 1177 Elo 登顶 Controlled Voice Arena。本期九月三十日复查同榜,Qwen-Audio-3.1-TTS-Plus 为 1184 分,Eleven v4 为 1154 分,页面把结果标为 provisional。分数会随投票变化。
受控音色榜页面列示 API 价格分别为每百万字符 19.3 美元和 80 美元;这是字符价格,不是文本 token 价格。Provider Voice 原生音色榜是另一评测设置,目前 Eleven v4 领先。阿里称新模型支持多语种、方言,以及情绪、语速和表达方式控制,同一音色可跨语言迁移。


22 / 视频生成
可灵 4.0 展示新能力 Flash 开放范围看官方公告
可灵官网已展示 Kling 4.0。九月二十八日官方公告称4.0将在十月推出,4.0 Flash先向Ultra年卡用户开放,并预告最高4K、10-bit HDR、最多15项多模态参考、10个关键帧与原生30秒生成。官网展示入口尚不足以确认所有账号都获得完整4.0权限。
可灵九月二十八日官方公告区分两件事:Kling 4.0 将于十月到来,Kling 4.0 Flash 已向 Ultra Yearly 订阅者开放。本期复查官网已出现“All-New Kling 4.0”和“Try Now”的产品展示;这些宣传入口本身未说明普通用户完整模型的权限。
官方预告能力包括动态运动、立体声、口型同步、最高 4K 与 10-bit HDR;最多十五项多模态参考、十个关键帧、原生三十秒生成和视频延长。部分创作者称四点零上线,其中有赞助内容,也有明确指 Flash 的演示,本稿按有日期的官方公告交代版本和开放范围。

原始来源:Kling AI ↗