OPC 中国专业的人 让好的工作发生

OPC 中国 · AI 日报

AI 日报 10月4日|Claude 5.5 新入口、开源决策模型与 H3 Max

· 酷恩 · 18 条新闻 · 7 分 42 秒

18条已核验的AI新闻,覆盖Claude 5.5入口、Kolibri、Decision/Clef、本地决策工具、国产模型与H3 Max视频控制。

OPC 中国 AI 日报:编程模型新增入口,2026年10月4日18条新闻

本节目使用AI配音与数字卡通形象;原始新闻素材和事实出处均在正文标注。

本期目录 · 先国外,后国内
  1. Antigravity 接入 Claude 5.5
  2. Kolibri 开放权重 兼顾部署与长上下文
  3. Gemini 将调整 个人账号模型权益
  4. Decision 2.0 一次计算回答多道决策题
  5. llama.cpp 新接口 让决策模型本地运行
  6. Clef 决策模型 增加 Ollama 本地入口
  7. OpenClaw 稳定分支 补上 Sol 与任务交付修复
  8. Muse 开发者门户 管理连接器提交与审核
  9. AstaBrief 8B 开放 快速生成有引用的研究报告
  10. Prime Inference 上线 提供开放模型推理服务
  11. ChatGPT 财务功能 向美国 Free、Go 扩展
  12. Claude Code 更新 改善长对话恢复与续接
  13. Cline 新增 Ling 入口 限免至 10 月 13 日
  14. DeepSeek Harness 预览版 尝试 Mods 兼容与插件创造
  15. GLM 5.3 与 Flash 进入 Cursor 模型列表
  16. SETA 补充训练脚本 开放四类模型训练流程
  17. openJiuwen xRouter 按任务复杂度选择模型
  18. H3 Max 视频生成 增加首、中、尾关键帧控制

国外新闻

01 / 今日头条

Antigravity 接入 Claude 5.5

官方模型表已列出 Claude Opus 5.5、Sonnet 5.5 的 Thinking 版本。

今天的头条,Antigravity 增加了 Claude Opus 五点五和 Sonnet 五点五的思考版本。官方模型表显示,两项能力面向 Ultra 和非试用 Pro 用户。使用这些套餐的开发者,可以在同一个编程工具里增加模型选择。表格还标注,旧 Claude 四点六和 GPT OSS 条目将在十一月二日移除,正在使用旧型号的工作流可以提前检查切换安排。

面向 Ultra 和非试用 Pro;Free、Plus、Enterprise 不在这两项提供范围。旧 Claude 4.6 与 GPT-OSS 条目注明 11 月 2 日移除。

官方原始素材 / 演示静音
官方原始素材 / 演示静音
官方原始素材 / 演示静音
官方原始素材 / 演示静音
官方原始素材 / 演示静音
官方原始素材 / 演示静音

原始来源:Google Antigravity ↗

02 / 开放模型

Kolibri 开放权重 兼顾部署与长上下文

10 月 3 日发布 Kolibri,约 78.1B 总参数、3.46B 激活参数,权重按 Apache 2.0 开放。

国外新闻先看开放模型。Aleph Alpha 发布 Kolibri,采用混合专家架构,总参数约七百八十一亿,每次激活约三十四点六亿参数。权重按 Apache 二点零许可开放,支持工具调用和推理强度调节。它侧重英语、德语以及行业任务;训练最长上下文是二十五万六千,最高一百万上下文需要额外配置。

侧重英语、德语和行业任务;最高 1M 上下文需额外配置,训练最长长度为 256K;不将厂商内部评测写成全能冠军。

官方原始素材 / 演示静音
官方原始素材 / 演示静音

原始来源:Aleph Alpha ↗

03 / 模型使用权益

Gemini 将调整 个人账号模型权益

Google 帮助页确认个人账号模型访问调整:免费计划仅 Flash-Lite;Plus 提供 Flash-Lite、Flash,Pro 与 Ultra 保留 Pro。

再看个人用户的模型选择。Google 帮助页确认,十月九日起,未订阅方案的 Gemini 用户只保留 Flash Lite。AI Plus 将提供 Flash Lite 和 Flash,具体生效日期以账号收到的邮件为准。AI Pro 和 Ultra 仍保留 Pro 模型。不同方案都可以为可用模型选择低、中、高思考等级;

免费用户从 10 月 9 日生效;Plus 以通知邮件日期为准。帮助页无发布日期,10 月 3 日原帖与报道为本期发现线索;不把它推断成 Argon 已全面开放。

官方原始素材 / 演示静音
官方原始素材 / 演示静音

原始来源:Google ↗

04 / 决策模型

Decision 2.0 一次计算回答多道决策题

官方宣布 Decision 2.0 系列,单次前向计算可回答同一状态的多道选择、是非或评分问题,返回概率。

除了生成长回答,模型也在专门做决策。vLLM Semantic Router 宣布 Decision 二点零系列,规模从六亿到二百七十亿参数。它把同一个状态配上多道选择、是非或评分问题,在一次前向计算中给出概率,公告称最多可处理六十四个问题。模型采用 Apache 二点零许可,并提供 Transformers 接入方式,可用于分类、审核和模型路由等固定选项任务。

Apache 2.0、Transformers 接入;系列公告称可处理 64 个问题。4B 的成绩与速度对应特定评测,不表示所有任务胜过大语言模型。

官方原始素材 / 演示静音
官方原始素材 / 演示静音
官方原始素材 / 演示静音
官方原始素材 / 演示静音

原始来源:vLLM Semantic Router ↗

05 / 本地模型部署

llama.cpp 新接口 让决策模型本地运行

10 月 2 日官方文章宣布 /v1/systemone:给状态和固定选项,单次计算返回每个选项的概率;支持 Julia、Laya、Kev、lev、OpenJev。

这类能力也有了本地运行入口。ggml 团队在十月二日介绍了 llama 点 cpp 的 system one 接口:给定状态和选项,返回各选项的概率。它支持 Julia、Laya、Kev、lev 和 OpenJev 等模型,可使用本地量化权重。OpenJev 还支持图像输入,但采用非商用许可;

模型与量化可本地运行;OpenJev 支持图像但为非商用许可,其他支持范围各异;不能把旧 Jev 模型本身写成今天发布。

官方原始素材 / 演示静音
官方原始素材 / 演示静音

原始来源:ggml-org ↗

06 / 决策模型接入

Clef 决策模型 增加 Ollama 本地入口

Ollama 与 Cloudflare 官方新增介绍 Clef 27B、Clef Flash 9B 的本地部署入口,可做分类和请求路由。

同样在推进本地应用的,还有 Cloudflare 的 Clef。Ollama 与 Cloudflare 的新介绍,把 Clef 二百七十亿参数和 Clef Flash 九十亿参数的部署入口带到用户面前,可用于分类与请求路由。Ollama 的 system one 接口还支持图像。这次关注的是既有模型的接入和使用方式,开发者可以按官方说明尝试本地决策流程。

Clef 模型本身在前期已播,本卡只报道新接入与实践扩散;Ollama /v1/systemone 支持图像,版本标签日期较早,不称今天新发该版本。

官方原始素材 / 演示静音
官方原始素材 / 演示静音
官方原始素材 / 演示静音
官方原始素材 / 演示静音

原始来源:Cloudflare / Ollama ↗

07 / 智能体框架

OpenClaw 稳定分支 补上 Sol 与任务交付修复

10 月 2 日发布 gateway-only 扩展稳定版 2026.8.35,加入 GPT-6.1 Sol 支持,并修复子任务结果、定时输出、升级恢复等。

智能体工具方面,OpenClaw 发布 gateway only 扩展稳定版二零二六点八点三五。这是八月底版本的维护分支,加入 GPT 六点一 Sol 支持,同时改善升级恢复、子任务答案保存和定时任务的完整输出。版本说明还列出邮件监听、远程 MCP 启动等修复。

这是旧稳定分支的维护更新;当时主线最新为 2026.9.7。Sol 本身和前期榜单已播,今天只跟进兼容性及实际交付变化。

官方原始素材 / 演示静音
官方原始素材 / 演示静音

原始来源:OpenClaw ↗

08 / 智能体生态

Muse 开发者门户 管理连接器提交与审核

官方宣布连接器提交超过 3,000,新增开发者门户用于提交、管理和跟踪连接器审核。

Muse 则把连接器开发流程集中到新门户。官方说,收到的连接器提交已经超过三千个,并开放开发者门户,供开发者提交、管理连接器和跟踪审核进度。这里的三千是提交数量,具体是否通过审核要看各自状态。

3,000 是提交数量,不能写成全部已审核上线;与此前 Gadgets、Home Link 是不同事件。

官方原始素材 / 演示静音
官方原始素材 / 演示静音

原始来源:Muse ↗

09 / 开放科研模型

AstaBrief 8B 开放 快速生成有引用的研究报告

10 月 2 日开放 AstaBrief 8B 与训练数据,输入研究问题及检索片段,生成有引用的报告;Asta 中提供 Fast 模式。

研究工具方面,Ai2 开放 AstaBrief 八 B 模型和训练数据。输入研究问题与检索片段,它可以生成带引用的报告,并在 Asta 中提供 Fast 模式。官方评测中,完整流程平均五十一点一秒,Thinking 模式是一百七十八点五秒,约快三点五倍。这组评测大多在二零二五年完成,适合用来理解两种流程的速度差异。

全流程平均 51.1 秒对比 Thinking 的 178.5 秒,约 3.5 倍;评测大多在 2025 年完成,未重新对比今天的最强模型。

官方原始素材 / 演示静音
官方原始素材 / 演示静音

原始来源:Ai2 ↗

10 / 模型推理服务

Prime Inference 上线 提供开放模型推理服务

10 月 2 日推出推理服务,提供 serverless 与 reserved capacity、OpenAI 兼容接口及跨数据中心故障切换。

部署服务也有新入口。Prime Intellect 推出 Prime Inference,面向开放模型提供按需服务和预留算力,接口兼容 OpenAI 风格调用,并设计了跨数据中心故障切换。此前已经上线的 GLM 五点三端点,现在被放进完整推理平台。需要把开放模型接入现有应用的开发者,可以比较两种容量模式和具体服务条件。

早期 GLM-5.3 端点 9 月 22 日已上线;本次新增平台发布。吞吐、错误率与可用性是厂商特定负载观察,不承诺所有用户同等表现。

官方原始素材 / 演示静音
官方原始素材 / 演示静音

原始来源:Prime Intellect ↗

11 / AI 应用开放范围

ChatGPT 财务功能 向美国 Free、Go 扩展

10 月 2 日官方宣布 Finances 开始向美国 Free 和 Go 用户开放,可连接 Plaid、Experian 并基于个人财务信息回答。

日常应用方面,ChatGPT 的财务功能开始向美国 Free 和 Go 用户逐步开放。官方演示了连接 Plaid、Experian 等服务,再结合个人财务信息提问的流程。连接个人账户需要用户授权,目前的开放范围是美国。

仅美国、逐步开放;连接个人账户需授权,不表示中国用户现在可用,也不等于保证理财结果。

官方原始素材 / 演示静音
官方原始素材 / 演示静音

原始来源:OpenAI ↗

12 / 编程智能体更新

Claude Code 更新 改善长对话恢复与续接

2.1.288 修复长对话压缩、恢复上下文和超时续接;MCP 申请更多 OAuth 权限时增加重新认证提示。

编程工具最后看 Claude Code。二点一点二八八版本修复了长对话未自动压缩、恢复时丢失上下文,以及部分非交互任务超时后无法续接的问题。MCP 服务在工具调用中申请更多 OAuth 权限时,也会提示重新认证。

还修复重复 MCP 调用、退出与安装问题;具体修复按版本范围,不能推断所有长任务已稳定。

官方原始素材 / 演示静音
官方原始素材 / 演示静音

原始来源:Anthropic ↗

国内新闻

13 / 国内模型接入

Cline 新增 Ling 入口 限免至 10 月 13 日

Cline 官方宣布 Ling 3.1 Flash 已可使用并限免至 10 月 13 日,560B 总参数、25B 激活参数。

国内新闻先看模型入口。Cline 官方宣布,蚂蚁 inclusion AI 的 Ling 三点一 Flash 已可使用,并限免到十月十三日。模型总参数五千六百亿,每次激活二百五十亿参数。这次新增的是 Cline 中的调用入口,此前其他平台的接入属于较早进展。正在使用 Cline 的开发者,可以检查模型列表,并以活动页显示的额度和可用性为准。

本卡新增 Cline 入口;此前 OpenRouter/OpenCode 接入已播,不重报模型首次发布。免费活动的额度与可用性以 Cline 页面为准。

官方原始素材 / 演示静音
官方原始素材 / 演示静音

原始来源:蚂蚁 inclusionAI / Cline ↗

14 / 智能体工具

DeepSeek Harness 预览版 尝试 Mods 兼容与插件创造

10 月 3 日发布 dsh-v0.2.1-alpha.1:实验性 Claude Code Mods 兼容层、插件创造入口、草稿保留与 Web 自动化能力调整。

DeepSeek Harness 发布零点二点一的首个 alpha 预览版。新增实验性 Claude Code Mods 兼容层,官方说明,现阶段是验证接口能力的子集关系。插件管理页增加“让 Agent 创建插件”入口,保留草稿进入创造模式,发送需求后才执行。更新还改善会话引用和 Web 自动化,并包含扩展接口的破坏性变更,扩展开发者需要对照版本说明调整。

官方明确兼容层用于验证 API 子集,不提供完整实用兼容;有破坏性扩展接口变化。桌面版较早发布,不将 10 月 2 日转发当首发。

官方原始素材 / 演示静音
官方原始素材 / 演示静音
官方原始素材 / 演示静音
官方原始素材 / 演示静音

原始来源:DeepSeek ↗

15 / 国内编程模型接入

GLM 5.3 与 Flash 进入 Cursor 模型列表

Cursor 官方宣布 GLM 5.3 与 GLM 5.3 Flash 已可选择,并称 Max 是 CursorBench 4.0 最高分开放权重型号。

智谱模型也有新接入。Cursor 官方宣布,GLM 五点三和 GLM 五点三 Flash 已进入可选模型列表,并介绍 Max 在 CursorBench 四点零中取得开放权重型号的最高分。这是 Cursor 自身的编程评测,用户可以结合自己的代码库实际比较。

10 月 1 日 22:30 UTC 仍在窗口;榜单限定 CursorBench,不扩大成全网最强;本卡是新接入,非再次发布 GLM。

官方原始素材 / 演示静音
官方原始素材 / 演示静音

原始来源:智谱 / Cursor ↗

16 / 智能体训练

SETA 补充训练脚本 开放四类模型训练流程

研究作者宣布补充 DeepSeek-V4-Flash、GLM-5.2 LoRA、Inkling-Small、Qwen3.8-27B 的完整 GRPO/PPO 训练脚本。

训练研究方面,SETA 作者宣布补充完整的 GRPO 和 PPO 脚本,覆盖 DeepSeek V 四 Flash、GLM 五点二 LoRA、Inkling Small 和 Qwen 三点八二十七 B。项目原本就提供四千五百多个可验证终端环境,这次的新变化是把相应训练流程进一步开放。

SETA 数据与论文较早出现,本卡只报道训练脚本的新开放;4,500 多个可验证终端环境是项目规模,不能写成全部新发布。

官方原始素材 / 演示静音
官方原始素材 / 演示静音
官方原始素材 / 演示静音
官方原始素材 / 演示静音

原始来源:CAMEL-AI / SETA 团队 ↗

17 / 模型路由工具

openJiuwen xRouter 按任务复杂度选择模型

公开仓库提供本地分类器、五档复杂度、模型选择与反馈接口;Bandit 可依据任务反馈调整路由。

openJiuwen 的公开模型路由仓库,则提供本地分类器和五档任务复杂度,帮助工作流选择模型,并支持把任务反馈交给 Bandit 调整路由。我们核对到,仓库里部分远端状态、绑定和算法模块仍是骨架。

量子位 10 月 2 日发布发现线索,仓库可核;部分远端状态、绑定与算法仍是骨架。44.6% 成本下降为报道中特定 PinchBench 实验,不写成普遍节省 50% Token。

官方原始素材 / 演示静音
官方原始素材 / 演示静音

原始来源:openJiuwen ↗

18 / 视频生成能力

H3 Max 视频生成 增加首、中、尾关键帧控制

fal 官方宣布 H3 Max Reference-to-Video 可指定开始、中间和结束画面,并选择中间帧出现时刻。

最后看视频创作。fal 官方宣布,H 三 Max 的参考视频生成入口支持开始、中间和结束画面控制,还可以指定中间帧出现的时刻。用户可以加入图像或视频参考,安排镜头如何开始、展开和结束。

可加图片或视频参考;这是本次 H3 Max 入口的新控制能力,不将普通 H3、其他平台或全部套餐视为同时支持。

官方原始素材 / 演示静音
官方原始素材 / 演示静音

原始来源:MiniMax / fal ↗

← 返回日报归档