OPC 中国 · AI 日报
AI 日报 10月4日|Claude 5.5 新入口、开源决策模型与 H3 Max
18条已核验的AI新闻,覆盖Claude 5.5入口、Kolibri、Decision/Clef、本地决策工具、国产模型与H3 Max视频控制。

本节目使用AI配音与数字卡通形象;原始新闻素材和事实出处均在正文标注。
本期目录 · 先国外,后国内
- Antigravity 接入 Claude 5.5
- Kolibri 开放权重 兼顾部署与长上下文
- Gemini 将调整 个人账号模型权益
- Decision 2.0 一次计算回答多道决策题
- llama.cpp 新接口 让决策模型本地运行
- Clef 决策模型 增加 Ollama 本地入口
- OpenClaw 稳定分支 补上 Sol 与任务交付修复
- Muse 开发者门户 管理连接器提交与审核
- AstaBrief 8B 开放 快速生成有引用的研究报告
- Prime Inference 上线 提供开放模型推理服务
- ChatGPT 财务功能 向美国 Free、Go 扩展
- Claude Code 更新 改善长对话恢复与续接
- Cline 新增 Ling 入口 限免至 10 月 13 日
- DeepSeek Harness 预览版 尝试 Mods 兼容与插件创造
- GLM 5.3 与 Flash 进入 Cursor 模型列表
- SETA 补充训练脚本 开放四类模型训练流程
- openJiuwen xRouter 按任务复杂度选择模型
- H3 Max 视频生成 增加首、中、尾关键帧控制
国外新闻
01 / 今日头条
Antigravity 接入 Claude 5.5
官方模型表已列出 Claude Opus 5.5、Sonnet 5.5 的 Thinking 版本。
今天的头条,Antigravity 增加了 Claude Opus 五点五和 Sonnet 五点五的思考版本。官方模型表显示,两项能力面向 Ultra 和非试用 Pro 用户。使用这些套餐的开发者,可以在同一个编程工具里增加模型选择。表格还标注,旧 Claude 四点六和 GPT OSS 条目将在十一月二日移除,正在使用旧型号的工作流可以提前检查切换安排。
面向 Ultra 和非试用 Pro;Free、Plus、Enterprise 不在这两项提供范围。旧 Claude 4.6 与 GPT-OSS 条目注明 11 月 2 日移除。



原始来源:Google Antigravity ↗
02 / 开放模型
Kolibri 开放权重 兼顾部署与长上下文
10 月 3 日发布 Kolibri,约 78.1B 总参数、3.46B 激活参数,权重按 Apache 2.0 开放。
国外新闻先看开放模型。Aleph Alpha 发布 Kolibri,采用混合专家架构,总参数约七百八十一亿,每次激活约三十四点六亿参数。权重按 Apache 二点零许可开放,支持工具调用和推理强度调节。它侧重英语、德语以及行业任务;训练最长上下文是二十五万六千,最高一百万上下文需要额外配置。
侧重英语、德语和行业任务;最高 1M 上下文需额外配置,训练最长长度为 256K;不将厂商内部评测写成全能冠军。

原始来源:Aleph Alpha ↗
03 / 模型使用权益
Gemini 将调整 个人账号模型权益
Google 帮助页确认个人账号模型访问调整:免费计划仅 Flash-Lite;Plus 提供 Flash-Lite、Flash,Pro 与 Ultra 保留 Pro。
再看个人用户的模型选择。Google 帮助页确认,十月九日起,未订阅方案的 Gemini 用户只保留 Flash Lite。AI Plus 将提供 Flash Lite 和 Flash,具体生效日期以账号收到的邮件为准。AI Pro 和 Ultra 仍保留 Pro 模型。不同方案都可以为可用模型选择低、中、高思考等级;
免费用户从 10 月 9 日生效;Plus 以通知邮件日期为准。帮助页无发布日期,10 月 3 日原帖与报道为本期发现线索;不把它推断成 Argon 已全面开放。

原始来源:Google ↗
04 / 决策模型
Decision 2.0 一次计算回答多道决策题
官方宣布 Decision 2.0 系列,单次前向计算可回答同一状态的多道选择、是非或评分问题,返回概率。
除了生成长回答,模型也在专门做决策。vLLM Semantic Router 宣布 Decision 二点零系列,规模从六亿到二百七十亿参数。它把同一个状态配上多道选择、是非或评分问题,在一次前向计算中给出概率,公告称最多可处理六十四个问题。模型采用 Apache 二点零许可,并提供 Transformers 接入方式,可用于分类、审核和模型路由等固定选项任务。
Apache 2.0、Transformers 接入;系列公告称可处理 64 个问题。4B 的成绩与速度对应特定评测,不表示所有任务胜过大语言模型。


05 / 本地模型部署
llama.cpp 新接口 让决策模型本地运行
10 月 2 日官方文章宣布 /v1/systemone:给状态和固定选项,单次计算返回每个选项的概率;支持 Julia、Laya、Kev、lev、OpenJev。
这类能力也有了本地运行入口。ggml 团队在十月二日介绍了 llama 点 cpp 的 system one 接口:给定状态和选项,返回各选项的概率。它支持 Julia、Laya、Kev、lev 和 OpenJev 等模型,可使用本地量化权重。OpenJev 还支持图像输入,但采用非商用许可;
模型与量化可本地运行;OpenJev 支持图像但为非商用许可,其他支持范围各异;不能把旧 Jev 模型本身写成今天发布。

原始来源:ggml-org ↗
06 / 决策模型接入
Clef 决策模型 增加 Ollama 本地入口
Ollama 与 Cloudflare 官方新增介绍 Clef 27B、Clef Flash 9B 的本地部署入口,可做分类和请求路由。
同样在推进本地应用的,还有 Cloudflare 的 Clef。Ollama 与 Cloudflare 的新介绍,把 Clef 二百七十亿参数和 Clef Flash 九十亿参数的部署入口带到用户面前,可用于分类与请求路由。Ollama 的 system one 接口还支持图像。这次关注的是既有模型的接入和使用方式,开发者可以按官方说明尝试本地决策流程。
Clef 模型本身在前期已播,本卡只报道新接入与实践扩散;Ollama /v1/systemone 支持图像,版本标签日期较早,不称今天新发该版本。


07 / 智能体框架
OpenClaw 稳定分支 补上 Sol 与任务交付修复
10 月 2 日发布 gateway-only 扩展稳定版 2026.8.35,加入 GPT-6.1 Sol 支持,并修复子任务结果、定时输出、升级恢复等。
智能体工具方面,OpenClaw 发布 gateway only 扩展稳定版二零二六点八点三五。这是八月底版本的维护分支,加入 GPT 六点一 Sol 支持,同时改善升级恢复、子任务答案保存和定时任务的完整输出。版本说明还列出邮件监听、远程 MCP 启动等修复。
这是旧稳定分支的维护更新;当时主线最新为 2026.9.7。Sol 本身和前期榜单已播,今天只跟进兼容性及实际交付变化。

原始来源:OpenClaw ↗
08 / 智能体生态
Muse 开发者门户 管理连接器提交与审核
官方宣布连接器提交超过 3,000,新增开发者门户用于提交、管理和跟踪连接器审核。
Muse 则把连接器开发流程集中到新门户。官方说,收到的连接器提交已经超过三千个,并开放开发者门户,供开发者提交、管理连接器和跟踪审核进度。这里的三千是提交数量,具体是否通过审核要看各自状态。
3,000 是提交数量,不能写成全部已审核上线;与此前 Gadgets、Home Link 是不同事件。

原始来源:Muse ↗
09 / 开放科研模型
AstaBrief 8B 开放 快速生成有引用的研究报告
10 月 2 日开放 AstaBrief 8B 与训练数据,输入研究问题及检索片段,生成有引用的报告;Asta 中提供 Fast 模式。
研究工具方面,Ai2 开放 AstaBrief 八 B 模型和训练数据。输入研究问题与检索片段,它可以生成带引用的报告,并在 Asta 中提供 Fast 模式。官方评测中,完整流程平均五十一点一秒,Thinking 模式是一百七十八点五秒,约快三点五倍。这组评测大多在二零二五年完成,适合用来理解两种流程的速度差异。
全流程平均 51.1 秒对比 Thinking 的 178.5 秒,约 3.5 倍;评测大多在 2025 年完成,未重新对比今天的最强模型。

原始来源:Ai2 ↗
10 / 模型推理服务
Prime Inference 上线 提供开放模型推理服务
10 月 2 日推出推理服务,提供 serverless 与 reserved capacity、OpenAI 兼容接口及跨数据中心故障切换。
部署服务也有新入口。Prime Intellect 推出 Prime Inference,面向开放模型提供按需服务和预留算力,接口兼容 OpenAI 风格调用,并设计了跨数据中心故障切换。此前已经上线的 GLM 五点三端点,现在被放进完整推理平台。需要把开放模型接入现有应用的开发者,可以比较两种容量模式和具体服务条件。
早期 GLM-5.3 端点 9 月 22 日已上线;本次新增平台发布。吞吐、错误率与可用性是厂商特定负载观察,不承诺所有用户同等表现。

原始来源:Prime Intellect ↗
11 / AI 应用开放范围
ChatGPT 财务功能 向美国 Free、Go 扩展
10 月 2 日官方宣布 Finances 开始向美国 Free 和 Go 用户开放,可连接 Plaid、Experian 并基于个人财务信息回答。
日常应用方面,ChatGPT 的财务功能开始向美国 Free 和 Go 用户逐步开放。官方演示了连接 Plaid、Experian 等服务,再结合个人财务信息提问的流程。连接个人账户需要用户授权,目前的开放范围是美国。
仅美国、逐步开放;连接个人账户需授权,不表示中国用户现在可用,也不等于保证理财结果。

原始来源:OpenAI ↗
12 / 编程智能体更新
Claude Code 更新 改善长对话恢复与续接
2.1.288 修复长对话压缩、恢复上下文和超时续接;MCP 申请更多 OAuth 权限时增加重新认证提示。
编程工具最后看 Claude Code。二点一点二八八版本修复了长对话未自动压缩、恢复时丢失上下文,以及部分非交互任务超时后无法续接的问题。MCP 服务在工具调用中申请更多 OAuth 权限时,也会提示重新认证。
还修复重复 MCP 调用、退出与安装问题;具体修复按版本范围,不能推断所有长任务已稳定。

原始来源:Anthropic ↗
国内新闻
13 / 国内模型接入
Cline 新增 Ling 入口 限免至 10 月 13 日
Cline 官方宣布 Ling 3.1 Flash 已可使用并限免至 10 月 13 日,560B 总参数、25B 激活参数。
国内新闻先看模型入口。Cline 官方宣布,蚂蚁 inclusion AI 的 Ling 三点一 Flash 已可使用,并限免到十月十三日。模型总参数五千六百亿,每次激活二百五十亿参数。这次新增的是 Cline 中的调用入口,此前其他平台的接入属于较早进展。正在使用 Cline 的开发者,可以检查模型列表,并以活动页显示的额度和可用性为准。
本卡新增 Cline 入口;此前 OpenRouter/OpenCode 接入已播,不重报模型首次发布。免费活动的额度与可用性以 Cline 页面为准。

14 / 智能体工具
DeepSeek Harness 预览版 尝试 Mods 兼容与插件创造
10 月 3 日发布 dsh-v0.2.1-alpha.1:实验性 Claude Code Mods 兼容层、插件创造入口、草稿保留与 Web 自动化能力调整。
DeepSeek Harness 发布零点二点一的首个 alpha 预览版。新增实验性 Claude Code Mods 兼容层,官方说明,现阶段是验证接口能力的子集关系。插件管理页增加“让 Agent 创建插件”入口,保留草稿进入创造模式,发送需求后才执行。更新还改善会话引用和 Web 自动化,并包含扩展接口的破坏性变更,扩展开发者需要对照版本说明调整。
官方明确兼容层用于验证 API 子集,不提供完整实用兼容;有破坏性扩展接口变化。桌面版较早发布,不将 10 月 2 日转发当首发。


原始来源:DeepSeek ↗
15 / 国内编程模型接入
GLM 5.3 与 Flash 进入 Cursor 模型列表
Cursor 官方宣布 GLM 5.3 与 GLM 5.3 Flash 已可选择,并称 Max 是 CursorBench 4.0 最高分开放权重型号。
智谱模型也有新接入。Cursor 官方宣布,GLM 五点三和 GLM 五点三 Flash 已进入可选模型列表,并介绍 Max 在 CursorBench 四点零中取得开放权重型号的最高分。这是 Cursor 自身的编程评测,用户可以结合自己的代码库实际比较。
10 月 1 日 22:30 UTC 仍在窗口;榜单限定 CursorBench,不扩大成全网最强;本卡是新接入,非再次发布 GLM。

原始来源:智谱 / Cursor ↗
16 / 智能体训练
SETA 补充训练脚本 开放四类模型训练流程
研究作者宣布补充 DeepSeek-V4-Flash、GLM-5.2 LoRA、Inkling-Small、Qwen3.8-27B 的完整 GRPO/PPO 训练脚本。
训练研究方面,SETA 作者宣布补充完整的 GRPO 和 PPO 脚本,覆盖 DeepSeek V 四 Flash、GLM 五点二 LoRA、Inkling Small 和 Qwen 三点八二十七 B。项目原本就提供四千五百多个可验证终端环境,这次的新变化是把相应训练流程进一步开放。
SETA 数据与论文较早出现,本卡只报道训练脚本的新开放;4,500 多个可验证终端环境是项目规模,不能写成全部新发布。


原始来源:CAMEL-AI / SETA 团队 ↗
17 / 模型路由工具
openJiuwen xRouter 按任务复杂度选择模型
公开仓库提供本地分类器、五档复杂度、模型选择与反馈接口;Bandit 可依据任务反馈调整路由。
openJiuwen 的公开模型路由仓库,则提供本地分类器和五档任务复杂度,帮助工作流选择模型,并支持把任务反馈交给 Bandit 调整路由。我们核对到,仓库里部分远端状态、绑定和算法模块仍是骨架。
量子位 10 月 2 日发布发现线索,仓库可核;部分远端状态、绑定与算法仍是骨架。44.6% 成本下降为报道中特定 PinchBench 实验,不写成普遍节省 50% Token。

原始来源:openJiuwen ↗
18 / 视频生成能力
H3 Max 视频生成 增加首、中、尾关键帧控制
fal 官方宣布 H3 Max Reference-to-Video 可指定开始、中间和结束画面,并选择中间帧出现时刻。
最后看视频创作。fal 官方宣布,H 三 Max 的参考视频生成入口支持开始、中间和结束画面控制,还可以指定中间帧出现的时刻。用户可以加入图像或视频参考,安排镜头如何开始、展开和结束。
可加图片或视频参考;这是本次 H3 Max 入口的新控制能力,不将普通 H3、其他平台或全部套餐视为同时支持。

原始来源:MiniMax / fal ↗