OPC 中国 · AI 日报
Jev决策模型、千问全模态与企业Agent实践
24条 AI 动态:先国外13条,再国内11条。聚焦 Jev 决策模型、千问全模态升级和企业 Agent 实践,附逐条解读与原始来源。

本节目由酷恩选题与编辑,使用 AI 配音、酷恩数字卡通形象,以及标明来源的官方演示、厂商配图和编辑摘要卡。活动安排与开放范围以官方实时信息为准。
本期目录 · 先国外,后国内
- Jev 热度上升:决策模型走进应用
- Grok 转写 2.0:批量与实时 API 上线
- ChatGPT 多数插件:支持连接多个账号
- Claude Code:读取 AGENTS.md
- Codex for OSS:名额增至一万
- fal 接入 H3 Max:图片加音频生成口型
- Codex 用量分析:看清任务消耗
- Codex CLI 语音:进入实验功能
- Runway 积分打通:网页与 API 共用
- SAM 3.1 上线 API:检测、分割与追踪
- ChatGPT 内置浏览器:支持 Chrome 扩展
- Grok Bot:新增语音消息
- Helix 2.5:测试陌生家庭家务
- Qwen3.8 全模态:支持百万上下文
- Qoder 限时免费:每日还可领积分
- GLM-5.3-FlashX:高速 API 上线
- MiniMax Code CLI:正式开源
- 北京词元经济方案:纳入 OPC 实训
- Kimi Code 桌面版:支持 Mac 与 Windows
- 达摩院 RADAR:腹部 CT 研究公开
- 未成年人网络保护:新规公开征求意见
- 百炼 CLI 更新:加入监控与告警
- 小鹏企业 Agent:从员工共创到业务
- 腾讯 Chatterfly:桌面端限时内测
国外新闻
01 / 模型与研究
Jev 热度上升:决策模型走进应用
TypeSafe AI 的 Jev 决策模型近期出现密集讨论,OpenRouter 测试接入与 TRAE 官方教程为开发者提供了新的上手入口。
OpenRouter 将 Jev 描述为 System One 模型:它接收应用状态和类型化问题,输出附带概率的类型化决策。这样的接口面向程序中的具体判断环节,与自由文本生成的交互形式不同。
本轮跟进的是模型发布后的平台接入、应用演示和使用实践。网络传播中的速度与成本倍数缺少统一可比条件,本期不将其写成实测结论。
02 / 语音与多模态
Grok 转写 2.0:批量与实时 API 上线
Grok Voice Transcribe 2.0 于9月18日发布,提供批量和实时语音转文字 API,支持同段音频中的多语言切换。
官方定价为批量每小时0.10美元、实时每小时0.20美元。厂商将电话、噪声和多语言环境列为优化重点;准确率与榜单成绩来自官方披露,本期未进行跨模型转写测试。

原始来源:SpaceXAI / Grok ↗
03 / 应用与办公
ChatGPT 多数插件:支持连接多个账号
ChatGPT 已为大多数插件加入多账号连接能力,用户可以把工作与个人账号的上下文带到同一个对话里。
连接入口位于插件目录。开发者也可完善账号标识,帮助用户区分不同连接;实际支持情况以各插件为准。
原始来源:OpenAI ↗
04 / 编程与智能体
Claude Code:读取 AGENTS.md
Claude Code 2.1.277 增加 AGENTS.md 兼容支持,通过内置 mod 读取项目指令。
在没有项目 CLAUDE.md 等对应指令的情况下,该能力默认采用 AGENTS.md,用户可通过 /config 调整。内置兼容能力与未来自定义 mods 的开放计划属于不同范围。
05 / 价格额度与开放
Codex for OSS:名额增至一万
Codex for OSS 将面向开源维护者的资助名额从5,000个扩大到10,000个,入选者可获得六个月100美元档 Pro 权益。
该计划需要申请和审核,申请页另列符合条件时的 API credits 与安全支持;它是一项维护者支持计划,不是向所有用户发放现金。
原始来源:OpenAI ↗
06 / 图像与视频
fal 接入 H3 Max:图片加音频生成口型
fal 平台新增 MiniMax H3 Max 口型视频接口,接受人物图片和音频输入,提供多档输出分辨率。
本次新闻是平台接入进展。实际费用取决于输出时长和分辨率,生成速度及口型质量仍需结合具体输入测试。

原始来源:fal / MiniMax ↗
07 / 编程与智能体
Codex 用量分析:看清任务消耗
Codex 新增用量分析页面,可查看任务、子代理和单独对话对总体使用量的贡献。
官方提示更新客户端后体验。此次增加的是消耗可见性,公告没有宣布额外增加额度。
原始来源:OpenAI ↗
08 / 编程与智能体
Codex CLI 语音:进入实验功能
Codex CLI 0.155.0 加入实验性语音模式,在支持的构建中可通过 /experimental 启用,再使用 /voice。
该功能提供语音输入与实时转写,属于命令行的新交互入口,与此前手机远程语音操作的演示是不同更新。
原始来源:OpenAI / Codex ↗
09 / 价格额度与开放
Runway 积分打通:网页与 API 共用
Runway 宣布购买的 credits 可在网页应用与 Runway Dev 之间共用,减少网页创作和 API 开发分别维护积分池的操作。
企业客户还可使用统一账单、用量视图及成员管理。公告中的新签约和现有企业优惠各有条件,不适用于所有个人套餐。
原始来源:Runway ↗
10 / 图像与视频
SAM 3.1 上线 API:检测、分割与追踪
SAM 3.1 已接入 Meta Model API,开发者可以通过短语在图像和视频中定位对象。
接口一次返回检测结果、像素级分割和保留对象身份的视频追踪。本次更新是 API 可用性变化,模型本身并非本次重新首发。
11 / 应用与办公
ChatGPT 内置浏览器:支持 Chrome 扩展
ChatGPT 桌面应用的内置浏览器新增 Chrome 扩展支持,可安装、固定并使用常用扩展。
产品团队同时介绍了企业集中部署和管理能力。公告未完整列出所有操作系统及套餐范围,具体可用性以客户端实际入口为准。
原始来源:OpenAI 产品团队 ↗
12 / 语音与多模态
Grok Bot:新增语音消息
Grok Bot 官方宣布新增发送 voice notes 的能力,为机器人回复增加语音形式。
短公告尚未完整说明语言、账号和地区覆盖范围,本期仅确认已公开宣布的功能变化。
原始来源:Grok Bot ↗
13 / 机器人与具身智能
Helix 2.5:测试陌生家庭家务
Figure 于9月17日公布 Helix 2.5 在30个未见家庭中的家务测试,覆盖整理客厅、折毛巾和铺床。
厂商报告称,Index 预训练使该测试中的总体成功率由9%提高到56%。这里的零样本指未见环境,系统仍经历任务适配训练,研究测试也不等同于家用产品上市。
原始来源:Figure ↗
国内新闻
14 / 模型与研究
Qwen3.8 全模态:支持百万上下文
Qwen3.8-Omni-Flash 正式上线,支持文本、图像、音频、视频输入及1M长上下文,面向音视频理解与 Agent 工作流。
官方展示了素材理解、任务规划、工具执行和结果交付等场景。Qwen-MM-Plugins 与 Qwen-Live Harness 的状态需分别看:后者链接仍标为 Coming Soon,性能提升数据来自厂商评测。

原始来源:千问大模型 ↗
15 / 价格额度与开放
Qoder 限时免费:每日还可领积分
Qoder 在9月18日10:00至9月30日23:59:59期间提供 Qwen3.8-Flash 免扣 credits 使用,覆盖国际版、中国版的新老个人用户,包括免费和试用用户。
另有每日10点后领取100通用 Credits 的活动,每笔30天有效,可累计、漏领不补。模型免费活动结束后按公示费率,每日领取活动的结束时间尚未公布。


原始来源:Qoder ↗
16 / 模型与研究
GLM-5.3-FlashX:高速 API 上线
智谱推出 GLM-5.3-FlashX,API 的 Model Key 为 GLM-5.3-FlashX,官方宣称最高输出速度可达200 tokens/s。
这是模型服务上线与推理提速公告。峰值表现受任务及服务条件影响,本期未做性能测试,也未将接口可用写成模型权重开源。

原始来源:智谱 ↗
17 / 编程与智能体
MiniMax Code CLI:正式开源
MiniMax Code CLI 正式开源,支持终端交互、无界面调用与 ACP 集成。
第一方代码默认采用 MIT 许可,具体第三方内容遵循各自许可。此次范围为 CLI,桌面客户端源码不在本次公开仓库中。
原始来源:MiniMax ↗
18 / 政策与产业
北京词元经济方案:纳入 OPC 实训
北京市经信局、北京市发改委9月18日公布《北京市加快词元经济发展的行动方案(2026—2028年)》,覆盖词元生产、质量评测、分发平台、智能体应用、软件生态和人才培养。
方案提出统筹产教融合、超级经济个体(OPC)产业实训等政策资源,支持开展模型调优、推理加速、平台运维和安全合规培训。具体支持依执行条件落实,文件本身不等于个人或企业已取得补贴资格。
原始来源:北京市经信局 / 发改委 ↗
19 / 编程与智能体
Kimi Code 桌面版:支持 Mac 与 Windows
Kimi Code 官方更新日志记录,桌面版于9月17日发布,支持 macOS 和 Windows。
客户端提供项目会话、工具调用、改动审阅、目标和计划模式、后台任务及内置浏览器等能力。它与 Kimi Work 是不同产品,本期不套用未核实的媒体套餐价格。
原始来源:Kimi ↗
20 / 模型与研究
达摩院 RADAR:腹部 CT 研究公开
阿里达摩院公开 DAMO RADAR 项目,研究面向腹部增强 CT 的通用视觉语言模型,并提供论文、代码、模型和数据相关入口。
官方描述其从临床报告学习影像与文本关系。本期将其作为研究成果介绍,不据此认定临床准入;不同资源的使用许可也需分别核对。

原始来源:阿里达摩院 ↗
21 / 政策与治理
未成年人网络保护:新规公开征求意见
国家网信办就《国务院关于保障未成年人健康安全使用网络的规定(征求意见稿)》公开征求意见,意见反馈截止10月17日。
草案涉及未成年人 AI 服务、虚拟亲属和虚拟伴侣等关系服务,以及诱导情感依赖的算法模型。针对未满16周岁用户,可能影响认知的 AI 服务被纳入拟通过未成年人模式提供的范围;当前尚是草案。
原始来源:国家网信办 ↗
22 / 编程与智能体
百炼 CLI 更新:加入监控与告警
百炼 CLI 1.27.0 增加监控、日志、告警、模型搜索及示例代码等入口,可查看调用统计、失败、延迟和用量。
这些命令帮助开发者观察服务运行状态,监控数据及告警操作仍依赖账号权限和服务配置。

原始来源:百炼 CLI 官方仓库 ↗
23 / 企业与智能体
小鹏企业 Agent:从员工共创到业务
火山引擎披露小鹏集团使用 HiAgent 等工具开展员工共创及企业 Agent 应用的案例,涉及供应链风险、入职服务、知识与创意内容等场景。
据案例中的团队介绍,供应链平台覆盖800多家供应商;AI公开赛超过2.1万人次参与、累计提交近7,000份作品。活动作品数、平台智能体数和实际生产部署并非同一口径,效果属于厂商与客户案例披露。

原始来源:火山引擎 / 小鹏 ↗
24 / 应用与办公
腾讯 Chatterfly:桌面端限时内测
腾讯 Chatterfly 官网显示产品处于限时内测,提供 macOS、Windows 下载及抢先体验申请入口,iOS 和 Android 标注为即将发布。
官网介绍语音转文字、上下文理解、意图识别、表达整理与任务协助等能力。上述状态已从官方页面读回,本期未安装测试,不将官网宣传等同于实测效果。

原始来源:腾讯 Chatterfly ↗