OPC 中国 · AI 日报
AI日报 2026-10-06:订阅提速约50%,Beam与群聊助手
15条经核对的AI新闻,覆盖模型、订阅体验、智能体、创作工具和购物场景。

本期使用AI辅助整理、AI配音与数字形象,原始素材及事实出处逐条标注。
本期目录 · 先国外,后国内
国外新闻
01 / 今日头条
Astra与Sol订阅默认速度提升
北京时间10月6日凌晨,OpenAI员工Tibo发帖称,已将GPT-6 Astra和GPT-6.1 Sol的默认速度优化到约快50%。覆盖各产品订阅和Sign in With ChatGPT合作工具,举例有OpenCode、Pi、Amp和Devin。用户不用改设置,作者在发帖时预计两小时内可感知。
北京时间10月6日1时20分,OpenAI员工Tibo发帖,称已经把GPT-6 Astra和GPT-6.1 Sol的默认速度优化到大约快50%。他写明,优化通过订阅覆盖各产品,以及使用Sign in With ChatGPT的合作方,举例包括OpenCode、Pi、Amp和Devin。用户端不需要改动,他在发帖时预计接下来两小时内可以感觉到。
帖文以Day 1开头,并引用他10月4日的说明:未来28天,每天要么为大多数Codex或工作用户推出一项明确改进,要么做一次完整重置。这次写出的范围是订阅产品和登录合作工具,没有宣布全部付费API提速。

原始来源:OpenAI ↗
02 / 国外AI
Reflection预告501B模型Beam
10月5日,Reflection博客介绍首个开放权重模型Beam。它是稀疏混合专家模型,总参数501B、激活23B,面向编程、推理和智能体。模型仍在最终红队测试中,早期访问采用候补名单。权重、技术报告、模型卡和开发材料计划本月以Apache 2.0发布,目前尚未公开。博客把较低推理计算表述为估算。
Reflection在10月5日的博客介绍首个开放权重模型Beam。这是面向编程、推理和智能体的稀疏混合专家文本模型,总参数501B,每个词元激活23B。博客称,预训练使用23.8万亿词元;强化学习在10500块NVIDIA GB300上训练四周,生成超过1亿次推演。文中列出多项编程、终端、推理和工具调用分数,并称高阶推理基准上的成绩接近GLM-5.2,推理计算大约少3到4倍;原始能力上,Kimi K3等模型仍然领先。
较低计算量是团队估算:按激活参数和平均生成词元估算前向计算,不含提示预填充、与上下文相关的注意力以及服务开销,不能代替实测推理价格。Beam仍在做最终红队测试和评测,早期使用需登记候补。权重、技术报告、模型卡和开发者材料计划本月稍后以Apache 2.0发布,目前尚未公开。

原始来源:Reflection ↗
03 / 国外AI
Instinct向早期用户开放群聊
10月5日,Noah Shinn宣布Instinct向早期用户开放群聊。群内会新增一个为整组服务的Instinct,朋友没有账号也能一起参与。个人Instinct连接群组前会先征求同意,用户可选择信任对象并随时取消。群组不能直接访问个人账户。新成员加入后,待发回复会等你重新授权。现已覆盖早期用户,很快会向所有人开放。
10月5日17时28分(协调世界时),Noah Shinn发帖称,早期访问用户从当天起可以把Instinct加入群聊。群里会加入一个新的Instinct,为整个群组工作。朋友即使没有Instinct账号也能参与。帖文举例包括周末出行、室友后勤、开售后购票并分摊费用、梦幻联赛、拼车和感恩节安排。
个人Instinct在连接群组Instinct之前会先询问。用户选择信任哪些群,也可以随时取消信任。群组Instinct不能直接访问个人账户,分享信息或采取行动前,由个人Instinct检查权限。有新成员加入时,个人Instinct尚未发出的回复会先暂停,直到用户同意向扩大后的群组分享。功能已向全部早期用户开放,并称很快向所有人推出。想参加这份早期访问,可以向自己的Instinct申请列入名单。

04 / 国外AI
OpenAI分阶段推出文本水印
OpenAI于10月5日说明欧盟文本来源规则做法。即日起,全球API客户可对部分模型自愿打开文本水印,默认仍然关闭。未来数周,欧盟符合条件的ChatGPT和Codex文本会加入不可见水印,覆盖欧盟各档订阅,发布时不做全球默认。检测器即日起接受申请,初期不向公众开放。标记不能证明真伪,改写或翻译会削弱信号。
OpenAI于10月5日发表文章,说明欧盟人工智能法案要求生成文本能够以机器可读方式识别。其文本水印技术名为textGrain,在用词中加入不可见统计信号。即日起,全球API客户可对部分模型自愿打开水印,接口默认关闭。未来数周,欧盟符合条件的ChatGPT和Codex用户、各档订阅的文本输出会加入不可见水印。发布时不设为全球默认。公司还在与云伙伴合作,使经由其服务获得的模型输出也能在数周内使用水印。
检测器从10月5日起接受申请,初期按个案提供给获批研究者和专业机构,用于评估和改进,暂不对公众开放。工具只报告是否检测到OpenAI水印,不识别用户,也不展示提示或对话。文章给出的测试包括:400个词元的段落里,把10%的词换成同义词,检出率从约92%降到66%,换掉25%则降到17%。在用于评估Astra的多项基准上,加水印前后没有看到有意义的性能差别。水印不能衡量人类贡献,不能确定归属、责任或使用者,也不能证明内容准确。没有检出,也不等于人类原创。图片和音频的公开核验继续可用。


原始来源:OpenAI ↗
05 / 国外AI
Opus 5.5算出磁性半导体候选
Vals于10月4日介绍,Claude Opus 5.5智能体通过计算提出两种室温磁性半导体候选。新化合物YBaMnFeO5尚待合成验证;KV[Cr(CN)6]早在1999年已制得,这次补充了电子性质与自旋窗口计算。关键自旋性质仍需实验测量,研究目标面向下一代存储。
10月4日,Geby Jaff在Vals博客写道,一组Claude Opus 5.5智能体用密度泛函计算寻找室温反铁磁半导体。计算同时使用较快的PBE+U和通常更准确的HSE06,带隙与自旋窗口取自后者。新设计的YBaMnFeO5含钇、钡、锰、铁和氧。作者检索后认为,它尚未被制成,也未被提出作为这类磁体。HSE06给出2.35电子伏带隙,空穴窗口1.0电子伏,电子窗口1.4电子伏。模拟中的磁性大约保持到420K,对照已知磁体校正后约490K。锰和铁需要完美棋盘排列,约在950K变成无序;这类氧化物的合成温度约900至1300摄氏度,常规路线很可能得到打乱晶体,从而失去自旋分选。
另一则是1999年已经合成的KV[Cr(CN)6],与普鲁士蓝同族。当年化学家测得样品磁有序保持到376K,加热后为365K。新计算针对完美干燥晶体,带隙约2.1电子伏,空穴窗口2.6电子伏,电子窗口1.6电子伏。1999年样品是含水粉末,净磁矩为每个化学式0.125玻尔磁子。HSE06认为自旋分选仍在,PBE+U认为空穴窗口缩小一半以上。带隙和自旋分选都还没有测量。作者把输入、输出、复核代码和已知限制放在github.com/spicylemonade/compensated-magnet-ledger。文章讨论的是反铁磁半导体计算候选,不是室温超导。

原始来源:Vals / 科研团队 ↗
06 / 国外AI
开发者在旧PSP上跑通Muse
10月4日,开发者Robert Soriano发帖,称家里一台放了超过15年的PSP跑起了Muse。他让智能体把小工具客户端用C语言改写,从而在PSP上原生运行。按住R键,对着内置麦克风说话,Muse作出回答,并由OpenAI提供声音。这是一次个人演示,原文没有给出安装包,也不能把它看成正式发布的PSP客户端。
10月4日16时11分(协调世界时),开发者Robert Soriano发帖演示,家里一台放了超过15年的PSP跑起了Muse。他让智能体把小工具客户端移植成C语言,使它在PSP上原生运行。按住R,对着内置麦克风说话,Muse作出回答,声音由OpenAI生成。帖文点名了Muse和alexandr_wang,并附有一段竖屏演示视频。
这次展示的是他本人完成的客户端移植。原文没有提供安装包或适用固件,也没有写成面向所有人发布的正式版本。

07 / 国外AI
ChatGPT简化自定义MCP连接
OpenAI的Max Stoiber于10月5日发帖称,ChatGPT已去掉连接自定义MCP服务器前必须打开开发者模式的开关。现在所有用户都可以从插件进入添加,再选择创建自定义MCP服务器来完成连接。帖文给出的是入口变化,并配有开发者模式开关与新建菜单的界面对比图。使用时按连接界面完成所需授权。
10月5日,OpenAI的Max Stoiber发帖说明,ChatGPT连接自定义MCP服务器时,不必再先打开开发者模式。他写道,所有用户现在都可以从插件进入添加,再创建自定义MCP服务器。
帖文配图对比了原先的开发者模式开关,以及之后菜单中的创建自定义MCP服务器选项。这次说的是添加入口少了一次切换。帖文没有宣布工具权限、账号授权或安全检查被取消。

08 / 国外AI
ChatGPT将测试生图期间的广告
OpenAI于10月5日宣布,ChatGPT将测试一种新的视觉广告。测试放在生成图片的过程中,广告会清楚标注,并与正在生成的图片分开,不会画进用户的成图。测试本月稍晚在美国开始,先覆盖一批广告主,并未向全球开放。官方同时表示,广告不影响ChatGPT给出的回答。同期扩展了转化与归因测量集成。
OpenAI在10月5日的公告中推出新的视觉广告,并先放进ChatGPT生成图片的流程里测试。广告会单独、清楚地标出,与正在生成的图片保持分开,不会画进用户的成图。测试本月稍晚开始,范围是美国的首批广告主,不是全球开放。公告写明,广告不影响ChatGPT给出的回答。
测量方面,广告主可通过Hightouch、Tealium和LiveRamp,把既有系统中的转化数据传给ChatGPT广告,并接入多家网站与应用归因合作方。增量效果测量仍处早期,OpenAI正与Haus、Measured和WorkMagic探索基于地域的实验。符合条件的广告主可以使用否定短语;DoubleVerify和Integral Ad Science的品牌适宜性评估试点不读取私人对话。
公告引用的早期合作方结果需要按出处理解。DV Rockerbox称,WeightWatchers在ChatGPT广告上的归因获客成本,较其混合付费搜索基准低15.3%。WorkMagic称,wellness品牌Dose有统计上显著的提升,增量购买中67%来自新客户。Triple Whale称,Portland Leather来自ChatGPT广告的访客中93%是新访客。

原始来源:OpenAI ↗
09 / 国外AI
HyperFrames推出剪辑应用
HeyGen于10月5日发帖称,HyperFrames已经做成应用。用户描述视频后,智能体先做出第一版剪辑;之后可以在画面上圈选、把批注钉到某个词,或自己裁切。官方账号写道,它可以配合Claude Code、Codex或用户自己的智能体,完成后导出4K。官方同时介绍了数百个灵感与模板。
HeyGen在10月5日发帖说,HyperFrames已经变成一个应用。用户先描述想要的视频,智能体做出第一版剪辑,再由人指导:可以在画面上圈出内容,把评论钉到某一个词,也可以自己裁切。
帖文写明,它可以配合Claude Code、Codex或用户自己的智能体,完成后导出4K。同日HyperFrames账号介绍HyperFrames Studio时补充,人和智能体在同一条时间线上工作,在画面上绘制或评论后会做出编辑,并提供数百个灵感与模板,文末写着可以下载。

原始来源:HeyGen ↗
10 / 国外AI
Claude Code预览HTML计划技能
Anthropic的Thariq于10月5日发帖,介绍自己正在做的一项Claude Code技能,用来生成更好的HTML计划。计划使用简明语言,展示代码片段,列出问题,并做出原型。文中说,校验能减少Claude通常会遇到的失败情况。作者希望在更广泛发布前先收集反馈,因此这仍是预览,不是已经全量内置的功能。
Thariq在10月5日发帖说,他正在做一项Claude Code技能,用来把计划写成更好的HTML。计划使用简明语言,放入代码片段,提出问题,并做出原型。
帖文写到,校验可以减少Claude通常会碰到的失败情况。作者是在更广泛发布之前征求反馈,所以现阶段是预览,不是已经面向所有用户内置的功能,作者正在收集使用反馈。

原始来源:Anthropic / Thariq ↗
11 / 国外AI
Grok Bot新增更新日志
Grok工程团队成员于10月5日发帖宣布,Grok Bot已经有更新日志。日志包含自上线以来的每次发布,并写明新增、改进和修复。帖文还提供RSS,便于按程序方式跟踪后续发布,地址为x.ai的bot更新日志页。读者可以据此跟踪后续版本。通过RSS可持续订阅后续变化。
10月5日,Grok工程团队成员发帖说,Grok Bot已经有了更新日志。按帖文说明,日志收录自上线以来的每一次发布,内容分为新增、改进和修复。
帖文同时提供RSS,方便用程序跟踪后续发布。入口为https://x.ai/changelog/bot,可用于持续查看新增功能、改进和修复。

12 / 国外AI
定时任务可改模型与推理
OpenAI的Axel Delafosse于10月5日发帖提示,ChatGPT定时任务现在可以直接在编辑任务窗口里修改模型和推理档位。也就是说,已经创建的任务可以打开编辑窗口调整执行设置。帖文附有该窗口的界面图。它没有宣布任务配额增加,没有改写定时规则,也没有说历史任务会自动改配置。
Axel Delafosse在10月5日发帖说,ChatGPT定时任务使用的模型和推理档位,现在可以直接在Edit task编辑窗口里修改。模型和推理档位可以只改一项,也可以一起改。
帖文附有这个窗口的照片。变化是让已有任务在界面里改设置,不是自动替换全部历史任务的配置。帖文没有提到任务配额或定时规则有调整。

13 / 国外AI
Arena更新代码、工作与聊天榜
Arena十月五日公布Agent Arena快照。Fable 5.1 Max领代码与工作,聊天第二;Sonnet 5.5 Max领聊天,代码第四、工作第五。GPT 6 Astra Max代码第二,工作与聊天均第四。Gemini 4 Argon High聊天第五,代码第十四、工作第十二。它来自真实任务净改进,属当日快照。
2026年10月5日,Arena发布Agent Arena的分类对比。Claude Fable 5.1 Max同时领先代码和工作,聊天排第二;Claude Sonnet 5.5 Max领先聊天,代码第四、工作第五。OpenAI的GPT 6 Astra Max仍在三项前四,代码第二,工作与聊天均为第四。
代码与工作的名次更接近,聊天会分开。Gemini 4 Argon High在代码排第十四、工作第十二,聊天升到第五。排名依据智能体处理全球用户所提真实任务时的追踪,衡量相对当前前沿的总体净改进。代码包括编写和调试代码、工作流自动化与数据分析;聊天包括创意写作、学习、个人问题、日常检索和媒体生成;工作包括文档、专业检索、规划与专业写作。
这张图对应的是2026年10月5日选定模型在三类任务中的比较。

原始来源:Arena ↗
国内新闻
14 / 国内AI
飞书提供AI页面模板中心
飞书官方社区飞行社展示了多维表格AI页面模板中心,主打“一句话搭建专属业务页面”。已经使用多维表格的团队,可以从这个入口寻找页面模板,并围绕自己的业务需求开始搭建。
飞书在官方社区飞行社展示多维表格AI页面模板中心,页面直接给出“一句话搭建专属业务页面”的使用方式,并提供进入模板中心的入口。
这条信息聚焦已经展示的功能入口:从多维表格中的业务需求出发,用自然语言开始搭建专属业务页面。官方社区首页没有注明这项入口的首次发布日期,本期不将其表述为10月6日首次上线。

原始来源:飞书 ↗
15 / 国内AI
TikTok公布AI购物助手测试
TikTok新闻室十月五日在纽约广告周发布文章,介绍正在打造的Agentic Commerce,起点包括Buy Direct和Shopping Assistant。购物助手理解上下文、记住需求,在多个入口的对话里说明商品、配送、尺码、库存和购买引导。公告未写开放地区或账号。官方演示标着仍在测试。
2026年10月5日,TikTok新闻室发布文章,标题为TikTok Unveils AI-Powered Updates for Advertisers,并写明正在纽约广告周公布这一批更新。购物部分称为Agentic Commerce,从Buy Direct和Shopping Assistant做起,一起合作的商务与支付平台包括Salesforce、Shopify、Shoplazza、Stripe等。
Shopping Assistant是对话式人工智能代理,负责引导用户的购物过程。它理解上下文,记住用户需求,更快找到合适商品,并做进多个TikTok接触点。一次对话里可以提供商品细节、配送、尺码、是否有货和购买方面的引导。Buy Direct是另一项应用内结账,用户可以不离开TikTok、直接向品牌购买,也可以在For You信息流里一键下单。
新闻室正文没有写出购物助手的开放国家或账号范围。官方演示画面标注Product still in testing,这是已经公布、仍在测试的体验。

原始来源:TikTok ↗