OPC 中国专业的人 让好的工作发生

OPC 中国 · AI 日报

AI日报 2026-10-06:订阅提速约50%,Beam与群聊助手

· 酷恩 · 15 条新闻 · 8 分 30 秒

15条经核对的AI新闻,覆盖模型、订阅体验、智能体、创作工具和购物场景。

2026年10月6日OPC中国AI日报,酷恩02与订阅提速约50%主题,15条新闻

本期使用AI辅助整理、AI配音与数字形象,原始素材及事实出处逐条标注。

本期目录 · 先国外,后国内
  1. Astra与Sol订阅默认速度提升
  2. Reflection预告501B模型Beam
  3. Instinct向早期用户开放群聊
  4. OpenAI分阶段推出文本水印
  5. Opus 5.5算出磁性半导体候选
  6. 开发者在旧PSP上跑通Muse
  7. ChatGPT简化自定义MCP连接
  8. ChatGPT将测试生图期间的广告
  9. HyperFrames推出剪辑应用
  10. Claude Code预览HTML计划技能
  11. Grok Bot新增更新日志
  12. 定时任务可改模型与推理
  13. Arena更新代码、工作与聊天榜
  14. 飞书提供AI页面模板中心
  15. TikTok公布AI购物助手测试

国外新闻

01 / 今日头条

Astra与Sol订阅默认速度提升

北京时间10月6日凌晨,OpenAI员工Tibo发帖称,已将GPT-6 Astra和GPT-6.1 Sol的默认速度优化到约快50%。覆盖各产品订阅和Sign in With ChatGPT合作工具,举例有OpenCode、Pi、Amp和Devin。用户不用改设置,作者在发帖时预计两小时内可感知。

北京时间10月6日1时20分,OpenAI员工Tibo发帖,称已经把GPT-6 Astra和GPT-6.1 Sol的默认速度优化到大约快50%。他写明,优化通过订阅覆盖各产品,以及使用Sign in With ChatGPT的合作方,举例包括OpenCode、Pi、Amp和Devin。用户端不需要改动,他在发帖时预计接下来两小时内可以感觉到。

帖文以Day 1开头,并引用他10月4日的说明:未来28天,每天要么为大多数Codex或工作用户推出一项明确改进,要么做一次完整重置。这次写出的范围是订阅产品和登录合作工具,没有宣布全部付费API提速。

原始发布素材
原始发布素材

原始来源:OpenAI ↗

02 / 国外AI

Reflection预告501B模型Beam

10月5日,Reflection博客介绍首个开放权重模型Beam。它是稀疏混合专家模型,总参数501B、激活23B,面向编程、推理和智能体。模型仍在最终红队测试中,早期访问采用候补名单。权重、技术报告、模型卡和开发材料计划本月以Apache 2.0发布,目前尚未公开。博客把较低推理计算表述为估算。

Reflection在10月5日的博客介绍首个开放权重模型Beam。这是面向编程、推理和智能体的稀疏混合专家文本模型,总参数501B,每个词元激活23B。博客称,预训练使用23.8万亿词元;强化学习在10500块NVIDIA GB300上训练四周,生成超过1亿次推演。文中列出多项编程、终端、推理和工具调用分数,并称高阶推理基准上的成绩接近GLM-5.2,推理计算大约少3到4倍;原始能力上,Kimi K3等模型仍然领先。

较低计算量是团队估算:按激活参数和平均生成词元估算前向计算,不含提示预填充、与上下文相关的注意力以及服务开销,不能代替实测推理价格。Beam仍在做最终红队测试和评测,早期使用需登记候补。权重、技术报告、模型卡和开发者材料计划本月稍后以Apache 2.0发布,目前尚未公开。

原始发布素材
原始发布素材

原始来源:Reflection ↗

03 / 国外AI

Instinct向早期用户开放群聊

10月5日,Noah Shinn宣布Instinct向早期用户开放群聊。群内会新增一个为整组服务的Instinct,朋友没有账号也能一起参与。个人Instinct连接群组前会先征求同意,用户可选择信任对象并随时取消。群组不能直接访问个人账户。新成员加入后,待发回复会等你重新授权。现已覆盖早期用户,很快会向所有人开放。

10月5日17时28分(协调世界时),Noah Shinn发帖称,早期访问用户从当天起可以把Instinct加入群聊。群里会加入一个新的Instinct,为整个群组工作。朋友即使没有Instinct账号也能参与。帖文举例包括周末出行、室友后勤、开售后购票并分摊费用、梦幻联赛、拼车和感恩节安排。

个人Instinct在连接群组Instinct之前会先询问。用户选择信任哪些群,也可以随时取消信任。群组Instinct不能直接访问个人账户,分享信息或采取行动前,由个人Instinct检查权限。有新成员加入时,个人Instinct尚未发出的回复会先暂停,直到用户同意向扩大后的群组分享。功能已向全部早期用户开放,并称很快向所有人推出。想参加这份早期访问,可以向自己的Instinct申请列入名单。

原始演示画面 · 静音
原始演示画面 · 静音

原始来源:Instinct / Noah Shinn ↗

04 / 国外AI

OpenAI分阶段推出文本水印

OpenAI于10月5日说明欧盟文本来源规则做法。即日起,全球API客户可对部分模型自愿打开文本水印,默认仍然关闭。未来数周,欧盟符合条件的ChatGPT和Codex文本会加入不可见水印,覆盖欧盟各档订阅,发布时不做全球默认。检测器即日起接受申请,初期不向公众开放。标记不能证明真伪,改写或翻译会削弱信号。

OpenAI于10月5日发表文章,说明欧盟人工智能法案要求生成文本能够以机器可读方式识别。其文本水印技术名为textGrain,在用词中加入不可见统计信号。即日起,全球API客户可对部分模型自愿打开水印,接口默认关闭。未来数周,欧盟符合条件的ChatGPT和Codex用户、各档订阅的文本输出会加入不可见水印。发布时不设为全球默认。公司还在与云伙伴合作,使经由其服务获得的模型输出也能在数周内使用水印。

检测器从10月5日起接受申请,初期按个案提供给获批研究者和专业机构,用于评估和改进,暂不对公众开放。工具只报告是否检测到OpenAI水印,不识别用户,也不展示提示或对话。文章给出的测试包括:400个词元的段落里,把10%的词换成同义词,检出率从约92%降到66%,换掉25%则降到17%。在用于评估Astra的多项基准上,加水印前后没有看到有意义的性能差别。水印不能衡量人类贡献,不能确定归属、责任或使用者,也不能证明内容准确。没有检出,也不等于人类原创。图片和音频的公开核验继续可用。

原始发布素材
原始发布素材
原始发布素材
原始发布素材

原始来源:OpenAI ↗

05 / 国外AI

Opus 5.5算出磁性半导体候选

Vals于10月4日介绍,Claude Opus 5.5智能体通过计算提出两种室温磁性半导体候选。新化合物YBaMnFeO5尚待合成验证;KV[Cr(CN)6]早在1999年已制得,这次补充了电子性质与自旋窗口计算。关键自旋性质仍需实验测量,研究目标面向下一代存储。

10月4日,Geby Jaff在Vals博客写道,一组Claude Opus 5.5智能体用密度泛函计算寻找室温反铁磁半导体。计算同时使用较快的PBE+U和通常更准确的HSE06,带隙与自旋窗口取自后者。新设计的YBaMnFeO5含钇、钡、锰、铁和氧。作者检索后认为,它尚未被制成,也未被提出作为这类磁体。HSE06给出2.35电子伏带隙,空穴窗口1.0电子伏,电子窗口1.4电子伏。模拟中的磁性大约保持到420K,对照已知磁体校正后约490K。锰和铁需要完美棋盘排列,约在950K变成无序;这类氧化物的合成温度约900至1300摄氏度,常规路线很可能得到打乱晶体,从而失去自旋分选。

另一则是1999年已经合成的KV[Cr(CN)6],与普鲁士蓝同族。当年化学家测得样品磁有序保持到376K,加热后为365K。新计算针对完美干燥晶体,带隙约2.1电子伏,空穴窗口2.6电子伏,电子窗口1.6电子伏。1999年样品是含水粉末,净磁矩为每个化学式0.125玻尔磁子。HSE06认为自旋分选仍在,PBE+U认为空穴窗口缩小一半以上。带隙和自旋分选都还没有测量。作者把输入、输出、复核代码和已知限制放在github.com/spicylemonade/compensated-magnet-ledger。文章讨论的是反铁磁半导体计算候选,不是室温超导。

原始发布素材
原始发布素材

原始来源:Vals / 科研团队 ↗

06 / 国外AI

开发者在旧PSP上跑通Muse

10月4日,开发者Robert Soriano发帖,称家里一台放了超过15年的PSP跑起了Muse。他让智能体把小工具客户端用C语言改写,从而在PSP上原生运行。按住R键,对着内置麦克风说话,Muse作出回答,并由OpenAI提供声音。这是一次个人演示,原文没有给出安装包,也不能把它看成正式发布的PSP客户端。

10月4日16时11分(协调世界时),开发者Robert Soriano发帖演示,家里一台放了超过15年的PSP跑起了Muse。他让智能体把小工具客户端移植成C语言,使它在PSP上原生运行。按住R,对着内置麦克风说话,Muse作出回答,声音由OpenAI生成。帖文点名了Muse和alexandr_wang,并附有一段竖屏演示视频。

这次展示的是他本人完成的客户端移植。原文没有提供安装包或适用固件,也没有写成面向所有人发布的正式版本。

原始演示画面 · 静音
原始演示画面 · 静音

原始来源:Robert Soriano / Muse ↗

07 / 国外AI

ChatGPT简化自定义MCP连接

OpenAI的Max Stoiber于10月5日发帖称,ChatGPT已去掉连接自定义MCP服务器前必须打开开发者模式的开关。现在所有用户都可以从插件进入添加,再选择创建自定义MCP服务器来完成连接。帖文给出的是入口变化,并配有开发者模式开关与新建菜单的界面对比图。使用时按连接界面完成所需授权。

10月5日,OpenAI的Max Stoiber发帖说明,ChatGPT连接自定义MCP服务器时,不必再先打开开发者模式。他写道,所有用户现在都可以从插件进入添加,再创建自定义MCP服务器。

帖文配图对比了原先的开发者模式开关,以及之后菜单中的创建自定义MCP服务器选项。这次说的是添加入口少了一次切换。帖文没有宣布工具权限、账号授权或安全检查被取消。

原始发布素材
原始发布素材

原始来源:OpenAI / Max Stoiber ↗

08 / 国外AI

ChatGPT将测试生图期间的广告

OpenAI于10月5日宣布,ChatGPT将测试一种新的视觉广告。测试放在生成图片的过程中,广告会清楚标注,并与正在生成的图片分开,不会画进用户的成图。测试本月稍晚在美国开始,先覆盖一批广告主,并未向全球开放。官方同时表示,广告不影响ChatGPT给出的回答。同期扩展了转化与归因测量集成。

OpenAI在10月5日的公告中推出新的视觉广告,并先放进ChatGPT生成图片的流程里测试。广告会单独、清楚地标出,与正在生成的图片保持分开,不会画进用户的成图。测试本月稍晚开始,范围是美国的首批广告主,不是全球开放。公告写明,广告不影响ChatGPT给出的回答。

测量方面,广告主可通过Hightouch、Tealium和LiveRamp,把既有系统中的转化数据传给ChatGPT广告,并接入多家网站与应用归因合作方。增量效果测量仍处早期,OpenAI正与Haus、Measured和WorkMagic探索基于地域的实验。符合条件的广告主可以使用否定短语;DoubleVerify和Integral Ad Science的品牌适宜性评估试点不读取私人对话。

公告引用的早期合作方结果需要按出处理解。DV Rockerbox称,WeightWatchers在ChatGPT广告上的归因获客成本,较其混合付费搜索基准低15.3%。WorkMagic称,wellness品牌Dose有统计上显著的提升,增量购买中67%来自新客户。Triple Whale称,Portland Leather来自ChatGPT广告的访客中93%是新访客。

原始发布素材
原始发布素材

原始来源:OpenAI ↗

09 / 国外AI

HyperFrames推出剪辑应用

HeyGen于10月5日发帖称,HyperFrames已经做成应用。用户描述视频后,智能体先做出第一版剪辑;之后可以在画面上圈选、把批注钉到某个词,或自己裁切。官方账号写道,它可以配合Claude Code、Codex或用户自己的智能体,完成后导出4K。官方同时介绍了数百个灵感与模板。

HeyGen在10月5日发帖说,HyperFrames已经变成一个应用。用户先描述想要的视频,智能体做出第一版剪辑,再由人指导:可以在画面上圈出内容,把评论钉到某一个词,也可以自己裁切。

帖文写明,它可以配合Claude Code、Codex或用户自己的智能体,完成后导出4K。同日HyperFrames账号介绍HyperFrames Studio时补充,人和智能体在同一条时间线上工作,在画面上绘制或评论后会做出编辑,并提供数百个灵感与模板,文末写着可以下载。

原始演示画面 · 静音
原始演示画面 · 静音

原始来源:HeyGen ↗

10 / 国外AI

Claude Code预览HTML计划技能

Anthropic的Thariq于10月5日发帖,介绍自己正在做的一项Claude Code技能,用来生成更好的HTML计划。计划使用简明语言,展示代码片段,列出问题,并做出原型。文中说,校验能减少Claude通常会遇到的失败情况。作者希望在更广泛发布前先收集反馈,因此这仍是预览,不是已经全量内置的功能。

Thariq在10月5日发帖说,他正在做一项Claude Code技能,用来把计划写成更好的HTML。计划使用简明语言,放入代码片段,提出问题,并做出原型。

帖文写到,校验可以减少Claude通常会碰到的失败情况。作者是在更广泛发布之前征求反馈,所以现阶段是预览,不是已经面向所有用户内置的功能,作者正在收集使用反馈。

原始演示画面 · 静音
原始演示画面 · 静音

原始来源:Anthropic / Thariq ↗

11 / 国外AI

Grok Bot新增更新日志

Grok工程团队成员于10月5日发帖宣布,Grok Bot已经有更新日志。日志包含自上线以来的每次发布,并写明新增、改进和修复。帖文还提供RSS,便于按程序方式跟踪后续发布,地址为x.ai的bot更新日志页。读者可以据此跟踪后续版本。通过RSS可持续订阅后续变化。

10月5日,Grok工程团队成员发帖说,Grok Bot已经有了更新日志。按帖文说明,日志收录自上线以来的每一次发布,内容分为新增、改进和修复。

帖文同时提供RSS,方便用程序跟踪后续发布。入口为https://x.ai/changelog/bot,可用于持续查看新增功能、改进和修复。

原始演示画面 · 静音
原始演示画面 · 静音

原始来源:SpaceXAI / Grok 工程团队 ↗

12 / 国外AI

定时任务可改模型与推理

OpenAI的Axel Delafosse于10月5日发帖提示,ChatGPT定时任务现在可以直接在编辑任务窗口里修改模型和推理档位。也就是说,已经创建的任务可以打开编辑窗口调整执行设置。帖文附有该窗口的界面图。它没有宣布任务配额增加,没有改写定时规则,也没有说历史任务会自动改配置。

Axel Delafosse在10月5日发帖说,ChatGPT定时任务使用的模型和推理档位,现在可以直接在Edit task编辑窗口里修改。模型和推理档位可以只改一项,也可以一起改。

帖文附有这个窗口的照片。变化是让已有任务在界面里改设置,不是自动替换全部历史任务的配置。帖文没有提到任务配额或定时规则有调整。

原始发布素材
原始发布素材

原始来源:OpenAI / Axel Delafosse ↗

13 / 国外AI

Arena更新代码、工作与聊天榜

Arena十月五日公布Agent Arena快照。Fable 5.1 Max领代码与工作,聊天第二;Sonnet 5.5 Max领聊天,代码第四、工作第五。GPT 6 Astra Max代码第二,工作与聊天均第四。Gemini 4 Argon High聊天第五,代码第十四、工作第十二。它来自真实任务净改进,属当日快照。

2026年10月5日,Arena发布Agent Arena的分类对比。Claude Fable 5.1 Max同时领先代码和工作,聊天排第二;Claude Sonnet 5.5 Max领先聊天,代码第四、工作第五。OpenAI的GPT 6 Astra Max仍在三项前四,代码第二,工作与聊天均为第四。

代码与工作的名次更接近,聊天会分开。Gemini 4 Argon High在代码排第十四、工作第十二,聊天升到第五。排名依据智能体处理全球用户所提真实任务时的追踪,衡量相对当前前沿的总体净改进。代码包括编写和调试代码、工作流自动化与数据分析;聊天包括创意写作、学习、个人问题、日常检索和媒体生成;工作包括文档、专业检索、规划与专业写作。

这张图对应的是2026年10月5日选定模型在三类任务中的比较。

原始发布素材
原始发布素材

原始来源:Arena ↗

国内新闻

14 / 国内AI

飞书提供AI页面模板中心

飞书官方社区飞行社展示了多维表格AI页面模板中心,主打“一句话搭建专属业务页面”。已经使用多维表格的团队,可以从这个入口寻找页面模板,并围绕自己的业务需求开始搭建。

飞书在官方社区飞行社展示多维表格AI页面模板中心,页面直接给出“一句话搭建专属业务页面”的使用方式,并提供进入模板中心的入口。

这条信息聚焦已经展示的功能入口:从多维表格中的业务需求出发,用自然语言开始搭建专属业务页面。官方社区首页没有注明这项入口的首次发布日期,本期不将其表述为10月6日首次上线。

原始发布素材
原始发布素材

原始来源:飞书 ↗

15 / 国内AI

TikTok公布AI购物助手测试

TikTok新闻室十月五日在纽约广告周发布文章,介绍正在打造的Agentic Commerce,起点包括Buy Direct和Shopping Assistant。购物助手理解上下文、记住需求,在多个入口的对话里说明商品、配送、尺码、库存和购买引导。公告未写开放地区或账号。官方演示标着仍在测试。

2026年10月5日,TikTok新闻室发布文章,标题为TikTok Unveils AI-Powered Updates for Advertisers,并写明正在纽约广告周公布这一批更新。购物部分称为Agentic Commerce,从Buy Direct和Shopping Assistant做起,一起合作的商务与支付平台包括Salesforce、Shopify、Shoplazza、Stripe等。

Shopping Assistant是对话式人工智能代理,负责引导用户的购物过程。它理解上下文,记住用户需求,更快找到合适商品,并做进多个TikTok接触点。一次对话里可以提供商品细节、配送、尺码、是否有货和购买方面的引导。Buy Direct是另一项应用内结账,用户可以不离开TikTok、直接向品牌购买,也可以在For You信息流里一键下单。

新闻室正文没有写出购物助手的开放国家或账号范围。官方演示画面标注Product still in testing,这是已经公布、仍在测试的体验。

原始演示画面 · 静音
原始演示画面 · 静音

原始来源:TikTok ↗

← 返回日报归档