OPC 中国 · AI 日报
10月7日AI日报:图像上线与开放权重
10月7日日报:Nano Banana 2.1可体验并逐步推出,EmbeddingGemma 2开放权重,Claude进入Google文件beta。另有Large 4预览、Decisions公测和智能体标准预览。本期共15条新闻,还关注本地模型推理、API用量档位,以及彭博对DeepSeek和月之暗面融资、上市计划的报道。

使用AI配音与酷恩02数字形象;原始新闻素材与各条来源链接对应。
本期目录 · 先国外,后国内
- Nano Banana 2.1 图像能力升级
- EmbeddingGemma 2 本地多模态检索
- Mistral Large 4 开放公开预览
- Decisions API 图文决策公测
- Meta 携手 Sierra 预览智能体标准
- 自动审查免费开放 后台智能体把关
- Claude 进入 Google 文件
- OpenAI API 三档 Grow 门槛降低
- Claude 云端会话 连接本地文件夹
- Claude 云端赠额 符合条件可领取
- Ling 3.1 Flash 独立评测提升
- GLM-5.3 接入 Amazon Bedrock
- Strata 本地推理 显存与内存协作
- 彭博报道 DeepSeek 融资与上市计划
- 彭博报道月之暗面 估值与上市计划
国外新闻
01 / 模型与产品
Nano Banana 2.1 图像能力升级
谷歌10月6日推出图像生成与编辑模型Nano Banana 2.1,当天可在AI Studio试用,并开始向Gemini、搜索AI模式、Flow、Stitch、Google Ads和Gemini企业平台逐步推出。
谷歌表示,2.1在视觉设计、蒙版编辑和主体一致性上全面优于前代,画面也更自然。Arena公布的当时用户偏好快照为:多图编辑第4、1431分,文生图第5、1328分,图像编辑第6、1428分;相对Nano Banana 2分别提高67分、80分和38分。分类榜中,多图编辑的商业设计与3D为第3。
OpenRouter已上线该模型,支持最多14张参考图、Google搜索接地,以及2K和4K下更干净的1:4、4:1、1:8、8:1全景比例。其标价为每张1K 0.0336美元、2K 0.0504美元、4K 0.1134美元。逐步推出并不等于所有账号同步获得。




原始来源:Google ↗
02 / 模型与产品
EmbeddingGemma 2 本地多模态检索
谷歌10月6日发布EmbeddingGemma 2,把文字、图像、音频和视频映射到同一嵌入空间,权重已可下载,企业Model Garden仍将随后推出。
模型基于Gemma 4,采用可商用的Apache 2.0许可,总参数7.4亿。文本工作负载最少约2.7亿参数,视觉编码器1.7亿、音频编码器3亿可选。借助Matryoshka表示学习,输出可从768维动态裁到512、256或128维。上下文为8K,官方称可在本地处理最多约5.5分钟音频、29张图像或58帧视频。
谷歌称,其代码评测MTEB Code从68.76升至78.68,提高9.92分。在特定量化条件下,Pixel 11 Pro的活跃内存约为纯文本191MB、完整多模态567MB。权重现已在Hugging Face和Kaggle提供。

原始来源:Google ↗
03 / 模型与产品
Mistral Large 4 开放公开预览
Mistral 10月6日开放Large 4公开预览,可在API和Studio试用。页面标价为输入每百万Token 1.36美元、输出4.18美元,权重预计本月底放出。
Mistral称,ML4是迄今最大的模型,原生多模态,总参数1万亿、激活490亿,训练数据覆盖160多种语言,包括欧盟全部官方语言。它在欧洲自有数据中心的3800块NVIDIA Grace Blackwell GPU上从零训练,公开预览也由同一基础设施提供。官方列出代码、网络安全、金融与法律等多项评测,并称在开放模型的部分企业任务中处于领先,但测试成绩不代表所有任务领先。
页面价格为输入每百万Token 1.36美元、输出4.18美元。权重计划10月底发布,目前开放的是预览API。


原始来源:Mistral ↗
04 / 模型与产品
Decisions API 图文决策公测
OpenAI 10月6日向全部开发者开放Decisions API公测。它接受文字和图像,输出判定概率、带置信度的选项或数值评分。
OpenAI表示,接口由GPT-6 Luna驱动,提供三类结果:估计一句话为真的概率,从预设选项中选择并给出置信度,或按数值范围评分。开发者已用它把请求路由到合适的模型、工具或代理,也可做标注、排序、图像比较、截图操作判断和风险标记。
官方称,该接口做决策最多比通过Responses API调用GPT-6 Luna快10倍。这一速度说明针对的是决策调用,不扩大到全部任务,也不是新的对话模型或价格调整。

原始来源:OpenAI ↗
05 / 模型与产品
Meta 携手 Sierra 预览智能体标准
Meta的Muse、Business Agents与Sierra 10月6日携多家服务及商业伙伴,预览一项让个人智能体与企业交互有共同规则的标准建设。
Meta 的 Muse、Business Agents 与 Sierra 共同预览开放标准建设,探索个人智能体如何与企业交互。参与伙伴包括 Genesys、NiCE、Decagon、Rocket、Shopify、Stripe 和 Walmart。
目前公布的是共同建设工作预览,最终协议仍待后续发布。

原始来源:Meta / Sierra ↗
06 / 模型与产品
自动审查免费开放 后台智能体把关
负责人称,用 ChatGPT 账号登录的用户可免费开启 Auto-review。它由第二智能体审查主要智能体的动作,目标是帮助防止高风险和不符合原意的操作,且不占用套餐用量。
负责人表示,Auto-review 已对通过 ChatGPT 账号登录的用户免费提供,可在设置的权限页面中开启。相比默认沙箱要求逐项批准,它让长任务运行时由第二智能体审查主要智能体的全部动作,目标是防止高风险操作,并拦住与用户最初意图不一致的动作。该功能免费,不从套餐用量中扣除。

原始来源:OpenAI ↗
07 / 模型与产品
Claude 进入 Google 文件
Claude 现可进入 Google 文档、表格和幻灯片,付费用户可试用 beta;也能从 Claude 打开或新建这些文件,修改仍需逐次批准。
Claude 现在可以在 Google 文档、表格和幻灯片中工作,这些文件也能在 Claude 里打开。在 Google Workspace 中,它位于文件旁的侧边栏,阅读当前打开的内容并就地编辑,每次修改落地前由用户批准。
在 Claude 中粘贴 Google 文件链接,或要求新建文档、表格、演示文稿,文件会在对话旁打开,供用户和 Claude 一起编辑。访问范围遵循 Google 分享权限。该功能以 beta 形式向所有付费方案开放。

原始来源:Anthropic ↗
08 / 模型与产品
OpenAI API 三档 Grow 门槛降低
OpenAI 将五个付费 API 用量档并为 Build、Launch、Grow。Grow 的累计 API 付款门槛从 1000 美元降至 500 美元,付费组织自动迁移。
OpenAI 开发者账号称,付费 API 用量档由五档调整为 Build、Launch、Grow 三档,以便更容易获得更高速率限制。新的最高档 Grow,资格为累计 API 付款 500 美元,低于此前最高档的 1000 美元。
已处于付费档的组织会自动迁到对应新档,无需自行操作。门槛只计 API 累计付款,不含 ChatGPT 订阅费;此次调整也不是 token 单价降价。

原始来源:OpenAI ↗
09 / 模型与产品
Claude 云端会话 连接本地文件夹
功能负责人称,Claude Projects 云端会话开始可连接用户批准的本地文件夹,按需就地读取和编辑;工程师亦确认,Cowork 支持仍在计划中。
功能负责人表示,Claude Projects 的云端会话现在可以连接电脑上用户批准的文件夹,并于 10 月 5 日起开始推出。会话仍留在云端,只在任务需要时访问该文件夹,就地读取和编辑文件。
本地 Mac 须保持在线,才能供云端会话按需读写。工程师确认,Cowork 对应支持仍在计划中。

10 / 模型与产品
Claude 云端赠额 符合条件可领取
9 月 23 日已在 Pro 或 Max 的用户,可在 Claude Code 用 /claim-credit 领取一次性云端会话赠额,截止 10 月 7 日 23:59 太平洋时间。
Claude 官方说明:9月23日14:00太平洋夏令时间已订阅的个人 Pro、Max 用户符合活动资格,试用、欠费、Team 和 Enterprise 不在范围内。Pro赠额100美元,Max赠额250美元。通过Claude账号领取,不适用于API密钥登录。
可在 Claude Code 运行 /claim-credit,领取截止北京时间10月8日14:59。赠额用于云端会话,11月4日23:59太平洋时间到期。一般在赠额用完后回到套餐额度;Pro选择Fable须启用有余额的额外用量,赠额耗尽后可能继续计费。

原始来源:Anthropic ↗
国内新闻
11 / 研究与评测
Ling 3.1 Flash 独立评测提升
独立评测显示Ling 3.1 Flash相对8月的3.0 Flash明显提升,现可经Novita AI调用,开源权重预计即将放出。
Artificial Analysis 10月6日公布评测:蚂蚁Ling 3.1 Flash在Intelligence Index v4.3上得41分,高于8月发布的Ling 3.0 Flash的20分。评测称其智能体能力提升,GDPval-AA v2 Elo为1622,AA-Briefcase Elo为1400,AutomationBench-AA为62%,Terminal-Bench v4.0为33%。在AA-Omniscience这一项,得分由-18升至+2,准确率由18%升至29%,幻觉率由44%降至38%,尝试率约56%至58%。
模型总参数5600亿、激活参数250亿,上下文100万Token。API输入每百万Token 0.30美元、输出0.90美元,缓存输入0.06美元。当前可经 Novita AI 调用,权重仍待开放。

12 / 模型与产品
GLM-5.3 接入 Amazon Bedrock
智谱官方宣布GLM-5.3接入Amazon Bedrock,企业可在该平台使用其代码与智能体能力。
智谱10月6日在官方账号宣布,GLM-5.3现已上架亚马逊云科技的大模型平台Amazon Bedrock,可把代码与智能体能力用于企业业务,并给出了Bedrock模型文档入口。
这次更新是云平台可用性,不是模型重新发布。已在使用AWS的团队,可以按Bedrock的调用方式接入GLM-5.3。

原始来源:智谱 ↗
13 / 模型与产品
Strata 本地推理 显存与内存协作
开发者Niko1221的开源引擎Strata,可在12GB及以上显存的消费级显卡上本地运行量化版Qwen3.8-Flash-Next。
10月6日的中文报道介绍了已有本地引擎 Strata。原作者仓库确认,它通过显存、系统内存、CPU及SSD协作,在Windows或Linux运行量化后的Qwen3.8-Flash-Next。
作者在 RTX5070 12GB显存、Ryzen5 7600和64GB系统内存上,用引擎0.1.36及Q2_0测得短回复94词元/秒。这是作者特定条件测试。32GB内存推荐裁减一半专家的Coder版,中文等能力较弱;64GB内存适合多种完整量化。


原始来源:Qwen / 社区工具 ↗
14 / 模型与产品
彭博报道 DeepSeek 融资与上市计划
彭博社10月6日援引匿名知情人士称,DeepSeek接近取得至少800亿元融资,并计划2027年初IPO,公司尚未回应。
彭博10月6日援引匿名知情人士报道,DeepSeek接近取得至少800亿元人民币融资,高于原先约500亿元目标。腾讯与宁德时代承诺的出资居前,融资尚未完成。
报道还称公司计划2027年初IPO。最终条款仍可能变化,公司未回应置评。

原始来源:DeepSeek / 彭博报道转述 ↗
15 / 模型与产品
彭博报道月之暗面 估值与上市计划
彭博社10月6日援引匿名知情人士称,Kimi开发者月之暗面最后一轮私募估值约500亿美元,并筹划2027年第一季度赴港上市。
彭博10月6日援引匿名知情人士报道,Kimi开发者月之暗面已完成最后一轮私募,估值约500亿美元,筹划2027年第一季度香港IPO。
上市仍在讨论,时间可能变化;公司未回应置评。

原始来源:月之暗面 / 彭博报道转述 ↗