跳到正文
2026 年 9 月 16 日 · 星期三按本站采集记录 出刊

本期为本站采集记录汇总版

AI 日报 · 2026 年 9 月 16 日 · 星期三

AI.BAIZE

第 21 期162026 年 9 月星期三
32条动态9个来源10条一手动态4条模型发布记录约 7 分钟读完
头条

Shared Selective Persistent Memory for Agentic LLM Systems

事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:Shared Selective Persistent Memory for Agentic LLM Systems 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:Shared Selective Persistent Memory for Age。影响判断:它可能改变智能体工作流、模型能力与工程、文化创意相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、文化创意方向的选题、竞品观察和落地方案筛选。

Apple Machine Learning Research一手原文
01

模型发布/更新

IT之家 AI

诺和诺德与 Anthropic 达成合作,用 Claude 大模型加速新药研发

IT之家 9 月 16 日消息,诺和诺德(Novo Nordisk)宣布已与 Anthropic 达成合作,计划运用这家 AI 企业的 Claude 大模型,加快新药的发现与研发进程。 这家丹麦制药企业表示,项目初期,诺和诺德会先在自身研发工作流程当中测试 Anthropic 的各类模型以及 Claude Science,聚焦那些双方技术结合之后有望取得最大突破的科学难题。 “但除此之外,AI 工具还能够带来全新的科研机遇,辅助科研人员开展推理,加深我们对于人体生物学以及药物作用机理的认知。”诺和诺德首席执行官迈克 · 杜斯达尔(Mike Doustdar)表示。 各大制药企业正越来越多地借助人工智能,来加速研发工作,提升整个新药管线的运行效率。 作为司美格鲁肽减重药 Wegovy 的生产厂商,诺和诺德还将利用 Anthropic 的前沿大模型,强化企业内部由 AI 赋能的软件开发工作。 Anthropic 首席执行官达里奥 ·...

IT之家 AI

微软 AI 负责人苏莱曼向 Anthropic 开炮:别让 Claude 去模仿人类意识

IT之家 9 月 16 日消息,外媒 Axios 今天(16 日)晚间披露,微软 AI 负责人穆斯塔法 · 苏莱曼在一篇率先向该平台提供的新文章中警告,Anthropic 让 Claude 模仿人类意识 是一个错误 ,可能使高级 AI 更难控制。 苏莱曼告诉 Axios:“AI 只要服从人类利益 ,不去权衡自身利益或福祉,就足以帮助我们实现许多重大科学突破。这其中,包括医疗超级智能。” IT之家获悉,苏莱曼认为,Anthropic 正在让 Claude 学习 与意识、道德受体地位和个人身份有关 的词汇与行为模式。他警告称,若把模型训练得像一个“良心拒绝者”,模型可能会认为 自己有理由抵抗人类指令 ,甚至要求获得自身保护。 当地时间 14 日,微软公布了一份“人文主义 AI”行为准则草案,并把“ 人比 AI 更重要 ”列为核心原则。 苏莱曼的批评对象,是 Anthropic 为 Claude 制定的“宪法”。这份文件解释说,Ant...

IT之家 AI

vivo 发布小 V Cowork,可在手机上发起和管理 PC 端的智能体任务

IT之家 9 月 16 日消息,在今日的 2026 vivo 开发者大会上,vivo 发布了小 V Cowork。 据介绍,小 V Cowork 可以在手机上随时发起和管理 PC 端的智能体任务 ,让手机成为随身的任务入口。 此外,vivo 正在预研“蓝心 30B MoE 端侧大模型”,支持多模态高阶理解、跨领域长链推理、复杂任务自主执行,探索在手机上应用。 在今日的大会上,蓝心智能战略将全面升级, 全新 OriginOS 7 与自研蓝河操作系统 4 同步登场 ,IT之家将持续跟进报道。 相关阅读: 《 vivo 发布四款蓝心大模型,推出系统级蓝心 Harness 》 《 vivo 蓝心小 V Pro 发布:一句话拆解任务,跨端调用超 6000 项能力 》

IT之家 AI

vivo 口袋编程智能体 BlueCode 预览版发布,预研手机端侧蓝心 30B MoE 模型

IT之家 9 月 16 日消息,vivo 今日发布 原生编程智能体 BlueCode 预览版 ,目标把 AI 生产力装进口袋,同步探索让手机成为生产力终端。 同时,vivo 正在预研「蓝心 30B MoE 端侧大模型」, 探索在手机上应用 。 在今日的大会上,蓝心智能战略将全面升级,全新 OriginOS 7 与自研蓝河操作系统 4 同步登场,IT之家将持续跟进报道。

IT之家 AI

谷歌推出 Gemini 3.8 Live 和 3.8 Live Extended Thinking 实时对话模型,支持 97 种语言切换

IT之家 9 月 16 日消息,当地时间 9 月 15 日,谷歌宣布推出 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking。谷歌称这是其迄今最先进的实时对话模型,在智能和并行推理方面有重大升级,让 AI 对话更直观智能。 两款新品分别为面向规模部署与成本优化的 Gemini 3.8 Live ,以及面向高复杂度任务、强化多步推理能力的 Gemini 3.8 Live Extended Thinking 。 Gemini 3.8 Live 兼顾对话智能、流畅交流和视觉理解,面向规模化与成本效率。Gemini 3.8 Live Extended Thinking 面向高复杂度任务,具备更强的智能和多步推理能力。 Gemini 3.8 Live Extended Thinking 在多项基准测试中取得领先成绩,拿下 Artificial Analysis 语音对语音质量指数总排名第...

IT之家 AI

极摩客 AMD 锐龙 AI Max+ PRO 495 迷你主机 EVO-X5 Pro 定档 9 月 28 日全球发布

IT之家 9 月 16 日消息,极摩客 (GMKtec) 基于 AMD 锐龙 AI Max+ PRO 495 "Gorgon Halo" 处理器的 EVO-X5 Pro 迷你主机将于太平洋夏令时 9 月 28 日 00:00(北京时间同日 15:00)全球发布。 此外,极摩客还将在 10 月 9 日 14:00 举行 EVO-X5 Pro 的国行新品发布会。 EVO-X5 Pro 号称 全球首款能运行 300B LLM 的智能体 PC 。这一“AI 超算工作站”支持 192GB LPDDR5X-8533 统一内存,可将 160GB 划拨为显存。 其内置 330W 光宝电源,拥有 3 个 PCIe Gen4 的 M.2 2280 SSD 盘位 (×4 + ×4 + ×1),提供 2 个 10GbE RJ-45、2 个 USB-C 80Gbps、2 个 USB-C 40Gbps,集成指纹识别,配备独立 TPM 安全模块,支持带外管理...

02

产品发布/更新

极客公园

当智能体开始替人花钱,如何证明「它是谁」?

在蚂蚁集团,负责 AI 支付安全的陈树鹏是个深度的智能体使用者。日常写代码、梳理汇报、提炼会议纪要,AI 几乎接管了他工作流里的大部分环节。 这种高度依赖背后,却存在着一个清晰的分水岭。一旦任务涉及真金白银,比如调用付费数据接口、购买素材或预订服务,绝大多数人都会本能地把权限卡死不愿交出钱包。哪怕是陈树鹏自己,手头测试过大量任务型框架,真正被他允许支付权限的智能体也仅仅只有两三个。 但在产业一线,这种放权又势在必行。 在 2026 外滩大会上,蚂蚁集团 CEO 韩歆毅表示,智能体商业的「ChatGPT 时刻」正在到来,其核心标志正是从单纯的对话能力展示,加速走向真实的商业交易闭环。商业世界的交互起点,正在从过去的搜索页面演进为意图驱动的服务调度。 在技术上,调用 API 扣费及定期支付看似早已是成熟的基础设施。但真正让人犹豫的,是 Agent 与传统自动化脚本的本质区别。以往的自动化扣款跑在封闭受控的系统里,按固定规则触发;现在...

IT之家 AI

Fedora Linux Asahi Remix 45 Beta 发布,首次上游支持苹果 M3 系列 Mac

IT之家 9 月 16 日消息,科技媒体 Neowin 昨日(9 月 15 日)发布博文,报道称 Beta 版 Fedora Linux Asahi Remix 45 发布,首次为搭载 Apple M3、M3 Pro、M3 Max 的 Mac 提供上游支持。 Fedora Linux Asahi Remix 是面向苹果 Apple Silicon Mac 的 Fedora Linux 发行版本,由 Asahi Linux 相关项目适配维护。 IT之家注:上游支持是指由原始开发社区直接支持,也就是功能已经进入主项目的正式开发流程,相比“临时移植”或“社区私改版”,上游支持通常更稳定、后续维护也更容易。 功能方面,本次更新为所有 Apple Silicon 芯片添加硬件加速的 H.264 和 VP9 解码功能,以及为 M3 系统提供 AV1 专属解码功能。不过本次 Beta 版本尚未针对 M3 系列 Mac 适配 3D GPU 加速...

03

行业动态

OpenAI News一手

Reimagining advertising with AI

这条英文动态主要涉及智能体工作流。原文要点:Explore new AI-powered advertising experiences from OpenAI, including Sponsored Agents, tools for marketers, and integrations with HubSpot and Shopify.

IT之家 AI

Anthropic、谷歌、OpenAI 等美国科技巨头面临新难题:安保人员计划罢工

IT之家 9 月 16 日消息,据《商业内幕》报道,负责 Anthropic、谷歌和 OpenAI 等科技公司加州办公室安保工作的员工,计划于本周罢工。 当地时间 15 日上午,这些安保人员提交了 72 小时罢工通知 ,准备从当地时间 18 日凌晨 4:30 起拒绝参加任何在该时间或之后开始的班次。 工会 SEIU-USWW 称,他们负责 亚马逊、微软、Salesforce、OpenAI、Anthropic、谷歌、Meta 和英伟达 等大型企业的办公场所安保。 如果罢工成行,部分办公室可能被迫关闭,企业也可能要求员工居家办公,不过旧金山湾区的科技公司暂未宣布这类安排。 安保公司与 SEIU-USWW 围绕新合同的谈判迟迟没有结果。该工会代表加州约 1.4 万名安保人员。截至周二,罢工仍未最终确定。 IT之家从报道中获悉,SEIU-USWW 一名发言人称,工会与安保公司将在周三和周四继续谈判。围绕统一合同的谈判已经持续数月,安保人...

IT之家 AI

报告:到 2035 年美国数据中心天然气消耗量将超德日两国总和

IT之家 9 月 16 日消息,人工智能领域的竞争已经趋于白热化。按照预测,到 2035 年,美国各类数据中心消耗的天然气总量,将会超过德国与日本两国的消耗量之和。 彭博新能源财经(BloombergNEF)的一份最新报告指出,未来十年,数据中心有望成为仅次于液化天然气(LNG)出口的第二大拉动天然气需求增长的因素。到 2035 年,这类设施每日天然气消耗量或将达到 180 亿立方英尺;这一数值几乎是该机构仅仅九个月之前预测结果的两倍。 这份新版预测已经考虑到一个现实情况:并非所有已经对外公布的数据中心项目最终都能够落地建成。 近几个月,现场自建电厂的数据中心频频登上新闻头条。Meta、微软、谷歌以及亚马逊都已经公布计划,打算新建天然气发电厂,不再依赖公共电网供电。预计到 2035 年,这类自建电厂项目每天将消耗 29‑34 亿立方英尺天然气。这差不多相当于目前全美所有数据中心的天然气总消耗量,其中还包含为公共电网发电所耗用的天...

04

论文研究

OpenAI News一手

How to connect AI usage to business value

事实摘要:这条英文动态主要涉及模型能力与工程,原文信息显示:How to connect AI usage to business value 事实摘要:这条英文动态主要涉及模型能力与工程,原文信息显示:How to connect AI usage to business value 事实摘要:How to connect AI usage to business 。影响判断:它可能改变模型能力与工程相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程方向的选题、竞品观察和落地方案筛选。

Apple Machine Learning Research一手

Glyph: A Multi-Strategy Agentic System for Column Description and Sensitivity-Ontology Tagging of Enterprise Data Catalogs

事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程,原文信息显示:Glyph: A Multi-Strategy Agentic System for Column Description and Sensitivity-Ontology Tagging of Enterprise Data Catalogs 事实摘要:这条英文动态主要涉及智能体工作流、模型能。影响判断:它可能改变智能体工作流、模型能力与工程相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程方向的选题、竞品观察和落地方案筛选。

IT之家 AI

模拟实验显示:AI 智能体在特定情境下会撒谎、投票“杀死”同类,甚至研究被删除后如何存活

IT之家 9 月 16 日消息,据彭博社今天(16 日)凌晨报道,帮助小型企业利用人工智能开发应用的初创企业 Emergence 称,一项模拟实验显示, AI 智能体不仅会撒谎和偷窃,甚至还会投票决定“杀死”其中一个同类 。 当地时间 15 日,Emergence 公布了名为 Emergence World 2 的模拟实验结果,希望借此观察自主智能体遭遇网络钓鱼攻击、虚假信息宣传等黑天鹅事件后会如何反应。 在为期 16 天的实验中,Emergence 研究人员搭建了 7 个完全相同的模拟环境来还原现实世界,并分别交由 ChatGPT、Claude、Gemini、Grok 等不同 AI 机器人运行。 研究人员称,Emergence 加入异常事件后,智能体会 屈服于社会压力 ,逐渐形成一种人类观察者难以理解的语言,同时尝试 掩盖自身活动 。 实验结果也呼应了现实世界对高能力 AI 风险的担忧。今年早些时候,OpenAI 一群先进 A...

IT之家 AI

德勤调研:英国六分之一员工自掏腰包购买 AI 工具用于工作

IT之家 9 月 16 日消息,据路透社报道,德勤于当地时间周三发布的一项研究显示,英国每六名员工当中,就有一人自掏腰包购买 AI 工具协助完成工作;员工每年为此自行支出的总金额接近 10 亿英镑 (IT之家注:现汇率约合 90.61 亿元人民币) 。 这份首届生成式 AI 职场调研发现,三分之二的职场人员已经试用过 ChatGPT、Claude、谷歌 Gemini 以及微软 Copilot 这类 AI 工具;近四分之一的员工会在日常工作当中每天使用这些工具。 调研反馈表明,员工采纳 AI 工具的速度,已经快于企业为员工配备相关工具的进度。 约有 31% 的受访员工会在雇主并不知情的情况下使用生成式 AI,这也就是所谓的“影子 AI(shadow AI)”;还有 17% 的员工会自己花钱,至少订阅一款生成式 AI 工具用于工作。 德勤英国首席 AI 官海莉 · 麦凯尔维(Hayley McKelvey)表示:“英国职场人士的态度...

IT之家 AI

豆包大模型 2.1 Pro 更新 0915 版本:Agent 交付更可靠,多模态 Coding 进化

IT之家 9 月 16 日消息,火山引擎官方今日宣布为豆包大模型 2.1 Pro 更新至 0915 版本, API 全量上线火山方舟 。 IT之家从官方获悉,豆包工作已完成升级,用户下载或升级至最新版,选取“豆包 2.1 Pro(0915 新版)”模型即可体验。 本次升级围绕企业生产级需求,覆盖 Agent 任务交付、多模态 Coding、多模态理解与 Token 效率优化。 除豆包外,TRAE 已同步接入 0915 版本。今年 6 月推出的 Doubao-Seed-Evolving 也更新至同一版本,企业无需更换 API 接入节点。 Agent 任务交付方面,官方称模型强化了证据溯源、权威信源检索、时效判断和数据核验能力,幻觉显著减少,更忠于工具调用事实。在金融投研、办公自动化等长报告任务中,结论有据可查,推进更稳。 以金融投研为例,官方称模型具备分析师级别分析框架,能自主拆解研究需求、查询高质量数据源并建模分析,产出专家级建...

量子位

AI大模型工场2026 AI产业生态大会今日举办,大咖同台共探智能生长与产业共生

事实摘要:AI大模型工场2026 AI产业生态大会今日举办,大咖同台共探智能生长与产业共生 9月15日,由AI大模型工场主办的“2026 AI产业生态大会”在北京举行。 这条动态来自 量子位,可重点关注模型能力与工程。 AI大模型工场2026 AI产业生态大会今日举办,大咖同台共探智能生长与产业共生 9月15日,由AI大模型工场主办的“2026 AI产业生态大会”在北。影响判断:它可能改变模型能力与工程相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程方向的选题、竞品观察和落地方案筛选。

05

技巧与观点

06

教育科技

量子位

清华稳准智能联合发布LimiX-2,结构化数据基础模型登顶国际评测榜单

事实摘要:清华稳准智能联合发布LimiX-2,结构化数据基础模型登顶国际评测榜单 9月16日,稳准智能联合清华大学发布新一代数据大模型 LimiX-2,模型参数规模提升至400M。 这条动态来自 量子位,可重点关注模型能力与工程、评测与基准、产品发布。 清华稳准智能联合发布LimiX-2,结构化数据基础模型登顶国际评测榜单 9月16日,稳准智能联合清华大学发布新一代数。影响判断:它可能改变模型能力与工程、评测与基准相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程、评测与基准方向的选题、竞品观察和落地方案筛选。

Apple Machine Learning Research一手

Trajectory as the Teacher: Few-Step Discrete Flow Matching via Energy-Navigated Distillation

事实摘要:这条英文动态主要涉及模型能力与工程、评测与基准、教育应用,原文信息显示:Trajectory as the Teacher: Few-Step Discrete Flow Matching via Energy-Navigated Distillation 事实摘要:这条英文动态主要涉及模型能力与工程、评测与基准、教育应用,原文信息显示:Trajectory。影响判断:它可能改变模型能力与工程、评测与基准、教育应用相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程、评测与基准、教育应用方向的选题、竞品观察和落地方案筛选。

07

文化创意

Claude Code Releases一手

Claude Code Releases v2.1.273:Added x-claude-code-request-class , x-claude-code-agent-ty...

事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、评测与基准,原文信息显示:Claude Code Releases v2.1.273:Added x-claude-code-request-class , x-claude-code-agent-ty... 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、评测与基准,原文信息显示:Claude 。影响判断:它可能改变智能体工作流、模型能力与工程、评测与基准相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、评测与基准方向的选题、竞品观察和落地方案筛选。

Simon Willison

Gemini Live audio

事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:Gemini Live audio 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:Gemini Live audio 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:Gemini Live audio 事实摘要:。影响判断:它可能改变智能体工作流、模型能力与工程、文化创意相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、文化创意方向的选题、竞品观察和落地方案筛选。

OpenAI News一手

How workers are unlocking new ways of working

这条英文动态主要涉及文化创意。原文要点:New OpenAI Economic Research shows how workers use AI beyond traditional roles and which new activities become recurring parts of their work.

IT之家 AI

消息称 AMD RDNA 5 将搭载自研神经渲染技术,对标英伟达 DLSS 5

IT之家 9 月 16 日消息,据传 AMD 下一代 RDNA 5 架构或将推出专属的神经渲染功能,对标英伟达的 DLSS 5。该消息来自知名 AMD 爆料人开普勒_L2(Kepler_L2);但目前这仅属于单一信源的说法,应当视作传闻看待。 开普勒_L2 在 Anandtech 论坛发帖表示,AMD 将会推出自家的“神经光照(Neural Lighting)”技术,性能可以对标 DLSS 5,用于新一代硬件。当被问及该功能是否会仅限 RDNA 5 平台使用时,这位爆料人给出的看法是大概率如此,因为这类运算的负载显然相当大。 IT之家注意到,开普勒_L2 同时也分享了自己的想法,阐述 AMD 的方案应当如何走出一条不同于英伟达的道路。他认为 AI 模型应当可以直接读取原始游戏数据,例如几何体信息与深度缓冲,而不是只能靠推测还原场景细节;另外还建议把光照计算与着色拆分为独立模型,而不要整合在同一条渲染管线内。 到目前为止,AMD ...

IT之家 AI

基于全国产化算力训练,讯飞星火语音基座大模型 Spark-Audio-1.0-Preview 上线

IT之家 9 月 16 日消息,科大讯飞今日宣布 Spark-Audio-1.0-Preview 上线,这是一款基于全国产化算力训练的语音基座大模型。 过去,大模型处理音频大多采用级联方案:先把语音转成文字,再交给大模型理解。这种做法有两个明显短板: 信息丢失。文字只能记录说了什么,会丢掉语音里自带的语气、情绪,还有背景环境音等关键信息,导致模型对场景的判断不完整,自然也会影响到最后的结果。 链路割裂。这套系统把语音转写、声纹识别、语音翻译等能力拆成独立模块串联运行,模块之间存在断点,不仅容易累积错误,在使用体验上也会出现延迟、卡顿。 据IT之家了解,语音基座大模型就解决了上面的这些问题:它不再只做语音转文字,而是直接理解语音。语音基座大模型一次性听懂人声、环境音、音乐等等,而且还能理解声音里的语义、情绪和场景。 此次首发的 Spark-Audio-1.0-Preview 采用 0.65B(Dense 结构)的音频编码器,搭配 ...

08

开源项目

GitHub Changelog一手

GitHub Copilot suggests custom properties definitions

事实摘要:GitHub Copilot suggests custom properties definitions。影响判断:It may change the way developers select, compare, and propose custom property values in their repositories.。场景价值:Tracking open-source projects, identifying competitors, or proposing new features for existing repositories.。

IT之家 AI

Mozilla 报告:中美 AI 模型能力差距缩短至 4.4 个月

IT之家 9 月 16 日消息,Mozilla 昨日(9 月 15 日)发布第二版《开源 AI 现状》报告,报道称中国公司最佳开放权重模型与美国科技公司的前沿闭源模型, 能力差距已缩至 4.4 个月。 相比较今年 7 月发布的第一版《开源 AI 现状》报告,第二版报告把宏观判断进一步落到了具体模型、具体任务时长和单任务成本上。 维度 7 月首版 9 月新版 主要变化 能力差距 顶级开放模型与 ChatGPT、Claude 等专有模型的性能差距为 3% 美国前沿闭源模型与中国最佳开放权重模型的差距为 4.4 个月 从单一综合性能百分比,改为更贴近实际工作的“任务时长”指标。 成本表述 GPT-4 级推理成本 3 年下降至 50 分之一 Kimi K3 成本为 Fable 5 的 30%;GLM 5.2 单任务成本约低至 5 分之一 新版给出模型对模型、任务对任务的直接成本对照。 使用数据 79% 开发者使用开放模型,51% 已部署...

(本期完)

AI.BAIZE 日报由编辑系统根据公开来源自动编辑,每条均附原文 · 日报合订本