跳到正文
2026 年 9 月 3 日 · 星期四按本站采集记录 出刊

本期为本站采集记录汇总版

AI 日报 · 2026 年 9 月 3 日 · 星期四

AI.BAIZE

第 8 期032026 年 9 月星期四
30条动态11个来源11条一手动态6条模型发布记录约 6 分钟读完
头条

Claude Code Releases v2.1.259:Added managedMcpServers managed setting: organizations can...

事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:Claude Code Releases v2.1.259:Added managedMcpServers managed setting: organizations can... 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:Claude Co。影响判断:它可能改变智能体工作流、模型能力与工程、文化创意相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、文化创意方向的选题、竞品观察和落地方案筛选。

Claude Code Releases一手原文
01

模型发布/更新

IT之家 AI

Meta 发布最强 AI 模型 Muse Spark 1.3,编码能力超 GPT-5.6 Sol

IT之家 9 月 3 日消息,Meta Platforms 于 2026 年 9 月 2 日发布迄今最强大 AI 模型 Muse Spark 1.3,专为延长智能体工作流与增强编码能力设计。 Meta 首席 AI 官 Alexandr Wang 表示, 该模型在编码能力上超越 OpenAI 的 GPT-5.6 Sol ,与 Anthropic 的 Claude Fable 5.1 表现持平。 定价方面,Muse Spark 1.3 维持与前代 Muse Spark 1.2 相同的定价,通过 Meta Model API 向开发者提供付费访问: 每 100 万词元输入费用为 1.25 美元 (IT之家注:现汇率约合 8.4 元人民币) 每 100 万词元缓存命中输入费用为 0.15 美元 (现汇率约合 1 元人民币) 每 100 万词元输出费用为 4.25 美元 (现汇率约合 28.6 元人民币) Wang 透露,API 平台市场...

IT之家 AI

欧洲最强 AI:西班牙公司推出 Quasar 438B 模型,1M 词元上下文

IT之家 9 月 3 日消息,西班牙 AI 公司 Multiverse Computing 最新推出 Quasar 438B 模型,根据 Artificial Analysis 得分, 该模型 Intelligence Index v4.1.1 得分为 43,在参与比较的欧洲模型中排名最高。 IT之家注:该指数综合 9 项评测,覆盖智能体、代码、科学推理、通用知识和长上下文推理,是评估模型能力的主要基准之一。作为对比,Mistral Medium 3.5 得分为 30,NVIDIA Nemotron 3 Ultra 得分为 38。 该模型拥有 4,380 亿参数,定位为推理模型,主要面向企业级智能体、软件开发和复杂多步任务。Quasar 438B 支持英语和西班牙语,并已通过 CompactifAI API 提供访问。 在官方 X 推文下方的“背景信息”中,补充表示该模型可能基于智谱的 GLM5.2 模型制作。 该模型目前属于专...

IT之家 AI

(更新:已恢复正常)ChatGPT、Grok、Claude、Cursor 集体突发故障

【9 月 4 日 1:13 更新】目前文中提到的模型 / AI 工具官网“Status”主页均显示已经恢复正常。 IT之家 9 月 3 日消息,据IT之家网友投稿反馈,ChatGPT、Grok、Claude、Cursor 等多款 AI 模型今晚突发故障。此外,用户请求 Codex 会出现“404 Not Found”错误。 IT之家查询 Downdetector 报告获悉,美国用户使用 OpenAI、Claude、Grok、Cursor 服务时均出现问题。目前已有超过 12,000 份用户报告指出 OpenAI 存在问题,关于 Claude 的问题报告约有 1,200 份,关于 Grok 的问题报告约有 1,000 份。 各方回应: OpenAI:ChatGPT 和 Codex 目前正出现问题。 Anthropic:正在调查 Claude 出现的错误,将致力于修复工作。 SpaceXAI:Grok 目前出现故障,正在调查服务中断...

IT之家 AI

图像编辑器 Paint.NET 首次登陆 Linux:开发者称 AI 辅助 3 周进展超 12 年总和

IT之家 9 月 3 日消息,开发者里克 · 布鲁斯特(Rick Brewster)于 9 月 1 日在 X 平台发布推文,宣布发布 Paint.NET 5.2 Build 9739 版, 通过 Wine 首次实验性支持 Linux 平台。 布鲁斯特表示在开发过程中,遇到的最大障碍在于 Direct2D,这是微软专为 Windows 系统打造的 2D 图形 API,而 Paint.NET 长期依赖其完成界面与图像渲染。 由于 Wine 对 Direct2D 的原生支持并不完善,Brewster 没有选择等待,而是自行开发了内部替代方案,实现了软件所需的核心图形 API 功能。 布鲁斯特透露,得益于 AI 编程工具 Claude Code 的协助,此次 Linux 移植工作仅耗时约 3 周,取得的进展超过此前 12 年间历次尝试的总和。 尽管取得阶段性突破,布鲁斯特坦言当前实现仍存在运行缓慢、bug 频发,对于普通用户而言,目前还...

02

产品发布/更新

IT之家 AI

微软商业经典版 Outlook 强化 AI 入口,本月功能区将新增 Copilot 专属按钮

IT之家 9 月 3 日消息,科技媒体 NeoWin 昨日(9 月 2 日)发布博文,报道称微软计划本月开始,面向所有经典版 Outlook 商业用户部署调整,在功能区安置 Copilot 专属按钮。 根据微软消息中心公告 MC1441784,为了让用户在需要 AI 协助时能更容易找到入口, 将会在经典版 Outlook 功能区放置 Copilot 专属按钮。 本次调整仍将保留 Copilot 侧边栏,功能区按钮只是增加了一条更简化的访问路径。 微软称,该 AI 服务已具备收件箱上下文感知能力,用户通过新入口调用后,可基于邮箱中的相关内容获得协助。 在部署方面,微软计划 9 月晚些时候开始,向所有经典版 Outlook 商业用户推出。符合条件且持有 Microsoft 365 Copilot 许可证的用户将默认获得该功能。 GCC(Government Community Cloud,政府社区云)、GCC-High 和 DoD(...

IT之家 AI

继鸿蒙之后,腾讯 WorkBuddy 再上线银河麒麟、统信操作系统

IT之家 9 月 3 日消息,今日,腾讯 WorkBuddy 登陆银河麒麟操作系统和统信操作系统 UOS ,并上架其应用商店;同时也上架了 openKylin 社区和 deepin 社区的软件商店。 ▲ 银河麒麟软件商店 ▲ 统信应用商店 据介绍,此次对银河麒麟和统信 UOS 的适配并非简单的代码迁移。WorkBuddy 团队联合国产操作系统协同攻坚,围绕系统登录联动、设备互联交互、智能技能调用、任务成果预览等核心业务链路,进行全场景、定制化适配打磨,达成原生级运行效果。对用户而言,这意味着在 国产 Linux 操作系统 上,也能获得与其他主流平台一致且顺畅的完整体验。 用户在上述操作系统应用商店搜索“ WorkBuddy ”,即可一键下载安装,开箱即用,无需任何额外配置,WorkBuddy 新用户同样可享受 2000 免费积分。 值得一提的是,今年 7 月,WorkBuddy 鸿蒙 PC 版发布,成为鸿蒙平台首个桌面办公智能体...

03

行业动态

IT之家 AI

微软调整财报口径:智能体与基础设施、设备与消费者 2 板块,Azure 营收纳入报告范围

IT之家 9 月 3 日消息,Microsoft(微软)当地时间 9 月 2 日宣布调整财报口径,将其整体业务从此前的“生产力和商业流程”“智能云”“更个人化计算”3 板块 调整为“智能体与基础设施”“设备与消费者”2 板块结构 。 “智能体与基础设施”大致相当于“生产力和商业流程”“智能云”两者之和,“设备与消费者”则在“更个人化计算”的基础上吸收了 LinkedIn(领英)的营销解决方案、高级订阅部分。 而在“智能体与基础设施”内部,此前独立的 LinkedIn 根据业务属性被拆分并纳入其它项目;Azure 则在开发者云等内容迁移到 Microsoft 365 云后成为更纯粹的按使用量计费的平台和基础设施业务, 微软也将开始披露 Azure 的季度收入 。

量子位

今年最难的机器人Demo,“机器人含量”为0

事实摘要:今年难于实现的机器人演示,机器人数量为零(Robot Demo, 'robot'含量为0)。影响判断:可能对AI应用和产业节奏产生重大影响。场景价值:机器人技术在某些领域的应用,如遥操作等。

04

论文研究

GitHub Changelog一手

Enterprise-managed settings support any default model

事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:Enterprise-managed settings support any default model 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:Enterprise-managed settings support any default。影响判断:它可能改变智能体工作流、模型能力与工程、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、开源生态方向的选题、竞品观察和落地方案筛选。

Tomer Tunguz

The Ads Model for Prompts Vertically Integrates AI

事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程,原文信息显示:The Ads Model for Prompts Vertically Integrates AI 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程,原文信息显示:The Ads Model for Prompts Vertically Integrates AI 事实摘要:这条英文。影响判断:它可能改变智能体工作流、模型能力与工程相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程方向的选题、竞品观察和落地方案筛选。

OpenAI News一手

Daybreak for Frontline Defenders: $1B to protect essential services

事实摘要:OpenAI introduces Daybreak for Frontline Defenders.。影响判断:It may change the way we evaluate model capabilities and engineering related products, research schedules or content production methods.。场景价值:Tracking model capabilities and engineering direction of frontier cyber AI services。

GitHub Changelog一手

Content exclusions generally available in Copilot app and CLI

事实摘要:这条英文动态主要涉及开源生态,原文信息显示:Content exclusions generally available in Copilot app and CLI 事实摘要:这条英文动态主要涉及开源生态,原文信息显示:Content exclusions generally available in Copilot app and CLI 事实摘要:这条。影响判断:它可能改变开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪开源生态方向的选题、竞品观察和落地方案筛选。

IT之家 AI

OpenAI 首席科学家回应“AI 推理不透明”争议:复杂度未跳跃增长

IT之家 9 月 3 日消息,OpenAI 首席科学家雅库布・帕乔基(Jakub Pachocki)昨日(9 月 2 日)在 X 平台发布推文, 回应 AI 模型 Astra“不可监控 / 推理不透明”的争议。 帕乔基强调,包括 Astra 在内的前沿模型,计算图深度与 GPT-4 相差不超过两倍,架构并未出现跳跃式复杂度增长。OpenAI 表示将为 Astra 部署额外思维链监控,加强监控仍是当前研究核心目标。 该事件最早追溯到 The Information 媒体的深度报道,透露 OpenAI 公司正在测试“深度循环”(recurrent depth)技术,可能导致研究人员更难解释模型的“思维链”(Chain-of-Thought)推理过程。 在技术路线方面,包括 ChatGPT、Claude 和 Gemini 等主流模型在内,大部分都基于 Transformer 架构。此类模型通常按线性步骤处理信息,并可在部分场景下用自然...

IT之家 AI

谷歌 DeepMind 发布 WeatherNext 3:分辨率最高 5 公里,号称全球最先进、精准 AI 天气预报模型

IT之家 9 月 3 日消息,谷歌 DeepMind 和 Google Research 今天宣布推出 WeatherNext 3 ,号称是目前最先进、最准确的全球气象模型。该模型可直接从实时观测中学习,能够为影响人类的天气事件提供更及时、更本地化的预测。 该模型可以原始卫星数据为基础,每小时生成一次高分辨率预报,为全球谷歌产品提供可靠的天气预报。 根据介绍,天气预报的实用性往往取决于细节,以及时间和空间的分辨率。WeatherNext 3 可生成多种空间分辨率的每小时预报,从广阔的全球风型到局部地形都能保持物理一致性。 借助 WeatherNext 3,谷歌能够以 5 公里分辨率呈现温度、湿度等关键地表变量,其他地表变量分辨率为 10 公里,风速等大气变量分辨率为 25 公里。 WeatherNext 3 通过接入 实时全球地球静止卫星数据拼图 ,让模型能够获得丰富、持续更新的大气视图,使模型可以每小时生成一次新预报,每次预报...

05

教育科技

极客公园

AI 下一场竞争:谁能成为 Agent 的「上下文操作系统」

头图来源:视觉中国 前段时间,Anthropic 发布了 Model Hardware Standard,尝试给 AI Agent 建立一套与硬件沟通的通用语言。接入这套标准后,显微镜、机械臂等不同厂商、不同接口的设备,可以被 Agent 发现、理解和调用。 这件事指向了 AI 行业正在发生的一次变化。过去一年,竞争主要围绕模型的推理、生成和多模态能力展开;如今,Agent 开始走出聊天窗口,进入实验室、工厂和企业现场。行业的问题随之向下移动:模型已经足够聪明之后,谁来连接工具、硬件、数据和任务? 9 月 2 日,腾讯 WorkBuddy 宣布面向更多伙伴开放合作。通达信、广发证券、北大法宝、腾讯 SSV 教师助手、微盟、北森、云帐房、帆软等应用与软件伙伴进入生态;Plaud、Rokid、影石、优篮子、科大讯飞、安克、猛玛、京造等硬件伙伴,也共同构成了 WorkBuddy 的生态版图。 一款 AI 产品为什么要同时连接专业软件、...

IT之家 AI

AI 让“赛博蟑螂”学会自主避险,识别危险环境准确率达 93%

9 月 3 日,据《日经亚洲》报道,研究人员正尝试将人工智能、传感器和通信设备安装在昆虫身上,利用昆虫体型小、感知灵敏和能耗低等特点,执行灾区搜救任务。一套最新系统可分析蟑螂的心跳、神经信号和身体动作, 识别周围环境并引导其逃离危险区域,最高识别准确率达到 93% 。 ▲ 一只昆虫搭载着由冈本圭介教授团队研发的昆虫协同电路 传统的“赛博昆虫”通常由外部人员直接控制。昆虫身上安装电极、传感器和通信设备后, 操作者可远程改变其移动方向并采集现场信息 ,使其进入人类和常规机器人难以抵达的狭窄空间。 由日本大阪大学教授森岛圭祐领导的国际研究团队开发了一种“昆虫协同回路”,希望减少对人工控制的依赖。研究人员为蟑螂安装背包式设备,用于测量心跳、神经信号和身体运动,再由 AI 分析这些数据,判断蟑螂可能处于何种环境,并结合昆虫自身的运动反应引导其行动。 研究团队把搭载该系统的蟑螂放入五种不同环境,包括紫外线照射、化学物质暴露和高温环境。表现最...

IT之家 AI

小红书治理 AI 制作虚假探店、民宿内容,今年 6-8 月清理相关内容近 12 万条

IT之家 9 月 3 日消息,小红书官方账号“薯管家”今日发布《关于 AI 制作医美、民宿等虚假内容治理公告》,宣布将 AI 制作发布虚假内容纳入常态化治理。 IT之家从公告获悉,小红书近期发现部分账号利用 AI 生成虚假体验笔记,用 AI 生成或拼接的图片伪造实景, 杜撰探店、住宿、就医、美容等使用体验等内容 ,误导用户决策。 小红书积极响应主管部门相关管理要求,切实履行平台主体责任,已将 AI 制作发布虚假内容纳入常态化治理。平台从三方面加大治理力度: 一是细化管控重点,以 AI 生成图片伪造实景、AI 批量生成同质化体验笔记、虚构亲历经历为高风险场景重点识别,文旅住宿、医疗医美、教育、房产等品类优先覆盖; 二是聚焦存量清理,从笔记、评论、账号等多环节清理历史虚假内容; 三是增补策略严控新增,同步强化未标识 AI 内容的识别能力,对同一图片或视频跨地域、跨账号重复使用的情形加强检测。 今年 6-8 月, 平台清理处置 AI ...

06

文化创意

GitHub Changelog一手

Reopening Copilot Business and Enterprise signups

事实摘要:这条英文动态主要涉及文化创意、开源生态,原文信息显示:Reopening Copilot Business and Enterprise signups 事实摘要:这条英文动态主要涉及文化创意、开源生态,原文信息显示:Reopening Copilot Business and Enterprise signups 事实摘要:这条英文动态主要涉及文化创意、开。影响判断:它可能改变文化创意、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪文化创意、开源生态方向的选题、竞品观察和落地方案筛选。

Simon Willison

llm-gemini 0.34

事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:llm-gemini 0.34 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:llm-gemini 0.34 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:llm-gemini 0.34 事实摘要:这条英文动态。影响判断:它可能改变智能体工作流、模型能力与工程、文化创意相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、文化创意方向的选题、竞品观察和落地方案筛选。

GitHub Blog AI一手

How we make AI coding more cost efficient without sacrificing task quality

事实摘要:这条英文动态主要涉及智能体工作流、文化创意、开源生态,原文信息显示:How we make AI coding more cost efficient without sacrificing task quality 事实摘要:这条英文动态主要涉及智能体工作流、文化创意、开源生态,原文信息显示:How we make AI coding more cost 。影响判断:它可能改变智能体工作流、文化创意、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、文化创意、开源生态方向的选题、竞品观察和落地方案筛选。

OpenAI News一手

Playco cut manual fixes 50% prototyping games with GPT-6 Astra

事实摘要:这条英文动态主要涉及模型能力与工程、开源生态,原文信息显示:Playco cut manual fixes 50% prototyping games with GPT-6 Astra 事实摘要:这条英文动态主要涉及模型能力与工程、开源生态,原文信息显示:Playco cut manual fixes 50% prototyping games with G。影响判断:它可能改变模型能力与工程、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程、开源生态方向的选题、竞品观察和落地方案筛选。

IT之家 AI

因 FSD 超速收到罚单,博主要求特斯拉承担责任

IT之家 9 月 3 日消息,当交通警察开出超速罚单时,法律责任通常由坐在驾驶座上的人承担。不过,在最近一起由特斯拉 FSD(监督版)引发的交通违法事件后,一位特斯拉社区知名内容创作者决定把这张罚单直接“转交”给特斯拉。 特斯拉内容创作者 @DrKnowItAll16 在 X 平台上发文称,自己的 Cybertruck 在开启 FSD 的情况下超速行驶,因此收到了罚单:“我一直都说,如果有一天我在特斯拉 FSD 驾驶车辆时收到超速罚单,而且我自己无法直接调整车速,我就会要求特斯拉支付这张罚单。好了,特斯拉,现在给你了。” 虽然这一举动更多只是象征性的,并不是真的期待特斯拉替自己缴纳罚款,但这一事件也反映出,随着特斯拉近期更新 FSD 软件,越来越多用户开始对其处理道路限速的方式感到不满。 问题的根源在于特斯拉近期对 FSD 软件进行的调整。在较早版本中,驾驶员可以通过方向盘右侧的滚轮,为车辆设置一个明确的最高速度上限。 但在最近...

07

开源项目

IT之家 AI

摩尔线程:公司已打通具身智能完整链路

IT之家 9 月 3 日消息,据新浪财经报道,摩尔线程在今日召开的 2026 年半年度业绩说明会介绍称, 公司已经打通具身智能从合成数据生成、大模型训练、仿真验证到端侧硬件部署完整链路 。 IT之家从原报道获悉,MT Lambda 是摩尔线程推出的全栈具身智能仿真平台,公司还开源了基于 MUSA 架构的 GPU 加速物理仿真后端 MuJoCo Warp MUSA,并完成四足机器狗和两足人形机器人 Sim2Real 真机验证。 摩尔线程在无锡设立工业具身智能创新中心,联合生态伙伴共建;同时与国家具身智能应用中试基地成立“具身智能算力与仿真联合实验室”。具身智能需要 AI 计算、物理仿真、图形渲染和端侧推理协同,正好体现了全功能 GPU 的差异化优势。

GitHub Blog AI一手

Decoding the new AI lingo: Loops, harnesses, squads, hill climbing… oh my!

这条英文动态主要涉及开源生态。原文要点:From loop engineering to harnesses, squads, and open weights, the GitHub Podcast breaks down the AI terms showing up in developer conversations. The post Decoding the new AI lingo: Loops, harnesses, squads, hill climbing… oh my! appeared first on The GitHub Blog .

(本期完)

AI.BAIZE 日报由编辑系统根据公开来源自动编辑,每条均附原文 · 日报合订本