本期为本站采集记录汇总版
AI 日报 · 2026 年 9 月 3 日 · 星期四
AI.BAIZE
Claude Code Releases v2.1.259:Added managedMcpServers managed setting: organizations can...
事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:Claude Code Releases v2.1.259:Added managedMcpServers managed setting: organizations can... 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:Claude Co。影响判断:它可能改变智能体工作流、模型能力与工程、文化创意相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、文化创意方向的选题、竞品观察和落地方案筛选。
模型发布/更新
Introducing WeatherNext 3, our most advanced and accurate global weather AI model
这条英文动态主要涉及模型能力与工程。原文要点:Introducing WeatherNext 3, our most advanced and accurate global weather AI model
Meta 发布最强 AI 模型 Muse Spark 1.3,编码能力超 GPT-5.6 Sol
IT之家 9 月 3 日消息,Meta Platforms 于 2026 年 9 月 2 日发布迄今最强大 AI 模型 Muse Spark 1.3,专为延长智能体工作流与增强编码能力设计。 Meta 首席 AI 官 Alexandr Wang 表示, 该模型在编码能力上超越 OpenAI 的 GPT-5.6 Sol ,与 Anthropic 的 Claude Fable 5.1 表现持平。 定价方面,Muse Spark 1.3 维持与前代 Muse Spark 1.2 相同的定价,通过 Meta Model API 向开发者提供付费访问: 每 100 万词元输入费用为 1.25 美元 (IT之家注:现汇率约合 8.4 元人民币) 每 100 万词元缓存命中输入费用为 0.15 美元 (现汇率约合 1 元人民币) 每 100 万词元输出费用为 4.25 美元 (现汇率约合 28.6 元人民币) Wang 透露,API 平台市场...
欧洲最强 AI:西班牙公司推出 Quasar 438B 模型,1M 词元上下文
IT之家 9 月 3 日消息,西班牙 AI 公司 Multiverse Computing 最新推出 Quasar 438B 模型,根据 Artificial Analysis 得分, 该模型 Intelligence Index v4.1.1 得分为 43,在参与比较的欧洲模型中排名最高。 IT之家注:该指数综合 9 项评测,覆盖智能体、代码、科学推理、通用知识和长上下文推理,是评估模型能力的主要基准之一。作为对比,Mistral Medium 3.5 得分为 30,NVIDIA Nemotron 3 Ultra 得分为 38。 该模型拥有 4,380 亿参数,定位为推理模型,主要面向企业级智能体、软件开发和复杂多步任务。Quasar 438B 支持英语和西班牙语,并已通过 CompactifAI API 提供访问。 在官方 X 推文下方的“背景信息”中,补充表示该模型可能基于智谱的 GLM5.2 模型制作。 该模型目前属于专...
(更新:已恢复正常)ChatGPT、Grok、Claude、Cursor 集体突发故障
【9 月 4 日 1:13 更新】目前文中提到的模型 / AI 工具官网“Status”主页均显示已经恢复正常。 IT之家 9 月 3 日消息,据IT之家网友投稿反馈,ChatGPT、Grok、Claude、Cursor 等多款 AI 模型今晚突发故障。此外,用户请求 Codex 会出现“404 Not Found”错误。 IT之家查询 Downdetector 报告获悉,美国用户使用 OpenAI、Claude、Grok、Cursor 服务时均出现问题。目前已有超过 12,000 份用户报告指出 OpenAI 存在问题,关于 Claude 的问题报告约有 1,200 份,关于 Grok 的问题报告约有 1,000 份。 各方回应: OpenAI:ChatGPT 和 Codex 目前正出现问题。 Anthropic:正在调查 Claude 出现的错误,将致力于修复工作。 SpaceXAI:Grok 目前出现故障,正在调查服务中断...
陈大年复出,入局大模型
首秀逼近DeepSeek万亿旗舰 这条动态来自 量子位,可重点关注模型能力与工程。
图像编辑器 Paint.NET 首次登陆 Linux:开发者称 AI 辅助 3 周进展超 12 年总和
IT之家 9 月 3 日消息,开发者里克 · 布鲁斯特(Rick Brewster)于 9 月 1 日在 X 平台发布推文,宣布发布 Paint.NET 5.2 Build 9739 版, 通过 Wine 首次实验性支持 Linux 平台。 布鲁斯特表示在开发过程中,遇到的最大障碍在于 Direct2D,这是微软专为 Windows 系统打造的 2D 图形 API,而 Paint.NET 长期依赖其完成界面与图像渲染。 由于 Wine 对 Direct2D 的原生支持并不完善,Brewster 没有选择等待,而是自行开发了内部替代方案,实现了软件所需的核心图形 API 功能。 布鲁斯特透露,得益于 AI 编程工具 Claude Code 的协助,此次 Linux 移植工作仅耗时约 3 周,取得的进展超过此前 12 年间历次尝试的总和。 尽管取得阶段性突破,布鲁斯特坦言当前实现仍存在运行缓慢、bug 频发,对于普通用户而言,目前还...
产品发布/更新
微软商业经典版 Outlook 强化 AI 入口,本月功能区将新增 Copilot 专属按钮
IT之家 9 月 3 日消息,科技媒体 NeoWin 昨日(9 月 2 日)发布博文,报道称微软计划本月开始,面向所有经典版 Outlook 商业用户部署调整,在功能区安置 Copilot 专属按钮。 根据微软消息中心公告 MC1441784,为了让用户在需要 AI 协助时能更容易找到入口, 将会在经典版 Outlook 功能区放置 Copilot 专属按钮。 本次调整仍将保留 Copilot 侧边栏,功能区按钮只是增加了一条更简化的访问路径。 微软称,该 AI 服务已具备收件箱上下文感知能力,用户通过新入口调用后,可基于邮箱中的相关内容获得协助。 在部署方面,微软计划 9 月晚些时候开始,向所有经典版 Outlook 商业用户推出。符合条件且持有 Microsoft 365 Copilot 许可证的用户将默认获得该功能。 GCC(Government Community Cloud,政府社区云)、GCC-High 和 DoD(...
继鸿蒙之后,腾讯 WorkBuddy 再上线银河麒麟、统信操作系统
IT之家 9 月 3 日消息,今日,腾讯 WorkBuddy 登陆银河麒麟操作系统和统信操作系统 UOS ,并上架其应用商店;同时也上架了 openKylin 社区和 deepin 社区的软件商店。 ▲ 银河麒麟软件商店 ▲ 统信应用商店 据介绍,此次对银河麒麟和统信 UOS 的适配并非简单的代码迁移。WorkBuddy 团队联合国产操作系统协同攻坚,围绕系统登录联动、设备互联交互、智能技能调用、任务成果预览等核心业务链路,进行全场景、定制化适配打磨,达成原生级运行效果。对用户而言,这意味着在 国产 Linux 操作系统 上,也能获得与其他主流平台一致且顺畅的完整体验。 用户在上述操作系统应用商店搜索“ WorkBuddy ”,即可一键下载安装,开箱即用,无需任何额外配置,WorkBuddy 新用户同样可享受 2000 免费积分。 值得一提的是,今年 7 月,WorkBuddy 鸿蒙 PC 版发布,成为鸿蒙平台首个桌面办公智能体...
Gemini 3.8 Flash 光速发布:干活挺勤快,就是没开窍
Gemini 圣质如初 #欢迎关注爱范儿官方微信公众号:爱范儿(微信号:ifanr),更多精彩内容第一时间为您奉上。 这条动态来自 爱范儿,可重点关注产品发布。
行业动态
Introducing Gemini 3.8 Flash and 3.8 Flash Cyber
Introducing Gemini 3.8 Flash and 3.8 Flash Cyber 这条动态来自 Google DeepMind,可重点关注其对 AI 应用和产业节奏的影响。
Legora reviewed 41 documents in minutes with GPT-6 Astra
这条英文动态主要涉及智能体工作流。原文要点:Legora used GPT-6 Astra to review 41 documents in minutes, find all four planted errors, and improve performance by nearly 40% in this financial-review workflow.
微软调整财报口径:智能体与基础设施、设备与消费者 2 板块,Azure 营收纳入报告范围
IT之家 9 月 3 日消息,Microsoft(微软)当地时间 9 月 2 日宣布调整财报口径,将其整体业务从此前的“生产力和商业流程”“智能云”“更个人化计算”3 板块 调整为“智能体与基础设施”“设备与消费者”2 板块结构 。 “智能体与基础设施”大致相当于“生产力和商业流程”“智能云”两者之和,“设备与消费者”则在“更个人化计算”的基础上吸收了 LinkedIn(领英)的营销解决方案、高级订阅部分。 而在“智能体与基础设施”内部,此前独立的 LinkedIn 根据业务属性被拆分并纳入其它项目;Azure 则在开发者云等内容迁移到 Microsoft 365 云后成为更纯粹的按使用量计费的平台和基础设施业务, 微软也将开始披露 Azure 的季度收入 。
今年最难的机器人Demo,“机器人含量”为0
事实摘要:今年难于实现的机器人演示,机器人数量为零(Robot Demo, 'robot'含量为0)。影响判断:可能对AI应用和产业节奏产生重大影响。场景价值:机器人技术在某些领域的应用,如遥操作等。
论文研究
Enterprise-managed settings support any default model
事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:Enterprise-managed settings support any default model 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:Enterprise-managed settings support any default。影响判断:它可能改变智能体工作流、模型能力与工程、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、开源生态方向的选题、竞品观察和落地方案筛选。
The Ads Model for Prompts Vertically Integrates AI
事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程,原文信息显示:The Ads Model for Prompts Vertically Integrates AI 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程,原文信息显示:The Ads Model for Prompts Vertically Integrates AI 事实摘要:这条英文。影响判断:它可能改变智能体工作流、模型能力与工程相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程方向的选题、竞品观察和落地方案筛选。
Daybreak for Frontline Defenders: $1B to protect essential services
事实摘要:OpenAI introduces Daybreak for Frontline Defenders.。影响判断:It may change the way we evaluate model capabilities and engineering related products, research schedules or content production methods.。场景价值:Tracking model capabilities and engineering direction of frontier cyber AI services。
Content exclusions generally available in Copilot app and CLI
事实摘要:这条英文动态主要涉及开源生态,原文信息显示:Content exclusions generally available in Copilot app and CLI 事实摘要:这条英文动态主要涉及开源生态,原文信息显示:Content exclusions generally available in Copilot app and CLI 事实摘要:这条。影响判断:它可能改变开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪开源生态方向的选题、竞品观察和落地方案筛选。
OpenAI 首席科学家回应“AI 推理不透明”争议:复杂度未跳跃增长
IT之家 9 月 3 日消息,OpenAI 首席科学家雅库布・帕乔基(Jakub Pachocki)昨日(9 月 2 日)在 X 平台发布推文, 回应 AI 模型 Astra“不可监控 / 推理不透明”的争议。 帕乔基强调,包括 Astra 在内的前沿模型,计算图深度与 GPT-4 相差不超过两倍,架构并未出现跳跃式复杂度增长。OpenAI 表示将为 Astra 部署额外思维链监控,加强监控仍是当前研究核心目标。 该事件最早追溯到 The Information 媒体的深度报道,透露 OpenAI 公司正在测试“深度循环”(recurrent depth)技术,可能导致研究人员更难解释模型的“思维链”(Chain-of-Thought)推理过程。 在技术路线方面,包括 ChatGPT、Claude 和 Gemini 等主流模型在内,大部分都基于 Transformer 架构。此类模型通常按线性步骤处理信息,并可在部分场景下用自然...
谷歌 DeepMind 发布 WeatherNext 3:分辨率最高 5 公里,号称全球最先进、精准 AI 天气预报模型
IT之家 9 月 3 日消息,谷歌 DeepMind 和 Google Research 今天宣布推出 WeatherNext 3 ,号称是目前最先进、最准确的全球气象模型。该模型可直接从实时观测中学习,能够为影响人类的天气事件提供更及时、更本地化的预测。 该模型可以原始卫星数据为基础,每小时生成一次高分辨率预报,为全球谷歌产品提供可靠的天气预报。 根据介绍,天气预报的实用性往往取决于细节,以及时间和空间的分辨率。WeatherNext 3 可生成多种空间分辨率的每小时预报,从广阔的全球风型到局部地形都能保持物理一致性。 借助 WeatherNext 3,谷歌能够以 5 公里分辨率呈现温度、湿度等关键地表变量,其他地表变量分辨率为 10 公里,风速等大气变量分辨率为 25 公里。 WeatherNext 3 通过接入 实时全球地球静止卫星数据拼图 ,让模型能够获得丰富、持续更新的大气视图,使模型可以每小时生成一次新预报,每次预报...
教育科技
AI 下一场竞争:谁能成为 Agent 的「上下文操作系统」
头图来源:视觉中国 前段时间,Anthropic 发布了 Model Hardware Standard,尝试给 AI Agent 建立一套与硬件沟通的通用语言。接入这套标准后,显微镜、机械臂等不同厂商、不同接口的设备,可以被 Agent 发现、理解和调用。 这件事指向了 AI 行业正在发生的一次变化。过去一年,竞争主要围绕模型的推理、生成和多模态能力展开;如今,Agent 开始走出聊天窗口,进入实验室、工厂和企业现场。行业的问题随之向下移动:模型已经足够聪明之后,谁来连接工具、硬件、数据和任务? 9 月 2 日,腾讯 WorkBuddy 宣布面向更多伙伴开放合作。通达信、广发证券、北大法宝、腾讯 SSV 教师助手、微盟、北森、云帐房、帆软等应用与软件伙伴进入生态;Plaud、Rokid、影石、优篮子、科大讯飞、安克、猛玛、京造等硬件伙伴,也共同构成了 WorkBuddy 的生态版图。 一款 AI 产品为什么要同时连接专业软件、...
AI 让“赛博蟑螂”学会自主避险,识别危险环境准确率达 93%
9 月 3 日,据《日经亚洲》报道,研究人员正尝试将人工智能、传感器和通信设备安装在昆虫身上,利用昆虫体型小、感知灵敏和能耗低等特点,执行灾区搜救任务。一套最新系统可分析蟑螂的心跳、神经信号和身体动作, 识别周围环境并引导其逃离危险区域,最高识别准确率达到 93% 。 ▲ 一只昆虫搭载着由冈本圭介教授团队研发的昆虫协同电路 传统的“赛博昆虫”通常由外部人员直接控制。昆虫身上安装电极、传感器和通信设备后, 操作者可远程改变其移动方向并采集现场信息 ,使其进入人类和常规机器人难以抵达的狭窄空间。 由日本大阪大学教授森岛圭祐领导的国际研究团队开发了一种“昆虫协同回路”,希望减少对人工控制的依赖。研究人员为蟑螂安装背包式设备,用于测量心跳、神经信号和身体运动,再由 AI 分析这些数据,判断蟑螂可能处于何种环境,并结合昆虫自身的运动反应引导其行动。 研究团队把搭载该系统的蟑螂放入五种不同环境,包括紫外线照射、化学物质暴露和高温环境。表现最...
小红书治理 AI 制作虚假探店、民宿内容,今年 6-8 月清理相关内容近 12 万条
IT之家 9 月 3 日消息,小红书官方账号“薯管家”今日发布《关于 AI 制作医美、民宿等虚假内容治理公告》,宣布将 AI 制作发布虚假内容纳入常态化治理。 IT之家从公告获悉,小红书近期发现部分账号利用 AI 生成虚假体验笔记,用 AI 生成或拼接的图片伪造实景, 杜撰探店、住宿、就医、美容等使用体验等内容 ,误导用户决策。 小红书积极响应主管部门相关管理要求,切实履行平台主体责任,已将 AI 制作发布虚假内容纳入常态化治理。平台从三方面加大治理力度: 一是细化管控重点,以 AI 生成图片伪造实景、AI 批量生成同质化体验笔记、虚构亲历经历为高风险场景重点识别,文旅住宿、医疗医美、教育、房产等品类优先覆盖; 二是聚焦存量清理,从笔记、评论、账号等多环节清理历史虚假内容; 三是增补策略严控新增,同步强化未标识 AI 内容的识别能力,对同一图片或视频跨地域、跨账号重复使用的情形加强检测。 今年 6-8 月, 平台清理处置 AI ...
文化创意
Reopening Copilot Business and Enterprise signups
事实摘要:这条英文动态主要涉及文化创意、开源生态,原文信息显示:Reopening Copilot Business and Enterprise signups 事实摘要:这条英文动态主要涉及文化创意、开源生态,原文信息显示:Reopening Copilot Business and Enterprise signups 事实摘要:这条英文动态主要涉及文化创意、开。影响判断:它可能改变文化创意、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪文化创意、开源生态方向的选题、竞品观察和落地方案筛选。
llm-gemini 0.34
事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:llm-gemini 0.34 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:llm-gemini 0.34 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:llm-gemini 0.34 事实摘要:这条英文动态。影响判断:它可能改变智能体工作流、模型能力与工程、文化创意相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、文化创意方向的选题、竞品观察和落地方案筛选。
How we make AI coding more cost efficient without sacrificing task quality
事实摘要:这条英文动态主要涉及智能体工作流、文化创意、开源生态,原文信息显示:How we make AI coding more cost efficient without sacrificing task quality 事实摘要:这条英文动态主要涉及智能体工作流、文化创意、开源生态,原文信息显示:How we make AI coding more cost 。影响判断:它可能改变智能体工作流、文化创意、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、文化创意、开源生态方向的选题、竞品观察和落地方案筛选。
Playco cut manual fixes 50% prototyping games with GPT-6 Astra
事实摘要:这条英文动态主要涉及模型能力与工程、开源生态,原文信息显示:Playco cut manual fixes 50% prototyping games with GPT-6 Astra 事实摘要:这条英文动态主要涉及模型能力与工程、开源生态,原文信息显示:Playco cut manual fixes 50% prototyping games with G。影响判断:它可能改变模型能力与工程、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程、开源生态方向的选题、竞品观察和落地方案筛选。
因 FSD 超速收到罚单,博主要求特斯拉承担责任
IT之家 9 月 3 日消息,当交通警察开出超速罚单时,法律责任通常由坐在驾驶座上的人承担。不过,在最近一起由特斯拉 FSD(监督版)引发的交通违法事件后,一位特斯拉社区知名内容创作者决定把这张罚单直接“转交”给特斯拉。 特斯拉内容创作者 @DrKnowItAll16 在 X 平台上发文称,自己的 Cybertruck 在开启 FSD 的情况下超速行驶,因此收到了罚单:“我一直都说,如果有一天我在特斯拉 FSD 驾驶车辆时收到超速罚单,而且我自己无法直接调整车速,我就会要求特斯拉支付这张罚单。好了,特斯拉,现在给你了。” 虽然这一举动更多只是象征性的,并不是真的期待特斯拉替自己缴纳罚款,但这一事件也反映出,随着特斯拉近期更新 FSD 软件,越来越多用户开始对其处理道路限速的方式感到不满。 问题的根源在于特斯拉近期对 FSD 软件进行的调整。在较早版本中,驾驶员可以通过方向盘右侧的滚轮,为车辆设置一个明确的最高速度上限。 但在最近...
开源项目
摩尔线程:公司已打通具身智能完整链路
IT之家 9 月 3 日消息,据新浪财经报道,摩尔线程在今日召开的 2026 年半年度业绩说明会介绍称, 公司已经打通具身智能从合成数据生成、大模型训练、仿真验证到端侧硬件部署完整链路 。 IT之家从原报道获悉,MT Lambda 是摩尔线程推出的全栈具身智能仿真平台,公司还开源了基于 MUSA 架构的 GPU 加速物理仿真后端 MuJoCo Warp MUSA,并完成四足机器狗和两足人形机器人 Sim2Real 真机验证。 摩尔线程在无锡设立工业具身智能创新中心,联合生态伙伴共建;同时与国家具身智能应用中试基地成立“具身智能算力与仿真联合实验室”。具身智能需要 AI 计算、物理仿真、图形渲染和端侧推理协同,正好体现了全功能 GPU 的差异化优势。
Decoding the new AI lingo: Loops, harnesses, squads, hill climbing… oh my!
这条英文动态主要涉及开源生态。原文要点:From loop engineering to harnesses, squads, and open weights, the GitHub Podcast breaks down the AI terms showing up in developer conversations. The post Decoding the new AI lingo: Loops, harnesses, squads, hill climbing… oh my! appeared first on The GitHub Blog .