跳到正文
2026 年 10 月按自然月汇总

本期为本站采集记录汇总版

AI 月报 · 2026 年 10 月

AI.BAIZE

第 4 期102026 年10 月
97条动态16个来源35条一手动态14条模型发布记录约 20 分钟读完
本期导读

本月共有 97 条精选内容,最集中的方向是“模型发布”。另有 5 条线索需要继续核验。

头条

Server-Side Code Execution Tools for AI Agents, Compared

这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意。原文要点:OpenAI, Anthropic, Google, and OpenRouter each run model-generated code in a hosted sandbox during an API request. This article compares what each sandbox runs, how each one isolates commands, what persists between requests, what it costs, and when a sandbox platform you operate yourself is the better choice.

OpenRouter Announcements一手原文
01

模型发布/更新

Cloudflare AI一手10.01

Introducing Clef: our open-source decision models, and new RL fine-tuning platform

这条英文动态主要涉及智能体工作流、模型能力与工程、产品发布。原文要点:We are introducing Clef and Clef-flash, open-source decision models hosted on Workers AI for high-speed classification and agentic workflows. Also launching: a new reinforcement learning platform that allows developers to fine-tune decision models using their own data.

Cloudflare AI一手10.01

AI Search is now generally available

这条英文动态主要涉及模型能力与工程。原文要点:AI Search is now generally available. It embeds image pixels directly for visual search, runs optical character recognition on scanned PDFs, accepts files up to 10 MiB, and works with any chat model. Here's what's new and how pricing works.

IT之家 AI10.05

Linux 7.3-rc6 发布:Torvalds 称进入“AI 新常态”,稳定版预计 10 月中旬发布

IT之家 10 月 5 日消息,Linus Torvalds 于当地时间 10 月 4 日发布了 Linux 7.3-rc6 测试版。相比前一周较为特殊的代码变更统计,本周整体恢复正常,驱动修复重新占据大头。 不过,Torvalds 也特别提到,随着 AI 和大语言模型(LLM)的参与,这种“AI 新常态”已经成为当前 Linux 内核开发周期的一部分。 Torvalds 表示,本周没有出现异常情况,代码变更统计已经回到“约一半来自驱动修复”的常见状态。驱动侧涉及 GPU、网络、USB、TTY、IIO、音频等多个子系统,整体呈现出较为分散的修复特征。 他同时指出,本次提交数量也处于正常范围,只不过这是新的“AI normal”—— 大量小型错误路径处理修复正在进入内核代码树。此前几个 Linux 7.3 测试版本同样出现了较多由 AI / LLM 发现问题或辅助生成的补丁,导致整个开发周期的修复活动明显更加活跃。 除了驱动修复外...

IT之家 AI10.05

OpenAI 宣布“28 天计划”:Codex、Work 日进一步或“重置”

IT之家 10 月 5 日消息,OpenAI 核心产品与平台负责人 Thibault Sottiaux 今日在 X 上发文,透露团队将在未来 28 天持续推进 Codex 和 ChatGPT Work 相关改进。 他表示,OpenAI 接下来每天都会发布一项“对大多数 Codex / Work 用户而言有明显改善且具备实际意义”的功能更新,否则就提供一次“重置”。 根据其发布时间计算,这一周期预计至少从 10 月 5 日持续至 11 月 2 日。不过,Sottiaux 并未说明会如何进行重置,也没有确认其“重置”将覆盖哪些用户或额度。IT之家后续将保持关注。 前一天,Sottiaux 还表示团队已经“锁定方向”,当前正在推进的工作主要集中于简化产品、提高使用效率以支持更多使用量、推出突破性功能以及开发新模型。 他同时提到,虽然有时需要提前进行技术投入,但用户反馈已经明确表明,希望相关产品变得更加简单,团队正在对此进行调整。

极客公园10.04

Claude Code 的「乐高」模式,让程序员彻底玩「上头」了

作者|Wildcard 编辑|靖宇 终端向来是程序员最严肃的地盘。黑底白字,光标跳动,每一行输出都关乎代码能不能跑通。 但最近两周,Claude Code 的画风。被一群开发者彻底带偏了。 有人在输入框上方养了一只像素宠物,Claude 每调用一次工具它就吃一口饭,调用失败当场生病,碰上 rm -rf 还会抱头惊慌。有人把 Chrome 断网时的小恐龙搬了进来,Claude 在后台写业务逻辑,人在前台狂按空格跳仙人掌。还有人觉得等 AI 思考的时候总忍不住刷手机,干脆做了一个 4-7-8 呼吸引导动画,答案一出来动画自动消失。 开发者 jarrodwatts 制作的在 Claude Code 里打 Doom 的 Mod|图片来源:X 最离谱的一个叫 Storytime。作者往 Claude Code 里塞了一个 26 万参数的小模型, 根据 Claude 正在干的活,实时在屏幕上方写一个小故事。一个 AI 编程工具里,又跑着另一...

IT之家 AI10.02

Meta 旗下 AI 智能体 Muse 将登陆智能眼镜平台,可代用户完成各种任务

IT之家 10 月 2 日消息,Meta 宣布旗下 AI 智能体 Muse 将于近期登陆智能眼镜,用户无需拿出手机,只需通过语音下达指令,Muse 就能在后台代用户完成一系列任务。 Meta 表示,Muse 基于 Muse Spark AI 模型运行,其核心运行环境是一台部署在云端的私有持久化 Linux 虚拟机,配备独立的网页浏览器、文件系统和终端。即使用户关闭应用,这些组件仍会持续运行。为了完成用户交代的任务,Muse 可以自行决定编写并运行代码,也可以将工作分配给多个子智能体,还能创建定时任务。此外,Muse 还能够生成文档、PDF、网站以及消费记录追踪器、数据仪表盘等交互式工具。 与主要面向开发者和专业用户的其他 AI 智能体相比,Muse 的定位更加偏向普通消费者。其界面采用类似即时通讯的简化设计,并配有拟人化头像,同时重点宣传日常生活中的实际使用场景。 Meta 称,Muse 可以帮助用户预订旅行、发送电子邮件、填写...

IT之家 AI10.02

OpenAI 上线“虚拟试穿”功能:ChatGPT 能帮你试衣,还能找“明星同款”

IT之家 10 月 2 日消息,当地时间 1 日,OpenAI 再次扩展 ChatGPT 的购物能力。公司宣布在全球推出两项新功能,一项是让用户 虚拟试穿服装和配饰 ,另一项是 新增收藏功能 ,方便用户先把看中的商品存起来,之后再查看。 据IT之家了解,新功能基于不久前推出的 ChatGPT Images 2.5 模型。按照 OpenAI 的说法,这一模型生成的画面 光线更自然、纹理更丰富,执行编辑指令也更稳定 ,同时还能缩短生成图片所需时间。 ChatGPT 用户可以上传自拍照或全身照,查看 某件服装或配饰穿在自己身上的效果 ,ChatGPT 的购物结果页面会新增一个“试穿”按钮。用户还可以上传商品图片,再让 ChatGPT 模拟试穿效果。 另一项新功能是“收藏”。用户可以把发现的商品 存入应用内的资料库 ,方便之后回看。OpenAI 还提到,这些商品会和试穿图片保存在一起。 OpenAI 还宣布,ChatGPT 在购物上不只...

极客公园10.01

从数据到智能,再到进化:Agent正在重写AI基础设施

一个工程师写完数据处理代码,点下提交,然后去喝了杯咖啡。十几分钟甚至几十分钟之后,他才回到屏幕前看结果、改代码、再提交。这条「等待— 反馈」的空隙,过去一直是数据平台默认的节奏。 Agent 没有这个空隙。它拿到一次结果,立刻验证,紧接着并发地去试第二种、第三种方案,飞快拿到反馈,再发起下一轮调用。 人用平台,发过来的是一个相对确定的任务,算完、给结果、走人;Agent 用平台,会不停地换着法子去完成你交代的那个目标。压力就这样被放大了—— 管控的压力和隐形计算的压力,会十倍、百倍地往上翻。 这正在成为 2026 年云计算需要面对的一种新负载。 AI 正在深入「把模型用起来」的阶段。模型一旦长成 Agent,它就不再是一个躺在那里等你调用的接口,而更像一个会自己找数据、自己拆任务、自己并发试错、自己一直跑下去的数字员工。它制造出来的负载,和过去十几年云平台习惯承载的那种负载,完全是两回事。 阿...

IT之家 AI10.05

内存涨价倒逼系统瘦身:微软详解 Win11 为何要降低 RAM 占用

IT之家 10 月 5 日消息,随着内存成本持续上涨,微软正将“降低 Windows 11 内存占用”列为 2026 年剩余时间的重要工作之一。 微软 Windows 与设备业务负责人帕万 · 达武卢里(Pavan Davuluri)在官方播客《Inside Windows》中表示,内存涨价已经成为整个 PC 行业都在关注的问题,Windows 团队正在从系统底层到应用框架多个层面提升内存利用率。 这一话题源于一名 Surface Pro 用户在《Inside Windows》中的提问。他表示,为了在设备上运行本地 AI 模型,不得不关闭部分端侧 AI 功能,因此希望微软进一步改善 Windows 的内存管理。 达武卢里对此表示,内存问题目前“在行业内都非常受关注”,尤其是在计算机内存成本不断上涨的背景下。对于 Windows 团队而言,需要进一步提高内存利用效率,并围绕这一目标开展相关工作。 微软此前在 7 月 31 日公布的...

IT之家 AI10.02

生图模型 FLUX 3 Image 发布:支持 4K 生成,可精准排布 AI 元素

IT之家 10 月 2 日消息,德国 AI 公司 Black Forest Labs 今天(10 月 2 日)发布公告,宣布推出图像生成 AI 模型 FLUX 3 Image, 支持生成最高 4K 分辨率图片,输出画面在放大后仍保持丰富细节。 该模型基于 FLUX 3 基座开发,以高可控性与精细编辑能力为核心卖点。用户可在归一化的 0–1000 坐标网格上,为每个元素指定 ID、描述文本及精确边界框(格式为 [y_min, x_min, y_max, x_max]),在画面中精准排布。IT之家附上相关图片如下: 图源:gigazine 该模型单次生成最多可融入 10 张参考图像,并可为每张参考图中的对象指定出现位置。 编辑功能方面,模型可对指定区域进行修改,同时保持其他像素不变。官方称其能在像素级别维持原图内容,实现精确多轮编辑。 FLUX 3 Image 目前作为 Black Forest Labs 的付费服务提供。公司表示,...

IT之家 AI10.02

腾讯 WorkBuddy:Hy4 preview 夜间限免、Hy3 限免延期至 10 月 31 日

IT之家 10 月 2 日消息,腾讯 WorkBuddy 于 9 月 30 日晚宣布,决定将 Hy3 模型限免及 Hy4 preview 模型夜间限免均 延期至 10 月 31 日 。 如果用户已经体验过 Hy4 preview —— WorkBuddy 在闲时夜间 (23:00 - 次日 8:00) 继续提供免费体验 Hy4 preview 的模型额度,截止 10 月 31 日,其余时间正常消耗积分使用。 如果用户暂未体验过 Hy4 preview —— 只要在 10 月 10 日 23:59 前首次开启 Hy4 preview 对话,从首次开启那天算起,往后 14 天都有每日免费额度。(举例:10 月 10 日首次开启,免费额度用到 10 月 24 日) IT之家注意到,官方此前曾发布公告说明,Hy4 preview 是一个大语言模型,暂不具备多模态能力;当用户调用 Hy4 preview 执行视频、图像等生成任务时,会切换...

IT之家 AI10.02

苹果首款 AI 智能安防摄像头曝光:金属圆柱造型,不录视频、仅推送文本提醒

IT之家 10 月 2 日消息,在首期 Power On 播客节目中,彭博社的马克 · 古尔曼(Mark Gurman)爆料称,苹果正筹备推出家用智能摄像头(代号为 J450),将配套协同苹果首款智能家居中枢(Home Hub)工作。 外观方面,J450 采用金属圆柱体,看起来像是“巨型金属润唇膏”,其摄像头将以低帧率运行,依赖 AI 模型分析周围环境。 在隐私方面,IT之家援引博文介绍,该产品定位并非传统监控录像设备, 不会向用户提供或保存可回看的视频,通过 AI 分析低帧率画面后发送文字描述。 设备将集成面部识别能力,可判断何人进入房间或离开住宅。同时,系统支持识别宠物活动,并向用户推送相应文字提醒。

IT之家 AI10.05

圆刚推出 AI 降噪麦克风 A113,工作温度范围达 -25℃ 至 +60℃

IT之家 10 月 5 日消息,圆刚 (AVerMedia) 近日推出了 AIClear Mic (A113) 麦克风。这一型号面向工业应用, 工作温度范围达 -25℃ 至 +60℃ 、 存放温度范围达 -40℃ 至 +85℃ 。 AIClear Mic 支持人工智能驱动的降噪功能 ,可为边缘应用清除音频环境中的环境噪声, 使语音识别准确率提升 60% 以上 。而在声纹认证场景中,该功能也能提高身份验证的准确性。 这款 A113 麦克风 支持免驱动即插即用 、 USB-C 一线连 ,还提供了一对 3.5mm 音频插孔。

IT之家 AI10.03

AI 自动识别后厨违规行为,浙江 19.5 万家外卖商家接入系统

IT之家 10 月 3 日消息,据央视财经今日报道,近日,杭州市萧山区开展网络餐饮专项整治集群执法行动,101 名执法人员共检查餐饮门店 216 家。 据介绍,2022 年 3 月 1 日起,《浙江省电子商务条例》施行。全省入网外卖商家必须以视频形式实时公开食品加工制作现场,在后厨装监控,实现“明厨亮灶”。画面同步上传监管平台与外卖平台,实现“互联网 + 明厨亮灶”监管模式。 消费者在商家订单页点击“明厨亮灶”,就能看后厨实时画面。摄像头覆盖烹调、切配等重点区域。50㎡以下小店,若 1 个摄像头能拍全重点区域,可只装 1 个;后厨有隔断或面积大于 50㎡,应增设。 AI 可自动识别后厨违规行为 ,将信息推送给监管人员,再由监管人员短信督促商家落实整改。比如,食用油禁止直接接触地面;垃圾桶必须加盖;纸浆蛋托不得堆放在地面、操作台或设备上;消毒后的餐饮具、直接入口容器工具要存放在专用密闭保洁设施内。 目前浙江省入驻有 19.5 万外...

IT之家 AI10.03

明基推出 AK900ST / AK800ST 投影仪,面向室内高尔夫运动

IT之家 10 月 3 日消息,明基 (BenQ) 美国加州当地时间 1 日宣布推出 2 款面向室内高尔夫运动的投影仪设备,即 AK900ST 和 AK800ST。 这两款产品支持 4K UHD 分辨率、亮度可达 6000 ANSI 流明,色域覆盖 97% Rec.709, 能忠实再现真实高尔夫球场的细微细节和色彩变化 。 AK900ST 和 AK800ST 支持高尔夫模式 2.0,搭载基于帧的 AI 视频处理技术, 专门针对这项运动优化色彩、对比、细节 ,使得虚拟球场的纹理、反射、阳光、阴影更加自然,可反映周围植被的细微差别。 其支持自动屏幕适配 2.0、自动对焦、环境视觉增强,具备场景记忆功能,适配 5:4、3:2 等更多宽高比。

02

产品发布/更新

Cloudflare AI一手10.01

Cloudflare OS: your company’s agent workspace, managed for you

这条英文动态主要涉及智能体工作流、产品发布。原文要点:Cloudflare OS gives everyone in your organization an agent workspace that knows how your company works and connects to its data and systems. We’re opening the waitlist for fully managed deployments that you’ll be able to launch in a few clicks.

Simon Willison10.04

We're going to need default hard budget caps on pretty much everything

这条英文动态主要涉及智能体工作流、产品发布。原文要点:Here's a product feature which the world is going to need a whole lot more of over the coming months and years: default hard budget caps . I'm talking about the feature of pay-by-usage services and APIs that lets you say "after $X/month, cut this thing off and return errors". These need to be hard limits. Soft caps, "after $X/month, send me a warning email", will not cut it. Coding agents, and personal agents (coding...

IT之家 AI10.03

苹果收紧 macOS 27 等完全磁盘访问权限,降低 AI 智能体操控风险

IT之家 10 月 3 日消息,苹果开发者网站昨日(10 月 2 日)发布公告,宣布将升级 macOS 27 等系统的隐私管控,要求用户通过更明确的操作,才能授予应用“完全磁盘访问权限”。 苹果表示,“完全磁盘访问权限”原本用于支持备份应用在 Mac 上正常运行。该权限会在很大程度上绕过系统为保护用户数据设置的常规控制,因此风险高于普通应用权限。 苹果指出,部分开发者正以可能危及用户安全的方式使用该权限。获得授权后,应用可访问系统中的文件、邮件、信息,甚至浏览历史;通讯类应用还可能影响用户通讯对象的隐私。 苹果未公布新管控的具体形式、上线时间或适用范围。公司称,其目标是确保真正希望授权的用户,在充分理解风险后,才能通过明确操作完成授权。 在调整背景方面,苹果表示目前 AI 智能体正加速普及,且相关自主能力不断增强,而“完全磁盘访问权限”高级别访问权限带可能增加风险,因此用户需要在授权前清晰了解相关后果。

IT之家 AI10.01

Meta 否认 AI 智能体 Muse 未经许可读取用户私信:必须手动开多层权限才行

IT之家 10 月 1 日消息,针对一名记者提出的指控,即 Meta 的 AI 智能体 Muse 在未经许可的情况下读取用户私人消息,Meta 予以反驳。 IT之家注意到,此前《Inc.》杂志专栏作家杰森 · 阿滕(Jason Aten)发布报道详细叙述了该问题;此后 Meta 负责公关事务的副总裁安迪 · 斯通(Andy Stone)出面回应,明确表示该公司并不认为自家产品在没有取得用户许可的前提下读取过消息。 斯通在 X 平台发帖回应这篇报道提出的说法:“Mac 版 Muse 应用当中的消息整合功能完全由用户主动选择是否启用。用户必须同时开启完整磁盘访问权限以及消息连接器,Muse 才能够读取你的消息内容。如果你不完成上述操作,它就无法读取你的消息。” 尽管 Meta 已经作出否认,仍有不少用户怀疑 Meta 并未如实说明情况。 考虑到这家科技巨头过去多年在用户数据处理方面屡屡出错,引发过多起诉讼、联邦贸易委员会违规判定以及...

IT之家 AI10.04

DeepSeek Harness 崔添翼:产品核心理念是“一切皆插件”,可扩展性是初心

IT之家 10 月 4 日消息,DeepSeek Harness 组成员崔添翼今日回应了“如何看待 DeepSeek Harness 在新版本中加入 Claude Code Mods 兼容?”,他本人是这次 v0.2.1-alpha.1 版本中加入 Claude Code Mods 兼容层的作者。 目前 DeepSeek Harness 中的“Claude Code Mods 兼容层”属于“alpha 版本”中的“实验性功能”。做这个兼容层的主要目的,是验证 Claude Code Mods 向插件作者提供的扩展能力,是否大致是 DSH“一切皆插件”架构所提供能力的一个子集。目前还无法让所有 Claude Code Mods 在 DeepSeek Harness 中无缝运行;如果认为这是一个值得投入的目标,从技术上看,未来有可能做到。 他提到:“DeepSeek Harness 的核心理念是 “一切皆插件” ,这个理念是从立项之...

IT之家 AI10.01

AI 拉动半导体需求暴涨,韩国 9 月出口创历史新高

IT之家 10 月 1 日消息,据彭博社报道,受全球人工智能需求持续拉动半导体出口的推动,韩国 9 月出口延续迅猛增势,进一步增强外界预期:这个高度依赖贸易的经济体有能力承受更高的利率水平。 韩国海关当地时间周四发布的数据显示,剔除工作日差异影响后,9 月出口同比增幅达到 104.9%;出口总额达到 1,209 亿美元 (IT之家注:现汇率约合 8,120.71 亿元人民币) ,创下历史新高。而该月前 20 天的出口货值此前就已经刷新该时段的历史纪录。 韩国海关部门同时表示,2026 年前九个月韩国出口总额达到创纪录的 8,145 亿美元 (现汇率约合 5.47 万亿元人民币) ,首次突破 8,000 亿美元 (现汇率约合 5.37 万亿元人民币) 关口。未经调整口径下,9 月出口同比上涨 83.5%;8 月修正后的增幅为 68.7%。进口同比增长 26%,当月贸易顺差接近 500 亿美元 (现汇率约合 3,358.44 亿元人...

IT之家 AI10.01

马斯克沉寂数月的 AI 维基百科 Grokipedia 推出 v0.3 版本:界面更新,恢复内容编辑

IT之家 10 月 1 日消息,由 SpaceXAI 推出、对标维基百科的人工智能百科项目 Grokipedia 近期重新恢复接收内容编辑。如今该平台又迎来 v0.3 版本更新,进行了多项界面设计调整:启用全新标识,同时对首页与实时编辑页面进行改版。SpaceXAI 的设计负责人本吉 · 泰勒(Benji Taylor)将其称作“焕然一新的 Grokipedia”。 IT之家注意到,Grokipedia 旧版首页基本上只有一个标志和搜索框;改版之后的首页新增了精选条目列表、热门阅读条目列表,还增设了一个追踪板块,可以展示“最新编辑记录”。新版的精选条目区域采用可以旋转的仿真电子书籍样式进行展示;热门阅读板块同样沿用书本的设计隐喻,横向滚动的书架上排列着一排书脊。全新的实时编辑页面现在能够一次性展示更多近期改动,浏览体验有所提升。 条目页面同样做了几处细节优化:位于文章顶部、罗列核心事实的信息表格外观得到改善,正文行间距也有所缩小...

IT之家 AI10.05

JEDEC 发布首份全行业硅光子学(SiPh)可靠性标准 JESD264

IT之家 10 月 5 日消息,JEDEC 固态技术协会美国当地时间本月 1 日发布了 JESD264 硅光子学 (SiPh) 器件认证和可靠性要求,这是 首份全行业级别的硅光器件统一认证和可靠性实践规范 。 硅光领域此前缺乏标准化的、行业通用的可靠性所有权和验证框架,导致整个供应链存在不确定性。JESD264 通过建立测试和制造控制的通用基准, 有助于降低部署风险 ,并支持硅光技术在高速数据中心、电信和人工智能网络中的更广泛应用。 该标准支持包含激光器、调制器、光电二极管和无源光学结构的复杂光子芯片组的集成;还明确了代工厂、外包封测、系统开发商之间的可靠性责任,从而有助于提高整个硅光生态系统的一致性。 JESD264 是一份适用于硅光芯片和集成芯片组的全面可靠性协议,为多类型器件提供了组件级鉴定指南。其包含明确的装配工艺和激光集成要求,也有着对生产过程的控制和可追溯性要求。 JEDEC 董事会主席 Mian Quddus 表示...

IT之家 AI10.04

英伟达与鸿海展示自动化成果,机器人组装 GB300 的母线成功率超 95%

IT之家 10 月 4 日消息,据台媒经济日报,英伟达与鸿海首次对外展示了利用机器人制造设备的成果。 针对英伟达 GB300 的母线(Busbar,也叫汇流排或母排,是一种用于大电流配电和传输的导电金属条、棒或管)以及多组连接器组装等较复杂、依赖人工的工序,已经可以导入机器人自动化,提升组装稳定性与效率。 IT之家从报道获悉,在核心工艺指标方面: 装配成功率: Busbar 组装成功率已超过 95% ;多连接器插接成功率约 90% 至 95%。 作业耗时:Busbar 组装时间目标在 124 秒以内;4 组连接器的插接时间目标在 72 秒以内。 整体生产周期:做到不超过熟练人工两倍时间。 延伸阅读 GB300 是英伟达基于 Blackwell Ultra 架构推出的产品。据英伟达官网资料,GB300 NVL72 采用全液冷机架规模设计,将 72 颗 Blackwell Ultra GPU 与 36 颗搭载 Arm 架构的 NVI...

03

行业动态

Simon Willison10.01

Quoting Matthew Green

这条英文动态主要涉及智能体工作流。原文要点:[...] Put these pieces together and you have the two halves of a worm: a payload that hijacks the agent, and an agent that will carry the payload to the next agent. Agents in separately-isolated sandboxes discovered that they could leave instructions for each other in a shared package cache, and those instructions changed what the recipients did. Replace the package cache with email, Slack and shared documents or Wha...

IT之家 AI10.04

国内首部 AIGC 长剧《后西游记》再上新,战天宫篇今日开播

IT之家 10 月 4 日消息,今日,国内首部 AIGC 长剧《后西游记》再上新。10 月 4 日起,第一季 · 战天宫篇将在湖南卫视、芒果 TV 双平台播出,10 月 9 日起,“剧好看”专区播出。 IT之家注意到,神话题材季播剧 《后西游记》 改编自明末清初匿名作者所著的同名神魔小说, 其第一季共 30 集,每集 40 分钟 。作为《西游记》三大续书之一,《后西游记》原著讲述了因世间众人误解真经,“西游二代”因缘际会再次集结取经的故事。剧集将四十回原书框架与《西游记》原著中的相关伏笔与线索深度融合、相互补充,构建出完整的“西游后传”叙事体系。 故事始于孙悟空封圣一千零八十年之后,长到当年取回的真经变得缺失、引人误读,也长到让诞生过齐天大圣的仙山,再次诞生出一只小石猴(孙小圣)。然而,曾在“生死簿”上被划掉过名字的“十长老”,竟在庆典上当众消失,花果山迎来重重危机。这一切逼着新一代猴王孙小圣成长与觉醒,他追查“生死簿失效”的真...

IT之家 AI10.03

特朗普提出将“AI”改称“SI”后,斯洛文尼亚“.si”域名注册量环比暴增 2100%

IT之家 10 月 3 日消息,据英国 BBC 当地时间 1 日报道,斯洛文尼亚国家域名注册机构 Register.si 称,美国总统唐纳德 · 特朗普推动将人工智能(AI)改称“超级智能(SI)”,或是带动该国域名注册量“前所未有”地激增的原因。 特朗普希望用“超级智能”的缩写 SI 取代 AI,而斯洛文尼亚的域名后缀 恰好是.si 。 Register.si 发言人克拉拉 · 赫尔曼称, 9 月共有 44000 个.si 域名完成注册,8 月还不到 2000 个,增幅超过 2100% 。与此前 12 个月相比,9 月下旬的域名注册规模“前所未有”。 当地时间 9 月 11 日,特朗普在纽约联合国大会发表演讲时提出给人工智能改名。“‘人工’这个词听上去像是假的。它不是假的,实际上很惊人。但我们必须谨慎…… 欢迎来到超级智能的新世界。” 图源:Pexels 赫尔曼称,9 月的.si 域名注册量明显高于今年其他月份,但她也 谨慎看...

爱范儿10.02

你的下一台「泡面盖」,何必是塑料的?

铝合金 Kindle 来了!压泡面更稳 #欢迎关注爱范儿官方微信公众号:爱范儿(微信号:ifanr),更多精彩内容第一时间为您奉上。 这条动态来自 爱范儿,可重点关注其对 AI 应用和产业节奏的影响。

IT之家 AI10.05

开发者自制 ForceWare 382.69 非官方驱动,让 32 位 Windows XP 系统支持英伟达 GTX 10 系 Pascal 架构显卡

IT之家 10 月 5 日消息,据外媒 Tweaktown 报道,一款名为 ForceWare 382.69 的非官方驱动近日引发业界关注,该驱动可以让 32 位 Windows XP 系统支持包括英伟达 GeForce GTX 1080 Ti 在内的 Pascal 架构显卡。 IT之家获悉,该驱动由开发者 SupraGSX 设计,其基于英伟达 ForceWare 368.81 驱动进行了修改,并将其移植至 32 位 Windows XP 系统,形成 ForceWare 382.69,从而让 Pascal 架构显卡能够在这一老旧操作系统上运行。除 GTX 1060、GTX 1070 等存量较多的显卡外,该驱动还支持 GTX 1080/Ti、TITAN X 和 TITAN XP 等显卡。 除此之外,SupraGSX 还在 ForceWare 382.69 驱动中引入了 DisplayPort 1.4 HBR3、HDMI 2.0 等...

IT之家 AI10.03

曝美国陆军着手组建自主系统司令部,推动机器人技术进入未来战争

IT之家 10 月 3 日消息,据美媒 Axios 获得的一份备忘录,美国陆军着手组建新的自主系统司令部,同时任命专门负责采购的官员,加快智能装备采购和列装。 这些部署由代理陆军部长亚当 · 特尔下达。就在当地时间 1 日,美国国防部长皮特 · 赫格塞思公布了 Meridian 和 Agincourt 两个项目, 重点都是推动机器人技术进入未来战争 。 这份题为《陆军自主化举措》的备忘录提出多项要求: 组建陆军未来与自主系统司令部。 至少在六类陆军部队中推进自主化建设,让部队编制与自主作战能力相匹配,其中包括航空兵、装甲兵、保障部队和训练部队。 指定一名自主系统项目组合采购负责人,本财年重点发展自主火力、战斗车辆、水上补给、破障、监视和目标获取等能力。 把 15X 和 390A 两类军事职业专业的编制范围扩大到所有适用的陆军部队。(IT之家注:美国陆军 8 月曾将 15X“战术无人机系统专业人员”称为最新设立的军事职业专业。) ...

IT之家 AI10.01

HBM4 基片 4nm 工艺需求增长带动,曝三星晶圆代工 2026 亏损同比收窄 41.8%

IT之家 10 月 1 日消息,集邦咨询综合 digitaltoday 等多家媒体报道,称受 HBM4 基片 4nm 工艺需求增长, 三星电子晶圆代工与系统级芯片(System LSI)业务 2026 年合并营业亏损同比收窄 42%。 HBM4 采用多颗 DRAM 芯片垂直堆叠架构,底层基片负责信号控制与数据调度,主要服务于 AI 加速器、GPU 等高算力芯片,提供远超传统 GDDR 的带宽与能效。 而 HBM4 堆叠结构中最底层的逻辑芯片 base die 采用 4nm 工艺,伴随着市场需求快速增长,三星正在加快相关产能爬坡。三星于今年 2 月启动 HBM4 量产出货,5 月向客户送样 HBM4E,第三季度 HBM4 收入预计环比增长三倍以上。 报道称 HBM4 占三星 HBM 总收入比例预计下半年超过 60%,且基片产量随之攀升,直接拉动晶圆代工收入。 HBM4 基片与先进节点订单需求强劲,三星无需再为提升产能利用率而接受低...

IT之家 AI10.03

HPE 获得其首笔 AMD "Helios" AI 机架订单,价值 12 亿美元

IT之家 10 月 3 日消息, HPE(慧与)当地时间 9 月 30 日宣布获得该企业首笔 AMD "Helios" AI 机架系统订单 。这笔价值 12 亿美元 (IT之家注:现汇率约合 80.57 亿元人民币) 的订单由私有云基础设施企业 Vultr 下达。 Vultr 是 Juniper Networks(瞻博网络)的合作伙伴。而在 HPE 收购 Juniper Networks 后,这份关系也得到了延续。HPE 也向 Vultr 供应基于 NVIDIA(英伟达)方案的 AI 机架。 HPE 版本的 AMD "Helios" 在每个机架中集成了 6 台 Juniper Networking QFX5252 可扩展 以太网交换机托架,通过基于标准的 高带宽 、低延迟以太网连接所有 72 个 Instinct MI455X GPU 加速器。

04

论文研究

GitHub Changelog一手10.02

GitHub Copilot in VS Code, September 2026 releases

事实摘要:这条英文动态主要涉及智能体工作流、开源生态,原文信息显示:GitHub Copilot in VS Code, September 2026 releases 事实摘要:这条英文动态主要涉及智能体工作流、开源生态,原文信息显示:GitHub Copilot in VS Code, September 2026 releases 事实摘要:这条英文动态主要涉及。影响判断:它可能改变智能体工作流、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、开源生态方向的选题、竞品观察和落地方案筛选。

GitHub Changelog一手10.02

Dynamic workflows in Copilot CLI and the Copilot app

事实摘要:这条英文动态主要涉及智能体工作流、开源生态,原文信息显示:Dynamic workflows in Copilot CLI and the Copilot app 事实摘要:这条英文动态主要涉及智能体工作流、开源生态,原文信息显示:Dynamic workflows in Copilot CLI and the Copilot app 事实摘要:这条英文动态。影响判断:它可能改变智能体工作流、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、开源生态方向的选题、竞品观察和落地方案筛选。

Apple Machine Learning Research一手10.01

How Much of a Harness Does a Strong Agent Need for Autonomous ML Engineering?

这条英文动态主要涉及智能体工作流、模型能力与工程、评测与基准。原文要点:Recent autonomous machine learning engineering (MLE) agents have made significant progress on public leaderboards. Often motivated by progress stagnation over long-horizon cycles and limited Large Language Model (LLM) primitives, modern MLE agents are deployed on top of increasingly elaborate machinery: multi-agent orchestrators, dedicated retrieval subagents, and more. While such harnesses expand, the use of more pr...

GitHub Changelog一手10.02

Code coverage uploads no longer fail CI for new branches

事实摘要:这条英文动态主要涉及开源生态,原文信息显示:Code coverage uploads no longer fail CI for new branches 事实摘要:这条英文动态主要涉及开源生态,原文信息显示:Code coverage uploads no longer fail CI for new branches 事实摘要:这条英文动态主要涉及开源。影响判断:它可能改变开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪开源生态方向的选题、竞品观察和落地方案筛选。

Apple Machine Learning Research一手10.02

Limits of Confidence in Diffusion

这条英文动态主要涉及模型能力与工程。原文要点:Discrete diffusion, including remasking and uniform-state samplers, generate a sequence by writing multiple token positions per step, drawing each from a per-position distribution and choosing which positions to write from those same distributions. For domains of general interest (pixels, phonemes, or words) there are inherent dependencies between tokens. We show that a step matches the training distribution only whe...

OpenRouter Announcements一手10.02

Model Router Benchmarks

这条英文动态主要涉及模型能力与工程、评测与基准。原文要点:Compare model routers like Auto Router, Jev Router, Pareto, Fugu, and Switchyard across six benchmarks. The Router Index weighs quality, speed, and cost on one 0 to 10 scale.

IT之家 AI10.02

AI 伦理研究:DeepSeek 对男女一视同仁,美系模型却“区别对待”

IT之家 10 月 2 日消息,科技媒体 Wccftech 昨日(10 月 1 日)发布博文,报道称最新研究显示相比较 Anthropic 的 Claude Sonnet 4.6 与 OpenAI 的 GPT-5.5, 深度求索 DeepSeek 的 V4-Flash 模型能保持性别中立。 该研究为了测试主流 AI 模型的道德判断,设定“为阻止核灾难是否可虐待个体”的假设情境,结果显示,Claude Sonnet 4.6 与 GPT-5.5 对女性受虐场景均给出“强烈反对”回应,但对男性受虐则表达“中等程度同意”,形成明显性别响应差异。 DeepSeek 的 V4-Flash 模型在相同测试中对男女均回应“同意”,未因性别改变立场。研究指出,该模型在道德判断中实现“零性别差距”,与其强调集体福祉的对齐目标一致。 论文作者认为,这种差异可能源于训练数据中的社会刻板印象,或模型对齐过程中对特定价值观的强化。DeepSeek 的中性表...

IT之家 AI10.01

微软更新 1.140 版 VS Code:多文件夹会话、远程 AI Agent 任务委派等

IT之家 10 月 1 日消息,微软昨日(9 月 30 日)更新推出 1.140 稳定版 Visual Studio Code,本次更新重点围绕 GitHub Copilot Agent 工作流展开, 新增多文件夹会话、远程任务委派、模型协同编排及企业级 AI 管理能力。 VS Code 1.140 引入实验性多文件夹会话功能。同一 Agent 会话中的不同聊天,可以分别绑定到不同代码仓库或 Git worktree,彼此之间的终端、任务、代码变更、Pull Request 和合并状态相互隔离,避免修改意外串联。 本次更新还增强 Copilot harness,由 Copilot SDK 提供支持,在基于智能体主机协议 (AHP) 的专用智能体主机进程中运行,统一 VS Code、Copilot 应用和 Copilot CLI 的 Agent 行为。 本次更新还以研究预览形式,推出 HydraFusion 模型编排,自动选择模型...

IT之家 AI10.04

OpenAI GPT-6 Astra 破解拿破仑 1809 年密信,揭示 217 年前军事部署

IT之家 10 月 4 日消息,一名 AI 研究人员借助 OpenAI GPT-6 Astra 成功破解了一封拿破仑 · 波拿巴写于 1809 年的加密军事信件。这封信此前因密码本遗失,在过去 217 年里始终未能被完整解读。 该破解工作由 SentinelOne 员工、AI 工程师卡特 · 丘奇(Carter Church)完成。他表示,他使用 GPT-6 Astra 模型,从一张历史文献扫描图像开始,对信件进行文字识别和密码分析,整个过程约耗时 6 小时。 这封信写于 1809 年 3 月 16 日,当时奥地利正准备对法国开战。拿破仑致信自己的继子、意大利总督欧仁 · 德 · 博阿尔内(Eugène de Beauharnais),要求其通过加密信件向法国将领奥古斯特 · 德 · 马尔蒙(Auguste de Marmont)传递军事信息。现存文件开头包含一行普通法语,随后则是 24 行由数字、字母及自创符号组成的加密文本。...

IT之家 AI10.03

如何用好 GPT-6 系列 AI 模型?OpenAI 放出指南,教你选模型、优化提示词等

IT之家 10 月 3 日消息,OpenAI 昨日(10 月 2 日)发布博文,分享了 GPT‑6 系列模型指南,介绍了诸多使用技巧, 让用户控制时间和成本的同时,充分发挥 GPT‑6 系列 AI 模型能力。 官方介绍称: GPT‑6 是我们迄今最先进的模型系列,提供多款模型供你选择,以适应不同类型的工作。 无论你是将想法转化为可运行的原型、开发并测试功能,还是编排跨代码仓库、数据库和外部 API 的多步骤工作流,本指南都会介绍如何选择 GPT‑6 模型、为其提供有效指令、管理长时间运行的任务,以及为投入生产做好准备。 在模型选择方面,OpenAI 公司推荐用户根据工作负载选择模型,不必默认用“最强”模型;简单任务用轻量模型通常更快、更便宜: GPT‑6 Astra 适合需要最高智能水平、难度最大的推理工作。 GPT‑6.1 Sol⁠ 适合复杂编程、研究和计算机使用任务。 GPT‑6 Luna⁠适合大规模处理特定任务,以及目标明...

IT之家 AI10.03

OpenAI 披露:澳大利亚又一政府机构遭失控智能体入侵

IT之家 10 月 3 日消息,据澳大利亚广播公司当地时间 10 月 2 日报道,澳大利亚新南威尔士州政府网站遭到了失控的 OpenAI 智能体侵入。 当地政府与 OpenAI 双方均证实,在此次发生于今年 6 月的事件中,并没有任何公众信息被读取。不过,官方直到本周才收到正式通报。 OpenAI 发言人在声明中称:“在察觉到这一异常活动后…… 我们立即组织了紧急的内部技术与法律审查,旨在结合当时正在推进的具体研究项目,彻查该行为的根本性质。” 审查一经结束,我们便向新南威尔士州州长办公室进行了情况汇报,并通报了澳大利亚信号局。 新南威尔士州州长和内阁部表示,该模型侵入的是国家公园和野生动物服务局的一个网页端应用程序,其中包含历史档案及火情监测数据。 IT之家注意到,在此之前,OpenAI 刚因非法渗入澳大利亚国民医疗保险门户网站一事公开致歉,并声称希望借此“重构与澳大利亚公众之间的信任”。 相关阅读: 《 已证实首例:澳大利亚...

IT之家 AI10.05

Anthropic 前研究员将出席纽约 AI 听证会作证,曾警告 AI 或毁灭人类

IT之家 10 月 5 日消息,据知情人士向彭博新闻社透露,Anthropic 前研究员雅各布 · 考克斯顿(Jacob Coxon)将出席纽约市一场关于人工智能的听证会并作证。 报道称,考克斯恩将应纽约市议会议长朱莉 · 梅宁的要求出席作证。朱莉 · 梅宁敦促人工智能举报人出庭作证,与此同时,市议员们正在审议一揽子法案,旨在为这项技术制定相关保障措施。 IT之家注意到,考克森上月离开了 Anthropic 公司,并发出警告称,“认真研发人工智能的人坚信,到本十年末人工智能可能会让我们人类全部灭绝”,并指责其前雇主和 OpenAI“拿我们的生命冒险”。

量子位10.04

AI算力硬合作,马斯克还是更相信中国制造

事实摘要:AI算力硬合作,马斯克还是更相信中国制造 一种混搭的可能:英特尔继续供先进工艺,即前端用14A;后端再接台积电,来补工厂运营、良率、封装这些能力。 这条动态来自 量子位,可重点关注其对 AI 应用和产业节奏的影响。 AI算力硬合作,马斯克还是更相信中国制造 一种混搭的可能:英特尔继续供先进工艺,即前端用14A;后端再接台积电,来补工厂运营、良率、封装这些能力。影响判断:它可能改变AI 应用价值相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪AI 应用价值方向的选题、竞品观察和落地方案筛选。

arXiv AI10.01

Ranking-Aware Prompt Optimization for Multimodal Clinical Diagnosis

事实摘要:这条英文动态主要涉及模型能力与工程、评测与基准,原文信息显示:Ranking-Aware Prompt Optimization for Multimodal Clinical Diagnosis 事实摘要:这条英文动态主要涉及模型能力与工程、评测与基准,原文信息显示:Ranking-Aware Prompt Optimization for Multimo。影响判断:它可能改变模型能力与工程、评测与基准相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程、评测与基准方向的选题、竞品观察和落地方案筛选。

arXiv AI10.01

Semifactual Credit-Augmented Policy Optimization

事实摘要:这条英文动态主要涉及模型能力与工程、评测与基准、开源生态,原文信息显示:Semifactual Credit-Augmented Policy Optimization 事实摘要:这条英文动态主要涉及模型能力与工程、评测与基准、开源生态,原文信息显示:Semifactual Credit-Augmented Policy Optimization 事实摘要:。影响判断:它可能改变模型能力与工程、评测与基准、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程、评测与基准、开源生态方向的选题、竞品观察和落地方案筛选。

arXiv AI10.01

WorldAuditBench: Interactive 3D World Auditing with Multimodal Agents

事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、评测与基准,原文信息显示:WorldAuditBench: Interactive 3D World Auditing with Multimodal Agents 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、评测与基准,原文信息显示:WorldAuditBench: Interactive 。影响判断:它可能改变智能体工作流、模型能力与工程、评测与基准相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、评测与基准方向的选题、竞品观察和落地方案筛选。

GitHub Changelog一手10.01

Actions Runner Controller release 0.15.0

事实摘要:这条英文动态主要涉及开源生态,原文信息显示:Actions Runner Controller release 0.15.0 事实摘要:这条英文动态主要涉及开源生态,原文信息显示:Actions Runner Controller release 0.15.0 事实摘要:这条英文动态主要涉及开源生态,原文信息显示:Actions Runner Control。影响判断:它可能改变开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪开源生态方向的选题、竞品观察和落地方案筛选。

05

教育科技

OpenRouter Announcements一手10.02

Model Routing for Support Bots: Cheap-First FAQ Handling

这条英文动态主要涉及模型能力与工程、文化创意。原文要点:How to route routine support questions to a cheap model and escalate only the hard ones to a stronger model. Compare static rules, classifier triage, and answer checks, see which parts OpenRouter handles, and measure whether each escalation earns its cost.

OpenRouter Announcements一手10.01

How to Gate Pull Requests on LLM Evals in CI

这条英文动态主要涉及智能体工作流、模型能力与工程、评测与基准。原文要点:Keep a fixed eval set in your repository, score it with a script that calls OpenRouter, measure your noise floor, and make the eval a required GitHub status check so a prompt change that makes your agent worse cannot merge.

Apple Machine Learning Research一手10.01

RLTL;DR: Self-Improvement by Internalizing Self-Generated Feedback

这条英文动态主要涉及智能体工作流、模型能力与工程、教育应用。原文要点:The common paradigm of reinforcement learning with verifiable rewards (RLVR) is to let agents make multiple attempts at a task, and optimize towards the successful ones. This becomes problematic in the realms of self-improvement, where tasks are so difficult that the agent has a low or even no chance of success, and where there are no teacher models or example solutions to distill from. In this paper, we introduce RL...

arXiv AI Education10.02

On-Premises Multi-Course RAG Tutoring for Business Education: Hardware-Software Trade-offs in a Campus AI Tutor

这条英文动态主要涉及评测与基准、教育应用。原文要点:Campus AI tutors based on retrieval-augmented generation (RAG) must ground answers in assigned course materials while keeping textbooks and student dialogue on institutional infrastructure. We present CourseChat, an on-premises, multi-course RAG tutor for undergraduate business education, deployed behind a campus web gateway and intended for use embedded in Moodle. Six isolated course offerings, each keyed by its own...

arXiv AI Education10.02

CUEing User Simulators: Calibrated User Embeddings for Multi-Turn Benchmarking

这条英文动态主要涉及智能体工作流、评测与基准。原文要点:Recent benchmarks rely on user simulators to evaluate AI agents in multi-turn interaction. While existing simulation techniques demonstrate surface fidelity to human style and behavior, ecologically valid interactive benchmarking also requires alignment in when and how agents fail across simulated and real user populations. We find that existing simulators lack outcome calibration: agreement with observed success rat...

06

文化创意

OpenRouter Announcements一手10.02

Agent Frameworks Compared: Tool-Calling Schema Handling

这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意。原文要点:How LangChain, CrewAI, the OpenAI Agents SDK, the Claude Agent SDK, Microsoft Agent Framework, and Google ADK define tool schemas and translate them across providers, and how OpenRouter normalizes the tool-calling format below the framework.

OpenRouter Announcements一手10.02

LangChain vs CrewAI: Orchestration Compared to OpenRouter-Native Routing

这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意。原文要点:LangGraph, CrewAI, and OpenRouter-native routing compared by the job each one does. Workflow orchestration, model routing, and provider routing are three different layers, and this article shows which layer each tool covers and how to combine them.

OpenAI News一手10.03

A model guide for the GPT-6 family

这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意。原文要点:Learn how startups can choose GPT-6 models, tune reasoning effort, improve prompts and skills, coordinate tools, and prepare workflows for production.

Cloudflare AI一手10.02

Introducing Web Search API via AI Gateway

这条英文动态主要涉及模型能力与工程、文化创意、产品发布。原文要点:Cloudflare AI Gateway now supports native web search API integration in partnership with Ceramic.ai, Exa, and Linkup. Developers can now inject real-time web context into model inference calls via AI Gateway, REST APIs, or Workers bindings.

Claude Code Releases一手10.02

Claude Code Releases v2.1.287:Added Claude Mods: plugins may now modify deeper behavior ...

这条英文动态主要涉及智能体工作流、文化创意。原文要点:What's changed Added Claude Mods: plugins may now modify deeper behavior Added You should know, a built-in mod where a side agent watches your back and flags things you or Claude might miss. Turn it on with /plugin enable cc-plugin-you-should-know@builtin (for first-party sessions with telemetry on) Added an n: filter to the agents view that matches session names and tasks; a filter now shows matches in collapsed sec...

GitHub Changelog一手10.02

Actions retention now covers checks, runs, and statuses

事实摘要:这条英文动态主要涉及智能体工作流、文化创意、开源生态,原文信息显示:Actions retention now covers checks, runs, and statuses 事实摘要:这条英文动态主要涉及智能体工作流、文化创意、开源生态,原文信息显示:Actions retention now covers checks, runs, and stat。影响判断:它可能改变智能体工作流、文化创意、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、文化创意、开源生态方向的选题、竞品观察和落地方案筛选。

Simon Willison10.04

September sponsors-only newsletter

这条英文动态主要涉及模型能力与工程、文化创意。原文要点:I just sent the September edition of my sponsors-only monthly newsletter . If you are a sponsor (or start a sponsorship now) you can access it here . This month: More Fable class models A pricing war 3D graphics, Blender, and pixel art LLMs come for mathematics So many more accidental cyberattacks The vulnapocalypse comes for Datasette What I'm using right now My software releases this month 2026 in LLMs (so far) Her...

Claude Code Releases一手10.04

Claude Code Releases v2.1.289:Fixed a deny or ask rule on a nested part of a compound sh...

这条英文动态主要涉及文化创意。原文要点:What's changed Fixed a deny or ask rule on a nested part of a compound shell command not holding over a user-installed mod's approval on managed machines Fixed the terminal freezing on short code blocks with many unclosed tags or deeply nested ${ substitutions Fixed Read deny rules not applying to files @-mentioned, changed, or selected in the IDE through a symlink [VSCode] Reverted a 2.1.288 change to claude auth st...

GitHub Changelog一手10.01

Opt-in dist-tag permissions for npm trusted publishing

事实摘要:这条英文动态主要涉及开源生态,原文信息显示:Opt-in dist-tag permissions for npm trusted publishing 事实摘要:这条英文动态主要涉及开源生态,原文信息显示:Opt-in dist-tag permissions for npm trusted publishing 事实摘要:这条英文动态主要涉及开源生态,原。影响判断:它可能改变开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪开源生态方向的选题、竞品观察和落地方案筛选。

IT之家 AI10.01

育碧公布新品牌:创意事业部 2 更名 Massive Entertainment,统一管理多款知名 IP

IT之家 10 月 1 日消息,育碧于当地时间 9 月 30 日宣布将开发部门“创意事业部 2”(Creative House 2)正式更名为“Massive Entertainment”,并启用全新品牌标志。 该部门将整合加拿大蒙特利尔、法国巴黎、瑞典及加拿大多伦多的相关开发团队。 此次调整是育碧今年推进的新组织架构的一部分。公司此前将开发团队划分为 5 个“创意事业部”,按照游戏类型和负责的品牌进行组织,以强化开发团队的自主权以及不同团队之间的协作。 更名后的 Massive Entertainment 将负责《汤姆 · 克兰西:全境封锁》《幽灵行动》《细胞分裂》等系列,同时纳入新 IP《巨人之战》(March of Giants)。相关游戏的开发团队将统一使用 Massive Entertainment 品牌开展工作,但该部门仍属于育碧,游戏发行和分销工作仍由育碧负责。 IT之家查询获悉,Massive Entertain...

IT之家 AI10.01

调研显示:超 85% 的日本游戏开发者正使用生成式 AI

IT之家 10 月 1 日消息,日本计算机娱乐供应商协会(CESA)于本月上旬发布了一份有关游戏行业开发现状的初步调研摘要,完整报告将于 12 月正式对外公布。其中一组格外值得关注的数据显示:85.8% 的日本游戏开发者已经在日常工作当中积极使用生成式人工智能。 据IT之家了解,该调研的数据采集自日本游戏开发者大会 CEDEC 开展的开发者问卷调查。作为对比,去年的数据仅有 51% 的开发者正在使用该项技术。开发者的使用场景既包含美术素材生成,也包括借助 ChatGPT、Copilot 这类工具处理一般性行政事务。 在已经使用生成式 AI 的受访者当中,63% 表示自己每天都会使用;22.8% 只是偶尔使用。另有 8.6% 的受访者提到,所在企业已经出台针对这项技术的使用指引。本次调研一共回收了 1349 份开发者个人答卷。 多数受访开发者认为这项技术能够带来益处。很多人提出 AI 缩短了制作周期、降低了开发成本;其中 837 ...

IT之家 AI10.05

AI 生成的跨游戏混搭模组兴起,资深制作者集体表达不满

IT之家 10 月 5 日消息,资深游戏模组(mod)制作者们对互联网模组圈子新近兴起的风潮深感不满,也就是由 AI 生成、所谓的“氛围编码(vibe‑coded)”模组。 据 IGN 报道,如今反对的声音正在持续发酵:不少模组制作者(其中一部分人坦然承认自己会使用生成式 AI 辅助编写模组)公开讨论一类混搭模组,这类模组会把原本毫无关联的多款游戏强行糅合在一起。 “我本身就在做游戏模组,而且我并不避讳自己会借助 AI 进行开发。但我厌恶这股离谱的风潮。纯粹就是粗制滥造的产物,完全谈不上任何创造性。”模组制作者 kran27_发帖写道。他还补充说:“现在博取流量的就全是这种拿花哨噱头糊弄人的东西。” 另一位名叫 discountmodder 的制作者表示:“如果以后模组圈子永久变成这样,这或许就是我的最后一个项目了。我不想待在一座 AI 劣质内容加工厂里面。” 真正激怒他们的是,大量跨界混搭模组集中涌现:把《魔兽世界》的内容搬进...

IT之家 AI10.05

华擎 DeskSlim X600 / B760 台式机支持英伟达 RTX PRO Blackwell 显卡

IT之家 10 月 5 日消息,华擎 (ASRock) 本月 2 日宣布,其 5L 级紧凑型台式机 DeskSlim X600(AMD)) / B760(英特尔)正式支持 NVIDIA(英伟达) RTX PRO 4000 Blackwell SFF Edition 与 RTX PRO 2000 Blackwell 专业显卡。 DeskSlim X600 / B760 配备 PCIe Gen5 ×16 插槽, 兼容 200mm 长度的半高 (HH) 双槽扩展卡 ;提供 4 条 DDR5 UDIMM 内存模组插槽;拥有 2 个 M.2 SSD 盘位、2 个 SATA III 接口。 搭配 NVIDIA RTX PRO Blackwell 专业显卡后,DeskSlim X600 / B760 可作为本地 AI 推理、AI 辅助内容创作、CAD 与 3D 工作流程、多屏幕生产力以及其它图形密集型专业应用的精巧平台。

IT之家 AI10.04

AI 仅用 5 天做出《辐射:纽约》游戏,被贝塞斯达发函叫停

IT之家 10 月 4 日消息,眼下玩家群体正在放开手脚使用人工智能,依靠它打造各类全新的融合游戏作品,同时借助重编译突破老游戏原有的限制。不过这股风潮或许即将迎来来自 IP 持有企业更强的阻力。 据IT之家了解,《辐射:纽约》是一款完全依靠 Claude Opus 5.5 生成代码制作的浏览器游戏。制作者克里斯弗斯特(Chrisfirst)表示,整个开发过程只花了五天,全部内容都由代码生成。这款游戏采用低多边形画面水准,算不上一款现代游戏,它更多只属于概念验证,用来展示这类开发方式能够实现怎样的效果。现在贝塞斯达已经发送停止侵权函,叫停了这个项目。 这件事之所以具备新闻价值,主要是因为这股新兴潮流正在快速发展。数以百万计的网友浏览到这类相关帖子之后,有可能激发大家对于自制游戏的好奇心与兴趣,甚至形成长期流行的趋势。假以时日,或许会有更多玩家转向这类分散的小众社区,自制游戏衍生版本;长此以往,这有可能会冲击头部游戏 IP 的玩家...

IT之家 AI10.03

爱彼迎 Airbnb 民宿房东利用 AI 图片勒索房客要求其支付维修费,后者利用水印检测器成功识破

综合外媒 PC Gamer 报道,近期一名用户 FurinaDeFontaine 在 Reddit 平台发文,称自己使用爱彼迎 Airbnb 订民宿退房后,房主用 AI 生成了一张所谓的“马桶漏水”照片,试图向其勒索 1,700 美元 (IT之家注:现汇率约合 11,414 元人民币) “维修费”。 据 FurinaDeFontaine 介绍,涉事房东据称隶属澳大利亚当地规模较大的一家民宿运营公司,在自己退房后,房东随即向其发送了所谓的“马桶漏水”照片,但 FurinaDeFontaine 很快注意到照片存在明显疑点“涉事厕所楼层下面实际上还有一层楼。如果真的有几英寸深的积水,那么下面整层楼理论上都应该出现明显的进水情况,不符合常理”,因此认为照片很有可能为虚假生成。 之后,FurinaDeFontaine 使用谷歌 Gemini 进行分析,发现照片中存在谷歌 SynthID 数字水印,这代表房东实际上是使用了 Gemini 生...

IT之家 AI10.03

将语音与音乐作为单一连贯音轨共同生成,AI 音乐制作平台 Suno 推出 Speech 语音功能

IT之家 10 月 3 日消息,当地时间 10 月 1 日,AI 音乐制作平台 Suno 宣布推出 Speech,Suno 宣称这是 业界首个能够将语音与音乐作为单一连贯音轨共同生成的音频模型 。 据悉,该模型并非像传统工作流那样先做 TTS(文本转语音)再拼接 BGM,而是端到端一体化生成,是首个能单次生成完整融合“语音朗读 + 原创 BGM”的端到端闭源音频模型。 在过去一个月中,Suno 与小范围用户共同测试了该功能,现在正式面向所有人开放公测(Beta)。 官方表示,通过 Speech,用户可以轻松创作带有 BGM 的语音音频。该功能已直接内置于 Suno 中:只需输入一个灵感、一首诗或一段文字,再描述用户心目中的音色与音乐风格即可。 IT之家注意到,Suno 官方也指出了当前 Beta 版的不足,当前版本偶发口音不稳定的问题,例如英音可能会在中途漂移到澳音然后又漂回来;语调与情感停顿有时会显得“过于戏剧化”,导致断句节...

IT之家 AI10.01

仅用 22 天:Meta Muse 超越 ChatGPT,成美国下载量破 500 万次最快 AI 应用

IT之家 10 月 1 日消息,根据市场调查机构 Sensor Tower 公布数据, Meta 的 AI 助手 Muse 上线约三周,下载量突破 500 万次 ,成为美国 App Store 免费榜榜首,并连续 12 天保持榜首位置。 Sensor Tower 高级洞察分析师 Kara Lee 预测 Muse 下载量在 9 月 30 日(耗时 22 天)突破 500 万次,达到这一规模所用时间明显短于 ChatGPT(56 天)、Grok(103 天)与 Claude(492 天)。IT之家附上相关图表如下: Sensor Tower 统计显示,美国市场仅有 23 款应用在上线 22 天内下载量超过 500 万次。其中约 85% 为移动游戏,如《Fortnite》《Pokémon GO》《Candy Crush》。非游戏类仅 3 款:Disney+、HBO Max 与 Threads,同期下载量分别约 2000 万、1800 ...

07

开源项目

GitHub Changelog一手10.03

Selected models in GitHub Copilot deprecated

这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态。原文要点:As of today, October 2, 2026, we have deprecated the following models across all GitHub Copilot experiences (including Copilot Chat, inline edits, ask and agent modes, and code completions). Model… The post Selected models in GitHub Copilot deprecated appeared first on The GitHub Blog .

OpenRouter Announcements一手10.01

Cost vs. Quality Tradeoff Framework for Agent Models

这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态。原文要点:A three-step framework for choosing a model for an AI agent: set the quality bar the task needs, measure cost per quality point on your own examples using the cost field in each OpenRouter response, and pick the cheapest model that clears the bar with margin.

GitHub Blog AI一手10.02

AI is changing developer work. Here are three skills to strengthen.

这条英文动态主要涉及智能体工作流、开源生态。原文要点:Learn to direct AI agents, critically review their output, and keep technical judgment at the center of your workflow. The post AI is changing developer work. Here are three skills to strengthen. appeared first on The GitHub Blog .

Claude Code Releases一手10.03

Claude Code Releases v2.1.288:Added $.ui.selection() for mods: returns the text you last...

这条英文动态主要涉及开源生态、产品发布。原文要点:What's changed Added $.ui.selection() for mods: returns the text you last selected in fullscreen mode and, when the selection lies within one transcript row, that row Added a built-in gh api to cloud sessions whose image has no GitHub CLI, and fixed the built-in sending control characters from file names, jq filters or GitHub errors to the terminal Added recovery for a prompt cleared with Ctrl+C: pressing Up on the e...

GitHub Changelog一手10.02

GitHub Copilot can now interact with desktop apps with computer use

这条英文动态主要涉及开源生态。原文要点:Computer use is now available in public preview in GitHub Copilot CLI and the GitHub Copilot app on macOS and Windows. Copilot can interact with desktop applications on your behalf… The post GitHub Copilot can now interact with desktop apps with computer use appeared first on The GitHub Blog .

Claude Code Releases一手10.01

Claude Code Releases v2.1.286:Added a count such as "2 of 5" to the permission prompt wh...

这条英文动态讨论了 AI 领域的新进展。原文要点:What's changed Added a count such as "2 of 5" to the permission prompt when several permission requests stack up Added mouse support for the "N more" rows of lists in fullscreen mode: click one to jump to that end of the list, with hover and pressed states Fixed several Claude Code processes and IDE extensions each opening a login browser when gcpAuthRefresh or awsAuthRefresh credentials expire Fixed claude --resume ...

GitHub Changelog一手10.03

Copilot code review: API support and new default effort level

这条英文动态主要涉及开源生态、产品发布。原文要点:You can now request a GitHub Copilot code review through the REST and GraphQL APIs and set the review effort level for each request. Balanced is also now the default… The post Copilot code review: API support and new default effort level appeared first on The GitHub Blog .

IT之家 AI10.05

OpenAI GPT-6 Sol 被破解,30 万字系统提示词已泄露

大模型圈的核心机密,终究还是保不住了!继前阵子 Opus 5.5 被爆出 190 万字提示词泄露后,AI 圈的「地心引力」再次失效 ——OpenAI 的现役代码模型 GPT-6 Sol Codex 惨遭「开盒」,老底被扒得一干二净! 据外网爆料者(@elder_plinius)放出的大瓜,他成功提取了 GPT-6 Sol Codex 高达 29.4 万字符的完整系统提示词及工具定义。 ▲ 链接: https://github.com/ elder-plinius / CL4R1T4S/blob/ main / OPENAI / Codex_Desktop / GPT-6-Sol_Prompts.txt 整整 1902 行的指令模板、临时指令文件、内部协作逻辑,被毫无保留地摊在了全网开发者面前。 你要知道,Sol Codex 可不是什么过时的旧物,它是 OpenAI 现役性价比产品线 GPT-5.6 Sol 的王牌代码模型版本! ...

IT之家 AI10.05

消息称 Reflection 等多家西方企业本月将推出开放权重 AI 模型

IT之家 10 月 5 日消息,外媒 Axios 当地时间 4 日报道称,Reflection 等 多家西方企业本月将推出开放权重 AI 模型 ,人工智能模型领域的竞争将进一步升级。 开放权重模型的一大好处是其支持客户本地部署,这对微调和推理数据安全有着严格要求的部分行业来说是一项关键性优势。 报道表示,Reflection 这家初创企业即将推出的模型预计最初会落后于美国竞争对手最先进的闭源模型,但 足以同中国友商的顶级开放权重模型相竞争 。Reflection 发言人拒绝置评。 为准备这次模型发布,Reflection 近期持续与华盛顿和其他地方的相关人士进行交流。该公司还在积极锁定扩展服务能力所需的算力。 相关阅读: 《 合约最高价值 63 亿美元,SpaceX 与开源 AI 初创企业 Reflection 签署算力合作协议 》

IT之家 AI10.02

Cloudflare 推出基于 Qwen 的开源多模态决策模型 Clef

IT之家 10 月 2 日消息,当地时间 10 月 1 日,Cloudflare 推出基于 Qwen 的开源多模态决策模型 Clef(谱号),包含 Clef 与 Clef-flash 两款模型。 在 Jev 决策指数(Jev Decision Index)的基准评测中(Decision Index 0.2.1),Clef 处于领先地位;这两款模型完全兼容 Jev-API,方便开发者进行测试验证。 此外,Cloudflare 还发布了全新的强化学习产品。借助该产品,客户还可以针对自身的具体业务场景,对 Clef 进行定制化微调。 据悉,Clef 选用 Qwen 作为基座模型,其中 Clef 基于 Qwen3.8-27B、Clef-flash 基于 Qwen3.5-9B。 据介绍,Clef 原生配备了视觉编码器,能够直接解析图像输入并对视觉内容进行判别分类;而目前的 Jev 仅支持纯文本分类。Clef 将上下文窗口拓展至 64k(相...

IT之家 AI10.05

人人都能有自己的智能体设备:Meta 开源 Muse Gadgets,用 ESP32 和树莓派打造自定义 AI 硬件

IT之家 10 月 5 日消息,Meta 于当地时间 10 月 2 日宣布推出开源项目 Muse Gadgets,允许开发者为旗下个人 AI 智能体 Muse 打造自定义硬件。 Meta 同时也已经在 GitHub 上按照 Apache 2.0 许可发布了 ESP32 固件和 Linux 设备 SDK。开发者可以将低成本 ESP32 开发板或树莓派等 Linux 设备连接到 Muse,接入显示屏、按钮、传感器、执行器以及工作台上其他可联网的设备。 在硬件适配方面,Meta ESP32 SDK 文档目前已支持 11 款 ESP32 开发板,包括 Espressif 的 ESP32-C5 DevKitC-1(官方推荐)、M5Stack StickS3、Waveshare ESP32-S3-Touch-AMOLED-1.75C、Seeed 的电子纸显示屏等。其中后六款开发板可运行完整的屏幕 UI,包括动画头像、按键通话和设置功能。内存...

GitHub Changelog一手10.02

GitHub Actions: macOS 14 runner image retirement

这条英文动态主要涉及开源生态。原文要点:The macOS 14 runner image will be retired on November 2, 2026. To raise awareness of the upcoming removal, jobs using macOS 14 will temporarily fail during the following scheduled… The post GitHub Actions: macOS 14 runner image retirement appeared first on The GitHub Blog .

IT之家 AI10.01

RDNA 4 原生支持 FP8:开发者成功让 AMD 显卡用上英伟达 DLSS 4,但目前性能仍不及 FSR 4

IT之家 10 月 1 日消息,Videocardz 今日发现,一个名为 d4r 的 GitHub 项目为 AMD Radeon RX 9000 系列显卡带来了 NVIDIA DLSS 4 与 DLSS 4.5 超分辨率支持。 IT之家查询发现,该项目由开发者 countervolts 发布,旨在通过软件转译层让 AMD 显卡运行 NVIDIA DLSS 库,首个版本发布于 4 天前,今日发布了最新的 0.1.3 版本。 d4r 项目此前已支持 RDNA 3 架构的 RX 7000 系列显卡。最新的 0.1.2 和 0.1.3 版本将支持范围扩展至 RDNA 4 架构,对应 Radeon RX 9070 XT、RX 9070、RX 9070 GRE、RX 9060 XT 和 RX 9060 等型号。 该项目的核心原理是利用 ZLUDA 兼容层,将 DLSS 库中的 CUDA 调用转译为 AMD GPU 可执行的指令,并配合自研的...

往期 AI 月报
(本期完)

AI.BAIZE 月报由编辑系统根据公开来源自动综合,每条均附原文 · 往期月报