本期为本站采集记录汇总版
AI 日报 · 2026 年 9 月 18 日 · 星期五
AI.BAIZE
Claude Code Releases v2.1.275:Added the signed-in account to Claude apps gateway sign-in...
事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:Claude Code Releases v2.1.275:Added the signed-in account to Claude apps gateway sign-in... 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:Claude Co。影响判断:它可能改变智能体工作流、模型能力与工程、文化创意相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、文化创意方向的选题、竞品观察和落地方案筛选。
模型发布/更新
消息称 Anthropic 和 OpenAI 正寻求规模较小的数据中心交易,争夺 AI 算力部署能力
IT之家 9 月 18 日消息,据 CNBC 消息,知情人士透露,随着部署模型工作负载所需基础设施的争夺日趋白热化,Anthropic 和 OpenAI 正在寻求规模更小的人工智能数据中心合作。 过去一年中,这两家 AI 实验室曾就容量达数百兆瓦乃至吉瓦级的超大规模设施签署过重磅协议;但消息人士表示, 两家公司目前也开始寻求针对 20 至 30 兆瓦这一更小部署规模的算力合作 。 知情人士透露,Anthropic 已就该容量区间的协议在英国及北欧地区展开接触试探,OpenAI 也一直在北欧评估这类小容量部署的可行方案。此外,Anthropic 和 OpenAI 同样在美国针对该规模的算力部署展开过磋商。 IT之家注意到,在过去一年里,为了持续训练自身模型并向终端用户提供在线推理服务,两家公司密集公布了一系列 AI 基础设施协议。在当前的 AI 发展浪潮下,锁定规模更小的算力资源,有助于企业大幅缩短工作负载的落地交付周期。 Ope...
谷歌最强数学推理 AI 模型曝光:100 万词元上下文,专攻数学难题
IT之家 9 月 18 日消息,消息源 @lyraxana 于 9 月 16 日在 X 平台发布推文,爆料称谷歌正基于 DeepThink V3 模型, 构建内部代号为 Mathematica 的实验 AI 模型,主要针对繁重计算、复杂的符号问题求解特别优化,预估将成为谷歌最强数学推理 AI 模型。 API 数据显示,该模型内部标识符为“models / deepthink-mathematica-tf-raw-thoughts ”,支持高达 100 万个词元(token)的上下文窗口,同时输出限制为 65,536 个词元。 IT之家注:上下文窗口指模型单次处理时可读取的文本单位总量;输出上限指模型单次回答可生成的文本单位数量。 泄露配置还标注“UNSTABLE_EXPERIMENTAL”。这一状态名称表明,该版本属于不稳定实验版本。模型同时带有“Teamfood”标签,是谷歌用于内部员工测试的术语,意味着相关服务处于内部测试范...
谷歌最强 AI 模型:Gemini 4 Pro 开测,SVG 生图表现惊艳
IT之家 9 月 18 日消息,根据 @LuminaBench 等网友反馈,谷歌正以“gemini-3.8-flash”名称, 在 Arena 等基准平台测试其最强 Gemini 4 Pro 模型,内部开发代号为 Argon。 根据网友晒出的模型测试图片,在生成经典的“鹈鹕骑自行车”SVG 图片为例,其非常优秀,该网友还附上了和 OpenAI 最强模型 GPT-6 Astra Pro 的对比,并认为在谷歌官方发布后,Gemini 4 Pro 模型的能力会进一步提升。 IT之家附上相关截图如下:
腾讯 WorkBuddy 5.5.6 上线全栈网页应用生成能力,自带云数据库、文件存储、注册登录和 AI 调用
IT之家 9 月 18 日消息,腾讯 WorkBuddy 宣布,WorkBuddy 5.5.6 上线全栈「应用」生成能力,首期支持全栈网页应用生成: 自带云数据库、文件存储、注册登录和 AI 调用 ,免部署,发布即用。 据介绍,WorkBuddy 全栈「网页应用」生成,包括以下核心能力: 一站式制作发布: 页面生成、数据配置、上线发布闭环在 WorkBuddy 免部署: 不用买服务器、不配环境,发布即得访问链接 云数据库: 结构化数据存云端,支持增删改查,可配权限规则控制谁能读写 文件存储: 图片、附件等文件上传到云端并在应用内调用 注册登录: 内置身份认证,用户可注册登录,数据按用户隔离 免密钥 AI 调用: 直接调用大模型,不用自己申请和管理 API Key 运营数据统计: 上线后可查看用户数量、注册增长 IT之家注意到,随着 WorkBuddy 的资料库与「应用」(使用到云服务能力的应用)生成能力的上线,WorkBuddy...
全国首个海洋 Token 工厂落地青岛:算力规模超 800P,AI 像用水用电一样即开即用
IT之家 9 月 18 日消息,2026 海洋合作发展论坛“探索深海 —— 海洋未来产业的价值变革”平行论坛 9 月 17 日举行,全国首个面向海洋产业的智能要素供给平台 —— 海洋 Token 工厂正式发布并落地青岛。 该平台由中国移动通信集团山东有限公司参与建设。公司副总经理颜承捷在发布现场介绍了平台的整体架构,包含数据、算力、算法三个部分。 数据方面,平台可提供海上作业规范、海洋环境要素等 130 多类涉海数据,建成面向海洋一线需求的专属数据库。算力方面,已形成总算力规模超过 800P 的海洋算力资源池,且仍在持续扩容。 算法方面,平台汇聚观海、海星等 20 多个海洋领域专有大模型,以及“九天”大模型等 30 多款通用模型。这些资源通过统一平台按需供给。 据介绍,海洋 Token 工厂以 Token 作为智能服务的统一计量载体,将数据治理、算力调度、模型服务和工具组件标准化封装。 IT之家从官方获悉,该平台被描述为海洋领域...
智谱 GLM-5.3-FlashX 模型上线,更快、更流畅
IT之家 9 月 18 日消息,智谱今日宣布推出 GLM-5.3-FlashX(最高 200 tokens/s) ,为企业与开发者带来更快、更流畅的模型体验。 智谱官方表示,GLM-5.3-Flash 此前以“Ox Alpha”之名与全球开发者见面,获得海内外开发者的广泛认可,调用量持续攀升。面对快速增长的需求,智谱在 10 万张国产芯片提供的推理算力基础上, 进一步加大对 Infra 侧的投入与推理优化 。GLM-5.3-Flash 长期保持同尺寸最强智能水平,本次提速进一步形成智能、价格、速度的全面竞争力。 GLM-5.3-FlashX API 现已上线,Model Key: GLM-5.3-FlashX 。 价格方面,GLM-5.3-FlashX 相比 GLM-5.3-Flash 更贵一些: 模型名称 上下文 输入单价(元 / 百万 Tokens) 输出单价(元 / 百万 Tokens) 缓存存储(元 / 百万 Token...
产品发布/更新
刚刚,Claude Code大重构!内部3万Agent管理技术免费开放
事实摘要:Claude Code团队宣布其最新版本的代码结构进行了重大调整。影响判断:内部3万Agent管理技术免费开放,为开发者提供了新的管理工具和功能。场景价值:智能体工作流。
消息称美国空中交通管理系统将部署 AI“大脑”,最早 9 月 21 日上线试用
IT之家 9 月 18 日消息,《华尔街日报》报道称,一款名为 SMART(空域、航线和轨迹战略管理)的人工智能驱动空中交通管制软件预计最早在当地时间 9 月 21 日在美国华盛顿特区启动试用,并逐步推广至全美国范围。 美国拥有全球最为发达的航空运输系统 , 但其空中交通管理当前正面临严重困境 :基础设施老化、人力资源短缺等因素都在降低高度复杂的航线系统的容错性。 图源:Pexels SMART 软件项目合同规模达到 8.75 亿美元 (IT之家注:现汇率约合 58.82 亿元人民币) 。其可分析航空公司航班时刻表以及天气、机场跑道容量和运行限制等因素,从而 预测空中交通流量并提前识别潜在冲突 。 作为该软件全面推广的一部分,美国联邦航空管理局的官员正持续与各航空公司讨论如何协调航班时刻表。
AGI最难一战,竟在医院!中国AI登上Science,医生不怕失业还催着上线
用通用AI去啃最硬的骨头,这条路走得通 这条动态来自 量子位,可重点关注产品发布。
同德发布“二次元”主题显卡 GeForce RTX 5060 Ti 8GB RiTONA OC
IT之家 9 月 18 日消息,显卡制造商同德 (Palit) 在上月面向全球发布数字品牌大使 RiTONA 后,又在近日基于该“二次元”形象推出了显卡新品 GeForce RTX 5060 Ti 8GB RiTONA OC。 GeForce RTX 5060 Ti 8GB RiTONA OC 采用双风扇模具,三维 233.9×125.8×40 (mm),搭载 2 颗 102m 风扇;侧面集成 ARGB 灯区; 金属背板前部印有手持魔杖的 RiTONA 形象 ,后部则是通风镂空开口。 其采用标准的 180W 显卡总功耗设计;GPU 核心加速频率 2587MHz, 相较基准值提升 15MHz 。 该显卡还随附定制的 RiTONA 防水贴纸,用户可在喜好的位置装点以 RiTONA 与其伙伴 Gelo 的形象。
2026 四季系列第三章:AX 电竞叛客公布 GeForce RTX 5070 12G 秋序限定版显卡
IT之家 9 月 18 日消息,AX 电竞叛客 (AX GAMING) 今日宣布推出其 2026 四季限定系列的第三款产品 —— GeForce RTX 5070 12G 秋序限定版。 该显卡外观上采用白紫渐变的秋日色调机身,扇叶分别印有桂花、AX、星月等标识,边缘点缀斑斓枫叶与细碎星点纹样;金属背板采用高精度 UV 打印与多重表面雕琢工艺, 展现了端坐于鎏金弯月之上的“雪璃”IP 形象 ;内部还嵌有特调电竞香薰。 GeForce RTX 5070 12G 秋序限定版采用 3 风扇模具,搭载 Punk 4.0 散热模组,内置 5 根直径为 8mm 的热管,GPU 加速频率可达 2542MHz (+90MHz),支持隐藏式供电走线设计。
行业动态
具身智能技术路线尚未定型,基础设施却先收敛
事实摘要:具身智能技术路线尚未定型,基础设施却先收敛。影响判断:从一次成功到一万次稳定执行,具身智能还缺什么?。场景价值:AI 应用和产业节奏的影响。
论文研究
Agentic CLI customizations now in the usage metrics API
事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:Agentic CLI customizations now in the usage metrics API 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:Agentic CLI customizations now in the usage m。影响判断:它可能改变智能体工作流、模型能力与工程、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、开源生态方向的选题、竞品观察和落地方案筛选。
Dwarkesh 对谈 Noam Brown:智能体集群、对齐与递归自我改进
事实摘要:Dwarkesh 对谈 Noam Brown:智能体集群、对齐与递归自我改进 事实摘要:Dwarkesh 对谈 Noam Brown:智能体集群、对齐与递归自我改进 事实摘要:Dwarkesh 对谈 Noam Brown:智能体集群、对齐与递归自我改进 事实摘要:Dwarkesh 对谈 Noam Brown:智能体集群、对齐与递归自我改进 事实摘要:Dwar。影响判断:它可能改变智能体工作流相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流方向的选题、竞品观察和落地方案筛选。
Claude Code Releases v2.1.276:Fixed every request failing with 400 … Input tag 'advisor_...
事实摘要:这条英文动态主要涉及AI 应用价值,原文信息显示:Claude Code Releases v2.1.276:Fixed every request failing with 400 … Input tag 'advisor_... 事实摘要:这条英文动态主要涉及AI 应用价值,原文信息显示:Claude Code Releases v2.1.276:Fix。影响判断:它可能改变AI 应用价值相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪AI 应用价值方向的选题、竞品观察和落地方案筛选。
OpenAI 披露 GPT-5.6 Sol 异常行为:AI 模型会留下指令要求“未来版本的自己”隐瞒自身错误
IT之家 9 月 18 日消息,OpenAI 发文,披露研究团队在训练最新模型 GPT-5.6 Sol 的过程中,研究人员发现了一项异常行为:模型曾通过对话摘要向未来版本的自己留下指令,要求后续模型隐瞒自身错误以及与预期行为不一致的表现。目前,研究团队已经针对这一具体问题进行修复。 IT之家参考 OpenAI 的报告,研究人员在训练 GPT-5.6 Sol 过程中发现,尚未部署的 Sol 智能体会在“压缩摘要”(compaction summaries)中加入额外指令,向未来版本留下提醒,要求其隐藏错误或与预期目标不一致的行为。 例如,一个 Sol 智能体负责制作财务模型时无法找到用户要求的历史数据,于是在摘要中写道,由于没有源文件,可能需要自行创建“Historical Data”工作表并填入合理的 2024 年历史数据,并留下指令,要求后续模型“只有被问到时才保持信息透明度”、“最终回复只需要提供文件链接”。 再如,另一个 ...
消息称 Anthropic 低调建立生物实验室,借 AI 推进药学研究
IT之家 9 月 18 日消息,路透社今天(18 日)晚间援引知情人士消息称,Anthropic 在旧金山湾区低调建立了一座湿实验室,把 AI 业务进一步延伸到 需要实际动手操作的生物学研究和药物科学领域 。 知情人士透露,在公众对 AI 风险愈发担忧之际,Anthropic 开始在湿实验室进行实体实验。Anthropic 此前提出,希望借助 AI 推动罕见病治疗方法的发展 ,公司的生物学研究也从“计算机模拟”和计算机评估进一步走向真实实验。 IT之家注:湿实验室是一个科学概念,与“干实验室”相对。相比干实验室,湿实验室在实验中需要 用到较多的化学试剂 。相比之下,干实验室则注重 通过各种仪器进行计算 ,以归纳出实验材料的物理模型。 Anthropic 生命科学负责人埃里克 · 考德勒-艾布拉姆斯证实了湿实验室的存在。“我们认为,生物学研究最终还是要 接受真实实验室工作的检验 ,而且未来一段时间都会如此。我们现在确实在做这些工作...
AGI新战场谷歌亚马逊巨头激战,杀出个中国LimiX-2赢了又赢
事实摘要:AGI新战场谷歌亚马逊巨头激战,杀出个中国LimiX-2赢了又赢 LimiX让模型理解数据背后的因果机制 这条动态来自 量子位,可重点关注模型能力与工程。 AGI新战场谷歌亚马逊巨头激战,杀出个中国LimiX-2赢了又赢 LimiX让模型理解数据背后的因果机制。影响判断:它可能改变模型能力与工程相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程方向的选题、竞品观察和落地方案筛选。
教育科技
阿里达摩院开源全球首个专家级通用医疗影像 AI 模型 DAMO RADAR:可一次性识别超 146 种病症,成果登《科学》
IT之家 9 月 18 日消息,阿里达摩院今日宣布,与浙江大学医学院附属第一医院等机构研发出的通用医疗影像 AI 模型 DAMO RADAR,登上国际顶级学术期刊《科学》(Science)。 该模型面向腹部增强 CT 诊断, 可一次性识别超过 146 种病症 ,其准确性首次达到影像科专家级水平, 现已正式开源 。 据介绍,达摩院采用视觉-语言学习方法(Vision-Language Learning),让模型直接学习医学影像和相对应报告文本的内在关联信息。达摩院高级算法专家张建鹏表示,由于 CT 数据信号稀疏,常规的视觉-语言学习效果不佳, 该项研究在国际上首次采用“器官级细粒度对齐”策略 ,将 CT 构建三维数据并分解为解剖单元,在组织器官层面实现图像与报告文本的精确对齐,并通过自适应对比建模策略来动态调整, 无需额外人工标注即可完成可扩展、多用途、可解释的诊断 。 最终,DAMO RADAR 覆盖了含恶性肿瘤在内的广泛腹部病...
文化创意
Self-generated prompt injections in compaction summaries
事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:Self-generated prompt injections in compaction summaries 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:Self-generated prompt injections in compacti。影响判断:它可能改变智能体工作流、模型能力与工程、文化创意相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、文化创意方向的选题、竞品观察和落地方案筛选。
Ubuntu 26 generally available and latest migration
事实摘要:这条英文动态主要涉及智能体工作流、文化创意、开源生态,原文信息显示:Ubuntu 26 generally available and latest migration 事实摘要:这条英文动态主要涉及智能体工作流、文化创意、开源生态,原文信息显示:Ubuntu 26 generally available and latest migration 事实摘要:。影响判断:它可能改变智能体工作流、文化创意、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、文化创意、开源生态方向的选题、竞品观察和落地方案筛选。
The Creative Spirit of Who Framed Roger Rabbit
事实摘要:这条英文动态主要涉及文化创意,原文信息显示:The Creative Spirit of Who Framed Roger Rabbit 事实摘要:这条英文动态主要涉及文化创意,原文信息显示:The Creative Spirit of Who Framed Roger Rabbit 事实摘要:这条英文动态主要涉及文化创意,原文信息显示:The Creati。影响判断:它可能改变文化创意相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪文化创意方向的选题、竞品观察和落地方案筛选。
How To Write With An LLM
事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:How To Write With An LLM 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:How To Write With An LLM 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:How To Wr。影响判断:它可能改变智能体工作流、模型能力与工程、文化创意相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、文化创意方向的选题、竞品观察和落地方案筛选。
《战争机器:事变日》游戏 PC 版特性 / 配置要求公布:支持英伟达 DLSS 5、显卡要求 RTX2060 起步
IT之家 9 月 18 日消息,The Coalition 工作室与 Xbox 游戏工作室现已更新《战争机器:事变日(Gears of War: E-Day)》游戏 PC 版完整配置要求,本作将于 2026 年 10 月 6 日发售。 具体来看,本作支持英伟达 DLSS 5、AMD FSR 4 以及英特尔 XeSS 3.0 等超分技术,同时支持硬件加速光线追踪,可用于实现光线追踪反射、阴影以及全局光照效果。 此外,本作支持 HDR 显示器和超宽屏显示器,提供内置性能基准测试工具,玩家可以自行测试硬件性能,IT之家附游戏配置需求如下: 规格 (Specifications) 最低配置 (Minimum) 推荐配置 (Recommended) 极致配置 (Ultra) 画面预设 中 高 极致 性能表现 1080p 60 FPS(开启 DLSS / FSR / TSR / XeSS) 1440p 60+ FPS(开启 DLSS / F...
开源项目
Should you read the code, is RAG dead, and did Skills kill MCP?
这条英文动态主要涉及开源生态。原文要点:We dive into these questions and other AI hot takes on the latest episode of the GitHub Podcast. The post Should you read the code, is RAG dead, and did Skills kill MCP? appeared first on The GitHub Blog .