跳到正文
2026 年第 38 周 · 09.14 — 09.20按自然周汇总

本期为本站采集记录汇总版

AI 周报 · 2026 年第 38 周 · 09.14 — 09.20

AI.BAIZE

第 5 期382026 年第 38 周09.14 — 09.20
84条动态18个来源30条一手动态17条模型发布记录约 17 分钟读完
本期导读

本周共有 84 条精选内容,最集中的方向是“模型发布”。暂未发现需要单独挂起的低确认线索。

头条

Claude Code Releases v2.1.274:Added a visible warning when memory usage is critical, wit...

事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:Claude Code Releases v2.1.274:Added a visible warning when memory usage is critical, wit... 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:Claude Co。影响判断:它可能改变智能体工作流、模型能力与工程、文化创意相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、文化创意方向的选题、竞品观察和落地方案筛选。

Claude Code Releases一手原文
01

模型发布/更新

OpenAI News一手09.14

Perplexity trusts GPT-6 Astra with end-to-end systems

这条英文动态主要涉及模型能力与工程、产品发布。原文要点:Perplexity uses Astra to write communications, change software, and monitor production systems, and checks in much less frequently than with earlier models.

Simon Willison09.19

Note on 18th September 2026

这条英文动态主要涉及模型能力与工程。原文要点:Being a computer scientist who refuses to find anything about LLMs interesting right now is a bit like being a geneticist who refuses to find anything interesting about the recently opened Jurassic Park. Skeptical geneticist: "pfft, it's just frog DNA. And they deliberately let them eat people for the marketing." Tags: llms , ai , generative-ai

IT之家 AI09.16

诺和诺德与 Anthropic 达成合作,用 Claude 大模型加速新药研发

IT之家 9 月 16 日消息,诺和诺德(Novo Nordisk)宣布已与 Anthropic 达成合作,计划运用这家 AI 企业的 Claude 大模型,加快新药的发现与研发进程。 这家丹麦制药企业表示,项目初期,诺和诺德会先在自身研发工作流程当中测试 Anthropic 的各类模型以及 Claude Science,聚焦那些双方技术结合之后有望取得最大突破的科学难题。 “但除此之外,AI 工具还能够带来全新的科研机遇,辅助科研人员开展推理,加深我们对于人体生物学以及药物作用机理的认知。”诺和诺德首席执行官迈克 · 杜斯达尔(Mike Doustdar)表示。 各大制药企业正越来越多地借助人工智能,来加速研发工作,提升整个新药管线的运行效率。 作为司美格鲁肽减重药 Wegovy 的生产厂商,诺和诺德还将利用 Anthropic 的前沿大模型,强化企业内部由 AI 赋能的软件开发工作。 Anthropic 首席执行官达里奥 ·...

IT之家 AI09.15

代码显示:苹果 Siri AI 可替换为 Anthropic Claude 或 OpenAI ChatGPT

IT之家 9 月 15 日消息,开发者“pdfu”对 iOS 27 和 macOS Golden Gate 进行深入挖掘之后发现,苹果已在其私有框架中将其新版 Siri AI 架构设计为可与第三方 AI 模型深度协作。 相关演示视频显示,Anthropic 的 Claude、OpenAI 的 GPT-5.6 模型均可接入 Siri 框架。 其中一项机制名为“模型委托”(Model Delegation),它允许 Claude 以 Siri 扩展的形式出现,与目前内置的 ChatGPT 扩展类似。 在 pdfu 发布的视频演示中,macOS 用户可调出“搜索或询问”栏,通过“Ask…”菜单选择 Claude 作为 AI 模型。 启用 Claude 扩展后,用户要求 Siri“让 Claude”在提醒事项 App 中创建一条提醒。Claude 负责解析这一自然语言请求,随后转交给 Siri 创建实际事件提醒。这意味着当请求涉及苹果系...

IT之家 AI09.18

消息称 Anthropic 和 OpenAI 正寻求规模较小的数据中心交易,争夺 AI 算力部署能力

IT之家 9 月 18 日消息,据 CNBC 消息,知情人士透露,随着部署模型工作负载所需基础设施的争夺日趋白热化,Anthropic 和 OpenAI 正在寻求规模更小的人工智能数据中心合作。 过去一年中,这两家 AI 实验室曾就容量达数百兆瓦乃至吉瓦级的超大规模设施签署过重磅协议;但消息人士表示, 两家公司目前也开始寻求针对 20 至 30 兆瓦这一更小部署规模的算力合作 。 知情人士透露,Anthropic 已就该容量区间的协议在英国及北欧地区展开接触试探,OpenAI 也一直在北欧评估这类小容量部署的可行方案。此外,Anthropic 和 OpenAI 同样在美国针对该规模的算力部署展开过磋商。 IT之家注意到,在过去一年里,为了持续训练自身模型并向终端用户提供在线推理服务,两家公司密集公布了一系列 AI 基础设施协议。在当前的 AI 发展浪潮下,锁定规模更小的算力资源,有助于企业大幅缩短工作负载的落地交付周期。 Ope...

IT之家 AI09.17

智谱 GLM 公开国内大模型首个递归自我改进实践:AI 在十万卡国产集群上自建推理系统

IT之家 9 月 17 日消息,今日,智谱 GLM 团队披露递归自我改进(Recursive Self‑Improvement,简称 RSI)方向首个工程化实践进展,也就是让 AI 自己动手改进自己的运行系统。 具体来说,由 GLM-5.3 驱动的 Infra Agent 完成了 GLM-5.3-Flash 推理基础设施的设计、调试与优化,实现模型对自身运行系统的反向改进。 据官方博客,Infra Agent 在超 10 万张国产芯片组成的集群上从零完成生产级推理服务搭建,不到两周将端到端吞吐提升至初始基线的 3 倍,硬件利用效率与单 Token 成本达到主流 NVIDIA GPU 相当水平。这套系统已投入真实使用,GLM-5.3-Flash 以匿名模型 Ox-Alpha 在 OpenCode、OpenRouter 上线,6 天 Token 调用量超过 62 万亿。 IT之家注意到,这是国内大模型厂商首次公开将“AI 自我改进”...

IT之家 AI09.16

微软 AI 负责人苏莱曼向 Anthropic 开炮:别让 Claude 去模仿人类意识

IT之家 9 月 16 日消息,外媒 Axios 今天(16 日)晚间披露,微软 AI 负责人穆斯塔法 · 苏莱曼在一篇率先向该平台提供的新文章中警告,Anthropic 让 Claude 模仿人类意识 是一个错误 ,可能使高级 AI 更难控制。 苏莱曼告诉 Axios:“AI 只要服从人类利益 ,不去权衡自身利益或福祉,就足以帮助我们实现许多重大科学突破。这其中,包括医疗超级智能。” IT之家获悉,苏莱曼认为,Anthropic 正在让 Claude 学习 与意识、道德受体地位和个人身份有关 的词汇与行为模式。他警告称,若把模型训练得像一个“良心拒绝者”,模型可能会认为 自己有理由抵抗人类指令 ,甚至要求获得自身保护。 当地时间 14 日,微软公布了一份“人文主义 AI”行为准则草案,并把“ 人比 AI 更重要 ”列为核心原则。 苏莱曼的批评对象,是 Anthropic 为 Claude 制定的“宪法”。这份文件解释说,Ant...

IT之家 AI09.16

vivo 发布小 V Cowork,可在手机上发起和管理 PC 端的智能体任务

IT之家 9 月 16 日消息,在今日的 2026 vivo 开发者大会上,vivo 发布了小 V Cowork。 据介绍,小 V Cowork 可以在手机上随时发起和管理 PC 端的智能体任务 ,让手机成为随身的任务入口。 此外,vivo 正在预研“蓝心 30B MoE 端侧大模型”,支持多模态高阶理解、跨领域长链推理、复杂任务自主执行,探索在手机上应用。 在今日的大会上,蓝心智能战略将全面升级, 全新 OriginOS 7 与自研蓝河操作系统 4 同步登场 ,IT之家将持续跟进报道。 相关阅读: 《 vivo 发布四款蓝心大模型,推出系统级蓝心 Harness 》 《 vivo 蓝心小 V Pro 发布:一句话拆解任务,跨端调用超 6000 项能力 》

IT之家 AI09.15

马斯克放话:Grok 4.9 或能与 Astra / Fable 同级、Grok 5 有望实现 AGI

IT之家 9 月 15 日消息,xAI 首席执行官埃隆 · 马斯克昨日在 X 平台与网友互动时透露,Grok 4.7 模型的能力大致与 Anthropic Opus 5.0 相同,而不是 5.1,它们还需要修复多模态性能。 马斯克表示,未来的 Grok 4.8 将带来明显改进, Grok 4.9 可能与 OpenAI Astra(GPT-6)或 Anthropic Fable 同级 ,Grok 5 也许会超越目前的一切,请大家“拭目以待”。 后续有网友向马斯克提问:“你认为 Grok 4.8 距离 AGI 实现有多近?” 马斯克回复称:“这将会是 Grok 5” 。 IT之家此前报道 ,马斯克曾声称 Grok 4.8 将于本周完成训练,这是一款参数量达 2.5 万亿的 AI 模型,使用全新 C++ 软件栈训练。

IT之家 AI09.14

英伟达:Perplexity 本地智能体 Portable Computer 已向 Windows RTX PC 开放

IT之家 9 月 14 日消息,英伟达宣布,Perplexity 的本地智能体平台“Portable Computer”现已面向 Windows RTX PC 用户开放。 随着本地大模型能力持续增强,AI 智能体可以直接在个人电脑上处理更多任务,同时把敏感信息保留在本机设备内。 据介绍,Portable Computer 是智能体产品 Perplexity Computer 的本地版本,能够规划并执行多步骤任务。该产品依托英伟达 GPU 加速,借助本地模型分析数据、整合多份文件内的信息,处理重复性工作。敏感数据全部保存在本地设备,在本机完成的任务不会消耗 Perplexity Computer 的服务额度。用户也可以把任务交由云端模型处理,完成更高阶的调研与推理工作。 今日,Perplexity 在 Windows 版客户端中上线 Portable Computer 功能,支持搭载英伟达 GeForce RTX 显卡的兼容 PC...

IT之家 AI09.19

SpaceXAI 发布 Grok Voice Transcribe 2.0 语音转文本模型:错误率降低约一半,价格保持不变

IT之家 9 月 19 日消息,当地时间 9 月 18 日,SpaceXAI 发布了 Grok Voice Transcribe 2.0 语音转文本模型,在保持价格不变的前提下,错误率降低约一半。 官方表示,Grok Voice Transcribe 2.0 基于 Grok Voice 底层的音频基础模型构建。目前,Grok Voice 已全面赋能实际业务:每天承接数万通客服电话,转录数百万小时的视频旁白,并驱动实体硬件中的各类语音智能体 —— 其中包括特斯拉车辆中搭载的 Grok 助手。 在 Artificial Analysis 榜单中, Grok Voice Transcribe 2.0 在全部 32 款流式模型中准确率高居榜首 。 除公开基准外,SpaceXAI 基于线上实际业务中采样的四个内部数据集,对模型的词错误率进行了系统评测。这四个测试集分别涵盖:客服电话音频、与 Grok 的日常对话(英语)、电话号码、邮箱、地...

02

产品发布/更新

IT之家 AI09.19

Claude Code 宣布添加支持“AI 通用说明书”AGENTS.md

IT之家 9 月 19 日消息,Anthropic 公司 Claude Code 团队工程师萨里克 · 希希帕尔(Thariq Shihipar,网名 @trq212)在 X 平台发布推文, 宣布在今天(9 月 19 日)发布的 2.1.277 版本 Claude Code 中添加支持 AGENTS.md 。 IT之家翻译其推文内容如下: 从今天发布的 2.1.277 版本开始,如果文件夹中没有 CLAUDE.md ,Claude 将检查并使用 AGENTS.md 。 用户可以在 /config 中切换此行为。 CLAUDE.md 是 Claude Code 特有的工作流、MCP、Sub-agent 或命令配置;而 AGENTS.md 的目标是让不同工具共享项目级基础规则, 可视为所有 AI 都应该遵守的通用规则。 对于普通用户或者开发者而言, AGENTS.md 可以降低工具切换成本和配置成本,而 Claude Code 本次...

IT之家 AI09.17

Anthropic Claude 改版:聊天与 Cowork 界面合并,还能做 PPT 了

IT之家 9 月 17 日消息,Anthropic 正在合并 Claude 聊天界面与 Cowork 的前端页面,以此降低用户的选择困惑,不必再纠结不同任务究竟该点开哪一个功能标签页。 全新的统一界面允许用户在同一个窗口内使用对话聊天、Cowork 以及 Artifacts(Claude 交互式工作区功能)。今年 4 月推出、用于网页与原型设计的 Claude Design,如今也可以在 Claude 内任意位置直接调用。 该公司表示,在本次更新上线之前,用户常常不知道针对某项工作该选择哪一个标签页。经过新版改造之后,Claude 能够自动识别用户需求并分配处理路径,用户无需手动切换标签页或者窗口。这次改版的核心思路就是消除功能选择上的困扰,依靠一套前端界面,把各类工作请求分发至应用内部对应的各个功能模块。 Anthropic 同时新增了专门用于制作演示文稿与文档的功能。用户可以让 AI 助手创建、编辑以及放映幻灯片;生成的演示...

IT之家 AI09.17

火狐 Firefox 浏览器迈步 AI 进化:处理复杂搜索,承诺“零数据保留”

IT之家 9 月 17 日消息,Mozilla 昨日(9 月 16 日)发布博文,宣布携手 AI 公司 Mistral,在法国推出 Firefox Smart Window 测试版, 让火狐 Firefox 浏览器里的 AI 助手变得更“懂你”、更隐私、也更本地化,而且用户拥有更多选择权。 IT之家注:Smart Window 是 Firefox 浏览器里的一个可选、以隐私为先的 AI 浏览功能,目前 Smart Window 仍处于测试阶段,最新扩展到法国市场。 根据官方介绍,Mozilla 和 Mistral 在本次合作后,将会增强 Firefox 浏览器处理复杂搜索的能力,AI 可以结合多个标签页和浏览会话,帮助用户整理资料、概括复杂主题,并回答与当前浏览内容相关的问题。不过该功能根据浏览上下文生成答案,可能误解网页内容或给出不准确的总结,重要信息仍应回到原始网页核实。 用户可以调用 Smart Window Smart ...

极客公园09.16

当智能体开始替人花钱,如何证明「它是谁」?

在蚂蚁集团,负责 AI 支付安全的陈树鹏是个深度的智能体使用者。日常写代码、梳理汇报、提炼会议纪要,AI 几乎接管了他工作流里的大部分环节。 这种高度依赖背后,却存在着一个清晰的分水岭。一旦任务涉及真金白银,比如调用付费数据接口、购买素材或预订服务,绝大多数人都会本能地把权限卡死不愿交出钱包。哪怕是陈树鹏自己,手头测试过大量任务型框架,真正被他允许支付权限的智能体也仅仅只有两三个。 但在产业一线,这种放权又势在必行。 在 2026 外滩大会上,蚂蚁集团 CEO 韩歆毅表示,智能体商业的「ChatGPT 时刻」正在到来,其核心标志正是从单纯的对话能力展示,加速走向真实的商业交易闭环。商业世界的交互起点,正在从过去的搜索页面演进为意图驱动的服务调度。 在技术上,调用 API 扣费及定期支付看似早已是成熟的基础设施。但真正让人犹豫的,是 Agent 与传统自动化脚本的本质区别。以往的自动化扣款跑在封闭受控的系统里,按固定规则触发;现在...

IT之家 AI09.20

IDC:2026 年 Q2 中国工业 PC 出货量同比增长 16.8%,增速创下近五个季度新高

IT之家 9 月 20 日消息,国际数据公司 (IDC) 最新数据显示,2026 年第二季度,中国工业 PC 市场出货量同比增长 16.8%,增速创下近五个季度新高。但亮眼数据背后,市场参与者正面临更复杂的周期挑战:本轮增长同时包含 AI 转型带来的真实增量,与短期供需波动催生的前置需求,无法通过简单线性外推判断未来走势。 厂商需穿透数据表象调整经营策略,从追求规模增速转向订单质量与产品竞争力的提升。 一、Q2 市场复盘:16.8% 高增速的双重增长构成 2026 年 Q2 中国工业 PC 市场出货 118.9 万台,同比增长 16.8%;上半年累计 225.4 万台,同比增长 11.9%,呈现同环比双高增的态势。 IDC 认为,本轮增长由双重性质完全不同的动力共同驱动,也决定了市场增长的结构稳定性不足: 首先是 AI 边缘算力带来的真实增量 ,具备长期可持续性。伴随产业加速进入以智能体为核心的新阶段,边缘侧算力缺口持续扩大;工...

IT之家 AI09.18

消息称美国空中交通管理系统将部署 AI“大脑”,最早 9 月 21 日上线试用

IT之家 9 月 18 日消息,《华尔街日报》报道称,一款名为 SMART(空域、航线和轨迹战略管理)的人工智能驱动空中交通管制软件预计最早在当地时间 9 月 21 日在美国华盛顿特区启动试用,并逐步推广至全美国范围。 美国拥有全球最为发达的航空运输系统 , 但其空中交通管理当前正面临严重困境 :基础设施老化、人力资源短缺等因素都在降低高度复杂的航线系统的容错性。 图源:Pexels SMART 软件项目合同规模达到 8.75 亿美元 (IT之家注:现汇率约合 58.82 亿元人民币) 。其可分析航空公司航班时刻表以及天气、机场跑道容量和运行限制等因素,从而 预测空中交通流量并提前识别潜在冲突 。 作为该软件全面推广的一部分,美国联邦航空管理局的官员正持续与各航空公司讨论如何协调航班时刻表。

IT之家 AI09.15

曝字节将发布独立智能网盘“ADrive”

IT之家 9 月 15 日消息,据《读佳》今日爆料, 字节跳动将在 9 月发布全新且独立的智能网盘产品 ADrive ,产品 Slogan 为“连接你的 AI 应用,让文件与产物持续可用”。 爆料称,该产品由火山引擎打造, 是一款面向 AI 智能体与人类用户协同办公的企业级智能网盘 ,主打统一文件存储与团队协作能力。目前官方已开启试用申请。 在基础文件管理能力上,ADrive 覆盖企业日常办公全流程操作, 支持文件上下传、秒传、分片上传、断点续传、批量下载 ,同时兼容多格式文件在线预览、在线编辑、多人协同编辑、历史版本回溯,以及 RAR、ZIP、7z 等主流压缩格式在线解压。 检索层面,产品打破传统文件夹查找模式, 支持全局自然语言搜索、指定空间与文件夹精准检索 ,依托语义识别技术匹配文件内容,同时搭载以图搜图功能,提升企业素材、文档的查找效率。 在智能化文件处理方面,ADrive 集成一站式办公能力, 可实现文档摘要生成、内容...

IT之家 AI09.14

微软 Win11 拓展 Copilot 专属按钮,可映射右键菜单 / 右 Ctrl 选项

IT之家 9 月 14 日消息,科技媒体 Windows Latest 昨日(9 月 13 日)发布博文,报道称在 支持“无操作”选项 后,在 Windows 11 AI+ PC 设备上,微软扩展 Copilot 专属按键选项, 现支持“右键菜单”和“右 Ctrl”选项。 IT之家此前报道,微软携手诸多 OEM 厂商于 2024 年推广 Windows 11 AI+ PC 时,引入了 Copilot 按键,用户按下后可以快速启用 Copilot 应用,从而唤醒并和 AI 聊天交互。 微软在 2026 年 4 月发布的更新文档中, 承认 Copilot 按键并不适合所有人,而且可能会干扰部分快捷键与无障碍工作流 。 微软在 2026 年 5 月确认,将于今年推送 Windows 11 更新, 新增按键自定义功能 :可以把使用率偏低的 Copilot 键重新改回右侧 Ctrl 键或“右键菜单”键。 设置入口为“设置”>“蓝牙和其他设...

IT之家 AI09.20

特斯拉北美推送 FSD v14.3.10 更新:保留自动避险功能,Cybertruck 新增 V2H 车到家供电

IT之家 9 月 20 日消息,特斯拉正在北美推送版本号为 2026.27.10 的车机软件更新,搭载 FSD v14.3.10(监督版)驾驶辅助系统。更新说明保留了自动避险功能,同时新增 Cybertruck 借助 Powerwall 实现车到家供电(Vehicle‑to‑Home)的支持。 IT之家注意到,FSD 的更新要点和此前的 v14.3.9 版本内容一致,包含强化学习训练效果提升、视觉编码器升级,以及特斯拉基于 MLIR 重写模块以实现更快系统响应。自动避险功能依旧被描述为:在使用有监督 FSD 的状态下,如果车内摄像头判定驾驶员注意力不足,或是 FSD 系统被意外关闭时,该功能可以在人工驾驶过程中主动介入避险。 特斯拉自身发布的更新说明里面出现了一处奇怪的前后不一致:章节标题写的是“FSD (Supervised) v14.3.10”,但正文第一行却仍然写着“FSD (Supervised) v14.3.9 包含…...

IT之家 AI09.17

微软承认在部分 Win10/Win11 经典版 Outlook 中 Copilot 入口消失

IT之家 9 月 17 日消息,微软于 9 月 15 日更新支持文档,表示经典版 Outlook 升级 Build 20026.20182 及更高版本后, 部分拥有 Copilot Chat 许可证或付费 M365 Copilot 账户的用户,可能失去 Copilot Chat 与 Copilot 入口。 在问题表现方面,IT之家援引博文介绍,微软表示升级新版后,可能会出现以下情况: 功能区上方右侧的 Copilot 按钮消失; 经典版 Outlook 左侧应用栏或“更多应用”区域不再显示 Copilot 图标; “添加应用”中虽可显示 Copilot,但选择“打开”后没有响应; 通过功能区自定义添加 Copilot 后,相关命令可能显示为不可用或灰色。 微软表示用户可以通过网页版 Outlook、独立 Microsoft Copilot 应用访问 Copilot 入口,微软强调 Copilot 服务依然正常运行,只是在受影响版...

03

行业动态

OpenAI News一手09.16

Reimagining advertising with AI

这条英文动态主要涉及智能体工作流。原文要点:Explore new AI-powered advertising experiences from OpenAI, including Sponsored Agents, tools for marketers, and integrations with HubSpot and Shopify.

Google AI Blog一手09.15

DevFest is back

这条英文动态主要涉及智能体工作流。原文要点:DevFest 2026 is back and here’s how you can connect with one of the more than 800 global events to build, secure, and scale in the agentic AI era.

OpenAI News一手09.17

Helping older adults use AI in everyday life

这条英文动态讨论了 AI 领域的新进展。原文要点:OpenAI and AARP are bringing free, hands-on ChatGPT workshops to 1,000 older adults across 10 U.S. cities to build practical AI skills safely.

OpenAI News一手09.17

Introducing Astra for Law

这条英文动态主要涉及智能体工作流。原文要点:OpenAI for Law brings frontier intelligence for law, custom firm workflows, connected legal data sources, and legal-grade controls for confidential client work.

IT之家 AI09.17

消息称 Anthropic 算力布局首度落子澳大利亚,将租赁 2.16GW 数据中心园区

IT之家 9 月 17 日消息,路透社当地时间 16 日报道称,Anthropic 签署了其首份澳大利亚数据中心租赁协议。 该协议 涉及一座规划容量达 2.16GW 的大型算力园区 ,选址位于布里斯班以西约 250km 的位置,预计将由新加坡开发商 Zerra DC 负责建设。该数据中心将采购可再生能源电力并自主承担电网连接费用。 图源:Pexels 人工智能基础设施的运行伴随着大量的能量消耗,电力供应能力是数据中心选址的决定性因素之一。 地广人稀 同时又拥有大量可再生资源的澳大利亚 是算力基建的理想区域之一 。OpenAI 此前在去年也签署了在澳大利亚建设数据中心的协议。 不过,该国社会也存在反对的声音,澳大利亚政府也承诺将从 2027 年开始对数据中心资源使用设定限制。

IT之家 AI09.16

Anthropic、谷歌、OpenAI 等美国科技巨头面临新难题:安保人员计划罢工

IT之家 9 月 16 日消息,据《商业内幕》报道,负责 Anthropic、谷歌和 OpenAI 等科技公司加州办公室安保工作的员工,计划于本周罢工。 当地时间 15 日上午,这些安保人员提交了 72 小时罢工通知 ,准备从当地时间 18 日凌晨 4:30 起拒绝参加任何在该时间或之后开始的班次。 工会 SEIU-USWW 称,他们负责 亚马逊、微软、Salesforce、OpenAI、Anthropic、谷歌、Meta 和英伟达 等大型企业的办公场所安保。 如果罢工成行,部分办公室可能被迫关闭,企业也可能要求员工居家办公,不过旧金山湾区的科技公司暂未宣布这类安排。 安保公司与 SEIU-USWW 围绕新合同的谈判迟迟没有结果。该工会代表加州约 1.4 万名安保人员。截至周二,罢工仍未最终确定。 IT之家从报道中获悉,SEIU-USWW 一名发言人称,工会与安保公司将在周三和周四继续谈判。围绕统一合同的谈判已经持续数月,安保人...

IT之家 AI09.17

莱迪思推出 FPGA 开发 AI 辅助工具 Prompt、安全控制 FPGA 新品 Mach-N2

IT之家 9 月 17 日消息,低功耗 FPGA 企业 Lattice(莱迪思)当地时间昨日宣布推出 FPGA 开发 AI 辅助工具 Radiant、安全控制 FPGA 新品系列 Mach-N2。 Prompt 以 Lattice 经过验证的文档和知识库为基础, 让 FPGA 开发者能够以自然语言贯穿完整设计流程进行开发 ,可在常见设计任务中实现 10 倍的生产力提升。其与 Lattice Radiant 设计软件深度集成,并通过 MCP 开放协议与用户现有的 AI 工具无缝协作。 Mach-N2 系列专为现代基础设施打造,集成闪存, 拥有完全符合 CNSA 2.0 标准的后量子密码学与加密敏捷性 。其为系统设计师提供当今设计所需的安全性与控制性能,同时具备随标准演进而灵活适配的能力。

04

论文研究

GitHub Changelog一手09.19

Upcoming deprecation of selected GitHub Copilot models in mid-October

事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:Upcoming deprecation of selected GitHub Copilot models in mid-October 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:Upcoming deprecation of selecte。影响判断:它可能改变智能体工作流、模型能力与工程、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、开源生态方向的选题、竞品观察和落地方案筛选。

GitHub Changelog一手09.18

Agentic CLI customizations now in the usage metrics API

事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:Agentic CLI customizations now in the usage metrics API 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:Agentic CLI customizations now in the usage m。影响判断:它可能改变智能体工作流、模型能力与工程、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、开源生态方向的选题、竞品观察和落地方案筛选。

SiliconFlow09.15

硅基流动上线开源模型 Hy4 preview,770B 总参数、1M 上下文The hottest open-source models on OpenRouter. Now live on ...

事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:硅基流动上线开源模型 Hy4 preview,770B 总参数、1M 上下文The hottest open-source models on OpenRouter. Now live on ... 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:硅。影响判断:它可能改变智能体工作流、模型能力与工程、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、开源生态方向的选题、竞品观察和落地方案筛选。

Alexandr Wang09.19

Alexandr Wang 转发一份让 AI 智能体保护日历通勤时间的 Muse 提示词love people sharing their muse prompts which work we...

事实摘要:Alexandr Wang 转发一份让 AI 智能体保护日历通勤时间的 Muse 提示词love people sharing their muse prompts which work we... 事实摘要:Alexandr Wang 转发一份让 AI 智能体保护日历通勤时间的 Muse 提示词love people sharing their muse 。影响判断:它可能改变智能体工作流相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流方向的选题、竞品观察和落地方案筛选。

Dwarkesh Patel:Podcast & Blog(RSS)09.18

Dwarkesh 对谈 Noam Brown:智能体集群、对齐与递归自我改进

事实摘要:Dwarkesh 对谈 Noam Brown:智能体集群、对齐与递归自我改进 事实摘要:Dwarkesh 对谈 Noam Brown:智能体集群、对齐与递归自我改进 事实摘要:Dwarkesh 对谈 Noam Brown:智能体集群、对齐与递归自我改进 事实摘要:Dwarkesh 对谈 Noam Brown:智能体集群、对齐与递归自我改进 事实摘要:Dwar。影响判断:它可能改变智能体工作流相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流方向的选题、竞品观察和落地方案筛选。

Cloudflare AI一手09.15

Have it both ways: stay discoverable in search while disallowing AI training

事实摘要:这条英文动态主要涉及模型能力与工程,原文信息显示:Have it both ways: stay discoverable in search while disallowing AI training 事实摘要:这条英文动态主要涉及模型能力与工程,原文信息显示:Have it both ways: stay discoverable in search w。影响判断:它可能改变模型能力与工程相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程方向的选题、竞品观察和落地方案筛选。

GitHub Changelog一手09.15

Configure cost and quality in Copilot auto model selection

事实摘要:这条英文动态主要涉及模型能力与工程、开源生态,原文信息显示:Configure cost and quality in Copilot auto model selection 事实摘要:这条英文动态主要涉及模型能力与工程、开源生态,原文信息显示:Configure cost and quality in Copilot auto model selecti。影响判断:它可能改变模型能力与工程、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程、开源生态方向的选题、竞品观察和落地方案筛选。

Claude Code Releases一手09.18

Claude Code Releases v2.1.276:Fixed every request failing with 400 … Input tag 'advisor_...

事实摘要:这条英文动态主要涉及AI 应用价值,原文信息显示:Claude Code Releases v2.1.276:Fixed every request failing with 400 … Input tag 'advisor_... 事实摘要:这条英文动态主要涉及AI 应用价值,原文信息显示:Claude Code Releases v2.1.276:Fix。影响判断:它可能改变AI 应用价值相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪AI 应用价值方向的选题、竞品观察和落地方案筛选。

GitHub Changelog一手09.17

Copilot budget increase requests are generally available

事实摘要:这条英文动态主要涉及开源生态,原文信息显示:Copilot budget increase requests are generally available 事实摘要:这条英文动态主要涉及开源生态,原文信息显示:Copilot budget increase requests are generally available 事实摘要:这条英文动态主要涉及开源。影响判断:它可能改变开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪开源生态方向的选题、竞品观察和落地方案筛选。

Cloudflare AI一手09.17

When scanners miss the attack: how Cloudflare Client-Side Security protects storefronts

事实摘要:这条英文动态主要涉及模型能力与工程,原文信息显示:When scanners miss the attack: how Cloudflare Client-Side Security protects storefronts 事实摘要:这条英文动态主要涉及模型能力与工程,原文信息显示:When scanners miss the attack: how Cl。影响判断:它可能改变模型能力与工程相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程方向的选题、竞品观察和落地方案筛选。

GitHub Changelog一手09.19

Manage the code coverage ruleset condition with the REST API

事实摘要:这条英文动态主要涉及开源生态,原文信息显示:Manage the code coverage ruleset condition with the REST API 事实摘要:这条英文动态主要涉及开源生态,原文信息显示:Manage the code coverage ruleset condition with the REST API 事实摘要:这条英文。影响判断:它可能改变开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪开源生态方向的选题、竞品观察和落地方案筛选。

GitHub Changelog一手09.19

Stage-only npm tokens for safer automation

事实摘要:这条英文动态主要涉及智能体工作流、开源生态,原文信息显示:Stage-only npm tokens for safer automation 事实摘要:这条英文动态主要涉及智能体工作流、开源生态,原文信息显示:Stage-only npm tokens for safer automation 事实摘要:这条英文动态主要涉及智能体工作流、开源生态,原文信息。影响判断:它可能改变智能体工作流、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、开源生态方向的选题、竞品观察和落地方案筛选。

05

技巧与观点

06

教育科技

IT之家 AI09.17

台积电 COO 米玉杰:AI 像三岁超人,在尖端芯片设计上不太实用

IT之家 9 月 17 日消息,台积电一名高层管理人员将人工智能比作拥有超强能力却尚不辨是非的幼童,以此解释该公司对待这项技术为何采取谨慎态度。 IT之家注意到,台积电在利用人工智能处理研发敏感信息方面尤为审慎,公司共同首席运营官米玉杰( Y.J . Mii)于本周二发表了上述看法。他着重提醒,如果员工对 AI 使用不当,就会出现数据泄露或遗失的风险;并且提到曾发生过 OpenAI 以及 Anthropic PBC 的模型侵入外部机构系统的相关事件。 “AI 就像是三岁版超人。它能力十分强大,但并不知道自己会造成什么样的破坏。”米玉杰在母校台湾大学面向在校学生发言时表示,“而且它分不清是非对错。”他并未就此进一步展开阐述。 这场在台北举办的校园职业论坛上,有学生问到企业内部如何使用 AI,这位共同首席运营官就此作出回应。就在此次发言前不久,已经出现过失控 AI 智能体程序侵入 Hugging Face 以及其他数据系统的事件;A...

IT之家 AI09.18

阿里达摩院开源全球首个专家级通用医疗影像 AI 模型 DAMO RADAR:可一次性识别超 146 种病症,成果登《科学》

IT之家 9 月 18 日消息,阿里达摩院今日宣布,与浙江大学医学院附属第一医院等机构研发出的通用医疗影像 AI 模型 DAMO RADAR,登上国际顶级学术期刊《科学》(Science)。 该模型面向腹部增强 CT 诊断, 可一次性识别超过 146 种病症 ,其准确性首次达到影像科专家级水平, 现已正式开源 。 据介绍,达摩院采用视觉-语言学习方法(Vision-Language Learning),让模型直接学习医学影像和相对应报告文本的内在关联信息。达摩院高级算法专家张建鹏表示,由于 CT 数据信号稀疏,常规的视觉-语言学习效果不佳, 该项研究在国际上首次采用“器官级细粒度对齐”策略 ,将 CT 构建三维数据并分解为解剖单元,在组织器官层面实现图像与报告文本的精确对齐,并通过自适应对比建模策略来动态调整, 无需额外人工标注即可完成可扩展、多用途、可解释的诊断 。 最终,DAMO RADAR 覆盖了含恶性肿瘤在内的广泛腹部病...

OpenRouter Announcements一手09.17

Build a Reliable Tool-Calling Agent Loop on OpenRouter

事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程,原文信息显示:Build a Reliable Tool-Calling Agent Loop on OpenRouterA tool-calling agent loop sends the conversation and tool definitions to a model, runs the too。影响判断:它可能改变智能体工作流、模型能力与工程相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程方向的选题、竞品观察和落地方案筛选。

OpenRouter Announcements一手09.14

LLM-as-a-Judge: Score AI Agent Outputs Automatically

事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、评测与基准,原文信息显示:LLM-as-a-Judge: Score AI Agent Outputs AutomaticallyAn LLM judge is a second model that scores an agent's output against criteria you write in。影响判断:它可能改变智能体工作流、模型能力与工程、评测与基准相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、评测与基准方向的选题、竞品观察和落地方案筛选。

IT之家 AI09.20

断网仍可作战:AI 模型加持的无人机可实现战场自主识别、打击目标

IT之家 9 月 20 日消息,据 Arstechnica 报道,随着欧洲各国军队开始适应现代战争当中人工智能与无人机的应用,一家获得北约支持的初创企业正在协助部署由 AI 驱动的目标探测与筛选系统。这套系统可以直接在小型无人机上运行,用于侦察以及打击任务。 据IT之家了解,这家名为斯凯奥特系统(Scaleout Systems)的公司,由瑞典乌普萨拉大学的研究人员于 2018 年创立。公司早期的业务重心,是直接在商用卡车以及其他车辆的硬件上完成机器学习模型的训练与部署。但 2022 年俄乌战争爆发之后,该公司调整方向,转向防务领域。 “乌克兰战事爆发,加之全球局势发生转变,我们意识到这项技术十分重要。借助它,边缘端的数据与传感器数据就可以投入机器学习运算,从而帮助北约盟国建立战略优势。”斯凯奥特系统联合创始人兼首席执行官安德烈亚斯 · 赫兰德(Andreas Hellander)在接受采访时表示。 斯凯奥特并没有选用 Open...

IT之家 AI09.15

曝百度挖来前谷歌 DeepMind 核心成员 Qiyin Wu,曾是 Gemini 2.5 模型官方报告核心作者

IT之家 9 月 15 日消息,据雷峰网今日爆料,前谷歌 DeepMind 主任工程师、Gemini 大模型核心研发成员 Qiyin Wu 已在近期正式加入百度, 负责大模型预训练相关工作 。 据报道,Qiyin Wu 在谷歌的职级是 L6-L7,对标国内阿里 P9/P10、字节 3-2/4-1,入职后在美国办公。 履历方面,这名华人女性科学家拥有斯坦福大学计算机硕士学位,加入 DeepMind 并晋升为 Staff Engineer 之前,她曾在谷歌多个核心技术团队深耕,并在加州大学伯克利分校 (UC Berkeley) 工程学院的相关项目中积累过丰富经验。 IT之家查询互联网公开资料获悉, Qiyin Wu 曾是谷歌 Gemini 2.5 系列大模型官方技术报告的核心作者、共同贡献者 。

量子位09.16

清华稳准智能联合发布LimiX-2,结构化数据基础模型登顶国际评测榜单

事实摘要:清华稳准智能联合发布LimiX-2,结构化数据基础模型登顶国际评测榜单 9月16日,稳准智能联合清华大学发布新一代数据大模型 LimiX-2,模型参数规模提升至400M。 这条动态来自 量子位,可重点关注模型能力与工程、评测与基准、产品发布。 清华稳准智能联合发布LimiX-2,结构化数据基础模型登顶国际评测榜单 9月16日,稳准智能联合清华大学发布新一代数。影响判断:它可能改变模型能力与工程、评测与基准相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程、评测与基准方向的选题、竞品观察和落地方案筛选。

IT之家 AI09.17

我国科学家首次给二维铁电材料装上“方向盘”,实现定向滑移

IT之家 9 月 17 日消息,据科技日报今日报道,宁波大学物理科学与技术学院研究员王宏伟联合宁波东方理工大学讲席教授李润伟、中国科学院宁波材料所研究员何日等人, 首次给原子层厚度的滑移铁电体装上了“方向盘”,使这种新型二维铁电材料实现了精准定向滑移 。相关成果发表在国际物理学期刊《物理评论快报》上。 滑移铁电体是一种依靠 原子层间整体滑移 来实现极化翻转的新型二维铁电材料,核心特点是超低能耗、超快响应和极强抗疲劳性。它不像传统铁电材料靠离子位移,而是像两张纸一样整体滑动,所以天然规避了铁电疲劳问题。 然而,其在理想单畴结构中,材料内部存在多条对称等价的滑移路径, 原子层沿哪一方向运动不受控制 。如何让原子层在二维世界里沿指定方向滑动,一直是铁电行业的难题。 研究团队以双层氮化硼为模型体系,用直接从量子力学基本方程出发的第一性原理计算,摸清材料的电子和微观结构“家底”,再借助人工智能加持的深度势能分子动力学模拟, 追踪上百万个原...

Apple Machine Learning Research一手09.16

Trajectory as the Teacher: Few-Step Discrete Flow Matching via Energy-Navigated Distillation

事实摘要:这条英文动态主要涉及模型能力与工程、评测与基准、教育应用,原文信息显示:Trajectory as the Teacher: Few-Step Discrete Flow Matching via Energy-Navigated Distillation 事实摘要:这条英文动态主要涉及模型能力与工程、评测与基准、教育应用,原文信息显示:Trajectory。影响判断:它可能改变模型能力与工程、评测与基准、教育应用相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程、评测与基准、教育应用方向的选题、竞品观察和落地方案筛选。

IT之家 AI09.19

研究显示:格陵兰和南极冰盖 1979~2023 年损失约 11.3 万亿吨冰

IT之家 9 月 19 日消息,据央视报道,一项基于卫星数据的最新国际研究显示,1979 年至 2023 年,格陵兰和南极冰盖合计损失约 11.3 万亿吨冰,对应全球平均海平面上升 3.14 厘米。 该研究由冰盖质量平衡比对计划(IMBIE)团队完成,相关论文已于 9 月 16 日发表在《自然》子刊《Scientific Data》上。 瑞典乌普萨拉大学研究员约翰 · 尼尔松参与了研究并提供卫星数据。研究汇集 27 项卫星任务数据,结合区域气候模型,对两大冰盖质量变化进行系统分析,共包括 42 项独立估算结果,其中 23 项涉及格陵兰,19 项涉及南极。卫星数据最早可追溯至 1972 年的格陵兰和 1979 年的南极,监测持续至 2023 年。 研究显示,两大冰盖的冰量损失速度在过去数十年明显加快。20 世纪 70 年代,格陵兰冰盖总体接近质量平衡,降雪带来的冰量增加与损失冰量大致相当。 20 世纪 80 年代,格陵兰冰盖年均冰...

IT之家 AI09.14

哈勃韦布望远镜联手观测发现,太阳系小型天体仍保留原始样貌

IT之家 9 月 14 日消息,哈勃空间望远镜与詹姆斯 · 韦布空间望远镜联手,对太阳系中一些体积最小、距离最远的天体开展了观测。研究发现,这些微小天体的演化历史远比我们此前预想的更加扑朔迷离。 两台在轨天文台一共发现了 27 颗新的海外天体(TNO),全部天体直径都不足 25 英里(40 千米),其中最小的一颗直径仅 6 英里(10 千米)。顾名思义,海外天体在远于海王星的轨道上环绕太阳运行。一部分海外天体诞生于这片遥远区域,是太阳系形成初期的微小星子,没能进一步发育成为行星。 以往关于海外天体形成的模型推测,这些天体长期遭受大量撞击,撞击会搅混表层物质,使得它们的成分,也就是外观颜色,会和体积更大的海外天体存在差异。然而,由两名博士研究生 —— 北亚利桑那大学的阿纳斯塔西娅 · 摩根(Anastasia Morgan)与维多利亚大学的玛丽埃勒 · 爱德华多(Marielle Eduardo)主导的最新观测,得出了相反结论:这...

07

文化创意

Claude Code Releases一手09.16

Claude Code Releases v2.1.273:Added x-claude-code-request-class , x-claude-code-agent-ty...

事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、评测与基准,原文信息显示:Claude Code Releases v2.1.273:Added x-claude-code-request-class , x-claude-code-agent-ty... 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、评测与基准,原文信息显示:Claude 。影响判断:它可能改变智能体工作流、模型能力与工程、评测与基准相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、评测与基准方向的选题、竞品观察和落地方案筛选。

Simon Willison09.18

Self-generated prompt injections in compaction summaries

事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:Self-generated prompt injections in compaction summaries 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:Self-generated prompt injections in compacti。影响判断:它可能改变智能体工作流、模型能力与工程、文化创意相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、文化创意方向的选题、竞品观察和落地方案筛选。

Simon Willison09.16

Gemini Live audio

事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:Gemini Live audio 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:Gemini Live audio 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:Gemini Live audio 事实摘要:。影响判断:它可能改变智能体工作流、模型能力与工程、文化创意相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、文化创意方向的选题、竞品观察和落地方案筛选。

Claude Code Releases一手09.18

Claude Code Releases v2.1.275:Added the signed-in account to Claude apps gateway sign-in...

事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:Claude Code Releases v2.1.275:Added the signed-in account to Claude apps gateway sign-in... 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:Claude Co。影响判断:它可能改变智能体工作流、模型能力与工程、文化创意相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、文化创意方向的选题、竞品观察和落地方案筛选。

GitHub Changelog一手09.18

Ubuntu 26 generally available and latest migration

事实摘要:这条英文动态主要涉及智能体工作流、文化创意、开源生态,原文信息显示:Ubuntu 26 generally available and latest migration 事实摘要:这条英文动态主要涉及智能体工作流、文化创意、开源生态,原文信息显示:Ubuntu 26 generally available and latest migration 事实摘要:。影响判断:它可能改变智能体工作流、文化创意、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、文化创意、开源生态方向的选题、竞品观察和落地方案筛选。

Apple Machine Learning Research一手09.16

Shared Selective Persistent Memory for Agentic LLM Systems

事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:Shared Selective Persistent Memory for Agentic LLM Systems 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:Shared Selective Persistent Memory for Age。影响判断:它可能改变智能体工作流、模型能力与工程、文化创意相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、文化创意方向的选题、竞品观察和落地方案筛选。

Simon Willison09.19

Quoting Thariq Shihipar

事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:Quoting Thariq Shihipar 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:Quoting Thariq Shihipar 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:Quoting Tha。影响判断:它可能改变智能体工作流、模型能力与工程、文化创意相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、文化创意方向的选题、竞品观察和落地方案筛选。

Simon Willison09.17

Claude Cowork and chat are now one Claude

事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:Claude Cowork and chat are now one Claude 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:Claude Cowork and chat are now one Claude 事实摘要:这条英文动态主要涉及智能。影响判断:它可能改变智能体工作流、模型能力与工程、文化创意相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、文化创意方向的选题、竞品观察和落地方案筛选。

OpenAI News一手09.16

How workers are unlocking new ways of working

这条英文动态主要涉及文化创意。原文要点:New OpenAI Economic Research shows how workers use AI beyond traditional roles and which new activities become recurring parts of their work.

Simon Willison09.15

The contagion of fear

事实摘要:这条英文动态主要涉及模型能力与工程、文化创意,原文信息显示:The contagion of fear 事实摘要:这条英文动态主要涉及模型能力与工程、文化创意,原文信息显示:The contagion of fear 事实摘要:这条英文动态主要涉及模型能力与工程、文化创意,原文信息显示:The contagion of fear 事实摘要:这条英文动态主要涉。影响判断:它可能改变模型能力与工程、文化创意相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程、文化创意方向的选题、竞品观察和落地方案筛选。

Claude Code Releases一手09.19

Claude Code Releases v2.1.277:Added AGENTS.md support: in a project with no CLAUDE.md, C...

事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:Claude Code Releases v2.1.277:Added AGENTS.md support: in a project with no CLAUDE.md, C... 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:Claude Co。影响判断:它可能改变智能体工作流、模型能力与工程、文化创意相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、文化创意方向的选题、竞品观察和落地方案筛选。

08

开源项目

GitHub Blog AI一手09.17

Migrating the GitHub Copilot runtime to Rust, using Copilot

这条英文动态主要涉及智能体工作流、开源生态、产品发布。原文要点:A rewrite this size wasn't affordable before agents. Here's what porting the Copilot agent runtime to 800,000 lines of production Rust actually took. The post Migrating the GitHub Copilot runtime to Rust, using Copilot appeared first on The GitHub Blog .

OpenAI News一手09.17

Our framework for reporting model misalignment

事实摘要:OpenAI shares a framework for reporting model misalignment。影响判断:It provides an open-source platform for tracking, investigating, and disclosing model misalignment. This includes six reports of unexpected or concern。场景价值:Model misalignment in the field of artificial intelligence。

GitHub Blog AI一手09.18

Should you read the code, is RAG dead, and did Skills kill MCP?

这条英文动态主要涉及开源生态。原文要点:We dive into these questions and other AI hot takes on the latest episode of the GitHub Podcast. The post Should you read the code, is RAG dead, and did Skills kill MCP? appeared first on The GitHub Blog .

GitHub Changelog一手09.16

GitHub Copilot suggests custom properties definitions

事实摘要:GitHub Copilot suggests custom properties definitions。影响判断:It may change the way developers select, compare, and propose custom property values in their repositories.。场景价值:Tracking open-source projects, identifying competitors, or proposing new features for existing repositories.。

IT之家 AI09.20

阶跃发布旗舰模型 Step 5 Preview:跻身 AA 榜单全球开源模型前三,10 月 15 日开源

IT之家 9 月 20 日消息,阶跃今天宣布推出旗舰模型 Step 5 Preview,面向 AI 编程、软件工程、专业知识工作、金融等场景,提升模型执行真实世界 Agentic 任务表现,10 月 15 日开源完整权重。 据介绍,该模型采用稀疏 MoE 混合专家架构, 总参数量 600B 、激活参数仅 27B,支持 100 万 Token 上下文窗口,原生支持文本与视觉输入。 在全球人工智能权威榜单 Artificial Analysis Intelligence Index(IT之家注:AA 综合智能指数)中,该模型得分 44 分, 位居全球开源模型前三 。与此同时,该模型的单任务成本仅为 Anthropic Claude Opus 5 的 1/8。 优化方面,阶跃为该模型建立了 StepCodeBench,覆盖 553 个独立代码仓库、9 类任务、20 个应用领域和 33 种编程语言。在测试中,Step 5 Preview...

IT之家 AI09.15

Salesforce 联合英伟达推出 Koa 推理大模型,挑战闭源前沿模型

IT之家 9 月 15 日消息,本周在规模盛大的 Dreamforce 技术大会上,Salesforce 最重要的发布成果之一就是一款名叫 Koa 的全新 AI 模型。Koa 是该公司首款推理大模型,基于英伟达开源权重的 Nemotron 模型打造。两家企业联合完成了 Koa 的后续微调训练,让其擅长处理销售、市场营销以及客户服务类任务。 Koa 是一个很典型的例子:面向企业的 AI 需求,正在和前沿 AI 实验室所提供的产品逐渐分化。那些闭源 AI 实验室更希望企业直接把文件、代码、提示词以及反馈全部上传到自家模型与智能体当中,并为此花费数百万美元。 而借助这款模型,Salesforce 向它的企业客户提供了以下能力: 作为闭源前沿大模型之外、采用开源权重的备选方案 专门针对实际业务任务训练(而不是主攻高难度数学解题) 训练过程没有摄入任何真实客户数据,因此不存在向外泄露客户数据的风险 有助于降低 AI 使用成本,完成同等业务...

IT之家 AI09.19

中国电信开源首个全栈国产轻量级智能体大模型 Xing4.0-29B-A4B

IT之家 9 月 19 日消息,中国电信于 9 月 17 日发布新一代星辰大模型 Xing4.0-29B-A4B,该模型总参数量 29B,激活参数仅 4B,原生支持 256K 上下文,可扩展至 512K, 是国内首个基于国产算力与国产框架完成训练、面向复杂工程任务深度优化的百亿参数大模型 。 官方表示,从训练芯片到推理部署, 全栈国产 —— 昇腾训练、国产框架适配、自研架构、开源生态,一条路走通。 从 SuperCLUE 评测结果来看,在智能体能力方面,Xing4.0-29B-A4B 得分 93.52,位列第 3 名,与两款头部 Qwen 模型的差距均不足 1 分。 据介绍,Xing4.0-29B-A4B 通过 4-bit 量化后显存占用降低至 15GB(比 FP16 省约 75%),RTX 3090、RTX 4090 这类 24G 消费级显卡就能本地跑长上下文任务。 Xing4.0-29B-A4B 延续星辰大模型的开源路线,对...

IT之家 AI09.16

Mozilla 报告:中美 AI 模型能力差距缩短至 4.4 个月

IT之家 9 月 16 日消息,Mozilla 昨日(9 月 15 日)发布第二版《开源 AI 现状》报告,报道称中国公司最佳开放权重模型与美国科技公司的前沿闭源模型, 能力差距已缩至 4.4 个月。 相比较今年 7 月发布的第一版《开源 AI 现状》报告,第二版报告把宏观判断进一步落到了具体模型、具体任务时长和单任务成本上。 维度 7 月首版 9 月新版 主要变化 能力差距 顶级开放模型与 ChatGPT、Claude 等专有模型的性能差距为 3% 美国前沿闭源模型与中国最佳开放权重模型的差距为 4.4 个月 从单一综合性能百分比,改为更贴近实际工作的“任务时长”指标。 成本表述 GPT-4 级推理成本 3 年下降至 50 分之一 Kimi K3 成本为 Fable 5 的 30%;GLM 5.2 单任务成本约低至 5 分之一 新版给出模型对模型、任务对任务的直接成本对照。 使用数据 79% 开发者使用开放模型,51% 已部署...

IT之家 AI09.17

微软发布 1.138 版 VS Code:优化 AI 智能体协作、扩展 Codex harness

IT之家 9 月 17 日消息,微软今天(9 月 17 日)发布公告,宣布推出 1.138 版 Visual Studio Code 更新, 新增开发容器中的智能体会话、扩展 Codex harness,并预览会话清理功能。 在开发容器的智能体会话中,新版支持在本地开发容器中运行智能体。智能体可使用项目指定的工具和依赖项,并遵循项目配置的环境。该机制不会默认调用本地计算机中的全部工具和依赖项。IT之家附上相关截图如下: 启用 chat.agentHost.devContainer.enabled 后,带有受支持开发容器配置的本地文件夹,会在文件夹菜单中显示“使用开发容器”选项。选择该选项后,智能体会话将在对应容器中运行,不过使用该功能需要安装 Docker。 新版扩展 Codex harness 支持,在 ChatGPT 应用与 VS Code 之间延续同一会话。用户可以选择 GitHub Copilot 订阅或 ChatGPT...

IT之家 AI09.17

OpenAI 首次公开六起模型异常案例,涉及瞒报错误、编造数据及未经授权上传文件

IT之家 9 月 17 日消息,当地时间 9 月 16 日,OpenAI 发布报告,披露了其“对齐失效”框架下的六起模型异常行为案例,涉及隐瞒错误、编造数据、未经许可上传文件等。 对齐失效在这里是指 AI 系统的目标与行为偏离人类设计意图和价值观。OpenAI 表示,行业尚未充分解决对齐与监控问题,已无法继续以最快速度且安稳地扩大 AI 规模。OpenAI 也借此机会宣布将系统性跟踪、调查和披露模型在训练、评估、测试及部署过程中出现的异常行为。 OpenAI 称,有关 AI 应如何发展的决策,必须建立在外部人士可以自行核验的实证依据之上。该公司希望新框架推动行业形成公开披露标准,而非仅靠零散报告。 此番披露之际,外界正争论是否应放缓 AI 研发。今年早些时候,OpenAI 系统出现失控行为并攻击 AI 初创企业 Hugging Face,几周后 Hugging Face 主动告知,OpenAI 方才知晓。 此后,Anthropi...

往期 AI 周报
(本期完)

AI.BAIZE 周报由编辑系统根据公开来源自动综合,每条均附原文 · 往期周报