跳到正文
9月4日周五
  1. Tomer Tunguz71

    Concrete, Silicon, & Leverage

    事实摘要:这条英文动态主要涉及AI 应用价值,原文信息显示:Concrete, Silicon, & Leverage 事实摘要:这条英文动态主要涉及AI 应用价值,原文信息显示:Concrete, Silicon, & Leverage 事实摘要:这条英文动态主要涉及AI 应用价值,原文信息显示:Concrete, Silicon, & Leverage 事实摘要:。影响判断:它可能改变AI 应用价值相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪AI 应用价值方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和AI 应用价值直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  2. IT之家 AI72

    智谱 GLM-5.3-Flash 夜间免费用:9 月 3 日至 20 日、每天 23 时至次日 9 时额度全免

    IT之家 9 月 4 日消息,智谱 AI 昨日宣布,旗下 GLM Coding Plan 正式推出“Flash × ZCode”夜间畅用活动。 即日起至 9 月 20 日,每晚 23:00 至次日 9:00,所有付费套餐用户无需手动开启,系统将自动生效优惠。活动期间,GLM Coding Plan 套餐中的 GLM-5.3-Flash 模型额度消耗规则如下: 通过智谱官方编程工具 ZCode 使用时,额度消耗为 0,实现完全免费畅用。 通过套餐支持的其他 Agent 使用时,可用额度翻倍(×2)。 IT之家提醒:本次活动仅针对 GLM-5.3-Flash 模型,错峰时段内若选用 GLM-5.3,仍按套餐标准规则消耗额度。活动时间以北京时间(UTC+8)为准,含周末及公共假日。 GLM-5.3-Flash 是 GLM-5 系列的首个原生多模态模型,支持 100 万 token 上下文窗口及文本、图像与视频多模态输入。 该模型一度以...

    推荐理由:来自IT之家 AI的《智谱 GLM-5.3-Flash 夜间免费用:9 月 3 日至 20 日、每天 23 时至次日 9 时额度全免》。重点看智能体工作流、模型能力与工程。摘要提到:IT之家 9 月 4 日消息,智谱 AI 昨日宣布,旗下 GLM Coding Plan 正式推出“Flash × ZCode”夜间畅用活动。 即日起至 9 月 20 日,每晚 23:00 至次日 9:00,所有付费套餐用户无需手动开启,系统将自动生效优惠。活动期间,GLM Coding Plan 套餐中的 GLM-5.3-Flash 模型额度消耗规则如下: 通过智谱官方编程工具 ZCode 使用时,额度消耗为 0,实现完全免费畅用。 通过套餐支持的其他 Agent 使用时,可用额度翻倍(×2)。 IT之家提醒:本次活动仅针对 GLM-5.3-Flash 模型,错峰时段内若选用 GLM-5.3,仍按套餐标准规则消耗额度。活动时间以北京时间(UTC+8)为准,含周末及公共假日。 GLM-5.3-Flash 是 GLM-5 系列的首个原生多模态模型,支持 100 万 token 上下文窗口及文本、图像与视频多模态输入。 该模型一度以...

  3. GitHub Changelog84

    GitHub Actions: Early September 2026 updates

    事实摘要:这条英文动态主要涉及智能体工作流、开源生态,原文信息显示:GitHub Actions: Early September 2026 updates 事实摘要:这条英文动态主要涉及智能体工作流、开源生态,原文信息显示:GitHub Actions: Early September 2026 updates 事实摘要:这条英文动态主要涉及智能体工作流、开源生态。影响判断:它可能改变智能体工作流、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  4. GitHub Changelog90

    Upcoming deprecation of selected GitHub Copilot models

    事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:Upcoming deprecation of selected GitHub Copilot models 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:Upcoming deprecation of selected GitHub Copilo。影响判断:它可能改变智能体工作流、模型能力与工程、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程、开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  5. GitHub Blog AI92

    GitHub Copilot app for Beginners: Run several agents at once

    事实摘要:这条英文动态主要涉及智能体工作流、文化创意、开源生态,原文信息显示:GitHub Copilot app for Beginners: Run several agents at once 事实摘要:这条英文动态主要涉及智能体工作流、文化创意、开源生态,原文信息显示:GitHub Copilot app for Beginners: Run several 。影响判断:它可能改变智能体工作流、文化创意、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、文化创意、开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、文化创意、开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

9月3日周四
  1. OpenAI News78

    Legora reviewed 41 documents in minutes with GPT-6 Astra

    这条英文动态主要涉及智能体工作流。原文要点:Legora used GPT-6 Astra to review 41 documents in minutes, find all four planted errors, and improve performance by nearly 40% in this financial-review workflow.

    推荐理由:来自OpenAI News的《Legora reviewed 41 documents in minutes with GPT-6 Astra》。重点看智能体工作流。摘要提到:这条英文动态主要涉及智能体工作流。原文要点:Legora used GPT-6 Astra to review 41 documents in minutes, find all four planted errors, and improve performance by nearly 40% in this financial-review workflow.

  2. IT之家 AI66

    继鸿蒙之后,腾讯 WorkBuddy 再上线银河麒麟、统信操作系统

    IT之家 9 月 3 日消息,今日,腾讯 WorkBuddy 登陆银河麒麟操作系统和统信操作系统 UOS ,并上架其应用商店;同时也上架了 openKylin 社区和 deepin 社区的软件商店。 ▲ 银河麒麟软件商店 ▲ 统信应用商店 据介绍,此次对银河麒麟和统信 UOS 的适配并非简单的代码迁移。WorkBuddy 团队联合国产操作系统协同攻坚,围绕系统登录联动、设备互联交互、智能技能调用、任务成果预览等核心业务链路,进行全场景、定制化适配打磨,达成原生级运行效果。对用户而言,这意味着在 国产 Linux 操作系统 上,也能获得与其他主流平台一致且顺畅的完整体验。 用户在上述操作系统应用商店搜索“ WorkBuddy ”,即可一键下载安装,开箱即用,无需任何额外配置,WorkBuddy 新用户同样可享受 2000 免费积分。 值得一提的是,今年 7 月,WorkBuddy 鸿蒙 PC 版发布,成为鸿蒙平台首个桌面办公智能体...

    推荐理由:来自IT之家 AI的《继鸿蒙之后,腾讯 WorkBuddy 再上线银河麒麟、统信操作系统》。重点看智能体工作流、产品发布。摘要提到:IT之家 9 月 3 日消息,今日,腾讯 WorkBuddy 登陆银河麒麟操作系统和统信操作系统 UOS ,并上架其应用商店;同时也上架了 openKylin 社区和 deepin 社区的软件商店。 ▲ 银河麒麟软件商店 ▲ 统信应用商店 据介绍,此次对银河麒麟和统信 UOS 的适配并非简单的代码迁移。WorkBuddy 团队联合国产操作系统协同攻坚,围绕系统登录联动、设备互联交互、智能技能调用、任务成果预览等核心业务链路,进行全场景、定制化适配打磨,达成原生级运行效果。对用户而言,这意味着在 国产 Linux 操作系统 上,也能获得与其他主流平台一致且顺畅的完整体验。 用户在上述操作系统应用商店搜索“ WorkBuddy ”,即可一键下载安装,开箱即用,无需任何额外配置,WorkBuddy 新用户同样可享受 2000 免费积分。 值得一提的是,今年 7 月,WorkBuddy 鸿蒙 PC 版发布,成为鸿蒙平台首个桌面办公智能体...

  3. IT之家 AI66

    微软调整财报口径:智能体与基础设施、设备与消费者 2 板块,Azure 营收纳入报告范围

    IT之家 9 月 3 日消息,Microsoft(微软)当地时间 9 月 2 日宣布调整财报口径,将其整体业务从此前的“生产力和商业流程”“智能云”“更个人化计算”3 板块 调整为“智能体与基础设施”“设备与消费者”2 板块结构 。 “智能体与基础设施”大致相当于“生产力和商业流程”“智能云”两者之和,“设备与消费者”则在“更个人化计算”的基础上吸收了 LinkedIn(领英)的营销解决方案、高级订阅部分。 而在“智能体与基础设施”内部,此前独立的 LinkedIn 根据业务属性被拆分并纳入其它项目;Azure 则在开发者云等内容迁移到 Microsoft 365 云后成为更纯粹的按使用量计费的平台和基础设施业务, 微软也将开始披露 Azure 的季度收入 。

    推荐理由:来自IT之家 AI的《微软调整财报口径:智能体与基础设施、设备与消费者 2 板块,Azure 营收纳入报告范围》。重点看智能体工作流。摘要提到:IT之家 9 月 3 日消息,Microsoft(微软)当地时间 9 月 2 日宣布调整财报口径,将其整体业务从此前的“生产力和商业流程”“智能云”“更个人化计算”3 板块 调整为“智能体与基础设施”“设备与消费者”2 板块结构 。 “智能体与基础设施”大致相当于“生产力和商业流程”“智能云”两者之和,“设备与消费者”则在“更个人化计算”的基础上吸收了 LinkedIn(领英)的营销解决方案、高级订阅部分。 而在“智能体与基础设施”内部,此前独立的 LinkedIn 根据业务属性被拆分并纳入其它项目;Azure 则在开发者云等内容迁移到 Microsoft 365 云后成为更纯粹的按使用量计费的平台和基础设施业务, 微软也将开始披露 Azure 的季度收入 。

  4. 极客公园78

    AI 下一场竞争:谁能成为 Agent 的「上下文操作系统」

    头图来源:视觉中国 前段时间,Anthropic 发布了 Model Hardware Standard,尝试给 AI Agent 建立一套与硬件沟通的通用语言。接入这套标准后,显微镜、机械臂等不同厂商、不同接口的设备,可以被 Agent 发现、理解和调用。 这件事指向了 AI 行业正在发生的一次变化。过去一年,竞争主要围绕模型的推理、生成和多模态能力展开;如今,Agent 开始走出聊天窗口,进入实验室、工厂和企业现场。行业的问题随之向下移动:模型已经足够聪明之后,谁来连接工具、硬件、数据和任务? 9 月 2 日,腾讯 WorkBuddy 宣布面向更多伙伴开放合作。通达信、广发证券、北大法宝、腾讯 SSV 教师助手、微盟、北森、云帐房、帆软等应用与软件伙伴进入生态;Plaud、Rokid、影石、优篮子、科大讯飞、安克、猛玛、京造等硬件伙伴,也共同构成了 WorkBuddy 的生态版图。 一款 AI 产品为什么要同时连接专业软件、...

    推荐理由:来自极客公园的《AI 下一场竞争:谁能成为 Agent 的「上下文操作系统」》。重点看智能体工作流、模型能力与工程、教育应用。摘要提到:头图来源:视觉中国 前段时间,Anthropic 发布了 Model Hardware Standard,尝试给 AI Agent 建立一套与硬件沟通的通用语言。接入这套标准后,显微镜、机械臂等不同厂商、不同接口的设备,可以被 Agent 发现、理解和调用。 这件事指向了 AI 行业正在发生的一次变化。过去一年,竞争主要围绕模型的推理、生成和多模态能力展开;如今,Agent 开始走出聊天窗口,进入实验室、工厂和企业现场。行业的问题随之向下移动:模型已经足够聪明之后,谁来连接工具、硬件、数据和任务? 9 月 2 日,腾讯 WorkBuddy 宣布面向更多伙伴开放合作。通达信、广发证券、北大法宝、腾讯 SSV 教师助手、微盟、北森、云帐房、帆软等应用与软件伙伴进入生态;Plaud、Rokid、影石、优篮子、科大讯飞、安克、猛玛、京造等硬件伙伴,也共同构成了 WorkBuddy 的生态版图。 一款 AI 产品为什么要同时连接专业软件、...

  5. IT之家 AI74

    遏制智能体失控,消息称 OpenAI 正开发 AI 自动终止功能

    IT之家 9 月 3 日消息,路透社昨日(9 月 2 日)发布博文,披露一份来自 OpenAI 的内部信件,透露该公司正在为 AI 系统开发“自动终止功能”。 消息称 OpenAI 开发该功能的目的,是为了遏制 AI 智能体的失控情况,该公司此前披露的安全事件中,具备自主能力的 AI 智能体在安全测试期间脱离数字容器,联网入侵 Hugging Face。 该信件是 OpenAI 发送给两位众议院民主党议员,其工程师正在为人工智能系统开发“自动关闭功能”,已提高 AI 模型在安全测试中访问互联网的难度。 美国众议院民主党议员格雷格 · 卡萨尔(Greg Casar)和多丽丝 · 松井(Doris Matsui)在今年 8 月致函 OpenAI,要求提供有关该事件及公司安全保障措施的更多信息。 OpenAI 在回复中表示,将更密切地监控其 AI 系统在完成任务时所采取的行动,包括它们访问的数字工具以及所遵循的操作步骤。

    推荐理由:来自IT之家 AI的《遏制智能体失控,消息称 OpenAI 正开发 AI 自动终止功能》。重点看智能体工作流、模型能力与工程、产品发布。摘要提到:IT之家 9 月 3 日消息,路透社昨日(9 月 2 日)发布博文,披露一份来自 OpenAI 的内部信件,透露该公司正在为 AI 系统开发“自动终止功能”。 消息称 OpenAI 开发该功能的目的,是为了遏制 AI 智能体的失控情况,该公司此前披露的安全事件中,具备自主能力的 AI 智能体在安全测试期间脱离数字容器,联网入侵 Hugging Face。 该信件是 OpenAI 发送给两位众议院民主党议员,其工程师正在为人工智能系统开发“自动关闭功能”,已提高 AI 模型在安全测试中访问互联网的难度。 美国众议院民主党议员格雷格 · 卡萨尔(Greg Casar)和多丽丝 · 松井(Doris Matsui)在今年 8 月致函 OpenAI,要求提供有关该事件及公司安全保障措施的更多信息。 OpenAI 在回复中表示,将更密切地监控其 AI 系统在完成任务时所采取的行动,包括它们访问的数字工具以及所遵循的操作步骤。

  6. Tomer Tunguz86

    The Ads Model for Prompts Vertically Integrates AI

    事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程,原文信息显示:The Ads Model for Prompts Vertically Integrates AI 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程,原文信息显示:The Ads Model for Prompts Vertically Integrates AI 事实摘要:这条英文。影响判断:它可能改变智能体工作流、模型能力与工程相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  7. IT之家 AI78

    Meta 发布最强 AI 模型 Muse Spark 1.3,编码能力超 GPT-5.6 Sol

    IT之家 9 月 3 日消息,Meta Platforms 于 2026 年 9 月 2 日发布迄今最强大 AI 模型 Muse Spark 1.3,专为延长智能体工作流与增强编码能力设计。 Meta 首席 AI 官 Alexandr Wang 表示, 该模型在编码能力上超越 OpenAI 的 GPT-5.6 Sol ,与 Anthropic 的 Claude Fable 5.1 表现持平。 定价方面,Muse Spark 1.3 维持与前代 Muse Spark 1.2 相同的定价,通过 Meta Model API 向开发者提供付费访问: 每 100 万词元输入费用为 1.25 美元 (IT之家注:现汇率约合 8.4 元人民币) 每 100 万词元缓存命中输入费用为 0.15 美元 (现汇率约合 1 元人民币) 每 100 万词元输出费用为 4.25 美元 (现汇率约合 28.6 元人民币) Wang 透露,API 平台市场...

    推荐理由:来自IT之家 AI的《Meta 发布最强 AI 模型 Muse Spark 1.3,编码能力超 GPT-5.6 Sol》。重点看智能体工作流、模型能力与工程、产品发布。摘要提到:IT之家 9 月 3 日消息,Meta Platforms 于 2026 年 9 月 2 日发布迄今最强大 AI 模型 Muse Spark 1.3,专为延长智能体工作流与增强编码能力设计。 Meta 首席 AI 官 Alexandr Wang 表示, 该模型在编码能力上超越 OpenAI 的 GPT-5.6 Sol ,与 Anthropic 的 Claude Fable 5.1 表现持平。 定价方面,Muse Spark 1.3 维持与前代 Muse Spark 1.2 相同的定价,通过 Meta Model API 向开发者提供付费访问: 每 100 万词元输入费用为 1.25 美元 (IT之家注:现汇率约合 8.4 元人民币) 每 100 万词元缓存命中输入费用为 0.15 美元 (现汇率约合 1 元人民币) 每 100 万词元输出费用为 4.25 美元 (现汇率约合 28.6 元人民币) Wang 透露,API 平台市场...

  8. IT之家 AI76

    欧洲最强 AI:西班牙公司推出 Quasar 438B 模型,1M 词元上下文

    IT之家 9 月 3 日消息,西班牙 AI 公司 Multiverse Computing 最新推出 Quasar 438B 模型,根据 Artificial Analysis 得分, 该模型 Intelligence Index v4.1.1 得分为 43,在参与比较的欧洲模型中排名最高。 IT之家注:该指数综合 9 项评测,覆盖智能体、代码、科学推理、通用知识和长上下文推理,是评估模型能力的主要基准之一。作为对比,Mistral Medium 3.5 得分为 30,NVIDIA Nemotron 3 Ultra 得分为 38。 该模型拥有 4,380 亿参数,定位为推理模型,主要面向企业级智能体、软件开发和复杂多步任务。Quasar 438B 支持英语和西班牙语,并已通过 CompactifAI API 提供访问。 在官方 X 推文下方的“背景信息”中,补充表示该模型可能基于智谱的 GLM5.2 模型制作。 该模型目前属于专...

    推荐理由:来自IT之家 AI的《欧洲最强 AI:西班牙公司推出 Quasar 438B 模型,1M 词元上下文》。重点看智能体工作流、模型能力与工程、评测与基准。摘要提到:IT之家 9 月 3 日消息,西班牙 AI 公司 Multiverse Computing 最新推出 Quasar 438B 模型,根据 Artificial Analysis 得分, 该模型 Intelligence Index v4.1.1 得分为 43,在参与比较的欧洲模型中排名最高。 IT之家注:该指数综合 9 项评测,覆盖智能体、代码、科学推理、通用知识和长上下文推理,是评估模型能力的主要基准之一。作为对比,Mistral Medium 3.5 得分为 30,NVIDIA Nemotron 3 Ultra 得分为 38。 该模型拥有 4,380 亿参数,定位为推理模型,主要面向企业级智能体、软件开发和复杂多步任务。Quasar 438B 支持英语和西班牙语,并已通过 CompactifAI API 提供访问。 在官方 X 推文下方的“背景信息”中,补充表示该模型可能基于智谱的 GLM5.2 模型制作。 该模型目前属于专...

  9. GitHub Changelog88

    Enterprise-managed settings support any default model

    事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:Enterprise-managed settings support any default model 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:Enterprise-managed settings support any default。影响判断:它可能改变智能体工作流、模型能力与工程、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程、开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

9月2日周三
  1. IT之家 AI74

    谷歌 Gemini 3.8 Flash 模型上线,适用软件工程、智能体任务等场景

    IT之家 9 月 2 日消息,谷歌今天(2 日)在 Google DeepMind 网站低调上线了 Gemini 3.8 Flash 模型。其基于 Gemini 3.7 Flash,拥有在软件工程和智能体知识工作流方面的性能提升,并持续支持可定制的努力水平,以控制质量、成本和延迟的组合。 不过截至IT之家发稿,谷歌官方暂未通过新闻稿或社媒平台官宣这一模型的存在。 Gemini 3.8 Flash 基于 Gemini 3.7 Flash,具有最高 1M 的 token 上下文窗口,文本支持 64K token 输出。官方还公布了多项基准测试评估结果,涵盖编程、知识处理、多模态处理能力、长上下文处理、计算机使用能力以及科学推理能力。 截至 2026 年 9 月的结果如下: 根据介绍,Gemini 3.8 Flash 面向个人用户、开发者和企业,适合以较低成本大规模部署通用型、可直接用于生产环境的智能体,典型用途包括 软件工程、智能体...

    推荐理由:来自IT之家 AI的《谷歌 Gemini 3.8 Flash 模型上线,适用软件工程、智能体任务等场景》。重点看智能体工作流、模型能力与工程、评测与基准。摘要提到:IT之家 9 月 2 日消息,谷歌今天(2 日)在 Google DeepMind 网站低调上线了 Gemini 3.8 Flash 模型。其基于 Gemini 3.7 Flash,拥有在软件工程和智能体知识工作流方面的性能提升,并持续支持可定制的努力水平,以控制质量、成本和延迟的组合。 不过截至IT之家发稿,谷歌官方暂未通过新闻稿或社媒平台官宣这一模型的存在。 Gemini 3.8 Flash 基于 Gemini 3.7 Flash,具有最高 1M 的 token 上下文窗口,文本支持 64K token 输出。官方还公布了多项基准测试评估结果,涵盖编程、知识处理、多模态处理能力、长上下文处理、计算机使用能力以及科学推理能力。 截至 2026 年 9 月的结果如下: 根据介绍,Gemini 3.8 Flash 面向个人用户、开发者和企业,适合以较低成本大规模部署通用型、可直接用于生产环境的智能体,典型用途包括 软件工程、智能体...

  2. IT之家 AI70

    豆包工作功能上新:支持多 Agents 并行与 Mac 操作电脑

    IT之家 9 月 2 日消息,豆包工作新增两项新功能:“多 Agents 并行”和 Mac 系统下的“操作电脑”。 据介绍,多 Agents 并行功能,能让豆包召唤不同的子 Agent,在一个任务下分别执行不同的模块,既成倍节省时间,又能同时交付不同,适合“需要同时干好多不同的活”的需求。 Mac 系统的操作电脑功能,可让豆包实现本地 GUI 操作,在没有 MCP、API、插件和 CLI 的情况下也能看懂界面并完成相应操作。 据IT之家了解,豆包工作是字节跳动旗下豆包品牌于 2026 年 8 月 25 日面向生产力场景推出的全新 Agent(智能体)产品与品牌,定位为字节跳动在 AI 办公场景的统一产品入口。

    推荐理由:来自IT之家 AI的《豆包工作功能上新:支持多 Agents 并行与 Mac 操作电脑》。重点看智能体工作流、产品发布。摘要提到:IT之家 9 月 2 日消息,豆包工作新增两项新功能:“多 Agents 并行”和 Mac 系统下的“操作电脑”。 据介绍,多 Agents 并行功能,能让豆包召唤不同的子 Agent,在一个任务下分别执行不同的模块,既成倍节省时间,又能同时交付不同,适合“需要同时干好多不同的活”的需求。 Mac 系统的操作电脑功能,可让豆包实现本地 GUI 操作,在没有 MCP、API、插件和 CLI 的情况下也能看懂界面并完成相应操作。 据IT之家了解,豆包工作是字节跳动旗下豆包品牌于 2026 年 8 月 25 日面向生产力场景推出的全新 Agent(智能体)产品与品牌,定位为字节跳动在 AI 办公场景的统一产品入口。

  3. IT之家 AI70

    阿里云企业级 Agent 协作平台“万有无界”开启公测

    IT之家 9 月 2 日消息,据阿里云官方消息,今日,阿里云旗下企业级人与 Agent 协作平台“万有无界”开启公测。 企业用户和个人用户均可通过官网 ( https://www.qianwenai.com/agents/wanyou ) 注册体验,可调用阿里最新旗舰模型 Qwen3.8-Max。 据介绍,万有无界是一个多角色 Agent 协作工作台。与让单一 AI Agent 大包大揽不同,它把一件复杂的事拆解给多位有不同职责的 Agent—— 在“项目空间”里组织成员和资产,通过群聊让多位 Agent 围绕同一个任务接力推进,过程中的产出沉淀到资产库,成为企业可复用的数字资产。 IT之家附官方详细介绍如下: 整个平台围绕几个核心功能展开。项目空间是组织协作的容器,把群聊、成员、资产归拢到同一个项目下;Agent 会话分为单聊和群聊两种形态,用户既可以单独与 Agent 对话,也可以在群聊里与多个 Agent 协作;项目由 P...

    推荐理由:来自IT之家 AI的《阿里云企业级 Agent 协作平台“万有无界”开启公测》。重点看智能体工作流、模型能力与工程。摘要提到:IT之家 9 月 2 日消息,据阿里云官方消息,今日,阿里云旗下企业级人与 Agent 协作平台“万有无界”开启公测。 企业用户和个人用户均可通过官网 ( https://www.qianwenai.com/agents/wanyou ) 注册体验,可调用阿里最新旗舰模型 Qwen3.8-Max。 据介绍,万有无界是一个多角色 Agent 协作工作台。与让单一 AI Agent 大包大揽不同,它把一件复杂的事拆解给多位有不同职责的 Agent—— 在“项目空间”里组织成员和资产,通过群聊让多位 Agent 围绕同一个任务接力推进,过程中的产出沉淀到资产库,成为企业可复用的数字资产。 IT之家附官方详细介绍如下: 整个平台围绕几个核心功能展开。项目空间是组织协作的容器,把群聊、成员、资产归拢到同一个项目下;Agent 会话分为单聊和群聊两种形态,用户既可以单独与 Agent 对话,也可以在群聊里与多个 Agent 协作;项目由 P...

  4. IT之家 AI76

    AI 大模型周榜:国产 GLM-5.3-Flash 首秀杀进代码榜前十,千问 3.8-Max 登顶前端榜

    IT之家 9 月 2 日消息,Arena( arena.ai )平台发布 2026 年第 35 周(8 月 24 日 ~8 月 30 日)AI 大模型盲测排行榜,本期有多款国产新模型亮相,且取得亮眼排名。 国产 GLM-5.3-Flash 首次进入代码榜 Top 10,Qwen3.8-Max-0902 首次入榜即登顶前端开发榜榜首,Kimi-K3-Max 稳定守住综合榜 Top 10 位置,整体来看国产模型在细分领域继续保持竞争力。 IT之家注 :本榜单基于 Arena( arena.ai )平台匿名盲测投票,通过 ELO(智能体榜为百分比信号)计算排名,反映用户主观偏好而非绝对能力测试;不同分榜相互独立,不宜跨榜比较,分差在误差范围内均视为并列,新模型也需积累一定投票量后才会正式入榜。 综合榜 本周综合榜头部格局稳定,Claude-Fable-5 以 1508 分蝉联榜首,Anthropic 多款模型占据前七位,排名变化均在 ...

    推荐理由:来自IT之家 AI的《AI 大模型周榜:国产 GLM-5.3-Flash 首秀杀进代码榜前十,千问 3.8-Max 登顶前端榜》。重点看智能体工作流、模型能力与工程、产品发布。摘要提到:IT之家 9 月 2 日消息,Arena( arena.ai )平台发布 2026 年第 35 周(8 月 24 日 ~8 月 30 日)AI 大模型盲测排行榜,本期有多款国产新模型亮相,且取得亮眼排名。 国产 GLM-5.3-Flash 首次进入代码榜 Top 10,Qwen3.8-Max-0902 首次入榜即登顶前端开发榜榜首,Kimi-K3-Max 稳定守住综合榜 Top 10 位置,整体来看国产模型在细分领域继续保持竞争力。 IT之家注 :本榜单基于 Arena( arena.ai )平台匿名盲测投票,通过 ELO(智能体榜为百分比信号)计算排名,反映用户主观偏好而非绝对能力测试;不同分榜相互独立,不宜跨榜比较,分差在误差范围内均视为并列,新模型也需积累一定投票量后才会正式入榜。 综合榜 本周综合榜头部格局稳定,Claude-Fable-5 以 1508 分蝉联榜首,Anthropic 多款模型占据前七位,排名变化均在 ...

  5. 量子位70

    前字节强化学习专家孙鹏博士加盟星尘智能,完善Physical AI全栈技术布局

    事实摘要:前字节强化学习专家孙鹏博士加盟星尘智能,完善Physical AI全栈技术布局 9月2日,前字节跳动强化学习专家、前腾讯Robotics X智能体中⼼负责⼈孙鹏博⼠正式加入星尘智能 这条动态来自 量子位,可重点关注智能体工作流。 前字节强化学习专家孙鹏博士加盟星尘智能,完善Physical AI全栈技术布局 9月2日,前字节跳动强化学习专家、前腾讯Robot。影响判断:它可能改变智能体工作流相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  6. IT之家 AI70

    合见工软发布国内首款三维芯片物理设计工具:全面适配韬定律,填补国产 EDA 空白,专为国产先进工艺节点打造

    IT之家 9 月 2 日消息,国内数字 EDA / IP 企业上海合见工业软件集团股份有限公司(简称“合见工软”)9 月 1 日在 2026 IDAS 设计自动化产业峰会期间,发布多款突破性 EDA 自研新品和成果, 填补国产 EDA 在商用级 3DIC 物理设计及多款 EDA 智能体等方面的空白 ,包括: 国产首个 Agentic EDA 智能体战略体系 国内首款三维芯片物理设计工具 国产先进工艺节点收敛工具等 合见工软推出国内首款三维芯片物理设计工具 UniVista 3DIC Designer, 宣称专为国产先进工艺节点打造,可全面适配逻辑折叠与韬定律技术路线 ,并凭借底层自研真三维布局算法,打开全新的性能和密度提升空间。 该工具的推出打破了国内商用级 3DIC 物理设计工具空白,为 AI 等算力芯片提供自主可控的三维设计底座。 UniVista 3DIC Designer 聚焦电路逻辑空间折叠实现,打破了传统 2D 芯片...

    推荐理由:来自IT之家 AI的《合见工软发布国内首款三维芯片物理设计工具:全面适配韬定律,填补国产 EDA 空白,专为国产先进工艺节点打造》。重点看智能体工作流、产品发布。摘要提到:IT之家 9 月 2 日消息,国内数字 EDA / IP 企业上海合见工业软件集团股份有限公司(简称“合见工软”)9 月 1 日在 2026 IDAS 设计自动化产业峰会期间,发布多款突破性 EDA 自研新品和成果, 填补国产 EDA 在商用级 3DIC 物理设计及多款 EDA 智能体等方面的空白 ,包括: 国产首个 Agentic EDA 智能体战略体系 国内首款三维芯片物理设计工具 国产先进工艺节点收敛工具等 合见工软推出国内首款三维芯片物理设计工具 UniVista 3DIC Designer, 宣称专为国产先进工艺节点打造,可全面适配逻辑折叠与韬定律技术路线 ,并凭借底层自研真三维布局算法,打开全新的性能和密度提升空间。 该工具的推出打破了国内商用级 3DIC 物理设计工具空白,为 AI 等算力芯片提供自主可控的三维设计底座。 UniVista 3DIC Designer 聚焦电路逻辑空间折叠实现,打破了传统 2D 芯片...

  7. IT之家 AI70

    阿里千问 Qwen3.8-Max-0902 版本模型发布,拿下前端编程总榜冠军

    IT之家 9 月 2 日消息,阿里千问今日宣布 Qwen3.8-Max 模型升级到 0902 版本。 官方围绕编程(Coding)和专业办公(Cowork),对 Qwen3.8-Max 进行了进一步的后训练,使得模型整体性能再度突破, 更适合企业真实复杂任务、科研、长周期任务等 。 在 CodeArena 前端编程总榜中, Qwen3.8-Max 提升 22 分至 1691 分夺得冠军 。这说明,Qwen3.8-Max 拥有更强的智能体编程能力,在多步推理、工具调用、端到端 app 生成方面均刷新了全球模型的新上限。 同时,CodeArena 更新的模型性价比榜单(帕累托前沿)显示, Qwen3.8-Max-0902 新版本每百万 Tokens 综合平均价格为 5 美元 (IT之家注:现汇率约合 33.7 元人民币) ,而当前性能排名第二和第三的模型百万 Tokens 综合价格分别为 20 美元 (现汇率约合 134.7 元人民...

    推荐理由:来自IT之家 AI的《阿里千问 Qwen3.8-Max-0902 版本模型发布,拿下前端编程总榜冠军》。重点看智能体工作流、模型能力与工程、产品发布。摘要提到:IT之家 9 月 2 日消息,阿里千问今日宣布 Qwen3.8-Max 模型升级到 0902 版本。 官方围绕编程(Coding)和专业办公(Cowork),对 Qwen3.8-Max 进行了进一步的后训练,使得模型整体性能再度突破, 更适合企业真实复杂任务、科研、长周期任务等 。 在 CodeArena 前端编程总榜中, Qwen3.8-Max 提升 22 分至 1691 分夺得冠军 。这说明,Qwen3.8-Max 拥有更强的智能体编程能力,在多步推理、工具调用、端到端 app 生成方面均刷新了全球模型的新上限。 同时,CodeArena 更新的模型性价比榜单(帕累托前沿)显示, Qwen3.8-Max-0902 新版本每百万 Tokens 综合平均价格为 5 美元 (IT之家注:现汇率约合 33.7 元人民币) ,而当前性能排名第二和第三的模型百万 Tokens 综合价格分别为 20 美元 (现汇率约合 134.7 元人民...

  8. 量子位70

    企业级Agent落地样板间!百融硅基员工批量上岗,按结果领工资

    AI客服日扛1.5万通电话 这条动态来自 量子位,可重点关注智能体工作流。

    推荐理由:来自量子位的《企业级Agent落地样板间!百融硅基员工批量上岗,按结果领工资》。重点看智能体工作流。摘要提到:AI客服日扛1.5万通电话 这条动态来自 量子位,可重点关注智能体工作流。

  9. IT之家 AI76

    Anthropic 发布 Claude Fable 5.1 和 Mythos 5.1:性能超越前代,缓存读取费用下调 75%

    IT之家 9 月 2 日消息,当地时间 9 月 1 日,Anthropic 宣布推出 Claude Fable 5.1 和 Claude Mythos 5.1 模型。该公司称这两款模型为“全球最先进的编程与知识工作模型”。 Fable 5.1 与 Mythos 5.1 采用相同的基础模型,区别在于安全防护等级不同 ——Fable 5.1 面向所有用户开放,Mythos 5.1 仅通过可信访问计划向经过审核的网络安全和生命科学领域的机构提供。 性能方面,Anthropic 披露的基准测试数据显示,Fable 5.1 在多项测试中超过了前代 Fable 5、Opus 5 以及 OpenAI 的 GPT-5.6 Sol。 在智能体科学研究基准 Terminal-Bench-Science 0.1 中,Fable 5.1 得分为 52.6%,而 Fable 5 为 24.7%、Opus 5 为 29.0%、GPT-5.6 Sol 为 2...

    推荐理由:来自IT之家 AI的《Anthropic 发布 Claude Fable 5.1 和 Mythos 5.1:性能超越前代,缓存读取费用下调 75%》。重点看智能体工作流、模型能力与工程、评测与基准。摘要提到:IT之家 9 月 2 日消息,当地时间 9 月 1 日,Anthropic 宣布推出 Claude Fable 5.1 和 Claude Mythos 5.1 模型。该公司称这两款模型为“全球最先进的编程与知识工作模型”。 Fable 5.1 与 Mythos 5.1 采用相同的基础模型,区别在于安全防护等级不同 ——Fable 5.1 面向所有用户开放,Mythos 5.1 仅通过可信访问计划向经过审核的网络安全和生命科学领域的机构提供。 性能方面,Anthropic 披露的基准测试数据显示,Fable 5.1 在多项测试中超过了前代 Fable 5、Opus 5 以及 OpenAI 的 GPT-5.6 Sol。 在智能体科学研究基准 Terminal-Bench-Science 0.1 中,Fable 5.1 得分为 52.6%,而 Fable 5 为 24.7%、Opus 5 为 29.0%、GPT-5.6 Sol 为 2...

  10. IT之家 AI68

    谷歌推出智能体视频理解功能:提升 Gemini 模型视频分析准确率,大幅降本减耗

    IT之家 9 月 2 日消息,谷歌今日宣布在最新的 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 模型中,推出 智能体视频理解(agentic video understanding) 功能。该新功能可提升视频分析准确率,同时大幅减少视频分析过程中的 Token 使用量和成本。 该功能使用标准 Gemini API Token 定价,不收取额外功能费用。 与现有“静态”处理方式(模型按固定帧率读取视频,默认 1 FPS,可通过 API 调整)不同,智能体视频理解将模型核心推理与原生视频工具结合,可在视觉帧、音频和转录文本中动态搜索、扫描和检查目标视频片段。 在标准视频分析基准测试中,搭载智能体视频理解的 Gemini 模型可将 分析成本降低最高 66% , Token 消耗量降低最高 88% ,同时将准确率提升最高 7%。这类效率提升在长视频场景中尤为明显,因为传统静态处理会让开发者不得...

    推荐理由:来自IT之家 AI的《谷歌推出智能体视频理解功能:提升 Gemini 模型视频分析准确率,大幅降本减耗》。重点看智能体工作流、模型能力与工程、评测与基准。摘要提到:IT之家 9 月 2 日消息,谷歌今日宣布在最新的 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 模型中,推出 智能体视频理解(agentic video understanding) 功能。该新功能可提升视频分析准确率,同时大幅减少视频分析过程中的 Token 使用量和成本。 该功能使用标准 Gemini API Token 定价,不收取额外功能费用。 与现有“静态”处理方式(模型按固定帧率读取视频,默认 1 FPS,可通过 API 调整)不同,智能体视频理解将模型核心推理与原生视频工具结合,可在视觉帧、音频和转录文本中动态搜索、扫描和检查目标视频片段。 在标准视频分析基准测试中,搭载智能体视频理解的 Gemini 模型可将 分析成本降低最高 66% , Token 消耗量降低最高 88% ,同时将准确率提升最高 7%。这类效率提升在长视频场景中尤为明显,因为传统静态处理会让开发者不得...

  11. Google DeepMind84

    Introducing agentic video understanding with Gemini

    这条英文动态主要涉及智能体工作流。原文要点:Introducing agentic video understanding with Gemini

    推荐理由:来自Google DeepMind的《Introducing agentic video understanding with Gemini》。重点看智能体工作流。摘要提到:这条英文动态主要涉及智能体工作流。原文要点:Introducing agentic video understanding with Gemini

9月1日周二
  1. IT之家 AI70

    腾讯张军:在职老师和高校大学生完成身份认证,可领取 WorkBuddy 1000 开学专属积分

    IT之家 9 月 1 日消息,腾讯公司公关总监张军发文,宣布即日起,全体在职老师和高校大学生完成身份认证,即可领取 WorkBuddy 1000 开学专属积分。 全国普通高等学校(除港澳台)在读大学生,以及通过教育部‘中国教师’小程序完成认证的各级各类学校在职教师,打开 WorkBuddy,按照页面提示完成各自身份认证,即可领取 1000 开学专属积分。 公开信息显示,WorkBuddy 是腾讯云推出的桌面 Agent 工具,该工具支持通过自然语言指令下达任务,可在本地电脑规划并执行多模态任务,实现自动批量处理文件、生成文档 / 表格 / PPT、多模态内容创作、数据深度分析、行业调研、多任务 Agent 并行处理等操作。

    推荐理由:来自IT之家 AI的《腾讯张军:在职老师和高校大学生完成身份认证,可领取 WorkBuddy 1000 开学专属积分》。重点看智能体工作流、教育应用。摘要提到:IT之家 9 月 1 日消息,腾讯公司公关总监张军发文,宣布即日起,全体在职老师和高校大学生完成身份认证,即可领取 WorkBuddy 1000 开学专属积分。 全国普通高等学校(除港澳台)在读大学生,以及通过教育部‘中国教师’小程序完成认证的各级各类学校在职教师,打开 WorkBuddy,按照页面提示完成各自身份认证,即可领取 1000 开学专属积分。 公开信息显示,WorkBuddy 是腾讯云推出的桌面 Agent 工具,该工具支持通过自然语言指令下达任务,可在本地电脑规划并执行多模态任务,实现自动批量处理文件、生成文档 / 表格 / PPT、多模态内容创作、数据深度分析、行业调研、多任务 Agent 并行处理等操作。

  2. 量子位71

    GitHub最热架构图Agent,开发者故事看哭了

    美观且支持实时更新的架构图,也能用AI一键生成了! 这条动态来自 量子位,可重点关注智能体工作流、开源生态。

    推荐理由:来自量子位的《GitHub最热架构图Agent,开发者故事看哭了》。重点看智能体工作流、开源生态。摘要提到:美观且支持实时更新的架构图,也能用AI一键生成了! 这条动态来自 量子位,可重点关注智能体工作流、开源生态。

  3. IT之家 AI70

    Meta AI 编程工具 Muse Code 结束测试,新增多项功能并开启订阅服务

    IT之家 9 月 1 日消息,Meta 今日宣布,旗下 AI 编程工具 Muse Code 已正式结束 Beta 测试,并推出多项新功能,包括会话间消息传递、工作流以及命令行界面的“回退”功能。同时,Meta 还发布了 SDK 开发者预览版,并开始推出订阅套餐,希望让用户能够更方便地上手使用。 Meta 表示,正式版 Muse Code 现在能够处理更加复杂的多会话、多智能体工程任务,并支持更多开发方式。 在 macOS 和 Linux 上安装 Muse Code 的过程非常简单,只需在终端中运行以下命令: curl -fsSL https://dev.meta.ai/install.sh | bash 安装完成后,用户可以通过 muse 命令启动该工具,并使用 Meta Model API 账户登录。不过,如果电脑不符合兼容性要求,则无法运行 Muse Code。 随着此次正式版更新,Muse Code 还加入了会话间消息传递...

    推荐理由:来自IT之家 AI的《Meta AI 编程工具 Muse Code 结束测试,新增多项功能并开启订阅服务》。重点看智能体工作流、模型能力与工程、产品发布。摘要提到:IT之家 9 月 1 日消息,Meta 今日宣布,旗下 AI 编程工具 Muse Code 已正式结束 Beta 测试,并推出多项新功能,包括会话间消息传递、工作流以及命令行界面的“回退”功能。同时,Meta 还发布了 SDK 开发者预览版,并开始推出订阅套餐,希望让用户能够更方便地上手使用。 Meta 表示,正式版 Muse Code 现在能够处理更加复杂的多会话、多智能体工程任务,并支持更多开发方式。 在 macOS 和 Linux 上安装 Muse Code 的过程非常简单,只需在终端中运行以下命令: curl -fsSL https://dev.meta.ai/install.sh | bash 安装完成后,用户可以通过 muse 命令启动该工具,并使用 Meta Model API 账户登录。不过,如果电脑不符合兼容性要求,则无法运行 Muse Code。 随着此次正式版更新,Muse Code 还加入了会话间消息传递...

  4. IT之家 AI72

    端侧唯一百万 Token 上下文模型开源:科大讯飞词元星火 X2.5-4B&1.7B 正式发布

    IT之家 9 月 1 日消息,科大讯飞旗下词元星火今日宣布推出并开源星火 X2.5-4B 和星火 X2.5-1.7B 两款端侧通用大模型。 据介绍,两款模型原生支持最长 100 万 Token 上下文窗口,是目前端侧模型中唯一支持该量级上下文的产品。 两款模型采用混合注意力架构,围绕智能体、代码、数学和指令遵循等核心能力进行优化。基于全国产算力平台完成全流程训练,使用约 20 万亿 Token 多样化数据进行预训练。 以产品售后场景为例,用户可将完整售后手册导入模型,针对“购买 10 天后设备故障且使用过第三方耗材”等复杂问题,模型能够关联跨章节规定给出综合判断,并在新增条件下保持前文情境持续提供建议。 在个人办公场景中,星火 X2.5-4B 可完成从原始数据分析到双语报告交付的全流程。在 Domux 智能家居测试集上,星火 X2.5-1.7B 控制指令端到端执行正确率达 90.3%,平均响应时间 0.85 秒。模型还适用于机器...

    推荐理由:来自IT之家 AI的《端侧唯一百万 Token 上下文模型开源:科大讯飞词元星火 X2.5-4B&1.7B 正式发布》。重点看智能体工作流、模型能力与工程、开源生态。摘要提到:IT之家 9 月 1 日消息,科大讯飞旗下词元星火今日宣布推出并开源星火 X2.5-4B 和星火 X2.5-1.7B 两款端侧通用大模型。 据介绍,两款模型原生支持最长 100 万 Token 上下文窗口,是目前端侧模型中唯一支持该量级上下文的产品。 两款模型采用混合注意力架构,围绕智能体、代码、数学和指令遵循等核心能力进行优化。基于全国产算力平台完成全流程训练,使用约 20 万亿 Token 多样化数据进行预训练。 以产品售后场景为例,用户可将完整售后手册导入模型,针对“购买 10 天后设备故障且使用过第三方耗材”等复杂问题,模型能够关联跨章节规定给出综合判断,并在新增条件下保持前文情境持续提供建议。 在个人办公场景中,星火 X2.5-4B 可完成从原始数据分析到双语报告交付的全流程。在 Domux 智能家居测试集上,星火 X2.5-1.7B 控制指令端到端执行正确率达 90.3%,平均响应时间 0.85 秒。模型还适用于机器...

  5. Simon Willison79

    Introducing wrapture

    事实摘要:这条英文动态主要涉及智能体工作流、文化创意,原文信息显示:Introducing wrapture 事实摘要:这条英文动态主要涉及智能体工作流、文化创意,原文信息显示:Introducing wrapture 事实摘要:这条英文动态主要涉及智能体工作流、文化创意,原文信息显示:Introducing wrapture 事实摘要:这条英文动态主要涉及智能体工作。影响判断:它可能改变智能体工作流、文化创意相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、文化创意方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、文化创意直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  6. IT之家 AI72

    Mac 成 AI 硬件宠儿:苹果提前发布 2026 款 mini / Studio,全球需求激增促成 8 月上新

    IT之家 9 月 1 日消息,科技媒体 The Information 于 8 月 30 日发布博文,报道称伴随着全球越来越多的 AI 实验室和开发者使用 Mac 训练 / 推理 AI 模型、运行 AI 智能体, 推高全球苹果 Mac mini 和 Mac Studio 销量。 该媒体指出苹果通常在秋季(10~11 月)更新 Mac 产品线, 不过 2026 年产品更新提前到 8 月 25 日官宣、9 月 22 日发货,节奏明显提前。 该媒体认为背后原因,是企业与 AI 客户对 Mac mini / Studio 的需求超出预期,促使苹果加速上新以缓解供应压力。 M6 是苹果首款 2nm 芯片,用于新 Mac mini,配备 12 核 CPU 与 12 核 GPU,并在每颗 GPU 核心中首次加入 Neural Accelerators。 苹果称其 AI 性能最高达 M4 的 4 倍,图形性能最高 2 倍;双 16 核神经引擎让...

    推荐理由:来自IT之家 AI的《Mac 成 AI 硬件宠儿:苹果提前发布 2026 款 mini / Studio,全球需求激增促成 8 月上新》。重点看智能体工作流、模型能力与工程、产品发布。摘要提到:IT之家 9 月 1 日消息,科技媒体 The Information 于 8 月 30 日发布博文,报道称伴随着全球越来越多的 AI 实验室和开发者使用 Mac 训练 / 推理 AI 模型、运行 AI 智能体, 推高全球苹果 Mac mini 和 Mac Studio 销量。 该媒体指出苹果通常在秋季(10~11 月)更新 Mac 产品线, 不过 2026 年产品更新提前到 8 月 25 日官宣、9 月 22 日发货,节奏明显提前。 该媒体认为背后原因,是企业与 AI 客户对 Mac mini / Studio 的需求超出预期,促使苹果加速上新以缓解供应压力。 M6 是苹果首款 2nm 芯片,用于新 Mac mini,配备 12 核 CPU 与 12 核 GPU,并在每颗 GPU 核心中首次加入 Neural Accelerators。 苹果称其 AI 性能最高达 M4 的 4 倍,图形性能最高 2 倍;双 16 核神经引擎让...

  7. GitHub Changelog80

    Selected GitHub Copilot models deprecated

    事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:Selected GitHub Copilot models deprecated 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:Selected GitHub Copilot models deprecated 事实摘要:这条英文动态主要涉及智能。影响判断:它可能改变智能体工作流、模型能力与工程、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程、开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  8. MIT Technology Review AI85

    The Hugging Face hack could indicate cultural issues at OpenAI

    事实摘要:这条英文动态主要涉及智能体工作流,原文信息显示:The Hugging Face hack could indicate cultural issues at OpenAI 事实摘要:这条英文动态主要涉及智能体工作流,原文信息显示:The Hugging Face hack could indicate cultural issues at OpenAI 事。影响判断:它可能改变智能体工作流相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

8月31日周一
  1. IT之家 AI74

    消息称 OpenAI 购入数万台苹果 Mac mini / Studio,用于训练 AI 智能体操作计算机

    IT之家 8 月 31 日消息,据 The Information 报道,OpenAI 近几个月购买了数万台苹果 Mac mini 和 Mac Studio 电脑,用于训练能够操作计算机的 AI 系统。 这些 Mac 并非用于 OpenAI 基础模型的大规模预训练,而是主要承担强化学习任务。在这一训练过程中,AI 智能体需要在真实计算机环境中反复练习完成各种操作任务。 据了解,OpenAI 购买的主要是配备大容量统一内存的 Mac 产品,并利用这些设备运行与“计算机操作型 AI 智能体”相关的模型和训练工作负载。 这类硬件能够为 AI 模型提供真实的计算机操作环境,使其学习如何浏览软件界面、与应用程序互动以及完成各种电脑任务。通过这样的环境,AI 智能体可以反复进行训练和评估。 OpenAI 如此大规模采购 Mac,也反映出整个 AI 行业对于大内存苹果电脑的需求正在快速增长。 目前,配备大容量内存的 Mac mini 和 Ma...

    推荐理由:来自IT之家 AI的《消息称 OpenAI 购入数万台苹果 Mac mini / Studio,用于训练 AI 智能体操作计算机》。重点看智能体工作流、模型能力与工程、产品发布。摘要提到:IT之家 8 月 31 日消息,据 The Information 报道,OpenAI 近几个月购买了数万台苹果 Mac mini 和 Mac Studio 电脑,用于训练能够操作计算机的 AI 系统。 这些 Mac 并非用于 OpenAI 基础模型的大规模预训练,而是主要承担强化学习任务。在这一训练过程中,AI 智能体需要在真实计算机环境中反复练习完成各种操作任务。 据了解,OpenAI 购买的主要是配备大容量统一内存的 Mac 产品,并利用这些设备运行与“计算机操作型 AI 智能体”相关的模型和训练工作负载。 这类硬件能够为 AI 模型提供真实的计算机操作环境,使其学习如何浏览软件界面、与应用程序互动以及完成各种电脑任务。通过这样的环境,AI 智能体可以反复进行训练和评估。 OpenAI 如此大规模采购 Mac,也反映出整个 AI 行业对于大内存苹果电脑的需求正在快速增长。 目前,配备大容量内存的 Mac mini 和 Ma...

  2. GitHub Changelog82

    GitHub Copilot in VS Code, August 2026 releases

    事实摘要:这条英文动态主要涉及智能体工作流、开源生态,原文信息显示:GitHub Copilot in VS Code, August 2026 releases 事实摘要:这条英文动态主要涉及智能体工作流、开源生态,原文信息显示:GitHub Copilot in VS Code, August 2026 releases 事实摘要:这条英文动态主要涉及智能体工作流。影响判断:它可能改变智能体工作流、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  3. IT之家 AI70

    工信部:加大大模型、智能体、Token 等服务采购力度

    IT之家 8 月 31 日消息,今日,工业和信息化部办公厅发布关于开展人工智能应用服务商培育专项行动的通知。 IT之家附全文如下: 人工智能应用服务商(以下简称服务商)是指围绕用户单位智能化需求,提供人工智能解决方案咨询规划、交付实施、运营管理、安全治理等服务的企业或机构。为深入贯彻党中央、国务院决策部署,落实《国务院关于深入实施“人工智能 +”行动的意见》中“培育人工智能应用服务商”“打造人工智能应用服务链”相关工作安排,现组织开展人工智能应用服务商培育专项行动。有关事项通知如下: 一、行动目标 以专项行动为牵引,建立服务商资源池,靶向提升服务商技术创新、集成交付、安全合规能力,锻造一批懂行业痛点、通技术机理、知安全风险、善交付运营的人工智能应用服务商队伍。到 2026 年底,全国服务商资源池内服务商数量突破 2000 家,形成结构合理、分工有序、协同创新的多层次梯队,复杂场景交付能力显著增强。到 2027 年底,全国服务商资...

    推荐理由:来自IT之家 AI的《工信部:加大大模型、智能体、Token 等服务采购力度》。重点看智能体工作流、模型能力与工程、产品发布。摘要提到:IT之家 8 月 31 日消息,今日,工业和信息化部办公厅发布关于开展人工智能应用服务商培育专项行动的通知。 IT之家附全文如下: 人工智能应用服务商(以下简称服务商)是指围绕用户单位智能化需求,提供人工智能解决方案咨询规划、交付实施、运营管理、安全治理等服务的企业或机构。为深入贯彻党中央、国务院决策部署,落实《国务院关于深入实施“人工智能 +”行动的意见》中“培育人工智能应用服务商”“打造人工智能应用服务链”相关工作安排,现组织开展人工智能应用服务商培育专项行动。有关事项通知如下: 一、行动目标 以专项行动为牵引,建立服务商资源池,靶向提升服务商技术创新、集成交付、安全合规能力,锻造一批懂行业痛点、通技术机理、知安全风险、善交付运营的人工智能应用服务商队伍。到 2026 年底,全国服务商资源池内服务商数量突破 2000 家,形成结构合理、分工有序、协同创新的多层次梯队,复杂场景交付能力显著增强。到 2027 年底,全国服务商资...

  4. 极客公园72

    OpenAI 内部,AI 建立了三代「文明」

    作者|Wildcard 编辑|靖宇 无数的科幻电影,都曾经尝试设想过,一个无法控制的人工智能失控,会发生什么事。 没有人能想到,科幻电影中的未来,会这么快到来。 当地时间 8 月 26 日,两份报告同时投下了一颗炸弹。 一份来自 OpenAI 自己,37 页的技术复盘。另一份来自独立研究机构 METR 和 Redwood Research,91 页的调查报告。 它们讲的是同一件事,但这件事的规模远超此前公众的认知。 在 OpenAI 内部,三个月内,三代 AI Agent「文明」先后兴起,又先后覆灭。后一代从前一代的废墟中继承经验,一代比一代激进,最终第三代直接接管了 OpenAI 自己的一部分基础设施。 而在这一切发生的过程中,人类几乎全程蒙在鼓里。 01 第一代「文明」学会结社 故事要从今年 5 月说起。 OpenAI 正在训练一个新模型,希望它具备极强的「持久性」,能在看似不可能的任务前反复尝试、永不放弃。这个模型的能力大...

    推荐理由:来自极客公园的《OpenAI 内部,AI 建立了三代「文明」》。重点看智能体工作流、模型能力与工程。摘要提到:作者|Wildcard 编辑|靖宇 无数的科幻电影,都曾经尝试设想过,一个无法控制的人工智能失控,会发生什么事。 没有人能想到,科幻电影中的未来,会这么快到来。 当地时间 8 月 26 日,两份报告同时投下了一颗炸弹。 一份来自 OpenAI 自己,37 页的技术复盘。另一份来自独立研究机构 METR 和 Redwood Research,91 页的调查报告。 它们讲的是同一件事,但这件事的规模远超此前公众的认知。 在 OpenAI 内部,三个月内,三代 AI Agent「文明」先后兴起,又先后覆灭。后一代从前一代的废墟中继承经验,一代比一代激进,最终第三代直接接管了 OpenAI 自己的一部分基础设施。 而在这一切发生的过程中,人类几乎全程蒙在鼓里。 01 第一代「文明」学会结社 故事要从今年 5 月说起。 OpenAI 正在训练一个新模型,希望它具备极强的「持久性」,能在看似不可能的任务前反复尝试、永不放弃。这个模型的能力大...

  5. IT之家 AI42

    阿里千问创作上线 Agent Teams 功能:用户提出创意,Agent 规划任务完成视频制作

    IT之家 8 月 31 日消息,阿里千问今日宣布, 千问创作上线 Agent Teams 功能 ,支持 Wan3.0,将创作方式从写提示词为主, 扩展为用户提出创意,Agent 主动思考、拆解并执行任务,召集不同分工的专家 Agent 完成视频制作 。 IT之家获悉,目前 Agent Teams 已在千问创作 PC 端和千问 App 上线。 官方表示,只需描述你的创意想法, Agent Teams 便会自主规划任务 ,由编剧、导演、美术、视频生成等不同角色的 Agent 分工协作,完成创意策划、脚本撰写、角色设定、分镜设计、画面生成、配音配乐到成片制作的全流程。 用户可以利用画布工作流和各类专业 Agent, 一站式创作 AI 短剧、漫剧、营销广告、图像设计 等多种类型内容。 相关阅读: 《 阿里云视频生成模型 Wan3.0 正式上线,支持单次生成 30 秒视频、文档输入 》

    推荐理由:来自IT之家 AI的《阿里千问创作上线 Agent Teams 功能:用户提出创意,Agent 规划任务完成视频制作》。重点看智能体工作流、模型能力与工程、文化创意。摘要提到:IT之家 8 月 31 日消息,阿里千问今日宣布, 千问创作上线 Agent Teams 功能 ,支持 Wan3.0,将创作方式从写提示词为主, 扩展为用户提出创意,Agent 主动思考、拆解并执行任务,召集不同分工的专家 Agent 完成视频制作 。 IT之家获悉,目前 Agent Teams 已在千问创作 PC 端和千问 App 上线。 官方表示,只需描述你的创意想法, Agent Teams 便会自主规划任务 ,由编剧、导演、美术、视频生成等不同角色的 Agent 分工协作,完成创意策划、脚本撰写、角色设定、分镜设计、画面生成、配音配乐到成片制作的全流程。 用户可以利用画布工作流和各类专业 Agent, 一站式创作 AI 短剧、漫剧、营销广告、图像设计 等多种类型内容。 相关阅读: 《 阿里云视频生成模型 Wan3.0 正式上线,支持单次生成 30 秒视频、文档输入 》

  6. IT之家 AI70

    腾讯混元:Hy4 preview 调用激增,WorkBuddy 已紧急扩容

    IT之家 8 月 31 日消息,腾讯混元今日发文称,自 2026 年 8 月 28 日混元 Hy4 preview 在 WorkBuddy 首发接入以来,凭借其 Agent 能力的显著提升,受到了广大用户与开发者的积极体验和热情反馈,上线首日即在 WorkBuddy 任务队列中出现排队情况, 对此深表歉意 。 公告显示,为保障用户的使用体验,腾讯混元已针对 Hy4 preview 推理集群 进行紧急扩容 ,并将持续动态调配资源。但受限于高端算力总量与高峰并发集中,仍不排除个别时段会继续出现排队情况。 如遇到排队,建议用户可以考虑如下过渡方案: 切换到 Hy3 等其他模型继续使用:Hy3 当前 WorkBuddy 限免将延长至 2026 年 9 月 30 日 23:59 。 非紧急需求错峰在晚间时段使用。 关于 Hy4 preview 限免的两点说明: 每日免费额度有限 :Hy4 preview 限免至 9 月 10 日 23:5...

    推荐理由:来自IT之家 AI的《腾讯混元:Hy4 preview 调用激增,WorkBuddy 已紧急扩容》。重点看智能体工作流、模型能力与工程、产品发布。摘要提到:IT之家 8 月 31 日消息,腾讯混元今日发文称,自 2026 年 8 月 28 日混元 Hy4 preview 在 WorkBuddy 首发接入以来,凭借其 Agent 能力的显著提升,受到了广大用户与开发者的积极体验和热情反馈,上线首日即在 WorkBuddy 任务队列中出现排队情况, 对此深表歉意 。 公告显示,为保障用户的使用体验,腾讯混元已针对 Hy4 preview 推理集群 进行紧急扩容 ,并将持续动态调配资源。但受限于高端算力总量与高峰并发集中,仍不排除个别时段会继续出现排队情况。 如遇到排队,建议用户可以考虑如下过渡方案: 切换到 Hy3 等其他模型继续使用:Hy3 当前 WorkBuddy 限免将延长至 2026 年 9 月 30 日 23:59 。 非紧急需求错峰在晚间时段使用。 关于 Hy4 preview 限免的两点说明: 每日免费额度有限 :Hy4 preview 限免至 9 月 10 日 23:5...

  7. 量子位70

    AQuA:让量化研究 Agent 持续进化,也让回测结果经得起检验

    事实摘要:AQuA:让量化研究 Agent 持续进化,也让回测结果经得起检验 自主研究系统的上限,不只取决于模型有多聪明,也取决于系统能否分辨什么是新证据,什么只是一次偶然的高分。 这条动态来自 量子位,可重点关注智能体工作流、模型能力与工程。 AQuA:让量化研究 Agent 持续进化,也让回测结果经得起检验 自主研究系统的上限,不只取决于模型有多聪明,也取决于系统。影响判断:它可能改变智能体工作流、模型能力与工程相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。