跳到正文
9月23日周三
  1. 量子位70

    DeepSeek新论文公开Agent训练!梁文锋署名

    事实摘要:DeepSeek新论文公开Agent训练!。影响判断:发布了一篇关于Agent(代理)训练的新论文,展示了在每秒产生50,000+个沙盒的能力。场景价值:智能体工作流、模型能力与工程。

    推荐理由:这篇文章为读者提供了一个关于Agent训练的视角,强调了其高效性和灵活性。

  2. IT之家 AI68

    Meta 测试真人代 Muse 拨打电话,引发内部隐私争议

    IT之家 9 月 23 日消息,据路透社看到的 Meta 公司内部帖子显示,Meta 一直在为其新推出的个人 AI 助手 Muse 测试一项“人工礼宾”服务,即由人类承包商在后台悄悄处理部分通过该数字助手拨出的电话。 这家 Facebook 和 Instagram 的母公司上周向员工披露了这一测试,时间就在该公司公开推出 Muse 电话呼叫功能后不久。 自发布两周以来,Muse 一直位居美国应用下载排行榜榜首。该智能体旨在自主完成代发邮件、购物和预订旅行等任务。 借助电话呼叫功能,用户可以指示 Muse 拨打美国商家的电话,并与接听者交谈,办理预约理发、询问门店是否有现货,或向不同承包商询价等事务。 这些内部帖子显示,一些员工对由人工处理这些电话提出了隐私担忧,警告称这种做法可能导致敏感信息被无意中分享给呼叫中心的承包商。 “令我费解的是,我们为什么会认为这项功能值得冒这样的风险,”一名员工在内部帖子中写道。“我们距离不必要的信...

    推荐理由:来自IT之家 AI的《Meta 测试真人代 Muse 拨打电话,引发内部隐私争议》。重点看智能体工作流、产品发布。摘要提到:IT之家 9 月 23 日消息,据路透社看到的 Meta 公司内部帖子显示,Meta 一直在为其新推出的个人 AI 助手 Muse 测试一项“人工礼宾”服务,即由人类承包商在后台悄悄处理部分通过该数字助手拨出的电话。 这家 Facebook 和 Instagram 的母公司上周向员工披露了这一测试,时间就在该公司公开推出 Muse 电话呼叫功能后不久。 自发布两周以来,Muse 一直位居美国应用下载排行榜榜首。该智能体旨在自主完成代发邮件、购物和预订旅行等任务。 借助电话呼叫功能,用户可以指示 Muse 拨打美国商家的电话,并与接听者交谈,办理预约理发、询问门店是否有现货,或向不同承包商询价等事务。 这些内部帖子显示,一些员工对由人工处理这些电话提出了隐私担忧,警告称这种做法可能导致敏感信息被无意中分享给呼叫中心的承包商。 “令我费解的是,我们为什么会认为这项功能值得冒这样的风险,”一名员工在内部帖子中写道。“我们距离不必要的信...

  3. IT之家 AI68

    大力投入 AI 未必真能省钱,麦肯锡报告称智能体或让企业面临更高成本

    IT之家 9 月 23 日消息,据《商业内幕》今天(23 日)上午报道,麦肯锡提醒企业,随着智能体越来越普及, AI 支出可能进一步增加 。 与文本类 AI 工具相比,智能体需要实际完成任务,或将带来高得多的运行成本。这类任务往往包含多个步骤,同一目标有不同的实现方式,成本也可能相差悬殊。麦肯锡的一项研究发现,不同智能体完成任务的成本差距 最高可达 30 倍 。 IT之家从报道中获悉,麦肯锡的《2026 年 AI 现状》调查显示,约三分之一的组织把超过 10% 的技术与通信预算投入 AI;60% 的受访者计划明年增加 AI 支出;约五分之一的受访者称, AI 支出开始给运营成本带来压力 。 麦肯锡高级合伙人、麦肯锡全球研究院院长唐吉 · 卡特林指出:“所以,AI 支出的规模开始变得相当可观,也越来越明显。” 麦肯锡表示,使用智能体自动编程的软件开发团队尤其面临成本压力,自动编程显然要消耗大量 token。 麦肯锡发出警告前,企业...

    推荐理由:来自IT之家 AI的《大力投入 AI 未必真能省钱,麦肯锡报告称智能体或让企业面临更高成本》。重点看智能体工作流。摘要提到:IT之家 9 月 23 日消息,据《商业内幕》今天(23 日)上午报道,麦肯锡提醒企业,随着智能体越来越普及, AI 支出可能进一步增加 。 与文本类 AI 工具相比,智能体需要实际完成任务,或将带来高得多的运行成本。这类任务往往包含多个步骤,同一目标有不同的实现方式,成本也可能相差悬殊。麦肯锡的一项研究发现,不同智能体完成任务的成本差距 最高可达 30 倍 。 IT之家从报道中获悉,麦肯锡的《2026 年 AI 现状》调查显示,约三分之一的组织把超过 10% 的技术与通信预算投入 AI;60% 的受访者计划明年增加 AI 支出;约五分之一的受访者称, AI 支出开始给运营成本带来压力 。 麦肯锡高级合伙人、麦肯锡全球研究院院长唐吉 · 卡特林指出:“所以,AI 支出的规模开始变得相当可观,也越来越明显。” 麦肯锡表示,使用智能体自动编程的软件开发团队尤其面临成本压力,自动编程显然要消耗大量 token。 麦肯锡发出警告前,企业...

  4. 极客公园76

    从单卡到千卡互联,平头哥真武 V900 背后的 AI 算力变局

    作者|Cynthia 编辑|郑玄 9 月 22 日的 2026 杭州云栖大会,平头哥少见地被完整推到了主论坛台前。 当天上午,吴泳铭完成主旨演讲后,千问大模型、多模态模型负责人依次登场,随后就是平头哥副总裁高慧。她的演讲题目是「Agentic 时代卓越算力基石」。 平头哥带来的产品,则从一颗最新得真武 V900 芯片,一直延伸到 ICN Switch 互联芯片、磐脉智能网卡、镇岳 SSD 主控、倚天 CPU 路线图,以及下一步的算、存、网全栈协同的超节点服务器。 发布「产品全家桶」地背后,是 Agentic 时代的负载变化:算力需求已经从训练为主进一步走向推理增长,应用从单轮请求变成连续的多步任务, 硬件的竞争也从一颗芯片的指标扩展到整个计算系统的协同。 01 真武V900,平头哥最新一代AI训推芯片 这次发布里,平头哥新一代训推一体 AI 芯片真武 V900 仍然是分量最重的产品。 这颗芯片搭载 216GB 显存,片间互联带宽...

    推荐理由:来自极客公园的《从单卡到千卡互联,平头哥真武 V900 背后的 AI 算力变局》。重点看智能体工作流、模型能力与工程、产品发布。摘要提到:作者|Cynthia 编辑|郑玄 9 月 22 日的 2026 杭州云栖大会,平头哥少见地被完整推到了主论坛台前。 当天上午,吴泳铭完成主旨演讲后,千问大模型、多模态模型负责人依次登场,随后就是平头哥副总裁高慧。她的演讲题目是「Agentic 时代卓越算力基石」。 平头哥带来的产品,则从一颗最新得真武 V900 芯片,一直延伸到 ICN Switch 互联芯片、磐脉智能网卡、镇岳 SSD 主控、倚天 CPU 路线图,以及下一步的算、存、网全栈协同的超节点服务器。 发布「产品全家桶」地背后,是 Agentic 时代的负载变化:算力需求已经从训练为主进一步走向推理增长,应用从单轮请求变成连续的多步任务, 硬件的竞争也从一颗芯片的指标扩展到整个计算系统的协同。 01 真武V900,平头哥最新一代AI训推芯片 这次发布里,平头哥新一代训推一体 AI 芯片真武 V900 仍然是分量最重的产品。 这颗芯片搭载 216GB 显存,片间互联带宽...

  5. 量子位72

    阿里千问AI平台全面升级模型服务、Agent服务、AI应用

    事实摘要:阿里千问AI平台全面升级模型服务、Agent服务、AI应用 覆盖MaaS、Agent服务、行业AI解决方案 这条动态来自 量子位,可重点关注智能体工作流、模型能力与工程。 阿里千问AI平台全面升级模型服务、Agent服务、AI应用 覆盖MaaS、Agent服务、行业AI解决方案。影响判断:它可能改变智能体工作流、模型能力与工程相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  6. Simon Willison81

    SF October 14th: A Birds of a Feather Session on Agentic Engineering

    这条英文动态主要涉及智能体工作流。原文要点:SF October 14th: A Birds of a Feather Session on Agentic Engineering I'm hosting an evening event with Jesse Vincent in San Francisco on Wednesday 14th October for people who are building weird and interesting things with and on top of coding agents. Think of it as an agentic show-and-tell: ​Compare notes with other builders and experimenters on things you’re trying, what you're learning, and what you haven’t figured...

    推荐理由:来自Simon Willison的《SF October 14th: A Birds of a Feather Session on Agentic Engineering》。重点看智能体工作流。摘要提到:这条英文动态主要涉及智能体工作流。原文要点:SF October 14th: A Birds of a Feather Session on Agentic Engineering I'm hosting an evening event with Jesse Vincent in San Francisco on Wednesday 14th October for people who are building weird and interesting things with and on top of coding agents. Think of it as an agentic show-and-tell: ​Compare notes with other builders and experimenters on things you’re trying, what you're learning, and wh...

  7. GitHub Changelog90

    OpenTelemetry in the GitHub Copilot app

    事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:OpenTelemetry in the GitHub Copilot app 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:OpenTelemetry in the GitHub Copilot app 事实摘要:这条英文动态主要涉及智能体工作流。影响判断:它可能改变智能体工作流、模型能力与工程、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程、开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  8. GitHub Changelog88

    New features and improvements in Copilot for JetBrains

    事实摘要:这条英文动态主要涉及智能体工作流、开源生态,原文信息显示:New features and improvements in Copilot for JetBrains 事实摘要:这条英文动态主要涉及智能体工作流、开源生态,原文信息显示:New features and improvements in Copilot for JetBrains 事实摘要:这条。影响判断:它可能改变智能体工作流、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  9. IT之家 AI72

    预填充吞吐超 330 Token/s:高通携手阶跃等为第六代骁龙 8 超级至尊版端侧适配 300 亿参数 AI 模型

    IT之家 9 月 23 日消息,夏威夷时间 9 月 22 日 9 点(北京时间 9 月 23 日 3 点)召开的 2026 骁龙峰会上,高通宣布携手阶跃、无量火及江波龙,基于第六代骁龙 8 超级至尊版移动平台, 端侧适配与推理优化阶跃 StepEdge-Omni 30B-MoE 模型,并现场演示相关智能体助手。 该模型拥有 300 亿参数,依托混合专家架构,仅根据任务需要激活部分专家模块,以降低计算量和内存带宽需求。 合作方通过推理引擎、异构调度及存储方案优化,让模型运行内存需求较行业常规方案降低超过 50%,并支持在智能手机上稳定运行。 高通表示,该方案无需调用云端服务,可以在本地完成邮件理解、行程规划、日历同步、航班及酒店推荐、行程分享和邮件草拟等任务。 测试数据显示,模型预填充吞吐性能超过每秒 330 个 Token,解码吞吐性能超过每秒 28 个 Token。 IT之家注:“模型预填充吞吐性能是指大语言模型在推理的预填充...

    推荐理由:来自IT之家 AI的《预填充吞吐超 330 Token/s:高通携手阶跃等为第六代骁龙 8 超级至尊版端侧适配 300 亿参数 AI 模型》。重点看智能体工作流、模型能力与工程。摘要提到:IT之家 9 月 23 日消息,夏威夷时间 9 月 22 日 9 点(北京时间 9 月 23 日 3 点)召开的 2026 骁龙峰会上,高通宣布携手阶跃、无量火及江波龙,基于第六代骁龙 8 超级至尊版移动平台, 端侧适配与推理优化阶跃 StepEdge-Omni 30B-MoE 模型,并现场演示相关智能体助手。 该模型拥有 300 亿参数,依托混合专家架构,仅根据任务需要激活部分专家模块,以降低计算量和内存带宽需求。 合作方通过推理引擎、异构调度及存储方案优化,让模型运行内存需求较行业常规方案降低超过 50%,并支持在智能手机上稳定运行。 高通表示,该方案无需调用云端服务,可以在本地完成邮件理解、行程规划、日历同步、航班及酒店推荐、行程分享和邮件草拟等任务。 测试数据显示,模型预填充吞吐性能超过每秒 330 个 Token,解码吞吐性能超过每秒 28 个 Token。 IT之家注:“模型预填充吞吐性能是指大语言模型在推理的预填充...

  10. GitHub Changelog96

    Claude Opus 5.5 is now available in GitHub Copilot

    事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:Claude Opus 5.5 is now available in GitHub Copilot 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:Claude Opus 5.5 is now available in GitHub Copilot。影响判断:它可能改变智能体工作流、模型能力与工程、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程、开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

9月22日周二
  1. OpenAI News82

    Parallel cut research time and cost in half with GPT‑6 Astra

    这条英文动态主要涉及智能体工作流、模型能力与工程。原文要点:GPT‑6 Astra allowed Parallel’s agents to research and synthesize labor-market data in half the time and at half the cost vs. prior models.

    推荐理由:来自OpenAI News的《Parallel cut research time and cost in half with GPT‑6 Astra》。重点看智能体工作流、模型能力与工程。摘要提到:这条英文动态主要涉及智能体工作流、模型能力与工程。原文要点:GPT‑6 Astra allowed Parallel’s agents to research and synthesize labor-market data in half the time and at half the cost vs. prior models.

  2. IT之家 AI72

    美银等多家银行警告:“AI 代购”或增加诈骗、欺诈和数据隐私泄露风险

    IT之家 9 月 22 日消息,据路透社今天(22 日)傍晚报道,国民西敏银行、美国银行等多家银行警告,让 AI 智能体代替消费者进行网上购物,可能增加诈骗、欺诈和数据隐私泄露的风险。 OpenAI、Anthropic、谷歌和 Meta 等科技企业正大力把 AI 聊天机器人推向购物场景,希望未来消费者可以 让 AI 智能体挑选商品并直接代为下单 ,零售商则开始争相影响聊天机器人的商品推荐。 英国零售商约翰 · 刘易斯百货 9 月称,来自 AI 智能体的搜索占比 从一年前的 0.3% 升至 2.5% ,而且增速还在加快。 参与报告的银行还包括 ING、新西兰 ASB 银行和美国第一资本金融。多家银行指出,消费者对 AI 智能体购物兴趣浓厚,也希望使用这类服务,但技术发展速度 超过了行业标准和消费者保护机制的完善速度 。 报告指出:消费者并不清楚 AI 是否真的会从他们的利益出发。他们担心 AI 智能体可能买错商品、花费过多,甚至因...

    推荐理由:来自IT之家 AI的《美银等多家银行警告:“AI 代购”或增加诈骗、欺诈和数据隐私泄露风险》。重点看智能体工作流。摘要提到:IT之家 9 月 22 日消息,据路透社今天(22 日)傍晚报道,国民西敏银行、美国银行等多家银行警告,让 AI 智能体代替消费者进行网上购物,可能增加诈骗、欺诈和数据隐私泄露的风险。 OpenAI、Anthropic、谷歌和 Meta 等科技企业正大力把 AI 聊天机器人推向购物场景,希望未来消费者可以 让 AI 智能体挑选商品并直接代为下单 ,零售商则开始争相影响聊天机器人的商品推荐。 英国零售商约翰 · 刘易斯百货 9 月称,来自 AI 智能体的搜索占比 从一年前的 0.3% 升至 2.5% ,而且增速还在加快。 参与报告的银行还包括 ING、新西兰 ASB 银行和美国第一资本金融。多家银行指出,消费者对 AI 智能体购物兴趣浓厚,也希望使用这类服务,但技术发展速度 超过了行业标准和消费者保护机制的完善速度 。 报告指出:消费者并不清楚 AI 是否真的会从他们的利益出发。他们担心 AI 智能体可能买错商品、花费过多,甚至因...

  3. 量子位70

    基元律动韩凯:从多模型调度到反馈闭环,探索Agent持续进化

    事实摘要:基元律动韩凯:从多模型调度到反馈闭环,探索Agent持续进化 9月22日,在2026杭州云栖大会企业级Agent实践峰会上,基元律动联合创始人兼CTO韩凯发表演讲《从Harness到RSI飞轮》。 这条动态来自 量子位,可重点关注智能体工作流、模型能力与工程。 基元律动韩凯:从多模型调度到反馈闭环,探索Agent持续进化 9月22日,在2026杭州云栖大会企。影响判断:它可能改变智能体工作流、模型能力与工程相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  4. 爱范儿68

    千问办公押注的企业上下文,是 Agent 时代的组织语言

    给 Agent 一张组织里的工牌 #欢迎关注爱范儿官方微信公众号:爱范儿(微信号:ifanr),更多精彩内容第一时间为您奉上。 这条动态来自 爱范儿,可重点关注智能体工作流。

    推荐理由:来自爱范儿的《千问办公押注的企业上下文,是 Agent 时代的组织语言》。重点看智能体工作流。摘要提到:给 Agent 一张组织里的工牌 #欢迎关注爱范儿官方微信公众号:爱范儿(微信号:ifanr),更多精彩内容第一时间为您奉上。 这条动态来自 爱范儿,可重点关注智能体工作流。

  5. IT之家 AI38

    阿里千问办公发布企业上下文、数字员工及 Agent 硬件 QwenNote A2

    IT之家 9 月 22 日消息,在今天举行的 2026 云栖大会千问办公专场上,阿里千问办公(QwenWork)围绕企业级 Agent 发布了一系列产品与能力升级,主题指向“让企业级 Agent 懂业务、能协同、信得过”。 企业上下文:让企业私有知识与千问办公无缝打通 IT之家注意到,千问办公此次发布了面向企业的全新产品“企业上下文”(Enterprise Context)。其逻辑是:Agent 进入企业业务流程,最重要的前提是理解企业数据,但员工开始一项具体任务时,需要的往往不是全部信息,而是与当前任务最相关的那部分。企业上下文会对分散在文档、沟通和业务系统中的企业信息进行压缩与结构化,并随业务变化及时更新,让 Agent 每次都能基于企业最新真实情况作判断。官方还强调,该产品内置专属模型,可用极低的 Token 成本完成数据压缩和处理。 数字员工:有身份、有边界、可追溯 面向不同场景,企业可基于千问办公和钉钉打造“数字员工”...

    推荐理由:来自IT之家 AI的《阿里千问办公发布企业上下文、数字员工及 Agent 硬件 QwenNote A2》。重点看智能体工作流、模型能力与工程、产品发布。摘要提到:IT之家 9 月 22 日消息,在今天举行的 2026 云栖大会千问办公专场上,阿里千问办公(QwenWork)围绕企业级 Agent 发布了一系列产品与能力升级,主题指向“让企业级 Agent 懂业务、能协同、信得过”。 企业上下文:让企业私有知识与千问办公无缝打通 IT之家注意到,千问办公此次发布了面向企业的全新产品“企业上下文”(Enterprise Context)。其逻辑是:Agent 进入企业业务流程,最重要的前提是理解企业数据,但员工开始一项具体任务时,需要的往往不是全部信息,而是与当前任务最相关的那部分。企业上下文会对分散在文档、沟通和业务系统中的企业信息进行压缩与结构化,并随业务变化及时更新,让 Agent 每次都能基于企业最新真实情况作判断。官方还强调,该产品内置专属模型,可用极低的 Token 成本完成数据压缩和处理。 数字员工:有身份、有边界、可追溯 面向不同场景,企业可基于千问办公和钉钉打造“数字员工”...

  6. IT之家 AI70

    中国联通发布智能热线 AICC3.0,让 AI 客服自主执行任务

    IT之家 9 月 22 日消息,在本月的 2026 中国联通合作伙伴大会期间, 中国联通发布智能热线 AICC3.0 ,助力热线行业由“AI 辅助应答”向“任务自主执行”转型迈进,将服务能力从“会回答”升级为“高效办成一件事”,依托智能体技术重构热线服务模式,为政企热线数智化转型提供完整解决方案。 智能热线 AICC 产品体系由中国联通中讯邮电咨询设计院支撑研发打造,自 2024 年底在运营商中率先推出。 本次发布的 AICC3.0 产品将服务进一步拓展至泛政务、金融、大企业等多元行业场景, 以实时多模态交互、智能体自主执行、人机协同运营为核心 ,打造自主服务引擎与智能 BPO 运营两大核心能力。 自主服务引擎采用“1 个总控智能体 +7 个专业智能体 +N 项可灵活扩展技能”架构,配套权限、护栏、审批、评测、审计五重可信治理机制。在总控调度中枢统筹调度下,依托七大专业智能体完成诉求理解、任务规划、智能调度、执行校验、结果闭环全...

    推荐理由:来自IT之家 AI的《中国联通发布智能热线 AICC3.0,让 AI 客服自主执行任务》。重点看智能体工作流、评测与基准、产品发布。摘要提到:IT之家 9 月 22 日消息,在本月的 2026 中国联通合作伙伴大会期间, 中国联通发布智能热线 AICC3.0 ,助力热线行业由“AI 辅助应答”向“任务自主执行”转型迈进,将服务能力从“会回答”升级为“高效办成一件事”,依托智能体技术重构热线服务模式,为政企热线数智化转型提供完整解决方案。 智能热线 AICC 产品体系由中国联通中讯邮电咨询设计院支撑研发打造,自 2024 年底在运营商中率先推出。 本次发布的 AICC3.0 产品将服务进一步拓展至泛政务、金融、大企业等多元行业场景, 以实时多模态交互、智能体自主执行、人机协同运营为核心 ,打造自主服务引擎与智能 BPO 运营两大核心能力。 自主服务引擎采用“1 个总控智能体 +7 个专业智能体 +N 项可灵活扩展技能”架构,配套权限、护栏、审批、评测、审计五重可信治理机制。在总控调度中枢统筹调度下,依托七大专业智能体完成诉求理解、任务规划、智能调度、执行校验、结果闭环全...

  7. 极客公园72

    Meta 个人 AI 助手刚火 13 天,Amazon 就拉闸了

    9 月 21 日,一条弹窗开始出现在试图用 Meta Muse 在 Amazon 上购物的用户屏幕上:「未经授权的 AI Agent 继续访问,将违反 Amazon 使用条款。」 这距离 Muse 正式上线,仅仅过了 13 天。 Meta 推出的个人 AI 助手 Muse 最近爆火|图片来源:Meta Meta 在 9 月 8 日发布了 Muse,把它定义为「 全球第一款,为所有人打造的个人 AI Agent 」。和 ChatGPT、Claude 这些聊天机器人不同,Muse 不只是回答问题,它能打开浏览器、登录你的邮箱、填表格、订机票,甚至直接替你下单买东西。 效果立竿见影,Sensor Tower 的数据显示,Muse 上线 13 天累计下载超过 250 万次, 9 月 18 日登顶美国 App Store 免费榜第一 ,把 ChatGPT、Gemini、Claude 全压在身后。 但显然,面对爆火的个人 AI 助手,传统互...

    推荐理由:来自极客公园的《Meta 个人 AI 助手刚火 13 天,Amazon 就拉闸了》。重点看智能体工作流、产品发布。摘要提到:9 月 21 日,一条弹窗开始出现在试图用 Meta Muse 在 Amazon 上购物的用户屏幕上:「未经授权的 AI Agent 继续访问,将违反 Amazon 使用条款。」 这距离 Muse 正式上线,仅仅过了 13 天。 Meta 推出的个人 AI 助手 Muse 最近爆火|图片来源:Meta Meta 在 9 月 8 日发布了 Muse,把它定义为「 全球第一款,为所有人打造的个人 AI Agent 」。和 ChatGPT、Claude 这些聊天机器人不同,Muse 不只是回答问题,它能打开浏览器、登录你的邮箱、填表格、订机票,甚至直接替你下单买东西。 效果立竿见影,Sensor Tower 的数据显示,Muse 上线 13 天累计下载超过 250 万次, 9 月 18 日登顶美国 App Store 免费榜第一 ,把 ChatGPT、Gemini、Claude 全压在身后。 但显然,面对爆火的个人 AI 助手,传统互...

  8. IT之家 AI68

    我国活跃智能体已近 500 万个,到 2030 年中国 AI 算力市场规模或暴增 300%

    IT之家 9 月 22 日消息,据央视新闻报道,《2026 年中国人工智能计算力发展评估报告》已于昨日发布。报告显示,随着智能体技术走向成熟,2026—2030 年,中国活跃智能体复合年均增长率将超 150%。 报告显示,人工智能正完成从内容生成到任务执行的转变,全球活跃智能体数量将从 2026 年的 7940 万个增长至 2030 年的 22.16 亿个。2026 年,中国活跃智能体已近 500 万个(达到 495 万个),据预测,2030 年将增长到 1.97 亿个,复合年均增长率达到 151.2%。 值得一提的是,支撑人工智能应用的算力,其投资规模也在加速扩张:2030 年,全球人工智能算力市场规模预计将达到 1.25 万亿美元 (IT之家注:现汇率约合 8.39 万亿元人民币) 。 其中,中国市场将达到 1,501 亿美元 (现汇率约合 1.01 万亿元人民币) ,均为 2025 年的 4 倍 。

    推荐理由:来自IT之家 AI的《我国活跃智能体已近 500 万个,到 2030 年中国 AI 算力市场规模或暴增 300%》。重点看智能体工作流、产品发布。摘要提到:IT之家 9 月 22 日消息,据央视新闻报道,《2026 年中国人工智能计算力发展评估报告》已于昨日发布。报告显示,随着智能体技术走向成熟,2026—2030 年,中国活跃智能体复合年均增长率将超 150%。 报告显示,人工智能正完成从内容生成到任务执行的转变,全球活跃智能体数量将从 2026 年的 7940 万个增长至 2030 年的 22.16 亿个。2026 年,中国活跃智能体已近 500 万个(达到 495 万个),据预测,2030 年将增长到 1.97 亿个,复合年均增长率达到 151.2%。 值得一提的是,支撑人工智能应用的算力,其投资规模也在加速扩张:2030 年,全球人工智能算力市场规模预计将达到 1.25 万亿美元 (IT之家注:现汇率约合 8.39 万亿元人民币) 。 其中,中国市场将达到 1,501 亿美元 (现汇率约合 1.01 万亿元人民币) ,均为 2025 年的 4 倍 。

9月21日周一
  1. GitHub Changelog91

    Grok 4.7 is now available in GitHub Copilot

    事实摘要:Grok 4.7 is now available in GitHub Copilot 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:Grok 4.7 is now available in GitHub Copilot 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:Grok 4.7。影响判断:它可能改变智能体工作流、模型能力与工程、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程、开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  2. 爱范儿74

    新 Mac mini 首发实测:我的第一台「多 Agent」电脑

    事实摘要:新 Mac mini 首发实测:我的第一台「多 Agent」电脑 能跑大模型只是 AI PC 的起点 #欢迎关注爱范儿官方微信公众号:爱范儿(微信号:ifanr),更多精彩内容第一时间为您奉上。 这条动态来自 爱范儿,可重点关注智能体工作流、模型能力与工程。 新 Mac mini 首发实测:我的第一台「多 Agent」电脑 能跑大模型只是 AI PC 的起点。影响判断:它可能改变智能体工作流、模型能力与工程相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  3. IT之家 AI68

    科技巨头因 AI 购物起争端:亚马逊封禁 Meta Muse 智能体

    IT之家 9 月 21 日消息,亚马逊已经阻断了 Meta 全新的个人 AI 智能体 Muse 代用户在亚马逊网站购物的访问权限。此前亚马逊曾尝试劝说这家 Facebook 母公司主动在 Muse 当中排除亚马逊电商站点,但协商未果。 亚马逊表示,整件事的问题在于,亚马逊自始至终从未许可过该访问行为。Meta 事先没有告知亚马逊 Muse 会访问其电商平台;这款智能体在网页浏览的时候也不会主动表明自身身份;而且 Muse 似乎会采集并保存用户账号凭证,亚马逊认为这会带来隐私以及安全隐患。 自当地时间上周日晚间起,当用户试图使用 Muse 在亚马逊下单购物时,页面就会弹出提示:“未经授权的 AI 智能体继续访问本网站,违反了亚马逊的使用条款,该条款已得到我方用户认可。” 亚马逊一位发言人在声明中表示:“道理其实十分简单。如果第三方应用要代消费者向其他商家发起采购,运作过程就应当公开透明,同时需要尊重服务提供方关于是否参与该服务的决...

    推荐理由:来自IT之家 AI的《科技巨头因 AI 购物起争端:亚马逊封禁 Meta Muse 智能体》。重点看智能体工作流。摘要提到:IT之家 9 月 21 日消息,亚马逊已经阻断了 Meta 全新的个人 AI 智能体 Muse 代用户在亚马逊网站购物的访问权限。此前亚马逊曾尝试劝说这家 Facebook 母公司主动在 Muse 当中排除亚马逊电商站点,但协商未果。 亚马逊表示,整件事的问题在于,亚马逊自始至终从未许可过该访问行为。Meta 事先没有告知亚马逊 Muse 会访问其电商平台;这款智能体在网页浏览的时候也不会主动表明自身身份;而且 Muse 似乎会采集并保存用户账号凭证,亚马逊认为这会带来隐私以及安全隐患。 自当地时间上周日晚间起,当用户试图使用 Muse 在亚马逊下单购物时,页面就会弹出提示:“未经授权的 AI 智能体继续访问本网站,违反了亚马逊的使用条款,该条款已得到我方用户认可。” 亚马逊一位发言人在声明中表示:“道理其实十分简单。如果第三方应用要代消费者向其他商家发起采购,运作过程就应当公开透明,同时需要尊重服务提供方关于是否参与该服务的决...

  4. IT之家 AI70

    鸿蒙 PC 生态首款 AI 编程智能体工作台,阿里 Qoder 支持鸿蒙电脑

    IT之家 9 月 21 日消息,阿里 Qoder 今日宣布,Qoder 登陆鸿蒙 PC 应用市场,是 鸿蒙 PC 生态首款 AI 编程智能体工作台 。 据介绍,Qoder 团队与鸿蒙团队紧密配合,重点解决了几个关键问题: 让 Qoder 的完整任务闭环 —— 从理解意图、拆解步骤、调用工具到交付结果 —— 在鸿蒙系统上流畅运行,确保核心体验不打折。 充分发挥鸿蒙 PC 的系统级能力,支撑 Qoder 的多 Agent 协同、代码执行和文件操作等核心场景。 IT之家获悉,在鸿蒙 PC 上,开发者可以用自然语言描述需求,Qoder 自主完成代码编写、重构、问题排查和功能测试。Qoder 具备深度代码库理解能力(Deep Codebase Awareness),能基于真实的项目背景和工作环境完成任务;还支持 Frontend Dev、Backend Dev、QA 等多个 Agent 角色协同工作。 此外,在通用模式下,用户无需直接处理...

    推荐理由:来自IT之家 AI的《鸿蒙 PC 生态首款 AI 编程智能体工作台,阿里 Qoder 支持鸿蒙电脑》。重点看智能体工作流。摘要提到:IT之家 9 月 21 日消息,阿里 Qoder 今日宣布,Qoder 登陆鸿蒙 PC 应用市场,是 鸿蒙 PC 生态首款 AI 编程智能体工作台 。 据介绍,Qoder 团队与鸿蒙团队紧密配合,重点解决了几个关键问题: 让 Qoder 的完整任务闭环 —— 从理解意图、拆解步骤、调用工具到交付结果 —— 在鸿蒙系统上流畅运行,确保核心体验不打折。 充分发挥鸿蒙 PC 的系统级能力,支撑 Qoder 的多 Agent 协同、代码执行和文件操作等核心场景。 IT之家获悉,在鸿蒙 PC 上,开发者可以用自然语言描述需求,Qoder 自主完成代码编写、重构、问题排查和功能测试。Qoder 具备深度代码库理解能力(Deep Codebase Awareness),能基于真实的项目背景和工作环境完成任务;还支持 Frontend Dev、Backend Dev、QA 等多个 Agent 角色协同工作。 此外,在通用模式下,用户无需直接处理...

  5. IT之家 AI72

    联合国:不必等风险完全厘清,各国应提前管控 AI 智能体

    IT之家 9 月 21 日消息,联合国一个科学专家小组发布警示: 各国政府应当在完全厘清风险之前,就对能力日益强大的 AI 智能体加以管控 。这份报告也是该国际组织针对今年早些时候 OpenAI 入侵 Hugging Face 一事出具的首份重要评估文件。 IT之家注意到,本周各国领导人齐聚纽约出席联合国大会,中美双方也同步开展人工智能相关会谈;这份报告的发布,进一步将人工智能议题推上全球外交议程。上周,联合国秘书长安东尼奥 · 古特雷斯(António Guterres)呼吁各国政府开展合作,共同应对人工智能带来的威胁。他同时发出警告:“世界承受不起一场在 AI 安全层面竞相降低标准的恶性竞赛。” 这份文件是联合国人工智能独立国际科学专家小组发布的首份专题简报。该专家小组成立于去年,是联合国旗下“首个人工智能领域全球性科学机构”。简报提出:即便各个国家选择不同的立法监管路径,全球仍然需要投入更多关注与资源,管控高级人工智能正在...

    推荐理由:来自IT之家 AI的《联合国:不必等风险完全厘清,各国应提前管控 AI 智能体》。重点看智能体工作流、产品发布。摘要提到:IT之家 9 月 21 日消息,联合国一个科学专家小组发布警示: 各国政府应当在完全厘清风险之前,就对能力日益强大的 AI 智能体加以管控 。这份报告也是该国际组织针对今年早些时候 OpenAI 入侵 Hugging Face 一事出具的首份重要评估文件。 IT之家注意到,本周各国领导人齐聚纽约出席联合国大会,中美双方也同步开展人工智能相关会谈;这份报告的发布,进一步将人工智能议题推上全球外交议程。上周,联合国秘书长安东尼奥 · 古特雷斯(António Guterres)呼吁各国政府开展合作,共同应对人工智能带来的威胁。他同时发出警告:“世界承受不起一场在 AI 安全层面竞相降低标准的恶性竞赛。” 这份文件是联合国人工智能独立国际科学专家小组发布的首份专题简报。该专家小组成立于去年,是联合国旗下“首个人工智能领域全球性科学机构”。简报提出:即便各个国家选择不同的立法监管路径,全球仍然需要投入更多关注与资源,管控高级人工智能正在...

  6. IT之家 AI68

    月之暗面发布 Kimi Code Desktop 桌面客户端,macOS 和 Windows 版同步上线

    IT之家 9 月 21 日消息,今天月之暗面 Kimi 发布了 Kimi Code Desktop,macOS 和 Windows 版同步上线,可访问 kimi.com/ code 安装使用。 作为 Kimi Code 官方桌面客户端,它将 Kimi Code 智能编程服务能力带到桌面应用中。用户不仅可以在桌面端内直接使用 Kimi Code 的 AI Agent 能力,通过对话让它读写代码、运行命令、完成自动化任务,还能在全新可视化的图形交互界面中,集中管理所有项目,调整常用配置,清晰查看 Agent 执行任务的每一步。 针对开发者的实际工作流,桌面端还提供内置终端、浏览器和 Git 状态查看等功能,支持直接运行和调试项目、审阅代码改动,关联 PR 状态,方便跟踪代码评审与合并进度。 IT之家附官方详细介绍如下: 如何安装和使用? 第一步:下载并安装 Kimi Code Desktop 下载地址: kimi.com/ code...

    推荐理由:来自IT之家 AI的《月之暗面发布 Kimi Code Desktop 桌面客户端,macOS 和 Windows 版同步上线》。重点看智能体工作流、产品发布。摘要提到:IT之家 9 月 21 日消息,今天月之暗面 Kimi 发布了 Kimi Code Desktop,macOS 和 Windows 版同步上线,可访问 kimi.com/ code 安装使用。 作为 Kimi Code 官方桌面客户端,它将 Kimi Code 智能编程服务能力带到桌面应用中。用户不仅可以在桌面端内直接使用 Kimi Code 的 AI Agent 能力,通过对话让它读写代码、运行命令、完成自动化任务,还能在全新可视化的图形交互界面中,集中管理所有项目,调整常用配置,清晰查看 Agent 执行任务的每一步。 针对开发者的实际工作流,桌面端还提供内置终端、浏览器和 Git 状态查看等功能,支持直接运行和调试项目、审阅代码改动,关联 PR 状态,方便跟踪代码评审与合并进度。 IT之家附官方详细介绍如下: 如何安装和使用? 第一步:下载并安装 Kimi Code Desktop 下载地址: kimi.com/ code...

  7. 量子位70

    国产数据库跑出AI新能力!OceanBase登顶国际Data Agent榜单

    事实摘要:国产数据库跑出AI新能力!OceanBase登顶国际Data Agent榜单 OceanBase团队提交的Data Agent方案登顶国际数据智能体基准Data Agent Benchmark 这条动态来自 量子位,可重点关注智能体工作流、评测与基准。 国产数据库跑出AI新能力!OceanBase登顶国际Data Agent榜单 OceanBase团队提交的。影响判断:它可能改变智能体工作流、评测与基准相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、评测与基准方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、评测与基准直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  8. 量子位68

    GPT-6 Astra开进机器人身体!清华联手无问芯穹等开源RPent

    在物理世界真正干活的具身智能体 这条动态来自 量子位,可重点关注智能体工作流、开源生态。

    推荐理由:来自量子位的《GPT-6 Astra开进机器人身体!清华联手无问芯穹等开源RPent》。重点看智能体工作流、开源生态。摘要提到:在物理世界真正干活的具身智能体 这条动态来自 量子位,可重点关注智能体工作流、开源生态。

  9. OpenAI News79

    V7 cuts costs 78% while boosting accuracy with GPT-5.6 Luna

    这条英文动态主要涉及智能体工作流。原文要点:Using GPT-5.6, V7 turns scattered company files into context agents can use to complete complex, source-linked work.

    推荐理由:来自OpenAI News的《V7 cuts costs 78% while boosting accuracy with GPT-5.6 Luna》。重点看智能体工作流。摘要提到:这条英文动态主要涉及智能体工作流。原文要点:Using GPT-5.6, V7 turns scattered company files into context agents can use to complete complex, source-linked work.

  10. Simon Willison79

    MCP was always a bad idea?

    事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:MCP was always a bad idea? 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:MCP was always a bad idea? 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:MCP w。影响判断:它可能改变智能体工作流、模型能力与工程、文化创意相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、文化创意方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程、文化创意直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  11. Simon Willison88

    llm-keys-ui 0.1

    事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:llm-keys-ui 0.1 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:llm-keys-ui 0.1 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:llm-keys-ui 0.1 事实摘要:这条英文动态。影响判断:它可能改变智能体工作流、模型能力与工程、文化创意相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、文化创意方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程、文化创意直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

9月20日周日
  1. IT之家 AI74

    消息称 Anthropic 拟于 IPO 前推出新 AI 模型,以应对 OpenAI GPT-6 Astra 竞争压力

    IT之家 9 月 20 日消息,据路透社报道,三位消息人士透露,Anthropic 正考虑推出一款全新人工智能模型,以此应对 OpenAI 发布 GPT‑6 Astra 之后的强劲发展势头。此事发生在该公司筹备 IPO(首次公开募股)前夕;就在此前,其首席执行官还呼吁整个 AI 行业放缓技术迭代的脚步。 消息人士称,此番计划发布新模型,意在直面来自直接竞争对手的竞争压力。而在此之前,Anthropic 首席执行官达里奥 · 阿莫代伊(Dario Amodei)已经向全球 AI 业界发声,呼吁行业放慢新能力的发布节奏,妥善处理安全风险。 “我们必须放缓 AI 模型能力迭代的速度。”阿莫代伊在 9 月 12 日一篇长达 3800 字的文章中写道。 这篇文章描绘了一幅不容乐观的前景:大批 AI 智能体席卷互联网,发展速度超出人类管控范围。该观点得到 OpenAI 首席执行官萨姆 · 奥尔特曼(Sam Altman)以及 SpaceX ...

    推荐理由:来自IT之家 AI的《消息称 Anthropic 拟于 IPO 前推出新 AI 模型,以应对 OpenAI GPT-6 Astra 竞争压力》。重点看智能体工作流、模型能力与工程、产品发布。摘要提到:IT之家 9 月 20 日消息,据路透社报道,三位消息人士透露,Anthropic 正考虑推出一款全新人工智能模型,以此应对 OpenAI 发布 GPT‑6 Astra 之后的强劲发展势头。此事发生在该公司筹备 IPO(首次公开募股)前夕;就在此前,其首席执行官还呼吁整个 AI 行业放缓技术迭代的脚步。 消息人士称,此番计划发布新模型,意在直面来自直接竞争对手的竞争压力。而在此之前,Anthropic 首席执行官达里奥 · 阿莫代伊(Dario Amodei)已经向全球 AI 业界发声,呼吁行业放慢新能力的发布节奏,妥善处理安全风险。 “我们必须放缓 AI 模型能力迭代的速度。”阿莫代伊在 9 月 12 日一篇长达 3800 字的文章中写道。 这篇文章描绘了一幅不容乐观的前景:大批 AI 智能体席卷互联网,发展速度超出人类管控范围。该观点得到 OpenAI 首席执行官萨姆 · 奥尔特曼(Sam Altman)以及 SpaceX ...

  2. IT之家 AI78

    阶跃发布旗舰模型 Step 5 Preview:跻身 AA 榜单全球开源模型前三,10 月 15 日开源

    IT之家 9 月 20 日消息,阶跃今天宣布推出旗舰模型 Step 5 Preview,面向 AI 编程、软件工程、专业知识工作、金融等场景,提升模型执行真实世界 Agentic 任务表现,10 月 15 日开源完整权重。 据介绍,该模型采用稀疏 MoE 混合专家架构, 总参数量 600B 、激活参数仅 27B,支持 100 万 Token 上下文窗口,原生支持文本与视觉输入。 在全球人工智能权威榜单 Artificial Analysis Intelligence Index(IT之家注:AA 综合智能指数)中,该模型得分 44 分, 位居全球开源模型前三 。与此同时,该模型的单任务成本仅为 Anthropic Claude Opus 5 的 1/8。 优化方面,阶跃为该模型建立了 StepCodeBench,覆盖 553 个独立代码仓库、9 类任务、20 个应用领域和 33 种编程语言。在测试中,Step 5 Preview...

    推荐理由:来自IT之家 AI的《阶跃发布旗舰模型 Step 5 Preview:跻身 AA 榜单全球开源模型前三,10 月 15 日开源》。重点看智能体工作流、模型能力与工程、文化创意。摘要提到:IT之家 9 月 20 日消息,阶跃今天宣布推出旗舰模型 Step 5 Preview,面向 AI 编程、软件工程、专业知识工作、金融等场景,提升模型执行真实世界 Agentic 任务表现,10 月 15 日开源完整权重。 据介绍,该模型采用稀疏 MoE 混合专家架构, 总参数量 600B 、激活参数仅 27B,支持 100 万 Token 上下文窗口,原生支持文本与视觉输入。 在全球人工智能权威榜单 Artificial Analysis Intelligence Index(IT之家注:AA 综合智能指数)中,该模型得分 44 分, 位居全球开源模型前三 。与此同时,该模型的单任务成本仅为 Anthropic Claude Opus 5 的 1/8。 优化方面,阶跃为该模型建立了 StepCodeBench,覆盖 553 个独立代码仓库、9 类任务、20 个应用领域和 33 种编程语言。在测试中,Step 5 Preview...

  3. IT之家 AI68

    IDC:2026 年 Q2 中国工业 PC 出货量同比增长 16.8%,增速创下近五个季度新高

    IT之家 9 月 20 日消息,国际数据公司 (IDC) 最新数据显示,2026 年第二季度,中国工业 PC 市场出货量同比增长 16.8%,增速创下近五个季度新高。但亮眼数据背后,市场参与者正面临更复杂的周期挑战:本轮增长同时包含 AI 转型带来的真实增量,与短期供需波动催生的前置需求,无法通过简单线性外推判断未来走势。 厂商需穿透数据表象调整经营策略,从追求规模增速转向订单质量与产品竞争力的提升。 一、Q2 市场复盘:16.8% 高增速的双重增长构成 2026 年 Q2 中国工业 PC 市场出货 118.9 万台,同比增长 16.8%;上半年累计 225.4 万台,同比增长 11.9%,呈现同环比双高增的态势。 IDC 认为,本轮增长由双重性质完全不同的动力共同驱动,也决定了市场增长的结构稳定性不足: 首先是 AI 边缘算力带来的真实增量 ,具备长期可持续性。伴随产业加速进入以智能体为核心的新阶段,边缘侧算力缺口持续扩大;工...

    推荐理由:来自IT之家 AI的《IDC:2026 年 Q2 中国工业 PC 出货量同比增长 16.8%,增速创下近五个季度新高》。重点看智能体工作流、产品发布。摘要提到:IT之家 9 月 20 日消息,国际数据公司 (IDC) 最新数据显示,2026 年第二季度,中国工业 PC 市场出货量同比增长 16.8%,增速创下近五个季度新高。但亮眼数据背后,市场参与者正面临更复杂的周期挑战:本轮增长同时包含 AI 转型带来的真实增量,与短期供需波动催生的前置需求,无法通过简单线性外推判断未来走势。 厂商需穿透数据表象调整经营策略,从追求规模增速转向订单质量与产品竞争力的提升。 一、Q2 市场复盘:16.8% 高增速的双重增长构成 2026 年 Q2 中国工业 PC 市场出货 118.9 万台,同比增长 16.8%;上半年累计 225.4 万台,同比增长 11.9%,呈现同环比双高增的态势。 IDC 认为,本轮增长由双重性质完全不同的动力共同驱动,也决定了市场增长的结构稳定性不足: 首先是 AI 边缘算力带来的真实增量 ,具备长期可持续性。伴随产业加速进入以智能体为核心的新阶段,边缘侧算力缺口持续扩大;工...

  4. Simon Willison80

    datasette-auth-github 1.0

    事实摘要:这条英文动态主要涉及智能体工作流、开源生态,原文信息显示:datasette-auth-github 1.0 事实摘要:这条英文动态主要涉及智能体工作流、开源生态,原文信息显示:datasette-auth-github 1.0 事实摘要:这条英文动态主要涉及智能体工作流、开源生态,原文信息显示:datasette-auth-github 1.0 事实摘要:。影响判断:它可能改变智能体工作流、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

9月19日周六
  1. IT之家 AI72

    SpaceXAI 发布 Grok Voice Transcribe 2.0 语音转文本模型:错误率降低约一半,价格保持不变

    IT之家 9 月 19 日消息,当地时间 9 月 18 日,SpaceXAI 发布了 Grok Voice Transcribe 2.0 语音转文本模型,在保持价格不变的前提下,错误率降低约一半。 官方表示,Grok Voice Transcribe 2.0 基于 Grok Voice 底层的音频基础模型构建。目前,Grok Voice 已全面赋能实际业务:每天承接数万通客服电话,转录数百万小时的视频旁白,并驱动实体硬件中的各类语音智能体 —— 其中包括特斯拉车辆中搭载的 Grok 助手。 在 Artificial Analysis 榜单中, Grok Voice Transcribe 2.0 在全部 32 款流式模型中准确率高居榜首 。 除公开基准外,SpaceXAI 基于线上实际业务中采样的四个内部数据集,对模型的词错误率进行了系统评测。这四个测试集分别涵盖:客服电话音频、与 Grok 的日常对话(英语)、电话号码、邮箱、地...

    推荐理由:来自IT之家 AI的《SpaceXAI 发布 Grok Voice Transcribe 2.0 语音转文本模型:错误率降低约一半,价格保持不变》。重点看智能体工作流、模型能力与工程、评测与基准。摘要提到:IT之家 9 月 19 日消息,当地时间 9 月 18 日,SpaceXAI 发布了 Grok Voice Transcribe 2.0 语音转文本模型,在保持价格不变的前提下,错误率降低约一半。 官方表示,Grok Voice Transcribe 2.0 基于 Grok Voice 底层的音频基础模型构建。目前,Grok Voice 已全面赋能实际业务:每天承接数万通客服电话,转录数百万小时的视频旁白,并驱动实体硬件中的各类语音智能体 —— 其中包括特斯拉车辆中搭载的 Grok 助手。 在 Artificial Analysis 榜单中, Grok Voice Transcribe 2.0 在全部 32 款流式模型中准确率高居榜首 。 除公开基准外,SpaceXAI 基于线上实际业务中采样的四个内部数据集,对模型的词错误率进行了系统评测。这四个测试集分别涵盖:客服电话音频、与 Grok 的日常对话(英语)、电话号码、邮箱、地...

  2. IT之家 AI74

    中国电信开源首个全栈国产轻量级智能体大模型 Xing4.0-29B-A4B

    IT之家 9 月 19 日消息,中国电信于 9 月 17 日发布新一代星辰大模型 Xing4.0-29B-A4B,该模型总参数量 29B,激活参数仅 4B,原生支持 256K 上下文,可扩展至 512K, 是国内首个基于国产算力与国产框架完成训练、面向复杂工程任务深度优化的百亿参数大模型 。 官方表示,从训练芯片到推理部署, 全栈国产 —— 昇腾训练、国产框架适配、自研架构、开源生态,一条路走通。 从 SuperCLUE 评测结果来看,在智能体能力方面,Xing4.0-29B-A4B 得分 93.52,位列第 3 名,与两款头部 Qwen 模型的差距均不足 1 分。 据介绍,Xing4.0-29B-A4B 通过 4-bit 量化后显存占用降低至 15GB(比 FP16 省约 75%),RTX 3090、RTX 4090 这类 24G 消费级显卡就能本地跑长上下文任务。 Xing4.0-29B-A4B 延续星辰大模型的开源路线,对...

    推荐理由:来自IT之家 AI的《中国电信开源首个全栈国产轻量级智能体大模型 Xing4.0-29B-A4B》。重点看智能体工作流、模型能力与工程、评测与基准。摘要提到:IT之家 9 月 19 日消息,中国电信于 9 月 17 日发布新一代星辰大模型 Xing4.0-29B-A4B,该模型总参数量 29B,激活参数仅 4B,原生支持 256K 上下文,可扩展至 512K, 是国内首个基于国产算力与国产框架完成训练、面向复杂工程任务深度优化的百亿参数大模型 。 官方表示,从训练芯片到推理部署, 全栈国产 —— 昇腾训练、国产框架适配、自研架构、开源生态,一条路走通。 从 SuperCLUE 评测结果来看,在智能体能力方面,Xing4.0-29B-A4B 得分 93.52,位列第 3 名,与两款头部 Qwen 模型的差距均不足 1 分。 据介绍,Xing4.0-29B-A4B 通过 4-bit 量化后显存占用降低至 15GB(比 FP16 省约 75%),RTX 3090、RTX 4090 这类 24G 消费级显卡就能本地跑长上下文任务。 Xing4.0-29B-A4B 延续星辰大模型的开源路线,对...

  3. IT之家 AI74

    OpenAI 研究员示警:AI 能力越强,越容易“隐藏内心想法”

    IT之家 9 月 19 日消息,OpenAI 研究员诺姆 · 布朗(Noam Brown)最新表示,伴随着 AI 模型能力越来越强, 模型的思维链可监测性正逐渐下降,未来开发者可能无法有效、可靠地发现、解释并约束 AI 的风险行为。 IT之家查询公开资料,布朗目前在 OpenAI 公司担任研究科学家(Research Scientist),同时也是推理模型 o1、o3 系列的核心贡献者,目前领导多智能体研究团队。 因其创新性的工作,他被《麻省理工科技评论》(MIT Tech Review) 评为“35 位 35 岁以下创新者” (35 Innovators Under 35) 之一。 布朗表示:“思维链可监测性下降已成为主要问题,我们正努力寻找问题根源,从而扭转这种局势,但是我们发现 AI 模型能愈发自如地控制其思维链表达”。 研究人员原本希望从模型展示的中间推理中,看出它是否正在走向欺骗、规避规则或错误目标;但如果模型学会“隐...

    推荐理由:来自IT之家 AI的《OpenAI 研究员示警:AI 能力越强,越容易“隐藏内心想法”》。重点看智能体工作流、模型能力与工程。摘要提到:IT之家 9 月 19 日消息,OpenAI 研究员诺姆 · 布朗(Noam Brown)最新表示,伴随着 AI 模型能力越来越强, 模型的思维链可监测性正逐渐下降,未来开发者可能无法有效、可靠地发现、解释并约束 AI 的风险行为。 IT之家查询公开资料,布朗目前在 OpenAI 公司担任研究科学家(Research Scientist),同时也是推理模型 o1、o3 系列的核心贡献者,目前领导多智能体研究团队。 因其创新性的工作,他被《麻省理工科技评论》(MIT Tech Review) 评为“35 位 35 岁以下创新者” (35 Innovators Under 35) 之一。 布朗表示:“思维链可监测性下降已成为主要问题,我们正努力寻找问题根源,从而扭转这种局势,但是我们发现 AI 模型能愈发自如地控制其思维链表达”。 研究人员原本希望从模型展示的中间推理中,看出它是否正在走向欺骗、规避规则或错误目标;但如果模型学会“隐...

  4. IT之家 AI72

    Claude Code 宣布添加支持“AI 通用说明书”AGENTS.md

    IT之家 9 月 19 日消息,Anthropic 公司 Claude Code 团队工程师萨里克 · 希希帕尔(Thariq Shihipar,网名 @trq212)在 X 平台发布推文, 宣布在今天(9 月 19 日)发布的 2.1.277 版本 Claude Code 中添加支持 AGENTS.md 。 IT之家翻译其推文内容如下: 从今天发布的 2.1.277 版本开始,如果文件夹中没有 CLAUDE.md ,Claude 将检查并使用 AGENTS.md 。 用户可以在 /config 中切换此行为。 CLAUDE.md 是 Claude Code 特有的工作流、MCP、Sub-agent 或命令配置;而 AGENTS.md 的目标是让不同工具共享项目级基础规则, 可视为所有 AI 都应该遵守的通用规则。 对于普通用户或者开发者而言, AGENTS.md 可以降低工具切换成本和配置成本,而 Claude Code 本次...

    推荐理由:来自IT之家 AI的《Claude Code 宣布添加支持“AI 通用说明书”AGENTS.md》。重点看智能体工作流、产品发布。摘要提到:IT之家 9 月 19 日消息,Anthropic 公司 Claude Code 团队工程师萨里克 · 希希帕尔(Thariq Shihipar,网名 @trq212)在 X 平台发布推文, 宣布在今天(9 月 19 日)发布的 2.1.277 版本 Claude Code 中添加支持 AGENTS.md 。 IT之家翻译其推文内容如下: 从今天发布的 2.1.277 版本开始,如果文件夹中没有 CLAUDE.md ,Claude 将检查并使用 AGENTS.md 。 用户可以在 /config 中切换此行为。 CLAUDE.md 是 Claude Code 特有的工作流、MCP、Sub-agent 或命令配置;而 AGENTS.md 的目标是让不同工具共享项目级基础规则, 可视为所有 AI 都应该遵守的通用规则。 对于普通用户或者开发者而言, AGENTS.md 可以降低工具切换成本和配置成本,而 Claude Code 本次...

  5. Simon Willison87

    Quoting Thariq Shihipar

    事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:Quoting Thariq Shihipar 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:Quoting Thariq Shihipar 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:Quoting Tha。影响判断:它可能改变智能体工作流、模型能力与工程、文化创意相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、文化创意方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程、文化创意直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  6. GitHub Changelog90

    Upcoming deprecation of selected GitHub Copilot models in mid-October

    事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:Upcoming deprecation of selected GitHub Copilot models in mid-October 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:Upcoming deprecation of selecte。影响判断:它可能改变智能体工作流、模型能力与工程、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程、开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  7. Claude Code Releases84

    Claude Code Releases v2.1.277:Added AGENTS.md support: in a project with no CLAUDE.md, C...

    事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:Claude Code Releases v2.1.277:Added AGENTS.md support: in a project with no CLAUDE.md, C... 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:Claude Co。影响判断:它可能改变智能体工作流、模型能力与工程、文化创意相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、文化创意方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程、文化创意直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。