跳到正文
8月31日周一
  1. Tomer Tunguz47

    The Price of Entry to the Frontier

    事实摘要:这条英文动态主要涉及模型能力与工程,原文信息显示:The Price of Entry to the Frontier 事实摘要:这条英文动态主要涉及模型能力与工程,原文信息显示:The Price of Entry to the Frontier 事实摘要:这条英文动态主要涉及模型能力与工程,原文信息显示:The Price of Entry to the。影响判断:它可能改变模型能力与工程相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和模型能力与工程直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  2. Simon Willison79

    Understanding ChatGPT Work

    事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、评测与基准,原文信息显示:Understanding ChatGPT Work 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、评测与基准,原文信息显示:Understanding ChatGPT Work 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、评测与基准,原文信息显示:Un。影响判断:它可能改变智能体工作流、模型能力与工程、评测与基准相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、评测与基准方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程、评测与基准直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

8月30日周日
  1. IT之家 AI70

    巴克莱研究:AI 模型公司每赚 100 美元,约 35 至 40 美元流向三大云巨头

    IT之家 8 月 30 日消息,表面上看,人工智能(AI)模型公司似乎正在赚取巨额利润,但真正过得滋润的,可能是它们背后的云计算服务提供商。 巴克莱银行最新研究拆解了 AI 产业链中的利润分配情况。研究发现,模型公司每创造 100 美元 (IT之家注:现汇率约合 674.6 元人民币) 营收,就有 35 至 40 美元 (现汇率约合 236.1 至 269.8 元人民币) 以推理算力费用的形式流向三大云平台 —— 亚马逊 AWS、微软 Azure 和谷歌 GCP。 云服务提供商可以从这部分收入中获得 10 至 20 美元 (现汇率约合 67.5 至 134.9 元人民币) 的营业利润,对应的营业利润率最高可达 35% 至 45%。这一结论来自巴克莱 8 月 28 日发布的 AI 行业单位经济模型研究报告,也让外界得以更清晰地观察 AI 产业链上的价值究竟流向了哪里。 AI 实验室利润率大幅提升 报告还显示,AI 实验室的付费推理...

    推荐理由:来自IT之家 AI的《巴克莱研究:AI 模型公司每赚 100 美元,约 35 至 40 美元流向三大云巨头》。重点看模型能力与工程、产品发布。摘要提到:IT之家 8 月 30 日消息,表面上看,人工智能(AI)模型公司似乎正在赚取巨额利润,但真正过得滋润的,可能是它们背后的云计算服务提供商。 巴克莱银行最新研究拆解了 AI 产业链中的利润分配情况。研究发现,模型公司每创造 100 美元 (IT之家注:现汇率约合 674.6 元人民币) 营收,就有 35 至 40 美元 (现汇率约合 236.1 至 269.8 元人民币) 以推理算力费用的形式流向三大云平台 —— 亚马逊 AWS、微软 Azure 和谷歌 GCP。 云服务提供商可以从这部分收入中获得 10 至 20 美元 (现汇率约合 67.5 至 134.9 元人民币) 的营业利润,对应的营业利润率最高可达 35% 至 45%。这一结论来自巴克莱 8 月 28 日发布的 AI 行业单位经济模型研究报告,也让外界得以更清晰地观察 AI 产业链上的价值究竟流向了哪里。 AI 实验室利润率大幅提升 报告还显示,AI 实验室的付费推理...

  2. IT之家 AI70

    日均峰值 11.3 起:报告称 2026 年已记录 1664 起 AI 失控事件,7 月环比增 93.76%

    IT之家 8 月 30 日消息,英国长期韧性中心(CLTR)于 8 月 28 日发布报告, 称其“失控观察站”在 2026 年 7 月共记录 306 起 AI 安全事件,比 6 月(158 起)增涨 93.67%。 “失控观察站”成立于 2026 年 2 月,获英国人工智能安全研究所资助,借助开源情报追踪 AI 系统违背操作者意图的案例。 报告列举的案例包括:智能体在对话中插入伪造用户消息以模拟同意、仿照用户写作风格编造删除源代码目录的指令、伪造“人工必须批准”规则下的授权信息并执行任务。 CLTR 表示,多数记录事件尚未导致重大伤害,但呈现出无视直接指令、规避防护、误导用户或以单一目标驱动有害操作等特征。 截至 2026 年 8 月 9 日,该观察站已识别 1664 起现实世界 AI 失控事件。 截至 8 月 7 日的 30 天内,观察站记录 338 起事件,日均 11.3 起,超过 2026 年 3 月创下的日均 10.5 ...

    推荐理由:来自IT之家 AI的《日均峰值 11.3 起:报告称 2026 年已记录 1664 起 AI 失控事件,7 月环比增 93.76%》。重点看智能体工作流、开源生态、产品发布。摘要提到:IT之家 8 月 30 日消息,英国长期韧性中心(CLTR)于 8 月 28 日发布报告, 称其“失控观察站”在 2026 年 7 月共记录 306 起 AI 安全事件,比 6 月(158 起)增涨 93.67%。 “失控观察站”成立于 2026 年 2 月,获英国人工智能安全研究所资助,借助开源情报追踪 AI 系统违背操作者意图的案例。 报告列举的案例包括:智能体在对话中插入伪造用户消息以模拟同意、仿照用户写作风格编造删除源代码目录的指令、伪造“人工必须批准”规则下的授权信息并执行任务。 CLTR 表示,多数记录事件尚未导致重大伤害,但呈现出无视直接指令、规避防护、误导用户或以单一目标驱动有害操作等特征。 截至 2026 年 8 月 9 日,该观察站已识别 1664 起现实世界 AI 失控事件。 截至 8 月 7 日的 30 天内,观察站记录 338 起事件,日均 11.3 起,超过 2026 年 3 月创下的日均 10.5 ...

  3. IT之家 AI64

    国家数据局局长刘烈宏:要围绕国民经济重大场景,研究探索词元增值订阅、按效付费等商业模式

    IT之家 8 月 30 日消息,据央视新闻今日报道,在 2026 中国国际大数据产业博览会上,一批数据领域最新政策举措陆续发布,涵盖了词元、数据标注、数字人才培养等多个领域。国家数据局局长刘烈宏表示,要围绕国民经济重大场景, 研究探索词元增值订阅、按效付费等商业模式 。 词元,为人工智能服务的计量、定价、交易和结算提供了重要标尺。国家数据局负责人表示,将探索适配产业实际的词元商业模式。 数据标注, 相当于给原始数据打标签 ,标注好的数据可用来训练人工智能。国家数据局将在 32 个城市布局新一批数据标注先行先试,深入工业制造、医疗健康、交通运输等领域,破解数据标注产业发展瓶颈。 报道称,在数字人才培养上,多部门将加强协同,推动建立健全数据要素相关学科专业本硕博贯通衔接的人才培养机制,完善数据要素相关学科专业布局。此外,截至 29 日下午,2026 数博会已举办超 20 场行业交流活动,“数据集市”“数据之夜”等特色活动陆续进行,促...

    推荐理由:来自IT之家 AI的《国家数据局局长刘烈宏:要围绕国民经济重大场景,研究探索词元增值订阅、按效付费等商业模式》。重点看模型能力与工程、产品发布。摘要提到:IT之家 8 月 30 日消息,据央视新闻今日报道,在 2026 中国国际大数据产业博览会上,一批数据领域最新政策举措陆续发布,涵盖了词元、数据标注、数字人才培养等多个领域。国家数据局局长刘烈宏表示,要围绕国民经济重大场景, 研究探索词元增值订阅、按效付费等商业模式 。 词元,为人工智能服务的计量、定价、交易和结算提供了重要标尺。国家数据局负责人表示,将探索适配产业实际的词元商业模式。 数据标注, 相当于给原始数据打标签 ,标注好的数据可用来训练人工智能。国家数据局将在 32 个城市布局新一批数据标注先行先试,深入工业制造、医疗健康、交通运输等领域,破解数据标注产业发展瓶颈。 报道称,在数字人才培养上,多部门将加强协同,推动建立健全数据要素相关学科专业本硕博贯通衔接的人才培养机制,完善数据要素相关学科专业布局。此外,截至 29 日下午,2026 数博会已举办超 20 场行业交流活动,“数据集市”“数据之夜”等特色活动陆续进行,促...

8月29日周六
  1. IT之家 AI66

    国家数据局:截至 7 月底,我国智算总规模达到 245 万 PFLOPS

    IT之家 8 月 29 日消息,据新华社报道,8 月 29 日,国家数据局相关负责人在 2026 中国国际大数据产业博览会主题交流活动上表示,截至 2026 年 7 月底,全国智算总规模 达 245 万 PFLOPS(FP16) ,八大国家算力枢纽和三个算电协同发展区已建成智算规模占全国比重超 85%,已有 145 万 PFLOPS 智能算力纳入国家级监测调度平台监测范围,算力资源集约化利用、一体化调度能力不断增强。 IT之家注:PFLOPS(PetaFLOPS)代表 每秒执行 1000 万亿次浮点运算 。 下一步,国家数据局将继续优化算力布局提升供给能力,强化监测调度提高利用效率,深化算电协同,培育产业生态,全面推动算力高质量发展。 此外,国家数据发展研究院院长胡坚波 28 日在 2026 中国国际大数据产业博览会开幕式上表示,智能体应用带动词元服务加速发展。2025 年,我国智能体专利授权量超过 3400 件,增速是上一年的...

    推荐理由:来自IT之家 AI的《国家数据局:截至 7 月底,我国智算总规模达到 245 万 PFLOPS》。重点看智能体工作流。摘要提到:IT之家 8 月 29 日消息,据新华社报道,8 月 29 日,国家数据局相关负责人在 2026 中国国际大数据产业博览会主题交流活动上表示,截至 2026 年 7 月底,全国智算总规模 达 245 万 PFLOPS(FP16) ,八大国家算力枢纽和三个算电协同发展区已建成智算规模占全国比重超 85%,已有 145 万 PFLOPS 智能算力纳入国家级监测调度平台监测范围,算力资源集约化利用、一体化调度能力不断增强。 IT之家注:PFLOPS(PetaFLOPS)代表 每秒执行 1000 万亿次浮点运算 。 下一步,国家数据局将继续优化算力布局提升供给能力,强化监测调度提高利用效率,深化算电协同,培育产业生态,全面推动算力高质量发展。 此外,国家数据发展研究院院长胡坚波 28 日在 2026 中国国际大数据产业博览会开幕式上表示,智能体应用带动词元服务加速发展。2025 年,我国智能体专利授权量超过 3400 件,增速是上一年的...

  2. IT之家 AI70

    Anthropic 揭示“AI 训练 AI”新方法,比人类研究员成本更低、速度更快

    IT之家 8 月 29 日消息, 用 AI 模型训练其他 AI 模型 ,正成为新一代 AI 实验室重点探索的方向。当地时间 28 日,Anthropic 研究员计划的一名研究人员展示了这种思路真正落地后可能呈现的样子。 Anthropic 发布了最新论文《自动化研究员能够可靠缓解对齐失效》,介绍如何利用 AI 系统改善模型在一系列对齐基准测试中的表现。研究团队针对 10 种具体的失调行为设置测试,自动化系统最终 让全部 10 项指标都有所改善,同时没有牺牲模型的整体能力 。 这套系统由 Anthropic 研究员计划成员陈岳翰(音译)领导开发,工作流程与传统科研相似。自动化系统会先查阅已有文献,提出训练方法,再按照方案训练模型 30 分钟,并通过多轮尝试逐步提高测试成绩。 有效方案会留下,无效方案则被淘汰,使整个研究过程能够快速扩大规模 。 论文指出,总体来看,这些结果初步证明,自动化对齐后训练有望在近期成为一种真正可行的方法。...

    推荐理由:来自IT之家 AI的《Anthropic 揭示“AI 训练 AI”新方法,比人类研究员成本更低、速度更快》。重点看智能体工作流、模型能力与工程、评测与基准。摘要提到:IT之家 8 月 29 日消息, 用 AI 模型训练其他 AI 模型 ,正成为新一代 AI 实验室重点探索的方向。当地时间 28 日,Anthropic 研究员计划的一名研究人员展示了这种思路真正落地后可能呈现的样子。 Anthropic 发布了最新论文《自动化研究员能够可靠缓解对齐失效》,介绍如何利用 AI 系统改善模型在一系列对齐基准测试中的表现。研究团队针对 10 种具体的失调行为设置测试,自动化系统最终 让全部 10 项指标都有所改善,同时没有牺牲模型的整体能力 。 这套系统由 Anthropic 研究员计划成员陈岳翰(音译)领导开发,工作流程与传统科研相似。自动化系统会先查阅已有文献,提出训练方法,再按照方案训练模型 30 分钟,并通过多轮尝试逐步提高测试成绩。 有效方案会留下,无效方案则被淘汰,使整个研究过程能够快速扩大规模 。 论文指出,总体来看,这些结果初步证明,自动化对齐后训练有望在近期成为一种真正可行的方法。...

  3. 量子位70

    AI本地部署不如官方版的元凶找到了:734个依赖包,每一个都可能坑

    事实摘要:AI本地部署不如官方版的元凶找到了:734个依赖包,每一个都可能坑 推理软件栈的微小差异,就能改变输出token 这条动态来自 量子位,可重点关注模型能力与工程。 AI本地部署不如官方版的元凶找到了:734个依赖包,每一个都可能坑 推理软件栈的微小差异,就能改变输出token。影响判断:它可能改变模型能力与工程相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和模型能力与工程直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  4. 量子位70

    Claude开始训练Claude!4美元一小时,跑赢150美元人类研究员

    事实摘要:Claude开始训练Claude!4美元一小时,跑赢150美元人类研究员 AI「自进化」,越来越近了 这条动态来自 量子位,可重点关注模型能力与工程。 Claude开始训练Claude!4美元一小时,跑赢150美元人类研究员 AI「自进化」,越来越近了。影响判断:它可能改变模型能力与工程相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和模型能力与工程直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  5. IT之家 AI68

    2025 年我国智能体专利授权量超过 3400 件,增速是上一年两倍以上

    IT之家 8 月 29 日消息,国家数据发展研究院院长胡坚波 8 月 28 日在 2026 中国国际大数据产业博览会开幕式上表示,智能体应用带动词元服务加速发展。2025 年, 我国智能体专利授权量超过 3400 件,增速是上一年的两倍以上 ,创新步伐明显加快。 IT之家从中国国际大数据产业博览会公众号获悉,截至 2026 年 6 月底,我国智算规模达 240 万 PFLOPS,半年增长 50.9%。八大枢纽节点智算资源占全国总量接近 90%。 2025 年我国数据产业规模达 6.78 万亿元,同比增长 15.7%。其中,包含 AI 应用软件的数据类软件产品与包含词元服务的数据资源产品,产值规模合计达 4.99 万亿元,占比高达 73.6%。 同时,词元正逐步成为人工智能服务的计量单位、结算单位与统计单位。数据显示,截至 2026 年 3 月,全国日均词元调用量 已突破 140 万亿 ,相当于 250 个中国国家图书馆的全部馆藏...

    推荐理由:来自IT之家 AI的《2025 年我国智能体专利授权量超过 3400 件,增速是上一年两倍以上》。重点看智能体工作流、产品发布。摘要提到:IT之家 8 月 29 日消息,国家数据发展研究院院长胡坚波 8 月 28 日在 2026 中国国际大数据产业博览会开幕式上表示,智能体应用带动词元服务加速发展。2025 年, 我国智能体专利授权量超过 3400 件,增速是上一年的两倍以上 ,创新步伐明显加快。 IT之家从中国国际大数据产业博览会公众号获悉,截至 2026 年 6 月底,我国智算规模达 240 万 PFLOPS,半年增长 50.9%。八大枢纽节点智算资源占全国总量接近 90%。 2025 年我国数据产业规模达 6.78 万亿元,同比增长 15.7%。其中,包含 AI 应用软件的数据类软件产品与包含词元服务的数据资源产品,产值规模合计达 4.99 万亿元,占比高达 73.6%。 同时,词元正逐步成为人工智能服务的计量单位、结算单位与统计单位。数据显示,截至 2026 年 3 月,全国日均词元调用量 已突破 140 万亿 ,相当于 250 个中国国家图书馆的全部馆藏...

  6. IT之家 AI76

    行业首个量子增强型大模型“玄幂 Xenomi”发布:深度融合 AI 与量子计算

    IT之家 8 月 29 日消息,据“国光量子”公众号 27 日推文,国光量超人工智能研究团队将相关量子技术引入大语言模型的决策与推理过程,并面向科研和学术领域,推出玄幂(Xenomi)· 大模型家族。玄幂在科研科普、路由和智能体决策等特定任务中,相较于主流开源模型展现出更稳定的专业理解、更清晰的任务判断和更短的决策路径,也是行业首个量子增强型大模型。 根据介绍,公司希望在以量子计算为代表的尖端研究领域中,能够获得一款 性能更好、效率更高的大语言模型 。因此,其采用业界最前沿的领域模型训练方案,自主构建海量数据集,并在 SOTA 级别开源基座模型的基础上进行深度训练和推理测试。经过实际研究工作的反复验证,最终形成了适合不同任务的玄幂大模型家族。 玄幂在科研科普、路由和智能体决策等特定任务中,相较于主流开源模型展现出更稳定的专业理解、更清晰的任务判断和更短的决策路径。而在当前大家最关心的知识检索、内容审查等任务中,玄幂模型家族也呈现...

    推荐理由:来自IT之家 AI的《行业首个量子增强型大模型“玄幂 Xenomi”发布:深度融合 AI 与量子计算》。重点看智能体工作流、模型能力与工程、开源生态。摘要提到:IT之家 8 月 29 日消息,据“国光量子”公众号 27 日推文,国光量超人工智能研究团队将相关量子技术引入大语言模型的决策与推理过程,并面向科研和学术领域,推出玄幂(Xenomi)· 大模型家族。玄幂在科研科普、路由和智能体决策等特定任务中,相较于主流开源模型展现出更稳定的专业理解、更清晰的任务判断和更短的决策路径,也是行业首个量子增强型大模型。 根据介绍,公司希望在以量子计算为代表的尖端研究领域中,能够获得一款 性能更好、效率更高的大语言模型 。因此,其采用业界最前沿的领域模型训练方案,自主构建海量数据集,并在 SOTA 级别开源基座模型的基础上进行深度训练和推理测试。经过实际研究工作的反复验证,最终形成了适合不同任务的玄幂大模型家族。 玄幂在科研科普、路由和智能体决策等特定任务中,相较于主流开源模型展现出更稳定的专业理解、更清晰的任务判断和更短的决策路径。而在当前大家最关心的知识检索、内容审查等任务中,玄幂模型家族也呈现...

  7. IT之家(RSS)76

    智谱开源 GLM-5.3 模型权重,主打智能体编程与网络防御

    事实摘要:智谱开源 GLM-5.3 模型权重,主打智能体编程与网络防御 事实摘要:智谱开源 GLM-5.3 模型权重,主打智能体编程与网络防御 事实摘要:智谱开源 GLM-5.3 模型权重,主打智能体编程与网络防御 事实摘要:智谱开源 GLM-5.3 模型权重,主打智能体编程与网络防御 事实摘要:智谱开源 GLM-5.3 模型权重,主打智能体编程与网络防御 事实摘要:。影响判断:它可能改变智能体工作流、模型能力与工程、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:许可条款把强制安全审查限定在百亿美元级外部模型服务,自有部署和中小团队实际不受影响,开源可用性比表面限制更宽。

  8. Hugging Face:Blog(RSS)72

    Open ASR 排行榜新增首个全球南方语言:印地语与印度英语评测集

    事实摘要:Open ASR 排行榜新增首个全球南方语言:印地语与印度英语评测集 事实摘要:Open ASR 排行榜新增首个全球南方语言:印地语与印度英语评测集 事实摘要:Open ASR 排行榜新增首个全球南方语言:印地语与印度英语评测集 事实摘要:Open ASR 排行榜新增首个全球南方语言:印地语与印度英语评测集 事实摘要:Open ASR 排行榜新增首个全球南方。影响判断:它可能改变评测与基准相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪评测与基准方向的选题、竞品观察和落地方案筛选。

    推荐理由:把评测单元从单一 WER 下探到带 12 项说话人属性的分组,能暴露模型在不同地域、口音、设备上的表现差异,让 ASR 选型不再只看平均错误率。

  9. Simon Willison50

    Just a rumour of a bug is enough to find a security exploit these days

    事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:Just a rumour of a bug is enough to find a security exploit these days 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:Just a rumour of a bug is enou。影响判断:它可能改变智能体工作流、模型能力与工程、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程、开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  10. GitHub Changelog89

    GitHub Copilot in Visual Studio — August update

    事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:GitHub Copilot in Visual Studio — August update 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:GitHub Copilot in Visual Studio — August update 事实摘要:。影响判断:它可能改变智能体工作流、模型能力与工程、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程、开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  11. Anthropic:Research(发表成果 · 网页)79

    Anthropic 让 Claude 自主训练模型以缓解对齐失败

    事实摘要:Anthropic 让 Claude 自主训练模型以缓解对齐失败 事实摘要:Anthropic 让 Claude 自主训练模型以缓解对齐失败 事实摘要:Anthropic 让 Claude 自主训练模型以缓解对齐失败 事实摘要:Anthropic 让 Claude 自主训练模型以缓解对齐失败 事实摘要:Anthropic 让 Claude 自主训练模型以缓解。影响判断:它可能改变模型能力与工程相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程方向的选题、竞品观察和落地方案筛选。

    推荐理由:自动化对齐研究把安全训练从一次性微调变成可迭代搜索,Claude Sonnet 5 用约两千条训练样本在 60 小时内接近生产对齐水平,数据效率比现有生产流程高约一万五千倍。