跳到正文
9月4日周五
  1. Google AI:DEV 作者专属(RSS)78

    Google Cloud 教你用 Cloud Run instances 以每月 $5.70 搭建常驻 Agent

    事实摘要:Google Cloud 教你用 Cloud Run instances 以每月 $5.70 搭建常驻 Agent 事实摘要:Google Cloud 教你用 Cloud Run instances 以每月 $5.70 搭建常驻 Agent 事实摘要:Google Cloud 教你用 Cloud Run instances 以每月 $5.70 搭建常驻 Ag。影响判断:它可能改变智能体工作流相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流方向的选题、竞品观察和落地方案筛选。

    推荐理由:原文给出在 Cloud Run instances 上以每月 $5.70 常驻运行 Agent 的完整部署步骤和适用边界,方法可直接迁移到其他后台 Agent 场景。

9月3日周四
  1. IT之家 AI70

    谷歌 DeepMind 发布 WeatherNext 3:分辨率最高 5 公里,号称全球最先进、精准 AI 天气预报模型

    IT之家 9 月 3 日消息,谷歌 DeepMind 和 Google Research 今天宣布推出 WeatherNext 3 ,号称是目前最先进、最准确的全球气象模型。该模型可直接从实时观测中学习,能够为影响人类的天气事件提供更及时、更本地化的预测。 该模型可以原始卫星数据为基础,每小时生成一次高分辨率预报,为全球谷歌产品提供可靠的天气预报。 根据介绍,天气预报的实用性往往取决于细节,以及时间和空间的分辨率。WeatherNext 3 可生成多种空间分辨率的每小时预报,从广阔的全球风型到局部地形都能保持物理一致性。 借助 WeatherNext 3,谷歌能够以 5 公里分辨率呈现温度、湿度等关键地表变量,其他地表变量分辨率为 10 公里,风速等大气变量分辨率为 25 公里。 WeatherNext 3 通过接入 实时全球地球静止卫星数据拼图 ,让模型能够获得丰富、持续更新的大气视图,使模型可以每小时生成一次新预报,每次预报...

    推荐理由:来自IT之家 AI的《谷歌 DeepMind 发布 WeatherNext 3:分辨率最高 5 公里,号称全球最先进、精准 AI 天气预报模型》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 3 日消息,谷歌 DeepMind 和 Google Research 今天宣布推出 WeatherNext 3 ,号称是目前最先进、最准确的全球气象模型。该模型可直接从实时观测中学习,能够为影响人类的天气事件提供更及时、更本地化的预测。 该模型可以原始卫星数据为基础,每小时生成一次高分辨率预报,为全球谷歌产品提供可靠的天气预报。 根据介绍,天气预报的实用性往往取决于细节,以及时间和空间的分辨率。WeatherNext 3 可生成多种空间分辨率的每小时预报,从广阔的全球风型到局部地形都能保持物理一致性。 借助 WeatherNext 3,谷歌能够以 5 公里分辨率呈现温度、湿度等关键地表变量,其他地表变量分辨率为 10 公里,风速等大气变量分辨率为 25 公里。 WeatherNext 3 通过接入 实时全球地球静止卫星数据拼图 ,让模型能够获得丰富、持续更新的大气视图,使模型可以每小时生成一次新预报,每次预报...

  2. IT之家 AI68

    沙特 HUMAIN 公布前沿阿语模型 humain-m3,由 MiniMax 受托开发

    IT之家 9 月 3 日消息,沙特阿拉伯主权财富基金 PIF 旗下人工智能企业 HUMAIN 当地时间今日公布了前沿阿拉伯语模型 humain-m3。 该模型由 MiniMax 受托开发 。 humain-m3 基于 MiniMax 自家 MiniMax-M3 构建,并进行了 T 级阿拉伯语原生文本 Token(词元)规模的预训练。 其在 7 个公开的阿拉伯语基准测试中取得了参测前沿模型中的最高平均分 。 humain-m3 率先在 HUMAIN Node 平台以研究和评估预览版本提供。HUMAIN 后续将发布开放权重版本。 HUMAIN 首席执行官 Tareq Amin 表示: 阿拉伯语的使用人口达数亿, 但在人工智能前沿领域 , 它的代表性仍然严重不足 。我们正通过 humain-m3 项目来改变这一现状。同时,通过 HUMAIN Node,我们将这种智能技术开放给开发者、研究人员和创新者,让他们能够进行实验、在此基础上进行...

    推荐理由:来自IT之家 AI的《沙特 HUMAIN 公布前沿阿语模型 humain-m3,由 MiniMax 受托开发》。重点看模型能力与工程、评测与基准、产品发布。摘要提到:IT之家 9 月 3 日消息,沙特阿拉伯主权财富基金 PIF 旗下人工智能企业 HUMAIN 当地时间今日公布了前沿阿拉伯语模型 humain-m3。 该模型由 MiniMax 受托开发 。 humain-m3 基于 MiniMax 自家 MiniMax-M3 构建,并进行了 T 级阿拉伯语原生文本 Token(词元)规模的预训练。 其在 7 个公开的阿拉伯语基准测试中取得了参测前沿模型中的最高平均分 。 humain-m3 率先在 HUMAIN Node 平台以研究和评估预览版本提供。HUMAIN 后续将发布开放权重版本。 HUMAIN 首席执行官 Tareq Amin 表示: 阿拉伯语的使用人口达数亿, 但在人工智能前沿领域 , 它的代表性仍然严重不足 。我们正通过 humain-m3 项目来改变这一现状。同时,通过 HUMAIN Node,我们将这种智能技术开放给开发者、研究人员和创新者,让他们能够进行实验、在此基础上进行...

  3. GitHub Changelog51

    CodeQL 2.26.4 improves GitHub actions security detections

    事实摘要:这条英文动态主要涉及开源生态,原文信息显示:CodeQL 2.26.4 improves GitHub actions security detections 事实摘要:这条英文动态主要涉及开源生态,原文信息显示:CodeQL 2.26.4 improves GitHub actions security detections 事实摘要:这条英文动态主要涉及。影响判断:它可能改变开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  4. OpenAI News83

    Daybreak for Frontline Defenders: $1B to protect essential services

    事实摘要:OpenAI introduces Daybreak for Frontline Defenders.。影响判断:It may change the way we evaluate model capabilities and engineering related products, research schedules or content production methods.。场景价值:Tracking model capabilities and engineering direction of frontier cyber AI services。

    推荐理由:This dynamic highlights the potential impact on how we assess and develop models for essential services.

  5. Hugging Face:Blog(RSS)84

    Hugging Face 发布开源工具 funes,为编码智能体提供可本地持有的记忆层

    事实摘要:Hugging Face 发布开源工具 funes,为编码智能体提供可本地持有的记忆层 事实摘要:Hugging Face 发布开源工具 funes,为编码智能体提供可本地持有的记忆层 事实摘要:Hugging Face 发布开源工具 funes,为编码智能体提供可本地持有的记忆层 事实摘要:Hugging Face 发布开源工具 funes,为编码智能体提。影响判断:它可能改变智能体工作流、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:原文给出本地记忆层的检索机制、跨 Agent 复用方式,以及召回比压缩和交接更省成本的基准数字,方法可直接复用。

  6. 量子位36

    世界生成模型来了3D头部玩家,可进入生产管线的场景级生成时代来临!

    单图直出场景,顶会最佳论文落地 这条动态来自 量子位,可重点关注模型能力与工程。

    推荐理由:来自量子位的《世界生成模型来了3D头部玩家,可进入生产管线的场景级生成时代来临!》。重点看模型能力与工程。摘要提到:单图直出场景,顶会最佳论文落地 这条动态来自 量子位,可重点关注模型能力与工程。

  7. IT之家 AI76

    OpenAI 首席科学家回应“AI 推理不透明”争议:复杂度未跳跃增长

    IT之家 9 月 3 日消息,OpenAI 首席科学家雅库布・帕乔基(Jakub Pachocki)昨日(9 月 2 日)在 X 平台发布推文, 回应 AI 模型 Astra“不可监控 / 推理不透明”的争议。 帕乔基强调,包括 Astra 在内的前沿模型,计算图深度与 GPT-4 相差不超过两倍,架构并未出现跳跃式复杂度增长。OpenAI 表示将为 Astra 部署额外思维链监控,加强监控仍是当前研究核心目标。 该事件最早追溯到 The Information 媒体的深度报道,透露 OpenAI 公司正在测试“深度循环”(recurrent depth)技术,可能导致研究人员更难解释模型的“思维链”(Chain-of-Thought)推理过程。 在技术路线方面,包括 ChatGPT、Claude 和 Gemini 等主流模型在内,大部分都基于 Transformer 架构。此类模型通常按线性步骤处理信息,并可在部分场景下用自然...

    推荐理由:来自IT之家 AI的《OpenAI 首席科学家回应“AI 推理不透明”争议:复杂度未跳跃增长》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 3 日消息,OpenAI 首席科学家雅库布・帕乔基(Jakub Pachocki)昨日(9 月 2 日)在 X 平台发布推文, 回应 AI 模型 Astra“不可监控 / 推理不透明”的争议。 帕乔基强调,包括 Astra 在内的前沿模型,计算图深度与 GPT-4 相差不超过两倍,架构并未出现跳跃式复杂度增长。OpenAI 表示将为 Astra 部署额外思维链监控,加强监控仍是当前研究核心目标。 该事件最早追溯到 The Information 媒体的深度报道,透露 OpenAI 公司正在测试“深度循环”(recurrent depth)技术,可能导致研究人员更难解释模型的“思维链”(Chain-of-Thought)推理过程。 在技术路线方面,包括 ChatGPT、Claude 和 Gemini 等主流模型在内,大部分都基于 Transformer 架构。此类模型通常按线性步骤处理信息,并可在部分场景下用自然...

  8. 爱范儿50

    能让谷歌逆风翻盘的AI,可能不是 Gemini

    事实摘要:能让谷歌逆风翻盘的AI,可能不是 Gemini 无人在意的角落,Google 让视频像网页一样可以被灵魂拷问了 #欢迎关注爱范儿官方微信公众号:爱范儿(微信号:ifanr),更多精彩内容第一时间为您奉上。 这条动态来自 爱范儿,可重点关注其对 AI 应用和产业节奏的影响。 能让谷歌逆风翻盘的AI,可能不是 Gemini 无人在意的角落,Google 让视频像。影响判断:它可能改变AI 应用价值相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪AI 应用价值方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和AI 应用价值直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  9. IT之家 AI68

    Anthropic 升级 Claude Code / Cowork,可后台操控用户 Mac

    IT之家 9 月 3 日消息,Anthropic 今天(9 月 3 日)在 X 平台发布推文, 宣布升级 Claude Cowork 和 Claude Code 的电脑控制功能,可以在后台操控用户 Mac。 在适配要求方面,官方要求使用 macOS 15 以及更高系统版本,桌面必须保持唤醒状态,Claude Desktop 应用需保持打开。IT之家附上相关截图如下: 在本次更新之后,在 macOS 平台上,用户在处理其它工作的同时,Claude 可以在后台通过屏幕交互完成点击、输入和导航操作。如需 Claude 接管全屏,可在设置中调整为“完全控制”模式。 该功能同时服务于 Claude Cowork 和 Claude Code 两个产品。Cowork 面向文档处理、文件整理、研究综合等知识工作,Code 专注开发任务。 目前仅限 Pro 和 Max 个人订阅用户,Team 和 Enterprise 计划尚未开放。Linux 版...

    推荐理由:来自IT之家 AI的《Anthropic 升级 Claude Code / Cowork,可后台操控用户 Mac》。重点看产品发布。摘要提到:IT之家 9 月 3 日消息,Anthropic 今天(9 月 3 日)在 X 平台发布推文, 宣布升级 Claude Cowork 和 Claude Code 的电脑控制功能,可以在后台操控用户 Mac。 在适配要求方面,官方要求使用 macOS 15 以及更高系统版本,桌面必须保持唤醒状态,Claude Desktop 应用需保持打开。IT之家附上相关截图如下: 在本次更新之后,在 macOS 平台上,用户在处理其它工作的同时,Claude 可以在后台通过屏幕交互完成点击、输入和导航操作。如需 Claude 接管全屏,可在设置中调整为“完全控制”模式。 该功能同时服务于 Claude Cowork 和 Claude Code 两个产品。Cowork 面向文档处理、文件整理、研究综合等知识工作,Code 专注开发任务。 目前仅限 Pro 和 Max 个人订阅用户,Team 和 Enterprise 计划尚未开放。Linux 版...

  10. 量子位36

    神秘具身团队又放出一连串很炸的Demo视频…自进化模型,技术路线曝光

    事实摘要:神秘具身团队又放出一连串很炸的Demo视频…自进化模型,技术路线曝光 神秘具身团队又放出一连串很炸的Demo视频…自进化模型,技术路线曝光 这条动态来自 量子位,可重点关注模型能力与工程。 神秘具身团队又放出一连串很炸的Demo视频…自进化模型,技术路线曝光。影响判断:它可能改变模型能力与工程相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和模型能力与工程直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  11. IT之家 AI70

    探索太阳风暴早期预警:AI 提前 9.24 小时捕捉太阳活动区信号

    IT之家 9 月 3 日消息,科技媒体 SciTech 昨日(9 月 2 日)发布博文,报道称由美国新泽西理工学院(NJIT)牵头的科研团队发布最新研究, 成功打造出机器学习模型 EarlyDetect,可从太阳声学活动和磁场变化中识别活动区形成前兆。 IT之家援引博文介绍,太阳活动区是太阳表面磁场强烈的区域,太阳黑子通常在其中形成。活动区开始浮现可能只需数小时,但完整发展过程通常需要 1 到数天。研究人员希望利用更早的信号,为空间天气预报提供补充信息。 EarlyDetect 模型采用 Transformer 架构,处理连续的太阳观测数据,分析美国国家航空航天局(NASA)太阳动力学观测台(SDO)搭载的日震与磁成像仪(HMI)数据。 HMI 记录的太阳振动观测时间间隔为 45 秒,研究团队据此生成声学功率图,再与磁场测量结果结合,预测连续强度变化,性能最佳的版本平均提前 9.24 小时识别活动区即将出现的信号。 该可视化案例...

    推荐理由:来自IT之家 AI的《探索太阳风暴早期预警:AI 提前 9.24 小时捕捉太阳活动区信号》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 3 日消息,科技媒体 SciTech 昨日(9 月 2 日)发布博文,报道称由美国新泽西理工学院(NJIT)牵头的科研团队发布最新研究, 成功打造出机器学习模型 EarlyDetect,可从太阳声学活动和磁场变化中识别活动区形成前兆。 IT之家援引博文介绍,太阳活动区是太阳表面磁场强烈的区域,太阳黑子通常在其中形成。活动区开始浮现可能只需数小时,但完整发展过程通常需要 1 到数天。研究人员希望利用更早的信号,为空间天气预报提供补充信息。 EarlyDetect 模型采用 Transformer 架构,处理连续的太阳观测数据,分析美国国家航空航天局(NASA)太阳动力学观测台(SDO)搭载的日震与磁成像仪(HMI)数据。 HMI 记录的太阳振动观测时间间隔为 45 秒,研究团队据此生成声学功率图,再与磁场测量结果结合,预测连续强度变化,性能最佳的版本平均提前 9.24 小时识别活动区即将出现的信号。 该可视化案例...

  12. Tomer Tunguz86

    The Ads Model for Prompts Vertically Integrates AI

    事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程,原文信息显示:The Ads Model for Prompts Vertically Integrates AI 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程,原文信息显示:The Ads Model for Prompts Vertically Integrates AI 事实摘要:这条英文。影响判断:它可能改变智能体工作流、模型能力与工程相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  13. GitHub Changelog88

    Enterprise-managed settings support any default model

    事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:Enterprise-managed settings support any default model 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:Enterprise-managed settings support any default。影响判断:它可能改变智能体工作流、模型能力与工程、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程、开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  14. GitHub Changelog83

    Content exclusions generally available in Copilot app and CLI

    事实摘要:这条英文动态主要涉及开源生态,原文信息显示:Content exclusions generally available in Copilot app and CLI 事实摘要:这条英文动态主要涉及开源生态,原文信息显示:Content exclusions generally available in Copilot app and CLI 事实摘要:这条。影响判断:它可能改变开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  15. Google AI:DEV 作者专属(RSS)82

    Google AI 团队分享如何为 LLM-as-a-Judge 评测编写可靠的评分标准

    事实摘要:Google AI 团队分享如何为 LLM-as-a-Judge 评测编写可靠的评分标准 事实摘要:Google AI 团队分享如何为 LLM-as-a-Judge 评测编写可靠的评分标准 事实摘要:Google AI 团队分享如何为 LLM-as-a-Judge 评测编写可靠的评分标准 事实摘要:Google AI 团队分享如何为 LLM-as-a-Jud。影响判断:它可能改变模型能力与工程、评测与基准相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程、评测与基准方向的选题、竞品观察和落地方案筛选。

    推荐理由:作者来自 Google 团队,把写作 LLM-as-a-judge 评分标准的经验整理成四条可迁移规则,附带校准流程,适合自己搭建评测时参考。

  16. Claude:Blog(网页)84

    Anthropic 发布 Claude 电商智能体构建指南及参考实现

    事实摘要:Anthropic 发布 Claude 电商智能体构建指南及参考实现 事实摘要:Anthropic 发布 Claude 电商智能体构建指南及参考实现 事实摘要:Anthropic 发布 Claude 电商智能体构建指南及参考实现 事实摘要:Anthropic 发布 Claude 电商智能体构建指南及参考实现 事实摘要:Anthropic 发布 Claude 。影响判断:它可能改变智能体工作流、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:Anthropic 根据多个企业部署经验总结电商智能体架构、延迟成本优化和生产实践,并附参考实现,可迁移到类似 Agent 项目。

  17. Google AI:DEV 作者专属(RSS)78

    什么是 harness 工程?Google 用 ADK 2.0 与 Antigravity SDK 演示自动修复编码循环

    事实摘要:什么是 harness 工程?Google 用 ADK 2.0 与 Antigravity SDK 演示自动修复编码循环 事实摘要:什么是 harness 工程?Google 用 ADK 2.0 与 Antigravity SDK 演示自动修复编码循环 事实摘要:什么是 harness 工程?Google 用 ADK 2.0 与 Antigravity SD。影响判断:它可能改变智能体工作流、模型能力与工程相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程方向的选题、竞品观察和落地方案筛选。

    推荐理由:原文解释了 harness 工程的构成要素,并给出可运行的沙箱与修复循环示例代码,方法可直接迁移到自己的 Agent 工作流。

9月2日周三
  1. IT之家 AI36

    科学家疑似探测到暗物质首个直接证据,待进一步验证

    IT之家 9 月 2 日消息,科学家近日报告称,他们可能探测到了暗物质的首个直接证据。如果这一发现最终得到证实,将可能成为一项突破性成果。此次潜在探测来自 LUX-ZEPLIN 实验,研究人员发现了一个疑似由弱相互作用大质量粒子(WIMP)与普通物质粒子发生相互作用产生的事件。WIMP 是目前暗物质最主要的假想粒子候选者之一。 暗物质一直是困扰科学家的难题。尽管暗物质约占宇宙总质量的 85%,但科学家至今仍不知道它究竟是什么。由于暗物质不会与电磁辐射,也就是光发生相互作用,因此它不可能由电子、质子和中子构成。电子、质子和中子正是组成原子的基本粒子,而原子又构成了恒星、行星、卫星、人体以及我们日常生活中能够看到的一切物体。 这也推动科学家寻找超越所谓“粒子物理学标准模型”的新型粒子。遗憾的是,到目前为止,这项搜索始终没有取得令人信服的结果。不过,LUX-ZEPLIN 实验或许终于捕捉到了重要线索。 研究人员分析了 LUX-ZEPL...

    推荐理由:来自IT之家 AI的《科学家疑似探测到暗物质首个直接证据,待进一步验证》。重点看模型能力与工程。摘要提到:IT之家 9 月 2 日消息,科学家近日报告称,他们可能探测到了暗物质的首个直接证据。如果这一发现最终得到证实,将可能成为一项突破性成果。此次潜在探测来自 LUX-ZEPLIN 实验,研究人员发现了一个疑似由弱相互作用大质量粒子(WIMP)与普通物质粒子发生相互作用产生的事件。WIMP 是目前暗物质最主要的假想粒子候选者之一。 暗物质一直是困扰科学家的难题。尽管暗物质约占宇宙总质量的 85%,但科学家至今仍不知道它究竟是什么。由于暗物质不会与电磁辐射,也就是光发生相互作用,因此它不可能由电子、质子和中子构成。电子、质子和中子正是组成原子的基本粒子,而原子又构成了恒星、行星、卫星、人体以及我们日常生活中能够看到的一切物体。 这也推动科学家寻找超越所谓“粒子物理学标准模型”的新型粒子。遗憾的是,到目前为止,这项搜索始终没有取得令人信服的结果。不过,LUX-ZEPLIN 实验或许终于捕捉到了重要线索。 研究人员分析了 LUX-ZEPL...

  2. IT之家 AI68

    美光探索近 GPU NAND 闪存,可支撑更大规模 AI 模型

    IT之家 9 月 2 日消息,据 DigiTimes 今天报道,美光正在研究高耐久性 NAND 闪存模块,该公司计划将其部署在距离 GPU 更近的位置,而不是像传统存储方案那样,通过多个协议连接到距 GPU 较远的存储池。 据报道,美光正在探索如何将 NAND 闪存进一步靠近 GPU,希望在存储密度和耐久性之间提供一种折中方案。这种产品当前被称为“近 GPU NAND”(IT之家注:near-GPU NAND),可用于处理非低延迟 / 高带宽工作负载。 这种方案可以让 GPU 直接访问数百 GB 的 NAND 存储池, 它可以直接放置在 GPU 封装内部或 PCB ,工作方式类似 HBM、GDDR7 等方案。与传统 TLC 或 QLC NAND 相比, 这种 NAND 芯片的存储密度更低 ,重点在于提升 I/O 速度、带宽。 该存储层位于显存和普通存储之间,可充当高速缓冲层,因此特别适合运行更大规模的 AI 大语言模型。该方案落...

    推荐理由:来自IT之家 AI的《美光探索近 GPU NAND 闪存,可支撑更大规模 AI 模型》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 2 日消息,据 DigiTimes 今天报道,美光正在研究高耐久性 NAND 闪存模块,该公司计划将其部署在距离 GPU 更近的位置,而不是像传统存储方案那样,通过多个协议连接到距 GPU 较远的存储池。 据报道,美光正在探索如何将 NAND 闪存进一步靠近 GPU,希望在存储密度和耐久性之间提供一种折中方案。这种产品当前被称为“近 GPU NAND”(IT之家注:near-GPU NAND),可用于处理非低延迟 / 高带宽工作负载。 这种方案可以让 GPU 直接访问数百 GB 的 NAND 存储池, 它可以直接放置在 GPU 封装内部或 PCB ,工作方式类似 HBM、GDDR7 等方案。与传统 TLC 或 QLC NAND 相比, 这种 NAND 芯片的存储密度更低 ,重点在于提升 I/O 速度、带宽。 该存储层位于显存和普通存储之间,可充当高速缓冲层,因此特别适合运行更大规模的 AI 大语言模型。该方案落...

  3. IT之家 AI66

    研究发现:AI 客服“更像人”未必带来更佳体验

    IT之家 9 月 2 日消息,如今,各行各业的许多机构都在投入使用越来越像真人的 AI,用它们回答问题、排查故障和处理投诉。 澳大利亚联邦银行(Commonwealth Bank)最近透露,其 AI 客服平台每月通过语音和消息渠道处理超过 200 万次对话。 澳大利亚邮政(Australia Post)也表示,2025 年有 55% 的客户咨询得到了自助式 AI 的支持。 这种趋势背后的逻辑看起来很简单:出了问题时,消费者已经习惯向真人寻求帮助。如果 AI 能够以更加自然的方式交流,那么让它承担部分传统人工客服的职责似乎顺理成章。但一项研究表明,实际情况要复杂得多。 如今客服 AI 越来越多地采用语音交互和对话式设计,背后其实存在一个假设,那就是消费者更喜欢类似人与人之间交流的互动方式。 《澳大利亚联络中心行业基准报告》显示,当消费者被告知自己的问题可以得到解决时,27% 的人首选电话,而选择网页聊天的比例为 12%。 但这并不...

    推荐理由:来自IT之家 AI的《研究发现:AI 客服“更像人”未必带来更佳体验》。重点看评测与基准。摘要提到:IT之家 9 月 2 日消息,如今,各行各业的许多机构都在投入使用越来越像真人的 AI,用它们回答问题、排查故障和处理投诉。 澳大利亚联邦银行(Commonwealth Bank)最近透露,其 AI 客服平台每月通过语音和消息渠道处理超过 200 万次对话。 澳大利亚邮政(Australia Post)也表示,2025 年有 55% 的客户咨询得到了自助式 AI 的支持。 这种趋势背后的逻辑看起来很简单:出了问题时,消费者已经习惯向真人寻求帮助。如果 AI 能够以更加自然的方式交流,那么让它承担部分传统人工客服的职责似乎顺理成章。但一项研究表明,实际情况要复杂得多。 如今客服 AI 越来越多地采用语音交互和对话式设计,背后其实存在一个假设,那就是消费者更喜欢类似人与人之间交流的互动方式。 《澳大利亚联络中心行业基准报告》显示,当消费者被告知自己的问题可以得到解决时,27% 的人首选电话,而选择网页聊天的比例为 12%。 但这并不...

  4. IT之家 AI76

    Kimi API 已原生支持 Codex 和 Claude Code

    事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程,原文信息显示:Kimi API 已原生支持 Codex 和 Claude Code IT之家 9 月 2 日消息,月之暗面宣布,为满足大家在 Codex 和 Claude Code 中接入 Kimi API 的需求,Kimi API 现已支持 OpenAI 的 Responses API 格式,base_ur。影响判断:它可能改变智能体工作流、模型能力与工程相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  5. IT之家 AI36

    月球藏着超新星遗迹:新模型揭示放射性星尘在月壤中的踪迹

    IT之家 9 月 2 日消息,就像散落在泥土中的闪粉一样,月球表面也遍布着来自超新星爆炸的放射性残骸。 如今,科学家已经能够将月球尘土中混杂的超新星尘埃分离出来。这得益于一种全新的计算机模型。该模型让月球表面成为一座“时间胶囊”,帮助科学家了解太阳系在绕银河系运行并穿越太空的过程中,地球附近曾发生过哪些超新星爆炸。 恒星以超新星形式爆炸时,会向宇宙空间喷射大量碎片,其中一些是以极高速度运动的放射性同位素。这些放射性同位素中的一部分会进入太阳系,并最终落到包括地球和月球在内的各个行星和卫星上。科学家对地球深海沉积物中的放射性同位素进行研究,同时分析阿波罗任务带回的月球土壤样本 —— 科学家称其为“月壤”(regolith),发现超新星活动可能在 230 万年前和 730 万年前出现过两次明显的高峰。 “如果我们掌握了解读星尘的方法,那么过去恒星留下的残骸就能够帮助我们探索地月附近区域漫长而浩瀚的历史,我认为这是一件非常美妙的事情。...

    推荐理由:来自IT之家 AI的《月球藏着超新星遗迹:新模型揭示放射性星尘在月壤中的踪迹》。重点看模型能力与工程。摘要提到:IT之家 9 月 2 日消息,就像散落在泥土中的闪粉一样,月球表面也遍布着来自超新星爆炸的放射性残骸。 如今,科学家已经能够将月球尘土中混杂的超新星尘埃分离出来。这得益于一种全新的计算机模型。该模型让月球表面成为一座“时间胶囊”,帮助科学家了解太阳系在绕银河系运行并穿越太空的过程中,地球附近曾发生过哪些超新星爆炸。 恒星以超新星形式爆炸时,会向宇宙空间喷射大量碎片,其中一些是以极高速度运动的放射性同位素。这些放射性同位素中的一部分会进入太阳系,并最终落到包括地球和月球在内的各个行星和卫星上。科学家对地球深海沉积物中的放射性同位素进行研究,同时分析阿波罗任务带回的月球土壤样本 —— 科学家称其为“月壤”(regolith),发现超新星活动可能在 230 万年前和 730 万年前出现过两次明显的高峰。 “如果我们掌握了解读星尘的方法,那么过去恒星留下的残骸就能够帮助我们探索地月附近区域漫长而浩瀚的历史,我认为这是一件非常美妙的事情。...

  6. 爱范儿70

    刚刚,李飞飞掀桌!全球首个多模态世界模型发布,几张照片省掉几百个机位

    事实摘要:刚刚,李飞飞掀桌!全球首个多模态世界模型发布,几张照片省掉几百个机位 大模型理解文字,李飞飞想让 Atlas 理解空间 #欢迎关注爱范儿官方微信公众号:爱范儿(微信号:ifanr),更多精彩内容第一时间为您奉上。 这条动态来自 爱范儿,可重点关注模型能力与工程、产品发布。 刚刚,李飞飞掀桌!全球首个多模态世界模型发布,几张照片省掉几百个机位 大模型理解文字。影响判断:它可能改变模型能力与工程相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和模型能力与工程直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  7. 量子位68

    还在为大模型洗数据熬夜?蚂蚁拿下VLDB工业最佳论文,一套宽表搞定35PB语料,效率狂飙5.6倍

    事实摘要:还在为大模型洗数据熬夜?蚂蚁拿下VLDB工业最佳论文,一套宽表搞定35PB语料,效率狂飙5.6倍 蚂蚁集团推出统一宽表系统OmniTable,论文获评VLDB 2026工业赛道最佳论文 这条动态来自 量子位,可重点关注模型能力与工程。 还在为大模型洗数据熬夜?蚂蚁拿下VLDB工业最佳论文,一套宽表搞定35PB语料,效率狂飙5.6倍 蚂蚁集团推出统一宽表系统O。影响判断:它可能改变模型能力与工程相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和模型能力与工程直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  8. 量子位70

    前字节强化学习专家孙鹏博士加盟星尘智能,完善Physical AI全栈技术布局

    事实摘要:前字节强化学习专家孙鹏博士加盟星尘智能,完善Physical AI全栈技术布局 9月2日,前字节跳动强化学习专家、前腾讯Robotics X智能体中⼼负责⼈孙鹏博⼠正式加入星尘智能 这条动态来自 量子位,可重点关注智能体工作流。 前字节强化学习专家孙鹏博士加盟星尘智能,完善Physical AI全栈技术布局 9月2日,前字节跳动强化学习专家、前腾讯Robot。影响判断:它可能改变智能体工作流相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  9. Anthropic:Newsroom(网页)80

    Anthropic 发布 Claude Fable 5.1 与 Claude Mythos 5.1

    事实摘要:Anthropic 发布 Claude Fable 5.1 与 Claude Mythos 5.1 事实摘要:Anthropic 发布 Claude Fable 5.1 与 Claude Mythos 5.1 事实摘要:Anthropic 发布 Claude Fable 5.1 与 Claude Mythos 5.1 事实摘要:Anthropic 发布 Cl。影响判断:它可能改变模型能力与工程相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程方向的选题、竞品观察和落地方案筛选。

    推荐理由:官方发布给出了定价变化、基准数据和科学应用实例,读者可以据此评估新模型在编码与科研场景中的成本与能力取舍。

  10. Berkeley RDI:Blog(AI 安全与评测)78

    UC Berkeley 团队发布 Vero 基准:测试 AI 智能体能否构建形式化验证的软件仓库

    事实摘要:UC Berkeley 团队发布 Vero 基准:测试 AI 智能体能否构建形式化验证的软件仓库 事实摘要:UC Berkeley 团队发布 Vero 基准:测试 AI 智能体能否构建形式化验证的软件仓库 事实摘要:UC Berkeley 团队发布 Vero 基准:测试 AI 智能体能否构建形式化验证的软件仓库 事实摘要:UC Berkeley 团队发布 V。影响判断:它可能改变智能体工作流、评测与基准相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、评测与基准方向的选题、竞品观察和落地方案筛选。

    推荐理由:原文给出仓库级形式化验证基准的任务设计与模型成绩,读者可以据此了解智能体在代码与证明协同生成上的真实差距。

  11. 量子位66

    Claude最强Fable 5.1发布!8项屠榜,最高降价45%,反蒸馏机制上线

    事实摘要:Claude最强Fable 5.1发布!8项屠榜,最高降价45%,反蒸馏机制上线 无论你此前让Claude处理什么任务,Fable 5.1都能做更多,并且把最难的部分完成得更出色 这条动态来自 量子位,可重点关注产品发布。 Claude最强Fable 5.1发布!8项屠榜,最高降价45%,反蒸馏机制上线 无论你此前让Claude处理什么任务,Fable 5.。影响判断:它可能改变AI 应用价值相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪AI 应用价值方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和AI 应用价值直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  12. IT之家 AI64

    探究微软 Win95 开始按钮设计,出自研究黑猩猩的心理学家之手

    IT之家 9 月 2 日消息,科技媒体 Windows Latest 昨日(9 月 1 日)发布博文,围绕着 Windows 任务管理器之父戴夫・普拉默(Dave W. Plummer)的相关讨论, 溯源指出 Windows 95 的开始菜单由一位研究黑猩猩的心理学家发明的。 普拉默围绕着 Windows 系统开始菜单、任务栏的相关谈论,在 X 平台持续引发热议,IT之家此前报道,前微软企业副总裁 Joe Belfiore(乔 · 贝尔菲奥雷,中文名乔北峰)回应称,Windows 95 任务栏并非借鉴史蒂夫 · 乔布斯 NeXT 公司在 1988 年推出的 NeXTSTEP Dock。 开始菜单和任务栏的演变历程。 该媒体基于相关话题,进一步溯源指出 Windows 95 的“开始”按钮的诞生源于一场跨界实验,曾在 B.F . Skinner 实验室训练黑猩猩使用键盘设备的行为心理学家 Danny Oran,于 1992 年加入...

    推荐理由:来自IT之家 AI的《探究微软 Win95 开始按钮设计,出自研究黑猩猩的心理学家之手》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 2 日消息,科技媒体 Windows Latest 昨日(9 月 1 日)发布博文,围绕着 Windows 任务管理器之父戴夫・普拉默(Dave W. Plummer)的相关讨论, 溯源指出 Windows 95 的开始菜单由一位研究黑猩猩的心理学家发明的。 普拉默围绕着 Windows 系统开始菜单、任务栏的相关谈论,在 X 平台持续引发热议,IT之家此前报道,前微软企业副总裁 Joe Belfiore(乔 · 贝尔菲奥雷,中文名乔北峰)回应称,Windows 95 任务栏并非借鉴史蒂夫 · 乔布斯 NeXT 公司在 1988 年推出的 NeXTSTEP Dock。 开始菜单和任务栏的演变历程。 该媒体基于相关话题,进一步溯源指出 Windows 95 的“开始”按钮的诞生源于一场跨界实验,曾在 B.F . Skinner 实验室训练黑猩猩使用键盘设备的行为心理学家 Danny Oran,于 1992 年加入...

  13. Apple Machine Learning Research50

    REFACTOR-VLA: Unsupervised Library Learning of Typed Motor Programs

    事实摘要:这条英文动态主要涉及模型能力与工程,原文信息显示:REFACTOR-VLA: Unsupervised Library Learning of Typed Motor Programs 事实摘要:这条英文动态主要涉及模型能力与工程,原文信息显示:REFACTOR-VLA: Unsupervised Library Learning of Typed Moto。影响判断:它可能改变模型能力与工程相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和模型能力与工程直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  14. Simon Willison79

    Claude Fable 5.1 made me a really nice animated pelican

    事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、评测与基准,原文信息显示:Claude Fable 5.1 made me a really nice animated pelican 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、评测与基准,原文信息显示:Claude Fable 5.1 made me a really nice anim。影响判断:它可能改变智能体工作流、模型能力与工程、评测与基准相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、评测与基准方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程、评测与基准直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。