跳到正文
9月11日周五
  1. 量子位70

    墨芯人工智能亮相2026 Inclusion·外滩大会:以专用稀疏推理芯片提升算力效能,共创AI新经济

    事实摘要:墨芯人工智能亮相2026 Inclusion·外滩大会:以专用稀疏推理芯片提升算力效能,共创AI新经济 9月9日,墨芯人工智能亮相以"共创AI新经济"为主题的2026 Inclusion·外滩大会。 这条动态来自 量子位,可重点关注模型能力与工程。 墨芯人工智能亮相2026 Inclusion·外滩大会:以专用稀疏推理芯片提升算力效能,共创AI新经济 9月9。影响判断:它可能改变模型能力与工程相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和模型能力与工程直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  2. IT之家 AI72

    NS 方程争议发酵:数学家联名抗议,OpenAI 宣布退出数学黑客马拉松赞助

    北京时间 9 月 11 日,据《商业内幕》报道,OpenAI 眼下试图解决的最新数学难题,是一群愤怒的数学家。 OpenAI 一名研究员周四表示,该公司不再赞助加州理工学院的“数学黑客马拉松”。该活动让参与者使用大语言模型解决研究问题。 就在 OpenAI 退出该活动之前,加州理工学院现任和前任数学家于周三发布了一封公开信,称这项由 AI 公司赞助的活动“可能对数学界产生破坏性影响”。 OpenAI 研究负责人丹 · 罗伯茨 (Dan Roberts) 表示:“我们认识到 AI 在数学领域的快速进展具有颠覆性。我们希望能与数学界更多接触,探讨如何最好地整合这项技术并传达其影响。” Anthropic 和 OpenAI 同意通过捐赠价值 200 万美元的 AI 使用额度来支持这项活动。截至周四,尚不清楚其中有多少词元由 OpenAI 提供,以及这些词元现在将如何处理。 数学家们的公开信 数学家们指出,问题在于,AI 公司宣称用其模...

    推荐理由:来自IT之家 AI的《NS 方程争议发酵:数学家联名抗议,OpenAI 宣布退出数学黑客马拉松赞助》。重点看模型能力与工程、产品发布。摘要提到:北京时间 9 月 11 日,据《商业内幕》报道,OpenAI 眼下试图解决的最新数学难题,是一群愤怒的数学家。 OpenAI 一名研究员周四表示,该公司不再赞助加州理工学院的“数学黑客马拉松”。该活动让参与者使用大语言模型解决研究问题。 就在 OpenAI 退出该活动之前,加州理工学院现任和前任数学家于周三发布了一封公开信,称这项由 AI 公司赞助的活动“可能对数学界产生破坏性影响”。 OpenAI 研究负责人丹 · 罗伯茨 (Dan Roberts) 表示:“我们认识到 AI 在数学领域的快速进展具有颠覆性。我们希望能与数学界更多接触,探讨如何最好地整合这项技术并传达其影响。” Anthropic 和 OpenAI 同意通过捐赠价值 200 万美元的 AI 使用额度来支持这项活动。截至周四,尚不清楚其中有多少词元由 OpenAI 提供,以及这些词元现在将如何处理。 数学家们的公开信 数学家们指出,问题在于,AI 公司宣称用其模...

  3. 量子位66

    量子位「MEET2027智能未来大会」启动!年度榜单征集进行中

    事实摘要:量子位「MEET2027智能未来大会」启动!年度榜单征集进行中 今年12月,北京,MEET2027智能未来大会! 这条动态来自 量子位,可重点关注其对 AI 应用和产业节奏的影响。 量子位「MEET2027智能未来大会」启动!年度榜单征集进行中 今年12月,北京,MEET2027智能未来大会!。影响判断:它可能改变AI 应用价值相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪AI 应用价值方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和AI 应用价值直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  4. 量子位68

    OpenAI这是拿千禧年难题当Benchmark刷啊。。。

    事实摘要:OpenAI这是拿千禧年难题当Benchmark刷啊。。。 爆料直指霍奇猜想 这条动态来自 量子位,可重点关注评测与基准。 OpenAI这是拿千禧年难题当Benchmark刷啊。。。 爆料直指霍奇猜想。影响判断:它可能改变评测与基准相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪评测与基准方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和评测与基准直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  5. Simon Willison40

    github-to-sqlite 2.9.1

    事实摘要:github-to-sqlite 2.9.1 事实摘要:github-to-sqlite 2.9.1 事实摘要:github-to-sqlite 2.9.1 事实摘要:github-to-sqlite 2.9.1 事实摘要:github-to-sqlite 2.9.1 事实摘要:这条英文动态主要涉及开源生态,原文信息显示:github-to-sqlite 2。影响判断:它可能改变开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  6. Apple Machine Learning Research52

    SimpleDesign: A Joint Model for Protein Sequence and Structure Codesign

    事实摘要:这条英文动态主要涉及模型能力与工程,原文信息显示:SimpleDesign: A Joint Model for Protein Sequence and Structure Codesign 事实摘要:这条英文动态主要涉及模型能力与工程,原文信息显示:SimpleDesign: A Joint Model for Protein Sequence and 。影响判断:它可能改变模型能力与工程相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和模型能力与工程直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  7. Cursor Blog76

    Cursor 推出 Projects:协调者智能体管理数千个子智能体处理大型开发任务

    事实摘要:Cursor 推出 Projects:协调者智能体管理数千个子智能体处理大型开发任务 事实摘要:Cursor 推出 Projects:协调者智能体管理数千个子智能体处理大型开发任务 事实摘要:Cursor 推出 Projects:协调者智能体管理数千个子智能体处理大型开发任务 事实摘要:Cursor 推出 Projects:协调者智能体管理数千个子智能体处理。影响判断:它可能改变智能体工作流相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流方向的选题、竞品观察和落地方案筛选。

    推荐理由:官方介绍 Projects 的三项核心能力,并给出内部使用数据,读者可据此判断它适合什么规模的工作。

  8. IT之家 AI72

    OpenAI 推出金融服务版 ChatGPT:集成 GPT-6 Astra 内置金融数据与细粒度引用,支持估值模型与研究报告

    IT之家 9 月 11 日消息,OpenAI 于当地时间 9 月 10 日宣布推出 ChatGPT for Financial Services。 这是一款面向金融服务团队的定制化 ChatGPT 服务,结合内置金融数据与 GPT-6 Astra 推理能力,旨在帮助金融团队开展研究、财务建模并制作定制客户材料。该产品目前已向符合条件的金融机构开放。 据介绍,该产品由 OpenAI 与摩根士丹利、Evercore 联合开发,初期重点面向投资银行和股票研究场景。 OpenAI 表示,合作过程中发现,金融团队面临的主要问题包括可靠获取数据,以及将分析结果制作成高质量工作材料。 该服务内置 Daloopa、PitchBook、LSEG News 和 Crunchbase 等数据提供商的金融数据,涵盖财报电话会、财务报表、公司基本面及私营企业信息。相关数据由 OpenAI 索引并托管,用户可在分析过程中追溯具体数据和结论的来源。 Open...

    推荐理由:来自IT之家 AI的《OpenAI 推出金融服务版 ChatGPT:集成 GPT-6 Astra 内置金融数据与细粒度引用,支持估值模型与研究报告》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 11 日消息,OpenAI 于当地时间 9 月 10 日宣布推出 ChatGPT for Financial Services。 这是一款面向金融服务团队的定制化 ChatGPT 服务,结合内置金融数据与 GPT-6 Astra 推理能力,旨在帮助金融团队开展研究、财务建模并制作定制客户材料。该产品目前已向符合条件的金融机构开放。 据介绍,该产品由 OpenAI 与摩根士丹利、Evercore 联合开发,初期重点面向投资银行和股票研究场景。 OpenAI 表示,合作过程中发现,金融团队面临的主要问题包括可靠获取数据,以及将分析结果制作成高质量工作材料。 该服务内置 Daloopa、PitchBook、LSEG News 和 Crunchbase 等数据提供商的金融数据,涵盖财报电话会、财务报表、公司基本面及私营企业信息。相关数据由 OpenAI 索引并托管,用户可在分析过程中追溯具体数据和结论的来源。 Open...

  9. GitHub Changelog85

    GitHub Copilot weekly releases — September 7

    事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:GitHub Copilot weekly releases — September 7 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:GitHub Copilot weekly releases — September 7 事实摘要:这条英文动态。影响判断:它可能改变智能体工作流、模型能力与工程、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程、开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  10. GitHub Blog AI86

    GitHub Copilot app for Beginners: Using the diff, terminal, and browser

    事实摘要:这条英文动态主要涉及智能体工作流、开源生态,原文信息显示:GitHub Copilot app for Beginners: Using the diff, terminal, and browser 这条英文动态主要涉及智能体工作流、开源生态。原文要点:Checking agent-generated code usually means hopping 。影响判断:它可能改变智能体工作流、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  11. TechCrunch:AI(RSS)80

    Anthropic 报告指控阿里、月之暗面与 DeepSeek 对 Claude 发起蒸馏攻击

    事实摘要:Anthropic 报告指控阿里、月之暗面与 DeepSeek 对 Claude 发起蒸馏攻击 事实摘要:Anthropic 报告指控阿里、月之暗面与 DeepSeek 对 Claude 发起蒸馏攻击 事实摘要:Anthropic 报告指控阿里、月之暗面与 DeepSeek 对 Claude 发起蒸馏攻击 事实摘要:Anthropic 报告指控阿里、月之暗面。影响判断:它可能改变AI 应用价值相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪AI 应用价值方向的选题、竞品观察和落地方案筛选。

    推荐理由:报告首次由当事方系统披露蒸馏攻击的规模与手法,读者可以据此了解前沿模型能力外流的具体路径。

  12. OpenAI:官网动态(RSS · 排除企业/客户案例)82

    OpenAI 发布 Agents API 公测版

    事实摘要:OpenAI 发布 Agents API 公测版 事实摘要:OpenAI 发布 Agents API 公测版 事实摘要:OpenAI 发布 Agents API 公测版 事实摘要:OpenAI 发布 Agents API 公测版 事实摘要:OpenAI 发布 Agents API 公测版 事实摘要:OpenAI 发布 Agents API 公测版 事实摘要:。影响判断:它可能改变智能体工作流相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流方向的选题、竞品观察和落地方案筛选。

    推荐理由:原文给出环境选择、子智能体和上下文管理等具体能力与定价方式,读者可据此评估是否迁移现有 Agent 基础设施。

  13. Anthropic:Research(发表成果 · 网页)80

    Anthropic 红队评测 AI 模型的战术情报定位与常规武器开发能力

    事实摘要:Anthropic 红队评测 AI 模型的战术情报定位与常规武器开发能力 事实摘要:Anthropic 红队评测 AI 模型的战术情报定位与常规武器开发能力 事实摘要:Anthropic 红队评测 AI 模型的战术情报定位与常规武器开发能力 事实摘要:Anthropic 红队评测 AI 模型的战术情报定位与常规武器开发能力 事实摘要:Anthropic 红队。影响判断:它可能改变模型能力与工程、评测与基准相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程、评测与基准方向的选题、竞品观察和落地方案筛选。

    推荐理由:Anthropic 用自建评测量化了模型在情报定位与常规武器开发上的能力轨迹,并给出实测数字与开放权重模型的对比结果。

  14. OpenAI:官网动态(RSS · 排除企业/客户案例)82

    OpenAI 在 API 中推出全双工语音模型 GPT-Live-1

    事实摘要:OpenAI 在 API 中推出全双工语音模型 GPT-Live-1 事实摘要:OpenAI 在 API 中推出全双工语音模型 GPT-Live-1 事实摘要:OpenAI 在 API 中推出全双工语音模型 GPT-Live-1 事实摘要:OpenAI 在 API 中推出全双工语音模型 GPT-Live-1 事实摘要:OpenAI 在 API 中推出全双工语。影响判断:它可能改变模型能力与工程相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程方向的选题、竞品观察和落地方案筛选。

    推荐理由:原文给出单模型全双工语音架构、基准变化和定价,读者可以据此评估它能否简化现有语音 Agent 的分层方案。

  15. GitHub Changelog92

    MAI-Code-1-Flash deprecated

    事实摘要:MAI-Code-1-Flash deprecated 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:MAI-Code-1-Flash deprecated 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:MAI-Code-1-Flash deprecated 事实摘要:这条英文动态主。影响判断:它可能改变智能体工作流、模型能力与工程、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程、开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  16. OpenAI News80

    How a researcher uses Codex and ChatGPT to search for new antimicrobial molecules

    事实摘要:这条英文动态主要涉及AI 应用价值,原文信息显示:How a researcher uses Codex and ChatGPT to search for new antimicrobial molecules 事实摘要:这条英文动态主要涉及AI 应用价值,原文信息显示:How a researcher uses Codex and ChatGPT to 。影响判断:它可能改变AI 应用价值相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪AI 应用价值方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和AI 应用价值直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

9月10日周四
  1. GitHub Changelog53

    Xcode 27 runner image now runs on macOS 27

    事实摘要:这条英文动态主要涉及开源生态,原文信息显示:Xcode 27 runner image now runs on macOS 27 事实摘要:这条英文动态主要涉及开源生态,原文信息显示:Xcode 27 runner image now runs on macOS 27 事实摘要:这条英文动态主要涉及开源生态,原文信息显示:Xcode 27 runner im。影响判断:它可能改变开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  2. IT之家 AI36

    看似不可能的黑洞合并,或许只是时空扭曲带来的宇宙错觉

    IT之家 9 月 10 日消息,一项新研究提出,两个超大质量黑洞之间那场看似“不可能发生”的并合事件,或许并没有原先认为的那么违背物理规律。研究认为,参与并合的黑洞实际质量比此前测算的更小。 2023 年 11 月 23 日,激光干涉引力波天文台(LIGO)探测到时空泛起的微弱涟漪,信号来自一次黑洞并合。这个编号 GW231123 的信号之所以震惊学界,是因为它最初的解读结果显示,一个 140 倍太阳质量的黑洞和一个 100 倍太阳质量的黑洞发生了碰撞。 这一结果让研究人员十分费解。现有的恒星演化模型很难解释为何会形成质量如此巨大的黑洞,更何况这两个黑洞的自转速度看起来还极高。科学家一直在寻找这类特殊双黑洞系统的形成机制。而这支新研究团队提出,其实不必费心解释它的形成原因,因为这两个黑洞的巨大质量只是一种假象。 造成这种假象的核心效应是引力透镜 。该效应最早由爱因斯坦 1915 年提出的引力理论,也就是广义相对论预言,引力波同样...

    推荐理由:来自IT之家 AI的《看似不可能的黑洞合并,或许只是时空扭曲带来的宇宙错觉》。重点看模型能力与工程。摘要提到:IT之家 9 月 10 日消息,一项新研究提出,两个超大质量黑洞之间那场看似“不可能发生”的并合事件,或许并没有原先认为的那么违背物理规律。研究认为,参与并合的黑洞实际质量比此前测算的更小。 2023 年 11 月 23 日,激光干涉引力波天文台(LIGO)探测到时空泛起的微弱涟漪,信号来自一次黑洞并合。这个编号 GW231123 的信号之所以震惊学界,是因为它最初的解读结果显示,一个 140 倍太阳质量的黑洞和一个 100 倍太阳质量的黑洞发生了碰撞。 这一结果让研究人员十分费解。现有的恒星演化模型很难解释为何会形成质量如此巨大的黑洞,更何况这两个黑洞的自转速度看起来还极高。科学家一直在寻找这类特殊双黑洞系统的形成机制。而这支新研究团队提出,其实不必费心解释它的形成原因,因为这两个黑洞的巨大质量只是一种假象。 造成这种假象的核心效应是引力透镜 。该效应最早由爱因斯坦 1915 年提出的引力理论,也就是广义相对论预言,引力波同样...

  3. The Decoder:AI News(RSS)88

    DeepSeek 发布 V4.1-Flash,大幅降低 AI Agent 的 KV cache 内存需求

    事实摘要:DeepSeek 发布 V4.1-Flash,大幅降低 AI Agent 的 KV cache 内存需求 事实摘要:DeepSeek 发布 V4.1-Flash,大幅降低 AI Agent 的 KV cache 内存需求 事实摘要:DeepSeek 发布 V4.1-Flash,大幅降低 AI Agent 的 KV cache 内存需求 事实摘要:DeepSe。影响判断:它可能改变智能体工作流、模型能力与工程、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:文章梳理了 V4.1-Flash 压缩 KV cache 和输入算力的具体做法,读者可以评估它在长上下文 Agent 部署成本上的实际收益。

  4. IT之家 AI72

    NASA 与 IBM 联合发布开源月球研究基础大模型,可识别月表冰区与撞击坑

    IT之家 9 月 10 日消息,今年春天,NASA 的阿尔忒弥斯 2 号任务完成了具有历史意义的月球掠飞,这是 1972 年之后人类首次载人绕月飞行。4 月 6 日,宇航员里德 · 怀斯曼、克里斯蒂娜 · 科赫、维克多 · 格洛弗与杰里米 · 汉森抵达了比以往任何人都更远的地外空间。如今,NASA 在筹备后续阿尔忒弥斯系列任务的同时,正与 IBM 合作,为科研人员打造全新的月球研究工具。 当地时间周四,双方联合发布了 NASA-IBM 月球基础大模型。这是一套开源人工智能系统,可在 Hugging Face 平台下载。IBM 欧洲、英国及爱尔兰研究院院长胡安 · 贝尔纳韦-莫雷诺博士介绍,作为基础大模型,它可以完成多项任务。首先,NASA 与 IBM 发现,该模型特别擅长识别月球表面可能存在冰的区域。 IT之家注意到,双方开展了一项对照测试:将模型的预测结果,和一套依靠成熟科研流程生成的月球地图进行比对,这套地图融合了地形、温度...

    推荐理由:来自IT之家 AI的《NASA 与 IBM 联合发布开源月球研究基础大模型,可识别月表冰区与撞击坑》。重点看模型能力与工程、开源生态、产品发布。摘要提到:IT之家 9 月 10 日消息,今年春天,NASA 的阿尔忒弥斯 2 号任务完成了具有历史意义的月球掠飞,这是 1972 年之后人类首次载人绕月飞行。4 月 6 日,宇航员里德 · 怀斯曼、克里斯蒂娜 · 科赫、维克多 · 格洛弗与杰里米 · 汉森抵达了比以往任何人都更远的地外空间。如今,NASA 在筹备后续阿尔忒弥斯系列任务的同时,正与 IBM 合作,为科研人员打造全新的月球研究工具。 当地时间周四,双方联合发布了 NASA-IBM 月球基础大模型。这是一套开源人工智能系统,可在 Hugging Face 平台下载。IBM 欧洲、英国及爱尔兰研究院院长胡安 · 贝尔纳韦-莫雷诺博士介绍,作为基础大模型,它可以完成多项任务。首先,NASA 与 IBM 发现,该模型特别擅长识别月球表面可能存在冰的区域。 IT之家注意到,双方开展了一项对照测试:将模型的预测结果,和一套依靠成熟科研流程生成的月球地图进行比对,这套地图融合了地形、温度...

  5. 量子位68

    ECCV上,顶尖学者们开始研究如何让AI做生意了

    事实摘要:顶尖学者们开始研究如何让AI做生意了。影响判断:多模态AI大牛轮番登台,全球64支团队组团解题。场景价值:AI 应用和产业节奏的影响。

    推荐理由:这些动态表明顶尖学者们正在探索如何将机器学习应用于商业领域,通过多模态技术提高 AI 的商业应用潜力。

  6. IT之家 AI72

    DeepMind 工程师反驳“谷歌搞不出前沿模型”:Gemini 3.8 Cyber 已在多项测试中优于 Mythos

    IT之家 9 月 10 日消息,AI 研究员伊森 · 莫利克( Ethan Mollick )今日在 X 平台发文称,谷歌已不再拥有前沿模型,这代表着谷歌将错失数学领域,以及网络安全领域。 谷歌 DeepMind 工程师洛根 · 基尔帕特里克( Logan Kilpatrick )对此反驳称, Gemini 3.8 Cyber 在许多网络安全测试、实际应用能力已经超过 Anthropic 的 Mythos 。谷歌内部的 Chrome、Wiz 和 Cloud 团队已经广泛使用该模型。 IT之家注意到,该工程师还进一步表示:“我们的重点是让越来越多的网络安全防御人员拥有更强能力。Gemini 4 系列模型将继续推动前沿网络安全模型发展。”

    推荐理由:来自IT之家 AI的《DeepMind 工程师反驳“谷歌搞不出前沿模型”:Gemini 3.8 Cyber 已在多项测试中优于 Mythos》。重点看模型能力与工程。摘要提到:IT之家 9 月 10 日消息,AI 研究员伊森 · 莫利克( Ethan Mollick )今日在 X 平台发文称,谷歌已不再拥有前沿模型,这代表着谷歌将错失数学领域,以及网络安全领域。 谷歌 DeepMind 工程师洛根 · 基尔帕特里克( Logan Kilpatrick )对此反驳称, Gemini 3.8 Cyber 在许多网络安全测试、实际应用能力已经超过 Anthropic 的 Mythos 。谷歌内部的 Chrome、Wiz 和 Cloud 团队已经广泛使用该模型。 IT之家注意到,该工程师还进一步表示:“我们的重点是让越来越多的网络安全防御人员拥有更强能力。Gemini 4 系列模型将继续推动前沿网络安全模型发展。”

  7. IT之家 AI72

    支持前实习生创业项目:消息称阿里拟领投 AI 评测公司 UniPat 的 3 亿美元融资

    IT之家 9 月 10 日消息,据彭博社今天(10 日)上午报道,阿里巴巴集团拟领投 AI 训练与基准测试初创公司 UniPat AI 的一轮 3 亿美元 (IT之家注:现汇率约合 20.18 亿元人民币) 融资,本轮估值达 25 亿美元 (现汇率约合 168.14 亿元人民币) 。这笔投资也是阿里巴巴对一名前实习生创业的认可。 知情人士透露,融资预计很快完成,腾讯控股及红杉等老股东也参与投资。各方仍在磋商,交易细节可能发生变化。 UniPat 由 去年在通义 AI 实验室从事后训练分析、数据合成和强化学习工作 的李宽创办,为 AI 模型设计贴近真实使用环境的测试与评估场景。该公司专门生成细致的训练和评测数据,计划向 AI 领域的其他研究人员及企业出售。 这笔融资说明,为了获得高质量数据、了解 AI 系统的表现,巨头是愿意支付高价的。 UniPat 成立于 2025 年末,提供的基准测试涵盖 AI 编程智能体的软件工程能力、浏览...

    推荐理由:来自IT之家 AI的《支持前实习生创业项目:消息称阿里拟领投 AI 评测公司 UniPat 的 3 亿美元融资》。重点看智能体工作流、模型能力与工程、评测与基准。摘要提到:IT之家 9 月 10 日消息,据彭博社今天(10 日)上午报道,阿里巴巴集团拟领投 AI 训练与基准测试初创公司 UniPat AI 的一轮 3 亿美元 (IT之家注:现汇率约合 20.18 亿元人民币) 融资,本轮估值达 25 亿美元 (现汇率约合 168.14 亿元人民币) 。这笔投资也是阿里巴巴对一名前实习生创业的认可。 知情人士透露,融资预计很快完成,腾讯控股及红杉等老股东也参与投资。各方仍在磋商,交易细节可能发生变化。 UniPat 由 去年在通义 AI 实验室从事后训练分析、数据合成和强化学习工作 的李宽创办,为 AI 模型设计贴近真实使用环境的测试与评估场景。该公司专门生成细致的训练和评测数据,计划向 AI 领域的其他研究人员及企业出售。 这笔融资说明,为了获得高质量数据、了解 AI 系统的表现,巨头是愿意支付高价的。 UniPat 成立于 2025 年末,提供的基准测试涵盖 AI 编程智能体的软件工程能力、浏览...

  8. MarkTechPost(RSS)80

    DeepSeek AI 发布 DeepSeek-V4.1-Flash:1M 上下文、FP4 KV 缓存与跨层注意力复用

    事实摘要:DeepSeek AI 发布 DeepSeek-V4.1-Flash:1M 上下文、FP4 KV 缓存与跨层注意力复用 事实摘要:DeepSeek AI 发布 DeepSeek-V4.1-Flash:1M 上下文、FP4 KV 缓存与跨层注意力复用 事实摘要:DeepSeek AI 发布 DeepSeek-V4.1-Flash:1M 上下文、FP4 KV 缓。影响判断:它可能改变模型能力与工程相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程方向的选题、竞品观察和落地方案筛选。

    推荐理由:文章拆解了 KV 缓存压缩和预精简架构的具体做法,读者可以对照其工程路径评估长上下文部署成本。

  9. OpenAI News78

    Introducing ChatGPT for Financial Services

    这条英文动态主要涉及模型能力与工程。原文要点:Introducing ChatGPT for Financial Services, combining built-in financial data and GPT-6 Astra for research, modeling, and client-ready materials.

    推荐理由:来自OpenAI News的《Introducing ChatGPT for Financial Services》。重点看模型能力与工程。摘要提到:这条英文动态主要涉及模型能力与工程。原文要点:Introducing ChatGPT for Financial Services, combining built-in financial data and GPT-6 Astra for research, modeling, and client-ready materials.

  10. OpenAI News79

    Expanding AI access and cyber defense for federal, state, local, and tribal governments

    事实摘要:这条英文动态主要涉及AI 应用价值,原文信息显示:Expanding AI access and cyber defense for federal, state, local, and tribal governments 事实摘要:这条英文动态主要涉及AI 应用价值,原文信息显示:Expanding AI access and cyber defense。影响判断:它可能改变AI 应用价值相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪AI 应用价值方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和AI 应用价值直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  11. 公众号:DeepSeek(深度求索)80

    DeepSeek 发布 V4.1 Flash:552B MoE 多模态模型,同步开源并下调 API 定价

    事实摘要:DeepSeek 发布 V4.1 Flash:552B MoE 多模态模型,同步开源并下调 API 定价 事实摘要:DeepSeek 发布 V4.1 Flash:552B MoE 多模态模型,同步开源并下调 API 定价 事实摘要:DeepSeek 发布 V4.1 Flash:552B MoE 多模态模型,同步开源并下调 API 定价 事实摘要:DeepSe。影响判断:它可能改变模型能力与工程、评测与基准、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程、评测与基准、开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:官方发布了新结构系列的552B MoE模型,读者可以据此了解Causal-Encoder-Decoder结构、KV Cache压缩幅度和API定价变化。

  12. IT之家 AI74

    DeepSeek V4.1 Flash 模型正式发布:全面超越 V4 Pro、原生多模态视觉理解,API 定价下调

    IT之家 9 月 10 日消息,深度求索今日正式发布 DeepSeek V4.1 Flash 模型 。这是其全新模型结构系列中的最小尺寸的模型,具备原生多模态视觉理解能力。 新模型结构的设计初衷是:能力上限更高、推理速度更快、吞吐更大、可扩展到更大参数模型。 DeepSeek V4.1 Flash 为 552B 参数的 MoE 模型 ,采用了全新的 Causal-Encoder-Decoder 结构,输入和输出不对称,输入激活只有 8B,输出激活 16B,成本显著低于已知的同尺寸模型。同时,V4.1 Flash 还采用了新的预训练方式、经过了更大规模的强化学习后训练,在基准测试中,成功超越了包括 DeepSeek V4 Pro 在内的一众旗舰模型的智能水平。 ▲ DeepSeek-V4.1-Flash 与主流前沿模型在 Agentic Benchmark 上的性能对比 此外,新一代模型大幅减少了 KV Cache 缓存的大小,与...

    推荐理由:来自IT之家 AI的《DeepSeek V4.1 Flash 模型正式发布:全面超越 V4 Pro、原生多模态视觉理解,API 定价下调》。重点看智能体工作流、模型能力与工程、评测与基准。摘要提到:IT之家 9 月 10 日消息,深度求索今日正式发布 DeepSeek V4.1 Flash 模型 。这是其全新模型结构系列中的最小尺寸的模型,具备原生多模态视觉理解能力。 新模型结构的设计初衷是:能力上限更高、推理速度更快、吞吐更大、可扩展到更大参数模型。 DeepSeek V4.1 Flash 为 552B 参数的 MoE 模型 ,采用了全新的 Causal-Encoder-Decoder 结构,输入和输出不对称,输入激活只有 8B,输出激活 16B,成本显著低于已知的同尺寸模型。同时,V4.1 Flash 还采用了新的预训练方式、经过了更大规模的强化学习后训练,在基准测试中,成功超越了包括 DeepSeek V4 Pro 在内的一众旗舰模型的智能水平。 ▲ DeepSeek-V4.1-Flash 与主流前沿模型在 Agentic Benchmark 上的性能对比 此外,新一代模型大幅减少了 KV Cache 缓存的大小,与...

  13. IT之家 AI68

    DeepSeek Harness 0.1.5 更新:适配 DeepSeek V4.1 Flash 模型,新增文件上传与侧边栏预览功能

    IT之家 9 月 10 日消息,DeepSeek Harness v0.1.5 版本现已发布。新版本与 DeepSeek V4.1 Flash 模型训练深度结合,模型在 DeepSeek Harness 不同配置中进行了专项训练和优化。 新版同时为插件作者提供更多标准化 UI 扩展入口,新增文件上传、侧边栏文件预览等功能,优化 UI 性能与交互,并持续增加与模型研究前沿结合的实验性功能。 面向 DeepSeek V4.1 Flash 模型的适配方面,该模型针对 DeepSeek Harness 专项训练和优化,覆盖标准模式、程序化工具调用(PTC)模式和极简模式。使用该模型时,新版本支持在保留已有 KV Cache 的情况下更新系统提示词。IT之家注:KV Cache 是模型推理中缓存键值对以加速生成的技术。 文件处理与预览方面,Web 界面支持上传图片、PDF 等多种文件,模型可通过文件工具按需读取。右侧 Sidebar 支持...

    推荐理由:来自IT之家 AI的《DeepSeek Harness 0.1.5 更新:适配 DeepSeek V4.1 Flash 模型,新增文件上传与侧边栏预览功能》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 10 日消息,DeepSeek Harness v0.1.5 版本现已发布。新版本与 DeepSeek V4.1 Flash 模型训练深度结合,模型在 DeepSeek Harness 不同配置中进行了专项训练和优化。 新版同时为插件作者提供更多标准化 UI 扩展入口,新增文件上传、侧边栏文件预览等功能,优化 UI 性能与交互,并持续增加与模型研究前沿结合的实验性功能。 面向 DeepSeek V4.1 Flash 模型的适配方面,该模型针对 DeepSeek Harness 专项训练和优化,覆盖标准模式、程序化工具调用(PTC)模式和极简模式。使用该模型时,新版本支持在保留已有 KV Cache 的情况下更新系统提示词。IT之家注:KV Cache 是模型推理中缓存键值对以加速生成的技术。 文件处理与预览方面,Web 界面支持上传图片、PDF 等多种文件,模型可通过文件工具按需读取。右侧 Sidebar 支持...

  14. 量子位38

    一周连发6个模型!这家公司把具身智能的闭环跑通了

    事实摘要:一周连发6个模型!这家公司把具身智能的闭环跑通了 模型可以开源,部署经验不能 这条动态来自 量子位,可重点关注模型能力与工程、开源生态。 一周连发6个模型!这家公司把具身智能的闭环跑通了 模型可以开源,部署经验不能。影响判断:它可能改变模型能力与工程、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程、开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和模型能力与工程、开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  15. IT之家 AI68

    曾获扎克伯格 15 亿美元 offer,Meta 明星 AI 研究员安德鲁 · 塔洛克宣布离职

    北京时间 9 月 10 日,据《华尔街日报》报道,知情人士透露,明星 AI 研究员安德鲁 · 塔洛克 (Andrew Tulloch) 即将从 Meta 离职。去年,Meta 为了招募他曾提供价值超过 10 亿美元的薪酬方案。 塔洛克的加入曾被视为 Meta 的一次重大胜利,也为去年夏天那场疯狂的人才争夺战画上了句号。当时,Meta CEO 马克 · 扎克伯格 (Mark Zuckerberg) 不惜重金招揽研究人员,力图在 AI 竞赛中迎头赶上。他曾在 Meta 工作 11 年,于 2023 年离职前往 OpenAI,随后共同创立了 Thinking Machines Lab。 塔洛克周三向同事宣布离职时,并未透露下一步去向。他未回应置评请求。Meta 也拒绝就他的离职发表评论。 他的离职加剧了一连串的 AI 研究人员高调出走潮。上个月,谷歌首席科学家杰夫 · 迪恩 (Jeff Dean) 与另外三名资深研究员离职,共同创立了...

    推荐理由:来自IT之家 AI的《曾获扎克伯格 15 亿美元 offer,Meta 明星 AI 研究员安德鲁 · 塔洛克宣布离职》。重点看论文/研究。摘要提到:北京时间 9 月 10 日,据《华尔街日报》报道,知情人士透露,明星 AI 研究员安德鲁 · 塔洛克 (Andrew Tulloch) 即将从 Meta 离职。去年,Meta 为了招募他曾提供价值超过 10 亿美元的薪酬方案。 塔洛克的加入曾被视为 Meta 的一次重大胜利,也为去年夏天那场疯狂的人才争夺战画上了句号。当时,Meta CEO 马克 · 扎克伯格 (Mark Zuckerberg) 不惜重金招揽研究人员,力图在 AI 竞赛中迎头赶上。他曾在 Meta 工作 11 年,于 2023 年离职前往 OpenAI,随后共同创立了 Thinking Machines Lab。 塔洛克周三向同事宣布离职时,并未透露下一步去向。他未回应置评请求。Meta 也拒绝就他的离职发表评论。 他的离职加剧了一连串的 AI 研究人员高调出走潮。上个月,谷歌首席科学家杰夫 · 迪恩 (Jeff Dean) 与另外三名资深研究员离职,共同创立了...