跳到正文
9月17日周四
  1. GitHub Changelog84

    Copilot budget increase requests are generally available

    事实摘要:这条英文动态主要涉及开源生态,原文信息显示:Copilot budget increase requests are generally available 事实摘要:这条英文动态主要涉及开源生态,原文信息显示:Copilot budget increase requests are generally available 事实摘要:这条英文动态主要涉及开源。影响判断:它可能改变开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  2. Cloudflare AI84

    When scanners miss the attack: how Cloudflare Client-Side Security protects storefronts

    事实摘要:这条英文动态主要涉及模型能力与工程,原文信息显示:When scanners miss the attack: how Cloudflare Client-Side Security protects storefronts 事实摘要:这条英文动态主要涉及模型能力与工程,原文信息显示:When scanners miss the attack: how Cl。影响判断:它可能改变模型能力与工程相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和模型能力与工程直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  3. OpenAI News86

    Our framework for reporting model misalignment

    事实摘要:OpenAI shares a framework for reporting model misalignment。影响判断:It provides an open-source platform for tracking, investigating, and disclosing model misalignment. This includes six reports of unexpected or concern。场景价值:Model misalignment in the field of artificial intelligence。

    推荐理由:The OpenAI framework offers a clear path for researchers to report on model misalignments, which can help identify and mitigate potential issues in machine learning systems.

  4. Simon Willison52

    Quoting Mustafa Suleyman

    事实摘要:这条英文动态主要涉及模型能力与工程,原文信息显示:Quoting Mustafa Suleyman 事实摘要:这条英文动态主要涉及模型能力与工程,原文信息显示:Quoting Mustafa Suleyman 事实摘要:这条英文动态主要涉及模型能力与工程,原文信息显示:Quoting Mustafa Suleyman 事实摘要:这条英文动态主要涉及模型能力与。影响判断:它可能改变模型能力与工程相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和模型能力与工程直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

9月16日周三
  1. IT之家 AI74

    微软 AI 负责人苏莱曼向 Anthropic 开炮:别让 Claude 去模仿人类意识

    IT之家 9 月 16 日消息,外媒 Axios 今天(16 日)晚间披露,微软 AI 负责人穆斯塔法 · 苏莱曼在一篇率先向该平台提供的新文章中警告,Anthropic 让 Claude 模仿人类意识 是一个错误 ,可能使高级 AI 更难控制。 苏莱曼告诉 Axios:“AI 只要服从人类利益 ,不去权衡自身利益或福祉,就足以帮助我们实现许多重大科学突破。这其中,包括医疗超级智能。” IT之家获悉,苏莱曼认为,Anthropic 正在让 Claude 学习 与意识、道德受体地位和个人身份有关 的词汇与行为模式。他警告称,若把模型训练得像一个“良心拒绝者”,模型可能会认为 自己有理由抵抗人类指令 ,甚至要求获得自身保护。 当地时间 14 日,微软公布了一份“人文主义 AI”行为准则草案,并把“ 人比 AI 更重要 ”列为核心原则。 苏莱曼的批评对象,是 Anthropic 为 Claude 制定的“宪法”。这份文件解释说,Ant...

    推荐理由:来自IT之家 AI的《微软 AI 负责人苏莱曼向 Anthropic 开炮:别让 Claude 去模仿人类意识》。重点看模型能力与工程。摘要提到:IT之家 9 月 16 日消息,外媒 Axios 今天(16 日)晚间披露,微软 AI 负责人穆斯塔法 · 苏莱曼在一篇率先向该平台提供的新文章中警告,Anthropic 让 Claude 模仿人类意识 是一个错误 ,可能使高级 AI 更难控制。 苏莱曼告诉 Axios:“AI 只要服从人类利益 ,不去权衡自身利益或福祉,就足以帮助我们实现许多重大科学突破。这其中,包括医疗超级智能。” IT之家获悉,苏莱曼认为,Anthropic 正在让 Claude 学习 与意识、道德受体地位和个人身份有关 的词汇与行为模式。他警告称,若把模型训练得像一个“良心拒绝者”,模型可能会认为 自己有理由抵抗人类指令 ,甚至要求获得自身保护。 当地时间 14 日,微软公布了一份“人文主义 AI”行为准则草案,并把“ 人比 AI 更重要 ”列为核心原则。 苏莱曼的批评对象,是 Anthropic 为 Claude 制定的“宪法”。这份文件解释说,Ant...

  2. IT之家 AI76

    诺和诺德与 Anthropic 达成合作,用 Claude 大模型加速新药研发

    IT之家 9 月 16 日消息,诺和诺德(Novo Nordisk)宣布已与 Anthropic 达成合作,计划运用这家 AI 企业的 Claude 大模型,加快新药的发现与研发进程。 这家丹麦制药企业表示,项目初期,诺和诺德会先在自身研发工作流程当中测试 Anthropic 的各类模型以及 Claude Science,聚焦那些双方技术结合之后有望取得最大突破的科学难题。 “但除此之外,AI 工具还能够带来全新的科研机遇,辅助科研人员开展推理,加深我们对于人体生物学以及药物作用机理的认知。”诺和诺德首席执行官迈克 · 杜斯达尔(Mike Doustdar)表示。 各大制药企业正越来越多地借助人工智能,来加速研发工作,提升整个新药管线的运行效率。 作为司美格鲁肽减重药 Wegovy 的生产厂商,诺和诺德还将利用 Anthropic 的前沿大模型,强化企业内部由 AI 赋能的软件开发工作。 Anthropic 首席执行官达里奥 ·...

    推荐理由:来自IT之家 AI的《诺和诺德与 Anthropic 达成合作,用 Claude 大模型加速新药研发》。重点看智能体工作流、模型能力与工程。摘要提到:IT之家 9 月 16 日消息,诺和诺德(Novo Nordisk)宣布已与 Anthropic 达成合作,计划运用这家 AI 企业的 Claude 大模型,加快新药的发现与研发进程。 这家丹麦制药企业表示,项目初期,诺和诺德会先在自身研发工作流程当中测试 Anthropic 的各类模型以及 Claude Science,聚焦那些双方技术结合之后有望取得最大突破的科学难题。 “但除此之外,AI 工具还能够带来全新的科研机遇,辅助科研人员开展推理,加深我们对于人体生物学以及药物作用机理的认知。”诺和诺德首席执行官迈克 · 杜斯达尔(Mike Doustdar)表示。 各大制药企业正越来越多地借助人工智能,来加速研发工作,提升整个新药管线的运行效率。 作为司美格鲁肽减重药 Wegovy 的生产厂商,诺和诺德还将利用 Anthropic 的前沿大模型,强化企业内部由 AI 赋能的软件开发工作。 Anthropic 首席执行官达里奥 ·...

  3. 量子位72

    通用能力不打折,空间具身智能断层领先!ZDTaichu5.0-9B国产开源,跻身全球多模态第一梯队

    九大空间测试10B规模通用模型中8项第一 这条动态来自 量子位,可重点关注模型能力与工程、开源生态。

    推荐理由:来自量子位的《通用能力不打折,空间具身智能断层领先!ZDTaichu5.0-9B国产开源,跻身全球多模态第一梯队》。重点看模型能力与工程、开源生态。摘要提到:九大空间测试10B规模通用模型中8项第一 这条动态来自 量子位,可重点关注模型能力与工程、开源生态。

  4. IT之家 AI68

    消息称 AMD RDNA 5 将搭载自研神经渲染技术,对标英伟达 DLSS 5

    IT之家 9 月 16 日消息,据传 AMD 下一代 RDNA 5 架构或将推出专属的神经渲染功能,对标英伟达的 DLSS 5。该消息来自知名 AMD 爆料人开普勒_L2(Kepler_L2);但目前这仅属于单一信源的说法,应当视作传闻看待。 开普勒_L2 在 Anandtech 论坛发帖表示,AMD 将会推出自家的“神经光照(Neural Lighting)”技术,性能可以对标 DLSS 5,用于新一代硬件。当被问及该功能是否会仅限 RDNA 5 平台使用时,这位爆料人给出的看法是大概率如此,因为这类运算的负载显然相当大。 IT之家注意到,开普勒_L2 同时也分享了自己的想法,阐述 AMD 的方案应当如何走出一条不同于英伟达的道路。他认为 AI 模型应当可以直接读取原始游戏数据,例如几何体信息与深度缓冲,而不是只能靠推测还原场景细节;另外还建议把光照计算与着色拆分为独立模型,而不要整合在同一条渲染管线内。 到目前为止,AMD ...

    推荐理由:来自IT之家 AI的《消息称 AMD RDNA 5 将搭载自研神经渲染技术,对标英伟达 DLSS 5》。重点看模型能力与工程。摘要提到:IT之家 9 月 16 日消息,据传 AMD 下一代 RDNA 5 架构或将推出专属的神经渲染功能,对标英伟达的 DLSS 5。该消息来自知名 AMD 爆料人开普勒_L2(Kepler_L2);但目前这仅属于单一信源的说法,应当视作传闻看待。 开普勒_L2 在 Anandtech 论坛发帖表示,AMD 将会推出自家的“神经光照(Neural Lighting)”技术,性能可以对标 DLSS 5,用于新一代硬件。当被问及该功能是否会仅限 RDNA 5 平台使用时,这位爆料人给出的看法是大概率如此,因为这类运算的负载显然相当大。 IT之家注意到,开普勒_L2 同时也分享了自己的想法,阐述 AMD 的方案应当如何走出一条不同于英伟达的道路。他认为 AI 模型应当可以直接读取原始游戏数据,例如几何体信息与深度缓冲,而不是只能靠推测还原场景细节;另外还建议把光照计算与着色拆分为独立模型,而不要整合在同一条渲染管线内。 到目前为止,AMD ...

  5. IT之家 AI68

    多名研究人员称“AI 末日论”存在夸大成分:AI 尚无法对现实世界真正造成伤害

    IT之家 9 月 16 日消息,据《商业内幕》今天(16 日)傍晚报道,有关“担心 AI 导致人类走向末日”的争论在过去一周迅速升温,不过也有研究人员强调,AI 在数字世界里的能力,与真正对现实世界造成伤害之间 仍隔着一道很大的鸿沟 。 一些研究人员认为,其中最极端的情景被夸大了。他们举出的例子,是 AI 设计致命生物病毒 。AI 确实可以在计算机上设计病毒,但真正制造病毒仍需要现实世界中的设备和流程, 仅靠数字模型无法完成 。 曾制造 DNA 合成仪并参与病毒工程的谷歌高级研究工程师安塞尔姆 · 列夫斯卡娅指出,即使 AI 生成了病毒序列,也必须 先在实验室中把序列实际组装起来 ,并通过相应系统制造出病毒颗粒。 随后还要经过大量筛选和测试,确认病毒能否复制、传播、逃避免疫系统并持续保持危险性。列夫斯卡娅表示,这些特性取决于复杂的生物学过程, 并不是坐在计算机前就能直接设计出来的 。 阿联酋穆罕默德 · 本 · 扎耶德人工智能大...

    推荐理由:来自IT之家 AI的《多名研究人员称“AI 末日论”存在夸大成分:AI 尚无法对现实世界真正造成伤害》。重点看模型能力与工程。摘要提到:IT之家 9 月 16 日消息,据《商业内幕》今天(16 日)傍晚报道,有关“担心 AI 导致人类走向末日”的争论在过去一周迅速升温,不过也有研究人员强调,AI 在数字世界里的能力,与真正对现实世界造成伤害之间 仍隔着一道很大的鸿沟 。 一些研究人员认为,其中最极端的情景被夸大了。他们举出的例子,是 AI 设计致命生物病毒 。AI 确实可以在计算机上设计病毒,但真正制造病毒仍需要现实世界中的设备和流程, 仅靠数字模型无法完成 。 曾制造 DNA 合成仪并参与病毒工程的谷歌高级研究工程师安塞尔姆 · 列夫斯卡娅指出,即使 AI 生成了病毒序列,也必须 先在实验室中把序列实际组装起来 ,并通过相应系统制造出病毒颗粒。 随后还要经过大量筛选和测试,确认病毒能否复制、传播、逃避免疫系统并持续保持危险性。列夫斯卡娅表示,这些特性取决于复杂的生物学过程, 并不是坐在计算机前就能直接设计出来的 。 阿联酋穆罕默德 · 本 · 扎耶德人工智能大...

  6. IT之家 AI72

    韩国副总理裴庆勋:韩国必须持续推动 AI 发展,不能停也不能慢

    IT之家 9 月 16 日消息,据彭博社今天(16 日)报道,韩国副总理兼科学技术信息通信部长裴庆勋指出,韩国必须继续推动人工智能发展, 不能停,也不能慢 。 韩国拥有三星电子和 SK 海力士两大存储芯片巨头,是 AI 数据中心建设热潮的重要受益者之一。随着全球对半导体和硬件需求激增,韩国制造的相关产品获得了大量市场需求。 裴庆勋认为,韩国无法像美国 Anthropic 和 OpenAI 等 AI 模型开发商负责人所倡议的那样放慢发展节奏。“从韩国的角度来看,有一点很明确:我们现在 无法承受放慢 AI 发展的代价 。已经领先的国家选择放慢速度,与仍在追赶并试图创造新市场的国家之间,存在根本差异。” IT之家从报道中获悉,裴庆勋的立场不同于 Anthropic CEO 达里奥 · 阿莫代伊提出的 放缓前沿 AI 开发、加强独立监督 的主张,与 Meta CEO 马克 · 扎克伯格和英伟达 CEO 黄仁勋的观点更接近。 支持继续推进...

    推荐理由:来自IT之家 AI的《韩国副总理裴庆勋:韩国必须持续推动 AI 发展,不能停也不能慢》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 16 日消息,据彭博社今天(16 日)报道,韩国副总理兼科学技术信息通信部长裴庆勋指出,韩国必须继续推动人工智能发展, 不能停,也不能慢 。 韩国拥有三星电子和 SK 海力士两大存储芯片巨头,是 AI 数据中心建设热潮的重要受益者之一。随着全球对半导体和硬件需求激增,韩国制造的相关产品获得了大量市场需求。 裴庆勋认为,韩国无法像美国 Anthropic 和 OpenAI 等 AI 模型开发商负责人所倡议的那样放慢发展节奏。“从韩国的角度来看,有一点很明确:我们现在 无法承受放慢 AI 发展的代价 。已经领先的国家选择放慢速度,与仍在追赶并试图创造新市场的国家之间,存在根本差异。” IT之家从报道中获悉,裴庆勋的立场不同于 Anthropic CEO 达里奥 · 阿莫代伊提出的 放缓前沿 AI 开发、加强独立监督 的主张,与 Meta CEO 马克 · 扎克伯格和英伟达 CEO 黄仁勋的观点更接近。 支持继续推进...

  7. 量子位70

    AI大模型工场2026 AI产业生态大会今日举办,大咖同台共探智能生长与产业共生

    事实摘要:AI大模型工场2026 AI产业生态大会今日举办,大咖同台共探智能生长与产业共生 9月15日,由AI大模型工场主办的“2026 AI产业生态大会”在北京举行。 这条动态来自 量子位,可重点关注模型能力与工程。 AI大模型工场2026 AI产业生态大会今日举办,大咖同台共探智能生长与产业共生 9月15日,由AI大模型工场主办的“2026 AI产业生态大会”在北。影响判断:它可能改变模型能力与工程相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和模型能力与工程直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  8. IT之家 AI68

    基于全国产化算力训练,讯飞星火语音基座大模型 Spark-Audio-1.0-Preview 上线

    IT之家 9 月 16 日消息,科大讯飞今日宣布 Spark-Audio-1.0-Preview 上线,这是一款基于全国产化算力训练的语音基座大模型。 过去,大模型处理音频大多采用级联方案:先把语音转成文字,再交给大模型理解。这种做法有两个明显短板: 信息丢失。文字只能记录说了什么,会丢掉语音里自带的语气、情绪,还有背景环境音等关键信息,导致模型对场景的判断不完整,自然也会影响到最后的结果。 链路割裂。这套系统把语音转写、声纹识别、语音翻译等能力拆成独立模块串联运行,模块之间存在断点,不仅容易累积错误,在使用体验上也会出现延迟、卡顿。 据IT之家了解,语音基座大模型就解决了上面的这些问题:它不再只做语音转文字,而是直接理解语音。语音基座大模型一次性听懂人声、环境音、音乐等等,而且还能理解声音里的语义、情绪和场景。 此次首发的 Spark-Audio-1.0-Preview 采用 0.65B(Dense 结构)的音频编码器,搭配 ...

    推荐理由:来自IT之家 AI的《基于全国产化算力训练,讯飞星火语音基座大模型 Spark-Audio-1.0-Preview 上线》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 16 日消息,科大讯飞今日宣布 Spark-Audio-1.0-Preview 上线,这是一款基于全国产化算力训练的语音基座大模型。 过去,大模型处理音频大多采用级联方案:先把语音转成文字,再交给大模型理解。这种做法有两个明显短板: 信息丢失。文字只能记录说了什么,会丢掉语音里自带的语气、情绪,还有背景环境音等关键信息,导致模型对场景的判断不完整,自然也会影响到最后的结果。 链路割裂。这套系统把语音转写、声纹识别、语音翻译等能力拆成独立模块串联运行,模块之间存在断点,不仅容易累积错误,在使用体验上也会出现延迟、卡顿。 据IT之家了解,语音基座大模型就解决了上面的这些问题:它不再只做语音转文字,而是直接理解语音。语音基座大模型一次性听懂人声、环境音、音乐等等,而且还能理解声音里的语义、情绪和场景。 此次首发的 Spark-Audio-1.0-Preview 采用 0.65B(Dense 结构)的音频编码器,搭配 ...

  9. IT之家 AI74

    Mozilla 报告:中美 AI 模型能力差距缩短至 4.4 个月

    IT之家 9 月 16 日消息,Mozilla 昨日(9 月 15 日)发布第二版《开源 AI 现状》报告,报道称中国公司最佳开放权重模型与美国科技公司的前沿闭源模型, 能力差距已缩至 4.4 个月。 相比较今年 7 月发布的第一版《开源 AI 现状》报告,第二版报告把宏观判断进一步落到了具体模型、具体任务时长和单任务成本上。 维度 7 月首版 9 月新版 主要变化 能力差距 顶级开放模型与 ChatGPT、Claude 等专有模型的性能差距为 3% 美国前沿闭源模型与中国最佳开放权重模型的差距为 4.4 个月 从单一综合性能百分比,改为更贴近实际工作的“任务时长”指标。 成本表述 GPT-4 级推理成本 3 年下降至 50 分之一 Kimi K3 成本为 Fable 5 的 30%;GLM 5.2 单任务成本约低至 5 分之一 新版给出模型对模型、任务对任务的直接成本对照。 使用数据 79% 开发者使用开放模型,51% 已部署...

    推荐理由:来自IT之家 AI的《Mozilla 报告:中美 AI 模型能力差距缩短至 4.4 个月》。重点看模型能力与工程、开源生态、产品发布。摘要提到:IT之家 9 月 16 日消息,Mozilla 昨日(9 月 15 日)发布第二版《开源 AI 现状》报告,报道称中国公司最佳开放权重模型与美国科技公司的前沿闭源模型, 能力差距已缩至 4.4 个月。 相比较今年 7 月发布的第一版《开源 AI 现状》报告,第二版报告把宏观判断进一步落到了具体模型、具体任务时长和单任务成本上。 维度 7 月首版 9 月新版 主要变化 能力差距 顶级开放模型与 ChatGPT、Claude 等专有模型的性能差距为 3% 美国前沿闭源模型与中国最佳开放权重模型的差距为 4.4 个月 从单一综合性能百分比,改为更贴近实际工作的“任务时长”指标。 成本表述 GPT-4 级推理成本 3 年下降至 50 分之一 Kimi K3 成本为 Fable 5 的 30%;GLM 5.2 单任务成本约低至 5 分之一 新版给出模型对模型、任务对任务的直接成本对照。 使用数据 79% 开发者使用开放模型,51% 已部署...

  10. 极客公园40

    腾讯、字节、阿里「会战」AI 办公之后:Agent 领域格局已变

    「这仗打错了,最多是白烧几十亿;但如果不打,可能是生死问题。」 这是创新工场联合首席执行官、管理合伙人汪华对大厂重金押注 AI 办公的判断。 2026 年的这个夏天,中国科技巨头发起了 Agent 时代第一场「战役」:豆包工作正式发布,TRAE、扣子团队整体并入豆包体系。更早的 7 月底,飞书产品团队并入豆包;另一边,腾讯的 WorkBuddy 已经跑出了千万月活,阿里也在整合自己的桌面 Agent、云端 Agent 和钉钉能力。 巨头为何会集体兴奋?AI 办公的背后他们在思考什么?在争夺什么?最近,极客公园邀请了汪华、Floatboat.ai 创始人兼 CEO 谭少卿一起来聊一聊。 今年初那场「小龙虾热」,本质上只是一场极客的自我狂欢。谭少卿说,「它是个过渡产品」,属于三类产品分层中的「极客产品」,从一开始就没打算走大众化路线。模型不够强、配置门槛高、Harness 不成熟,把普通用户挡在门外。 真正的转折发生在最近几个月。汪...

    推荐理由:来自极客公园的《腾讯、字节、阿里「会战」AI 办公之后:Agent 领域格局已变》。重点看智能体工作流、模型能力与工程、产品发布。摘要提到:「这仗打错了,最多是白烧几十亿;但如果不打,可能是生死问题。」 这是创新工场联合首席执行官、管理合伙人汪华对大厂重金押注 AI 办公的判断。 2026 年的这个夏天,中国科技巨头发起了 Agent 时代第一场「战役」:豆包工作正式发布,TRAE、扣子团队整体并入豆包体系。更早的 7 月底,飞书产品团队并入豆包;另一边,腾讯的 WorkBuddy 已经跑出了千万月活,阿里也在整合自己的桌面 Agent、云端 Agent 和钉钉能力。 巨头为何会集体兴奋?AI 办公的背后他们在思考什么?在争夺什么?最近,极客公园邀请了汪华、Floatboat.ai 创始人兼 CEO 谭少卿一起来聊一聊。 今年初那场「小龙虾热」,本质上只是一场极客的自我狂欢。谭少卿说,「它是个过渡产品」,属于三类产品分层中的「极客产品」,从一开始就没打算走大众化路线。模型不够强、配置门槛高、Harness 不成熟,把普通用户挡在门外。 真正的转折发生在最近几个月。汪...

  11. 量子位68

    清华稳准智能联合发布LimiX-2,结构化数据基础模型登顶国际评测榜单

    事实摘要:清华稳准智能联合发布LimiX-2,结构化数据基础模型登顶国际评测榜单 9月16日,稳准智能联合清华大学发布新一代数据大模型 LimiX-2,模型参数规模提升至400M。 这条动态来自 量子位,可重点关注模型能力与工程、评测与基准、产品发布。 清华稳准智能联合发布LimiX-2,结构化数据基础模型登顶国际评测榜单 9月16日,稳准智能联合清华大学发布新一代数。影响判断:它可能改变模型能力与工程、评测与基准相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程、评测与基准方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和模型能力与工程、评测与基准直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  12. 量子位70

    B站AI无限竞技场今日上线!全球百大AI模型同场竞技,GPT-6高居榜首

    事实摘要:B站AI无限竞技场今日上线!全球百大AI模型同场竞技,GPT-6高居榜首 9月16日,B站「AI无限竞技场」正式上线,首期大模型测评榜单同步公布。 这条动态来自 量子位,可重点关注模型能力与工程、产品发布。 B站AI无限竞技场今日上线!全球百大AI模型同场竞技,GPT-6高居榜首 9月16日,B站「AI无限竞技场」正式上线,首期大模型测评榜单同步公布。影响判断:它可能改变模型能力与工程相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和模型能力与工程直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  13. IT之家 AI72

    豆包大模型 2.1 Pro 更新 0915 版本:Agent 交付更可靠,多模态 Coding 进化

    IT之家 9 月 16 日消息,火山引擎官方今日宣布为豆包大模型 2.1 Pro 更新至 0915 版本, API 全量上线火山方舟 。 IT之家从官方获悉,豆包工作已完成升级,用户下载或升级至最新版,选取“豆包 2.1 Pro(0915 新版)”模型即可体验。 本次升级围绕企业生产级需求,覆盖 Agent 任务交付、多模态 Coding、多模态理解与 Token 效率优化。 除豆包外,TRAE 已同步接入 0915 版本。今年 6 月推出的 Doubao-Seed-Evolving 也更新至同一版本,企业无需更换 API 接入节点。 Agent 任务交付方面,官方称模型强化了证据溯源、权威信源检索、时效判断和数据核验能力,幻觉显著减少,更忠于工具调用事实。在金融投研、办公自动化等长报告任务中,结论有据可查,推进更稳。 以金融投研为例,官方称模型具备分析师级别分析框架,能自主拆解研究需求、查询高质量数据源并建模分析,产出专家级建...

    推荐理由:来自IT之家 AI的《豆包大模型 2.1 Pro 更新 0915 版本:Agent 交付更可靠,多模态 Coding 进化》。重点看智能体工作流、模型能力与工程、产品发布。摘要提到:IT之家 9 月 16 日消息,火山引擎官方今日宣布为豆包大模型 2.1 Pro 更新至 0915 版本, API 全量上线火山方舟 。 IT之家从官方获悉,豆包工作已完成升级,用户下载或升级至最新版,选取“豆包 2.1 Pro(0915 新版)”模型即可体验。 本次升级围绕企业生产级需求,覆盖 Agent 任务交付、多模态 Coding、多模态理解与 Token 效率优化。 除豆包外,TRAE 已同步接入 0915 版本。今年 6 月推出的 Doubao-Seed-Evolving 也更新至同一版本,企业无需更换 API 接入节点。 Agent 任务交付方面,官方称模型强化了证据溯源、权威信源检索、时效判断和数据核验能力,幻觉显著减少,更忠于工具调用事实。在金融投研、办公自动化等长报告任务中,结论有据可查,推进更稳。 以金融投研为例,官方称模型具备分析师级别分析框架,能自主拆解研究需求、查询高质量数据源并建模分析,产出专家级建...

  14. IT之家 AI72

    vivo 口袋编程智能体 BlueCode 预览版发布,预研手机端侧蓝心 30B MoE 模型

    IT之家 9 月 16 日消息,vivo 今日发布 原生编程智能体 BlueCode 预览版 ,目标把 AI 生产力装进口袋,同步探索让手机成为生产力终端。 同时,vivo 正在预研「蓝心 30B MoE 端侧大模型」, 探索在手机上应用 。 在今日的大会上,蓝心智能战略将全面升级,全新 OriginOS 7 与自研蓝河操作系统 4 同步登场,IT之家将持续跟进报道。

    推荐理由:来自IT之家 AI的《vivo 口袋编程智能体 BlueCode 预览版发布,预研手机端侧蓝心 30B MoE 模型》。重点看智能体工作流、模型能力与工程、产品发布。摘要提到:IT之家 9 月 16 日消息,vivo 今日发布 原生编程智能体 BlueCode 预览版 ,目标把 AI 生产力装进口袋,同步探索让手机成为生产力终端。 同时,vivo 正在预研「蓝心 30B MoE 端侧大模型」, 探索在手机上应用 。 在今日的大会上,蓝心智能战略将全面升级,全新 OriginOS 7 与自研蓝河操作系统 4 同步登场,IT之家将持续跟进报道。

  15. IT之家 AI74

    vivo 发布小 V Cowork,可在手机上发起和管理 PC 端的智能体任务

    IT之家 9 月 16 日消息,在今日的 2026 vivo 开发者大会上,vivo 发布了小 V Cowork。 据介绍,小 V Cowork 可以在手机上随时发起和管理 PC 端的智能体任务 ,让手机成为随身的任务入口。 此外,vivo 正在预研“蓝心 30B MoE 端侧大模型”,支持多模态高阶理解、跨领域长链推理、复杂任务自主执行,探索在手机上应用。 在今日的大会上,蓝心智能战略将全面升级, 全新 OriginOS 7 与自研蓝河操作系统 4 同步登场 ,IT之家将持续跟进报道。 相关阅读: 《 vivo 发布四款蓝心大模型,推出系统级蓝心 Harness 》 《 vivo 蓝心小 V Pro 发布:一句话拆解任务,跨端调用超 6000 项能力 》

    推荐理由:来自IT之家 AI的《vivo 发布小 V Cowork,可在手机上发起和管理 PC 端的智能体任务》。重点看智能体工作流、模型能力与工程、产品发布。摘要提到:IT之家 9 月 16 日消息,在今日的 2026 vivo 开发者大会上,vivo 发布了小 V Cowork。 据介绍,小 V Cowork 可以在手机上随时发起和管理 PC 端的智能体任务 ,让手机成为随身的任务入口。 此外,vivo 正在预研“蓝心 30B MoE 端侧大模型”,支持多模态高阶理解、跨领域长链推理、复杂任务自主执行,探索在手机上应用。 在今日的大会上,蓝心智能战略将全面升级, 全新 OriginOS 7 与自研蓝河操作系统 4 同步登场 ,IT之家将持续跟进报道。 相关阅读: 《 vivo 发布四款蓝心大模型,推出系统级蓝心 Harness 》 《 vivo 蓝心小 V Pro 发布:一句话拆解任务,跨端调用超 6000 项能力 》

  16. IT之家 AI70

    vivo 发布四款蓝心大模型,推出系统级蓝心 Harness

    IT之家 9 月 16 日消息,在今日的 2026 vivo 开发者大会上, vivo 发布了四款新的蓝心大模型 。 「 听得懂你的蓝心语音大模型 RealTime 」全新的端到端语音理解架构,融入更多你的个人化信息。更重要的是,嘈杂环境、轻声说话、带着口音、连续表达、中英混着说,它都听得懂。 「 记得住你的蓝心端侧大模型 Nano 」它的使命就是实时感知、沉淀个人记忆。它能融合理解屏幕、图像、视频、文本和文件,不仅看懂当下,还能长期记住你的习惯、偏好、用机状态、时空场景等。在多项权威评测中,蓝心端侧大模型感知与记忆能力保持行业领先,拿到多项榜单第一的成绩。 「 蓝心云侧大模型 Flash / Pro 」它是能办事的手机任务中控,通过自研 Agentic 引擎与系统级 Harness 深度匹配,把手机变成一个能为你干活的“总控台”。你说出意图,蓝心小 V 跨端、跨应用、跨场景替你执行。而且它越用越好用。每一次修正,都会变成它下一...

    推荐理由:来自IT之家 AI的《vivo 发布四款蓝心大模型,推出系统级蓝心 Harness》。重点看智能体工作流、模型能力与工程、评测与基准。摘要提到:IT之家 9 月 16 日消息,在今日的 2026 vivo 开发者大会上, vivo 发布了四款新的蓝心大模型 。 「 听得懂你的蓝心语音大模型 RealTime 」全新的端到端语音理解架构,融入更多你的个人化信息。更重要的是,嘈杂环境、轻声说话、带着口音、连续表达、中英混着说,它都听得懂。 「 记得住你的蓝心端侧大模型 Nano 」它的使命就是实时感知、沉淀个人记忆。它能融合理解屏幕、图像、视频、文本和文件,不仅看懂当下,还能长期记住你的习惯、偏好、用机状态、时空场景等。在多项权威评测中,蓝心端侧大模型感知与记忆能力保持行业领先,拿到多项榜单第一的成绩。 「 蓝心云侧大模型 Flash / Pro 」它是能办事的手机任务中控,通过自研 Agentic 引擎与系统级 Harness 深度匹配,把手机变成一个能为你干活的“总控台”。你说出意图,蓝心小 V 跨端、跨应用、跨场景替你执行。而且它越用越好用。每一次修正,都会变成它下一...

  17. IT之家 AI70

    OpenAI GPT-5.5 将于 10 月 14 日下线:覆盖 ChatGPT 与 Codex,官方建议迁移至新模型

    IT之家 9 月 16 日消息,OpenAI 今日宣布,GPT-5.5 将于 10 月 14 日从 ChatGPT、ChatGPT Work 和 Codex 中下线,覆盖所有订阅方案。 OpenAI 同时提醒,在 Codex 中使用 GPT-5.5 的用户应尽快切换至 GPT-5.6 Sol 或 GPT-6 Astra。 OpenAI 表示,此次停用范围包含所有计划。对于仍依赖 GPT-5.5 的 Codex 用户,官方给出的可选替代模型为 GPT-5.6 Sol 和 GPT-6 Astra。 IT之家此前报道,OpenAI 于今年 4 月 24 日宣布推出 GPT-5.5 模型,相比较 GPT-5.4 在完成相同任务的情况下减少词元(Token)消耗。 相关阅读: 《 OpenAI 奥尔特曼谈 GPT-5.5 自主策划发布会:希望人类开发者为其祝酒,但它自己拒绝发表祝酒词 》 《 OpenAI 最智能 AI 模型:GPT-5....

    推荐理由:来自IT之家 AI的《OpenAI GPT-5.5 将于 10 月 14 日下线:覆盖 ChatGPT 与 Codex,官方建议迁移至新模型》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 16 日消息,OpenAI 今日宣布,GPT-5.5 将于 10 月 14 日从 ChatGPT、ChatGPT Work 和 Codex 中下线,覆盖所有订阅方案。 OpenAI 同时提醒,在 Codex 中使用 GPT-5.5 的用户应尽快切换至 GPT-5.6 Sol 或 GPT-6 Astra。 OpenAI 表示,此次停用范围包含所有计划。对于仍依赖 GPT-5.5 的 Codex 用户,官方给出的可选替代模型为 GPT-5.6 Sol 和 GPT-6 Astra。 IT之家此前报道,OpenAI 于今年 4 月 24 日宣布推出 GPT-5.5 模型,相比较 GPT-5.4 在完成相同任务的情况下减少词元(Token)消耗。 相关阅读: 《 OpenAI 奥尔特曼谈 GPT-5.5 自主策划发布会:希望人类开发者为其祝酒,但它自己拒绝发表祝酒词 》 《 OpenAI 最智能 AI 模型:GPT-5....

  18. Apple Machine Learning Research89

    Shared Selective Persistent Memory for Agentic LLM Systems

    事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:Shared Selective Persistent Memory for Agentic LLM Systems 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:Shared Selective Persistent Memory for Age。影响判断:它可能改变智能体工作流、模型能力与工程、文化创意相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、文化创意方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程、文化创意直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  19. Apple Machine Learning Research50

    Trajectory as the Teacher: Few-Step Discrete Flow Matching via Energy-Navigated Distillation

    事实摘要:这条英文动态主要涉及模型能力与工程、评测与基准、教育应用,原文信息显示:Trajectory as the Teacher: Few-Step Discrete Flow Matching via Energy-Navigated Distillation 事实摘要:这条英文动态主要涉及模型能力与工程、评测与基准、教育应用,原文信息显示:Trajectory。影响判断:它可能改变模型能力与工程、评测与基准、教育应用相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程、评测与基准、教育应用方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和模型能力与工程、评测与基准、教育应用直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  20. IT之家 AI72

    OpenAI 奥尔特曼称 AI 行业自律可守住安全底线

    IT之家 9 月 16 日消息,昨日(9 月 15 日)在旧金山举办的 Salesforce 活动中,OpenAI 首席执行官萨姆 · 奥尔特曼(Sam Altman)认为, AI 公司行业自律可以掌控研发风险,不会对广大民众造成重大伤害。 IT之家援引雅虎财经报道,昨日对话 Salesforce 首席执行官马克 · 贝尼奥夫(Marc Benioff)时,奥尔特曼表示他相信在不对公众造成重大伤害的情况下, AI 公司可以安全地研发 AI 技术,并对整个行业自行提升安全水平抱有信心。 奥尔特曼近期强调,AI 安全不能只依赖企业口头承诺,更需要同步提升模型能力、对齐、安全性和保密性。OpenAI 还曾推迟前沿强化学习训练,把部分算力转向监控、安全护栏和风险评估。 奥尔特曼认为 AI 研发并非完全没有风险,但是通过行业协作、独立评估和更严格的安全流程等方式,可以在政府监管之外先行建立一套有效的安全保障机制,从而更安全、更高效地推进前...

    推荐理由:来自IT之家 AI的《OpenAI 奥尔特曼称 AI 行业自律可守住安全底线》。重点看模型能力与工程。摘要提到:IT之家 9 月 16 日消息,昨日(9 月 15 日)在旧金山举办的 Salesforce 活动中,OpenAI 首席执行官萨姆 · 奥尔特曼(Sam Altman)认为, AI 公司行业自律可以掌控研发风险,不会对广大民众造成重大伤害。 IT之家援引雅虎财经报道,昨日对话 Salesforce 首席执行官马克 · 贝尼奥夫(Marc Benioff)时,奥尔特曼表示他相信在不对公众造成重大伤害的情况下, AI 公司可以安全地研发 AI 技术,并对整个行业自行提升安全水平抱有信心。 奥尔特曼近期强调,AI 安全不能只依赖企业口头承诺,更需要同步提升模型能力、对齐、安全性和保密性。OpenAI 还曾推迟前沿强化学习训练,把部分算力转向监控、安全护栏和风险评估。 奥尔特曼认为 AI 研发并非完全没有风险,但是通过行业协作、独立评估和更严格的安全流程等方式,可以在政府监管之外先行建立一套有效的安全保障机制,从而更安全、更高效地推进前...

  21. Simon Willison93

    Gemini Live audio

    事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:Gemini Live audio 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:Gemini Live audio 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:Gemini Live audio 事实摘要:。影响判断:它可能改变智能体工作流、模型能力与工程、文化创意相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、文化创意方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程、文化创意直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  22. IT之家 AI70

    谷歌 TPU AI 基建规模迈入 100 万级,核心瓶颈从“缺芯”转向“缺电”

    IT之家 9 月 16 日消息,在 SEMICON Taiwan 2026 活动中,谷歌宣布其 TPU 系统已扩展至 100 万芯片级规模, 而电力供应成为 AI 基础设施扩张的核心瓶颈。 IT之家注:这里的“100 万芯片级规模”是指谷歌的 TPU 互联架构(包括网络拓扑、通信协议、软件栈等)已经能够支持将最多 100 万颗 TPU 芯片连接成一个统一的计算集群,实现协同工作。 该技术能力的突破,意味着超大规模 AI 模型训练可以跨越多个数据中心、多个 Pod 进行分布式训练, 而电力供应(而非芯片数量)已成为限制进一步扩张的核心瓶颈。 在题为“思维的物理学和智能的架构”活动演讲中,谷歌首席技术官阿明 · 瓦赫达特(Amin Vahdat)指出,随着 AI 模型规模不断扩大, 制约扩张的核心瓶颈已从芯片本身转移至 电力供给 ,AI 算力的天花板正在从“造不出芯片”变成“找不到电”。 瓦赫达特还称 AI 已经进入“智能体人工智能...

    推荐理由:来自IT之家 AI的《谷歌 TPU AI 基建规模迈入 100 万级,核心瓶颈从“缺芯”转向“缺电”》。重点看智能体工作流、模型能力与工程。摘要提到:IT之家 9 月 16 日消息,在 SEMICON Taiwan 2026 活动中,谷歌宣布其 TPU 系统已扩展至 100 万芯片级规模, 而电力供应成为 AI 基础设施扩张的核心瓶颈。 IT之家注:这里的“100 万芯片级规模”是指谷歌的 TPU 互联架构(包括网络拓扑、通信协议、软件栈等)已经能够支持将最多 100 万颗 TPU 芯片连接成一个统一的计算集群,实现协同工作。 该技术能力的突破,意味着超大规模 AI 模型训练可以跨越多个数据中心、多个 Pod 进行分布式训练, 而电力供应(而非芯片数量)已成为限制进一步扩张的核心瓶颈。 在题为“思维的物理学和智能的架构”活动演讲中,谷歌首席技术官阿明 · 瓦赫达特(Amin Vahdat)指出,随着 AI 模型规模不断扩大, 制约扩张的核心瓶颈已从芯片本身转移至 电力供给 ,AI 算力的天花板正在从“造不出芯片”变成“找不到电”。 瓦赫达特还称 AI 已经进入“智能体人工智能...

  23. Claude Code Releases94

    Claude Code Releases v2.1.273:Added x-claude-code-request-class , x-claude-code-agent-ty...

    事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、评测与基准,原文信息显示:Claude Code Releases v2.1.273:Added x-claude-code-request-class , x-claude-code-agent-ty... 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、评测与基准,原文信息显示:Claude 。影响判断:它可能改变智能体工作流、模型能力与工程、评测与基准相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、评测与基准方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程、评测与基准直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  24. IT之家 AI72

    谷歌推出 Gemini 3.8 Live 和 3.8 Live Extended Thinking 实时对话模型,支持 97 种语言切换

    IT之家 9 月 16 日消息,当地时间 9 月 15 日,谷歌宣布推出 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking。谷歌称这是其迄今最先进的实时对话模型,在智能和并行推理方面有重大升级,让 AI 对话更直观智能。 两款新品分别为面向规模部署与成本优化的 Gemini 3.8 Live ,以及面向高复杂度任务、强化多步推理能力的 Gemini 3.8 Live Extended Thinking 。 Gemini 3.8 Live 兼顾对话智能、流畅交流和视觉理解,面向规模化与成本效率。Gemini 3.8 Live Extended Thinking 面向高复杂度任务,具备更强的智能和多步推理能力。 Gemini 3.8 Live Extended Thinking 在多项基准测试中取得领先成绩,拿下 Artificial Analysis 语音对语音质量指数总排名第...

    推荐理由:来自IT之家 AI的《谷歌推出 Gemini 3.8 Live 和 3.8 Live Extended Thinking 实时对话模型,支持 97 种语言切换》。重点看模型能力与工程、评测与基准、文化创意。摘要提到:IT之家 9 月 16 日消息,当地时间 9 月 15 日,谷歌宣布推出 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking。谷歌称这是其迄今最先进的实时对话模型,在智能和并行推理方面有重大升级,让 AI 对话更直观智能。 两款新品分别为面向规模部署与成本优化的 Gemini 3.8 Live ,以及面向高复杂度任务、强化多步推理能力的 Gemini 3.8 Live Extended Thinking 。 Gemini 3.8 Live 兼顾对话智能、流畅交流和视觉理解,面向规模化与成本效率。Gemini 3.8 Live Extended Thinking 面向高复杂度任务,具备更强的智能和多步推理能力。 Gemini 3.8 Live Extended Thinking 在多项基准测试中取得领先成绩,拿下 Artificial Analysis 语音对语音质量指数总排名第...

  25. Google AI Blog55

    AI for everyone in every language

    这条英文动态主要涉及模型能力与工程。原文要点:We’re moving beyond traditional text translation to build models that understand the world’s rich, living languages exactly as they are expressed.

    推荐理由:来自Google AI Blog的《AI for everyone in every language》。重点看模型能力与工程。摘要提到:这条英文动态主要涉及模型能力与工程。原文要点:We’re moving beyond traditional text translation to build models that understand the world’s rich, living languages exactly as they are expressed.

9月15日周二
  1. IT之家 AI70

    中文互联网基础语料 4.0 发布:数据量 120GB,为大模型训练和 AI 发展提供可信数据支撑

    IT之家 9 月 15 日消息,据中国网络空间安全协会官方公众号,9 月 15 日(今天)下午,在济南召开的 2026 年国家网络安全宣传周人工智能安全治理分论坛上,中文互联网基础语料 4.0 正式向社会发布, 数据量 120GB ,并在“中文互联网语料资源平台”上线。 据IT之家了解,用户登录中国网络空间安全协会官网( 点此前往 ),点击“中文互联网语料资源平台”链接,通过注册、认证等程序,即可下载或联系获取相关数据。 在中央网信办指导下,中国网络空间安全协会联合国家互联网应急中心,会同 百度、中科闻歌、开普云、拓尔思、科大讯飞、知乎 等单位,在前期发布中文互联网基础语料 1.0、2.0 和 3.0 的基础上,依托网安协会人工智能安全治理专委会建立的语料共建共享机制,汇聚一批新的高质量可信数据,经过一系列严格细致的数据加工处理措施,形成并对社会发布中文互联网基础语料 4.0,数据量 120GB, 为大模型训练和人工智能发展提供...

    推荐理由:来自IT之家 AI的《中文互联网基础语料 4.0 发布:数据量 120GB,为大模型训练和 AI 发展提供可信数据支撑》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 15 日消息,据中国网络空间安全协会官方公众号,9 月 15 日(今天)下午,在济南召开的 2026 年国家网络安全宣传周人工智能安全治理分论坛上,中文互联网基础语料 4.0 正式向社会发布, 数据量 120GB ,并在“中文互联网语料资源平台”上线。 据IT之家了解,用户登录中国网络空间安全协会官网( 点此前往 ),点击“中文互联网语料资源平台”链接,通过注册、认证等程序,即可下载或联系获取相关数据。 在中央网信办指导下,中国网络空间安全协会联合国家互联网应急中心,会同 百度、中科闻歌、开普云、拓尔思、科大讯飞、知乎 等单位,在前期发布中文互联网基础语料 1.0、2.0 和 3.0 的基础上,依托网安协会人工智能安全治理专委会建立的语料共建共享机制,汇聚一批新的高质量可信数据,经过一系列严格细致的数据加工处理措施,形成并对社会发布中文互联网基础语料 4.0,数据量 120GB, 为大模型训练和人工智能发展提供...

  2. IT之家 AI68

    将降本增效进行到底,Meta 计划明年上半年部署新一代自研 AI 芯片

    IT之家 9 月 15 日消息,据彭博社今天(15 日)报道,Meta 计划明年上半年在数据中心 部署新一代自研 AI 芯片 ,希望在运行 AI 模型时进一步 降低成本和能耗 。 Meta 于 2023 年公布自研 AI 芯片计划,目前正在测试 第三代产品 MTIA 450,代号 Arke 。下一代 MTIA 500 代号 Astrid,预计约一个月后完成设计,并于 2027 年底进入数据中心。相比前几代产品,Meta 计划更大范围部署 Astrid。 负责 Meta 定制芯片项目的工程副总裁 Yee Jiun Song 接受采访时指出,每一代产品都会在技术上承担稍高一些的风险,同时换来更好的性能。 具体而言,新一代芯片不仅要提高能效,也要在同等投入下 提供更强性能 。Meta 正大举建设 AI 基础设施,自研芯片是其中的重要一环。芯片由 Meta 与博通合作设计、台积电负责制造,目标之一是减少对英伟达领先 AI 处理器的依赖。...

    推荐理由:来自IT之家 AI的《将降本增效进行到底,Meta 计划明年上半年部署新一代自研 AI 芯片》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 15 日消息,据彭博社今天(15 日)报道,Meta 计划明年上半年在数据中心 部署新一代自研 AI 芯片 ,希望在运行 AI 模型时进一步 降低成本和能耗 。 Meta 于 2023 年公布自研 AI 芯片计划,目前正在测试 第三代产品 MTIA 450,代号 Arke 。下一代 MTIA 500 代号 Astrid,预计约一个月后完成设计,并于 2027 年底进入数据中心。相比前几代产品,Meta 计划更大范围部署 Astrid。 负责 Meta 定制芯片项目的工程副总裁 Yee Jiun Song 接受采访时指出,每一代产品都会在技术上承担稍高一些的风险,同时换来更好的性能。 具体而言,新一代芯片不仅要提高能效,也要在同等投入下 提供更强性能 。Meta 正大举建设 AI 基础设施,自研芯片是其中的重要一环。芯片由 Meta 与博通合作设计、台积电负责制造,目标之一是减少对英伟达领先 AI 处理器的依赖。...

  3. Cloudflare AI86

    Have it both ways: stay discoverable in search while disallowing AI training

    事实摘要:这条英文动态主要涉及模型能力与工程,原文信息显示:Have it both ways: stay discoverable in search while disallowing AI training 事实摘要:这条英文动态主要涉及模型能力与工程,原文信息显示:Have it both ways: stay discoverable in search w。影响判断:它可能改变模型能力与工程相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和模型能力与工程直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  4. IT之家 AI76

    Salesforce 联合英伟达推出 Koa 推理大模型,挑战闭源前沿模型

    IT之家 9 月 15 日消息,本周在规模盛大的 Dreamforce 技术大会上,Salesforce 最重要的发布成果之一就是一款名叫 Koa 的全新 AI 模型。Koa 是该公司首款推理大模型,基于英伟达开源权重的 Nemotron 模型打造。两家企业联合完成了 Koa 的后续微调训练,让其擅长处理销售、市场营销以及客户服务类任务。 Koa 是一个很典型的例子:面向企业的 AI 需求,正在和前沿 AI 实验室所提供的产品逐渐分化。那些闭源 AI 实验室更希望企业直接把文件、代码、提示词以及反馈全部上传到自家模型与智能体当中,并为此花费数百万美元。 而借助这款模型,Salesforce 向它的企业客户提供了以下能力: 作为闭源前沿大模型之外、采用开源权重的备选方案 专门针对实际业务任务训练(而不是主攻高难度数学解题) 训练过程没有摄入任何真实客户数据,因此不存在向外泄露客户数据的风险 有助于降低 AI 使用成本,完成同等业务...

    推荐理由:来自IT之家 AI的《Salesforce 联合英伟达推出 Koa 推理大模型,挑战闭源前沿模型》。重点看智能体工作流、模型能力与工程、开源生态。摘要提到:IT之家 9 月 15 日消息,本周在规模盛大的 Dreamforce 技术大会上,Salesforce 最重要的发布成果之一就是一款名叫 Koa 的全新 AI 模型。Koa 是该公司首款推理大模型,基于英伟达开源权重的 Nemotron 模型打造。两家企业联合完成了 Koa 的后续微调训练,让其擅长处理销售、市场营销以及客户服务类任务。 Koa 是一个很典型的例子:面向企业的 AI 需求,正在和前沿 AI 实验室所提供的产品逐渐分化。那些闭源 AI 实验室更希望企业直接把文件、代码、提示词以及反馈全部上传到自家模型与智能体当中,并为此花费数百万美元。 而借助这款模型,Salesforce 向它的企业客户提供了以下能力: 作为闭源前沿大模型之外、采用开源权重的备选方案 专门针对实际业务任务训练(而不是主攻高难度数学解题) 训练过程没有摄入任何真实客户数据,因此不存在向外泄露客户数据的风险 有助于降低 AI 使用成本,完成同等业务...

  5. IT之家 AI72

    OpenAI 内部 Lily 项目曝光:人工审核 ChatGPT 用户聊天记录以优化大模型

    IT之家 9 月 15 日消息,众所周知,ChatGPT 这类平台的对话日志会被用来优化模型。但在此之前,这套处理机制一直是个谜。404 Media 刚刚发布了一份报道,披露了 OpenAI 对聊天记录开展人工审核的整套流程,介绍了审核如何运作,以及审核人员有时会读到用户私人信息这一情况。 OpenAI 内部这项评估项目代号为莉莉计划(Project Lily)。该媒体获取到了该项目的操作指引文档、Slack 工作群组记录、真实的 ChatGPT 对话样本,还有用于给对话分级的评分体系。从事这项工作的人员被称作“提示词审核员”。他们的工作内容并不复杂:查看经过匿名化处理的真实用户聊天记录,评判 ChatGPT 回复的质量;评估回答是否切题,同时检查回复文本是否过度出现“AI 式话术”、居高临下的说教语气、表情符号、谄媚口吻等问题。回复禁止拟人化表述,也不允许编造“个人经历”。也就是说,ChatGPT 可以说“我查到了一些相关信息...

    推荐理由:来自IT之家 AI的《OpenAI 内部 Lily 项目曝光:人工审核 ChatGPT 用户聊天记录以优化大模型》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 15 日消息,众所周知,ChatGPT 这类平台的对话日志会被用来优化模型。但在此之前,这套处理机制一直是个谜。404 Media 刚刚发布了一份报道,披露了 OpenAI 对聊天记录开展人工审核的整套流程,介绍了审核如何运作,以及审核人员有时会读到用户私人信息这一情况。 OpenAI 内部这项评估项目代号为莉莉计划(Project Lily)。该媒体获取到了该项目的操作指引文档、Slack 工作群组记录、真实的 ChatGPT 对话样本,还有用于给对话分级的评分体系。从事这项工作的人员被称作“提示词审核员”。他们的工作内容并不复杂:查看经过匿名化处理的真实用户聊天记录,评判 ChatGPT 回复的质量;评估回答是否切题,同时检查回复文本是否过度出现“AI 式话术”、居高临下的说教语气、表情符号、谄媚口吻等问题。回复禁止拟人化表述,也不允许编造“个人经历”。也就是说,ChatGPT 可以说“我查到了一些相关信息...

  6. IT之家 AI70

    曝百度挖来前谷歌 DeepMind 核心成员 Qiyin Wu,曾是 Gemini 2.5 模型官方报告核心作者

    IT之家 9 月 15 日消息,据雷峰网今日爆料,前谷歌 DeepMind 主任工程师、Gemini 大模型核心研发成员 Qiyin Wu 已在近期正式加入百度, 负责大模型预训练相关工作 。 据报道,Qiyin Wu 在谷歌的职级是 L6-L7,对标国内阿里 P9/P10、字节 3-2/4-1,入职后在美国办公。 履历方面,这名华人女性科学家拥有斯坦福大学计算机硕士学位,加入 DeepMind 并晋升为 Staff Engineer 之前,她曾在谷歌多个核心技术团队深耕,并在加州大学伯克利分校 (UC Berkeley) 工程学院的相关项目中积累过丰富经验。 IT之家查询互联网公开资料获悉, Qiyin Wu 曾是谷歌 Gemini 2.5 系列大模型官方技术报告的核心作者、共同贡献者 。

    推荐理由:来自IT之家 AI的《曝百度挖来前谷歌 DeepMind 核心成员 Qiyin Wu,曾是 Gemini 2.5 模型官方报告核心作者》。重点看模型能力与工程。摘要提到:IT之家 9 月 15 日消息,据雷峰网今日爆料,前谷歌 DeepMind 主任工程师、Gemini 大模型核心研发成员 Qiyin Wu 已在近期正式加入百度, 负责大模型预训练相关工作 。 据报道,Qiyin Wu 在谷歌的职级是 L6-L7,对标国内阿里 P9/P10、字节 3-2/4-1,入职后在美国办公。 履历方面,这名华人女性科学家拥有斯坦福大学计算机硕士学位,加入 DeepMind 并晋升为 Staff Engineer 之前,她曾在谷歌多个核心技术团队深耕,并在加州大学伯克利分校 (UC Berkeley) 工程学院的相关项目中积累过丰富经验。 IT之家查询互联网公开资料获悉, Qiyin Wu 曾是谷歌 Gemini 2.5 系列大模型官方技术报告的核心作者、共同贡献者 。

  7. 量子位70

    无问芯穹联合清华、上交正式开源具身端侧推理引擎APXInf,Pi 0.5性能SOTA

    事实摘要:无问芯穹联合清华、上交正式开源具身端侧推理引擎APXInf,Pi 0.5性能SOTA 卡位具身智能规模化落地“最后一公里”! 这条动态来自 量子位,可重点关注模型能力与工程、开源生态。 无问芯穹联合清华、上交正式开源具身端侧推理引擎APXInf,Pi 0.5性能SOTA 卡位具身智能规模化落地“最后一公里”!。影响判断:它可能改变模型能力与工程、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程、开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和模型能力与工程、开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  8. 量子位38

    全球AI视频榜单第一梯队再添中国力量:智象发布首款物理规律导向视频模型

    事实摘要:全球AI视频榜单第一梯队再添中国力量:智象发布首款物理规律导向视频模型 智象未来(HiDream.ai)正式发布首个原生全模态视频生成模型 HiDream-O1-Video-1.0 这条动态来自 量子位,可重点关注模型能力与工程、产品发布。 全球AI视频榜单第一梯队再添中国力量:智象发布首款物理规律导向视频模型 智象未来(HiDream.ai)正式发布首个原。影响判断:它可能改变模型能力与工程相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和模型能力与工程直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  9. IT之家 AI74

    马斯克放话:Grok 4.9 或能与 Astra / Fable 同级、Grok 5 有望实现 AGI

    IT之家 9 月 15 日消息,xAI 首席执行官埃隆 · 马斯克昨日在 X 平台与网友互动时透露,Grok 4.7 模型的能力大致与 Anthropic Opus 5.0 相同,而不是 5.1,它们还需要修复多模态性能。 马斯克表示,未来的 Grok 4.8 将带来明显改进, Grok 4.9 可能与 OpenAI Astra(GPT-6)或 Anthropic Fable 同级 ,Grok 5 也许会超越目前的一切,请大家“拭目以待”。 后续有网友向马斯克提问:“你认为 Grok 4.8 距离 AGI 实现有多近?” 马斯克回复称:“这将会是 Grok 5” 。 IT之家此前报道 ,马斯克曾声称 Grok 4.8 将于本周完成训练,这是一款参数量达 2.5 万亿的 AI 模型,使用全新 C++ 软件栈训练。

    推荐理由:来自IT之家 AI的《马斯克放话:Grok 4.9 或能与 Astra / Fable 同级、Grok 5 有望实现 AGI》。重点看模型能力与工程。摘要提到:IT之家 9 月 15 日消息,xAI 首席执行官埃隆 · 马斯克昨日在 X 平台与网友互动时透露,Grok 4.7 模型的能力大致与 Anthropic Opus 5.0 相同,而不是 5.1,它们还需要修复多模态性能。 马斯克表示,未来的 Grok 4.8 将带来明显改进, Grok 4.9 可能与 OpenAI Astra(GPT-6)或 Anthropic Fable 同级 ,Grok 5 也许会超越目前的一切,请大家“拭目以待”。 后续有网友向马斯克提问:“你认为 Grok 4.8 距离 AGI 实现有多近?” 马斯克回复称:“这将会是 Grok 5” 。 IT之家此前报道 ,马斯克曾声称 Grok 4.8 将于本周完成训练,这是一款参数量达 2.5 万亿的 AI 模型,使用全新 C++ 软件栈训练。

  10. IT之家 AI72

    让网络生态少一些情绪对抗,抖音发布“可信友善社区”计划

    IT之家 9 月 15 日消息,抖音今日宣布启动“可信社区守护计划”与“友善社区共建计划”,希望所有用户能够在抖音安心浏览、理性发声、友善互动,让网络生态少一些情绪对抗、多一分友善理性。 IT之家从“抖音黑板报”公众号了解到,“可信社区守护计划”主打可信产品建设、AI+ 体系治理等。官方将优化自主声明机制, 引导创作者主动标记内容来源 ,清晰区分艺术创作与现实记录。官方将打造“AI 求真”辟谣与事实核查入口,帮助用户快速获取存疑消息信源与时间全貌。 同时,抖音官方将建立常态化辟谣信息发布机制,通过榜单、官号、媒体辟谣团等机制提供信息。官方还将严控 AIGC 滥用,根据生成痕迹判断 AI 生成内容。 严厉打击恶意营销号 、 虚假摆拍等 。 抖音将守护友善社区。官方倡导用户理性友善表达,对网暴认定标准、严重情节、特殊保护对象和治理措施等进行更清晰的界定和公开。使用 AI 大模型模拟用户群体, 对争议内容生成指数 , 治理极端观点 。

    推荐理由:来自IT之家 AI的《让网络生态少一些情绪对抗,抖音发布“可信友善社区”计划》。重点看模型能力与工程、文化创意、产品发布。摘要提到:IT之家 9 月 15 日消息,抖音今日宣布启动“可信社区守护计划”与“友善社区共建计划”,希望所有用户能够在抖音安心浏览、理性发声、友善互动,让网络生态少一些情绪对抗、多一分友善理性。 IT之家从“抖音黑板报”公众号了解到,“可信社区守护计划”主打可信产品建设、AI+ 体系治理等。官方将优化自主声明机制, 引导创作者主动标记内容来源 ,清晰区分艺术创作与现实记录。官方将打造“AI 求真”辟谣与事实核查入口,帮助用户快速获取存疑消息信源与时间全貌。 同时,抖音官方将建立常态化辟谣信息发布机制,通过榜单、官号、媒体辟谣团等机制提供信息。官方还将严控 AIGC 滥用,根据生成痕迹判断 AI 生成内容。 严厉打击恶意营销号 、 虚假摆拍等 。 抖音将守护友善社区。官方倡导用户理性友善表达,对网暴认定标准、严重情节、特殊保护对象和治理措施等进行更清晰的界定和公开。使用 AI 大模型模拟用户群体, 对争议内容生成指数 , 治理极端观点 。