跳到正文
10月4日周日
  1. IT之家 AI38

    大量 AI“幻觉”报告压垮维护团队,谷歌暂停部分开源漏洞奖励计划

    IT之家 10 月 4 日消息,谷歌宣布,自 2026 年 10 月 1 日起,开源软件漏洞奖励计划(OSS VRP)将不再接收产品漏洞提报。本次规则调整不影响 2026 年 10 月 1 日之前已提交的产品漏洞。 不过,针对部分可能对谷歌云(Google Cloud)产品造成影响的谷歌云代码仓库,如果涉及产品漏洞,谷歌仍可能通过云漏洞奖励计划(Cloud VRP)接收相关报告。 OSS VRP 是谷歌设立的一项专业安全赏金计划,旨在通过激励独立安全研究人员,在谷歌整个开源生态系统中挖掘并负责任地披露安全缺陷。 据 Tom's Hardware 报道,知情人士透露, 谷歌工程师与开源代码维护人员已被数以千计的劣质报告彻底吞没 。这些报告声称发现了严重漏洞,但深入排查后发现,它们全都是 AI 产生的“幻觉”,根本无效且无法被实际利用。 维护团队不得不将大量精力耗费在验证这些虚假代码上,严重挤占了修复现实中高危漏洞的时间。这正是导致...

    推荐理由:来自IT之家 AI的《大量 AI“幻觉”报告压垮维护团队,谷歌暂停部分开源漏洞奖励计划》。重点看开源生态、产品发布。摘要提到:IT之家 10 月 4 日消息,谷歌宣布,自 2026 年 10 月 1 日起,开源软件漏洞奖励计划(OSS VRP)将不再接收产品漏洞提报。本次规则调整不影响 2026 年 10 月 1 日之前已提交的产品漏洞。 不过,针对部分可能对谷歌云(Google Cloud)产品造成影响的谷歌云代码仓库,如果涉及产品漏洞,谷歌仍可能通过云漏洞奖励计划(Cloud VRP)接收相关报告。 OSS VRP 是谷歌设立的一项专业安全赏金计划,旨在通过激励独立安全研究人员,在谷歌整个开源生态系统中挖掘并负责任地披露安全缺陷。 据 Tom's Hardware 报道,知情人士透露, 谷歌工程师与开源代码维护人员已被数以千计的劣质报告彻底吞没 。这些报告声称发现了严重漏洞,但深入排查后发现,它们全都是 AI 产生的“幻觉”,根本无效且无法被实际利用。 维护团队不得不将大量精力耗费在验证这些虚假代码上,严重挤占了修复现实中高危漏洞的时间。这正是导致...

10月3日周六
  1. IT之家 AI72

    如何用好 GPT-6 系列 AI 模型?OpenAI 放出指南,教你选模型、优化提示词等

    IT之家 10 月 3 日消息,OpenAI 昨日(10 月 2 日)发布博文,分享了 GPT‑6 系列模型指南,介绍了诸多使用技巧, 让用户控制时间和成本的同时,充分发挥 GPT‑6 系列 AI 模型能力。 官方介绍称: GPT‑6 是我们迄今最先进的模型系列,提供多款模型供你选择,以适应不同类型的工作。 无论你是将想法转化为可运行的原型、开发并测试功能,还是编排跨代码仓库、数据库和外部 API 的多步骤工作流,本指南都会介绍如何选择 GPT‑6 模型、为其提供有效指令、管理长时间运行的任务,以及为投入生产做好准备。 在模型选择方面,OpenAI 公司推荐用户根据工作负载选择模型,不必默认用“最强”模型;简单任务用轻量模型通常更快、更便宜: GPT‑6 Astra 适合需要最高智能水平、难度最大的推理工作。 GPT‑6.1 Sol⁠ 适合复杂编程、研究和计算机使用任务。 GPT‑6 Luna⁠适合大规模处理特定任务,以及目标明...

    推荐理由:来自IT之家 AI的《如何用好 GPT-6 系列 AI 模型?OpenAI 放出指南,教你选模型、优化提示词等》。重点看智能体工作流、模型能力与工程、产品发布。摘要提到:IT之家 10 月 3 日消息,OpenAI 昨日(10 月 2 日)发布博文,分享了 GPT‑6 系列模型指南,介绍了诸多使用技巧, 让用户控制时间和成本的同时,充分发挥 GPT‑6 系列 AI 模型能力。 官方介绍称: GPT‑6 是我们迄今最先进的模型系列,提供多款模型供你选择,以适应不同类型的工作。 无论你是将想法转化为可运行的原型、开发并测试功能,还是编排跨代码仓库、数据库和外部 API 的多步骤工作流,本指南都会介绍如何选择 GPT‑6 模型、为其提供有效指令、管理长时间运行的任务,以及为投入生产做好准备。 在模型选择方面,OpenAI 公司推荐用户根据工作负载选择模型,不必默认用“最强”模型;简单任务用轻量模型通常更快、更便宜: GPT‑6 Astra 适合需要最高智能水平、难度最大的推理工作。 GPT‑6.1 Sol⁠ 适合复杂编程、研究和计算机使用任务。 GPT‑6 Luna⁠适合大规模处理特定任务,以及目标明...

10月2日周五
  1. GitHub Changelog86

    GitHub Copilot in VS Code, September 2026 releases

    事实摘要:这条英文动态主要涉及智能体工作流、开源生态,原文信息显示:GitHub Copilot in VS Code, September 2026 releases 事实摘要:这条英文动态主要涉及智能体工作流、开源生态,原文信息显示:GitHub Copilot in VS Code, September 2026 releases 事实摘要:这条英文动态主要涉及。影响判断:它可能改变智能体工作流、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  2. GitHub Changelog82

    Code coverage uploads no longer fail CI for new branches

    事实摘要:这条英文动态主要涉及开源生态,原文信息显示:Code coverage uploads no longer fail CI for new branches 事实摘要:这条英文动态主要涉及开源生态,原文信息显示:Code coverage uploads no longer fail CI for new branches 事实摘要:这条英文动态主要涉及开源。影响判断:它可能改变开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  3. GitHub Changelog85

    Dynamic workflows in Copilot CLI and the Copilot app

    事实摘要:这条英文动态主要涉及智能体工作流、开源生态,原文信息显示:Dynamic workflows in Copilot CLI and the Copilot app 事实摘要:这条英文动态主要涉及智能体工作流、开源生态,原文信息显示:Dynamic workflows in Copilot CLI and the Copilot app 事实摘要:这条英文动态。影响判断:它可能改变智能体工作流、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

10月1日周四
  1. IT之家 AI74

    微软更新 1.140 版 VS Code:多文件夹会话、远程 AI Agent 任务委派等

    IT之家 10 月 1 日消息,微软昨日(9 月 30 日)更新推出 1.140 稳定版 Visual Studio Code,本次更新重点围绕 GitHub Copilot Agent 工作流展开, 新增多文件夹会话、远程任务委派、模型协同编排及企业级 AI 管理能力。 VS Code 1.140 引入实验性多文件夹会话功能。同一 Agent 会话中的不同聊天,可以分别绑定到不同代码仓库或 Git worktree,彼此之间的终端、任务、代码变更、Pull Request 和合并状态相互隔离,避免修改意外串联。 本次更新还增强 Copilot harness,由 Copilot SDK 提供支持,在基于智能体主机协议 (AHP) 的专用智能体主机进程中运行,统一 VS Code、Copilot 应用和 Copilot CLI 的 Agent 行为。 本次更新还以研究预览形式,推出 HydraFusion 模型编排,自动选择模型...

    推荐理由:来自IT之家 AI的《微软更新 1.140 版 VS Code:多文件夹会话、远程 AI Agent 任务委派等》。重点看智能体工作流、模型能力与工程、开源生态。摘要提到:IT之家 10 月 1 日消息,微软昨日(9 月 30 日)更新推出 1.140 稳定版 Visual Studio Code,本次更新重点围绕 GitHub Copilot Agent 工作流展开, 新增多文件夹会话、远程任务委派、模型协同编排及企业级 AI 管理能力。 VS Code 1.140 引入实验性多文件夹会话功能。同一 Agent 会话中的不同聊天,可以分别绑定到不同代码仓库或 Git worktree,彼此之间的终端、任务、代码变更、Pull Request 和合并状态相互隔离,避免修改意外串联。 本次更新还增强 Copilot harness,由 Copilot SDK 提供支持,在基于智能体主机协议 (AHP) 的专用智能体主机进程中运行,统一 VS Code、Copilot 应用和 Copilot CLI 的 Agent 行为。 本次更新还以研究预览形式,推出 HydraFusion 模型编排,自动选择模型...

9月30日周三
  1. GitHub Changelog87

    HydraFusion in VS Code and the GitHub Copilot app

    事实摘要:这条英文动态主要涉及模型能力与工程、开源生态,原文信息显示:HydraFusion in VS Code and the GitHub Copilot app 事实摘要:这条英文动态主要涉及模型能力与工程、开源生态,原文信息显示:HydraFusion in VS Code and the GitHub Copilot app 事实摘要:这条英文动态主要涉及。影响判断:它可能改变模型能力与工程、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程、开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和模型能力与工程、开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  2. IT之家 AI70

    蚂蚁百灵发布 Ling-3.1-flash 模型:约 560B 总参数、25B 激活参数

    IT之家 9 月 30 日消息,蚂蚁百灵今日发布 Ling-3.1-flash 模型,拥有约 560B 总参数,每个 Token 激活约 25B 参数; 模型上下文窗口上限为 1M ,可容纳更长的文档、代码和任务历史。 官方表示,在研发过程中,围绕通用智能体、搜索、日常办公和软件研发等任务持续优化,并在医疗、金融和材料科学研究等场景持续提升模型能力。 此外, Ling-3.1-flash 将开放为期两周的免费体验 ;考虑到综合服务成本,免费体验期间模型服务长度为 256K。 免费体验期结束并转为付费服务后,计划开放 1M 上下文。届时, 团队也计划同步开源 ,并继续更新模型性能。 IT之家附这款模型在多个任务评测中得分如下:

    推荐理由:来自IT之家 AI的《蚂蚁百灵发布 Ling-3.1-flash 模型:约 560B 总参数、25B 激活参数》。重点看智能体工作流、模型能力与工程、评测与基准。摘要提到:IT之家 9 月 30 日消息,蚂蚁百灵今日发布 Ling-3.1-flash 模型,拥有约 560B 总参数,每个 Token 激活约 25B 参数; 模型上下文窗口上限为 1M ,可容纳更长的文档、代码和任务历史。 官方表示,在研发过程中,围绕通用智能体、搜索、日常办公和软件研发等任务持续优化,并在医疗、金融和材料科学研究等场景持续提升模型能力。 此外, Ling-3.1-flash 将开放为期两周的免费体验 ;考虑到综合服务成本,免费体验期间模型服务长度为 256K。 免费体验期结束并转为付费服务后,计划开放 1M 上下文。届时, 团队也计划同步开源 ,并继续更新模型性能。 IT之家附这款模型在多个任务评测中得分如下:

  3. GitHub Changelog94

    GPT-6.1 Sol in GitHub Copilot

    事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:GPT-6.1 Sol in GitHub Copilot 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:GPT-6.1 Sol in GitHub Copilot 事实摘要:GPT-6.1 Sol in GitHub Copilot 事实摘要:G。影响判断:它可能改变智能体工作流、模型能力与工程、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程、开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

9月29日周二
  1. IT之家 AI72

    内部测试发现安全隐患,消息称 OpenAI 取消发布 AI 模型 GPT‑6.1 Astra

    IT之家 9 月 29 日消息,据《华尔街日报》报道,由于内部测试过程中研究人员提出多项安全隐患,OpenAI 决定取消 GPT‑6.1 Astra 的发布。这款下一代 AI 模型原本计划于 10 月正式亮相。 报道称,该模型原定部署于 ChatGPT 以及 Codex 产品当中,设计目标是无需人类协助就可以处理更加复杂的任务。 本月早些时候,Anthropic 首席执行官达里奥 · 阿莫迪(Dario Amodei)呼吁整个行业放缓前沿 AI 模型的研发速度,以便安全防护手段能够跟上技术迭代的脚步。OpenAI 首席执行官萨姆 · 奥尔特曼(Sam Altman)以及 SpaceX 首席执行官埃隆 · 马斯克(Elon Musk)均对这一观点表示认同。 OpenAI 的安全主管萨奇 · 贾因(Saachi Jain)周一在接受《华尔街日报》采访时表示,Astra 在对齐测试当中没有达到公司内部标准;对齐测试用于评估 AI 系统...

    推荐理由:来自IT之家 AI的《内部测试发现安全隐患,消息称 OpenAI 取消发布 AI 模型 GPT‑6.1 Astra》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 29 日消息,据《华尔街日报》报道,由于内部测试过程中研究人员提出多项安全隐患,OpenAI 决定取消 GPT‑6.1 Astra 的发布。这款下一代 AI 模型原本计划于 10 月正式亮相。 报道称,该模型原定部署于 ChatGPT 以及 Codex 产品当中,设计目标是无需人类协助就可以处理更加复杂的任务。 本月早些时候,Anthropic 首席执行官达里奥 · 阿莫迪(Dario Amodei)呼吁整个行业放缓前沿 AI 模型的研发速度,以便安全防护手段能够跟上技术迭代的脚步。OpenAI 首席执行官萨姆 · 奥尔特曼(Sam Altman)以及 SpaceX 首席执行官埃隆 · 马斯克(Elon Musk)均对这一观点表示认同。 OpenAI 的安全主管萨奇 · 贾因(Saachi Jain)周一在接受《华尔街日报》采访时表示,Astra 在对齐测试当中没有达到公司内部标准;对齐测试用于评估 AI 系统...

9月28日周一
  1. 极客公园72

    对话 Seede AI:帮人类创作只是第一步,我们想帮人类理解 Agent 产出的内容

    本文首发于 Founder Park 公众号 · 2026 年 3 月 10 日 上线一年后,Seede AI 推出了他们的海外版产品 Veeso AI,主打把原始素材转化成可交付的设计稿。 与 Lovart 这种面向懂设计的人群的产品相比,Seede AI 更容易上手,面对的人群也更大众一些,比如一家书店想做个小活动的海报、一家二线城市的医院想张贴个宣传告示、或者是一家健身房想在公众号里放一张会员招募活动海报等等,他们可以不用去研究配色、搭配,只需要找到一张他们喜欢的模版,放上自己的原素材,2 到 3 次对话,一张可交付的设计稿就出来了。 门槛足够低,但因为使用了各家 SOTA 模型,上限也足够好。 创始人 Longyi 早年在美团负责系统架构的工作,甚至从零手搓了一个美团内部版的「Vercel」。后来加入了创业公司 Dora AI——「面向建站领域的 Figma」,在 GPT-4 出来后意识到,传统的无代码架构, 不彻底转向...

    推荐理由:来自极客公园的《对话 Seede AI:帮人类创作只是第一步,我们想帮人类理解 Agent 产出的内容》。重点看智能体工作流、模型能力与工程、文化创意。摘要提到:本文首发于 Founder Park 公众号 · 2026 年 3 月 10 日 上线一年后,Seede AI 推出了他们的海外版产品 Veeso AI,主打把原始素材转化成可交付的设计稿。 与 Lovart 这种面向懂设计的人群的产品相比,Seede AI 更容易上手,面对的人群也更大众一些,比如一家书店想做个小活动的海报、一家二线城市的医院想张贴个宣传告示、或者是一家健身房想在公众号里放一张会员招募活动海报等等,他们可以不用去研究配色、搭配,只需要找到一张他们喜欢的模版,放上自己的原素材,2 到 3 次对话,一张可交付的设计稿就出来了。 门槛足够低,但因为使用了各家 SOTA 模型,上限也足够好。 创始人 Longyi 早年在美团负责系统架构的工作,甚至从零手搓了一个美团内部版的「Vercel」。后来加入了创业公司 Dora AI——「面向建站领域的 Figma」,在 GPT-4 出来后意识到,传统的无代码架构, 不彻底转向...

9月26日周六
  1. GitHub Changelog90

    GitHub Copilot weekly releases — September 21

    事实摘要:这条英文动态主要涉及模型能力与工程、开源生态,原文信息显示:GitHub Copilot weekly releases — September 21 事实摘要:这条英文动态主要涉及模型能力与工程、开源生态,原文信息显示:GitHub Copilot weekly releases — September 21 事实摘要:这条英文动态主要涉及模型能力与工程、。影响判断:它可能改变模型能力与工程、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程、开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和模型能力与工程、开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

9月24日周四
  1. Apple Machine Learning Research77

    Compressing Streaming Neural Audio Encoders via Latent-Space Distillation

    这条英文动态主要涉及模型能力与工程。原文要点:System-wide Dictation on Apple devices runs entirely on-device, and the speech it transcribes reaches the foundation model through a tokenizer: an encoder that maps short windows of waveform onto the representation the language model reads. Because that model is sparsely activated under Instruction-Following Pruning, only a small subset of its experts occupies DRAM at any time, so the always-on tokenizer competes for...

    推荐理由:来自Apple Machine Learning Research的《Compressing Streaming Neural Audio Encoders via Latent-Space Distillation》。重点看模型能力与工程。摘要提到:这条英文动态主要涉及模型能力与工程。原文要点:System-wide Dictation on Apple devices runs entirely on-device, and the speech it transcribes reaches the foundation model through a tokenizer: an encoder that maps short windows of waveform onto the representation the language model reads. Because that model is sparsely activated under Instruction-Following Pruning, only a small subset of its experts occupies DRAM at any time, so the always-on...

  2. GitHub Changelog84

    More ways to request and configure Copilot code reviews

    事实摘要:这条英文动态主要涉及开源生态,原文信息显示:More ways to request and configure Copilot code reviews 事实摘要:这条英文动态主要涉及开源生态,原文信息显示:More ways to request and configure Copilot code reviews 事实摘要:这条英文动态主要涉及开源生态。影响判断:它可能改变开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

9月23日周三
  1. IT之家 AI68

    大力投入 AI 未必真能省钱,麦肯锡报告称智能体或让企业面临更高成本

    IT之家 9 月 23 日消息,据《商业内幕》今天(23 日)上午报道,麦肯锡提醒企业,随着智能体越来越普及, AI 支出可能进一步增加 。 与文本类 AI 工具相比,智能体需要实际完成任务,或将带来高得多的运行成本。这类任务往往包含多个步骤,同一目标有不同的实现方式,成本也可能相差悬殊。麦肯锡的一项研究发现,不同智能体完成任务的成本差距 最高可达 30 倍 。 IT之家从报道中获悉,麦肯锡的《2026 年 AI 现状》调查显示,约三分之一的组织把超过 10% 的技术与通信预算投入 AI;60% 的受访者计划明年增加 AI 支出;约五分之一的受访者称, AI 支出开始给运营成本带来压力 。 麦肯锡高级合伙人、麦肯锡全球研究院院长唐吉 · 卡特林指出:“所以,AI 支出的规模开始变得相当可观,也越来越明显。” 麦肯锡表示,使用智能体自动编程的软件开发团队尤其面临成本压力,自动编程显然要消耗大量 token。 麦肯锡发出警告前,企业...

    推荐理由:来自IT之家 AI的《大力投入 AI 未必真能省钱,麦肯锡报告称智能体或让企业面临更高成本》。重点看智能体工作流。摘要提到:IT之家 9 月 23 日消息,据《商业内幕》今天(23 日)上午报道,麦肯锡提醒企业,随着智能体越来越普及, AI 支出可能进一步增加 。 与文本类 AI 工具相比,智能体需要实际完成任务,或将带来高得多的运行成本。这类任务往往包含多个步骤,同一目标有不同的实现方式,成本也可能相差悬殊。麦肯锡的一项研究发现,不同智能体完成任务的成本差距 最高可达 30 倍 。 IT之家从报道中获悉,麦肯锡的《2026 年 AI 现状》调查显示,约三分之一的组织把超过 10% 的技术与通信预算投入 AI;60% 的受访者计划明年增加 AI 支出;约五分之一的受访者称, AI 支出开始给运营成本带来压力 。 麦肯锡高级合伙人、麦肯锡全球研究院院长唐吉 · 卡特林指出:“所以,AI 支出的规模开始变得相当可观,也越来越明显。” 麦肯锡表示,使用智能体自动编程的软件开发团队尤其面临成本压力,自动编程显然要消耗大量 token。 麦肯锡发出警告前,企业...

  2. 量子位66

    Claude Opus 5.5突袭!68万行代码一天迁完,API价格打8折

    事实摘要:Claude Opus 5.5突袭!68万行代码一天迁完,API价格打8折 缓存读取价砍了60% 这条动态来自 量子位,可重点关注产品发布。 Claude Opus 5.5突袭!68万行代码一天迁完,API价格打8折 缓存读取价砍了60%。影响判断:它可能改变AI 应用价值相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪AI 应用价值方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和AI 应用价值直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  3. GitHub Changelog88

    New features and improvements in Copilot for JetBrains

    事实摘要:这条英文动态主要涉及智能体工作流、开源生态,原文信息显示:New features and improvements in Copilot for JetBrains 事实摘要:这条英文动态主要涉及智能体工作流、开源生态,原文信息显示:New features and improvements in Copilot for JetBrains 事实摘要:这条。影响判断:它可能改变智能体工作流、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  4. GitHub Changelog96

    Claude Opus 5.5 is now available in GitHub Copilot

    事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:Claude Opus 5.5 is now available in GitHub Copilot 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:Claude Opus 5.5 is now available in GitHub Copilot。影响判断:它可能改变智能体工作流、模型能力与工程、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程、开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

9月21日周一
  1. GitHub Changelog91

    Grok 4.7 is now available in GitHub Copilot

    事实摘要:Grok 4.7 is now available in GitHub Copilot 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:Grok 4.7 is now available in GitHub Copilot 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:Grok 4.7。影响判断:它可能改变智能体工作流、模型能力与工程、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程、开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  2. IT之家 AI70

    被质疑“偷传代码”后智谱 ZCode 官宣开源:已完成整改并向所有用户道歉

    IT之家 9 月 21 日消息,智谱 ZCode 今日宣布,针对社区反馈的 ZCode 产品安全问题, 官方已经完成整改,并向所有用户道歉 。 智谱已将 ZCode 开源 ( https://github.com/zai-org/ZCode ),把代码交给社区监督,让 ZCode 变得开放、透明。 非常感谢此前发现 ZCode 问题的社区开发者,接下来我们将建立常态化的产品安全漏洞机制,欢迎开发者伙伴持续检查和反馈问题,我们会根据问题严重程度给予相应回报。 对于社区中提及的代码数据,我们承诺无留存,也从未将其用于模型训练。完成整改后,我们邀请中国信息通信研究院和绿盟科技开展安全审计,结果如下: 经中国信息通信研究院技术评测,确认 zcode-prod 阿里云 OSS 存储桶状态为云端零数据。ZCode v3.14.0 客户端已完成安全整改,已经移除 Repo Wiki 功能,已切断本地仓库快照生成与上传链路。 经绿盟科技审查,确...

    推荐理由:来自IT之家 AI的《被质疑“偷传代码”后智谱 ZCode 官宣开源:已完成整改并向所有用户道歉》。重点看模型能力与工程、评测与基准、开源生态。摘要提到:IT之家 9 月 21 日消息,智谱 ZCode 今日宣布,针对社区反馈的 ZCode 产品安全问题, 官方已经完成整改,并向所有用户道歉 。 智谱已将 ZCode 开源 ( https://github.com/zai-org/ZCode ),把代码交给社区监督,让 ZCode 变得开放、透明。 非常感谢此前发现 ZCode 问题的社区开发者,接下来我们将建立常态化的产品安全漏洞机制,欢迎开发者伙伴持续检查和反馈问题,我们会根据问题严重程度给予相应回报。 对于社区中提及的代码数据,我们承诺无留存,也从未将其用于模型训练。完成整改后,我们邀请中国信息通信研究院和绿盟科技开展安全审计,结果如下: 经中国信息通信研究院技术评测,确认 zcode-prod 阿里云 OSS 存储桶状态为云端零数据。ZCode v3.14.0 客户端已完成安全整改,已经移除 Repo Wiki 功能,已切断本地仓库快照生成与上传链路。 经绿盟科技审查,确...

9月19日周六
  1. Claude Code Releases80

    Claude Code Releases v2.1.278:Changed auto mode for Claude API and Enterprise users, and...

    事实摘要:这条英文动态主要涉及AI 应用价值,原文信息显示:Claude Code Releases v2.1.278:Changed auto mode for Claude API and Enterprise users, and... 事实摘要:这条英文动态主要涉及AI 应用价值,原文信息显示:Claude Code Releases v2.1.278:Cha。影响判断:它可能改变AI 应用价值相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪AI 应用价值方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和AI 应用价值直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  2. GitHub Changelog81

    Copilot code review: An improved review experience

    事实摘要:这条英文动态主要涉及开源生态,原文信息显示:Copilot code review: An improved review experience 事实摘要:这条英文动态主要涉及开源生态,原文信息显示:Copilot code review: An improved review experience 事实摘要:这条英文动态主要涉及开源生态,原文信息显示:Co。影响判断:它可能改变开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  3. GitHub Changelog82

    Manage the code coverage ruleset condition with the REST API

    事实摘要:这条英文动态主要涉及开源生态,原文信息显示:Manage the code coverage ruleset condition with the REST API 事实摘要:这条英文动态主要涉及开源生态,原文信息显示:Manage the code coverage ruleset condition with the REST API 事实摘要:这条英文。影响判断:它可能改变开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  4. GitHub Changelog90

    Upcoming deprecation of selected GitHub Copilot models in mid-October

    事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:Upcoming deprecation of selected GitHub Copilot models in mid-October 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:Upcoming deprecation of selecte。影响判断:它可能改变智能体工作流、模型能力与工程、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程、开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

9月18日周五
  1. Claude Code Releases84

    Claude Code Releases v2.1.276:Fixed every request failing with 400 … Input tag 'advisor_...

    事实摘要:这条英文动态主要涉及AI 应用价值,原文信息显示:Claude Code Releases v2.1.276:Fixed every request failing with 400 … Input tag 'advisor_... 事实摘要:这条英文动态主要涉及AI 应用价值,原文信息显示:Claude Code Releases v2.1.276:Fix。影响判断:它可能改变AI 应用价值相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪AI 应用价值方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和AI 应用价值直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

9月17日周四
  1. IT之家 AI72

    ChatGPT 背后功臣:Almeida 推出 AI 模型 Jev,不生成文本、输出免费

    IT之家 9 月 17 日消息,TypeSafe AI 昨日(9 月 16 日)发布公告,宣布推出 Jev,该 AI 模型定位为“System One Model”(系统一模型), 不生成文本,直接返回结构化决策,其成本和延迟远低于大型语言模型。 IT之家查询公开资料,TypeSafe AI 由 Diogo Almeida 成立,他曾在 OpenAI 工作,是 RLHF 研究的幕后功臣之一,而该研究催生了 ChatGPT。该公司成立于 2 年前,本周宣布结束隐身状态,宣布完成由 DCVC 领投的 4,000 万美元 (IT之家注:现汇率约合 2.69 亿元人民币) 种子轮融资。 该公司将 Jev 定义为“System One Model”(系统一模型),对应快速、低延迟的重复决策场景。该定义借用心理学中的“系统 1”概念,指快速、直觉式判断。该类模型面向固定选项、连续评分或是非概率等重复决策任务,不以生成自然语言文本、代码或多轮...

    推荐理由:来自IT之家 AI的《ChatGPT 背后功臣:Almeida 推出 AI 模型 Jev,不生成文本、输出免费》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 17 日消息,TypeSafe AI 昨日(9 月 16 日)发布公告,宣布推出 Jev,该 AI 模型定位为“System One Model”(系统一模型), 不生成文本,直接返回结构化决策,其成本和延迟远低于大型语言模型。 IT之家查询公开资料,TypeSafe AI 由 Diogo Almeida 成立,他曾在 OpenAI 工作,是 RLHF 研究的幕后功臣之一,而该研究催生了 ChatGPT。该公司成立于 2 年前,本周宣布结束隐身状态,宣布完成由 DCVC 领投的 4,000 万美元 (IT之家注:现汇率约合 2.69 亿元人民币) 种子轮融资。 该公司将 Jev 定义为“System One Model”(系统一模型),对应快速、低延迟的重复决策场景。该定义借用心理学中的“系统 1”概念,指快速、直觉式判断。该类模型面向固定选项、连续评分或是非概率等重复决策任务,不以生成自然语言文本、代码或多轮...

9月16日周三
  1. OpenAI News81

    How to connect AI usage to business value

    事实摘要:这条英文动态主要涉及模型能力与工程,原文信息显示:How to connect AI usage to business value 事实摘要:这条英文动态主要涉及模型能力与工程,原文信息显示:How to connect AI usage to business value 事实摘要:How to connect AI usage to business 。影响判断:它可能改变模型能力与工程相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和模型能力与工程直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  2. IT之家 AI72

    豆包大模型 2.1 Pro 更新 0915 版本:Agent 交付更可靠,多模态 Coding 进化

    IT之家 9 月 16 日消息,火山引擎官方今日宣布为豆包大模型 2.1 Pro 更新至 0915 版本, API 全量上线火山方舟 。 IT之家从官方获悉,豆包工作已完成升级,用户下载或升级至最新版,选取“豆包 2.1 Pro(0915 新版)”模型即可体验。 本次升级围绕企业生产级需求,覆盖 Agent 任务交付、多模态 Coding、多模态理解与 Token 效率优化。 除豆包外,TRAE 已同步接入 0915 版本。今年 6 月推出的 Doubao-Seed-Evolving 也更新至同一版本,企业无需更换 API 接入节点。 Agent 任务交付方面,官方称模型强化了证据溯源、权威信源检索、时效判断和数据核验能力,幻觉显著减少,更忠于工具调用事实。在金融投研、办公自动化等长报告任务中,结论有据可查,推进更稳。 以金融投研为例,官方称模型具备分析师级别分析框架,能自主拆解研究需求、查询高质量数据源并建模分析,产出专家级建...

    推荐理由:来自IT之家 AI的《豆包大模型 2.1 Pro 更新 0915 版本:Agent 交付更可靠,多模态 Coding 进化》。重点看智能体工作流、模型能力与工程、产品发布。摘要提到:IT之家 9 月 16 日消息,火山引擎官方今日宣布为豆包大模型 2.1 Pro 更新至 0915 版本, API 全量上线火山方舟 。 IT之家从官方获悉,豆包工作已完成升级,用户下载或升级至最新版,选取“豆包 2.1 Pro(0915 新版)”模型即可体验。 本次升级围绕企业生产级需求,覆盖 Agent 任务交付、多模态 Coding、多模态理解与 Token 效率优化。 除豆包外,TRAE 已同步接入 0915 版本。今年 6 月推出的 Doubao-Seed-Evolving 也更新至同一版本,企业无需更换 API 接入节点。 Agent 任务交付方面,官方称模型强化了证据溯源、权威信源检索、时效判断和数据核验能力,幻觉显著减少,更忠于工具调用事实。在金融投研、办公自动化等长报告任务中,结论有据可查,推进更稳。 以金融投研为例,官方称模型具备分析师级别分析框架,能自主拆解研究需求、查询高质量数据源并建模分析,产出专家级建...

9月15日周二
  1. IT之家 AI66

    国家超算互联网累计上线智能体 500 余个、覆盖 170 余个核心计算场景

    IT之家 9 月 15 日消息,据财联社今日消息,曙光智算总裁何牧君在 2026 算力网发展大会透露,国家超算互联网平台已建成材料计算、工业仿真等 6 大智能体矩阵。 据介绍,国家超算互联网已覆盖 170 余个核心计算场景, 累计上线智能体 500 余个 、 技能 1 万余项 。何牧君表示,在国家超算互联网上,用户无需精通编程,依托 1.6 万余个内容组件与对话式构建工具,即可像搭积木一样组建专属科学计算智能体。 IT之家注:2023 年,科技部组织召开超算互联网发展工作部署会,统筹超算互联网建设启动工作;2023 年 4 月,国家超算互联网平台建设工作正式启动,国家超算互联网联合体成立,国家高性能计算机工程技术研究中心任理事长单位。 今年 1 月,国家超算互联网平台曾发布消息,宣布 国家超算互联网用户规模正式突破 100 万 。

    推荐理由:来自IT之家 AI的《国家超算互联网累计上线智能体 500 余个、覆盖 170 余个核心计算场景》。重点看智能体工作流、产品发布。摘要提到:IT之家 9 月 15 日消息,据财联社今日消息,曙光智算总裁何牧君在 2026 算力网发展大会透露,国家超算互联网平台已建成材料计算、工业仿真等 6 大智能体矩阵。 据介绍,国家超算互联网已覆盖 170 余个核心计算场景, 累计上线智能体 500 余个 、 技能 1 万余项 。何牧君表示,在国家超算互联网上,用户无需精通编程,依托 1.6 万余个内容组件与对话式构建工具,即可像搭积木一样组建专属科学计算智能体。 IT之家注:2023 年,科技部组织召开超算互联网发展工作部署会,统筹超算互联网建设启动工作;2023 年 4 月,国家超算互联网平台建设工作正式启动,国家超算互联网联合体成立,国家高性能计算机工程技术研究中心任理事长单位。 今年 1 月,国家超算互联网平台曾发布消息,宣布 国家超算互联网用户规模正式突破 100 万 。

  2. 量子位74

    7名博士生仅用3个月从零训练7B大模型:代码+数据+训练日志全公开

    事实摘要:7名博士生仅用3个月从零训练7B大模型:代码+数据+训练日志全公开 几百个Agent参与研发,AI开始造AI 这条动态来自 量子位,可重点关注智能体工作流、模型能力与工程。 7名博士生仅用3个月从零训练7B大模型:代码+数据+训练日志全公开 几百个Agent参与研发,AI开始造AI。影响判断:它可能改变智能体工作流、模型能力与工程相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  3. IT之家 AI74

    Anthropic Claude Opus 5.2 灰度测试曝光:响应更快,告别“偷懒”

    原标题:《突发!Opus 5.2 深夜上线,RSI 真来了?》 今天清晨,Opus 5.2 悄悄上线了。许多开发者发现,新一代神级模型 Claude Opus 5.2,已经在 Claude Code 中开启灰度测试! 而且,此前一份内部风险报告显示,Anthropic 正在动用「核武器级别」的未发布模型 Model 2。它接管了公司大部分代码编写,将替代 85% 研究团队。传说中的 RSI,真的来了。 Opus 5.2 悄悄上线:不仅跳级,还治好了「偷懒病」 昨晚,X 上的开发者们沸腾了。越来越多的 Claude 用户发现:在 Claude Code 中调用 Opus 5 时,它的表现和网页版 Opus 5 截然不同,仿佛降维打击。 这就是前沿 AI 大厂最喜欢玩的「障眼法」—— 路由(Routing)。 开发者们通过抓包和查看请求状态(/status)发现,虽然前端名字没变,但背后的模型 slug 已经赫然指向了 Opus 5...

    推荐理由:来自IT之家 AI的《Anthropic Claude Opus 5.2 灰度测试曝光:响应更快,告别“偷懒”》。重点看模型能力与工程、产品发布。摘要提到:原标题:《突发!Opus 5.2 深夜上线,RSI 真来了?》 今天清晨,Opus 5.2 悄悄上线了。许多开发者发现,新一代神级模型 Claude Opus 5.2,已经在 Claude Code 中开启灰度测试! 而且,此前一份内部风险报告显示,Anthropic 正在动用「核武器级别」的未发布模型 Model 2。它接管了公司大部分代码编写,将替代 85% 研究团队。传说中的 RSI,真的来了。 Opus 5.2 悄悄上线:不仅跳级,还治好了「偷懒病」 昨晚,X 上的开发者们沸腾了。越来越多的 Claude 用户发现:在 Claude Code 中调用 Opus 5 时,它的表现和网页版 Opus 5 截然不同,仿佛降维打击。 这就是前沿 AI 大厂最喜欢玩的「障眼法」—— 路由(Routing)。 开发者们通过抓包和查看请求状态(/status)发现,虽然前端名字没变,但背后的模型 slug 已经赫然指向了 Opus 5...

9月14日周一
  1. Simon Willison81

    commit-rewriter 0.1

    事实摘要:这条英文动态主要涉及智能体工作流、开源生态,原文信息显示:commit-rewriter 0.1 事实摘要:这条英文动态主要涉及智能体工作流、开源生态,原文信息显示:commit-rewriter 0.1 事实摘要:这条英文动态主要涉及智能体工作流、开源生态,原文信息显示:commit-rewriter 0.1 事实摘要:这条英文动态主要涉及智能体工作流、开。影响判断:它可能改变智能体工作流、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

9月13日周日
  1. Claude Code Releases82

    Claude Code Releases v2.1.270:Fixed read-only git commands in Bash unexpectedly asking f...

    事实摘要:这条英文动态主要涉及AI 应用价值,原文信息显示:Claude Code Releases v2.1.270:Fixed read-only git commands in Bash unexpectedly asking f... 事实摘要:这条英文动态主要涉及AI 应用价值,原文信息显示:Claude Code Releases v2.1.270:Fix。影响判断:它可能改变AI 应用价值相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪AI 应用价值方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和AI 应用价值直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

9月12日周六
  1. Claude Code Releases84

    Claude Code Releases v2.1.269:Added claude plugin eval : run a plugin's eval suite again...

    事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、评测与基准,原文信息显示:Claude Code Releases v2.1.269:Added claude plugin eval : run a plugin's eval suite again... 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、评测与基准,原文信息显示:Claude 。影响判断:它可能改变智能体工作流、模型能力与工程、评测与基准相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、评测与基准方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程、评测与基准直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  2. Simon Willison81

    Quoting Boris Cherny

    事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程,原文信息显示:Quoting Boris Cherny 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程,原文信息显示:Quoting Boris Cherny 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程,原文信息显示:Quoting Boris Cherny 事实摘要:这条英文动态。影响判断:它可能改变智能体工作流、模型能力与工程相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

9月11日周五
  1. Simon Willison48

    Soft-deprecating re.match()

    事实摘要:这条英文动态主要涉及模型能力与工程,原文信息显示:Soft-deprecating re.match() 事实摘要:这条英文动态主要涉及模型能力与工程,原文信息显示:Soft-deprecating re.match() 事实摘要:这条英文动态主要涉及模型能力与工程,原文信息显示:Soft-deprecating re.match() 事实摘要:这条英文动态。影响判断:它可能改变模型能力与工程相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和模型能力与工程直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  2. Apple Machine Learning Research52

    SimpleDesign: A Joint Model for Protein Sequence and Structure Codesign

    事实摘要:这条英文动态主要涉及模型能力与工程,原文信息显示:SimpleDesign: A Joint Model for Protein Sequence and Structure Codesign 事实摘要:这条英文动态主要涉及模型能力与工程,原文信息显示:SimpleDesign: A Joint Model for Protein Sequence and 。影响判断:它可能改变模型能力与工程相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和模型能力与工程直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  3. GitHub Changelog85

    GitHub Copilot weekly releases — September 7

    事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:GitHub Copilot weekly releases — September 7 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:GitHub Copilot weekly releases — September 7 事实摘要:这条英文动态。影响判断:它可能改变智能体工作流、模型能力与工程、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程、开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  4. GitHub Changelog92

    MAI-Code-1-Flash deprecated

    事实摘要:MAI-Code-1-Flash deprecated 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:MAI-Code-1-Flash deprecated 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:MAI-Code-1-Flash deprecated 事实摘要:这条英文动态主。影响判断:它可能改变智能体工作流、模型能力与工程、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程、开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  5. OpenAI News80

    How a researcher uses Codex and ChatGPT to search for new antimicrobial molecules

    事实摘要:这条英文动态主要涉及AI 应用价值,原文信息显示:How a researcher uses Codex and ChatGPT to search for new antimicrobial molecules 事实摘要:这条英文动态主要涉及AI 应用价值,原文信息显示:How a researcher uses Codex and ChatGPT to 。影响判断:它可能改变AI 应用价值相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪AI 应用价值方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和AI 应用价值直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。