跳到正文
9月24日周四
  1. GitHub Changelog84

    More ways to request and configure Copilot code reviews

    事实摘要:这条英文动态主要涉及开源生态,原文信息显示:More ways to request and configure Copilot code reviews 事实摘要:这条英文动态主要涉及开源生态,原文信息显示:More ways to request and configure Copilot code reviews 事实摘要:这条英文动态主要涉及开源生态。影响判断:它可能改变开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  2. Claude Code Releases82

    Claude Code Releases v2.1.281:Added Claude apps gateway support for newer Claude Desktop...

    这条英文动态讨论了 AI 领域的新进展。原文要点:What's changed Added Claude apps gateway support for newer Claude Desktop keys in desktop policy blocks, including blockReadsOutsideWorkingDirectories and disableBypassPermissionsMode Added assume_role on Claude apps gateway Bedrock upstreams: the gateway calls Bedrock as an IAM role it assumes through STS, in another AWS account if needed, optionally one session per developer Added guardrail: {id, version} on Claude...

    推荐理由:来自Claude Code Releases的《Claude Code Releases v2.1.281:Added Claude apps gateway support for newer Claude Desktop...》。重点看模型发布、编码、政策/监管。摘要提到:这条英文动态讨论了 AI 领域的新进展。原文要点:What's changed Added Claude apps gateway support for newer Claude Desktop keys in desktop policy blocks, including blockReadsOutsideWorkingDirectories and disableBypassPermissionsMode Added assume_role on Claude apps gateway Bedrock upstreams: the gateway calls Bedrock as an IAM role it assumes through STS, in another AWS account if needed, optionally one session per developer Added guardrail...

9月23日周三
  1. IT之家 AI76

    Anthropic 工程师解释为何 Claude 写作变差:模型被训练成写给 AI 看而非写给人看

    IT之家 9 月 23 日消息,AI 模型在数学、编程和推理能力上进步迅速,写作水平却停滞不前,甚至有所退步,Anthropic 的 Claude 同样也存在这一问题。 为何 Opus 4.6 会成为 Anthropic 最后一款写作表现出色的模型?负责 Claude 微调的 Anthropic 工程师杰克逊 · 克尼恩今天(23 日)对此给出了解释:后续模型的优化重点 更多放在数学和代码能力上 。 这些模型还接受了大量 面向其他 AI 模型撰写技术解释 的训练,而这正是 Claude 逐渐形成奇特表达方式,也就是所谓“Claude 腔”(Claudeish)的主要原因。克尼恩称,模型被“调整得适应 LLM 心理”,最终学会了 写给 AI 模型看,而不是写给人看 。 克尼恩把这种现象类比为 只与其他自闭症人士交流的人 。此类群体会逐渐形成一套 在群体内部沟通顺畅、外人却难以理解 的表达方式。LLM 拥有远超人类的工作记忆,也能捕...

    推荐理由:来自IT之家 AI的《Anthropic 工程师解释为何 Claude 写作变差:模型被训练成写给 AI 看而非写给人看》。重点看模型能力与工程。摘要提到:IT之家 9 月 23 日消息,AI 模型在数学、编程和推理能力上进步迅速,写作水平却停滞不前,甚至有所退步,Anthropic 的 Claude 同样也存在这一问题。 为何 Opus 4.6 会成为 Anthropic 最后一款写作表现出色的模型?负责 Claude 微调的 Anthropic 工程师杰克逊 · 克尼恩今天(23 日)对此给出了解释:后续模型的优化重点 更多放在数学和代码能力上 。 这些模型还接受了大量 面向其他 AI 模型撰写技术解释 的训练,而这正是 Claude 逐渐形成奇特表达方式,也就是所谓“Claude 腔”(Claudeish)的主要原因。克尼恩称,模型被“调整得适应 LLM 心理”,最终学会了 写给 AI 模型看,而不是写给人看 。 克尼恩把这种现象类比为 只与其他自闭症人士交流的人 。此类群体会逐渐形成一套 在群体内部沟通顺畅、外人却难以理解 的表达方式。LLM 拥有远超人类的工作记忆,也能捕...

  2. IT之家 AI72

    rabbit 沉寂许久后发布 OS3 智能体操作系统,支持多设备编排

    IT之家 9 月 23 日消息,人工智能初创企业 rabbit 曾因其口袋 AI 设备 Rabbit R1 名噪一时。但在硬件产品备受争议的推出后,该企业热度迅速降低并最终陷入沉寂。根据IT之家的查询, 其本周之前的最后一条官网新闻发布于 2025 年 9 月 。 而在当地时间 22 日, rabbit 宣布正式发布其智能体操作系统 OS3 。其兼容广泛第三方硬件,以单一聊天界面为主要入口。用户仅需设定一个目标,系统便会自动调度所需的设备、模型、文件来完成剩余步骤。 OS3 在云端运行并通过 rabbit agent 智能体连接和操作设备,一个账户最多可以连接五台设备。其 支持 多设备编排 、单一连续对话,兼容通用技能,可进行直接的计算机控制与自动编程。 IT之家了解到,用户使用 OS3 时 需自备 API 接口 。其 仅访问本地文件,仅通过模型提供程序处理上下文,仅执行用户发起的操作。

    推荐理由:来自IT之家 AI的《rabbit 沉寂许久后发布 OS3 智能体操作系统,支持多设备编排》。重点看智能体工作流、模型能力与工程、产品发布。摘要提到:IT之家 9 月 23 日消息,人工智能初创企业 rabbit 曾因其口袋 AI 设备 Rabbit R1 名噪一时。但在硬件产品备受争议的推出后,该企业热度迅速降低并最终陷入沉寂。根据IT之家的查询, 其本周之前的最后一条官网新闻发布于 2025 年 9 月 。 而在当地时间 22 日, rabbit 宣布正式发布其智能体操作系统 OS3 。其兼容广泛第三方硬件,以单一聊天界面为主要入口。用户仅需设定一个目标,系统便会自动调度所需的设备、模型、文件来完成剩余步骤。 OS3 在云端运行并通过 rabbit agent 智能体连接和操作设备,一个账户最多可以连接五台设备。其 支持 多设备编排 、单一连续对话,兼容通用技能,可进行直接的计算机控制与自动编程。 IT之家了解到,用户使用 OS3 时 需自备 API 接口 。其 仅访问本地文件,仅通过模型提供程序处理上下文,仅执行用户发起的操作。

  3. IT之家 AI68

    大力投入 AI 未必真能省钱,麦肯锡报告称智能体或让企业面临更高成本

    IT之家 9 月 23 日消息,据《商业内幕》今天(23 日)上午报道,麦肯锡提醒企业,随着智能体越来越普及, AI 支出可能进一步增加 。 与文本类 AI 工具相比,智能体需要实际完成任务,或将带来高得多的运行成本。这类任务往往包含多个步骤,同一目标有不同的实现方式,成本也可能相差悬殊。麦肯锡的一项研究发现,不同智能体完成任务的成本差距 最高可达 30 倍 。 IT之家从报道中获悉,麦肯锡的《2026 年 AI 现状》调查显示,约三分之一的组织把超过 10% 的技术与通信预算投入 AI;60% 的受访者计划明年增加 AI 支出;约五分之一的受访者称, AI 支出开始给运营成本带来压力 。 麦肯锡高级合伙人、麦肯锡全球研究院院长唐吉 · 卡特林指出:“所以,AI 支出的规模开始变得相当可观,也越来越明显。” 麦肯锡表示,使用智能体自动编程的软件开发团队尤其面临成本压力,自动编程显然要消耗大量 token。 麦肯锡发出警告前,企业...

    推荐理由:来自IT之家 AI的《大力投入 AI 未必真能省钱,麦肯锡报告称智能体或让企业面临更高成本》。重点看智能体工作流。摘要提到:IT之家 9 月 23 日消息,据《商业内幕》今天(23 日)上午报道,麦肯锡提醒企业,随着智能体越来越普及, AI 支出可能进一步增加 。 与文本类 AI 工具相比,智能体需要实际完成任务,或将带来高得多的运行成本。这类任务往往包含多个步骤,同一目标有不同的实现方式,成本也可能相差悬殊。麦肯锡的一项研究发现,不同智能体完成任务的成本差距 最高可达 30 倍 。 IT之家从报道中获悉,麦肯锡的《2026 年 AI 现状》调查显示,约三分之一的组织把超过 10% 的技术与通信预算投入 AI;60% 的受访者计划明年增加 AI 支出;约五分之一的受访者称, AI 支出开始给运营成本带来压力 。 麦肯锡高级合伙人、麦肯锡全球研究院院长唐吉 · 卡特林指出:“所以,AI 支出的规模开始变得相当可观,也越来越明显。” 麦肯锡表示,使用智能体自动编程的软件开发团队尤其面临成本压力,自动编程显然要消耗大量 token。 麦肯锡发出警告前,企业...

  4. IT之家 AI78

    马斯克惊叹中国 AI 大模型“单位算力产出性能几乎是全球顶尖水平”,预计两到三年内就能靠光刻技术与芯片制造补齐算力缺口

    IT之家 9 月 23 日消息,特斯拉 CEO 埃隆 · 马斯克今日接受了央视财经专访。 当谈及 AI,他表示中国的 AI 大模型整体而言非常出色,单位算力产出的性能几乎全球顶尖。 他认为,中国解决算力问题的速度会比大多数人预想更快。粗略估计,大概两到三年内,中国就能依靠光刻技术与芯片制造补齐算力缺口。 图源:Pexels 谈及 AI 时代教育,马斯克建议广泛学习,兼顾人文艺术、科学与工程,夯实通识基础。 他表示,想要向机器人下达指令,就要学会组织问题;知识面越广,越擅长提问,这正是给 AI 写提示词。 马斯克此前曾表示,预计到 2027 年底,人工智能将独立完成所有数字领域工作,彻底替代人工直接操作的各类数字化岗位。 在短期技术突破上,他预判未来 12 至 18 个月内,AI 将在工程及各类数字领域实现能力跨越式提升。 其中,AI 编程能力最快明年达到“Stockfish 级”水准(IT之家注:Stockfish 是一款开源国...

    推荐理由:来自IT之家 AI的《马斯克惊叹中国 AI 大模型“单位算力产出性能几乎是全球顶尖水平”,预计两到三年内就能靠光刻技术与芯片制造补齐算力缺口》。重点看模型能力与工程、教育应用、文化创意。摘要提到:IT之家 9 月 23 日消息,特斯拉 CEO 埃隆 · 马斯克今日接受了央视财经专访。 当谈及 AI,他表示中国的 AI 大模型整体而言非常出色,单位算力产出的性能几乎全球顶尖。 他认为,中国解决算力问题的速度会比大多数人预想更快。粗略估计,大概两到三年内,中国就能依靠光刻技术与芯片制造补齐算力缺口。 图源:Pexels 谈及 AI 时代教育,马斯克建议广泛学习,兼顾人文艺术、科学与工程,夯实通识基础。 他表示,想要向机器人下达指令,就要学会组织问题;知识面越广,越擅长提问,这正是给 AI 写提示词。 马斯克此前曾表示,预计到 2027 年底,人工智能将独立完成所有数字领域工作,彻底替代人工直接操作的各类数字化岗位。 在短期技术突破上,他预判未来 12 至 18 个月内,AI 将在工程及各类数字领域实现能力跨越式提升。 其中,AI 编程能力最快明年达到“Stockfish 级”水准(IT之家注:Stockfish 是一款开源国...

  5. 量子位66

    Claude Opus 5.5突袭!68万行代码一天迁完,API价格打8折

    事实摘要:Claude Opus 5.5突袭!68万行代码一天迁完,API价格打8折 缓存读取价砍了60% 这条动态来自 量子位,可重点关注产品发布。 Claude Opus 5.5突袭!68万行代码一天迁完,API价格打8折 缓存读取价砍了60%。影响判断:它可能改变AI 应用价值相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪AI 应用价值方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和AI 应用价值直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  6. Simon Willison81

    SF October 14th: A Birds of a Feather Session on Agentic Engineering

    这条英文动态主要涉及智能体工作流。原文要点:SF October 14th: A Birds of a Feather Session on Agentic Engineering I'm hosting an evening event with Jesse Vincent in San Francisco on Wednesday 14th October for people who are building weird and interesting things with and on top of coding agents. Think of it as an agentic show-and-tell: ​Compare notes with other builders and experimenters on things you’re trying, what you're learning, and what you haven’t figured...

    推荐理由:来自Simon Willison的《SF October 14th: A Birds of a Feather Session on Agentic Engineering》。重点看智能体工作流。摘要提到:这条英文动态主要涉及智能体工作流。原文要点:SF October 14th: A Birds of a Feather Session on Agentic Engineering I'm hosting an evening event with Jesse Vincent in San Francisco on Wednesday 14th October for people who are building weird and interesting things with and on top of coding agents. Think of it as an agentic show-and-tell: ​Compare notes with other builders and experimenters on things you’re trying, what you're learning, and wh...

  7. GitHub Changelog88

    New features and improvements in Copilot for JetBrains

    事实摘要:这条英文动态主要涉及智能体工作流、开源生态,原文信息显示:New features and improvements in Copilot for JetBrains 事实摘要:这条英文动态主要涉及智能体工作流、开源生态,原文信息显示:New features and improvements in Copilot for JetBrains 事实摘要:这条。影响判断:它可能改变智能体工作流、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  8. IT之家 AI70

    Anthropic 发布 Claude Opus 5.5 模型:性能媲美 Fable 5.1,运行成本比 Opus 5 低 40%

    IT之家 9 月 23 日消息,Anthropic 今日正式发布了 Claude Opus 5.5 模型,这是其全新 Claude 5.5 家族的首个模型, 宣称在大多数工作上表现可媲美 Claude Fable 5.1,运行成本比 Opus 5 低 40% 。 IT之家从 Anthropic 公告获悉,具体来看,Claude Opus 5.5 模型有以下提升: 性能方面,Opus 5.5 比 Opus 5 有了很大提升,官方宣传早期测试者在最复杂的工作中看到性能大幅提升。一名测试人员在不到一天内完成了 68 万行代码迁移 —— 这一任务本应耗时数周。 Opus 5.5 擅长发现并修复软件中的低效程序 —— 当官方要求它将网页应用的每个页面缩短加载时间时,Opus 5.5 在 40 次尝试中成功了 39 次,而 Opus 5 仅仅做了一些小改进,也改变了应用的行为。另一位测试者让多个 Claude 模型根据单一提示构建游戏,Op...

    推荐理由:来自IT之家 AI的《Anthropic 发布 Claude Opus 5.5 模型:性能媲美 Fable 5.1,运行成本比 Opus 5 低 40%》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 23 日消息,Anthropic 今日正式发布了 Claude Opus 5.5 模型,这是其全新 Claude 5.5 家族的首个模型, 宣称在大多数工作上表现可媲美 Claude Fable 5.1,运行成本比 Opus 5 低 40% 。 IT之家从 Anthropic 公告获悉,具体来看,Claude Opus 5.5 模型有以下提升: 性能方面,Opus 5.5 比 Opus 5 有了很大提升,官方宣传早期测试者在最复杂的工作中看到性能大幅提升。一名测试人员在不到一天内完成了 68 万行代码迁移 —— 这一任务本应耗时数周。 Opus 5.5 擅长发现并修复软件中的低效程序 —— 当官方要求它将网页应用的每个页面缩短加载时间时,Opus 5.5 在 40 次尝试中成功了 39 次,而 Opus 5 仅仅做了一些小改进,也改变了应用的行为。另一位测试者让多个 Claude 模型根据单一提示构建游戏,Op...

  9. GitHub Changelog96

    Claude Opus 5.5 is now available in GitHub Copilot

    事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:Claude Opus 5.5 is now available in GitHub Copilot 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:Claude Opus 5.5 is now available in GitHub Copilot。影响判断:它可能改变智能体工作流、模型能力与工程、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程、开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  10. Claude Code Releases84

    Claude Code Releases v2.1.280:Added Claude Opus 5.5 ( claude-opus-5-5 ), now the default...

    这条英文动态主要涉及模型能力与工程。原文要点:What's changed Added Claude Opus 5.5 ( claude-opus-5-5 ), now the default Opus model — 1M context, $4/$20 per Mtok with $0.20/Mtok cache reads Added mouse support to more lists in fullscreen mode: the wheel scrolls the /skills list, and a skill's state options in /plugin can be clicked Added CLAUDE_CODE_MAX_MCP_DESCRIPTION_LENGTH to change the 2,048-character cap on MCP tool descriptions and server instructions for e...

    推荐理由:来自Claude Code Releases的《Claude Code Releases v2.1.280:Added Claude Opus 5.5 ( claude-opus-5-5 ), now the default...》。重点看模型能力与工程。摘要提到:这条英文动态主要涉及模型能力与工程。原文要点:What's changed Added Claude Opus 5.5 ( claude-opus-5-5 ), now the default Opus model — 1M context, $4/$20 per Mtok with $0.20/Mtok cache reads Added mouse support to more lists in fullscreen mode: the wheel scrolls the /skills list, and a skill's state options in /plugin can be clicked Added CLAUDE_CODE_MAX_MCP_DESCRIPTION_LENGTH to change the 2,048-character cap on MCP tool descriptions and se...

9月22日周二
  1. GitHub Changelog57

    Deprecation notice: All-platform CodeQL bundle

    事实摘要:这条英文动态主要涉及文化创意、开源生态,原文信息显示:Deprecation notice: All-platform CodeQL bundle 事实摘要:这条英文动态主要涉及文化创意、开源生态,原文信息显示:Deprecation notice: All-platform CodeQL bundle 事实摘要:这条英文动态主要涉及文化创意、开源生态,原文。影响判断:它可能改变文化创意、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪文化创意、开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和文化创意、开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  2. IT之家 AI70

    龙芯发布自研通用 GPU 加速计算平台首个软件版本:支持 OpenCL 3.0、CUDA 及 AI 推理

    IT之家 9 月 22 日消息,龙芯中科今日宣布推出支持自研通用 GPU 的龙芯加速计算平台(Loongson Accelerated Computing Platform)首个软件版本,面向龙芯通用 GPU 提供从底层驱动、编程环境到 AI 模型推理的完整软件支持。 该平台基于龙芯 2K3000 和 9A1000 芯片集成的 LG200 系列通用 GPU 核心开发。在已有 OpenGL、Vulkan 图形软件栈的基础上,平台进一步覆盖算力芯片驱动、编译器、运行时环境、算子库、推理引擎、调试工具和性能分析工具等组件。 龙芯加速计算平台支持 OpenCL 3.0 和 CUDA 两类编程模型接口,并集成 BLAS、DNN 等高性能算子库,可用于 AI 模型推理。平台面向龙芯全系列算力芯片,支持从系统选型、算力调用、模型优化到应用部署的开发流程。 在运行时环境方面,平台提供资源调度管理、内存管理、任务队列调度和事件同步等功能。底层驱动...

    推荐理由:来自IT之家 AI的《龙芯发布自研通用 GPU 加速计算平台首个软件版本:支持 OpenCL 3.0、CUDA 及 AI 推理》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 22 日消息,龙芯中科今日宣布推出支持自研通用 GPU 的龙芯加速计算平台(Loongson Accelerated Computing Platform)首个软件版本,面向龙芯通用 GPU 提供从底层驱动、编程环境到 AI 模型推理的完整软件支持。 该平台基于龙芯 2K3000 和 9A1000 芯片集成的 LG200 系列通用 GPU 核心开发。在已有 OpenGL、Vulkan 图形软件栈的基础上,平台进一步覆盖算力芯片驱动、编译器、运行时环境、算子库、推理引擎、调试工具和性能分析工具等组件。 龙芯加速计算平台支持 OpenCL 3.0 和 CUDA 两类编程模型接口,并集成 BLAS、DNN 等高性能算子库,可用于 AI 模型推理。平台面向龙芯全系列算力芯片,支持从系统选型、算力调用、模型优化到应用部署的开发流程。 在运行时环境方面,平台提供资源调度管理、内存管理、任务队列调度和事件同步等功能。底层驱动...

  3. IT之家 AI68

    索尼 SIE 申请“AI 自修复系统”专利:利用人工智能实时生成诊断固件以修复 PlayStation 游戏机故障

    IT之家 9 月 22 日消息,据专利聚合网站 Patentlyze 披露,索尼 SIE 近日提交一项基于 AI 的 PlayStation 自动诊断和修复系统专利,该系统可以持续监测联网的 PlayStation 设备,在发现软件问题后由 AI 服务器实时生成针对性的诊断固件,并将其直接部署到出现故障的主机上,从而减少用户联系客服的需求。 IT之家参考专利描述,该系统的目标之一是减少保修申请、客服工单以及传统故障排查过程中需要用户反复操作的步骤。当系统检测到主机存在问题后,AI 模型不会简单调用预先编写好的修复方案,而是根据具体故障生成相应的修复代码,并进一步判断问题能否自动处理。如果无法解决,则将相关问题升级给人工客服或技术人员。 不过,让 AI 直接生成并部署消费级硬件固件显然存在明显风险。目前 AI 模型无法 100% 准确, 相应模型可能生成带有缺陷的固件补丁,反而可能导致设备“变砖”,最终需要返厂维修更换 。 此外,...

    推荐理由:来自IT之家 AI的《索尼 SIE 申请“AI 自修复系统”专利:利用人工智能实时生成诊断固件以修复 PlayStation 游戏机故障》。重点看模型能力与工程。摘要提到:IT之家 9 月 22 日消息,据专利聚合网站 Patentlyze 披露,索尼 SIE 近日提交一项基于 AI 的 PlayStation 自动诊断和修复系统专利,该系统可以持续监测联网的 PlayStation 设备,在发现软件问题后由 AI 服务器实时生成针对性的诊断固件,并将其直接部署到出现故障的主机上,从而减少用户联系客服的需求。 IT之家参考专利描述,该系统的目标之一是减少保修申请、客服工单以及传统故障排查过程中需要用户反复操作的步骤。当系统检测到主机存在问题后,AI 模型不会简单调用预先编写好的修复方案,而是根据具体故障生成相应的修复代码,并进一步判断问题能否自动处理。如果无法解决,则将相关问题升级给人工客服或技术人员。 不过,让 AI 直接生成并部署消费级硬件固件显然存在明显风险。目前 AI 模型无法 100% 准确, 相应模型可能生成带有缺陷的固件补丁,反而可能导致设备“变砖”,最终需要返厂维修更换 。 此外,...

  4. IT之家 AI70

    马斯克 SpaceXAI 发布旗下最强编码和知识处理模型 Grok 4.7,百万词元输入 2 美元起

    IT之家 9 月 22 日消息,SpaceXAI 今日宣布推出新一代 Grok 4.7,主打编程和知识工作场景。 官方称其采用全新更大规模基础模型,并通过更长时间的强化学习训练提升复杂任务处理能力,是该公司目前最强的编码和知识处理模型 —— 速度是同类模型的两倍,价格却只有一半。 如前所述,Grok 4.7 针对编程和知识工作进行了优化。与 Grok 4.6 相比,新模型能够在困难任务上持续更长时间,并加强了对自身输出结果的检查能力。 在 CursorBench 4.0 测试中,Grok 4.7 面向长时间运行的编程任务,在价格与性能方面处于同类模型的前列。官方同时表示,该模型的运行速度和定价与 Grok 4.6 相同。 Grok 4.7 使用了比 Grok 4.6 更大的基座模型,并接受了更长时间的强化学习训练。训练数据更加侧重需要数小时完成的复杂任务,同时针对模型的自我验证和长上下文管理能力进行了优化。 SpaceXAI 还...

    推荐理由:来自IT之家 AI的《马斯克 SpaceXAI 发布旗下最强编码和知识处理模型 Grok 4.7,百万词元输入 2 美元起》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 22 日消息,SpaceXAI 今日宣布推出新一代 Grok 4.7,主打编程和知识工作场景。 官方称其采用全新更大规模基础模型,并通过更长时间的强化学习训练提升复杂任务处理能力,是该公司目前最强的编码和知识处理模型 —— 速度是同类模型的两倍,价格却只有一半。 如前所述,Grok 4.7 针对编程和知识工作进行了优化。与 Grok 4.6 相比,新模型能够在困难任务上持续更长时间,并加强了对自身输出结果的检查能力。 在 CursorBench 4.0 测试中,Grok 4.7 面向长时间运行的编程任务,在价格与性能方面处于同类模型的前列。官方同时表示,该模型的运行速度和定价与 Grok 4.6 相同。 Grok 4.7 使用了比 Grok 4.6 更大的基座模型,并接受了更长时间的强化学习训练。训练数据更加侧重需要数小时完成的复杂任务,同时针对模型的自我验证和长上下文管理能力进行了优化。 SpaceXAI 还...

9月21日周一
  1. GitHub Changelog91

    Grok 4.7 is now available in GitHub Copilot

    事实摘要:Grok 4.7 is now available in GitHub Copilot 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:Grok 4.7 is now available in GitHub Copilot 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:Grok 4.7。影响判断:它可能改变智能体工作流、模型能力与工程、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程、开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  2. IT之家 AI70

    鸿蒙 PC 生态首款 AI 编程智能体工作台,阿里 Qoder 支持鸿蒙电脑

    IT之家 9 月 21 日消息,阿里 Qoder 今日宣布,Qoder 登陆鸿蒙 PC 应用市场,是 鸿蒙 PC 生态首款 AI 编程智能体工作台 。 据介绍,Qoder 团队与鸿蒙团队紧密配合,重点解决了几个关键问题: 让 Qoder 的完整任务闭环 —— 从理解意图、拆解步骤、调用工具到交付结果 —— 在鸿蒙系统上流畅运行,确保核心体验不打折。 充分发挥鸿蒙 PC 的系统级能力,支撑 Qoder 的多 Agent 协同、代码执行和文件操作等核心场景。 IT之家获悉,在鸿蒙 PC 上,开发者可以用自然语言描述需求,Qoder 自主完成代码编写、重构、问题排查和功能测试。Qoder 具备深度代码库理解能力(Deep Codebase Awareness),能基于真实的项目背景和工作环境完成任务;还支持 Frontend Dev、Backend Dev、QA 等多个 Agent 角色协同工作。 此外,在通用模式下,用户无需直接处理...

    推荐理由:来自IT之家 AI的《鸿蒙 PC 生态首款 AI 编程智能体工作台,阿里 Qoder 支持鸿蒙电脑》。重点看智能体工作流。摘要提到:IT之家 9 月 21 日消息,阿里 Qoder 今日宣布,Qoder 登陆鸿蒙 PC 应用市场,是 鸿蒙 PC 生态首款 AI 编程智能体工作台 。 据介绍,Qoder 团队与鸿蒙团队紧密配合,重点解决了几个关键问题: 让 Qoder 的完整任务闭环 —— 从理解意图、拆解步骤、调用工具到交付结果 —— 在鸿蒙系统上流畅运行,确保核心体验不打折。 充分发挥鸿蒙 PC 的系统级能力,支撑 Qoder 的多 Agent 协同、代码执行和文件操作等核心场景。 IT之家获悉,在鸿蒙 PC 上,开发者可以用自然语言描述需求,Qoder 自主完成代码编写、重构、问题排查和功能测试。Qoder 具备深度代码库理解能力(Deep Codebase Awareness),能基于真实的项目背景和工作环境完成任务;还支持 Frontend Dev、Backend Dev、QA 等多个 Agent 角色协同工作。 此外,在通用模式下,用户无需直接处理...

  3. IT之家 AI68

    月之暗面发布 Kimi Code Desktop 桌面客户端,macOS 和 Windows 版同步上线

    IT之家 9 月 21 日消息,今天月之暗面 Kimi 发布了 Kimi Code Desktop,macOS 和 Windows 版同步上线,可访问 kimi.com/ code 安装使用。 作为 Kimi Code 官方桌面客户端,它将 Kimi Code 智能编程服务能力带到桌面应用中。用户不仅可以在桌面端内直接使用 Kimi Code 的 AI Agent 能力,通过对话让它读写代码、运行命令、完成自动化任务,还能在全新可视化的图形交互界面中,集中管理所有项目,调整常用配置,清晰查看 Agent 执行任务的每一步。 针对开发者的实际工作流,桌面端还提供内置终端、浏览器和 Git 状态查看等功能,支持直接运行和调试项目、审阅代码改动,关联 PR 状态,方便跟踪代码评审与合并进度。 IT之家附官方详细介绍如下: 如何安装和使用? 第一步:下载并安装 Kimi Code Desktop 下载地址: kimi.com/ code...

    推荐理由:来自IT之家 AI的《月之暗面发布 Kimi Code Desktop 桌面客户端,macOS 和 Windows 版同步上线》。重点看智能体工作流、产品发布。摘要提到:IT之家 9 月 21 日消息,今天月之暗面 Kimi 发布了 Kimi Code Desktop,macOS 和 Windows 版同步上线,可访问 kimi.com/ code 安装使用。 作为 Kimi Code 官方桌面客户端,它将 Kimi Code 智能编程服务能力带到桌面应用中。用户不仅可以在桌面端内直接使用 Kimi Code 的 AI Agent 能力,通过对话让它读写代码、运行命令、完成自动化任务,还能在全新可视化的图形交互界面中,集中管理所有项目,调整常用配置,清晰查看 Agent 执行任务的每一步。 针对开发者的实际工作流,桌面端还提供内置终端、浏览器和 Git 状态查看等功能,支持直接运行和调试项目、审阅代码改动,关联 PR 状态,方便跟踪代码评审与合并进度。 IT之家附官方详细介绍如下: 如何安装和使用? 第一步:下载并安装 Kimi Code Desktop 下载地址: kimi.com/ code...

  4. IT之家 AI70

    亚马逊 AWS 旗下 Bedrock 官宣接入 Kimi K3 模型

    IT之家 9 月 21 日消息,亚马逊云服务(AWS)旗下人工智能服务平台 Amazon Bedrock 近日宣布接入 Kimi K3 模型,为编程工作提供新选择。 IT之家了解到,Kimi K3 是月之暗面开发的大模型。官方宣称其是首个参数规模达 2.8 万亿的开源模型。该模型原生支持视觉能力,拥有 100 万 Token 的上下文窗口,非常适合执行长时间编程、多文档分析等工作。 Amazon Bedrock 将为 Kimi K3 提供闭源模型相同的安全边界,拥有统一的访问控制、加密和审计机制。Kimi K3 是 Amazon Bedrock 首个支持显式提示缓存的开放权重模型。当多次调用模型时重复使用上下文,可借此降低延迟和输入成本。

    推荐理由:来自IT之家 AI的《亚马逊 AWS 旗下 Bedrock 官宣接入 Kimi K3 模型》。重点看模型能力与工程、开源生态。摘要提到:IT之家 9 月 21 日消息,亚马逊云服务(AWS)旗下人工智能服务平台 Amazon Bedrock 近日宣布接入 Kimi K3 模型,为编程工作提供新选择。 IT之家了解到,Kimi K3 是月之暗面开发的大模型。官方宣称其是首个参数规模达 2.8 万亿的开源模型。该模型原生支持视觉能力,拥有 100 万 Token 的上下文窗口,非常适合执行长时间编程、多文档分析等工作。 Amazon Bedrock 将为 Kimi K3 提供闭源模型相同的安全边界,拥有统一的访问控制、加密和审计机制。Kimi K3 是 Amazon Bedrock 首个支持显式提示缓存的开放权重模型。当多次调用模型时重复使用上下文,可借此降低延迟和输入成本。

  5. OpenAI News82

    Expanding OpenAI Academy with new learning paths

    这条英文动态主要涉及教育应用。原文要点:Explore new OpenAI Academy learning paths for employees, developers, leaders, educators, and students to build and demonstrate practical AI skills.

    推荐理由:来自OpenAI News的《Expanding OpenAI Academy with new learning paths》。重点看教育应用。摘要提到:这条英文动态主要涉及教育应用。原文要点:Explore new OpenAI Academy learning paths for employees, developers, leaders, educators, and students to build and demonstrate practical AI skills.

  6. IT之家 AI70

    被质疑“偷传代码”后智谱 ZCode 官宣开源:已完成整改并向所有用户道歉

    IT之家 9 月 21 日消息,智谱 ZCode 今日宣布,针对社区反馈的 ZCode 产品安全问题, 官方已经完成整改,并向所有用户道歉 。 智谱已将 ZCode 开源 ( https://github.com/zai-org/ZCode ),把代码交给社区监督,让 ZCode 变得开放、透明。 非常感谢此前发现 ZCode 问题的社区开发者,接下来我们将建立常态化的产品安全漏洞机制,欢迎开发者伙伴持续检查和反馈问题,我们会根据问题严重程度给予相应回报。 对于社区中提及的代码数据,我们承诺无留存,也从未将其用于模型训练。完成整改后,我们邀请中国信息通信研究院和绿盟科技开展安全审计,结果如下: 经中国信息通信研究院技术评测,确认 zcode-prod 阿里云 OSS 存储桶状态为云端零数据。ZCode v3.14.0 客户端已完成安全整改,已经移除 Repo Wiki 功能,已切断本地仓库快照生成与上传链路。 经绿盟科技审查,确...

    推荐理由:来自IT之家 AI的《被质疑“偷传代码”后智谱 ZCode 官宣开源:已完成整改并向所有用户道歉》。重点看模型能力与工程、评测与基准、开源生态。摘要提到:IT之家 9 月 21 日消息,智谱 ZCode 今日宣布,针对社区反馈的 ZCode 产品安全问题, 官方已经完成整改,并向所有用户道歉 。 智谱已将 ZCode 开源 ( https://github.com/zai-org/ZCode ),把代码交给社区监督,让 ZCode 变得开放、透明。 非常感谢此前发现 ZCode 问题的社区开发者,接下来我们将建立常态化的产品安全漏洞机制,欢迎开发者伙伴持续检查和反馈问题,我们会根据问题严重程度给予相应回报。 对于社区中提及的代码数据,我们承诺无留存,也从未将其用于模型训练。完成整改后,我们邀请中国信息通信研究院和绿盟科技开展安全审计,结果如下: 经中国信息通信研究院技术评测,确认 zcode-prod 阿里云 OSS 存储桶状态为云端零数据。ZCode v3.14.0 客户端已完成安全整改,已经移除 Repo Wiki 功能,已切断本地仓库快照生成与上传链路。 经绿盟科技审查,确...

  7. Tomer Tunguz78

    AI Comes for the If Statement

    这条英文动态主要涉及模型能力与工程。原文要点:Machine-native models replace human-facing text generation with zero-token typed execution, cutting inference costs by orders of magnitude for basic programming primitives.

    推荐理由:来自Tomer Tunguz的《AI Comes for the If Statement》。重点看模型能力与工程。摘要提到:这条英文动态主要涉及模型能力与工程。原文要点:Machine-native models replace human-facing text generation with zero-token typed execution, cutting inference costs by orders of magnitude for basic programming primitives.

  8. Simon Willison79

    MCP was always a bad idea?

    事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:MCP was always a bad idea? 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:MCP was always a bad idea? 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:MCP w。影响判断:它可能改变智能体工作流、模型能力与工程、文化创意相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、文化创意方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程、文化创意直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  9. Simon Willison88

    llm-keys-ui 0.1

    事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:llm-keys-ui 0.1 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:llm-keys-ui 0.1 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:llm-keys-ui 0.1 事实摘要:这条英文动态。影响判断:它可能改变智能体工作流、模型能力与工程、文化创意相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、文化创意方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程、文化创意直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

9月20日周日
  1. IT之家 AI36

    智谱 MaaS 平台上线数据内容不留存机制,用户可申请开通

    IT之家 9 月 20 日消息,智谱 MaaS 平台今日宣布, 近期将上线数据内容不留存功能 ,为企业和开发者用户提供更严格的数据隐私保护。 公告称,数据内容不留存机制旨在减少模型调用内容在平台侧的持久化留存。任何用户均可以申请开通,生效后,智谱 MaaS 平台不会对用户的输入和输出进行静态存储, 数据仅用于完成当次模型调用 。企业和开发者可通过 MaaS 控制台提交开通申请,具体生效时间及适用范围以平台确认结果为准。 公告提到, 这个功能并不意味着任何情形下都不留存数据 。Batch API、File API 等需要在平台侧持久化保存任务或文件的功能不在上述覆盖范围内,以及法律法规要求留存、为核查涉嫌违规或滥用行为的情况,平台可能按有关要求留存相关数据 30 天及以上。 据IT之家此前报道,针对社区中有关代码库数据上传的讨论,智谱旗下编程产品 ZCode 于 9 月 18 日通过智谱官方群组向受影响用户致歉,并发布回应称已第一...

    推荐理由:来自IT之家 AI的《智谱 MaaS 平台上线数据内容不留存机制,用户可申请开通》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 20 日消息,智谱 MaaS 平台今日宣布, 近期将上线数据内容不留存功能 ,为企业和开发者用户提供更严格的数据隐私保护。 公告称,数据内容不留存机制旨在减少模型调用内容在平台侧的持久化留存。任何用户均可以申请开通,生效后,智谱 MaaS 平台不会对用户的输入和输出进行静态存储, 数据仅用于完成当次模型调用 。企业和开发者可通过 MaaS 控制台提交开通申请,具体生效时间及适用范围以平台确认结果为准。 公告提到, 这个功能并不意味着任何情形下都不留存数据 。Batch API、File API 等需要在平台侧持久化保存任务或文件的功能不在上述覆盖范围内,以及法律法规要求留存、为核查涉嫌违规或滥用行为的情况,平台可能按有关要求留存相关数据 30 天及以上。 据IT之家此前报道,针对社区中有关代码库数据上传的讨论,智谱旗下编程产品 ZCode 于 9 月 18 日通过智谱官方群组向受影响用户致歉,并发布回应称已第一...

  2. IT之家 AI74

    B站上线“AI 无限竞技场”LLM 测评榜:号称“全球百大模型同场竞技”、GPT-6 现居榜首

    IT之家 9 月 20 日消息,B站宣布上线“AI 无限竞技场”大模型测评榜,同步公布了首轮模型排行榜,其中 GPT-6 Astra 在 10 个 UP 主测评中拿下榜首,打败 GLM-5.3 获得榜首次数冠军;前五名中,国产大模型占据三席。IT之家附榜单地址( https://www.bilibili.com/blackboard/era/aiarena.html ?bsource=market_aiarena_sns_02 )。 据B站介绍,“AI 无限竞技场”是一个汇集了B站 UP 主 AI 大模型测评的竞技广场,由各领域 UP 主对上百个大模型的真实场景实测构成,涵盖代码、推理、协作、知识等多种测评主题。 不同于传统跑分评测,B站 AI 无限竞技场不设主题或测评维度限制,来自各个分区的 UP 主们以真实工作流、专业应用、趣味脑洞等自主命题,在同题 PK 中直观呈现各模型的实际表现差异。榜单涵盖 DeepSeek、Kimi...

    推荐理由:来自IT之家 AI的《B站上线“AI 无限竞技场”LLM 测评榜:号称“全球百大模型同场竞技”、GPT-6 现居榜首》。重点看智能体工作流、模型能力与工程、评测与基准。摘要提到:IT之家 9 月 20 日消息,B站宣布上线“AI 无限竞技场”大模型测评榜,同步公布了首轮模型排行榜,其中 GPT-6 Astra 在 10 个 UP 主测评中拿下榜首,打败 GLM-5.3 获得榜首次数冠军;前五名中,国产大模型占据三席。IT之家附榜单地址( https://www.bilibili.com/blackboard/era/aiarena.html ?bsource=market_aiarena_sns_02 )。 据B站介绍,“AI 无限竞技场”是一个汇集了B站 UP 主 AI 大模型测评的竞技广场,由各领域 UP 主对上百个大模型的真实场景实测构成,涵盖代码、推理、协作、知识等多种测评主题。 不同于传统跑分评测,B站 AI 无限竞技场不设主题或测评维度限制,来自各个分区的 UP 主们以真实工作流、专业应用、趣味脑洞等自主命题,在同题 PK 中直观呈现各模型的实际表现差异。榜单涵盖 DeepSeek、Kimi...

  3. IT之家 AI78

    阶跃发布旗舰模型 Step 5 Preview:跻身 AA 榜单全球开源模型前三,10 月 15 日开源

    IT之家 9 月 20 日消息,阶跃今天宣布推出旗舰模型 Step 5 Preview,面向 AI 编程、软件工程、专业知识工作、金融等场景,提升模型执行真实世界 Agentic 任务表现,10 月 15 日开源完整权重。 据介绍,该模型采用稀疏 MoE 混合专家架构, 总参数量 600B 、激活参数仅 27B,支持 100 万 Token 上下文窗口,原生支持文本与视觉输入。 在全球人工智能权威榜单 Artificial Analysis Intelligence Index(IT之家注:AA 综合智能指数)中,该模型得分 44 分, 位居全球开源模型前三 。与此同时,该模型的单任务成本仅为 Anthropic Claude Opus 5 的 1/8。 优化方面,阶跃为该模型建立了 StepCodeBench,覆盖 553 个独立代码仓库、9 类任务、20 个应用领域和 33 种编程语言。在测试中,Step 5 Preview...

    推荐理由:来自IT之家 AI的《阶跃发布旗舰模型 Step 5 Preview:跻身 AA 榜单全球开源模型前三,10 月 15 日开源》。重点看智能体工作流、模型能力与工程、文化创意。摘要提到:IT之家 9 月 20 日消息,阶跃今天宣布推出旗舰模型 Step 5 Preview,面向 AI 编程、软件工程、专业知识工作、金融等场景,提升模型执行真实世界 Agentic 任务表现,10 月 15 日开源完整权重。 据介绍,该模型采用稀疏 MoE 混合专家架构, 总参数量 600B 、激活参数仅 27B,支持 100 万 Token 上下文窗口,原生支持文本与视觉输入。 在全球人工智能权威榜单 Artificial Analysis Intelligence Index(IT之家注:AA 综合智能指数)中,该模型得分 44 分, 位居全球开源模型前三 。与此同时,该模型的单任务成本仅为 Anthropic Claude Opus 5 的 1/8。 优化方面,阶跃为该模型建立了 StepCodeBench,覆盖 553 个独立代码仓库、9 类任务、20 个应用领域和 33 种编程语言。在测试中,Step 5 Preview...

9月19日周六
  1. Claude Code Releases80

    Claude Code Releases v2.1.278:Changed auto mode for Claude API and Enterprise users, and...

    事实摘要:这条英文动态主要涉及AI 应用价值,原文信息显示:Claude Code Releases v2.1.278:Changed auto mode for Claude API and Enterprise users, and... 事实摘要:这条英文动态主要涉及AI 应用价值,原文信息显示:Claude Code Releases v2.1.278:Cha。影响判断:它可能改变AI 应用价值相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪AI 应用价值方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和AI 应用价值直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  2. IT之家 AI72

    Claude Code 宣布添加支持“AI 通用说明书”AGENTS.md

    IT之家 9 月 19 日消息,Anthropic 公司 Claude Code 团队工程师萨里克 · 希希帕尔(Thariq Shihipar,网名 @trq212)在 X 平台发布推文, 宣布在今天(9 月 19 日)发布的 2.1.277 版本 Claude Code 中添加支持 AGENTS.md 。 IT之家翻译其推文内容如下: 从今天发布的 2.1.277 版本开始,如果文件夹中没有 CLAUDE.md ,Claude 将检查并使用 AGENTS.md 。 用户可以在 /config 中切换此行为。 CLAUDE.md 是 Claude Code 特有的工作流、MCP、Sub-agent 或命令配置;而 AGENTS.md 的目标是让不同工具共享项目级基础规则, 可视为所有 AI 都应该遵守的通用规则。 对于普通用户或者开发者而言, AGENTS.md 可以降低工具切换成本和配置成本,而 Claude Code 本次...

    推荐理由:来自IT之家 AI的《Claude Code 宣布添加支持“AI 通用说明书”AGENTS.md》。重点看智能体工作流、产品发布。摘要提到:IT之家 9 月 19 日消息,Anthropic 公司 Claude Code 团队工程师萨里克 · 希希帕尔(Thariq Shihipar,网名 @trq212)在 X 平台发布推文, 宣布在今天(9 月 19 日)发布的 2.1.277 版本 Claude Code 中添加支持 AGENTS.md 。 IT之家翻译其推文内容如下: 从今天发布的 2.1.277 版本开始,如果文件夹中没有 CLAUDE.md ,Claude 将检查并使用 AGENTS.md 。 用户可以在 /config 中切换此行为。 CLAUDE.md 是 Claude Code 特有的工作流、MCP、Sub-agent 或命令配置;而 AGENTS.md 的目标是让不同工具共享项目级基础规则, 可视为所有 AI 都应该遵守的通用规则。 对于普通用户或者开发者而言, AGENTS.md 可以降低工具切换成本和配置成本,而 Claude Code 本次...

  3. GitHub Changelog81

    Copilot code review: An improved review experience

    事实摘要:这条英文动态主要涉及开源生态,原文信息显示:Copilot code review: An improved review experience 事实摘要:这条英文动态主要涉及开源生态,原文信息显示:Copilot code review: An improved review experience 事实摘要:这条英文动态主要涉及开源生态,原文信息显示:Co。影响判断:它可能改变开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  4. GitHub Changelog82

    Manage the code coverage ruleset condition with the REST API

    事实摘要:这条英文动态主要涉及开源生态,原文信息显示:Manage the code coverage ruleset condition with the REST API 事实摘要:这条英文动态主要涉及开源生态,原文信息显示:Manage the code coverage ruleset condition with the REST API 事实摘要:这条英文。影响判断:它可能改变开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  5. Simon Willison87

    Quoting Thariq Shihipar

    事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:Quoting Thariq Shihipar 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:Quoting Thariq Shihipar 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:Quoting Tha。影响判断:它可能改变智能体工作流、模型能力与工程、文化创意相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、文化创意方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程、文化创意直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  6. GitHub Changelog90

    Upcoming deprecation of selected GitHub Copilot models in mid-October

    事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:Upcoming deprecation of selected GitHub Copilot models in mid-October 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:Upcoming deprecation of selecte。影响判断:它可能改变智能体工作流、模型能力与工程、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程、开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  7. Claude Code Releases84

    Claude Code Releases v2.1.277:Added AGENTS.md support: in a project with no CLAUDE.md, C...

    事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:Claude Code Releases v2.1.277:Added AGENTS.md support: in a project with no CLAUDE.md, C... 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:Claude Co。影响判断:它可能改变智能体工作流、模型能力与工程、文化创意相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、文化创意方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程、文化创意直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

9月18日周五
  1. GitHub Blog AI82

    Should you read the code, is RAG dead, and did Skills kill MCP?

    这条英文动态主要涉及开源生态。原文要点:We dive into these questions and other AI hot takes on the latest episode of the GitHub Podcast. The post Should you read the code, is RAG dead, and did Skills kill MCP? appeared first on The GitHub Blog .

    推荐理由:来自GitHub Blog AI的《Should you read the code, is RAG dead, and did Skills kill MCP?》。重点看开源生态。摘要提到:这条英文动态主要涉及开源生态。原文要点:We dive into these questions and other AI hot takes on the latest episode of the GitHub Podcast. The post Should you read the code, is RAG dead, and did Skills kill MCP? appeared first on The GitHub Blog .

  2. IT之家 AI66

    MiniMax Code CLI 正式开源,在评测中取得 76.7% 的任务通过率

    IT之家 9 月 18 日消息,MiniMax 今晚宣布, MiniMax Code CLI 的 v0.4.12 版本面向全球开发者正式开放,并且以 MIT 协议正式开放源代码 。 据介绍,MiniMax Code CLI 是 MiniMax Code 客户端的核心组件。在基于 FrontierHarness Eval 的本轮评测中,取得了 76.7% 的任务通过率,成功任务耗时中位数为 4 分 33 秒, 两项指标均优于报告所列公开基线 。 官方表示,希望通过开源,让开发者能够审视工具调用和权限处理,构建可靠的企业级应用。也让社区参与发现问题、贡献修复。让使用更放心,让安全机制在实际使用和审查中持续完善。 IT之家附相关链接: 快速体验: curl -fsSL https://filecdn.minimax.chat/public/install.sh | bash Github 源码: https://github.com/...

    推荐理由:来自IT之家 AI的《MiniMax Code CLI 正式开源,在评测中取得 76.7% 的任务通过率》。重点看评测与基准、开源生态。摘要提到:IT之家 9 月 18 日消息,MiniMax 今晚宣布, MiniMax Code CLI 的 v0.4.12 版本面向全球开发者正式开放,并且以 MIT 协议正式开放源代码 。 据介绍,MiniMax Code CLI 是 MiniMax Code 客户端的核心组件。在基于 FrontierHarness Eval 的本轮评测中,取得了 76.7% 的任务通过率,成功任务耗时中位数为 4 分 33 秒, 两项指标均优于报告所列公开基线 。 官方表示,希望通过开源,让开发者能够审视工具调用和权限处理,构建可靠的企业级应用。也让社区参与发现问题、贡献修复。让使用更放心,让安全机制在实际使用和审查中持续完善。 IT之家附相关链接: 快速体验: curl -fsSL https://filecdn.minimax.chat/public/install.sh | bash Github 源码: https://github.com/...

  3. IT之家 AI70

    苹果详解 Safari 27 浏览器升级:解决阅读“乱跳”,修复 844 个问题

    IT之家 9 月 18 日消息,苹果公司昨日(9 月 17 日)更新 WebKit 博文,详细介绍了 Safari 27 系统带来的诸多新功能 / 新特性, 包括支持 MCP 协议,以及修复 844 个问题等。 对于开发者而言,Safari 27 浏览器最主要变化在于新增支持 MCP(Model Context Protocol)服务器支持,让 Claude Code、Codex 等 AI 工具能够控制浏览器窗口,读取 DOM 结构、网络请求、屏幕截图和控制台输出,从而帮助开发者更快地调试网站。 对于用户而言,Safari 27 新增滚动锚定(Scroll Anchoring)功能,当用户正在读文章时,页面上方延迟加载的图片、广告、评论或推荐模块,不会再把正在看的段落往下推。 IT之家翻译官方相关介绍如下: 许多网站会在用户阅读或浏览内容时向页面注入新内容。这些新内容通常会出现在用户当前视线上方,例如图片、广告或评论。过去这会导...

    推荐理由:来自IT之家 AI的《苹果详解 Safari 27 浏览器升级:解决阅读“乱跳”,修复 844 个问题》。重点看模型能力与工程。摘要提到:IT之家 9 月 18 日消息,苹果公司昨日(9 月 17 日)更新 WebKit 博文,详细介绍了 Safari 27 系统带来的诸多新功能 / 新特性, 包括支持 MCP 协议,以及修复 844 个问题等。 对于开发者而言,Safari 27 浏览器最主要变化在于新增支持 MCP(Model Context Protocol)服务器支持,让 Claude Code、Codex 等 AI 工具能够控制浏览器窗口,读取 DOM 结构、网络请求、屏幕截图和控制台输出,从而帮助开发者更快地调试网站。 对于用户而言,Safari 27 新增滚动锚定(Scroll Anchoring)功能,当用户正在读文章时,页面上方延迟加载的图片、广告、评论或推荐模块,不会再把正在看的段落往下推。 IT之家翻译官方相关介绍如下: 许多网站会在用户阅读或浏览内容时向页面注入新内容。这些新内容通常会出现在用户当前视线上方,例如图片、广告或评论。过去这会导...

  4. Claude Code Releases84

    Claude Code Releases v2.1.276:Fixed every request failing with 400 … Input tag 'advisor_...

    事实摘要:这条英文动态主要涉及AI 应用价值,原文信息显示:Claude Code Releases v2.1.276:Fixed every request failing with 400 … Input tag 'advisor_... 事实摘要:这条英文动态主要涉及AI 应用价值,原文信息显示:Claude Code Releases v2.1.276:Fix。影响判断:它可能改变AI 应用价值相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪AI 应用价值方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和AI 应用价值直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  5. IT之家 AI34

    苹果增强辅助功能:iOS 27.2 Beta 1 开放 FaceTime 手语 API 接口

    IT之家 9 月 18 日消息,科技媒体 macobserver 昨日(9 月 17 日)发布博文,报道称在 iOS 27.2 Beta 1 更新中, 苹果公司开放 FaceTime 手语口译应用编程接口(API)。 IT之家援引博文介绍,兼容的 App 可以调用该 API 服务,通话参与者无需退出当前通话,也无需为口译服务另行协调独立视频房间,可以在统一通话会话内实现手语服务。 该媒体指出苹果 FaceTime 本身并不具备自动手语翻译能力,也不会替代专业人工手语译员,只是提供了 API 接口,方便第三方辅助功能应用接入通话,具体服务仍由支持该接口的应用和口译服务商提供。 相关功能于 2026 年进入预览阶段,在 iOS 27.2 Beta 1 中开放 API 接口后,口译服务商可据此开发适配应用。

    推荐理由:来自IT之家 AI的《苹果增强辅助功能:iOS 27.2 Beta 1 开放 FaceTime 手语 API 接口》。重点看产品发布。摘要提到:IT之家 9 月 18 日消息,科技媒体 macobserver 昨日(9 月 17 日)发布博文,报道称在 iOS 27.2 Beta 1 更新中, 苹果公司开放 FaceTime 手语口译应用编程接口(API)。 IT之家援引博文介绍,兼容的 App 可以调用该 API 服务,通话参与者无需退出当前通话,也无需为口译服务另行协调独立视频房间,可以在统一通话会话内实现手语服务。 该媒体指出苹果 FaceTime 本身并不具备自动手语翻译能力,也不会替代专业人工手语译员,只是提供了 API 接口,方便第三方辅助功能应用接入通话,具体服务仍由支持该接口的应用和口译服务商提供。 相关功能于 2026 年进入预览阶段,在 iOS 27.2 Beta 1 中开放 API 接口后,口译服务商可据此开发适配应用。