跳到正文
9月11日周五
  1. IT之家 AI72

    月之暗面 Kimi K2.8 Preview 模型全量上线 Kimi Code,综合性能接近 K3

    IT之家 9 月 11 日消息, 月之暗面 Kimi K2.8 Preview 模型今日全量上线 Kimi Code ,Model ID 不变,仍为 kimi-for-coding,客户端与第三方工具无需修改配置即可使用。 官方表示, K2.8 Preview 综合性能接近 K3 ,思考效率更高。编码与智能体能力全面提升,思考(thinking)效率较 K2.7 Code 显著改善, 全部会员档位均开放最高 1M 上下文窗口 。 IT之家获悉,Kimi K2.8 Preview 支持 thinking effort 档位调节,与 K3 的思考等级一致,支持 low / high / max 三档(默认 max)。关闭 thinking 后,K3 系列与 K2.8 Preview 的请求均路由到 K2.8 Preview(无思考)。 相关阅读: 《 月之暗面开源 Kimi K3 模型,2.8 万亿参数 》

    推荐理由:来自IT之家 AI的《月之暗面 Kimi K2.8 Preview 模型全量上线 Kimi Code,综合性能接近 K3》。重点看智能体工作流、模型能力与工程、开源生态。摘要提到:IT之家 9 月 11 日消息, 月之暗面 Kimi K2.8 Preview 模型今日全量上线 Kimi Code ,Model ID 不变,仍为 kimi-for-coding,客户端与第三方工具无需修改配置即可使用。 官方表示, K2.8 Preview 综合性能接近 K3 ,思考效率更高。编码与智能体能力全面提升,思考(thinking)效率较 K2.7 Code 显著改善, 全部会员档位均开放最高 1M 上下文窗口 。 IT之家获悉,Kimi K2.8 Preview 支持 thinking effort 档位调节,与 K3 的思考等级一致,支持 low / high / max 三档(默认 max)。关闭 thinking 后,K3 系列与 K2.8 Preview 的请求均路由到 K2.8 Preview(无思考)。 相关阅读: 《 月之暗面开源 Kimi K3 模型,2.8 万亿参数 》

  2. IT之家 AI36

    阿里云 Token Plan 个人版升级:Standard、Pro 套餐新增 12 类 Agent Harness 工具

    IT之家 9 月 11 日消息,阿里云官方今日宣布,阿里云 Token Plan 个人版升级。 原有价格及 Credit 额度保持不变,Standard 和 Pro 套餐新增 Agent Harness 工具权益与用量 ,覆盖搜索、网页解析、图像生成、语音处理、代码执行等 12 项 Agent 开发常用能力。上述工具均通过 MCP 标准协议开放,可直接接入到自有 Agent 应用,无需逐项单独采购。 Token Plan 个人版主要面向个人开发者和中小团队,IT之家附价格及额度: Lite 套餐价格为 39 元 / 月,每 7 天提供 2500Credits; Standard 套餐价格为 139 元 / 月,每 7 天提供 10000Credits; Pro 套餐价格为 499 元 / 月,每 7 天提供 40000Credits。 升级后,Standard 和 Pro 套餐新增 Harness 每月权益,包括联网搜索增强版、...

    推荐理由:来自IT之家 AI的《阿里云 Token Plan 个人版升级:Standard、Pro 套餐新增 12 类 Agent Harness 工具》。重点看智能体工作流。摘要提到:IT之家 9 月 11 日消息,阿里云官方今日宣布,阿里云 Token Plan 个人版升级。 原有价格及 Credit 额度保持不变,Standard 和 Pro 套餐新增 Agent Harness 工具权益与用量 ,覆盖搜索、网页解析、图像生成、语音处理、代码执行等 12 项 Agent 开发常用能力。上述工具均通过 MCP 标准协议开放,可直接接入到自有 Agent 应用,无需逐项单独采购。 Token Plan 个人版主要面向个人开发者和中小团队,IT之家附价格及额度: Lite 套餐价格为 39 元 / 月,每 7 天提供 2500Credits; Standard 套餐价格为 139 元 / 月,每 7 天提供 10000Credits; Pro 套餐价格为 499 元 / 月,每 7 天提供 40000Credits。 升级后,Standard 和 Pro 套餐新增 Harness 每月权益,包括联网搜索增强版、...

  3. IT之家 AI70

    支付宝将推 AI 钱包智能体

    IT之家 9 月 11 日消息,在本周的 2026 外滩大会上,支付宝宣布 AI 支付进一步从“可支付”迈向“可信支付”, 将推出 AI 钱包智能体 ,帮助个人管好每一笔 AI 支付。 支付宝“AI 收”进一步推出 Vibe Pay、Skill Pay、Machine Pay 三大能力,覆盖 AI 应用创造、Skill 变现和机器互联等数字世界的商业场景。不需要懂代码,也可以让自己的产品具备收款能力。 IT之家从支付宝官方获悉,支付宝“AI 付”基于升级后的能力,推出「 AI 周期购 」、「 AI 帮你抢 」、「 AI 帮你订 」三种适用于电商的新场景能力。 支付宝“AI 付”应用蚂蚁集团自主打造的 APASS 商业信任基础设施。基于 KYA(Know Your Agent)理念,APASS 围绕智能体的身份、意图、授权和行为建立全过程信任机制,让 AI 支付从“能付”进一步走向“可信地付”。 支付宝与蚂蚁国际为 AI 从业者联...

    推荐理由:来自IT之家 AI的《支付宝将推 AI 钱包智能体》。重点看智能体工作流、产品发布。摘要提到:IT之家 9 月 11 日消息,在本周的 2026 外滩大会上,支付宝宣布 AI 支付进一步从“可支付”迈向“可信支付”, 将推出 AI 钱包智能体 ,帮助个人管好每一笔 AI 支付。 支付宝“AI 收”进一步推出 Vibe Pay、Skill Pay、Machine Pay 三大能力,覆盖 AI 应用创造、Skill 变现和机器互联等数字世界的商业场景。不需要懂代码,也可以让自己的产品具备收款能力。 IT之家从支付宝官方获悉,支付宝“AI 付”基于升级后的能力,推出「 AI 周期购 」、「 AI 帮你抢 」、「 AI 帮你订 」三种适用于电商的新场景能力。 支付宝“AI 付”应用蚂蚁集团自主打造的 APASS 商业信任基础设施。基于 KYA(Know Your Agent)理念,APASS 围绕智能体的身份、意图、授权和行为建立全过程信任机制,让 AI 支付从“能付”进一步走向“可信地付”。 支付宝与蚂蚁国际为 AI 从业者联...

  4. IT之家 AI68

    中国软件协会吕卫锋回应“AI 替代程序员”:高度重视,支持从业人员向高附加值岗位转型

    IT之家 9 月 11 日消息,工信部今日召开《“人工智能 + 软件”专项行动实施方案》新闻发布会,有记者提到智能编程普及让一些软件从业人员感到压力,社会上也有“人工智能会替代程序员”的讨论。 中国软件行业协会副理事长兼秘书长吕卫锋表示, 当前这个问题社会关注度很高,我们也高度重视 。需要看到,人工智能推动软件生产方式变革,软件人才能力结构与岗位需求随之调整。 吕卫锋表示,从人才能力结构看: 一是单纯的编码执行能力权重下降 ,而需求理解、架构设计、系统集成、质量和安全控制等能力要求上升。这些环节对经验积累的依赖没有减弱,要求反而更高。 二是人机协同成为新的基础能力 ,准确表达开发意图、评估校验生成结果、编排多智能体协作,正在成为从业人员的必备技能。 三是复合型要求明显提高 ,既懂软件,又懂行业知识的人才更为紧缺。近来行业内出现前线部署工程师(FDE)等新角色,深入客户业务现场完成产品和服务的适配交付,对技术能力和行业理解都提出了...

    推荐理由:来自IT之家 AI的《中国软件协会吕卫锋回应“AI 替代程序员”:高度重视,支持从业人员向高附加值岗位转型》。重点看智能体工作流、产品发布。摘要提到:IT之家 9 月 11 日消息,工信部今日召开《“人工智能 + 软件”专项行动实施方案》新闻发布会,有记者提到智能编程普及让一些软件从业人员感到压力,社会上也有“人工智能会替代程序员”的讨论。 中国软件行业协会副理事长兼秘书长吕卫锋表示, 当前这个问题社会关注度很高,我们也高度重视 。需要看到,人工智能推动软件生产方式变革,软件人才能力结构与岗位需求随之调整。 吕卫锋表示,从人才能力结构看: 一是单纯的编码执行能力权重下降 ,而需求理解、架构设计、系统集成、质量和安全控制等能力要求上升。这些环节对经验积累的依赖没有减弱,要求反而更高。 二是人机协同成为新的基础能力 ,准确表达开发意图、评估校验生成结果、编排多智能体协作,正在成为从业人员的必备技能。 三是复合型要求明显提高 ,既懂软件,又懂行业知识的人才更为紧缺。近来行业内出现前线部署工程师(FDE)等新角色,深入客户业务现场完成产品和服务的适配交付,对技术能力和行业理解都提出了...

  5. IT之家 AI70

    微软 VS Code 1.137 发布:为宠物征名、按小时 / 日 / 周调度 AI 智能体任务

    IT之家 9 月 11 日消息,微软昨日(9 月 10 日)发布公告,宣布推出 Visual Studio Code 1.137 版本, 可帮助用户自动化重复性工作、在工作区中继续快速聊天,以及在不离开客服窗口的情况下处理 GitHub 问题和拉取请求。 本次更新主要聚焦增强 AI 智能体能力,推出 5 项主要新功能,其中 3 项仍处于实验或预览阶段。核心功能包括 Automations(预览)、Voice Mode(实验)、快速聊天转工作区、GitHub Issue / PR 集成以及 VS Code 宠物互动功能。 Automations 方面,用户可以根据使用需求,在手动触发之外,也可以按小时、每日或每周自动执行 AI 智能体任务。IT之家附上相关视频如下: 用户可通过启用 chat.automations.enabled 设置,在 Agents 窗口侧边栏选择 Automations,使用预设模板(如追踪变更、分类 Is...

    推荐理由:来自IT之家 AI的《微软 VS Code 1.137 发布:为宠物征名、按小时 / 日 / 周调度 AI 智能体任务》。重点看智能体工作流、开源生态、产品发布。摘要提到:IT之家 9 月 11 日消息,微软昨日(9 月 10 日)发布公告,宣布推出 Visual Studio Code 1.137 版本, 可帮助用户自动化重复性工作、在工作区中继续快速聊天,以及在不离开客服窗口的情况下处理 GitHub 问题和拉取请求。 本次更新主要聚焦增强 AI 智能体能力,推出 5 项主要新功能,其中 3 项仍处于实验或预览阶段。核心功能包括 Automations(预览)、Voice Mode(实验)、快速聊天转工作区、GitHub Issue / PR 集成以及 VS Code 宠物互动功能。 Automations 方面,用户可以根据使用需求,在手动触发之外,也可以按小时、每日或每周自动执行 AI 智能体任务。IT之家附上相关视频如下: 用户可通过启用 chat.automations.enabled 设置,在 Agents 窗口侧边栏选择 Automations,使用预设模板(如追踪变更、分类 Is...

  6. 极客公园72

    DeepSeek V4.1 Flash 发布;罗永浩狂喷苹果折叠屏:全是抄的;马斯克「无聊公司」融资 30 亿美元|极客早知道

    DeepSeek V4.1 Flash 模型正式发布:全面超越 V4 Pro、原生多模态视觉理解,最高降价 60% 9 月 10 日消息,深度求索今日正式发布 DeepSeek V4.1 Flash 模型 。这是其全新模型结构系列中的最小尺寸的模型,具备原生多模态视觉理解能力。 新模型结构的设计初衷是:能力上限更高、推理速度更快、吞吐更大、可扩展到更大参数模型。 DeepSeek V4.1 Flash 为 552B 参数的 MoE 模型 ,采用了全新的 Causal-Encoder-Decoder 结构,输入和输出不对称,输入激活只有 8B,输出激活 16B,成本显著低于已知的同尺寸模型。同时,V4.1 Flash 还采用了新的预训练方式、经过了更大规模的强化学习后训练,在基准测试中,成功超越了包括 DeepSeek V4 Pro 在内的一众旗舰模型的智能水平。 ▲ DeepSeek-V4.1-Flash 与主流前沿模型在 Ag...

    推荐理由:来自极客公园的《DeepSeek V4.1 Flash 发布;罗永浩狂喷苹果折叠屏:全是抄的;马斯克「无聊公司」融资 30 亿美元|极客早知道》。重点看模型能力与工程、评测与基准、产品发布。摘要提到:DeepSeek V4.1 Flash 模型正式发布:全面超越 V4 Pro、原生多模态视觉理解,最高降价 60% 9 月 10 日消息,深度求索今日正式发布 DeepSeek V4.1 Flash 模型 。这是其全新模型结构系列中的最小尺寸的模型,具备原生多模态视觉理解能力。 新模型结构的设计初衷是:能力上限更高、推理速度更快、吞吐更大、可扩展到更大参数模型。 DeepSeek V4.1 Flash 为 552B 参数的 MoE 模型 ,采用了全新的 Causal-Encoder-Decoder 结构,输入和输出不对称,输入激活只有 8B,输出激活 16B,成本显著低于已知的同尺寸模型。同时,V4.1 Flash 还采用了新的预训练方式、经过了更大规模的强化学习后训练,在基准测试中,成功超越了包括 DeepSeek V4 Pro 在内的一众旗舰模型的智能水平。 ▲ DeepSeek-V4.1-Flash 与主流前沿模型在 Ag...

  7. IT之家 AI74

    OpenAI 扩大实时语音模型能力:GPT-Live-1 上线 API,支持打断处理、工具调用和电话语音智能体

    IT之家 9 月 11 日消息,OpenAI 今日宣布将 GPT-Live-1 引入 API,开发者可据此打造支持实时语音交互的应用和业务流程。该模型支持全双工对话,能够同时听取和输出语音,并在对话过程中处理打断、停顿及背景噪声。 GPT-Live-1 还支持电话场景,可用于预订餐厅、客户服务等全双工语音智能体。OpenAI 表示,开发者可以将其与 Codex 等工具连接,也可以通过 OpenAI Presence 开发能够查询企业系统、执行获批操作并在必要时转交人工的语音工作。 据介绍,GPT-Live-1 将语音理解与语音输出整合在同一模型中,减少传统“语音转文字 — 大语言模型 — 文字转语音”的多次衔接,从而降低延迟。模型还支持将复杂推理和工具调用交由后端文本模型处理。 开发者可以通过系统提示词调整其语气、语速和对话风格,也可以配置后端模型、工具及智能体框架。 OpenAI 表示,GPT-Live-1 支持原生语音识别转...

    推荐理由:来自IT之家 AI的《OpenAI 扩大实时语音模型能力:GPT-Live-1 上线 API,支持打断处理、工具调用和电话语音智能体》。重点看智能体工作流、模型能力与工程、产品发布。摘要提到:IT之家 9 月 11 日消息,OpenAI 今日宣布将 GPT-Live-1 引入 API,开发者可据此打造支持实时语音交互的应用和业务流程。该模型支持全双工对话,能够同时听取和输出语音,并在对话过程中处理打断、停顿及背景噪声。 GPT-Live-1 还支持电话场景,可用于预订餐厅、客户服务等全双工语音智能体。OpenAI 表示,开发者可以将其与 Codex 等工具连接,也可以通过 OpenAI Presence 开发能够查询企业系统、执行获批操作并在必要时转交人工的语音工作。 据介绍,GPT-Live-1 将语音理解与语音输出整合在同一模型中,减少传统“语音转文字 — 大语言模型 — 文字转语音”的多次衔接,从而降低延迟。模型还支持将复杂推理和工具调用交由后端文本模型处理。 开发者可以通过系统提示词调整其语气、语速和对话风格,也可以配置后端模型、工具及智能体框架。 OpenAI 表示,GPT-Live-1 支持原生语音识别转...

  8. IT之家 AI68

    马斯克 SpaceXAI 团队将直播用 Grok Bot 从零开始建立一家公司,从创意构思、产品开发到实际工作部署

    IT之家 9 月 11 日消息,马斯克旗下 SpaceXAI 团队宣布,将于当地时间 9 月 15 日至 17 日开展为期三天的直播活动,展示团队成员如何借助 Grok Bot 从一个想法和一张白纸开始,制定商业计划、确定产品功能并完成实际工程工作,将概念转化为可运行的业务。 本次直播将从每天上午 8:30 持续至下午 6:00。团队将实时展示从产品构思到工程开发的过程,并通过不同部门的专题环节,介绍 Grok Bot 在业务各阶段的实际工作流程。 9 月 15 日为第一天,安排包括 Grok Bot 入门介绍、工程开发、产品经理及创始人专题。9 月 16 日将聚焦销售工程、销售、销售开发代表(SDR)和客户支持。9 月 17 日则安排营销运营、售后及营销专题。 活动期间,SpaceX AI 团队还将展示 Grok Bot 如何参与从编写第一行代码到帮助客户成功的不同环节,并分享面向各职能岗位的具体应用案例。IT之家后续将保持关...

    推荐理由:来自IT之家 AI的《马斯克 SpaceXAI 团队将直播用 Grok Bot 从零开始建立一家公司,从创意构思、产品开发到实际工作部署》。重点看智能体工作流、文化创意、产品发布。摘要提到:IT之家 9 月 11 日消息,马斯克旗下 SpaceXAI 团队宣布,将于当地时间 9 月 15 日至 17 日开展为期三天的直播活动,展示团队成员如何借助 Grok Bot 从一个想法和一张白纸开始,制定商业计划、确定产品功能并完成实际工程工作,将概念转化为可运行的业务。 本次直播将从每天上午 8:30 持续至下午 6:00。团队将实时展示从产品构思到工程开发的过程,并通过不同部门的专题环节,介绍 Grok Bot 在业务各阶段的实际工作流程。 9 月 15 日为第一天,安排包括 Grok Bot 入门介绍、工程开发、产品经理及创始人专题。9 月 16 日将聚焦销售工程、销售、销售开发代表(SDR)和客户支持。9 月 17 日则安排营销运营、售后及营销专题。 活动期间,SpaceX AI 团队还将展示 Grok Bot 如何参与从编写第一行代码到帮助客户成功的不同环节,并分享面向各职能岗位的具体应用案例。IT之家后续将保持关...

  9. Apple Machine Learning Research52

    SimpleDesign: A Joint Model for Protein Sequence and Structure Codesign

    事实摘要:这条英文动态主要涉及模型能力与工程,原文信息显示:SimpleDesign: A Joint Model for Protein Sequence and Structure Codesign 事实摘要:这条英文动态主要涉及模型能力与工程,原文信息显示:SimpleDesign: A Joint Model for Protein Sequence and 。影响判断:它可能改变模型能力与工程相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和模型能力与工程直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  10. IT之家 AI74

    OpenAI Agents API 开放公测:支持代码执行、工具调用和跨上下文任务运行,为开发者提供云端智能体基础设施

    IT之家 9 月 11 日消息,OpenAI 于当地时间 9 月 10 日宣布推出 Agents API 公测版,允许开发者通过 API 调用由 OpenAI 管理的云端 AI 智能体运行环境。 该服务复用了 Codex 背后的智能体执行框架和基础设施,开发者可以指定任务、模型、工具及运行环境,打造能够执行多步骤任务的 AI 应用。 OpenAI 表示,开发者只需一次 API 调用即可创建生产环境级别的智能体。智能体可以在云端运行代码、处理文件、保存中间结果,并持续执行跨越数小时甚至数天的任务。OpenAI 负责维护智能体执行框架,开发者则可以专注于自身应用所需的工具、知识和工作流程。 Agents API 支持 OpenAI 托管的沙盒环境,也支持部署在开发者自有基础设施或合作伙伴提供的沙盒中。OpenAI 已与 Blaxel、Cloudflare、Daytona、DigitalOcean、E2B、Modal、Oracle、R...

    推荐理由:来自IT之家 AI的《OpenAI Agents API 开放公测:支持代码执行、工具调用和跨上下文任务运行,为开发者提供云端智能体基础设施》。重点看智能体工作流、模型能力与工程、产品发布。摘要提到:IT之家 9 月 11 日消息,OpenAI 于当地时间 9 月 10 日宣布推出 Agents API 公测版,允许开发者通过 API 调用由 OpenAI 管理的云端 AI 智能体运行环境。 该服务复用了 Codex 背后的智能体执行框架和基础设施,开发者可以指定任务、模型、工具及运行环境,打造能够执行多步骤任务的 AI 应用。 OpenAI 表示,开发者只需一次 API 调用即可创建生产环境级别的智能体。智能体可以在云端运行代码、处理文件、保存中间结果,并持续执行跨越数小时甚至数天的任务。OpenAI 负责维护智能体执行框架,开发者则可以专注于自身应用所需的工具、知识和工作流程。 Agents API 支持 OpenAI 托管的沙盒环境,也支持部署在开发者自有基础设施或合作伙伴提供的沙盒中。OpenAI 已与 Blaxel、Cloudflare、Daytona、DigitalOcean、E2B、Modal、Oracle、R...

  11. IT之家 AI66

    办公协作平台 Slack 升级 Slackbot AI 助手,可快速创建交互式报告 / 网站等内容

    IT之家 9 月 11 日消息,办公协作平台 Slack 发布公告,宣布为旗下 Slackbot AI 助手引入一项 Slackforce Surfaces 功能,用户只需告诉 Slackbot AI 助手自己的需求,即可利用自己先前的对话记录以及连接的 App 创建交互式报告、投票、仪表盘、演示文稿、微型网站等内容,之后用户可以将这些内容快速分享给同事。 Slack 展示的一个案例中,用户要求 Slackbot 制作一份街机游戏主题的 AI Token 使用量可视化内容,AI 助手随后生成了交互式仪表盘,并按照销售、设计、工程等不同部门展示 Token 使用情况。 Slack 近期对旗下 Slackbot AI 助手进行大规模功能提升,目前其已支持跨频道汇总信息、整理聊天消息、智能安排日程、协作式 Vibe Coding 等功能,用户无需订阅,可直接免费使用。

    推荐理由:来自IT之家 AI的《办公协作平台 Slack 升级 Slackbot AI 助手,可快速创建交互式报告 / 网站等内容》。重点看产品发布。摘要提到:IT之家 9 月 11 日消息,办公协作平台 Slack 发布公告,宣布为旗下 Slackbot AI 助手引入一项 Slackforce Surfaces 功能,用户只需告诉 Slackbot AI 助手自己的需求,即可利用自己先前的对话记录以及连接的 App 创建交互式报告、投票、仪表盘、演示文稿、微型网站等内容,之后用户可以将这些内容快速分享给同事。 Slack 展示的一个案例中,用户要求 Slackbot 制作一份街机游戏主题的 AI Token 使用量可视化内容,AI 助手随后生成了交互式仪表盘,并按照销售、设计、工程等不同部门展示 Token 使用情况。 Slack 近期对旗下 Slackbot AI 助手进行大规模功能提升,目前其已支持跨频道汇总信息、整理聊天消息、智能安排日程、协作式 Vibe Coding 等功能,用户无需订阅,可直接免费使用。

  12. GitHub Changelog85

    GitHub Copilot weekly releases — September 7

    事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:GitHub Copilot weekly releases — September 7 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:GitHub Copilot weekly releases — September 7 事实摘要:这条英文动态。影响判断:它可能改变智能体工作流、模型能力与工程、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程、开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  13. IT之家 AI34

    苹果开放 iOS / iPadOS 27 应用提交,macOS 27 移除 Intel Mac 支持

    IT之家 9 月 11 日消息,科技媒体 9to5Mac 昨日(9 月 10 日)发布博文,报道称苹果公司已开放最新 SDK(软件开发工具包), 邀请开发者针对 iOS 27、iPadOS 27、macOS 27、tvOS 27、visionOS 27 和 watchOS 27 系统开发应用和游戏。 苹果官网目前已开放 Xcode 27 Release Candidate 候选版本,并邀请开发者通过最新 SDK 构建应用和游戏,提交给 App Store 应用商店审核。 此外,苹果明确 macOS 27 将仅支持 Apple Silicon 软件;macOS 26 将是最后一个同时支持 Intel Mac 和 Rosetta(Intel 应用转译环境)的 macOS 版本,开发者须转向 Apple Silicon 架构。 同时,苹果提醒开发者填写新的年龄分级问题。其中包括 Time Allowances(使用时长限制)等功能所需...

    推荐理由:来自IT之家 AI的《苹果开放 iOS / iPadOS 27 应用提交,macOS 27 移除 Intel Mac 支持》。重点看产品发布。摘要提到:IT之家 9 月 11 日消息,科技媒体 9to5Mac 昨日(9 月 10 日)发布博文,报道称苹果公司已开放最新 SDK(软件开发工具包), 邀请开发者针对 iOS 27、iPadOS 27、macOS 27、tvOS 27、visionOS 27 和 watchOS 27 系统开发应用和游戏。 苹果官网目前已开放 Xcode 27 Release Candidate 候选版本,并邀请开发者通过最新 SDK 构建应用和游戏,提交给 App Store 应用商店审核。 此外,苹果明确 macOS 27 将仅支持 Apple Silicon 软件;macOS 26 将是最后一个同时支持 Intel Mac 和 Rosetta(Intel 应用转译环境)的 macOS 版本,开发者须转向 Apple Silicon 架构。 同时,苹果提醒开发者填写新的年龄分级问题。其中包括 Time Allowances(使用时长限制)等功能所需...

  14. GitHub Blog AI86

    GitHub Copilot app for Beginners: Using the diff, terminal, and browser

    这条英文动态主要涉及智能体工作流、开源生态。原文要点:Checking agent-generated code usually means hopping between tabs. Learn how to view diffs, run terminal commands, and preview web apps side by side in the GitHub Copilot app. The post GitHub Copilot app for Beginners: Using the diff, terminal, and browser appeared first on The GitHub Blog .

    推荐理由:来自GitHub Blog AI的《GitHub Copilot app for Beginners: Using the diff, terminal, and browser》。重点看智能体工作流、开源生态。摘要提到:这条英文动态主要涉及智能体工作流、开源生态。原文要点:Checking agent-generated code usually means hopping between tabs. Learn how to view diffs, run terminal commands, and preview web apps side by side in the GitHub Copilot app. The post GitHub Copilot app for Beginners: Using the diff, terminal, and browser appeared first on The GitHub Blog .

  15. Claude Code Releases86

    Claude Code Releases v2.1.268:Added to the Claude apps gateway: with pricing: set in gat...

    事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、评测与基准,原文信息显示:Claude Code Releases v2.1.268:Added to the Claude apps gateway: with pricing: set in gat... 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、评测与基准,原文信息显示:Claude 。影响判断:它可能改变智能体工作流、模型能力与工程、评测与基准相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、评测与基准方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程、评测与基准直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  16. GitHub Changelog92

    MAI-Code-1-Flash deprecated

    事实摘要:MAI-Code-1-Flash deprecated 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:MAI-Code-1-Flash deprecated 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:MAI-Code-1-Flash deprecated 事实摘要:这条英文动态主。影响判断:它可能改变智能体工作流、模型能力与工程、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程、开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  17. OpenAI News80

    How a researcher uses Codex and ChatGPT to search for new antimicrobial molecules

    事实摘要:这条英文动态主要涉及AI 应用价值,原文信息显示:How a researcher uses Codex and ChatGPT to search for new antimicrobial molecules 事实摘要:这条英文动态主要涉及AI 应用价值,原文信息显示:How a researcher uses Codex and ChatGPT to 。影响判断:它可能改变AI 应用价值相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪AI 应用价值方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和AI 应用价值直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

9月10日周四
  1. GitHub Changelog53

    Xcode 27 runner image now runs on macOS 27

    事实摘要:这条英文动态主要涉及开源生态,原文信息显示:Xcode 27 runner image now runs on macOS 27 事实摘要:这条英文动态主要涉及开源生态,原文信息显示:Xcode 27 runner image now runs on macOS 27 事实摘要:这条英文动态主要涉及开源生态,原文信息显示:Xcode 27 runner im。影响判断:它可能改变开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  2. IT之家 AI68

    DeepSeek V4.1 Flash 模型上线国家超算互联网

    IT之家 9 月 10 日消息,DeepSeek V4.1 Flash 模型今日上线国家 超算互联网中心。用户可登录国家超算互联网官网, 从首页进入「模型服务」页面,即可快速打开 DeepSeek V4.1 Flash 模型 API 调用界面。 据IT之家了解,DeepSeek V4.1 Flash 为 552B 参数的 MoE 模型,采用了全新的 Causal-Encoder-Decoder 结构,输入和输出不对称,输入激活只有 8B,输出激活 16B,成本显著低于已知的同尺寸模型。 同时,V4.1 Flash 还采用了新的预训练方式、经过了更大规模的强化学习后训练,在基准测试中,成功超越了包括 DeepSeek V4 Pro 在内的一众旗舰模型的智能水平。 此外,DeepSeek V4.1 Flash 大幅减少了 KV Cache 缓存的大小,与上一代模型相比,对 HBM 的需求减少到 1/4,对 SSD 的需求减少到 1/...

    推荐理由:来自IT之家 AI的《DeepSeek V4.1 Flash 模型上线国家超算互联网》。重点看模型能力与工程、评测与基准、产品发布。摘要提到:IT之家 9 月 10 日消息,DeepSeek V4.1 Flash 模型今日上线国家 超算互联网中心。用户可登录国家超算互联网官网, 从首页进入「模型服务」页面,即可快速打开 DeepSeek V4.1 Flash 模型 API 调用界面。 据IT之家了解,DeepSeek V4.1 Flash 为 552B 参数的 MoE 模型,采用了全新的 Causal-Encoder-Decoder 结构,输入和输出不对称,输入激活只有 8B,输出激活 16B,成本显著低于已知的同尺寸模型。 同时,V4.1 Flash 还采用了新的预训练方式、经过了更大规模的强化学习后训练,在基准测试中,成功超越了包括 DeepSeek V4 Pro 在内的一众旗舰模型的智能水平。 此外,DeepSeek V4.1 Flash 大幅减少了 KV Cache 缓存的大小,与上一代模型相比,对 HBM 的需求减少到 1/4,对 SSD 的需求减少到 1/...

  3. IT之家 AI66

    开发者用 Claude 一小时复刻 Win3.1 程序管理器,可在 Win11 和 macOS 上运行

    IT之家 9 月 10 日消息,如果你想在 Windows 11 或 macOS 设备上快速回味一把复古 Windows 体验,这款主打氛围感还原的 Windows 3.1 程序管理器复刻版或许会合你心意。 开发者 Mayuki 推出了一个精巧的怀旧小项目 ReProgman—— 名字源自早年 Windows 3.1 的核心系统外壳程序“ progman.exe ”,三十年前 Windows 95 问世后,这款程序管理器就彻底退出了历史舞台。 ReProgman 的还原度相当高,在发布 ReProgman 的社交动态里,Mayuki 写道:“我让 Claude 做了一个 Windows 3.1 程序管理器的复刻版”,“我觉得你大概能对着它怀旧个 30 秒吧。” Claude Code 生成这款 Windows 3.1 外壳复刻版的速度相当快。仅用约一小时就产出的初版“效果已经不错”,但还需要花些功夫打磨细节、修复问题。而 May...

    推荐理由:来自IT之家 AI的《开发者用 Claude 一小时复刻 Win3.1 程序管理器,可在 Win11 和 macOS 上运行》。重点看产品发布。摘要提到:IT之家 9 月 10 日消息,如果你想在 Windows 11 或 macOS 设备上快速回味一把复古 Windows 体验,这款主打氛围感还原的 Windows 3.1 程序管理器复刻版或许会合你心意。 开发者 Mayuki 推出了一个精巧的怀旧小项目 ReProgman—— 名字源自早年 Windows 3.1 的核心系统外壳程序“ progman.exe ”,三十年前 Windows 95 问世后,这款程序管理器就彻底退出了历史舞台。 ReProgman 的还原度相当高,在发布 ReProgman 的社交动态里,Mayuki 写道:“我让 Claude 做了一个 Windows 3.1 程序管理器的复刻版”,“我觉得你大概能对着它怀旧个 30 秒吧。” Claude Code 生成这款 Windows 3.1 外壳复刻版的速度相当快。仅用约一小时就产出的初版“效果已经不错”,但还需要花些功夫打磨细节、修复问题。而 May...

  4. IT之家 AI72

    支持前实习生创业项目:消息称阿里拟领投 AI 评测公司 UniPat 的 3 亿美元融资

    IT之家 9 月 10 日消息,据彭博社今天(10 日)上午报道,阿里巴巴集团拟领投 AI 训练与基准测试初创公司 UniPat AI 的一轮 3 亿美元 (IT之家注:现汇率约合 20.18 亿元人民币) 融资,本轮估值达 25 亿美元 (现汇率约合 168.14 亿元人民币) 。这笔投资也是阿里巴巴对一名前实习生创业的认可。 知情人士透露,融资预计很快完成,腾讯控股及红杉等老股东也参与投资。各方仍在磋商,交易细节可能发生变化。 UniPat 由 去年在通义 AI 实验室从事后训练分析、数据合成和强化学习工作 的李宽创办,为 AI 模型设计贴近真实使用环境的测试与评估场景。该公司专门生成细致的训练和评测数据,计划向 AI 领域的其他研究人员及企业出售。 这笔融资说明,为了获得高质量数据、了解 AI 系统的表现,巨头是愿意支付高价的。 UniPat 成立于 2025 年末,提供的基准测试涵盖 AI 编程智能体的软件工程能力、浏览...

    推荐理由:来自IT之家 AI的《支持前实习生创业项目:消息称阿里拟领投 AI 评测公司 UniPat 的 3 亿美元融资》。重点看智能体工作流、模型能力与工程、评测与基准。摘要提到:IT之家 9 月 10 日消息,据彭博社今天(10 日)上午报道,阿里巴巴集团拟领投 AI 训练与基准测试初创公司 UniPat AI 的一轮 3 亿美元 (IT之家注:现汇率约合 20.18 亿元人民币) 融资,本轮估值达 25 亿美元 (现汇率约合 168.14 亿元人民币) 。这笔投资也是阿里巴巴对一名前实习生创业的认可。 知情人士透露,融资预计很快完成,腾讯控股及红杉等老股东也参与投资。各方仍在磋商,交易细节可能发生变化。 UniPat 由 去年在通义 AI 实验室从事后训练分析、数据合成和强化学习工作 的李宽创办,为 AI 模型设计贴近真实使用环境的测试与评估场景。该公司专门生成细致的训练和评测数据,计划向 AI 领域的其他研究人员及企业出售。 这笔融资说明,为了获得高质量数据、了解 AI 系统的表现,巨头是愿意支付高价的。 UniPat 成立于 2025 年末,提供的基准测试涵盖 AI 编程智能体的软件工程能力、浏览...

  5. IT之家 AI74

    DeepSeek V4.1 Flash 模型正式发布:全面超越 V4 Pro、原生多模态视觉理解,API 定价下调

    IT之家 9 月 10 日消息,深度求索今日正式发布 DeepSeek V4.1 Flash 模型 。这是其全新模型结构系列中的最小尺寸的模型,具备原生多模态视觉理解能力。 新模型结构的设计初衷是:能力上限更高、推理速度更快、吞吐更大、可扩展到更大参数模型。 DeepSeek V4.1 Flash 为 552B 参数的 MoE 模型 ,采用了全新的 Causal-Encoder-Decoder 结构,输入和输出不对称,输入激活只有 8B,输出激活 16B,成本显著低于已知的同尺寸模型。同时,V4.1 Flash 还采用了新的预训练方式、经过了更大规模的强化学习后训练,在基准测试中,成功超越了包括 DeepSeek V4 Pro 在内的一众旗舰模型的智能水平。 ▲ DeepSeek-V4.1-Flash 与主流前沿模型在 Agentic Benchmark 上的性能对比 此外,新一代模型大幅减少了 KV Cache 缓存的大小,与...

    推荐理由:来自IT之家 AI的《DeepSeek V4.1 Flash 模型正式发布:全面超越 V4 Pro、原生多模态视觉理解,API 定价下调》。重点看智能体工作流、模型能力与工程、评测与基准。摘要提到:IT之家 9 月 10 日消息,深度求索今日正式发布 DeepSeek V4.1 Flash 模型 。这是其全新模型结构系列中的最小尺寸的模型,具备原生多模态视觉理解能力。 新模型结构的设计初衷是:能力上限更高、推理速度更快、吞吐更大、可扩展到更大参数模型。 DeepSeek V4.1 Flash 为 552B 参数的 MoE 模型 ,采用了全新的 Causal-Encoder-Decoder 结构,输入和输出不对称,输入激活只有 8B,输出激活 16B,成本显著低于已知的同尺寸模型。同时,V4.1 Flash 还采用了新的预训练方式、经过了更大规模的强化学习后训练,在基准测试中,成功超越了包括 DeepSeek V4 Pro 在内的一众旗舰模型的智能水平。 ▲ DeepSeek-V4.1-Flash 与主流前沿模型在 Agentic Benchmark 上的性能对比 此外,新一代模型大幅减少了 KV Cache 缓存的大小,与...

  6. IT之家 AI34

    英伟达 CUDA Toolkit 13.4 首次原生支持 Windows on Arm64,铺路 RTX Spark

    IT之家 9 月 10 日消息,英伟达昨日(9 月 9 日)发布 CUDA Toolkit 13.4 工具包, 首次为 Windows on Arm64 平台提供原生开发包支持。 这是 CUDA 历史上第一次将 Arm 平台支持从 Linux 扩展至 Windows on Arm,开发者现在可以直接在 Windows Arm64 系统上编译 CUDA 应用程序,也可使用 Windows x86-64 版本的工具包进行交叉编译。 CUDA Toolkit 是英伟达推出的 GPU 编程开发工具包,包含编译器、库和工具,让开发者能编写在 NVIDIA GPU 上加速运行的程序。 最新 CUDA Toolkit 13.4 版本以预览版形式,为 NVIDIA Rubin 架构(计算能力 107)提供功能性支持,在正式版发布前,让开发者和关键软件库维护者能够提前移植、开发与验证应用。 IT之家注:计算能力 107 对应计算能力版本 10.7...

    推荐理由:来自IT之家 AI的《英伟达 CUDA Toolkit 13.4 首次原生支持 Windows on Arm64,铺路 RTX Spark》。重点看产品发布。摘要提到:IT之家 9 月 10 日消息,英伟达昨日(9 月 9 日)发布 CUDA Toolkit 13.4 工具包, 首次为 Windows on Arm64 平台提供原生开发包支持。 这是 CUDA 历史上第一次将 Arm 平台支持从 Linux 扩展至 Windows on Arm,开发者现在可以直接在 Windows Arm64 系统上编译 CUDA 应用程序,也可使用 Windows x86-64 版本的工具包进行交叉编译。 CUDA Toolkit 是英伟达推出的 GPU 编程开发工具包,包含编译器、库和工具,让开发者能编写在 NVIDIA GPU 上加速运行的程序。 最新 CUDA Toolkit 13.4 版本以预览版形式,为 NVIDIA Rubin 架构(计算能力 107)提供功能性支持,在正式版发布前,让开发者和关键软件库维护者能够提前移植、开发与验证应用。 IT之家注:计算能力 107 对应计算能力版本 10.7...

  7. OpenAI News75

    Introducing the Agents API

    这条英文动态主要涉及智能体工作流、产品发布。原文要点:Build and launch cloud agents with the Agents API, a managed service powered by the Codex harness for orchestration, long-running sessions, and tool use.

    推荐理由:来自OpenAI News的《Introducing the Agents API》。重点看智能体工作流、产品发布。摘要提到:这条英文动态主要涉及智能体工作流、产品发布。原文要点:Build and launch cloud agents with the Agents API, a managed service powered by the Codex harness for orchestration, long-running sessions, and tool use.

  8. Claude Code Releases86

    Claude Code Releases v2.1.267:Added maxEffortLevel setting (top-level or per model under...

    事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:Claude Code Releases v2.1.267:Added maxEffortLevel setting (top-level or per model under... 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:Claude Co。影响判断:它可能改变智能体工作流、模型能力与工程、文化创意相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、文化创意方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程、文化创意直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

9月9日周三
  1. GitHub Changelog85

    Remediate Code Quality findings with agentic autofix

    事实摘要:这条英文动态主要涉及智能体工作流、开源生态,原文信息显示:Remediate Code Quality findings with agentic autofix 事实摘要:这条英文动态主要涉及智能体工作流、开源生态,原文信息显示:Remediate Code Quality findings with agentic autofix 事实摘要:这条英文动态。影响判断:它可能改变智能体工作流、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  2. IT之家 AI66

    AI 编程推动插件提交量增长,微软更新 Edge 浏览器加载项商店机制为审核“减负”

    IT之家 9 月 9 日消息,据外媒 Neowin 今天(9 日)报道,微软更新了 Edge 加载项商店的扩展提交流程,引入自动化验证检查,以缩短开发者提交 Edge 扩展后的审核时间。微软还调整了“精选”徽章机制,改为每 15 天自动刷新一次, 让优质扩展能够更快获得认可 。 微软去年曾加快扩展审核,但此后 提交量持续增长 ,因此再次调整审核机制。 AI 辅助编程和氛围编程降低了扩展开发门槛,让更多人能够 在短时间内制作并提交扩展 ,也使 Edge 加载项商店收到的申请数量明显增加。 微软希望通过新的审核机制,缩短漏洞修复和新功能上线所需的等待时间,同时维持原有安全标准。为了帮助用户筛选优质加载项,“精选”徽章将 每 15 天自动重新评估一次 ,评估依据包括 60 项质量指标。 微软表示,AI 推动扩展提交量增加, 给原有审核流程带来了更大压力 :“去年,我们为高质量、高价值扩展推出了加速审核流程。此后,扩展提交量持续增加,审...

    推荐理由:来自IT之家 AI的《AI 编程推动插件提交量增长,微软更新 Edge 浏览器加载项商店机制为审核“减负”》。重点看产品发布。摘要提到:IT之家 9 月 9 日消息,据外媒 Neowin 今天(9 日)报道,微软更新了 Edge 加载项商店的扩展提交流程,引入自动化验证检查,以缩短开发者提交 Edge 扩展后的审核时间。微软还调整了“精选”徽章机制,改为每 15 天自动刷新一次, 让优质扩展能够更快获得认可 。 微软去年曾加快扩展审核,但此后 提交量持续增长 ,因此再次调整审核机制。 AI 辅助编程和氛围编程降低了扩展开发门槛,让更多人能够 在短时间内制作并提交扩展 ,也使 Edge 加载项商店收到的申请数量明显增加。 微软希望通过新的审核机制,缩短漏洞修复和新功能上线所需的等待时间,同时维持原有安全标准。为了帮助用户筛选优质加载项,“精选”徽章将 每 15 天自动重新评估一次 ,评估依据包括 60 项质量指标。 微软表示,AI 推动扩展提交量增加, 给原有审核流程带来了更大压力 :“去年,我们为高质量、高价值扩展推出了加速审核流程。此后,扩展提交量持续增加,审...

  3. IT之家 AI74

    AI 攻克数学难题,纽约大学教授质疑 OpenAI“截胡”其研究成果

    IT之家 9 月 9 日消息,纽约大学数学教授 Tristan Buckmaster 当地时间周二宣布了三项证明成果,其中一项为理论数学领域最重要的未解问题之一取得了初步进展。这些成果由 Buckmaster 与 Anthropic 数学家 Levent Alpöge 合作完成,并同时使用了 Codex 和 Claude AI 模型。相关研究成果本身就具有重要意义,但围绕 OpenAI 试图解决同一问题的行动,还出现了一场不同寻常的争议。 “这个故事还有另一部分,”Buckmaster 在宣布证明成果的声明中写道,“坦率地说,这是我非常希望自己不必面对的问题。”根据他的声明,OpenAI 的一项并行研究在相关成果公开之前就建立在他们的工作之上,由此引发了一系列学术竞争以及相互矛盾的说法。 Buckmaster 发布声明后不久,OpenAI 公布了纳维-斯托克斯存在性与光滑性问题的完整证明,而 Buckmaster 的研究成果已为...

    推荐理由:来自IT之家 AI的《AI 攻克数学难题,纽约大学教授质疑 OpenAI“截胡”其研究成果》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 9 日消息,纽约大学数学教授 Tristan Buckmaster 当地时间周二宣布了三项证明成果,其中一项为理论数学领域最重要的未解问题之一取得了初步进展。这些成果由 Buckmaster 与 Anthropic 数学家 Levent Alpöge 合作完成,并同时使用了 Codex 和 Claude AI 模型。相关研究成果本身就具有重要意义,但围绕 OpenAI 试图解决同一问题的行动,还出现了一场不同寻常的争议。 “这个故事还有另一部分,”Buckmaster 在宣布证明成果的声明中写道,“坦率地说,这是我非常希望自己不必面对的问题。”根据他的声明,OpenAI 的一项并行研究在相关成果公开之前就建立在他们的工作之上,由此引发了一系列学术竞争以及相互矛盾的说法。 Buckmaster 发布声明后不久,OpenAI 公布了纳维-斯托克斯存在性与光滑性问题的完整证明,而 Buckmaster 的研究成果已为...

  4. 爱范儿70

    首个走进联合国的中国教育 Agent,正在打开下一个 Token 入口

    Coding 之后,教育 Agent 正在成为下一场 Token 战争 #欢迎关注爱范儿官方微信公众号:爱范儿(微信号:ifanr),更多精彩内容第一时间为您奉上。 这条动态来自 爱范儿,可重点关注智能体工作流、教育应用。

    推荐理由:来自爱范儿的《首个走进联合国的中国教育 Agent,正在打开下一个 Token 入口》。重点看智能体工作流、教育应用。摘要提到:Coding 之后,教育 Agent 正在成为下一场 Token 战争 #欢迎关注爱范儿官方微信公众号:爱范儿(微信号:ifanr),更多精彩内容第一时间为您奉上。 这条动态来自 爱范儿,可重点关注智能体工作流、教育应用。

  5. IT之家 AI80

    面壁智能开源 MiniCPM5-2B AI 模型:AA 榜单全球 4B 以下第一,初具端侧通用 Agent 能力

    IT之家 9 月 9 日消息,面壁智能昨日联合 OpenBMB 开源社区正式开源新一代“小钢炮” MiniCPM5-2B 。 MiniCPM5-2B 的参数规模为 2B,是一款高密度端侧语言基座模型,支持工具调用、深度搜索、代码生成等任务,官方称 初步实现了 端侧通用 Agent 雏形 。 根据榜单 Artificial Analysis Intelligence Index(以下简称「AA 榜单」)的最新评测,MiniCPM5-2B 综合能力得分 23 分, 在全球 4B 参数规模以下的开源基座模型中综合表现第一 。 官方表示,在评测智能体能力的 Agentic Index 指标上,MiniCPM5-2B 更是断层式领先:总分达 20 分,同级模型(如 LFM2.5-2.6B、Granite 4.2 3B、Mistral 3 3B)仅 2 分。 MiniCPM5-2B 在覆盖代码推理、数学推理、指令遵循、综合知识、长文本、工具...

    推荐理由:来自IT之家 AI的《面壁智能开源 MiniCPM5-2B AI 模型:AA 榜单全球 4B 以下第一,初具端侧通用 Agent 能力》。重点看智能体工作流、模型能力与工程、评测与基准。摘要提到:IT之家 9 月 9 日消息,面壁智能昨日联合 OpenBMB 开源社区正式开源新一代“小钢炮” MiniCPM5-2B 。 MiniCPM5-2B 的参数规模为 2B,是一款高密度端侧语言基座模型,支持工具调用、深度搜索、代码生成等任务,官方称 初步实现了 端侧通用 Agent 雏形 。 根据榜单 Artificial Analysis Intelligence Index(以下简称「AA 榜单」)的最新评测,MiniCPM5-2B 综合能力得分 23 分, 在全球 4B 参数规模以下的开源基座模型中综合表现第一 。 官方表示,在评测智能体能力的 Agentic Index 指标上,MiniCPM5-2B 更是断层式领先:总分达 20 分,同级模型(如 LFM2.5-2.6B、Granite 4.2 3B、Mistral 3 3B)仅 2 分。 MiniCPM5-2B 在覆盖代码推理、数学推理、指令遵循、综合知识、长文本、工具...

  6. IT之家 AI70

    OpenAI 韩国负责人:与三星电子的下一代芯片合作取得良好进展

    IT之家 9 月 9 日消息,OpenAI 韩国负责人 Kim Kyoung-hoon (Harrison Kim) 在该企业韩国首尔区域办事处成立一周年新闻发布会上表示, OpenAI 与三星电子的下一代芯片合作取得良好进展 。三星电子在一份声明中表示无法确认与客户相关的信息。 Kim Kyoung-hoon 在发布会上提到,OpenAI 将继续与韩国半导体供应链企业建立合作,先进芯片对加速人工智能处理非常重要。OpenAI 还计划在韩国建设 AI 推理基础设施,以规避数据跨境流动潜藏的监管风险。 数据显示,韩国 ChatGPT Enterprise 用户数量较一年前增长了 28 倍,ChatGPT Work / Codex 用户规模近半年增长了 14 倍,ChatGPT 周活用户数量也增长了 35%。 OpenAI 韩国近期组建了专门的广告团队,旨在为韩国本土广告主和代理商提供更全面的支持。 相关阅读: 《 消息称三星电子联...

    推荐理由:来自IT之家 AI的《OpenAI 韩国负责人:与三星电子的下一代芯片合作取得良好进展》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 9 日消息,OpenAI 韩国负责人 Kim Kyoung-hoon (Harrison Kim) 在该企业韩国首尔区域办事处成立一周年新闻发布会上表示, OpenAI 与三星电子的下一代芯片合作取得良好进展 。三星电子在一份声明中表示无法确认与客户相关的信息。 Kim Kyoung-hoon 在发布会上提到,OpenAI 将继续与韩国半导体供应链企业建立合作,先进芯片对加速人工智能处理非常重要。OpenAI 还计划在韩国建设 AI 推理基础设施,以规避数据跨境流动潜藏的监管风险。 数据显示,韩国 ChatGPT Enterprise 用户数量较一年前增长了 28 倍,ChatGPT Work / Codex 用户规模近半年增长了 14 倍,ChatGPT 周活用户数量也增长了 35%。 OpenAI 韩国近期组建了专门的广告团队,旨在为韩国本土广告主和代理商提供更全面的支持。 相关阅读: 《 消息称三星电子联...

  7. IT之家 AI76

    蚂蚁百灵系列首个原生多模态模型 Ling-3.0-flash-VL 发布开源,引入视觉反馈闭环机制

    IT之家 9 月 9 日消息,蚂蚁集团今日宣布推出并开源百灵系列首个原生多模态大模型 Ling-3.0-flash-VL。 该模型基于 Ling-3.0-flash 的 MoE(混合专家)架构拓展,总参数量为 124B,单次推理激活 5.5B 参数,原生支持图像、文本与视频输入,上下文窗口达到 256K Token。 模型围绕“更可靠、更高效完成真实任务”的方向,引入了视觉反馈闭环机制。不同于一次性的“看图生成”,该机制将任务推进为“观察 → 行动 → 验证 → 修正”的持续闭环,使模型在医疗报告解读、前端代码生成及 GUI 自动化等场景中能够基于视觉反馈持续修正执行结果。 在训练层面,蚂蚁集团表示,通过原生多模态联合训练,视觉信息的引入对模型的文本能力带来了正向提升。在 Artificial Analysis Intelligence Index v4.1.1 评估中,Ling-3.0-flash-VL 较纯文本版本(Ling...

    推荐理由:来自IT之家 AI的《蚂蚁百灵系列首个原生多模态模型 Ling-3.0-flash-VL 发布开源,引入视觉反馈闭环机制》。重点看模型能力与工程、文化创意、开源生态。摘要提到:IT之家 9 月 9 日消息,蚂蚁集团今日宣布推出并开源百灵系列首个原生多模态大模型 Ling-3.0-flash-VL。 该模型基于 Ling-3.0-flash 的 MoE(混合专家)架构拓展,总参数量为 124B,单次推理激活 5.5B 参数,原生支持图像、文本与视频输入,上下文窗口达到 256K Token。 模型围绕“更可靠、更高效完成真实任务”的方向,引入了视觉反馈闭环机制。不同于一次性的“看图生成”,该机制将任务推进为“观察 → 行动 → 验证 → 修正”的持续闭环,使模型在医疗报告解读、前端代码生成及 GUI 自动化等场景中能够基于视觉反馈持续修正执行结果。 在训练层面,蚂蚁集团表示,通过原生多模态联合训练,视觉信息的引入对模型的文本能力带来了正向提升。在 Artificial Analysis Intelligence Index v4.1.1 评估中,Ling-3.0-flash-VL 较纯文本版本(Ling...

  8. Claude Code Releases88

    Claude Code Releases v2.1.266:Fixed a 2.1.265 regression affecting LLM-gateway and proxy...

    事实摘要:这条英文动态主要涉及模型能力与工程,原文信息显示:Claude Code Releases v2.1.266:Fixed a 2.1.265 regression affecting LLM-gateway and proxy... 事实摘要:这条英文动态主要涉及模型能力与工程,原文信息显示:Claude Code Releases v2.1.266:Fix。影响判断:它可能改变模型能力与工程相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和模型能力与工程直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  9. IT之家 AI70

    Claude 额度离奇消失,Anthropic 确认账号被黑客盗用

    9 月 9 日,据 TechCrunch 报道,多名 Claude 用户近期发现,自己在没有使用服务的情况下,账号额度仍在快速消耗。Anthropic 调查后称,黑客利用窃取的 Claude 登录会话访问用户账号,并消耗其使用额度。 8 月 4 日,英国东萨塞克斯郡独立 AI 顾问格兰特 · 德斯沃特发现,他的 Claude Max 20x 账号出现异常。当天他并未工作,账号用量却持续上升。 第二天,德斯沃特停用了所有与 Claude 连接的工具,并暂停了定时任务和云端执行功能,但用量仍从 45% 升至 55%。他表示,当时本地也没有正在运行的 Claude Code 任务。 德斯沃特随后联系 Anthropic,要求对方提供详细的使用记录。Anthropic 没有给出逐项明细,但承认账号存在异常,并暂停其付费账户,注销全部登录会话和服务器端 Claude Code 令牌,同时退还其订阅剩余时间对应的 44.49 英镑费用。Cl...

    推荐理由:来自IT之家 AI的《Claude 额度离奇消失,Anthropic 确认账号被黑客盗用》。重点看编码。摘要提到:9 月 9 日,据 TechCrunch 报道,多名 Claude 用户近期发现,自己在没有使用服务的情况下,账号额度仍在快速消耗。Anthropic 调查后称,黑客利用窃取的 Claude 登录会话访问用户账号,并消耗其使用额度。 8 月 4 日,英国东萨塞克斯郡独立 AI 顾问格兰特 · 德斯沃特发现,他的 Claude Max 20x 账号出现异常。当天他并未工作,账号用量却持续上升。 第二天,德斯沃特停用了所有与 Claude 连接的工具,并暂停了定时任务和云端执行功能,但用量仍从 45% 升至 55%。他表示,当时本地也没有正在运行的 Claude Code 任务。 德斯沃特随后联系 Anthropic,要求对方提供详细的使用记录。Anthropic 没有给出逐项明细,但承认账号存在异常,并暂停其付费账户,注销全部登录会话和服务器端 Claude Code 令牌,同时退还其订阅剩余时间对应的 44.49 英镑费用。Cl...

  10. IT之家 AI36

    微软 Win11 自动深浅色模式已在路上:可按当地日出 / 日落时间或自定义时间触发

    IT之家 9 月 9 日消息,Windows 爱好者 PhantomOfEarth 发现,微软正在为 Windows 11 开发一项用户期待已久的功能 —— 自动深色模式定时切换。相关代码已经出现在 Experimental 实验预览版中。 根据其发现的多个字符串,该功能被命名为“Schedule auto mode”。微软将提供两种触发方式:一种是基于地理位置计算出当地的日出和日落时间进行自动切换;另一种是允许用户设置一个固定的时间,例如在夜间特定时段开启深色模式。 此外,相关代码还暗示了一个贴心的设计:为避免打断用户工作,Win11 只会在电脑“空闲”时进行主题切换。这意味着当用户正在打字、观看视频或进行演示时,屏幕不会突然切换主题。 目前,Windows 11 虽然允许用户在设置中手动选择浅色或深色模式,但一直缺乏原生的自动切换功能。用户若想实现这一效果,通常需要借助第三方脚本或 PowerToys 等工具。此次在预览版中...

    推荐理由:来自IT之家 AI的《微软 Win11 自动深浅色模式已在路上:可按当地日出 / 日落时间或自定义时间触发》。重点看文化创意。摘要提到:IT之家 9 月 9 日消息,Windows 爱好者 PhantomOfEarth 发现,微软正在为 Windows 11 开发一项用户期待已久的功能 —— 自动深色模式定时切换。相关代码已经出现在 Experimental 实验预览版中。 根据其发现的多个字符串,该功能被命名为“Schedule auto mode”。微软将提供两种触发方式:一种是基于地理位置计算出当地的日出和日落时间进行自动切换;另一种是允许用户设置一个固定的时间,例如在夜间特定时段开启深色模式。 此外,相关代码还暗示了一个贴心的设计:为避免打断用户工作,Win11 只会在电脑“空闲”时进行主题切换。这意味着当用户正在打字、观看视频或进行演示时,屏幕不会突然切换主题。 目前,Windows 11 虽然允许用户在设置中手动选择浅色或深色模式,但一直缺乏原生的自动切换功能。用户若想实现这一效果,通常需要借助第三方脚本或 PowerToys 等工具。此次在预览版中...

  11. Claude Code Releases82

    Claude Code Releases v2.1.265:Added user.email and user.groups to the telemetry Claude D...

    事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:Claude Code Releases v2.1.265:Added user.email and user.groups to the telemetry Claude D... 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:Claude Co。影响判断:它可能改变智能体工作流、模型能力与工程、文化创意相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、文化创意方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程、文化创意直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  12. OpenAI News79

    How GPT-5.6 Sol helps run quantum computing experiments

    这条英文动态讨论了 AI 领域的新进展。原文要点:See how an MIT researcher uses GPT-5.6 Sol with Codex to autonomously run quantum computing experiments, analyze results, and calibrate qubits.

    推荐理由:来自OpenAI News的《How GPT-5.6 Sol helps run quantum computing experiments》。重点看编码、论文/研究。摘要提到:这条英文动态讨论了 AI 领域的新进展。原文要点:See how an MIT researcher uses GPT-5.6 Sol with Codex to autonomously run quantum computing experiments, analyze results, and calibrate qubits.

9月8日周二
  1. IT之家 AI70

    达芬奇 DaVinci Resolve 21.1 发布,接入 Claude Code、ChatGPT Codex 等 AI 助手

    IT之家 9 月 8 日消息,Blackmagic Design 今天发布视频剪辑软件 DaVinci Resolve 21.1,接入多个人工智能助手。 据介绍, 本次更新将支持 Claude、Claude Code 和 ChatGPT Codex 等 AI 助手 ,使用户能够使用自然语言分析项目、整理媒体、调整设置和批量渲染。用户可要求 AI 助手从长视频中剪辑精彩片段、删除不需要的片段或渲染最终视频,减少重复劳动,将时间投入到创意构思中。 IT之家注意到,达芬奇的照片页面现已支持富士 GFX 和 X 系列、徕卡 SL 以及索尼 α7R VI 等相机,摄影师可直接导入照片,无需转换格式。本次更新还改进了改进多机位工作流程,并加入全新图形工具等。

    推荐理由:来自IT之家 AI的《达芬奇 DaVinci Resolve 21.1 发布,接入 Claude Code、ChatGPT Codex 等 AI 助手》。重点看智能体工作流、文化创意、产品发布。摘要提到:IT之家 9 月 8 日消息,Blackmagic Design 今天发布视频剪辑软件 DaVinci Resolve 21.1,接入多个人工智能助手。 据介绍, 本次更新将支持 Claude、Claude Code 和 ChatGPT Codex 等 AI 助手 ,使用户能够使用自然语言分析项目、整理媒体、调整设置和批量渲染。用户可要求 AI 助手从长视频中剪辑精彩片段、删除不需要的片段或渲染最终视频,减少重复劳动,将时间投入到创意构思中。 IT之家注意到,达芬奇的照片页面现已支持富士 GFX 和 X 系列、徕卡 SL 以及索尼 α7R VI 等相机,摄影师可直接导入照片,无需转换格式。本次更新还改进了改进多机位工作流程,并加入全新图形工具等。

  2. IT之家 AI72

    微信 WeMM-Embedding 多模态模型已在微信大规模使用:覆盖朋友圈搜索等,每天调用量 10 亿次

    IT之家 9 月 8 日消息,微信 AI 官方在 9 月 4 日宣布, 将通用多模态嵌入模型 WeMM-Embedding 开源 ,包含 2B、4B、9B 三个版本,支持文本、图像、视频、视觉文档以及任意交错的多模态输入。 据微信员工 @客村小蒋 分享,微信视觉团队最近开源的多模态模型 WeMM-Embedding 简单说就是让系统能同时理解文字、图片和视频,把它们放在同一个语义空间里去比较和检索。 他透露, 这个模型已经在微信里大规模用了 —— 朋友圈搜索、视频号推荐、公众号推荐、微信电商都在用 ,每天调用量 10 亿次。 在国际权威榜单 MMEB-v2 上拿了第一 ,超过此前所有已提交的开源与闭源模型。 IT之家附相关链接: 论文链接: https://arxiv.org/abs/2608.24053 代码仓库: https://github.com/Tencent/WeMM-Embedding 模型集合: https://...

    推荐理由:来自IT之家 AI的《微信 WeMM-Embedding 多模态模型已在微信大规模使用:覆盖朋友圈搜索等,每天调用量 10 亿次》。重点看模型能力与工程、开源生态。摘要提到:IT之家 9 月 8 日消息,微信 AI 官方在 9 月 4 日宣布, 将通用多模态嵌入模型 WeMM-Embedding 开源 ,包含 2B、4B、9B 三个版本,支持文本、图像、视频、视觉文档以及任意交错的多模态输入。 据微信员工 @客村小蒋 分享,微信视觉团队最近开源的多模态模型 WeMM-Embedding 简单说就是让系统能同时理解文字、图片和视频,把它们放在同一个语义空间里去比较和检索。 他透露, 这个模型已经在微信里大规模用了 —— 朋友圈搜索、视频号推荐、公众号推荐、微信电商都在用 ,每天调用量 10 亿次。 在国际权威榜单 MMEB-v2 上拿了第一 ,超过此前所有已提交的开源与闭源模型。 IT之家附相关链接: 论文链接: https://arxiv.org/abs/2608.24053 代码仓库: https://github.com/Tencent/WeMM-Embedding 模型集合: https://...

  3. IT之家 AI64

    苹果 Apple Watch Series 12 爆料:升级 128GB 存储、拓展力量训练等

    IT之家 9 月 8 日消息,网友 pdfu 昨日(9 月 7 日)在 MacRumors 论坛发帖,通过挖掘 watchOS 27 Beta 8 更新,发现了关于 Apple Watch Series 12 智能手表的更多线索, 并预估苹果公司会带来 4 项升级。 硬件方面,基于 watchOS 27 Beta 8 代码信息,在关联 T8320 芯片的 NAND 存储配置文件中, 显示 Apple Watch Series 12 和 Apple Watch Ultra 4 可能会提供 128GB 的存储空间。 IT之家附上历年 Apple Watch 存储空间如下: 型号 发布年份 存储容量 备注 Apple Watch(初代) 2015 8 GB 所有版本统一 8 GB Apple Watch Series 1 2016 8 GB 与初代相同 Apple Watch Series 2 2016 8 GB 所有版本统一 8 G...

    推荐理由:来自IT之家 AI的《苹果 Apple Watch Series 12 爆料:升级 128GB 存储、拓展力量训练等》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 8 日消息,网友 pdfu 昨日(9 月 7 日)在 MacRumors 论坛发帖,通过挖掘 watchOS 27 Beta 8 更新,发现了关于 Apple Watch Series 12 智能手表的更多线索, 并预估苹果公司会带来 4 项升级。 硬件方面,基于 watchOS 27 Beta 8 代码信息,在关联 T8320 芯片的 NAND 存储配置文件中, 显示 Apple Watch Series 12 和 Apple Watch Ultra 4 可能会提供 128GB 的存储空间。 IT之家附上历年 Apple Watch 存储空间如下: 型号 发布年份 存储容量 备注 Apple Watch(初代) 2015 8 GB 所有版本统一 8 GB Apple Watch Series 1 2016 8 GB 与初代相同 Apple Watch Series 2 2016 8 GB 所有版本统一 8 G...