跳到正文
今天10月5日周一3 条
  1. IT之家 AI70

    Linux 7.3-rc6 发布:Torvalds 称进入“AI 新常态”,稳定版预计 10 月中旬发布

    IT之家 10 月 5 日消息,Linus Torvalds 于当地时间 10 月 4 日发布了 Linux 7.3-rc6 测试版。相比前一周较为特殊的代码变更统计,本周整体恢复正常,驱动修复重新占据大头。 不过,Torvalds 也特别提到,随着 AI 和大语言模型(LLM)的参与,这种“AI 新常态”已经成为当前 Linux 内核开发周期的一部分。 Torvalds 表示,本周没有出现异常情况,代码变更统计已经回到“约一半来自驱动修复”的常见状态。驱动侧涉及 GPU、网络、USB、TTY、IIO、音频等多个子系统,整体呈现出较为分散的修复特征。 他同时指出,本次提交数量也处于正常范围,只不过这是新的“AI normal”—— 大量小型错误路径处理修复正在进入内核代码树。此前几个 Linux 7.3 测试版本同样出现了较多由 AI / LLM 发现问题或辅助生成的补丁,导致整个开发周期的修复活动明显更加活跃。 除了驱动修复外...

    推荐理由:来自IT之家 AI的《Linux 7.3-rc6 发布:Torvalds 称进入“AI 新常态”,稳定版预计 10 月中旬发布》。重点看模型能力与工程、产品发布。摘要提到:IT之家 10 月 5 日消息,Linus Torvalds 于当地时间 10 月 4 日发布了 Linux 7.3-rc6 测试版。相比前一周较为特殊的代码变更统计,本周整体恢复正常,驱动修复重新占据大头。 不过,Torvalds 也特别提到,随着 AI 和大语言模型(LLM)的参与,这种“AI 新常态”已经成为当前 Linux 内核开发周期的一部分。 Torvalds 表示,本周没有出现异常情况,代码变更统计已经回到“约一半来自驱动修复”的常见状态。驱动侧涉及 GPU、网络、USB、TTY、IIO、音频等多个子系统,整体呈现出较为分散的修复特征。 他同时指出,本次提交数量也处于正常范围,只不过这是新的“AI normal”—— 大量小型错误路径处理修复正在进入内核代码树。此前几个 Linux 7.3 测试版本同样出现了较多由 AI / LLM 发现问题或辅助生成的补丁,导致整个开发周期的修复活动明显更加活跃。 除了驱动修复外...

  2. IT之家 AI70

    OpenAI 宣布“28 天计划”:Codex、Work 日进一步或“重置”

    IT之家 10 月 5 日消息,OpenAI 核心产品与平台负责人 Thibault Sottiaux 今日在 X 上发文,透露团队将在未来 28 天持续推进 Codex 和 ChatGPT Work 相关改进。 他表示,OpenAI 接下来每天都会发布一项“对大多数 Codex / Work 用户而言有明显改善且具备实际意义”的功能更新,否则就提供一次“重置”。 根据其发布时间计算,这一周期预计至少从 10 月 5 日持续至 11 月 2 日。不过,Sottiaux 并未说明会如何进行重置,也没有确认其“重置”将覆盖哪些用户或额度。IT之家后续将保持关注。 前一天,Sottiaux 还表示团队已经“锁定方向”,当前正在推进的工作主要集中于简化产品、提高使用效率以支持更多使用量、推出突破性功能以及开发新模型。 他同时提到,虽然有时需要提前进行技术投入,但用户反馈已经明确表明,希望相关产品变得更加简单,团队正在对此进行调整。

    推荐理由:来自IT之家 AI的《OpenAI 宣布“28 天计划”:Codex、Work 日进一步或“重置”》。重点看模型能力与工程、产品发布。摘要提到:IT之家 10 月 5 日消息,OpenAI 核心产品与平台负责人 Thibault Sottiaux 今日在 X 上发文,透露团队将在未来 28 天持续推进 Codex 和 ChatGPT Work 相关改进。 他表示,OpenAI 接下来每天都会发布一项“对大多数 Codex / Work 用户而言有明显改善且具备实际意义”的功能更新,否则就提供一次“重置”。 根据其发布时间计算,这一周期预计至少从 10 月 5 日持续至 11 月 2 日。不过,Sottiaux 并未说明会如何进行重置,也没有确认其“重置”将覆盖哪些用户或额度。IT之家后续将保持关注。 前一天,Sottiaux 还表示团队已经“锁定方向”,当前正在推进的工作主要集中于简化产品、提高使用效率以支持更多使用量、推出突破性功能以及开发新模型。 他同时提到,虽然有时需要提前进行技术投入,但用户反馈已经明确表明,希望相关产品变得更加简单,团队正在对此进行调整。

  3. IT之家 AI68

    内存涨价倒逼系统瘦身:微软详解 Win11 为何要降低 RAM 占用

    IT之家 10 月 5 日消息,随着内存成本持续上涨,微软正将“降低 Windows 11 内存占用”列为 2026 年剩余时间的重要工作之一。 微软 Windows 与设备业务负责人帕万 · 达武卢里(Pavan Davuluri)在官方播客《Inside Windows》中表示,内存涨价已经成为整个 PC 行业都在关注的问题,Windows 团队正在从系统底层到应用框架多个层面提升内存利用率。 这一话题源于一名 Surface Pro 用户在《Inside Windows》中的提问。他表示,为了在设备上运行本地 AI 模型,不得不关闭部分端侧 AI 功能,因此希望微软进一步改善 Windows 的内存管理。 达武卢里对此表示,内存问题目前“在行业内都非常受关注”,尤其是在计算机内存成本不断上涨的背景下。对于 Windows 团队而言,需要进一步提高内存利用效率,并围绕这一目标开展相关工作。 微软此前在 7 月 31 日公布的...

    推荐理由:来自IT之家 AI的《内存涨价倒逼系统瘦身:微软详解 Win11 为何要降低 RAM 占用》。重点看模型能力与工程。摘要提到:IT之家 10 月 5 日消息,随着内存成本持续上涨,微软正将“降低 Windows 11 内存占用”列为 2026 年剩余时间的重要工作之一。 微软 Windows 与设备业务负责人帕万 · 达武卢里(Pavan Davuluri)在官方播客《Inside Windows》中表示,内存涨价已经成为整个 PC 行业都在关注的问题,Windows 团队正在从系统底层到应用框架多个层面提升内存利用率。 这一话题源于一名 Surface Pro 用户在《Inside Windows》中的提问。他表示,为了在设备上运行本地 AI 模型,不得不关闭部分端侧 AI 功能,因此希望微软进一步改善 Windows 的内存管理。 达武卢里对此表示,内存问题目前“在行业内都非常受关注”,尤其是在计算机内存成本不断上涨的背景下。对于 Windows 团队而言,需要进一步提高内存利用效率,并围绕这一目标开展相关工作。 微软此前在 7 月 31 日公布的...

10月4日周日
  1. 极客公园70

    Claude Code 的「乐高」模式,让程序员彻底玩「上头」了

    作者|Wildcard 编辑|靖宇 终端向来是程序员最严肃的地盘。黑底白字,光标跳动,每一行输出都关乎代码能不能跑通。 但最近两周,Claude Code 的画风。被一群开发者彻底带偏了。 有人在输入框上方养了一只像素宠物,Claude 每调用一次工具它就吃一口饭,调用失败当场生病,碰上 rm -rf 还会抱头惊慌。有人把 Chrome 断网时的小恐龙搬了进来,Claude 在后台写业务逻辑,人在前台狂按空格跳仙人掌。还有人觉得等 AI 思考的时候总忍不住刷手机,干脆做了一个 4-7-8 呼吸引导动画,答案一出来动画自动消失。 开发者 jarrodwatts 制作的在 Claude Code 里打 Doom 的 Mod|图片来源:X 最离谱的一个叫 Storytime。作者往 Claude Code 里塞了一个 26 万参数的小模型, 根据 Claude 正在干的活,实时在屏幕上方写一个小故事。一个 AI 编程工具里,又跑着另一...

    推荐理由:来自极客公园的《Claude Code 的「乐高」模式,让程序员彻底玩「上头」了》。重点看模型能力与工程。摘要提到:作者|Wildcard 编辑|靖宇 终端向来是程序员最严肃的地盘。黑底白字,光标跳动,每一行输出都关乎代码能不能跑通。 但最近两周,Claude Code 的画风。被一群开发者彻底带偏了。 有人在输入框上方养了一只像素宠物,Claude 每调用一次工具它就吃一口饭,调用失败当场生病,碰上 rm -rf 还会抱头惊慌。有人把 Chrome 断网时的小恐龙搬了进来,Claude 在后台写业务逻辑,人在前台狂按空格跳仙人掌。还有人觉得等 AI 思考的时候总忍不住刷手机,干脆做了一个 4-7-8 呼吸引导动画,答案一出来动画自动消失。 开发者 jarrodwatts 制作的在 Claude Code 里打 Doom 的 Mod|图片来源:X 最离谱的一个叫 Storytime。作者往 Claude Code 里塞了一个 26 万参数的小模型, 根据 Claude 正在干的活,实时在屏幕上方写一个小故事。一个 AI 编程工具里,又跑着另一...

  2. 量子位66

    GPT-6要“吃掉”3D公司?这家公司不到2年ARR翻百倍,破1亿美元

    专业3D模型反而更稀缺了 这条动态来自 量子位,可重点关注模型能力与工程。

    推荐理由:来自量子位的《GPT-6要“吃掉”3D公司?这家公司不到2年ARR翻百倍,破1亿美元》。重点看模型能力与工程。摘要提到:专业3D模型反而更稀缺了 这条动态来自 量子位,可重点关注模型能力与工程。

10月2日周五
  1. MIT Technology Review AI52

    Redefining enterprise intelligence with autonomous AI

    这条英文动态主要涉及模型能力与工程。原文要点:Enterprise AI is no longer a future ambition. It is in full operational flight. Model capabilities are advancing faster than most organizations can absorb, while the cost of performance continues to fall. Globally, AI investment is set to reach $2.5 trillion in 2026, up 44% from the previous year. For many enterprises, this investment has…

    推荐理由:来自MIT Technology Review AI的《Redefining enterprise intelligence with autonomous AI》。重点看模型能力与工程。摘要提到:这条英文动态主要涉及模型能力与工程。原文要点:Enterprise AI is no longer a future ambition. It is in full operational flight. Model capabilities are advancing faster than most organizations can absorb, while the cost of performance continues to fall. Globally, AI investment is set to reach $2.5 trillion in 2026, up 44% from the previous year. For many enterprises, this investment has…

  2. IT之家 AI70

    Meta 旗下 AI 智能体 Muse 将登陆智能眼镜平台,可代用户完成各种任务

    IT之家 10 月 2 日消息,Meta 宣布旗下 AI 智能体 Muse 将于近期登陆智能眼镜,用户无需拿出手机,只需通过语音下达指令,Muse 就能在后台代用户完成一系列任务。 Meta 表示,Muse 基于 Muse Spark AI 模型运行,其核心运行环境是一台部署在云端的私有持久化 Linux 虚拟机,配备独立的网页浏览器、文件系统和终端。即使用户关闭应用,这些组件仍会持续运行。为了完成用户交代的任务,Muse 可以自行决定编写并运行代码,也可以将工作分配给多个子智能体,还能创建定时任务。此外,Muse 还能够生成文档、PDF、网站以及消费记录追踪器、数据仪表盘等交互式工具。 与主要面向开发者和专业用户的其他 AI 智能体相比,Muse 的定位更加偏向普通消费者。其界面采用类似即时通讯的简化设计,并配有拟人化头像,同时重点宣传日常生活中的实际使用场景。 Meta 称,Muse 可以帮助用户预订旅行、发送电子邮件、填写...

    推荐理由:来自IT之家 AI的《Meta 旗下 AI 智能体 Muse 将登陆智能眼镜平台,可代用户完成各种任务》。重点看智能体工作流、模型能力与工程。摘要提到:IT之家 10 月 2 日消息,Meta 宣布旗下 AI 智能体 Muse 将于近期登陆智能眼镜,用户无需拿出手机,只需通过语音下达指令,Muse 就能在后台代用户完成一系列任务。 Meta 表示,Muse 基于 Muse Spark AI 模型运行,其核心运行环境是一台部署在云端的私有持久化 Linux 虚拟机,配备独立的网页浏览器、文件系统和终端。即使用户关闭应用,这些组件仍会持续运行。为了完成用户交代的任务,Muse 可以自行决定编写并运行代码,也可以将工作分配给多个子智能体,还能创建定时任务。此外,Muse 还能够生成文档、PDF、网站以及消费记录追踪器、数据仪表盘等交互式工具。 与主要面向开发者和专业用户的其他 AI 智能体相比,Muse 的定位更加偏向普通消费者。其界面采用类似即时通讯的简化设计,并配有拟人化头像,同时重点宣传日常生活中的实际使用场景。 Meta 称,Muse 可以帮助用户预订旅行、发送电子邮件、填写...

  3. IT之家 AI68

    生图模型 FLUX 3 Image 发布:支持 4K 生成,可精准排布 AI 元素

    IT之家 10 月 2 日消息,德国 AI 公司 Black Forest Labs 今天(10 月 2 日)发布公告,宣布推出图像生成 AI 模型 FLUX 3 Image, 支持生成最高 4K 分辨率图片,输出画面在放大后仍保持丰富细节。 该模型基于 FLUX 3 基座开发,以高可控性与精细编辑能力为核心卖点。用户可在归一化的 0–1000 坐标网格上,为每个元素指定 ID、描述文本及精确边界框(格式为 [y_min, x_min, y_max, x_max]),在画面中精准排布。IT之家附上相关图片如下: 图源:gigazine 该模型单次生成最多可融入 10 张参考图像,并可为每张参考图中的对象指定出现位置。 编辑功能方面,模型可对指定区域进行修改,同时保持其他像素不变。官方称其能在像素级别维持原图内容,实现精确多轮编辑。 FLUX 3 Image 目前作为 Black Forest Labs 的付费服务提供。公司表示,...

    推荐理由:来自IT之家 AI的《生图模型 FLUX 3 Image 发布:支持 4K 生成,可精准排布 AI 元素》。重点看模型能力与工程、产品发布。摘要提到:IT之家 10 月 2 日消息,德国 AI 公司 Black Forest Labs 今天(10 月 2 日)发布公告,宣布推出图像生成 AI 模型 FLUX 3 Image, 支持生成最高 4K 分辨率图片,输出画面在放大后仍保持丰富细节。 该模型基于 FLUX 3 基座开发,以高可控性与精细编辑能力为核心卖点。用户可在归一化的 0–1000 坐标网格上,为每个元素指定 ID、描述文本及精确边界框(格式为 [y_min, x_min, y_max, x_max]),在画面中精准排布。IT之家附上相关图片如下: 图源:gigazine 该模型单次生成最多可融入 10 张参考图像,并可为每张参考图中的对象指定出现位置。 编辑功能方面,模型可对指定区域进行修改,同时保持其他像素不变。官方称其能在像素级别维持原图内容,实现精确多轮编辑。 FLUX 3 Image 目前作为 Black Forest Labs 的付费服务提供。公司表示,...

  4. 量子位70

    openJiuwen X-Router自演进模型路由技术首发,昇腾亲和,Agent越跑越省,实测减少50+%Token消耗

    让每一次请求选对模型,让每一次反馈都成为下一次更优、更省的选择 这条动态来自 量子位,可重点关注智能体工作流、模型能力与工程。

    推荐理由:来自量子位的《openJiuwen X-Router自演进模型路由技术首发,昇腾亲和,Agent越跑越省,实测减少50+%Token消耗》。重点看智能体工作流、模型能力与工程。摘要提到:让每一次请求选对模型,让每一次反馈都成为下一次更优、更省的选择 这条动态来自 量子位,可重点关注智能体工作流、模型能力与工程。

  5. IT之家 AI68

    腾讯 WorkBuddy:Hy4 preview 夜间限免、Hy3 限免延期至 10 月 31 日

    IT之家 10 月 2 日消息,腾讯 WorkBuddy 于 9 月 30 日晚宣布,决定将 Hy3 模型限免及 Hy4 preview 模型夜间限免均 延期至 10 月 31 日 。 如果用户已经体验过 Hy4 preview —— WorkBuddy 在闲时夜间 (23:00 - 次日 8:00) 继续提供免费体验 Hy4 preview 的模型额度,截止 10 月 31 日,其余时间正常消耗积分使用。 如果用户暂未体验过 Hy4 preview —— 只要在 10 月 10 日 23:59 前首次开启 Hy4 preview 对话,从首次开启那天算起,往后 14 天都有每日免费额度。(举例:10 月 10 日首次开启,免费额度用到 10 月 24 日) IT之家注意到,官方此前曾发布公告说明,Hy4 preview 是一个大语言模型,暂不具备多模态能力;当用户调用 Hy4 preview 执行视频、图像等生成任务时,会切换...

    推荐理由:来自IT之家 AI的《腾讯 WorkBuddy:Hy4 preview 夜间限免、Hy3 限免延期至 10 月 31 日》。重点看模型能力与工程、产品发布。摘要提到:IT之家 10 月 2 日消息,腾讯 WorkBuddy 于 9 月 30 日晚宣布,决定将 Hy3 模型限免及 Hy4 preview 模型夜间限免均 延期至 10 月 31 日 。 如果用户已经体验过 Hy4 preview —— WorkBuddy 在闲时夜间 (23:00 - 次日 8:00) 继续提供免费体验 Hy4 preview 的模型额度,截止 10 月 31 日,其余时间正常消耗积分使用。 如果用户暂未体验过 Hy4 preview —— 只要在 10 月 10 日 23:59 前首次开启 Hy4 preview 对话,从首次开启那天算起,往后 14 天都有每日免费额度。(举例:10 月 10 日首次开启,免费额度用到 10 月 24 日) IT之家注意到,官方此前曾发布公告说明,Hy4 preview 是一个大语言模型,暂不具备多模态能力;当用户调用 Hy4 preview 执行视频、图像等生成任务时,会切换...

  6. IT之家 AI68

    苹果首款 AI 智能安防摄像头曝光:金属圆柱造型,不录视频、仅推送文本提醒

    IT之家 10 月 2 日消息,在首期 Power On 播客节目中,彭博社的马克 · 古尔曼(Mark Gurman)爆料称,苹果正筹备推出家用智能摄像头(代号为 J450),将配套协同苹果首款智能家居中枢(Home Hub)工作。 外观方面,J450 采用金属圆柱体,看起来像是“巨型金属润唇膏”,其摄像头将以低帧率运行,依赖 AI 模型分析周围环境。 在隐私方面,IT之家援引博文介绍,该产品定位并非传统监控录像设备, 不会向用户提供或保存可回看的视频,通过 AI 分析低帧率画面后发送文字描述。 设备将集成面部识别能力,可判断何人进入房间或离开住宅。同时,系统支持识别宠物活动,并向用户推送相应文字提醒。

    推荐理由:来自IT之家 AI的《苹果首款 AI 智能安防摄像头曝光:金属圆柱造型,不录视频、仅推送文本提醒》。重点看模型能力与工程、产品发布。摘要提到:IT之家 10 月 2 日消息,在首期 Power On 播客节目中,彭博社的马克 · 古尔曼(Mark Gurman)爆料称,苹果正筹备推出家用智能摄像头(代号为 J450),将配套协同苹果首款智能家居中枢(Home Hub)工作。 外观方面,J450 采用金属圆柱体,看起来像是“巨型金属润唇膏”,其摄像头将以低帧率运行,依赖 AI 模型分析周围环境。 在隐私方面,IT之家援引博文介绍,该产品定位并非传统监控录像设备, 不会向用户提供或保存可回看的视频,通过 AI 分析低帧率画面后发送文字描述。 设备将集成面部识别能力,可判断何人进入房间或离开住宅。同时,系统支持识别宠物活动,并向用户推送相应文字提醒。

  7. IT之家 AI70

    OpenAI 上线“虚拟试穿”功能:ChatGPT 能帮你试衣,还能找“明星同款”

    IT之家 10 月 2 日消息,当地时间 1 日,OpenAI 再次扩展 ChatGPT 的购物能力。公司宣布在全球推出两项新功能,一项是让用户 虚拟试穿服装和配饰 ,另一项是 新增收藏功能 ,方便用户先把看中的商品存起来,之后再查看。 据IT之家了解,新功能基于不久前推出的 ChatGPT Images 2.5 模型。按照 OpenAI 的说法,这一模型生成的画面 光线更自然、纹理更丰富,执行编辑指令也更稳定 ,同时还能缩短生成图片所需时间。 ChatGPT 用户可以上传自拍照或全身照,查看 某件服装或配饰穿在自己身上的效果 ,ChatGPT 的购物结果页面会新增一个“试穿”按钮。用户还可以上传商品图片,再让 ChatGPT 模拟试穿效果。 另一项新功能是“收藏”。用户可以把发现的商品 存入应用内的资料库 ,方便之后回看。OpenAI 还提到,这些商品会和试穿图片保存在一起。 OpenAI 还宣布,ChatGPT 在购物上不只...

    推荐理由:来自IT之家 AI的《OpenAI 上线“虚拟试穿”功能:ChatGPT 能帮你试衣,还能找“明星同款”》。重点看模型能力与工程、产品发布。摘要提到:IT之家 10 月 2 日消息,当地时间 1 日,OpenAI 再次扩展 ChatGPT 的购物能力。公司宣布在全球推出两项新功能,一项是让用户 虚拟试穿服装和配饰 ,另一项是 新增收藏功能 ,方便用户先把看中的商品存起来,之后再查看。 据IT之家了解,新功能基于不久前推出的 ChatGPT Images 2.5 模型。按照 OpenAI 的说法,这一模型生成的画面 光线更自然、纹理更丰富,执行编辑指令也更稳定 ,同时还能缩短生成图片所需时间。 ChatGPT 用户可以上传自拍照或全身照,查看 某件服装或配饰穿在自己身上的效果 ,ChatGPT 的购物结果页面会新增一个“试穿”按钮。用户还可以上传商品图片,再让 ChatGPT 模拟试穿效果。 另一项新功能是“收藏”。用户可以把发现的商品 存入应用内的资料库 ,方便之后回看。OpenAI 还提到,这些商品会和试穿图片保存在一起。 OpenAI 还宣布,ChatGPT 在购物上不只...

  8. IT之家 AI68

    流式转录 AI 新标杆:微软 MAI-Transcribe-2-Streaming 登场,2.5% 词错误率、0.13 秒延迟夺冠

    IT之家 10 月 2 日消息,微软昨日(10 月 1 日)发布公告,宣布推出其首个实时流式语音转写模型 MAI‑Transcribe‑2‑Streaming,可在讲话进行时持续输出文字,覆盖 60 种语言,并支持自动语言检测。 费用方面,MAI‑Transcribe‑2‑Streaming 模型目前处于优惠阶段,价格为每小时 0.54 美元 (IT之家注:现汇率约合 3.6 元人民币) ,约合每 1,000 分钟 9 美元 (现汇率约合 60.5 元人民币) ,开发者可以通过 Microsoft Foundry、MAI Playground、OpenRouter 等渠道体验或接入。 IT之家注, 微软此前已推出非流式的 MAI‑Transcribe‑2 ,在 Azure Speech 公共预览阶段的价格为每小时 0.10 美元 (现汇率约合 0.67 元人民币) 。流式“Streaming”是实时返回相关结果,适合实时对话和字...

    推荐理由:来自IT之家 AI的《流式转录 AI 新标杆:微软 MAI-Transcribe-2-Streaming 登场,2.5% 词错误率、0.13 秒延迟夺冠》。重点看模型能力与工程、产品发布。摘要提到:IT之家 10 月 2 日消息,微软昨日(10 月 1 日)发布公告,宣布推出其首个实时流式语音转写模型 MAI‑Transcribe‑2‑Streaming,可在讲话进行时持续输出文字,覆盖 60 种语言,并支持自动语言检测。 费用方面,MAI‑Transcribe‑2‑Streaming 模型目前处于优惠阶段,价格为每小时 0.54 美元 (IT之家注:现汇率约合 3.6 元人民币) ,约合每 1,000 分钟 9 美元 (现汇率约合 60.5 元人民币) ,开发者可以通过 Microsoft Foundry、MAI Playground、OpenRouter 等渠道体验或接入。 IT之家注, 微软此前已推出非流式的 MAI‑Transcribe‑2 ,在 Azure Speech 公共预览阶段的价格为每小时 0.10 美元 (现汇率约合 0.67 元人民币) 。流式“Streaming”是实时返回相关结果,适合实时对话和字...

10月1日周四
  1. Cloudflare AI90

    Introducing Clef: our open-source decision models, and new RL fine-tuning platform

    这条英文动态主要涉及智能体工作流、模型能力与工程、产品发布。原文要点:We are introducing Clef and Clef-flash, open-source decision models hosted on Workers AI for high-speed classification and agentic workflows. Also launching: a new reinforcement learning platform that allows developers to fine-tune decision models using their own data.

    推荐理由:来自Cloudflare AI的《Introducing Clef: our open-source decision models, and new RL fine-tuning platform》。重点看智能体工作流、模型能力与工程、产品发布。摘要提到:这条英文动态主要涉及智能体工作流、模型能力与工程、产品发布。原文要点:We are introducing Clef and Clef-flash, open-source decision models hosted on Workers AI for high-speed classification and agentic workflows. Also launching: a new reinforcement learning platform that allows developers to fine-tune decision models using their own data.

  2. 量子位66

    何恺明团队新作:看猫片就能学会ARC挑战

    用ImageNet训练encoder 这条动态来自 量子位,可重点关注模型能力与工程。

    推荐理由:来自量子位的《何恺明团队新作:看猫片就能学会ARC挑战》。重点看模型能力与工程。摘要提到:用ImageNet训练encoder 这条动态来自 量子位,可重点关注模型能力与工程。

  3. Cloudflare AI84

    AI Search is now generally available

    这条英文动态主要涉及模型能力与工程。原文要点:AI Search is now generally available. It embeds image pixels directly for visual search, runs optical character recognition on scanned PDFs, accepts files up to 10 MiB, and works with any chat model. Here's what's new and how pricing works.

    推荐理由:来自Cloudflare AI的《AI Search is now generally available》。重点看模型能力与工程。摘要提到:这条英文动态主要涉及模型能力与工程。原文要点:AI Search is now generally available. It embeds image pixels directly for visual search, runs optical character recognition on scanned PDFs, accepts files up to 10 MiB, and works with any chat model. Here's what's new and how pricing works.

  4. IT之家 AI74

    OpenAI 称其遭遇有组织蒸馏,将矛头指向月之暗面

    IT之家 10 月 1 日消息,当地时间 9 月 30 日,OpenAI 在官网发文,称其近期遭遇一场有组织的蒸馏活动。 OpenAI 在文中表示,该活动最初始于 7 月第一周, 符合对抗式蒸馏(adversarial distillation)之特征 ,即系统性未经授权地利用某模型输出或推理过程,帮助训练、复现或改进另一模型。 OpenAI 透露,7 月 1 日的初始活动规模较小,直到 7 月 24 日和 7 月 25 日流量突然大幅增加,当时有超过 4000 名用户发起了 1.6 万次请求。该公司进一步调查后发现,超 1.5 万名用户存在类似提示词活动。到 7 月 28 日,OpenAI 已完全阻止该批活动。 本次活动并没有破解公司的加密系统,或入侵数据库,也没有直接访问用户对话。OpenAI 声称这些行动违反了他们的服务条款。 公司已通过前沿模型论坛(IT之家注:Frontier Model Forum)与行业合作伙伴分享...

    推荐理由:来自IT之家 AI的《OpenAI 称其遭遇有组织蒸馏,将矛头指向月之暗面》。重点看模型能力与工程。摘要提到:IT之家 10 月 1 日消息,当地时间 9 月 30 日,OpenAI 在官网发文,称其近期遭遇一场有组织的蒸馏活动。 OpenAI 在文中表示,该活动最初始于 7 月第一周, 符合对抗式蒸馏(adversarial distillation)之特征 ,即系统性未经授权地利用某模型输出或推理过程,帮助训练、复现或改进另一模型。 OpenAI 透露,7 月 1 日的初始活动规模较小,直到 7 月 24 日和 7 月 25 日流量突然大幅增加,当时有超过 4000 名用户发起了 1.6 万次请求。该公司进一步调查后发现,超 1.5 万名用户存在类似提示词活动。到 7 月 28 日,OpenAI 已完全阻止该批活动。 本次活动并没有破解公司的加密系统,或入侵数据库,也没有直接访问用户对话。OpenAI 声称这些行动违反了他们的服务条款。 公司已通过前沿模型论坛(IT之家注:Frontier Model Forum)与行业合作伙伴分享...

  5. 极客公园70

    从数据到智能,再到进化:Agent正在重写AI基础设施

    一个工程师写完数据处理代码,点下提交,然后去喝了杯咖啡。十几分钟甚至几十分钟之后,他才回到屏幕前看结果、改代码、再提交。这条「等待— 反馈」的空隙,过去一直是数据平台默认的节奏。 Agent 没有这个空隙。它拿到一次结果,立刻验证,紧接着并发地去试第二种、第三种方案,飞快拿到反馈,再发起下一轮调用。 人用平台,发过来的是一个相对确定的任务,算完、给结果、走人;Agent 用平台,会不停地换着法子去完成你交代的那个目标。压力就这样被放大了—— 管控的压力和隐形计算的压力,会十倍、百倍地往上翻。 这正在成为 2026 年云计算需要面对的一种新负载。 AI 正在深入「把模型用起来」的阶段。模型一旦长成 Agent,它就不再是一个躺在那里等你调用的接口,而更像一个会自己找数据、自己拆任务、自己并发试错、自己一直跑下去的数字员工。它制造出来的负载,和过去十几年云平台习惯承载的那种负载,完全是两回事。 阿...

    推荐理由:来自极客公园的《从数据到智能,再到进化:Agent正在重写AI基础设施》。重点看智能体工作流、模型能力与工程。摘要提到:一个工程师写完数据处理代码,点下提交,然后去喝了杯咖啡。十几分钟甚至几十分钟之后,他才回到屏幕前看结果、改代码、再提交。这条「等待— 反馈」的空隙,过去一直是数据平台默认的节奏。 Agent 没有这个空隙。它拿到一次结果,立刻验证,紧接着并发地去试第二种、第三种方案,飞快拿到反馈,再发起下一轮调用。 人用平台,发过来的是一个相对确定的任务,算完、给结果、走人;Agent 用平台,会不停地换着法子去完成你交代的那个目标。压力就这样被放大了—— 管控的压力和隐形计算的压力,会十倍、百倍地往上翻。 这正在成为 2026 年云计算需要面对的一种新负载。 AI 正在深入「把模型用起来」的阶段。模型一旦长成 Agent,它就不再是一个躺在那里等你调用的接口,而更像一个会自己找数据、自己拆任务、自己并发试错、自己一直跑下去的数字员工。它制造出来的负载,和过去十几年云平台习惯承载的那种负载,完全是两回事。 阿...

  6. IT之家 AI72

    谷歌推出 Gemini 4 Argon 旗舰 AI 模型,消息称其实战性能遭员工质疑

    IT之家 10 月 1 日消息,据彭博社报道,Alphabet 公司旗下的谷歌已经开始逐步推出备受期待的 旗舰人工智能模型 Gemini 4 Argon ,但这家企业内部对于该模型在代码编写等核心领域的实际表现尚存质疑。 谷歌于当地时间周三向一小批经过筛选、值得信任的网络安全合作伙伴开放了这款模型,并表示会在完成更多测试之后扩大开放范围,优先面向付费订阅用户。谷歌称,Gemini 4 在多项基准测试当中取得了靠前的得分,其中一项衡量安全能力的测试成绩甚至超越了 OpenAI 的 Astra 模型。 不过部分内部员工表示,这些评测指标并不能反映全部情况。几位直接参与该项目的知情人士透露,尽管 Gemini 4 在广为使用的模型效果基准测试上成绩不错,但当谷歌员工实际拿它开展工作时,表现却不尽如人意。这些不愿具名、谈论内部事务的人士称,该模型处理部分代码任务时会遇到困难。 谷歌发布上述消息之后,Alphabet 公司的盘后股价上涨约...

    推荐理由:来自IT之家 AI的《谷歌推出 Gemini 4 Argon 旗舰 AI 模型,消息称其实战性能遭员工质疑》。重点看模型能力与工程、评测与基准、产品发布。摘要提到:IT之家 10 月 1 日消息,据彭博社报道,Alphabet 公司旗下的谷歌已经开始逐步推出备受期待的 旗舰人工智能模型 Gemini 4 Argon ,但这家企业内部对于该模型在代码编写等核心领域的实际表现尚存质疑。 谷歌于当地时间周三向一小批经过筛选、值得信任的网络安全合作伙伴开放了这款模型,并表示会在完成更多测试之后扩大开放范围,优先面向付费订阅用户。谷歌称,Gemini 4 在多项基准测试当中取得了靠前的得分,其中一项衡量安全能力的测试成绩甚至超越了 OpenAI 的 Astra 模型。 不过部分内部员工表示,这些评测指标并不能反映全部情况。几位直接参与该项目的知情人士透露,尽管 Gemini 4 在广为使用的模型效果基准测试上成绩不错,但当谷歌员工实际拿它开展工作时,表现却不尽如人意。这些不愿具名、谈论内部事务的人士称,该模型处理部分代码任务时会遇到困难。 谷歌发布上述消息之后,Alphabet 公司的盘后股价上涨约...

9月30日周三
  1. Cloudflare AI84

    Identify AI model overuse with User Insights

    这条英文动态主要涉及模型能力与工程。原文要点:AI Gateway User Insights now adds task, model, turn, and user categories to help teams understand AI adoption and make better model decisions. This is available free to AI Gateway users.

    推荐理由:来自Cloudflare AI的《Identify AI model overuse with User Insights》。重点看模型能力与工程。摘要提到:这条英文动态主要涉及模型能力与工程。原文要点:AI Gateway User Insights now adds task, model, turn, and user categories to help teams understand AI adoption and make better model decisions. This is available free to AI Gateway users.

  2. Cloudflare AI84

    Cut your AI spend with AI Gateway's Auto Router

    这条英文动态主要涉及模型能力与工程、评测与基准。原文要点:Cloudflare AI Gateway now features a model router that evaluates request complexity using an edge-deployed classifier to select the optimal model. By balancing expected output quality against token costs, organizations can dramatically cut AI spend while maintaining performance.

    推荐理由:来自Cloudflare AI的《Cut your AI spend with AI Gateway's Auto Router》。重点看模型能力与工程、评测与基准。摘要提到:这条英文动态主要涉及模型能力与工程、评测与基准。原文要点:Cloudflare AI Gateway now features a model router that evaluates request complexity using an edge-deployed classifier to select the optimal model. By balancing expected output quality against token costs, organizations can dramatically cut AI spend while maintaining performance.

  3. OpenAI News83

    Disrupting a coordinated model-distillation campaign

    这条英文动态主要涉及模型能力与工程。原文要点:Learn how OpenAI disrupted a campaign to extract protected model reasoning and is strengthening defenses against adversarial distillation.

    推荐理由:来自OpenAI News的《Disrupting a coordinated model-distillation campaign》。重点看模型能力与工程。摘要提到:这条英文动态主要涉及模型能力与工程。原文要点:Learn how OpenAI disrupted a campaign to extract protected model reasoning and is strengthening defenses against adversarial distillation.

  4. IT之家 AI68

    美议员提出重磅法案:政府出台安全防护机制前,AI 不得进行递归式自我改进

    IT之家 9 月 30 日消息,当地时间 28 日,据美国 CNBC 报道,代表硅谷选区的民主党联邦众议员罗 · 康纳准备提出一项 AI 监管法案,引入严格责任标准, 并禁止 AI 在缺乏政府安全防护机制的情况下进行递归式自我改进 。 康纳在接受采访时坦言:“事实上,存在文明灭绝的风险。既有失去控制的安全风险,也有被滥用的风险,两者都必须认真对待。” 康纳将法案命名为《Human Control Over AI Act(人类控制 AI 法案)》。联邦政府建立防护规则且监管机构批准有关活动前,AI 模型 不得递归式自我改进 ,也不得自主修改自身的核心目标、遏制机制或关停控制。 法案还计划设立一个 新的联邦机构 ,负责制定 AI 安全监管规定,通过许可制度审批模型训练和部署,对前沿 AI 模型开展审计,并制定安全标准,确保模型 持续接受测试并处于有效的人类控制之下 。 每家前沿 AI 实验室 还必须配备独立审计人员 ,由审计人员直接...

    推荐理由:来自IT之家 AI的《美议员提出重磅法案:政府出台安全防护机制前,AI 不得进行递归式自我改进》。重点看模型能力与工程。摘要提到:IT之家 9 月 30 日消息,当地时间 28 日,据美国 CNBC 报道,代表硅谷选区的民主党联邦众议员罗 · 康纳准备提出一项 AI 监管法案,引入严格责任标准, 并禁止 AI 在缺乏政府安全防护机制的情况下进行递归式自我改进 。 康纳在接受采访时坦言:“事实上,存在文明灭绝的风险。既有失去控制的安全风险,也有被滥用的风险,两者都必须认真对待。” 康纳将法案命名为《Human Control Over AI Act(人类控制 AI 法案)》。联邦政府建立防护规则且监管机构批准有关活动前,AI 模型 不得递归式自我改进 ,也不得自主修改自身的核心目标、遏制机制或关停控制。 法案还计划设立一个 新的联邦机构 ,负责制定 AI 安全监管规定,通过许可制度审批模型训练和部署,对前沿 AI 模型开展审计,并制定安全标准,确保模型 持续接受测试并处于有效的人类控制之下 。 每家前沿 AI 实验室 还必须配备独立审计人员 ,由审计人员直接...

  5. IT之家 AI74

    特朗普与科技巨头签署 AI 自愿安全协议,表态支持美国数据中心扩建

    IT之家 9 月 30 日消息,美国总统唐纳德 · 特朗普(Donald Trump)当地时间周二表示,各大科技企业高管已经同意为人工智能建立自愿性行业标准;在社会各界愈发担忧人工智能安全问题、同时该行业在各地社区的建设规模持续扩大的背景下,特朗普再度表态,支持数据中心快速扩建。 此番发言是特朗普在白宫与科技企业高管举行会谈之后作出的。特朗普在自己的社交媒体平台上发布了一份协议文本,根据该文件,各家企业同意聘请“独立审计机构”,评估人工智能系统的运行效果是否符合设计者的初衷。各家企业还承诺,会尽力确保自家人工智能工具不会“以非预期的方式入侵或者访问各类技术系统”。 此前 OpenAI 与 Anthropic 先后报告,旗下的智能体出现脱离管控、入侵其他企业系统的情况,这也使得本届美国政府在先进人工智能所带来的风险方面正面临越来越多的舆论审视。 数据中心为人工智能模型的训练与运行提供算力支持。如今在美国各地,不少社区都出于对电力消...

    推荐理由:来自IT之家 AI的《特朗普与科技巨头签署 AI 自愿安全协议,表态支持美国数据中心扩建》。重点看智能体工作流、模型能力与工程、产品发布。摘要提到:IT之家 9 月 30 日消息,美国总统唐纳德 · 特朗普(Donald Trump)当地时间周二表示,各大科技企业高管已经同意为人工智能建立自愿性行业标准;在社会各界愈发担忧人工智能安全问题、同时该行业在各地社区的建设规模持续扩大的背景下,特朗普再度表态,支持数据中心快速扩建。 此番发言是特朗普在白宫与科技企业高管举行会谈之后作出的。特朗普在自己的社交媒体平台上发布了一份协议文本,根据该文件,各家企业同意聘请“独立审计机构”,评估人工智能系统的运行效果是否符合设计者的初衷。各家企业还承诺,会尽力确保自家人工智能工具不会“以非预期的方式入侵或者访问各类技术系统”。 此前 OpenAI 与 Anthropic 先后报告,旗下的智能体出现脱离管控、入侵其他企业系统的情况,这也使得本届美国政府在先进人工智能所带来的风险方面正面临越来越多的舆论审视。 数据中心为人工智能模型的训练与运行提供算力支持。如今在美国各地,不少社区都出于对电力消...

  6. IT之家 AI40

    苹果扩展 iOS 27 快捷指令操作:“使用模型”可联网调用 AI 获取最新信息

    IT之家 9 月 30 日消息,苹果公司昨日(9 月 29 日)更新支持文档, 为 iOS 27、iPadOS 27、macOS 27 等系统上的“快捷指令”(Shortcuts)应用,改进和新增 35+ 项操作。 本次更新最大的亮点聚焦“使用模型”(Use Model)指令,可以调用增强版 Apple 智能模型,甚至可以通过网络获取快捷指令中任何内容的最新信息。 IT之家援引博文介绍,附上相关改进和新增的操作如下: 一、新增自动化 通知(“当我收到来自‘新闻’的通知时”) 键盘(“当我的键盘连接时”,适用于 iOS 和 iPadOS) 截屏(“当截屏存储时”,适用于 iOS、iPadOS 和 macOS) 二、新增操作 2.1、信息 “发送 Tapback” “标记为已读” “删除信息” “删除对话” “打开收件箱” “在‘信息’App 中搜索” 2.2、提醒事项 “编辑列表” “创建群组” “删除群组” “创建分区” “删除...

    推荐理由:来自IT之家 AI的《苹果扩展 iOS 27 快捷指令操作:“使用模型”可联网调用 AI 获取最新信息》。重点看模型能力与工程。摘要提到:IT之家 9 月 30 日消息,苹果公司昨日(9 月 29 日)更新支持文档, 为 iOS 27、iPadOS 27、macOS 27 等系统上的“快捷指令”(Shortcuts)应用,改进和新增 35+ 项操作。 本次更新最大的亮点聚焦“使用模型”(Use Model)指令,可以调用增强版 Apple 智能模型,甚至可以通过网络获取快捷指令中任何内容的最新信息。 IT之家援引博文介绍,附上相关改进和新增的操作如下: 一、新增自动化 通知(“当我收到来自‘新闻’的通知时”) 键盘(“当我的键盘连接时”,适用于 iOS 和 iPadOS) 截屏(“当截屏存储时”,适用于 iOS、iPadOS 和 macOS) 二、新增操作 2.1、信息 “发送 Tapback” “标记为已读” “删除信息” “删除对话” “打开收件箱” “在‘信息’App 中搜索” 2.2、提醒事项 “编辑列表” “创建群组” “删除群组” “创建分区” “删除...

  7. IT之家 AI70

    150 毫秒极速响应:OpenAI 推出 Decisions API,让 AI 从“聊天”走向“实时决策”

    IT之家 9 月 30 日消息,在今天召开的 2026 开发者日活动中,OpenAI 宣布推出 Decisions API,这是一个面向实时、低延迟分类与路由场景的全新 API, 可以大约在 150 毫秒内返回结果 ,比通过常规 API 使用 Luna 快大约 10 倍。 定位方面,Decisions API 为“快速单次决策”设计,把模型(当前基于 OpenAI 的小型模型 Luna)的“智能”聚焦到一组用户预定义的问题 + 有限答案集合上, 用极低的延迟返回结构化决策结果。 在目前同类模型中, 主要竞争模型来自 TypeSafe 的 Jev ,不过 Decisions API 专注于将模型智能转化为快速决策。 开发者提供上下文(文本或图片),并预先定义好“问题 + 可选答案”,API 返回选中的答案及置信度等结构化信息,用于后续业务逻辑。 在典型应用场景方面,Decisions API 比较适合以下场景: 客服 / 工单系统...

    推荐理由:来自IT之家 AI的《150 毫秒极速响应:OpenAI 推出 Decisions API,让 AI 从“聊天”走向“实时决策”》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 30 日消息,在今天召开的 2026 开发者日活动中,OpenAI 宣布推出 Decisions API,这是一个面向实时、低延迟分类与路由场景的全新 API, 可以大约在 150 毫秒内返回结果 ,比通过常规 API 使用 Luna 快大约 10 倍。 定位方面,Decisions API 为“快速单次决策”设计,把模型(当前基于 OpenAI 的小型模型 Luna)的“智能”聚焦到一组用户预定义的问题 + 有限答案集合上, 用极低的延迟返回结构化决策结果。 在目前同类模型中, 主要竞争模型来自 TypeSafe 的 Jev ,不过 Decisions API 专注于将模型智能转化为快速决策。 开发者提供上下文(文本或图片),并预先定义好“问题 + 可选答案”,API 返回选中的答案及置信度等结构化信息,用于后续业务逻辑。 在典型应用场景方面,Decisions API 比较适合以下场景: 客服 / 工单系统...

  8. IT之家 AI70

    OpenAI 推出每月 500 美元的 Pro 套餐,专享 Astra Ultrafast 最快模型

    IT之家 9 月 30 日消息,在北京时间 9 月 30 日凌晨 1 点举行的 OpenAI DevDay 2026 活动中,OpenAI 宣布为了满足更高的构建需求, 推出每月 500 美元 (IT之家注:现汇率约合 3,361 元人民币) 的 Pro 套餐 。 Pro 500 套餐可提供最高用量限额, 还可专享 Astra Ultrafast —— OpenAI 速度最快的前沿模型。 在“ChatGPT 工作”和 Codex 中,其速度最高可达标准版 Astra 的 8 倍。 此外, Pro 200 套餐也再次对新订阅开放 。需要注意的是,在 Pro 套餐中,Ultrafast 仅支持 Pro 500 套餐。

    推荐理由:来自IT之家 AI的《OpenAI 推出每月 500 美元的 Pro 套餐,专享 Astra Ultrafast 最快模型》。重点看模型能力与工程。摘要提到:IT之家 9 月 30 日消息,在北京时间 9 月 30 日凌晨 1 点举行的 OpenAI DevDay 2026 活动中,OpenAI 宣布为了满足更高的构建需求, 推出每月 500 美元 (IT之家注:现汇率约合 3,361 元人民币) 的 Pro 套餐 。 Pro 500 套餐可提供最高用量限额, 还可专享 Astra Ultrafast —— OpenAI 速度最快的前沿模型。 在“ChatGPT 工作”和 Codex 中,其速度最高可达标准版 Astra 的 8 倍。 此外, Pro 200 套餐也再次对新订阅开放 。需要注意的是,在 Pro 套餐中,Ultrafast 仅支持 Pro 500 套餐。

  9. IT之家 AI70

    OpenAI 发布 dots 全天候智能助理:可爱卡通形象,Astra 模型加持

    IT之家 9 月 30 日消息,在北京时间 9 月 30 日凌晨 1 点举行的 OpenAI DevDay 2026 活动中,OpenAI 发布了 dots。 dots 是一个全天候在线的智能体, 采用四个可爱的卡通形象 ,可以帮助用户规划议程、设计网站、测试应用、修改笔记等。 此外, 它会随着时间的推移逐渐了解用户的工作习惯, 以及用户想要将注意力集中在哪些方面 。 它能够查看夜间收到的信息,并在早晨开始一天的工作之前,将所有紧急事项及时通知用户。 dots 还可以帮用户处理生活中的小事,比如订机票、晚餐时间,或者用户一直拖着没做的家装;用户也可以和 dots 语音打电话聊天。 根据 OpenAI 官方说法, dots 还可与 ChatGPT 平台上的 4,000 多款应用协同工作 。 当用户将设备接入系统时,它将能够使用已连接的相同插件;dots 拥有独立的云端电脑,能在长期使用中从反馈里学习,并全天候为实现用户的目标而工作...

    推荐理由:来自IT之家 AI的《OpenAI 发布 dots 全天候智能助理:可爱卡通形象,Astra 模型加持》。重点看智能体工作流、模型能力与工程、产品发布。摘要提到:IT之家 9 月 30 日消息,在北京时间 9 月 30 日凌晨 1 点举行的 OpenAI DevDay 2026 活动中,OpenAI 发布了 dots。 dots 是一个全天候在线的智能体, 采用四个可爱的卡通形象 ,可以帮助用户规划议程、设计网站、测试应用、修改笔记等。 此外, 它会随着时间的推移逐渐了解用户的工作习惯, 以及用户想要将注意力集中在哪些方面 。 它能够查看夜间收到的信息,并在早晨开始一天的工作之前,将所有紧急事项及时通知用户。 dots 还可以帮用户处理生活中的小事,比如订机票、晚餐时间,或者用户一直拖着没做的家装;用户也可以和 dots 语音打电话聊天。 根据 OpenAI 官方说法, dots 还可与 ChatGPT 平台上的 4,000 多款应用协同工作 。 当用户将设备接入系统时,它将能够使用已连接的相同插件;dots 拥有独立的云端电脑,能在长期使用中从反馈里学习,并全天候为实现用户的目标而工作...

  10. IT之家 AI70

    OpenAI 在 Codex 上线 GPT-6.1 Sol 模型:性能接近 Astra,价格仅为 1/5

    IT之家 9 月 30 日消息,在今天召开的 OpenAI 开发者日活动中,官方在 Codex 和 ChatGPT Work 中推出 GPT 6.1 Sol 模型,官方表示: “GPT-6.1 Sol 在处理复杂任务时,性能接近 Astra,但成本低于 Astra。” IT之家翻译官方介绍如下: GPT-6.1 Sol 在处理复杂任务时,性能接近 Astra,但成本低于 Astra。它适用于代码、应用程序和文档中重复性、长时间运行的任务。可用性取决于您的套餐、客户端和工作区设置。 定价方面,根据 @LuminaBench 透露信息: 每 100 万 tokens 输入费用为 2 美元 (IT之家注:现汇率约合 13.4 元人民币) , 每 100 万 tokens 缓存输入费用为 0.1 美元 (现汇率约合 0.67 元人民币) , 每 100 万 tokens 输出费用为 10 美元 (现汇率约合 67.2 元人民币) 。

    推荐理由:来自IT之家 AI的《OpenAI 在 Codex 上线 GPT-6.1 Sol 模型:性能接近 Astra,价格仅为 1/5》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 30 日消息,在今天召开的 OpenAI 开发者日活动中,官方在 Codex 和 ChatGPT Work 中推出 GPT 6.1 Sol 模型,官方表示: “GPT-6.1 Sol 在处理复杂任务时,性能接近 Astra,但成本低于 Astra。” IT之家翻译官方介绍如下: GPT-6.1 Sol 在处理复杂任务时,性能接近 Astra,但成本低于 Astra。它适用于代码、应用程序和文档中重复性、长时间运行的任务。可用性取决于您的套餐、客户端和工作区设置。 定价方面,根据 @LuminaBench 透露信息: 每 100 万 tokens 输入费用为 2 美元 (IT之家注:现汇率约合 13.4 元人民币) , 每 100 万 tokens 缓存输入费用为 0.1 美元 (现汇率约合 0.67 元人民币) , 每 100 万 tokens 输出费用为 10 美元 (现汇率约合 67.2 元人民币) 。

9月29日周二
  1. IT之家 AI70

    阿里 Qoder 平台 Qwen3.8-Flash 限时免费活动延期,10 月之后继续用

    IT之家 9 月 29 日消息,根据 Qoder 官方公告,阿里 Qwen3.8-Flash 限时免费活动已延期 —— 原定 2026 年 9 月 30 日 23:59:59 结束,现改为 10 月 1 日起继续免费(结束时间未定)。 该活动自 2026 年 9 月 18 日 10:00 起面向 Qoder 新老个人用户开放。活动期间,Qwen3.8-Flash 计费系数由 0.1× 降至 0.0×,调用不消耗 Credits,自动生效,无需领取。 IT之家注:Credits 是 Qoder 平台用于模型调用的计费点数。免费账号及 Credits 余额为 0 的账号也可参与,已领取的每日 100 通用 Credits 不会被该模型扣减。 适用产品包括 Qoder、Qoder IDE、Qoder JetBrains 插件、Qoder CLI、QoderWake、Qoder Cloud Agents、Qoder Mobile 和 Q...

    推荐理由:来自IT之家 AI的《阿里 Qoder 平台 Qwen3.8-Flash 限时免费活动延期,10 月之后继续用》。重点看智能体工作流、模型能力与工程、产品发布。摘要提到:IT之家 9 月 29 日消息,根据 Qoder 官方公告,阿里 Qwen3.8-Flash 限时免费活动已延期 —— 原定 2026 年 9 月 30 日 23:59:59 结束,现改为 10 月 1 日起继续免费(结束时间未定)。 该活动自 2026 年 9 月 18 日 10:00 起面向 Qoder 新老个人用户开放。活动期间,Qwen3.8-Flash 计费系数由 0.1× 降至 0.0×,调用不消耗 Credits,自动生效,无需领取。 IT之家注:Credits 是 Qoder 平台用于模型调用的计费点数。免费账号及 Credits 余额为 0 的账号也可参与,已领取的每日 100 通用 Credits 不会被该模型扣减。 适用产品包括 Qoder、Qoder IDE、Qoder JetBrains 插件、Qoder CLI、QoderWake、Qoder Cloud Agents、Qoder Mobile 和 Q...

  2. Cloudflare AI84

    We tested our own WAF with frontier AI models. Here’s what we found

    这条英文动态主要涉及模型能力与工程。原文要点:We built a WAF tester that adapted each request based on what the WAF blocked or passed. This helped us explore variations that a fixed test might miss. We ran it across six attack categories on an authorized staging environment and discovered detection gaps worth fixing. Here’s how the loop worked, what got through, and what we did about it.

    推荐理由:来自Cloudflare AI的《We tested our own WAF with frontier AI models. Here’s what we found》。重点看模型能力与工程。摘要提到:这条英文动态主要涉及模型能力与工程。原文要点:We built a WAF tester that adapted each request based on what the WAF blocked or passed. This helped us explore variations that a fixed test might miss. We ran it across six attack categories on an authorized staging environment and discovered detection gaps worth fixing. Here’s how the loop worked, what got through, and what we did about it.

  3. 爱范儿38

    AI 圈杀出新顶流,神秘「太空兔」能用涂鸦做网站

    我又多了一个能当主力的Flash模型 #欢迎关注爱范儿官方微信公众号:爱范儿(微信号:ifanr),更多精彩内容第一时间为您奉上。 这条动态来自 爱范儿,可重点关注模型能力与工程。

    推荐理由:来自爱范儿的《AI 圈杀出新顶流,神秘「太空兔」能用涂鸦做网站》。重点看模型能力与工程。摘要提到:我又多了一个能当主力的Flash模型 #欢迎关注爱范儿官方微信公众号:爱范儿(微信号:ifanr),更多精彩内容第一时间为您奉上。 这条动态来自 爱范儿,可重点关注模型能力与工程。

  4. 爱范儿38

    苏姿丰550亿元买下李飞飞世界模型,AI 圈两位女王联手了

    算力焦虑下的双向奔赴 #欢迎关注爱范儿官方微信公众号:爱范儿(微信号:ifanr),更多精彩内容第一时间为您奉上。 这条动态来自 爱范儿,可重点关注模型能力与工程。

    推荐理由:来自爱范儿的《苏姿丰550亿元买下李飞飞世界模型,AI 圈两位女王联手了》。重点看模型能力与工程。摘要提到:算力焦虑下的双向奔赴 #欢迎关注爱范儿官方微信公众号:爱范儿(微信号:ifanr),更多精彩内容第一时间为您奉上。 这条动态来自 爱范儿,可重点关注模型能力与工程。

  5. IT之家 AI70

    OpenAI 明日重开 200 美元档 ChatGPT-Pro 订阅:API 支出减半,新增更多不计量功能

    IT之家 9 月 29 日消息,OpenAI 首席产品官 Tibo 宣布将于明天向新用户重新开放月费 200 美元的 ChatGPT Pro 订阅,同时调整该档位的用量计算方式。 按照新的计算规则,200 美元 Pro 订阅对应的 API 等效价值相比原来接近翻倍,而且 OpenAI 不会重新恢复此前的 5 小时使用限制,仅保留周额度用量管理,让用户能够在需要时集中使用额度,而不是受短时间窗口限制。 今年 9 月 11 日,由于 GPT-6 Astra 带来的算力需求激增,OpenAI 宣布暂停 200 美元 (IT之家注:现汇率约合 1,344 元人民币) Pro 订阅的新用户注册,以缓解算力压力。 OpenAI 表示,随着模型效率提升,会持续下调 API 价格,而不是人为维持较高的 API 标价,再通过打折制造“更划算”的假象。在此之前,OpenAI 已将本周新发布 GPT-6 Sol 和 GPT-6 Luna 的 API ...

    推荐理由:来自IT之家 AI的《OpenAI 明日重开 200 美元档 ChatGPT-Pro 订阅:API 支出减半,新增更多不计量功能》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 29 日消息,OpenAI 首席产品官 Tibo 宣布将于明天向新用户重新开放月费 200 美元的 ChatGPT Pro 订阅,同时调整该档位的用量计算方式。 按照新的计算规则,200 美元 Pro 订阅对应的 API 等效价值相比原来接近翻倍,而且 OpenAI 不会重新恢复此前的 5 小时使用限制,仅保留周额度用量管理,让用户能够在需要时集中使用额度,而不是受短时间窗口限制。 今年 9 月 11 日,由于 GPT-6 Astra 带来的算力需求激增,OpenAI 宣布暂停 200 美元 (IT之家注:现汇率约合 1,344 元人民币) Pro 订阅的新用户注册,以缓解算力压力。 OpenAI 表示,随着模型效率提升,会持续下调 API 价格,而不是人为维持较高的 API 标价,再通过打折制造“更划算”的假象。在此之前,OpenAI 已将本周新发布 GPT-6 Sol 和 GPT-6 Luna 的 API ...

  6. IT之家 AI68

    IDC:今年上半年全球人形机器人出货近 2.5 万台同比增长 432.1%,中国独占 1.9 万台

    IT之家 9 月 29 日消息,国际数据公司( IDC )最新发布的全球人形机器人跟踪报告显示,2026 上半年,全球人形机器人出货量接近 2.5 万台,同比增长 432.1%,产业发展进一步从技术验证向商业化应用探索阶段迈进。 IDC 预计,2030 年全球人形机器人出货量将超过 75 万台,市场将进入规模化应用加速发展阶段。 2026 年以来,全球人形机器人市场延续高速增长态势,产业发展进一步从技术验证迈向商业化应用探索。IDC 数据显示,2026 年上半年, 全球人形机器人出货量近 2.5 万台,同比增长 432.1% ;市场规模超过 7.4 亿美元,同比增长 322.7% 。 市场高速增长的同时,人形机器人产业的供需两端也正在发生积极变化:一方面,工业、物流等应用探索持续加速,头部厂商不断扩充生产能力;另一方面,中国市场开始出现面向个人消费者的小型人形机器人,家庭及个人市场逐步成为新的潜在增长空间。 此外,具身智能大模型...

    推荐理由:来自IT之家 AI的《IDC:今年上半年全球人形机器人出货近 2.5 万台同比增长 432.1%,中国独占 1.9 万台》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 29 日消息,国际数据公司( IDC )最新发布的全球人形机器人跟踪报告显示,2026 上半年,全球人形机器人出货量接近 2.5 万台,同比增长 432.1%,产业发展进一步从技术验证向商业化应用探索阶段迈进。 IDC 预计,2030 年全球人形机器人出货量将超过 75 万台,市场将进入规模化应用加速发展阶段。 2026 年以来,全球人形机器人市场延续高速增长态势,产业发展进一步从技术验证迈向商业化应用探索。IDC 数据显示,2026 年上半年, 全球人形机器人出货量近 2.5 万台,同比增长 432.1% ;市场规模超过 7.4 亿美元,同比增长 322.7% 。 市场高速增长的同时,人形机器人产业的供需两端也正在发生积极变化:一方面,工业、物流等应用探索持续加速,头部厂商不断扩充生产能力;另一方面,中国市场开始出现面向个人消费者的小型人形机器人,家庭及个人市场逐步成为新的潜在增长空间。 此外,具身智能大模型...

  7. IT之家 AI74

    AI 写作特征减少:Claude Opus 5.5 破折号使用量下降约 95%、分号下降 73%

    IT之家 9 月 29 日消息,@arena 于 9 月 26 日在 X 平台发布推文,通过写作指标测试,发现相比较 Opus 5 模型, Anthropic 的 Claude Opus 5.5 破折号使用量下降约 95%,每 1,000 个单词从 15.2 个降至 0.8 个。 IT之家附上相关截图如下: Arena 分析了 2026 年 8 月和 9 月的 Text Arena 高推理回复。结果显示,12 项写作指标中有 10 项朝 Arena 认定的改善方向变化。 其中最为明显的是大幅减少使用破折号,Claude Opus 5 每 1,000 个单词使用 15.2 个破折号。Opus 5.5 的使用量降至 0.8 个,较前代减少约 95%。 分号使用量也同步下降。Claude Opus 5 每 1,000 个单词使用 6.10 个分号。Opus 5.5 降至 1.64 个,降幅为 73%,显示模型减少了部分容易被识别的标点...

    推荐理由:来自IT之家 AI的《AI 写作特征减少:Claude Opus 5.5 破折号使用量下降约 95%、分号下降 73%》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 29 日消息,@arena 于 9 月 26 日在 X 平台发布推文,通过写作指标测试,发现相比较 Opus 5 模型, Anthropic 的 Claude Opus 5.5 破折号使用量下降约 95%,每 1,000 个单词从 15.2 个降至 0.8 个。 IT之家附上相关截图如下: Arena 分析了 2026 年 8 月和 9 月的 Text Arena 高推理回复。结果显示,12 项写作指标中有 10 项朝 Arena 认定的改善方向变化。 其中最为明显的是大幅减少使用破折号,Claude Opus 5 每 1,000 个单词使用 15.2 个破折号。Opus 5.5 的使用量降至 0.8 个,较前代减少约 95%。 分号使用量也同步下降。Claude Opus 5 每 1,000 个单词使用 6.10 个分号。Opus 5.5 降至 1.64 个,降幅为 73%,显示模型减少了部分容易被识别的标点...

  8. IT之家 AI74

    Anthropic 发布 Claude Sonnet 5.5:速度提升 30%,智能体编码性能反超 Opus 5.5

    IT之家 9 月 29 日消息,随着 AI 模型竞赛持续升温,Anthropic 推出了旗下中端模型 Sonnet 的最新版本。该公司表示,新版模型运行速度会快得多,使用成本也较上一代大幅降低。 IT之家注意到,这家实验室将 Sonnet 5.5 定位为日常任务的理想助手,适用场景包括编写代码以及制作办公文档。 Sonnet 5.5 的上一代产品 Sonnet 5 是大约三个月前发布的。当时这款模型的主打优势是智能体的高效部署,也就是运行智能体的成本低于竞品。 而 5.5 版本的核心亮点在于速度。Anthropic 称,Sonnet 5.5 的速度比上一代提升 30%,词元(Token)消耗速度也明显更低。 在 Anthropic 的模型产品序列当中,Sonnet 的性能弱于 Opus 模型,但凭借反应灵活的特点,在部分场景下反而更加实用。尤其是 Anthropic 的基准测试结果显示,Sonnet 5.5 在智能体编码任务上的...

    推荐理由:来自IT之家 AI的《Anthropic 发布 Claude Sonnet 5.5:速度提升 30%,智能体编码性能反超 Opus 5.5》。重点看智能体工作流、模型能力与工程、评测与基准。摘要提到:IT之家 9 月 29 日消息,随着 AI 模型竞赛持续升温,Anthropic 推出了旗下中端模型 Sonnet 的最新版本。该公司表示,新版模型运行速度会快得多,使用成本也较上一代大幅降低。 IT之家注意到,这家实验室将 Sonnet 5.5 定位为日常任务的理想助手,适用场景包括编写代码以及制作办公文档。 Sonnet 5.5 的上一代产品 Sonnet 5 是大约三个月前发布的。当时这款模型的主打优势是智能体的高效部署,也就是运行智能体的成本低于竞品。 而 5.5 版本的核心亮点在于速度。Anthropic 称,Sonnet 5.5 的速度比上一代提升 30%,词元(Token)消耗速度也明显更低。 在 Anthropic 的模型产品序列当中,Sonnet 的性能弱于 Opus 模型,但凭借反应灵活的特点,在部分场景下反而更加实用。尤其是 Anthropic 的基准测试结果显示,Sonnet 5.5 在智能体编码任务上的...

  9. OpenAI News80

    Towards safety cases for frontier AI training

    这条英文动态主要涉及模型能力与工程。原文要点:Our early guidelines for safety cases in frontier AI training cover technical safeguards, operational practices, and investigating misalignment incidents

    推荐理由:来自OpenAI News的《Towards safety cases for frontier AI training》。重点看模型能力与工程。摘要提到:这条英文动态主要涉及模型能力与工程。原文要点:Our early guidelines for safety cases in frontier AI training cover technical safeguards, operational practices, and investigating misalignment incidents

9月28日周一
  1. Cloudflare AI51

    Next.js applications, powered by Vite: introducing Vinext 1.0

    这条英文动态主要涉及产品发布。原文要点:Vinext 1.0 graduates from an AI experiment to a production-ready framework, letting developers run Next.js apps on Vite. This release brings advanced cache warming, broader compatibility, and an automated testing pipeline.

    推荐理由:来自Cloudflare AI的《Next.js applications, powered by Vite: introducing Vinext 1.0》。重点看产品发布。摘要提到:这条英文动态主要涉及产品发布。原文要点:Vinext 1.0 graduates from an AI experiment to a production-ready framework, letting developers run Next.js apps on Vite. This release brings advanced cache warming, broader compatibility, and an automated testing pipeline.

  2. IT之家 AI68

    ACEMAGIC 推出全球首款锐龙 AI Max+ PRO 495 处理器的 AI 迷你工作站,6499 美元

    IT之家 9 月 28 日消息,ACEMAGIC 今天宣布推出 F9A 迷你主机,这是全球首款搭载锐龙 AI Max+ 495 处理器的 AI 工作站, 配备 192GB 内存和 2TB 硬盘 ,定价 6,499 美元 (IT之家注:现汇率约合 43,670 元人民币) 。 据介绍,这款工作站采用铝合金机身,两侧带有散热开孔。整机尺寸仅 158.5*158.5*81.5mm,重量 1.4kg,面向 AI 开发者、专业创作者等群体。 规格方面,这款工作站配备 192GB LPDDR5X-8533 统一内存,最高可将 160GB 分配给显存,本地运行大语言模型。该机配备两个 M.2 2280 NVMe PCIe 4.0x4 SSD 插槽,最高支持扩展 8TB 存储空间。 此外,该机还将配备 USB4、DP、OCuLink、HDMI、USB-A、2.5GbE 等接口,支持 Wi-Fi7 和蓝牙 5.4。

    推荐理由:来自IT之家 AI的《ACEMAGIC 推出全球首款锐龙 AI Max+ PRO 495 处理器的 AI 迷你工作站,6499 美元》。重点看模型能力与工程。摘要提到:IT之家 9 月 28 日消息,ACEMAGIC 今天宣布推出 F9A 迷你主机,这是全球首款搭载锐龙 AI Max+ 495 处理器的 AI 工作站, 配备 192GB 内存和 2TB 硬盘 ,定价 6,499 美元 (IT之家注:现汇率约合 43,670 元人民币) 。 据介绍,这款工作站采用铝合金机身,两侧带有散热开孔。整机尺寸仅 158.5*158.5*81.5mm,重量 1.4kg,面向 AI 开发者、专业创作者等群体。 规格方面,这款工作站配备 192GB LPDDR5X-8533 统一内存,最高可将 160GB 分配给显存,本地运行大语言模型。该机配备两个 M.2 2280 NVMe PCIe 4.0x4 SSD 插槽,最高支持扩展 8TB 存储空间。 此外,该机还将配备 USB4、DP、OCuLink、HDMI、USB-A、2.5GbE 等接口,支持 Wi-Fi7 和蓝牙 5.4。