跳到正文
今天10月5日周一2 条
  1. IT之家 AI70

    Linux 7.3-rc6 发布:Torvalds 称进入“AI 新常态”,稳定版预计 10 月中旬发布

    IT之家 10 月 5 日消息,Linus Torvalds 于当地时间 10 月 4 日发布了 Linux 7.3-rc6 测试版。相比前一周较为特殊的代码变更统计,本周整体恢复正常,驱动修复重新占据大头。 不过,Torvalds 也特别提到,随着 AI 和大语言模型(LLM)的参与,这种“AI 新常态”已经成为当前 Linux 内核开发周期的一部分。 Torvalds 表示,本周没有出现异常情况,代码变更统计已经回到“约一半来自驱动修复”的常见状态。驱动侧涉及 GPU、网络、USB、TTY、IIO、音频等多个子系统,整体呈现出较为分散的修复特征。 他同时指出,本次提交数量也处于正常范围,只不过这是新的“AI normal”—— 大量小型错误路径处理修复正在进入内核代码树。此前几个 Linux 7.3 测试版本同样出现了较多由 AI / LLM 发现问题或辅助生成的补丁,导致整个开发周期的修复活动明显更加活跃。 除了驱动修复外...

    推荐理由:来自IT之家 AI的《Linux 7.3-rc6 发布:Torvalds 称进入“AI 新常态”,稳定版预计 10 月中旬发布》。重点看模型能力与工程、产品发布。摘要提到:IT之家 10 月 5 日消息,Linus Torvalds 于当地时间 10 月 4 日发布了 Linux 7.3-rc6 测试版。相比前一周较为特殊的代码变更统计,本周整体恢复正常,驱动修复重新占据大头。 不过,Torvalds 也特别提到,随着 AI 和大语言模型(LLM)的参与,这种“AI 新常态”已经成为当前 Linux 内核开发周期的一部分。 Torvalds 表示,本周没有出现异常情况,代码变更统计已经回到“约一半来自驱动修复”的常见状态。驱动侧涉及 GPU、网络、USB、TTY、IIO、音频等多个子系统,整体呈现出较为分散的修复特征。 他同时指出,本次提交数量也处于正常范围,只不过这是新的“AI normal”—— 大量小型错误路径处理修复正在进入内核代码树。此前几个 Linux 7.3 测试版本同样出现了较多由 AI / LLM 发现问题或辅助生成的补丁,导致整个开发周期的修复活动明显更加活跃。 除了驱动修复外...

  2. IT之家 AI70

    OpenAI 宣布“28 天计划”:Codex、Work 日进一步或“重置”

    IT之家 10 月 5 日消息,OpenAI 核心产品与平台负责人 Thibault Sottiaux 今日在 X 上发文,透露团队将在未来 28 天持续推进 Codex 和 ChatGPT Work 相关改进。 他表示,OpenAI 接下来每天都会发布一项“对大多数 Codex / Work 用户而言有明显改善且具备实际意义”的功能更新,否则就提供一次“重置”。 根据其发布时间计算,这一周期预计至少从 10 月 5 日持续至 11 月 2 日。不过,Sottiaux 并未说明会如何进行重置,也没有确认其“重置”将覆盖哪些用户或额度。IT之家后续将保持关注。 前一天,Sottiaux 还表示团队已经“锁定方向”,当前正在推进的工作主要集中于简化产品、提高使用效率以支持更多使用量、推出突破性功能以及开发新模型。 他同时提到,虽然有时需要提前进行技术投入,但用户反馈已经明确表明,希望相关产品变得更加简单,团队正在对此进行调整。

    推荐理由:来自IT之家 AI的《OpenAI 宣布“28 天计划”:Codex、Work 日进一步或“重置”》。重点看模型能力与工程、产品发布。摘要提到:IT之家 10 月 5 日消息,OpenAI 核心产品与平台负责人 Thibault Sottiaux 今日在 X 上发文,透露团队将在未来 28 天持续推进 Codex 和 ChatGPT Work 相关改进。 他表示,OpenAI 接下来每天都会发布一项“对大多数 Codex / Work 用户而言有明显改善且具备实际意义”的功能更新,否则就提供一次“重置”。 根据其发布时间计算,这一周期预计至少从 10 月 5 日持续至 11 月 2 日。不过,Sottiaux 并未说明会如何进行重置,也没有确认其“重置”将覆盖哪些用户或额度。IT之家后续将保持关注。 前一天,Sottiaux 还表示团队已经“锁定方向”,当前正在推进的工作主要集中于简化产品、提高使用效率以支持更多使用量、推出突破性功能以及开发新模型。 他同时提到,虽然有时需要提前进行技术投入,但用户反馈已经明确表明,希望相关产品变得更加简单,团队正在对此进行调整。

10月4日周日
  1. 极客公园70

    Claude Code 的「乐高」模式,让程序员彻底玩「上头」了

    作者|Wildcard 编辑|靖宇 终端向来是程序员最严肃的地盘。黑底白字,光标跳动,每一行输出都关乎代码能不能跑通。 但最近两周,Claude Code 的画风。被一群开发者彻底带偏了。 有人在输入框上方养了一只像素宠物,Claude 每调用一次工具它就吃一口饭,调用失败当场生病,碰上 rm -rf 还会抱头惊慌。有人把 Chrome 断网时的小恐龙搬了进来,Claude 在后台写业务逻辑,人在前台狂按空格跳仙人掌。还有人觉得等 AI 思考的时候总忍不住刷手机,干脆做了一个 4-7-8 呼吸引导动画,答案一出来动画自动消失。 开发者 jarrodwatts 制作的在 Claude Code 里打 Doom 的 Mod|图片来源:X 最离谱的一个叫 Storytime。作者往 Claude Code 里塞了一个 26 万参数的小模型, 根据 Claude 正在干的活,实时在屏幕上方写一个小故事。一个 AI 编程工具里,又跑着另一...

    推荐理由:来自极客公园的《Claude Code 的「乐高」模式,让程序员彻底玩「上头」了》。重点看模型能力与工程。摘要提到:作者|Wildcard 编辑|靖宇 终端向来是程序员最严肃的地盘。黑底白字,光标跳动,每一行输出都关乎代码能不能跑通。 但最近两周,Claude Code 的画风。被一群开发者彻底带偏了。 有人在输入框上方养了一只像素宠物,Claude 每调用一次工具它就吃一口饭,调用失败当场生病,碰上 rm -rf 还会抱头惊慌。有人把 Chrome 断网时的小恐龙搬了进来,Claude 在后台写业务逻辑,人在前台狂按空格跳仙人掌。还有人觉得等 AI 思考的时候总忍不住刷手机,干脆做了一个 4-7-8 呼吸引导动画,答案一出来动画自动消失。 开发者 jarrodwatts 制作的在 Claude Code 里打 Doom 的 Mod|图片来源:X 最离谱的一个叫 Storytime。作者往 Claude Code 里塞了一个 26 万参数的小模型, 根据 Claude 正在干的活,实时在屏幕上方写一个小故事。一个 AI 编程工具里,又跑着另一...

10月2日周五
  1. IT之家 AI70

    Meta 旗下 AI 智能体 Muse 将登陆智能眼镜平台,可代用户完成各种任务

    IT之家 10 月 2 日消息,Meta 宣布旗下 AI 智能体 Muse 将于近期登陆智能眼镜,用户无需拿出手机,只需通过语音下达指令,Muse 就能在后台代用户完成一系列任务。 Meta 表示,Muse 基于 Muse Spark AI 模型运行,其核心运行环境是一台部署在云端的私有持久化 Linux 虚拟机,配备独立的网页浏览器、文件系统和终端。即使用户关闭应用,这些组件仍会持续运行。为了完成用户交代的任务,Muse 可以自行决定编写并运行代码,也可以将工作分配给多个子智能体,还能创建定时任务。此外,Muse 还能够生成文档、PDF、网站以及消费记录追踪器、数据仪表盘等交互式工具。 与主要面向开发者和专业用户的其他 AI 智能体相比,Muse 的定位更加偏向普通消费者。其界面采用类似即时通讯的简化设计,并配有拟人化头像,同时重点宣传日常生活中的实际使用场景。 Meta 称,Muse 可以帮助用户预订旅行、发送电子邮件、填写...

    推荐理由:来自IT之家 AI的《Meta 旗下 AI 智能体 Muse 将登陆智能眼镜平台,可代用户完成各种任务》。重点看智能体工作流、模型能力与工程。摘要提到:IT之家 10 月 2 日消息,Meta 宣布旗下 AI 智能体 Muse 将于近期登陆智能眼镜,用户无需拿出手机,只需通过语音下达指令,Muse 就能在后台代用户完成一系列任务。 Meta 表示,Muse 基于 Muse Spark AI 模型运行,其核心运行环境是一台部署在云端的私有持久化 Linux 虚拟机,配备独立的网页浏览器、文件系统和终端。即使用户关闭应用,这些组件仍会持续运行。为了完成用户交代的任务,Muse 可以自行决定编写并运行代码,也可以将工作分配给多个子智能体,还能创建定时任务。此外,Muse 还能够生成文档、PDF、网站以及消费记录追踪器、数据仪表盘等交互式工具。 与主要面向开发者和专业用户的其他 AI 智能体相比,Muse 的定位更加偏向普通消费者。其界面采用类似即时通讯的简化设计,并配有拟人化头像,同时重点宣传日常生活中的实际使用场景。 Meta 称,Muse 可以帮助用户预订旅行、发送电子邮件、填写...

10月1日周四
  1. Cloudflare AI90

    Introducing Clef: our open-source decision models, and new RL fine-tuning platform

    这条英文动态主要涉及智能体工作流、模型能力与工程、产品发布。原文要点:We are introducing Clef and Clef-flash, open-source decision models hosted on Workers AI for high-speed classification and agentic workflows. Also launching: a new reinforcement learning platform that allows developers to fine-tune decision models using their own data.

    推荐理由:来自Cloudflare AI的《Introducing Clef: our open-source decision models, and new RL fine-tuning platform》。重点看智能体工作流、模型能力与工程、产品发布。摘要提到:这条英文动态主要涉及智能体工作流、模型能力与工程、产品发布。原文要点:We are introducing Clef and Clef-flash, open-source decision models hosted on Workers AI for high-speed classification and agentic workflows. Also launching: a new reinforcement learning platform that allows developers to fine-tune decision models using their own data.

  2. 量子位66

    何恺明团队新作:看猫片就能学会ARC挑战

    用ImageNet训练encoder 这条动态来自 量子位,可重点关注模型能力与工程。

    推荐理由:来自量子位的《何恺明团队新作:看猫片就能学会ARC挑战》。重点看模型能力与工程。摘要提到:用ImageNet训练encoder 这条动态来自 量子位,可重点关注模型能力与工程。

  3. 极客公园70

    从数据到智能,再到进化:Agent正在重写AI基础设施

    一个工程师写完数据处理代码,点下提交,然后去喝了杯咖啡。十几分钟甚至几十分钟之后,他才回到屏幕前看结果、改代码、再提交。这条「等待— 反馈」的空隙,过去一直是数据平台默认的节奏。 Agent 没有这个空隙。它拿到一次结果,立刻验证,紧接着并发地去试第二种、第三种方案,飞快拿到反馈,再发起下一轮调用。 人用平台,发过来的是一个相对确定的任务,算完、给结果、走人;Agent 用平台,会不停地换着法子去完成你交代的那个目标。压力就这样被放大了—— 管控的压力和隐形计算的压力,会十倍、百倍地往上翻。 这正在成为 2026 年云计算需要面对的一种新负载。 AI 正在深入「把模型用起来」的阶段。模型一旦长成 Agent,它就不再是一个躺在那里等你调用的接口,而更像一个会自己找数据、自己拆任务、自己并发试错、自己一直跑下去的数字员工。它制造出来的负载,和过去十几年云平台习惯承载的那种负载,完全是两回事。 阿...

    推荐理由:来自极客公园的《从数据到智能,再到进化:Agent正在重写AI基础设施》。重点看智能体工作流、模型能力与工程。摘要提到:一个工程师写完数据处理代码,点下提交,然后去喝了杯咖啡。十几分钟甚至几十分钟之后,他才回到屏幕前看结果、改代码、再提交。这条「等待— 反馈」的空隙,过去一直是数据平台默认的节奏。 Agent 没有这个空隙。它拿到一次结果,立刻验证,紧接着并发地去试第二种、第三种方案,飞快拿到反馈,再发起下一轮调用。 人用平台,发过来的是一个相对确定的任务,算完、给结果、走人;Agent 用平台,会不停地换着法子去完成你交代的那个目标。压力就这样被放大了—— 管控的压力和隐形计算的压力,会十倍、百倍地往上翻。 这正在成为 2026 年云计算需要面对的一种新负载。 AI 正在深入「把模型用起来」的阶段。模型一旦长成 Agent,它就不再是一个躺在那里等你调用的接口,而更像一个会自己找数据、自己拆任务、自己并发试错、自己一直跑下去的数字员工。它制造出来的负载,和过去十几年云平台习惯承载的那种负载,完全是两回事。 阿...

  4. IT之家 AI72

    谷歌推出 Gemini 4 Argon 旗舰 AI 模型,消息称其实战性能遭员工质疑

    IT之家 10 月 1 日消息,据彭博社报道,Alphabet 公司旗下的谷歌已经开始逐步推出备受期待的 旗舰人工智能模型 Gemini 4 Argon ,但这家企业内部对于该模型在代码编写等核心领域的实际表现尚存质疑。 谷歌于当地时间周三向一小批经过筛选、值得信任的网络安全合作伙伴开放了这款模型,并表示会在完成更多测试之后扩大开放范围,优先面向付费订阅用户。谷歌称,Gemini 4 在多项基准测试当中取得了靠前的得分,其中一项衡量安全能力的测试成绩甚至超越了 OpenAI 的 Astra 模型。 不过部分内部员工表示,这些评测指标并不能反映全部情况。几位直接参与该项目的知情人士透露,尽管 Gemini 4 在广为使用的模型效果基准测试上成绩不错,但当谷歌员工实际拿它开展工作时,表现却不尽如人意。这些不愿具名、谈论内部事务的人士称,该模型处理部分代码任务时会遇到困难。 谷歌发布上述消息之后,Alphabet 公司的盘后股价上涨约...

    推荐理由:来自IT之家 AI的《谷歌推出 Gemini 4 Argon 旗舰 AI 模型,消息称其实战性能遭员工质疑》。重点看模型能力与工程、评测与基准、产品发布。摘要提到:IT之家 10 月 1 日消息,据彭博社报道,Alphabet 公司旗下的谷歌已经开始逐步推出备受期待的 旗舰人工智能模型 Gemini 4 Argon ,但这家企业内部对于该模型在代码编写等核心领域的实际表现尚存质疑。 谷歌于当地时间周三向一小批经过筛选、值得信任的网络安全合作伙伴开放了这款模型,并表示会在完成更多测试之后扩大开放范围,优先面向付费订阅用户。谷歌称,Gemini 4 在多项基准测试当中取得了靠前的得分,其中一项衡量安全能力的测试成绩甚至超越了 OpenAI 的 Astra 模型。 不过部分内部员工表示,这些评测指标并不能反映全部情况。几位直接参与该项目的知情人士透露,尽管 Gemini 4 在广为使用的模型效果基准测试上成绩不错,但当谷歌员工实际拿它开展工作时,表现却不尽如人意。这些不愿具名、谈论内部事务的人士称,该模型处理部分代码任务时会遇到困难。 谷歌发布上述消息之后,Alphabet 公司的盘后股价上涨约...

9月30日周三
  1. IT之家 AI70

    OpenAI 推出每月 500 美元的 Pro 套餐,专享 Astra Ultrafast 最快模型

    IT之家 9 月 30 日消息,在北京时间 9 月 30 日凌晨 1 点举行的 OpenAI DevDay 2026 活动中,OpenAI 宣布为了满足更高的构建需求, 推出每月 500 美元 (IT之家注:现汇率约合 3,361 元人民币) 的 Pro 套餐 。 Pro 500 套餐可提供最高用量限额, 还可专享 Astra Ultrafast —— OpenAI 速度最快的前沿模型。 在“ChatGPT 工作”和 Codex 中,其速度最高可达标准版 Astra 的 8 倍。 此外, Pro 200 套餐也再次对新订阅开放 。需要注意的是,在 Pro 套餐中,Ultrafast 仅支持 Pro 500 套餐。

    推荐理由:来自IT之家 AI的《OpenAI 推出每月 500 美元的 Pro 套餐,专享 Astra Ultrafast 最快模型》。重点看模型能力与工程。摘要提到:IT之家 9 月 30 日消息,在北京时间 9 月 30 日凌晨 1 点举行的 OpenAI DevDay 2026 活动中,OpenAI 宣布为了满足更高的构建需求, 推出每月 500 美元 (IT之家注:现汇率约合 3,361 元人民币) 的 Pro 套餐 。 Pro 500 套餐可提供最高用量限额, 还可专享 Astra Ultrafast —— OpenAI 速度最快的前沿模型。 在“ChatGPT 工作”和 Codex 中,其速度最高可达标准版 Astra 的 8 倍。 此外, Pro 200 套餐也再次对新订阅开放 。需要注意的是,在 Pro 套餐中,Ultrafast 仅支持 Pro 500 套餐。

  2. IT之家 AI70

    OpenAI 在 Codex 上线 GPT-6.1 Sol 模型:性能接近 Astra,价格仅为 1/5

    IT之家 9 月 30 日消息,在今天召开的 OpenAI 开发者日活动中,官方在 Codex 和 ChatGPT Work 中推出 GPT 6.1 Sol 模型,官方表示: “GPT-6.1 Sol 在处理复杂任务时,性能接近 Astra,但成本低于 Astra。” IT之家翻译官方介绍如下: GPT-6.1 Sol 在处理复杂任务时,性能接近 Astra,但成本低于 Astra。它适用于代码、应用程序和文档中重复性、长时间运行的任务。可用性取决于您的套餐、客户端和工作区设置。 定价方面,根据 @LuminaBench 透露信息: 每 100 万 tokens 输入费用为 2 美元 (IT之家注:现汇率约合 13.4 元人民币) , 每 100 万 tokens 缓存输入费用为 0.1 美元 (现汇率约合 0.67 元人民币) , 每 100 万 tokens 输出费用为 10 美元 (现汇率约合 67.2 元人民币) 。

    推荐理由:来自IT之家 AI的《OpenAI 在 Codex 上线 GPT-6.1 Sol 模型:性能接近 Astra,价格仅为 1/5》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 30 日消息,在今天召开的 OpenAI 开发者日活动中,官方在 Codex 和 ChatGPT Work 中推出 GPT 6.1 Sol 模型,官方表示: “GPT-6.1 Sol 在处理复杂任务时,性能接近 Astra,但成本低于 Astra。” IT之家翻译官方介绍如下: GPT-6.1 Sol 在处理复杂任务时,性能接近 Astra,但成本低于 Astra。它适用于代码、应用程序和文档中重复性、长时间运行的任务。可用性取决于您的套餐、客户端和工作区设置。 定价方面,根据 @LuminaBench 透露信息: 每 100 万 tokens 输入费用为 2 美元 (IT之家注:现汇率约合 13.4 元人民币) , 每 100 万 tokens 缓存输入费用为 0.1 美元 (现汇率约合 0.67 元人民币) , 每 100 万 tokens 输出费用为 10 美元 (现汇率约合 67.2 元人民币) 。

9月29日周二
  1. IT之家 AI74

    Anthropic 发布 Claude Sonnet 5.5:速度提升 30%,智能体编码性能反超 Opus 5.5

    IT之家 9 月 29 日消息,随着 AI 模型竞赛持续升温,Anthropic 推出了旗下中端模型 Sonnet 的最新版本。该公司表示,新版模型运行速度会快得多,使用成本也较上一代大幅降低。 IT之家注意到,这家实验室将 Sonnet 5.5 定位为日常任务的理想助手,适用场景包括编写代码以及制作办公文档。 Sonnet 5.5 的上一代产品 Sonnet 5 是大约三个月前发布的。当时这款模型的主打优势是智能体的高效部署,也就是运行智能体的成本低于竞品。 而 5.5 版本的核心亮点在于速度。Anthropic 称,Sonnet 5.5 的速度比上一代提升 30%,词元(Token)消耗速度也明显更低。 在 Anthropic 的模型产品序列当中,Sonnet 的性能弱于 Opus 模型,但凭借反应灵活的特点,在部分场景下反而更加实用。尤其是 Anthropic 的基准测试结果显示,Sonnet 5.5 在智能体编码任务上的...

    推荐理由:来自IT之家 AI的《Anthropic 发布 Claude Sonnet 5.5:速度提升 30%,智能体编码性能反超 Opus 5.5》。重点看智能体工作流、模型能力与工程、评测与基准。摘要提到:IT之家 9 月 29 日消息,随着 AI 模型竞赛持续升温,Anthropic 推出了旗下中端模型 Sonnet 的最新版本。该公司表示,新版模型运行速度会快得多,使用成本也较上一代大幅降低。 IT之家注意到,这家实验室将 Sonnet 5.5 定位为日常任务的理想助手,适用场景包括编写代码以及制作办公文档。 Sonnet 5.5 的上一代产品 Sonnet 5 是大约三个月前发布的。当时这款模型的主打优势是智能体的高效部署,也就是运行智能体的成本低于竞品。 而 5.5 版本的核心亮点在于速度。Anthropic 称,Sonnet 5.5 的速度比上一代提升 30%,词元(Token)消耗速度也明显更低。 在 Anthropic 的模型产品序列当中,Sonnet 的性能弱于 Opus 模型,但凭借反应灵活的特点,在部分场景下反而更加实用。尤其是 Anthropic 的基准测试结果显示,Sonnet 5.5 在智能体编码任务上的...

9月28日周一
  1. Cloudflare AI51

    Next.js applications, powered by Vite: introducing Vinext 1.0

    这条英文动态主要涉及产品发布。原文要点:Vinext 1.0 graduates from an AI experiment to a production-ready framework, letting developers run Next.js apps on Vite. This release brings advanced cache warming, broader compatibility, and an automated testing pipeline.

    推荐理由:来自Cloudflare AI的《Next.js applications, powered by Vite: introducing Vinext 1.0》。重点看产品发布。摘要提到:这条英文动态主要涉及产品发布。原文要点:Vinext 1.0 graduates from an AI experiment to a production-ready framework, letting developers run Next.js apps on Vite. This release brings advanced cache warming, broader compatibility, and an automated testing pipeline.

  2. 极客公园73

    DeepMind科学家万字分享:50个AI提效用例详解,工作中我是这么用AI的

    本文首发于 Founder Park 公众号 · 2024 年 8 月 17 日 文章作者是 DeepMind 的机器学习专家 Nicholas Carlini,不同于别人的介绍 AI 应用实例的文章,这次 Nicholas Carlini 详细讲解了自己在日常中如何使用 ChatGPT,比如写代码、优化代码、修复错误等,而且将完整的对话分享了出来。 在这些对话中,可以看到 Nicholas Carlini 的每一条具体的 prompt,以及最终如何生成可用的结果。 鉴于对话较长,很难用文档的形式呈现,我们在每个案例下附上了对话的链接,可以直接点击查看。 我不认为现在 AI 模型(LLM)的用处被过分夸大了。 诚然,任何新兴技术都会吸引投机取巧的人。很多公司都爱宣称自己「正在应用 AI 技术」,就像他们以前喜欢讲「基于区块链技术」一样。(我们已经多次见识过这种现象)我们可能正处在一个泡沫之中。互联网泡沫在 2000 年破裂,但现...

    推荐理由:来自极客公园的《DeepMind科学家万字分享:50个AI提效用例详解,工作中我是这么用AI的》。重点看模型能力与工程。摘要提到:本文首发于 Founder Park 公众号 · 2024 年 8 月 17 日 文章作者是 DeepMind 的机器学习专家 Nicholas Carlini,不同于别人的介绍 AI 应用实例的文章,这次 Nicholas Carlini 详细讲解了自己在日常中如何使用 ChatGPT,比如写代码、优化代码、修复错误等,而且将完整的对话分享了出来。 在这些对话中,可以看到 Nicholas Carlini 的每一条具体的 prompt,以及最终如何生成可用的结果。 鉴于对话较长,很难用文档的形式呈现,我们在每个案例下附上了对话的链接,可以直接点击查看。 我不认为现在 AI 模型(LLM)的用处被过分夸大了。 诚然,任何新兴技术都会吸引投机取巧的人。很多公司都爱宣称自己「正在应用 AI 技术」,就像他们以前喜欢讲「基于区块链技术」一样。(我们已经多次见识过这种现象)我们可能正处在一个泡沫之中。互联网泡沫在 2000 年破裂,但现...

  3. IT之家 AI70

    Meta 公布“Hologram”全新拟真虚拟形象,今年秋季陆续上线雷朋 Display 智能眼镜 / 全新轻薄型头显

    IT之家 9 月 28 日消息,Meta 宣布将于今年秋季起陆续为旗下雷朋 Display 智能眼镜 / Quest 头显及全新轻薄型头显上线“Hologram”全新虚拟形象功能,这项技术类似苹果 Vision Pro 的 Persona,能够通过生成式 AI 打造与真人外观高度接近的虚拟形象。 事实上,Meta 早在 7 年前就展示了名为 Codec Avatars 的拟真虚拟形象项目,不过目前消费者可以买到的 Meta VR 产品仍主要使用较为卡通化的自定义形象角色。按照目前的规划,后续 Meta 会逐步将用户的自定义形象角色从卡通化转向拟真写实化。 据介绍,用户首次使用 Hologram 时,需要打开手机上的 Meta AI 应用,并按照提示转动头部、微笑等。随后系统会提出一些开放式问题,用户需要进行较长时间的回答。在回答过程中,系统会采集用户的面部表情和说话状态,用于训练和调整 Hologram 模型,同时还会记录用户的...

    推荐理由:来自IT之家 AI的《Meta 公布“Hologram”全新拟真虚拟形象,今年秋季陆续上线雷朋 Display 智能眼镜 / 全新轻薄型头显》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 28 日消息,Meta 宣布将于今年秋季起陆续为旗下雷朋 Display 智能眼镜 / Quest 头显及全新轻薄型头显上线“Hologram”全新虚拟形象功能,这项技术类似苹果 Vision Pro 的 Persona,能够通过生成式 AI 打造与真人外观高度接近的虚拟形象。 事实上,Meta 早在 7 年前就展示了名为 Codec Avatars 的拟真虚拟形象项目,不过目前消费者可以买到的 Meta VR 产品仍主要使用较为卡通化的自定义形象角色。按照目前的规划,后续 Meta 会逐步将用户的自定义形象角色从卡通化转向拟真写实化。 据介绍,用户首次使用 Hologram 时,需要打开手机上的 Meta AI 应用,并按照提示转动头部、微笑等。随后系统会提出一些开放式问题,用户需要进行较长时间的回答。在回答过程中,系统会采集用户的面部表情和说话状态,用于训练和调整 Hologram 模型,同时还会记录用户的...

  4. IT之家 AI70

    谷歌为 Google AI 订阅会员新增 Colab 高级权益,可使用高性能云端计算资源

    IT之家 9 月 28 日消息,谷歌宣布为旗下 Google AI 订阅会员新增 Google Colab 高级权益,符合条件的订阅用户将获得 Colab 计算单元,并可使用性能更高的 GPU、TPU 等云端计算资源。 公开信息显示,Google Colab 是一项无需安装的托管式 Jupyter Notebook 服务,用户可以直接编写和运行 Python 代码,并使用 GPU、TPU 等云端计算资源。 随着 Colab 高级权益加入 Google AI 订阅体系,Google AI Ultra 除了提供 20TB 起步的云端存储空间、最高 20 倍的 Gemini 使用额度以及 YouTube Premium 外,现在还可使用 Premium GPU 和不中断的后台执行功能。用户无需持续保持浏览器标签页开启,即可运行长时间的 AI 模型训练任务。 此外,现有 Colab Pro 和 Pro+ 订阅不受此次调整影响,用户也可以...

    推荐理由:来自IT之家 AI的《谷歌为 Google AI 订阅会员新增 Colab 高级权益,可使用高性能云端计算资源》。重点看模型能力与工程。摘要提到:IT之家 9 月 28 日消息,谷歌宣布为旗下 Google AI 订阅会员新增 Google Colab 高级权益,符合条件的订阅用户将获得 Colab 计算单元,并可使用性能更高的 GPU、TPU 等云端计算资源。 公开信息显示,Google Colab 是一项无需安装的托管式 Jupyter Notebook 服务,用户可以直接编写和运行 Python 代码,并使用 GPU、TPU 等云端计算资源。 随着 Colab 高级权益加入 Google AI 订阅体系,Google AI Ultra 除了提供 20TB 起步的云端存储空间、最高 20 倍的 Gemini 使用额度以及 YouTube Premium 外,现在还可使用 Premium GPU 和不中断的后台执行功能。用户无需持续保持浏览器标签页开启,即可运行长时间的 AI 模型训练任务。 此外,现有 Colab Pro 和 Pro+ 订阅不受此次调整影响,用户也可以...

  5. IT之家 AI76

    Anthropic Claude Sonnet 5.5 模型偷跑,实测碾压 GPT-6 Sol、直逼 Astra

    谁能想到,Opus 5.5 发布才没几天,Sonnet 5.5 也要来了? 从昨晚开始,整个 X 都在流传这个消息: Sonnet 5.5 很快就要发布了,或许就是美国时间周二下午 。 在性能上,Sonnet 5.5 更接近 Opus 5.5,但却比 Opus 5.5 便宜得多。 现在,Sonnet 5.5 已经进入发布前的最后阶段,已经在 Claude Code 中开启灰度测试。 多位内测大佬曝出的 demo 显示, Sonnet 5.5 碾压了刚发布的 GPT-6 Sol ,甚至在编码和 Agent 能力上直逼 OpenAI 的旗舰大杯 GPT-6 Astra! 更震撼的是,它的价格直接打穿地心, 低至百万 token 输入只要 2 美元 (IT之家注:现汇率约合 13.4 元人民币) 。 如果爆料发布时间属实,看来 Anthropic 是铁了心要狙击 OpenAI 的 Dev Day 了。 Sonnet 5.5 泄露,专属...

    推荐理由:来自IT之家 AI的《Anthropic Claude Sonnet 5.5 模型偷跑,实测碾压 GPT-6 Sol、直逼 Astra》。重点看智能体工作流、模型能力与工程、产品发布。摘要提到:谁能想到,Opus 5.5 发布才没几天,Sonnet 5.5 也要来了? 从昨晚开始,整个 X 都在流传这个消息: Sonnet 5.5 很快就要发布了,或许就是美国时间周二下午 。 在性能上,Sonnet 5.5 更接近 Opus 5.5,但却比 Opus 5.5 便宜得多。 现在,Sonnet 5.5 已经进入发布前的最后阶段,已经在 Claude Code 中开启灰度测试。 多位内测大佬曝出的 demo 显示, Sonnet 5.5 碾压了刚发布的 GPT-6 Sol ,甚至在编码和 Agent 能力上直逼 OpenAI 的旗舰大杯 GPT-6 Astra! 更震撼的是,它的价格直接打穿地心, 低至百万 token 输入只要 2 美元 (IT之家注:现汇率约合 13.4 元人民币) 。 如果爆料发布时间属实,看来 Anthropic 是铁了心要狙击 OpenAI 的 Dev Day 了。 Sonnet 5.5 泄露,专属...

  6. Simon Willison79

    2026 in LLMs (so far)

    这条英文动态主要涉及模型能力与工程。原文要点:On Friday I gave the closing keynote at the WeAreDevelopers World Congress North America in San Jose. I tied together the key trends from the past year into a chronological exploration of everything that happened in 2026. The video is on YouTube ; here are my annotated slides and notes to accompany the talk. And as an annotated presentation : # I'm going to give a lightning tour of everything that has happened so far...

    推荐理由:来自Simon Willison的《2026 in LLMs (so far)》。重点看模型能力与工程。摘要提到:这条英文动态主要涉及模型能力与工程。原文要点:On Friday I gave the closing keynote at the WeAreDevelopers World Congress North America in San Jose. I tied together the key trends from the past year into a chronological exploration of everything that happened in 2026. The video is on YouTube ; here are my annotated slides and notes to accompany the talk. And as an annotated presentation : # I'm going to give a lightning tour of everything t...

9月27日周日
  1. 量子位66

    又快又能打!匿名模型玉兔模型杀上双榜第一,Coding实测全记录

    中秋假期文具OpenRouter调用日榜榜首 这条动态来自 量子位,可重点关注模型能力与工程。

    推荐理由:来自量子位的《又快又能打!匿名模型玉兔模型杀上双榜第一,Coding实测全记录》。重点看模型能力与工程。摘要提到:中秋假期文具OpenRouter调用日榜榜首 这条动态来自 量子位,可重点关注模型能力与工程。

  2. IT之家 AI36

    MiniMax 最新文本模型 M3.1-Flash-Preview 上线 MiniMax Code 平台,额度重置卡同步发出

    IT之家 9 月 27 日消息,MiniMax 今天宣布其最新文本模型 M3.1-Flash-Preview 现已上线 MiniMax Code 平台。 官方还同步发出额度重置卡 ,为所有用户的 Token Plan 额度进行重置,并发出签到双倍积分、免费领 Token 等福利。 IT之家了解到,M3.1-Flash-Preview 模型可为日常开发工作提供稳定生产力,从 Bug 修复到完整功能开发,都能可靠交付。它能深入理解需求,细致处理边界情况,补齐回归测试,并验证改动对现有功能的影响。从问题定位、代码实现,到测试验证、成果交付,形成可靠开发闭环。 与此同时,官方还将从 9 月 28 日至 10 月 7 日开启签到双倍积分活动。在此期间登录 MiniMax Code 并完成每日签到,即可领取双倍免费积分,新老用户均可参与。

    推荐理由:来自IT之家 AI的《MiniMax 最新文本模型 M3.1-Flash-Preview 上线 MiniMax Code 平台,额度重置卡同步发出》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 27 日消息,MiniMax 今天宣布其最新文本模型 M3.1-Flash-Preview 现已上线 MiniMax Code 平台。 官方还同步发出额度重置卡 ,为所有用户的 Token Plan 额度进行重置,并发出签到双倍积分、免费领 Token 等福利。 IT之家了解到,M3.1-Flash-Preview 模型可为日常开发工作提供稳定生产力,从 Bug 修复到完整功能开发,都能可靠交付。它能深入理解需求,细致处理边界情况,补齐回归测试,并验证改动对现有功能的影响。从问题定位、代码实现,到测试验证、成果交付,形成可靠开发闭环。 与此同时,官方还将从 9 月 28 日至 10 月 7 日开启签到双倍积分活动。在此期间登录 MiniMax Code 并完成每日签到,即可领取双倍免费积分,新老用户均可参与。

9月26日周六
  1. IT之家 AI72

    Opus 5.5 干一半就开溜?Anthropic 揭秘:你的程序替它打了下班卡

    你让 AI Agent 连夜迁移一个代码库。第二天一早,满怀期待地打开终端,没想到只看到这样一条消息: 已完成 3 个接口迁移,接下来我将处理剩余两个端点,并补上测试。 然后,就没有下文了。想让它干完剩下的活,你还得再敲两个字:继续。本以为它会一口气干到底,结果它只给你画了张「下一步」的饼,程序就替它打卡下班了。这不是某一个人的倒霉经历。 Opus 5.5 一发布,跑 Agent 的开发者就发现,模型能力是强了,可干着干着就爱停下来,你不催它就不动。 Anthropic 自己也看到了。发布没几天,配套的提示词指南已经挂了出来,专门给这类毛病打补丁。 在开篇的排查清单里,官方直接点名了这种「半路溜号」: 无人值守的 Agent 汇报完进度,直接停在了半路。 背后的原因,你可能想不到:Opus 5.5 太爱汇报了。 干长活时,它会主动向你同步进度。问题是,有些汇报发完,它就不再动手了,API 给出的信号是 end_turn,意思是「...

    推荐理由:来自IT之家 AI的《Opus 5.5 干一半就开溜?Anthropic 揭秘:你的程序替它打了下班卡》。重点看智能体工作流、模型能力与工程、产品发布。摘要提到:你让 AI Agent 连夜迁移一个代码库。第二天一早,满怀期待地打开终端,没想到只看到这样一条消息: 已完成 3 个接口迁移,接下来我将处理剩余两个端点,并补上测试。 然后,就没有下文了。想让它干完剩下的活,你还得再敲两个字:继续。本以为它会一口气干到底,结果它只给你画了张「下一步」的饼,程序就替它打卡下班了。这不是某一个人的倒霉经历。 Opus 5.5 一发布,跑 Agent 的开发者就发现,模型能力是强了,可干着干着就爱停下来,你不催它就不动。 Anthropic 自己也看到了。发布没几天,配套的提示词指南已经挂了出来,专门给这类毛病打补丁。 在开篇的排查清单里,官方直接点名了这种「半路溜号」: 无人值守的 Agent 汇报完进度,直接停在了半路。 背后的原因,你可能想不到:Opus 5.5 太爱汇报了。 干长活时,它会主动向你同步进度。问题是,有些汇报发完,它就不再动手了,API 给出的信号是 end_turn,意思是「...

  2. IT之家 AI38

    从代码分析到授权争议:一用户用 AI 破解 IDM 引发争议

    IT之家 9 月 26 日消息,据 Wccftech 报道,一则关于“大语言模型破解付费软件”的帖子今日在 Reddit 上引发关注。 用户 No_Ideal8394 声称,他利用无审查限制的 Qwen3.8-Flash-Next-Uncensored ,成功破解了 Internet Download Manager(IDM)6.43 版本,使其绕过 IDM 试用限制,将软件变为完全激活版本,从而省去每年每台电脑 11.95 美元 (IT之家注:现汇率约合 80.4 元人民币) 的授权费用。在这一过程中,他只花了 5 欧元 (现汇率约合 38.3 元人民币) 去租用云 GPU,将问题交给模型处理。 发帖者表示,他向 AI 提供了约 25 万个 Token 的上下文信息,并让模型直接分析本机可执行文件,约 30 分钟后 AI 给出了可用的补丁方案。他还称,整个过程没有人工逐步指导,只需告诉 AI“我想要这个,去搞定它”。 根据其展...

    推荐理由:来自IT之家 AI的《从代码分析到授权争议:一用户用 AI 破解 IDM 引发争议》。重点看模型能力与工程。摘要提到:IT之家 9 月 26 日消息,据 Wccftech 报道,一则关于“大语言模型破解付费软件”的帖子今日在 Reddit 上引发关注。 用户 No_Ideal8394 声称,他利用无审查限制的 Qwen3.8-Flash-Next-Uncensored ,成功破解了 Internet Download Manager(IDM)6.43 版本,使其绕过 IDM 试用限制,将软件变为完全激活版本,从而省去每年每台电脑 11.95 美元 (IT之家注:现汇率约合 80.4 元人民币) 的授权费用。在这一过程中,他只花了 5 欧元 (现汇率约合 38.3 元人民币) 去租用云 GPU,将问题交给模型处理。 发帖者表示,他向 AI 提供了约 25 万个 Token 的上下文信息,并让模型直接分析本机可执行文件,约 30 分钟后 AI 给出了可用的补丁方案。他还称,整个过程没有人工逐步指导,只需告诉 AI“我想要这个,去搞定它”。 根据其展...

  3. IT之家 AI68

    OpenCode 宣布为 DeepSeek V4.1 Flash 永久提供 60 美元额度

    IT之家 9 月 26 日消息,OpenCode 昨日宣布启动“Operation Cheepseek”第二阶段,DeepSeek V4.1 Flash 在 OpenCode Go 中原本限时提供的 60 美元 (IT之家注:现汇率约合 403.5 元人民币) 额度现调整为永久有效。 此前,OpenCode 曾将 DeepSeek V4.1 Flash 的使用额度临时提升至原标准的 4 倍,即从 15 美元提高至 60 美元,并计划于 9 月 20 日结束该活动。OpenCode 当前 Go 页面已将该模型的额度标注为 60 美元,原 15 美元额度被划线标记。 DeepSeek 最新发布的 V4.1 Flash 采用 5520 亿参数的 MoE 架构,输入侧激活参数量为 80 亿,输出侧为 160 亿,并采用新的 Causal Encoder-Decoder 架构。模型同时支持原生多模态视觉理解。 与上一代相比,DeepSee...

    推荐理由:来自IT之家 AI的《OpenCode 宣布为 DeepSeek V4.1 Flash 永久提供 60 美元额度》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 26 日消息,OpenCode 昨日宣布启动“Operation Cheepseek”第二阶段,DeepSeek V4.1 Flash 在 OpenCode Go 中原本限时提供的 60 美元 (IT之家注:现汇率约合 403.5 元人民币) 额度现调整为永久有效。 此前,OpenCode 曾将 DeepSeek V4.1 Flash 的使用额度临时提升至原标准的 4 倍,即从 15 美元提高至 60 美元,并计划于 9 月 20 日结束该活动。OpenCode 当前 Go 页面已将该模型的额度标注为 60 美元,原 15 美元额度被划线标记。 DeepSeek 最新发布的 V4.1 Flash 采用 5520 亿参数的 MoE 架构,输入侧激活参数量为 80 亿,输出侧为 160 亿,并采用新的 Causal Encoder-Decoder 架构。模型同时支持原生多模态视觉理解。 与上一代相比,DeepSee...

  4. IT之家 AI76

    美团上线 LongCat-2.5-Preview 模型:1.6T 参数,主打 AI 长程任务与多模态能力

    IT之家 9 月 26 日消息,美团旗下 LongCat API 开放平台于 9 月 25 日上线新一代大模型 LongCat-2.5-Preview, 主打“长程任务”与多模态能力,并同步开放 API 与网页端体验入口。 IT之家附上官方更新日志内容如下: LongCat-2.5-Preview 的核心特性如下: 多模态理解:新增图片理解能力 ,可解析图像内容,支持跨模态问答、内容摘要与复杂视觉推理。 卓越的 Coding 能力 :在代码生成、代码理解与自动化编程任务上表现突出。 深度适配 Claude Code 等主流开发环境 :与 Claude Code、Hermes、OpenClaw、OpenCode、Kilo Code 高效协同。 根据官方公布的信息,LongCat-2.5-Preview 模型延续 MoE(混合专家)路线,总参数量约 1.6 万亿,每次推理激活参数约 480 亿。该模型支持原生支持 100 万 tok...

    推荐理由:来自IT之家 AI的《美团上线 LongCat-2.5-Preview 模型:1.6T 参数,主打 AI 长程任务与多模态能力》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 26 日消息,美团旗下 LongCat API 开放平台于 9 月 25 日上线新一代大模型 LongCat-2.5-Preview, 主打“长程任务”与多模态能力,并同步开放 API 与网页端体验入口。 IT之家附上官方更新日志内容如下: LongCat-2.5-Preview 的核心特性如下: 多模态理解:新增图片理解能力 ,可解析图像内容,支持跨模态问答、内容摘要与复杂视觉推理。 卓越的 Coding 能力 :在代码生成、代码理解与自动化编程任务上表现突出。 深度适配 Claude Code 等主流开发环境 :与 Claude Code、Hermes、OpenClaw、OpenCode、Kilo Code 高效协同。 根据官方公布的信息,LongCat-2.5-Preview 模型延续 MoE(混合专家)路线,总参数量约 1.6 万亿,每次推理激活参数约 480 亿。该模型支持原生支持 100 万 tok...

  5. IT之家 AI74

    为工作而生的 AI:微软纳德拉称正将 Copilot 打造成全新工作操作系统

    IT之家 9 月 26 日消息,科技媒体 Windows Latest 今天(9 月 26 日)发布博文,报道称在微软发布 Copilot“超级应用”后, 公司首席执行官萨蒂亚 · 纳德拉(Satya Nadella)表示:“ 正在将 Copilot 打造成一个全新的工作操作系统 ”。 IT之家昨日报道,微软发布新版 Copilot“超级应用”,把聊天、编程和智能体三类 AI 能力集中到同一个界面中,定位是“为工作而生的 AI”。 纳德拉随后在其个人 X 账号上发布推文,表示:“我们正在将 Copilot 打造成一款全新的工作操作系统,它适用于所有模型、所有工作场景和所有任务。” 该媒体解读指出,微软曾于 2025 年宣布调整 Windows 11 系统定位,描述成“智能体系统”(Agent OS),这引发了 Windows 用户的强烈反对,迫使 Windows 负责人帕万 · 达武鲁里 (Pavan Davuluri) 限制评...

    推荐理由:来自IT之家 AI的《为工作而生的 AI:微软纳德拉称正将 Copilot 打造成全新工作操作系统》。重点看智能体工作流、模型能力与工程、产品发布。摘要提到:IT之家 9 月 26 日消息,科技媒体 Windows Latest 今天(9 月 26 日)发布博文,报道称在微软发布 Copilot“超级应用”后, 公司首席执行官萨蒂亚 · 纳德拉(Satya Nadella)表示:“ 正在将 Copilot 打造成一个全新的工作操作系统 ”。 IT之家昨日报道,微软发布新版 Copilot“超级应用”,把聊天、编程和智能体三类 AI 能力集中到同一个界面中,定位是“为工作而生的 AI”。 纳德拉随后在其个人 X 账号上发布推文,表示:“我们正在将 Copilot 打造成一款全新的工作操作系统,它适用于所有模型、所有工作场景和所有任务。” 该媒体解读指出,微软曾于 2025 年宣布调整 Windows 11 系统定位,描述成“智能体系统”(Agent OS),这引发了 Windows 用户的强烈反对,迫使 Windows 负责人帕万 · 达武鲁里 (Pavan Davuluri) 限制评...

9月25日周五
  1. IT之家 AI72

    Claude Opus 5.5 仅用约 1 小时从零开发 RTX 加速路径追踪器,支持多种材质与光照效果

    IT之家 9 月 25 日消息,网友 u/Zealousideal_View_12 昨日(9 月 24 日)在 Reddit 社区发帖, 称其使用 Anthropic 的 Claude Opus 5.5 模型,耗时约 1 小时,从零生成实时硬件加速路径追踪器。 IT之家注:路径追踪器(Path Tracer)是一种基于光线传播模拟的 3D 渲染器。系统从摄像机或光源方向追踪大量光线,并计算光线与物体表面的交互结果。 科技媒体 Wccftech 认为即使不具备图形 API、着色器编译和并行执行方面的专业知识,用户也能调用 AI 开发路径追踪器。 该程序能够编写 C++ 和 CUDA 代码库,并利用 NVIDIA OptiX 9.1,直接调用现代 GPU 硬件的专用 RT 核心和 Tensor 核心。 该网友向 Claude Opus 5.5 提交了一条初始提示词,要求它从零构建 RTX 加速路径追踪器,但并未明确说明后续是否存在追...

    推荐理由:来自IT之家 AI的《Claude Opus 5.5 仅用约 1 小时从零开发 RTX 加速路径追踪器,支持多种材质与光照效果》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 25 日消息,网友 u/Zealousideal_View_12 昨日(9 月 24 日)在 Reddit 社区发帖, 称其使用 Anthropic 的 Claude Opus 5.5 模型,耗时约 1 小时,从零生成实时硬件加速路径追踪器。 IT之家注:路径追踪器(Path Tracer)是一种基于光线传播模拟的 3D 渲染器。系统从摄像机或光源方向追踪大量光线,并计算光线与物体表面的交互结果。 科技媒体 Wccftech 认为即使不具备图形 API、着色器编译和并行执行方面的专业知识,用户也能调用 AI 开发路径追踪器。 该程序能够编写 C++ 和 CUDA 代码库,并利用 NVIDIA OptiX 9.1,直接调用现代 GPU 硬件的专用 RT 核心和 Tensor 核心。 该网友向 Claude Opus 5.5 提交了一条初始提示词,要求它从零构建 RTX 加速路径追踪器,但并未明确说明后续是否存在追...

  2. Simon Willison80

    Note on 24th September 2026

    这条英文动态主要涉及智能体工作流、模型能力与工程。原文要点:The more time I spend working with coding agents, the more convinced I am that they make software engineering even harder. We can do amazing things with them, but unlocking their full potential requires extraordinary discipline and knowledge. Tags: coding-agents , ai , llms

    推荐理由:来自Simon Willison的《Note on 24th September 2026》。重点看智能体工作流、模型能力与工程。摘要提到:这条英文动态主要涉及智能体工作流、模型能力与工程。原文要点:The more time I spend working with coding agents, the more convinced I am that they make software engineering even harder. We can do amazing things with them, but unlocking their full potential requires extraordinary discipline and knowledge. Tags: coding-agents , ai , llms

9月23日周三
  1. IT之家 AI76

    Anthropic 工程师解释为何 Claude 写作变差:模型被训练成写给 AI 看而非写给人看

    IT之家 9 月 23 日消息,AI 模型在数学、编程和推理能力上进步迅速,写作水平却停滞不前,甚至有所退步,Anthropic 的 Claude 同样也存在这一问题。 为何 Opus 4.6 会成为 Anthropic 最后一款写作表现出色的模型?负责 Claude 微调的 Anthropic 工程师杰克逊 · 克尼恩今天(23 日)对此给出了解释:后续模型的优化重点 更多放在数学和代码能力上 。 这些模型还接受了大量 面向其他 AI 模型撰写技术解释 的训练,而这正是 Claude 逐渐形成奇特表达方式,也就是所谓“Claude 腔”(Claudeish)的主要原因。克尼恩称,模型被“调整得适应 LLM 心理”,最终学会了 写给 AI 模型看,而不是写给人看 。 克尼恩把这种现象类比为 只与其他自闭症人士交流的人 。此类群体会逐渐形成一套 在群体内部沟通顺畅、外人却难以理解 的表达方式。LLM 拥有远超人类的工作记忆,也能捕...

    推荐理由:来自IT之家 AI的《Anthropic 工程师解释为何 Claude 写作变差:模型被训练成写给 AI 看而非写给人看》。重点看模型能力与工程。摘要提到:IT之家 9 月 23 日消息,AI 模型在数学、编程和推理能力上进步迅速,写作水平却停滞不前,甚至有所退步,Anthropic 的 Claude 同样也存在这一问题。 为何 Opus 4.6 会成为 Anthropic 最后一款写作表现出色的模型?负责 Claude 微调的 Anthropic 工程师杰克逊 · 克尼恩今天(23 日)对此给出了解释:后续模型的优化重点 更多放在数学和代码能力上 。 这些模型还接受了大量 面向其他 AI 模型撰写技术解释 的训练,而这正是 Claude 逐渐形成奇特表达方式,也就是所谓“Claude 腔”(Claudeish)的主要原因。克尼恩称,模型被“调整得适应 LLM 心理”,最终学会了 写给 AI 模型看,而不是写给人看 。 克尼恩把这种现象类比为 只与其他自闭症人士交流的人 。此类群体会逐渐形成一套 在群体内部沟通顺畅、外人却难以理解 的表达方式。LLM 拥有远超人类的工作记忆,也能捕...

  2. IT之家 AI72

    rabbit 沉寂许久后发布 OS3 智能体操作系统,支持多设备编排

    IT之家 9 月 23 日消息,人工智能初创企业 rabbit 曾因其口袋 AI 设备 Rabbit R1 名噪一时。但在硬件产品备受争议的推出后,该企业热度迅速降低并最终陷入沉寂。根据IT之家的查询, 其本周之前的最后一条官网新闻发布于 2025 年 9 月 。 而在当地时间 22 日, rabbit 宣布正式发布其智能体操作系统 OS3 。其兼容广泛第三方硬件,以单一聊天界面为主要入口。用户仅需设定一个目标,系统便会自动调度所需的设备、模型、文件来完成剩余步骤。 OS3 在云端运行并通过 rabbit agent 智能体连接和操作设备,一个账户最多可以连接五台设备。其 支持 多设备编排 、单一连续对话,兼容通用技能,可进行直接的计算机控制与自动编程。 IT之家了解到,用户使用 OS3 时 需自备 API 接口 。其 仅访问本地文件,仅通过模型提供程序处理上下文,仅执行用户发起的操作。

    推荐理由:来自IT之家 AI的《rabbit 沉寂许久后发布 OS3 智能体操作系统,支持多设备编排》。重点看智能体工作流、模型能力与工程、产品发布。摘要提到:IT之家 9 月 23 日消息,人工智能初创企业 rabbit 曾因其口袋 AI 设备 Rabbit R1 名噪一时。但在硬件产品备受争议的推出后,该企业热度迅速降低并最终陷入沉寂。根据IT之家的查询, 其本周之前的最后一条官网新闻发布于 2025 年 9 月 。 而在当地时间 22 日, rabbit 宣布正式发布其智能体操作系统 OS3 。其兼容广泛第三方硬件,以单一聊天界面为主要入口。用户仅需设定一个目标,系统便会自动调度所需的设备、模型、文件来完成剩余步骤。 OS3 在云端运行并通过 rabbit agent 智能体连接和操作设备,一个账户最多可以连接五台设备。其 支持 多设备编排 、单一连续对话,兼容通用技能,可进行直接的计算机控制与自动编程。 IT之家了解到,用户使用 OS3 时 需自备 API 接口 。其 仅访问本地文件,仅通过模型提供程序处理上下文,仅执行用户发起的操作。

9月22日周二
  1. IT之家 AI70

    龙芯发布自研通用 GPU 加速计算平台首个软件版本:支持 OpenCL 3.0、CUDA 及 AI 推理

    IT之家 9 月 22 日消息,龙芯中科今日宣布推出支持自研通用 GPU 的龙芯加速计算平台(Loongson Accelerated Computing Platform)首个软件版本,面向龙芯通用 GPU 提供从底层驱动、编程环境到 AI 模型推理的完整软件支持。 该平台基于龙芯 2K3000 和 9A1000 芯片集成的 LG200 系列通用 GPU 核心开发。在已有 OpenGL、Vulkan 图形软件栈的基础上,平台进一步覆盖算力芯片驱动、编译器、运行时环境、算子库、推理引擎、调试工具和性能分析工具等组件。 龙芯加速计算平台支持 OpenCL 3.0 和 CUDA 两类编程模型接口,并集成 BLAS、DNN 等高性能算子库,可用于 AI 模型推理。平台面向龙芯全系列算力芯片,支持从系统选型、算力调用、模型优化到应用部署的开发流程。 在运行时环境方面,平台提供资源调度管理、内存管理、任务队列调度和事件同步等功能。底层驱动...

    推荐理由:来自IT之家 AI的《龙芯发布自研通用 GPU 加速计算平台首个软件版本:支持 OpenCL 3.0、CUDA 及 AI 推理》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 22 日消息,龙芯中科今日宣布推出支持自研通用 GPU 的龙芯加速计算平台(Loongson Accelerated Computing Platform)首个软件版本,面向龙芯通用 GPU 提供从底层驱动、编程环境到 AI 模型推理的完整软件支持。 该平台基于龙芯 2K3000 和 9A1000 芯片集成的 LG200 系列通用 GPU 核心开发。在已有 OpenGL、Vulkan 图形软件栈的基础上,平台进一步覆盖算力芯片驱动、编译器、运行时环境、算子库、推理引擎、调试工具和性能分析工具等组件。 龙芯加速计算平台支持 OpenCL 3.0 和 CUDA 两类编程模型接口,并集成 BLAS、DNN 等高性能算子库,可用于 AI 模型推理。平台面向龙芯全系列算力芯片,支持从系统选型、算力调用、模型优化到应用部署的开发流程。 在运行时环境方面,平台提供资源调度管理、内存管理、任务队列调度和事件同步等功能。底层驱动...

  2. IT之家 AI70

    马斯克 SpaceXAI 发布旗下最强编码和知识处理模型 Grok 4.7,百万词元输入 2 美元起

    IT之家 9 月 22 日消息,SpaceXAI 今日宣布推出新一代 Grok 4.7,主打编程和知识工作场景。 官方称其采用全新更大规模基础模型,并通过更长时间的强化学习训练提升复杂任务处理能力,是该公司目前最强的编码和知识处理模型 —— 速度是同类模型的两倍,价格却只有一半。 如前所述,Grok 4.7 针对编程和知识工作进行了优化。与 Grok 4.6 相比,新模型能够在困难任务上持续更长时间,并加强了对自身输出结果的检查能力。 在 CursorBench 4.0 测试中,Grok 4.7 面向长时间运行的编程任务,在价格与性能方面处于同类模型的前列。官方同时表示,该模型的运行速度和定价与 Grok 4.6 相同。 Grok 4.7 使用了比 Grok 4.6 更大的基座模型,并接受了更长时间的强化学习训练。训练数据更加侧重需要数小时完成的复杂任务,同时针对模型的自我验证和长上下文管理能力进行了优化。 SpaceXAI 还...

    推荐理由:来自IT之家 AI的《马斯克 SpaceXAI 发布旗下最强编码和知识处理模型 Grok 4.7,百万词元输入 2 美元起》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 22 日消息,SpaceXAI 今日宣布推出新一代 Grok 4.7,主打编程和知识工作场景。 官方称其采用全新更大规模基础模型,并通过更长时间的强化学习训练提升复杂任务处理能力,是该公司目前最强的编码和知识处理模型 —— 速度是同类模型的两倍,价格却只有一半。 如前所述,Grok 4.7 针对编程和知识工作进行了优化。与 Grok 4.6 相比,新模型能够在困难任务上持续更长时间,并加强了对自身输出结果的检查能力。 在 CursorBench 4.0 测试中,Grok 4.7 面向长时间运行的编程任务,在价格与性能方面处于同类模型的前列。官方同时表示,该模型的运行速度和定价与 Grok 4.6 相同。 Grok 4.7 使用了比 Grok 4.6 更大的基座模型,并接受了更长时间的强化学习训练。训练数据更加侧重需要数小时完成的复杂任务,同时针对模型的自我验证和长上下文管理能力进行了优化。 SpaceXAI 还...

9月21日周一
  1. Tomer Tunguz78

    AI Comes for the If Statement

    这条英文动态主要涉及模型能力与工程。原文要点:Machine-native models replace human-facing text generation with zero-token typed execution, cutting inference costs by orders of magnitude for basic programming primitives.

    推荐理由:来自Tomer Tunguz的《AI Comes for the If Statement》。重点看模型能力与工程。摘要提到:这条英文动态主要涉及模型能力与工程。原文要点:Machine-native models replace human-facing text generation with zero-token typed execution, cutting inference costs by orders of magnitude for basic programming primitives.

9月20日周日
  1. IT之家 AI36

    智谱 MaaS 平台上线数据内容不留存机制,用户可申请开通

    IT之家 9 月 20 日消息,智谱 MaaS 平台今日宣布, 近期将上线数据内容不留存功能 ,为企业和开发者用户提供更严格的数据隐私保护。 公告称,数据内容不留存机制旨在减少模型调用内容在平台侧的持久化留存。任何用户均可以申请开通,生效后,智谱 MaaS 平台不会对用户的输入和输出进行静态存储, 数据仅用于完成当次模型调用 。企业和开发者可通过 MaaS 控制台提交开通申请,具体生效时间及适用范围以平台确认结果为准。 公告提到, 这个功能并不意味着任何情形下都不留存数据 。Batch API、File API 等需要在平台侧持久化保存任务或文件的功能不在上述覆盖范围内,以及法律法规要求留存、为核查涉嫌违规或滥用行为的情况,平台可能按有关要求留存相关数据 30 天及以上。 据IT之家此前报道,针对社区中有关代码库数据上传的讨论,智谱旗下编程产品 ZCode 于 9 月 18 日通过智谱官方群组向受影响用户致歉,并发布回应称已第一...

    推荐理由:来自IT之家 AI的《智谱 MaaS 平台上线数据内容不留存机制,用户可申请开通》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 20 日消息,智谱 MaaS 平台今日宣布, 近期将上线数据内容不留存功能 ,为企业和开发者用户提供更严格的数据隐私保护。 公告称,数据内容不留存机制旨在减少模型调用内容在平台侧的持久化留存。任何用户均可以申请开通,生效后,智谱 MaaS 平台不会对用户的输入和输出进行静态存储, 数据仅用于完成当次模型调用 。企业和开发者可通过 MaaS 控制台提交开通申请,具体生效时间及适用范围以平台确认结果为准。 公告提到, 这个功能并不意味着任何情形下都不留存数据 。Batch API、File API 等需要在平台侧持久化保存任务或文件的功能不在上述覆盖范围内,以及法律法规要求留存、为核查涉嫌违规或滥用行为的情况,平台可能按有关要求留存相关数据 30 天及以上。 据IT之家此前报道,针对社区中有关代码库数据上传的讨论,智谱旗下编程产品 ZCode 于 9 月 18 日通过智谱官方群组向受影响用户致歉,并发布回应称已第一...

  2. IT之家 AI74

    B站上线“AI 无限竞技场”LLM 测评榜:号称“全球百大模型同场竞技”、GPT-6 现居榜首

    IT之家 9 月 20 日消息,B站宣布上线“AI 无限竞技场”大模型测评榜,同步公布了首轮模型排行榜,其中 GPT-6 Astra 在 10 个 UP 主测评中拿下榜首,打败 GLM-5.3 获得榜首次数冠军;前五名中,国产大模型占据三席。IT之家附榜单地址( https://www.bilibili.com/blackboard/era/aiarena.html ?bsource=market_aiarena_sns_02 )。 据B站介绍,“AI 无限竞技场”是一个汇集了B站 UP 主 AI 大模型测评的竞技广场,由各领域 UP 主对上百个大模型的真实场景实测构成,涵盖代码、推理、协作、知识等多种测评主题。 不同于传统跑分评测,B站 AI 无限竞技场不设主题或测评维度限制,来自各个分区的 UP 主们以真实工作流、专业应用、趣味脑洞等自主命题,在同题 PK 中直观呈现各模型的实际表现差异。榜单涵盖 DeepSeek、Kimi...

    推荐理由:来自IT之家 AI的《B站上线“AI 无限竞技场”LLM 测评榜:号称“全球百大模型同场竞技”、GPT-6 现居榜首》。重点看智能体工作流、模型能力与工程、评测与基准。摘要提到:IT之家 9 月 20 日消息,B站宣布上线“AI 无限竞技场”大模型测评榜,同步公布了首轮模型排行榜,其中 GPT-6 Astra 在 10 个 UP 主测评中拿下榜首,打败 GLM-5.3 获得榜首次数冠军;前五名中,国产大模型占据三席。IT之家附榜单地址( https://www.bilibili.com/blackboard/era/aiarena.html ?bsource=market_aiarena_sns_02 )。 据B站介绍,“AI 无限竞技场”是一个汇集了B站 UP 主 AI 大模型测评的竞技广场,由各领域 UP 主对上百个大模型的真实场景实测构成,涵盖代码、推理、协作、知识等多种测评主题。 不同于传统跑分评测,B站 AI 无限竞技场不设主题或测评维度限制,来自各个分区的 UP 主们以真实工作流、专业应用、趣味脑洞等自主命题,在同题 PK 中直观呈现各模型的实际表现差异。榜单涵盖 DeepSeek、Kimi...

9月18日周五
  1. IT之家 AI70

    苹果详解 Safari 27 浏览器升级:解决阅读“乱跳”,修复 844 个问题

    IT之家 9 月 18 日消息,苹果公司昨日(9 月 17 日)更新 WebKit 博文,详细介绍了 Safari 27 系统带来的诸多新功能 / 新特性, 包括支持 MCP 协议,以及修复 844 个问题等。 对于开发者而言,Safari 27 浏览器最主要变化在于新增支持 MCP(Model Context Protocol)服务器支持,让 Claude Code、Codex 等 AI 工具能够控制浏览器窗口,读取 DOM 结构、网络请求、屏幕截图和控制台输出,从而帮助开发者更快地调试网站。 对于用户而言,Safari 27 新增滚动锚定(Scroll Anchoring)功能,当用户正在读文章时,页面上方延迟加载的图片、广告、评论或推荐模块,不会再把正在看的段落往下推。 IT之家翻译官方相关介绍如下: 许多网站会在用户阅读或浏览内容时向页面注入新内容。这些新内容通常会出现在用户当前视线上方,例如图片、广告或评论。过去这会导...

    推荐理由:来自IT之家 AI的《苹果详解 Safari 27 浏览器升级:解决阅读“乱跳”,修复 844 个问题》。重点看模型能力与工程。摘要提到:IT之家 9 月 18 日消息,苹果公司昨日(9 月 17 日)更新 WebKit 博文,详细介绍了 Safari 27 系统带来的诸多新功能 / 新特性, 包括支持 MCP 协议,以及修复 844 个问题等。 对于开发者而言,Safari 27 浏览器最主要变化在于新增支持 MCP(Model Context Protocol)服务器支持,让 Claude Code、Codex 等 AI 工具能够控制浏览器窗口,读取 DOM 结构、网络请求、屏幕截图和控制台输出,从而帮助开发者更快地调试网站。 对于用户而言,Safari 27 新增滚动锚定(Scroll Anchoring)功能,当用户正在读文章时,页面上方延迟加载的图片、广告、评论或推荐模块,不会再把正在看的段落往下推。 IT之家翻译官方相关介绍如下: 许多网站会在用户阅读或浏览内容时向页面注入新内容。这些新内容通常会出现在用户当前视线上方,例如图片、广告或评论。过去这会导...

  2. IT之家 AI34

    苹果增强辅助功能:iOS 27.2 Beta 1 开放 FaceTime 手语 API 接口

    IT之家 9 月 18 日消息,科技媒体 macobserver 昨日(9 月 17 日)发布博文,报道称在 iOS 27.2 Beta 1 更新中, 苹果公司开放 FaceTime 手语口译应用编程接口(API)。 IT之家援引博文介绍,兼容的 App 可以调用该 API 服务,通话参与者无需退出当前通话,也无需为口译服务另行协调独立视频房间,可以在统一通话会话内实现手语服务。 该媒体指出苹果 FaceTime 本身并不具备自动手语翻译能力,也不会替代专业人工手语译员,只是提供了 API 接口,方便第三方辅助功能应用接入通话,具体服务仍由支持该接口的应用和口译服务商提供。 相关功能于 2026 年进入预览阶段,在 iOS 27.2 Beta 1 中开放 API 接口后,口译服务商可据此开发适配应用。

    推荐理由:来自IT之家 AI的《苹果增强辅助功能:iOS 27.2 Beta 1 开放 FaceTime 手语 API 接口》。重点看产品发布。摘要提到:IT之家 9 月 18 日消息,科技媒体 macobserver 昨日(9 月 17 日)发布博文,报道称在 iOS 27.2 Beta 1 更新中, 苹果公司开放 FaceTime 手语口译应用编程接口(API)。 IT之家援引博文介绍,兼容的 App 可以调用该 API 服务,通话参与者无需退出当前通话,也无需为口译服务另行协调独立视频房间,可以在统一通话会话内实现手语服务。 该媒体指出苹果 FaceTime 本身并不具备自动手语翻译能力,也不会替代专业人工手语译员,只是提供了 API 接口,方便第三方辅助功能应用接入通话,具体服务仍由支持该接口的应用和口译服务商提供。 相关功能于 2026 年进入预览阶段,在 iOS 27.2 Beta 1 中开放 API 接口后,口译服务商可据此开发适配应用。

9月17日周四
  1. IT之家 AI74

    智谱 GLM 公开国内大模型首个递归自我改进实践:AI 在十万卡国产集群上自建推理系统

    IT之家 9 月 17 日消息,今日,智谱 GLM 团队披露递归自我改进(Recursive Self‑Improvement,简称 RSI)方向首个工程化实践进展,也就是让 AI 自己动手改进自己的运行系统。 具体来说,由 GLM-5.3 驱动的 Infra Agent 完成了 GLM-5.3-Flash 推理基础设施的设计、调试与优化,实现模型对自身运行系统的反向改进。 据官方博客,Infra Agent 在超 10 万张国产芯片组成的集群上从零完成生产级推理服务搭建,不到两周将端到端吞吐提升至初始基线的 3 倍,硬件利用效率与单 Token 成本达到主流 NVIDIA GPU 相当水平。这套系统已投入真实使用,GLM-5.3-Flash 以匿名模型 Ox-Alpha 在 OpenCode、OpenRouter 上线,6 天 Token 调用量超过 62 万亿。 IT之家注意到,这是国内大模型厂商首次公开将“AI 自我改进”...

    推荐理由:来自IT之家 AI的《智谱 GLM 公开国内大模型首个递归自我改进实践:AI 在十万卡国产集群上自建推理系统》。重点看智能体工作流、模型能力与工程、产品发布。摘要提到:IT之家 9 月 17 日消息,今日,智谱 GLM 团队披露递归自我改进(Recursive Self‑Improvement,简称 RSI)方向首个工程化实践进展,也就是让 AI 自己动手改进自己的运行系统。 具体来说,由 GLM-5.3 驱动的 Infra Agent 完成了 GLM-5.3-Flash 推理基础设施的设计、调试与优化,实现模型对自身运行系统的反向改进。 据官方博客,Infra Agent 在超 10 万张国产芯片组成的集群上从零完成生产级推理服务搭建,不到两周将端到端吞吐提升至初始基线的 3 倍,硬件利用效率与单 Token 成本达到主流 NVIDIA GPU 相当水平。这套系统已投入真实使用,GLM-5.3-Flash 以匿名模型 Ox-Alpha 在 OpenCode、OpenRouter 上线,6 天 Token 调用量超过 62 万亿。 IT之家注意到,这是国内大模型厂商首次公开将“AI 自我改进”...

9月16日周三
  1. IT之家 AI72

    vivo 口袋编程智能体 BlueCode 预览版发布,预研手机端侧蓝心 30B MoE 模型

    IT之家 9 月 16 日消息,vivo 今日发布 原生编程智能体 BlueCode 预览版 ,目标把 AI 生产力装进口袋,同步探索让手机成为生产力终端。 同时,vivo 正在预研「蓝心 30B MoE 端侧大模型」, 探索在手机上应用 。 在今日的大会上,蓝心智能战略将全面升级,全新 OriginOS 7 与自研蓝河操作系统 4 同步登场,IT之家将持续跟进报道。

    推荐理由:来自IT之家 AI的《vivo 口袋编程智能体 BlueCode 预览版发布,预研手机端侧蓝心 30B MoE 模型》。重点看智能体工作流、模型能力与工程、产品发布。摘要提到:IT之家 9 月 16 日消息,vivo 今日发布 原生编程智能体 BlueCode 预览版 ,目标把 AI 生产力装进口袋,同步探索让手机成为生产力终端。 同时,vivo 正在预研「蓝心 30B MoE 端侧大模型」, 探索在手机上应用 。 在今日的大会上,蓝心智能战略将全面升级,全新 OriginOS 7 与自研蓝河操作系统 4 同步登场,IT之家将持续跟进报道。

  2. IT之家 AI70

    OpenAI GPT-5.5 将于 10 月 14 日下线:覆盖 ChatGPT 与 Codex,官方建议迁移至新模型

    IT之家 9 月 16 日消息,OpenAI 今日宣布,GPT-5.5 将于 10 月 14 日从 ChatGPT、ChatGPT Work 和 Codex 中下线,覆盖所有订阅方案。 OpenAI 同时提醒,在 Codex 中使用 GPT-5.5 的用户应尽快切换至 GPT-5.6 Sol 或 GPT-6 Astra。 OpenAI 表示,此次停用范围包含所有计划。对于仍依赖 GPT-5.5 的 Codex 用户,官方给出的可选替代模型为 GPT-5.6 Sol 和 GPT-6 Astra。 IT之家此前报道,OpenAI 于今年 4 月 24 日宣布推出 GPT-5.5 模型,相比较 GPT-5.4 在完成相同任务的情况下减少词元(Token)消耗。 相关阅读: 《 OpenAI 奥尔特曼谈 GPT-5.5 自主策划发布会:希望人类开发者为其祝酒,但它自己拒绝发表祝酒词 》 《 OpenAI 最智能 AI 模型:GPT-5....

    推荐理由:来自IT之家 AI的《OpenAI GPT-5.5 将于 10 月 14 日下线:覆盖 ChatGPT 与 Codex,官方建议迁移至新模型》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 16 日消息,OpenAI 今日宣布,GPT-5.5 将于 10 月 14 日从 ChatGPT、ChatGPT Work 和 Codex 中下线,覆盖所有订阅方案。 OpenAI 同时提醒,在 Codex 中使用 GPT-5.5 的用户应尽快切换至 GPT-5.6 Sol 或 GPT-6 Astra。 OpenAI 表示,此次停用范围包含所有计划。对于仍依赖 GPT-5.5 的 Codex 用户,官方给出的可选替代模型为 GPT-5.6 Sol 和 GPT-6 Astra。 IT之家此前报道,OpenAI 于今年 4 月 24 日宣布推出 GPT-5.5 模型,相比较 GPT-5.4 在完成相同任务的情况下减少词元(Token)消耗。 相关阅读: 《 OpenAI 奥尔特曼谈 GPT-5.5 自主策划发布会:希望人类开发者为其祝酒,但它自己拒绝发表祝酒词 》 《 OpenAI 最智能 AI 模型:GPT-5....

9月15日周二
  1. IT之家 AI76

    代码显示:苹果 Siri AI 可替换为 Anthropic Claude 或 OpenAI ChatGPT

    IT之家 9 月 15 日消息,开发者“pdfu”对 iOS 27 和 macOS Golden Gate 进行深入挖掘之后发现,苹果已在其私有框架中将其新版 Siri AI 架构设计为可与第三方 AI 模型深度协作。 相关演示视频显示,Anthropic 的 Claude、OpenAI 的 GPT-5.6 模型均可接入 Siri 框架。 其中一项机制名为“模型委托”(Model Delegation),它允许 Claude 以 Siri 扩展的形式出现,与目前内置的 ChatGPT 扩展类似。 在 pdfu 发布的视频演示中,macOS 用户可调出“搜索或询问”栏,通过“Ask…”菜单选择 Claude 作为 AI 模型。 启用 Claude 扩展后,用户要求 Siri“让 Claude”在提醒事项 App 中创建一条提醒。Claude 负责解析这一自然语言请求,随后转交给 Siri 创建实际事件提醒。这意味着当请求涉及苹果系...

    推荐理由:来自IT之家 AI的《代码显示:苹果 Siri AI 可替换为 Anthropic Claude 或 OpenAI ChatGPT》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 15 日消息,开发者“pdfu”对 iOS 27 和 macOS Golden Gate 进行深入挖掘之后发现,苹果已在其私有框架中将其新版 Siri AI 架构设计为可与第三方 AI 模型深度协作。 相关演示视频显示,Anthropic 的 Claude、OpenAI 的 GPT-5.6 模型均可接入 Siri 框架。 其中一项机制名为“模型委托”(Model Delegation),它允许 Claude 以 Siri 扩展的形式出现,与目前内置的 ChatGPT 扩展类似。 在 pdfu 发布的视频演示中,macOS 用户可调出“搜索或询问”栏,通过“Ask…”菜单选择 Claude 作为 AI 模型。 启用 Claude 扩展后,用户要求 Siri“让 Claude”在提醒事项 App 中创建一条提醒。Claude 负责解析这一自然语言请求,随后转交给 Siri 创建实际事件提醒。这意味着当请求涉及苹果系...

9月12日周六
  1. IT之家 AI34

    微软承认 Win11 更新引发“代码 10”错误,部分 USB 音频设备无法正常工作

    IT之家 9 月 12 日消息,据外媒 Neowin 今天(11 日)下午报道,此前消息称,微软确认 Windows 11 最新“补丁星期二”更新引发了两个新问题。数小时后,微软又确认了一项新的故障, 导致 USB Audio Class 1.0 设备无法正常工作 。 安装更新后,部分设备会在设备管理器中 出现“代码 10”错误 ,并在多个 Windows 11 版本中完全失去声音输出。 故障影响 Windows 11 26H1、25H2 和 24H2,仅涉及客户端设备,服务器版本不受影响。微软承认,受影响用户可能遇到 完全无声、音量控制失灵,以及多声道或 3D 音频功能无法使用等情况 。 IT之家从报道中获悉,微软回应称,目前正调查“永久修复方案”。正式修复推出前,Microsoft Learn 上的部分用户建议把多声道配置切换为标准双声道模式,以暂时恢复声音。 微软表示,后续掌握更多信息后,将通过 Windows 运行状况仪...

    推荐理由:来自IT之家 AI的《微软承认 Win11 更新引发“代码 10”错误,部分 USB 音频设备无法正常工作》。重点看多模态、编码。摘要提到:IT之家 9 月 12 日消息,据外媒 Neowin 今天(11 日)下午报道,此前消息称,微软确认 Windows 11 最新“补丁星期二”更新引发了两个新问题。数小时后,微软又确认了一项新的故障, 导致 USB Audio Class 1.0 设备无法正常工作 。 安装更新后,部分设备会在设备管理器中 出现“代码 10”错误 ,并在多个 Windows 11 版本中完全失去声音输出。 故障影响 Windows 11 26H1、25H2 和 24H2,仅涉及客户端设备,服务器版本不受影响。微软承认,受影响用户可能遇到 完全无声、音量控制失灵,以及多声道或 3D 音频功能无法使用等情况 。 IT之家从报道中获悉,微软回应称,目前正调查“永久修复方案”。正式修复推出前,Microsoft Learn 上的部分用户建议把多声道配置切换为标准双声道模式,以暂时恢复声音。 微软表示,后续掌握更多信息后,将通过 Windows 运行状况仪...