跳到正文
今天10月5日周一1 条
  1. IT之家 AI70

    Linux 7.3-rc6 发布:Torvalds 称进入“AI 新常态”,稳定版预计 10 月中旬发布

    IT之家 10 月 5 日消息,Linus Torvalds 于当地时间 10 月 4 日发布了 Linux 7.3-rc6 测试版。相比前一周较为特殊的代码变更统计,本周整体恢复正常,驱动修复重新占据大头。 不过,Torvalds 也特别提到,随着 AI 和大语言模型(LLM)的参与,这种“AI 新常态”已经成为当前 Linux 内核开发周期的一部分。 Torvalds 表示,本周没有出现异常情况,代码变更统计已经回到“约一半来自驱动修复”的常见状态。驱动侧涉及 GPU、网络、USB、TTY、IIO、音频等多个子系统,整体呈现出较为分散的修复特征。 他同时指出,本次提交数量也处于正常范围,只不过这是新的“AI normal”—— 大量小型错误路径处理修复正在进入内核代码树。此前几个 Linux 7.3 测试版本同样出现了较多由 AI / LLM 发现问题或辅助生成的补丁,导致整个开发周期的修复活动明显更加活跃。 除了驱动修复外...

    推荐理由:来自IT之家 AI的《Linux 7.3-rc6 发布:Torvalds 称进入“AI 新常态”,稳定版预计 10 月中旬发布》。重点看模型能力与工程、产品发布。摘要提到:IT之家 10 月 5 日消息,Linus Torvalds 于当地时间 10 月 4 日发布了 Linux 7.3-rc6 测试版。相比前一周较为特殊的代码变更统计,本周整体恢复正常,驱动修复重新占据大头。 不过,Torvalds 也特别提到,随着 AI 和大语言模型(LLM)的参与,这种“AI 新常态”已经成为当前 Linux 内核开发周期的一部分。 Torvalds 表示,本周没有出现异常情况,代码变更统计已经回到“约一半来自驱动修复”的常见状态。驱动侧涉及 GPU、网络、USB、TTY、IIO、音频等多个子系统,整体呈现出较为分散的修复特征。 他同时指出,本次提交数量也处于正常范围,只不过这是新的“AI normal”—— 大量小型错误路径处理修复正在进入内核代码树。此前几个 Linux 7.3 测试版本同样出现了较多由 AI / LLM 发现问题或辅助生成的补丁,导致整个开发周期的修复活动明显更加活跃。 除了驱动修复外...

10月4日周日
  1. 量子位66

    GPT-6要“吃掉”3D公司?这家公司不到2年ARR翻百倍,破1亿美元

    专业3D模型反而更稀缺了 这条动态来自 量子位,可重点关注模型能力与工程。

    推荐理由:来自量子位的《GPT-6要“吃掉”3D公司?这家公司不到2年ARR翻百倍,破1亿美元》。重点看模型能力与工程。摘要提到:专业3D模型反而更稀缺了 这条动态来自 量子位,可重点关注模型能力与工程。

10月2日周五
  1. MIT Technology Review AI52

    Redefining enterprise intelligence with autonomous AI

    这条英文动态主要涉及模型能力与工程。原文要点:Enterprise AI is no longer a future ambition. It is in full operational flight. Model capabilities are advancing faster than most organizations can absorb, while the cost of performance continues to fall. Globally, AI investment is set to reach $2.5 trillion in 2026, up 44% from the previous year. For many enterprises, this investment has…

    推荐理由:来自MIT Technology Review AI的《Redefining enterprise intelligence with autonomous AI》。重点看模型能力与工程。摘要提到:这条英文动态主要涉及模型能力与工程。原文要点:Enterprise AI is no longer a future ambition. It is in full operational flight. Model capabilities are advancing faster than most organizations can absorb, while the cost of performance continues to fall. Globally, AI investment is set to reach $2.5 trillion in 2026, up 44% from the previous year. For many enterprises, this investment has…

  2. IT之家 AI70

    Meta 旗下 AI 智能体 Muse 将登陆智能眼镜平台,可代用户完成各种任务

    IT之家 10 月 2 日消息,Meta 宣布旗下 AI 智能体 Muse 将于近期登陆智能眼镜,用户无需拿出手机,只需通过语音下达指令,Muse 就能在后台代用户完成一系列任务。 Meta 表示,Muse 基于 Muse Spark AI 模型运行,其核心运行环境是一台部署在云端的私有持久化 Linux 虚拟机,配备独立的网页浏览器、文件系统和终端。即使用户关闭应用,这些组件仍会持续运行。为了完成用户交代的任务,Muse 可以自行决定编写并运行代码,也可以将工作分配给多个子智能体,还能创建定时任务。此外,Muse 还能够生成文档、PDF、网站以及消费记录追踪器、数据仪表盘等交互式工具。 与主要面向开发者和专业用户的其他 AI 智能体相比,Muse 的定位更加偏向普通消费者。其界面采用类似即时通讯的简化设计,并配有拟人化头像,同时重点宣传日常生活中的实际使用场景。 Meta 称,Muse 可以帮助用户预订旅行、发送电子邮件、填写...

    推荐理由:来自IT之家 AI的《Meta 旗下 AI 智能体 Muse 将登陆智能眼镜平台,可代用户完成各种任务》。重点看智能体工作流、模型能力与工程。摘要提到:IT之家 10 月 2 日消息,Meta 宣布旗下 AI 智能体 Muse 将于近期登陆智能眼镜,用户无需拿出手机,只需通过语音下达指令,Muse 就能在后台代用户完成一系列任务。 Meta 表示,Muse 基于 Muse Spark AI 模型运行,其核心运行环境是一台部署在云端的私有持久化 Linux 虚拟机,配备独立的网页浏览器、文件系统和终端。即使用户关闭应用,这些组件仍会持续运行。为了完成用户交代的任务,Muse 可以自行决定编写并运行代码,也可以将工作分配给多个子智能体,还能创建定时任务。此外,Muse 还能够生成文档、PDF、网站以及消费记录追踪器、数据仪表盘等交互式工具。 与主要面向开发者和专业用户的其他 AI 智能体相比,Muse 的定位更加偏向普通消费者。其界面采用类似即时通讯的简化设计,并配有拟人化头像,同时重点宣传日常生活中的实际使用场景。 Meta 称,Muse 可以帮助用户预订旅行、发送电子邮件、填写...

  3. 量子位70

    openJiuwen X-Router自演进模型路由技术首发,昇腾亲和,Agent越跑越省,实测减少50+%Token消耗

    让每一次请求选对模型,让每一次反馈都成为下一次更优、更省的选择 这条动态来自 量子位,可重点关注智能体工作流、模型能力与工程。

    推荐理由:来自量子位的《openJiuwen X-Router自演进模型路由技术首发,昇腾亲和,Agent越跑越省,实测减少50+%Token消耗》。重点看智能体工作流、模型能力与工程。摘要提到:让每一次请求选对模型,让每一次反馈都成为下一次更优、更省的选择 这条动态来自 量子位,可重点关注智能体工作流、模型能力与工程。

10月1日周四
  1. Cloudflare AI90

    Introducing Clef: our open-source decision models, and new RL fine-tuning platform

    这条英文动态主要涉及智能体工作流、模型能力与工程、产品发布。原文要点:We are introducing Clef and Clef-flash, open-source decision models hosted on Workers AI for high-speed classification and agentic workflows. Also launching: a new reinforcement learning platform that allows developers to fine-tune decision models using their own data.

    推荐理由:来自Cloudflare AI的《Introducing Clef: our open-source decision models, and new RL fine-tuning platform》。重点看智能体工作流、模型能力与工程、产品发布。摘要提到:这条英文动态主要涉及智能体工作流、模型能力与工程、产品发布。原文要点:We are introducing Clef and Clef-flash, open-source decision models hosted on Workers AI for high-speed classification and agentic workflows. Also launching: a new reinforcement learning platform that allows developers to fine-tune decision models using their own data.

  2. 量子位66

    何恺明团队新作:看猫片就能学会ARC挑战

    用ImageNet训练encoder 这条动态来自 量子位,可重点关注模型能力与工程。

    推荐理由:来自量子位的《何恺明团队新作:看猫片就能学会ARC挑战》。重点看模型能力与工程。摘要提到:用ImageNet训练encoder 这条动态来自 量子位,可重点关注模型能力与工程。

  3. Cloudflare AI84

    AI Search is now generally available

    这条英文动态主要涉及模型能力与工程。原文要点:AI Search is now generally available. It embeds image pixels directly for visual search, runs optical character recognition on scanned PDFs, accepts files up to 10 MiB, and works with any chat model. Here's what's new and how pricing works.

    推荐理由:来自Cloudflare AI的《AI Search is now generally available》。重点看模型能力与工程。摘要提到:这条英文动态主要涉及模型能力与工程。原文要点:AI Search is now generally available. It embeds image pixels directly for visual search, runs optical character recognition on scanned PDFs, accepts files up to 10 MiB, and works with any chat model. Here's what's new and how pricing works.

  4. IT之家 AI74

    OpenAI 称其遭遇有组织蒸馏,将矛头指向月之暗面

    IT之家 10 月 1 日消息,当地时间 9 月 30 日,OpenAI 在官网发文,称其近期遭遇一场有组织的蒸馏活动。 OpenAI 在文中表示,该活动最初始于 7 月第一周, 符合对抗式蒸馏(adversarial distillation)之特征 ,即系统性未经授权地利用某模型输出或推理过程,帮助训练、复现或改进另一模型。 OpenAI 透露,7 月 1 日的初始活动规模较小,直到 7 月 24 日和 7 月 25 日流量突然大幅增加,当时有超过 4000 名用户发起了 1.6 万次请求。该公司进一步调查后发现,超 1.5 万名用户存在类似提示词活动。到 7 月 28 日,OpenAI 已完全阻止该批活动。 本次活动并没有破解公司的加密系统,或入侵数据库,也没有直接访问用户对话。OpenAI 声称这些行动违反了他们的服务条款。 公司已通过前沿模型论坛(IT之家注:Frontier Model Forum)与行业合作伙伴分享...

    推荐理由:来自IT之家 AI的《OpenAI 称其遭遇有组织蒸馏,将矛头指向月之暗面》。重点看模型能力与工程。摘要提到:IT之家 10 月 1 日消息,当地时间 9 月 30 日,OpenAI 在官网发文,称其近期遭遇一场有组织的蒸馏活动。 OpenAI 在文中表示,该活动最初始于 7 月第一周, 符合对抗式蒸馏(adversarial distillation)之特征 ,即系统性未经授权地利用某模型输出或推理过程,帮助训练、复现或改进另一模型。 OpenAI 透露,7 月 1 日的初始活动规模较小,直到 7 月 24 日和 7 月 25 日流量突然大幅增加,当时有超过 4000 名用户发起了 1.6 万次请求。该公司进一步调查后发现,超 1.5 万名用户存在类似提示词活动。到 7 月 28 日,OpenAI 已完全阻止该批活动。 本次活动并没有破解公司的加密系统,或入侵数据库,也没有直接访问用户对话。OpenAI 声称这些行动违反了他们的服务条款。 公司已通过前沿模型论坛(IT之家注:Frontier Model Forum)与行业合作伙伴分享...

  5. 极客公园70

    从数据到智能,再到进化:Agent正在重写AI基础设施

    一个工程师写完数据处理代码,点下提交,然后去喝了杯咖啡。十几分钟甚至几十分钟之后,他才回到屏幕前看结果、改代码、再提交。这条「等待— 反馈」的空隙,过去一直是数据平台默认的节奏。 Agent 没有这个空隙。它拿到一次结果,立刻验证,紧接着并发地去试第二种、第三种方案,飞快拿到反馈,再发起下一轮调用。 人用平台,发过来的是一个相对确定的任务,算完、给结果、走人;Agent 用平台,会不停地换着法子去完成你交代的那个目标。压力就这样被放大了—— 管控的压力和隐形计算的压力,会十倍、百倍地往上翻。 这正在成为 2026 年云计算需要面对的一种新负载。 AI 正在深入「把模型用起来」的阶段。模型一旦长成 Agent,它就不再是一个躺在那里等你调用的接口,而更像一个会自己找数据、自己拆任务、自己并发试错、自己一直跑下去的数字员工。它制造出来的负载,和过去十几年云平台习惯承载的那种负载,完全是两回事。 阿...

    推荐理由:来自极客公园的《从数据到智能,再到进化:Agent正在重写AI基础设施》。重点看智能体工作流、模型能力与工程。摘要提到:一个工程师写完数据处理代码,点下提交,然后去喝了杯咖啡。十几分钟甚至几十分钟之后,他才回到屏幕前看结果、改代码、再提交。这条「等待— 反馈」的空隙,过去一直是数据平台默认的节奏。 Agent 没有这个空隙。它拿到一次结果,立刻验证,紧接着并发地去试第二种、第三种方案,飞快拿到反馈,再发起下一轮调用。 人用平台,发过来的是一个相对确定的任务,算完、给结果、走人;Agent 用平台,会不停地换着法子去完成你交代的那个目标。压力就这样被放大了—— 管控的压力和隐形计算的压力,会十倍、百倍地往上翻。 这正在成为 2026 年云计算需要面对的一种新负载。 AI 正在深入「把模型用起来」的阶段。模型一旦长成 Agent,它就不再是一个躺在那里等你调用的接口,而更像一个会自己找数据、自己拆任务、自己并发试错、自己一直跑下去的数字员工。它制造出来的负载,和过去十几年云平台习惯承载的那种负载,完全是两回事。 阿...

9月30日周三
  1. Cloudflare AI84

    Identify AI model overuse with User Insights

    这条英文动态主要涉及模型能力与工程。原文要点:AI Gateway User Insights now adds task, model, turn, and user categories to help teams understand AI adoption and make better model decisions. This is available free to AI Gateway users.

    推荐理由:来自Cloudflare AI的《Identify AI model overuse with User Insights》。重点看模型能力与工程。摘要提到:这条英文动态主要涉及模型能力与工程。原文要点:AI Gateway User Insights now adds task, model, turn, and user categories to help teams understand AI adoption and make better model decisions. This is available free to AI Gateway users.

  2. Cloudflare AI84

    Cut your AI spend with AI Gateway's Auto Router

    这条英文动态主要涉及模型能力与工程、评测与基准。原文要点:Cloudflare AI Gateway now features a model router that evaluates request complexity using an edge-deployed classifier to select the optimal model. By balancing expected output quality against token costs, organizations can dramatically cut AI spend while maintaining performance.

    推荐理由:来自Cloudflare AI的《Cut your AI spend with AI Gateway's Auto Router》。重点看模型能力与工程、评测与基准。摘要提到:这条英文动态主要涉及模型能力与工程、评测与基准。原文要点:Cloudflare AI Gateway now features a model router that evaluates request complexity using an edge-deployed classifier to select the optimal model. By balancing expected output quality against token costs, organizations can dramatically cut AI spend while maintaining performance.

  3. OpenAI News83

    Disrupting a coordinated model-distillation campaign

    这条英文动态主要涉及模型能力与工程。原文要点:Learn how OpenAI disrupted a campaign to extract protected model reasoning and is strengthening defenses against adversarial distillation.

    推荐理由:来自OpenAI News的《Disrupting a coordinated model-distillation campaign》。重点看模型能力与工程。摘要提到:这条英文动态主要涉及模型能力与工程。原文要点:Learn how OpenAI disrupted a campaign to extract protected model reasoning and is strengthening defenses against adversarial distillation.

  4. IT之家 AI68

    美议员提出重磅法案:政府出台安全防护机制前,AI 不得进行递归式自我改进

    IT之家 9 月 30 日消息,当地时间 28 日,据美国 CNBC 报道,代表硅谷选区的民主党联邦众议员罗 · 康纳准备提出一项 AI 监管法案,引入严格责任标准, 并禁止 AI 在缺乏政府安全防护机制的情况下进行递归式自我改进 。 康纳在接受采访时坦言:“事实上,存在文明灭绝的风险。既有失去控制的安全风险,也有被滥用的风险,两者都必须认真对待。” 康纳将法案命名为《Human Control Over AI Act(人类控制 AI 法案)》。联邦政府建立防护规则且监管机构批准有关活动前,AI 模型 不得递归式自我改进 ,也不得自主修改自身的核心目标、遏制机制或关停控制。 法案还计划设立一个 新的联邦机构 ,负责制定 AI 安全监管规定,通过许可制度审批模型训练和部署,对前沿 AI 模型开展审计,并制定安全标准,确保模型 持续接受测试并处于有效的人类控制之下 。 每家前沿 AI 实验室 还必须配备独立审计人员 ,由审计人员直接...

    推荐理由:来自IT之家 AI的《美议员提出重磅法案:政府出台安全防护机制前,AI 不得进行递归式自我改进》。重点看模型能力与工程。摘要提到:IT之家 9 月 30 日消息,当地时间 28 日,据美国 CNBC 报道,代表硅谷选区的民主党联邦众议员罗 · 康纳准备提出一项 AI 监管法案,引入严格责任标准, 并禁止 AI 在缺乏政府安全防护机制的情况下进行递归式自我改进 。 康纳在接受采访时坦言:“事实上,存在文明灭绝的风险。既有失去控制的安全风险,也有被滥用的风险,两者都必须认真对待。” 康纳将法案命名为《Human Control Over AI Act(人类控制 AI 法案)》。联邦政府建立防护规则且监管机构批准有关活动前,AI 模型 不得递归式自我改进 ,也不得自主修改自身的核心目标、遏制机制或关停控制。 法案还计划设立一个 新的联邦机构 ,负责制定 AI 安全监管规定,通过许可制度审批模型训练和部署,对前沿 AI 模型开展审计,并制定安全标准,确保模型 持续接受测试并处于有效的人类控制之下 。 每家前沿 AI 实验室 还必须配备独立审计人员 ,由审计人员直接...

9月29日周二
  1. Cloudflare AI84

    We tested our own WAF with frontier AI models. Here’s what we found

    这条英文动态主要涉及模型能力与工程。原文要点:We built a WAF tester that adapted each request based on what the WAF blocked or passed. This helped us explore variations that a fixed test might miss. We ran it across six attack categories on an authorized staging environment and discovered detection gaps worth fixing. Here’s how the loop worked, what got through, and what we did about it.

    推荐理由:来自Cloudflare AI的《We tested our own WAF with frontier AI models. Here’s what we found》。重点看模型能力与工程。摘要提到:这条英文动态主要涉及模型能力与工程。原文要点:We built a WAF tester that adapted each request based on what the WAF blocked or passed. This helped us explore variations that a fixed test might miss. We ran it across six attack categories on an authorized staging environment and discovered detection gaps worth fixing. Here’s how the loop worked, what got through, and what we did about it.

  2. 爱范儿38

    AI 圈杀出新顶流,神秘「太空兔」能用涂鸦做网站

    我又多了一个能当主力的Flash模型 #欢迎关注爱范儿官方微信公众号:爱范儿(微信号:ifanr),更多精彩内容第一时间为您奉上。 这条动态来自 爱范儿,可重点关注模型能力与工程。

    推荐理由:来自爱范儿的《AI 圈杀出新顶流,神秘「太空兔」能用涂鸦做网站》。重点看模型能力与工程。摘要提到:我又多了一个能当主力的Flash模型 #欢迎关注爱范儿官方微信公众号:爱范儿(微信号:ifanr),更多精彩内容第一时间为您奉上。 这条动态来自 爱范儿,可重点关注模型能力与工程。

  3. 爱范儿38

    苏姿丰550亿元买下李飞飞世界模型,AI 圈两位女王联手了

    算力焦虑下的双向奔赴 #欢迎关注爱范儿官方微信公众号:爱范儿(微信号:ifanr),更多精彩内容第一时间为您奉上。 这条动态来自 爱范儿,可重点关注模型能力与工程。

    推荐理由:来自爱范儿的《苏姿丰550亿元买下李飞飞世界模型,AI 圈两位女王联手了》。重点看模型能力与工程。摘要提到:算力焦虑下的双向奔赴 #欢迎关注爱范儿官方微信公众号:爱范儿(微信号:ifanr),更多精彩内容第一时间为您奉上。 这条动态来自 爱范儿,可重点关注模型能力与工程。

  4. IT之家 AI68

    LPDDR6 内存加持 AI 推理 ASIC,SEMIFIVE 接获规格交接型芯片设计订单

    IT之家 9 月 29 日消息,韩国芯片设计服务企业 SEMIFIVE 当地时间今日宣布,将为一家美国无晶圆厂 AI 设计芯片企业开发一款支持 LPDDR6、PCIe Gen5 的数据中心级“大芯片”推理加速器。 IT之家注意到, 这是高带宽低功耗的 LPDDR6 成为 ASIC 片外缓存选择的早期案例之一 。这颗芯片预计 2027H1 流片,2028 年量产出货。 SEMIFIVE 获得的这份订单采用“规格交接”模式:客户提供核心性能和规格指标,设计服务企业负责从详细设计到封装、测试、量产乃至软件开发的整个流程。 该订单是 SEMIFIVE 在北美市场斩获首个同类型项目。其以约 703 亿韩元 (IT之家注:现汇率约合 3.48 亿元人民币) 的总价成为 SEMIFIVE 历史上最大的单笔合同 ,已高于企业去年订单总额的 40%,约为 2026H1 订单总额的 60%。

    推荐理由:来自IT之家 AI的《LPDDR6 内存加持 AI 推理 ASIC,SEMIFIVE 接获规格交接型芯片设计订单》。重点看模型能力与工程。摘要提到:IT之家 9 月 29 日消息,韩国芯片设计服务企业 SEMIFIVE 当地时间今日宣布,将为一家美国无晶圆厂 AI 设计芯片企业开发一款支持 LPDDR6、PCIe Gen5 的数据中心级“大芯片”推理加速器。 IT之家注意到, 这是高带宽低功耗的 LPDDR6 成为 ASIC 片外缓存选择的早期案例之一 。这颗芯片预计 2027H1 流片,2028 年量产出货。 SEMIFIVE 获得的这份订单采用“规格交接”模式:客户提供核心性能和规格指标,设计服务企业负责从详细设计到封装、测试、量产乃至软件开发的整个流程。 该订单是 SEMIFIVE 在北美市场斩获首个同类型项目。其以约 703 亿韩元 (IT之家注:现汇率约合 3.48 亿元人民币) 的总价成为 SEMIFIVE 历史上最大的单笔合同 ,已高于企业去年订单总额的 40%,约为 2026H1 订单总额的 60%。

  5. IT之家 AI74

    AI 写作特征减少:Claude Opus 5.5 破折号使用量下降约 95%、分号下降 73%

    IT之家 9 月 29 日消息,@arena 于 9 月 26 日在 X 平台发布推文,通过写作指标测试,发现相比较 Opus 5 模型, Anthropic 的 Claude Opus 5.5 破折号使用量下降约 95%,每 1,000 个单词从 15.2 个降至 0.8 个。 IT之家附上相关截图如下: Arena 分析了 2026 年 8 月和 9 月的 Text Arena 高推理回复。结果显示,12 项写作指标中有 10 项朝 Arena 认定的改善方向变化。 其中最为明显的是大幅减少使用破折号,Claude Opus 5 每 1,000 个单词使用 15.2 个破折号。Opus 5.5 的使用量降至 0.8 个,较前代减少约 95%。 分号使用量也同步下降。Claude Opus 5 每 1,000 个单词使用 6.10 个分号。Opus 5.5 降至 1.64 个,降幅为 73%,显示模型减少了部分容易被识别的标点...

    推荐理由:来自IT之家 AI的《AI 写作特征减少:Claude Opus 5.5 破折号使用量下降约 95%、分号下降 73%》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 29 日消息,@arena 于 9 月 26 日在 X 平台发布推文,通过写作指标测试,发现相比较 Opus 5 模型, Anthropic 的 Claude Opus 5.5 破折号使用量下降约 95%,每 1,000 个单词从 15.2 个降至 0.8 个。 IT之家附上相关截图如下: Arena 分析了 2026 年 8 月和 9 月的 Text Arena 高推理回复。结果显示,12 项写作指标中有 10 项朝 Arena 认定的改善方向变化。 其中最为明显的是大幅减少使用破折号,Claude Opus 5 每 1,000 个单词使用 15.2 个破折号。Opus 5.5 的使用量降至 0.8 个,较前代减少约 95%。 分号使用量也同步下降。Claude Opus 5 每 1,000 个单词使用 6.10 个分号。Opus 5.5 降至 1.64 个,降幅为 73%,显示模型减少了部分容易被识别的标点...

  6. IT之家 AI74

    Anthropic 发布 Claude Sonnet 5.5:速度提升 30%,智能体编码性能反超 Opus 5.5

    IT之家 9 月 29 日消息,随着 AI 模型竞赛持续升温,Anthropic 推出了旗下中端模型 Sonnet 的最新版本。该公司表示,新版模型运行速度会快得多,使用成本也较上一代大幅降低。 IT之家注意到,这家实验室将 Sonnet 5.5 定位为日常任务的理想助手,适用场景包括编写代码以及制作办公文档。 Sonnet 5.5 的上一代产品 Sonnet 5 是大约三个月前发布的。当时这款模型的主打优势是智能体的高效部署,也就是运行智能体的成本低于竞品。 而 5.5 版本的核心亮点在于速度。Anthropic 称,Sonnet 5.5 的速度比上一代提升 30%,词元(Token)消耗速度也明显更低。 在 Anthropic 的模型产品序列当中,Sonnet 的性能弱于 Opus 模型,但凭借反应灵活的特点,在部分场景下反而更加实用。尤其是 Anthropic 的基准测试结果显示,Sonnet 5.5 在智能体编码任务上的...

    推荐理由:来自IT之家 AI的《Anthropic 发布 Claude Sonnet 5.5:速度提升 30%,智能体编码性能反超 Opus 5.5》。重点看智能体工作流、模型能力与工程、评测与基准。摘要提到:IT之家 9 月 29 日消息,随着 AI 模型竞赛持续升温,Anthropic 推出了旗下中端模型 Sonnet 的最新版本。该公司表示,新版模型运行速度会快得多,使用成本也较上一代大幅降低。 IT之家注意到,这家实验室将 Sonnet 5.5 定位为日常任务的理想助手,适用场景包括编写代码以及制作办公文档。 Sonnet 5.5 的上一代产品 Sonnet 5 是大约三个月前发布的。当时这款模型的主打优势是智能体的高效部署,也就是运行智能体的成本低于竞品。 而 5.5 版本的核心亮点在于速度。Anthropic 称,Sonnet 5.5 的速度比上一代提升 30%,词元(Token)消耗速度也明显更低。 在 Anthropic 的模型产品序列当中,Sonnet 的性能弱于 Opus 模型,但凭借反应灵活的特点,在部分场景下反而更加实用。尤其是 Anthropic 的基准测试结果显示,Sonnet 5.5 在智能体编码任务上的...

  7. OpenAI News80

    Towards safety cases for frontier AI training

    这条英文动态主要涉及模型能力与工程。原文要点:Our early guidelines for safety cases in frontier AI training cover technical safeguards, operational practices, and investigating misalignment incidents

    推荐理由:来自OpenAI News的《Towards safety cases for frontier AI training》。重点看模型能力与工程。摘要提到:这条英文动态主要涉及模型能力与工程。原文要点:Our early guidelines for safety cases in frontier AI training cover technical safeguards, operational practices, and investigating misalignment incidents

9月28日周一
  1. IT之家 AI74

    月之暗面最强 AI 模型:Kimi K3.1 前端标识泄露,预计将在近期发布

    IT之家 9 月 28 日消息,今日有多名开发者注意到月之暗面 API 平台的后台模型注册表中出现了“kimi-k3-1”标识,该模型标识通过了接口探测并可调用。 今日晚些时候,Kimi 官方开放平台也出现了 K3.1 或 K3 11111 模型的预告,支持 1M tokens 上下文窗口。 Kimi K3.1 预计支持最高 100 万 Token 上下文窗口,并提供 Low、High、Max 三档推理强度选项,可能引入 Agent 智能体模式、Swarm 多智能体协作以及搜索和批处理等任务模式。有开发者分析认为,多档推理强度的设计可能对应不同的算力资源配置与计费模型。 Kimi 开放平台显示,Kimi K3.1 的 API 价格与现有 K3 相同,但也不排除是占位符的可能。 相关阅读: 《 月之暗面最强 AI:消息称 Kimi K3.1 下月登场 》

    推荐理由:来自IT之家 AI的《月之暗面最强 AI 模型:Kimi K3.1 前端标识泄露,预计将在近期发布》。重点看智能体工作流、模型能力与工程、产品发布。摘要提到:IT之家 9 月 28 日消息,今日有多名开发者注意到月之暗面 API 平台的后台模型注册表中出现了“kimi-k3-1”标识,该模型标识通过了接口探测并可调用。 今日晚些时候,Kimi 官方开放平台也出现了 K3.1 或 K3 11111 模型的预告,支持 1M tokens 上下文窗口。 Kimi K3.1 预计支持最高 100 万 Token 上下文窗口,并提供 Low、High、Max 三档推理强度选项,可能引入 Agent 智能体模式、Swarm 多智能体协作以及搜索和批处理等任务模式。有开发者分析认为,多档推理强度的设计可能对应不同的算力资源配置与计费模型。 Kimi 开放平台显示,Kimi K3.1 的 API 价格与现有 K3 相同,但也不排除是占位符的可能。 相关阅读: 《 月之暗面最强 AI:消息称 Kimi K3.1 下月登场 》

  2. 极客公园73

    Kimi发力AI搜索,产品形态更加明确,在聊天中探索生产力

    本文首发于 Founder Park 公众号 · 2024 年 10 月 11 日 Kimi 今天发布了 AI 深度搜索功能, Web 端逐渐放量,预计 10 月 14 日全量上线。 产品功能和试用体验我们稍后再谈。 从产品形态上来看,Kimi 可能是国内最接近 ChatGPT 的 AI Native 产品,恰巧近期 OpenAI 的一些动作,我们觉得可以做一些延展的讨论。 关注 Founder Park, 更多 AI 产品 review 01 把模型当成产品 feature 在 AI 产品形态的探索上, 过去两年正在定义行业的 OpenAI 只有一个答案:chatbot。 行业更加关注 OpenAI 在模型上的动作,年初的视频生成 Sora,年中的多模态 4o,以及近期发布的 RL 推理强化模型 o1-preview,都在全行业引起了广泛讨论。 但在模型能力的主线之外,还有另一条也许更重要的主线任务,产品化,在 2024 年尤...

    推荐理由:来自极客公园的《Kimi发力AI搜索,产品形态更加明确,在聊天中探索生产力》。重点看模型能力与工程、产品发布。摘要提到:本文首发于 Founder Park 公众号 · 2024 年 10 月 11 日 Kimi 今天发布了 AI 深度搜索功能, Web 端逐渐放量,预计 10 月 14 日全量上线。 产品功能和试用体验我们稍后再谈。 从产品形态上来看,Kimi 可能是国内最接近 ChatGPT 的 AI Native 产品,恰巧近期 OpenAI 的一些动作,我们觉得可以做一些延展的讨论。 关注 Founder Park, 更多 AI 产品 review 01 把模型当成产品 feature 在 AI 产品形态的探索上, 过去两年正在定义行业的 OpenAI 只有一个答案:chatbot。 行业更加关注 OpenAI 在模型上的动作,年初的视频生成 Sora,年中的多模态 4o,以及近期发布的 RL 推理强化模型 o1-preview,都在全行业引起了广泛讨论。 但在模型能力的主线之外,还有另一条也许更重要的主线任务,产品化,在 2024 年尤...

  3. 极客公园71

    Kimi发布新模型,数学能力超o1,产品重点提升留存率

    本文首发于 Founder Park 公众号 · 2024 年 11 月 17 日 11 月 16 日,在 Kimi 全面上线一周年之际,月之暗面推出了基于推理强化的数学模型 k0-math,以及 Kimio 探索版的一系列新功能,新推出的 k0-math 数学模型测试成绩超越 o1。 官方称,2024 年 10 月,Kimi 智能助手全平台活跃用户超过 3600 万,k0-math 数学模型和 Kimi 探索版的新功能,将陆续上线网页端和 APP。 「AI 领域正在经历新一轮技术范式的变化。 基于强化学习、合成数据和思维链的新技术,可以解决高质量数据缺乏的问题,将提升 AI 在各个领域和场景的推理能力和智能水平上限。 」 针对最近业内讨论的 Scaling Law 撞墙的问题,Kimi 创始人杨植麟也发表了自己的观点。而对于深度推理、Kimi 自身海外业务收缩、以及 Kimi 的广告投放和用户留存问题,他也一并做了回答,我们对...

    推荐理由:来自极客公园的《Kimi发布新模型,数学能力超o1,产品重点提升留存率》。重点看模型能力与工程、产品发布。摘要提到:本文首发于 Founder Park 公众号 · 2024 年 11 月 17 日 11 月 16 日,在 Kimi 全面上线一周年之际,月之暗面推出了基于推理强化的数学模型 k0-math,以及 Kimio 探索版的一系列新功能,新推出的 k0-math 数学模型测试成绩超越 o1。 官方称,2024 年 10 月,Kimi 智能助手全平台活跃用户超过 3600 万,k0-math 数学模型和 Kimi 探索版的新功能,将陆续上线网页端和 APP。 「AI 领域正在经历新一轮技术范式的变化。 基于强化学习、合成数据和思维链的新技术,可以解决高质量数据缺乏的问题,将提升 AI 在各个领域和场景的推理能力和智能水平上限。 」 针对最近业内讨论的 Scaling Law 撞墙的问题,Kimi 创始人杨植麟也发表了自己的观点。而对于深度推理、Kimi 自身海外业务收缩、以及 Kimi 的广告投放和用户留存问题,他也一并做了回答,我们对...

  4. 极客公园70

    给 OpenClaw 做硬件没前途,但给上下文系统做,是值得的

    本文首发于 Founder Park 公众号 · 2026 年 4 月 2 日 一家叫泛灵人工智能的团队,出了一款主打「超级办公助理」的硬件产品。 参数配置很厉害,x86 芯片直接跑本地 Ubuntu,推理芯片可以本地跑 122B 的 MoE 模型 +27B 的稠密模型。支持办公场景的实时会议录音,操作任何设备的录屏,线下开会和外出调研的全记录。 目标是成为「口袋里的全模态超级办公助理」,后 OpenClaw 时代的个人 Agent Native 硬件基座。 初看到这个宣传,会有很多疑问,甚至质疑。 云端模型越来越强大、价格在持续下降的时候,把模型全放在端侧,有价值吗?122B 的模型到底能做啥?又做上下文记录又做任务处理,难道是想做 All in One 吗? 一个小团队,做这么复杂的硬件,今年 9 月份才量产,真的不是噱头吗? 所以今天这篇采访,更多的是好奇和 challenge 的角度,试图去理解他们为什么要用独立的硬件去...

    推荐理由:来自极客公园的《给 OpenClaw 做硬件没前途,但给上下文系统做,是值得的》。重点看智能体工作流、模型能力与工程、产品发布。摘要提到:本文首发于 Founder Park 公众号 · 2026 年 4 月 2 日 一家叫泛灵人工智能的团队,出了一款主打「超级办公助理」的硬件产品。 参数配置很厉害,x86 芯片直接跑本地 Ubuntu,推理芯片可以本地跑 122B 的 MoE 模型 +27B 的稠密模型。支持办公场景的实时会议录音,操作任何设备的录屏,线下开会和外出调研的全记录。 目标是成为「口袋里的全模态超级办公助理」,后 OpenClaw 时代的个人 Agent Native 硬件基座。 初看到这个宣传,会有很多疑问,甚至质疑。 云端模型越来越强大、价格在持续下降的时候,把模型全放在端侧,有价值吗?122B 的模型到底能做啥?又做上下文记录又做任务处理,难道是想做 All in One 吗? 一个小团队,做这么复杂的硬件,今年 9 月份才量产,真的不是噱头吗? 所以今天这篇采访,更多的是好奇和 challenge 的角度,试图去理解他们为什么要用独立的硬件去...

  5. IT之家 AI70

    谷歌为 Google AI 订阅会员新增 Colab 高级权益,可使用高性能云端计算资源

    IT之家 9 月 28 日消息,谷歌宣布为旗下 Google AI 订阅会员新增 Google Colab 高级权益,符合条件的订阅用户将获得 Colab 计算单元,并可使用性能更高的 GPU、TPU 等云端计算资源。 公开信息显示,Google Colab 是一项无需安装的托管式 Jupyter Notebook 服务,用户可以直接编写和运行 Python 代码,并使用 GPU、TPU 等云端计算资源。 随着 Colab 高级权益加入 Google AI 订阅体系,Google AI Ultra 除了提供 20TB 起步的云端存储空间、最高 20 倍的 Gemini 使用额度以及 YouTube Premium 外,现在还可使用 Premium GPU 和不中断的后台执行功能。用户无需持续保持浏览器标签页开启,即可运行长时间的 AI 模型训练任务。 此外,现有 Colab Pro 和 Pro+ 订阅不受此次调整影响,用户也可以...

    推荐理由:来自IT之家 AI的《谷歌为 Google AI 订阅会员新增 Colab 高级权益,可使用高性能云端计算资源》。重点看模型能力与工程。摘要提到:IT之家 9 月 28 日消息,谷歌宣布为旗下 Google AI 订阅会员新增 Google Colab 高级权益,符合条件的订阅用户将获得 Colab 计算单元,并可使用性能更高的 GPU、TPU 等云端计算资源。 公开信息显示,Google Colab 是一项无需安装的托管式 Jupyter Notebook 服务,用户可以直接编写和运行 Python 代码,并使用 GPU、TPU 等云端计算资源。 随着 Colab 高级权益加入 Google AI 订阅体系,Google AI Ultra 除了提供 20TB 起步的云端存储空间、最高 20 倍的 Gemini 使用额度以及 YouTube Premium 外,现在还可使用 Premium GPU 和不中断的后台执行功能。用户无需持续保持浏览器标签页开启,即可运行长时间的 AI 模型训练任务。 此外,现有 Colab Pro 和 Pro+ 订阅不受此次调整影响,用户也可以...

  6. Tomer Tunguz75

    How GPU Prices Can Double While AI Gets Cheaper

    这条英文动态主要涉及模型能力与工程。原文要点:GPU rental prices doubled in six months while inference prices kept falling. The reconciliation is efficiency : the hinge that turns scarce silicon into cheap intelligence.

    推荐理由:来自Tomer Tunguz的《How GPU Prices Can Double While AI Gets Cheaper》。重点看模型能力与工程。摘要提到:这条英文动态主要涉及模型能力与工程。原文要点:GPU rental prices doubled in six months while inference prices kept falling. The reconciliation is efficiency : the hinge that turns scarce silicon into cheap intelligence.

  7. IT之家 AI70

    前苹果 Siri 工程师推出 AI 智能体 szn,可在 iMessage 中与用户互动

    IT之家 9 月 28 日消息,前苹果 Siri 和 Apple Intelligence 工程师 Nikhil Gupta 宣布推出了一款名为 szn 的 AI 智能体,可直接运行在 iMessage 对话中,帮助用户浏览网页、购买商品以及代表用户与商家沟通。该服务目前已在官网开启注册,面向部分用户提供早期体验,计划于 10 月进一步扩大开放范围。 与传统聊天机器人不同,szn 并不只是回答用户的问题,而是可以代表用户执行实际操作。目前用户可以通过 iMessage 与 szn 互动,其能够基于用户共享的备忘录、Find My 位置以及 iCloud 文件提取分析数据,用户无需离开当前对话即可让 AI 完成相关操作。 Gupta 表示,每名用户都会获得一个独立的 AI 模型,每个 szn 智能体均拥有独立的姓名、电子邮件地址和电话号码, 因此理论上可以像一个独立联系人一样与外部服务进行沟通 。例如,用户可以让它代为联系商家、处...

    推荐理由:来自IT之家 AI的《前苹果 Siri 工程师推出 AI 智能体 szn,可在 iMessage 中与用户互动》。重点看智能体工作流、模型能力与工程。摘要提到:IT之家 9 月 28 日消息,前苹果 Siri 和 Apple Intelligence 工程师 Nikhil Gupta 宣布推出了一款名为 szn 的 AI 智能体,可直接运行在 iMessage 对话中,帮助用户浏览网页、购买商品以及代表用户与商家沟通。该服务目前已在官网开启注册,面向部分用户提供早期体验,计划于 10 月进一步扩大开放范围。 与传统聊天机器人不同,szn 并不只是回答用户的问题,而是可以代表用户执行实际操作。目前用户可以通过 iMessage 与 szn 互动,其能够基于用户共享的备忘录、Find My 位置以及 iCloud 文件提取分析数据,用户无需离开当前对话即可让 AI 完成相关操作。 Gupta 表示,每名用户都会获得一个独立的 AI 模型,每个 szn 智能体均拥有独立的姓名、电子邮件地址和电话号码, 因此理论上可以像一个独立联系人一样与外部服务进行沟通 。例如,用户可以让它代为联系商家、处...

  8. Simon Willison79

    2026 in LLMs (so far)

    这条英文动态主要涉及模型能力与工程。原文要点:On Friday I gave the closing keynote at the WeAreDevelopers World Congress North America in San Jose. I tied together the key trends from the past year into a chronological exploration of everything that happened in 2026. The video is on YouTube ; here are my annotated slides and notes to accompany the talk. And as an annotated presentation : # I'm going to give a lightning tour of everything that has happened so far...

    推荐理由:来自Simon Willison的《2026 in LLMs (so far)》。重点看模型能力与工程。摘要提到:这条英文动态主要涉及模型能力与工程。原文要点:On Friday I gave the closing keynote at the WeAreDevelopers World Congress North America in San Jose. I tied together the key trends from the past year into a chronological exploration of everything that happened in 2026. The video is on YouTube ; here are my annotated slides and notes to accompany the talk. And as an annotated presentation : # I'm going to give a lightning tour of everything t...

9月27日周日
  1. 量子位66

    又快又能打!匿名模型玉兔模型杀上双榜第一,Coding实测全记录

    中秋假期文具OpenRouter调用日榜榜首 这条动态来自 量子位,可重点关注模型能力与工程。

    推荐理由:来自量子位的《又快又能打!匿名模型玉兔模型杀上双榜第一,Coding实测全记录》。重点看模型能力与工程。摘要提到:中秋假期文具OpenRouter调用日榜榜首 这条动态来自 量子位,可重点关注模型能力与工程。

  2. 量子位70

    啥题啊能干崩OpenAI最强模型训练…

    啥题啊能干崩OpenAI最强模型训练… 这条动态来自 量子位,可重点关注模型能力与工程。

    推荐理由:来自量子位的《啥题啊能干崩OpenAI最强模型训练…》。重点看模型能力与工程。摘要提到:啥题啊能干崩OpenAI最强模型训练… 这条动态来自 量子位,可重点关注模型能力与工程。

  3. IT之家 AI70

    爆料称 OpenAI 准备扩大 Ultrafast API 开放范围

    IT之家 9 月 27 日消息,据 X 平台博主 @imjustnewatai 今日爆料,OpenAI Platform 和 API 文档已经出现 Ultrafast API 相关文档, 预示着公司似乎准备扩大 Ultrafast API 开放范围 。 IT之家注意到,OpenAI 正在为 Responses API Playground 准备全新速度选项,用户可在 Standard、Fast 和 Ultrafast 三种处理速度之间选择,目前该功能处于隐藏状态。 OpenAI 此前已正式预览搭载 GPT-5.6 Sol 的 Ultrafast 模式,称其输出速度最高可达每秒 750 个 Token,相比 Standard 模式的推理速度最高可提升 14 倍。目前该模式仍仅向部分客户开放。 从时间安排来看,Ultrafast 在 9 月 29 日的 DevDay 期间扩大开放范围并非不可能。OpenAI 已推出 GPT-6 系列...

    推荐理由:来自IT之家 AI的《爆料称 OpenAI 准备扩大 Ultrafast API 开放范围》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 27 日消息,据 X 平台博主 @imjustnewatai 今日爆料,OpenAI Platform 和 API 文档已经出现 Ultrafast API 相关文档, 预示着公司似乎准备扩大 Ultrafast API 开放范围 。 IT之家注意到,OpenAI 正在为 Responses API Playground 准备全新速度选项,用户可在 Standard、Fast 和 Ultrafast 三种处理速度之间选择,目前该功能处于隐藏状态。 OpenAI 此前已正式预览搭载 GPT-5.6 Sol 的 Ultrafast 模式,称其输出速度最高可达每秒 750 个 Token,相比 Standard 模式的推理速度最高可提升 14 倍。目前该模式仍仅向部分客户开放。 从时间安排来看,Ultrafast 在 9 月 29 日的 DevDay 期间扩大开放范围并非不可能。OpenAI 已推出 GPT-6 系列...

  4. IT之家 AI70

    中国首个面向全球与深空的太空计算基础设施“太空之弦”计算星座发布,G1 卫星预计明年发射

    IT之家 9 月 27 日消息,据东方星链昨晚分享,其于 9 月 25 日联合地卫二发布了“太空之弦”计算星座 —— 中国首个面向全球与深空的太空计算基础设施 。 据介绍,“太空之弦”计算星座由三体计算星座共建方地卫二与东方星链共同推进建设。东方星链负责总体设计与运营,地卫二提供 AI 能力支持并拓展国际市场。星座将以计算服务为核心组织卫星与轨道资源,探索天基数据处理、模型部署和计算资源协同, 逐步形成可调度、可供用户调用的太空计算服务能力 。 此次发布是前期在轨 AI 技术、卫星项目和国际合作积累向系统化星座建设的推进。 IT之家从东方星链获悉,“太空之弦”计划采用「业务层」与「计算层」协同的架构,让任务能够按需调用单颗卫星之外的计算资源。 业务层计划部署 720+ 颗数据星 ,也称推理星,承担数据获取与业务任务; 计算层计划在晨昏轨道分层部署 360+ 颗算力星 ,也称训练星,提供计算支撑,并可根据需求进一步扩展。 两层之间...

    推荐理由:来自IT之家 AI的《中国首个面向全球与深空的太空计算基础设施“太空之弦”计算星座发布,G1 卫星预计明年发射》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 27 日消息,据东方星链昨晚分享,其于 9 月 25 日联合地卫二发布了“太空之弦”计算星座 —— 中国首个面向全球与深空的太空计算基础设施 。 据介绍,“太空之弦”计算星座由三体计算星座共建方地卫二与东方星链共同推进建设。东方星链负责总体设计与运营,地卫二提供 AI 能力支持并拓展国际市场。星座将以计算服务为核心组织卫星与轨道资源,探索天基数据处理、模型部署和计算资源协同, 逐步形成可调度、可供用户调用的太空计算服务能力 。 此次发布是前期在轨 AI 技术、卫星项目和国际合作积累向系统化星座建设的推进。 IT之家从东方星链获悉,“太空之弦”计划采用「业务层」与「计算层」协同的架构,让任务能够按需调用单颗卫星之外的计算资源。 业务层计划部署 720+ 颗数据星 ,也称推理星,承担数据获取与业务任务; 计算层计划在晨昏轨道分层部署 360+ 颗算力星 ,也称训练星,提供计算支撑,并可根据需求进一步扩展。 两层之间...

9月26日周六
  1. IT之家 AI38

    从代码分析到授权争议:一用户用 AI 破解 IDM 引发争议

    IT之家 9 月 26 日消息,据 Wccftech 报道,一则关于“大语言模型破解付费软件”的帖子今日在 Reddit 上引发关注。 用户 No_Ideal8394 声称,他利用无审查限制的 Qwen3.8-Flash-Next-Uncensored ,成功破解了 Internet Download Manager(IDM)6.43 版本,使其绕过 IDM 试用限制,将软件变为完全激活版本,从而省去每年每台电脑 11.95 美元 (IT之家注:现汇率约合 80.4 元人民币) 的授权费用。在这一过程中,他只花了 5 欧元 (现汇率约合 38.3 元人民币) 去租用云 GPU,将问题交给模型处理。 发帖者表示,他向 AI 提供了约 25 万个 Token 的上下文信息,并让模型直接分析本机可执行文件,约 30 分钟后 AI 给出了可用的补丁方案。他还称,整个过程没有人工逐步指导,只需告诉 AI“我想要这个,去搞定它”。 根据其展...

    推荐理由:来自IT之家 AI的《从代码分析到授权争议:一用户用 AI 破解 IDM 引发争议》。重点看模型能力与工程。摘要提到:IT之家 9 月 26 日消息,据 Wccftech 报道,一则关于“大语言模型破解付费软件”的帖子今日在 Reddit 上引发关注。 用户 No_Ideal8394 声称,他利用无审查限制的 Qwen3.8-Flash-Next-Uncensored ,成功破解了 Internet Download Manager(IDM)6.43 版本,使其绕过 IDM 试用限制,将软件变为完全激活版本,从而省去每年每台电脑 11.95 美元 (IT之家注:现汇率约合 80.4 元人民币) 的授权费用。在这一过程中,他只花了 5 欧元 (现汇率约合 38.3 元人民币) 去租用云 GPU,将问题交给模型处理。 发帖者表示,他向 AI 提供了约 25 万个 Token 的上下文信息,并让模型直接分析本机可执行文件,约 30 分钟后 AI 给出了可用的补丁方案。他还称,整个过程没有人工逐步指导,只需告诉 AI“我想要这个,去搞定它”。 根据其展...

  2. IT之家 AI76

    美团上线 LongCat-2.5-Preview 模型:1.6T 参数,主打 AI 长程任务与多模态能力

    IT之家 9 月 26 日消息,美团旗下 LongCat API 开放平台于 9 月 25 日上线新一代大模型 LongCat-2.5-Preview, 主打“长程任务”与多模态能力,并同步开放 API 与网页端体验入口。 IT之家附上官方更新日志内容如下: LongCat-2.5-Preview 的核心特性如下: 多模态理解:新增图片理解能力 ,可解析图像内容,支持跨模态问答、内容摘要与复杂视觉推理。 卓越的 Coding 能力 :在代码生成、代码理解与自动化编程任务上表现突出。 深度适配 Claude Code 等主流开发环境 :与 Claude Code、Hermes、OpenClaw、OpenCode、Kilo Code 高效协同。 根据官方公布的信息,LongCat-2.5-Preview 模型延续 MoE(混合专家)路线,总参数量约 1.6 万亿,每次推理激活参数约 480 亿。该模型支持原生支持 100 万 tok...

    推荐理由:来自IT之家 AI的《美团上线 LongCat-2.5-Preview 模型:1.6T 参数,主打 AI 长程任务与多模态能力》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 26 日消息,美团旗下 LongCat API 开放平台于 9 月 25 日上线新一代大模型 LongCat-2.5-Preview, 主打“长程任务”与多模态能力,并同步开放 API 与网页端体验入口。 IT之家附上官方更新日志内容如下: LongCat-2.5-Preview 的核心特性如下: 多模态理解:新增图片理解能力 ,可解析图像内容,支持跨模态问答、内容摘要与复杂视觉推理。 卓越的 Coding 能力 :在代码生成、代码理解与自动化编程任务上表现突出。 深度适配 Claude Code 等主流开发环境 :与 Claude Code、Hermes、OpenClaw、OpenCode、Kilo Code 高效协同。 根据官方公布的信息,LongCat-2.5-Preview 模型延续 MoE(混合专家)路线,总参数量约 1.6 万亿,每次推理激活参数约 480 亿。该模型支持原生支持 100 万 tok...

  3. IT之家 AI70

    微星推出 MS-C9ZA 无风扇边缘 AI 盒子,基于 Jetson Orin Nano 8GB

    IT之家 9 月 26 日消息,微星 (MSI) 本月 23 日宣布推出 MS-C9ZA。这款边缘 AI 盒子可在端侧执行 AI 推理与计算机视觉处理,协助降低云端依赖、带宽使用与网络延迟, 面向机器人 、 智能制造等场景 。 MS-C9ZA 基于 NVIDIA(英伟达)Jetson Orin Nano 8GB 模组,拥有 1024 个 "Ampere" GPU 核心、6 个 Arm Cortex-A78AE CPU 内核,集成 8GB LPDDR5 内存。 该设备 采用无风扇的被动散热设计 ,三维 126×96×74 (mm),支持 -25~+60 ℃ 工作温度范围允许 12~14V 宽幅电压 DC 输入。其提供 1 个 PCIe Gen4 ×4 的 M.2 2280 SSD 盘位、2 个 1GbE RJ-45,另有 HDMI、USB、I²C、UART、CAN、GPIO 等端口。

    推荐理由:来自IT之家 AI的《微星推出 MS-C9ZA 无风扇边缘 AI 盒子,基于 Jetson Orin Nano 8GB》。重点看模型能力与工程、文化创意。摘要提到:IT之家 9 月 26 日消息,微星 (MSI) 本月 23 日宣布推出 MS-C9ZA。这款边缘 AI 盒子可在端侧执行 AI 推理与计算机视觉处理,协助降低云端依赖、带宽使用与网络延迟, 面向机器人 、 智能制造等场景 。 MS-C9ZA 基于 NVIDIA(英伟达)Jetson Orin Nano 8GB 模组,拥有 1024 个 "Ampere" GPU 核心、6 个 Arm Cortex-A78AE CPU 内核,集成 8GB LPDDR5 内存。 该设备 采用无风扇的被动散热设计 ,三维 126×96×74 (mm),支持 -25~+60 ℃ 工作温度范围允许 12~14V 宽幅电压 DC 输入。其提供 1 个 PCIe Gen4 ×4 的 M.2 2280 SSD 盘位、2 个 1GbE RJ-45,另有 HDMI、USB、I²C、UART、CAN、GPIO 等端口。

9月25日周五
  1. IT之家 AI72

    Claude Opus 5.5 仅用约 1 小时从零开发 RTX 加速路径追踪器,支持多种材质与光照效果

    IT之家 9 月 25 日消息,网友 u/Zealousideal_View_12 昨日(9 月 24 日)在 Reddit 社区发帖, 称其使用 Anthropic 的 Claude Opus 5.5 模型,耗时约 1 小时,从零生成实时硬件加速路径追踪器。 IT之家注:路径追踪器(Path Tracer)是一种基于光线传播模拟的 3D 渲染器。系统从摄像机或光源方向追踪大量光线,并计算光线与物体表面的交互结果。 科技媒体 Wccftech 认为即使不具备图形 API、着色器编译和并行执行方面的专业知识,用户也能调用 AI 开发路径追踪器。 该程序能够编写 C++ 和 CUDA 代码库,并利用 NVIDIA OptiX 9.1,直接调用现代 GPU 硬件的专用 RT 核心和 Tensor 核心。 该网友向 Claude Opus 5.5 提交了一条初始提示词,要求它从零构建 RTX 加速路径追踪器,但并未明确说明后续是否存在追...

    推荐理由:来自IT之家 AI的《Claude Opus 5.5 仅用约 1 小时从零开发 RTX 加速路径追踪器,支持多种材质与光照效果》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 25 日消息,网友 u/Zealousideal_View_12 昨日(9 月 24 日)在 Reddit 社区发帖, 称其使用 Anthropic 的 Claude Opus 5.5 模型,耗时约 1 小时,从零生成实时硬件加速路径追踪器。 IT之家注:路径追踪器(Path Tracer)是一种基于光线传播模拟的 3D 渲染器。系统从摄像机或光源方向追踪大量光线,并计算光线与物体表面的交互结果。 科技媒体 Wccftech 认为即使不具备图形 API、着色器编译和并行执行方面的专业知识,用户也能调用 AI 开发路径追踪器。 该程序能够编写 C++ 和 CUDA 代码库,并利用 NVIDIA OptiX 9.1,直接调用现代 GPU 硬件的专用 RT 核心和 Tensor 核心。 该网友向 Claude Opus 5.5 提交了一条初始提示词,要求它从零构建 RTX 加速路径追踪器,但并未明确说明后续是否存在追...

  2. IT之家 AI72

    谷歌 Gemini 3.8 Live 虚拟人上线:实时唇形同步 + 自然表情,无缝切换 97 种语言

    IT之家 9 月 25 日消息,谷歌近日宣布,在上周推出 Gemini 3.8 Live 的基础上,正式推出带有 Live Avatar 功能的 Gemini 3.8 Live, 为原生实时对话模型带来接近实时的视觉呈现效果。 该功能将接近实时的视频生成与语音相结合,可打造能倾听、观察并以动态视觉形象交流的交互体验, 借助精准唇形同步、自然表情与流畅对话轮次切换 ,帮助企业拓展更具交互性的虚拟服务。IT之家附上相关视频如下: 对话本身天生就是多模态的,人们通过倾听、观察、说话和面部表情交流。Live Avatar 将这些能力赋予企业智能代理,同时处理视觉和音频输入,生成更丰富的对话,带来更全面的交互体验。 除视觉呈现外,该功能依托 Gemini 的高级推理能力。通过异步工具调用,Live Avatar 可在后台触发工具调用并获取数据,同时保持对话正常进行,在处理复杂任务时保证对话流程不中断。 Live Avatar 支持原生多语...

    推荐理由:来自IT之家 AI的《谷歌 Gemini 3.8 Live 虚拟人上线:实时唇形同步 + 自然表情,无缝切换 97 种语言》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 25 日消息,谷歌近日宣布,在上周推出 Gemini 3.8 Live 的基础上,正式推出带有 Live Avatar 功能的 Gemini 3.8 Live, 为原生实时对话模型带来接近实时的视觉呈现效果。 该功能将接近实时的视频生成与语音相结合,可打造能倾听、观察并以动态视觉形象交流的交互体验, 借助精准唇形同步、自然表情与流畅对话轮次切换 ,帮助企业拓展更具交互性的虚拟服务。IT之家附上相关视频如下: 对话本身天生就是多模态的,人们通过倾听、观察、说话和面部表情交流。Live Avatar 将这些能力赋予企业智能代理,同时处理视觉和音频输入,生成更丰富的对话,带来更全面的交互体验。 除视觉呈现外,该功能依托 Gemini 的高级推理能力。通过异步工具调用,Live Avatar 可在后台触发工具调用并获取数据,同时保持对话正常进行,在处理复杂任务时保证对话流程不中断。 Live Avatar 支持原生多语...

  3. Simon Willison80

    Note on 24th September 2026

    这条英文动态主要涉及智能体工作流、模型能力与工程。原文要点:The more time I spend working with coding agents, the more convinced I am that they make software engineering even harder. We can do amazing things with them, but unlocking their full potential requires extraordinary discipline and knowledge. Tags: coding-agents , ai , llms

    推荐理由:来自Simon Willison的《Note on 24th September 2026》。重点看智能体工作流、模型能力与工程。摘要提到:这条英文动态主要涉及智能体工作流、模型能力与工程。原文要点:The more time I spend working with coding agents, the more convinced I am that they make software engineering even harder. We can do amazing things with them, but unlocking their full potential requires extraordinary discipline and knowledge. Tags: coding-agents , ai , llms

9月24日周四
  1. 量子位68

    PCIe显卡被低估了!内核补齐+通信重构,DeepSeek推理吞吐翻近7倍

    1.5台6000D跑赢1台B300! 这条动态来自 量子位,可重点关注模型能力与工程。

    推荐理由:来自量子位的《PCIe显卡被低估了!内核补齐+通信重构,DeepSeek推理吞吐翻近7倍》。重点看模型能力与工程。摘要提到:1.5台6000D跑赢1台B300! 这条动态来自 量子位,可重点关注模型能力与工程。