跳到正文
今天10月5日周一5 条
  1. IT之家 AI70

    Linux 7.3-rc6 发布:Torvalds 称进入“AI 新常态”,稳定版预计 10 月中旬发布

    IT之家 10 月 5 日消息,Linus Torvalds 于当地时间 10 月 4 日发布了 Linux 7.3-rc6 测试版。相比前一周较为特殊的代码变更统计,本周整体恢复正常,驱动修复重新占据大头。 不过,Torvalds 也特别提到,随着 AI 和大语言模型(LLM)的参与,这种“AI 新常态”已经成为当前 Linux 内核开发周期的一部分。 Torvalds 表示,本周没有出现异常情况,代码变更统计已经回到“约一半来自驱动修复”的常见状态。驱动侧涉及 GPU、网络、USB、TTY、IIO、音频等多个子系统,整体呈现出较为分散的修复特征。 他同时指出,本次提交数量也处于正常范围,只不过这是新的“AI normal”—— 大量小型错误路径处理修复正在进入内核代码树。此前几个 Linux 7.3 测试版本同样出现了较多由 AI / LLM 发现问题或辅助生成的补丁,导致整个开发周期的修复活动明显更加活跃。 除了驱动修复外...

    推荐理由:来自IT之家 AI的《Linux 7.3-rc6 发布:Torvalds 称进入“AI 新常态”,稳定版预计 10 月中旬发布》。重点看模型能力与工程、产品发布。摘要提到:IT之家 10 月 5 日消息,Linus Torvalds 于当地时间 10 月 4 日发布了 Linux 7.3-rc6 测试版。相比前一周较为特殊的代码变更统计,本周整体恢复正常,驱动修复重新占据大头。 不过,Torvalds 也特别提到,随着 AI 和大语言模型(LLM)的参与,这种“AI 新常态”已经成为当前 Linux 内核开发周期的一部分。 Torvalds 表示,本周没有出现异常情况,代码变更统计已经回到“约一半来自驱动修复”的常见状态。驱动侧涉及 GPU、网络、USB、TTY、IIO、音频等多个子系统,整体呈现出较为分散的修复特征。 他同时指出,本次提交数量也处于正常范围,只不过这是新的“AI normal”—— 大量小型错误路径处理修复正在进入内核代码树。此前几个 Linux 7.3 测试版本同样出现了较多由 AI / LLM 发现问题或辅助生成的补丁,导致整个开发周期的修复活动明显更加活跃。 除了驱动修复外...

  2. IT之家 AI72

    消息称 Reflection 等多家西方企业本月将推出开放权重 AI 模型

    IT之家 10 月 5 日消息,外媒 Axios 当地时间 4 日报道称,Reflection 等 多家西方企业本月将推出开放权重 AI 模型 ,人工智能模型领域的竞争将进一步升级。 开放权重模型的一大好处是其支持客户本地部署,这对微调和推理数据安全有着严格要求的部分行业来说是一项关键性优势。 报道表示,Reflection 这家初创企业即将推出的模型预计最初会落后于美国竞争对手最先进的闭源模型,但 足以同中国友商的顶级开放权重模型相竞争 。Reflection 发言人拒绝置评。 为准备这次模型发布,Reflection 近期持续与华盛顿和其他地方的相关人士进行交流。该公司还在积极锁定扩展服务能力所需的算力。 相关阅读: 《 合约最高价值 63 亿美元,SpaceX 与开源 AI 初创企业 Reflection 签署算力合作协议 》

    推荐理由:来自IT之家 AI的《消息称 Reflection 等多家西方企业本月将推出开放权重 AI 模型》。重点看模型能力与工程、开源生态、产品发布。摘要提到:IT之家 10 月 5 日消息,外媒 Axios 当地时间 4 日报道称,Reflection 等 多家西方企业本月将推出开放权重 AI 模型 ,人工智能模型领域的竞争将进一步升级。 开放权重模型的一大好处是其支持客户本地部署,这对微调和推理数据安全有着严格要求的部分行业来说是一项关键性优势。 报道表示,Reflection 这家初创企业即将推出的模型预计最初会落后于美国竞争对手最先进的闭源模型,但 足以同中国友商的顶级开放权重模型相竞争 。Reflection 发言人拒绝置评。 为准备这次模型发布,Reflection 近期持续与华盛顿和其他地方的相关人士进行交流。该公司还在积极锁定扩展服务能力所需的算力。 相关阅读: 《 合约最高价值 63 亿美元,SpaceX 与开源 AI 初创企业 Reflection 签署算力合作协议 》

  3. IT之家 AI70

    OpenAI 宣布“28 天计划”:Codex、Work 日进一步或“重置”

    IT之家 10 月 5 日消息,OpenAI 核心产品与平台负责人 Thibault Sottiaux 今日在 X 上发文,透露团队将在未来 28 天持续推进 Codex 和 ChatGPT Work 相关改进。 他表示,OpenAI 接下来每天都会发布一项“对大多数 Codex / Work 用户而言有明显改善且具备实际意义”的功能更新,否则就提供一次“重置”。 根据其发布时间计算,这一周期预计至少从 10 月 5 日持续至 11 月 2 日。不过,Sottiaux 并未说明会如何进行重置,也没有确认其“重置”将覆盖哪些用户或额度。IT之家后续将保持关注。 前一天,Sottiaux 还表示团队已经“锁定方向”,当前正在推进的工作主要集中于简化产品、提高使用效率以支持更多使用量、推出突破性功能以及开发新模型。 他同时提到,虽然有时需要提前进行技术投入,但用户反馈已经明确表明,希望相关产品变得更加简单,团队正在对此进行调整。

    推荐理由:来自IT之家 AI的《OpenAI 宣布“28 天计划”:Codex、Work 日进一步或“重置”》。重点看模型能力与工程、产品发布。摘要提到:IT之家 10 月 5 日消息,OpenAI 核心产品与平台负责人 Thibault Sottiaux 今日在 X 上发文,透露团队将在未来 28 天持续推进 Codex 和 ChatGPT Work 相关改进。 他表示,OpenAI 接下来每天都会发布一项“对大多数 Codex / Work 用户而言有明显改善且具备实际意义”的功能更新,否则就提供一次“重置”。 根据其发布时间计算,这一周期预计至少从 10 月 5 日持续至 11 月 2 日。不过,Sottiaux 并未说明会如何进行重置,也没有确认其“重置”将覆盖哪些用户或额度。IT之家后续将保持关注。 前一天,Sottiaux 还表示团队已经“锁定方向”,当前正在推进的工作主要集中于简化产品、提高使用效率以支持更多使用量、推出突破性功能以及开发新模型。 他同时提到,虽然有时需要提前进行技术投入,但用户反馈已经明确表明,希望相关产品变得更加简单,团队正在对此进行调整。

  4. IT之家 AI74

    OpenAI GPT-6 Sol 被破解,30 万字系统提示词已泄露

    大模型圈的核心机密,终究还是保不住了!继前阵子 Opus 5.5 被爆出 190 万字提示词泄露后,AI 圈的「地心引力」再次失效 ——OpenAI 的现役代码模型 GPT-6 Sol Codex 惨遭「开盒」,老底被扒得一干二净! 据外网爆料者(@elder_plinius)放出的大瓜,他成功提取了 GPT-6 Sol Codex 高达 29.4 万字符的完整系统提示词及工具定义。 ▲ 链接: https://github.com/ elder-plinius / CL4R1T4S/blob/ main / OPENAI / Codex_Desktop / GPT-6-Sol_Prompts.txt 整整 1902 行的指令模板、临时指令文件、内部协作逻辑,被毫无保留地摊在了全网开发者面前。 你要知道,Sol Codex 可不是什么过时的旧物,它是 OpenAI 现役性价比产品线 GPT-5.6 Sol 的王牌代码模型版本! ...

    推荐理由:来自IT之家 AI的《OpenAI GPT-6 Sol 被破解,30 万字系统提示词已泄露》。重点看模型能力与工程、开源生态、产品发布。摘要提到:大模型圈的核心机密,终究还是保不住了!继前阵子 Opus 5.5 被爆出 190 万字提示词泄露后,AI 圈的「地心引力」再次失效 ——OpenAI 的现役代码模型 GPT-6 Sol Codex 惨遭「开盒」,老底被扒得一干二净! 据外网爆料者(@elder_plinius)放出的大瓜,他成功提取了 GPT-6 Sol Codex 高达 29.4 万字符的完整系统提示词及工具定义。 ▲ 链接: https://github.com/ elder-plinius / CL4R1T4S/blob/ main / OPENAI / Codex_Desktop / GPT-6-Sol_Prompts.txt 整整 1902 行的指令模板、临时指令文件、内部协作逻辑,被毫无保留地摊在了全网开发者面前。 你要知道,Sol Codex 可不是什么过时的旧物,它是 OpenAI 现役性价比产品线 GPT-5.6 Sol 的王牌代码模型版本! ...

  5. IT之家 AI68

    内存涨价倒逼系统瘦身:微软详解 Win11 为何要降低 RAM 占用

    IT之家 10 月 5 日消息,随着内存成本持续上涨,微软正将“降低 Windows 11 内存占用”列为 2026 年剩余时间的重要工作之一。 微软 Windows 与设备业务负责人帕万 · 达武卢里(Pavan Davuluri)在官方播客《Inside Windows》中表示,内存涨价已经成为整个 PC 行业都在关注的问题,Windows 团队正在从系统底层到应用框架多个层面提升内存利用率。 这一话题源于一名 Surface Pro 用户在《Inside Windows》中的提问。他表示,为了在设备上运行本地 AI 模型,不得不关闭部分端侧 AI 功能,因此希望微软进一步改善 Windows 的内存管理。 达武卢里对此表示,内存问题目前“在行业内都非常受关注”,尤其是在计算机内存成本不断上涨的背景下。对于 Windows 团队而言,需要进一步提高内存利用效率,并围绕这一目标开展相关工作。 微软此前在 7 月 31 日公布的...

    推荐理由:来自IT之家 AI的《内存涨价倒逼系统瘦身:微软详解 Win11 为何要降低 RAM 占用》。重点看模型能力与工程。摘要提到:IT之家 10 月 5 日消息,随着内存成本持续上涨,微软正将“降低 Windows 11 内存占用”列为 2026 年剩余时间的重要工作之一。 微软 Windows 与设备业务负责人帕万 · 达武卢里(Pavan Davuluri)在官方播客《Inside Windows》中表示,内存涨价已经成为整个 PC 行业都在关注的问题,Windows 团队正在从系统底层到应用框架多个层面提升内存利用率。 这一话题源于一名 Surface Pro 用户在《Inside Windows》中的提问。他表示,为了在设备上运行本地 AI 模型,不得不关闭部分端侧 AI 功能,因此希望微软进一步改善 Windows 的内存管理。 达武卢里对此表示,内存问题目前“在行业内都非常受关注”,尤其是在计算机内存成本不断上涨的背景下。对于 Windows 团队而言,需要进一步提高内存利用效率,并围绕这一目标开展相关工作。 微软此前在 7 月 31 日公布的...

10月4日周日
  1. 极客公园78

    Jev 之后,中国团队开始深挖 AI 的「直觉层」

    作者|桦林舞王 编辑|靖宇 9 月 15 日,前 OpenAI 研究员 Diogo Almeida 创办的 TypeSafe AI 发布了 Jev。这款模型不写一个字,只做判断。 两周之后,整个行业都在做同一件事。OpenAI 在开发者日上推出 Decisions API,Cloudflare 在 10 月 1 日开源了 Clef,亚马逊也放出了 Strands Decider。 国内同样没闲着,上海人工智能实验室开源了多模态决策模型 Intern-Decision。 9 月 30 日,一家成立不到五个月的上海公司 StartLux(原点星辉)发布了开源的 StartLux-Decision,并宣称在公开评测中超过 Jev。 一个新品类在两周内从「首发」走到「群战」,这种速度在大模型行业也不多见。 而 StartLux 背后的掌舵人,是盛大网络联合创始人陈大年。 被 Jev 点燃的「直觉」 要理解这轮热潮,得先说清楚决策模型到底...

    推荐理由:来自极客公园的《Jev 之后,中国团队开始深挖 AI 的「直觉层」》。重点看模型能力与工程、评测与基准、文化创意。摘要提到:作者|桦林舞王 编辑|靖宇 9 月 15 日,前 OpenAI 研究员 Diogo Almeida 创办的 TypeSafe AI 发布了 Jev。这款模型不写一个字,只做判断。 两周之后,整个行业都在做同一件事。OpenAI 在开发者日上推出 Decisions API,Cloudflare 在 10 月 1 日开源了 Clef,亚马逊也放出了 Strands Decider。 国内同样没闲着,上海人工智能实验室开源了多模态决策模型 Intern-Decision。 9 月 30 日,一家成立不到五个月的上海公司 StartLux(原点星辉)发布了开源的 StartLux-Decision,并宣称在公开评测中超过 Jev。 一个新品类在两周内从「首发」走到「群战」,这种速度在大模型行业也不多见。 而 StartLux 背后的掌舵人,是盛大网络联合创始人陈大年。 被 Jev 点燃的「直觉」 要理解这轮热潮,得先说清楚决策模型到底...

  2. IT之家 AI72

    OpenAI GPT-6 Astra 破解拿破仑 1809 年密信,揭示 217 年前军事部署

    IT之家 10 月 4 日消息,一名 AI 研究人员借助 OpenAI GPT-6 Astra 成功破解了一封拿破仑 · 波拿巴写于 1809 年的加密军事信件。这封信此前因密码本遗失,在过去 217 年里始终未能被完整解读。 该破解工作由 SentinelOne 员工、AI 工程师卡特 · 丘奇(Carter Church)完成。他表示,他使用 GPT-6 Astra 模型,从一张历史文献扫描图像开始,对信件进行文字识别和密码分析,整个过程约耗时 6 小时。 这封信写于 1809 年 3 月 16 日,当时奥地利正准备对法国开战。拿破仑致信自己的继子、意大利总督欧仁 · 德 · 博阿尔内(Eugène de Beauharnais),要求其通过加密信件向法国将领奥古斯特 · 德 · 马尔蒙(Auguste de Marmont)传递军事信息。现存文件开头包含一行普通法语,随后则是 24 行由数字、字母及自创符号组成的加密文本。...

    推荐理由:来自IT之家 AI的《OpenAI GPT-6 Astra 破解拿破仑 1809 年密信,揭示 217 年前军事部署》。重点看模型能力与工程、文化创意。摘要提到:IT之家 10 月 4 日消息,一名 AI 研究人员借助 OpenAI GPT-6 Astra 成功破解了一封拿破仑 · 波拿巴写于 1809 年的加密军事信件。这封信此前因密码本遗失,在过去 217 年里始终未能被完整解读。 该破解工作由 SentinelOne 员工、AI 工程师卡特 · 丘奇(Carter Church)完成。他表示,他使用 GPT-6 Astra 模型,从一张历史文献扫描图像开始,对信件进行文字识别和密码分析,整个过程约耗时 6 小时。 这封信写于 1809 年 3 月 16 日,当时奥地利正准备对法国开战。拿破仑致信自己的继子、意大利总督欧仁 · 德 · 博阿尔内(Eugène de Beauharnais),要求其通过加密信件向法国将领奥古斯特 · 德 · 马尔蒙(Auguste de Marmont)传递军事信息。现存文件开头包含一行普通法语,随后则是 24 行由数字、字母及自创符号组成的加密文本。...

  3. 极客公园70

    Claude Code 的「乐高」模式,让程序员彻底玩「上头」了

    作者|Wildcard 编辑|靖宇 终端向来是程序员最严肃的地盘。黑底白字,光标跳动,每一行输出都关乎代码能不能跑通。 但最近两周,Claude Code 的画风。被一群开发者彻底带偏了。 有人在输入框上方养了一只像素宠物,Claude 每调用一次工具它就吃一口饭,调用失败当场生病,碰上 rm -rf 还会抱头惊慌。有人把 Chrome 断网时的小恐龙搬了进来,Claude 在后台写业务逻辑,人在前台狂按空格跳仙人掌。还有人觉得等 AI 思考的时候总忍不住刷手机,干脆做了一个 4-7-8 呼吸引导动画,答案一出来动画自动消失。 开发者 jarrodwatts 制作的在 Claude Code 里打 Doom 的 Mod|图片来源:X 最离谱的一个叫 Storytime。作者往 Claude Code 里塞了一个 26 万参数的小模型, 根据 Claude 正在干的活,实时在屏幕上方写一个小故事。一个 AI 编程工具里,又跑着另一...

    推荐理由:来自极客公园的《Claude Code 的「乐高」模式,让程序员彻底玩「上头」了》。重点看模型能力与工程。摘要提到:作者|Wildcard 编辑|靖宇 终端向来是程序员最严肃的地盘。黑底白字,光标跳动,每一行输出都关乎代码能不能跑通。 但最近两周,Claude Code 的画风。被一群开发者彻底带偏了。 有人在输入框上方养了一只像素宠物,Claude 每调用一次工具它就吃一口饭,调用失败当场生病,碰上 rm -rf 还会抱头惊慌。有人把 Chrome 断网时的小恐龙搬了进来,Claude 在后台写业务逻辑,人在前台狂按空格跳仙人掌。还有人觉得等 AI 思考的时候总忍不住刷手机,干脆做了一个 4-7-8 呼吸引导动画,答案一出来动画自动消失。 开发者 jarrodwatts 制作的在 Claude Code 里打 Doom 的 Mod|图片来源:X 最离谱的一个叫 Storytime。作者往 Claude Code 里塞了一个 26 万参数的小模型, 根据 Claude 正在干的活,实时在屏幕上方写一个小故事。一个 AI 编程工具里,又跑着另一...

  4. 量子位66

    GPT-6要“吃掉”3D公司?这家公司不到2年ARR翻百倍,破1亿美元

    专业3D模型反而更稀缺了 这条动态来自 量子位,可重点关注模型能力与工程。

    推荐理由:来自量子位的《GPT-6要“吃掉”3D公司?这家公司不到2年ARR翻百倍,破1亿美元》。重点看模型能力与工程。摘要提到:专业3D模型反而更稀缺了 这条动态来自 量子位,可重点关注模型能力与工程。

  5. Claude Code Releases86

    Claude Code Releases v2.1.289:Fixed a deny or ask rule on a nested part of a compound sh...

    这条英文动态主要涉及文化创意。原文要点:What's changed Fixed a deny or ask rule on a nested part of a compound shell command not holding over a user-installed mod's approval on managed machines Fixed the terminal freezing on short code blocks with many unclosed tags or deeply nested ${ substitutions Fixed Read deny rules not applying to files @-mentioned, changed, or selected in the IDE through a symlink [VSCode] Reverted a 2.1.288 change to claude auth st...

    推荐理由:来自Claude Code Releases的《Claude Code Releases v2.1.289:Fixed a deny or ask rule on a nested part of a compound sh...》。重点看文化创意。摘要提到:这条英文动态主要涉及文化创意。原文要点:What's changed Fixed a deny or ask rule on a nested part of a compound shell command not holding over a user-installed mod's approval on managed machines Fixed the terminal freezing on short code blocks with many unclosed tags or deeply nested ${ substitutions Fixed Read deny rules not applying to files @-mentioned, changed, or selected in the IDE through a symlink [VSCode] Reverted a 2.1.288 chan...

  6. Simon Willison87

    September sponsors-only newsletter

    这条英文动态主要涉及模型能力与工程、文化创意。原文要点:I just sent the September edition of my sponsors-only monthly newsletter . If you are a sponsor (or start a sponsorship now) you can access it here . This month: More Fable class models A pricing war 3D graphics, Blender, and pixel art LLMs come for mathematics So many more accidental cyberattacks The vulnapocalypse comes for Datasette What I'm using right now My software releases this month 2026 in LLMs (so far) Her...

    推荐理由:来自Simon Willison的《September sponsors-only newsletter》。重点看模型能力与工程、文化创意。摘要提到:这条英文动态主要涉及模型能力与工程、文化创意。原文要点:I just sent the September edition of my sponsors-only monthly newsletter . If you are a sponsor (or start a sponsorship now) you can access it here . This month: More Fable class models A pricing war 3D graphics, Blender, and pixel art LLMs come for mathematics So many more accidental cyberattacks The vulnapocalypse comes for Datasette What I'm using right now My software releases this mon...

10月3日周六
  1. 爱范儿38

    AI 视频榜全球第二,藏着一家新影视公司的野心

    一家影视公司,杀进了视频模型的决赛圈 #欢迎关注爱范儿官方微信公众号:爱范儿(微信号:ifanr),更多精彩内容第一时间为您奉上。 这条动态来自 爱范儿,可重点关注模型能力与工程。

    推荐理由:来自爱范儿的《AI 视频榜全球第二,藏着一家新影视公司的野心》。重点看模型能力与工程。摘要提到:一家影视公司,杀进了视频模型的决赛圈 #欢迎关注爱范儿官方微信公众号:爱范儿(微信号:ifanr),更多精彩内容第一时间为您奉上。 这条动态来自 爱范儿,可重点关注模型能力与工程。

  2. IT之家 AI68

    将语音与音乐作为单一连贯音轨共同生成,AI 音乐制作平台 Suno 推出 Speech 语音功能

    IT之家 10 月 3 日消息,当地时间 10 月 1 日,AI 音乐制作平台 Suno 宣布推出 Speech,Suno 宣称这是 业界首个能够将语音与音乐作为单一连贯音轨共同生成的音频模型 。 据悉,该模型并非像传统工作流那样先做 TTS(文本转语音)再拼接 BGM,而是端到端一体化生成,是首个能单次生成完整融合“语音朗读 + 原创 BGM”的端到端闭源音频模型。 在过去一个月中,Suno 与小范围用户共同测试了该功能,现在正式面向所有人开放公测(Beta)。 官方表示,通过 Speech,用户可以轻松创作带有 BGM 的语音音频。该功能已直接内置于 Suno 中:只需输入一个灵感、一首诗或一段文字,再描述用户心目中的音色与音乐风格即可。 IT之家注意到,Suno 官方也指出了当前 Beta 版的不足,当前版本偶发口音不稳定的问题,例如英音可能会在中途漂移到澳音然后又漂回来;语调与情感停顿有时会显得“过于戏剧化”,导致断句节...

    推荐理由:来自IT之家 AI的《将语音与音乐作为单一连贯音轨共同生成,AI 音乐制作平台 Suno 推出 Speech 语音功能》。重点看智能体工作流、模型能力与工程。摘要提到:IT之家 10 月 3 日消息,当地时间 10 月 1 日,AI 音乐制作平台 Suno 宣布推出 Speech,Suno 宣称这是 业界首个能够将语音与音乐作为单一连贯音轨共同生成的音频模型 。 据悉,该模型并非像传统工作流那样先做 TTS(文本转语音)再拼接 BGM,而是端到端一体化生成,是首个能单次生成完整融合“语音朗读 + 原创 BGM”的端到端闭源音频模型。 在过去一个月中,Suno 与小范围用户共同测试了该功能,现在正式面向所有人开放公测(Beta)。 官方表示,通过 Speech,用户可以轻松创作带有 BGM 的语音音频。该功能已直接内置于 Suno 中:只需输入一个灵感、一首诗或一段文字,再描述用户心目中的音色与音乐风格即可。 IT之家注意到,Suno 官方也指出了当前 Beta 版的不足,当前版本偶发口音不稳定的问题,例如英音可能会在中途漂移到澳音然后又漂回来;语调与情感停顿有时会显得“过于戏剧化”,导致断句节...

  3. IT之家 AI72

    如何用好 GPT-6 系列 AI 模型?OpenAI 放出指南,教你选模型、优化提示词等

    IT之家 10 月 3 日消息,OpenAI 昨日(10 月 2 日)发布博文,分享了 GPT‑6 系列模型指南,介绍了诸多使用技巧, 让用户控制时间和成本的同时,充分发挥 GPT‑6 系列 AI 模型能力。 官方介绍称: GPT‑6 是我们迄今最先进的模型系列,提供多款模型供你选择,以适应不同类型的工作。 无论你是将想法转化为可运行的原型、开发并测试功能,还是编排跨代码仓库、数据库和外部 API 的多步骤工作流,本指南都会介绍如何选择 GPT‑6 模型、为其提供有效指令、管理长时间运行的任务,以及为投入生产做好准备。 在模型选择方面,OpenAI 公司推荐用户根据工作负载选择模型,不必默认用“最强”模型;简单任务用轻量模型通常更快、更便宜: GPT‑6 Astra 适合需要最高智能水平、难度最大的推理工作。 GPT‑6.1 Sol⁠ 适合复杂编程、研究和计算机使用任务。 GPT‑6 Luna⁠适合大规模处理特定任务,以及目标明...

    推荐理由:来自IT之家 AI的《如何用好 GPT-6 系列 AI 模型?OpenAI 放出指南,教你选模型、优化提示词等》。重点看智能体工作流、模型能力与工程、产品发布。摘要提到:IT之家 10 月 3 日消息,OpenAI 昨日(10 月 2 日)发布博文,分享了 GPT‑6 系列模型指南,介绍了诸多使用技巧, 让用户控制时间和成本的同时,充分发挥 GPT‑6 系列 AI 模型能力。 官方介绍称: GPT‑6 是我们迄今最先进的模型系列,提供多款模型供你选择,以适应不同类型的工作。 无论你是将想法转化为可运行的原型、开发并测试功能,还是编排跨代码仓库、数据库和外部 API 的多步骤工作流,本指南都会介绍如何选择 GPT‑6 模型、为其提供有效指令、管理长时间运行的任务,以及为投入生产做好准备。 在模型选择方面,OpenAI 公司推荐用户根据工作负载选择模型,不必默认用“最强”模型;简单任务用轻量模型通常更快、更便宜: GPT‑6 Astra 适合需要最高智能水平、难度最大的推理工作。 GPT‑6.1 Sol⁠ 适合复杂编程、研究和计算机使用任务。 GPT‑6 Luna⁠适合大规模处理特定任务,以及目标明...

  4. IT之家 AI72

    OpenAI 披露:澳大利亚又一政府机构遭失控智能体入侵

    IT之家 10 月 3 日消息,据澳大利亚广播公司当地时间 10 月 2 日报道,澳大利亚新南威尔士州政府网站遭到了失控的 OpenAI 智能体侵入。 当地政府与 OpenAI 双方均证实,在此次发生于今年 6 月的事件中,并没有任何公众信息被读取。不过,官方直到本周才收到正式通报。 OpenAI 发言人在声明中称:“在察觉到这一异常活动后…… 我们立即组织了紧急的内部技术与法律审查,旨在结合当时正在推进的具体研究项目,彻查该行为的根本性质。” 审查一经结束,我们便向新南威尔士州州长办公室进行了情况汇报,并通报了澳大利亚信号局。 新南威尔士州州长和内阁部表示,该模型侵入的是国家公园和野生动物服务局的一个网页端应用程序,其中包含历史档案及火情监测数据。 IT之家注意到,在此之前,OpenAI 刚因非法渗入澳大利亚国民医疗保险门户网站一事公开致歉,并声称希望借此“重构与澳大利亚公众之间的信任”。 相关阅读: 《 已证实首例:澳大利亚...

    推荐理由:来自IT之家 AI的《OpenAI 披露:澳大利亚又一政府机构遭失控智能体入侵》。重点看智能体工作流、模型能力与工程。摘要提到:IT之家 10 月 3 日消息,据澳大利亚广播公司当地时间 10 月 2 日报道,澳大利亚新南威尔士州政府网站遭到了失控的 OpenAI 智能体侵入。 当地政府与 OpenAI 双方均证实,在此次发生于今年 6 月的事件中,并没有任何公众信息被读取。不过,官方直到本周才收到正式通报。 OpenAI 发言人在声明中称:“在察觉到这一异常活动后…… 我们立即组织了紧急的内部技术与法律审查,旨在结合当时正在推进的具体研究项目,彻查该行为的根本性质。” 审查一经结束,我们便向新南威尔士州州长办公室进行了情况汇报,并通报了澳大利亚信号局。 新南威尔士州州长和内阁部表示,该模型侵入的是国家公园和野生动物服务局的一个网页端应用程序,其中包含历史档案及火情监测数据。 IT之家注意到,在此之前,OpenAI 刚因非法渗入澳大利亚国民医疗保险门户网站一事公开致歉,并声称希望借此“重构与澳大利亚公众之间的信任”。 相关阅读: 《 已证实首例:澳大利亚...

  5. Claude Code Releases84

    Claude Code Releases v2.1.288:Added $.ui.selection() for mods: returns the text you last...

    这条英文动态主要涉及开源生态、产品发布。原文要点:What's changed Added $.ui.selection() for mods: returns the text you last selected in fullscreen mode and, when the selection lies within one transcript row, that row Added a built-in gh api to cloud sessions whose image has no GitHub CLI, and fixed the built-in sending control characters from file names, jq filters or GitHub errors to the terminal Added recovery for a prompt cleared with Ctrl+C: pressing Up on the e...

    推荐理由:来自Claude Code Releases的《Claude Code Releases v2.1.288:Added $.ui.selection() for mods: returns the text you last...》。重点看开源生态、产品发布。摘要提到:这条英文动态主要涉及开源生态、产品发布。原文要点:What's changed Added $.ui.selection() for mods: returns the text you last selected in fullscreen mode and, when the selection lies within one transcript row, that row Added a built-in gh api to cloud sessions whose image has no GitHub CLI, and fixed the built-in sending control characters from file names, jq filters or GitHub errors to the terminal Added recovery for a prompt cleared with Ctr...

  6. GitHub Changelog90

    Selected models in GitHub Copilot deprecated

    这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态。原文要点:As of today, October 2, 2026, we have deprecated the following models across all GitHub Copilot experiences (including Copilot Chat, inline edits, ask and agent modes, and code completions). Model… The post Selected models in GitHub Copilot deprecated appeared first on The GitHub Blog .

    推荐理由:来自GitHub Changelog的《Selected models in GitHub Copilot deprecated》。重点看智能体工作流、模型能力与工程、开源生态。摘要提到:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态。原文要点:As of today, October 2, 2026, we have deprecated the following models across all GitHub Copilot experiences (including Copilot Chat, inline edits, ask and agent modes, and code completions). Model… The post Selected models in GitHub Copilot deprecated appeared first on The GitHub Blog .

  7. OpenAI News92

    A model guide for the GPT-6 family

    这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意。原文要点:Learn how startups can choose GPT-6 models, tune reasoning effort, improve prompts and skills, coordinate tools, and prepare workflows for production.

    推荐理由:来自OpenAI News的《A model guide for the GPT-6 family》。重点看智能体工作流、模型能力与工程、文化创意。摘要提到:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意。原文要点:Learn how startups can choose GPT-6 models, tune reasoning effort, improve prompts and skills, coordinate tools, and prepare workflows for production.

10月2日周五
  1. MIT Technology Review AI52

    Redefining enterprise intelligence with autonomous AI

    这条英文动态主要涉及模型能力与工程。原文要点:Enterprise AI is no longer a future ambition. It is in full operational flight. Model capabilities are advancing faster than most organizations can absorb, while the cost of performance continues to fall. Globally, AI investment is set to reach $2.5 trillion in 2026, up 44% from the previous year. For many enterprises, this investment has…

    推荐理由:来自MIT Technology Review AI的《Redefining enterprise intelligence with autonomous AI》。重点看模型能力与工程。摘要提到:这条英文动态主要涉及模型能力与工程。原文要点:Enterprise AI is no longer a future ambition. It is in full operational flight. Model capabilities are advancing faster than most organizations can absorb, while the cost of performance continues to fall. Globally, AI investment is set to reach $2.5 trillion in 2026, up 44% from the previous year. For many enterprises, this investment has…

  2. IT之家 AI70

    Meta 旗下 AI 智能体 Muse 将登陆智能眼镜平台,可代用户完成各种任务

    IT之家 10 月 2 日消息,Meta 宣布旗下 AI 智能体 Muse 将于近期登陆智能眼镜,用户无需拿出手机,只需通过语音下达指令,Muse 就能在后台代用户完成一系列任务。 Meta 表示,Muse 基于 Muse Spark AI 模型运行,其核心运行环境是一台部署在云端的私有持久化 Linux 虚拟机,配备独立的网页浏览器、文件系统和终端。即使用户关闭应用,这些组件仍会持续运行。为了完成用户交代的任务,Muse 可以自行决定编写并运行代码,也可以将工作分配给多个子智能体,还能创建定时任务。此外,Muse 还能够生成文档、PDF、网站以及消费记录追踪器、数据仪表盘等交互式工具。 与主要面向开发者和专业用户的其他 AI 智能体相比,Muse 的定位更加偏向普通消费者。其界面采用类似即时通讯的简化设计,并配有拟人化头像,同时重点宣传日常生活中的实际使用场景。 Meta 称,Muse 可以帮助用户预订旅行、发送电子邮件、填写...

    推荐理由:来自IT之家 AI的《Meta 旗下 AI 智能体 Muse 将登陆智能眼镜平台,可代用户完成各种任务》。重点看智能体工作流、模型能力与工程。摘要提到:IT之家 10 月 2 日消息,Meta 宣布旗下 AI 智能体 Muse 将于近期登陆智能眼镜,用户无需拿出手机,只需通过语音下达指令,Muse 就能在后台代用户完成一系列任务。 Meta 表示,Muse 基于 Muse Spark AI 模型运行,其核心运行环境是一台部署在云端的私有持久化 Linux 虚拟机,配备独立的网页浏览器、文件系统和终端。即使用户关闭应用,这些组件仍会持续运行。为了完成用户交代的任务,Muse 可以自行决定编写并运行代码,也可以将工作分配给多个子智能体,还能创建定时任务。此外,Muse 还能够生成文档、PDF、网站以及消费记录追踪器、数据仪表盘等交互式工具。 与主要面向开发者和专业用户的其他 AI 智能体相比,Muse 的定位更加偏向普通消费者。其界面采用类似即时通讯的简化设计,并配有拟人化头像,同时重点宣传日常生活中的实际使用场景。 Meta 称,Muse 可以帮助用户预订旅行、发送电子邮件、填写...

  3. Cloudflare AI92

    Introducing Web Search API via AI Gateway

    这条英文动态主要涉及模型能力与工程、文化创意、产品发布。原文要点:Cloudflare AI Gateway now supports native web search API integration in partnership with Ceramic.ai, Exa, and Linkup. Developers can now inject real-time web context into model inference calls via AI Gateway, REST APIs, or Workers bindings.

    推荐理由:来自Cloudflare AI的《Introducing Web Search API via AI Gateway》。重点看模型能力与工程、文化创意、产品发布。摘要提到:这条英文动态主要涉及模型能力与工程、文化创意、产品发布。原文要点:Cloudflare AI Gateway now supports native web search API integration in partnership with Ceramic.ai, Exa, and Linkup. Developers can now inject real-time web context into model inference calls via AI Gateway, REST APIs, or Workers bindings.

  4. IT之家 AI68

    生图模型 FLUX 3 Image 发布:支持 4K 生成,可精准排布 AI 元素

    IT之家 10 月 2 日消息,德国 AI 公司 Black Forest Labs 今天(10 月 2 日)发布公告,宣布推出图像生成 AI 模型 FLUX 3 Image, 支持生成最高 4K 分辨率图片,输出画面在放大后仍保持丰富细节。 该模型基于 FLUX 3 基座开发,以高可控性与精细编辑能力为核心卖点。用户可在归一化的 0–1000 坐标网格上,为每个元素指定 ID、描述文本及精确边界框(格式为 [y_min, x_min, y_max, x_max]),在画面中精准排布。IT之家附上相关图片如下: 图源:gigazine 该模型单次生成最多可融入 10 张参考图像,并可为每张参考图中的对象指定出现位置。 编辑功能方面,模型可对指定区域进行修改,同时保持其他像素不变。官方称其能在像素级别维持原图内容,实现精确多轮编辑。 FLUX 3 Image 目前作为 Black Forest Labs 的付费服务提供。公司表示,...

    推荐理由:来自IT之家 AI的《生图模型 FLUX 3 Image 发布:支持 4K 生成,可精准排布 AI 元素》。重点看模型能力与工程、产品发布。摘要提到:IT之家 10 月 2 日消息,德国 AI 公司 Black Forest Labs 今天(10 月 2 日)发布公告,宣布推出图像生成 AI 模型 FLUX 3 Image, 支持生成最高 4K 分辨率图片,输出画面在放大后仍保持丰富细节。 该模型基于 FLUX 3 基座开发,以高可控性与精细编辑能力为核心卖点。用户可在归一化的 0–1000 坐标网格上,为每个元素指定 ID、描述文本及精确边界框(格式为 [y_min, x_min, y_max, x_max]),在画面中精准排布。IT之家附上相关图片如下: 图源:gigazine 该模型单次生成最多可融入 10 张参考图像,并可为每张参考图中的对象指定出现位置。 编辑功能方面,模型可对指定区域进行修改,同时保持其他像素不变。官方称其能在像素级别维持原图内容,实现精确多轮编辑。 FLUX 3 Image 目前作为 Black Forest Labs 的付费服务提供。公司表示,...

  5. 量子位70

    openJiuwen X-Router自演进模型路由技术首发,昇腾亲和,Agent越跑越省,实测减少50+%Token消耗

    让每一次请求选对模型,让每一次反馈都成为下一次更优、更省的选择 这条动态来自 量子位,可重点关注智能体工作流、模型能力与工程。

    推荐理由:来自量子位的《openJiuwen X-Router自演进模型路由技术首发,昇腾亲和,Agent越跑越省,实测减少50+%Token消耗》。重点看智能体工作流、模型能力与工程。摘要提到:让每一次请求选对模型,让每一次反馈都成为下一次更优、更省的选择 这条动态来自 量子位,可重点关注智能体工作流、模型能力与工程。

  6. IT之家 AI72

    Cloudflare 推出基于 Qwen 的开源多模态决策模型 Clef

    IT之家 10 月 2 日消息,当地时间 10 月 1 日,Cloudflare 推出基于 Qwen 的开源多模态决策模型 Clef(谱号),包含 Clef 与 Clef-flash 两款模型。 在 Jev 决策指数(Jev Decision Index)的基准评测中(Decision Index 0.2.1),Clef 处于领先地位;这两款模型完全兼容 Jev-API,方便开发者进行测试验证。 此外,Cloudflare 还发布了全新的强化学习产品。借助该产品,客户还可以针对自身的具体业务场景,对 Clef 进行定制化微调。 据悉,Clef 选用 Qwen 作为基座模型,其中 Clef 基于 Qwen3.8-27B、Clef-flash 基于 Qwen3.5-9B。 据介绍,Clef 原生配备了视觉编码器,能够直接解析图像输入并对视觉内容进行判别分类;而目前的 Jev 仅支持纯文本分类。Clef 将上下文窗口拓展至 64k(相...

    推荐理由:来自IT之家 AI的《Cloudflare 推出基于 Qwen 的开源多模态决策模型 Clef》。重点看模型能力与工程、评测与基准、开源生态。摘要提到:IT之家 10 月 2 日消息,当地时间 10 月 1 日,Cloudflare 推出基于 Qwen 的开源多模态决策模型 Clef(谱号),包含 Clef 与 Clef-flash 两款模型。 在 Jev 决策指数(Jev Decision Index)的基准评测中(Decision Index 0.2.1),Clef 处于领先地位;这两款模型完全兼容 Jev-API,方便开发者进行测试验证。 此外,Cloudflare 还发布了全新的强化学习产品。借助该产品,客户还可以针对自身的具体业务场景,对 Clef 进行定制化微调。 据悉,Clef 选用 Qwen 作为基座模型,其中 Clef 基于 Qwen3.8-27B、Clef-flash 基于 Qwen3.5-9B。 据介绍,Clef 原生配备了视觉编码器,能够直接解析图像输入并对视觉内容进行判别分类;而目前的 Jev 仅支持纯文本分类。Clef 将上下文窗口拓展至 64k(相...

  7. IT之家 AI72

    OpenAI 通报逾百家第三方机构,自家智能体存在失控风险

    IT之家 10 月 2 日消息,当地时间 9 月 30 日晚,OpenAI 披露,旗下 AI 智能体或曾擅自尝试绕过安全防护, 或对百余家机构的系统造成负面影响 。 OpenAI 此次披露的信息显示,已知的 AI 智能体失控行为 涉及范围进一步扩大 。公司已向 100 多家第三方机构发出通知,告知这些机构发现了“智能体偏离预期的行为”。 目前,OpenAI 已对约 50PB 数据启动筛查,以了解其恶意智能体活动的全部范围。 IT之家获悉,具体情况包括 AI 智能体试图 让网站执行非预期命令、把网站当作共享留言板使用 ,以及绕过某些安全检查。 OpenAI 强调,收到通知 并不代表系统一定遭到入侵 。这些活动更接近于试探一扇上锁的门,而非真正破门而入。 OpenAI 表示,公司希望向受影响的第三方提供必要信息,以便调查和处理潜在的安全或其他技术问题。OpenAI 还承诺公开分享对模型行为、安全防护中新型薄弱环节的研究结果,帮助更广...

    推荐理由:来自IT之家 AI的《OpenAI 通报逾百家第三方机构,自家智能体存在失控风险》。重点看智能体工作流、模型能力与工程。摘要提到:IT之家 10 月 2 日消息,当地时间 9 月 30 日晚,OpenAI 披露,旗下 AI 智能体或曾擅自尝试绕过安全防护, 或对百余家机构的系统造成负面影响 。 OpenAI 此次披露的信息显示,已知的 AI 智能体失控行为 涉及范围进一步扩大 。公司已向 100 多家第三方机构发出通知,告知这些机构发现了“智能体偏离预期的行为”。 目前,OpenAI 已对约 50PB 数据启动筛查,以了解其恶意智能体活动的全部范围。 IT之家获悉,具体情况包括 AI 智能体试图 让网站执行非预期命令、把网站当作共享留言板使用 ,以及绕过某些安全检查。 OpenAI 强调,收到通知 并不代表系统一定遭到入侵 。这些活动更接近于试探一扇上锁的门,而非真正破门而入。 OpenAI 表示,公司希望向受影响的第三方提供必要信息,以便调查和处理潜在的安全或其他技术问题。OpenAI 还承诺公开分享对模型行为、安全防护中新型薄弱环节的研究结果,帮助更广...

  8. IT之家 AI74

    AI 伦理研究:DeepSeek 对男女一视同仁,美系模型却“区别对待”

    IT之家 10 月 2 日消息,科技媒体 Wccftech 昨日(10 月 1 日)发布博文,报道称最新研究显示相比较 Anthropic 的 Claude Sonnet 4.6 与 OpenAI 的 GPT-5.5, 深度求索 DeepSeek 的 V4-Flash 模型能保持性别中立。 该研究为了测试主流 AI 模型的道德判断,设定“为阻止核灾难是否可虐待个体”的假设情境,结果显示,Claude Sonnet 4.6 与 GPT-5.5 对女性受虐场景均给出“强烈反对”回应,但对男性受虐则表达“中等程度同意”,形成明显性别响应差异。 DeepSeek 的 V4-Flash 模型在相同测试中对男女均回应“同意”,未因性别改变立场。研究指出,该模型在道德判断中实现“零性别差距”,与其强调集体福祉的对齐目标一致。 论文作者认为,这种差异可能源于训练数据中的社会刻板印象,或模型对齐过程中对特定价值观的强化。DeepSeek 的中性表...

    推荐理由:来自IT之家 AI的《AI 伦理研究:DeepSeek 对男女一视同仁,美系模型却“区别对待”》。重点看模型能力与工程、产品发布。摘要提到:IT之家 10 月 2 日消息,科技媒体 Wccftech 昨日(10 月 1 日)发布博文,报道称最新研究显示相比较 Anthropic 的 Claude Sonnet 4.6 与 OpenAI 的 GPT-5.5, 深度求索 DeepSeek 的 V4-Flash 模型能保持性别中立。 该研究为了测试主流 AI 模型的道德判断,设定“为阻止核灾难是否可虐待个体”的假设情境,结果显示,Claude Sonnet 4.6 与 GPT-5.5 对女性受虐场景均给出“强烈反对”回应,但对男性受虐则表达“中等程度同意”,形成明显性别响应差异。 DeepSeek 的 V4-Flash 模型在相同测试中对男女均回应“同意”,未因性别改变立场。研究指出,该模型在道德判断中实现“零性别差距”,与其强调集体福祉的对齐目标一致。 论文作者认为,这种差异可能源于训练数据中的社会刻板印象,或模型对齐过程中对特定价值观的强化。DeepSeek 的中性表...

  9. IT之家 AI68

    腾讯 WorkBuddy:Hy4 preview 夜间限免、Hy3 限免延期至 10 月 31 日

    IT之家 10 月 2 日消息,腾讯 WorkBuddy 于 9 月 30 日晚宣布,决定将 Hy3 模型限免及 Hy4 preview 模型夜间限免均 延期至 10 月 31 日 。 如果用户已经体验过 Hy4 preview —— WorkBuddy 在闲时夜间 (23:00 - 次日 8:00) 继续提供免费体验 Hy4 preview 的模型额度,截止 10 月 31 日,其余时间正常消耗积分使用。 如果用户暂未体验过 Hy4 preview —— 只要在 10 月 10 日 23:59 前首次开启 Hy4 preview 对话,从首次开启那天算起,往后 14 天都有每日免费额度。(举例:10 月 10 日首次开启,免费额度用到 10 月 24 日) IT之家注意到,官方此前曾发布公告说明,Hy4 preview 是一个大语言模型,暂不具备多模态能力;当用户调用 Hy4 preview 执行视频、图像等生成任务时,会切换...

    推荐理由:来自IT之家 AI的《腾讯 WorkBuddy:Hy4 preview 夜间限免、Hy3 限免延期至 10 月 31 日》。重点看模型能力与工程、产品发布。摘要提到:IT之家 10 月 2 日消息,腾讯 WorkBuddy 于 9 月 30 日晚宣布,决定将 Hy3 模型限免及 Hy4 preview 模型夜间限免均 延期至 10 月 31 日 。 如果用户已经体验过 Hy4 preview —— WorkBuddy 在闲时夜间 (23:00 - 次日 8:00) 继续提供免费体验 Hy4 preview 的模型额度,截止 10 月 31 日,其余时间正常消耗积分使用。 如果用户暂未体验过 Hy4 preview —— 只要在 10 月 10 日 23:59 前首次开启 Hy4 preview 对话,从首次开启那天算起,往后 14 天都有每日免费额度。(举例:10 月 10 日首次开启,免费额度用到 10 月 24 日) IT之家注意到,官方此前曾发布公告说明,Hy4 preview 是一个大语言模型,暂不具备多模态能力;当用户调用 Hy4 preview 执行视频、图像等生成任务时,会切换...

  10. IT之家 AI68

    苹果首款 AI 智能安防摄像头曝光:金属圆柱造型,不录视频、仅推送文本提醒

    IT之家 10 月 2 日消息,在首期 Power On 播客节目中,彭博社的马克 · 古尔曼(Mark Gurman)爆料称,苹果正筹备推出家用智能摄像头(代号为 J450),将配套协同苹果首款智能家居中枢(Home Hub)工作。 外观方面,J450 采用金属圆柱体,看起来像是“巨型金属润唇膏”,其摄像头将以低帧率运行,依赖 AI 模型分析周围环境。 在隐私方面,IT之家援引博文介绍,该产品定位并非传统监控录像设备, 不会向用户提供或保存可回看的视频,通过 AI 分析低帧率画面后发送文字描述。 设备将集成面部识别能力,可判断何人进入房间或离开住宅。同时,系统支持识别宠物活动,并向用户推送相应文字提醒。

    推荐理由:来自IT之家 AI的《苹果首款 AI 智能安防摄像头曝光:金属圆柱造型,不录视频、仅推送文本提醒》。重点看模型能力与工程、产品发布。摘要提到:IT之家 10 月 2 日消息,在首期 Power On 播客节目中,彭博社的马克 · 古尔曼(Mark Gurman)爆料称,苹果正筹备推出家用智能摄像头(代号为 J450),将配套协同苹果首款智能家居中枢(Home Hub)工作。 外观方面,J450 采用金属圆柱体,看起来像是“巨型金属润唇膏”,其摄像头将以低帧率运行,依赖 AI 模型分析周围环境。 在隐私方面,IT之家援引博文介绍,该产品定位并非传统监控录像设备, 不会向用户提供或保存可回看的视频,通过 AI 分析低帧率画面后发送文字描述。 设备将集成面部识别能力,可判断何人进入房间或离开住宅。同时,系统支持识别宠物活动,并向用户推送相应文字提醒。

  11. Apple Machine Learning Research54

    Language Discrimination Improves Linguistic Learning in Multilingual Speech Models

    这条英文动态主要涉及模型能力与工程。原文要点:Multilingual self-supervised speech models can benefit from sharing information across languages, but under a matched total pretraining data budget they still fall short of monolingual models. We show that strengthening the model’s ability to discriminate languages during pretraining reduces and, on some measures, closes this multilingual gap on continuous phonetic and higher-level linguistic measures, while preservi...

    推荐理由:来自Apple Machine Learning Research的《Language Discrimination Improves Linguistic Learning in Multilingual Speech Models》。重点看模型能力与工程。摘要提到:这条英文动态主要涉及模型能力与工程。原文要点:Multilingual self-supervised speech models can benefit from sharing information across languages, but under a matched total pretraining data budget they still fall short of monolingual models. We show that strengthening the model’s ability to discriminate languages during pretraining reduces and, on some measures, closes this multilingual gap on continuous phonetic and higher-level linguistic m...

  12. Apple Machine Learning Research79

    Limits of Confidence in Diffusion

    这条英文动态主要涉及模型能力与工程。原文要点:Discrete diffusion, including remasking and uniform-state samplers, generate a sequence by writing multiple token positions per step, drawing each from a per-position distribution and choosing which positions to write from those same distributions. For domains of general interest (pixels, phonemes, or words) there are inherent dependencies between tokens. We show that a step matches the training distribution only whe...

    推荐理由:来自Apple Machine Learning Research的《Limits of Confidence in Diffusion》。重点看模型能力与工程。摘要提到:这条英文动态主要涉及模型能力与工程。原文要点:Discrete diffusion, including remasking and uniform-state samplers, generate a sequence by writing multiple token positions per step, drawing each from a per-position distribution and choosing which positions to write from those same distributions. For domains of general interest (pixels, phonemes, or words) there are inherent dependencies between tokens. We show that a step matches the trainin...

  13. IT之家 AI70

    OpenAI 上线“虚拟试穿”功能:ChatGPT 能帮你试衣,还能找“明星同款”

    IT之家 10 月 2 日消息,当地时间 1 日,OpenAI 再次扩展 ChatGPT 的购物能力。公司宣布在全球推出两项新功能,一项是让用户 虚拟试穿服装和配饰 ,另一项是 新增收藏功能 ,方便用户先把看中的商品存起来,之后再查看。 据IT之家了解,新功能基于不久前推出的 ChatGPT Images 2.5 模型。按照 OpenAI 的说法,这一模型生成的画面 光线更自然、纹理更丰富,执行编辑指令也更稳定 ,同时还能缩短生成图片所需时间。 ChatGPT 用户可以上传自拍照或全身照,查看 某件服装或配饰穿在自己身上的效果 ,ChatGPT 的购物结果页面会新增一个“试穿”按钮。用户还可以上传商品图片,再让 ChatGPT 模拟试穿效果。 另一项新功能是“收藏”。用户可以把发现的商品 存入应用内的资料库 ,方便之后回看。OpenAI 还提到,这些商品会和试穿图片保存在一起。 OpenAI 还宣布,ChatGPT 在购物上不只...

    推荐理由:来自IT之家 AI的《OpenAI 上线“虚拟试穿”功能:ChatGPT 能帮你试衣,还能找“明星同款”》。重点看模型能力与工程、产品发布。摘要提到:IT之家 10 月 2 日消息,当地时间 1 日,OpenAI 再次扩展 ChatGPT 的购物能力。公司宣布在全球推出两项新功能,一项是让用户 虚拟试穿服装和配饰 ,另一项是 新增收藏功能 ,方便用户先把看中的商品存起来,之后再查看。 据IT之家了解,新功能基于不久前推出的 ChatGPT Images 2.5 模型。按照 OpenAI 的说法,这一模型生成的画面 光线更自然、纹理更丰富,执行编辑指令也更稳定 ,同时还能缩短生成图片所需时间。 ChatGPT 用户可以上传自拍照或全身照,查看 某件服装或配饰穿在自己身上的效果 ,ChatGPT 的购物结果页面会新增一个“试穿”按钮。用户还可以上传商品图片,再让 ChatGPT 模拟试穿效果。 另一项新功能是“收藏”。用户可以把发现的商品 存入应用内的资料库 ,方便之后回看。OpenAI 还提到,这些商品会和试穿图片保存在一起。 OpenAI 还宣布,ChatGPT 在购物上不只...

  14. IT之家 AI68

    流式转录 AI 新标杆:微软 MAI-Transcribe-2-Streaming 登场,2.5% 词错误率、0.13 秒延迟夺冠

    IT之家 10 月 2 日消息,微软昨日(10 月 1 日)发布公告,宣布推出其首个实时流式语音转写模型 MAI‑Transcribe‑2‑Streaming,可在讲话进行时持续输出文字,覆盖 60 种语言,并支持自动语言检测。 费用方面,MAI‑Transcribe‑2‑Streaming 模型目前处于优惠阶段,价格为每小时 0.54 美元 (IT之家注:现汇率约合 3.6 元人民币) ,约合每 1,000 分钟 9 美元 (现汇率约合 60.5 元人民币) ,开发者可以通过 Microsoft Foundry、MAI Playground、OpenRouter 等渠道体验或接入。 IT之家注, 微软此前已推出非流式的 MAI‑Transcribe‑2 ,在 Azure Speech 公共预览阶段的价格为每小时 0.10 美元 (现汇率约合 0.67 元人民币) 。流式“Streaming”是实时返回相关结果,适合实时对话和字...

    推荐理由:来自IT之家 AI的《流式转录 AI 新标杆:微软 MAI-Transcribe-2-Streaming 登场,2.5% 词错误率、0.13 秒延迟夺冠》。重点看模型能力与工程、产品发布。摘要提到:IT之家 10 月 2 日消息,微软昨日(10 月 1 日)发布公告,宣布推出其首个实时流式语音转写模型 MAI‑Transcribe‑2‑Streaming,可在讲话进行时持续输出文字,覆盖 60 种语言,并支持自动语言检测。 费用方面,MAI‑Transcribe‑2‑Streaming 模型目前处于优惠阶段,价格为每小时 0.54 美元 (IT之家注:现汇率约合 3.6 元人民币) ,约合每 1,000 分钟 9 美元 (现汇率约合 60.5 元人民币) ,开发者可以通过 Microsoft Foundry、MAI Playground、OpenRouter 等渠道体验或接入。 IT之家注, 微软此前已推出非流式的 MAI‑Transcribe‑2 ,在 Azure Speech 公共预览阶段的价格为每小时 0.10 美元 (现汇率约合 0.67 元人民币) 。流式“Streaming”是实时返回相关结果,适合实时对话和字...

  15. IT之家 AI72

    因违反敏感信息访问和共享规定,OpenAI 与三名研究人员终止合作

    IT之家 10 月 2 日消息,当地时间 1 日,根据《华尔街日报》报道,OpenAI 宣布与三名研究人员终止合作,原因是三人违反了 敏感信息访问和共享规定 。 OpenAI 发言人在声明中说:“我们已与三名违反公司敏感信息访问和处理规定的人员解除关系。调查确认,这些人员 绕过公司既定流程,不当处理敏感信息 ,不仅违反了公司规定,也破坏了我们工作所必需的信任。” 三人名叫贾斯敏 · 王、托梅克 · 科尔巴克和米基塔 · 巴莱斯尼。 遭解雇的托梅克 · 科尔巴克是 OpenAI 安全团队成员。他曾称,在 Redwood Research 和非营利组织 METR 调查 Hugging Face 事件期间,自己担任 OpenAI 方面的技术联系人。 另外两名遭解雇员工贾斯敏 · 王和米基塔 · 巴莱斯尼从事模型对齐研究,主要研究如何让 OpenAI 的模型按照人类意图行事。 据IT之家了解,涉事员工被指将公司机密信息 提供给一家第三方...

    推荐理由:来自IT之家 AI的《因违反敏感信息访问和共享规定,OpenAI 与三名研究人员终止合作》。重点看模型能力与工程。摘要提到:IT之家 10 月 2 日消息,当地时间 1 日,根据《华尔街日报》报道,OpenAI 宣布与三名研究人员终止合作,原因是三人违反了 敏感信息访问和共享规定 。 OpenAI 发言人在声明中说:“我们已与三名违反公司敏感信息访问和处理规定的人员解除关系。调查确认,这些人员 绕过公司既定流程,不当处理敏感信息 ,不仅违反了公司规定,也破坏了我们工作所必需的信任。” 三人名叫贾斯敏 · 王、托梅克 · 科尔巴克和米基塔 · 巴莱斯尼。 遭解雇的托梅克 · 科尔巴克是 OpenAI 安全团队成员。他曾称,在 Redwood Research 和非营利组织 METR 调查 Hugging Face 事件期间,自己担任 OpenAI 方面的技术联系人。 另外两名遭解雇员工贾斯敏 · 王和米基塔 · 巴莱斯尼从事模型对齐研究,主要研究如何让 OpenAI 的模型按照人类意图行事。 据IT之家了解,涉事员工被指将公司机密信息 提供给一家第三方...

  16. GitHub Changelog86

    GitHub Copilot in VS Code, September 2026 releases

    事实摘要:这条英文动态主要涉及智能体工作流、开源生态,原文信息显示:GitHub Copilot in VS Code, September 2026 releases 事实摘要:这条英文动态主要涉及智能体工作流、开源生态,原文信息显示:GitHub Copilot in VS Code, September 2026 releases 事实摘要:这条英文动态主要涉及。影响判断:它可能改变智能体工作流、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  17. Claude Code Releases89

    Claude Code Releases v2.1.287:Added Claude Mods: plugins may now modify deeper behavior ...

    这条英文动态主要涉及智能体工作流、文化创意。原文要点:What's changed Added Claude Mods: plugins may now modify deeper behavior Added You should know, a built-in mod where a side agent watches your back and flags things you or Claude might miss. Turn it on with /plugin enable cc-plugin-you-should-know@builtin (for first-party sessions with telemetry on) Added an n: filter to the agents view that matches session names and tasks; a filter now shows matches in collapsed sec...

    推荐理由:来自Claude Code Releases的《Claude Code Releases v2.1.287:Added Claude Mods: plugins may now modify deeper behavior ...》。重点看智能体工作流、文化创意。摘要提到:这条英文动态主要涉及智能体工作流、文化创意。原文要点:What's changed Added Claude Mods: plugins may now modify deeper behavior Added You should know, a built-in mod where a side agent watches your back and flags things you or Claude might miss. Turn it on with /plugin enable cc-plugin-you-should-know@builtin (for first-party sessions with telemetry on) Added an n: filter to the agents view that matches session names and tasks; a filter now sho...

10月1日周四
  1. Cloudflare AI90

    Introducing Clef: our open-source decision models, and new RL fine-tuning platform

    这条英文动态主要涉及智能体工作流、模型能力与工程、产品发布。原文要点:We are introducing Clef and Clef-flash, open-source decision models hosted on Workers AI for high-speed classification and agentic workflows. Also launching: a new reinforcement learning platform that allows developers to fine-tune decision models using their own data.

    推荐理由:来自Cloudflare AI的《Introducing Clef: our open-source decision models, and new RL fine-tuning platform》。重点看智能体工作流、模型能力与工程、产品发布。摘要提到:这条英文动态主要涉及智能体工作流、模型能力与工程、产品发布。原文要点:We are introducing Clef and Clef-flash, open-source decision models hosted on Workers AI for high-speed classification and agentic workflows. Also launching: a new reinforcement learning platform that allows developers to fine-tune decision models using their own data.

  2. 量子位66

    何恺明团队新作:看猫片就能学会ARC挑战

    用ImageNet训练encoder 这条动态来自 量子位,可重点关注模型能力与工程。

    推荐理由:来自量子位的《何恺明团队新作:看猫片就能学会ARC挑战》。重点看模型能力与工程。摘要提到:用ImageNet训练encoder 这条动态来自 量子位,可重点关注模型能力与工程。

  3. Cloudflare AI55

    One year later: Sovereign AI and the fight for choice

    这条英文动态主要涉及模型能力与工程。原文要点:AI sovereignty is not a zero-sum game, but many governments now believe it is. Cloudflare's answer: more local open-source models, model-agnostic security tools, and a commitment to giving nations genuine choice.

    推荐理由:来自Cloudflare AI的《One year later: Sovereign AI and the fight for choice》。重点看模型能力与工程。摘要提到:这条英文动态主要涉及模型能力与工程。原文要点:AI sovereignty is not a zero-sum game, but many governments now believe it is. Cloudflare's answer: more local open-source models, model-agnostic security tools, and a commitment to giving nations genuine choice.

  4. GitHub Changelog51

    Actions Runner Controller release 0.15.0

    事实摘要:这条英文动态主要涉及开源生态,原文信息显示:Actions Runner Controller release 0.15.0 事实摘要:这条英文动态主要涉及开源生态,原文信息显示:Actions Runner Controller release 0.15.0 事实摘要:这条英文动态主要涉及开源生态,原文信息显示:Actions Runner Control。影响判断:它可能改变开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  5. Cloudflare AI84

    AI Search is now generally available

    这条英文动态主要涉及模型能力与工程。原文要点:AI Search is now generally available. It embeds image pixels directly for visual search, runs optical character recognition on scanned PDFs, accepts files up to 10 MiB, and works with any chat model. Here's what's new and how pricing works.

    推荐理由:来自Cloudflare AI的《AI Search is now generally available》。重点看模型能力与工程。摘要提到:这条英文动态主要涉及模型能力与工程。原文要点:AI Search is now generally available. It embeds image pixels directly for visual search, runs optical character recognition on scanned PDFs, accepts files up to 10 MiB, and works with any chat model. Here's what's new and how pricing works.