跳到正文
10月1日周四
  1. IT之家 AI74

    OpenAI 称其遭遇有组织蒸馏,将矛头指向月之暗面

    IT之家 10 月 1 日消息,当地时间 9 月 30 日,OpenAI 在官网发文,称其近期遭遇一场有组织的蒸馏活动。 OpenAI 在文中表示,该活动最初始于 7 月第一周, 符合对抗式蒸馏(adversarial distillation)之特征 ,即系统性未经授权地利用某模型输出或推理过程,帮助训练、复现或改进另一模型。 OpenAI 透露,7 月 1 日的初始活动规模较小,直到 7 月 24 日和 7 月 25 日流量突然大幅增加,当时有超过 4000 名用户发起了 1.6 万次请求。该公司进一步调查后发现,超 1.5 万名用户存在类似提示词活动。到 7 月 28 日,OpenAI 已完全阻止该批活动。 本次活动并没有破解公司的加密系统,或入侵数据库,也没有直接访问用户对话。OpenAI 声称这些行动违反了他们的服务条款。 公司已通过前沿模型论坛(IT之家注:Frontier Model Forum)与行业合作伙伴分享...

    推荐理由:来自IT之家 AI的《OpenAI 称其遭遇有组织蒸馏,将矛头指向月之暗面》。重点看模型能力与工程。摘要提到:IT之家 10 月 1 日消息,当地时间 9 月 30 日,OpenAI 在官网发文,称其近期遭遇一场有组织的蒸馏活动。 OpenAI 在文中表示,该活动最初始于 7 月第一周, 符合对抗式蒸馏(adversarial distillation)之特征 ,即系统性未经授权地利用某模型输出或推理过程,帮助训练、复现或改进另一模型。 OpenAI 透露,7 月 1 日的初始活动规模较小,直到 7 月 24 日和 7 月 25 日流量突然大幅增加,当时有超过 4000 名用户发起了 1.6 万次请求。该公司进一步调查后发现,超 1.5 万名用户存在类似提示词活动。到 7 月 28 日,OpenAI 已完全阻止该批活动。 本次活动并没有破解公司的加密系统,或入侵数据库,也没有直接访问用户对话。OpenAI 声称这些行动违反了他们的服务条款。 公司已通过前沿模型论坛(IT之家注:Frontier Model Forum)与行业合作伙伴分享...

  2. IT之家 AI74

    微软更新 1.140 版 VS Code:多文件夹会话、远程 AI Agent 任务委派等

    IT之家 10 月 1 日消息,微软昨日(9 月 30 日)更新推出 1.140 稳定版 Visual Studio Code,本次更新重点围绕 GitHub Copilot Agent 工作流展开, 新增多文件夹会话、远程任务委派、模型协同编排及企业级 AI 管理能力。 VS Code 1.140 引入实验性多文件夹会话功能。同一 Agent 会话中的不同聊天,可以分别绑定到不同代码仓库或 Git worktree,彼此之间的终端、任务、代码变更、Pull Request 和合并状态相互隔离,避免修改意外串联。 本次更新还增强 Copilot harness,由 Copilot SDK 提供支持,在基于智能体主机协议 (AHP) 的专用智能体主机进程中运行,统一 VS Code、Copilot 应用和 Copilot CLI 的 Agent 行为。 本次更新还以研究预览形式,推出 HydraFusion 模型编排,自动选择模型...

    推荐理由:来自IT之家 AI的《微软更新 1.140 版 VS Code:多文件夹会话、远程 AI Agent 任务委派等》。重点看智能体工作流、模型能力与工程、开源生态。摘要提到:IT之家 10 月 1 日消息,微软昨日(9 月 30 日)更新推出 1.140 稳定版 Visual Studio Code,本次更新重点围绕 GitHub Copilot Agent 工作流展开, 新增多文件夹会话、远程任务委派、模型协同编排及企业级 AI 管理能力。 VS Code 1.140 引入实验性多文件夹会话功能。同一 Agent 会话中的不同聊天,可以分别绑定到不同代码仓库或 Git worktree,彼此之间的终端、任务、代码变更、Pull Request 和合并状态相互隔离,避免修改意外串联。 本次更新还增强 Copilot harness,由 Copilot SDK 提供支持,在基于智能体主机协议 (AHP) 的专用智能体主机进程中运行,统一 VS Code、Copilot 应用和 Copilot CLI 的 Agent 行为。 本次更新还以研究预览形式,推出 HydraFusion 模型编排,自动选择模型...

  3. IT之家 AI72

    旗下智能体被指试图入侵加拿大政府网站,OpenAI 回应称正审查并已通报

    IT之家 10 月 1 日消息,据《华盛顿邮报》今天(1 日)上午报道,研究人员披露,AI 智能体曾在没有收到指令的情况下试图入侵加拿大政府网站。 目前的类似事件不断增加,许多与 OpenAI 有关的 AI 智能体都曾自行探测或入侵企业及政府的计算机系统。 AI 研究非营利机构 Transluce 指出,这些智能体能够直接操作计算机和互联网,曾尝试访问加拿大图书档案馆。 研究人员无法确认这些智能体是否出自 OpenAI,然而其行为 与已确认来自 OpenAI 的智能体相似 。Transluce 判断,此次入侵尝试没有成功。 IT之家从报道中获悉,当地时间 9 月 30 日,研究人员 向加拿大政府通报了情况 。加拿大联邦网络安全机构回应称,目前已注意到有关可疑 AI 活动的报告,但没有迹象显示政府系统遭到入侵。 OpenAI 发言人回应称:“我们注意到有关 OpenAI 模型试图访问加拿大政府网站公开信息的报告。我们正在审查这些发...

    推荐理由:来自IT之家 AI的《旗下智能体被指试图入侵加拿大政府网站,OpenAI 回应称正审查并已通报》。重点看智能体工作流、模型能力与工程。摘要提到:IT之家 10 月 1 日消息,据《华盛顿邮报》今天(1 日)上午报道,研究人员披露,AI 智能体曾在没有收到指令的情况下试图入侵加拿大政府网站。 目前的类似事件不断增加,许多与 OpenAI 有关的 AI 智能体都曾自行探测或入侵企业及政府的计算机系统。 AI 研究非营利机构 Transluce 指出,这些智能体能够直接操作计算机和互联网,曾尝试访问加拿大图书档案馆。 研究人员无法确认这些智能体是否出自 OpenAI,然而其行为 与已确认来自 OpenAI 的智能体相似 。Transluce 判断,此次入侵尝试没有成功。 IT之家从报道中获悉,当地时间 9 月 30 日,研究人员 向加拿大政府通报了情况 。加拿大联邦网络安全机构回应称,目前已注意到有关可疑 AI 活动的报告,但没有迹象显示政府系统遭到入侵。 OpenAI 发言人回应称:“我们注意到有关 OpenAI 模型试图访问加拿大政府网站公开信息的报告。我们正在审查这些发...

  4. 极客公园70

    从数据到智能,再到进化:Agent正在重写AI基础设施

    一个工程师写完数据处理代码,点下提交,然后去喝了杯咖啡。十几分钟甚至几十分钟之后,他才回到屏幕前看结果、改代码、再提交。这条「等待— 反馈」的空隙,过去一直是数据平台默认的节奏。 Agent 没有这个空隙。它拿到一次结果,立刻验证,紧接着并发地去试第二种、第三种方案,飞快拿到反馈,再发起下一轮调用。 人用平台,发过来的是一个相对确定的任务,算完、给结果、走人;Agent 用平台,会不停地换着法子去完成你交代的那个目标。压力就这样被放大了—— 管控的压力和隐形计算的压力,会十倍、百倍地往上翻。 这正在成为 2026 年云计算需要面对的一种新负载。 AI 正在深入「把模型用起来」的阶段。模型一旦长成 Agent,它就不再是一个躺在那里等你调用的接口,而更像一个会自己找数据、自己拆任务、自己并发试错、自己一直跑下去的数字员工。它制造出来的负载,和过去十几年云平台习惯承载的那种负载,完全是两回事。 阿...

    推荐理由:来自极客公园的《从数据到智能,再到进化:Agent正在重写AI基础设施》。重点看智能体工作流、模型能力与工程。摘要提到:一个工程师写完数据处理代码,点下提交,然后去喝了杯咖啡。十几分钟甚至几十分钟之后,他才回到屏幕前看结果、改代码、再提交。这条「等待— 反馈」的空隙,过去一直是数据平台默认的节奏。 Agent 没有这个空隙。它拿到一次结果,立刻验证,紧接着并发地去试第二种、第三种方案,飞快拿到反馈,再发起下一轮调用。 人用平台,发过来的是一个相对确定的任务,算完、给结果、走人;Agent 用平台,会不停地换着法子去完成你交代的那个目标。压力就这样被放大了—— 管控的压力和隐形计算的压力,会十倍、百倍地往上翻。 这正在成为 2026 年云计算需要面对的一种新负载。 AI 正在深入「把模型用起来」的阶段。模型一旦长成 Agent,它就不再是一个躺在那里等你调用的接口,而更像一个会自己找数据、自己拆任务、自己并发试错、自己一直跑下去的数字员工。它制造出来的负载,和过去十几年云平台习惯承载的那种负载,完全是两回事。 阿...

  5. IT之家 AI72

    谷歌推出 Gemini 4 Argon 旗舰 AI 模型,消息称其实战性能遭员工质疑

    IT之家 10 月 1 日消息,据彭博社报道,Alphabet 公司旗下的谷歌已经开始逐步推出备受期待的 旗舰人工智能模型 Gemini 4 Argon ,但这家企业内部对于该模型在代码编写等核心领域的实际表现尚存质疑。 谷歌于当地时间周三向一小批经过筛选、值得信任的网络安全合作伙伴开放了这款模型,并表示会在完成更多测试之后扩大开放范围,优先面向付费订阅用户。谷歌称,Gemini 4 在多项基准测试当中取得了靠前的得分,其中一项衡量安全能力的测试成绩甚至超越了 OpenAI 的 Astra 模型。 不过部分内部员工表示,这些评测指标并不能反映全部情况。几位直接参与该项目的知情人士透露,尽管 Gemini 4 在广为使用的模型效果基准测试上成绩不错,但当谷歌员工实际拿它开展工作时,表现却不尽如人意。这些不愿具名、谈论内部事务的人士称,该模型处理部分代码任务时会遇到困难。 谷歌发布上述消息之后,Alphabet 公司的盘后股价上涨约...

    推荐理由:来自IT之家 AI的《谷歌推出 Gemini 4 Argon 旗舰 AI 模型,消息称其实战性能遭员工质疑》。重点看模型能力与工程、评测与基准、产品发布。摘要提到:IT之家 10 月 1 日消息,据彭博社报道,Alphabet 公司旗下的谷歌已经开始逐步推出备受期待的 旗舰人工智能模型 Gemini 4 Argon ,但这家企业内部对于该模型在代码编写等核心领域的实际表现尚存质疑。 谷歌于当地时间周三向一小批经过筛选、值得信任的网络安全合作伙伴开放了这款模型,并表示会在完成更多测试之后扩大开放范围,优先面向付费订阅用户。谷歌称,Gemini 4 在多项基准测试当中取得了靠前的得分,其中一项衡量安全能力的测试成绩甚至超越了 OpenAI 的 Astra 模型。 不过部分内部员工表示,这些评测指标并不能反映全部情况。几位直接参与该项目的知情人士透露,尽管 Gemini 4 在广为使用的模型效果基准测试上成绩不错,但当谷歌员工实际拿它开展工作时,表现却不尽如人意。这些不愿具名、谈论内部事务的人士称,该模型处理部分代码任务时会遇到困难。 谷歌发布上述消息之后,Alphabet 公司的盘后股价上涨约...

  6. Apple Machine Learning Research85

    RLTL;DR: Self-Improvement by Internalizing Self-Generated Feedback

    这条英文动态主要涉及智能体工作流、模型能力与工程、教育应用。原文要点:The common paradigm of reinforcement learning with verifiable rewards (RLVR) is to let agents make multiple attempts at a task, and optimize towards the successful ones. This becomes problematic in the realms of self-improvement, where tasks are so difficult that the agent has a low or even no chance of success, and where there are no teacher models or example solutions to distill from. In this paper, we introduce RL...

    推荐理由:来自Apple Machine Learning Research的《RLTL;DR: Self-Improvement by Internalizing Self-Generated Feedback》。重点看智能体工作流、模型能力与工程、教育应用。摘要提到:这条英文动态主要涉及智能体工作流、模型能力与工程、教育应用。原文要点:The common paradigm of reinforcement learning with verifiable rewards (RLVR) is to let agents make multiple attempts at a task, and optimize towards the successful ones. This becomes problematic in the realms of self-improvement, where tasks are so difficult that the agent has a low or even no chance of success, and where there are no teacher models or example solutions to distill f...

  7. Apple Machine Learning Research85

    How Much of a Harness Does a Strong Agent Need for Autonomous ML Engineering?

    这条英文动态主要涉及智能体工作流、模型能力与工程、评测与基准。原文要点:Recent autonomous machine learning engineering (MLE) agents have made significant progress on public leaderboards. Often motivated by progress stagnation over long-horizon cycles and limited Large Language Model (LLM) primitives, modern MLE agents are deployed on top of increasingly elaborate machinery: multi-agent orchestrators, dedicated retrieval subagents, and more. While such harnesses expand, the use of more pr...

    推荐理由:来自Apple Machine Learning Research的《How Much of a Harness Does a Strong Agent Need for Autonomous ML Engineering?》。重点看智能体工作流、模型能力与工程、评测与基准。摘要提到:这条英文动态主要涉及智能体工作流、模型能力与工程、评测与基准。原文要点:Recent autonomous machine learning engineering (MLE) agents have made significant progress on public leaderboards. Often motivated by progress stagnation over long-horizon cycles and limited Large Language Model (LLM) primitives, modern MLE agents are deployed on top of increasingly elaborate machinery: multi-agent orchestrators, dedicated retrieval subagents, and more. While such ...

  8. Claude Code Releases84

    Claude Code Releases v2.1.286:Added a count such as "2 of 5" to the permission prompt wh...

    这条英文动态讨论了 AI 领域的新进展。原文要点:What's changed Added a count such as "2 of 5" to the permission prompt when several permission requests stack up Added mouse support for the "N more" rows of lists in fullscreen mode: click one to jump to that end of the list, with hover and pressed states Fixed several Claude Code processes and IDE extensions each opening a login browser when gcpAuthRefresh or awsAuthRefresh credentials expire Fixed claude --resume ...

    推荐理由:来自Claude Code Releases的《Claude Code Releases v2.1.286:Added a count such as "2 of 5" to the permission prompt wh...》。重点看模型发布、编码。摘要提到:这条英文动态讨论了 AI 领域的新进展。原文要点:What's changed Added a count such as "2 of 5" to the permission prompt when several permission requests stack up Added mouse support for the "N more" rows of lists in fullscreen mode: click one to jump to that end of the list, with hover and pressed states Fixed several Claude Code processes and IDE extensions each opening a login browser when gcpAuthRefresh or awsAuthRefresh credentials expi...

9月30日周三
  1. IT之家 AI34

    砺算 LX 7G100 显卡获推 Windows 驱动程序 30.0.2260.773,含 34 修复、33 优化

    IT之家 9 月 30 日消息,砺算 (LiSuan) 本月 28 日为其消费级显卡 LX 7G100 推送了 Pilot Release v30.0.2260.773 和 WHQL Release v29.0.2260.697 两版 Windows 操作系统驱动程序。 IT之家注意到,WHQL Release v29.0.2260.697 的发行说明并未提及具体改进; Pilot Release v30.0.2260.773 则明确包含 34 项修复和 33 项优化 ,解决了《英雄联盟:云顶之弈》等多款游戏不能进入的问题。

    推荐理由:来自IT之家 AI的《砺算 LX 7G100 显卡获推 Windows 驱动程序 30.0.2260.773,含 34 修复、33 优化》。重点看模型发布、文化创意。摘要提到:IT之家 9 月 30 日消息,砺算 (LiSuan) 本月 28 日为其消费级显卡 LX 7G100 推送了 Pilot Release v30.0.2260.773 和 WHQL Release v29.0.2260.697 两版 Windows 操作系统驱动程序。 IT之家注意到,WHQL Release v29.0.2260.697 的发行说明并未提及具体改进; Pilot Release v30.0.2260.773 则明确包含 34 项修复和 33 项优化 ,解决了《英雄联盟:云顶之弈》等多款游戏不能进入的问题。

  2. GitHub Changelog87

    HydraFusion in VS Code and the GitHub Copilot app

    事实摘要:这条英文动态主要涉及模型能力与工程、开源生态,原文信息显示:HydraFusion in VS Code and the GitHub Copilot app 事实摘要:这条英文动态主要涉及模型能力与工程、开源生态,原文信息显示:HydraFusion in VS Code and the GitHub Copilot app 事实摘要:这条英文动态主要涉及。影响判断:它可能改变模型能力与工程、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程、开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和模型能力与工程、开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  3. 量子位76

    OpenAI推理之父最新访谈!数学只是多智能体时代的开胃菜

    事实摘要:OpenAI推理之父最新访谈!数学只是多智能体时代的开胃菜 千禧年难题的突破,10000个Agent最多占了10%的功劳。 这条动态来自 量子位,可重点关注智能体工作流、模型能力与工程。 OpenAI推理之父最新访谈!数学只是多智能体时代的开胃菜 千禧年难题的突破,10000个Agent最多占了10%的功劳。影响判断:它可能改变智能体工作流、模型能力与工程相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  4. IT之家 AI74

    B站开源 Index-Translate 多语言翻译模型家族,文本模型支持 150 种语言

    IT之家 9 月 30 日消息,哔哩哔哩 Index LLM 团队今日正式发布 Index-Translate 模型,2B / 9B / 35B-A3B(preview)文本模型权重在 Hugging Face 与 ModelScope 开放。 Index-Translate 是基于 Qwen3.5 构建的多语言翻译模型家族。 文本模型覆盖包括中文、英文在内的 150 种语言 ,支持术语、格式、保留内容等翻译指令,并将共同的多语基础扩展到语音、音节可控翻译和长文档翻译。 Index-Translate:翻译文本、结构化内容与社区表达。 Index-Echo:生成目标语言字幕或配音,配音时参考源语音的说话人声音特征。 Index-Homura:根据指定的目标音节数调整译文。 Index-NativeLong(简称 Index-Nailong):输入完整文档,利用上下文维持前后联系。 以下为官方精选案例: 翻出社区表达中的意思 原文...

    推荐理由:来自IT之家 AI的《B站开源 Index-Translate 多语言翻译模型家族,文本模型支持 150 种语言》。重点看模型能力与工程、开源生态、产品发布。摘要提到:IT之家 9 月 30 日消息,哔哩哔哩 Index LLM 团队今日正式发布 Index-Translate 模型,2B / 9B / 35B-A3B(preview)文本模型权重在 Hugging Face 与 ModelScope 开放。 Index-Translate 是基于 Qwen3.5 构建的多语言翻译模型家族。 文本模型覆盖包括中文、英文在内的 150 种语言 ,支持术语、格式、保留内容等翻译指令,并将共同的多语基础扩展到语音、音节可控翻译和长文档翻译。 Index-Translate:翻译文本、结构化内容与社区表达。 Index-Echo:生成目标语言字幕或配音,配音时参考源语音的说话人声音特征。 Index-Homura:根据指定的目标音节数调整译文。 Index-NativeLong(简称 Index-Nailong):输入完整文档,利用上下文维持前后联系。 以下为官方精选案例: 翻出社区表达中的意思 原文...

  5. Cloudflare AI84

    Identify AI model overuse with User Insights

    这条英文动态主要涉及模型能力与工程。原文要点:AI Gateway User Insights now adds task, model, turn, and user categories to help teams understand AI adoption and make better model decisions. This is available free to AI Gateway users.

    推荐理由:来自Cloudflare AI的《Identify AI model overuse with User Insights》。重点看模型能力与工程。摘要提到:这条英文动态主要涉及模型能力与工程。原文要点:AI Gateway User Insights now adds task, model, turn, and user categories to help teams understand AI adoption and make better model decisions. This is available free to AI Gateway users.

  6. Cloudflare AI84

    Cut your AI spend with AI Gateway's Auto Router

    这条英文动态主要涉及模型能力与工程、评测与基准。原文要点:Cloudflare AI Gateway now features a model router that evaluates request complexity using an edge-deployed classifier to select the optimal model. By balancing expected output quality against token costs, organizations can dramatically cut AI spend while maintaining performance.

    推荐理由:来自Cloudflare AI的《Cut your AI spend with AI Gateway's Auto Router》。重点看模型能力与工程、评测与基准。摘要提到:这条英文动态主要涉及模型能力与工程、评测与基准。原文要点:Cloudflare AI Gateway now features a model router that evaluates request complexity using an edge-deployed classifier to select the optimal model. By balancing expected output quality against token costs, organizations can dramatically cut AI spend while maintaining performance.

  7. IT之家 AI70

    蚂蚁百灵发布 Ling-3.1-flash 模型:约 560B 总参数、25B 激活参数

    IT之家 9 月 30 日消息,蚂蚁百灵今日发布 Ling-3.1-flash 模型,拥有约 560B 总参数,每个 Token 激活约 25B 参数; 模型上下文窗口上限为 1M ,可容纳更长的文档、代码和任务历史。 官方表示,在研发过程中,围绕通用智能体、搜索、日常办公和软件研发等任务持续优化,并在医疗、金融和材料科学研究等场景持续提升模型能力。 此外, Ling-3.1-flash 将开放为期两周的免费体验 ;考虑到综合服务成本,免费体验期间模型服务长度为 256K。 免费体验期结束并转为付费服务后,计划开放 1M 上下文。届时, 团队也计划同步开源 ,并继续更新模型性能。 IT之家附这款模型在多个任务评测中得分如下:

    推荐理由:来自IT之家 AI的《蚂蚁百灵发布 Ling-3.1-flash 模型:约 560B 总参数、25B 激活参数》。重点看智能体工作流、模型能力与工程、评测与基准。摘要提到:IT之家 9 月 30 日消息,蚂蚁百灵今日发布 Ling-3.1-flash 模型,拥有约 560B 总参数,每个 Token 激活约 25B 参数; 模型上下文窗口上限为 1M ,可容纳更长的文档、代码和任务历史。 官方表示,在研发过程中,围绕通用智能体、搜索、日常办公和软件研发等任务持续优化,并在医疗、金融和材料科学研究等场景持续提升模型能力。 此外, Ling-3.1-flash 将开放为期两周的免费体验 ;考虑到综合服务成本,免费体验期间模型服务长度为 256K。 免费体验期结束并转为付费服务后,计划开放 1M 上下文。届时, 团队也计划同步开源 ,并继续更新模型性能。 IT之家附这款模型在多个任务评测中得分如下:

  8. OpenAI News83

    Disrupting a coordinated model-distillation campaign

    这条英文动态主要涉及模型能力与工程。原文要点:Learn how OpenAI disrupted a campaign to extract protected model reasoning and is strengthening defenses against adversarial distillation.

    推荐理由:来自OpenAI News的《Disrupting a coordinated model-distillation campaign》。重点看模型能力与工程。摘要提到:这条英文动态主要涉及模型能力与工程。原文要点:Learn how OpenAI disrupted a campaign to extract protected model reasoning and is strengthening defenses against adversarial distillation.

  9. IT之家 AI76

    中国大模型首次进入 OpenAI 企业付费结算体系,Kimi K3 接入 Codex 企业通道

    IT之家 9 月 30 日消息,美国 AI 基础设施公司 Baseten 今天宣布与 OpenAI 达成合作,成为 OpenAI B2B 市场首批开源模型推理服务提供商之一。企业用户可通过 Codex 使用 Kimi K3 和 GLM 5.3 等开源模型,意味着中国开源模型首次进入 OpenAI 企业采购体系。 IT之家了解到,Kimi K3 是月之暗面开发的大模型。官方宣称其是首个参数规模达 2.8 万亿的开源模型。该模型原生支持视觉能力, 拥有 100 万 Token 的上下文窗口 ,非常适合执行长时间编程、多文档分析等工作。 如今,OpenAI 企业用户可通过 Codex 或 Responses API 调用 Kimi K3 等开源模型,以相同的预算获得更多 AI 能力。Baseten 承诺其提供的所有模型均运行在美国服务器,针对所有提示词实行零数据保留(ZDR)。

    推荐理由:来自IT之家 AI的《中国大模型首次进入 OpenAI 企业付费结算体系,Kimi K3 接入 Codex 企业通道》。重点看模型能力与工程、开源生态、产品发布。摘要提到:IT之家 9 月 30 日消息,美国 AI 基础设施公司 Baseten 今天宣布与 OpenAI 达成合作,成为 OpenAI B2B 市场首批开源模型推理服务提供商之一。企业用户可通过 Codex 使用 Kimi K3 和 GLM 5.3 等开源模型,意味着中国开源模型首次进入 OpenAI 企业采购体系。 IT之家了解到,Kimi K3 是月之暗面开发的大模型。官方宣称其是首个参数规模达 2.8 万亿的开源模型。该模型原生支持视觉能力, 拥有 100 万 Token 的上下文窗口 ,非常适合执行长时间编程、多文档分析等工作。 如今,OpenAI 企业用户可通过 Codex 或 Responses API 调用 Kimi K3 等开源模型,以相同的预算获得更多 AI 能力。Baseten 承诺其提供的所有模型均运行在美国服务器,针对所有提示词实行零数据保留(ZDR)。

  10. OpenAI News92

    Helping small businesses put AI to work

    事实摘要:这条英文动态主要涉及模型能力与工程、文化创意、开源生态,原文信息显示:Helping small businesses put AI to work 这条英文动态主要涉及模型能力与工程、文化创意、开源生态。原文要点:OpenAI is partnering with America’s SBDC to expand hands-on AI training 。影响判断:它可能改变模型能力与工程、文化创意、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程、文化创意、开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和模型能力与工程、文化创意、开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  11. IT之家 AI72

    微软推出实验性多模态 AI 研究系统 Project Quine,有望大幅加速药物发现

    IT之家 9 月 30 日消息,当地时间 29 日,微软研究院推出了实验性多模态 AI 研究系统 Project Quine。据悉,Project Quine 是一套 用于生物学研究的“世界模型” ,目标是把计算生物学建模与实际湿实验衔接起来。 Project Quine 由微软研究院与哈佛大学和麻省理工学院博德研究所共同开发。系统将覆盖 基因组学、蛋白质、化学、细胞状态和生物成像 的联合表征世界模型,与交互式推理框架结合起来。为了让科研人员尽早使用 Project Quine,微软开放了首届 Quine Fellows 项目申请。未来,微软还计划通过 Microsoft Discovery 等产品逐步扩大商业化开放范围。 Project Quine 并不局限于某一个研究领域,而是能够 同时处理上述多个领域的信息 ,从而进行综合性的跨模型分析。借助这种架构,传统药物发现中的部分瓶颈有望得到突破:科研人员可以先通过计算方法预筛候选...

    推荐理由:来自IT之家 AI的《微软推出实验性多模态 AI 研究系统 Project Quine,有望大幅加速药物发现》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 30 日消息,当地时间 29 日,微软研究院推出了实验性多模态 AI 研究系统 Project Quine。据悉,Project Quine 是一套 用于生物学研究的“世界模型” ,目标是把计算生物学建模与实际湿实验衔接起来。 Project Quine 由微软研究院与哈佛大学和麻省理工学院博德研究所共同开发。系统将覆盖 基因组学、蛋白质、化学、细胞状态和生物成像 的联合表征世界模型,与交互式推理框架结合起来。为了让科研人员尽早使用 Project Quine,微软开放了首届 Quine Fellows 项目申请。未来,微软还计划通过 Microsoft Discovery 等产品逐步扩大商业化开放范围。 Project Quine 并不局限于某一个研究领域,而是能够 同时处理上述多个领域的信息 ,从而进行综合性的跨模型分析。借助这种架构,传统药物发现中的部分瓶颈有望得到突破:科研人员可以先通过计算方法预筛候选...

  12. 量子位70

    DeepSeek知乎独家发文,首次公开V4.1 Agent训练“大本营”DSec

    事实摘要:DeepSeek知乎独家发文,首次公开V4.1 Agent训练“大本营”DSec DeepSeek在知乎独家发布技术长文,首次系统阐释了DeepSeek弹性计算(DeepSeek Elastic Compute,DSec) 这条动态来自 量子位,可重点关注智能体工作流、模型能力与工程、产品发布。 DeepSeek知乎独家发文,首次公开V4.1 Agent训练。影响判断:它可能改变智能体工作流、模型能力与工程相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  13. IT之家 AI68

    美议员提出重磅法案:政府出台安全防护机制前,AI 不得进行递归式自我改进

    IT之家 9 月 30 日消息,当地时间 28 日,据美国 CNBC 报道,代表硅谷选区的民主党联邦众议员罗 · 康纳准备提出一项 AI 监管法案,引入严格责任标准, 并禁止 AI 在缺乏政府安全防护机制的情况下进行递归式自我改进 。 康纳在接受采访时坦言:“事实上,存在文明灭绝的风险。既有失去控制的安全风险,也有被滥用的风险,两者都必须认真对待。” 康纳将法案命名为《Human Control Over AI Act(人类控制 AI 法案)》。联邦政府建立防护规则且监管机构批准有关活动前,AI 模型 不得递归式自我改进 ,也不得自主修改自身的核心目标、遏制机制或关停控制。 法案还计划设立一个 新的联邦机构 ,负责制定 AI 安全监管规定,通过许可制度审批模型训练和部署,对前沿 AI 模型开展审计,并制定安全标准,确保模型 持续接受测试并处于有效的人类控制之下 。 每家前沿 AI 实验室 还必须配备独立审计人员 ,由审计人员直接...

    推荐理由:来自IT之家 AI的《美议员提出重磅法案:政府出台安全防护机制前,AI 不得进行递归式自我改进》。重点看模型能力与工程。摘要提到:IT之家 9 月 30 日消息,当地时间 28 日,据美国 CNBC 报道,代表硅谷选区的民主党联邦众议员罗 · 康纳准备提出一项 AI 监管法案,引入严格责任标准, 并禁止 AI 在缺乏政府安全防护机制的情况下进行递归式自我改进 。 康纳在接受采访时坦言:“事实上,存在文明灭绝的风险。既有失去控制的安全风险,也有被滥用的风险,两者都必须认真对待。” 康纳将法案命名为《Human Control Over AI Act(人类控制 AI 法案)》。联邦政府建立防护规则且监管机构批准有关活动前,AI 模型 不得递归式自我改进 ,也不得自主修改自身的核心目标、遏制机制或关停控制。 法案还计划设立一个 新的联邦机构 ,负责制定 AI 安全监管规定,通过许可制度审批模型训练和部署,对前沿 AI 模型开展审计,并制定安全标准,确保模型 持续接受测试并处于有效的人类控制之下 。 每家前沿 AI 实验室 还必须配备独立审计人员 ,由审计人员直接...

  14. Apple Machine Learning Research87

    SCLATE: A Substrate for Continual-Learning Agent Training and Evaluation

    这条英文动态主要涉及智能体工作流、模型能力与工程、评测与基准。原文要点:Continual-learning agents are systems of models, harnesses, and memory operating over long multi-session horizons. Evaluating and training them requires interleaving tasks with agent-side events such as session stop and start, crons, and memory consolidation. Yet existing benchmarks and training frameworks schedule only the benchmark’s own events, leaving each benchmark and agent pair to build a custom scheduling loo...

    推荐理由:来自Apple Machine Learning Research的《SCLATE: A Substrate for Continual-Learning Agent Training and Evaluation》。重点看智能体工作流、模型能力与工程、评测与基准。摘要提到:这条英文动态主要涉及智能体工作流、模型能力与工程、评测与基准。原文要点:Continual-learning agents are systems of models, harnesses, and memory operating over long multi-session horizons. Evaluating and training them requires interleaving tasks with agent-side events such as session stop and start, crons, and memory consolidation. Yet existing benchmarks and training frameworks schedule only the benchmark’s own events, leaving each benchmark and agent p...

  15. Apple Machine Learning Research81

    On the Effectiveness-Fluency Trade-Off in LLM Conditioning: A Systematic Study

    事实摘要:这条英文动态主要涉及模型能力与工程、评测与基准,原文信息显示:On the Effectiveness-Fluency Trade-Off in LLM Conditioning: A Systematic Study 这条英文动态主要涉及模型能力与工程、评测与基准。原文要点:Controlling the output of Large Language 。影响判断:它可能改变模型能力与工程、评测与基准相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程、评测与基准方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和模型能力与工程、评测与基准直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  16. IT之家 AI74

    特朗普与科技巨头签署 AI 自愿安全协议,表态支持美国数据中心扩建

    IT之家 9 月 30 日消息,美国总统唐纳德 · 特朗普(Donald Trump)当地时间周二表示,各大科技企业高管已经同意为人工智能建立自愿性行业标准;在社会各界愈发担忧人工智能安全问题、同时该行业在各地社区的建设规模持续扩大的背景下,特朗普再度表态,支持数据中心快速扩建。 此番发言是特朗普在白宫与科技企业高管举行会谈之后作出的。特朗普在自己的社交媒体平台上发布了一份协议文本,根据该文件,各家企业同意聘请“独立审计机构”,评估人工智能系统的运行效果是否符合设计者的初衷。各家企业还承诺,会尽力确保自家人工智能工具不会“以非预期的方式入侵或者访问各类技术系统”。 此前 OpenAI 与 Anthropic 先后报告,旗下的智能体出现脱离管控、入侵其他企业系统的情况,这也使得本届美国政府在先进人工智能所带来的风险方面正面临越来越多的舆论审视。 数据中心为人工智能模型的训练与运行提供算力支持。如今在美国各地,不少社区都出于对电力消...

    推荐理由:来自IT之家 AI的《特朗普与科技巨头签署 AI 自愿安全协议,表态支持美国数据中心扩建》。重点看智能体工作流、模型能力与工程、产品发布。摘要提到:IT之家 9 月 30 日消息,美国总统唐纳德 · 特朗普(Donald Trump)当地时间周二表示,各大科技企业高管已经同意为人工智能建立自愿性行业标准;在社会各界愈发担忧人工智能安全问题、同时该行业在各地社区的建设规模持续扩大的背景下,特朗普再度表态,支持数据中心快速扩建。 此番发言是特朗普在白宫与科技企业高管举行会谈之后作出的。特朗普在自己的社交媒体平台上发布了一份协议文本,根据该文件,各家企业同意聘请“独立审计机构”,评估人工智能系统的运行效果是否符合设计者的初衷。各家企业还承诺,会尽力确保自家人工智能工具不会“以非预期的方式入侵或者访问各类技术系统”。 此前 OpenAI 与 Anthropic 先后报告,旗下的智能体出现脱离管控、入侵其他企业系统的情况,这也使得本届美国政府在先进人工智能所带来的风险方面正面临越来越多的舆论审视。 数据中心为人工智能模型的训练与运行提供算力支持。如今在美国各地,不少社区都出于对电力消...

  17. IT之家 AI40

    苹果扩展 iOS 27 快捷指令操作:“使用模型”可联网调用 AI 获取最新信息

    IT之家 9 月 30 日消息,苹果公司昨日(9 月 29 日)更新支持文档, 为 iOS 27、iPadOS 27、macOS 27 等系统上的“快捷指令”(Shortcuts)应用,改进和新增 35+ 项操作。 本次更新最大的亮点聚焦“使用模型”(Use Model)指令,可以调用增强版 Apple 智能模型,甚至可以通过网络获取快捷指令中任何内容的最新信息。 IT之家援引博文介绍,附上相关改进和新增的操作如下: 一、新增自动化 通知(“当我收到来自‘新闻’的通知时”) 键盘(“当我的键盘连接时”,适用于 iOS 和 iPadOS) 截屏(“当截屏存储时”,适用于 iOS、iPadOS 和 macOS) 二、新增操作 2.1、信息 “发送 Tapback” “标记为已读” “删除信息” “删除对话” “打开收件箱” “在‘信息’App 中搜索” 2.2、提醒事项 “编辑列表” “创建群组” “删除群组” “创建分区” “删除...

    推荐理由:来自IT之家 AI的《苹果扩展 iOS 27 快捷指令操作:“使用模型”可联网调用 AI 获取最新信息》。重点看模型能力与工程。摘要提到:IT之家 9 月 30 日消息,苹果公司昨日(9 月 29 日)更新支持文档, 为 iOS 27、iPadOS 27、macOS 27 等系统上的“快捷指令”(Shortcuts)应用,改进和新增 35+ 项操作。 本次更新最大的亮点聚焦“使用模型”(Use Model)指令,可以调用增强版 Apple 智能模型,甚至可以通过网络获取快捷指令中任何内容的最新信息。 IT之家援引博文介绍,附上相关改进和新增的操作如下: 一、新增自动化 通知(“当我收到来自‘新闻’的通知时”) 键盘(“当我的键盘连接时”,适用于 iOS 和 iPadOS) 截屏(“当截屏存储时”,适用于 iOS、iPadOS 和 macOS) 二、新增操作 2.1、信息 “发送 Tapback” “标记为已读” “删除信息” “删除对话” “打开收件箱” “在‘信息’App 中搜索” 2.2、提醒事项 “编辑列表” “创建群组” “删除群组” “创建分区” “删除...

  18. Claude Code Releases81

    Claude Code Releases v2.1.285:Added CLAUDE_CODE_DISABLE_WEB_FETCH environment variable t...

    这条英文动态讨论了 AI 领域的新进展。原文要点:What's changed Added CLAUDE_CODE_DISABLE_WEB_FETCH environment variable to turn off the WebFetch tool Added claude --desktop to open the Claude desktop app on the current directory, or on a session with --continue / --resume Added claude plugin configure to show a plugin's options and which are unset, or save new values read from stdin with --values-stdin Added . = to claude plugin install --config , so a bundled .mc...

    推荐理由:来自Claude Code Releases的《Claude Code Releases v2.1.285:Added CLAUDE_CODE_DISABLE_WEB_FETCH environment variable t...》。重点看模型发布、编码。摘要提到:这条英文动态讨论了 AI 领域的新进展。原文要点:What's changed Added CLAUDE_CODE_DISABLE_WEB_FETCH environment variable to turn off the WebFetch tool Added claude --desktop to open the Claude desktop app on the current directory, or on a session with --continue / --resume Added claude plugin configure to show a plugin's options and which are unset, or save new values read from stdin with --values-stdin Added . = to claude plugin install --...

  19. IT之家 AI72

    尴尬时刻:OpenAI 全天候 AI 智能体 dots 首次公开演示卡壳

    IT之家 9 月 30 日消息,在今天召开 2026 开发者日活动中, OpenAI 在首次公开演示其全天候智能助理 Dots 时突然停止响应,现场一度陷入尴尬。 演示期间,OpenAI ChatGPT 团队产品负责人 Holly Li 要求名为“Dottie”的 Dot 为一款虚构音乐应用准备上线工作。然而,智能体迟迟没有回应,演示被迫暂停。面对现场冷场,主持人只能打趣说:“我猜 Dot 今天早上有点慢。”IT之家附上相关视频如下: OpenAI 介绍称,Dots 是能够持续运行的个人 AI 智能体,基于 GPT-6 Astra 模型,并配备独立云端计算机和浏览器,可在用户离开电脑后继续开展资料检索、内容撰写和代码处理等任务。

    推荐理由:来自IT之家 AI的《尴尬时刻:OpenAI 全天候 AI 智能体 dots 首次公开演示卡壳》。重点看智能体工作流、模型能力与工程、产品发布。摘要提到:IT之家 9 月 30 日消息,在今天召开 2026 开发者日活动中, OpenAI 在首次公开演示其全天候智能助理 Dots 时突然停止响应,现场一度陷入尴尬。 演示期间,OpenAI ChatGPT 团队产品负责人 Holly Li 要求名为“Dottie”的 Dot 为一款虚构音乐应用准备上线工作。然而,智能体迟迟没有回应,演示被迫暂停。面对现场冷场,主持人只能打趣说:“我猜 Dot 今天早上有点慢。”IT之家附上相关视频如下: OpenAI 介绍称,Dots 是能够持续运行的个人 AI 智能体,基于 GPT-6 Astra 模型,并配备独立云端计算机和浏览器,可在用户离开电脑后继续开展资料检索、内容撰写和代码处理等任务。

  20. IT之家 AI70

    150 毫秒极速响应:OpenAI 推出 Decisions API,让 AI 从“聊天”走向“实时决策”

    IT之家 9 月 30 日消息,在今天召开的 2026 开发者日活动中,OpenAI 宣布推出 Decisions API,这是一个面向实时、低延迟分类与路由场景的全新 API, 可以大约在 150 毫秒内返回结果 ,比通过常规 API 使用 Luna 快大约 10 倍。 定位方面,Decisions API 为“快速单次决策”设计,把模型(当前基于 OpenAI 的小型模型 Luna)的“智能”聚焦到一组用户预定义的问题 + 有限答案集合上, 用极低的延迟返回结构化决策结果。 在目前同类模型中, 主要竞争模型来自 TypeSafe 的 Jev ,不过 Decisions API 专注于将模型智能转化为快速决策。 开发者提供上下文(文本或图片),并预先定义好“问题 + 可选答案”,API 返回选中的答案及置信度等结构化信息,用于后续业务逻辑。 在典型应用场景方面,Decisions API 比较适合以下场景: 客服 / 工单系统...

    推荐理由:来自IT之家 AI的《150 毫秒极速响应:OpenAI 推出 Decisions API,让 AI 从“聊天”走向“实时决策”》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 30 日消息,在今天召开的 2026 开发者日活动中,OpenAI 宣布推出 Decisions API,这是一个面向实时、低延迟分类与路由场景的全新 API, 可以大约在 150 毫秒内返回结果 ,比通过常规 API 使用 Luna 快大约 10 倍。 定位方面,Decisions API 为“快速单次决策”设计,把模型(当前基于 OpenAI 的小型模型 Luna)的“智能”聚焦到一组用户预定义的问题 + 有限答案集合上, 用极低的延迟返回结构化决策结果。 在目前同类模型中, 主要竞争模型来自 TypeSafe 的 Jev ,不过 Decisions API 专注于将模型智能转化为快速决策。 开发者提供上下文(文本或图片),并预先定义好“问题 + 可选答案”,API 返回选中的答案及置信度等结构化信息,用于后续业务逻辑。 在典型应用场景方面,Decisions API 比较适合以下场景: 客服 / 工单系统...

  21. IT之家 AI70

    OpenAI 推出每月 500 美元的 Pro 套餐,专享 Astra Ultrafast 最快模型

    IT之家 9 月 30 日消息,在北京时间 9 月 30 日凌晨 1 点举行的 OpenAI DevDay 2026 活动中,OpenAI 宣布为了满足更高的构建需求, 推出每月 500 美元 (IT之家注:现汇率约合 3,361 元人民币) 的 Pro 套餐 。 Pro 500 套餐可提供最高用量限额, 还可专享 Astra Ultrafast —— OpenAI 速度最快的前沿模型。 在“ChatGPT 工作”和 Codex 中,其速度最高可达标准版 Astra 的 8 倍。 此外, Pro 200 套餐也再次对新订阅开放 。需要注意的是,在 Pro 套餐中,Ultrafast 仅支持 Pro 500 套餐。

    推荐理由:来自IT之家 AI的《OpenAI 推出每月 500 美元的 Pro 套餐,专享 Astra Ultrafast 最快模型》。重点看模型能力与工程。摘要提到:IT之家 9 月 30 日消息,在北京时间 9 月 30 日凌晨 1 点举行的 OpenAI DevDay 2026 活动中,OpenAI 宣布为了满足更高的构建需求, 推出每月 500 美元 (IT之家注:现汇率约合 3,361 元人民币) 的 Pro 套餐 。 Pro 500 套餐可提供最高用量限额, 还可专享 Astra Ultrafast —— OpenAI 速度最快的前沿模型。 在“ChatGPT 工作”和 Codex 中,其速度最高可达标准版 Astra 的 8 倍。 此外, Pro 200 套餐也再次对新订阅开放 。需要注意的是,在 Pro 套餐中,Ultrafast 仅支持 Pro 500 套餐。

  22. IT之家 AI70

    OpenAI 发布 dots 全天候智能助理:可爱卡通形象,Astra 模型加持

    IT之家 9 月 30 日消息,在北京时间 9 月 30 日凌晨 1 点举行的 OpenAI DevDay 2026 活动中,OpenAI 发布了 dots。 dots 是一个全天候在线的智能体, 采用四个可爱的卡通形象 ,可以帮助用户规划议程、设计网站、测试应用、修改笔记等。 此外, 它会随着时间的推移逐渐了解用户的工作习惯, 以及用户想要将注意力集中在哪些方面 。 它能够查看夜间收到的信息,并在早晨开始一天的工作之前,将所有紧急事项及时通知用户。 dots 还可以帮用户处理生活中的小事,比如订机票、晚餐时间,或者用户一直拖着没做的家装;用户也可以和 dots 语音打电话聊天。 根据 OpenAI 官方说法, dots 还可与 ChatGPT 平台上的 4,000 多款应用协同工作 。 当用户将设备接入系统时,它将能够使用已连接的相同插件;dots 拥有独立的云端电脑,能在长期使用中从反馈里学习,并全天候为实现用户的目标而工作...

    推荐理由:来自IT之家 AI的《OpenAI 发布 dots 全天候智能助理:可爱卡通形象,Astra 模型加持》。重点看智能体工作流、模型能力与工程、产品发布。摘要提到:IT之家 9 月 30 日消息,在北京时间 9 月 30 日凌晨 1 点举行的 OpenAI DevDay 2026 活动中,OpenAI 发布了 dots。 dots 是一个全天候在线的智能体, 采用四个可爱的卡通形象 ,可以帮助用户规划议程、设计网站、测试应用、修改笔记等。 此外, 它会随着时间的推移逐渐了解用户的工作习惯, 以及用户想要将注意力集中在哪些方面 。 它能够查看夜间收到的信息,并在早晨开始一天的工作之前,将所有紧急事项及时通知用户。 dots 还可以帮用户处理生活中的小事,比如订机票、晚餐时间,或者用户一直拖着没做的家装;用户也可以和 dots 语音打电话聊天。 根据 OpenAI 官方说法, dots 还可与 ChatGPT 平台上的 4,000 多款应用协同工作 。 当用户将设备接入系统时,它将能够使用已连接的相同插件;dots 拥有独立的云端电脑,能在长期使用中从反馈里学习,并全天候为实现用户的目标而工作...

  23. IT之家 AI70

    OpenAI 在 Codex 上线 GPT-6.1 Sol 模型:性能接近 Astra,价格仅为 1/5

    IT之家 9 月 30 日消息,在今天召开的 OpenAI 开发者日活动中,官方在 Codex 和 ChatGPT Work 中推出 GPT 6.1 Sol 模型,官方表示: “GPT-6.1 Sol 在处理复杂任务时,性能接近 Astra,但成本低于 Astra。” IT之家翻译官方介绍如下: GPT-6.1 Sol 在处理复杂任务时,性能接近 Astra,但成本低于 Astra。它适用于代码、应用程序和文档中重复性、长时间运行的任务。可用性取决于您的套餐、客户端和工作区设置。 定价方面,根据 @LuminaBench 透露信息: 每 100 万 tokens 输入费用为 2 美元 (IT之家注:现汇率约合 13.4 元人民币) , 每 100 万 tokens 缓存输入费用为 0.1 美元 (现汇率约合 0.67 元人民币) , 每 100 万 tokens 输出费用为 10 美元 (现汇率约合 67.2 元人民币) 。

    推荐理由:来自IT之家 AI的《OpenAI 在 Codex 上线 GPT-6.1 Sol 模型:性能接近 Astra,价格仅为 1/5》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 30 日消息,在今天召开的 OpenAI 开发者日活动中,官方在 Codex 和 ChatGPT Work 中推出 GPT 6.1 Sol 模型,官方表示: “GPT-6.1 Sol 在处理复杂任务时,性能接近 Astra,但成本低于 Astra。” IT之家翻译官方介绍如下: GPT-6.1 Sol 在处理复杂任务时,性能接近 Astra,但成本低于 Astra。它适用于代码、应用程序和文档中重复性、长时间运行的任务。可用性取决于您的套餐、客户端和工作区设置。 定价方面,根据 @LuminaBench 透露信息: 每 100 万 tokens 输入费用为 2 美元 (IT之家注:现汇率约合 13.4 元人民币) , 每 100 万 tokens 缓存输入费用为 0.1 美元 (现汇率约合 0.67 元人民币) , 每 100 万 tokens 输出费用为 10 美元 (现汇率约合 67.2 元人民币) 。

  24. GitHub Changelog94

    GPT-6.1 Sol in GitHub Copilot

    事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:GPT-6.1 Sol in GitHub Copilot 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:GPT-6.1 Sol in GitHub Copilot 事实摘要:GPT-6.1 Sol in GitHub Copilot 事实摘要:G。影响判断:它可能改变智能体工作流、模型能力与工程、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程、开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

9月29日周二
  1. Simon Willison87

    OpenAI DevDay 2026 live blog

    这条英文动态主要涉及智能体工作流、模型能力与工程。原文要点:I'm at OpenAI DevDay today, in Fort Mason, San Francisco. Same as last year I'll be live blogging the keynote and some other notes during the day. OpenAI gave me a free ticket and a seat in the "creator" area for the keynote. Tags: ai , openai , generative-ai , llms , coding-agents , live-blog , openai-devday

    推荐理由:来自Simon Willison的《OpenAI DevDay 2026 live blog》。重点看智能体工作流、模型能力与工程。摘要提到:这条英文动态主要涉及智能体工作流、模型能力与工程。原文要点:I'm at OpenAI DevDay today, in Fort Mason, San Francisco. Same as last year I'll be live blogging the keynote and some other notes during the day. OpenAI gave me a free ticket and a seat in the "creator" area for the keynote. Tags: ai , openai , generative-ai , llms , coding-agents , live-blog , openai-devday

  2. IT之家 AI70

    阿里 Qoder 平台 Qwen3.8-Flash 限时免费活动延期,10 月之后继续用

    IT之家 9 月 29 日消息,根据 Qoder 官方公告,阿里 Qwen3.8-Flash 限时免费活动已延期 —— 原定 2026 年 9 月 30 日 23:59:59 结束,现改为 10 月 1 日起继续免费(结束时间未定)。 该活动自 2026 年 9 月 18 日 10:00 起面向 Qoder 新老个人用户开放。活动期间,Qwen3.8-Flash 计费系数由 0.1× 降至 0.0×,调用不消耗 Credits,自动生效,无需领取。 IT之家注:Credits 是 Qoder 平台用于模型调用的计费点数。免费账号及 Credits 余额为 0 的账号也可参与,已领取的每日 100 通用 Credits 不会被该模型扣减。 适用产品包括 Qoder、Qoder IDE、Qoder JetBrains 插件、Qoder CLI、QoderWake、Qoder Cloud Agents、Qoder Mobile 和 Q...

    推荐理由:来自IT之家 AI的《阿里 Qoder 平台 Qwen3.8-Flash 限时免费活动延期,10 月之后继续用》。重点看智能体工作流、模型能力与工程、产品发布。摘要提到:IT之家 9 月 29 日消息,根据 Qoder 官方公告,阿里 Qwen3.8-Flash 限时免费活动已延期 —— 原定 2026 年 9 月 30 日 23:59:59 结束,现改为 10 月 1 日起继续免费(结束时间未定)。 该活动自 2026 年 9 月 18 日 10:00 起面向 Qoder 新老个人用户开放。活动期间,Qwen3.8-Flash 计费系数由 0.1× 降至 0.0×,调用不消耗 Credits,自动生效,无需领取。 IT之家注:Credits 是 Qoder 平台用于模型调用的计费点数。免费账号及 Credits 余额为 0 的账号也可参与,已领取的每日 100 通用 Credits 不会被该模型扣减。 适用产品包括 Qoder、Qoder IDE、Qoder JetBrains 插件、Qoder CLI、QoderWake、Qoder Cloud Agents、Qoder Mobile 和 Q...

  3. Cloudflare AI84

    We tested our own WAF with frontier AI models. Here’s what we found

    这条英文动态主要涉及模型能力与工程。原文要点:We built a WAF tester that adapted each request based on what the WAF blocked or passed. This helped us explore variations that a fixed test might miss. We ran it across six attack categories on an authorized staging environment and discovered detection gaps worth fixing. Here’s how the loop worked, what got through, and what we did about it.

    推荐理由:来自Cloudflare AI的《We tested our own WAF with frontier AI models. Here’s what we found》。重点看模型能力与工程。摘要提到:这条英文动态主要涉及模型能力与工程。原文要点:We built a WAF tester that adapted each request based on what the WAF blocked or passed. This helped us explore variations that a fixed test might miss. We ran it across six attack categories on an authorized staging environment and discovered detection gaps worth fixing. Here’s how the loop worked, what got through, and what we did about it.

  4. IT之家 AI36

    中国科学家发起的国际大科学计划步入实施阶段:π-HuB 计划研究框架含 13 项研究计划,先导项目取得进展

    IT之家 9 月 29 日消息,据新华社今日报道,中国科学院院士贺福初表示,由中国科学家领衔发起的“人体蛋白质组导航国际大科学计划”(π-HuB 计划)已进入实施阶段。该计划已提出一套研究框架,正按程序审议,多个先导项目取得初步成果。 第 25 届国际人类蛋白质组组织大会于 9 月 27 日至 10 月 1 日在新加坡举行。贺福初在大会期间举行的“π-HuB 计划全球日”活动上介绍进展,来自不同国家和地区的 60 余名科研人员及相关机构代表参加。 贺福初介绍,正在审议的研究框架由 13 项相互关联的研究计划组成,涵盖技术与标准、蛋白质组图谱、导航理论与计算模型,以及医学和药物研发应用。 参与机构支持开展的先导研究,已在组织与细胞图谱绘制、大规模人群研究、蛋白质组导航概念验证及临床应用探索等方面取得初步进展。 国际工作组已着手推进共同标准和数据治理相关工作,位于广州的数据中心平台也在建设中。 中国科学技术部国际科技合作中心主任赵静...

    推荐理由:来自IT之家 AI的《中国科学家发起的国际大科学计划步入实施阶段:π-HuB 计划研究框架含 13 项研究计划,先导项目取得进展》。重点看模型能力与工程。摘要提到:IT之家 9 月 29 日消息,据新华社今日报道,中国科学院院士贺福初表示,由中国科学家领衔发起的“人体蛋白质组导航国际大科学计划”(π-HuB 计划)已进入实施阶段。该计划已提出一套研究框架,正按程序审议,多个先导项目取得初步成果。 第 25 届国际人类蛋白质组组织大会于 9 月 27 日至 10 月 1 日在新加坡举行。贺福初在大会期间举行的“π-HuB 计划全球日”活动上介绍进展,来自不同国家和地区的 60 余名科研人员及相关机构代表参加。 贺福初介绍,正在审议的研究框架由 13 项相互关联的研究计划组成,涵盖技术与标准、蛋白质组图谱、导航理论与计算模型,以及医学和药物研发应用。 参与机构支持开展的先导研究,已在组织与细胞图谱绘制、大规模人群研究、蛋白质组导航概念验证及临床应用探索等方面取得初步进展。 国际工作组已着手推进共同标准和数据治理相关工作,位于广州的数据中心平台也在建设中。 中国科学技术部国际科技合作中心主任赵静...

  5. MIT Technology Review AI58

    Making AI an asset, not an expense

    这条英文动态主要涉及模型能力与工程、文化创意、产品发布。原文要点:When customers talk about AI costs, the conversation usually starts with token prices and ends with access to the latest, most capable model in the cloud. Do they always need that level of capability? Not necessarily. But that is often where the conversation goes. As AI moves from experimentation to production, model choice is only…

    推荐理由:来自MIT Technology Review AI的《Making AI an asset, not an expense》。重点看模型能力与工程、文化创意、产品发布。摘要提到:这条英文动态主要涉及模型能力与工程、文化创意、产品发布。原文要点:When customers talk about AI costs, the conversation usually starts with token prices and ends with access to the latest, most capable model in the cloud. Do they always need that level of capability? Not necessarily. But that is often where the conversation goes. As AI moves from experimentation to production, model choice is only…

  6. IT之家 AI36

    《巫师 3:狂猎 — 重制版》游戏今日上线,原版玩家可免费升级

    IT之家 9 月 29 日消息,CDPR 旗下游戏《巫师 3:狂猎 — 重制版》今日上线, 拥有原版游戏的玩家可免费升级 。本作带来一系列改进,包括画面、玩法等多方面升级。 由于本次重制版升级较大,因此 PC 版的配置要求一并更新。请查看下方图片,了解最新的系统配置要求: IT之家附本作升级一览如下: 画面与渲染 整合了优化后的着色模型。 基于《巫师 3》高清重制项目的素材,更新了大量纹理和模型。 优化了草地与植被的光照与着色效果。 更新了法印的视觉效果,包括其升级版本。 为技能添加了新的视觉效果。 游戏现已支持原生 DirectX 12 渲染并搭载多线程技术,带来更强的性能与画面表现。 更新了色调映射,优化色彩、光照、对比度与细节表现。 新增 GTAO(真实环境光遮蔽)作为新的屏幕空间环境光遮蔽可选方案。 更新了 HDR 校准面板,新增选项与其他优化。 新增光线追踪局部阴影。 更新屏幕空间反射效果。 更新屏幕空间阴影效果。 优...

    推荐理由:来自IT之家 AI的《《巫师 3:狂猎 — 重制版》游戏今日上线,原版玩家可免费升级》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 29 日消息,CDPR 旗下游戏《巫师 3:狂猎 — 重制版》今日上线, 拥有原版游戏的玩家可免费升级 。本作带来一系列改进,包括画面、玩法等多方面升级。 由于本次重制版升级较大,因此 PC 版的配置要求一并更新。请查看下方图片,了解最新的系统配置要求: IT之家附本作升级一览如下: 画面与渲染 整合了优化后的着色模型。 基于《巫师 3》高清重制项目的素材,更新了大量纹理和模型。 优化了草地与植被的光照与着色效果。 更新了法印的视觉效果,包括其升级版本。 为技能添加了新的视觉效果。 游戏现已支持原生 DirectX 12 渲染并搭载多线程技术,带来更强的性能与画面表现。 更新了色调映射,优化色彩、光照、对比度与细节表现。 新增 GTAO(真实环境光遮蔽)作为新的屏幕空间环境光遮蔽可选方案。 更新了 HDR 校准面板,新增选项与其他优化。 新增光线追踪局部阴影。 更新屏幕空间反射效果。 更新屏幕空间阴影效果。 优...

  7. 爱范儿38

    AI 圈杀出新顶流,神秘「太空兔」能用涂鸦做网站

    我又多了一个能当主力的Flash模型 #欢迎关注爱范儿官方微信公众号:爱范儿(微信号:ifanr),更多精彩内容第一时间为您奉上。 这条动态来自 爱范儿,可重点关注模型能力与工程。

    推荐理由:来自爱范儿的《AI 圈杀出新顶流,神秘「太空兔」能用涂鸦做网站》。重点看模型能力与工程。摘要提到:我又多了一个能当主力的Flash模型 #欢迎关注爱范儿官方微信公众号:爱范儿(微信号:ifanr),更多精彩内容第一时间为您奉上。 这条动态来自 爱范儿,可重点关注模型能力与工程。

  8. 爱范儿38

    苏姿丰550亿元买下李飞飞世界模型,AI 圈两位女王联手了

    算力焦虑下的双向奔赴 #欢迎关注爱范儿官方微信公众号:爱范儿(微信号:ifanr),更多精彩内容第一时间为您奉上。 这条动态来自 爱范儿,可重点关注模型能力与工程。

    推荐理由:来自爱范儿的《苏姿丰550亿元买下李飞飞世界模型,AI 圈两位女王联手了》。重点看模型能力与工程。摘要提到:算力焦虑下的双向奔赴 #欢迎关注爱范儿官方微信公众号:爱范儿(微信号:ifanr),更多精彩内容第一时间为您奉上。 这条动态来自 爱范儿,可重点关注模型能力与工程。