跳到正文
10月2日周五
  1. IT之家 AI34

    苹果视频剪辑应用 Final Cut Pro 13 曝光:支持 Pixelmator Pro 往返编辑等

    IT之家 10 月 2 日消息,科技媒体 AppleInsider 昨日(10 月 1 日)发布博文,报道称 Final Cut Pro 13 应用部分新功能 / 新特性提前泄露, 新版本有望加入多语言转录、Pixelmator Pro 图像往返编辑、自然运动模糊、捏合缩放、剪辑断开和关键帧缓动等功能。 Final Cut Pro 是苹果面向专业视频创作者推出的视频剪辑应用,目前最新版本是 9 月 29 日发布的 12.4 版本更新,主要用于视频导入、剪辑、调色、字幕、音频处理、动画和特效制作。 报道称 YouTube 用户 The Final Cut Bro 制作并上传了一段标题为《Final Cut 13 is here》的视频,可能是因为误操作改为公开发布,IT之家发稿前访问该频道,相关视频已设为私有,不再对外公开显示。 在功能方面,Final Cut Pro 13 主要增强和 Pixelmator Pro 的图像往返编辑...

    推荐理由:来自IT之家 AI的《苹果视频剪辑应用 Final Cut Pro 13 曝光:支持 Pixelmator Pro 往返编辑等》。重点看产品发布。摘要提到:IT之家 10 月 2 日消息,科技媒体 AppleInsider 昨日(10 月 1 日)发布博文,报道称 Final Cut Pro 13 应用部分新功能 / 新特性提前泄露, 新版本有望加入多语言转录、Pixelmator Pro 图像往返编辑、自然运动模糊、捏合缩放、剪辑断开和关键帧缓动等功能。 Final Cut Pro 是苹果面向专业视频创作者推出的视频剪辑应用,目前最新版本是 9 月 29 日发布的 12.4 版本更新,主要用于视频导入、剪辑、调色、字幕、音频处理、动画和特效制作。 报道称 YouTube 用户 The Final Cut Bro 制作并上传了一段标题为《Final Cut 13 is here》的视频,可能是因为误操作改为公开发布,IT之家发稿前访问该频道,相关视频已设为私有,不再对外公开显示。 在功能方面,Final Cut Pro 13 主要增强和 Pixelmator Pro 的图像往返编辑...

  2. Apple Machine Learning Research54

    Language Discrimination Improves Linguistic Learning in Multilingual Speech Models

    这条英文动态主要涉及模型能力与工程。原文要点:Multilingual self-supervised speech models can benefit from sharing information across languages, but under a matched total pretraining data budget they still fall short of monolingual models. We show that strengthening the model’s ability to discriminate languages during pretraining reduces and, on some measures, closes this multilingual gap on continuous phonetic and higher-level linguistic measures, while preservi...

    推荐理由:来自Apple Machine Learning Research的《Language Discrimination Improves Linguistic Learning in Multilingual Speech Models》。重点看模型能力与工程。摘要提到:这条英文动态主要涉及模型能力与工程。原文要点:Multilingual self-supervised speech models can benefit from sharing information across languages, but under a matched total pretraining data budget they still fall short of monolingual models. We show that strengthening the model’s ability to discriminate languages during pretraining reduces and, on some measures, closes this multilingual gap on continuous phonetic and higher-level linguistic m...

  3. OpenRouter Announcements94

    LangChain vs CrewAI: Orchestration Compared to OpenRouter-Native Routing

    这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意。原文要点:LangGraph, CrewAI, and OpenRouter-native routing compared by the job each one does. Workflow orchestration, model routing, and provider routing are three different layers, and this article shows which layer each tool covers and how to combine them.

    推荐理由:来自OpenRouter Announcements的《LangChain vs CrewAI: Orchestration Compared to OpenRouter-Native RoutingMulti-model orchestration is three layers. Workflow orchestration is planning, state, memory, and delegation, and LangGraph and CrewAI are built for it. Model routing is choosing a model per call and falling back when it fails, and provider routing is choosing which provider serves that model. OpenRouter does the second two. This article separates the layers, shows the same two-step pipeline in direct OpenRouter calls and in LangChain, and describes when to add a framework, when to use our Agent

  4. OpenRouter Announcements90

    Model Routing for Support Bots: Cheap-First FAQ Handling

    这条英文动态主要涉及模型能力与工程、文化创意。原文要点:How to route routine support questions to a cheap model and escalate only the hard ones to a stronger model. Compare static rules, classifier triage, and answer checks, see which parts OpenRouter handles, and measure whether each escalation earns its cost.

    推荐理由:来自OpenRouter Announcements的《Model Routing for Support Bots: Cheap-First FAQ Handling》。重点看模型能力与工程、文化创意。摘要提到:这条英文动态主要涉及模型能力与工程、文化创意。原文要点:How to

  5. Apple Machine Learning Research79

    Limits of Confidence in Diffusion

    这条英文动态主要涉及模型能力与工程。原文要点:Discrete diffusion, including remasking and uniform-state samplers, generate a sequence by writing multiple token positions per step, drawing each from a per-position distribution and choosing which positions to write from those same distributions. For domains of general interest (pixels, phonemes, or words) there are inherent dependencies between tokens. We show that a step matches the training distribution only whe...

    推荐理由:来自Apple Machine Learning Research的《Limits of Confidence in Diffusion》。重点看模型能力与工程。摘要提到:这条英文动态主要涉及模型能力与工程。原文要点:Discrete diffusion, including remasking and uniform-state samplers, generate a sequence by writing multiple token positions per step, drawing each from a per-position distribution and choosing which positions to write from those same distributions. For domains of general interest (pixels, phonemes, or words) there are inherent dependencies between tokens. We show that a step matches the trainin...

  6. OpenRouter Announcements96

    Agent Frameworks Compared: Tool-Calling Schema Handling

    这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意。原文要点:How LangChain, CrewAI, the OpenAI Agents SDK, the Claude Agent SDK, Microsoft Agent Framework, and Google ADK define tool schemas and translate them across providers, and how OpenRouter normalizes the tool-calling format below the framework.

    推荐理由:来自OpenRouter Announcements的《Agent Frameworks Compared: Tool-Calling Schema HandlingOpenAI, Anthropic, and Google each use a different request and response shape for the same tool. Agent frameworks handle that difference in different places. Some translate one definition into each provider's format, some are native to a single provider, and some hand the question to a connector underneath. This article compares six frameworks on schema definition, translation, and MCP support, then shows how OpenRouter normalizes tool calling at the API layer so a model swap is a change to one string.October 2,

  7. OpenAI News78

    Chatham scales its capital markets expertise with OpenAI

    这条英文动态主要涉及智能体工作流、产品发布。原文要点:Chatham Financial uses Codex and GPT-5.6 to build technology and redesign workflows, cutting trade validation from 30 minutes to under 4.

    推荐理由:来自OpenAI News的《Chatham scales its capital markets expertise with OpenAI》。重点看智能体工作流、产品发布。摘要提到:这条英文动态主要涉及智能体工作流、产品发布。原文要点:Chatham Financial uses Codex and GPT-5.6 to build technology and redesign workflows, cutting trade validation from 30 minutes to under 4.

  8. OpenRouter Announcements75

    Model Router Benchmarks

    这条英文动态主要涉及模型能力与工程、评测与基准。原文要点:Compare model routers like Auto Router, Jev Router, Pareto, Fugu, and Switchyard across six benchmarks. The Router Index weighs quality, speed, and cost on one 0 to 10 scale.

    推荐理由:来自OpenRouter Announcements的《Model Router Benchmarks》。重点看模型能力与工程、评测与基准。摘要提到:这条英文动态主要涉及模型能力与工程、评测与基准。原文要点:Compare model routers like Auto Router, Jev Router, Pareto, Fugu, and Switchyard across six benchmarks. The Router Index weighs quality, speed, and cost on one 0 to 10 scale.

  9. IT之家 AI70

    OpenAI 上线“虚拟试穿”功能:ChatGPT 能帮你试衣,还能找“明星同款”

    IT之家 10 月 2 日消息,当地时间 1 日,OpenAI 再次扩展 ChatGPT 的购物能力。公司宣布在全球推出两项新功能,一项是让用户 虚拟试穿服装和配饰 ,另一项是 新增收藏功能 ,方便用户先把看中的商品存起来,之后再查看。 据IT之家了解,新功能基于不久前推出的 ChatGPT Images 2.5 模型。按照 OpenAI 的说法,这一模型生成的画面 光线更自然、纹理更丰富,执行编辑指令也更稳定 ,同时还能缩短生成图片所需时间。 ChatGPT 用户可以上传自拍照或全身照,查看 某件服装或配饰穿在自己身上的效果 ,ChatGPT 的购物结果页面会新增一个“试穿”按钮。用户还可以上传商品图片,再让 ChatGPT 模拟试穿效果。 另一项新功能是“收藏”。用户可以把发现的商品 存入应用内的资料库 ,方便之后回看。OpenAI 还提到,这些商品会和试穿图片保存在一起。 OpenAI 还宣布,ChatGPT 在购物上不只...

    推荐理由:来自IT之家 AI的《OpenAI 上线“虚拟试穿”功能:ChatGPT 能帮你试衣,还能找“明星同款”》。重点看模型能力与工程、产品发布。摘要提到:IT之家 10 月 2 日消息,当地时间 1 日,OpenAI 再次扩展 ChatGPT 的购物能力。公司宣布在全球推出两项新功能,一项是让用户 虚拟试穿服装和配饰 ,另一项是 新增收藏功能 ,方便用户先把看中的商品存起来,之后再查看。 据IT之家了解,新功能基于不久前推出的 ChatGPT Images 2.5 模型。按照 OpenAI 的说法,这一模型生成的画面 光线更自然、纹理更丰富,执行编辑指令也更稳定 ,同时还能缩短生成图片所需时间。 ChatGPT 用户可以上传自拍照或全身照,查看 某件服装或配饰穿在自己身上的效果 ,ChatGPT 的购物结果页面会新增一个“试穿”按钮。用户还可以上传商品图片,再让 ChatGPT 模拟试穿效果。 另一项新功能是“收藏”。用户可以把发现的商品 存入应用内的资料库 ,方便之后回看。OpenAI 还提到,这些商品会和试穿图片保存在一起。 OpenAI 还宣布,ChatGPT 在购物上不只...

  10. IT之家 AI68

    流式转录 AI 新标杆:微软 MAI-Transcribe-2-Streaming 登场,2.5% 词错误率、0.13 秒延迟夺冠

    IT之家 10 月 2 日消息,微软昨日(10 月 1 日)发布公告,宣布推出其首个实时流式语音转写模型 MAI‑Transcribe‑2‑Streaming,可在讲话进行时持续输出文字,覆盖 60 种语言,并支持自动语言检测。 费用方面,MAI‑Transcribe‑2‑Streaming 模型目前处于优惠阶段,价格为每小时 0.54 美元 (IT之家注:现汇率约合 3.6 元人民币) ,约合每 1,000 分钟 9 美元 (现汇率约合 60.5 元人民币) ,开发者可以通过 Microsoft Foundry、MAI Playground、OpenRouter 等渠道体验或接入。 IT之家注, 微软此前已推出非流式的 MAI‑Transcribe‑2 ,在 Azure Speech 公共预览阶段的价格为每小时 0.10 美元 (现汇率约合 0.67 元人民币) 。流式“Streaming”是实时返回相关结果,适合实时对话和字...

    推荐理由:来自IT之家 AI的《流式转录 AI 新标杆:微软 MAI-Transcribe-2-Streaming 登场,2.5% 词错误率、0.13 秒延迟夺冠》。重点看模型能力与工程、产品发布。摘要提到:IT之家 10 月 2 日消息,微软昨日(10 月 1 日)发布公告,宣布推出其首个实时流式语音转写模型 MAI‑Transcribe‑2‑Streaming,可在讲话进行时持续输出文字,覆盖 60 种语言,并支持自动语言检测。 费用方面,MAI‑Transcribe‑2‑Streaming 模型目前处于优惠阶段,价格为每小时 0.54 美元 (IT之家注:现汇率约合 3.6 元人民币) ,约合每 1,000 分钟 9 美元 (现汇率约合 60.5 元人民币) ,开发者可以通过 Microsoft Foundry、MAI Playground、OpenRouter 等渠道体验或接入。 IT之家注, 微软此前已推出非流式的 MAI‑Transcribe‑2 ,在 Azure Speech 公共预览阶段的价格为每小时 0.10 美元 (现汇率约合 0.67 元人民币) 。流式“Streaming”是实时返回相关结果,适合实时对话和字...

  11. IT之家 AI72

    因违反敏感信息访问和共享规定,OpenAI 与三名研究人员终止合作

    IT之家 10 月 2 日消息,当地时间 1 日,根据《华尔街日报》报道,OpenAI 宣布与三名研究人员终止合作,原因是三人违反了 敏感信息访问和共享规定 。 OpenAI 发言人在声明中说:“我们已与三名违反公司敏感信息访问和处理规定的人员解除关系。调查确认,这些人员 绕过公司既定流程,不当处理敏感信息 ,不仅违反了公司规定,也破坏了我们工作所必需的信任。” 三人名叫贾斯敏 · 王、托梅克 · 科尔巴克和米基塔 · 巴莱斯尼。 遭解雇的托梅克 · 科尔巴克是 OpenAI 安全团队成员。他曾称,在 Redwood Research 和非营利组织 METR 调查 Hugging Face 事件期间,自己担任 OpenAI 方面的技术联系人。 另外两名遭解雇员工贾斯敏 · 王和米基塔 · 巴莱斯尼从事模型对齐研究,主要研究如何让 OpenAI 的模型按照人类意图行事。 据IT之家了解,涉事员工被指将公司机密信息 提供给一家第三方...

    推荐理由:来自IT之家 AI的《因违反敏感信息访问和共享规定,OpenAI 与三名研究人员终止合作》。重点看模型能力与工程。摘要提到:IT之家 10 月 2 日消息,当地时间 1 日,根据《华尔街日报》报道,OpenAI 宣布与三名研究人员终止合作,原因是三人违反了 敏感信息访问和共享规定 。 OpenAI 发言人在声明中说:“我们已与三名违反公司敏感信息访问和处理规定的人员解除关系。调查确认,这些人员 绕过公司既定流程,不当处理敏感信息 ,不仅违反了公司规定,也破坏了我们工作所必需的信任。” 三人名叫贾斯敏 · 王、托梅克 · 科尔巴克和米基塔 · 巴莱斯尼。 遭解雇的托梅克 · 科尔巴克是 OpenAI 安全团队成员。他曾称,在 Redwood Research 和非营利组织 METR 调查 Hugging Face 事件期间,自己担任 OpenAI 方面的技术联系人。 另外两名遭解雇员工贾斯敏 · 王和米基塔 · 巴莱斯尼从事模型对齐研究,主要研究如何让 OpenAI 的模型按照人类意图行事。 据IT之家了解,涉事员工被指将公司机密信息 提供给一家第三方...

  12. GitHub AI Trending70

    Trusted-AI/adversarial-robustness-toolbox: Adversarial Robustness Toolbox (ART) - Python Library for Machine Learning Security - Evasion, Poisoning, Extraction, Inference - Red and Blue Teams

    事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:Trusted-AI/adversarial-robustness-toolbox: Adversarial Robustness Toolbox (ART) - Python Library for Machine Learning Security - Evasion, Poiso。影响判断:它可能改变智能体工作流、模型能力与工程、文化创意相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、文化创意方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程、文化创意直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  13. arXiv AI Education40

    On-Premises Multi-Course RAG Tutoring for Business Education: Hardware-Software Trade-offs in a Campus AI Tutor

    这条英文动态主要涉及评测与基准、教育应用。原文要点:Campus AI tutors based on retrieval-augmented generation (RAG) must ground answers in assigned course materials while keeping textbooks and student dialogue on institutional infrastructure. We present CourseChat, an on-premises, multi-course RAG tutor for undergraduate business education, deployed behind a campus web gateway and intended for use embedded in Moodle. Six isolated course offerings, each keyed by its own...

    推荐理由:来自arXiv AI Education的《On-Premises Multi-Course RAG Tutoring for Business Education: Hardware-Software Trade-offs in a Campus AI Tutor》。重点看评测与基准、教育应用。摘要提到:这条英文动态主要涉及评测与基准、教育应用。原文要点:Campus AI tutors based on retrieval-augmented generation (RAG) must ground answers in assigned course materials while keeping textbooks and student dialogue on institutional infrastructure. We present CourseChat, an on-premises, multi-course RAG tutor for undergraduate business education, deployed behind a campus web gateway and intended for use embedded in Moodle. Six isolated course offeri...

  14. arXiv AI Education40

    CUEing User Simulators: Calibrated User Embeddings for Multi-Turn Benchmarking

    这条英文动态主要涉及智能体工作流、评测与基准。原文要点:Recent benchmarks rely on user simulators to evaluate AI agents in multi-turn interaction. While existing simulation techniques demonstrate surface fidelity to human style and behavior, ecologically valid interactive benchmarking also requires alignment in when and how agents fail across simulated and real user populations. We find that existing simulators lack outcome calibration: agreement with observed success rat...

    推荐理由:来自arXiv AI Education的《CUEing User Simulators: Calibrated User Embeddings for Multi-Turn Benchmarking》。重点看智能体工作流、评测与基准。摘要提到:这条英文动态主要涉及智能体工作流、评测与基准。原文要点:Recent benchmarks rely on user simulators to evaluate AI agents in multi-turn interaction. While existing simulation techniques demonstrate surface fidelity to human style and behavior, ecologically valid interactive benchmarking also requires alignment in when and how agents fail across simulated and real user populations. We find that existing simulators lack outcome calibration: agreeme...

  15. GitHub Changelog84

    GitHub Copilot can now interact with desktop apps with computer use

    这条英文动态主要涉及开源生态。原文要点:Computer use is now available in public preview in GitHub Copilot CLI and the GitHub Copilot app on macOS and Windows. Copilot can interact with desktop applications on your behalf… The post GitHub Copilot can now interact with desktop apps with computer use appeared first on The GitHub Blog .

    推荐理由:来自GitHub Changelog的《GitHub Copilot can now interact with desktop apps with computer use》。重点看开源生态。摘要提到:这条英文动态主要涉及开源生态。原文要点:Computer use is now available in public preview in GitHub Copilot CLI and the GitHub Copilot app on macOS and Windows. Copilot can interact with desktop applications on your behalf… The post GitHub Copilot can now interact with desktop apps with computer use appeared first on The GitHub Blog .

  16. GitHub Changelog52

    GitHub Actions: macOS 14 runner image retirement

    这条英文动态主要涉及开源生态。原文要点:The macOS 14 runner image will be retired on November 2, 2026. To raise awareness of the upcoming removal, jobs using macOS 14 will temporarily fail during the following scheduled… The post GitHub Actions: macOS 14 runner image retirement appeared first on The GitHub Blog .

    推荐理由:来自GitHub Changelog的《GitHub Actions: macOS 14 runner image retirement》。重点看开源生态。摘要提到:这条英文动态主要涉及开源生态。原文要点:The macOS 14 runner image will be retired on November 2, 2026. To raise awareness of the upcoming removal, jobs using macOS 14 will temporarily fail during the following scheduled… The post GitHub Actions: macOS 14 runner image retirement appeared first on The GitHub Blog .

  17. GitHub Changelog86

    GitHub Copilot in VS Code, September 2026 releases

    事实摘要:这条英文动态主要涉及智能体工作流、开源生态,原文信息显示:GitHub Copilot in VS Code, September 2026 releases 事实摘要:这条英文动态主要涉及智能体工作流、开源生态,原文信息显示:GitHub Copilot in VS Code, September 2026 releases 事实摘要:这条英文动态主要涉及。影响判断:它可能改变智能体工作流、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  18. Claude Code Releases89

    Claude Code Releases v2.1.287:Added Claude Mods: plugins may now modify deeper behavior ...

    这条英文动态主要涉及智能体工作流、文化创意。原文要点:What's changed Added Claude Mods: plugins may now modify deeper behavior Added You should know, a built-in mod where a side agent watches your back and flags things you or Claude might miss. Turn it on with /plugin enable cc-plugin-you-should-know@builtin (for first-party sessions with telemetry on) Added an n: filter to the agents view that matches session names and tasks; a filter now shows matches in collapsed sec...

    推荐理由:来自Claude Code Releases的《Claude Code Releases v2.1.287:Added Claude Mods: plugins may now modify deeper behavior ...》。重点看智能体工作流、文化创意。摘要提到:这条英文动态主要涉及智能体工作流、文化创意。原文要点:What's changed Added Claude Mods: plugins may now modify deeper behavior Added You should know, a built-in mod where a side agent watches your back and flags things you or Claude might miss. Turn it on with /plugin enable cc-plugin-you-should-know@builtin (for first-party sessions with telemetry on) Added an n: filter to the agents view that matches session names and tasks; a filter now sho...

  19. arXiv AI59

    KaliBench: A Fine-Grained Benchmark for Cybersecurity Tool Use on Kali Linux with Runtime-Free Verifiable Rewards

    事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、评测与基准,原文信息显示:KaliBench: A Fine-Grained Benchmark for Cybersecurity Tool Use on Kali Linux with Runtime-Free Verifiable Rewards 这条英文动态主要涉及智能体工作流、模型能力与工程、评测与。影响判断:它可能改变智能体工作流、模型能力与工程、评测与基准相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、评测与基准方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程、评测与基准直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  20. GitHub Changelog88

    Actions retention now covers checks, runs, and statuses

    事实摘要:这条英文动态主要涉及智能体工作流、文化创意、开源生态,原文信息显示:Actions retention now covers checks, runs, and statuses 事实摘要:这条英文动态主要涉及智能体工作流、文化创意、开源生态,原文信息显示:Actions retention now covers checks, runs, and stat。影响判断:它可能改变智能体工作流、文化创意、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、文化创意、开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、文化创意、开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  21. arXiv AI59

    Reconstruct, Practice, Go Real: Guided Self-Improvement for Embodied Agents

    事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、评测与基准,原文信息显示:Reconstruct, Practice, Go Real: Guided Self-Improvement for Embodied Agents 这条英文动态主要涉及智能体工作流、模型能力与工程。原文要点:Building reliable robot capabilities。影响判断:它可能改变智能体工作流、模型能力与工程、评测与基准相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、评测与基准方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程、评测与基准直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  22. arXiv AI55

    Embedding Prediction Helps Image Generation

    事实摘要:这条英文动态主要涉及模型能力与工程,原文信息显示:Embedding Prediction Helps Image Generation 这条英文动态讨论了 AI 领域的新进展。原文要点:In diffusion transformers, a class label or a text prompt is embedded once, and the sa。影响判断:它可能改变模型能力与工程相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和模型能力与工程直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  23. arXiv AI57

    ScholarCatalyst: A Benchmark for Retrieving Papers That Inspire New Research

    事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、评测与基准,原文信息显示:ScholarCatalyst: A Benchmark for Retrieving Papers That Inspire New Research 这条英文动态主要涉及评测与基准、文化创意。原文要点:What makes great scientists great? Even。影响判断:它可能改变智能体工作流、模型能力与工程、评测与基准相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、评测与基准方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程、评测与基准直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  24. arXiv AI57

    VISTA: A Visual Harness for Reasoning in an Interactive World

    事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、评测与基准,原文信息显示:VISTA: A Visual Harness for Reasoning in an Interactive World 这条英文动态主要涉及模型能力与工程。原文要点:We show that multimodal models possess strong reasoning a。影响判断:它可能改变智能体工作流、模型能力与工程、评测与基准相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、评测与基准方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程、评测与基准直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  25. arXiv AI57

    TACO: Ternary Absolute-max Column-wise One-sparse Optimizer for LLM Fine-Tuning

    事实摘要:这条英文动态主要涉及模型能力与工程,原文信息显示:TACO: Ternary Absolute-max Column-wise One-sparse Optimizer for LLM Fine-Tuning 这条英文动态主要涉及模型能力与工程。原文要点:Full-parameter fine-tuning of large language models 。影响判断:它可能改变模型能力与工程相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和模型能力与工程直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  26. GitHub Changelog82

    Code coverage uploads no longer fail CI for new branches

    事实摘要:这条英文动态主要涉及开源生态,原文信息显示:Code coverage uploads no longer fail CI for new branches 事实摘要:这条英文动态主要涉及开源生态,原文信息显示:Code coverage uploads no longer fail CI for new branches 事实摘要:这条英文动态主要涉及开源。影响判断:它可能改变开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  27. GitHub Changelog85

    Dynamic workflows in Copilot CLI and the Copilot app

    事实摘要:这条英文动态主要涉及智能体工作流、开源生态,原文信息显示:Dynamic workflows in Copilot CLI and the Copilot app 事实摘要:这条英文动态主要涉及智能体工作流、开源生态,原文信息显示:Dynamic workflows in Copilot CLI and the Copilot app 事实摘要:这条英文动态。影响判断:它可能改变智能体工作流、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  28. OpenAI News82

    How Albertsons Companies is reimagining retail from the inside out

    这条英文动态主要涉及产品发布。原文要点:Albertsons Cos. is using ChatGPT Enterprise and the OpenAI API to help teams work faster and make grocery shopping easier for millions of customers.

    推荐理由:来自OpenAI News的《How Albertsons Companies is reimagining retail from the inside out》。重点看产品发布。摘要提到:这条英文动态主要涉及产品发布。原文要点:Albertsons Cos. is using ChatGPT Enterprise and the OpenAI API to help teams work faster and make grocery shopping easier for millions of customers.

10月1日周四
  1. IT之家 AI34

    英伟达为 GTX 700-10 系显卡发布 582.78 安全更新,修复 114 个漏洞

    IT之家 10 月 1 日消息,英伟达于当地时间 30 日推出 GeForce 安全更新驱动程序 582.78,适用于 Maxwell、Pascal 和 Volta 架构显卡,涵盖 GTX 700 系、GTX 900 系、GTX 10 系显卡及 Tesla V100、Titan V 等专业卡。 据IT之家了解,英伟达已经不会为上述显卡发布常规 Game Ready 驱动更新,但仍然会不时推出安全更新。该更新支持 Windows 10 和 Windows 11 操作系统, 大小为 912.74 MB 。 同时, 该更新修复了显示驱动程序和 vGPU 的 114 个漏洞 ,其中大多数漏洞直接影响显卡驱动程序,包括 76 个高危漏洞和 37 个中危漏洞。 此外,此次驱动更新适用于 GeForce GTX 745、GTX 750 和 GTX 750 Ti 系列、GTX 950-GTX 980 Ti、GTX 1050-GTX 1080 T...

    推荐理由:来自IT之家 AI的《英伟达为 GTX 700-10 系显卡发布 582.78 安全更新,修复 114 个漏洞》。重点看产品发布。摘要提到:IT之家 10 月 1 日消息,英伟达于当地时间 30 日推出 GeForce 安全更新驱动程序 582.78,适用于 Maxwell、Pascal 和 Volta 架构显卡,涵盖 GTX 700 系、GTX 900 系、GTX 10 系显卡及 Tesla V100、Titan V 等专业卡。 据IT之家了解,英伟达已经不会为上述显卡发布常规 Game Ready 驱动更新,但仍然会不时推出安全更新。该更新支持 Windows 10 和 Windows 11 操作系统, 大小为 912.74 MB 。 同时, 该更新修复了显示驱动程序和 vGPU 的 114 个漏洞 ,其中大多数漏洞直接影响显卡驱动程序,包括 76 个高危漏洞和 37 个中危漏洞。 此外,此次驱动更新适用于 GeForce GTX 745、GTX 750 和 GTX 750 Ti 系列、GTX 950-GTX 980 Ti、GTX 1050-GTX 1080 T...

  2. Cloudflare AI90

    Introducing Clef: our open-source decision models, and new RL fine-tuning platform

    这条英文动态主要涉及智能体工作流、模型能力与工程、产品发布。原文要点:We are introducing Clef and Clef-flash, open-source decision models hosted on Workers AI for high-speed classification and agentic workflows. Also launching: a new reinforcement learning platform that allows developers to fine-tune decision models using their own data.

    推荐理由:来自Cloudflare AI的《Introducing Clef: our open-source decision models, and new RL fine-tuning platform》。重点看智能体工作流、模型能力与工程、产品发布。摘要提到:这条英文动态主要涉及智能体工作流、模型能力与工程、产品发布。原文要点:We are introducing Clef and Clef-flash, open-source decision models hosted on Workers AI for high-speed classification and agentic workflows. Also launching: a new reinforcement learning platform that allows developers to fine-tune decision models using their own data.

  3. 量子位66

    何恺明团队新作:看猫片就能学会ARC挑战

    用ImageNet训练encoder 这条动态来自 量子位,可重点关注模型能力与工程。

    推荐理由:来自量子位的《何恺明团队新作:看猫片就能学会ARC挑战》。重点看模型能力与工程。摘要提到:用ImageNet训练encoder 这条动态来自 量子位,可重点关注模型能力与工程。

  4. 量子位66

    谷歌Gemini 4突然发布!RSI加持,GPT和Opus都让让

    价格只有Astra一半 这条动态来自 量子位,可重点关注产品发布。

    推荐理由:来自量子位的《谷歌Gemini 4突然发布!RSI加持,GPT和Opus都让让》。重点看产品发布。摘要提到:价格只有Astra一半 这条动态来自 量子位,可重点关注产品发布。

  5. IT之家 AI34

    致敬《终结者 2》:Figure 让 F.02 人形机器人亲自跳入熔炉,采纳施瓦辛格本人提议

    IT之家 10 月 1 日消息,美国初创企业 Figure 今日发布视频,为寿终正寝的 F.02 机器人举行一场“火化仪式”。 随着 Figure F.03 机队不断壮大,F.02 已经日显颓势。该公司认为继续维护老一代机器人已经没有意义,但直接报废并不是最优选择,因为这些机器人内含大量专用硬件和知识产权结晶。Figure 甚至表示,直接进行拆解工作需要大量时间,甚至可能拖慢 F.04 的研发进度。 Figure 表示,让机器人自己跳入熔炉这个想法正是源自 T-800 扮演者阿诺德 · 施瓦辛格本人。此前 Figure 曾在网上征集如何进行 F.02 送别仪式,后来施瓦辛格的想法被采纳。 IT之家注意到,后来施瓦辛格亲自来到了熔解现场,他身穿全套防护装备,带领一台 F.02 走向熔炉,致敬了《终结者 2》电影。在视频结尾,他摘下面具说道:“Figure 2 已经退役。” 不过,想找到合适的熔炉并不容易。许多美国和墨西哥企业都拒绝...

    推荐理由:来自IT之家 AI的《致敬《终结者 2》:Figure 让 F.02 人形机器人亲自跳入熔炉,采纳施瓦辛格本人提议》。重点看产品发布。摘要提到:IT之家 10 月 1 日消息,美国初创企业 Figure 今日发布视频,为寿终正寝的 F.02 机器人举行一场“火化仪式”。 随着 Figure F.03 机队不断壮大,F.02 已经日显颓势。该公司认为继续维护老一代机器人已经没有意义,但直接报废并不是最优选择,因为这些机器人内含大量专用硬件和知识产权结晶。Figure 甚至表示,直接进行拆解工作需要大量时间,甚至可能拖慢 F.04 的研发进度。 Figure 表示,让机器人自己跳入熔炉这个想法正是源自 T-800 扮演者阿诺德 · 施瓦辛格本人。此前 Figure 曾在网上征集如何进行 F.02 送别仪式,后来施瓦辛格的想法被采纳。 IT之家注意到,后来施瓦辛格亲自来到了熔解现场,他身穿全套防护装备,带领一台 F.02 走向熔炉,致敬了《终结者 2》电影。在视频结尾,他摘下面具说道:“Figure 2 已经退役。” 不过,想找到合适的熔炉并不容易。许多美国和墨西哥企业都拒绝...

  6. Cloudflare AI55

    One year later: Sovereign AI and the fight for choice

    这条英文动态主要涉及模型能力与工程。原文要点:AI sovereignty is not a zero-sum game, but many governments now believe it is. Cloudflare's answer: more local open-source models, model-agnostic security tools, and a commitment to giving nations genuine choice.

    推荐理由:来自Cloudflare AI的《One year later: Sovereign AI and the fight for choice》。重点看模型能力与工程。摘要提到:这条英文动态主要涉及模型能力与工程。原文要点:AI sovereignty is not a zero-sum game, but many governments now believe it is. Cloudflare's answer: more local open-source models, model-agnostic security tools, and a commitment to giving nations genuine choice.

  7. GitHub Changelog51

    Actions Runner Controller release 0.15.0

    事实摘要:这条英文动态主要涉及开源生态,原文信息显示:Actions Runner Controller release 0.15.0 事实摘要:这条英文动态主要涉及开源生态,原文信息显示:Actions Runner Controller release 0.15.0 事实摘要:这条英文动态主要涉及开源生态,原文信息显示:Actions Runner Control。影响判断:它可能改变开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  8. Cloudflare AI84

    Cloudflare OS: your company’s agent workspace, managed for you

    这条英文动态主要涉及智能体工作流、产品发布。原文要点:Cloudflare OS gives everyone in your organization an agent workspace that knows how your company works and connects to its data and systems. We’re opening the waitlist for fully managed deployments that you’ll be able to launch in a few clicks.

    推荐理由:来自Cloudflare AI的《Cloudflare OS: your company’s agent workspace, managed for you》。重点看智能体工作流、产品发布。摘要提到:这条英文动态主要涉及智能体工作流、产品发布。原文要点:Cloudflare OS gives everyone in your organization an agent workspace that knows how your company works and connects to its data and systems. We’re opening the waitlist for fully managed deployments that you’ll be able to launch in a few clicks.

  9. Cloudflare AI84

    AI Search is now generally available

    这条英文动态主要涉及模型能力与工程。原文要点:AI Search is now generally available. It embeds image pixels directly for visual search, runs optical character recognition on scanned PDFs, accepts files up to 10 MiB, and works with any chat model. Here's what's new and how pricing works.

    推荐理由:来自Cloudflare AI的《AI Search is now generally available》。重点看模型能力与工程。摘要提到:这条英文动态主要涉及模型能力与工程。原文要点:AI Search is now generally available. It embeds image pixels directly for visual search, runs optical character recognition on scanned PDFs, accepts files up to 10 MiB, and works with any chat model. Here's what's new and how pricing works.

  10. IT之家 AI34

    RDNA 4 原生支持 FP8:开发者成功让 AMD 显卡用上英伟达 DLSS 4,但目前性能仍不及 FSR 4

    IT之家 10 月 1 日消息,Videocardz 今日发现,一个名为 d4r 的 GitHub 项目为 AMD Radeon RX 9000 系列显卡带来了 NVIDIA DLSS 4 与 DLSS 4.5 超分辨率支持。 IT之家查询发现,该项目由开发者 countervolts 发布,旨在通过软件转译层让 AMD 显卡运行 NVIDIA DLSS 库,首个版本发布于 4 天前,今日发布了最新的 0.1.3 版本。 d4r 项目此前已支持 RDNA 3 架构的 RX 7000 系列显卡。最新的 0.1.2 和 0.1.3 版本将支持范围扩展至 RDNA 4 架构,对应 Radeon RX 9070 XT、RX 9070、RX 9070 GRE、RX 9060 XT 和 RX 9060 等型号。 该项目的核心原理是利用 ZLUDA 兼容层,将 DLSS 库中的 CUDA 调用转译为 AMD GPU 可执行的指令,并配合自研的...

    推荐理由:来自IT之家 AI的《RDNA 4 原生支持 FP8:开发者成功让 AMD 显卡用上英伟达 DLSS 4,但目前性能仍不及 FSR 4》。重点看开源生态、产品发布。摘要提到:IT之家 10 月 1 日消息,Videocardz 今日发现,一个名为 d4r 的 GitHub 项目为 AMD Radeon RX 9000 系列显卡带来了 NVIDIA DLSS 4 与 DLSS 4.5 超分辨率支持。 IT之家查询发现,该项目由开发者 countervolts 发布,旨在通过软件转译层让 AMD 显卡运行 NVIDIA DLSS 库,首个版本发布于 4 天前,今日发布了最新的 0.1.3 版本。 d4r 项目此前已支持 RDNA 3 架构的 RX 7000 系列显卡。最新的 0.1.2 和 0.1.3 版本将支持范围扩展至 RDNA 4 架构,对应 Radeon RX 9070 XT、RX 9070、RX 9070 GRE、RX 9060 XT 和 RX 9060 等型号。 该项目的核心原理是利用 ZLUDA 兼容层,将 DLSS 库中的 CUDA 调用转译为 AMD GPU 可执行的指令,并配合自研的...

  11. IT之家 AI70

    育碧公布新品牌:创意事业部 2 更名 Massive Entertainment,统一管理多款知名 IP

    IT之家 10 月 1 日消息,育碧于当地时间 9 月 30 日宣布将开发部门“创意事业部 2”(Creative House 2)正式更名为“Massive Entertainment”,并启用全新品牌标志。 该部门将整合加拿大蒙特利尔、法国巴黎、瑞典及加拿大多伦多的相关开发团队。 此次调整是育碧今年推进的新组织架构的一部分。公司此前将开发团队划分为 5 个“创意事业部”,按照游戏类型和负责的品牌进行组织,以强化开发团队的自主权以及不同团队之间的协作。 更名后的 Massive Entertainment 将负责《汤姆 · 克兰西:全境封锁》《幽灵行动》《细胞分裂》等系列,同时纳入新 IP《巨人之战》(March of Giants)。相关游戏的开发团队将统一使用 Massive Entertainment 品牌开展工作,但该部门仍属于育碧,游戏发行和分销工作仍由育碧负责。 IT之家查询获悉,Massive Entertain...

    推荐理由:来自IT之家 AI的《育碧公布新品牌:创意事业部 2 更名 Massive Entertainment,统一管理多款知名 IP》。重点看文化创意。摘要提到:IT之家 10 月 1 日消息,育碧于当地时间 9 月 30 日宣布将开发部门“创意事业部 2”(Creative House 2)正式更名为“Massive Entertainment”,并启用全新品牌标志。 该部门将整合加拿大蒙特利尔、法国巴黎、瑞典及加拿大多伦多的相关开发团队。 此次调整是育碧今年推进的新组织架构的一部分。公司此前将开发团队划分为 5 个“创意事业部”,按照游戏类型和负责的品牌进行组织,以强化开发团队的自主权以及不同团队之间的协作。 更名后的 Massive Entertainment 将负责《汤姆 · 克兰西:全境封锁》《幽灵行动》《细胞分裂》等系列,同时纳入新 IP《巨人之战》(March of Giants)。相关游戏的开发团队将统一使用 Massive Entertainment 品牌开展工作,但该部门仍属于育碧,游戏发行和分销工作仍由育碧负责。 IT之家查询获悉,Massive Entertain...

  12. IT之家 AI74

    OpenAI 称其遭遇有组织蒸馏,将矛头指向月之暗面

    IT之家 10 月 1 日消息,当地时间 9 月 30 日,OpenAI 在官网发文,称其近期遭遇一场有组织的蒸馏活动。 OpenAI 在文中表示,该活动最初始于 7 月第一周, 符合对抗式蒸馏(adversarial distillation)之特征 ,即系统性未经授权地利用某模型输出或推理过程,帮助训练、复现或改进另一模型。 OpenAI 透露,7 月 1 日的初始活动规模较小,直到 7 月 24 日和 7 月 25 日流量突然大幅增加,当时有超过 4000 名用户发起了 1.6 万次请求。该公司进一步调查后发现,超 1.5 万名用户存在类似提示词活动。到 7 月 28 日,OpenAI 已完全阻止该批活动。 本次活动并没有破解公司的加密系统,或入侵数据库,也没有直接访问用户对话。OpenAI 声称这些行动违反了他们的服务条款。 公司已通过前沿模型论坛(IT之家注:Frontier Model Forum)与行业合作伙伴分享...

    推荐理由:来自IT之家 AI的《OpenAI 称其遭遇有组织蒸馏,将矛头指向月之暗面》。重点看模型能力与工程。摘要提到:IT之家 10 月 1 日消息,当地时间 9 月 30 日,OpenAI 在官网发文,称其近期遭遇一场有组织的蒸馏活动。 OpenAI 在文中表示,该活动最初始于 7 月第一周, 符合对抗式蒸馏(adversarial distillation)之特征 ,即系统性未经授权地利用某模型输出或推理过程,帮助训练、复现或改进另一模型。 OpenAI 透露,7 月 1 日的初始活动规模较小,直到 7 月 24 日和 7 月 25 日流量突然大幅增加,当时有超过 4000 名用户发起了 1.6 万次请求。该公司进一步调查后发现,超 1.5 万名用户存在类似提示词活动。到 7 月 28 日,OpenAI 已完全阻止该批活动。 本次活动并没有破解公司的加密系统,或入侵数据库,也没有直接访问用户对话。OpenAI 声称这些行动违反了他们的服务条款。 公司已通过前沿模型论坛(IT之家注:Frontier Model Forum)与行业合作伙伴分享...