跳到正文
9月12日周六
  1. GitHub AI Trending62

    Lightning-AI/pytorch-lightning: Pretrain, finetune ANY AI model of ANY size on 1 or 10,000+ GPUs with zero code changes.

    事实摘要:这条英文动态主要涉及模型能力与工程,原文信息显示:Lightning-AI/pytorch-lightning: Pretrain, finetune ANY AI model of ANY size on 1 or 10,000+ GPUs with zero code changes. 事实摘要:这条英文动态主要涉及模型能力与工程,原文信息显示:Ligh。影响判断:它可能改变模型能力与工程相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和模型能力与工程直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  2. Simon Willison85

    OpenAI agents attacked RubyGems back in May

    事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、评测与基准,原文信息显示:OpenAI agents attacked RubyGems back in May 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、评测与基准,原文信息显示:OpenAI agents attacked RubyGems back in May 事实摘要:这条英文动态。影响判断:它可能改变智能体工作流、模型能力与工程、评测与基准相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、评测与基准方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程、评测与基准直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  3. GitHub Changelog88

    Add VS Code Agents to Copilot usage metrics

    这条英文动态主要涉及智能体工作流、开源生态。原文要点:GitHub Copilot usage metrics reports now include generally available metrics for activity in the dedicated VS Code Agents window, helping you measure adoption and engagement across enterprises and organizations. What’s… The post Add VS Code Agents to Copilot usage metrics appeared first on The GitHub Blog .

    推荐理由:来自GitHub Changelog的《Add VS Code Agents to Copilot usage metrics》。重点看智能体工作流、开源生态。摘要提到:这条英文动态主要涉及智能体工作流、开源生态。原文要点:GitHub Copilot usage metrics reports now include generally available metrics for activity in the dedicated VS Code Agents window, helping you measure adoption and engagement across enterprises and organizations. What’s… The post Add VS Code Agents to Copilot usage metrics appeared first on The GitHub Blog .

  4. GitHub Changelog88

    Auto-resolution and analysis updates in Copilot code review

    事实摘要:这条英文动态主要涉及文化创意、开源生态,原文信息显示:Auto-resolution and analysis updates in Copilot code review 事实摘要:这条英文动态主要涉及文化创意、开源生态,原文信息显示:Auto-resolution and analysis updates in Copilot code review 事。影响判断:它可能改变文化创意、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪文化创意、开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和文化创意、开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  5. Claude Code Releases84

    Claude Code Releases v2.1.269:Added claude plugin eval : run a plugin's eval suite again...

    事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、评测与基准,原文信息显示:Claude Code Releases v2.1.269:Added claude plugin eval : run a plugin's eval suite again... 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、评测与基准,原文信息显示:Claude 。影响判断:它可能改变智能体工作流、模型能力与工程、评测与基准相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、评测与基准方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程、评测与基准直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

9月11日周五
  1. IT之家 AI72

    月之暗面 Kimi K2.8 Preview 模型全量上线 Kimi Code,综合性能接近 K3

    IT之家 9 月 11 日消息, 月之暗面 Kimi K2.8 Preview 模型今日全量上线 Kimi Code ,Model ID 不变,仍为 kimi-for-coding,客户端与第三方工具无需修改配置即可使用。 官方表示, K2.8 Preview 综合性能接近 K3 ,思考效率更高。编码与智能体能力全面提升,思考(thinking)效率较 K2.7 Code 显著改善, 全部会员档位均开放最高 1M 上下文窗口 。 IT之家获悉,Kimi K2.8 Preview 支持 thinking effort 档位调节,与 K3 的思考等级一致,支持 low / high / max 三档(默认 max)。关闭 thinking 后,K3 系列与 K2.8 Preview 的请求均路由到 K2.8 Preview(无思考)。 相关阅读: 《 月之暗面开源 Kimi K3 模型,2.8 万亿参数 》

    推荐理由:来自IT之家 AI的《月之暗面 Kimi K2.8 Preview 模型全量上线 Kimi Code,综合性能接近 K3》。重点看智能体工作流、模型能力与工程、开源生态。摘要提到:IT之家 9 月 11 日消息, 月之暗面 Kimi K2.8 Preview 模型今日全量上线 Kimi Code ,Model ID 不变,仍为 kimi-for-coding,客户端与第三方工具无需修改配置即可使用。 官方表示, K2.8 Preview 综合性能接近 K3 ,思考效率更高。编码与智能体能力全面提升,思考(thinking)效率较 K2.7 Code 显著改善, 全部会员档位均开放最高 1M 上下文窗口 。 IT之家获悉,Kimi K2.8 Preview 支持 thinking effort 档位调节,与 K3 的思考等级一致,支持 low / high / max 三档(默认 max)。关闭 thinking 后,K3 系列与 K2.8 Preview 的请求均路由到 K2.8 Preview(无思考)。 相关阅读: 《 月之暗面开源 Kimi K3 模型,2.8 万亿参数 》

  2. IT之家 AI76

    小米开源工业级目标说话人语音识别大模型 Xiaomi-CocktailASR-1

    IT之家 9 月 11 日消息,小米技术今日发文宣布,小米正式发布并开源工业级目标说话人语音识别大模型 Xiaomi-CocktailASR-1。 官方表示,Xiaomi-CocktailASR-1 旨在解决“鸡尾酒会”难题 (IT之家注:当前语音识别技术已经可以以较高精度识别一个人所讲的话,但是当说话的人数为两人或者多人时,语音识别率就会极大地降低,这一难题被称为鸡尾酒会问题)。 该模型采用端到端 LLM 架构,以目标说话人的一段参考音频作为声纹提示,可在多人同时说话的复杂环境中,精准提取并仅转录目标用户的语音。 在多个主流多说话人测试集上均达到 SOTA ,大幅领先现有方案。 同时, 其单人识别性能比肩标准 ASR 模型 ,可无缝兼顾单人说话场景;具备拒识非目标说话人干扰语音的能力,目标不在场时输出空文本,有效避免误触发;此外还支持思维链推理模式,为识别结果提供可解释推理过程。 IT之家附相关链接: GitHub: http...

    推荐理由:来自IT之家 AI的《小米开源工业级目标说话人语音识别大模型 Xiaomi-CocktailASR-1》。重点看模型能力与工程、开源生态、产品发布。摘要提到:IT之家 9 月 11 日消息,小米技术今日发文宣布,小米正式发布并开源工业级目标说话人语音识别大模型 Xiaomi-CocktailASR-1。 官方表示,Xiaomi-CocktailASR-1 旨在解决“鸡尾酒会”难题 (IT之家注:当前语音识别技术已经可以以较高精度识别一个人所讲的话,但是当说话的人数为两人或者多人时,语音识别率就会极大地降低,这一难题被称为鸡尾酒会问题)。 该模型采用端到端 LLM 架构,以目标说话人的一段参考音频作为声纹提示,可在多人同时说话的复杂环境中,精准提取并仅转录目标用户的语音。 在多个主流多说话人测试集上均达到 SOTA ,大幅领先现有方案。 同时, 其单人识别性能比肩标准 ASR 模型 ,可无缝兼顾单人说话场景;具备拒识非目标说话人干扰语音的能力,目标不在场时输出空文本,有效避免误触发;此外还支持思维链推理模式,为识别结果提供可解释推理过程。 IT之家附相关链接: GitHub: http...

  3. GitHub AI Trending33

    WasmEdge/WasmEdge: WasmEdge is a lightweight, high-performance, and extensible WebAssembly runtime for cloud native, edge, and decentralized applications. It powers serverless apps, embedded functions, microservices, smart contracts, and IoT devices.

    这条英文动态主要涉及文化创意。原文要点:WasmEdge is a lightweight, high-performance, and extensible WebAssembly runtime for cloud native, edge, and decentralized applications. It powers serverless apps, embedded functions, microservices, smart contracts, and IoT devices.。Stars: 10817, language: C++.

    推荐理由:来自GitHub AI Trending的《WasmEdge/WasmEdge: WasmEdge is a lightweight, high-performance, and extensible WebAssembly runtime for cloud native, edge, and decentralized applications. It powers serverless apps, embedded functions, microservices, smart contracts, and IoT devices.》。重点看文化创意。摘要提到:这条英文动态主要涉及文化创意。原文要点:WasmEdge is a lightweight, high-performance, and extensible WebAssembly runtime for cloud native, edge, and decentralized applications. It powers serverless apps, embedded functions, microservices, smart contracts, and IoT devices.。Stars: 10817, language: C++.

  4. Simon Willison54

    Datasette 1.0a39 and 0.65.4 security releases

    原文摘录(自动中文摘要暂不可用):Datasette 1.0a39 and 0.65.4 security releases Datasette 1.0a39 and 0.65.4 security releases Today we're releasing two new security patch versions of Datasette: 1.0a39 and 0.65.4 - one for the current alpha series and one for the stable 0.65.x family. These are security fixes which you should apply if you are running a Datasette instance on the public web - i

    推荐理由:自动中文摘要尚未通过校验,请核对原文与完整来源。

  5. IT之家 AI70

    微软 VS Code 1.137 发布:为宠物征名、按小时 / 日 / 周调度 AI 智能体任务

    IT之家 9 月 11 日消息,微软昨日(9 月 10 日)发布公告,宣布推出 Visual Studio Code 1.137 版本, 可帮助用户自动化重复性工作、在工作区中继续快速聊天,以及在不离开客服窗口的情况下处理 GitHub 问题和拉取请求。 本次更新主要聚焦增强 AI 智能体能力,推出 5 项主要新功能,其中 3 项仍处于实验或预览阶段。核心功能包括 Automations(预览)、Voice Mode(实验)、快速聊天转工作区、GitHub Issue / PR 集成以及 VS Code 宠物互动功能。 Automations 方面,用户可以根据使用需求,在手动触发之外,也可以按小时、每日或每周自动执行 AI 智能体任务。IT之家附上相关视频如下: 用户可通过启用 chat.automations.enabled 设置,在 Agents 窗口侧边栏选择 Automations,使用预设模板(如追踪变更、分类 Is...

    推荐理由:来自IT之家 AI的《微软 VS Code 1.137 发布:为宠物征名、按小时 / 日 / 周调度 AI 智能体任务》。重点看智能体工作流、开源生态、产品发布。摘要提到:IT之家 9 月 11 日消息,微软昨日(9 月 10 日)发布公告,宣布推出 Visual Studio Code 1.137 版本, 可帮助用户自动化重复性工作、在工作区中继续快速聊天,以及在不离开客服窗口的情况下处理 GitHub 问题和拉取请求。 本次更新主要聚焦增强 AI 智能体能力,推出 5 项主要新功能,其中 3 项仍处于实验或预览阶段。核心功能包括 Automations(预览)、Voice Mode(实验)、快速聊天转工作区、GitHub Issue / PR 集成以及 VS Code 宠物互动功能。 Automations 方面,用户可以根据使用需求,在手动触发之外,也可以按小时、每日或每周自动执行 AI 智能体任务。IT之家附上相关视频如下: 用户可通过启用 chat.automations.enabled 设置,在 Agents 窗口侧边栏选择 Automations,使用预设模板(如追踪变更、分类 Is...

  6. Simon Willison40

    github-to-sqlite 2.9.1

    事实摘要:github-to-sqlite 2.9.1 事实摘要:github-to-sqlite 2.9.1 事实摘要:github-to-sqlite 2.9.1 事实摘要:github-to-sqlite 2.9.1 事实摘要:github-to-sqlite 2.9.1 事实摘要:这条英文动态主要涉及开源生态,原文信息显示:github-to-sqlite 2。影响判断:它可能改变开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  7. GitHub Changelog85

    GitHub Copilot weekly releases — September 7

    事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:GitHub Copilot weekly releases — September 7 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:GitHub Copilot weekly releases — September 7 事实摘要:这条英文动态。影响判断:它可能改变智能体工作流、模型能力与工程、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程、开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  8. GitHub Blog AI86

    GitHub Copilot app for Beginners: Using the diff, terminal, and browser

    事实摘要:这条英文动态主要涉及智能体工作流、开源生态,原文信息显示:GitHub Copilot app for Beginners: Using the diff, terminal, and browser 这条英文动态主要涉及智能体工作流、开源生态。原文要点:Checking agent-generated code usually means hopping 。影响判断:它可能改变智能体工作流、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  9. GitHub Changelog82

    Control GitHub Actions cache access with cache-mode

    这条英文动态主要涉及智能体工作流、开源生态。原文要点:You can now use cache-mode to apply least-privilege access to the GitHub Actions cache at the workflow or job level. By granting each workflow or job only the cache access… The post Control GitHub Actions cache access with cache-mode appeared first on The GitHub Blog .

    推荐理由:来自GitHub Changelog的《Control GitHub Actions cache access with cache-mode》。重点看智能体工作流、开源生态。摘要提到:这条英文动态主要涉及智能体工作流、开源生态。原文要点:You can now use cache-mode to apply least-privilege access to the GitHub Actions cache at the workflow or job level. By granting each workflow or job only the cache access… The post Control GitHub Actions cache access with cache-mode appeared first on The GitHub Blog .

  10. GitHub Changelog92

    MAI-Code-1-Flash deprecated

    事实摘要:MAI-Code-1-Flash deprecated 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:MAI-Code-1-Flash deprecated 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:MAI-Code-1-Flash deprecated 事实摘要:这条英文动态主。影响判断:它可能改变智能体工作流、模型能力与工程、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程、开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

9月10日周四
  1. GitHub Changelog53

    Xcode 27 runner image now runs on macOS 27

    原文摘录(自动中文摘要暂不可用):Xcode 27 runner image now runs on macOS 27 You can now validate your Apple apps against macOS 27 using the Xcode 27 runner image for GitHub-hosted macOS runners, available in public preview. The image previously ran on macOS… The post Xcode 27 runner image now runs on macOS 27 appeared first on The GitHub Blog .

    推荐理由:自动中文摘要尚未通过校验,请核对原文与完整来源。

  2. IT之家 AI72

    NASA 与 IBM 联合发布开源月球研究基础大模型,可识别月表冰区与撞击坑

    IT之家 9 月 10 日消息,今年春天,NASA 的阿尔忒弥斯 2 号任务完成了具有历史意义的月球掠飞,这是 1972 年之后人类首次载人绕月飞行。4 月 6 日,宇航员里德 · 怀斯曼、克里斯蒂娜 · 科赫、维克多 · 格洛弗与杰里米 · 汉森抵达了比以往任何人都更远的地外空间。如今,NASA 在筹备后续阿尔忒弥斯系列任务的同时,正与 IBM 合作,为科研人员打造全新的月球研究工具。 当地时间周四,双方联合发布了 NASA-IBM 月球基础大模型。这是一套开源人工智能系统,可在 Hugging Face 平台下载。IBM 欧洲、英国及爱尔兰研究院院长胡安 · 贝尔纳韦-莫雷诺博士介绍,作为基础大模型,它可以完成多项任务。首先,NASA 与 IBM 发现,该模型特别擅长识别月球表面可能存在冰的区域。 IT之家注意到,双方开展了一项对照测试:将模型的预测结果,和一套依靠成熟科研流程生成的月球地图进行比对,这套地图融合了地形、温度...

    推荐理由:来自IT之家 AI的《NASA 与 IBM 联合发布开源月球研究基础大模型,可识别月表冰区与撞击坑》。重点看模型能力与工程、开源生态、产品发布。摘要提到:IT之家 9 月 10 日消息,今年春天,NASA 的阿尔忒弥斯 2 号任务完成了具有历史意义的月球掠飞,这是 1972 年之后人类首次载人绕月飞行。4 月 6 日,宇航员里德 · 怀斯曼、克里斯蒂娜 · 科赫、维克多 · 格洛弗与杰里米 · 汉森抵达了比以往任何人都更远的地外空间。如今,NASA 在筹备后续阿尔忒弥斯系列任务的同时,正与 IBM 合作,为科研人员打造全新的月球研究工具。 当地时间周四,双方联合发布了 NASA-IBM 月球基础大模型。这是一套开源人工智能系统,可在 Hugging Face 平台下载。IBM 欧洲、英国及爱尔兰研究院院长胡安 · 贝尔纳韦-莫雷诺博士介绍,作为基础大模型,它可以完成多项任务。首先,NASA 与 IBM 发现,该模型特别擅长识别月球表面可能存在冰的区域。 IT之家注意到,双方开展了一项对照测试:将模型的预测结果,和一套依靠成熟科研流程生成的月球地图进行比对,这套地图融合了地形、温度...

  3. IT之家 AI70

    英伟达与 Palantir 达成合作,将主权 AI 引入关键供应链

    IT之家 9 月 10 日消息,Palantir 与英伟达今日宣布达成合作,将主权 AI 技术落地于关键供应链领域,合作率先从英伟达自身的生产运营场景启动。 据IT之家了解,此次部署将打造一套 AI 技术栈,把英伟达 Nemotron 开源模型接入 Palantir Foundry 平台及人工智能平台(AIP),并以 Palantir 本体框架为底层支撑。这套技术栈旨在实现前所未有的供应链可视化能力,识别产能瓶颈,持续沉淀运营专业经验,并以机器级速度辅助决策 —— 在保障英伟达 AI 基础设施供应链可靠性与运转效率的同时,确保企业对自有专有数据的控制权与所有权。 支撑本次合作的这套 AI 技术栈及其跨行业应用方案,将在 Palantir AIPCon 11 大会上进行深度展示。农业、制造业、制药、零售、科技等复杂行业的企业及政府机构,均可借助这套 AI 技术栈优化自身专属的供应链运营。 英伟达拥有全球最复杂的供应链体系之一,覆盖...

    推荐理由:来自IT之家 AI的《英伟达与 Palantir 达成合作,将主权 AI 引入关键供应链》。重点看模型能力与工程、开源生态。摘要提到:IT之家 9 月 10 日消息,Palantir 与英伟达今日宣布达成合作,将主权 AI 技术落地于关键供应链领域,合作率先从英伟达自身的生产运营场景启动。 据IT之家了解,此次部署将打造一套 AI 技术栈,把英伟达 Nemotron 开源模型接入 Palantir Foundry 平台及人工智能平台(AIP),并以 Palantir 本体框架为底层支撑。这套技术栈旨在实现前所未有的供应链可视化能力,识别产能瓶颈,持续沉淀运营专业经验,并以机器级速度辅助决策 —— 在保障英伟达 AI 基础设施供应链可靠性与运转效率的同时,确保企业对自有专有数据的控制权与所有权。 支撑本次合作的这套 AI 技术栈及其跨行业应用方案,将在 Palantir AIPCon 11 大会上进行深度展示。农业、制造业、制药、零售、科技等复杂行业的企业及政府机构,均可借助这套 AI 技术栈优化自身专属的供应链运营。 英伟达拥有全球最复杂的供应链体系之一,覆盖...

  4. IT之家 AI72

    刷新全球开源模型多项评测 SOTA,宇树科技开源全新一代通用人形机器人基座模型 UnifoLM-WLA-1.0

    IT之家 9 月 10 日消息,宇树科技宣布完全开源 UnifoLM-WLA-1.0 具身基座模型,刷新全球开源模型多项评测 SOTA。单模型统筹桌面与全身移动操作,支持跨任务、跨末端执行器泛化。 据介绍,UnifoLM-WLA-1.0 是宇树科技全新一代通用人形机器人基础模型,依托大规模通用多模态感知与理解数据,融合以交互为中心的世界建模,全面提升空间感知与理解能力,在多项具身推理评测中领先国内外开源模型,亦可比肩头部闭源模型。真机评测实现单模型统筹 64 个任务,覆盖桌面操作与全身移动操作,具备跨任务、跨末端执行器的泛化能力。 IT之家附官方介绍视频如下:

    推荐理由:来自IT之家 AI的《刷新全球开源模型多项评测 SOTA,宇树科技开源全新一代通用人形机器人基座模型 UnifoLM-WLA-1.0》。重点看模型能力与工程、评测与基准、开源生态。摘要提到:IT之家 9 月 10 日消息,宇树科技宣布完全开源 UnifoLM-WLA-1.0 具身基座模型,刷新全球开源模型多项评测 SOTA。单模型统筹桌面与全身移动操作,支持跨任务、跨末端执行器泛化。 据介绍,UnifoLM-WLA-1.0 是宇树科技全新一代通用人形机器人基础模型,依托大规模通用多模态感知与理解数据,融合以交互为中心的世界建模,全面提升空间感知与理解能力,在多项具身推理评测中领先国内外开源模型,亦可比肩头部闭源模型。真机评测实现单模型统筹 64 个任务,覆盖桌面操作与全身移动操作,具备跨任务、跨末端执行器的泛化能力。 IT之家附官方介绍视频如下:

  5. 量子位37

    这个新开源的世界模型只有1.3B,单卡就能实时跑!

    轻量版LingBot-World 2.0 这条动态来自 量子位,可重点关注模型能力与工程、开源生态。

    推荐理由:来自量子位的《这个新开源的世界模型只有1.3B,单卡就能实时跑!》。重点看模型能力与工程、开源生态。摘要提到:轻量版LingBot-World 2.0 这条动态来自 量子位,可重点关注模型能力与工程、开源生态。

  6. 量子位38

    一周连发6个模型!这家公司把具身智能的闭环跑通了

    事实摘要:一周连发6个模型!这家公司把具身智能的闭环跑通了 模型可以开源,部署经验不能 这条动态来自 量子位,可重点关注模型能力与工程、开源生态。 一周连发6个模型!这家公司把具身智能的闭环跑通了 模型可以开源,部署经验不能。影响判断:它可能改变模型能力与工程、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程、开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和模型能力与工程、开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  7. GitHub Changelog87

    Enterprise managed permissions for GitHub Copilot agent operations

    事实摘要:这条英文动态主要涉及智能体工作流、开源生态,原文信息显示:Enterprise managed permissions for GitHub Copilot agent operations 事实摘要:这条英文动态主要涉及智能体工作流、开源生态,原文信息显示:Enterprise managed permissions for GitHub Copilot 。影响判断:它可能改变智能体工作流、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

9月9日周三
  1. IT之家 AI72

    全球首个千亿级参数气象服务垂域模型:“风和”V1.0 实现业务准入

    IT之家 9 月 9 日消息,中国气象局官方公众号今天(9 日)晚间发文宣布,生成式人工智能气象服务系统“风和”模型 V1.0 通过中国气象局组织的专家评审,实现业务准入 。 作为首个千亿级参数的气象服务垂域模型,“风和”具备 气象服务需求理解、气象服务内容生成、气象推理与决策、气象工具调用 等能力,可为气象服务业务提供基座模型能力支撑。 模型能力评估结果表明,“风和”在服务需求理解、服务内容生成、气象推理与决策等方面优于通用模型。模型通过中央网信办备案,试运行稳定,达到业务准入要求。 “风和”不仅能够为全国气象服务业务提供基础支撑,为国内公众提供个性化、智能化气象信息查询、气象服务建议和气象风险预警,还深度融入联合国全民早期预警倡议, 其国际版已上线并融入中国气象智能预警方案“妈祖” ,为全球用户提供中英文智能问答、天气查询和风险分析服务。 据IT之家此前报道,“风和”大语言模型于今年 7 月正式发布,“风和”全球开源计划同时...

    推荐理由:来自IT之家 AI的《全球首个千亿级参数气象服务垂域模型:“风和”V1.0 实现业务准入》。重点看模型能力与工程、开源生态、产品发布。摘要提到:IT之家 9 月 9 日消息,中国气象局官方公众号今天(9 日)晚间发文宣布,生成式人工智能气象服务系统“风和”模型 V1.0 通过中国气象局组织的专家评审,实现业务准入 。 作为首个千亿级参数的气象服务垂域模型,“风和”具备 气象服务需求理解、气象服务内容生成、气象推理与决策、气象工具调用 等能力,可为气象服务业务提供基座模型能力支撑。 模型能力评估结果表明,“风和”在服务需求理解、服务内容生成、气象推理与决策等方面优于通用模型。模型通过中央网信办备案,试运行稳定,达到业务准入要求。 “风和”不仅能够为全国气象服务业务提供基础支撑,为国内公众提供个性化、智能化气象信息查询、气象服务建议和气象风险预警,还深度融入联合国全民早期预警倡议, 其国际版已上线并融入中国气象智能预警方案“妈祖” ,为全球用户提供中英文智能问答、天气查询和风险分析服务。 据IT之家此前报道,“风和”大语言模型于今年 7 月正式发布,“风和”全球开源计划同时...

  2. GitHub Changelog85

    Remediate Code Quality findings with agentic autofix

    原文摘录(自动中文摘要暂不可用):Remediate Code Quality findings with agentic autofix Agentic autofix is now available to help you burn down findings in your code quality backlog. You can select up to 25 standard findings on a page and assign the… The post Remediate Code Quality findings with agentic autofix appeared first on The GitHub Blog .

    推荐理由:自动中文摘要尚未通过校验,请核对原文与完整来源。

  3. IT之家 AI72

    OpenAI CFO:自研 AI 助力芯片设计,Luna 模型部署成本低于开源方案

    IT之家 9 月 9 日消息,据路透社报道,OpenAI 首席财务官 Sarah Friar 当地时间周一表示,随着企业业务增长不断加速,OpenAI 正在推动 AI 进一步进入专业行业,同时通过降低价格来与开源及开放权重模型竞争。 Friar 在旧金山举行的高盛 Communacopia + Technology Conference 会议上表示,OpenAI 目前正重点布局芯片设计、生命科学和金融服务等领域。随着企业越来越希望 AI 系统能够针对特定任务进行优化,OpenAI 也在探索更加行业化的 AI 解决方案。 与此同时,OpenAI 正在尝试按照企业最终获得的业务成果,而不是模型的实际使用量来制定价格。随着越来越多企业要求 AI 投资能够带来明确的回报,这种定价模式也成为 OpenAI 正在探索的方向。 OpenAI 向行业专用 AI 领域扩张,并采取更具攻击性的定价策略,也反映出公司正面临日益激烈的竞争。一方面,中国...

    推荐理由:来自IT之家 AI的《OpenAI CFO:自研 AI 助力芯片设计,Luna 模型部署成本低于开源方案》。重点看模型能力与工程、开源生态。摘要提到:IT之家 9 月 9 日消息,据路透社报道,OpenAI 首席财务官 Sarah Friar 当地时间周一表示,随着企业业务增长不断加速,OpenAI 正在推动 AI 进一步进入专业行业,同时通过降低价格来与开源及开放权重模型竞争。 Friar 在旧金山举行的高盛 Communacopia + Technology Conference 会议上表示,OpenAI 目前正重点布局芯片设计、生命科学和金融服务等领域。随着企业越来越希望 AI 系统能够针对特定任务进行优化,OpenAI 也在探索更加行业化的 AI 解决方案。 与此同时,OpenAI 正在尝试按照企业最终获得的业务成果,而不是模型的实际使用量来制定价格。随着越来越多企业要求 AI 投资能够带来明确的回报,这种定价模式也成为 OpenAI 正在探索的方向。 OpenAI 向行业专用 AI 领域扩张,并采取更具攻击性的定价策略,也反映出公司正面临日益激烈的竞争。一方面,中国...

  4. IT之家 AI80

    面壁智能开源 MiniCPM5-2B AI 模型:AA 榜单全球 4B 以下第一,初具端侧通用 Agent 能力

    IT之家 9 月 9 日消息,面壁智能昨日联合 OpenBMB 开源社区正式开源新一代“小钢炮” MiniCPM5-2B 。 MiniCPM5-2B 的参数规模为 2B,是一款高密度端侧语言基座模型,支持工具调用、深度搜索、代码生成等任务,官方称 初步实现了 端侧通用 Agent 雏形 。 根据榜单 Artificial Analysis Intelligence Index(以下简称「AA 榜单」)的最新评测,MiniCPM5-2B 综合能力得分 23 分, 在全球 4B 参数规模以下的开源基座模型中综合表现第一 。 官方表示,在评测智能体能力的 Agentic Index 指标上,MiniCPM5-2B 更是断层式领先:总分达 20 分,同级模型(如 LFM2.5-2.6B、Granite 4.2 3B、Mistral 3 3B)仅 2 分。 MiniCPM5-2B 在覆盖代码推理、数学推理、指令遵循、综合知识、长文本、工具...

    推荐理由:来自IT之家 AI的《面壁智能开源 MiniCPM5-2B AI 模型:AA 榜单全球 4B 以下第一,初具端侧通用 Agent 能力》。重点看智能体工作流、模型能力与工程、评测与基准。摘要提到:IT之家 9 月 9 日消息,面壁智能昨日联合 OpenBMB 开源社区正式开源新一代“小钢炮” MiniCPM5-2B 。 MiniCPM5-2B 的参数规模为 2B,是一款高密度端侧语言基座模型,支持工具调用、深度搜索、代码生成等任务,官方称 初步实现了 端侧通用 Agent 雏形 。 根据榜单 Artificial Analysis Intelligence Index(以下简称「AA 榜单」)的最新评测,MiniCPM5-2B 综合能力得分 23 分, 在全球 4B 参数规模以下的开源基座模型中综合表现第一 。 官方表示,在评测智能体能力的 Agentic Index 指标上,MiniCPM5-2B 更是断层式领先:总分达 20 分,同级模型(如 LFM2.5-2.6B、Granite 4.2 3B、Mistral 3 3B)仅 2 分。 MiniCPM5-2B 在覆盖代码推理、数学推理、指令遵循、综合知识、长文本、工具...

  5. IT之家 AI76

    蚂蚁百灵系列首个原生多模态模型 Ling-3.0-flash-VL 发布开源,引入视觉反馈闭环机制

    IT之家 9 月 9 日消息,蚂蚁集团今日宣布推出并开源百灵系列首个原生多模态大模型 Ling-3.0-flash-VL。 该模型基于 Ling-3.0-flash 的 MoE(混合专家)架构拓展,总参数量为 124B,单次推理激活 5.5B 参数,原生支持图像、文本与视频输入,上下文窗口达到 256K Token。 模型围绕“更可靠、更高效完成真实任务”的方向,引入了视觉反馈闭环机制。不同于一次性的“看图生成”,该机制将任务推进为“观察 → 行动 → 验证 → 修正”的持续闭环,使模型在医疗报告解读、前端代码生成及 GUI 自动化等场景中能够基于视觉反馈持续修正执行结果。 在训练层面,蚂蚁集团表示,通过原生多模态联合训练,视觉信息的引入对模型的文本能力带来了正向提升。在 Artificial Analysis Intelligence Index v4.1.1 评估中,Ling-3.0-flash-VL 较纯文本版本(Ling...

    推荐理由:来自IT之家 AI的《蚂蚁百灵系列首个原生多模态模型 Ling-3.0-flash-VL 发布开源,引入视觉反馈闭环机制》。重点看模型能力与工程、文化创意、开源生态。摘要提到:IT之家 9 月 9 日消息,蚂蚁集团今日宣布推出并开源百灵系列首个原生多模态大模型 Ling-3.0-flash-VL。 该模型基于 Ling-3.0-flash 的 MoE(混合专家)架构拓展,总参数量为 124B,单次推理激活 5.5B 参数,原生支持图像、文本与视频输入,上下文窗口达到 256K Token。 模型围绕“更可靠、更高效完成真实任务”的方向,引入了视觉反馈闭环机制。不同于一次性的“看图生成”,该机制将任务推进为“观察 → 行动 → 验证 → 修正”的持续闭环,使模型在医疗报告解读、前端代码生成及 GUI 自动化等场景中能够基于视觉反馈持续修正执行结果。 在训练层面,蚂蚁集团表示,通过原生多模态联合训练,视觉信息的引入对模型的文本能力带来了正向提升。在 Artificial Analysis Intelligence Index v4.1.1 评估中,Ling-3.0-flash-VL 较纯文本版本(Ling...

9月8日周二
  1. IT之家 AI36

    瑞士启动 3000 台电脑迁移试点,900 万法郎推动开源替代微软 M365

    IT之家 9 月 8 日消息,科技媒体 Windows Central 昨日(9 月 7 日)发布博文,报道称瑞士联邦委员会已启动试点项目, 覆盖约 3,000 台政府电脑,测试德国开发的开源协作套件 openDesk,探索替代 Microsoft 365 的可行性。 本次试点项目的推进初衷是维护瑞士的数字主权,减少对单一海外技术供应商的依赖,让瑞士政府能够自主掌控关键数据、软件、基础设施和技术决策。 在本次试点项目启动之前,瑞士此前已展开概念验证(PoC)测试,邀请 172 名政府公职人员测试,测试者对文档处理、文件存储、协作、邮件和日历功能给出积极评价。该平台也可能在 Microsoft 365 发生中断后,承担部分应急办公任务。 概念验证同时显示,大型视频会议存在功能限制。瑞士方面指出,后续建设还需要完成大量适配、安全评估、平台验证和能力建设,并可能需要追加建设及运营资金。 基于概念验证(PoC)测试结果,瑞士进一步推动试...

    推荐理由:来自IT之家 AI的《瑞士启动 3000 台电脑迁移试点,900 万法郎推动开源替代微软 M365》。重点看开源生态、产品发布。摘要提到:IT之家 9 月 8 日消息,科技媒体 Windows Central 昨日(9 月 7 日)发布博文,报道称瑞士联邦委员会已启动试点项目, 覆盖约 3,000 台政府电脑,测试德国开发的开源协作套件 openDesk,探索替代 Microsoft 365 的可行性。 本次试点项目的推进初衷是维护瑞士的数字主权,减少对单一海外技术供应商的依赖,让瑞士政府能够自主掌控关键数据、软件、基础设施和技术决策。 在本次试点项目启动之前,瑞士此前已展开概念验证(PoC)测试,邀请 172 名政府公职人员测试,测试者对文档处理、文件存储、协作、邮件和日历功能给出积极评价。该平台也可能在 Microsoft 365 发生中断后,承担部分应急办公任务。 概念验证同时显示,大型视频会议存在功能限制。瑞士方面指出,后续建设还需要完成大量适配、安全评估、平台验证和能力建设,并可能需要追加建设及运营资金。 基于概念验证(PoC)测试结果,瑞士进一步推动试...

  2. IT之家 AI72

    微信 WeMM-Embedding 多模态模型已在微信大规模使用:覆盖朋友圈搜索等,每天调用量 10 亿次

    IT之家 9 月 8 日消息,微信 AI 官方在 9 月 4 日宣布, 将通用多模态嵌入模型 WeMM-Embedding 开源 ,包含 2B、4B、9B 三个版本,支持文本、图像、视频、视觉文档以及任意交错的多模态输入。 据微信员工 @客村小蒋 分享,微信视觉团队最近开源的多模态模型 WeMM-Embedding 简单说就是让系统能同时理解文字、图片和视频,把它们放在同一个语义空间里去比较和检索。 他透露, 这个模型已经在微信里大规模用了 —— 朋友圈搜索、视频号推荐、公众号推荐、微信电商都在用 ,每天调用量 10 亿次。 在国际权威榜单 MMEB-v2 上拿了第一 ,超过此前所有已提交的开源与闭源模型。 IT之家附相关链接: 论文链接: https://arxiv.org/abs/2608.24053 代码仓库: https://github.com/Tencent/WeMM-Embedding 模型集合: https://...

    推荐理由:来自IT之家 AI的《微信 WeMM-Embedding 多模态模型已在微信大规模使用:覆盖朋友圈搜索等,每天调用量 10 亿次》。重点看模型能力与工程、开源生态。摘要提到:IT之家 9 月 8 日消息,微信 AI 官方在 9 月 4 日宣布, 将通用多模态嵌入模型 WeMM-Embedding 开源 ,包含 2B、4B、9B 三个版本,支持文本、图像、视频、视觉文档以及任意交错的多模态输入。 据微信员工 @客村小蒋 分享,微信视觉团队最近开源的多模态模型 WeMM-Embedding 简单说就是让系统能同时理解文字、图片和视频,把它们放在同一个语义空间里去比较和检索。 他透露, 这个模型已经在微信里大规模用了 —— 朋友圈搜索、视频号推荐、公众号推荐、微信电商都在用 ,每天调用量 10 亿次。 在国际权威榜单 MMEB-v2 上拿了第一 ,超过此前所有已提交的开源与闭源模型。 IT之家附相关链接: 论文链接: https://arxiv.org/abs/2608.24053 代码仓库: https://github.com/Tencent/WeMM-Embedding 模型集合: https://...

9月7日周一
  1. IT之家 AI68

    腾讯混元:Hy4 preview 模型升级,显著降低任务轮次及输入输出 Token 消耗

    IT之家 9 月 7 日消息,腾讯混元与 WorkBuddy 联合团队今日宣布,针对 Hy4 preview 模型“复杂任务下的长思考、过度自我验证”等问题,进行了专项优化并全量上线。 通过 Bench 指标与人工评测双重监控, 在不损失任务效果的前提下,优化版本显著降低了任务轮次及输入输出 token 消耗 。 据IT之家此前报道,腾讯于 8 月 28 日 发布了 Hy4 preview 模型 ,总参数 770 B,激活参数 49 B,上下文长度 1M。 官方表示,Hy4 preview 在模型尺寸、上下文长度、数据规模上都进行了显著的扩展,预训练和后训练的共同进步带来了智能水平的又一次巨大提升, 稳居开源模型第一梯队 。

    推荐理由:来自IT之家 AI的《腾讯混元:Hy4 preview 模型升级,显著降低任务轮次及输入输出 Token 消耗》。重点看模型能力与工程、评测与基准、开源生态。摘要提到:IT之家 9 月 7 日消息,腾讯混元与 WorkBuddy 联合团队今日宣布,针对 Hy4 preview 模型“复杂任务下的长思考、过度自我验证”等问题,进行了专项优化并全量上线。 通过 Bench 指标与人工评测双重监控, 在不损失任务效果的前提下,优化版本显著降低了任务轮次及输入输出 token 消耗 。 据IT之家此前报道,腾讯于 8 月 28 日 发布了 Hy4 preview 模型 ,总参数 770 B,激活参数 49 B,上下文长度 1M。 官方表示,Hy4 preview 在模型尺寸、上下文长度、数据规模上都进行了显著的扩展,预训练和后训练的共同进步带来了智能水平的又一次巨大提升, 稳居开源模型第一梯队 。

9月6日周日
  1. IT之家 AI70

    微软借力 AI 重塑 Win11 应用生态:30 分钟即可生成 WinUI 原生应用

    IT之家 9 月 6 日消息,在普遍认为企业还不知道该如何真正利用 AI 的当下,微软却已经制定了一套计划:借助 AI,让更多原生 WinUI 应用进入 Microsoft Store。 IT之家注意到,微软近日发布了一份新的快速入门指南,帮助开发者利用 AI、VS Code 和自家的 winapp CLI,从一个空文件夹开始,一步步创建并发布 WinUI 3 应用。微软表示,整个流程大约只需要 30 分钟,而且无需安装 Visual Studio,使用的工具也都是免费的,包括 GitHub Copilot 的免费版本。 这份简单的 30 分钟指南,本质上是在吸引初学者为 Windows 11 开发应用,而且不必再经历传统开发中那些“繁重”的编码工作。 现在,任何人都可以借助 AI 创建一个新的 WinUI 应用,让 AI 智能体添加功能、测试结果,将应用打包成 MSIX,然后提交到 Microsoft Store,整个过程免费...

    推荐理由:来自IT之家 AI的《微软借力 AI 重塑 Win11 应用生态:30 分钟即可生成 WinUI 原生应用》。重点看智能体工作流、开源生态、产品发布。摘要提到:IT之家 9 月 6 日消息,在普遍认为企业还不知道该如何真正利用 AI 的当下,微软却已经制定了一套计划:借助 AI,让更多原生 WinUI 应用进入 Microsoft Store。 IT之家注意到,微软近日发布了一份新的快速入门指南,帮助开发者利用 AI、VS Code 和自家的 winapp CLI,从一个空文件夹开始,一步步创建并发布 WinUI 3 应用。微软表示,整个流程大约只需要 30 分钟,而且无需安装 Visual Studio,使用的工具也都是免费的,包括 GitHub Copilot 的免费版本。 这份简单的 30 分钟指南,本质上是在吸引初学者为 Windows 11 开发应用,而且不必再经历传统开发中那些“繁重”的编码工作。 现在,任何人都可以借助 AI 创建一个新的 WinUI 应用,让 AI 智能体添加功能、测试结果,将应用打包成 MSIX,然后提交到 Microsoft Store,整个过程免费...

  2. IT之家 AI70

    阿里千问开源 Qwen-Drive-1.0-4B:首个面向自动驾驶的视觉语言基础模型

    IT之家 9 月 6 日消息,阿里千问本周开源了 Qwen-Drive-1.0-4B,这是一款基于 Qwen3.5-4B 构建的自动驾驶视觉语言模型。 官方表示,Qwen-Drive-1.0 是 首个面向自动驾驶的视觉语言基础模型 ,在预训练阶段统一了 3D 感知与视觉问答,并进一步扩展至运动规划,同时完全保留了预训练 VLM 的原始架构。 模型采用分阶段训练方案,将驾驶监督与通用视觉语言数据结合,在获得驾驶特定能力的同时,保留通用视觉理解与指令遵循能力。Qwen-Drive-1.0-4B 同时提供 SFT 和 RL 两个规划专家,官方评测覆盖 3D 感知、驾驶场景理解、通用视觉语言能力,以及开环、伪闭环和闭环运动规划。 据介绍,Qwen-Drive-1.0 仅使用公开来源构建规划样本 ,统一了各数据集的轨迹格式,并从开环预测到闭环驾驶进行全面评估。SFT 模型在所有基准上已具备竞争力。经过强化学习后,该模型仅以微小的开环位移误...

    推荐理由:来自IT之家 AI的《阿里千问开源 Qwen-Drive-1.0-4B:首个面向自动驾驶的视觉语言基础模型》。重点看模型能力与工程、评测与基准、开源生态。摘要提到:IT之家 9 月 6 日消息,阿里千问本周开源了 Qwen-Drive-1.0-4B,这是一款基于 Qwen3.5-4B 构建的自动驾驶视觉语言模型。 官方表示,Qwen-Drive-1.0 是 首个面向自动驾驶的视觉语言基础模型 ,在预训练阶段统一了 3D 感知与视觉问答,并进一步扩展至运动规划,同时完全保留了预训练 VLM 的原始架构。 模型采用分阶段训练方案,将驾驶监督与通用视觉语言数据结合,在获得驾驶特定能力的同时,保留通用视觉理解与指令遵循能力。Qwen-Drive-1.0-4B 同时提供 SFT 和 RL 两个规划专家,官方评测覆盖 3D 感知、驾驶场景理解、通用视觉语言能力,以及开环、伪闭环和闭环运动规划。 据介绍,Qwen-Drive-1.0 仅使用公开来源构建规划样本 ,统一了各数据集的轨迹格式,并从开环预测到闭环驾驶进行全面评估。SFT 模型在所有基准上已具备竞争力。经过强化学习后,该模型仅以微小的开环位移误...

  3. IT之家 AI72

    开源安卓应用商店 F-Droid 考虑效仿 Debian AI 政策:允许使用 AI,最终责任由贡献者承担

    IT之家 9 月 6 日消息,Debian 社区大语言模型投票议案上周迎来表决。投票结果显示,大部分开发者支持负责任地使用生成式 AI,如今开源安卓应用商店项目 F-Droid 也考虑采用类似的 AI 政策。 参考IT之家先前报道,本次投票一共有 9 种选项,范围从完全禁止大语言模型辅助开发,到允许特定条件使用 AI。投票结果将影响 Debian 开发者工作方式,以及开发组未来如何应对新 AI 工具。该投票采用孔多塞投票制,第 5 个选项“负责任地使用生成式 AI”最终胜出。 Debian 新政策并不禁止软件开发、文档编写流程使用生成式 AI。但是所有 AI 辅助生成的代码和文档,必须满足质量、法律合规要求,最终责任由人类开发者承担。Debian 不强制贡献者标注其代码是否使用 AI。虽然官方鼓励披露,但并不要求必须注明。 如今 F-Droid 社区也在考虑采用类似 Debian 的 AI 政策。当前阶段的拟议政策直接拷贝了 D...

    推荐理由:来自IT之家 AI的《开源安卓应用商店 F-Droid 考虑效仿 Debian AI 政策:允许使用 AI,最终责任由贡献者承担》。重点看模型能力与工程、开源生态。摘要提到:IT之家 9 月 6 日消息,Debian 社区大语言模型投票议案上周迎来表决。投票结果显示,大部分开发者支持负责任地使用生成式 AI,如今开源安卓应用商店项目 F-Droid 也考虑采用类似的 AI 政策。 参考IT之家先前报道,本次投票一共有 9 种选项,范围从完全禁止大语言模型辅助开发,到允许特定条件使用 AI。投票结果将影响 Debian 开发者工作方式,以及开发组未来如何应对新 AI 工具。该投票采用孔多塞投票制,第 5 个选项“负责任地使用生成式 AI”最终胜出。 Debian 新政策并不禁止软件开发、文档编写流程使用生成式 AI。但是所有 AI 辅助生成的代码和文档,必须满足质量、法律合规要求,最终责任由人类开发者承担。Debian 不强制贡献者标注其代码是否使用 AI。虽然官方鼓励披露,但并不要求必须注明。 如今 F-Droid 社区也在考虑采用类似 Debian 的 AI 政策。当前阶段的拟议政策直接拷贝了 D...

9月5日周六
  1. GitHub Changelog92

    GitHub Copilot weekly releases — August 31

    原文摘录(自动中文摘要暂不可用):GitHub Copilot weekly releases — August 31 This week, GitHub Copilot expands model choice and content protections, while VS Code adds new ways to manage agent sessions and get pull requests merge-ready. GitHub Copilot, general Claude Fable… The post GitHub Copilot weekly releases — August 31 appeared first on The GitHub Blog .

    推荐理由:自动中文摘要尚未通过校验,请核对原文与完整来源。

  2. GitHub Changelog93

    GPT-6 Astra is generally available in GitHub Copilot

    原文摘录(自动中文摘要暂不可用):GPT-6 Astra is generally available in GitHub Copilot GPT-6 Astra from OpenAI is now available in GitHub Copilot. OpenAI’s latest general-purpose model, GPT-6 Astra, is designed for long-horizon, autonomous coding and agentic tasks. In our internal testing, GPT-6… The post GPT-6 Astra is generally available in GitHub Copilot appeared first on The

    推荐理由:自动中文摘要尚未通过校验,请核对原文与完整来源。

9月4日周五
  1. IT之家 AI72

    微信开源通用多模态嵌入模型 WeMM-Embedding,已大规模部署在微信推荐与搜索系统中

    IT之家 9 月 4 日消息,微信 AI 官方今日宣布,将 微信线上每天调用十亿量级 的通用多模态嵌入模型 WeMM-Embedding 开源, 包含 2B、4B、9B 三个版本 ,支持文本、图像、视频、视觉文档以及任意交错的多模态输入。 官方表示,WeMM-Embedding 选择基于 Qwen3.5 多模态架构作为统一骨干,让图像、视频和文字从一开始就在同一个模型中共同处理。 在权威多模态嵌入榜单 MMEB-v2 上,WeMM-Embedding-9B 以 80.6 分位列第一。2B 版本取得 77.9 分,超过此前领先的 8B 开源模型。 WeMM-Embedding 已大规模部署在微信的推荐与搜索系统中 ,包括视频号、直播、公众号、电商与朋友圈, 每日调用量已达 10 亿量级 。模型生成的多模态表示被用于候选检索、排序特征构建、用户序列建模和跨域内容理解等环节。 在 26 项内部任务基准上,WeMM-Embedding-...

    推荐理由:来自IT之家 AI的《微信开源通用多模态嵌入模型 WeMM-Embedding,已大规模部署在微信推荐与搜索系统中》。重点看模型能力与工程、评测与基准、开源生态。摘要提到:IT之家 9 月 4 日消息,微信 AI 官方今日宣布,将 微信线上每天调用十亿量级 的通用多模态嵌入模型 WeMM-Embedding 开源, 包含 2B、4B、9B 三个版本 ,支持文本、图像、视频、视觉文档以及任意交错的多模态输入。 官方表示,WeMM-Embedding 选择基于 Qwen3.5 多模态架构作为统一骨干,让图像、视频和文字从一开始就在同一个模型中共同处理。 在权威多模态嵌入榜单 MMEB-v2 上,WeMM-Embedding-9B 以 80.6 分位列第一。2B 版本取得 77.9 分,超过此前领先的 8B 开源模型。 WeMM-Embedding 已大规模部署在微信的推荐与搜索系统中 ,包括视频号、直播、公众号、电商与朋友圈, 每日调用量已达 10 亿量级 。模型生成的多模态表示被用于候选检索、排序特征构建、用户序列建模和跨域内容理解等环节。 在 26 项内部任务基准上,WeMM-Embedding-...