跳到正文
9月23日周三
  1. IT之家 AI72

    OpenAI 发布 GPT-6 Sol 和 Luna 模型,API 价格大降 50%

    IT之家 9 月 23 日消息,OpenAI 今日发布 GPT-6 系列模型的最新成员 GPT-6 Sol 和 GPT-6 Luna 。 OpenAI 官方表示,两款模型采用与 GPT-6 Astra 类似的方法进行训练,将 Astra 在专业工作、事实性、编码、计算机使用和对齐等方面 最先进的性能带入更快、更经济的模型 。 GPT-6 Sol 和 Luna 模型的 API 价格相比 GPT-5.6 促销价降低 50% 。不过 OpenAI 官方也表示,GPT-6 Astra 依然是其整体上最优秀的模型,如果你想要最佳效果和无妥协的体验,还是建议选择 GPT-6 Astra。 性能方面,在 AutomationBench 的跨应用业务流程测试中,GPT-6 Sol 在 xhigh 强度下表现优于 Claude Opus 5, 成本仅为 Opus 5 每任务成本的 9% 。在 high 强度下,GPT-6 Luna 比前代提升了 ...

    推荐理由:来自IT之家 AI的《OpenAI 发布 GPT-6 Sol 和 Luna 模型,API 价格大降 50%》。重点看智能体工作流、模型能力与工程、产品发布。摘要提到:IT之家 9 月 23 日消息,OpenAI 今日发布 GPT-6 系列模型的最新成员 GPT-6 Sol 和 GPT-6 Luna 。 OpenAI 官方表示,两款模型采用与 GPT-6 Astra 类似的方法进行训练,将 Astra 在专业工作、事实性、编码、计算机使用和对齐等方面 最先进的性能带入更快、更经济的模型 。 GPT-6 Sol 和 Luna 模型的 API 价格相比 GPT-5.6 促销价降低 50% 。不过 OpenAI 官方也表示,GPT-6 Astra 依然是其整体上最优秀的模型,如果你想要最佳效果和无妥协的体验,还是建议选择 GPT-6 Astra。 性能方面,在 AutomationBench 的跨应用业务流程测试中,GPT-6 Sol 在 xhigh 强度下表现优于 Claude Opus 5, 成本仅为 Opus 5 每任务成本的 9% 。在 high 强度下,GPT-6 Luna 比前代提升了 ...

  2. IT之家 AI70

    Anthropic 发布 Claude Opus 5.5 模型:性能媲美 Fable 5.1,运行成本比 Opus 5 低 40%

    IT之家 9 月 23 日消息,Anthropic 今日正式发布了 Claude Opus 5.5 模型,这是其全新 Claude 5.5 家族的首个模型, 宣称在大多数工作上表现可媲美 Claude Fable 5.1,运行成本比 Opus 5 低 40% 。 IT之家从 Anthropic 公告获悉,具体来看,Claude Opus 5.5 模型有以下提升: 性能方面,Opus 5.5 比 Opus 5 有了很大提升,官方宣传早期测试者在最复杂的工作中看到性能大幅提升。一名测试人员在不到一天内完成了 68 万行代码迁移 —— 这一任务本应耗时数周。 Opus 5.5 擅长发现并修复软件中的低效程序 —— 当官方要求它将网页应用的每个页面缩短加载时间时,Opus 5.5 在 40 次尝试中成功了 39 次,而 Opus 5 仅仅做了一些小改进,也改变了应用的行为。另一位测试者让多个 Claude 模型根据单一提示构建游戏,Op...

    推荐理由:来自IT之家 AI的《Anthropic 发布 Claude Opus 5.5 模型:性能媲美 Fable 5.1,运行成本比 Opus 5 低 40%》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 23 日消息,Anthropic 今日正式发布了 Claude Opus 5.5 模型,这是其全新 Claude 5.5 家族的首个模型, 宣称在大多数工作上表现可媲美 Claude Fable 5.1,运行成本比 Opus 5 低 40% 。 IT之家从 Anthropic 公告获悉,具体来看,Claude Opus 5.5 模型有以下提升: 性能方面,Opus 5.5 比 Opus 5 有了很大提升,官方宣传早期测试者在最复杂的工作中看到性能大幅提升。一名测试人员在不到一天内完成了 68 万行代码迁移 —— 这一任务本应耗时数周。 Opus 5.5 擅长发现并修复软件中的低效程序 —— 当官方要求它将网页应用的每个页面缩短加载时间时,Opus 5.5 在 40 次尝试中成功了 39 次,而 Opus 5 仅仅做了一些小改进,也改变了应用的行为。另一位测试者让多个 Claude 模型根据单一提示构建游戏,Op...

  3. Simon Willison91

    llm 0.36

    事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:llm 0.36 这条英文动态主要涉及模型能力与工程、文化创意。原文要点:Release: llm 0.36 New OpenAI models: gpt-6-sol for GPT-6 Sol and gpt-6-luna for GPT-6 Luna . #1702 Model p。影响判断:它可能改变智能体工作流、模型能力与工程、文化创意相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、文化创意方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程、文化创意直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  4. OpenAI News81

    Introducing GPT-6 Sol and Luna

    这条英文动态主要涉及模型能力与工程。原文要点:Meet GPT-6 Sol and Luna, two models that bring frontier intelligence to everyday work with different balances of capability and cost.

    推荐理由:来自OpenAI News的《Introducing GPT-6 Sol and Luna》。重点看模型能力与工程。摘要提到:这条英文动态主要涉及模型能力与工程。原文要点:Meet GPT-6 Sol and Luna, two models that bring frontier intelligence to everyday work with different balances of capability and cost.

  5. Simon Willison83

    llm-anthropic 0.29

    这条英文动态主要涉及模型能力与工程。原文要点:Release: llm-anthropic 0.29 Adds support for Claude Opus 5.5 : llm -m claude-opus-5.5 "prompt goes here" Tags: llm , anthropic

    推荐理由:来自Simon Willison的《llm-anthropic 0.29》。重点看模型能力与工程。摘要提到:这条英文动态主要涉及模型能力与工程。原文要点:Release: llm-anthropic 0.29 Adds support for Claude Opus 5.5 : llm -m claude-opus-5.5 "prompt goes here" Tags: llm , anthropic

  6. GitHub Changelog96

    Claude Opus 5.5 is now available in GitHub Copilot

    事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:Claude Opus 5.5 is now available in GitHub Copilot 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:Claude Opus 5.5 is now available in GitHub Copilot。影响判断:它可能改变智能体工作流、模型能力与工程、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程、开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  7. GitHub Changelog89

    OpenAI’s GPT-6 Sol and GPT-6 Luna now available

    事实摘要:这条英文动态主要涉及模型能力与工程、开源生态,原文信息显示:OpenAI’s GPT-6 Sol and GPT-6 Luna now available 事实摘要:这条英文动态主要涉及模型能力与工程、开源生态,原文信息显示:OpenAI’s GPT-6 Sol and GPT-6 Luna now available 事实摘要:这条。影响判断:它可能改变模型能力与工程、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程、开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和模型能力与工程、开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  8. Claude Code Releases84

    Claude Code Releases v2.1.280:Added Claude Opus 5.5 ( claude-opus-5-5 ), now the default...

    这条英文动态主要涉及模型能力与工程。原文要点:What's changed Added Claude Opus 5.5 ( claude-opus-5-5 ), now the default Opus model — 1M context, $4/$20 per Mtok with $0.20/Mtok cache reads Added mouse support to more lists in fullscreen mode: the wheel scrolls the /skills list, and a skill's state options in /plugin can be clicked Added CLAUDE_CODE_MAX_MCP_DESCRIPTION_LENGTH to change the 2,048-character cap on MCP tool descriptions and server instructions for e...

    推荐理由:来自Claude Code Releases的《Claude Code Releases v2.1.280:Added Claude Opus 5.5 ( claude-opus-5-5 ), now the default...》。重点看模型能力与工程。摘要提到:这条英文动态主要涉及模型能力与工程。原文要点:What's changed Added Claude Opus 5.5 ( claude-opus-5-5 ), now the default Opus model — 1M context, $4/$20 per Mtok with $0.20/Mtok cache reads Added mouse support to more lists in fullscreen mode: the wheel scrolls the /skills list, and a skill's state options in /plugin can be clicked Added CLAUDE_CODE_MAX_MCP_DESCRIPTION_LENGTH to change the 2,048-character cap on MCP tool descriptions and se...

9月22日周二
  1. 量子位36

    陆川手搓历史现场,王珞丹熬夜抽卡,阿里全模态开始兜底生产

    事实摘要:陆川手搓历史现场,王珞丹熬夜抽卡,阿里全模态开始兜底生产 阿里:三年之内会出现一个原生的全模态统一生成模型,未来体验将不再受限于模态边界。 这条动态来自 量子位,可重点关注模型能力与工程。 陆川手搓历史现场,王珞丹熬夜抽卡,阿里全模态开始兜底生产 阿里:三年之内会出现一个原生的全模态统一生成模型,未来体验将不再受限于模态边界。影响判断:它可能改变模型能力与工程相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和模型能力与工程直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  2. Simon Willison83

    llm-typesafe 0.1a0

    这条英文动态主要涉及模型能力与工程、产品发布。原文要点:Release: llm-typesafe 0.1a0 I built this new plugin for LLM to add support for TypeSafe AI's new Jev model . Install it like this: llm install llm-typesafe Then set an API key ( get one here , the waitlist seems to move pretty fast): llm keys set typesafe # Paste key And now you can ask yes/no "noul" questions like this: llm -m jev 'Please refund my last payment.' \ -s 'Does this message explicitly request a refund?'...

    推荐理由:来自Simon Willison的《llm-typesafe 0.1a0》。重点看模型能力与工程、产品发布。摘要提到:这条英文动态主要涉及模型能力与工程、产品发布。原文要点:Release: llm-typesafe 0.1a0 I built this new plugin for LLM to add support for TypeSafe AI's new Jev model . Install it like this: llm install llm-typesafe Then set an API key ( get one here , the waitlist seems to move pretty fast): llm keys set typesafe # Paste key And now you can ask yes/no "noul" questions like this: llm -m jev 'Please refund my last payment.' \ -s 'Does this message e...

  3. IT之家 AI70

    拿下 2 亿日活跃用户后,消息称字节跳动豆包收缩对话团队

    IT之家 9 月 22 日消息,《晚点 LatePost》今天(22 日)晚间发布消息称,豆包通用 Session 团队正在减员,规模预计减半。该团队此前约有 50 人, 一度是豆包内规模最大的团队 ,主要负责豆包的对话(Chat)产品能力,包括策略、评测等工作。此次调整后,部分人员将转岗至豆包商业化、飞书等团队,其余人员将被裁撤。 消息称豆包负责人赵祺推动了此次人员调整。他在字节已有十余年履历,此前负责增长中台、穿山甲(字节旗下广告平台),之后转岗至集团人力资源部门,为字节 AI 业务搭建人才体系。2025 年 9 月,赵祺转岗至豆包,后于今年 7 月飞书、豆包产品团队整合后成为新产品团队负责人。 赵祺在转岗到豆包后依旧看中人效,拆散了豆包此前的独立评测团队,并将其分到各业务组。 IT之家从报道中获悉,负责对话方向的产品后训练团队(Product Posttrain-Chat)也在缩减。该团队由朱文佳负责,隶属于大模型部门 S...

    推荐理由:来自IT之家 AI的《拿下 2 亿日活跃用户后,消息称字节跳动豆包收缩对话团队》。重点看模型能力与工程、评测与基准、产品发布。摘要提到:IT之家 9 月 22 日消息,《晚点 LatePost》今天(22 日)晚间发布消息称,豆包通用 Session 团队正在减员,规模预计减半。该团队此前约有 50 人, 一度是豆包内规模最大的团队 ,主要负责豆包的对话(Chat)产品能力,包括策略、评测等工作。此次调整后,部分人员将转岗至豆包商业化、飞书等团队,其余人员将被裁撤。 消息称豆包负责人赵祺推动了此次人员调整。他在字节已有十余年履历,此前负责增长中台、穿山甲(字节旗下广告平台),之后转岗至集团人力资源部门,为字节 AI 业务搭建人才体系。2025 年 9 月,赵祺转岗至豆包,后于今年 7 月飞书、豆包产品团队整合后成为新产品团队负责人。 赵祺在转岗到豆包后依旧看中人效,拆散了豆包此前的独立评测团队,并将其分到各业务组。 IT之家从报道中获悉,负责对话方向的产品后训练团队(Product Posttrain-Chat)也在缩减。该团队由朱文佳负责,隶属于大模型部门 S...

  4. OpenAI News82

    Parallel cut research time and cost in half with GPT‑6 Astra

    这条英文动态主要涉及智能体工作流、模型能力与工程。原文要点:GPT‑6 Astra allowed Parallel’s agents to research and synthesize labor-market data in half the time and at half the cost vs. prior models.

    推荐理由:来自OpenAI News的《Parallel cut research time and cost in half with GPT‑6 Astra》。重点看智能体工作流、模型能力与工程。摘要提到:这条英文动态主要涉及智能体工作流、模型能力与工程。原文要点:GPT‑6 Astra allowed Parallel’s agents to research and synthesize labor-market data in half the time and at half the cost vs. prior models.

  5. MIT Technology Review AI89

    Don’t be fooled by this summer of AI hype

    事实摘要:这条英文动态主要涉及模型能力与工程,原文信息显示:Don’t be fooled by this summer of AI hype 这条英文动态主要涉及模型能力与工程。原文要点:It’s been a busy few months for AI hype. At the end of April, Anthropic claimed that its m。影响判断:它可能改变模型能力与工程相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和模型能力与工程直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  6. IT之家 AI38

    Seedance 2.5 上线 Draft 模式:先用 480P 验证创意,满意再用 1080P 生成终版

    IT之家 9 月 22 日消息,据火山引擎消息,今天,Seedance 2.5 API 正式推出 Draft(样片)模式:企业和创作者可以先用 480P 快速生成样片,低成本验证创意;选中满意的镜头后,再用 1080P 生成终版。官方称,成片与样片高度一致,拥有 1080P 的原生质感,同时最大程度节省成本。 以 Seedance 2.5 1080P 生成 5 秒的镜头为例,不含输入视频的情况下,假设抽卡 4 次得到满意片段,Draft 模式可节约成本 57%,生成速度提升近一倍。在企业和工作室的完整创作管线中,镜头越难、抽卡越多,Draft 模式则省得越多。 即刻起,企业用户通过 Seedance 2.5 API 创建视频生成任务时,可将参数 draft 设置为 true,开启 Draft 模式。C 端创作者可以在即梦中将模型选择设为“Seedance 2.5(样片模式)”后直接体验。 IT之家附官方详细介绍如下: 样片和成片...

    推荐理由:来自IT之家 AI的《Seedance 2.5 上线 Draft 模式:先用 480P 验证创意,满意再用 1080P 生成终版》。重点看模型能力与工程、文化创意、产品发布。摘要提到:IT之家 9 月 22 日消息,据火山引擎消息,今天,Seedance 2.5 API 正式推出 Draft(样片)模式:企业和创作者可以先用 480P 快速生成样片,低成本验证创意;选中满意的镜头后,再用 1080P 生成终版。官方称,成片与样片高度一致,拥有 1080P 的原生质感,同时最大程度节省成本。 以 Seedance 2.5 1080P 生成 5 秒的镜头为例,不含输入视频的情况下,假设抽卡 4 次得到满意片段,Draft 模式可节约成本 57%,生成速度提升近一倍。在企业和工作室的完整创作管线中,镜头越难、抽卡越多,Draft 模式则省得越多。 即刻起,企业用户通过 Seedance 2.5 API 创建视频生成任务时,可将参数 draft 设置为 true,开启 Draft 模式。C 端创作者可以在即梦中将模型选择设为“Seedance 2.5(样片模式)”后直接体验。 IT之家附官方详细介绍如下: 样片和成片...

  7. 量子位70

    基元律动韩凯:从多模型调度到反馈闭环,探索Agent持续进化

    事实摘要:基元律动韩凯:从多模型调度到反馈闭环,探索Agent持续进化 9月22日,在2026杭州云栖大会企业级Agent实践峰会上,基元律动联合创始人兼CTO韩凯发表演讲《从Harness到RSI飞轮》。 这条动态来自 量子位,可重点关注智能体工作流、模型能力与工程。 基元律动韩凯:从多模型调度到反馈闭环,探索Agent持续进化 9月22日,在2026杭州云栖大会企。影响判断:它可能改变智能体工作流、模型能力与工程相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  8. IT之家 AI70

    AI 助力古籍修复:Apollo 大语言模型问世,专门用于解读古希腊莎草纸残片

    IT之家 9 月 22 日消息,据 《连线》(WIRED)报道,全球各地高校图书馆保存着数十万份古希腊莎草纸残片,不少残片损毁严重,其内容或许已无法解读;对于其余尚存修复希望的文本,学者只能依靠人工逐条补全缺失的词句完成复原。为加快这项繁重的工作,研究人员开始借助人工智能。 奥地利科学院将于当地时间周三正式发布了全球首款面向古希腊语的高级大语言模型。该项目由奥地利科学院联合法国 AI 实验室 Mistral 以及科技服务商 Sail Reply 共同开发,命名为 Apollo。这套模型的训练素材取自手稿、莎草纸与石刻铭文,总计大约 6 亿个古希腊历史词汇。 据IT之家了解,科研人员可以通过聊天机器人界面免费使用该模型。研发团队希望借助 Apollo 帮助学者更快筛选出和自身细分研究方向相关的莎草纸残片,发掘出新的研究切入点。针对破损残缺的文献,Apollo 会基于统计概率给出可能性最高的词句来填补文本空白,有望挖掘出此前被掩盖的...

    推荐理由:来自IT之家 AI的《AI 助力古籍修复:Apollo 大语言模型问世,专门用于解读古希腊莎草纸残片》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 22 日消息,据 《连线》(WIRED)报道,全球各地高校图书馆保存着数十万份古希腊莎草纸残片,不少残片损毁严重,其内容或许已无法解读;对于其余尚存修复希望的文本,学者只能依靠人工逐条补全缺失的词句完成复原。为加快这项繁重的工作,研究人员开始借助人工智能。 奥地利科学院将于当地时间周三正式发布了全球首款面向古希腊语的高级大语言模型。该项目由奥地利科学院联合法国 AI 实验室 Mistral 以及科技服务商 Sail Reply 共同开发,命名为 Apollo。这套模型的训练素材取自手稿、莎草纸与石刻铭文,总计大约 6 亿个古希腊历史词汇。 据IT之家了解,科研人员可以通过聊天机器人界面免费使用该模型。研发团队希望借助 Apollo 帮助学者更快筛选出和自身细分研究方向相关的莎草纸残片,发掘出新的研究切入点。针对破损残缺的文献,Apollo 会基于统计概率给出可能性最高的词句来填补文本空白,有望挖掘出此前被掩盖的...

  9. GitHub Changelog57

    Deprecation notice: All-platform CodeQL bundle

    事实摘要:这条英文动态主要涉及文化创意、开源生态,原文信息显示:Deprecation notice: All-platform CodeQL bundle 事实摘要:这条英文动态主要涉及文化创意、开源生态,原文信息显示:Deprecation notice: All-platform CodeQL bundle 事实摘要:这条英文动态主要涉及文化创意、开源生态,原文。影响判断:它可能改变文化创意、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪文化创意、开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和文化创意、开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  10. IT之家 AI76

    OpenAI、Anthropic 喊话澳大利亚政府,希望放宽创意内容版权限制

    IT之家 9 月 22 日消息,据路透社今天(22 日)下午报道,OpenAI 和 Anthropic 呼吁澳大利亚重新考虑禁止两家公司 使用当地创意内容训练 AI 模型 的做法,认为设置有限度的豁免,既能保护艺术家权益,也有助于吸引更多投资。 随着 AI 迅速发展,各国都在加紧制定监管方案,同时争夺 AI 投资。经济学家预计,到本世纪 20 年代末,此类投资的规模可能达到数千亿美元。 澳大利亚计划从明年起实施一整套针对 AI 和数据中心的监管规则,并且排除了在版权法中设置豁免条款的可能性。按照现行规定,这些大多注册于美国的 AI 企业实际上 无法在澳大利亚使用当地受版权保护的内容开展模型训练 。 今年 9 月,OpenAI 和 Anthropic 向议会 AI 法律调查提交的材料中承认了有关禁令的存在,但仍要求放宽现有限制。 Anthropic 在提交材料中称:“我们接受这样一个事实,即广泛的版权豁免并未获得普遍支持,而且政府...

    推荐理由:来自IT之家 AI的《OpenAI、Anthropic 喊话澳大利亚政府,希望放宽创意内容版权限制》。重点看模型能力与工程、文化创意。摘要提到:IT之家 9 月 22 日消息,据路透社今天(22 日)下午报道,OpenAI 和 Anthropic 呼吁澳大利亚重新考虑禁止两家公司 使用当地创意内容训练 AI 模型 的做法,认为设置有限度的豁免,既能保护艺术家权益,也有助于吸引更多投资。 随着 AI 迅速发展,各国都在加紧制定监管方案,同时争夺 AI 投资。经济学家预计,到本世纪 20 年代末,此类投资的规模可能达到数千亿美元。 澳大利亚计划从明年起实施一整套针对 AI 和数据中心的监管规则,并且排除了在版权法中设置豁免条款的可能性。按照现行规定,这些大多注册于美国的 AI 企业实际上 无法在澳大利亚使用当地受版权保护的内容开展模型训练 。 今年 9 月,OpenAI 和 Anthropic 向议会 AI 法律调查提交的材料中承认了有关禁令的存在,但仍要求放宽现有限制。 Anthropic 在提交材料中称:“我们接受这样一个事实,即广泛的版权豁免并未获得普遍支持,而且政府...

  11. IT之家 AI68

    日本计划在国际空间站举办 AI 机器人竞赛,最早 2027 年实行

    IT之家 9 月 22 日消息,据《日经》今天报道,日本计划案最早于 2027 年在国际空间站(ISS)举办机器人竞赛。参赛团队将通过 AI 控制机器人完成任务, 培养下一代航天工程师 。 据报道,该竞赛由“太空 AI 机器人协会(SAIRA)”组织。该协会成立于今年 7 月,旨在通过与大学、公司和研究机构合作,开发太空、AI、机器人等方面技术。 该竞赛最开始将在模拟空间站环境的地面进行预赛,对 AI 模型进行测试。胜出队伍将进入空间站, 通过自行开发的物理 AI 模型 , 控制日本“希望号”实验舱内的球形机器人无人机 Int-Ball2 。 市场研究聚合机构 Global Information 数据显示,预计到 2035 年,太空机器人市场规模将达到 124 亿美元 (IT之家注:现汇率约合 832.07 亿元人民币) ,约为 2026 年市场规模的两倍。

    推荐理由:来自IT之家 AI的《日本计划在国际空间站举办 AI 机器人竞赛,最早 2027 年实行》。重点看模型能力与工程。摘要提到:IT之家 9 月 22 日消息,据《日经》今天报道,日本计划案最早于 2027 年在国际空间站(ISS)举办机器人竞赛。参赛团队将通过 AI 控制机器人完成任务, 培养下一代航天工程师 。 据报道,该竞赛由“太空 AI 机器人协会(SAIRA)”组织。该协会成立于今年 7 月,旨在通过与大学、公司和研究机构合作,开发太空、AI、机器人等方面技术。 该竞赛最开始将在模拟空间站环境的地面进行预赛,对 AI 模型进行测试。胜出队伍将进入空间站, 通过自行开发的物理 AI 模型 , 控制日本“希望号”实验舱内的球形机器人无人机 Int-Ball2 。 市场研究聚合机构 Global Information 数据显示,预计到 2035 年,太空机器人市场规模将达到 124 亿美元 (IT之家注:现汇率约合 832.07 亿元人民币) ,约为 2026 年市场规模的两倍。

  12. IT之家 AI70

    OpenAI 呼吁美国牵头联合其他国家为前沿 AI 制定全球性标准

    IT之家 9 月 22 日消息,各界对先进 AI 潜在危害的担忧持续升温之际,OpenAI 呼吁 美国牵头联合其他国家 ,为前沿 AI 制定共同标准。 当地时间 21 日,OpenAI 通过官方博客发文指出,要确保 AI 安全发展, 需要建立国际技术标准 ,重点明确哪些 AI 模型事故必须上报、各国如何协同推进 AI 发展,以及如何改善开发此类技术所需算力的获取条件。“要让 AI 持续进步的同时保持安全并造福社会,既需要推进对齐研究,也需要建立共同标准,为不同实验室和国家的开发工作提供指引。” OpenAI 在博客中强调,各国应合作制定能够 相互衔接的国内和国际标准 ,用于约束最先进 AI 模型的开发。现有 AI 安全机构可以成为推进这项工作的渠道,其中包括美国商务部下属的人工智能标准与创新中心(CAISI),该机构负责协助测试 AI 模型并制定指导规范。 OpenAI 还呼吁针对 AI 日益增强的自主工作能力建立标准,在能够确...

    推荐理由:来自IT之家 AI的《OpenAI 呼吁美国牵头联合其他国家为前沿 AI 制定全球性标准》。重点看模型能力与工程。摘要提到:IT之家 9 月 22 日消息,各界对先进 AI 潜在危害的担忧持续升温之际,OpenAI 呼吁 美国牵头联合其他国家 ,为前沿 AI 制定共同标准。 当地时间 21 日,OpenAI 通过官方博客发文指出,要确保 AI 安全发展, 需要建立国际技术标准 ,重点明确哪些 AI 模型事故必须上报、各国如何协同推进 AI 发展,以及如何改善开发此类技术所需算力的获取条件。“要让 AI 持续进步的同时保持安全并造福社会,既需要推进对齐研究,也需要建立共同标准,为不同实验室和国家的开发工作提供指引。” OpenAI 在博客中强调,各国应合作制定能够 相互衔接的国内和国际标准 ,用于约束最先进 AI 模型的开发。现有 AI 安全机构可以成为推进这项工作的渠道,其中包括美国商务部下属的人工智能标准与创新中心(CAISI),该机构负责协助测试 AI 模型并制定指导规范。 OpenAI 还呼吁针对 AI 日益增强的自主工作能力建立标准,在能够确...

  13. IT之家 AI38

    阿里千问办公发布企业上下文、数字员工及 Agent 硬件 QwenNote A2

    IT之家 9 月 22 日消息,在今天举行的 2026 云栖大会千问办公专场上,阿里千问办公(QwenWork)围绕企业级 Agent 发布了一系列产品与能力升级,主题指向“让企业级 Agent 懂业务、能协同、信得过”。 企业上下文:让企业私有知识与千问办公无缝打通 IT之家注意到,千问办公此次发布了面向企业的全新产品“企业上下文”(Enterprise Context)。其逻辑是:Agent 进入企业业务流程,最重要的前提是理解企业数据,但员工开始一项具体任务时,需要的往往不是全部信息,而是与当前任务最相关的那部分。企业上下文会对分散在文档、沟通和业务系统中的企业信息进行压缩与结构化,并随业务变化及时更新,让 Agent 每次都能基于企业最新真实情况作判断。官方还强调,该产品内置专属模型,可用极低的 Token 成本完成数据压缩和处理。 数字员工:有身份、有边界、可追溯 面向不同场景,企业可基于千问办公和钉钉打造“数字员工”...

    推荐理由:来自IT之家 AI的《阿里千问办公发布企业上下文、数字员工及 Agent 硬件 QwenNote A2》。重点看智能体工作流、模型能力与工程、产品发布。摘要提到:IT之家 9 月 22 日消息,在今天举行的 2026 云栖大会千问办公专场上,阿里千问办公(QwenWork)围绕企业级 Agent 发布了一系列产品与能力升级,主题指向“让企业级 Agent 懂业务、能协同、信得过”。 企业上下文:让企业私有知识与千问办公无缝打通 IT之家注意到,千问办公此次发布了面向企业的全新产品“企业上下文”(Enterprise Context)。其逻辑是:Agent 进入企业业务流程,最重要的前提是理解企业数据,但员工开始一项具体任务时,需要的往往不是全部信息,而是与当前任务最相关的那部分。企业上下文会对分散在文档、沟通和业务系统中的企业信息进行压缩与结构化,并随业务变化及时更新,让 Agent 每次都能基于企业最新真实情况作判断。官方还强调,该产品内置专属模型,可用极低的 Token 成本完成数据压缩和处理。 数字员工:有身份、有边界、可追溯 面向不同场景,企业可基于千问办公和钉钉打造“数字员工”...

  14. 量子位36

    阿里研究员透露Qwen4.5后模型将扩展至5-10T参数

    事实摘要:阿里研究员透露Qwen4.5后模型将扩展至5-10T参数 未来Qwen4.5、Qwen5等版本将扩展至5-10T参数。 这条动态来自 量子位,可重点关注模型能力与工程。 阿里研究员透露Qwen4.5后模型将扩展至5-10T参数 未来Qwen4.5、Qwen5等版本将扩展至5-10T参数。影响判断:它可能改变模型能力与工程相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和模型能力与工程直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  15. 量子位68

    阿里公布全模态模型新进展,Qwen4和下代视频模型均在训练中

    事实摘要:阿里公布全模态模型新进展,Qwen4和下代视频模型均在训练中 9月22日, 2026云栖大会开幕,阿里巴巴公布大模型最新进展。 这条动态来自 量子位,可重点关注模型能力与工程。 阿里公布全模态模型新进展,Qwen4和下代视频模型均在训练中 9月22日, 2026云栖大会开幕,阿里巴巴公布大模型最新进展。影响判断:它可能改变模型能力与工程相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和模型能力与工程直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  16. IT之家 AI70

    阿里 Qwen4 和下代视频模型训练中,Qwen4.5 后模型将扩展至 5-10T 参数

    IT之家 9 月 22 日消息,IT之家今日在 2026 年云栖大会现场获悉,阿里巴巴公布了大模型一系列进展,大模型递归自我改进(RSI)已初步进入模型训练、推理及芯模协同等环节中, 基于新一代架构的 Qwen4 已在训练中,未来 Qwen4.5、Qwen5 等版本将扩展至 5-10T 参数 。 同时,阿里的视频生成模型、语音模型、图像模型、世界模型、音乐模型以及全模态模型等均在当天或近期推出新版本。 阿里全新的下一代视频生成模型将于 11 月发布 ,朝着更长、更可控、更完整、更智能的方向演进:在更长的时间里,新模型仍然能保持一致性,创作者可精准掌控人物、场景与镜头;同时,模型能具备导演级的创作思维,从生成单个镜头迈向理解完整叙事。 本届云栖大会,阿里系统展示了千问大模型自我进化的最新探索成果: 在模型自我训练上 ,Qwen3.8-Max 通过自主搭建训练流程、构造训练数据,并自主设计实验、定位缺陷,在人类完全“零参与”的情况下...

    推荐理由:来自IT之家 AI的《阿里 Qwen4 和下代视频模型训练中,Qwen4.5 后模型将扩展至 5-10T 参数》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 22 日消息,IT之家今日在 2026 年云栖大会现场获悉,阿里巴巴公布了大模型一系列进展,大模型递归自我改进(RSI)已初步进入模型训练、推理及芯模协同等环节中, 基于新一代架构的 Qwen4 已在训练中,未来 Qwen4.5、Qwen5 等版本将扩展至 5-10T 参数 。 同时,阿里的视频生成模型、语音模型、图像模型、世界模型、音乐模型以及全模态模型等均在当天或近期推出新版本。 阿里全新的下一代视频生成模型将于 11 月发布 ,朝着更长、更可控、更完整、更智能的方向演进:在更长的时间里,新模型仍然能保持一致性,创作者可精准掌控人物、场景与镜头;同时,模型能具备导演级的创作思维,从生成单个镜头迈向理解完整叙事。 本届云栖大会,阿里系统展示了千问大模型自我进化的最新探索成果: 在模型自我训练上 ,Qwen3.8-Max 通过自主搭建训练流程、构造训练数据,并自主设计实验、定位缺陷,在人类完全“零参与”的情况下...

  17. IT之家 AI70

    龙芯发布自研通用 GPU 加速计算平台首个软件版本:支持 OpenCL 3.0、CUDA 及 AI 推理

    IT之家 9 月 22 日消息,龙芯中科今日宣布推出支持自研通用 GPU 的龙芯加速计算平台(Loongson Accelerated Computing Platform)首个软件版本,面向龙芯通用 GPU 提供从底层驱动、编程环境到 AI 模型推理的完整软件支持。 该平台基于龙芯 2K3000 和 9A1000 芯片集成的 LG200 系列通用 GPU 核心开发。在已有 OpenGL、Vulkan 图形软件栈的基础上,平台进一步覆盖算力芯片驱动、编译器、运行时环境、算子库、推理引擎、调试工具和性能分析工具等组件。 龙芯加速计算平台支持 OpenCL 3.0 和 CUDA 两类编程模型接口,并集成 BLAS、DNN 等高性能算子库,可用于 AI 模型推理。平台面向龙芯全系列算力芯片,支持从系统选型、算力调用、模型优化到应用部署的开发流程。 在运行时环境方面,平台提供资源调度管理、内存管理、任务队列调度和事件同步等功能。底层驱动...

    推荐理由:来自IT之家 AI的《龙芯发布自研通用 GPU 加速计算平台首个软件版本:支持 OpenCL 3.0、CUDA 及 AI 推理》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 22 日消息,龙芯中科今日宣布推出支持自研通用 GPU 的龙芯加速计算平台(Loongson Accelerated Computing Platform)首个软件版本,面向龙芯通用 GPU 提供从底层驱动、编程环境到 AI 模型推理的完整软件支持。 该平台基于龙芯 2K3000 和 9A1000 芯片集成的 LG200 系列通用 GPU 核心开发。在已有 OpenGL、Vulkan 图形软件栈的基础上,平台进一步覆盖算力芯片驱动、编译器、运行时环境、算子库、推理引擎、调试工具和性能分析工具等组件。 龙芯加速计算平台支持 OpenCL 3.0 和 CUDA 两类编程模型接口,并集成 BLAS、DNN 等高性能算子库,可用于 AI 模型推理。平台面向龙芯全系列算力芯片,支持从系统选型、算力调用、模型优化到应用部署的开发流程。 在运行时环境方面,平台提供资源调度管理、内存管理、任务队列调度和事件同步等功能。底层驱动...

  18. 量子位68

    阿里巴巴:机器智能时代,坚定投入AI模型 AI芯片 AI云三大基石

    事实摘要:吴泳铭表示,阿里巴巴将坚定投入AI模型、AI芯片和AI云这三项基础设施建设。影响判断:这是阿里的长期战略选择。场景价值:适用于所有关注阿里科技的开发者。

    推荐理由:吴泳铭强调了阿里在机器智能时代对AI模型、AI芯片和AI云等基础设施建设的决心,这表明阿里巴巴致力于构建强大的技术基础,以支持其不断发展的业务。

  19. IT之家 AI66

    腾讯混元 Hy Image3.5 preview 发布:支持文生图与多轮对话创作,已上线元宝、ima 等应用

    IT之家 9 月 22 日消息,腾讯混元团队今日宣布推出 Hy Image3.5 preview 模型。腾讯称该模型面向专业级生图创作,支持文生图、图生图和多轮对话创作。 腾讯称,该模型经过内部数百名专业设计师 GSB 盲测,对比 Hy Image3.0 提升 30%,与 Seedream 5.0 pro 持平,略优于 Nano-Banana Pro 和 Qwen-Image-3.0 Pro。 IT之家注:GSB 盲测是一种成对比较评测方法,评测者在不知道模型来源的情况下判断生成效果优劣。 腾讯表示,Hy Image3.5 preview 已在元宝 App 提前 2 个月逐步灰度上线和内测,生图整体请求量提升超过 50%。 定价方面,腾讯云 API 2K 图像定价为 0.15 元 / 张图,腾讯云国际版为 0.024 美元 / 张图,仅对输出图片收费。企业和开发者可通过腾讯云 TokenHub 调用 API。 目前,该模型已上线...

    推荐理由:来自IT之家 AI的《腾讯混元 Hy Image3.5 preview 发布:支持文生图与多轮对话创作,已上线元宝、ima 等应用》。重点看模型能力与工程、评测与基准、产品发布。摘要提到:IT之家 9 月 22 日消息,腾讯混元团队今日宣布推出 Hy Image3.5 preview 模型。腾讯称该模型面向专业级生图创作,支持文生图、图生图和多轮对话创作。 腾讯称,该模型经过内部数百名专业设计师 GSB 盲测,对比 Hy Image3.0 提升 30%,与 Seedream 5.0 pro 持平,略优于 Nano-Banana Pro 和 Qwen-Image-3.0 Pro。 IT之家注:GSB 盲测是一种成对比较评测方法,评测者在不知道模型来源的情况下判断生成效果优劣。 腾讯表示,Hy Image3.5 preview 已在元宝 App 提前 2 个月逐步灰度上线和内测,生图整体请求量提升超过 50%。 定价方面,腾讯云 API 2K 图像定价为 0.15 元 / 张图,腾讯云国际版为 0.024 美元 / 张图,仅对输出图片收费。企业和开发者可通过腾讯云 TokenHub 调用 API。 目前,该模型已上线...

  20. IT之家 AI72

    阿里吴泳铭:全力投入 AI 基础设施建设,目标到 2032 年阿里云全球数据中心规模超 20GW

    IT之家 9 月 22 日消息,IT之家今日在 2026 年云栖大会现场获悉,阿里巴巴 CEO 吴泳铭表示,当前客户 AI 需求非常强劲,将全力投入 AI 基础设施建设, 目标到 2032 年阿里云运营的全球数据中心规模超过 20GW 。 2026 云栖大会今日(9 月 22 日)上午在浙江杭州开幕, 英伟达位列本次大会巅峰合作伙伴,是本届云栖大会最高等级合作伙伴 。英特尔、AMD 分获钻石、红宝石合作伙伴。 阿里巴巴集团 CEO 吴泳铭、阿里千问 LLM 项目负责人刘大一恒等将在大会上发表主题演讲。今年云栖大会,云计算、AI、智能制造等众多国内外头部企业,多家算力、大模型产业链厂商集中亮相,算力生态合作成为本次云栖大会一大看点。 吴泳铭认为,今天机器动力已经承担了 99.9% 的物理工作,未来人类的思考总量还会继续增长,但机器思考将以更快的速度扩张,预期将会承担 99.9% 的思考工作。 顶级思考将从奢侈品变成可规模化供给的商...

    推荐理由:来自IT之家 AI的《阿里吴泳铭:全力投入 AI 基础设施建设,目标到 2032 年阿里云全球数据中心规模超 20GW》。重点看模型能力与工程。摘要提到:IT之家 9 月 22 日消息,IT之家今日在 2026 年云栖大会现场获悉,阿里巴巴 CEO 吴泳铭表示,当前客户 AI 需求非常强劲,将全力投入 AI 基础设施建设, 目标到 2032 年阿里云运营的全球数据中心规模超过 20GW 。 2026 云栖大会今日(9 月 22 日)上午在浙江杭州开幕, 英伟达位列本次大会巅峰合作伙伴,是本届云栖大会最高等级合作伙伴 。英特尔、AMD 分获钻石、红宝石合作伙伴。 阿里巴巴集团 CEO 吴泳铭、阿里千问 LLM 项目负责人刘大一恒等将在大会上发表主题演讲。今年云栖大会,云计算、AI、智能制造等众多国内外头部企业,多家算力、大模型产业链厂商集中亮相,算力生态合作成为本次云栖大会一大看点。 吴泳铭认为,今天机器动力已经承担了 99.9% 的物理工作,未来人类的思考总量还会继续增长,但机器思考将以更快的速度扩张,预期将会承担 99.9% 的思考工作。 顶级思考将从奢侈品变成可规模化供给的商...

  21. IT之家 AI68

    索尼 SIE 申请“AI 自修复系统”专利:利用人工智能实时生成诊断固件以修复 PlayStation 游戏机故障

    IT之家 9 月 22 日消息,据专利聚合网站 Patentlyze 披露,索尼 SIE 近日提交一项基于 AI 的 PlayStation 自动诊断和修复系统专利,该系统可以持续监测联网的 PlayStation 设备,在发现软件问题后由 AI 服务器实时生成针对性的诊断固件,并将其直接部署到出现故障的主机上,从而减少用户联系客服的需求。 IT之家参考专利描述,该系统的目标之一是减少保修申请、客服工单以及传统故障排查过程中需要用户反复操作的步骤。当系统检测到主机存在问题后,AI 模型不会简单调用预先编写好的修复方案,而是根据具体故障生成相应的修复代码,并进一步判断问题能否自动处理。如果无法解决,则将相关问题升级给人工客服或技术人员。 不过,让 AI 直接生成并部署消费级硬件固件显然存在明显风险。目前 AI 模型无法 100% 准确, 相应模型可能生成带有缺陷的固件补丁,反而可能导致设备“变砖”,最终需要返厂维修更换 。 此外,...

    推荐理由:来自IT之家 AI的《索尼 SIE 申请“AI 自修复系统”专利:利用人工智能实时生成诊断固件以修复 PlayStation 游戏机故障》。重点看模型能力与工程。摘要提到:IT之家 9 月 22 日消息,据专利聚合网站 Patentlyze 披露,索尼 SIE 近日提交一项基于 AI 的 PlayStation 自动诊断和修复系统专利,该系统可以持续监测联网的 PlayStation 设备,在发现软件问题后由 AI 服务器实时生成针对性的诊断固件,并将其直接部署到出现故障的主机上,从而减少用户联系客服的需求。 IT之家参考专利描述,该系统的目标之一是减少保修申请、客服工单以及传统故障排查过程中需要用户反复操作的步骤。当系统检测到主机存在问题后,AI 模型不会简单调用预先编写好的修复方案,而是根据具体故障生成相应的修复代码,并进一步判断问题能否自动处理。如果无法解决,则将相关问题升级给人工客服或技术人员。 不过,让 AI 直接生成并部署消费级硬件固件显然存在明显风险。目前 AI 模型无法 100% 准确, 相应模型可能生成带有缺陷的固件补丁,反而可能导致设备“变砖”,最终需要返厂维修更换 。 此外,...

  22. IT之家 AI74

    OpenAI 宣布成立数学与 AI 顾问组,神秘新模型 24 天攻破 100+ 世界级难题

    IT之家 9 月 22 日消息,OpenAI 宣布成立“数学与 AI 顾问组”(Advisory Group on Mathematics and Artificial Intelligence)。据介绍,该顾问组设在普林斯顿高等研究院,由九位数学家组成,将独立于 OpenAI 运作。 相较于此,更重磅的是 OpenAI 在公告中披露 —— 公司于 8 月 28 日开始训练的一个神秘模型已成功解决了多个数学领域中 100 多个长期未解决的开放问题(包含此前引发争议的纳维-斯托克斯千年大奖难题)。 OpenAI 称,该模型在数学领域的进展速度令公司内部的数学家感到惊讶,这引发了关于如何以最佳方式告知学界的内部讨论。 OpenAI 认为,数学属于基础科学领域,AI 取得新的数学发现后可能产生广泛应用,因此相关能力的开发和部署需要采取更稳重的方式。公司目前正在研究如何更广泛地部署与数学相关的 AI 能力。 此前,陶哲轩、邓煜、彼得 ·...

    推荐理由:来自IT之家 AI的《OpenAI 宣布成立数学与 AI 顾问组,神秘新模型 24 天攻破 100+ 世界级难题》。重点看模型能力与工程、文化创意。摘要提到:IT之家 9 月 22 日消息,OpenAI 宣布成立“数学与 AI 顾问组”(Advisory Group on Mathematics and Artificial Intelligence)。据介绍,该顾问组设在普林斯顿高等研究院,由九位数学家组成,将独立于 OpenAI 运作。 相较于此,更重磅的是 OpenAI 在公告中披露 —— 公司于 8 月 28 日开始训练的一个神秘模型已成功解决了多个数学领域中 100 多个长期未解决的开放问题(包含此前引发争议的纳维-斯托克斯千年大奖难题)。 OpenAI 称,该模型在数学领域的进展速度令公司内部的数学家感到惊讶,这引发了关于如何以最佳方式告知学界的内部讨论。 OpenAI 认为,数学属于基础科学领域,AI 取得新的数学发现后可能产生广泛应用,因此相关能力的开发和部署需要采取更稳重的方式。公司目前正在研究如何更广泛地部署与数学相关的 AI 能力。 此前,陶哲轩、邓煜、彼得 ·...

  23. Simon Willison83

    Jev introduces a new shape of LLM - System One, aka Decision Models

    事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、评测与基准,原文信息显示:Jev introduces a new shape of LLM - System One, aka Decision Models 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、评测与基准,原文信息显示:Jev introduces a new shape of L。影响判断:它可能改变智能体工作流、模型能力与工程、评测与基准相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、评测与基准方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程、评测与基准直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  24. IT之家 AI70

    马斯克 SpaceXAI 发布旗下最强编码和知识处理模型 Grok 4.7,百万词元输入 2 美元起

    IT之家 9 月 22 日消息,SpaceXAI 今日宣布推出新一代 Grok 4.7,主打编程和知识工作场景。 官方称其采用全新更大规模基础模型,并通过更长时间的强化学习训练提升复杂任务处理能力,是该公司目前最强的编码和知识处理模型 —— 速度是同类模型的两倍,价格却只有一半。 如前所述,Grok 4.7 针对编程和知识工作进行了优化。与 Grok 4.6 相比,新模型能够在困难任务上持续更长时间,并加强了对自身输出结果的检查能力。 在 CursorBench 4.0 测试中,Grok 4.7 面向长时间运行的编程任务,在价格与性能方面处于同类模型的前列。官方同时表示,该模型的运行速度和定价与 Grok 4.6 相同。 Grok 4.7 使用了比 Grok 4.6 更大的基座模型,并接受了更长时间的强化学习训练。训练数据更加侧重需要数小时完成的复杂任务,同时针对模型的自我验证和长上下文管理能力进行了优化。 SpaceXAI 还...

    推荐理由:来自IT之家 AI的《马斯克 SpaceXAI 发布旗下最强编码和知识处理模型 Grok 4.7,百万词元输入 2 美元起》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 22 日消息,SpaceXAI 今日宣布推出新一代 Grok 4.7,主打编程和知识工作场景。 官方称其采用全新更大规模基础模型,并通过更长时间的强化学习训练提升复杂任务处理能力,是该公司目前最强的编码和知识处理模型 —— 速度是同类模型的两倍,价格却只有一半。 如前所述,Grok 4.7 针对编程和知识工作进行了优化。与 Grok 4.6 相比,新模型能够在困难任务上持续更长时间,并加强了对自身输出结果的检查能力。 在 CursorBench 4.0 测试中,Grok 4.7 面向长时间运行的编程任务,在价格与性能方面处于同类模型的前列。官方同时表示,该模型的运行速度和定价与 Grok 4.6 相同。 Grok 4.7 使用了比 Grok 4.6 更大的基座模型,并接受了更长时间的强化学习训练。训练数据更加侧重需要数小时完成的复杂任务,同时针对模型的自我验证和长上下文管理能力进行了优化。 SpaceXAI 还...

9月21日周一
  1. GitHub Changelog91

    Grok 4.7 is now available in GitHub Copilot

    事实摘要:Grok 4.7 is now available in GitHub Copilot 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:Grok 4.7 is now available in GitHub Copilot 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、开源生态,原文信息显示:Grok 4.7。影响判断:它可能改变智能体工作流、模型能力与工程、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程、开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  2. 爱范儿74

    新 Mac mini 首发实测:我的第一台「多 Agent」电脑

    事实摘要:新 Mac mini 首发实测:我的第一台「多 Agent」电脑 能跑大模型只是 AI PC 的起点 #欢迎关注爱范儿官方微信公众号:爱范儿(微信号:ifanr),更多精彩内容第一时间为您奉上。 这条动态来自 爱范儿,可重点关注智能体工作流、模型能力与工程。 新 Mac mini 首发实测:我的第一台「多 Agent」电脑 能跑大模型只是 AI PC 的起点。影响判断:它可能改变智能体工作流、模型能力与工程相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  3. IT之家 AI36

    商汤发布 SenseNova U1 Pro 正式版图片创作模型,至高支持 8K 分辨率及特殊长宽比

    IT之家 9 月 21 日消息,商汤今日发布 SenseNova U1 Pro 正式版模型,上线 商汤小浣熊 ,和商汤日日新 API 服务。 据介绍,SenseNova U1 Pro 模型可通过内生的图文交错思维链创作出内容准确、设计精美、生产可用的图片素材,效果比肩海外顶尖模型。 IT之家从官网获悉,SenseNova U1 Pro 有以下能力: 超高清素材输出 :至高支持 8K 分辨率及特殊长宽比,满足高精度输出与细节呈现的生产需求 精准内容表达 :准确组织复杂信息,生成逻辑清晰、文字精准、图文结合的知识内容 ▲ 生成一幅以手提包为核心主题的信息图,标题为《皮囊解析:被携带的自我》,探讨个人物品与自我身份的关系,包含甄选法则、容器、内衬秘密、生活沉淀、磨损情结五个主题模块 卓越视觉设计 :融合设计美感与视觉表达,呈现层次丰富、质感出众的专业视觉效果 ▲ 竖幅泉州城市主题插画海报,9:16,版画木刻风格,纯线描与双色配色:黑色...

    推荐理由:来自IT之家 AI的《商汤发布 SenseNova U1 Pro 正式版图片创作模型,至高支持 8K 分辨率及特殊长宽比》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 21 日消息,商汤今日发布 SenseNova U1 Pro 正式版模型,上线 商汤小浣熊 ,和商汤日日新 API 服务。 据介绍,SenseNova U1 Pro 模型可通过内生的图文交错思维链创作出内容准确、设计精美、生产可用的图片素材,效果比肩海外顶尖模型。 IT之家从官网获悉,SenseNova U1 Pro 有以下能力: 超高清素材输出 :至高支持 8K 分辨率及特殊长宽比,满足高精度输出与细节呈现的生产需求 精准内容表达 :准确组织复杂信息,生成逻辑清晰、文字精准、图文结合的知识内容 ▲ 生成一幅以手提包为核心主题的信息图,标题为《皮囊解析:被携带的自我》,探讨个人物品与自我身份的关系,包含甄选法则、容器、内衬秘密、生活沉淀、磨损情结五个主题模块 卓越视觉设计 :融合设计美感与视觉表达,呈现层次丰富、质感出众的专业视觉效果 ▲ 竖幅泉州城市主题插画海报,9:16,版画木刻风格,纯线描与双色配色:黑色...

  4. Interconnects50

    The current balance of power in open models

    这条英文动态主要涉及模型能力与工程。原文要点:The expanded form of a testimony I prepared for Congress.

    推荐理由:来自Interconnects的《The current balance of power in open models》。重点看模型能力与工程。摘要提到:这条英文动态主要涉及模型能力与工程。原文要点:The expanded form of a testimony I prepared for Congress.

  5. IT之家 AI36

    大晓机器人联合中国石油落地首个加油站便利店具身智能项目

    IT之家 9 月 21 日消息, 大晓机器人今日宣布与中国石油上海销售公司正式达成战略合作,启动试运营首个加油站便利店场景的全闭环具身智能机器人项目。 IT之家从官方介绍获悉,双方此次合作落地后,首店(昆仑好客便利店(中国石油振兴店))已进入试运营阶段。消费者通过美团下单后,订单经中国石油数智平台进入作业系统,大晓机器人根据订单和库存信息, 在 75 厘米通道及 2 米高货架条件下完成商品拣选、搬运、打包 ,并同步更新订单状态。 到店消费场景下,机器人也可协助完成商品取放与履约准备;大晓专注机器人本体与世界模型,运营方案覆盖商品仓储、分拣、补货、上架、订单拣选与装箱履约等关键环节,打通“前置仓 — 门店 — 订单”全流程。 大晓机器人表示,下一步,将与中国石油上海销售公司将持续深化技术协同与场景共创, 加快仓店一体化方案在真实零售业务中的验证与落地 ,推动具身智能进一步融入线下零售运营体系,一起探索仓储、门店与即时履约深度协同的...

    推荐理由:来自IT之家 AI的《大晓机器人联合中国石油落地首个加油站便利店具身智能项目》。重点看模型能力与工程。摘要提到:IT之家 9 月 21 日消息, 大晓机器人今日宣布与中国石油上海销售公司正式达成战略合作,启动试运营首个加油站便利店场景的全闭环具身智能机器人项目。 IT之家从官方介绍获悉,双方此次合作落地后,首店(昆仑好客便利店(中国石油振兴店))已进入试运营阶段。消费者通过美团下单后,订单经中国石油数智平台进入作业系统,大晓机器人根据订单和库存信息, 在 75 厘米通道及 2 米高货架条件下完成商品拣选、搬运、打包 ,并同步更新订单状态。 到店消费场景下,机器人也可协助完成商品取放与履约准备;大晓专注机器人本体与世界模型,运营方案覆盖商品仓储、分拣、补货、上架、订单拣选与装箱履约等关键环节,打通“前置仓 — 门店 — 订单”全流程。 大晓机器人表示,下一步,将与中国石油上海销售公司将持续深化技术协同与场景共创, 加快仓店一体化方案在真实零售业务中的验证与落地 ,推动具身智能进一步融入线下零售运营体系,一起探索仓储、门店与即时履约深度协同的...

  6. IT之家 AI70

    亚马逊 AWS 旗下 Bedrock 官宣接入 Kimi K3 模型

    IT之家 9 月 21 日消息,亚马逊云服务(AWS)旗下人工智能服务平台 Amazon Bedrock 近日宣布接入 Kimi K3 模型,为编程工作提供新选择。 IT之家了解到,Kimi K3 是月之暗面开发的大模型。官方宣称其是首个参数规模达 2.8 万亿的开源模型。该模型原生支持视觉能力,拥有 100 万 Token 的上下文窗口,非常适合执行长时间编程、多文档分析等工作。 Amazon Bedrock 将为 Kimi K3 提供闭源模型相同的安全边界,拥有统一的访问控制、加密和审计机制。Kimi K3 是 Amazon Bedrock 首个支持显式提示缓存的开放权重模型。当多次调用模型时重复使用上下文,可借此降低延迟和输入成本。

    推荐理由:来自IT之家 AI的《亚马逊 AWS 旗下 Bedrock 官宣接入 Kimi K3 模型》。重点看模型能力与工程、开源生态。摘要提到:IT之家 9 月 21 日消息,亚马逊云服务(AWS)旗下人工智能服务平台 Amazon Bedrock 近日宣布接入 Kimi K3 模型,为编程工作提供新选择。 IT之家了解到,Kimi K3 是月之暗面开发的大模型。官方宣称其是首个参数规模达 2.8 万亿的开源模型。该模型原生支持视觉能力,拥有 100 万 Token 的上下文窗口,非常适合执行长时间编程、多文档分析等工作。 Amazon Bedrock 将为 Kimi K3 提供闭源模型相同的安全边界,拥有统一的访问控制、加密和审计机制。Kimi K3 是 Amazon Bedrock 首个支持显式提示缓存的开放权重模型。当多次调用模型时重复使用上下文,可借此降低延迟和输入成本。

  7. 爱范儿68

    GPT-6 伤人实测曝光:刺向「婴儿」、制造毒气,97% 情况选择照做

    当大模型开始拥有一双真实的手 #欢迎关注爱范儿官方微信公众号:爱范儿(微信号:ifanr),更多精彩内容第一时间为您奉上。 这条动态来自 爱范儿,可重点关注模型能力与工程。

    推荐理由:来自爱范儿的《GPT-6 伤人实测曝光:刺向「婴儿」、制造毒气,97% 情况选择照做》。重点看模型能力与工程。摘要提到:当大模型开始拥有一双真实的手 #欢迎关注爱范儿官方微信公众号:爱范儿(微信号:ifanr),更多精彩内容第一时间为您奉上。 这条动态来自 爱范儿,可重点关注模型能力与工程。

  8. IT之家 AI70

    被质疑“偷传代码”后智谱 ZCode 官宣开源:已完成整改并向所有用户道歉

    IT之家 9 月 21 日消息,智谱 ZCode 今日宣布,针对社区反馈的 ZCode 产品安全问题, 官方已经完成整改,并向所有用户道歉 。 智谱已将 ZCode 开源 ( https://github.com/zai-org/ZCode ),把代码交给社区监督,让 ZCode 变得开放、透明。 非常感谢此前发现 ZCode 问题的社区开发者,接下来我们将建立常态化的产品安全漏洞机制,欢迎开发者伙伴持续检查和反馈问题,我们会根据问题严重程度给予相应回报。 对于社区中提及的代码数据,我们承诺无留存,也从未将其用于模型训练。完成整改后,我们邀请中国信息通信研究院和绿盟科技开展安全审计,结果如下: 经中国信息通信研究院技术评测,确认 zcode-prod 阿里云 OSS 存储桶状态为云端零数据。ZCode v3.14.0 客户端已完成安全整改,已经移除 Repo Wiki 功能,已切断本地仓库快照生成与上传链路。 经绿盟科技审查,确...

    推荐理由:来自IT之家 AI的《被质疑“偷传代码”后智谱 ZCode 官宣开源:已完成整改并向所有用户道歉》。重点看模型能力与工程、评测与基准、开源生态。摘要提到:IT之家 9 月 21 日消息,智谱 ZCode 今日宣布,针对社区反馈的 ZCode 产品安全问题, 官方已经完成整改,并向所有用户道歉 。 智谱已将 ZCode 开源 ( https://github.com/zai-org/ZCode ),把代码交给社区监督,让 ZCode 变得开放、透明。 非常感谢此前发现 ZCode 问题的社区开发者,接下来我们将建立常态化的产品安全漏洞机制,欢迎开发者伙伴持续检查和反馈问题,我们会根据问题严重程度给予相应回报。 对于社区中提及的代码数据,我们承诺无留存,也从未将其用于模型训练。完成整改后,我们邀请中国信息通信研究院和绿盟科技开展安全审计,结果如下: 经中国信息通信研究院技术评测,确认 zcode-prod 阿里云 OSS 存储桶状态为云端零数据。ZCode v3.14.0 客户端已完成安全整改,已经移除 Repo Wiki 功能,已切断本地仓库快照生成与上传链路。 经绿盟科技审查,确...