跳到正文
9月10日周四
  1. 量子位63

    全球首个可仿真的人–场景交互重建框架 HSImul3R:让人类视频真正成为机器人技能来源

    事实摘要:全球首个可仿真的人–场景交互重建框架 HSImul3R:让人类视频真正成为机器人技能来源 大晓机器人联合南洋理工大学 S-Lab、上海人工智能实验室发布全新人–场景交互重建研究 HSImul3R 这条动态来自 量子位,可重点关注产品发布。 全球首个可仿真的人–场景交互重建框架 HSImul3R:让人类视频真正成为机器人技能来源 大晓机器人联合南洋理工大学 S。影响判断:它可能改变AI 应用价值相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪AI 应用价值方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和AI 应用价值直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  2. IT之家 AI66

    亚马逊 Prime Video 上线新 AI 功能:不同语言配音都能准确对口型

    IT之家 9 月 10 日消息,当地时间 9 日,亚马逊通过新闻稿宣布 Prime Video 上线 AI 口型同步功能,可以让 演员的嘴部动作与“真人配音”音轨对齐 。目前,该功能仅支持德国剧集《贵族高中:我们之间的鸿沟》的英语配音版,未来还将扩展至更多作品。 Prime Video 表示,新功能结合 AI 与视觉特效技术,让演员口型与翻译后的台词保持一致。Meta 和 YouTube 近期也面向创作者推出了人工智能自动配音功能,并提供“口型同步”选项,让画面中的创作者看起来像是在 直接使用观众偏好的语言说话 。 据IT之家了解,去年,Prime Video 已开始在《熙德:传奇》《我的鹦鹉妈妈》和《久别重逢》等 12 部电影和电视剧中试验英语和西班牙语“AI 辅助”配音。目前,全球订阅用户都可以在《贵族高中:我们之间的鸿沟》第一季和第二季使用口型同步配音功能,12 月 9 日上线的第三季也将支持该功能。

    推荐理由:来自IT之家 AI的《亚马逊 Prime Video 上线新 AI 功能:不同语言配音都能准确对口型》。重点看产品发布。摘要提到:IT之家 9 月 10 日消息,当地时间 9 日,亚马逊通过新闻稿宣布 Prime Video 上线 AI 口型同步功能,可以让 演员的嘴部动作与“真人配音”音轨对齐 。目前,该功能仅支持德国剧集《贵族高中:我们之间的鸿沟》的英语配音版,未来还将扩展至更多作品。 Prime Video 表示,新功能结合 AI 与视觉特效技术,让演员口型与翻译后的台词保持一致。Meta 和 YouTube 近期也面向创作者推出了人工智能自动配音功能,并提供“口型同步”选项,让画面中的创作者看起来像是在 直接使用观众偏好的语言说话 。 据IT之家了解,去年,Prime Video 已开始在《熙德:传奇》《我的鹦鹉妈妈》和《久别重逢》等 12 部电影和电视剧中试验英语和西班牙语“AI 辅助”配音。目前,全球订阅用户都可以在《贵族高中:我们之间的鸿沟》第一季和第二季使用口型同步配音功能,12 月 9 日上线的第三季也将支持该功能。

  3. 量子位66

    AGI时代的第一个生图模型,ChatGPT Images 2.5上线

    事实摘要:ChatGPT Images 2.5 是 AGI时代的第一个生图模型。影响判断:生成更快,细节更好,改图也终于越来越像‘真·修图’了。场景价值:适用于需要快速生成高质量图像的场景,如广告、设计等。

    推荐理由:该模型通过优化生成速度和提高细节处理能力,使其在图像生成领域具有竞争优势。

  4. IT之家 AI74

    DeepSeek V4.1 Flash 模型正式发布:全面超越 V4 Pro、原生多模态视觉理解,API 定价下调

    IT之家 9 月 10 日消息,深度求索今日正式发布 DeepSeek V4.1 Flash 模型 。这是其全新模型结构系列中的最小尺寸的模型,具备原生多模态视觉理解能力。 新模型结构的设计初衷是:能力上限更高、推理速度更快、吞吐更大、可扩展到更大参数模型。 DeepSeek V4.1 Flash 为 552B 参数的 MoE 模型 ,采用了全新的 Causal-Encoder-Decoder 结构,输入和输出不对称,输入激活只有 8B,输出激活 16B,成本显著低于已知的同尺寸模型。同时,V4.1 Flash 还采用了新的预训练方式、经过了更大规模的强化学习后训练,在基准测试中,成功超越了包括 DeepSeek V4 Pro 在内的一众旗舰模型的智能水平。 ▲ DeepSeek-V4.1-Flash 与主流前沿模型在 Agentic Benchmark 上的性能对比 此外,新一代模型大幅减少了 KV Cache 缓存的大小,与...

    推荐理由:来自IT之家 AI的《DeepSeek V4.1 Flash 模型正式发布:全面超越 V4 Pro、原生多模态视觉理解,API 定价下调》。重点看智能体工作流、模型能力与工程、评测与基准。摘要提到:IT之家 9 月 10 日消息,深度求索今日正式发布 DeepSeek V4.1 Flash 模型 。这是其全新模型结构系列中的最小尺寸的模型,具备原生多模态视觉理解能力。 新模型结构的设计初衷是:能力上限更高、推理速度更快、吞吐更大、可扩展到更大参数模型。 DeepSeek V4.1 Flash 为 552B 参数的 MoE 模型 ,采用了全新的 Causal-Encoder-Decoder 结构,输入和输出不对称,输入激活只有 8B,输出激活 16B,成本显著低于已知的同尺寸模型。同时,V4.1 Flash 还采用了新的预训练方式、经过了更大规模的强化学习后训练,在基准测试中,成功超越了包括 DeepSeek V4 Pro 在内的一众旗舰模型的智能水平。 ▲ DeepSeek-V4.1-Flash 与主流前沿模型在 Agentic Benchmark 上的性能对比 此外,新一代模型大幅减少了 KV Cache 缓存的大小,与...

  5. IT之家 AI68

    JPR 报告 2026Q2 全球 PC AIB 显卡出货量 1250 万块:环比增 10%、同比增 6.6%

    IT之家 9 月 10 日消息,市场调查机构 Jon Peddie Research 昨日(9 月 9 日)发布博文, 报告称 2026 年第二季度全球 PC 图形附加板(AIB)市场出货量达到 1,250 万块,环比增长 10%、同比增长 6.6%。 IT之家注:AIB 是 Add-in Board 的缩写,在 PC 硬件语境中,图形附加板通常指带有 GPU、显存、供电和散热组件的完整独立显卡,例如由华硕、微星、技嘉等板卡厂商制造、搭载 NVIDIA、AMD 或 Intel GPU 的显卡。 这些图形附加板通常经由 PCIe 插槽连接主板,为游戏渲染、视频剪辑、3D 建模、AI 推理和科学计算等任务提供图形与并行计算能力。 厂商份额方面,AMD 的 AIB 总市场份额环比下降 0.16 个百分点,Intel 上升 0.3 个百分点,NVIDIA 下降 0.1 个百分点。 该机构指出同期 PC 图形附加板与台式 CPU 市场呈现...

    推荐理由:来自IT之家 AI的《JPR 报告 2026Q2 全球 PC AIB 显卡出货量 1250 万块:环比增 10%、同比增 6.6%》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 10 日消息,市场调查机构 Jon Peddie Research 昨日(9 月 9 日)发布博文, 报告称 2026 年第二季度全球 PC 图形附加板(AIB)市场出货量达到 1,250 万块,环比增长 10%、同比增长 6.6%。 IT之家注:AIB 是 Add-in Board 的缩写,在 PC 硬件语境中,图形附加板通常指带有 GPU、显存、供电和散热组件的完整独立显卡,例如由华硕、微星、技嘉等板卡厂商制造、搭载 NVIDIA、AMD 或 Intel GPU 的显卡。 这些图形附加板通常经由 PCIe 插槽连接主板,为游戏渲染、视频剪辑、3D 建模、AI 推理和科学计算等任务提供图形与并行计算能力。 厂商份额方面,AMD 的 AIB 总市场份额环比下降 0.16 个百分点,Intel 上升 0.3 个百分点,NVIDIA 下降 0.1 个百分点。 该机构指出同期 PC 图形附加板与台式 CPU 市场呈现...

  6. IT之家 AI68

    DeepSeek 快速、专家、识图模式合并升级,V4.1 Flash 最快今日发布

    IT之家 9 月 10 日消息,DeepSeek 今日宣布将原有的快速模式、专家模式和识图模式合而为一,这意味着用户将不再需要手动切换。 DeepSeek 将其整合为统一的智能模式,模型可自动检测查询复杂度、在检测到图片输入时激活视觉能力,并根据任务难度调整处理能力。 在此之前,多模态视觉理解模型 DeepSeek-V4-Flash-Vision-Exp 已上线 DeepSeek API 平台,支持 Chat Completions、Messages、Responses 三种格式调用。 DeepSeek 昨日已发布预告,计划于北京时间 2026 年 9 月 10 日前后正式发布 V4.1 Flash 模型。经 DeepSeek 内部、外部多方测试,V4.1 Flash 在性能、费用、速度、总用时等各项指标上已全面超越 V4 Pro。 DeepSeek 计划于北京时间 2026 年 9 月 14 日 12:00 下线 V4 Pro...

    推荐理由:来自IT之家 AI的《DeepSeek 快速、专家、识图模式合并升级,V4.1 Flash 最快今日发布》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 10 日消息,DeepSeek 今日宣布将原有的快速模式、专家模式和识图模式合而为一,这意味着用户将不再需要手动切换。 DeepSeek 将其整合为统一的智能模式,模型可自动检测查询复杂度、在检测到图片输入时激活视觉能力,并根据任务难度调整处理能力。 在此之前,多模态视觉理解模型 DeepSeek-V4-Flash-Vision-Exp 已上线 DeepSeek API 平台,支持 Chat Completions、Messages、Responses 三种格式调用。 DeepSeek 昨日已发布预告,计划于北京时间 2026 年 9 月 10 日前后正式发布 V4.1 Flash 模型。经 DeepSeek 内部、外部多方测试,V4.1 Flash 在性能、费用、速度、总用时等各项指标上已全面超越 V4 Pro。 DeepSeek 计划于北京时间 2026 年 9 月 14 日 12:00 下线 V4 Pro...

  7. Simon Willison83

    .blend URL Viewer

    事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:.blend URL Viewer 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:.blend URL Viewer 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:.blend URL Viewer 事实摘要:。影响判断:它可能改变智能体工作流、模型能力与工程、文化创意相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、文化创意方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程、文化创意直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  8. IT之家 AI36

    苹果 Apple Watch 将增 AI 音频功能:全天谈话划重点 / 回顾 15 秒对话

    IT之家 9 月 10 日消息,彭博社今天(9 月 10 日)发布博文,报道称在 2026 秋季发布会上,苹果为 Apple Watch Series 12、Apple Watch Ultra 4 两款智能手表, 带来了 Siri Recap 和 Live Recap 在内的全新音频智能工具,通过环境聆听记录对话要点并生成实时转录。 IT之家援引博文介绍,Siri Recap 定位类似自动化的对话备忘录,通过“环境聆听”(ambient listening),从日常对话中记录概括性信息,帮助用户回顾可能遗漏的事项或重点。 而 Live Recap 可显示最近 15 秒实时对话的文字转录,方便用户快速回顾刚才说了什么。此外 Apple Watch 还可监听婴儿哭声、门铃和警笛等重要环境声音。 隐私方面,用户可以根据自身使用偏好决定是否启用,此外苹果强调新功能不会创建或存储任何录音,苹果以及第三方应用均不可访问原始音频,且处理完成后...

    推荐理由:来自IT之家 AI的《苹果 Apple Watch 将增 AI 音频功能:全天谈话划重点 / 回顾 15 秒对话》。重点看产品发布。摘要提到:IT之家 9 月 10 日消息,彭博社今天(9 月 10 日)发布博文,报道称在 2026 秋季发布会上,苹果为 Apple Watch Series 12、Apple Watch Ultra 4 两款智能手表, 带来了 Siri Recap 和 Live Recap 在内的全新音频智能工具,通过环境聆听记录对话要点并生成实时转录。 IT之家援引博文介绍,Siri Recap 定位类似自动化的对话备忘录,通过“环境聆听”(ambient listening),从日常对话中记录概括性信息,帮助用户回顾可能遗漏的事项或重点。 而 Live Recap 可显示最近 15 秒实时对话的文字转录,方便用户快速回顾刚才说了什么。此外 Apple Watch 还可监听婴儿哭声、门铃和警笛等重要环境声音。 隐私方面,用户可以根据自身使用偏好决定是否启用,此外苹果强调新功能不会创建或存储任何录音,苹果以及第三方应用均不可访问原始音频,且处理完成后...

  9. IT之家 AI34

    索尼发布第四代 DWX 无线麦克风:主打简便操作与传输可靠性,发射器自带录音备份

    IT之家 9 月 10 日消息,索尼于当地时间 9 月 9 日宣布推出第四代 DWX 系列数字无线麦克风系统,包含 DWT-B40 腰包式发射器和 DWR-R40Q 机架式接收器两款新品。 该系列旨在降低无线麦克风的操作门槛,同时提升传输可靠性,适用于从专业广电制作到小型活动现场等多种场景。 索尼表示,无线麦克风的频率配置传统上需要专业知识与复杂操作,而第四代 DWX 系列将频道设置与配对简化为几步按键操作即可完成。该系统不仅面向专业制作环境,也适用于大、小型演播室以及戏剧制作、宗教活动、企业会议、讲座研讨会等各类现场活动。据索尼欧洲消息,该系列产品也将在本月于阿姆斯特丹举办的 IBC 2026 展会上亮相。 在传输性能方面,第四代 DWX 系列在保持具有竞争力的定价的同时,提升了射频稳定性和长距离音频传输能力。DWT-B40 发射器支持最高 50mW 的发射功率(视地区而定),可在长距离传输场景下保持稳定音频传输。发射器提供灵...

    推荐理由:来自IT之家 AI的《索尼发布第四代 DWX 无线麦克风:主打简便操作与传输可靠性,发射器自带录音备份》。重点看产品发布。摘要提到:IT之家 9 月 10 日消息,索尼于当地时间 9 月 9 日宣布推出第四代 DWX 系列数字无线麦克风系统,包含 DWT-B40 腰包式发射器和 DWR-R40Q 机架式接收器两款新品。 该系列旨在降低无线麦克风的操作门槛,同时提升传输可靠性,适用于从专业广电制作到小型活动现场等多种场景。 索尼表示,无线麦克风的频率配置传统上需要专业知识与复杂操作,而第四代 DWX 系列将频道设置与配对简化为几步按键操作即可完成。该系统不仅面向专业制作环境,也适用于大、小型演播室以及戏剧制作、宗教活动、企业会议、讲座研讨会等各类现场活动。据索尼欧洲消息,该系列产品也将在本月于阿姆斯特丹举办的 IBC 2026 展会上亮相。 在传输性能方面,第四代 DWX 系列在保持具有竞争力的定价的同时,提升了射频稳定性和长距离音频传输能力。DWT-B40 发射器支持最高 50mW 的发射功率(视地区而定),可在长距离传输场景下保持稳定音频传输。发射器提供灵...

  10. IT之家 AI36

    苹果 Apple Watch Series 12 和 Ultra 4 发布:全新 AI 健康、对话摘要,陶瓷表壳回归

    IT之家 9 月 10 日消息,苹果今日正式发布 Apple Watch Series 12 和 Apple Watch Ultra 4 智能手表。 两款手表搭载苹果最先进的健康传感器和全新 Apple 芯片, 全新的健康感测系统带来更大的电极表面积,在测量心电图时可以和皮肤贴合得更好,读取频率也提升到 60 倍。 心率 App 和表盘复杂功能迎来重点升级,能让用户更全面地了解自己的健康状况。 此外,用户能在健身 App 中查看身体评分,设备通过 Apple 智能给出建议,并根据状态和数据动态调整建议。 用户还可以手动添加同步更新病历,App 还会根据检测结果推荐来自临床专家的相关视频。 Apple Watch Series 12 和 Ultra 4 迎来音频智能,将声音识别能力带到 Apple Watch 上,可留意闹钟、门铃、婴儿啼哭等声音。 新款 Apple Watch 还迎来记录功能,会将对话生成文本摘要,将率先支持英语...

    推荐理由:来自IT之家 AI的《苹果 Apple Watch Series 12 和 Ultra 4 发布:全新 AI 健康、对话摘要,陶瓷表壳回归》。重点看产品发布。摘要提到:IT之家 9 月 10 日消息,苹果今日正式发布 Apple Watch Series 12 和 Apple Watch Ultra 4 智能手表。 两款手表搭载苹果最先进的健康传感器和全新 Apple 芯片, 全新的健康感测系统带来更大的电极表面积,在测量心电图时可以和皮肤贴合得更好,读取频率也提升到 60 倍。 心率 App 和表盘复杂功能迎来重点升级,能让用户更全面地了解自己的健康状况。 此外,用户能在健身 App 中查看身体评分,设备通过 Apple 智能给出建议,并根据状态和数据动态调整建议。 用户还可以手动添加同步更新病历,App 还会根据检测结果推荐来自临床专家的相关视频。 Apple Watch Series 12 和 Ultra 4 迎来音频智能,将声音识别能力带到 Apple Watch 上,可留意闹钟、门铃、婴儿啼哭等声音。 新款 Apple Watch 还迎来记录功能,会将对话生成文本摘要,将率先支持英语...

9月9日周三
  1. IT之家 AI36

    消息称三星研发带显示屏的 AI 眼镜,预计最早明年下半年发布

    IT之家 9 月 9 日消息,据韩媒 TheElec 消息,三星电子已着手开发其首款配备显示屏的 AI 眼镜。与 Meta Ray-Ban Display 智能眼镜类似,该产品不仅能提供音频功能,还能在镜片上显示彩色视觉信息。 据业内人士 9 日透露,三星电子上个月要求三星显示为 AI 眼镜开发微型显示屏(Micro Display),三星电子提出了具体要求,涵盖产品外形、信息显示区域、色彩能力及价格等。 据悉,三星电子目前对 OLEDoS(硅基 OLED)或 LEDoS(硅基 LED)等候选面板方案展开评估,重点权衡其性能与成本。 业内预计该产品将在 2027 年下半年或 2028 年上半年发布 ,具体时间主要取决于面板开发和产品验证所需的周期。 在规格方面,三星电子正评估 0.2 英寸以下的超小型微显示面板,以便直接集成于眼镜镜框内。系统通过近眼光学系统将面板图像放大并投影至人眼,主要用于承载文字、系统通知、UI 图标及导航...

    推荐理由:来自IT之家 AI的《消息称三星研发带显示屏的 AI 眼镜,预计最早明年下半年发布》。重点看产品发布。摘要提到:IT之家 9 月 9 日消息,据韩媒 TheElec 消息,三星电子已着手开发其首款配备显示屏的 AI 眼镜。与 Meta Ray-Ban Display 智能眼镜类似,该产品不仅能提供音频功能,还能在镜片上显示彩色视觉信息。 据业内人士 9 日透露,三星电子上个月要求三星显示为 AI 眼镜开发微型显示屏(Micro Display),三星电子提出了具体要求,涵盖产品外形、信息显示区域、色彩能力及价格等。 据悉,三星电子目前对 OLEDoS(硅基 OLED)或 LEDoS(硅基 LED)等候选面板方案展开评估,重点权衡其性能与成本。 业内预计该产品将在 2027 年下半年或 2028 年上半年发布 ,具体时间主要取决于面板开发和产品验证所需的周期。 在规格方面,三星电子正评估 0.2 英寸以下的超小型微显示面板,以便直接集成于眼镜镜框内。系统通过近眼光学系统将面板图像放大并投影至人眼,主要用于承载文字、系统通知、UI 图标及导航...

  2. IT之家 AI64

    天马推出极窄超高刷 AMOLED 显示技术:屏占比 99.6%,刷新率 240Hz

    IT之家 9 月 9 日消息,天马今日宣布推出极窄超高刷显示技术,融合极窄边框、超高刷新、低耗长寿等多项自研核心技术。 天马表示,通过自研 FSD 技术与模组一体化设计方案等显示技术, 将面板单体边框直降至 0.35mm,模组边框目视仅 0.1mm ,且达成四边四角等宽的极致对称设计,彻底弱化边框视觉割裂感, 屏占比达 99.6% ,真正达成趋近“0”边框的无界视觉效果。 据介绍,天马首创全新分离式像素电路设计,搭配新型快速充电电路与智能触控算法优化, 成功实现 240Hz 超高刷新率 。相较于传统显示方案,天马全新分离式电路设计带来全方位性能提升: 首帧亮度对比 13.4%,避免画面闪暗,保障每一次切换都清晰舒适; 图像残留优化提升 61%,面对高速运动画面、快速滑动场景,画面依旧干净利落、无模糊拖影; 让动态画面无拖影、暗部细节层次分明,实现“快且准”的极致高刷显示体验。 IT之家获悉,天马极窄超高刷 AMOLED 显示屏搭...

    推荐理由:来自IT之家 AI的《天马推出极窄超高刷 AMOLED 显示技术:屏占比 99.6%,刷新率 240Hz》。重点看多模态。摘要提到:IT之家 9 月 9 日消息,天马今日宣布推出极窄超高刷显示技术,融合极窄边框、超高刷新、低耗长寿等多项自研核心技术。 天马表示,通过自研 FSD 技术与模组一体化设计方案等显示技术, 将面板单体边框直降至 0.35mm,模组边框目视仅 0.1mm ,且达成四边四角等宽的极致对称设计,彻底弱化边框视觉割裂感, 屏占比达 99.6% ,真正达成趋近“0”边框的无界视觉效果。 据介绍,天马首创全新分离式像素电路设计,搭配新型快速充电电路与智能触控算法优化, 成功实现 240Hz 超高刷新率 。相较于传统显示方案,天马全新分离式电路设计带来全方位性能提升: 首帧亮度对比 13.4%,避免画面闪暗,保障每一次切换都清晰舒适; 图像残留优化提升 61%,面对高速运动画面、快速滑动场景,画面依旧干净利落、无模糊拖影; 让动态画面无拖影、暗部细节层次分明,实现“快且准”的极致高刷显示体验。 IT之家获悉,天马极窄超高刷 AMOLED 显示屏搭...

  3. 爱范儿34

    GPT Images 2.5 突发上线!网友的「灵魂画作」一个比一个离谱

    事实摘要:GPT Images 2.5 突发上线!网友的「灵魂画作」一个比一个离谱 过于抽象 #欢迎关注爱范儿官方微信公众号:爱范儿(微信号:ifanr),更多精彩内容第一时间为您奉上。 这条动态来自 爱范儿,可重点关注产品发布。 GPT Images 2.5 突发上线!网友的「灵魂画作」一个比一个离谱 过于抽象 #欢迎关注爱范儿官方微信公众号:爱范儿(微信号:ifa。影响判断:它可能改变AI 应用价值相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪AI 应用价值方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和AI 应用价值直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  4. IT之家 AI34

    宁德时代否认网传不让普工上厕所导致过激事件:视频中并非宁德时代,已报警

    IT之家 9 月 9 日消息,一条视频近期在网上热传,网传信息显示,某基地一名班长不让普工上厕所,导致员工拉裤兜里,随后情绪失控在车间裸奔并拿粪便扔向班长…… 据财闻今日报道,宁德时代有关负责人回应称是恶意造谣, 视频中并非宁德时代,公司已报警请警方调查 。 另据钱江视频报道,四川时代一名工作人员表示,此事不属于四川时代新能源科技有限公司,“ 他不是我们基地啊,也不是我们公司啊 ”,对于此事,该工作人员表示,“什么人都有吧,我只能说……”

    推荐理由:来自IT之家 AI的《宁德时代否认网传不让普工上厕所导致过激事件:视频中并非宁德时代,已报警》。重点看多模态。摘要提到:IT之家 9 月 9 日消息,一条视频近期在网上热传,网传信息显示,某基地一名班长不让普工上厕所,导致员工拉裤兜里,随后情绪失控在车间裸奔并拿粪便扔向班长…… 据财闻今日报道,宁德时代有关负责人回应称是恶意造谣, 视频中并非宁德时代,公司已报警请警方调查 。 另据钱江视频报道,四川时代一名工作人员表示,此事不属于四川时代新能源科技有限公司,“ 他不是我们基地啊,也不是我们公司啊 ”,对于此事,该工作人员表示,“什么人都有吧,我只能说……”

  5. IT之家 AI70

    Suno 发布 v6 系列 AI 音乐模型,新增多项能力

    IT之家 9 月 9 日消息,据科技媒体 Engadget 今天报道,Suno 现已推出 v6 系列 AI 音乐模型,同时与华纳音乐、BMG 等唱片公司达成合作。 IT之家了解到,v6 系列一共包含三款模型:v6、v6-wild 和 v6-mini。其中 v6 主打旗舰,可生成各种风格的音乐;v6-wild 可生成实验性音乐;v6-mini 是唯一向免费用户开放的模型,另外两款需要 Pro 或 Premier 订阅才能使用。 该系列模型的生成速度相比以往产品更快,用户输入提示词后,等待几秒即可听到音乐,还可使用自然语言编辑歌曲特定部分。用户还可从多个音频源生成混音作品,还能够单独提取某首歌曲的采样。 此外,该系列模型还具备多模态理解能力,可以从其他音频、图片中生成歌曲。

    推荐理由:来自IT之家 AI的《Suno 发布 v6 系列 AI 音乐模型,新增多项能力》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 9 日消息,据科技媒体 Engadget 今天报道,Suno 现已推出 v6 系列 AI 音乐模型,同时与华纳音乐、BMG 等唱片公司达成合作。 IT之家了解到,v6 系列一共包含三款模型:v6、v6-wild 和 v6-mini。其中 v6 主打旗舰,可生成各种风格的音乐;v6-wild 可生成实验性音乐;v6-mini 是唯一向免费用户开放的模型,另外两款需要 Pro 或 Premier 订阅才能使用。 该系列模型的生成速度相比以往产品更快,用户输入提示词后,等待几秒即可听到音乐,还可使用自然语言编辑歌曲特定部分。用户还可从多个音频源生成混音作品,还能够单独提取某首歌曲的采样。 此外,该系列模型还具备多模态理解能力,可以从其他音频、图片中生成歌曲。

  6. IT之家 AI68

    行业首个开放世界全天候商业交付级具身智能架构,万勋科技发布 NOVA2.0 柔性具身大脑

    IT之家 9 月 9 日消息,万勋科技今日宣布推出其第二代柔性具身大脑 NOVA2.0,宣称是行业首个开放世界全天候商业交付级具身智能架构。 IT之家从官方公众号了解到, NOVA2.0 柔性具身大脑基于“肌体智能”理念打造 ,拥有触觉原生多模态柔性具身大脑分层架构,以潜意识多模态动作基进行实时轨迹生成与场景适应,实现低数据、超极速与强泛化优势。 同时,该模型可适配肌肉关节、柔性单臂、柔性双臂、柔性灵巧手 / 仿生人等多种本体构型及其任务需求, 拥有 1B+ 参数 ,支持 20 ms 极速轨迹生成。 官方宣称,该模型已泛化应用于地产建筑、电力能源、交通运输、智能驾驶、工业制造等领域的 40+ 真实行业场景的超 1000 万次多维度极限工况作业中。

    推荐理由:来自IT之家 AI的《行业首个开放世界全天候商业交付级具身智能架构,万勋科技发布 NOVA2.0 柔性具身大脑》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 9 日消息,万勋科技今日宣布推出其第二代柔性具身大脑 NOVA2.0,宣称是行业首个开放世界全天候商业交付级具身智能架构。 IT之家从官方公众号了解到, NOVA2.0 柔性具身大脑基于“肌体智能”理念打造 ,拥有触觉原生多模态柔性具身大脑分层架构,以潜意识多模态动作基进行实时轨迹生成与场景适应,实现低数据、超极速与强泛化优势。 同时,该模型可适配肌肉关节、柔性单臂、柔性双臂、柔性灵巧手 / 仿生人等多种本体构型及其任务需求, 拥有 1B+ 参数 ,支持 20 ms 极速轨迹生成。 官方宣称,该模型已泛化应用于地产建筑、电力能源、交通运输、智能驾驶、工业制造等领域的 40+ 真实行业场景的超 1000 万次多维度极限工况作业中。

  7. IT之家 AI66

    古尔曼:苹果 Apple Watch Series 12/Ultra 4 可自动记录用户每日活动并生成摘要

    IT之家 9 月 9 日消息,苹果将在北京时间明天凌晨发布新一代 Apple Watch 系列产品,彭博社记者马克 · 古尔曼(Mark Gurman)已经提前曝光了新品部分信息。 古尔曼称,Apple Watch Series 12 和 Apple Watch Ultra 4 将加入一项全新的 AI 功能,该功能可持续采集麦克风、全球定位系统以及其他传感器的数据,生成用户每日活动摘要,其中还包含对话总结。 古尔曼表示,这项功能不会保存音频录音。用户可以选择让它全天运行,也可以设置为仅在特定地点运行。生成的活动总结将存储在全新的 Siri 应用中。 IT之家注意到,这意味着 Apple Watch 将直接加入与其他公司近期 AI 可穿戴设备的竞争。这些产品都试图充当一种高度个性化的 AI 助手,帮助用户记录生活中的摘要、记忆并提供建议。 其核心理念是,用户不再需要手动记录那么多事情,而是让 AI 代替自己自动记住这些信息。此后,...

    推荐理由:来自IT之家 AI的《古尔曼:苹果 Apple Watch Series 12/Ultra 4 可自动记录用户每日活动并生成摘要》。重点看产品发布。摘要提到:IT之家 9 月 9 日消息,苹果将在北京时间明天凌晨发布新一代 Apple Watch 系列产品,彭博社记者马克 · 古尔曼(Mark Gurman)已经提前曝光了新品部分信息。 古尔曼称,Apple Watch Series 12 和 Apple Watch Ultra 4 将加入一项全新的 AI 功能,该功能可持续采集麦克风、全球定位系统以及其他传感器的数据,生成用户每日活动摘要,其中还包含对话总结。 古尔曼表示,这项功能不会保存音频录音。用户可以选择让它全天运行,也可以设置为仅在特定地点运行。生成的活动总结将存储在全新的 Siri 应用中。 IT之家注意到,这意味着 Apple Watch 将直接加入与其他公司近期 AI 可穿戴设备的竞争。这些产品都试图充当一种高度个性化的 AI 助手,帮助用户记录生活中的摘要、记忆并提供建议。 其核心理念是,用户不再需要手动记录那么多事情,而是让 AI 代替自己自动记住这些信息。此后,...

  8. IT之家 AI34

    微软 Win11 优化音频设置:音量滑块可显示实时活动

    IT之家 9 月 9 日消息,科技媒体 Windows Central 昨日(9 月 8 日)发布博文,报道称 今天面向 Beta 和 Experimental 通道推送的 Windows 11 预览版中 , 微软带来了全新的音频设置体验。 用户升级到 Windows 11 最新预览版,打开设置应用之后,可以在“声音设置”区域看到重新设计的音量滑块。用户在调整音量时,滑块侧边可显示后台音乐或视频播放产生的实时音频活动。 微软还继续把控制面板中的音频管理能力迁入“设置”,支持硬件加速的音频设备,可在设备属性的“高级”部分启用该选项。 IT之家附上 Windows 11 新预览版新增的声音设置列表: 微软优化声音设置中的音量滑块设计,在播放音频时,滑块会在侧边显示音频活动。 用户音频设备如果支持硬件加速,则可以在设备属性的“高级”部分中找到启用硬件加速的选项。 用户可以在音频设备属性的“高级”部分配置独占(exclusive)模式,...

    推荐理由:来自IT之家 AI的《微软 Win11 优化音频设置:音量滑块可显示实时活动》。重点看产品发布。摘要提到:IT之家 9 月 9 日消息,科技媒体 Windows Central 昨日(9 月 8 日)发布博文,报道称 今天面向 Beta 和 Experimental 通道推送的 Windows 11 预览版中 , 微软带来了全新的音频设置体验。 用户升级到 Windows 11 最新预览版,打开设置应用之后,可以在“声音设置”区域看到重新设计的音量滑块。用户在调整音量时,滑块侧边可显示后台音乐或视频播放产生的实时音频活动。 微软还继续把控制面板中的音频管理能力迁入“设置”,支持硬件加速的音频设备,可在设备属性的“高级”部分启用该选项。 IT之家附上 Windows 11 新预览版新增的声音设置列表: 微软优化声音设置中的音量滑块设计,在播放音频时,滑块会在侧边显示音频活动。 用户音频设备如果支持硬件加速,则可以在设备属性的“高级”部分中找到启用硬件加速的选项。 用户可以在音频设备属性的“高级”部分配置独占(exclusive)模式,...

  9. IT之家 AI36

    AZZA 推出 AI 工作站机箱 TRAIL,支持塔式 / 机架部署

    IT之家 9 月 9 日消息,以其异形机箱而广为人知的 PC 硬件品牌 AZZA 近日推出了一款造型常规的机箱产品 TRAIL。这一型号面向 AI 工作站用途, 可容纳 4 张双槽 370mm 扩展卡 , 支持塔式 / 机架部署 。 TRAIL 主要采用 1.0~1.2mm SGCC 钢板,提供 8 条 FHFL 扩展槽,兼容 SSI-EEB、E-ATX 与更小尺寸的主板,支持标准 ATX 与 2U CRPS 冗余电源,包含多卡支撑架。 其正面盖板后的面板包括 2 个 5.25" 盘位、1 个 3.5" 盘位、2 组 4 盘位 3.5" 硬盘笼,背板支持 12Gbps 速率;集成电源键、重启键、2 个 USB-A 5Gbps、1 个 USB-C 1 组 3.5mm 音频插孔。面板后的风扇支架集成 3 颗 12038 风扇,可替换为 360 液冷。 此外,该机箱在后方装有 2 颗 8038 规格 6300 RPM 高速风扇,底部支...

    推荐理由:来自IT之家 AI的《AZZA 推出 AI 工作站机箱 TRAIL,支持塔式 / 机架部署》。重点看产品发布。摘要提到:IT之家 9 月 9 日消息,以其异形机箱而广为人知的 PC 硬件品牌 AZZA 近日推出了一款造型常规的机箱产品 TRAIL。这一型号面向 AI 工作站用途, 可容纳 4 张双槽 370mm 扩展卡 , 支持塔式 / 机架部署 。 TRAIL 主要采用 1.0~1.2mm SGCC 钢板,提供 8 条 FHFL 扩展槽,兼容 SSI-EEB、E-ATX 与更小尺寸的主板,支持标准 ATX 与 2U CRPS 冗余电源,包含多卡支撑架。 其正面盖板后的面板包括 2 个 5.25" 盘位、1 个 3.5" 盘位、2 组 4 盘位 3.5" 硬盘笼,背板支持 12Gbps 速率;集成电源键、重启键、2 个 USB-A 5Gbps、1 个 USB-C 1 组 3.5mm 音频插孔。面板后的风扇支架集成 3 颗 12038 风扇,可替换为 360 液冷。 此外,该机箱在后方装有 2 颗 8038 规格 6300 RPM 高速风扇,底部支...

  10. IT之家 AI66

    Creative 带来 B3 条形音箱:4 发声单元,集成麦克风

    IT之家 9 月 9 日消息,Creative(创新科技)现已在电商平台上架 B3 条形音箱(回音壁)。其 搭载四大发声单元 , 内置降噪麦克风 ,集成 RGB 动态灯效,到手价低至 319 元。 Creative B3 配备山景音频 DSP 芯片 ,拥有游戏模式、7.1 环绕模式、音乐模式、影院模式 4 种均衡器预设,支持 AUX、USB-C、光纤、蓝牙 6.0 连接。 其内置 40mm 高频单元与 58mm 低频单元,高频单元频率响应范围 20~20000Hz,低频单元响应范围 20~300Hz,峰值功率合计可达 20W,支持 SBC 格式音频编解码,采用 USB-C 供电。

    推荐理由:来自IT之家 AI的《Creative 带来 B3 条形音箱:4 发声单元,集成麦克风》。重点看文化创意。摘要提到:IT之家 9 月 9 日消息,Creative(创新科技)现已在电商平台上架 B3 条形音箱(回音壁)。其 搭载四大发声单元 , 内置降噪麦克风 ,集成 RGB 动态灯效,到手价低至 319 元。 Creative B3 配备山景音频 DSP 芯片 ,拥有游戏模式、7.1 环绕模式、音乐模式、影院模式 4 种均衡器预设,支持 AUX、USB-C、光纤、蓝牙 6.0 连接。 其内置 40mm 高频单元与 58mm 低频单元,高频单元频率响应范围 20~20000Hz,低频单元响应范围 20~300Hz,峰值功率合计可达 20W,支持 SBC 格式音频编解码,采用 USB-C 供电。

  11. IT之家 AI68

    已修复:OpenAI 的 ChatGPT 生图功能出现故障,持续约 7.5 小时

    IT之家 9 月 9 日消息,OpenAI 官方状态页面显示, 从北京时间 9 月 8 日 22:32 到 9 月 9 日 05:59,旗下 ChatGPT 和 Images API 的图像生成功能出现故障,持续约 7 小时 27 分钟。 IT之家附上相关截图如下: 本次故障主要涉及 ChatGPT 的图像生成功能,以及面向开发者的 Images API。OpenAI 称,用户提交图像生成请求时出现更高频率的错误。 此外文件上传处理也受到影响,部分文件可能显示已完成上传,但仍停留在处理状态,暂时无法访问;另一些上传请求可能直接失败。 用户在提交图像生成提示词后,也可能看到系统返回错误。OpenAI 尚未披露故障的具体技术原因、受影响用户数量和预计恢复时间。

    推荐理由:来自IT之家 AI的《已修复:OpenAI 的 ChatGPT 生图功能出现故障,持续约 7.5 小时》。重点看产品发布。摘要提到:IT之家 9 月 9 日消息,OpenAI 官方状态页面显示, 从北京时间 9 月 8 日 22:32 到 9 月 9 日 05:59,旗下 ChatGPT 和 Images API 的图像生成功能出现故障,持续约 7 小时 27 分钟。 IT之家附上相关截图如下: 本次故障主要涉及 ChatGPT 的图像生成功能,以及面向开发者的 Images API。OpenAI 称,用户提交图像生成请求时出现更高频率的错误。 此外文件上传处理也受到影响,部分文件可能显示已完成上传,但仍停留在处理状态,暂时无法访问;另一些上传请求可能直接失败。 用户在提交图像生成提示词后,也可能看到系统返回错误。OpenAI 尚未披露故障的具体技术原因、受影响用户数量和预计恢复时间。

  12. IT之家 AI34

    全球首张 3×8 针 RTX 5090 显卡:900W 测试下线缆温度约 35℃

    IT之家 9 月 9 日消息,YouTube 频道 Teclab 昨日(9 月 8 日)发布视频,改装影驰(GALAX)的 HOF OC LAB 定制 RTX 5090 显卡,打造出全球首张 3×8 针供电的 RTX 5090 显卡。 IT之家援引视频介绍,原显卡采用 2 个 16 针电源接口, 改装后移除原有焊接和供电设计,换成 3 个 8 针接口。 改装团队在显卡 PCB 背面加装铜板,将线缆端部包覆并引出 24 根粗规格导线,再连接至 PCB 正面供电区域。整个方案共有 9 路 +12V 线路,每路电流为 8~8.5A。 为让显卡识别新的供电配置,Teclab 重新连接了 Sense 0 与 Sense 1 感测针脚。这样显卡可识别可用功率,并以最高可用功率状态工作。本次改装没有修改 BIOS 或软件,全部调整均在硬件层面完成。 测试中,Teclab 按 400W、500W、600W 和 900W 依次提高输入功率,同时监...

    推荐理由:来自IT之家 AI的《全球首张 3×8 针 RTX 5090 显卡:900W 测试下线缆温度约 35℃》。重点看产品发布。摘要提到:IT之家 9 月 9 日消息,YouTube 频道 Teclab 昨日(9 月 8 日)发布视频,改装影驰(GALAX)的 HOF OC LAB 定制 RTX 5090 显卡,打造出全球首张 3×8 针供电的 RTX 5090 显卡。 IT之家援引视频介绍,原显卡采用 2 个 16 针电源接口, 改装后移除原有焊接和供电设计,换成 3 个 8 针接口。 改装团队在显卡 PCB 背面加装铜板,将线缆端部包覆并引出 24 根粗规格导线,再连接至 PCB 正面供电区域。整个方案共有 9 路 +12V 线路,每路电流为 8~8.5A。 为让显卡识别新的供电配置,Teclab 重新连接了 Sense 0 与 Sense 1 感测针脚。这样显卡可识别可用功率,并以最高可用功率状态工作。本次改装没有修改 BIOS 或软件,全部调整均在硬件层面完成。 测试中,Teclab 按 400W、500W、600W 和 900W 依次提高输入功率,同时监...

  13. IT之家 AI76

    蚂蚁百灵系列首个原生多模态模型 Ling-3.0-flash-VL 发布开源,引入视觉反馈闭环机制

    IT之家 9 月 9 日消息,蚂蚁集团今日宣布推出并开源百灵系列首个原生多模态大模型 Ling-3.0-flash-VL。 该模型基于 Ling-3.0-flash 的 MoE(混合专家)架构拓展,总参数量为 124B,单次推理激活 5.5B 参数,原生支持图像、文本与视频输入,上下文窗口达到 256K Token。 模型围绕“更可靠、更高效完成真实任务”的方向,引入了视觉反馈闭环机制。不同于一次性的“看图生成”,该机制将任务推进为“观察 → 行动 → 验证 → 修正”的持续闭环,使模型在医疗报告解读、前端代码生成及 GUI 自动化等场景中能够基于视觉反馈持续修正执行结果。 在训练层面,蚂蚁集团表示,通过原生多模态联合训练,视觉信息的引入对模型的文本能力带来了正向提升。在 Artificial Analysis Intelligence Index v4.1.1 评估中,Ling-3.0-flash-VL 较纯文本版本(Ling...

    推荐理由:来自IT之家 AI的《蚂蚁百灵系列首个原生多模态模型 Ling-3.0-flash-VL 发布开源,引入视觉反馈闭环机制》。重点看模型能力与工程、文化创意、开源生态。摘要提到:IT之家 9 月 9 日消息,蚂蚁集团今日宣布推出并开源百灵系列首个原生多模态大模型 Ling-3.0-flash-VL。 该模型基于 Ling-3.0-flash 的 MoE(混合专家)架构拓展,总参数量为 124B,单次推理激活 5.5B 参数,原生支持图像、文本与视频输入,上下文窗口达到 256K Token。 模型围绕“更可靠、更高效完成真实任务”的方向,引入了视觉反馈闭环机制。不同于一次性的“看图生成”,该机制将任务推进为“观察 → 行动 → 验证 → 修正”的持续闭环,使模型在医疗报告解读、前端代码生成及 GUI 自动化等场景中能够基于视觉反馈持续修正执行结果。 在训练层面,蚂蚁集团表示,通过原生多模态联合训练,视觉信息的引入对模型的文本能力带来了正向提升。在 Artificial Analysis Intelligence Index v4.1.1 评估中,Ling-3.0-flash-VL 较纯文本版本(Ling...

  14. IT之家 AI36

    微软 Win11 自动深浅色模式已在路上:可按当地日出 / 日落时间或自定义时间触发

    IT之家 9 月 9 日消息,Windows 爱好者 PhantomOfEarth 发现,微软正在为 Windows 11 开发一项用户期待已久的功能 —— 自动深色模式定时切换。相关代码已经出现在 Experimental 实验预览版中。 根据其发现的多个字符串,该功能被命名为“Schedule auto mode”。微软将提供两种触发方式:一种是基于地理位置计算出当地的日出和日落时间进行自动切换;另一种是允许用户设置一个固定的时间,例如在夜间特定时段开启深色模式。 此外,相关代码还暗示了一个贴心的设计:为避免打断用户工作,Win11 只会在电脑“空闲”时进行主题切换。这意味着当用户正在打字、观看视频或进行演示时,屏幕不会突然切换主题。 目前,Windows 11 虽然允许用户在设置中手动选择浅色或深色模式,但一直缺乏原生的自动切换功能。用户若想实现这一效果,通常需要借助第三方脚本或 PowerToys 等工具。此次在预览版中...

    推荐理由:来自IT之家 AI的《微软 Win11 自动深浅色模式已在路上:可按当地日出 / 日落时间或自定义时间触发》。重点看文化创意。摘要提到:IT之家 9 月 9 日消息,Windows 爱好者 PhantomOfEarth 发现,微软正在为 Windows 11 开发一项用户期待已久的功能 —— 自动深色模式定时切换。相关代码已经出现在 Experimental 实验预览版中。 根据其发现的多个字符串,该功能被命名为“Schedule auto mode”。微软将提供两种触发方式:一种是基于地理位置计算出当地的日出和日落时间进行自动切换;另一种是允许用户设置一个固定的时间,例如在夜间特定时段开启深色模式。 此外,相关代码还暗示了一个贴心的设计:为避免打断用户工作,Win11 只会在电脑“空闲”时进行主题切换。这意味着当用户正在打字、观看视频或进行演示时,屏幕不会突然切换主题。 目前,Windows 11 虽然允许用户在设置中手动选择浅色或深色模式,但一直缺乏原生的自动切换功能。用户若想实现这一效果,通常需要借助第三方脚本或 PowerToys 等工具。此次在预览版中...

  15. Simon Willison83

    Introducing ChatGPT Images 2.5

    事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:Introducing ChatGPT Images 2.5 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息显示:Introducing ChatGPT Images 2.5 事实摘要:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意,原文信息。影响判断:它可能改变智能体工作流、模型能力与工程、文化创意相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程、文化创意方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、模型能力与工程、文化创意直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

9月8日周二
  1. IT之家 AI70

    达芬奇 DaVinci Resolve 21.1 发布,接入 Claude Code、ChatGPT Codex 等 AI 助手

    IT之家 9 月 8 日消息,Blackmagic Design 今天发布视频剪辑软件 DaVinci Resolve 21.1,接入多个人工智能助手。 据介绍, 本次更新将支持 Claude、Claude Code 和 ChatGPT Codex 等 AI 助手 ,使用户能够使用自然语言分析项目、整理媒体、调整设置和批量渲染。用户可要求 AI 助手从长视频中剪辑精彩片段、删除不需要的片段或渲染最终视频,减少重复劳动,将时间投入到创意构思中。 IT之家注意到,达芬奇的照片页面现已支持富士 GFX 和 X 系列、徕卡 SL 以及索尼 α7R VI 等相机,摄影师可直接导入照片,无需转换格式。本次更新还改进了改进多机位工作流程,并加入全新图形工具等。

    推荐理由:来自IT之家 AI的《达芬奇 DaVinci Resolve 21.1 发布,接入 Claude Code、ChatGPT Codex 等 AI 助手》。重点看智能体工作流、文化创意、产品发布。摘要提到:IT之家 9 月 8 日消息,Blackmagic Design 今天发布视频剪辑软件 DaVinci Resolve 21.1,接入多个人工智能助手。 据介绍, 本次更新将支持 Claude、Claude Code 和 ChatGPT Codex 等 AI 助手 ,使用户能够使用自然语言分析项目、整理媒体、调整设置和批量渲染。用户可要求 AI 助手从长视频中剪辑精彩片段、删除不需要的片段或渲染最终视频,减少重复劳动,将时间投入到创意构思中。 IT之家注意到,达芬奇的照片页面现已支持富士 GFX 和 X 系列、徕卡 SL 以及索尼 α7R VI 等相机,摄影师可直接导入照片,无需转换格式。本次更新还改进了改进多机位工作流程,并加入全新图形工具等。

  2. 爱范儿36

    实测全球上线的 vivago R1,我用它打造了一部赛博西游记短片

    事实摘要:实测全球上线的 vivago R1,我用它打造了一部赛博西游记短片 真正属于普通人的 AI 视频时代,才刚刚开始 #欢迎关注爱范儿官方微信公众号:爱范儿(微信号:ifanr),更多精彩内容第一时间为您奉上。 这条动态来自 爱范儿,可重点关注产品发布。 实测全球上线的 vivago R1,我用它打造了一部赛博西游记短片 真正属于普通人的 AI 视频时代,才刚刚。影响判断:它可能改变AI 应用价值相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪AI 应用价值方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和AI 应用价值直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  3. IT之家 AI70

    “傻瓜式”剪片:Adobe Premiere 更新 AI 功能,时间线上能直接生成音视频素材

    IT之家 9 月 8 日消息,Adobe 今天(8 日)宣布重新设计专业视频剪辑软件 Premiere 中的 AI 交互方式,新的“生成式媒体”工具支持直接在项目时间线中生成视频、音效、音乐和声景, 无需中断当前工作流程 。所使用的生成模型并非全都是新产品,这次更新的重点是大幅简化调用方式。 以往缺少补充镜头或音频素材时,编辑人员往往需要 在浏览器或外部应用之间来回切换 。更新后, 只需选中视频或音频轨道上的空白区域,即可根据项目上下文生成可完全编辑的片段 。 此外,时间线还可以直接调用多种底层模型,提供了 Adobe Firefly、谷歌 Veo、Runway、Luma 和可灵 ,便于用户根据项目风格选择合适的模型。 Premiere 还将增加一批处于测试阶段的 AI 音频工具, 可分离同时说话的不同人物、在人声出现时自动压低音乐音量 ,并单独调整对白和环境声。 据IT之家了解,Adobe 还将把 AI 助手引入特效编辑软件 ...

    推荐理由:来自IT之家 AI的《“傻瓜式”剪片:Adobe Premiere 更新 AI 功能,时间线上能直接生成音视频素材》。重点看智能体工作流、模型能力与工程、产品发布。摘要提到:IT之家 9 月 8 日消息,Adobe 今天(8 日)宣布重新设计专业视频剪辑软件 Premiere 中的 AI 交互方式,新的“生成式媒体”工具支持直接在项目时间线中生成视频、音效、音乐和声景, 无需中断当前工作流程 。所使用的生成模型并非全都是新产品,这次更新的重点是大幅简化调用方式。 以往缺少补充镜头或音频素材时,编辑人员往往需要 在浏览器或外部应用之间来回切换 。更新后, 只需选中视频或音频轨道上的空白区域,即可根据项目上下文生成可完全编辑的片段 。 此外,时间线还可以直接调用多种底层模型,提供了 Adobe Firefly、谷歌 Veo、Runway、Luma 和可灵 ,便于用户根据项目风格选择合适的模型。 Premiere 还将增加一批处于测试阶段的 AI 音频工具, 可分离同时说话的不同人物、在人声出现时自动压低音乐音量 ,并单独调整对白和环境声。 据IT之家了解,Adobe 还将把 AI 助手引入特效编辑软件 ...

  4. IT之家 AI34

    LG U+ 在韩国市场推出家庭安保订阅服务“Homecam Lite”,整合监控摄像头及保险

    IT之家 9 月 8 日消息,据韩媒 mbiz 报道,LG U+ 宣布在韩国市场推出一项整合了软硬件的家庭安保服务“Homecam Lite”,3 年合约期内月费为 5,500 韩元 (IT之家注:现汇率约合 27.5 元人民币) 。该服务将家庭摄像头、云端存储空间以及火灾和视频遭黑客攻击损失赔偿保险整合在一起,同时面向其他运营商宽带用户开放。 LG U+ 表示,近年来家庭摄像头的应用场景已不再局限于实时查看画面,而是逐渐拓展至宠物看护、婴幼儿照看等日常生活场景,成为智能家居物联网设备的一部分。LG U+ 的这一“Homecam Lite”服务计划可提供高性价比整合服务,为用户较为关注的安全问题提供解决方案。 “Homecam Lite”以 3 年合约为基础,月费 5,500 韩元 (现汇率约合 27.5 元人民币) ,主要面向新生儿父母以及宠物家庭等用户,相应服务还整合保险保障,发生火灾事故时最高可获 5,000 万韩元 (现...

    推荐理由:来自IT之家 AI的《LG U+ 在韩国市场推出家庭安保订阅服务“Homecam Lite”,整合监控摄像头及保险》。重点看多模态、政策/监管。摘要提到:IT之家 9 月 8 日消息,据韩媒 mbiz 报道,LG U+ 宣布在韩国市场推出一项整合了软硬件的家庭安保服务“Homecam Lite”,3 年合约期内月费为 5,500 韩元 (IT之家注:现汇率约合 27.5 元人民币) 。该服务将家庭摄像头、云端存储空间以及火灾和视频遭黑客攻击损失赔偿保险整合在一起,同时面向其他运营商宽带用户开放。 LG U+ 表示,近年来家庭摄像头的应用场景已不再局限于实时查看画面,而是逐渐拓展至宠物看护、婴幼儿照看等日常生活场景,成为智能家居物联网设备的一部分。LG U+ 的这一“Homecam Lite”服务计划可提供高性价比整合服务,为用户较为关注的安全问题提供解决方案。 “Homecam Lite”以 3 年合约为基础,月费 5,500 韩元 (现汇率约合 27.5 元人民币) ,主要面向新生儿父母以及宠物家庭等用户,相应服务还整合保险保障,发生火灾事故时最高可获 5,000 万韩元 (现...

  5. IT之家 AI34

    (更新:已恢复)腾讯微信团队致歉:视频号服务器出现抖动致部分功能异常,正在恢复中

    17:08 更新: 腾讯微信团队宣布已经全部恢复。 IT之家 9 月 8 日消息,腾讯微信团队官方微博今日发文, 刚刚视频号服务器出现了抖动,导致部分功能出现异常 ,目前正在火速恢复中,给大家带来了不好的体验,实在抱歉。 有IT之家小伙伴反馈,微信视频号出现异常,内容无法加载。 大家在 IT之家微信号 回复“ 微信 ”两字,即可获取当前最新官方内部版微信下载。

    推荐理由:来自IT之家 AI的《(更新:已恢复)腾讯微信团队致歉:视频号服务器出现抖动致部分功能异常,正在恢复中》。重点看多模态。摘要提到:17:08 更新: 腾讯微信团队宣布已经全部恢复。 IT之家 9 月 8 日消息,腾讯微信团队官方微博今日发文, 刚刚视频号服务器出现了抖动,导致部分功能出现异常 ,目前正在火速恢复中,给大家带来了不好的体验,实在抱歉。 有IT之家小伙伴反馈,微信视频号出现异常,内容无法加载。 大家在 IT之家微信号 回复“ 微信 ”两字,即可获取当前最新官方内部版微信下载。

  6. IT之家 AI70

    微软纳德拉发布 Opal:用户只需提目标,AI 跑全流程交付成品

    IT之家 9 月 8 日消息,微软首席执行官萨提亚 · 纳德拉(Satya Nadella)昨日(9 月 7 日)在 X 平台发布推文,宣布为 Microsoft 365 Copilot 推出全新 AI 功能 Project Opal, 定位是在可控的安全环境中,让用户规划和执行复杂、长周期任务的 AI 智能体。 微软表示 Project Opal 的核心,是在可控制、可追踪的环境内,是让 AI 从处理快速问题,逐步覆盖委派型工作和长期运行的自动化任务。用户交代任务后, 它可连续工作数小时或数天,自动完成“找素材、做表格、生成 PPT、发给同事”的完整流程。 在纳德拉展示的案例中,该功能可以分析 1 个月户外相机影像,AI 会浏览素材,找出全部动物出现画面,并截取其中表现较好的片段,制作精选视频。 系统会为每条动物记录补充相机来源、拍摄日期和物种标签。随后,它将全部记录汇入电子表格,便于用户检索和统计。 在资料整理完成后,Cop...

    推荐理由:来自IT之家 AI的《微软纳德拉发布 Opal:用户只需提目标,AI 跑全流程交付成品》。重点看智能体工作流、产品发布。摘要提到:IT之家 9 月 8 日消息,微软首席执行官萨提亚 · 纳德拉(Satya Nadella)昨日(9 月 7 日)在 X 平台发布推文,宣布为 Microsoft 365 Copilot 推出全新 AI 功能 Project Opal, 定位是在可控的安全环境中,让用户规划和执行复杂、长周期任务的 AI 智能体。 微软表示 Project Opal 的核心,是在可控制、可追踪的环境内,是让 AI 从处理快速问题,逐步覆盖委派型工作和长期运行的自动化任务。用户交代任务后, 它可连续工作数小时或数天,自动完成“找素材、做表格、生成 PPT、发给同事”的完整流程。 在纳德拉展示的案例中,该功能可以分析 1 个月户外相机影像,AI 会浏览素材,找出全部动物出现画面,并截取其中表现较好的片段,制作精选视频。 系统会为每条动物记录补充相机来源、拍摄日期和物种标签。随后,它将全部记录汇入电子表格,便于用户检索和统计。 在资料整理完成后,Cop...

  7. IT之家 AI70

    DeepSeek V4.1 Flash 中间版本内测:新模型结构,原生多模态支持,更快更强、成本更低

    IT之家 9 月 8 日消息,据IT之家小伙伴反馈,DeepSeek 今日在官方交流群内发布通知, DeepSeek V4.1 Flash 的中间版本内测 ,采用了新的模型结构,原生多模态支持、能力更强、速度更快、成本更低。 内测用户可保持 base_url 不变,将模型名设置为 deepseek-v4.1-flash-expires-on-0910 即可调用,当前计费与 deepseek-v4-flash 相同,每账号限流 20 并发。 而在反馈问卷中,DeepSeek 官方询问用户,DeepSeek V4.1 Flash 中间版本能否全面替换线上的 DeepSeek V4 Pro。 综合IT之家此前报道, DeepSeek-V4-Flash 正式版 API 于 7 月底上线公测 ,Agent 能力大幅增强。 8 月 21 日, DeepSeek-V4-Flash-Vision-Exp 多模态视觉理解模型 上线 DeepSee...

    推荐理由:来自IT之家 AI的《DeepSeek V4.1 Flash 中间版本内测:新模型结构,原生多模态支持,更快更强、成本更低》。重点看智能体工作流、模型能力与工程、产品发布。摘要提到:IT之家 9 月 8 日消息,据IT之家小伙伴反馈,DeepSeek 今日在官方交流群内发布通知, DeepSeek V4.1 Flash 的中间版本内测 ,采用了新的模型结构,原生多模态支持、能力更强、速度更快、成本更低。 内测用户可保持 base_url 不变,将模型名设置为 deepseek-v4.1-flash-expires-on-0910 即可调用,当前计费与 deepseek-v4-flash 相同,每账号限流 20 并发。 而在反馈问卷中,DeepSeek 官方询问用户,DeepSeek V4.1 Flash 中间版本能否全面替换线上的 DeepSeek V4 Pro。 综合IT之家此前报道, DeepSeek-V4-Flash 正式版 API 于 7 月底上线公测 ,Agent 能力大幅增强。 8 月 21 日, DeepSeek-V4-Flash-Vision-Exp 多模态视觉理解模型 上线 DeepSee...

  8. IT之家 AI34

    尼康宣布正在开发九款尼克尔 Z CINEMA T1.9 VV 系列电影镜头

    IT之家 9 月 8 日消息,尼康中国今日宣布正在开发 尼克尔 Z CINEMA T1.9 VV 系列电影镜头 ,专为电影行业、高端影视作品和创摄者设计。 该系列将包含九款镜头 ,其中一款是尼克尔 Z CINEMA 50mm T1.9 VV。 尼康中国表示,尼克尔 Z CINEMA T1.9 VV 系列镜头将是首个像圈足以覆盖 V-RAPTOR [X] VV 传感器(尺寸大于全画幅传感器)的尼克尔镜头产品线。 同时, 该系列镜头还将配备高精度自动对焦系统 ,以支持创作者的工作流程。 IT之家注:V-RAPTOR [X] VV 传感器指尼康旗下电影机厂商 RED 开发的 40.96mm x 21.60mm 图像传感器。

    推荐理由:来自IT之家 AI的《尼康宣布正在开发九款尼克尔 Z CINEMA T1.9 VV 系列电影镜头》。重点看智能体工作流、产品发布。摘要提到:IT之家 9 月 8 日消息,尼康中国今日宣布正在开发 尼克尔 Z CINEMA T1.9 VV 系列电影镜头 ,专为电影行业、高端影视作品和创摄者设计。 该系列将包含九款镜头 ,其中一款是尼克尔 Z CINEMA 50mm T1.9 VV。 尼康中国表示,尼克尔 Z CINEMA T1.9 VV 系列镜头将是首个像圈足以覆盖 V-RAPTOR [X] VV 传感器(尺寸大于全画幅传感器)的尼克尔镜头产品线。 同时, 该系列镜头还将配备高精度自动对焦系统 ,以支持创作者的工作流程。 IT之家注:V-RAPTOR [X] VV 传感器指尼康旗下电影机厂商 RED 开发的 40.96mm x 21.60mm 图像传感器。

  9. IT之家 AI36

    瑞士启动 3000 台电脑迁移试点,900 万法郎推动开源替代微软 M365

    IT之家 9 月 8 日消息,科技媒体 Windows Central 昨日(9 月 7 日)发布博文,报道称瑞士联邦委员会已启动试点项目, 覆盖约 3,000 台政府电脑,测试德国开发的开源协作套件 openDesk,探索替代 Microsoft 365 的可行性。 本次试点项目的推进初衷是维护瑞士的数字主权,减少对单一海外技术供应商的依赖,让瑞士政府能够自主掌控关键数据、软件、基础设施和技术决策。 在本次试点项目启动之前,瑞士此前已展开概念验证(PoC)测试,邀请 172 名政府公职人员测试,测试者对文档处理、文件存储、协作、邮件和日历功能给出积极评价。该平台也可能在 Microsoft 365 发生中断后,承担部分应急办公任务。 概念验证同时显示,大型视频会议存在功能限制。瑞士方面指出,后续建设还需要完成大量适配、安全评估、平台验证和能力建设,并可能需要追加建设及运营资金。 基于概念验证(PoC)测试结果,瑞士进一步推动试...

    推荐理由:来自IT之家 AI的《瑞士启动 3000 台电脑迁移试点,900 万法郎推动开源替代微软 M365》。重点看开源生态、产品发布。摘要提到:IT之家 9 月 8 日消息,科技媒体 Windows Central 昨日(9 月 7 日)发布博文,报道称瑞士联邦委员会已启动试点项目, 覆盖约 3,000 台政府电脑,测试德国开发的开源协作套件 openDesk,探索替代 Microsoft 365 的可行性。 本次试点项目的推进初衷是维护瑞士的数字主权,减少对单一海外技术供应商的依赖,让瑞士政府能够自主掌控关键数据、软件、基础设施和技术决策。 在本次试点项目启动之前,瑞士此前已展开概念验证(PoC)测试,邀请 172 名政府公职人员测试,测试者对文档处理、文件存储、协作、邮件和日历功能给出积极评价。该平台也可能在 Microsoft 365 发生中断后,承担部分应急办公任务。 概念验证同时显示,大型视频会议存在功能限制。瑞士方面指出,后续建设还需要完成大量适配、安全评估、平台验证和能力建设,并可能需要追加建设及运营资金。 基于概念验证(PoC)测试结果,瑞士进一步推动试...

  10. IT之家 AI72

    微信 WeMM-Embedding 多模态模型已在微信大规模使用:覆盖朋友圈搜索等,每天调用量 10 亿次

    IT之家 9 月 8 日消息,微信 AI 官方在 9 月 4 日宣布, 将通用多模态嵌入模型 WeMM-Embedding 开源 ,包含 2B、4B、9B 三个版本,支持文本、图像、视频、视觉文档以及任意交错的多模态输入。 据微信员工 @客村小蒋 分享,微信视觉团队最近开源的多模态模型 WeMM-Embedding 简单说就是让系统能同时理解文字、图片和视频,把它们放在同一个语义空间里去比较和检索。 他透露, 这个模型已经在微信里大规模用了 —— 朋友圈搜索、视频号推荐、公众号推荐、微信电商都在用 ,每天调用量 10 亿次。 在国际权威榜单 MMEB-v2 上拿了第一 ,超过此前所有已提交的开源与闭源模型。 IT之家附相关链接: 论文链接: https://arxiv.org/abs/2608.24053 代码仓库: https://github.com/Tencent/WeMM-Embedding 模型集合: https://...

    推荐理由:来自IT之家 AI的《微信 WeMM-Embedding 多模态模型已在微信大规模使用:覆盖朋友圈搜索等,每天调用量 10 亿次》。重点看模型能力与工程、开源生态。摘要提到:IT之家 9 月 8 日消息,微信 AI 官方在 9 月 4 日宣布, 将通用多模态嵌入模型 WeMM-Embedding 开源 ,包含 2B、4B、9B 三个版本,支持文本、图像、视频、视觉文档以及任意交错的多模态输入。 据微信员工 @客村小蒋 分享,微信视觉团队最近开源的多模态模型 WeMM-Embedding 简单说就是让系统能同时理解文字、图片和视频,把它们放在同一个语义空间里去比较和检索。 他透露, 这个模型已经在微信里大规模用了 —— 朋友圈搜索、视频号推荐、公众号推荐、微信电商都在用 ,每天调用量 10 亿次。 在国际权威榜单 MMEB-v2 上拿了第一 ,超过此前所有已提交的开源与闭源模型。 IT之家附相关链接: 论文链接: https://arxiv.org/abs/2608.24053 代码仓库: https://github.com/Tencent/WeMM-Embedding 模型集合: https://...

  11. 极客公园68

    传字节开发实时空间视频生成模型;微信内测「AI 社交」功能;华为小米同天发布折叠屏手机

    消息称字节正开发实时空间视频生成 AI 模型:最快下个月发布 9 月 7 日消息,据彭博社报道,字节跳动正准备推出一款实时空间视频生成 AI 模型。该模型计划最早于下月发布。 知情人士指出,发布时间尚未最终确定,计划仍可能发生变动。 据介绍,该模型基于字节跳动现有的电影级视频生成 AI 模型 Seedance 构建,将允许用户面向直播、短剧和游戏创建交互式虚拟世界。字节跳动发言人未回应置评请求。 知情人士称,字节跳动此次将空间视频模型定位为驱动整个生态的「飞轮(Flywheel)」——该模型能够将用户置于高度沉浸的三维虚拟环境中,功能与谷歌的 Genie 类似。字节跳动得以将其自研 AI 模型、云计算底层资源,与旗下的内容平台以及 XR 业务分支 Pico 的硬件终端深度串联、协同发力。 字节跳动最新的模型旨在生成能够响应 Pico 头显用户语音或动作的虚拟世界。该模型致力于将生成空间内容这一计算密集型任...

    推荐理由:来自极客公园的《传字节开发实时空间视频生成模型;微信内测「AI 社交」功能;华为小米同天发布折叠屏手机》。重点看模型能力与工程、产品发布。摘要提到:消息称字节正开发实时空间视频生成 AI 模型:最快下个月发布 9 月 7 日消息,据彭博社报道,字节跳动正准备推出一款实时空间视频生成 AI 模型。该模型计划最早于下月发布。 知情人士指出,发布时间尚未最终确定,计划仍可能发生变动。 据介绍,该模型基于字节跳动现有的电影级视频生成 AI 模型 Seedance 构建,将允许用户面向直播、短剧和游戏创建交互式虚拟世界。字节跳动发言人未回应置评请求。 知情人士称,字节跳动此次将空间视频模型定位为驱动整个生态的「飞轮(Flywheel)」——该模型能够将用户置于高度沉浸的三维虚拟环境中,功能与谷歌的 Genie 类似。字节跳动得以将其自研 AI 模型、云计算底层资源,与旗下的内容平台以及 XR 业务分支 Pico 的硬件终端深度串联、协同发力。 字节跳动最新的模型旨在生成能够响应 Pico 头显用户语音或动作的虚拟世界。该模型致力于将生成空间内容这一计算密集型任...

  12. IT之家 AI36

    法拉第未来机器人 8 月销量 158 台再创新高,累销已突破 552 台

    IT之家 9 月 8 日消息,贾跃亭今早发布视频宣布, 法拉第未来 EAI 机器人本体销售及出货量达 158 台,再创单月新高 。 贾跃亭表示, 自 2 月启动交付以来,截至 8 月底,机器人累计销售及出货量已达到 552 台 。这为打赢 Q3 机器人实用化战役、冲刺全年 2000 台目标提供了有力支撑。 据IT之家此前报道, 8 月初,贾跃亭宣布 FF EAI 机器人 7 月实现销售及出货 152 台,创单月新高 。据其此前公布的消息,今年 6 月,FF EAI 机器人的销售、出货及交付量达到 105 台,3-6 月累计 242 台,超额完成原定的 220 台目标。 根据规划,法拉第未来计划于 9 月底举行 FF EAI 机器人首场中东发布会,加快拓展中东市场。今年 8 月底,法拉第未来(FF)机器人中东业务正式启航,完成了中东首笔订单的销售及交付,共交付 6 台机器人(2 台人形、4 台四足)。

    推荐理由:来自IT之家 AI的《法拉第未来机器人 8 月销量 158 台再创新高,累销已突破 552 台》。重点看产品发布。摘要提到:IT之家 9 月 8 日消息,贾跃亭今早发布视频宣布, 法拉第未来 EAI 机器人本体销售及出货量达 158 台,再创单月新高 。 贾跃亭表示, 自 2 月启动交付以来,截至 8 月底,机器人累计销售及出货量已达到 552 台 。这为打赢 Q3 机器人实用化战役、冲刺全年 2000 台目标提供了有力支撑。 据IT之家此前报道, 8 月初,贾跃亭宣布 FF EAI 机器人 7 月实现销售及出货 152 台,创单月新高 。据其此前公布的消息,今年 6 月,FF EAI 机器人的销售、出货及交付量达到 105 台,3-6 月累计 242 台,超额完成原定的 220 台目标。 根据规划,法拉第未来计划于 9 月底举行 FF EAI 机器人首场中东发布会,加快拓展中东市场。今年 8 月底,法拉第未来(FF)机器人中东业务正式启航,完成了中东首笔订单的销售及交付,共交付 6 台机器人(2 台人形、4 台四足)。

  13. IT之家 AI38

    《暗影蜘蛛侠》电视剧 8 集收官:5 项艾美奖与取消续订同周发生

    IT之家 9 月 8 日消息,科技媒体 macobserver 昨日(9 月 7 日)发布博文,报道称亚马逊 Prime Video 真人超级英雄电视剧《暗影蜘蛛侠》(Spider-Noir)在 2026 年创意艺术艾美奖上斩获 5 项大奖后,但是 Prime Video 已在数日前宣布不再续订第 2 季。 IT之家查询公开资料,《暗影蜘蛛侠》(Spider-Man Noir / Spider-Noir)是一部基于漫威漫画《蜘蛛侠:暗影》改编的真人剧集,由尼古拉斯 · 凯奇主演,背景设定在 1930 年代大萧条时期的纽约,讲述一位年迈私家侦探被迫重拾“城市唯一超级英雄”身份的故事。 该真人剧集第一季共 8 集,于 2026 年 5 月 25 日在美国 MGM+ 频道首播,5 月 27 日在 Prime Video 全球上线,官方提供黑白版与全彩版两种观看模式,观众可自由选择。 演员方面,尼古拉斯 · 凯奇(Nicolas Cag...

    推荐理由:来自IT之家 AI的《《暗影蜘蛛侠》电视剧 8 集收官:5 项艾美奖与取消续订同周发生》。重点看文化创意、产品发布。摘要提到:IT之家 9 月 8 日消息,科技媒体 macobserver 昨日(9 月 7 日)发布博文,报道称亚马逊 Prime Video 真人超级英雄电视剧《暗影蜘蛛侠》(Spider-Noir)在 2026 年创意艺术艾美奖上斩获 5 项大奖后,但是 Prime Video 已在数日前宣布不再续订第 2 季。 IT之家查询公开资料,《暗影蜘蛛侠》(Spider-Man Noir / Spider-Noir)是一部基于漫威漫画《蜘蛛侠:暗影》改编的真人剧集,由尼古拉斯 · 凯奇主演,背景设定在 1930 年代大萧条时期的纽约,讲述一位年迈私家侦探被迫重拾“城市唯一超级英雄”身份的故事。 该真人剧集第一季共 8 集,于 2026 年 5 月 25 日在美国 MGM+ 频道首播,5 月 27 日在 Prime Video 全球上线,官方提供黑白版与全彩版两种观看模式,观众可自由选择。 演员方面,尼古拉斯 · 凯奇(Nicolas Cag...

  14. Simon Willison82

    Video compressor

    事实摘要:这条英文动态主要涉及智能体工作流、文化创意,原文信息显示:Video compressor 事实摘要:这条英文动态主要涉及智能体工作流、文化创意,原文信息显示:Video compressor 事实摘要:这条英文动态主要涉及智能体工作流、文化创意,原文信息显示:Video compressor 事实摘要:这条英文动态主要涉及智能体工作流、文化创意,原文信息显。影响判断:它可能改变智能体工作流、文化创意相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、文化创意方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和智能体工作流、文化创意直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

9月7日周一
  1. IT之家 AI74

    OpenAI GPT-6 Astra 模型自主通关 3D 解谜游戏《传送门》:耗时 24 小时,成本 571 美元

    IT之家 9 月 7 日消息,一名 AI 和大语言模型爱好者近日进行了一项实验,让 OpenAI 的新模型 GPT-6 Astra 自主通关了 Valve 旗下 3D 解谜游戏《传送门》。 从结果来看,这对大语言模型而言无疑是极具突破性的进步,也是对多模态“AI 智能”的一次颇具说服力的展示。不久之前,AI 甚至还会在 Atari 2600 国际象棋游戏中输掉比赛,而如今已经能够自主通关整个 3D 解谜游戏。 这次《传送门》通关过程共进行了 3336 次工具调用,按照 API 价格计算,成本达 571.18 美元 (IT之家注:现汇率约合 3,838 元人民币) 。 实验发起者 CozyBlaze 随后澄清称,这些成本实际上由其每月 200 美元 (现汇率约合 1,344 元人民币) 的 Codex Pro 订阅服务覆盖。 CozyBlaze 解释称:“模型通过 MCP,也就是 Model Context Protocol,以及...

    推荐理由:来自IT之家 AI的《OpenAI GPT-6 Astra 模型自主通关 3D 解谜游戏《传送门》:耗时 24 小时,成本 571 美元》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 7 日消息,一名 AI 和大语言模型爱好者近日进行了一项实验,让 OpenAI 的新模型 GPT-6 Astra 自主通关了 Valve 旗下 3D 解谜游戏《传送门》。 从结果来看,这对大语言模型而言无疑是极具突破性的进步,也是对多模态“AI 智能”的一次颇具说服力的展示。不久之前,AI 甚至还会在 Atari 2600 国际象棋游戏中输掉比赛,而如今已经能够自主通关整个 3D 解谜游戏。 这次《传送门》通关过程共进行了 3336 次工具调用,按照 API 价格计算,成本达 571.18 美元 (IT之家注:现汇率约合 3,838 元人民币) 。 实验发起者 CozyBlaze 随后澄清称,这些成本实际上由其每月 200 美元 (现汇率约合 1,344 元人民币) 的 Codex Pro 订阅服务覆盖。 CozyBlaze 解释称:“模型通过 MCP,也就是 Model Context Protocol,以及...