跳到正文
9月4日周五
  1. 量子位64

    新版GPT Image 2.5已经能伪造GPT-6发布会了

    改进GPT Image 2的噪点问题 这条动态来自 量子位,可重点关注产品发布。

    推荐理由:来自量子位的《新版GPT Image 2.5已经能伪造GPT-6发布会了》。重点看产品发布。摘要提到:改进GPT Image 2的噪点问题 这条动态来自 量子位,可重点关注产品发布。

9月3日周四
  1. IT之家 AI66

    我国推进新一代全火星地质图编制工作,计划 2028 年底完成 1:500 万比例的 1.0 版

    IT之家 9 月 3 日消息,据新华社报道,中国科学院院士、天问三号任务首席科学家侯增谦在采访中透露,我国正在推进的一项重要工作 —— 新一代全火星地质图编制,以“数据驱动、智能编图”为核心理念,充分利用天问一号任务探测数据,统筹多源国际数据,融合影像、光谱、雷达、重力等多模态信息,突出对火星地质演化的科学新认知,引入人工智能编研新技术实现智能地质解译。 这将是全球首版智能化火星地质图,计划 2028 年底完成 1:500 万全火星地质图 1.0 版 。火星取样返回既是工程能力的集中检验,也是行星科学学科发展的重要牵引,其辐射带动效应将覆盖技术、学科、能力等多个层面。它体现了我国深空探测进一步向科学目标与工程能力深度融合发展,以重大科学问题牵引任务设计和工程实施。 图源:Pexels 此外,我国天问三号计划于 2028 年前后发射、2031 年前后携火星样品返回地球,有望成为 人类历史上首个火星取样返回任务 。这项任务将推动天体...

    推荐理由:来自IT之家 AI的《我国推进新一代全火星地质图编制工作,计划 2028 年底完成 1:500 万比例的 1.0 版》。重点看多模态、部署/工程。摘要提到:IT之家 9 月 3 日消息,据新华社报道,中国科学院院士、天问三号任务首席科学家侯增谦在采访中透露,我国正在推进的一项重要工作 —— 新一代全火星地质图编制,以“数据驱动、智能编图”为核心理念,充分利用天问一号任务探测数据,统筹多源国际数据,融合影像、光谱、雷达、重力等多模态信息,突出对火星地质演化的科学新认知,引入人工智能编研新技术实现智能地质解译。 这将是全球首版智能化火星地质图,计划 2028 年底完成 1:500 万全火星地质图 1.0 版 。火星取样返回既是工程能力的集中检验,也是行星科学学科发展的重要牵引,其辐射带动效应将覆盖技术、学科、能力等多个层面。它体现了我国深空探测进一步向科学目标与工程能力深度融合发展,以重大科学问题牵引任务设计和工程实施。 图源:Pexels 此外,我国天问三号计划于 2028 年前后发射、2031 年前后携火星样品返回地球,有望成为 人类历史上首个火星取样返回任务 。这项任务将推动天体...

  2. IT之家 AI38

    小红书治理 AI 制作虚假探店、民宿内容,今年 6-8 月清理相关内容近 12 万条

    IT之家 9 月 3 日消息,小红书官方账号“薯管家”今日发布《关于 AI 制作医美、民宿等虚假内容治理公告》,宣布将 AI 制作发布虚假内容纳入常态化治理。 IT之家从公告获悉,小红书近期发现部分账号利用 AI 生成虚假体验笔记,用 AI 生成或拼接的图片伪造实景, 杜撰探店、住宿、就医、美容等使用体验等内容 ,误导用户决策。 小红书积极响应主管部门相关管理要求,切实履行平台主体责任,已将 AI 制作发布虚假内容纳入常态化治理。平台从三方面加大治理力度: 一是细化管控重点,以 AI 生成图片伪造实景、AI 批量生成同质化体验笔记、虚构亲历经历为高风险场景重点识别,文旅住宿、医疗医美、教育、房产等品类优先覆盖; 二是聚焦存量清理,从笔记、评论、账号等多环节清理历史虚假内容; 三是增补策略严控新增,同步强化未标识 AI 内容的识别能力,对同一图片或视频跨地域、跨账号重复使用的情形加强检测。 今年 6-8 月, 平台清理处置 AI ...

    推荐理由:来自IT之家 AI的《小红书治理 AI 制作虚假探店、民宿内容,今年 6-8 月清理相关内容近 12 万条》。重点看教育应用、产品发布。摘要提到:IT之家 9 月 3 日消息,小红书官方账号“薯管家”今日发布《关于 AI 制作医美、民宿等虚假内容治理公告》,宣布将 AI 制作发布虚假内容纳入常态化治理。 IT之家从公告获悉,小红书近期发现部分账号利用 AI 生成虚假体验笔记,用 AI 生成或拼接的图片伪造实景, 杜撰探店、住宿、就医、美容等使用体验等内容 ,误导用户决策。 小红书积极响应主管部门相关管理要求,切实履行平台主体责任,已将 AI 制作发布虚假内容纳入常态化治理。平台从三方面加大治理力度: 一是细化管控重点,以 AI 生成图片伪造实景、AI 批量生成同质化体验笔记、虚构亲历经历为高风险场景重点识别,文旅住宿、医疗医美、教育、房产等品类优先覆盖; 二是聚焦存量清理,从笔记、评论、账号等多环节清理历史虚假内容; 三是增补策略严控新增,同步强化未标识 AI 内容的识别能力,对同一图片或视频跨地域、跨账号重复使用的情形加强检测。 今年 6-8 月, 平台清理处置 AI ...

  3. IT之家 AI68

    图像编辑器 Paint.NET 首次登陆 Linux:开发者称 AI 辅助 3 周进展超 12 年总和

    IT之家 9 月 3 日消息,开发者里克 · 布鲁斯特(Rick Brewster)于 9 月 1 日在 X 平台发布推文,宣布发布 Paint.NET 5.2 Build 9739 版, 通过 Wine 首次实验性支持 Linux 平台。 布鲁斯特表示在开发过程中,遇到的最大障碍在于 Direct2D,这是微软专为 Windows 系统打造的 2D 图形 API,而 Paint.NET 长期依赖其完成界面与图像渲染。 由于 Wine 对 Direct2D 的原生支持并不完善,Brewster 没有选择等待,而是自行开发了内部替代方案,实现了软件所需的核心图形 API 功能。 布鲁斯特透露,得益于 AI 编程工具 Claude Code 的协助,此次 Linux 移植工作仅耗时约 3 周,取得的进展超过此前 12 年间历次尝试的总和。 尽管取得阶段性突破,布鲁斯特坦言当前实现仍存在运行缓慢、bug 频发,对于普通用户而言,目前还...

    推荐理由:来自IT之家 AI的《图像编辑器 Paint.NET 首次登陆 Linux:开发者称 AI 辅助 3 周进展超 12 年总和》。重点看产品发布。摘要提到:IT之家 9 月 3 日消息,开发者里克 · 布鲁斯特(Rick Brewster)于 9 月 1 日在 X 平台发布推文,宣布发布 Paint.NET 5.2 Build 9739 版, 通过 Wine 首次实验性支持 Linux 平台。 布鲁斯特表示在开发过程中,遇到的最大障碍在于 Direct2D,这是微软专为 Windows 系统打造的 2D 图形 API,而 Paint.NET 长期依赖其完成界面与图像渲染。 由于 Wine 对 Direct2D 的原生支持并不完善,Brewster 没有选择等待,而是自行开发了内部替代方案,实现了软件所需的核心图形 API 功能。 布鲁斯特透露,得益于 AI 编程工具 Claude Code 的协助,此次 Linux 移植工作仅耗时约 3 周,取得的进展超过此前 12 年间历次尝试的总和。 尽管取得阶段性突破,布鲁斯特坦言当前实现仍存在运行缓慢、bug 频发,对于普通用户而言,目前还...

  4. 极客公园78

    AI 下一场竞争:谁能成为 Agent 的「上下文操作系统」

    头图来源:视觉中国 前段时间,Anthropic 发布了 Model Hardware Standard,尝试给 AI Agent 建立一套与硬件沟通的通用语言。接入这套标准后,显微镜、机械臂等不同厂商、不同接口的设备,可以被 Agent 发现、理解和调用。 这件事指向了 AI 行业正在发生的一次变化。过去一年,竞争主要围绕模型的推理、生成和多模态能力展开;如今,Agent 开始走出聊天窗口,进入实验室、工厂和企业现场。行业的问题随之向下移动:模型已经足够聪明之后,谁来连接工具、硬件、数据和任务? 9 月 2 日,腾讯 WorkBuddy 宣布面向更多伙伴开放合作。通达信、广发证券、北大法宝、腾讯 SSV 教师助手、微盟、北森、云帐房、帆软等应用与软件伙伴进入生态;Plaud、Rokid、影石、优篮子、科大讯飞、安克、猛玛、京造等硬件伙伴,也共同构成了 WorkBuddy 的生态版图。 一款 AI 产品为什么要同时连接专业软件、...

    推荐理由:来自极客公园的《AI 下一场竞争:谁能成为 Agent 的「上下文操作系统」》。重点看智能体工作流、模型能力与工程、教育应用。摘要提到:头图来源:视觉中国 前段时间,Anthropic 发布了 Model Hardware Standard,尝试给 AI Agent 建立一套与硬件沟通的通用语言。接入这套标准后,显微镜、机械臂等不同厂商、不同接口的设备,可以被 Agent 发现、理解和调用。 这件事指向了 AI 行业正在发生的一次变化。过去一年,竞争主要围绕模型的推理、生成和多模态能力展开;如今,Agent 开始走出聊天窗口,进入实验室、工厂和企业现场。行业的问题随之向下移动:模型已经足够聪明之后,谁来连接工具、硬件、数据和任务? 9 月 2 日,腾讯 WorkBuddy 宣布面向更多伙伴开放合作。通达信、广发证券、北大法宝、腾讯 SSV 教师助手、微盟、北森、云帐房、帆软等应用与软件伙伴进入生态;Plaud、Rokid、影石、优篮子、科大讯飞、安克、猛玛、京造等硬件伙伴,也共同构成了 WorkBuddy 的生态版图。 一款 AI 产品为什么要同时连接专业软件、...

  5. 爱范儿50

    能让谷歌逆风翻盘的AI,可能不是 Gemini

    事实摘要:能让谷歌逆风翻盘的AI,可能不是 Gemini 无人在意的角落,Google 让视频像网页一样可以被灵魂拷问了 #欢迎关注爱范儿官方微信公众号:爱范儿(微信号:ifanr),更多精彩内容第一时间为您奉上。 这条动态来自 爱范儿,可重点关注其对 AI 应用和产业节奏的影响。 能让谷歌逆风翻盘的AI,可能不是 Gemini 无人在意的角落,Google 让视频像。影响判断:它可能改变AI 应用价值相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪AI 应用价值方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和AI 应用价值直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  6. IT之家 AI34

    AOC 带来 Q27U4D 显示器:26.5" QHD 144Hz QD-OLED

    IT之家 9 月 3 日消息,AOC 八月末在官网上线了 Q27U4D 显示器。这一型号采用 26.5" QHD 144Hz QD-OLED 面板,搭载 AGLR 防眩光低反射技术。 Q27U4D 全屏亮度 200nits、 HDR APL 10% 亮度 400nits ;色域 100% sRGB / 99% DCI-P3,sRGB 下色偏 ΔE<1;拥有 0.03ms 灰阶 (GtG) 响应时间与 1.5M:1 静态对比度,支持 VRR 可变刷新率、MBR 低运动模糊技术。 其提供 HDMI 2.1 TMDS、DisplayPort 1.4、3.5mm 音频输出插孔, 集成 USB Hub ,提供全功能 USB-C 上行 (96W PD-out)、4 个 USB 10Gbps 下行等接口,支持 KVM 切换; 集成 2 个 5W 扬声器 ;原装支架允许四向调节。

    推荐理由:来自IT之家 AI的《AOC 带来 Q27U4D 显示器:26.5" QHD 144Hz QD-OLED》。重点看产品发布。摘要提到:IT之家 9 月 3 日消息,AOC 八月末在官网上线了 Q27U4D 显示器。这一型号采用 26.5" QHD 144Hz QD-OLED 面板,搭载 AGLR 防眩光低反射技术。 Q27U4D 全屏亮度 200nits、 HDR APL 10% 亮度 400nits ;色域 100% sRGB / 99% DCI-P3,sRGB 下色偏 ΔE<1;拥有 0.03ms 灰阶 (GtG) 响应时间与 1.5M:1 静态对比度,支持 VRR 可变刷新率、MBR 低运动模糊技术。 其提供 HDMI 2.1 TMDS、DisplayPort 1.4、3.5mm 音频输出插孔, 集成 USB Hub ,提供全功能 USB-C 上行 (96W PD-out)、4 个 USB 10Gbps 下行等接口,支持 KVM 切换; 集成 2 个 5W 扬声器 ;原装支架允许四向调节。

  7. IT之家 AI34

    《漫威金刚狼》游戏 32 套金刚狼战衣曝光,多款利爪外观同步流出

    IT之家 9 月 3 日消息,游戏媒体 mp1st 昨日(9 月 2 日)发布博文, 爆料分享了《漫威金刚狼》游戏中的 32 套金刚狼战衣,以及多款利爪外观。 IT之家附上相关演示视频如下: 《漫威金刚狼》(Marvel's Wolverine)游戏由 Insomniac Games 开发,计划以独占形式,于 9 月 15 日在索尼 PlayStation 5 平台发行。 该媒体分享了 32 套金刚狼战衣,其中包括金刚狼在动画版《X-Men》中使用的经典服装,并出现了多款利爪外观。该媒体还认为战衣和利爪可供玩家独立选择,不会绑定关联。

    推荐理由:来自IT之家 AI的《《漫威金刚狼》游戏 32 套金刚狼战衣曝光,多款利爪外观同步流出》。重点看产品发布。摘要提到:IT之家 9 月 3 日消息,游戏媒体 mp1st 昨日(9 月 2 日)发布博文, 爆料分享了《漫威金刚狼》游戏中的 32 套金刚狼战衣,以及多款利爪外观。 IT之家附上相关演示视频如下: 《漫威金刚狼》(Marvel's Wolverine)游戏由 Insomniac Games 开发,计划以独占形式,于 9 月 15 日在索尼 PlayStation 5 平台发行。 该媒体分享了 32 套金刚狼战衣,其中包括金刚狼在动画版《X-Men》中使用的经典服装,并出现了多款利爪外观。该媒体还认为战衣和利爪可供玩家独立选择,不会绑定关联。

  8. 量子位36

    神秘具身团队又放出一连串很炸的Demo视频…自进化模型,技术路线曝光

    事实摘要:神秘具身团队又放出一连串很炸的Demo视频…自进化模型,技术路线曝光 神秘具身团队又放出一连串很炸的Demo视频…自进化模型,技术路线曝光 这条动态来自 量子位,可重点关注模型能力与工程。 神秘具身团队又放出一连串很炸的Demo视频…自进化模型,技术路线曝光。影响判断:它可能改变模型能力与工程相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和模型能力与工程直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  9. IT之家 AI36

    大逃杀融合肉鸽:《PUBG:DED.NET》玩法详解,希望玩家“爱或恨”而非“无所谓”

    IT之家 9 月 3 日消息,在 2026 年科隆游戏展上,Krafton 正式公布了《绝地求生》衍生新作《PUBG: DED.NET 》。 本作将大逃杀玩法与肉鸽式成长体系相结合,玩家的一次挑战将横跨多场比赛,角色的胜负与状态会延续至下一局。游戏创意总监 Dave Curd 在接受 Video Games Chronicle 采访时详细介绍了这款风格迥异的作品。 据介绍,《PUBG: DED.NET 》设定在虚构的 1996 年,美术风格被团队称为“Grunge House”—— 融合了 90 年代另类摇滚的颓废美学与 Grindhouse 电影的邪典气质。 游戏开始挑战时,玩家可从首批 9 名拥有各自动机和人际关系的角色中选择一人,但角色不绑定专属能力。他表示,制作组希望玩家按照自己喜欢的角色和故事进行选择,而不是单纯追逐强势技能 ——“我们希望角色选择是出于喜好,而非强度考虑。” 选定角色后,玩家需从突击、支援或干扰等方向...

    推荐理由:来自IT之家 AI的《大逃杀融合肉鸽:《PUBG:DED.NET》玩法详解,希望玩家“爱或恨”而非“无所谓”》。重点看文化创意。摘要提到:IT之家 9 月 3 日消息,在 2026 年科隆游戏展上,Krafton 正式公布了《绝地求生》衍生新作《PUBG: DED.NET 》。 本作将大逃杀玩法与肉鸽式成长体系相结合,玩家的一次挑战将横跨多场比赛,角色的胜负与状态会延续至下一局。游戏创意总监 Dave Curd 在接受 Video Games Chronicle 采访时详细介绍了这款风格迥异的作品。 据介绍,《PUBG: DED.NET 》设定在虚构的 1996 年,美术风格被团队称为“Grunge House”—— 融合了 90 年代另类摇滚的颓废美学与 Grindhouse 电影的邪典气质。 游戏开始挑战时,玩家可从首批 9 名拥有各自动机和人际关系的角色中选择一人,但角色不绑定专属能力。他表示,制作组希望玩家按照自己喜欢的角色和故事进行选择,而不是单纯追逐强势技能 ——“我们希望角色选择是出于喜好,而非强度考虑。” 选定角色后,玩家需从突击、支援或干扰等方向...

  10. IT之家 AI36

    美国宇航局火星直升机旋翼突破 1.08 马赫,升力提高 30%

    IT之家 9 月 3 日消息,科技媒体 scitechdaily 昨日(9 月 2 日)发布博文,报道称美国宇航局(NASA)喷气推进实验室(JPL)完成 137 次火星直升机(Mars Helicopter)旋翼测试, 突破 1.08 马赫,升力相比“机智号”提高 30%。 美国宇航局工程团队在 25 英尺太空模拟器内抽出空气,并注入接近火星压力水平的二氧化碳,测试运行 137 次。 2025 年 11 月,工程师雅科 · 卡拉斯(Jaakko Karras)在 NASA 喷气推进实验室的 25 英尺太空模拟器中,对下一代火星直升机旋翼叶片进行检查,之后将进行超音速测试。图片来源:NASA / JPL-Caltech 工程师持续提高旋翼转速和模拟逆风强度,监测实时数据与视频画面。最终,旋翼桨尖达到 1.08 马赫(约 869 千米 / 小时),飞行器升力能力提高 30%。 火星大气密度约为地球的 1%,可供旋翼“抓住”的气体分...

    推荐理由:来自IT之家 AI的《美国宇航局火星直升机旋翼突破 1.08 马赫,升力提高 30%》。重点看产品发布。摘要提到:IT之家 9 月 3 日消息,科技媒体 scitechdaily 昨日(9 月 2 日)发布博文,报道称美国宇航局(NASA)喷气推进实验室(JPL)完成 137 次火星直升机(Mars Helicopter)旋翼测试, 突破 1.08 马赫,升力相比“机智号”提高 30%。 美国宇航局工程团队在 25 英尺太空模拟器内抽出空气,并注入接近火星压力水平的二氧化碳,测试运行 137 次。 2025 年 11 月,工程师雅科 · 卡拉斯(Jaakko Karras)在 NASA 喷气推进实验室的 25 英尺太空模拟器中,对下一代火星直升机旋翼叶片进行检查,之后将进行超音速测试。图片来源:NASA / JPL-Caltech 工程师持续提高旋翼转速和模拟逆风强度,监测实时数据与视频画面。最终,旋翼桨尖达到 1.08 马赫(约 869 千米 / 小时),飞行器升力能力提高 30%。 火星大气密度约为地球的 1%,可供旋翼“抓住”的气体分...

9月2日周三
  1. IT之家 AI74

    谷歌 Gemini 3.8 Flash 模型上线,适用软件工程、智能体任务等场景

    IT之家 9 月 2 日消息,谷歌今天(2 日)在 Google DeepMind 网站低调上线了 Gemini 3.8 Flash 模型。其基于 Gemini 3.7 Flash,拥有在软件工程和智能体知识工作流方面的性能提升,并持续支持可定制的努力水平,以控制质量、成本和延迟的组合。 不过截至IT之家发稿,谷歌官方暂未通过新闻稿或社媒平台官宣这一模型的存在。 Gemini 3.8 Flash 基于 Gemini 3.7 Flash,具有最高 1M 的 token 上下文窗口,文本支持 64K token 输出。官方还公布了多项基准测试评估结果,涵盖编程、知识处理、多模态处理能力、长上下文处理、计算机使用能力以及科学推理能力。 截至 2026 年 9 月的结果如下: 根据介绍,Gemini 3.8 Flash 面向个人用户、开发者和企业,适合以较低成本大规模部署通用型、可直接用于生产环境的智能体,典型用途包括 软件工程、智能体...

    推荐理由:来自IT之家 AI的《谷歌 Gemini 3.8 Flash 模型上线,适用软件工程、智能体任务等场景》。重点看智能体工作流、模型能力与工程、评测与基准。摘要提到:IT之家 9 月 2 日消息,谷歌今天(2 日)在 Google DeepMind 网站低调上线了 Gemini 3.8 Flash 模型。其基于 Gemini 3.7 Flash,拥有在软件工程和智能体知识工作流方面的性能提升,并持续支持可定制的努力水平,以控制质量、成本和延迟的组合。 不过截至IT之家发稿,谷歌官方暂未通过新闻稿或社媒平台官宣这一模型的存在。 Gemini 3.8 Flash 基于 Gemini 3.7 Flash,具有最高 1M 的 token 上下文窗口,文本支持 64K token 输出。官方还公布了多项基准测试评估结果,涵盖编程、知识处理、多模态处理能力、长上下文处理、计算机使用能力以及科学推理能力。 截至 2026 年 9 月的结果如下: 根据介绍,Gemini 3.8 Flash 面向个人用户、开发者和企业,适合以较低成本大规模部署通用型、可直接用于生产环境的智能体,典型用途包括 软件工程、智能体...

  2. IT之家 AI34

    Netflix《GTA 6:分量十足的一瞥》狂揽 3110 万次观看数,登上 87 个地区榜首

    IT之家 9 月 2 日消息,Netflix 今天(2 日)公布了《GTA 6:分量十足的一瞥》的观看数据:在截至 8 月 30 日的统计周期内获得 3110 万次观看,登上了 93 个国家和地区中的 87 个市场观看排行榜第一 。 视频上线 Netflix 后约 6 小时,Rockstar Games 便将其上传至 YouTube,目前该视频在 R 星官方 YouTube 频道上的观看量 进一步达到 1700 万次 。 不过,Netflix 和 YouTube 对于观看次数的统计标准并不相同。YouTube 自 8 月 24 日起采用新的计算方式,只要用户开始播放视频一秒,就会计入一次观看。因此,即使用户只观看 10 秒后退出,也会被计算在内。 Netflix 则按照总观看时长计算观看次数,即所有用户观看该视频的累计时长除以视频长度。按照这一算法,如果两名用户分别观看了一半视频,理论上会被计算为一次完整观看。 由于统计方式不同...

    推荐理由:来自IT之家 AI的《Netflix《GTA 6:分量十足的一瞥》狂揽 3110 万次观看数,登上 87 个地区榜首》。重点看产品发布。摘要提到:IT之家 9 月 2 日消息,Netflix 今天(2 日)公布了《GTA 6:分量十足的一瞥》的观看数据:在截至 8 月 30 日的统计周期内获得 3110 万次观看,登上了 93 个国家和地区中的 87 个市场观看排行榜第一 。 视频上线 Netflix 后约 6 小时,Rockstar Games 便将其上传至 YouTube,目前该视频在 R 星官方 YouTube 频道上的观看量 进一步达到 1700 万次 。 不过,Netflix 和 YouTube 对于观看次数的统计标准并不相同。YouTube 自 8 月 24 日起采用新的计算方式,只要用户开始播放视频一秒,就会计入一次观看。因此,即使用户只观看 10 秒后退出,也会被计算在内。 Netflix 则按照总观看时长计算观看次数,即所有用户观看该视频的累计时长除以视频长度。按照这一算法,如果两名用户分别观看了一半视频,理论上会被计算为一次完整观看。 由于统计方式不同...

  3. IT之家 AI70

    国内首部 AIGC 长剧:《后西游记》策划到上线时间较传统三维动画减少 70%,总成本约为同类 S 级真人剧几分之一

    IT之家 9 月 2 日消息,8 月 31 日,没有真人演员参演的国内首部 AIGC 长剧《后西游记》上线芒果 TV,同步登陆湖南卫视黄金档。 据每日经济新闻今日报道,芒果超媒董事长蔡怀军接受采访时透露, 该剧总成本约为同类 S 级真人剧的几分之一 ;30 集、单集 40 分钟的体量,从策划到上线, 时间较传统三维动画压缩了 70% 。 按照蔡怀军的介绍,导演首先确定作品的情绪基调,美术团队完成人物和环境设计,AI 团队再从文生图推进到图生视频。 导演、编剧和美术仍要参与整个制作过程 ,团队花费更多精力的地方,变成了创意把控、模型生成和不同工序之间的协作。 在会员转化方面,芒果 TV 过去聚集了较多女性用户,但蔡怀军观察到,《后西游记》的神话题材加上电影级的 AI 视觉呈现,对站内用户拉新效果显著。“ 特别是男性用户群体拉新率超出了我们的预期 ,也验证了 AI 长剧在拓宽用户结构上的独特价值。” 作为国内首部 AIGC 长剧 ,...

    推荐理由:来自IT之家 AI的《国内首部 AIGC 长剧:《后西游记》策划到上线时间较传统三维动画减少 70%,总成本约为同类 S 级真人剧几分之一》。重点看模型能力与工程、文化创意、产品发布。摘要提到:IT之家 9 月 2 日消息,8 月 31 日,没有真人演员参演的国内首部 AIGC 长剧《后西游记》上线芒果 TV,同步登陆湖南卫视黄金档。 据每日经济新闻今日报道,芒果超媒董事长蔡怀军接受采访时透露, 该剧总成本约为同类 S 级真人剧的几分之一 ;30 集、单集 40 分钟的体量,从策划到上线, 时间较传统三维动画压缩了 70% 。 按照蔡怀军的介绍,导演首先确定作品的情绪基调,美术团队完成人物和环境设计,AI 团队再从文生图推进到图生视频。 导演、编剧和美术仍要参与整个制作过程 ,团队花费更多精力的地方,变成了创意把控、模型生成和不同工序之间的协作。 在会员转化方面,芒果 TV 过去聚集了较多女性用户,但蔡怀军观察到,《后西游记》的神话题材加上电影级的 AI 视觉呈现,对站内用户拉新效果显著。“ 特别是男性用户群体拉新率超出了我们的预期 ,也验证了 AI 长剧在拓宽用户结构上的独特价值。” 作为国内首部 AIGC 长剧 ,...

  4. IT之家 AI34

    《GTA 6》冲刺按键改为 L3,打破 25 年操作传统

    IT之家 9 月 2 日消息,近 25 年来,《侠盗猎车手》(GTA)系列一直有一个非常独特的操作设计:玩家需要通过手柄上的正面按键来控制角色冲刺。虽然部分 Rockstar 游戏提供过其他操作方案,但默认设置始终是按下 X 键或 A 键(取决于游戏平台)让角色跑起来。不过,这一传统可能要在《GTA 6》中被打破。 Rockstar 最近向少数媒体和内容创作者展示了《GTA 6》。随着外界陆续了解到游戏的驾驶机制、角色关系以及开放世界等大量细节,一些更加细微的玩法设计也开始浮出水面。 受邀参与此次展示的 YouTuber MikeShowSha 就在最新一期问答视频中透露了一个细节:玩家究竟需要按哪个按键才能让角色冲刺? 根据 MikeShowSha 的说法,《GTA 6》默认的冲刺操作已经改为按下手柄左摇杆,也就是 L3 键。 据IT之家了解,在过去十多年里,L3 一直是绝大多数射击游戏默认的冲刺按键。通常情况下,玩家只需按下...

    推荐理由:来自IT之家 AI的《《GTA 6》冲刺按键改为 L3,打破 25 年操作传统》。重点看多模态、文化创意。摘要提到:IT之家 9 月 2 日消息,近 25 年来,《侠盗猎车手》(GTA)系列一直有一个非常独特的操作设计:玩家需要通过手柄上的正面按键来控制角色冲刺。虽然部分 Rockstar 游戏提供过其他操作方案,但默认设置始终是按下 X 键或 A 键(取决于游戏平台)让角色跑起来。不过,这一传统可能要在《GTA 6》中被打破。 Rockstar 最近向少数媒体和内容创作者展示了《GTA 6》。随着外界陆续了解到游戏的驾驶机制、角色关系以及开放世界等大量细节,一些更加细微的玩法设计也开始浮出水面。 受邀参与此次展示的 YouTuber MikeShowSha 就在最新一期问答视频中透露了一个细节:玩家究竟需要按哪个按键才能让角色冲刺? 根据 MikeShowSha 的说法,《GTA 6》默认的冲刺操作已经改为按下手柄左摇杆,也就是 L3 键。 据IT之家了解,在过去十多年里,L3 一直是绝大多数射击游戏默认的冲刺按键。通常情况下,玩家只需按下...

  5. 爱范儿70

    刚刚,李飞飞掀桌!全球首个多模态世界模型发布,几张照片省掉几百个机位

    事实摘要:刚刚,李飞飞掀桌!全球首个多模态世界模型发布,几张照片省掉几百个机位 大模型理解文字,李飞飞想让 Atlas 理解空间 #欢迎关注爱范儿官方微信公众号:爱范儿(微信号:ifanr),更多精彩内容第一时间为您奉上。 这条动态来自 爱范儿,可重点关注模型能力与工程、产品发布。 刚刚,李飞飞掀桌!全球首个多模态世界模型发布,几张照片省掉几百个机位 大模型理解文字。影响判断:它可能改变模型能力与工程相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和模型能力与工程直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  6. IT之家 AI36

    马斯克预测 10 年内全球人形机器人超 10 亿台,每台产出是人类 5 倍

    IT之家 9 月 2 日消息,昨日(9 月 1 日)在美国北卡罗来纳州教堂山举行的二十国集团(G20)创新部长级会议上, 全球首富埃隆 · 马斯克(Elon Musk)发表视频讲话,预估未来 10 年内人形机器人数量将超过 10 亿台。 IT之家援引 barrons 媒体报道,在本次视频讲话中,马斯克表示: 在未来 10 年内,全球人形机器人数量将超过 10 亿台,生产力将高于全球人类生产力总和。 未来 10 年内将至少有 10 亿台机器人,每台机器人的产出将至少是人类工作者的 5 倍。 马斯克还预测,AI 最快明年就能高效处理各类数字任务,从而将全球生产总值提升 20% 至 30%,即每年增加 20 万亿至 30 万亿美元 (IT之家注:现汇率约合 134.74 万亿至 202.11 万亿元人民币) 。

    推荐理由:来自IT之家 AI的《马斯克预测 10 年内全球人形机器人超 10 亿台,每台产出是人类 5 倍》。重点看多模态。摘要提到:IT之家 9 月 2 日消息,昨日(9 月 1 日)在美国北卡罗来纳州教堂山举行的二十国集团(G20)创新部长级会议上, 全球首富埃隆 · 马斯克(Elon Musk)发表视频讲话,预估未来 10 年内人形机器人数量将超过 10 亿台。 IT之家援引 barrons 媒体报道,在本次视频讲话中,马斯克表示: 在未来 10 年内,全球人形机器人数量将超过 10 亿台,生产力将高于全球人类生产力总和。 未来 10 年内将至少有 10 亿台机器人,每台机器人的产出将至少是人类工作者的 5 倍。 马斯克还预测,AI 最快明年就能高效处理各类数字任务,从而将全球生产总值提升 20% 至 30%,即每年增加 20 万亿至 30 万亿美元 (IT之家注:现汇率约合 134.74 万亿至 202.11 万亿元人民币) 。

  7. IT之家 AI34

    目标 2030 年投运:蓝色起源拿下 NASA 约 7 亿美元大单,开发火星通信网络

    IT之家 9 月 2 日消息,美国宇航局昨日(9 月 1 日)发布博文, 宣布已向蓝色起源(Blue Origin)授予一份固定价格合同(firm-fixed-price),由后者开发火星通信网络。 固定价格合同(Firm-Fixed-Price,FFP)是政府采购与商业合同中“风险主要在承包商一侧”的典型合同类型:价格在签约时即确定,除非发生合同约定的变更(如范围变更、不可抗力条款触发等),否则不因承包商实际成本高低而调整。 该合同最高潜在价值约 7 亿美元 (IT之家注:现汇率约合 47.16 亿元人民币) ,蓝色起源将负责火星通信网络(MTN)的设计、开发、集成、发射和运营, 目标在 2028 年 12 月 31 日前交付 1 艘高性能火星通信轨道器,并预估 2030 年在火星投入运行。 根据建设规划,这艘轨道器将绕火星运行,充当火星任务与地球之间的数据中继节点,为火星表面及周边航天器转发科学数据、图像、导航信息和关键任务...

    推荐理由:来自IT之家 AI的《目标 2030 年投运:蓝色起源拿下 NASA 约 7 亿美元大单,开发火星通信网络》。重点看产品发布。摘要提到:IT之家 9 月 2 日消息,美国宇航局昨日(9 月 1 日)发布博文, 宣布已向蓝色起源(Blue Origin)授予一份固定价格合同(firm-fixed-price),由后者开发火星通信网络。 固定价格合同(Firm-Fixed-Price,FFP)是政府采购与商业合同中“风险主要在承包商一侧”的典型合同类型:价格在签约时即确定,除非发生合同约定的变更(如范围变更、不可抗力条款触发等),否则不因承包商实际成本高低而调整。 该合同最高潜在价值约 7 亿美元 (IT之家注:现汇率约合 47.16 亿元人民币) ,蓝色起源将负责火星通信网络(MTN)的设计、开发、集成、发射和运营, 目标在 2028 年 12 月 31 日前交付 1 艘高性能火星通信轨道器,并预估 2030 年在火星投入运行。 根据建设规划,这艘轨道器将绕火星运行,充当火星任务与地球之间的数据中继节点,为火星表面及周边航天器转发科学数据、图像、导航信息和关键任务...

  8. IT之家 AI70

    协作表格有“历史记录”:微软 Excel 用 AI 梳理变化,明晰谁改的、改了什么

    IT之家 9 月 2 日消息,科技媒体 NeoWin 昨日(9 月 1 日)发布博文,报道称微软面向多人协作工作簿追溯修改, 为 Excel 推出 Change History(变更历史)功能。 IT之家附上相关演示视频如下: 在官方博文中,微软指出 Excel 工作簿常因数据更新、需求变化和多人同步编辑而持续变化。时间拉长后,团队往往难以快速确认某项数据何时被修改、由谁修改,以及该改动是否影响其他计算结果。 微软因此引入 Change History 功能,通过读取 Excel 已有编辑记录,并结合 Copilot 的推理能力生成修改说明。用户可通过自然语言提问,了解工作簿在特定时间段内发生的重要变化。 该功能可汇总具体修改内容、修改产生的影响和相关编辑者。原文未披露该功能支持的最长历史追溯周期、可处理的工作簿规模,以及响应时间等性能参数。 此外该功能会通过不同颜色,标记用户编辑和 Copilot 辅助修改,团队成员可据此快速...

    推荐理由:来自IT之家 AI的《协作表格有“历史记录”:微软 Excel 用 AI 梳理变化,明晰谁改的、改了什么》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 2 日消息,科技媒体 NeoWin 昨日(9 月 1 日)发布博文,报道称微软面向多人协作工作簿追溯修改, 为 Excel 推出 Change History(变更历史)功能。 IT之家附上相关演示视频如下: 在官方博文中,微软指出 Excel 工作簿常因数据更新、需求变化和多人同步编辑而持续变化。时间拉长后,团队往往难以快速确认某项数据何时被修改、由谁修改,以及该改动是否影响其他计算结果。 微软因此引入 Change History 功能,通过读取 Excel 已有编辑记录,并结合 Copilot 的推理能力生成修改说明。用户可通过自然语言提问,了解工作簿在特定时间段内发生的重要变化。 该功能可汇总具体修改内容、修改产生的影响和相关编辑者。原文未披露该功能支持的最长历史追溯周期、可处理的工作簿规模,以及响应时间等性能参数。 此外该功能会通过不同颜色,标记用户编辑和 Copilot 辅助修改,团队成员可据此快速...

  9. IT之家 AI72

    全球首个多模态世界模型:李飞飞 World Labs 发布 Atlas,像素级精度控制镜头、拍出“子弹时间”大片

    IT之家 9 月 2 日消息,“AI 教母”李飞飞的创企 World Labs 今日发布了“ 全球首个多模态世界模型 ”—— Atlas,宣称该模型能够以像素级精确的相机控制生成图像和视频帧,并将其在 3D 中重建。 World Labs 官方介绍,其从头开始对 Atlas 进行预训练,使其能够接受多模态输入,包括相机移动,并将其转化为 3D 视图。 通过在模型的空间上下文中定位多个输入视图,Atlas 允许用户生成具有精确控制的图像和视频帧, 实现类似“子弹时间”的拍摄效果 。 Atlas 还能从一张到多张输入图像输出明确的 3D 模型,超越了顶级开源重建模型。 Atlas 会根据你指定的任意摄像机位置和角度生成一个或多个参考图像 。生成的视图与输入图像的内容和几何形状相匹配,能够平滑地扩展图像,自主想象输入中看不到的场景部分。 具体来看,Atlas 能够执行涵盖世界生成、重建和模拟的广泛任务: 相机控制生成:Atlas 通过...

    推荐理由:来自IT之家 AI的《全球首个多模态世界模型:李飞飞 World Labs 发布 Atlas,像素级精度控制镜头、拍出“子弹时间”大片》。重点看模型能力与工程、开源生态、产品发布。摘要提到:IT之家 9 月 2 日消息,“AI 教母”李飞飞的创企 World Labs 今日发布了“ 全球首个多模态世界模型 ”—— Atlas,宣称该模型能够以像素级精确的相机控制生成图像和视频帧,并将其在 3D 中重建。 World Labs 官方介绍,其从头开始对 Atlas 进行预训练,使其能够接受多模态输入,包括相机移动,并将其转化为 3D 视图。 通过在模型的空间上下文中定位多个输入视图,Atlas 允许用户生成具有精确控制的图像和视频帧, 实现类似“子弹时间”的拍摄效果 。 Atlas 还能从一张到多张输入图像输出明确的 3D 模型,超越了顶级开源重建模型。 Atlas 会根据你指定的任意摄像机位置和角度生成一个或多个参考图像 。生成的视图与输入图像的内容和几何形状相匹配,能够平滑地扩展图像,自主想象输入中看不到的场景部分。 具体来看,Atlas 能够执行涵盖世界生成、重建和模拟的广泛任务: 相机控制生成:Atlas 通过...

  10. IT之家 AI36

    Switch 2 版《剑星》游戏首秀 FSR 3.1,掌机与主机模式均瞄准 60 FPS

    IT之家 9 月 2 日消息,科技媒体 nintendoeverything 昨日(9 月 1 日)发布博文,报道称韩国开发商 Shift Up 透露, 任天堂 Switch 2 掌机版《剑星》(Stellar Blade)目标帧率为 60FPS。 IT之家援引博文介绍,开发团队为掌机模式和底座模式都设定了 60FPS 目标,底座模式将呈现增强的 1080p 画面;掌机模式则采用 720p 画面。 Shift Up 确认《剑星》游戏接入 NVIDIA DLSS(深度学习超级采样),DLSS 在该版本中负责将较低分辨率的渲染结果放大,以输出更高分辨率画面。 Shift Up 的首席技术官兼技术总监 DongKi Lee 表示,团队引入 PC 版 AMD FSR 3.1 的帧插值功能,技术流程是先通过 DLSS 完成图像超分,再以 FSR 3.1 为结果画面插入中间帧,向 60 帧每秒目标推进。 对于动作游戏而言,画面帧率、输入响应...

    推荐理由:来自IT之家 AI的《Switch 2 版《剑星》游戏首秀 FSR 3.1,掌机与主机模式均瞄准 60 FPS》。重点看产品发布。摘要提到:IT之家 9 月 2 日消息,科技媒体 nintendoeverything 昨日(9 月 1 日)发布博文,报道称韩国开发商 Shift Up 透露, 任天堂 Switch 2 掌机版《剑星》(Stellar Blade)目标帧率为 60FPS。 IT之家援引博文介绍,开发团队为掌机模式和底座模式都设定了 60FPS 目标,底座模式将呈现增强的 1080p 画面;掌机模式则采用 720p 画面。 Shift Up 确认《剑星》游戏接入 NVIDIA DLSS(深度学习超级采样),DLSS 在该版本中负责将较低分辨率的渲染结果放大,以输出更高分辨率画面。 Shift Up 的首席技术官兼技术总监 DongKi Lee 表示,团队引入 PC 版 AMD FSR 3.1 的帧插值功能,技术流程是先通过 DLSS 完成图像超分,再以 FSR 3.1 为结果画面插入中间帧,向 60 帧每秒目标推进。 对于动作游戏而言,画面帧率、输入响应...

  11. 量子位68

    李飞飞发布:全球首个多模态世界模型

    一张图补全3D世界,还能给机器人造训练场 这条动态来自 量子位,可重点关注模型能力与工程、产品发布。

    推荐理由:来自量子位的《李飞飞发布:全球首个多模态世界模型》。重点看模型能力与工程、产品发布。摘要提到:一张图补全3D世界,还能给机器人造训练场 这条动态来自 量子位,可重点关注模型能力与工程、产品发布。

  12. IT之家 AI70

    Meta 发布首个实时音频感知 AI 模型,支持 20 余人分轨转写

    IT之家 9 月 2 日消息,科技媒体 9to5Mac 昨日(9 月 1 日)发布博文,报道称 Meta 公司推出 Muse Voice Transcribe, 这是其首个实时音频感知模型。 开发者可通过 Meta Model API 调用该能力,定价为每 1000 分钟音频 3 美元 (现汇率约合 20.2 元人民币) ,等同每小时 0.18 美元 (现汇率约合 1.2 元人民币) 。 该模型在同一流程中整合流式自动语音识别、说话人分离与端点检测,用户说话时,系统可同步输出文字,无需等待完整录音结束后再单独处理。 IT之家注:“流式”就是边说边转写,模型不必等整段音频说完才出结果,而是会一小段一小段持续输出文字,所以延迟更低,适合实时听写、会议记录、通话字幕。 Muse Voice Transcribe 可在包含 20 余名说话者的录音中分离不同发言者,还能识别说话是否结束,从而自动确定一段输入的边界。 模型训练覆盖 70 余...

    推荐理由:来自IT之家 AI的《Meta 发布首个实时音频感知 AI 模型,支持 20 余人分轨转写》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 2 日消息,科技媒体 9to5Mac 昨日(9 月 1 日)发布博文,报道称 Meta 公司推出 Muse Voice Transcribe, 这是其首个实时音频感知模型。 开发者可通过 Meta Model API 调用该能力,定价为每 1000 分钟音频 3 美元 (现汇率约合 20.2 元人民币) ,等同每小时 0.18 美元 (现汇率约合 1.2 元人民币) 。 该模型在同一流程中整合流式自动语音识别、说话人分离与端点检测,用户说话时,系统可同步输出文字,无需等待完整录音结束后再单独处理。 IT之家注:“流式”就是边说边转写,模型不必等整段音频说完才出结果,而是会一小段一小段持续输出文字,所以延迟更低,适合实时听写、会议记录、通话字幕。 Muse Voice Transcribe 可在包含 20 余名说话者的录音中分离不同发言者,还能识别说话是否结束,从而自动确定一段输入的边界。 模型训练覆盖 70 余...

  13. IT之家 AI34

    我国科学家首次实现高光谱相机实时解析,卫星可直接实时出结果

    IT之家 9 月 2 日消息,据央视今日报道,北京理工大学科研团队在《科学》上发表了一项最新研究成果,首创片上光谱计算新方法,实现了高光谱相机从图像采集到信息解析的全链路片上集成处理,使原本依赖大型服务器完成的光谱解析可在便携设备中现场实时完成。 高光谱成像技术通过在空间信息基础上增加光谱维度,能够通过物质特有的光谱信息识别材质和成分,是遥感监测、工业检测等领域的重要技术。但高光谱图像数据量极大,单张图片可达数百兆甚至上千兆,对后端数据处理分析造成巨大压力。北京理工大学长聘教授边丽蘅表示,高光谱成像在空间信息基础上多了一个光谱维度,一张图片就可能占几百到上千兆空间,给后端数据处理带来了压力。 为破解这一难题,团队从软硬件两端协同发力。2024 年,团队率先在图像采集环节取得突破,将传统高光谱相机庞大的光路系统缩小到了芯片级别。 此次研究进一步攻克了后端实时计算难题,通过挖掘光谱数据的关联性减少重复计算,并针对光谱数据特点重新设计...

    推荐理由:来自IT之家 AI的《我国科学家首次实现高光谱相机实时解析,卫星可直接实时出结果》。重点看多模态、论文/研究。摘要提到:IT之家 9 月 2 日消息,据央视今日报道,北京理工大学科研团队在《科学》上发表了一项最新研究成果,首创片上光谱计算新方法,实现了高光谱相机从图像采集到信息解析的全链路片上集成处理,使原本依赖大型服务器完成的光谱解析可在便携设备中现场实时完成。 高光谱成像技术通过在空间信息基础上增加光谱维度,能够通过物质特有的光谱信息识别材质和成分,是遥感监测、工业检测等领域的重要技术。但高光谱图像数据量极大,单张图片可达数百兆甚至上千兆,对后端数据处理分析造成巨大压力。北京理工大学长聘教授边丽蘅表示,高光谱成像在空间信息基础上多了一个光谱维度,一张图片就可能占几百到上千兆空间,给后端数据处理带来了压力。 为破解这一难题,团队从软硬件两端协同发力。2024 年,团队率先在图像采集环节取得突破,将传统高光谱相机庞大的光路系统缩小到了芯片级别。 此次研究进一步攻克了后端实时计算难题,通过挖掘光谱数据的关联性减少重复计算,并针对光谱数据特点重新设计...

  14. IT之家 AI38

    全球首例苹果 Vision Pro 辅助髋关节镜手术完成,医生无需频繁扭头看屏幕

    IT之家 9 月 2 日消息,科技媒体 AppleInsider 昨日(9 月 1 日)发布博文,报道称苹果 Vision Pro 头显在医疗领域大放异彩, 已辅助完成首例髋关节镜(arthroscopic)手术。 IT之家查询公开资料,髋关节镜属于技术门槛较高的微创骨科手术。它切口小,但髋关节位置深、周围软组织厚,医生须在有限空间中同时依赖关节镜视频、影像定位和精细器械操作,因此学习曲线较陡。 医疗技术公司 Stryker 宣布,杜克大学医疗中心已完成首例通过苹果 Vision Pro 头显,搭配使用其 SportSuite Vision 应用的髋关节镜手术。 主刀医生 Chad Mather III 表示,空间计算功能让其可按个人工作流程安排关键临床信息的位置,并在无菌区域内查看所需内容。 在常规关节镜流程中,医生需要反复参考手术室周围的多个屏幕。SportSuite Vision 将关节镜画面和 CT 影像等信息显示在 A...

    推荐理由:来自IT之家 AI的《全球首例苹果 Vision Pro 辅助髋关节镜手术完成,医生无需频繁扭头看屏幕》。重点看智能体工作流、文化创意、产品发布。摘要提到:IT之家 9 月 2 日消息,科技媒体 AppleInsider 昨日(9 月 1 日)发布博文,报道称苹果 Vision Pro 头显在医疗领域大放异彩, 已辅助完成首例髋关节镜(arthroscopic)手术。 IT之家查询公开资料,髋关节镜属于技术门槛较高的微创骨科手术。它切口小,但髋关节位置深、周围软组织厚,医生须在有限空间中同时依赖关节镜视频、影像定位和精细器械操作,因此学习曲线较陡。 医疗技术公司 Stryker 宣布,杜克大学医疗中心已完成首例通过苹果 Vision Pro 头显,搭配使用其 SportSuite Vision 应用的髋关节镜手术。 主刀医生 Chad Mather III 表示,空间计算功能让其可按个人工作流程安排关键临床信息的位置,并在无菌区域内查看所需内容。 在常规关节镜流程中,医生需要反复参考手术室周围的多个屏幕。SportSuite Vision 将关节镜画面和 CT 影像等信息显示在 A...

  15. IT之家 AI68

    谷歌推出智能体视频理解功能:提升 Gemini 模型视频分析准确率,大幅降本减耗

    IT之家 9 月 2 日消息,谷歌今日宣布在最新的 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 模型中,推出 智能体视频理解(agentic video understanding) 功能。该新功能可提升视频分析准确率,同时大幅减少视频分析过程中的 Token 使用量和成本。 该功能使用标准 Gemini API Token 定价,不收取额外功能费用。 与现有“静态”处理方式(模型按固定帧率读取视频,默认 1 FPS,可通过 API 调整)不同,智能体视频理解将模型核心推理与原生视频工具结合,可在视觉帧、音频和转录文本中动态搜索、扫描和检查目标视频片段。 在标准视频分析基准测试中,搭载智能体视频理解的 Gemini 模型可将 分析成本降低最高 66% , Token 消耗量降低最高 88% ,同时将准确率提升最高 7%。这类效率提升在长视频场景中尤为明显,因为传统静态处理会让开发者不得...

    推荐理由:来自IT之家 AI的《谷歌推出智能体视频理解功能:提升 Gemini 模型视频分析准确率,大幅降本减耗》。重点看智能体工作流、模型能力与工程、评测与基准。摘要提到:IT之家 9 月 2 日消息,谷歌今日宣布在最新的 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 模型中,推出 智能体视频理解(agentic video understanding) 功能。该新功能可提升视频分析准确率,同时大幅减少视频分析过程中的 Token 使用量和成本。 该功能使用标准 Gemini API Token 定价,不收取额外功能费用。 与现有“静态”处理方式(模型按固定帧率读取视频,默认 1 FPS,可通过 API 调整)不同,智能体视频理解将模型核心推理与原生视频工具结合,可在视觉帧、音频和转录文本中动态搜索、扫描和检查目标视频片段。 在标准视频分析基准测试中,搭载智能体视频理解的 Gemini 模型可将 分析成本降低最高 66% , Token 消耗量降低最高 88% ,同时将准确率提升最高 7%。这类效率提升在长视频场景中尤为明显,因为传统静态处理会让开发者不得...

  16. Google DeepMind84

    Introducing agentic video understanding with Gemini

    这条英文动态主要涉及智能体工作流。原文要点:Introducing agentic video understanding with Gemini

    推荐理由:来自Google DeepMind的《Introducing agentic video understanding with Gemini》。重点看智能体工作流。摘要提到:这条英文动态主要涉及智能体工作流。原文要点:Introducing agentic video understanding with Gemini

  17. Google AI Blog55

    Try Google Pics: Easy image creation and editing in Google Workspace

    这条英文动态主要涉及模型能力与工程。原文要点:Built on our latest Nano Banana model, Google Pics — our image creation and editing tool — is now available.

    推荐理由:来自Google AI Blog的《Try Google Pics: Easy image creation and editing in Google Workspace》。重点看模型能力与工程。摘要提到:这条英文动态主要涉及模型能力与工程。原文要点:Built on our latest Nano Banana model, Google Pics — our image creation and editing tool — is now available.

9月1日周二
  1. GitHub Changelog48

    GitHub CLI: Media in issues, pull requests, and comments

    事实摘要:这条英文动态主要涉及开源生态,原文信息显示:GitHub CLI: Media in issues, pull requests, and comments 事实摘要:这条英文动态主要涉及开源生态,原文信息显示:GitHub CLI: Media in issues, pull requests, and comments 事实摘要:这条英文动态主要涉及开源。影响判断:它可能改变开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  2. 量子位66

    3秒出片比播放还快,MiniMax打开了AI视频的实时商业化路径

    3秒出片比播放还快,MiniMax打开了AI视频的实时商业化路径 这条动态来自 量子位,可重点关注其对 AI 应用和产业节奏的影响。

    推荐理由:来自量子位的《3秒出片比播放还快,MiniMax打开了AI视频的实时商业化路径》。重点看多模态。摘要提到:3秒出片比播放还快,MiniMax打开了AI视频的实时商业化路径 这条动态来自 量子位,可重点关注其对 AI 应用和产业节奏的影响。

  3. IT之家 AI34

    任天堂为《皮克敏 3 豪华版》推出免费 Switch 2 更新:画面升级、支持游戏分享

    IT之家 9 月 1 日消息,任天堂今日为《皮克敏 3 豪华版》推出 Switch 2 免费更新, NS2 玩家下载后可享受到更好的画面 。 据介绍,本次更新为 Switch 2 游戏机强化画质表现,针对 Switch 2 屏幕和高分辨率电视进行优化,提升图像质量。 同时, 本作还新增了游戏分享(GameShare)支持 ,两名玩家可在本地使用两台 Switch 2 进行宾果对战。 据IT之家了解,《皮克敏 3 豪华版》最初于 2020 年 10 月登陆任天堂 Switch 1。本作是 2013 年 Wii U 游戏《皮克敏 3》的强化移植版,收录多个 DLC,并新增多个内容。

    推荐理由:来自IT之家 AI的《任天堂为《皮克敏 3 豪华版》推出免费 Switch 2 更新:画面升级、支持游戏分享》。重点看多模态、文化创意。摘要提到:IT之家 9 月 1 日消息,任天堂今日为《皮克敏 3 豪华版》推出 Switch 2 免费更新, NS2 玩家下载后可享受到更好的画面 。 据介绍,本次更新为 Switch 2 游戏机强化画质表现,针对 Switch 2 屏幕和高分辨率电视进行优化,提升图像质量。 同时, 本作还新增了游戏分享(GameShare)支持 ,两名玩家可在本地使用两台 Switch 2 进行宾果对战。 据IT之家了解,《皮克敏 3 豪华版》最初于 2020 年 10 月登陆任天堂 Switch 1。本作是 2013 年 Wii U 游戏《皮克敏 3》的强化移植版,收录多个 DLC,并新增多个内容。

  4. IT之家 AI36

    2026 年 8 月“AI 魔改”视频治理成果公布:共清理违规视频近 14000 条、处置违规账号 30 余个

    IT之家 9 月 1 日消息,据“振兴国剧”微信公众号消息,部分重点网络视听平台公布了 2026 年 8 月“AI 魔改”视频专项治理工作的处置情况,共清理违规视频近 14000 条、处置违规账号 30 余个。 IT之家附具体平台清理信息如下: 抖音: 8 月,平台累计处置涉“AI 魔改”违规视频 2897 条。 快手: 共处置“AI 魔改”违规内容 2824 条。 微信: 累计处置违规短视频内容 2633 条。 微博: 本阶段(8 月 1 日至 31 日),共拦截并清理各类违规视频 37 条。 哔哩哔哩: 从严拦截处置涉“AI 魔改”问题的违规稿件 800 余条。 小红书: 8 月平台新增清理处置“AI 魔改”视频违规内容 1348 条,处置违规账号 25 个。 百度: 8 月 1 日至 8 月 31 日,平台围绕“AI 魔改”视频累计巡查清理违规视频 3424 条,禁言账号 7 个。 按照国家广播电视总局工作部署,2026 ...

    推荐理由:来自IT之家 AI的《2026 年 8 月“AI 魔改”视频治理成果公布:共清理违规视频近 14000 条、处置违规账号 30 余个》。重点看多模态、部署/工程。摘要提到:IT之家 9 月 1 日消息,据“振兴国剧”微信公众号消息,部分重点网络视听平台公布了 2026 年 8 月“AI 魔改”视频专项治理工作的处置情况,共清理违规视频近 14000 条、处置违规账号 30 余个。 IT之家附具体平台清理信息如下: 抖音: 8 月,平台累计处置涉“AI 魔改”违规视频 2897 条。 快手: 共处置“AI 魔改”违规内容 2824 条。 微信: 累计处置违规短视频内容 2633 条。 微博: 本阶段(8 月 1 日至 31 日),共拦截并清理各类违规视频 37 条。 哔哩哔哩: 从严拦截处置涉“AI 魔改”问题的违规稿件 800 余条。 小红书: 8 月平台新增清理处置“AI 魔改”视频违规内容 1348 条,处置违规账号 25 个。 百度: 8 月 1 日至 8 月 31 日,平台围绕“AI 魔改”视频累计巡查清理违规视频 3424 条,禁言账号 7 个。 按照国家广播电视总局工作部署,2026 ...

  5. IT之家 AI34

    R 星母公司 T2 继续向 Discord 发传票,追查《GTA6》泄密者大葱哥

    IT之家 9 月 1 日消息,据游戏媒体 EuroGamer 今天报道,Rockstar 母公司 Take-Two 再次向 Discord 发出传票,要求追查《GTA6》泄密者 Cyberleek“大葱哥”。 据报道,Take-Two 本次发出的传票并没有公开细节,文件采用封存处理。此前 Take-Two 曾对 Discord、微软和 X 平台等公司发出传票,要求调取《GTA6》泄密视频的存储、传播路径。 综合IT之家此前报道,以大葱形象示人的黑客 Cyberleek 曾于上个月中下旬,将《侠盗猎车手 VI》游戏视频传到互联网,其中一段视频甚至展示了驾驶飞机穿越莱昂尼达地图的画面,引发网友热议。

    推荐理由:来自IT之家 AI的《R 星母公司 T2 继续向 Discord 发传票,追查《GTA6》泄密者大葱哥》。重点看多模态、文化创意。摘要提到:IT之家 9 月 1 日消息,据游戏媒体 EuroGamer 今天报道,Rockstar 母公司 Take-Two 再次向 Discord 发出传票,要求追查《GTA6》泄密者 Cyberleek“大葱哥”。 据报道,Take-Two 本次发出的传票并没有公开细节,文件采用封存处理。此前 Take-Two 曾对 Discord、微软和 X 平台等公司发出传票,要求调取《GTA6》泄密视频的存储、传播路径。 综合IT之家此前报道,以大葱形象示人的黑客 Cyberleek 曾于上个月中下旬,将《侠盗猎车手 VI》游戏视频传到互联网,其中一段视频甚至展示了驾驶飞机穿越莱昂尼达地图的画面,引发网友热议。

  6. IT之家 AI70

    腾讯张军:在职老师和高校大学生完成身份认证,可领取 WorkBuddy 1000 开学专属积分

    IT之家 9 月 1 日消息,腾讯公司公关总监张军发文,宣布即日起,全体在职老师和高校大学生完成身份认证,即可领取 WorkBuddy 1000 开学专属积分。 全国普通高等学校(除港澳台)在读大学生,以及通过教育部‘中国教师’小程序完成认证的各级各类学校在职教师,打开 WorkBuddy,按照页面提示完成各自身份认证,即可领取 1000 开学专属积分。 公开信息显示,WorkBuddy 是腾讯云推出的桌面 Agent 工具,该工具支持通过自然语言指令下达任务,可在本地电脑规划并执行多模态任务,实现自动批量处理文件、生成文档 / 表格 / PPT、多模态内容创作、数据深度分析、行业调研、多任务 Agent 并行处理等操作。

    推荐理由:来自IT之家 AI的《腾讯张军:在职老师和高校大学生完成身份认证,可领取 WorkBuddy 1000 开学专属积分》。重点看智能体工作流、教育应用。摘要提到:IT之家 9 月 1 日消息,腾讯公司公关总监张军发文,宣布即日起,全体在职老师和高校大学生完成身份认证,即可领取 WorkBuddy 1000 开学专属积分。 全国普通高等学校(除港澳台)在读大学生,以及通过教育部‘中国教师’小程序完成认证的各级各类学校在职教师,打开 WorkBuddy,按照页面提示完成各自身份认证,即可领取 1000 开学专属积分。 公开信息显示,WorkBuddy 是腾讯云推出的桌面 Agent 工具,该工具支持通过自然语言指令下达任务,可在本地电脑规划并执行多模态任务,实现自动批量处理文件、生成文档 / 表格 / PPT、多模态内容创作、数据深度分析、行业调研、多任务 Agent 并行处理等操作。

  7. IT之家 AI34

    知情人士回应抖音突发算法推荐错乱:原因为服务器异常

    IT之家 9 月 1 日消息,今天(1 日)早些时候,“抖音崩了”及“抖音推荐难看”等热搜词条引发关注。据《科创板日报》援引知情人士消息称,推荐算法错乱是因为 抖音平台突发服务器异常 。 报道称,据大量网友反馈,此次服务异常主要表现为三大技术故障:其一, 推荐算法机制疑似失灵 ,用户刷到的内容与日常偏好严重不符,大量推送不感兴趣、低相关度的视频,甚至出现“误入中老年频道”的既视感,部分用户反映关注页内容无法刷新;其二, 内容流出现重复性紊乱 ,同一个视频在信息流中被反复推送多次,无法获取新内容;其三, 基础播放功能受阻 ,视频播放频繁卡顿、加载画面持续转圈,甚至在网络连接正常的情况下,系统仍错误提示“无网络连接”。 另外,据IT之家网友反馈,此次故障还存在 系统 推送若干年前的旧内容 这一问题。 另据每日经济新闻,抖音人工客服表示,已有大量用户反馈同类问题,平台已经在排查优化中,后续优化完成就可以恢复。不过,在回复“是否有排查到...

    推荐理由:来自IT之家 AI的《知情人士回应抖音突发算法推荐错乱:原因为服务器异常》。重点看多模态。摘要提到:IT之家 9 月 1 日消息,今天(1 日)早些时候,“抖音崩了”及“抖音推荐难看”等热搜词条引发关注。据《科创板日报》援引知情人士消息称,推荐算法错乱是因为 抖音平台突发服务器异常 。 报道称,据大量网友反馈,此次服务异常主要表现为三大技术故障:其一, 推荐算法机制疑似失灵 ,用户刷到的内容与日常偏好严重不符,大量推送不感兴趣、低相关度的视频,甚至出现“误入中老年频道”的既视感,部分用户反映关注页内容无法刷新;其二, 内容流出现重复性紊乱 ,同一个视频在信息流中被反复推送多次,无法获取新内容;其三, 基础播放功能受阻 ,视频播放频繁卡顿、加载画面持续转圈,甚至在网络连接正常的情况下,系统仍错误提示“无网络连接”。 另外,据IT之家网友反馈,此次故障还存在 系统 推送若干年前的旧内容 这一问题。 另据每日经济新闻,抖音人工客服表示,已有大量用户反馈同类问题,平台已经在排查优化中,后续优化完成就可以恢复。不过,在回复“是否有排查到...

  8. IT之家 AI38

    英伟达 GPU 帧插值支持并入 FFmpeg,用户可使用帧生成提高视频帧率

    IT之家 9 月 1 日消息,据科技媒体 Phoronix 前天报道,开源多媒体框架项目 FFmpeg 日前宣布,英伟达 GPU 加入帧插值功能已通过 Vulkan API 集成到 FFmpeg。 本次合并意味着,FFmpeg 可使用英伟达 GeForce RTX GPU,在不经过传统图形渲染流程的情况下预测生成下一帧。英伟达正将这一能力扩展至视频编码领域, 让用户利用帧生成技术提高视频帧率 。 同时,英伟达 GPU 的光流加速器(Optical Flow Accelerator)可将图形渲染的光流逻辑应用于视频,通过预测下一帧生成 AI 帧提升视频帧率。官方将该过程称为 FRUC(IT之家注:Engine-assisted Frame-rate Up Conversion)。 此次加入的 Vulkan 实现能够让 FFmpeg 直接访问英伟达硬件,同时避免了此前阻碍该功能合并的专有软件依赖问题。因此 FFmpeg 此前未能合并...

    推荐理由:来自IT之家 AI的《英伟达 GPU 帧插值支持并入 FFmpeg,用户可使用帧生成提高视频帧率》。重点看开源生态、产品发布。摘要提到:IT之家 9 月 1 日消息,据科技媒体 Phoronix 前天报道,开源多媒体框架项目 FFmpeg 日前宣布,英伟达 GPU 加入帧插值功能已通过 Vulkan API 集成到 FFmpeg。 本次合并意味着,FFmpeg 可使用英伟达 GeForce RTX GPU,在不经过传统图形渲染流程的情况下预测生成下一帧。英伟达正将这一能力扩展至视频编码领域, 让用户利用帧生成技术提高视频帧率 。 同时,英伟达 GPU 的光流加速器(Optical Flow Accelerator)可将图形渲染的光流逻辑应用于视频,通过预测下一帧生成 AI 帧提升视频帧率。官方将该过程称为 FRUC(IT之家注:Engine-assisted Frame-rate Up Conversion)。 此次加入的 Vulkan 实现能够让 FFmpeg 直接访问英伟达硬件,同时避免了此前阻碍该功能合并的专有软件依赖问题。因此 FFmpeg 此前未能合并...

  9. IT之家 AI70

    开源媒体播放器 VLC 全球下载量突破 70 亿次

    IT之家 9 月 1 日消息,在流媒体平台不断涨价的今天,开源媒体播放器 VLC Media Player 依然保持着强大的生命力。 据 VLC 总裁兼首席开发者 Jean-Baptiste Kempf 公告,目前 VLC 在全平台累计下载量已经突破 70 亿次,此次里程碑距离 VLC 在 2025 年 1 月突破 60 亿次下载约 18 个月。 Kempf 同时透露,开发团队近期已经将 VLC 移植到亚马逊面向电视推出的全新 Vega OS 平台,并计划继续完善对其他平台和媒体编码格式的支持。目前,VLC 4 也仍在开发之中,不过由于开发工作较为复杂,新版本还需要一段时间才能正式发布。 IT之家注意到,VLC 开发团队去年还曾展示基于本地 AI 模型的自动翻译和字幕功能,但目前尚不清楚这些功能具体正式上线时间。 从 1996 年首次发布至今,VLC 凭借免费、开源、跨平台以及支持海量音视频格式等特点,已经成为全球最知名的媒体播...

    推荐理由:来自IT之家 AI的《开源媒体播放器 VLC 全球下载量突破 70 亿次》。重点看模型能力与工程、开源生态、产品发布。摘要提到:IT之家 9 月 1 日消息,在流媒体平台不断涨价的今天,开源媒体播放器 VLC Media Player 依然保持着强大的生命力。 据 VLC 总裁兼首席开发者 Jean-Baptiste Kempf 公告,目前 VLC 在全平台累计下载量已经突破 70 亿次,此次里程碑距离 VLC 在 2025 年 1 月突破 60 亿次下载约 18 个月。 Kempf 同时透露,开发团队近期已经将 VLC 移植到亚马逊面向电视推出的全新 Vega OS 平台,并计划继续完善对其他平台和媒体编码格式的支持。目前,VLC 4 也仍在开发之中,不过由于开发工作较为复杂,新版本还需要一段时间才能正式发布。 IT之家注意到,VLC 开发团队去年还曾展示基于本地 AI 模型的自动翻译和字幕功能,但目前尚不清楚这些功能具体正式上线时间。 从 1996 年首次发布至今,VLC 凭借免费、开源、跨平台以及支持海量音视频格式等特点,已经成为全球最知名的媒体播...

  10. IT之家 AI64

    无人配送车逆行挡停公交车,九识客服回应称初步判断系路线设置问题

    IT之家 9 月 1 日消息,据新京报报道,陕西西安灞桥区纺东街一辆无人配送车 8 月 31 日逆行挡停公交车。视频拍摄者孙先生说,当时是放学的高峰期,所有车都在路上排队, 无人配送车打了转向后就直接逆行过去了,公交车就被堵走不了了 。 9 月 1 日,九识无人车客服人员表示,该车已关机调试, 初步判断系路线设置问题导致逆行 ,目前已安排人员进行核查处理。 IT之家查询获悉,九识(Zelos)成立于 2021 年,是一家无人驾驶科技公司。2022 年 5 月,九识正式发布首台无人物流原型车,标志着公司迈向自主配送领域的关键第一步。 今年 7 月,九识智能在 2026 世界人工智能大会现场宣布实现 L4 级无人驾驶无图方案规模化量产 ,成为全球首个实现 L4 级无图方案量产的企业。该方案已在九识智能新增运营路线中实现 30% 的渗透率。

    推荐理由:来自IT之家 AI的《无人配送车逆行挡停公交车,九识客服回应称初步判断系路线设置问题》。重点看产品发布。摘要提到:IT之家 9 月 1 日消息,据新京报报道,陕西西安灞桥区纺东街一辆无人配送车 8 月 31 日逆行挡停公交车。视频拍摄者孙先生说,当时是放学的高峰期,所有车都在路上排队, 无人配送车打了转向后就直接逆行过去了,公交车就被堵走不了了 。 9 月 1 日,九识无人车客服人员表示,该车已关机调试, 初步判断系路线设置问题导致逆行 ,目前已安排人员进行核查处理。 IT之家查询获悉,九识(Zelos)成立于 2021 年,是一家无人驾驶科技公司。2022 年 5 月,九识正式发布首台无人物流原型车,标志着公司迈向自主配送领域的关键第一步。 今年 7 月,九识智能在 2026 世界人工智能大会现场宣布实现 L4 级无人驾驶无图方案规模化量产 ,成为全球首个实现 L4 级无图方案量产的企业。该方案已在九识智能新增运营路线中实现 30% 的渗透率。

  11. IT之家 AI34

    宇树消防机器人亮相,能背水炮、不怕火烧

    IT之家 9 月 1 日消息,宇树科技昨日晚间晒出一段视频,展示了其 四足机器人消防应急解决方案 。 从视频可以看到,宇树展示了 A2-W 背负机器狗、B2 智能水炮机器狗、A2-W 侦测机器狗、B2 侦测机器狗、As2 云台侦查机器狗、B2 卫星侦查机器狗、A2-W 建模机器狗等产品, 还有不怕火烧的 B2 耐高温机器狗 。 IT之家注意到,消防员可通过机器狗与被困人员进行 双向语音对讲 。

    推荐理由:来自IT之家 AI的《宇树消防机器人亮相,能背水炮、不怕火烧》。重点看产品发布。摘要提到:IT之家 9 月 1 日消息,宇树科技昨日晚间晒出一段视频,展示了其 四足机器人消防应急解决方案 。 从视频可以看到,宇树展示了 A2-W 背负机器狗、B2 智能水炮机器狗、A2-W 侦测机器狗、B2 侦测机器狗、As2 云台侦查机器狗、B2 卫星侦查机器狗、A2-W 建模机器狗等产品, 还有不怕火烧的 B2 耐高温机器狗 。 IT之家注意到,消防员可通过机器狗与被困人员进行 双向语音对讲 。

8月31日周一
  1. IT之家 AI72

    沙特 13 岁以上公民和居民可免费使用 Adobe 两项服务 1 年,总价超 40 亿美元

    IT之家 8 月 31 日消息,Adobe 当地时间今日在沙特阿拉伯首都利雅得举行的 LEAP 2026 大会上宣布,沙特 13 岁以上公民和居民将 获得 Adobe Firefly Standard 及 Adobe Express Premium 的 12 个月免费使用权 。 这是 Adobe 与沙特通信和信息技术部、沙特主权财富基金 PIF 旗下人工智能企业 HUMAIN 扩展合作的一部分,覆盖超 2700 万沙特人,总价值超过 40 亿美元 (IT之家注:现汇率约合 269.43 亿元人民币) 。 Adobe 同时宣布自今天起在全球范围内的 Adobe Express 桌面版、网页版和 iOS 版上 提供现代标准阿拉伯语(从右到左)语言支持 ,包括排版、文本编辑、用户界面控件以及一系列专为沙特文化量身定制的模板。 此外,HUMAIN 和 Adobe 即将联合推出一款图像模型。该模型能根据沙特公民和创意团队的文化背景、视觉参...

    推荐理由:来自IT之家 AI的《沙特 13 岁以上公民和居民可免费使用 Adobe 两项服务 1 年,总价超 40 亿美元》。重点看模型能力与工程、文化创意。摘要提到:IT之家 8 月 31 日消息,Adobe 当地时间今日在沙特阿拉伯首都利雅得举行的 LEAP 2026 大会上宣布,沙特 13 岁以上公民和居民将 获得 Adobe Firefly Standard 及 Adobe Express Premium 的 12 个月免费使用权 。 这是 Adobe 与沙特通信和信息技术部、沙特主权财富基金 PIF 旗下人工智能企业 HUMAIN 扩展合作的一部分,覆盖超 2700 万沙特人,总价值超过 40 亿美元 (IT之家注:现汇率约合 269.43 亿元人民币) 。 Adobe 同时宣布自今天起在全球范围内的 Adobe Express 桌面版、网页版和 iOS 版上 提供现代标准阿拉伯语(从右到左)语言支持 ,包括排版、文本编辑、用户界面控件以及一系列专为沙特文化量身定制的模板。 此外,HUMAIN 和 Adobe 即将联合推出一款图像模型。该模型能根据沙特公民和创意团队的文化背景、视觉参...