本期为本站采集记录汇总版
AI 日报 · 2026 年 9 月 7 日 · 星期一
AI.BAIZE
Supporting independent journalism in Ukraine
事实摘要:OpenAI、AIRPPU和WAN-IFRA启动了一个AI项目,旨在帮助乌克兰新闻机构增强创新、韧性及独立性。影响判断:有助于提高乌克兰新闻机构的报道质量和影响力,促进国际新闻界的合作与交流。场景价值:支持独立记者和新闻媒体在乌克兰的报道。
模型发布/更新
判断用不用你的软件,Agent 只需 500 个 Token
作者|宇航猿 编辑|靖宇 现在几乎每个开发者都在用 AI Agent 干活。Cursor、Claude Code、Windsurf、Gemini CLI,各种 Coding Agent 已经深度嵌入了日常工作流。一个普遍的体验是,让 Agent 去调某些 API 或者集成某个服务,有些丝滑得像开了挂,有些则反复报错,甚至直接编造出一个根本不存在的接口。 大多数人把这归结为: 「 模型还不够聪明 」。 但如果反过来想, 不是 Agent 不够聪明,而是有些产品天然对 Agent 友好,有些则天然对 Agent 充满敌意 。 这像极了十几年前的 SEO。你觉得自己的网站内容很好,但 Google 就是不收录,问题不在 Google 的算法,而在于你的网站没有做搜索引擎优化。 今天同样的事情正在 Agent 身上重演,只不过这一次,大多数产品甚至不知道自己正在被「审判」。 Google Cloud AI 工程总监 Addy Osman...
AI 大模型周榜:国产多模型扎堆入榜前端开发榜,阿里 wan3.0 冲进视频榜前三
IT之家 9 月 7 日消息,Arena( arena.ai )平台本周发布 2026 年第 36 周(8 月 31 日 ~9 月 6 日)AI 大模型盲测排名,本期迎来多个重量级新模型入榜,其中多款国产模型在细分榜单实现亮眼突破。 前端开发榜中, 阿里 qwen3.8-max-0902 首次入榜即位列第 4 ,阿里 qwen3.8-flash-next、腾讯 hy4-preview、智谱 glm-5.3-flash 也同步首次入榜并杀入前 15; AI 视频榜中, 阿里 wan3.0 首次入榜直接冲进前三 ,展现国产生成视频模型的最新竞争力。 整体来看,头部格局仍以海外模型为主,但国产模型在细分领域的进步速度值得关注。 IT之家注 :本榜单基于 Arena( arena.ai )平台匿名盲测投票,通过 ELO(智能体榜为百分比信号)计算排名,反映用户主观偏好而非绝对能力测试;不同分榜相互独立,不宜跨榜比较,分差在误差范围内均视...
科大讯飞星火 X2.5 模型正式发布:293B-A30B MoE,全国产平台训练
IT之家 9 月 7 日消息,科大讯飞 (iFlytek) 今日正式发布星火 Spark-X2.5 多语言文本生成模型。该模型 基于全国产平台训练 ,采用 MoE 框架,模型参数 293B-A30B,支持 256K 上下文。 星火 X2.5 全面提升代码和智能体能力 ,同时覆盖 200 余种语言,在语言理解、答题、推理等通用任务上保持优异的效果。 这款模型目前已在讯飞星辰 MaaS 平台上线,定价如下: 输入:1.6 元人民币 / 百万词元 (Token); 输入缓存命中:0.24 元人民币 / 百万词元; 输出:6 元人民币 / 百万词元。
百度 2026 小度新品发布会定档 9 月 8 日,将发布智能屏、闺蜜机、音箱等新品
IT之家 9 月 7 日消息,小度今日官宣,百度 AI 开放日“2026 小度新品发布会”定档 9 月 8 日 14:00 ,将发布搭载超能小度智能体能力的小度添添闺蜜机、小度智能屏、小度智能摄像机等多款硬件新品。 从邀请函可以看到,小度将发布小度智能屏、小度摄像机 AI 看护智能体 2.0、小度闺蜜机、小度智能音箱等产品。 据IT之家去年 11 月报道, 小度发布其全新升级的多模态 AI 智能助手 —— 超能小度 ,并宣布全系、全量、全生态上线。数千万台已售小度设备将免费升级超能小度,为所有小度用户带来人机交互的新体验。
曙光介绍全球首款 64 线程移动工作站 N50 Pro:CPU 频率可达 4.3GHz
IT之家 9 月 7 日消息,中科曙光 (Sugon) 曾在早些时候官宣了 全球首款 64 线程移动工作站 (MWS) 产品 。而在本月 2 日, 曙光确认该产品名称为 N50 Pro ,并对其具体规格进行了进一步的介绍。 N50 Pro 的 CPU 单线程频率至高可达 4.3GH z 、 GPU 主频则达 3.3GHz ,支持 128GB 内存、8TB 存储。 其配备 "4K" 分辨率 120Hz 刷新率屏幕,色偏 ΔE<1,屏占比达 93%;薄至 16.9mm、轻至 1.69kg。 整机采用隐藏式接口设计,提供全套“大满贯”高速接口,支持多屏 4K 输出,数据传输速率可达“万兆”(10Gbps) 级别。 另根据此前披露,N50 Pro 的独立 GPU 配备 16GB 显存;本地运行 35B MoE 模型可实现 50 Tokens/s 的输出速率,AI 推理速度最高可达业界主流产品 3~5 倍。
「AI Native 」不是魔法,「创业者」这三个字依旧厚重
上个月,我集中跑了一趟上海和深圳,也跟几位在 AI 前沿一线折腾的创业者深聊了几次。 齐俊元的新产品干了半年,我问他这阶段最大的收获是什么,他说了句挺朴素的话:「真的伸手去干的时候,你会发现认真还是挺重要的。」 这话听着很普通,事后却让我不断想起,放到当下的行业环境下看,也挺让人警醒的。 3 年来深入聊过至少 200 位 AI 创业者了,现在有一些已经有点丧气了。「AI 应用已经不能投了」的观点也在业内流传。觉得这不能干,那不能干,机会没了,窗口关了。但你反过来看,那些真正跑出来的产品,都有一个共同点——特别笃定地扎在一个方向上,然后往死里抠细节。 比如俊元做的产品,真正让我惊异的不是产品形态的创新,而是远超我想象的数据表现。你问他怎么做到的,他说就是要一点一点抠,数据、框架、工程,全都要优化,接下来要做后训练,说的全是细活。一步一步,日拱一卒。 Vivix 刘宇那边也是。他给我展示了他们模型的生成效率,...
产品发布/更新
国内首份办公Agent用户行为报告发布:北京用户量全国居首,海外用户占比超12%
9月7日,国内首份《中国办公Agent用户行为不完全报告》在京发布。 这条动态来自 量子位,可重点关注智能体工作流、产品发布。
业内首个!“千问办公”推出“多人工作台”
近日,阿里巴巴旗下Agent产品“千问办公”推出业内首个“多人工作台”。 这条动态来自 量子位,可重点关注智能体工作流、产品发布。
AI 时代,「种草」这件事会变成什么样?
作者|靖宇 互联网时代,鲜有一个网站或者应用,能像小红书一样在不停的转换身份和功能的进化中,穿越周期。 对于现在的网民来说,你几乎能在小红书上面搜索到各种小妙招。它还是攻略集宝鉴,哪里旅游不踩坑全部奉献给小伙伴。 当然,没人能忘了,这是国内公认的「种草」平台,甚至,「种草」这两个字的本源,就来自小红书本身。 在 AI 时代,信息和内容以指数级的增速被生产出来,一方面确实拉低了「种草内容」的创作门槛,但另一方面,AIGC 内容的泛滥,也让用户对平台内容产生了「过敏」,降低了对于内容的信任。 对于营销从业者来说,这可能是一个新时代的挑战。 如何在 AI 时代,让品牌能够更精准的找到目标用户,更重要的是,如何让品牌在这样一个内容泛滥的时期,重新赢得用户的「信任」? 不久前,极客公园请到了小红书种草产品负责人许晴、悦普集团 COO 鲍白白,进行了一场深入的探讨,想要弄清,在 AI 时代,「种草」这件事将会如何进化?品牌又该如何借助平台的...
论文研究
OpenAI 宣布达到自动化研究实习生里程碑,内部 agent 运行时达人力 3.1 倍OpenAI just officially said it has reached its "auto...
事实摘要:OpenAI 宣布达到自动化研究实习生里程碑,内部 agent 运行时达人力 3.1 倍OpenAI just officially said it has reached its "auto... 事实摘要:OpenAI 宣布达到自动化研究实习生里程碑,内部 agent 运行时达人力 3.1 倍OpenAI just officially said it 。影响判断:它可能改变智能体工作流、模型能力与工程相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪智能体工作流、模型能力与工程方向的选题、竞品观察和落地方案筛选。
一天烧 7000 美元!OpenAI 研究员疯狂用 AI 写代码
IT之家 9 月 7 日消息,OpenAI 首次披露了旗下研究人员在 AI 编程智能体上的使用规模和成本。 这家 AI 公司当地时间上周日发布博客文章称,在 OpenAI 的研究人员中,使用 AI 编程智能体最频繁的一批用户,如今每天消耗的词元(Token)价值已经超过 7,000 美元 (IT之家注:现汇率约合 47,036 元人民币) 。Token 是 AI 模型读取和生成文本时使用的基本单位。 OpenAI 表示,在过去一年中,这项技术已经显著改变了公司研究人员的工作方式。员工编写和交付代码的速度更快,能够开展更多实验,同时也开始将越来越高级、更复杂的任务交给 AI 编程智能体完成。 该公司表示,过去三个月,研究人员使用 AI 编程智能体的规模出现爆发式增长,增长速度甚至超过 OpenAI 内部其他团队。 根据 OpenAI 公布的数据,截至 8 月中旬,该公司研究部门一名普通研究人员每天使用的 Token 价值中位数已经...
宇树科技:全球首次实现世界模型实时驱动全自主人形机器人格斗
IT之家 9 月 7 日消息,宇树科技今日宣布, 全球首次 实现世界模型实时驱动全自主人形机器人格斗。官方一同公布了全自主人形机器人格斗的 实拍画面 。 官方表示,UnifoLM-X2-1.0 突破世界-动作大模型瞬时规划、决策和动态交互执行等瓶颈,实现高动态、强交互、实时实现对未来预测和规划, 实现人形机器人全自主搏击 。验证了世界模型驱动的人形机器人大规模落地部署的基础可行性。 延伸阅读 在此次“全球首次”之前,宇树科技人形机器人已有多次公开“格斗”亮相。2025 年 11 月 5 日第八届中国国际进口博览会首日,两台宇树人形机器人就曾在展台展开擂台格斗表演,引来现场观众围观。 相较彼时的展示,此次 UnifoLM-X2-1.0 的突破在于机器人不再依赖预设程序或人工遥控,而是通过世界模型实时预测未来状态并自主完成决策与动态交互执行。 “世界模型”是近年具身智能领域的热门研究方向,核心理念是让智能体在内部建立对物理世界的预测...
GPT-6不只Astra!Sol内测结果曝光,速度快6倍
OpenAI研究院人均带3个AI实习生 这条动态来自 量子位,可重点关注其对 AI 应用和产业节奏的影响。
GPT-6 发布后,OpenAI 又自曝「外星思维」,AGI 真的来了?
事实摘要:GPT-6 发布后,OpenAI 又自曝「外星思维」,AGI 真的来了? 未来刚才来,它从何而来 #欢迎关注爱范儿官方微信公众号:爱范儿(微信号:ifanr),更多精彩内容第一时间为您奉上。 这条动态来自 爱范儿,可重点关注产品发布。 GPT-6 发布后,OpenAI 又自曝「外星思维」,AGI 真的来了? 未来刚才来,它从何而来 #欢迎关注爱范儿官方微信公。影响判断:它可能改变AI 应用价值相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪AI 应用价值方向的选题、竞品观察和落地方案筛选。
DeepSeek、千问、智谱轮番登场,PC 厂商终于等到了它们的弹药
事实摘要:DeepSeek、千问、智谱轮番登场,PC 厂商终于等到了它们的弹药 AMD 想用电脑把昂贵的 AI Token 账单降下来 #欢迎关注爱范儿官方微信公众号:爱范儿(微信号:ifanr),更多精彩内容第一时间为您奉上。 这条动态来自 爱范儿,可重点关注其对 AI 应用和产业节奏的影响。 DeepSeek、千问、智谱轮番登场,PC 厂商终于等到了它们的弹药 A。影响判断:它可能改变AI 应用价值相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪AI 应用价值方向的选题、竞品观察和落地方案筛选。
文化创意
OpenAI GPT-6 Astra 模型自主通关 3D 解谜游戏《传送门》:耗时 24 小时,成本 571 美元
IT之家 9 月 7 日消息,一名 AI 和大语言模型爱好者近日进行了一项实验,让 OpenAI 的新模型 GPT-6 Astra 自主通关了 Valve 旗下 3D 解谜游戏《传送门》。 从结果来看,这对大语言模型而言无疑是极具突破性的进步,也是对多模态“AI 智能”的一次颇具说服力的展示。不久之前,AI 甚至还会在 Atari 2600 国际象棋游戏中输掉比赛,而如今已经能够自主通关整个 3D 解谜游戏。 这次《传送门》通关过程共进行了 3336 次工具调用,按照 API 价格计算,成本达 571.18 美元 (IT之家注:现汇率约合 3,838 元人民币) 。 实验发起者 CozyBlaze 随后澄清称,这些成本实际上由其每月 200 美元 (现汇率约合 1,344 元人民币) 的 Codex Pro 订阅服务覆盖。 CozyBlaze 解释称:“模型通过 MCP,也就是 Model Context Protocol,以及...
华为鸿蒙 HarmonyOS 7 操作系统正式发布:全新空间美学设计语言,搭载系统智能体小艺
IT之家 9 月 7 日消息,华为鸿蒙 HarmonyOS 7 操作系统今天在全场景新品发布会正式发布。新系统主打全新空间美学,搭载 Harmony Intelligence 智能架构,拥有系统智能体小艺, 即日起正式开启公测 。 IT之家从发布会现场了解到,鸿蒙 7 系统采用空间美学设计语言, 锁屏界面新增 3D 空间壁纸 、 空间时钟功能 ,可将照片中的元素与 3D 时钟巧妙结合,带来更加立体的壁纸效果。新系统还将液态玻璃带到了通知中心、文件夹等地方。 智能化方面,鸿蒙 7 系统搭载 Harmony Intelligence 智能架构, 支持系统级智能体小艺 ,可将四层记忆架构、应用 Skills、云端 / 端侧大模型、多端协同无缝融合,可带来浏览器助手、通知聚合、智能录音、智能短信、游戏伙伴等应用场景,小艺可以打通系统的各个角落,让用户一句话使用各种功能。 安全方面,鸿蒙 7 系统带来全新升级的星盾防诈能力。 支持 AI ...
Anthropic 15 亿美元 AI 版权和解金开始陆续发放,但出版社和作者分配补偿争议不断
IT之家 9 月 7 日消息,Anthropic 去年就版权集体诉讼案达成和解。法院裁定,Anthropic 使用受版权保护的材料训练 AI 模型符合“合理使用”(Fair Use)原则,属于合法行为,但通过盗版方式获取这些材料则不受合理使用保护,因此 Anthropic 将为训练模型时使用的近 50 万部盗版作品原作者提供赔偿,补偿标准为每部盗版作品 3,000 美元 (IT之家注:现汇率约合 20,203 元人民币) ,和解金合计为 15 亿美元 (现汇率约合 101.02 亿元人民币) ,该和解方案今年 7 月获得最终批准,相关赔偿金随后开始进入发放流程。 根据和解协议,如果相关图书仍由传统出版社出版,赔偿金将由作者和出版社各分 50%;如果图书由作者自行出版,或者出版社此前已经让该图书绝版并将版权返还给作者,那么 3,000 美元 (现汇率约合 20,203 元人民币) 赔偿金应全部归作者所有。 不过,近期一些作者在社交...
消息称字节正开发实时空间视频生成 AI 模型:张一鸣亲自督导,最快下个月发布
IT之家 9 月 7 日消息,据彭博社报道,字节跳动正准备推出一款实时空间视频生成 AI 模型。创始人张一鸣正亲自督导这款新模型的研发工作,该模型计划最早于下月发布。 知情人士透露, 张一鸣近期一直在协调公司各业务部门的协作,并调动 AI 资源及算力全力推进该项目 。其中一位知情人士指出,发布时间尚未最终确定,计划仍可能发生变动。 据介绍,该模型基于字节跳动现有的电影级视频生成 AI 模型 Seedance 构建 ,将允许用户面向直播、短剧和游戏创建交互式虚拟世界。字节跳动发言人未回应置评请求。 知情人士称,张一鸣将空间视频模型定位为驱动整个生态的“飞轮(Flywheel)”—— 该模型能够将用户置于高度沉浸的三维虚拟环境中 ,功能与谷歌的 Genie 类似。字节跳动得以将其自研 AI 模型、云计算底层资源,与旗下的内容平台以及 XR 业务分支 Pico 的硬件终端深度串联、协同发力。 字节跳动最新的模型旨在生成能够响应 Pic...
Kaleidescape 发布 Compact Terra Prime 246TB SSD 电影存储服务器
IT之家 9 月 7 日消息,高清电影数字资源企业 Kaleidescape 当地时间本月 1 日宣布推出 Compact Terra Prime 246TB SSD 电影(存储)服务器。这一型号创下了该企业同类产品的容量纪录。 Compact Terra Prime 246TB SSD 搭载两块 122.88TB 固态硬盘,足以存放 4000 部高码率 4K 电影, 三台服务器即可装下 Kaleidescape 的整个资源库 。 这款设备采用黑色阳极氧化铝机身,通过 2.5GbE RJ-45 下载媒体资源,可同时播放 25 路视频流。此外其典型噪声 20dB(A),可借助托架安装在 1U 19" 机架空间中。
DLSS 5 提升显卡功耗,已出现 RTX 5090 供电接口熔化案例
IT之家 9 月 7 日消息,上周 DLSS 5 正式登陆《NBA 2K27》,开启游戏中的 DLSS 5 3D 引导神经渲染技术后,GPU 功耗会明显增加。 以 GeForce RTX 5090 Founders Edition 为例,关闭 DLSS 5 时,显卡功耗约为 465W;开启 DLSS 5 后,最高功耗则升至 575W。 据IT之家了解,GeForce RTX 5080 开启 DLSS 5 后也会出现类似情况,功耗同样增加约 100W,达到 GPU 360W 的功耗上限。随着 RTX 5070 及以上型号的 GeForce RTX 50 系列显卡全部采用新款 12V-2x6 供电接口,近年来已经不断出现供电线缆过热、熔化的案例,受损的不仅包括线缆和接口,甚至还可能波及 GPU 本身。 业内普遍认为,显卡功耗越高,供电线缆出现过热和故障的可能性就越大。因此,DLSS 5 这类会将 RTX 5090 等高端 GPU 推...
开源项目
腾讯混元:Hy4 preview 模型升级,显著降低任务轮次及输入输出 Token 消耗
IT之家 9 月 7 日消息,腾讯混元与 WorkBuddy 联合团队今日宣布,针对 Hy4 preview 模型“复杂任务下的长思考、过度自我验证”等问题,进行了专项优化并全量上线。 通过 Bench 指标与人工评测双重监控, 在不损失任务效果的前提下,优化版本显著降低了任务轮次及输入输出 token 消耗 。 据IT之家此前报道,腾讯于 8 月 28 日 发布了 Hy4 preview 模型 ,总参数 770 B,激活参数 49 B,上下文长度 1M。 官方表示,Hy4 preview 在模型尺寸、上下文长度、数据规模上都进行了显著的扩展,预训练和后训练的共同进步带来了智能水平的又一次巨大提升, 稳居开源模型第一梯队 。