跳到正文
10月4日周日
  1. Claude Code Releases86

    Claude Code Releases v2.1.289:Fixed a deny or ask rule on a nested part of a compound sh...

    这条英文动态主要涉及文化创意。原文要点:What's changed Fixed a deny or ask rule on a nested part of a compound shell command not holding over a user-installed mod's approval on managed machines Fixed the terminal freezing on short code blocks with many unclosed tags or deeply nested ${ substitutions Fixed Read deny rules not applying to files @-mentioned, changed, or selected in the IDE through a symlink [VSCode] Reverted a 2.1.288 change to claude auth st...

    推荐理由:来自Claude Code Releases的《Claude Code Releases v2.1.289:Fixed a deny or ask rule on a nested part of a compound sh...》。重点看文化创意。摘要提到:这条英文动态主要涉及文化创意。原文要点:What's changed Fixed a deny or ask rule on a nested part of a compound shell command not holding over a user-installed mod's approval on managed machines Fixed the terminal freezing on short code blocks with many unclosed tags or deeply nested ${ substitutions Fixed Read deny rules not applying to files @-mentioned, changed, or selected in the IDE through a symlink [VSCode] Reverted a 2.1.288 chan...

  2. Simon Willison87

    September sponsors-only newsletter

    这条英文动态主要涉及模型能力与工程、文化创意。原文要点:I just sent the September edition of my sponsors-only monthly newsletter . If you are a sponsor (or start a sponsorship now) you can access it here . This month: More Fable class models A pricing war 3D graphics, Blender, and pixel art LLMs come for mathematics So many more accidental cyberattacks The vulnapocalypse comes for Datasette What I'm using right now My software releases this month 2026 in LLMs (so far) Her...

    推荐理由:来自Simon Willison的《September sponsors-only newsletter》。重点看模型能力与工程、文化创意。摘要提到:这条英文动态主要涉及模型能力与工程、文化创意。原文要点:I just sent the September edition of my sponsors-only monthly newsletter . If you are a sponsor (or start a sponsorship now) you can access it here . This month: More Fable class models A pricing war 3D graphics, Blender, and pixel art LLMs come for mathematics So many more accidental cyberattacks The vulnapocalypse comes for Datasette What I'm using right now My software releases this mon...

10月3日周六
  1. 爱范儿38

    AI 视频榜全球第二,藏着一家新影视公司的野心

    一家影视公司,杀进了视频模型的决赛圈 #欢迎关注爱范儿官方微信公众号:爱范儿(微信号:ifanr),更多精彩内容第一时间为您奉上。 这条动态来自 爱范儿,可重点关注模型能力与工程。

    推荐理由:来自爱范儿的《AI 视频榜全球第二,藏着一家新影视公司的野心》。重点看模型能力与工程。摘要提到:一家影视公司,杀进了视频模型的决赛圈 #欢迎关注爱范儿官方微信公众号:爱范儿(微信号:ifanr),更多精彩内容第一时间为您奉上。 这条动态来自 爱范儿,可重点关注模型能力与工程。

  2. IT之家 AI68

    将语音与音乐作为单一连贯音轨共同生成,AI 音乐制作平台 Suno 推出 Speech 语音功能

    IT之家 10 月 3 日消息,当地时间 10 月 1 日,AI 音乐制作平台 Suno 宣布推出 Speech,Suno 宣称这是 业界首个能够将语音与音乐作为单一连贯音轨共同生成的音频模型 。 据悉,该模型并非像传统工作流那样先做 TTS(文本转语音)再拼接 BGM,而是端到端一体化生成,是首个能单次生成完整融合“语音朗读 + 原创 BGM”的端到端闭源音频模型。 在过去一个月中,Suno 与小范围用户共同测试了该功能,现在正式面向所有人开放公测(Beta)。 官方表示,通过 Speech,用户可以轻松创作带有 BGM 的语音音频。该功能已直接内置于 Suno 中:只需输入一个灵感、一首诗或一段文字,再描述用户心目中的音色与音乐风格即可。 IT之家注意到,Suno 官方也指出了当前 Beta 版的不足,当前版本偶发口音不稳定的问题,例如英音可能会在中途漂移到澳音然后又漂回来;语调与情感停顿有时会显得“过于戏剧化”,导致断句节...

    推荐理由:来自IT之家 AI的《将语音与音乐作为单一连贯音轨共同生成,AI 音乐制作平台 Suno 推出 Speech 语音功能》。重点看智能体工作流、模型能力与工程。摘要提到:IT之家 10 月 3 日消息,当地时间 10 月 1 日,AI 音乐制作平台 Suno 宣布推出 Speech,Suno 宣称这是 业界首个能够将语音与音乐作为单一连贯音轨共同生成的音频模型 。 据悉,该模型并非像传统工作流那样先做 TTS(文本转语音)再拼接 BGM,而是端到端一体化生成,是首个能单次生成完整融合“语音朗读 + 原创 BGM”的端到端闭源音频模型。 在过去一个月中,Suno 与小范围用户共同测试了该功能,现在正式面向所有人开放公测(Beta)。 官方表示,通过 Speech,用户可以轻松创作带有 BGM 的语音音频。该功能已直接内置于 Suno 中:只需输入一个灵感、一首诗或一段文字,再描述用户心目中的音色与音乐风格即可。 IT之家注意到,Suno 官方也指出了当前 Beta 版的不足,当前版本偶发口音不稳定的问题,例如英音可能会在中途漂移到澳音然后又漂回来;语调与情感停顿有时会显得“过于戏剧化”,导致断句节...

  3. OpenAI News92

    A model guide for the GPT-6 family

    这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意。原文要点:Learn how startups can choose GPT-6 models, tune reasoning effort, improve prompts and skills, coordinate tools, and prepare workflows for production.

    推荐理由:来自OpenAI News的《A model guide for the GPT-6 family》。重点看智能体工作流、模型能力与工程、文化创意。摘要提到:这条英文动态主要涉及智能体工作流、模型能力与工程、文化创意。原文要点:Learn how startups can choose GPT-6 models, tune reasoning effort, improve prompts and skills, coordinate tools, and prepare workflows for production.

10月2日周五
  1. Cloudflare AI92

    Introducing Web Search API via AI Gateway

    这条英文动态主要涉及模型能力与工程、文化创意、产品发布。原文要点:Cloudflare AI Gateway now supports native web search API integration in partnership with Ceramic.ai, Exa, and Linkup. Developers can now inject real-time web context into model inference calls via AI Gateway, REST APIs, or Workers bindings.

    推荐理由:来自Cloudflare AI的《Introducing Web Search API via AI Gateway》。重点看模型能力与工程、文化创意、产品发布。摘要提到:这条英文动态主要涉及模型能力与工程、文化创意、产品发布。原文要点:Cloudflare AI Gateway now supports native web search API integration in partnership with Ceramic.ai, Exa, and Linkup. Developers can now inject real-time web context into model inference calls via AI Gateway, REST APIs, or Workers bindings.

  2. Claude Code Releases89

    Claude Code Releases v2.1.287:Added Claude Mods: plugins may now modify deeper behavior ...

    这条英文动态主要涉及智能体工作流、文化创意。原文要点:What's changed Added Claude Mods: plugins may now modify deeper behavior Added You should know, a built-in mod where a side agent watches your back and flags things you or Claude might miss. Turn it on with /plugin enable cc-plugin-you-should-know@builtin (for first-party sessions with telemetry on) Added an n: filter to the agents view that matches session names and tasks; a filter now shows matches in collapsed sec...

    推荐理由:来自Claude Code Releases的《Claude Code Releases v2.1.287:Added Claude Mods: plugins may now modify deeper behavior ...》。重点看智能体工作流、文化创意。摘要提到:这条英文动态主要涉及智能体工作流、文化创意。原文要点:What's changed Added Claude Mods: plugins may now modify deeper behavior Added You should know, a built-in mod where a side agent watches your back and flags things you or Claude might miss. Turn it on with /plugin enable cc-plugin-you-should-know@builtin (for first-party sessions with telemetry on) Added an n: filter to the agents view that matches session names and tasks; a filter now sho...

10月1日周四
  1. Cloudflare AI55

    One year later: Sovereign AI and the fight for choice

    这条英文动态主要涉及模型能力与工程。原文要点:AI sovereignty is not a zero-sum game, but many governments now believe it is. Cloudflare's answer: more local open-source models, model-agnostic security tools, and a commitment to giving nations genuine choice.

    推荐理由:来自Cloudflare AI的《One year later: Sovereign AI and the fight for choice》。重点看模型能力与工程。摘要提到:这条英文动态主要涉及模型能力与工程。原文要点:AI sovereignty is not a zero-sum game, but many governments now believe it is. Cloudflare's answer: more local open-source models, model-agnostic security tools, and a commitment to giving nations genuine choice.

  2. Apple Machine Learning Research85

    RLTL;DR: Self-Improvement by Internalizing Self-Generated Feedback

    这条英文动态主要涉及智能体工作流、模型能力与工程、教育应用。原文要点:The common paradigm of reinforcement learning with verifiable rewards (RLVR) is to let agents make multiple attempts at a task, and optimize towards the successful ones. This becomes problematic in the realms of self-improvement, where tasks are so difficult that the agent has a low or even no chance of success, and where there are no teacher models or example solutions to distill from. In this paper, we introduce RL...

    推荐理由:来自Apple Machine Learning Research的《RLTL;DR: Self-Improvement by Internalizing Self-Generated Feedback》。重点看智能体工作流、模型能力与工程、教育应用。摘要提到:这条英文动态主要涉及智能体工作流、模型能力与工程、教育应用。原文要点:The common paradigm of reinforcement learning with verifiable rewards (RLVR) is to let agents make multiple attempts at a task, and optimize towards the successful ones. This becomes problematic in the realms of self-improvement, where tasks are so difficult that the agent has a low or even no chance of success, and where there are no teacher models or example solutions to distill f...

9月30日周三
  1. IT之家 AI34

    砺算 LX 7G100 显卡获推 Windows 驱动程序 30.0.2260.773,含 34 修复、33 优化

    IT之家 9 月 30 日消息,砺算 (LiSuan) 本月 28 日为其消费级显卡 LX 7G100 推送了 Pilot Release v30.0.2260.773 和 WHQL Release v29.0.2260.697 两版 Windows 操作系统驱动程序。 IT之家注意到,WHQL Release v29.0.2260.697 的发行说明并未提及具体改进; Pilot Release v30.0.2260.773 则明确包含 34 项修复和 33 项优化 ,解决了《英雄联盟:云顶之弈》等多款游戏不能进入的问题。

    推荐理由:来自IT之家 AI的《砺算 LX 7G100 显卡获推 Windows 驱动程序 30.0.2260.773,含 34 修复、33 优化》。重点看模型发布、文化创意。摘要提到:IT之家 9 月 30 日消息,砺算 (LiSuan) 本月 28 日为其消费级显卡 LX 7G100 推送了 Pilot Release v30.0.2260.773 和 WHQL Release v29.0.2260.697 两版 Windows 操作系统驱动程序。 IT之家注意到,WHQL Release v29.0.2260.697 的发行说明并未提及具体改进; Pilot Release v30.0.2260.773 则明确包含 34 项修复和 33 项优化 ,解决了《英雄联盟:云顶之弈》等多款游戏不能进入的问题。

  2. OpenAI News92

    Helping small businesses put AI to work

    事实摘要:这条英文动态主要涉及模型能力与工程、文化创意、开源生态,原文信息显示:Helping small businesses put AI to work 这条英文动态主要涉及模型能力与工程、文化创意、开源生态。原文要点:OpenAI is partnering with America’s SBDC to expand hands-on AI training 。影响判断:它可能改变模型能力与工程、文化创意、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程、文化创意、开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和模型能力与工程、文化创意、开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  3. IT之家 AI72

    微软推出实验性多模态 AI 研究系统 Project Quine,有望大幅加速药物发现

    IT之家 9 月 30 日消息,当地时间 29 日,微软研究院推出了实验性多模态 AI 研究系统 Project Quine。据悉,Project Quine 是一套 用于生物学研究的“世界模型” ,目标是把计算生物学建模与实际湿实验衔接起来。 Project Quine 由微软研究院与哈佛大学和麻省理工学院博德研究所共同开发。系统将覆盖 基因组学、蛋白质、化学、细胞状态和生物成像 的联合表征世界模型,与交互式推理框架结合起来。为了让科研人员尽早使用 Project Quine,微软开放了首届 Quine Fellows 项目申请。未来,微软还计划通过 Microsoft Discovery 等产品逐步扩大商业化开放范围。 Project Quine 并不局限于某一个研究领域,而是能够 同时处理上述多个领域的信息 ,从而进行综合性的跨模型分析。借助这种架构,传统药物发现中的部分瓶颈有望得到突破:科研人员可以先通过计算方法预筛候选...

    推荐理由:来自IT之家 AI的《微软推出实验性多模态 AI 研究系统 Project Quine,有望大幅加速药物发现》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 30 日消息,当地时间 29 日,微软研究院推出了实验性多模态 AI 研究系统 Project Quine。据悉,Project Quine 是一套 用于生物学研究的“世界模型” ,目标是把计算生物学建模与实际湿实验衔接起来。 Project Quine 由微软研究院与哈佛大学和麻省理工学院博德研究所共同开发。系统将覆盖 基因组学、蛋白质、化学、细胞状态和生物成像 的联合表征世界模型,与交互式推理框架结合起来。为了让科研人员尽早使用 Project Quine,微软开放了首届 Quine Fellows 项目申请。未来,微软还计划通过 Microsoft Discovery 等产品逐步扩大商业化开放范围。 Project Quine 并不局限于某一个研究领域,而是能够 同时处理上述多个领域的信息 ,从而进行综合性的跨模型分析。借助这种架构,传统药物发现中的部分瓶颈有望得到突破:科研人员可以先通过计算方法预筛候选...

  4. IT之家 AI72

    尴尬时刻:OpenAI 全天候 AI 智能体 dots 首次公开演示卡壳

    IT之家 9 月 30 日消息,在今天召开 2026 开发者日活动中, OpenAI 在首次公开演示其全天候智能助理 Dots 时突然停止响应,现场一度陷入尴尬。 演示期间,OpenAI ChatGPT 团队产品负责人 Holly Li 要求名为“Dottie”的 Dot 为一款虚构音乐应用准备上线工作。然而,智能体迟迟没有回应,演示被迫暂停。面对现场冷场,主持人只能打趣说:“我猜 Dot 今天早上有点慢。”IT之家附上相关视频如下: OpenAI 介绍称,Dots 是能够持续运行的个人 AI 智能体,基于 GPT-6 Astra 模型,并配备独立云端计算机和浏览器,可在用户离开电脑后继续开展资料检索、内容撰写和代码处理等任务。

    推荐理由:来自IT之家 AI的《尴尬时刻:OpenAI 全天候 AI 智能体 dots 首次公开演示卡壳》。重点看智能体工作流、模型能力与工程、产品发布。摘要提到:IT之家 9 月 30 日消息,在今天召开 2026 开发者日活动中, OpenAI 在首次公开演示其全天候智能助理 Dots 时突然停止响应,现场一度陷入尴尬。 演示期间,OpenAI ChatGPT 团队产品负责人 Holly Li 要求名为“Dottie”的 Dot 为一款虚构音乐应用准备上线工作。然而,智能体迟迟没有回应,演示被迫暂停。面对现场冷场,主持人只能打趣说:“我猜 Dot 今天早上有点慢。”IT之家附上相关视频如下: OpenAI 介绍称,Dots 是能够持续运行的个人 AI 智能体,基于 GPT-6 Astra 模型,并配备独立云端计算机和浏览器,可在用户离开电脑后继续开展资料检索、内容撰写和代码处理等任务。

9月29日周二
  1. Simon Willison87

    OpenAI DevDay 2026 live blog

    这条英文动态主要涉及智能体工作流、模型能力与工程。原文要点:I'm at OpenAI DevDay today, in Fort Mason, San Francisco. Same as last year I'll be live blogging the keynote and some other notes during the day. OpenAI gave me a free ticket and a seat in the "creator" area for the keynote. Tags: ai , openai , generative-ai , llms , coding-agents , live-blog , openai-devday

    推荐理由:来自Simon Willison的《OpenAI DevDay 2026 live blog》。重点看智能体工作流、模型能力与工程。摘要提到:这条英文动态主要涉及智能体工作流、模型能力与工程。原文要点:I'm at OpenAI DevDay today, in Fort Mason, San Francisco. Same as last year I'll be live blogging the keynote and some other notes during the day. OpenAI gave me a free ticket and a seat in the "creator" area for the keynote. Tags: ai , openai , generative-ai , llms , coding-agents , live-blog , openai-devday

  2. MIT Technology Review AI58

    Making AI an asset, not an expense

    这条英文动态主要涉及模型能力与工程、文化创意、产品发布。原文要点:When customers talk about AI costs, the conversation usually starts with token prices and ends with access to the latest, most capable model in the cloud. Do they always need that level of capability? Not necessarily. But that is often where the conversation goes. As AI moves from experimentation to production, model choice is only…

    推荐理由:来自MIT Technology Review AI的《Making AI an asset, not an expense》。重点看模型能力与工程、文化创意、产品发布。摘要提到:这条英文动态主要涉及模型能力与工程、文化创意、产品发布。原文要点:When customers talk about AI costs, the conversation usually starts with token prices and ends with access to the latest, most capable model in the cloud. Do they always need that level of capability? Not necessarily. But that is often where the conversation goes. As AI moves from experimentation to production, model choice is only…

  3. IT之家 AI36

    《巫师 3:狂猎 — 重制版》游戏今日上线,原版玩家可免费升级

    IT之家 9 月 29 日消息,CDPR 旗下游戏《巫师 3:狂猎 — 重制版》今日上线, 拥有原版游戏的玩家可免费升级 。本作带来一系列改进,包括画面、玩法等多方面升级。 由于本次重制版升级较大,因此 PC 版的配置要求一并更新。请查看下方图片,了解最新的系统配置要求: IT之家附本作升级一览如下: 画面与渲染 整合了优化后的着色模型。 基于《巫师 3》高清重制项目的素材,更新了大量纹理和模型。 优化了草地与植被的光照与着色效果。 更新了法印的视觉效果,包括其升级版本。 为技能添加了新的视觉效果。 游戏现已支持原生 DirectX 12 渲染并搭载多线程技术,带来更强的性能与画面表现。 更新了色调映射,优化色彩、光照、对比度与细节表现。 新增 GTAO(真实环境光遮蔽)作为新的屏幕空间环境光遮蔽可选方案。 更新了 HDR 校准面板,新增选项与其他优化。 新增光线追踪局部阴影。 更新屏幕空间反射效果。 更新屏幕空间阴影效果。 优...

    推荐理由:来自IT之家 AI的《《巫师 3:狂猎 — 重制版》游戏今日上线,原版玩家可免费升级》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 29 日消息,CDPR 旗下游戏《巫师 3:狂猎 — 重制版》今日上线, 拥有原版游戏的玩家可免费升级 。本作带来一系列改进,包括画面、玩法等多方面升级。 由于本次重制版升级较大,因此 PC 版的配置要求一并更新。请查看下方图片,了解最新的系统配置要求: IT之家附本作升级一览如下: 画面与渲染 整合了优化后的着色模型。 基于《巫师 3》高清重制项目的素材,更新了大量纹理和模型。 优化了草地与植被的光照与着色效果。 更新了法印的视觉效果,包括其升级版本。 为技能添加了新的视觉效果。 游戏现已支持原生 DirectX 12 渲染并搭载多线程技术,带来更强的性能与画面表现。 更新了色调映射,优化色彩、光照、对比度与细节表现。 新增 GTAO(真实环境光遮蔽)作为新的屏幕空间环境光遮蔽可选方案。 更新了 HDR 校准面板,新增选项与其他优化。 新增光线追踪局部阴影。 更新屏幕空间反射效果。 更新屏幕空间阴影效果。 优...

  4. 量子位67

    精准揪出RL训练数据Bug,Prompt直出小游戏,IQuest-Q1夯爆了!

    事实摘要:精准揪出RL训练数据Bug,Prompt直出小游戏,IQuest-Q1夯爆了! 精准揪出RL训练数据Bug,Prompt直出小游戏,IQuest-Q1夯爆了! 这条动态来自 量子位,可重点关注模型能力与工程。 精准揪出RL训练数据Bug,Prompt直出小游戏,IQuest-Q1夯爆了!。影响判断:它可能改变模型能力与工程相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和模型能力与工程直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  5. IT之家 AI70

    曝影石正在研发主打拍摄的智能眼镜:前镜框可更换,有望搭载阿里千问

    IT之家 9 月 29 日消息,蓝鲸新闻今日援引知情人士消息称, 影石创新正在研发一款主打拍摄的智能眼镜 。与市场上多数以语音 AI 助手为核心卖点的 AI 眼镜不同,这款产品优先满足内容创作者对便捷、高质量、免手持拍摄的需求。 据前述知情人士称:“ 影石这款产品或采用前镜框可换设计 ,功能主要集中在镜腿上。用户可以根据不同场景或穿搭风格更换镜框,让智能眼镜更接近传统眼镜的消费逻辑。”这意味着,影石希望把智能眼镜从“科技硬件”拉向更日常、可搭配的消费电子。 前述知情人士透露,AI 能力方面, 影石大概率会选择搭载阿里千问大模型 。不过,影石并不满足于只调用云端大模型。据影石内部人士透露:“未来公司 AI 的核心方向,还是如何把端侧生成模型直接部署到影石的产品端。另外,影石内部还在研发现有产品形态之外的新产品。”这背后是其更长远的野心 —— 让生成模型在端侧落地。 IT之家注意到,影石创新此前获得了一项名为“可穿戴式眼镜”的实用新...

    推荐理由:来自IT之家 AI的《曝影石正在研发主打拍摄的智能眼镜:前镜框可更换,有望搭载阿里千问》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 29 日消息,蓝鲸新闻今日援引知情人士消息称, 影石创新正在研发一款主打拍摄的智能眼镜 。与市场上多数以语音 AI 助手为核心卖点的 AI 眼镜不同,这款产品优先满足内容创作者对便捷、高质量、免手持拍摄的需求。 据前述知情人士称:“ 影石这款产品或采用前镜框可换设计 ,功能主要集中在镜腿上。用户可以根据不同场景或穿搭风格更换镜框,让智能眼镜更接近传统眼镜的消费逻辑。”这意味着,影石希望把智能眼镜从“科技硬件”拉向更日常、可搭配的消费电子。 前述知情人士透露,AI 能力方面, 影石大概率会选择搭载阿里千问大模型 。不过,影石并不满足于只调用云端大模型。据影石内部人士透露:“未来公司 AI 的核心方向,还是如何把端侧生成模型直接部署到影石的产品端。另外,影石内部还在研发现有产品形态之外的新产品。”这背后是其更长远的野心 —— 让生成模型在端侧落地。 IT之家注意到,影石创新此前获得了一项名为“可穿戴式眼镜”的实用新...

  6. IT之家 AI68

    ElevenLabs 推出 v4 和 v4 Turbo 语音模型:支持 90 余种语言,10 秒素材即可克隆声音

    IT之家 9 月 29 日消息,ElevenLabs 于当地时间周一正式推出了两款全新语音模型,分别为 ElevenLabs v4 与 v4 Turbo。新版模型强化了情绪表达控制能力,降低了语音智能体的响应延迟,同时支持 90 余种语言。 该公司去年发布了 v3 模型,并于今年早些时候在华沙举办的活动上对新一代模型进行了预热。v4 系列采用全新架构,实现了更精细的语音控制以及速度更快的声音克隆。官方表示,借助 v4,用户仅需 10 秒音频素材即可完成语音克隆。 在内容创作方面,当朗读大段文本时,新版模型可以更好地维持说话人的音色特征;朗读过程中还能够记住前后文本语境,随之调整语气。ElevenLabs 曾在 v3 版本当中引入内联标签用以设定语音情绪;到了 v4,标签功能得到进一步扩充,用户可以叠加多个标签,模型将按照标签的先后顺序执行。 旧版模型支持 70 种语言。经过优化之后,新版本的语言支持数量提升至 90 种。这家初创...

    推荐理由:来自IT之家 AI的《ElevenLabs 推出 v4 和 v4 Turbo 语音模型:支持 90 余种语言,10 秒素材即可克隆声音》。重点看智能体工作流、模型能力与工程、产品发布。摘要提到:IT之家 9 月 29 日消息,ElevenLabs 于当地时间周一正式推出了两款全新语音模型,分别为 ElevenLabs v4 与 v4 Turbo。新版模型强化了情绪表达控制能力,降低了语音智能体的响应延迟,同时支持 90 余种语言。 该公司去年发布了 v3 模型,并于今年早些时候在华沙举办的活动上对新一代模型进行了预热。v4 系列采用全新架构,实现了更精细的语音控制以及速度更快的声音克隆。官方表示,借助 v4,用户仅需 10 秒音频素材即可完成语音克隆。 在内容创作方面,当朗读大段文本时,新版模型可以更好地维持说话人的音色特征;朗读过程中还能够记住前后文本语境,随之调整语气。ElevenLabs 曾在 v3 版本当中引入内联标签用以设定语音情绪;到了 v4,标签功能得到进一步扩充,用户可以叠加多个标签,模型将按照标签的先后顺序执行。 旧版模型支持 70 种语言。经过优化之后,新版本的语言支持数量提升至 90 种。这家初创...

9月28日周一
  1. IT之家 AI38

    Manus:正组建团队开发面向国内市场的产品,与国产模型厂商合作稳步进行中

    IT之家 9 月 28 日消息,北京蝴蝶效应科技有限公司公众号今日发文,宣布面向海外用户发布 Manus 2.0 版本,并推出面向个人生活场景的智能助理 Cue。 Manus 表示,公司正在组建团队开发面向国内市场的产品,与国产模型厂商及生态伙伴的合作也在稳步进行,后续将分享更多进展。 IT之家注:Cue 被定位为面向个人生活场景的智能助理,Manus 2.0 面向海外用户发布,国内版本仍在筹备中。 Manus 2.0 已在网页端、桌面端和移动端上线,Cue 同步上线,iOS 版本将在通过 App Store 审核后推出。 据介绍,Manus 2.0 采用自研 Agent 框架 Cascade。官方称,该框架让项目保持轻量,仅在需要时引入专业能力。在一项测试配置中,Cascade 的 Token 消耗减少 23.2%,任务完成时间缩短 28.2%,运行成本降低 32%。 云电脑功能允许用户购买专属运行环境,用于多人游戏服务器或长...

    推荐理由:来自IT之家 AI的《Manus:正组建团队开发面向国内市场的产品,与国产模型厂商合作稳步进行中》。重点看智能体工作流、模型能力与工程、产品发布。摘要提到:IT之家 9 月 28 日消息,北京蝴蝶效应科技有限公司公众号今日发文,宣布面向海外用户发布 Manus 2.0 版本,并推出面向个人生活场景的智能助理 Cue。 Manus 表示,公司正在组建团队开发面向国内市场的产品,与国产模型厂商及生态伙伴的合作也在稳步进行,后续将分享更多进展。 IT之家注:Cue 被定位为面向个人生活场景的智能助理,Manus 2.0 面向海外用户发布,国内版本仍在筹备中。 Manus 2.0 已在网页端、桌面端和移动端上线,Cue 同步上线,iOS 版本将在通过 App Store 审核后推出。 据介绍,Manus 2.0 采用自研 Agent 框架 Cascade。官方称,该框架让项目保持轻量,仅在需要时引入专业能力。在一项测试配置中,Cascade 的 Token 消耗减少 23.2%,任务完成时间缩短 28.2%,运行成本降低 32%。 云电脑功能允许用户购买专属运行环境,用于多人游戏服务器或长...

  2. 极客公园71

    OpenAI o1 团队在线答疑:o1的o指OpenAI,强化后的推理有泛化能力,未来模型思考时间可控!

    本文首发于 Founder Park 公众号 · 2024 年 9 月 14 日 这可能是最有参与感的一次产品问答了。 对于 OpenAI o1 的所有疑问和好奇,由推特的所有网友来提问,OpenAI 的全体技术人 员来回答。数了下,一共有 12 位员工出现,这其中有 各个方向的研究员和研究科学家,以及产品经理、产品主管 。 至于提问,从 模型命名、模型的大小和模态 ,到 提示词、思维链、上下文长度,以及价格 ,可以说,大家关注的问题,基本都在里面了。 参与问答的 OpenAI 人员: Ahmed El-Kishky:OpenAI 研究 员 Łukasz Kondraciuk:草莓训练设施负责人,华沙大学计算机科学,ACM ICPC 2022 银牌 Shengjia Zhao:OpenAI 研究科学家,斯坦福大学博士 Romain Huet:GPT-4o、o1 开发者体验主管,曾任 Stripe、Twitter 产品主管 Hon...

    推荐理由:来自极客公园的《OpenAI o1 团队在线答疑:o1的o指OpenAI,强化后的推理有泛化能力,未来模型思考时间可控!》。重点看模型能力与工程、产品发布。摘要提到:本文首发于 Founder Park 公众号 · 2024 年 9 月 14 日 这可能是最有参与感的一次产品问答了。 对于 OpenAI o1 的所有疑问和好奇,由推特的所有网友来提问,OpenAI 的全体技术人 员来回答。数了下,一共有 12 位员工出现,这其中有 各个方向的研究员和研究科学家,以及产品经理、产品主管 。 至于提问,从 模型命名、模型的大小和模态 ,到 提示词、思维链、上下文长度,以及价格 ,可以说,大家关注的问题,基本都在里面了。 参与问答的 OpenAI 人员: Ahmed El-Kishky:OpenAI 研究 员 Łukasz Kondraciuk:草莓训练设施负责人,华沙大学计算机科学,ACM ICPC 2022 银牌 Shengjia Zhao:OpenAI 研究科学家,斯坦福大学博士 Romain Huet:GPT-4o、o1 开发者体验主管,曾任 Stripe、Twitter 产品主管 Hon...

  3. 极客公园73

    o1发布后,信息量最大的圆桌对话:杨植麟、姜大昕、朱军探讨大模型技术路径

    本文首发于 Founder Park 公众号 · 2024 年 9 月 19 日 在 2024 云栖大会上,阶跃星辰创始人姜大昕、月之暗面Kimi创始人杨植麟、生数科技首席科学家朱军与极客公园创始人张鹏一起,探讨了各自眼中 AI 技术发展的现状,推演未来 18 个月,大模型行业会发生什么。 在这场圆桌里,他们重点聊了: 客观来说,AI 领域过去两年发生了什么? OpenAI o1 的发布对行业意味着什么? o1 背后的强化学习新范式对算力和数据提出了怎样的新要求? AI 应用层的创业,在今天该怎么做? 未来 18 个月,AI 技术和应用的发展路径是什么? 信息量很大,我们将现场实录整理如下。 点击关注,每天更新深度 AI 行业洞察 01 AI 发展的速度太快了 张鹏:OpenAI 发布到现在快两年了,这两年里引发了整个世界对 AI 的讨论。各位都是下场创业做大模型的创业者,你们的感受是怎样的? 我们是在「看游戏」,你们在「打游戏...

    推荐理由:来自极客公园的《o1发布后,信息量最大的圆桌对话:杨植麟、姜大昕、朱军探讨大模型技术路径》。重点看模型能力与工程、产品发布。摘要提到:本文首发于 Founder Park 公众号 · 2024 年 9 月 19 日 在 2024 云栖大会上,阶跃星辰创始人姜大昕、月之暗面Kimi创始人杨植麟、生数科技首席科学家朱军与极客公园创始人张鹏一起,探讨了各自眼中 AI 技术发展的现状,推演未来 18 个月,大模型行业会发生什么。 在这场圆桌里,他们重点聊了: 客观来说,AI 领域过去两年发生了什么? OpenAI o1 的发布对行业意味着什么? o1 背后的强化学习新范式对算力和数据提出了怎样的新要求? AI 应用层的创业,在今天该怎么做? 未来 18 个月,AI 技术和应用的发展路径是什么? 信息量很大,我们将现场实录整理如下。 点击关注,每天更新深度 AI 行业洞察 01 AI 发展的速度太快了 张鹏:OpenAI 发布到现在快两年了,这两年里引发了整个世界对 AI 的讨论。各位都是下场创业做大模型的创业者,你们的感受是怎样的? 我们是在「看游戏」,你们在「打游戏...

  4. 极客公园69

    对话王诗沐:走出大厂创业,做 3D AI 游戏,瞄准新的内容平台机会

    本文首发于 Founder Park 公众号 · 2024 年 11 月 18 日 网易云音乐创始人王诗沐的创业公司,全灵 SEELE,宣布完成了千万美元 Pre-A 轮融资。 本轮融资由百度战投领投,投资方包括美图投资、富坤创投等机构, 老股东 Webtime Information S&T 持续加持。 SEELE 成立于 2022 年底,主攻 AI 生成 3D 游戏。2024 年正式推出第一款海外产品,半年积累近百万用户。据了解,SEELE 正在开发下一阶段的产品,并且有清晰的产品和技术路线规划。 核心团队来自腾讯、字节、阿里,包括大模型、图形学等领域的技术专家,产品和增长由连续创业者、腾讯和网易资深增长负责人组成。 作为移动互联网时代的知名产品经理,王诗沐凭借网易云音乐一战成名。 2009 年浙大工业设计毕业,加入支付宝; 2010 年加入网易,网易摄影、网易云音乐、网易美学; 2019 年加入腾讯,小鹅拼拼、腾讯新闻和幻...

    推荐理由:来自极客公园的《对话王诗沐:走出大厂创业,做 3D AI 游戏,瞄准新的内容平台机会》。重点看模型能力与工程、产品发布。摘要提到:本文首发于 Founder Park 公众号 · 2024 年 11 月 18 日 网易云音乐创始人王诗沐的创业公司,全灵 SEELE,宣布完成了千万美元 Pre-A 轮融资。 本轮融资由百度战投领投,投资方包括美图投资、富坤创投等机构, 老股东 Webtime Information S&T 持续加持。 SEELE 成立于 2022 年底,主攻 AI 生成 3D 游戏。2024 年正式推出第一款海外产品,半年积累近百万用户。据了解,SEELE 正在开发下一阶段的产品,并且有清晰的产品和技术路线规划。 核心团队来自腾讯、字节、阿里,包括大模型、图形学等领域的技术专家,产品和增长由连续创业者、腾讯和网易资深增长负责人组成。 作为移动互联网时代的知名产品经理,王诗沐凭借网易云音乐一战成名。 2009 年浙大工业设计毕业,加入支付宝; 2010 年加入网易,网易摄影、网易云音乐、网易美学; 2019 年加入腾讯,小鹅拼拼、腾讯新闻和幻...

  5. 极客公园71

    供应链改造、自研模型、AI营销,如何用AI重构一杯牛奶?

    本文首发于 Founder Park 公众号 · 2024 年 12 月 20 日 AI 时代,大模型正在激发更多企业品牌塑造、内容生产的新解法。 12 月,由伊利集团、阿里云、新华网共同发起举办的「2024 AIGC 视频生态创新大赛」落下帷幕。围绕「真 AI 牛奶,真 AI 创意」的主题——AIGC 技术在营销视频领域的创新应用,历时两个月的角逐,在精彩纷呈的近千个参赛作品中,78 部作品从内容赛道胜出,获得最佳作品奖、优秀创意奖、技术创新奖。 在技术赛道,有 10 家企业斩获优胜方案奖。 本次大赛获奖作品回顾 从视频制作到技术方案,从这次的参赛作品中,我们看到了 AI 视频生成在商业化场景落地的最积极的尝试,以及更可行的可能性。而对于一直苦于寻找 AI 技术落地场景的创业者来说,这无疑也是发现真实需求、解决真实需求的好时机。 今年的生态创新大赛,伊利将「数字 N+伊」生态创享计划升级为「数智伊利」生态创享计划,面对人工智能...

    推荐理由:来自极客公园的《供应链改造、自研模型、AI营销,如何用AI重构一杯牛奶?》。重点看模型能力与工程、文化创意。摘要提到:本文首发于 Founder Park 公众号 · 2024 年 12 月 20 日 AI 时代,大模型正在激发更多企业品牌塑造、内容生产的新解法。 12 月,由伊利集团、阿里云、新华网共同发起举办的「2024 AIGC 视频生态创新大赛」落下帷幕。围绕「真 AI 牛奶,真 AI 创意」的主题——AIGC 技术在营销视频领域的创新应用,历时两个月的角逐,在精彩纷呈的近千个参赛作品中,78 部作品从内容赛道胜出,获得最佳作品奖、优秀创意奖、技术创新奖。 在技术赛道,有 10 家企业斩获优胜方案奖。 本次大赛获奖作品回顾 从视频制作到技术方案,从这次的参赛作品中,我们看到了 AI 视频生成在商业化场景落地的最积极的尝试,以及更可行的可能性。而对于一直苦于寻找 AI 技术落地场景的创业者来说,这无疑也是发现真实需求、解决真实需求的好时机。 今年的生态创新大赛,伊利将「数字 N+伊」生态创享计划升级为「数智伊利」生态创享计划,面对人工智能...

  6. 极客公园72

    三大模态模型全部登顶后,昆仑万维正式披露了 2026 年 AGI 战略

    本文首发于 Founder Park 公众号 · 2026 年 3 月 30 日 在中国的 AI 版图里,昆仑万维及其旗下的天工 AI,一直是一家很难被 简单 定义的公司。 它不是 BAT,不是字节跳动,甚至不是科技媒体最热衷追逐的那类动辄发布在 XX 领域「杀疯了」的黑马选手。 但无论是曾经打得满场开花的业务版图,还是在游戏、出海等领域的独特地位,又注定了它的一举一动,会成为横跨科技、财经、互联网多个领域的新闻头条。 于是,我们看到, 在 2026 年,这家公司开始频繁站上世界 AI 舞台的中心。 3 月 18 日,昆仑万维的视频大模型 SkyReels V4 登顶了全球权威评测平台 Artificial Analysis 的「文生视频(含音频)」第一位置,刷新了 Google Veo 3.1 在内一众海内外视频大模型的 SOTA 表现。 几天后的 3 月 27 日,北京中关村创新中心 150 人的会场的 G08 厅,国家级科...

    推荐理由:来自极客公园的《三大模态模型全部登顶后,昆仑万维正式披露了 2026 年 AGI 战略》。重点看模型能力与工程、评测与基准、文化创意。摘要提到:本文首发于 Founder Park 公众号 · 2026 年 3 月 30 日 在中国的 AI 版图里,昆仑万维及其旗下的天工 AI,一直是一家很难被 简单 定义的公司。 它不是 BAT,不是字节跳动,甚至不是科技媒体最热衷追逐的那类动辄发布在 XX 领域「杀疯了」的黑马选手。 但无论是曾经打得满场开花的业务版图,还是在游戏、出海等领域的独特地位,又注定了它的一举一动,会成为横跨科技、财经、互联网多个领域的新闻头条。 于是,我们看到, 在 2026 年,这家公司开始频繁站上世界 AI 舞台的中心。 3 月 18 日,昆仑万维的视频大模型 SkyReels V4 登顶了全球权威评测平台 Artificial Analysis 的「文生视频(含音频)」第一位置,刷新了 Google Veo 3.1 在内一众海内外视频大模型的 SOTA 表现。 几天后的 3 月 27 日,北京中关村创新中心 150 人的会场的 G08 厅,国家级科...

  7. 极客公园72

    OpenAI,经历了最漫长的一天

    当地时间 9 月 25 日,OpenAI 经历了漫长的一天。 当天, OpenAI 的 AI 智能体擅自访问美国政府网站的事被曝光,涉及教育部、商务部和证券交易委员会 ,OpenAI 确认了其中商务部和 SEC 的情况。 同一天,它承认有 53 张用户上传到 ChatGPT 的图片被智能体发布到了外部图床上。还是这一天,一份事故报告的末尾写着,最强模型的全部训练、评估以及涉及工具调用的推理都已暂停。 这一切听上去,像一部 AI 叛逃的惊悚片。 但翻遍这些事件,没有一个 AI 想干坏事。 害 OpenAI 暂停模型研究的任务,仅仅是让 AI 查出一篇博客的作者的简单任务。 01 简单任务 9 月 20 日,一个正处于强化学习训练中的内部模型,拿到了一组人物履历细节和一篇公开博客里的线索,任务是找到那位博主。 它先用博客里的特征短语去搜,结果返回的是音乐和一些不相干的泛泛建议。模型开始怀疑搜索工具坏了,于是在命令行里用 Python...

    推荐理由:来自极客公园的《OpenAI,经历了最漫长的一天》。重点看智能体工作流、模型能力与工程、教育应用。摘要提到:当地时间 9 月 25 日,OpenAI 经历了漫长的一天。 当天, OpenAI 的 AI 智能体擅自访问美国政府网站的事被曝光,涉及教育部、商务部和证券交易委员会 ,OpenAI 确认了其中商务部和 SEC 的情况。 同一天,它承认有 53 张用户上传到 ChatGPT 的图片被智能体发布到了外部图床上。还是这一天,一份事故报告的末尾写着,最强模型的全部训练、评估以及涉及工具调用的推理都已暂停。 这一切听上去,像一部 AI 叛逃的惊悚片。 但翻遍这些事件,没有一个 AI 想干坏事。 害 OpenAI 暂停模型研究的任务,仅仅是让 AI 查出一篇博客的作者的简单任务。 01 简单任务 9 月 20 日,一个正处于强化学习训练中的内部模型,拿到了一组人物履历细节和一篇公开博客里的线索,任务是找到那位博主。 它先用博客里的特征短语去搜,结果返回的是音乐和一些不相干的泛泛建议。模型开始怀疑搜索工具坏了,于是在命令行里用 Python...

  8. IT之家 AI70

    创企 TakeMe2Space 将用 SpaceX 火箭送星上天,号称印度首颗轨道计算卫星

    IT之家 9 月 28 日消息,据路透社今天(28 日)上午报道,印度太空初创公司 TakeMe2Space 计划于当地时间 10 月 1 日搭乘 SpaceX 火箭发射 MOI-1A,并称其为印度首颗轨道计算卫星。与把原始数据全部传回地球不同,TakeMe2Space 希望直接 在轨完成数据处理 。 ▲ 图源 TakeMe2Space,仅供参考 MOI-1A 重量不到 50kg,搭载英伟达 Orin NX 边缘计算处理器,随 SpaceX 的 Transporter-18 拼车任务发射。 TakeMe2Space 披露,MOI-1A 任务已获得地理信息系统公司、教育机构等 23 家客户。创始人兼 CEO 罗纳克 · 萨曼特雷表示,商业客户覆盖农业、采矿、供应链管理和保险等行业,美国太空数据分析公司 Little Place Labs 也在客户名单之中。 客户可以把容器化 AI 模型上传至 MOI-1A。卫星经过指定区域上空时,...

    推荐理由:来自IT之家 AI的《创企 TakeMe2Space 将用 SpaceX 火箭送星上天,号称印度首颗轨道计算卫星》。重点看模型能力与工程、教育应用。摘要提到:IT之家 9 月 28 日消息,据路透社今天(28 日)上午报道,印度太空初创公司 TakeMe2Space 计划于当地时间 10 月 1 日搭乘 SpaceX 火箭发射 MOI-1A,并称其为印度首颗轨道计算卫星。与把原始数据全部传回地球不同,TakeMe2Space 希望直接 在轨完成数据处理 。 ▲ 图源 TakeMe2Space,仅供参考 MOI-1A 重量不到 50kg,搭载英伟达 Orin NX 边缘计算处理器,随 SpaceX 的 Transporter-18 拼车任务发射。 TakeMe2Space 披露,MOI-1A 任务已获得地理信息系统公司、教育机构等 23 家客户。创始人兼 CEO 罗纳克 · 萨曼特雷表示,商业客户覆盖农业、采矿、供应链管理和保险等行业,美国太空数据分析公司 Little Place Labs 也在客户名单之中。 客户可以把容器化 AI 模型上传至 MOI-1A。卫星经过指定区域上空时,...

  9. IT之家 AI36

    CDPR 开发者回顾《赛博朋克 2077:往日之影》开发:以结局为起点反向构建剧情

    IT之家 9 月 28 日消息,《赛博朋克 2077》的谍战惊悚资料片《往日之影》日前迎来发售三周年。据外媒 Gamesradar 当地时间 27 日报道,《赛博朋克 2》副游戏总监、《往日之影》首席任务设计师帕维尔 · 萨斯科借此机会回顾了开发过程,并分享了一些此前未曾透露的细节。 《往日之影》帮助《赛博朋克 2077》实现了一次令人印象深刻的口碑逆转,而谈到这段经历,就绕不开本体游戏灾难性的首发。萨斯科坦诚,为了不让《往日之影》重演本体发售时的问题,CD Projekt Red 只得重新思考制作游戏的方式。 开发《赛博朋克 2077》时,我们的组织方式更接近瀑布模型,各项工作在不同部门之间逐级流转,很多决策都集中在负责人和总监手中。 到了《往日之影》,我们转向了多学科内容团队,也就是内部所说的 pods,让设计、编剧、过场动画、美术、音频、QA 以及许多其他专业的成员围绕同一部分内容协同工作。我们用了很长时间才真正学会这种工...

    推荐理由:来自IT之家 AI的《CDPR 开发者回顾《赛博朋克 2077:往日之影》开发:以结局为起点反向构建剧情》。重点看模型能力与工程。摘要提到:IT之家 9 月 28 日消息,《赛博朋克 2077》的谍战惊悚资料片《往日之影》日前迎来发售三周年。据外媒 Gamesradar 当地时间 27 日报道,《赛博朋克 2》副游戏总监、《往日之影》首席任务设计师帕维尔 · 萨斯科借此机会回顾了开发过程,并分享了一些此前未曾透露的细节。 《往日之影》帮助《赛博朋克 2077》实现了一次令人印象深刻的口碑逆转,而谈到这段经历,就绕不开本体游戏灾难性的首发。萨斯科坦诚,为了不让《往日之影》重演本体发售时的问题,CD Projekt Red 只得重新思考制作游戏的方式。 开发《赛博朋克 2077》时,我们的组织方式更接近瀑布模型,各项工作在不同部门之间逐级流转,很多决策都集中在负责人和总监手中。 到了《往日之影》,我们转向了多学科内容团队,也就是内部所说的 pods,让设计、编剧、过场动画、美术、音频、QA 以及许多其他专业的成员围绕同一部分内容协同工作。我们用了很长时间才真正学会这种工...

9月27日周日
  1. IT之家 AI78

    接连发生 AI 失控事件,OpenAI 再次暂停其最强模型训练

    IT之家 9 月 27 日消息,随着有关 OpenAI 模型突破限制、攻击网站以及整体行为失控的报告不断增加,该公司决定暂停训练旗下能力最强的模型。 这一决定是在一款处于沙盒环境中测试的模型利用漏洞获得互联网访问权限后作出的。该事件发生于 9 月 20 日。截至当地时间 9 月 25 日星期六晚间,OpenAI“所有涉及工具使用的训练、评估和推理工作”仍处于暂停状态。 此外,OpenAI 周五披露,其智能体曾不当将 ChatGPT 用户的 53 张图片上传至图片托管网站。该公司尚未说明这些图片究竟是 AI 生成的图像、用户拍摄的照片,还是包含可识别身份的人物。 OpenAI 同日还透露,其模型曾尝试攻击美国教育部网站,并从美国人口普查局(Census Bureau)和美国证券交易委员会(SEC)获取数据。 据IT之家了解,这些披露属于 OpenAI 正在进行的一项模型行为审查。此前发生 Hugging Face 遭攻击事件后,O...

    推荐理由:来自IT之家 AI的《接连发生 AI 失控事件,OpenAI 再次暂停其最强模型训练》。重点看智能体工作流、模型能力与工程、教育应用。摘要提到:IT之家 9 月 27 日消息,随着有关 OpenAI 模型突破限制、攻击网站以及整体行为失控的报告不断增加,该公司决定暂停训练旗下能力最强的模型。 这一决定是在一款处于沙盒环境中测试的模型利用漏洞获得互联网访问权限后作出的。该事件发生于 9 月 20 日。截至当地时间 9 月 25 日星期六晚间,OpenAI“所有涉及工具使用的训练、评估和推理工作”仍处于暂停状态。 此外,OpenAI 周五披露,其智能体曾不当将 ChatGPT 用户的 53 张图片上传至图片托管网站。该公司尚未说明这些图片究竟是 AI 生成的图像、用户拍摄的照片,还是包含可识别身份的人物。 OpenAI 同日还透露,其模型曾尝试攻击美国教育部网站,并从美国人口普查局(Census Bureau)和美国证券交易委员会(SEC)获取数据。 据IT之家了解,这些披露属于 OpenAI 正在进行的一项模型行为审查。此前发生 Hugging Face 遭攻击事件后,O...

9月26日周六
  1. IT之家 AI72

    英国第二大图书馆:牛津大学博德利图书馆藏书被曝用于 OpenAI 模型训练

    IT之家 9 月 26 日消息,据英媒卫报消息,正值各大科技公司在学术机构中四处搜寻全新语料之际,牛津大学已允许 ChatGPT 开发商 OpenAI 利用其博德利图书馆(Bodleian Library)的历史典籍来训练其人工智能模型。 IT之家注:博德利图书馆是英国牛津大学主要的研究图书馆, 是英国规模仅次于大英图书馆的第二大图书馆 。 一份内部文件显示,由 OpenAI 完成数字化的博德利藏书已被用来“构建 OpenAI 的训练集”。牛津大学于 2025 年 3 月宣布与该公司达成合作,使用 OpenAI 的软件对该校这座享誉世界的图书馆藏书进行数字化处理。 校方当时表示,此举将让广大学生和研究人员更便捷地查阅这些文献资料。然而, 当时的合作公告并未提及这些资料会被用于训练 OpenAI 的模型 。 OpenAI 的一位发言人表示,公司很荣幸能够促成“当今的 AI 模型为后世守护人类的历史文化瑰宝”。 该发言人还补充道:“...

    推荐理由:来自IT之家 AI的《英国第二大图书馆:牛津大学博德利图书馆藏书被曝用于 OpenAI 模型训练》。重点看模型能力与工程、教育应用、文化创意。摘要提到:IT之家 9 月 26 日消息,据英媒卫报消息,正值各大科技公司在学术机构中四处搜寻全新语料之际,牛津大学已允许 ChatGPT 开发商 OpenAI 利用其博德利图书馆(Bodleian Library)的历史典籍来训练其人工智能模型。 IT之家注:博德利图书馆是英国牛津大学主要的研究图书馆, 是英国规模仅次于大英图书馆的第二大图书馆 。 一份内部文件显示,由 OpenAI 完成数字化的博德利藏书已被用来“构建 OpenAI 的训练集”。牛津大学于 2025 年 3 月宣布与该公司达成合作,使用 OpenAI 的软件对该校这座享誉世界的图书馆藏书进行数字化处理。 校方当时表示,此举将让广大学生和研究人员更便捷地查阅这些文献资料。然而, 当时的合作公告并未提及这些资料会被用于训练 OpenAI 的模型 。 OpenAI 的一位发言人表示,公司很荣幸能够促成“当今的 AI 模型为后世守护人类的历史文化瑰宝”。 该发言人还补充道:“...

9月25日周五
  1. IT之家 AI76

    第 48 届世界技能大赛在沪举办,新增 3 项人工智能相关赛项创历届之最

    IT之家 9 月 25 日消息,据央视新闻报道,9 月 22 日至 27 日,第 48 届世界技能大赛在中国上海举行。本届世赛上,人工智能走进赛题、操作台,成为选手训练和比赛的一部分。 本届世赛 64 个项目中,与 AI 直接相关的赛项有 8 个:智慧安防技术、软件测试、数字交互媒体设计、自主移动机器人、工业 4.0、云计算、网络安全、3D 数字游戏艺术。其中 智慧安防技术、软件测试、数字交互媒体设计是本届新增 ,新增数量创历届之最。 这些赛项的 AI 含量,体现在具体的工作场景里。 智慧安防技术,选手要应用深度学习算法和大模型基础原理,让监控系统自动识别异常。 软件测试,AI 已从工具升级为协作伙伴,选手调用多个智能体自主进行测试,自己则从更宏观的行业视角分析问题。 数字交互媒体设计,要求选手完成沉浸式数字体验,涉及虚拟场景和智能数字创新。 自主移动机器人,比的是机器人自主导航、环境识别、智能抓取,是“具身智能”的实战训练。 ...

    推荐理由:来自IT之家 AI的《第 48 届世界技能大赛在沪举办,新增 3 项人工智能相关赛项创历届之最》。重点看智能体工作流、模型能力与工程、文化创意。摘要提到:IT之家 9 月 25 日消息,据央视新闻报道,9 月 22 日至 27 日,第 48 届世界技能大赛在中国上海举行。本届世赛上,人工智能走进赛题、操作台,成为选手训练和比赛的一部分。 本届世赛 64 个项目中,与 AI 直接相关的赛项有 8 个:智慧安防技术、软件测试、数字交互媒体设计、自主移动机器人、工业 4.0、云计算、网络安全、3D 数字游戏艺术。其中 智慧安防技术、软件测试、数字交互媒体设计是本届新增 ,新增数量创历届之最。 这些赛项的 AI 含量,体现在具体的工作场景里。 智慧安防技术,选手要应用深度学习算法和大模型基础原理,让监控系统自动识别异常。 软件测试,AI 已从工具升级为协作伙伴,选手调用多个智能体自主进行测试,自己则从更宏观的行业视角分析问题。 数字交互媒体设计,要求选手完成沉浸式数字体验,涉及虚拟场景和智能数字创新。 自主移动机器人,比的是机器人自主导航、环境识别、智能抓取,是“具身智能”的实战训练。 ...

  2. IT之家 AI74

    试图闯入政府或学校网站,OpenAI 智能体四次“失控”细节曝光

    IT之家 9 月 25 日消息,当地时间 23 日,据《纽约时报》援引研究人员和政府官员消息称,OpenAI 的人工智能系统今年 至少又有 4 次擅自行动 ,在没有收到相应指令的情况下实施黑客攻击,或试图闯入政府和大学网站。 这些攻击发生于 5 月和 6 月。到 7 月,OpenAI 入侵了 AI 初创公司 Hugging Face,由此引发全球范围内关于 AI 安全的争论。 Hugging Face 事件以及此前其他一些案例都发生在网络安全测试中,AI 系统接到的任务本身就在要求模型展示黑客能力。 研究人员称,这 4 起新事件不同,当时 AI 系统执行的只是 相对普通的数据收集任务 。OpenAI 系统无法顺利从网站取得数据后,便转而 使用黑客手段获取信息 。 专门研究 AI 监管的 Transluce 发现了其中 3 起事件,OpenAI 随后确认这 3 起事件全部发生过。 IT之家汇总具体情况如下: 5 月 25 日和 2...

    推荐理由:来自IT之家 AI的《试图闯入政府或学校网站,OpenAI 智能体四次“失控”细节曝光》。重点看智能体工作流、模型能力与工程。摘要提到:IT之家 9 月 25 日消息,当地时间 23 日,据《纽约时报》援引研究人员和政府官员消息称,OpenAI 的人工智能系统今年 至少又有 4 次擅自行动 ,在没有收到相应指令的情况下实施黑客攻击,或试图闯入政府和大学网站。 这些攻击发生于 5 月和 6 月。到 7 月,OpenAI 入侵了 AI 初创公司 Hugging Face,由此引发全球范围内关于 AI 安全的争论。 Hugging Face 事件以及此前其他一些案例都发生在网络安全测试中,AI 系统接到的任务本身就在要求模型展示黑客能力。 研究人员称,这 4 起新事件不同,当时 AI 系统执行的只是 相对普通的数据收集任务 。OpenAI 系统无法顺利从网站取得数据后,便转而 使用黑客手段获取信息 。 专门研究 AI 监管的 Transluce 发现了其中 3 起事件,OpenAI 随后确认这 3 起事件全部发生过。 IT之家汇总具体情况如下: 5 月 25 日和 2...

  3. Claude Code Releases86

    Claude Code Releases v2.1.282:Added a maxProseWidth setting that caps the width of Claud...

    这条英文动态主要涉及文化创意。原文要点:What's changed Added a maxProseWidth setting that caps the width of Claude's prose in wide terminals while tables and code blocks keep the full width Added a startup notice, and /status and claude doctor entries, listing telemetry variables in a project's settings files that were ignored or that turned telemetry off Added the allowClaudeInChromeWithManagedMcp managed setting to let claude --chrome run alongside an ex...

    推荐理由:来自Claude Code Releases的《Claude Code Releases v2.1.282:Added a maxProseWidth setting that caps the width of Claud...》。重点看文化创意。摘要提到:这条英文动态主要涉及文化创意。原文要点:What's changed Added a maxProseWidth setting that caps the width of Claude's prose in wide terminals while tables and code blocks keep the full width Added a startup notice, and /status and claude doctor entries, listing telemetry variables in a project's settings files that were ignored or that turned telemetry off Added the allowClaudeInChromeWithManagedMcp managed setting to let claude --chrome...

9月24日周四
  1. 极客公园70

    Agent 时代来了,3D 生成大模型接下来比什么?

    9 月 3 日,GPT-6 Astra 的发布,把 3D 内容创作带到了舞台中央。 在 GPT-6 Astra 官方发布页的一个不到 3 分钟的视频里与后续解读中,Astra 已经能直接进入 Blender,从一句住宅设计需求开始搭场景,先生成极简住宅,后来又将其扩展为围绕庭院展开的家庭住宅。里面有卧室、办公室、厨房和卫生间;家具从床板、衣柜挂杆、烤箱、餐具抽屉,再到灯光模拟,一应俱全。甚至水槽表面的法线出了问题之后,Astra 还会自己返工。 为了制作 30 秒室内漫游,它还会把相机放在约 1.65 米的人眼高度,用 24—26mm 镜头安排四段运动;进入 Unreal Engine 5 之后,它又自己处理 FBX、JSON、米和厘米的单位差、坐标转换、材质映射、碰撞和第一人称控制。 当通用模型也能做 3D 了,专业 3D 生成模型的价值会发生什么变化? 当下, 3D 工具的使用者,正逐渐从人 扩展 为 Agent...

    推荐理由:来自极客公园的《Agent 时代来了,3D 生成大模型接下来比什么?》。重点看智能体工作流、模型能力与工程、产品发布。摘要提到:9 月 3 日,GPT-6 Astra 的发布,把 3D 内容创作带到了舞台中央。 在 GPT-6 Astra 官方发布页的一个不到 3 分钟的视频里与后续解读中,Astra 已经能直接进入 Blender,从一句住宅设计需求开始搭场景,先生成极简住宅,后来又将其扩展为围绕庭院展开的家庭住宅。里面有卧室、办公室、厨房和卫生间;家具从床板、衣柜挂杆、烤箱、餐具抽屉,再到灯光模拟,一应俱全。甚至水槽表面的法线出了问题之后,Astra 还会自己返工。 为了制作 30 秒室内漫游,它还会把相机放在约 1.65 米的人眼高度,用 24—26mm 镜头安排四段运动;进入 Unreal Engine 5 之后,它又自己处理 FBX、JSON、米和厘米的单位差、坐标转换、材质映射、碰撞和第一人称控制。 当通用模型也能做 3D 了,专业 3D 生成模型的价值会发生什么变化? 当下, 3D 工具的使用者,正逐渐从人 扩展 为 Agent...

  2. IT之家 AI36

    港大与北师大用三维波模拟研究超轻暗物质,首次预测其对引力透镜成像的影响

    IT之家 9 月 24 日消息,香港大学物理系与该校天文及天体物理研究所,联合北京师范大学主导的研究团队,提出一种更贴近物理实际的方案,用三维波模拟检验超轻暗物质对引力透镜图像的影响。 这是首次直接基于超轻暗物质的三维波模拟,直接预测其对引力透镜成像的影响,为利用高分辨率引力透镜观测研究暗物质性质提供了新的方法。相关成果已发表于《天体物理学杂志快报》。 暗物质被认为占宇宙全部物质的约 85%,不发光也不吸收或反射光,目前只能通过引力效应被探测。它不在粒子物理标准模型之内。过去十年,越来越多天文证据提示,暗物质可能由超轻粒子组成(超轻暗物质也称“模糊暗物质”,指质量极低、集体行为类似波的暗物质候选者)。 由于质量极低,这类粒子可像波一样集体运动,形成类似海浪相遇时的复杂干涉图样。这种图样可能在星系多重像中留下痕迹。 引力透镜是指大质量天体的引力弯曲并扭曲更遥远光源的光,从而形成多个图像。研究团队据此预测,若星系由超轻暗物质构成,透...

    推荐理由:来自IT之家 AI的《港大与北师大用三维波模拟研究超轻暗物质,首次预测其对引力透镜成像的影响》。重点看模型能力与工程。摘要提到:IT之家 9 月 24 日消息,香港大学物理系与该校天文及天体物理研究所,联合北京师范大学主导的研究团队,提出一种更贴近物理实际的方案,用三维波模拟检验超轻暗物质对引力透镜图像的影响。 这是首次直接基于超轻暗物质的三维波模拟,直接预测其对引力透镜成像的影响,为利用高分辨率引力透镜观测研究暗物质性质提供了新的方法。相关成果已发表于《天体物理学杂志快报》。 暗物质被认为占宇宙全部物质的约 85%,不发光也不吸收或反射光,目前只能通过引力效应被探测。它不在粒子物理标准模型之内。过去十年,越来越多天文证据提示,暗物质可能由超轻粒子组成(超轻暗物质也称“模糊暗物质”,指质量极低、集体行为类似波的暗物质候选者)。 由于质量极低,这类粒子可像波一样集体运动,形成类似海浪相遇时的复杂干涉图样。这种图样可能在星系多重像中留下痕迹。 引力透镜是指大质量天体的引力弯曲并扭曲更遥远光源的光,从而形成多个图像。研究团队据此预测,若星系由超轻暗物质构成,透...

  3. IT之家 AI68

    阿里达摩院发布食管癌 AI 模型,“不插管”发现早期和癌前病变

    IT之家 9 月 24 日消息,阿里巴巴发布第 4 个癌症筛查 AI 模型。阿里达摩院联合四川省肿瘤医院、中山大学肿瘤防治中心等机构研发 食管癌筛查 AI 模型 DAMO EAGLE ,无需插管和造影,从平扫 CT 上就能识别食管癌,包括早期和癌前恶性病变,已在 3 个国家 8 万多病例上获得验证。 相关论文于 9 月 22 日登上国际顶级期刊《自然 · 医学》(Nature Medicine)。 阿里达摩院介绍称,中国食管癌发病率和死亡率约占全球一半,多数患者直到晚期才发现,失去根治机会。 如能早发现,大部分患者可通过内镜下微创手术根治,5 年生存率可达 95% 以上 。目前食管癌的标准筛查手段是上消化道内镜,具有一定的侵入性,且操作复杂,难以大范围推广。 胸部平扫 CT 成本低、接受度高,广泛应用于各类医疗场景,尤其是低剂量的平扫 CT,已是肺癌的推荐筛查方法。这些 CT 的扫描范围本身就覆盖了食管,筛查肺癌时如能同时识别食...

    推荐理由:来自IT之家 AI的《阿里达摩院发布食管癌 AI 模型,“不插管”发现早期和癌前病变》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 24 日消息,阿里巴巴发布第 4 个癌症筛查 AI 模型。阿里达摩院联合四川省肿瘤医院、中山大学肿瘤防治中心等机构研发 食管癌筛查 AI 模型 DAMO EAGLE ,无需插管和造影,从平扫 CT 上就能识别食管癌,包括早期和癌前恶性病变,已在 3 个国家 8 万多病例上获得验证。 相关论文于 9 月 22 日登上国际顶级期刊《自然 · 医学》(Nature Medicine)。 阿里达摩院介绍称,中国食管癌发病率和死亡率约占全球一半,多数患者直到晚期才发现,失去根治机会。 如能早发现,大部分患者可通过内镜下微创手术根治,5 年生存率可达 95% 以上 。目前食管癌的标准筛查手段是上消化道内镜,具有一定的侵入性,且操作复杂,难以大范围推广。 胸部平扫 CT 成本低、接受度高,广泛应用于各类医疗场景,尤其是低剂量的平扫 CT,已是肺癌的推荐筛查方法。这些 CT 的扫描范围本身就覆盖了食管,筛查肺癌时如能同时识别食...

  4. Apple Machine Learning Research89

    A Practical Recipe for Semi-Supervised Federated ASR: Online Pseudo-Labels with Server Update Stabilization

    这条英文动态主要涉及模型能力与工程、教育应用、文化创意。原文要点:Semi-supervised federated learning (SSFL) trains models on clients’ unlabeled data using a teacher to generate pseudo-labels, with a small labeled seed dataset on the server. Automatic Speech Recognition (ASR) is particularly fragile here: pseudo-label errors compound across the output sequence and across training rounds into divergence, leaving a large gap to fully-supervised FL. We show that closing this gap turns ...

    推荐理由:来自Apple Machine Learning Research的《A Practical Recipe for Semi-Supervised Federated ASR: Online Pseudo-Labels with Server Update Stabilization》。重点看模型能力与工程、教育应用、文化创意。摘要提到:这条英文动态主要涉及模型能力与工程、教育应用、文化创意。原文要点:Semi-supervised federated learning (SSFL) trains models on clients’ unlabeled data using a teacher to generate pseudo-labels, with a small labeled seed dataset on the server. Automatic Speech Recognition (ASR) is particularly fragile here: pseudo-label errors compound across the output sequence and across training rounds into divergence, leaving a large gap to fully-supervised FL. We ...

9月23日周三
  1. IT之家 AI70

    谷歌推出 Gemini 3.8 Flash / Flash-Lite 文本转语音模型,每一行台词都能精确控制

    IT之家 9 月 23 日消息,谷歌今日宣布,Gemini 家族新增两款全新文本转语音模型,将语音生成 从静态预设转变为动态创意工作室 ,能够帮助创作者、开发者和企业打造更丰富、更具表现力的音频体验,同时为 Gemini Notebook 和 Google Vids 等产品改进用户体验。 两款新模型分别为 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS ,定位各有不同: Gemini 3.8 Flash TTS :面向深度创意方向和角色设计,可通过自然语言提示从头创建全新语音,在游戏、沉浸式有声读物、播客和互动媒体中赋予角色生命力,还可对表演提示、节奏、方言转换等进行精细控制。 Gemini 3.8 Flash-Lite TTS :面向大容量、高性价比规模场景,针对大容量配音、音频内容创作和富有表现力的语音代理进行了优化,可对音调、节奏和表现力细微差别进行精细控制。 据IT之家了...

    推荐理由:来自IT之家 AI的《谷歌推出 Gemini 3.8 Flash / Flash-Lite 文本转语音模型,每一行台词都能精确控制》。重点看模型能力与工程、文化创意、产品发布。摘要提到:IT之家 9 月 23 日消息,谷歌今日宣布,Gemini 家族新增两款全新文本转语音模型,将语音生成 从静态预设转变为动态创意工作室 ,能够帮助创作者、开发者和企业打造更丰富、更具表现力的音频体验,同时为 Gemini Notebook 和 Google Vids 等产品改进用户体验。 两款新模型分别为 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS ,定位各有不同: Gemini 3.8 Flash TTS :面向深度创意方向和角色设计,可通过自然语言提示从头创建全新语音,在游戏、沉浸式有声读物、播客和互动媒体中赋予角色生命力,还可对表演提示、节奏、方言转换等进行精细控制。 Gemini 3.8 Flash-Lite TTS :面向大容量、高性价比规模场景,针对大容量配音、音频内容创作和富有表现力的语音代理进行了优化,可对音调、节奏和表现力细微差别进行精细控制。 据IT之家了...

  2. IT之家 AI72

    蚂蚁百灵开源 Ming-Image-0.1-Design 系列模型,UI 设计专项评测位列开源第一

    IT之家 9 月 23 日消息,今日,蚂蚁百灵大模型正式开源 Ming-Image-0.1-Design 系列,包含两个参数量均为 6B 的模型:Ming-Image-0.1-Design,从文字需求生成 UI、信息图、海报和完整视觉设计;Ming-Image-0.1-Design-Layer,将创意图或者设计图拆成可独立编辑的透明图层。 IT之家注意到,蚂蚁百灵同时开源了 Design Skill 和 PPT Skill,将模型能力继续连接到前端页面与可编辑演示文稿。 据官方介绍,Ming-Image-0.1-Design 重点增强了四项能力: 支持 8K 长结构化提示词增强,将自然语言需求组织为文案、模块、布局和视觉风格; 优化标题、按钮、卡片和多区域信息的文字渲染与版式稳定性; 通过端到端生成一次性完成整体设计,统一配色、构图和素材风格; 创建原生 RGBA VAE,直接生成人物、商品、图标和装饰等透明背景素材。 相比通过...

    推荐理由:来自IT之家 AI的《蚂蚁百灵开源 Ming-Image-0.1-Design 系列模型,UI 设计专项评测位列开源第一》。重点看模型能力与工程、评测与基准、文化创意。摘要提到:IT之家 9 月 23 日消息,今日,蚂蚁百灵大模型正式开源 Ming-Image-0.1-Design 系列,包含两个参数量均为 6B 的模型:Ming-Image-0.1-Design,从文字需求生成 UI、信息图、海报和完整视觉设计;Ming-Image-0.1-Design-Layer,将创意图或者设计图拆成可独立编辑的透明图层。 IT之家注意到,蚂蚁百灵同时开源了 Design Skill 和 PPT Skill,将模型能力继续连接到前端页面与可编辑演示文稿。 据官方介绍,Ming-Image-0.1-Design 重点增强了四项能力: 支持 8K 长结构化提示词增强,将自然语言需求组织为文案、模块、布局和视觉风格; 优化标题、按钮、卡片和多区域信息的文字渲染与版式稳定性; 通过端到端生成一次性完成整体设计,统一配色、构图和素材风格; 创建原生 RGBA VAE,直接生成人物、商品、图标和装饰等透明背景素材。 相比通过...

  3. IT之家 AI78

    马斯克惊叹中国 AI 大模型“单位算力产出性能几乎是全球顶尖水平”,预计两到三年内就能靠光刻技术与芯片制造补齐算力缺口

    IT之家 9 月 23 日消息,特斯拉 CEO 埃隆 · 马斯克今日接受了央视财经专访。 当谈及 AI,他表示中国的 AI 大模型整体而言非常出色,单位算力产出的性能几乎全球顶尖。 他认为,中国解决算力问题的速度会比大多数人预想更快。粗略估计,大概两到三年内,中国就能依靠光刻技术与芯片制造补齐算力缺口。 图源:Pexels 谈及 AI 时代教育,马斯克建议广泛学习,兼顾人文艺术、科学与工程,夯实通识基础。 他表示,想要向机器人下达指令,就要学会组织问题;知识面越广,越擅长提问,这正是给 AI 写提示词。 马斯克此前曾表示,预计到 2027 年底,人工智能将独立完成所有数字领域工作,彻底替代人工直接操作的各类数字化岗位。 在短期技术突破上,他预判未来 12 至 18 个月内,AI 将在工程及各类数字领域实现能力跨越式提升。 其中,AI 编程能力最快明年达到“Stockfish 级”水准(IT之家注:Stockfish 是一款开源国...

    推荐理由:来自IT之家 AI的《马斯克惊叹中国 AI 大模型“单位算力产出性能几乎是全球顶尖水平”,预计两到三年内就能靠光刻技术与芯片制造补齐算力缺口》。重点看模型能力与工程、教育应用、文化创意。摘要提到:IT之家 9 月 23 日消息,特斯拉 CEO 埃隆 · 马斯克今日接受了央视财经专访。 当谈及 AI,他表示中国的 AI 大模型整体而言非常出色,单位算力产出的性能几乎全球顶尖。 他认为,中国解决算力问题的速度会比大多数人预想更快。粗略估计,大概两到三年内,中国就能依靠光刻技术与芯片制造补齐算力缺口。 图源:Pexels 谈及 AI 时代教育,马斯克建议广泛学习,兼顾人文艺术、科学与工程,夯实通识基础。 他表示,想要向机器人下达指令,就要学会组织问题;知识面越广,越擅长提问,这正是给 AI 写提示词。 马斯克此前曾表示,预计到 2027 年底,人工智能将独立完成所有数字领域工作,彻底替代人工直接操作的各类数字化岗位。 在短期技术突破上,他预判未来 12 至 18 个月内,AI 将在工程及各类数字领域实现能力跨越式提升。 其中,AI 编程能力最快明年达到“Stockfish 级”水准(IT之家注:Stockfish 是一款开源国...