跳到正文
9月29日周二
  1. 量子位67

    精准揪出RL训练数据Bug,Prompt直出小游戏,IQuest-Q1夯爆了!

    事实摘要:精准揪出RL训练数据Bug,Prompt直出小游戏,IQuest-Q1夯爆了! 精准揪出RL训练数据Bug,Prompt直出小游戏,IQuest-Q1夯爆了! 这条动态来自 量子位,可重点关注模型能力与工程。 精准揪出RL训练数据Bug,Prompt直出小游戏,IQuest-Q1夯爆了!。影响判断:它可能改变模型能力与工程相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和模型能力与工程直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  2. 量子位70

    OpenAI因新模型太强叫停发布

    事实摘要:OpenAI因新模型太强叫停发布 AGI计划暂停。 这条动态来自 量子位,可重点关注模型能力与工程、产品发布。 OpenAI因新模型太强叫停发布 AGI计划暂停。影响判断:它可能改变模型能力与工程相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和模型能力与工程直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  3. IT之家 AI70

    2026 年世界互联网大会乌镇峰会 11 月 2 日至 5 日举行:设 27 个分论坛,聚焦人工智能开源开放

    IT之家 9 月 29 日消息,世界互联网大会官方今日召开新闻发布会,宣布 2026 年世界互联网大会乌镇峰会将于 11 月 2 日至 5 日在浙江省乌镇举行。本次峰会主题为“开源开放共建共享 —— 携手构建网络空间命运共同体”。 本届峰会将邀请全球政府、国际组织、企业、专家学者代表,围绕人工智能开源开放发展的理念与实践,从创新发展、安全治理、文明交流、国际合作等多个维度展开交流。 IT之家从官方获悉,今年乌镇峰会将设置 27 个分论坛,围绕全球治理倡议网络空间合作、数智时代的理论与政策、机器人与具身智能等话题展开讨论。 主论坛将设置“人工智能乌镇对话”环节,邀请全球领军科技企业、知名开源大模型企业负责人以及人工智能科学家同台对话,围绕全球人工智能开源生态构建等议题展开交流。 “携手构建网络空间命运共同体”实践案例征集共收到来自全球 80 个国家和地区的 360 项申报案例,其中 22 个国家和地区为首次参与。 世界互联网大会领...

    推荐理由:来自IT之家 AI的《2026 年世界互联网大会乌镇峰会 11 月 2 日至 5 日举行:设 27 个分论坛,聚焦人工智能开源开放》。重点看模型能力与工程、开源生态、产品发布。摘要提到:IT之家 9 月 29 日消息,世界互联网大会官方今日召开新闻发布会,宣布 2026 年世界互联网大会乌镇峰会将于 11 月 2 日至 5 日在浙江省乌镇举行。本次峰会主题为“开源开放共建共享 —— 携手构建网络空间命运共同体”。 本届峰会将邀请全球政府、国际组织、企业、专家学者代表,围绕人工智能开源开放发展的理念与实践,从创新发展、安全治理、文明交流、国际合作等多个维度展开交流。 IT之家从官方获悉,今年乌镇峰会将设置 27 个分论坛,围绕全球治理倡议网络空间合作、数智时代的理论与政策、机器人与具身智能等话题展开讨论。 主论坛将设置“人工智能乌镇对话”环节,邀请全球领军科技企业、知名开源大模型企业负责人以及人工智能科学家同台对话,围绕全球人工智能开源生态构建等议题展开交流。 “携手构建网络空间命运共同体”实践案例征集共收到来自全球 80 个国家和地区的 360 项申报案例,其中 22 个国家和地区为首次参与。 世界互联网大会领...

  4. IT之家 AI72

    OpenAI 提出前沿 AI 训练安全指导原则:高级管理人员应有否决权

    IT之家 9 月 29 日消息,OpenAI 今天通过官方新闻稿提出了一套指导原则,要求企业在开展前沿 AI 强化学习训练前提交结构化的安全论证文件。 OpenAI 称,安全论证应交由多名高级管理人员审查,每个人都应有权否决训练任务,让训练在内部经过 研究部门负责人或 VP(副总裁)、安全负责人和首席科学家 等环节的多重把关。 此外,研究部门负责人、研究副总裁等负责训练任务的高级管理人员, 应对安全论证以及任何事故响应承担责任 ,包括把这些内容纳入绩效考核,以此促使训练团队主动推动安全和对齐工作。 OpenAI 称,如果高优先级安全警报没有在规定时限内得到确认,受影响的训练任务应自动暂停。这些建议已经进入落实过程,今后预计还会继续调整。此外,训练流程应能方便地 识别未对齐模型的所有下游用途 (IT之家注:例如用于数据生成或评分),以便必要时消除未对齐输出带来的影响。 今天早些时候,OpenAI 宣布,随着越来越多报告显示 AI ...

    推荐理由:来自IT之家 AI的《OpenAI 提出前沿 AI 训练安全指导原则:高级管理人员应有否决权》。重点看模型能力与工程。摘要提到:IT之家 9 月 29 日消息,OpenAI 今天通过官方新闻稿提出了一套指导原则,要求企业在开展前沿 AI 强化学习训练前提交结构化的安全论证文件。 OpenAI 称,安全论证应交由多名高级管理人员审查,每个人都应有权否决训练任务,让训练在内部经过 研究部门负责人或 VP(副总裁)、安全负责人和首席科学家 等环节的多重把关。 此外,研究部门负责人、研究副总裁等负责训练任务的高级管理人员, 应对安全论证以及任何事故响应承担责任 ,包括把这些内容纳入绩效考核,以此促使训练团队主动推动安全和对齐工作。 OpenAI 称,如果高优先级安全警报没有在规定时限内得到确认,受影响的训练任务应自动暂停。这些建议已经进入落实过程,今后预计还会继续调整。此外,训练流程应能方便地 识别未对齐模型的所有下游用途 (IT之家注:例如用于数据生成或评分),以便必要时消除未对齐输出带来的影响。 今天早些时候,OpenAI 宣布,随着越来越多报告显示 AI ...

  5. IT之家 AI70

    OpenAI 明日重开 200 美元档 ChatGPT-Pro 订阅:API 支出减半,新增更多不计量功能

    IT之家 9 月 29 日消息,OpenAI 首席产品官 Tibo 宣布将于明天向新用户重新开放月费 200 美元的 ChatGPT Pro 订阅,同时调整该档位的用量计算方式。 按照新的计算规则,200 美元 Pro 订阅对应的 API 等效价值相比原来接近翻倍,而且 OpenAI 不会重新恢复此前的 5 小时使用限制,仅保留周额度用量管理,让用户能够在需要时集中使用额度,而不是受短时间窗口限制。 今年 9 月 11 日,由于 GPT-6 Astra 带来的算力需求激增,OpenAI 宣布暂停 200 美元 (IT之家注:现汇率约合 1,344 元人民币) Pro 订阅的新用户注册,以缓解算力压力。 OpenAI 表示,随着模型效率提升,会持续下调 API 价格,而不是人为维持较高的 API 标价,再通过打折制造“更划算”的假象。在此之前,OpenAI 已将本周新发布 GPT-6 Sol 和 GPT-6 Luna 的 API ...

    推荐理由:来自IT之家 AI的《OpenAI 明日重开 200 美元档 ChatGPT-Pro 订阅:API 支出减半,新增更多不计量功能》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 29 日消息,OpenAI 首席产品官 Tibo 宣布将于明天向新用户重新开放月费 200 美元的 ChatGPT Pro 订阅,同时调整该档位的用量计算方式。 按照新的计算规则,200 美元 Pro 订阅对应的 API 等效价值相比原来接近翻倍,而且 OpenAI 不会重新恢复此前的 5 小时使用限制,仅保留周额度用量管理,让用户能够在需要时集中使用额度,而不是受短时间窗口限制。 今年 9 月 11 日,由于 GPT-6 Astra 带来的算力需求激增,OpenAI 宣布暂停 200 美元 (IT之家注:现汇率约合 1,344 元人民币) Pro 订阅的新用户注册,以缓解算力压力。 OpenAI 表示,随着模型效率提升,会持续下调 API 价格,而不是人为维持较高的 API 标价,再通过打折制造“更划算”的假象。在此之前,OpenAI 已将本周新发布 GPT-6 Sol 和 GPT-6 Luna 的 API ...

  6. IT之家 AI70

    曝影石正在研发主打拍摄的智能眼镜:前镜框可更换,有望搭载阿里千问

    IT之家 9 月 29 日消息,蓝鲸新闻今日援引知情人士消息称, 影石创新正在研发一款主打拍摄的智能眼镜 。与市场上多数以语音 AI 助手为核心卖点的 AI 眼镜不同,这款产品优先满足内容创作者对便捷、高质量、免手持拍摄的需求。 据前述知情人士称:“ 影石这款产品或采用前镜框可换设计 ,功能主要集中在镜腿上。用户可以根据不同场景或穿搭风格更换镜框,让智能眼镜更接近传统眼镜的消费逻辑。”这意味着,影石希望把智能眼镜从“科技硬件”拉向更日常、可搭配的消费电子。 前述知情人士透露,AI 能力方面, 影石大概率会选择搭载阿里千问大模型 。不过,影石并不满足于只调用云端大模型。据影石内部人士透露:“未来公司 AI 的核心方向,还是如何把端侧生成模型直接部署到影石的产品端。另外,影石内部还在研发现有产品形态之外的新产品。”这背后是其更长远的野心 —— 让生成模型在端侧落地。 IT之家注意到,影石创新此前获得了一项名为“可穿戴式眼镜”的实用新...

    推荐理由:来自IT之家 AI的《曝影石正在研发主打拍摄的智能眼镜:前镜框可更换,有望搭载阿里千问》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 29 日消息,蓝鲸新闻今日援引知情人士消息称, 影石创新正在研发一款主打拍摄的智能眼镜 。与市场上多数以语音 AI 助手为核心卖点的 AI 眼镜不同,这款产品优先满足内容创作者对便捷、高质量、免手持拍摄的需求。 据前述知情人士称:“ 影石这款产品或采用前镜框可换设计 ,功能主要集中在镜腿上。用户可以根据不同场景或穿搭风格更换镜框,让智能眼镜更接近传统眼镜的消费逻辑。”这意味着,影石希望把智能眼镜从“科技硬件”拉向更日常、可搭配的消费电子。 前述知情人士透露,AI 能力方面, 影石大概率会选择搭载阿里千问大模型 。不过,影石并不满足于只调用云端大模型。据影石内部人士透露:“未来公司 AI 的核心方向,还是如何把端侧生成模型直接部署到影石的产品端。另外,影石内部还在研发现有产品形态之外的新产品。”这背后是其更长远的野心 —— 让生成模型在端侧落地。 IT之家注意到,影石创新此前获得了一项名为“可穿戴式眼镜”的实用新...

  7. IT之家 AI68

    IDC:今年上半年全球人形机器人出货近 2.5 万台同比增长 432.1%,中国独占 1.9 万台

    IT之家 9 月 29 日消息,国际数据公司( IDC )最新发布的全球人形机器人跟踪报告显示,2026 上半年,全球人形机器人出货量接近 2.5 万台,同比增长 432.1%,产业发展进一步从技术验证向商业化应用探索阶段迈进。 IDC 预计,2030 年全球人形机器人出货量将超过 75 万台,市场将进入规模化应用加速发展阶段。 2026 年以来,全球人形机器人市场延续高速增长态势,产业发展进一步从技术验证迈向商业化应用探索。IDC 数据显示,2026 年上半年, 全球人形机器人出货量近 2.5 万台,同比增长 432.1% ;市场规模超过 7.4 亿美元,同比增长 322.7% 。 市场高速增长的同时,人形机器人产业的供需两端也正在发生积极变化:一方面,工业、物流等应用探索持续加速,头部厂商不断扩充生产能力;另一方面,中国市场开始出现面向个人消费者的小型人形机器人,家庭及个人市场逐步成为新的潜在增长空间。 此外,具身智能大模型...

    推荐理由:来自IT之家 AI的《IDC:今年上半年全球人形机器人出货近 2.5 万台同比增长 432.1%,中国独占 1.9 万台》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 29 日消息,国际数据公司( IDC )最新发布的全球人形机器人跟踪报告显示,2026 上半年,全球人形机器人出货量接近 2.5 万台,同比增长 432.1%,产业发展进一步从技术验证向商业化应用探索阶段迈进。 IDC 预计,2030 年全球人形机器人出货量将超过 75 万台,市场将进入规模化应用加速发展阶段。 2026 年以来,全球人形机器人市场延续高速增长态势,产业发展进一步从技术验证迈向商业化应用探索。IDC 数据显示,2026 年上半年, 全球人形机器人出货量近 2.5 万台,同比增长 432.1% ;市场规模超过 7.4 亿美元,同比增长 322.7% 。 市场高速增长的同时,人形机器人产业的供需两端也正在发生积极变化:一方面,工业、物流等应用探索持续加速,头部厂商不断扩充生产能力;另一方面,中国市场开始出现面向个人消费者的小型人形机器人,家庭及个人市场逐步成为新的潜在增长空间。 此外,具身智能大模型...

  8. IT之家 AI74

    AI 写作特征减少:Claude Opus 5.5 破折号使用量下降约 95%、分号下降 73%

    IT之家 9 月 29 日消息,@arena 于 9 月 26 日在 X 平台发布推文,通过写作指标测试,发现相比较 Opus 5 模型, Anthropic 的 Claude Opus 5.5 破折号使用量下降约 95%,每 1,000 个单词从 15.2 个降至 0.8 个。 IT之家附上相关截图如下: Arena 分析了 2026 年 8 月和 9 月的 Text Arena 高推理回复。结果显示,12 项写作指标中有 10 项朝 Arena 认定的改善方向变化。 其中最为明显的是大幅减少使用破折号,Claude Opus 5 每 1,000 个单词使用 15.2 个破折号。Opus 5.5 的使用量降至 0.8 个,较前代减少约 95%。 分号使用量也同步下降。Claude Opus 5 每 1,000 个单词使用 6.10 个分号。Opus 5.5 降至 1.64 个,降幅为 73%,显示模型减少了部分容易被识别的标点...

    推荐理由:来自IT之家 AI的《AI 写作特征减少:Claude Opus 5.5 破折号使用量下降约 95%、分号下降 73%》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 29 日消息,@arena 于 9 月 26 日在 X 平台发布推文,通过写作指标测试,发现相比较 Opus 5 模型, Anthropic 的 Claude Opus 5.5 破折号使用量下降约 95%,每 1,000 个单词从 15.2 个降至 0.8 个。 IT之家附上相关截图如下: Arena 分析了 2026 年 8 月和 9 月的 Text Arena 高推理回复。结果显示,12 项写作指标中有 10 项朝 Arena 认定的改善方向变化。 其中最为明显的是大幅减少使用破折号,Claude Opus 5 每 1,000 个单词使用 15.2 个破折号。Opus 5.5 的使用量降至 0.8 个,较前代减少约 95%。 分号使用量也同步下降。Claude Opus 5 每 1,000 个单词使用 6.10 个分号。Opus 5.5 降至 1.64 个,降幅为 73%,显示模型减少了部分容易被识别的标点...

  9. IT之家 AI72

    内部测试发现安全隐患,消息称 OpenAI 取消发布 AI 模型 GPT‑6.1 Astra

    IT之家 9 月 29 日消息,据《华尔街日报》报道,由于内部测试过程中研究人员提出多项安全隐患,OpenAI 决定取消 GPT‑6.1 Astra 的发布。这款下一代 AI 模型原本计划于 10 月正式亮相。 报道称,该模型原定部署于 ChatGPT 以及 Codex 产品当中,设计目标是无需人类协助就可以处理更加复杂的任务。 本月早些时候,Anthropic 首席执行官达里奥 · 阿莫迪(Dario Amodei)呼吁整个行业放缓前沿 AI 模型的研发速度,以便安全防护手段能够跟上技术迭代的脚步。OpenAI 首席执行官萨姆 · 奥尔特曼(Sam Altman)以及 SpaceX 首席执行官埃隆 · 马斯克(Elon Musk)均对这一观点表示认同。 OpenAI 的安全主管萨奇 · 贾因(Saachi Jain)周一在接受《华尔街日报》采访时表示,Astra 在对齐测试当中没有达到公司内部标准;对齐测试用于评估 AI 系统...

    推荐理由:来自IT之家 AI的《内部测试发现安全隐患,消息称 OpenAI 取消发布 AI 模型 GPT‑6.1 Astra》。重点看模型能力与工程、产品发布。摘要提到:IT之家 9 月 29 日消息,据《华尔街日报》报道,由于内部测试过程中研究人员提出多项安全隐患,OpenAI 决定取消 GPT‑6.1 Astra 的发布。这款下一代 AI 模型原本计划于 10 月正式亮相。 报道称,该模型原定部署于 ChatGPT 以及 Codex 产品当中,设计目标是无需人类协助就可以处理更加复杂的任务。 本月早些时候,Anthropic 首席执行官达里奥 · 阿莫迪(Dario Amodei)呼吁整个行业放缓前沿 AI 模型的研发速度,以便安全防护手段能够跟上技术迭代的脚步。OpenAI 首席执行官萨姆 · 奥尔特曼(Sam Altman)以及 SpaceX 首席执行官埃隆 · 马斯克(Elon Musk)均对这一观点表示认同。 OpenAI 的安全主管萨奇 · 贾因(Saachi Jain)周一在接受《华尔街日报》采访时表示,Astra 在对齐测试当中没有达到公司内部标准;对齐测试用于评估 AI 系统...

  10. Apple Machine Learning Research50

    The Communication Bottleneck: A Round-Trip Study of Tree-Structured Expression Serialization in Language Models

    事实摘要:这条英文动态主要涉及模型能力与工程、评测与基准,原文信息显示:The Communication Bottleneck: A Round-Trip Study of Tree-Structured Expression Serialization in Language Models 这条英文动态主要涉及模型能力与工程。原文要点:When language 。影响判断:它可能改变模型能力与工程、评测与基准相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程、评测与基准方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和模型能力与工程、评测与基准直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  11. IT之家 AI68

    ElevenLabs 推出 v4 和 v4 Turbo 语音模型:支持 90 余种语言,10 秒素材即可克隆声音

    IT之家 9 月 29 日消息,ElevenLabs 于当地时间周一正式推出了两款全新语音模型,分别为 ElevenLabs v4 与 v4 Turbo。新版模型强化了情绪表达控制能力,降低了语音智能体的响应延迟,同时支持 90 余种语言。 该公司去年发布了 v3 模型,并于今年早些时候在华沙举办的活动上对新一代模型进行了预热。v4 系列采用全新架构,实现了更精细的语音控制以及速度更快的声音克隆。官方表示,借助 v4,用户仅需 10 秒音频素材即可完成语音克隆。 在内容创作方面,当朗读大段文本时,新版模型可以更好地维持说话人的音色特征;朗读过程中还能够记住前后文本语境,随之调整语气。ElevenLabs 曾在 v3 版本当中引入内联标签用以设定语音情绪;到了 v4,标签功能得到进一步扩充,用户可以叠加多个标签,模型将按照标签的先后顺序执行。 旧版模型支持 70 种语言。经过优化之后,新版本的语言支持数量提升至 90 种。这家初创...

    推荐理由:来自IT之家 AI的《ElevenLabs 推出 v4 和 v4 Turbo 语音模型:支持 90 余种语言,10 秒素材即可克隆声音》。重点看智能体工作流、模型能力与工程、产品发布。摘要提到:IT之家 9 月 29 日消息,ElevenLabs 于当地时间周一正式推出了两款全新语音模型,分别为 ElevenLabs v4 与 v4 Turbo。新版模型强化了情绪表达控制能力,降低了语音智能体的响应延迟,同时支持 90 余种语言。 该公司去年发布了 v3 模型,并于今年早些时候在华沙举办的活动上对新一代模型进行了预热。v4 系列采用全新架构,实现了更精细的语音控制以及速度更快的声音克隆。官方表示,借助 v4,用户仅需 10 秒音频素材即可完成语音克隆。 在内容创作方面,当朗读大段文本时,新版模型可以更好地维持说话人的音色特征;朗读过程中还能够记住前后文本语境,随之调整语气。ElevenLabs 曾在 v3 版本当中引入内联标签用以设定语音情绪;到了 v4,标签功能得到进一步扩充,用户可以叠加多个标签,模型将按照标签的先后顺序执行。 旧版模型支持 70 种语言。经过优化之后,新版本的语言支持数量提升至 90 种。这家初创...

  12. IT之家 AI74

    Anthropic 发布 Claude Sonnet 5.5:速度提升 30%,智能体编码性能反超 Opus 5.5

    IT之家 9 月 29 日消息,随着 AI 模型竞赛持续升温,Anthropic 推出了旗下中端模型 Sonnet 的最新版本。该公司表示,新版模型运行速度会快得多,使用成本也较上一代大幅降低。 IT之家注意到,这家实验室将 Sonnet 5.5 定位为日常任务的理想助手,适用场景包括编写代码以及制作办公文档。 Sonnet 5.5 的上一代产品 Sonnet 5 是大约三个月前发布的。当时这款模型的主打优势是智能体的高效部署,也就是运行智能体的成本低于竞品。 而 5.5 版本的核心亮点在于速度。Anthropic 称,Sonnet 5.5 的速度比上一代提升 30%,词元(Token)消耗速度也明显更低。 在 Anthropic 的模型产品序列当中,Sonnet 的性能弱于 Opus 模型,但凭借反应灵活的特点,在部分场景下反而更加实用。尤其是 Anthropic 的基准测试结果显示,Sonnet 5.5 在智能体编码任务上的...

    推荐理由:来自IT之家 AI的《Anthropic 发布 Claude Sonnet 5.5:速度提升 30%,智能体编码性能反超 Opus 5.5》。重点看智能体工作流、模型能力与工程、评测与基准。摘要提到:IT之家 9 月 29 日消息,随着 AI 模型竞赛持续升温,Anthropic 推出了旗下中端模型 Sonnet 的最新版本。该公司表示,新版模型运行速度会快得多,使用成本也较上一代大幅降低。 IT之家注意到,这家实验室将 Sonnet 5.5 定位为日常任务的理想助手,适用场景包括编写代码以及制作办公文档。 Sonnet 5.5 的上一代产品 Sonnet 5 是大约三个月前发布的。当时这款模型的主打优势是智能体的高效部署,也就是运行智能体的成本低于竞品。 而 5.5 版本的核心亮点在于速度。Anthropic 称,Sonnet 5.5 的速度比上一代提升 30%,词元(Token)消耗速度也明显更低。 在 Anthropic 的模型产品序列当中,Sonnet 的性能弱于 Opus 模型,但凭借反应灵活的特点,在部分场景下反而更加实用。尤其是 Anthropic 的基准测试结果显示,Sonnet 5.5 在智能体编码任务上的...

  13. Simon Willison83

    Claude Sonnet 5.5

    这条英文动态主要涉及模型能力与工程、评测与基准。原文要点:Claude Sonnet 5.5 New Sonnet model from Anthropic today. They say it "runs 30%+ faster, and costs up to 30% less for most work" - it's priced the same as Sonnet 5 but appears to beat it on every benchmark, and should be cheaper to run as well. Here are some pelicans riding bicycles . Sonnet 5.5 suffered from the same bug as Opus 5.5 : the "max" thinking effort pelican thought for 128,000 tokens (at a cost of $1.28) b...

    推荐理由:来自Simon Willison的《Claude Sonnet 5.5》。重点看模型能力与工程、评测与基准。摘要提到:这条英文动态主要涉及模型能力与工程、评测与基准。原文要点:Claude Sonnet 5.5 New Sonnet model from Anthropic today. They say it "runs 30%+ faster, and costs up to 30% less for most work" - it's priced the same as Sonnet 5 but appears to beat it on every benchmark, and should be cheaper to run as well. Here are some pelicans riding bicycles . Sonnet 5.5 suffered from the same bug as Opus 5.5 : the "max" thinking effort pelican thought for 128,000 ...

  14. OpenAI News80

    Towards safety cases for frontier AI training

    这条英文动态主要涉及模型能力与工程。原文要点:Our early guidelines for safety cases in frontier AI training cover technical safeguards, operational practices, and investigating misalignment incidents

    推荐理由:来自OpenAI News的《Towards safety cases for frontier AI training》。重点看模型能力与工程。摘要提到:这条英文动态主要涉及模型能力与工程。原文要点:Our early guidelines for safety cases in frontier AI training cover technical safeguards, operational practices, and investigating misalignment incidents

  15. GitHub Changelog92

    Claude Sonnet 5.5 in GitHub Copilot

    事实摘要:这条英文动态主要涉及模型能力与工程、开源生态,原文信息显示:Claude Sonnet 5.5 in GitHub Copilot 事实摘要:这条英文动态主要涉及模型能力与工程、开源生态,原文信息显示:Claude Sonnet 5.5 in GitHub Copilot 事实摘要:这条英文动态主要涉及模型能力与工程、开源生态,原文信息显示:Claude S。影响判断:它可能改变模型能力与工程、开源生态相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程、开源生态方向的选题、竞品观察和落地方案筛选。

    推荐理由:它和模型能力与工程、开源生态直接相关,可能影响产品设计、研究判断、教育/文化场景落地或开发实践。

  16. Claude Code Releases90

    Claude Code Releases v2.1.284:Added Claude Sonnet 5.5 ( claude-sonnet-5-5 ), now the def...

    这条英文动态主要涉及模型能力与工程、产品发布。原文要点:What's changed Added Claude Sonnet 5.5 ( claude-sonnet-5-5 ), now the default Sonnet model on the Anthropic API — 1M context, $2/$10 per Mtok with $0.20/Mtok cache reads Added a "Yes, but ask again next time" answer to auto mode's prompt before a read outside the working directories, so you can allow that one read and still be asked about later ones Added dollar amounts to the Claude apps gateway spend limit in /usag...

    推荐理由:来自Claude Code Releases的《Claude Code Releases v2.1.284:Added Claude Sonnet 5.5 ( claude-sonnet-5-5 ), now the def...》。重点看模型能力与工程、产品发布。摘要提到:这条英文动态主要涉及模型能力与工程、产品发布。原文要点:What's changed Added Claude Sonnet 5.5 ( claude-sonnet-5-5 ), now the default Sonnet model on the Anthropic API — 1M context, $2/$10 per Mtok with $0.20/Mtok cache reads Added a "Yes, but ask again next time" answer to auto mode's prompt before a read outside the working directories, so you can allow that one read and still be asked about later ones Added dollar amounts to the Claude apps ...

9月28日周一
  1. IT之家 AI38

    Manus:正组建团队开发面向国内市场的产品,与国产模型厂商合作稳步进行中

    IT之家 9 月 28 日消息,北京蝴蝶效应科技有限公司公众号今日发文,宣布面向海外用户发布 Manus 2.0 版本,并推出面向个人生活场景的智能助理 Cue。 Manus 表示,公司正在组建团队开发面向国内市场的产品,与国产模型厂商及生态伙伴的合作也在稳步进行,后续将分享更多进展。 IT之家注:Cue 被定位为面向个人生活场景的智能助理,Manus 2.0 面向海外用户发布,国内版本仍在筹备中。 Manus 2.0 已在网页端、桌面端和移动端上线,Cue 同步上线,iOS 版本将在通过 App Store 审核后推出。 据介绍,Manus 2.0 采用自研 Agent 框架 Cascade。官方称,该框架让项目保持轻量,仅在需要时引入专业能力。在一项测试配置中,Cascade 的 Token 消耗减少 23.2%,任务完成时间缩短 28.2%,运行成本降低 32%。 云电脑功能允许用户购买专属运行环境,用于多人游戏服务器或长...

    推荐理由:来自IT之家 AI的《Manus:正组建团队开发面向国内市场的产品,与国产模型厂商合作稳步进行中》。重点看智能体工作流、模型能力与工程、产品发布。摘要提到:IT之家 9 月 28 日消息,北京蝴蝶效应科技有限公司公众号今日发文,宣布面向海外用户发布 Manus 2.0 版本,并推出面向个人生活场景的智能助理 Cue。 Manus 表示,公司正在组建团队开发面向国内市场的产品,与国产模型厂商及生态伙伴的合作也在稳步进行,后续将分享更多进展。 IT之家注:Cue 被定位为面向个人生活场景的智能助理,Manus 2.0 面向海外用户发布,国内版本仍在筹备中。 Manus 2.0 已在网页端、桌面端和移动端上线,Cue 同步上线,iOS 版本将在通过 App Store 审核后推出。 据介绍,Manus 2.0 采用自研 Agent 框架 Cascade。官方称,该框架让项目保持轻量,仅在需要时引入专业能力。在一项测试配置中,Cascade 的 Token 消耗减少 23.2%,任务完成时间缩短 28.2%,运行成本降低 32%。 云电脑功能允许用户购买专属运行环境,用于多人游戏服务器或长...

  2. Cloudflare AI51

    Next.js applications, powered by Vite: introducing Vinext 1.0

    这条英文动态主要涉及产品发布。原文要点:Vinext 1.0 graduates from an AI experiment to a production-ready framework, letting developers run Next.js apps on Vite. This release brings advanced cache warming, broader compatibility, and an automated testing pipeline.

    推荐理由:来自Cloudflare AI的《Next.js applications, powered by Vite: introducing Vinext 1.0》。重点看产品发布。摘要提到:这条英文动态主要涉及产品发布。原文要点:Vinext 1.0 graduates from an AI experiment to a production-ready framework, letting developers run Next.js apps on Vite. This release brings advanced cache warming, broader compatibility, and an automated testing pipeline.

  3. IT之家 AI68

    ACEMAGIC 推出全球首款锐龙 AI Max+ PRO 495 处理器的 AI 迷你工作站,6499 美元

    IT之家 9 月 28 日消息,ACEMAGIC 今天宣布推出 F9A 迷你主机,这是全球首款搭载锐龙 AI Max+ 495 处理器的 AI 工作站, 配备 192GB 内存和 2TB 硬盘 ,定价 6,499 美元 (IT之家注:现汇率约合 43,670 元人民币) 。 据介绍,这款工作站采用铝合金机身,两侧带有散热开孔。整机尺寸仅 158.5*158.5*81.5mm,重量 1.4kg,面向 AI 开发者、专业创作者等群体。 规格方面,这款工作站配备 192GB LPDDR5X-8533 统一内存,最高可将 160GB 分配给显存,本地运行大语言模型。该机配备两个 M.2 2280 NVMe PCIe 4.0x4 SSD 插槽,最高支持扩展 8TB 存储空间。 此外,该机还将配备 USB4、DP、OCuLink、HDMI、USB-A、2.5GbE 等接口,支持 Wi-Fi7 和蓝牙 5.4。

    推荐理由:来自IT之家 AI的《ACEMAGIC 推出全球首款锐龙 AI Max+ PRO 495 处理器的 AI 迷你工作站,6499 美元》。重点看模型能力与工程。摘要提到:IT之家 9 月 28 日消息,ACEMAGIC 今天宣布推出 F9A 迷你主机,这是全球首款搭载锐龙 AI Max+ 495 处理器的 AI 工作站, 配备 192GB 内存和 2TB 硬盘 ,定价 6,499 美元 (IT之家注:现汇率约合 43,670 元人民币) 。 据介绍,这款工作站采用铝合金机身,两侧带有散热开孔。整机尺寸仅 158.5*158.5*81.5mm,重量 1.4kg,面向 AI 开发者、专业创作者等群体。 规格方面,这款工作站配备 192GB LPDDR5X-8533 统一内存,最高可将 160GB 分配给显存,本地运行大语言模型。该机配备两个 M.2 2280 NVMe PCIe 4.0x4 SSD 插槽,最高支持扩展 8TB 存储空间。 此外,该机还将配备 USB4、DP、OCuLink、HDMI、USB-A、2.5GbE 等接口,支持 Wi-Fi7 和蓝牙 5.4。

  4. IT之家 AI74

    月之暗面最强 AI 模型:Kimi K3.1 前端标识泄露,预计将在近期发布

    IT之家 9 月 28 日消息,今日有多名开发者注意到月之暗面 API 平台的后台模型注册表中出现了“kimi-k3-1”标识,该模型标识通过了接口探测并可调用。 今日晚些时候,Kimi 官方开放平台也出现了 K3.1 或 K3 11111 模型的预告,支持 1M tokens 上下文窗口。 Kimi K3.1 预计支持最高 100 万 Token 上下文窗口,并提供 Low、High、Max 三档推理强度选项,可能引入 Agent 智能体模式、Swarm 多智能体协作以及搜索和批处理等任务模式。有开发者分析认为,多档推理强度的设计可能对应不同的算力资源配置与计费模型。 Kimi 开放平台显示,Kimi K3.1 的 API 价格与现有 K3 相同,但也不排除是占位符的可能。 相关阅读: 《 月之暗面最强 AI:消息称 Kimi K3.1 下月登场 》

    推荐理由:来自IT之家 AI的《月之暗面最强 AI 模型:Kimi K3.1 前端标识泄露,预计将在近期发布》。重点看智能体工作流、模型能力与工程、产品发布。摘要提到:IT之家 9 月 28 日消息,今日有多名开发者注意到月之暗面 API 平台的后台模型注册表中出现了“kimi-k3-1”标识,该模型标识通过了接口探测并可调用。 今日晚些时候,Kimi 官方开放平台也出现了 K3.1 或 K3 11111 模型的预告,支持 1M tokens 上下文窗口。 Kimi K3.1 预计支持最高 100 万 Token 上下文窗口,并提供 Low、High、Max 三档推理强度选项,可能引入 Agent 智能体模式、Swarm 多智能体协作以及搜索和批处理等任务模式。有开发者分析认为,多档推理强度的设计可能对应不同的算力资源配置与计费模型。 Kimi 开放平台显示,Kimi K3.1 的 API 价格与现有 K3 相同,但也不排除是占位符的可能。 相关阅读: 《 月之暗面最强 AI:消息称 Kimi K3.1 下月登场 》

  5. 极客公园69

    外网玩疯了,NSFW、毫无底线,FLUX 成为图片生成新王者

    本文首发于 Founder Park 公众号 · 2024 年 8 月 15 日 昨天马斯克的 Grok-2 发布,加入了 FLUX 模型提供的文生图能力。一夜之间,FLUX 毫无底线的图片血洗 X(推特)。 自从 Google 把美国开国总统和印第安人都画成黑人之后,马斯克带头掀起另一个极端的文生图刷屏现象。 FLUX 模型,来自于德国创业公司 Black Forest Labs,拳打 MJ 脚踩 SD,图片质量做到了行业天花板,道德底线也压到了地板砖。 点击关注,发现更多 AI 创业者 01 生成质量高, 内容「毫无限制」 首先在 X 上引起热议的,是前几天网友制作的 TEDx AI 讲师。 仔细看,嘉宾卡上的 Google 字样与真实的 logo 毫无区别。 比如这张华人讲师: 而在 图片准确性上,FLUX 可以说直接把 Gemini 摁在地上打 。Black Forest Labs 的董事 Anjney Midha 在 ...

    推荐理由:来自极客公园的《外网玩疯了,NSFW、毫无底线,FLUX 成为图片生成新王者》。重点看模型能力与工程、产品发布。摘要提到:本文首发于 Founder Park 公众号 · 2024 年 8 月 15 日 昨天马斯克的 Grok-2 发布,加入了 FLUX 模型提供的文生图能力。一夜之间,FLUX 毫无底线的图片血洗 X(推特)。 自从 Google 把美国开国总统和印第安人都画成黑人之后,马斯克带头掀起另一个极端的文生图刷屏现象。 FLUX 模型,来自于德国创业公司 Black Forest Labs,拳打 MJ 脚踩 SD,图片质量做到了行业天花板,道德底线也压到了地板砖。 点击关注,发现更多 AI 创业者 01 生成质量高, 内容「毫无限制」 首先在 X 上引起热议的,是前几天网友制作的 TEDx AI 讲师。 仔细看,嘉宾卡上的 Google 字样与真实的 logo 毫无区别。 比如这张华人讲师: 而在 图片准确性上,FLUX 可以说直接把 Gemini 摁在地上打 。Black Forest Labs 的董事 Anjney Midha 在 ...

  6. 极客公园73

    DeepMind科学家万字分享:50个AI提效用例详解,工作中我是这么用AI的

    本文首发于 Founder Park 公众号 · 2024 年 8 月 17 日 文章作者是 DeepMind 的机器学习专家 Nicholas Carlini,不同于别人的介绍 AI 应用实例的文章,这次 Nicholas Carlini 详细讲解了自己在日常中如何使用 ChatGPT,比如写代码、优化代码、修复错误等,而且将完整的对话分享了出来。 在这些对话中,可以看到 Nicholas Carlini 的每一条具体的 prompt,以及最终如何生成可用的结果。 鉴于对话较长,很难用文档的形式呈现,我们在每个案例下附上了对话的链接,可以直接点击查看。 我不认为现在 AI 模型(LLM)的用处被过分夸大了。 诚然,任何新兴技术都会吸引投机取巧的人。很多公司都爱宣称自己「正在应用 AI 技术」,就像他们以前喜欢讲「基于区块链技术」一样。(我们已经多次见识过这种现象)我们可能正处在一个泡沫之中。互联网泡沫在 2000 年破裂,但现...

    推荐理由:来自极客公园的《DeepMind科学家万字分享:50个AI提效用例详解,工作中我是这么用AI的》。重点看模型能力与工程。摘要提到:本文首发于 Founder Park 公众号 · 2024 年 8 月 17 日 文章作者是 DeepMind 的机器学习专家 Nicholas Carlini,不同于别人的介绍 AI 应用实例的文章,这次 Nicholas Carlini 详细讲解了自己在日常中如何使用 ChatGPT,比如写代码、优化代码、修复错误等,而且将完整的对话分享了出来。 在这些对话中,可以看到 Nicholas Carlini 的每一条具体的 prompt,以及最终如何生成可用的结果。 鉴于对话较长,很难用文档的形式呈现,我们在每个案例下附上了对话的链接,可以直接点击查看。 我不认为现在 AI 模型(LLM)的用处被过分夸大了。 诚然,任何新兴技术都会吸引投机取巧的人。很多公司都爱宣称自己「正在应用 AI 技术」,就像他们以前喜欢讲「基于区块链技术」一样。(我们已经多次见识过这种现象)我们可能正处在一个泡沫之中。互联网泡沫在 2000 年破裂,但现...

  7. 极客公园71

    OpenAI o1 团队在线答疑:o1的o指OpenAI,强化后的推理有泛化能力,未来模型思考时间可控!

    本文首发于 Founder Park 公众号 · 2024 年 9 月 14 日 这可能是最有参与感的一次产品问答了。 对于 OpenAI o1 的所有疑问和好奇,由推特的所有网友来提问,OpenAI 的全体技术人 员来回答。数了下,一共有 12 位员工出现,这其中有 各个方向的研究员和研究科学家,以及产品经理、产品主管 。 至于提问,从 模型命名、模型的大小和模态 ,到 提示词、思维链、上下文长度,以及价格 ,可以说,大家关注的问题,基本都在里面了。 参与问答的 OpenAI 人员: Ahmed El-Kishky:OpenAI 研究 员 Łukasz Kondraciuk:草莓训练设施负责人,华沙大学计算机科学,ACM ICPC 2022 银牌 Shengjia Zhao:OpenAI 研究科学家,斯坦福大学博士 Romain Huet:GPT-4o、o1 开发者体验主管,曾任 Stripe、Twitter 产品主管 Hon...

    推荐理由:来自极客公园的《OpenAI o1 团队在线答疑:o1的o指OpenAI,强化后的推理有泛化能力,未来模型思考时间可控!》。重点看模型能力与工程、产品发布。摘要提到:本文首发于 Founder Park 公众号 · 2024 年 9 月 14 日 这可能是最有参与感的一次产品问答了。 对于 OpenAI o1 的所有疑问和好奇,由推特的所有网友来提问,OpenAI 的全体技术人 员来回答。数了下,一共有 12 位员工出现,这其中有 各个方向的研究员和研究科学家,以及产品经理、产品主管 。 至于提问,从 模型命名、模型的大小和模态 ,到 提示词、思维链、上下文长度,以及价格 ,可以说,大家关注的问题,基本都在里面了。 参与问答的 OpenAI 人员: Ahmed El-Kishky:OpenAI 研究 员 Łukasz Kondraciuk:草莓训练设施负责人,华沙大学计算机科学,ACM ICPC 2022 银牌 Shengjia Zhao:OpenAI 研究科学家,斯坦福大学博士 Romain Huet:GPT-4o、o1 开发者体验主管,曾任 Stripe、Twitter 产品主管 Hon...

  8. 极客公园73

    o1发布后,信息量最大的圆桌对话:杨植麟、姜大昕、朱军探讨大模型技术路径

    本文首发于 Founder Park 公众号 · 2024 年 9 月 19 日 在 2024 云栖大会上,阶跃星辰创始人姜大昕、月之暗面Kimi创始人杨植麟、生数科技首席科学家朱军与极客公园创始人张鹏一起,探讨了各自眼中 AI 技术发展的现状,推演未来 18 个月,大模型行业会发生什么。 在这场圆桌里,他们重点聊了: 客观来说,AI 领域过去两年发生了什么? OpenAI o1 的发布对行业意味着什么? o1 背后的强化学习新范式对算力和数据提出了怎样的新要求? AI 应用层的创业,在今天该怎么做? 未来 18 个月,AI 技术和应用的发展路径是什么? 信息量很大,我们将现场实录整理如下。 点击关注,每天更新深度 AI 行业洞察 01 AI 发展的速度太快了 张鹏:OpenAI 发布到现在快两年了,这两年里引发了整个世界对 AI 的讨论。各位都是下场创业做大模型的创业者,你们的感受是怎样的? 我们是在「看游戏」,你们在「打游戏...

    推荐理由:来自极客公园的《o1发布后,信息量最大的圆桌对话:杨植麟、姜大昕、朱军探讨大模型技术路径》。重点看模型能力与工程、产品发布。摘要提到:本文首发于 Founder Park 公众号 · 2024 年 9 月 19 日 在 2024 云栖大会上,阶跃星辰创始人姜大昕、月之暗面Kimi创始人杨植麟、生数科技首席科学家朱军与极客公园创始人张鹏一起,探讨了各自眼中 AI 技术发展的现状,推演未来 18 个月,大模型行业会发生什么。 在这场圆桌里,他们重点聊了: 客观来说,AI 领域过去两年发生了什么? OpenAI o1 的发布对行业意味着什么? o1 背后的强化学习新范式对算力和数据提出了怎样的新要求? AI 应用层的创业,在今天该怎么做? 未来 18 个月,AI 技术和应用的发展路径是什么? 信息量很大,我们将现场实录整理如下。 点击关注,每天更新深度 AI 行业洞察 01 AI 发展的速度太快了 张鹏:OpenAI 发布到现在快两年了,这两年里引发了整个世界对 AI 的讨论。各位都是下场创业做大模型的创业者,你们的感受是怎样的? 我们是在「看游戏」,你们在「打游戏...

  9. 极客公园73

    Kimi发力AI搜索,产品形态更加明确,在聊天中探索生产力

    本文首发于 Founder Park 公众号 · 2024 年 10 月 11 日 Kimi 今天发布了 AI 深度搜索功能, Web 端逐渐放量,预计 10 月 14 日全量上线。 产品功能和试用体验我们稍后再谈。 从产品形态上来看,Kimi 可能是国内最接近 ChatGPT 的 AI Native 产品,恰巧近期 OpenAI 的一些动作,我们觉得可以做一些延展的讨论。 关注 Founder Park, 更多 AI 产品 review 01 把模型当成产品 feature 在 AI 产品形态的探索上, 过去两年正在定义行业的 OpenAI 只有一个答案:chatbot。 行业更加关注 OpenAI 在模型上的动作,年初的视频生成 Sora,年中的多模态 4o,以及近期发布的 RL 推理强化模型 o1-preview,都在全行业引起了广泛讨论。 但在模型能力的主线之外,还有另一条也许更重要的主线任务,产品化,在 2024 年尤...

    推荐理由:来自极客公园的《Kimi发力AI搜索,产品形态更加明确,在聊天中探索生产力》。重点看模型能力与工程、产品发布。摘要提到:本文首发于 Founder Park 公众号 · 2024 年 10 月 11 日 Kimi 今天发布了 AI 深度搜索功能, Web 端逐渐放量,预计 10 月 14 日全量上线。 产品功能和试用体验我们稍后再谈。 从产品形态上来看,Kimi 可能是国内最接近 ChatGPT 的 AI Native 产品,恰巧近期 OpenAI 的一些动作,我们觉得可以做一些延展的讨论。 关注 Founder Park, 更多 AI 产品 review 01 把模型当成产品 feature 在 AI 产品形态的探索上, 过去两年正在定义行业的 OpenAI 只有一个答案:chatbot。 行业更加关注 OpenAI 在模型上的动作,年初的视频生成 Sora,年中的多模态 4o,以及近期发布的 RL 推理强化模型 o1-preview,都在全行业引起了广泛讨论。 但在模型能力的主线之外,还有另一条也许更重要的主线任务,产品化,在 2024 年尤...

  10. 极客公园73

    RTE年度场景三强专访:实时语音、多模态Agent,创业机会在哪里?

    本文首发于 Founder Park 公众号 · 2024 年 10 月 31 日 10 月 25 日, RTE 年度场景 Showcase 暨第四届 RTE 创新大赛, Founder Park 作为核心生态合作伙伴应邀出席。 2024 年春季超音速计划四强与 RTE 开发者社区及各国际赛区的优胜项目共同角逐年度最具代表性场景三强,通过激烈的角逐最终评选出三强团队: Infiniflow、聊会小天和 Traini 。 新一代 AIRTE 创业者的不同在哪里? 小型团队的大模型创业进入真刀真枪时期:技术输出后,是时候直接服务用户了 。RTE 年度最具代表性的三个场景项目:Infiniflow 是 AI Agent 做到更细腻体验的必要底层能力、聊会小天从第一天就在解决现代年轻人都在面临的压力与心理疏导需求,而 Traini 则以宠物互动情感需求的角度切入市场。 Founder Park 旗下 AGI Founders Fund ...

    推荐理由:来自极客公园的《RTE年度场景三强专访:实时语音、多模态Agent,创业机会在哪里?》。重点看智能体工作流、模型能力与工程。摘要提到:本文首发于 Founder Park 公众号 · 2024 年 10 月 31 日 10 月 25 日, RTE 年度场景 Showcase 暨第四届 RTE 创新大赛, Founder Park 作为核心生态合作伙伴应邀出席。 2024 年春季超音速计划四强与 RTE 开发者社区及各国际赛区的优胜项目共同角逐年度最具代表性场景三强,通过激烈的角逐最终评选出三强团队: Infiniflow、聊会小天和 Traini 。 新一代 AIRTE 创业者的不同在哪里? 小型团队的大模型创业进入真刀真枪时期:技术输出后,是时候直接服务用户了 。RTE 年度最具代表性的三个场景项目:Infiniflow 是 AI Agent 做到更细腻体验的必要底层能力、聊会小天从第一天就在解决现代年轻人都在面临的压力与心理疏导需求,而 Traini 则以宠物互动情感需求的角度切入市场。 Founder Park 旗下 AGI Founders Fund ...

  11. 极客公园69

    对话Me.bot产品负责人:PH月榜第二,用另一种方式做AI陪伴

    本文首发于 Founder Park 公众号 · 2024 年 11 月 7 日 很多 AI 产品,就像你在全是陌生人的活动上,遇见的很多擦肩而过、加了微信的「好友」。 Let's be honest,你不会再跟 ta 发消息的。 但偶尔会有一两个人,聊了几句以后突然觉得这人有点意思,多聊几句,多聊几天,变成了朋友。 信赖感是一种偶然的涌现。有趣的是,AI 产品似乎也需要这种信赖感。 Me.bot 来自心识宇宙,一家在 ChatGPT 之前就开始做大模型的创业公司。 它像是很多产品的融合,笔记、稍后阅读、To-do List、日记类产品。不同的是,AI companion 在 Me.bot 里贯穿始终,每一步都有回响。 Me.bot 在夏天登录 PH,周榜第一月榜第二 「我希望它能成为一面镜子,」心识宇宙联创、Me.bot 产品负责人陈阳说,「每个人都需要一面自己可以信赖的镜子。」 以下是我们与陈阳访谈的记录,经 Founder...

    推荐理由:来自极客公园的《对话Me.bot产品负责人:PH月榜第二,用另一种方式做AI陪伴》。重点看模型能力与工程、产品发布。摘要提到:本文首发于 Founder Park 公众号 · 2024 年 11 月 7 日 很多 AI 产品,就像你在全是陌生人的活动上,遇见的很多擦肩而过、加了微信的「好友」。 Let's be honest,你不会再跟 ta 发消息的。 但偶尔会有一两个人,聊了几句以后突然觉得这人有点意思,多聊几句,多聊几天,变成了朋友。 信赖感是一种偶然的涌现。有趣的是,AI 产品似乎也需要这种信赖感。 Me.bot 来自心识宇宙,一家在 ChatGPT 之前就开始做大模型的创业公司。 它像是很多产品的融合,笔记、稍后阅读、To-do List、日记类产品。不同的是,AI companion 在 Me.bot 里贯穿始终,每一步都有回响。 Me.bot 在夏天登录 PH,周榜第一月榜第二 「我希望它能成为一面镜子,」心识宇宙联创、Me.bot 产品负责人陈阳说,「每个人都需要一面自己可以信赖的镜子。」 以下是我们与陈阳访谈的记录,经 Founder...

  12. 极客公园71

    Kimi发布新模型,数学能力超o1,产品重点提升留存率

    本文首发于 Founder Park 公众号 · 2024 年 11 月 17 日 11 月 16 日,在 Kimi 全面上线一周年之际,月之暗面推出了基于推理强化的数学模型 k0-math,以及 Kimio 探索版的一系列新功能,新推出的 k0-math 数学模型测试成绩超越 o1。 官方称,2024 年 10 月,Kimi 智能助手全平台活跃用户超过 3600 万,k0-math 数学模型和 Kimi 探索版的新功能,将陆续上线网页端和 APP。 「AI 领域正在经历新一轮技术范式的变化。 基于强化学习、合成数据和思维链的新技术,可以解决高质量数据缺乏的问题,将提升 AI 在各个领域和场景的推理能力和智能水平上限。 」 针对最近业内讨论的 Scaling Law 撞墙的问题,Kimi 创始人杨植麟也发表了自己的观点。而对于深度推理、Kimi 自身海外业务收缩、以及 Kimi 的广告投放和用户留存问题,他也一并做了回答,我们对...

    推荐理由:来自极客公园的《Kimi发布新模型,数学能力超o1,产品重点提升留存率》。重点看模型能力与工程、产品发布。摘要提到:本文首发于 Founder Park 公众号 · 2024 年 11 月 17 日 11 月 16 日,在 Kimi 全面上线一周年之际,月之暗面推出了基于推理强化的数学模型 k0-math,以及 Kimio 探索版的一系列新功能,新推出的 k0-math 数学模型测试成绩超越 o1。 官方称,2024 年 10 月,Kimi 智能助手全平台活跃用户超过 3600 万,k0-math 数学模型和 Kimi 探索版的新功能,将陆续上线网页端和 APP。 「AI 领域正在经历新一轮技术范式的变化。 基于强化学习、合成数据和思维链的新技术,可以解决高质量数据缺乏的问题,将提升 AI 在各个领域和场景的推理能力和智能水平上限。 」 针对最近业内讨论的 Scaling Law 撞墙的问题,Kimi 创始人杨植麟也发表了自己的观点。而对于深度推理、Kimi 自身海外业务收缩、以及 Kimi 的广告投放和用户留存问题,他也一并做了回答,我们对...

  13. 极客公园69

    对话王诗沐:走出大厂创业,做 3D AI 游戏,瞄准新的内容平台机会

    本文首发于 Founder Park 公众号 · 2024 年 11 月 18 日 网易云音乐创始人王诗沐的创业公司,全灵 SEELE,宣布完成了千万美元 Pre-A 轮融资。 本轮融资由百度战投领投,投资方包括美图投资、富坤创投等机构, 老股东 Webtime Information S&T 持续加持。 SEELE 成立于 2022 年底,主攻 AI 生成 3D 游戏。2024 年正式推出第一款海外产品,半年积累近百万用户。据了解,SEELE 正在开发下一阶段的产品,并且有清晰的产品和技术路线规划。 核心团队来自腾讯、字节、阿里,包括大模型、图形学等领域的技术专家,产品和增长由连续创业者、腾讯和网易资深增长负责人组成。 作为移动互联网时代的知名产品经理,王诗沐凭借网易云音乐一战成名。 2009 年浙大工业设计毕业,加入支付宝; 2010 年加入网易,网易摄影、网易云音乐、网易美学; 2019 年加入腾讯,小鹅拼拼、腾讯新闻和幻...

    推荐理由:来自极客公园的《对话王诗沐:走出大厂创业,做 3D AI 游戏,瞄准新的内容平台机会》。重点看模型能力与工程、产品发布。摘要提到:本文首发于 Founder Park 公众号 · 2024 年 11 月 18 日 网易云音乐创始人王诗沐的创业公司,全灵 SEELE,宣布完成了千万美元 Pre-A 轮融资。 本轮融资由百度战投领投,投资方包括美图投资、富坤创投等机构, 老股东 Webtime Information S&T 持续加持。 SEELE 成立于 2022 年底,主攻 AI 生成 3D 游戏。2024 年正式推出第一款海外产品,半年积累近百万用户。据了解,SEELE 正在开发下一阶段的产品,并且有清晰的产品和技术路线规划。 核心团队来自腾讯、字节、阿里,包括大模型、图形学等领域的技术专家,产品和增长由连续创业者、腾讯和网易资深增长负责人组成。 作为移动互联网时代的知名产品经理,王诗沐凭借网易云音乐一战成名。 2009 年浙大工业设计毕业,加入支付宝; 2010 年加入网易,网易摄影、网易云音乐、网易美学; 2019 年加入腾讯,小鹅拼拼、腾讯新闻和幻...

  14. 极客公园71

    供应链改造、自研模型、AI营销,如何用AI重构一杯牛奶?

    本文首发于 Founder Park 公众号 · 2024 年 12 月 20 日 AI 时代,大模型正在激发更多企业品牌塑造、内容生产的新解法。 12 月,由伊利集团、阿里云、新华网共同发起举办的「2024 AIGC 视频生态创新大赛」落下帷幕。围绕「真 AI 牛奶,真 AI 创意」的主题——AIGC 技术在营销视频领域的创新应用,历时两个月的角逐,在精彩纷呈的近千个参赛作品中,78 部作品从内容赛道胜出,获得最佳作品奖、优秀创意奖、技术创新奖。 在技术赛道,有 10 家企业斩获优胜方案奖。 本次大赛获奖作品回顾 从视频制作到技术方案,从这次的参赛作品中,我们看到了 AI 视频生成在商业化场景落地的最积极的尝试,以及更可行的可能性。而对于一直苦于寻找 AI 技术落地场景的创业者来说,这无疑也是发现真实需求、解决真实需求的好时机。 今年的生态创新大赛,伊利将「数字 N+伊」生态创享计划升级为「数智伊利」生态创享计划,面对人工智能...

    推荐理由:来自极客公园的《供应链改造、自研模型、AI营销,如何用AI重构一杯牛奶?》。重点看模型能力与工程、文化创意。摘要提到:本文首发于 Founder Park 公众号 · 2024 年 12 月 20 日 AI 时代,大模型正在激发更多企业品牌塑造、内容生产的新解法。 12 月,由伊利集团、阿里云、新华网共同发起举办的「2024 AIGC 视频生态创新大赛」落下帷幕。围绕「真 AI 牛奶,真 AI 创意」的主题——AIGC 技术在营销视频领域的创新应用,历时两个月的角逐,在精彩纷呈的近千个参赛作品中,78 部作品从内容赛道胜出,获得最佳作品奖、优秀创意奖、技术创新奖。 在技术赛道,有 10 家企业斩获优胜方案奖。 本次大赛获奖作品回顾 从视频制作到技术方案,从这次的参赛作品中,我们看到了 AI 视频生成在商业化场景落地的最积极的尝试,以及更可行的可能性。而对于一直苦于寻找 AI 技术落地场景的创业者来说,这无疑也是发现真实需求、解决真实需求的好时机。 今年的生态创新大赛,伊利将「数字 N+伊」生态创享计划升级为「数智伊利」生态创享计划,面对人工智能...

  15. 极客公园72

    对话 Seede AI:帮人类创作只是第一步,我们想帮人类理解 Agent 产出的内容

    本文首发于 Founder Park 公众号 · 2026 年 3 月 10 日 上线一年后,Seede AI 推出了他们的海外版产品 Veeso AI,主打把原始素材转化成可交付的设计稿。 与 Lovart 这种面向懂设计的人群的产品相比,Seede AI 更容易上手,面对的人群也更大众一些,比如一家书店想做个小活动的海报、一家二线城市的医院想张贴个宣传告示、或者是一家健身房想在公众号里放一张会员招募活动海报等等,他们可以不用去研究配色、搭配,只需要找到一张他们喜欢的模版,放上自己的原素材,2 到 3 次对话,一张可交付的设计稿就出来了。 门槛足够低,但因为使用了各家 SOTA 模型,上限也足够好。 创始人 Longyi 早年在美团负责系统架构的工作,甚至从零手搓了一个美团内部版的「Vercel」。后来加入了创业公司 Dora AI——「面向建站领域的 Figma」,在 GPT-4 出来后意识到,传统的无代码架构, 不彻底转向...

    推荐理由:来自极客公园的《对话 Seede AI:帮人类创作只是第一步,我们想帮人类理解 Agent 产出的内容》。重点看智能体工作流、模型能力与工程、文化创意。摘要提到:本文首发于 Founder Park 公众号 · 2026 年 3 月 10 日 上线一年后,Seede AI 推出了他们的海外版产品 Veeso AI,主打把原始素材转化成可交付的设计稿。 与 Lovart 这种面向懂设计的人群的产品相比,Seede AI 更容易上手,面对的人群也更大众一些,比如一家书店想做个小活动的海报、一家二线城市的医院想张贴个宣传告示、或者是一家健身房想在公众号里放一张会员招募活动海报等等,他们可以不用去研究配色、搭配,只需要找到一张他们喜欢的模版,放上自己的原素材,2 到 3 次对话,一张可交付的设计稿就出来了。 门槛足够低,但因为使用了各家 SOTA 模型,上限也足够好。 创始人 Longyi 早年在美团负责系统架构的工作,甚至从零手搓了一个美团内部版的「Vercel」。后来加入了创业公司 Dora AI——「面向建站领域的 Figma」,在 GPT-4 出来后意识到,传统的无代码架构, 不彻底转向...

  16. 极客公园76

    OpenClaw 背后核心框架 Pi:好的 Coding Agent 应该让用户来决定需要什么

    本文首发于 Founder Park 公众号 · 2026 年 3 月 17 日 OpenClaw,是当下最火的开源个人 AI 助手。很多人不知道的是,OpenClaw 背后,核心是一个极简框架 Pi-coding-agent。 在 OpenClaw 的系统架构中,Pi agent 是 Gateway 控制层的核心子系统,控制了所有 agent 的推理和工具调用。 和 Claude Code、Cursor、Codex 不同的是,Pi 最大的特点是「做减法」:系统提示词和工具定义加起来不到 1000 tokens,核心只有 read、write、edit、bash 四个工具,没有内置 plan mode,没有 to-do 系统,没有 MCP 支持,没有权限弹窗,甚至没有绑定任何特定模型。 但就是这样一个「什么都没有」的框架,在 Terminal Bench 2.0 上与 Codex、Cursor、Windsurf 一同排进了前五。...

    推荐理由:来自极客公园的《OpenClaw 背后核心框架 Pi:好的 Coding Agent 应该让用户来决定需要什么》。重点看智能体工作流、模型能力与工程、开源生态。摘要提到:本文首发于 Founder Park 公众号 · 2026 年 3 月 17 日 OpenClaw,是当下最火的开源个人 AI 助手。很多人不知道的是,OpenClaw 背后,核心是一个极简框架 Pi-coding-agent。 在 OpenClaw 的系统架构中,Pi agent 是 Gateway 控制层的核心子系统,控制了所有 agent 的推理和工具调用。 和 Claude Code、Cursor、Codex 不同的是,Pi 最大的特点是「做减法」:系统提示词和工具定义加起来不到 1000 tokens,核心只有 read、write、edit、bash 四个工具,没有内置 plan mode,没有 to-do 系统,没有 MCP 支持,没有权限弹窗,甚至没有绑定任何特定模型。 但就是这样一个「什么都没有」的框架,在 Terminal Bench 2.0 上与 Codex、Cursor、Windsurf 一同排进了前五。...

  17. 极客公园70

    一款产品,同时为人类和 Agent 设计,LibTV 是怎么做的?

    本文首发于 Founder Park 公众号 · 2026 年 3 月 19 日 试试让你的 Agent 做一支产品宣传片。 给它一段参考视频,加一句话:「能复刻这个视频,给我的产品做一个宣传片吗?」然后你去忙别的了。十几分钟后,Agent 交回一支完整的 TVC——它自己写了剧本,自己拆了分镜,自己选了模型生成每一个镜头,自己剪辑,自己配乐。你没有碰过任何一个按钮。 已经有产品做出来了。 3 月 18 日,LiblibAI 旗下 AI 视频创作平台 LibTV 正式上线。 它可能是目前市面上第一个,从产品设计的第一天起,就同时为人类创作者和 Agent 设计的视频创作工具——一款产品,两扇门。 LibTV: https://www.liblib.tv/ 超 22000 人的「AI 产品市集」社群!不错过每一款有价值的 AI 应用。 邀请从业者、开发人员和创业者,飞书扫码加群: 进群后,你有机会得到: 最新、最值得关注的 AI ...

    推荐理由:来自极客公园的《一款产品,同时为人类和 Agent 设计,LibTV 是怎么做的?》。重点看智能体工作流、模型能力与工程、产品发布。摘要提到:本文首发于 Founder Park 公众号 · 2026 年 3 月 19 日 试试让你的 Agent 做一支产品宣传片。 给它一段参考视频,加一句话:「能复刻这个视频,给我的产品做一个宣传片吗?」然后你去忙别的了。十几分钟后,Agent 交回一支完整的 TVC——它自己写了剧本,自己拆了分镜,自己选了模型生成每一个镜头,自己剪辑,自己配乐。你没有碰过任何一个按钮。 已经有产品做出来了。 3 月 18 日,LiblibAI 旗下 AI 视频创作平台 LibTV 正式上线。 它可能是目前市面上第一个,从产品设计的第一天起,就同时为人类创作者和 Agent 设计的视频创作工具——一款产品,两扇门。 LibTV: https://www.liblib.tv/ 超 22000 人的「AI 产品市集」社群!不错过每一款有价值的 AI 应用。 邀请从业者、开发人员和创业者,飞书扫码加群: 进群后,你有机会得到: 最新、最值得关注的 AI ...

  18. 极客公园76

    Cursor 套壳、Cloudflare 上架、老黄邀请,中国模型杀进了硅谷的 AI 供应链

    本文首发于 Founder Park 公众号 · 2026 年 3 月 23 日 3 月 19 日,Cursor 发布了自研新模型 Composer 2。官方博客称它来自「our first continued pretraining run」,跑分超过了 Claude Opus 4.6。 一天之内,技术社区就发现了问题:Composer 2 的底层,基于 Kimi 的开源模型 Kimi K2.5 微调。但 Cursor 的博客里一个字都没提。 一个估值 500 亿美元的硅谷 AI 编程工具,核心能力跑在一家中国公司的开源模型上,而且一开始还没说,这事儿,怎么看都有点意思。 但 Cursor 只是最新的一个信号。同样是本周: Cloudflare 把 K2.5 上架到全球边缘计算平台 Workers AI,内部实测成本降低 77%; 老黄邀请杨植麟作为唯一的中国独立大模型公司创始人在 GTC 2026 演讲; 马斯克一周内两度公...

    推荐理由:来自极客公园的《Cursor 套壳、Cloudflare 上架、老黄邀请,中国模型杀进了硅谷的 AI 供应链》。重点看模型能力与工程、开源生态、产品发布。摘要提到:本文首发于 Founder Park 公众号 · 2026 年 3 月 23 日 3 月 19 日,Cursor 发布了自研新模型 Composer 2。官方博客称它来自「our first continued pretraining run」,跑分超过了 Claude Opus 4.6。 一天之内,技术社区就发现了问题:Composer 2 的底层,基于 Kimi 的开源模型 Kimi K2.5 微调。但 Cursor 的博客里一个字都没提。 一个估值 500 亿美元的硅谷 AI 编程工具,核心能力跑在一家中国公司的开源模型上,而且一开始还没说,这事儿,怎么看都有点意思。 但 Cursor 只是最新的一个信号。同样是本周: Cloudflare 把 K2.5 上架到全球边缘计算平台 Workers AI,内部实测成本降低 77%; 老黄邀请杨植麟作为唯一的中国独立大模型公司创始人在 GTC 2026 演讲; 马斯克一周内两度公...

  19. 极客公园72

    三大模态模型全部登顶后,昆仑万维正式披露了 2026 年 AGI 战略

    本文首发于 Founder Park 公众号 · 2026 年 3 月 30 日 在中国的 AI 版图里,昆仑万维及其旗下的天工 AI,一直是一家很难被 简单 定义的公司。 它不是 BAT,不是字节跳动,甚至不是科技媒体最热衷追逐的那类动辄发布在 XX 领域「杀疯了」的黑马选手。 但无论是曾经打得满场开花的业务版图,还是在游戏、出海等领域的独特地位,又注定了它的一举一动,会成为横跨科技、财经、互联网多个领域的新闻头条。 于是,我们看到, 在 2026 年,这家公司开始频繁站上世界 AI 舞台的中心。 3 月 18 日,昆仑万维的视频大模型 SkyReels V4 登顶了全球权威评测平台 Artificial Analysis 的「文生视频(含音频)」第一位置,刷新了 Google Veo 3.1 在内一众海内外视频大模型的 SOTA 表现。 几天后的 3 月 27 日,北京中关村创新中心 150 人的会场的 G08 厅,国家级科...

    推荐理由:来自极客公园的《三大模态模型全部登顶后,昆仑万维正式披露了 2026 年 AGI 战略》。重点看模型能力与工程、评测与基准、文化创意。摘要提到:本文首发于 Founder Park 公众号 · 2026 年 3 月 30 日 在中国的 AI 版图里,昆仑万维及其旗下的天工 AI,一直是一家很难被 简单 定义的公司。 它不是 BAT,不是字节跳动,甚至不是科技媒体最热衷追逐的那类动辄发布在 XX 领域「杀疯了」的黑马选手。 但无论是曾经打得满场开花的业务版图,还是在游戏、出海等领域的独特地位,又注定了它的一举一动,会成为横跨科技、财经、互联网多个领域的新闻头条。 于是,我们看到, 在 2026 年,这家公司开始频繁站上世界 AI 舞台的中心。 3 月 18 日,昆仑万维的视频大模型 SkyReels V4 登顶了全球权威评测平台 Artificial Analysis 的「文生视频(含音频)」第一位置,刷新了 Google Veo 3.1 在内一众海内外视频大模型的 SOTA 表现。 几天后的 3 月 27 日,北京中关村创新中心 150 人的会场的 G08 厅,国家级科...

  20. 极客公园70

    给 OpenClaw 做硬件没前途,但给上下文系统做,是值得的

    本文首发于 Founder Park 公众号 · 2026 年 4 月 2 日 一家叫泛灵人工智能的团队,出了一款主打「超级办公助理」的硬件产品。 参数配置很厉害,x86 芯片直接跑本地 Ubuntu,推理芯片可以本地跑 122B 的 MoE 模型 +27B 的稠密模型。支持办公场景的实时会议录音,操作任何设备的录屏,线下开会和外出调研的全记录。 目标是成为「口袋里的全模态超级办公助理」,后 OpenClaw 时代的个人 Agent Native 硬件基座。 初看到这个宣传,会有很多疑问,甚至质疑。 云端模型越来越强大、价格在持续下降的时候,把模型全放在端侧,有价值吗?122B 的模型到底能做啥?又做上下文记录又做任务处理,难道是想做 All in One 吗? 一个小团队,做这么复杂的硬件,今年 9 月份才量产,真的不是噱头吗? 所以今天这篇采访,更多的是好奇和 challenge 的角度,试图去理解他们为什么要用独立的硬件去...

    推荐理由:来自极客公园的《给 OpenClaw 做硬件没前途,但给上下文系统做,是值得的》。重点看智能体工作流、模型能力与工程、产品发布。摘要提到:本文首发于 Founder Park 公众号 · 2026 年 4 月 2 日 一家叫泛灵人工智能的团队,出了一款主打「超级办公助理」的硬件产品。 参数配置很厉害,x86 芯片直接跑本地 Ubuntu,推理芯片可以本地跑 122B 的 MoE 模型 +27B 的稠密模型。支持办公场景的实时会议录音,操作任何设备的录屏,线下开会和外出调研的全记录。 目标是成为「口袋里的全模态超级办公助理」,后 OpenClaw 时代的个人 Agent Native 硬件基座。 初看到这个宣传,会有很多疑问,甚至质疑。 云端模型越来越强大、价格在持续下降的时候,把模型全放在端侧,有价值吗?122B 的模型到底能做啥?又做上下文记录又做任务处理,难道是想做 All in One 吗? 一个小团队,做这么复杂的硬件,今年 9 月份才量产,真的不是噱头吗? 所以今天这篇采访,更多的是好奇和 challenge 的角度,试图去理解他们为什么要用独立的硬件去...

  21. 极客公园74

    把方法论装进 AI:从这场 Skill 黑客松里,我们找到了 6 个值得参考的样本

    本文首发于 Founder Park 公众号 · 2026 年 4 月 7 日 过去一个月,OpenClaw 让大量人第一次跑起了自己的 AI Agent。给它起个名字,配上工具,接好 MCP,一只属于你的电子龙虾就上线了。但养过虾的人很快发现一个问题:龙虾能调用工具,不代表它知道怎么把活干好。你让它帮你清理磁盘,它把客户资料一块删了;你让它帮你比价下单,一转头就刷爆了主人的信用卡。 大模型的通用知识越来越强,但真正拿来干活的时候,「不稳定」才是最让人头疼的事。同一个任务跑两遍,两次输出在结构、细节、质量上都对不上。 光有 Agent 不够,你得教它做事。 以前常见的方法是写 prompt。但这就像是口头交代,说完就忘,下次还得重来。模型微调可以在一定程度上提升输出稳定性,但贵、慢、不灵活。 Skill 提供了第三种路径。本质是一个封装好的执行单元:操作说明、执行脚本、参考资料被组织在一起,把判断标准、执行步骤和质量要求固化下来...

    推荐理由:来自极客公园的《把方法论装进 AI:从这场 Skill 黑客松里,我们找到了 6 个值得参考的样本》。重点看智能体工作流、模型能力与工程、产品发布。摘要提到:本文首发于 Founder Park 公众号 · 2026 年 4 月 7 日 过去一个月,OpenClaw 让大量人第一次跑起了自己的 AI Agent。给它起个名字,配上工具,接好 MCP,一只属于你的电子龙虾就上线了。但养过虾的人很快发现一个问题:龙虾能调用工具,不代表它知道怎么把活干好。你让它帮你清理磁盘,它把客户资料一块删了;你让它帮你比价下单,一转头就刷爆了主人的信用卡。 大模型的通用知识越来越强,但真正拿来干活的时候,「不稳定」才是最让人头疼的事。同一个任务跑两遍,两次输出在结构、细节、质量上都对不上。 光有 Agent 不够,你得教它做事。 以前常见的方法是写 prompt。但这就像是口头交代,说完就忘,下次还得重来。模型微调可以在一定程度上提升输出稳定性,但贵、慢、不灵活。 Skill 提供了第三种路径。本质是一个封装好的执行单元:操作说明、执行脚本、参考资料被组织在一起,把判断标准、执行步骤和质量要求固化下来...

  22. 极客公园76

    感谢 OpenClaw,国产大模型终于知道怎么挣钱了

    本文首发于 Founder Park 公众号 · 2026 年 4 月 8 日 国内模型厂商一开始就走上了跟 OpenAI 不一样的商业化路径。 C 端付费模式基本被「锁死」,大家都想着 B 端卖 API。豆包、Kimi、DeepSeek、MiniMax、智谱都是这样。 早期阶段,Kimi 曾经试探性地推出过会员制,但始终也没能在行业内形成共识。那时候,基模能力本身也撑不住高价值的付费场景,Agent 技术不够成熟,多步复杂任务跑起来可靠性差,连续性也难以保证。 但年初 OpenClaw 的出现,正在改变模型厂商们的变现逻辑。 超 22000 人的「AI 产品市集」社群!不错过每一款有价值的 AI 应用。 邀请从业者、开发人员和创业者,飞书扫码加群: 进群后,你有机会得到: 最新、最值得关注的 AI 新品资讯; 不定期赠送热门新品的邀请码、会员码; 最精准的 AI 产品曝光渠道 01 一个免费的开源项目, 帮模型厂商找到了收费场...

    推荐理由:来自极客公园的《感谢 OpenClaw,国产大模型终于知道怎么挣钱了》。重点看智能体工作流、模型能力与工程、开源生态。摘要提到:本文首发于 Founder Park 公众号 · 2026 年 4 月 8 日 国内模型厂商一开始就走上了跟 OpenAI 不一样的商业化路径。 C 端付费模式基本被「锁死」,大家都想着 B 端卖 API。豆包、Kimi、DeepSeek、MiniMax、智谱都是这样。 早期阶段,Kimi 曾经试探性地推出过会员制,但始终也没能在行业内形成共识。那时候,基模能力本身也撑不住高价值的付费场景,Agent 技术不够成熟,多步复杂任务跑起来可靠性差,连续性也难以保证。 但年初 OpenClaw 的出现,正在改变模型厂商们的变现逻辑。 超 22000 人的「AI 产品市集」社群!不错过每一款有价值的 AI 应用。 邀请从业者、开发人员和创业者,飞书扫码加群: 进群后,你有机会得到: 最新、最值得关注的 AI 新品资讯; 不定期赠送热门新品的邀请码、会员码; 最精准的 AI 产品曝光渠道 01 一个免费的开源项目, 帮模型厂商找到了收费场...

  23. 极客公园72

    一款好的 AI Native 硬件,硬件只是脚手架,真正壁垒一定是 Agent

    本文首发于 Founder Park 公众号 · 2026 年 4 月 13 日 同样是做儿童 AI 硬件,奇朵的切入点有些不一样。 他们不做学习机,不做故事机,也不做陪伴玩具。他们做了一台让孩子拿着走出去、对着真实世界提问的相机。 背后的逻辑来自皮亚杰的建构主义,孩子的认知不是灌进去的,是在与真实世界的互动中自己建构出来的。VLM 模型的成熟,第一次让这件事在技术上变得可行。 内容上,他们选择了国内熟知的《十万个为什么》进行 IP 合作,并在此基础上搭建了一整套可信任的知识底座,解决了家长们对于 AI 回答不准确的担心。 创始人黄勇在儿童硬件行业做了十多年,在他看来,过往做硬件的思路在今天已经做不出 AI 原生的好产品了,于是决定亲自下场,重新定义自己做这个行业的方式。 范式很明确,「 核心是给 Agent 打造硬件产品,先定义好一个场景或内容驱动的 Agent,然后为它做躯体,而不是做了个硬件就往里堆东西。 」 我们和黄勇聊...

    推荐理由:来自极客公园的《一款好的 AI Native 硬件,硬件只是脚手架,真正壁垒一定是 Agent》。重点看智能体工作流、模型能力与工程、产品发布。摘要提到:本文首发于 Founder Park 公众号 · 2026 年 4 月 13 日 同样是做儿童 AI 硬件,奇朵的切入点有些不一样。 他们不做学习机,不做故事机,也不做陪伴玩具。他们做了一台让孩子拿着走出去、对着真实世界提问的相机。 背后的逻辑来自皮亚杰的建构主义,孩子的认知不是灌进去的,是在与真实世界的互动中自己建构出来的。VLM 模型的成熟,第一次让这件事在技术上变得可行。 内容上,他们选择了国内熟知的《十万个为什么》进行 IP 合作,并在此基础上搭建了一整套可信任的知识底座,解决了家长们对于 AI 回答不准确的担心。 创始人黄勇在儿童硬件行业做了十多年,在他看来,过往做硬件的思路在今天已经做不出 AI 原生的好产品了,于是决定亲自下场,重新定义自己做这个行业的方式。 范式很明确,「 核心是给 Agent 打造硬件产品,先定义好一个场景或内容驱动的 Agent,然后为它做躯体,而不是做了个硬件就往里堆东西。 」 我们和黄勇聊...

  24. 极客公园72

    OpenAI,经历了最漫长的一天

    当地时间 9 月 25 日,OpenAI 经历了漫长的一天。 当天, OpenAI 的 AI 智能体擅自访问美国政府网站的事被曝光,涉及教育部、商务部和证券交易委员会 ,OpenAI 确认了其中商务部和 SEC 的情况。 同一天,它承认有 53 张用户上传到 ChatGPT 的图片被智能体发布到了外部图床上。还是这一天,一份事故报告的末尾写着,最强模型的全部训练、评估以及涉及工具调用的推理都已暂停。 这一切听上去,像一部 AI 叛逃的惊悚片。 但翻遍这些事件,没有一个 AI 想干坏事。 害 OpenAI 暂停模型研究的任务,仅仅是让 AI 查出一篇博客的作者的简单任务。 01 简单任务 9 月 20 日,一个正处于强化学习训练中的内部模型,拿到了一组人物履历细节和一篇公开博客里的线索,任务是找到那位博主。 它先用博客里的特征短语去搜,结果返回的是音乐和一些不相干的泛泛建议。模型开始怀疑搜索工具坏了,于是在命令行里用 Python...

    推荐理由:来自极客公园的《OpenAI,经历了最漫长的一天》。重点看智能体工作流、模型能力与工程、教育应用。摘要提到:当地时间 9 月 25 日,OpenAI 经历了漫长的一天。 当天, OpenAI 的 AI 智能体擅自访问美国政府网站的事被曝光,涉及教育部、商务部和证券交易委员会 ,OpenAI 确认了其中商务部和 SEC 的情况。 同一天,它承认有 53 张用户上传到 ChatGPT 的图片被智能体发布到了外部图床上。还是这一天,一份事故报告的末尾写着,最强模型的全部训练、评估以及涉及工具调用的推理都已暂停。 这一切听上去,像一部 AI 叛逃的惊悚片。 但翻遍这些事件,没有一个 AI 想干坏事。 害 OpenAI 暂停模型研究的任务,仅仅是让 AI 查出一篇博客的作者的简单任务。 01 简单任务 9 月 20 日,一个正处于强化学习训练中的内部模型,拿到了一组人物履历细节和一篇公开博客里的线索,任务是找到那位博主。 它先用博客里的特征短语去搜,结果返回的是音乐和一些不相干的泛泛建议。模型开始怀疑搜索工具坏了,于是在命令行里用 Python...