跳到正文
IT之家 AI·· 2 小时前评分72

谷歌 Gemini 4“Argon”模型即将发布,消息称内部测试“Carbon”新版本

摘要

IT之家 10 月 10 日消息,据《商业内幕》报道,谷歌即将向公众正式发布新一代 Gemini 4“Argon”模型。与此同时,其内部员工已在测试性能更强的后续迭代版本,有望进一步缩小与竞品之间的技术差距。 据该媒体获取的内部文档与截图显示,谷歌员工近期一直在测试代号为“Carbon”的全新 Gemini 4 版本。该模型很可能是 Argon 架构下的新检查点(Checkpoint)更新,并已于近日接入谷歌内部代码平台 Jetski。 一名员工透露,Carbon 在代码能力上的表现“堪比 Opus 5.5”—— 后者是 Anthropic 旗下针对复杂代码智能体长期任务打造的最强模型。不过该员工同时表示,这一结论仍有待更深入的评测验证。 综合多名员工反馈及内部沟通记录来看,早期版本的 Argon 在内部测试中普遍收获了良好评价。不过也有员工指出,早期版本在处理部分编程任务时仍显吃力,其水平大体只相当于 Anthropic 早前...

推荐理由

来自IT之家 AI的《谷歌 Gemini 4“Argon”模型即将发布,消息称内部测试“Carbon”新版本》。重点看智能体工作流、模型能力与工程、评测与基准。摘要提到:IT之家 10 月 10 日消息,据《商业内幕》报道,谷歌即将向公众正式发布新一代 Gemini 4“Argon”模型。与此同时,其内部员工已在测试性能更强的后续迭代版本,有望进一步缩小与竞品之间的技术差距。 据该媒体获取的内部文档与截图显示,谷歌员工近期一直在测试代号为“Carbon”的全新 Gemini 4 版本。该模型很可能是 Argon 架构下的新检查点(Checkpoint)更新,并已于近日接入谷歌内部代码平台 Jetski。 一名员工透露,Carbon 在代码能力上的表现“堪比 Opus 5.5”—— 后者是 Anthropic 旗下针对复杂代码智能体长期任务打造的最强模型。不过该员工同时表示,这一结论仍有待更深入的评测验证。 综合多名员工反馈及内部沟通记录来看,早期版本的 Argon 在内部测试中普遍收获了良好评价。不过也有员工指出,早期版本在处理部分编程任务时仍显吃力,其水平大体只相当于 Anthropic 早前...

本站只提供摘要与原文入口。完整内容请阅读原文。

来源:IT之家 AI · ithome.com