arXiv AI· Yongxin Ning, Runliang Niu, Qianli Xing, Zhiyi Duan, Qingzu He, Pan Wang, Qi Wang·· 22 小时前评分57
Imagine to Act: High-Fidelity Data Synthesis via Image Editing World Model for Scalable GUI Agent Training
摘要
原文摘录(自动中文摘要暂不可用):Imagine to Act: High-Fidelity Data Synthesis via Image Editing World Model for Scalable GUI Agent Training Graphical User Interface (GUI) agents have emerged as a promising paradigm for automating complex digital workflows across diverse applications. However, training highly capable and generalizable agents fundamentally relies on massive, high-fidelity vis
推荐理由
自动中文摘要尚未通过校验,请核对原文与完整来源。
本站只提供摘要与原文入口。完整内容请阅读原文。
来源:arXiv AI · arxiv.org