省流:我们基于 AutoGLM 和 GELab-Zero 这类 开源 GUI model ,构建了一个 GUI Agent --- OMG-Agent!已开源先是豆包手机证明 AI ...
在更接近真实场景的MobileWorld测试集上,MAI-UI-235B-A22B整体成功率41.7%,比其他端到端模型高出20.8个百分点。在需要主动询问用户的任务上成功率37.5%,在需要调用MCP工具的任务上成功率51.1%,分别比之前最好的成绩高出32.1和18.7个百分点。
以苹果Apple Intelligence为代表的API范式,不是通过模拟,而是构建底层框架与标准化接口,让AI通过规范“调用能力”完成任务。这种模式的优点是稳定、保障隐私且效率高, 缺点则是需要App开发者主动配合,生态构建周期更长。