首页 > AI教程资讯 > 微软公布多模态模型MM-Navigator，基于GPT-4V研发

微软公布多模态模型MM-Navigator，基于GPT-4V研发

时间：2025-07-25来源：ai02门户网

据 Arxiv 页面显示，微软近日联手加州大学等高校，共同发布一款多模态大模型产品 MM-Navigator。

MM-Navigator基于 GPT-4V打造，可用于零镜头智能手机 GUI 导航任务。通过使用 MM-Navigator，智能手机屏幕可以像人类用户一样进行交互，并确定后续行动以完成给定的指示。

研究发现，多模态大模型在零镜头 GUI 导航方面表现出色，尤其是 GPT-4V，它具有先进的屏幕解释、行动推理和精确行动定位能力。

免责声明：网发此文仅为传递信息，不代表认同其观点或证实其描述。同时文中图片应用自网络，如有侵权请联系删除。

新品推荐更多

最新资讯更多