Skills Plugins MCP Prompt Model 导航 博客 资讯 我的中心

Qwen Intelligence,让个人智能触手可及

“帮我安排周一去上海出差。” 把这句话丢给今天的手机助手,你多半只会得到一个闹钟——它听不懂“周一”指哪天,不会去比价机票和高铁,也记不住你上次出差住的是哪家酒店。 AI手机早已迈过“从 0 到 1”,但仍处于早期阶段,今天,我们发布AI手机全栈解决方案Qwen Intelligence,旨在与手机厂商共创,让手机能够完成各类复杂任务。 Qwen Intelligence官网: https://w

正文


“帮我安排周一去上海出差。”

把这句话丢给今天的手机助手,你多半只会得到一个闹钟——它听不懂“周一”指哪天,不会去比价机票和高铁,也记不住你上次出差住的是哪家酒店。

AI手机早已迈过“从 0 到 1”,但仍处于早期阶段,今天,我们发布AI手机全栈解决方案Qwen Intelligence,旨在与手机厂商共创,让手机能够完成各类复杂任务。


Qwen Intelligence官网:

https://www.qwenintelligence.com/


千问AI平台:

https://www.qianwenai.com/agents/qwenintelligence


Qwen Intelligence不参与硬件生产,而是为手机厂商提供三层核心价值:

  • 先进的模型:

    基于千问大模型,专为手机场景深度优化。相比把通用基础模型直接搬到手机上,它在手机场景的能力更强,性价比也更高。

  •  全栈的平台:

    模块化、可按需组合、可定制。既支持模型独立部署与Harness定制,也提供工具与Skill的统一治理、一站式运维平台和自动化评测。

  •  面向真实场景的解决方案:

    打造精品Agent,解决垂域需求,把能力封装成面向真实场景的高价值解决方案。


针对手机Agent的核心需求,首发的Qwen Intelligence提供了三套解决方案,均达到行业SOTA水平,分别承接规划、操作和创意。



三大Agent,三大解决方案


Mobile Planner Agent


Mobile Planner Agent如同手机的大脑,负责智能规划,拆解任务,编排工具并作出动态调整。


  • 自主决策:先判断,再行动

综合复杂条件,理清每一步的先后,只在需要时,执行下一步。


  • 长程任务交付:稳步推进

规划复杂任务,汇集碎片知识;记住上下文,沉淀每一次协作成果。


Mobile Planner Agent包含两大核心技术:

  • “模型 × Harness协同演进”:模型负责理解、规划与决策,Harness管理状态、记忆与技能,二者在真实环境中执行、反馈、闭环。

  • “双层记忆”:工作记忆随着每次任务不断演化,长期记忆把短期经验沉淀为用户画像和认知,二者不断交互,越用越懂用户。


在真实业务场景任务评测MobilePA-Bench Business、通用手机评测MobilePA-Bench以及记忆能力评测Memory中,Mobile Planner Agent均位列第一;同时在通用Agent Benchmark中也保持第一梯队水平。
此外,Mobile Planner Agent还具备极致的性价比,每千次任务调用成本仅约2.41美元,是头部模型的几分之一。


🔗技术报告详见:

  • https://tongyi-mai.github.io/Qwen-Planner-Agent/Qwen-Planner-Agent-Technical-Report.pdf
  • https://github.com/Tongyi-MAI/Qwen-Planner-Agent


Mobile-Use Agent


Mobile-Use Agent执行手机操作,采用“API优先+GUI兜底”的混合操作模式。


  • 查找信息,进行表单填写

一句话,从找到到填好。理解零碎线索,准确找回对应图片,并在用户授权下,自动拉取所需信息、准确补全表单;提交之前,交由用户确认。


当存在可调用的接口时,通过MCP/API、DeepLink、CLI等方式直接调用,缩短路径、提升效率;没有接口时,则通过视觉理解和GUI操作覆盖长尾场景。
对于安全隐私,则有三层管控:违法或高风险请求直接拒绝;涉及资金、数据删除等关键决策交还用户确认;遵守平台规则,比如发表评论的动作交还用户。


在 MobileWorld(82.1)、MobileWorld-Real(92.2)、AndroidDaily(97.2)等六项主流评测中得分均位居前列;端到端实测任务成功率达90%(高于头部方案3个百分点),单步时延下降16%,一次任务完成时间从83.6秒压缩到59.5秒(下降 28.8%),任务完成费用降低20%,安全评分高出头部方案23个百分点。这套能力还能延伸到浏览器与跨设备场景。


🔗技术报告详见:

  • https://tongyi-mai.github.io/Qwen-UI-Agent/
  • https://tongyi-mai.github.io/Qwen-UI-Agent/Qwen-UI-Agent-Technical-Report.pdf
  • https://github.com/Tongyi-MAI/MAI-UI


Mobile Creative Agent


面向影像创作,在轻量模型基础上基于手机场景优化。


  • 轻松创作:一句话直出可用图片

理解多步意图自然语言,将创作目标拆解成完整工作流,并自动串联所需能力直出成品。


在Agent侧,规划模型负责理解需求和编排任务,将口语表达转为清晰指令,用户不需要掌握专业提示词,一句话即可生成排版清晰的复古日记。在模型侧,基于轻量模型的蒸馏和强化学习,生成过程从100步压缩到8步。首图生成只需3秒,相对头部竞品平均提速2倍,在通用场景对战评测中,达到行业第一梯队。


🔗技术报告详见:

  • https://arxiv.org/abs/2608.16887

  • https://arxiv.org/abs/2606.09076

  • https://arxiv.org/abs/2605.05204



四套评测集开放

业内尚缺乏针对手机真实场景的系统化评测体系。为此,从规划到执行,从云端到真机,从能力到安全,Qwen Intelligence的研发团队开放了四套评测集。


  • MobilePA-Bench:

    评估复杂任务的规划与端到端完成能力——“会不会规划”。

  • MobileWorld:

    评估云手机中的跨应用任务执行——“能不能把事做成”。

  • MobileWorld-Real:

    把评测带到真实手机,覆盖104个App——“真机上到底行不行”。

  • MobileWorld-Safety:

    评估风险场景下的安全行动——“不仅会做事,更要安全地做好”。

    MobileWorld-Safety安全能力体系由Qwen Intelligence团队与复旦大学白泽安全团队联合共建。该团队由复旦大学计算机科学技术学院院长、长江学者杨珉教授领衔,长期深耕移动操作系统安全领域,曾多次获得国家级奖项。


🔗更多介绍详见:

  • https://tongyi-mai.github.io/MobilePA-Bench/
  • https://github.com/Tongyi-MAI/MobileWorld
  • https://tongyi-mai.github.io/MobileWorld/#leaderboard



落地案例

目前,Qwen Intelligence已在真实场景落地。阿里巴巴携手荣耀,以Qwen Intelligence和荣耀Magic OS为基础,共同打造了面向下一代AI手机的垂域模型和解决方案,铸就行业领先的手机Agent能力,让手机从被动响应走向主动服务。基于这套解决方案,综合任务准确率达到91.8%,GUI操作速度仅有3.6s,对于复杂长程任务可实现100+操作步数,端到端的服务闭环率达90%。



Qwen Intelligence期待和终端厂商、生态合作伙伴一起,共创用户价值。


关注我,掌握千问大模型最新动态


数据来源:公开 AI 资讯聚合目录,版权归原文作者及媒体所有;本站仅作索引与摘要展示,如有异议可联系我们删除。

每日精选 Skill 推荐,免费送到你邮箱

输入邮箱,每天接收一个精选 AI Agent 技能推荐。完全免费,持续更新。

提交后我们会发送一封确认邮件,点击邮件里的链接才会开始收信。

完全免费,取消任意时间。我们不会发送垃圾邮件。