智能工具库

阿里Qwen Intelligence:Agent规划成功率达90%

阿里Qwen Intelligence:Agent规划成功率达90%

阿里发布Qwen Intelligence,通过「模型×Harness」架构将Agent规划成功率提升至90%,为AI智能体落地提供新范式。

2026-09-23 0来源:开源中国

阿里发布Qwen Intelligence,Agent规划成功率突破90%

2026年9月24日,阿里巴巴正式发布了 Qwen Intelligence,聚焦于AI Agent(智能体)的规划能力。据官方数据,该系统在Agent任务规划场景下,成功率达到了 90%,这一数字在当前行业水平中表现亮眼。

核心架构:「模型 × Harness」

Qwen Intelligence 的核心思路被概括为 「模型 × Harness」,即通过大模型与一套工程化框架(Harness)的协同配合来驱动Agent的规划与执行。

这一架构设计的意义在于:

  • 模型负责推理与决策:大模型承担理解任务、拆解步骤、生成规划的核心认知工作
  • Harness负责工程化约束:通过框架层面的工具调用、状态管理、错误恢复等机制,将模型的输出转化为可执行、可追踪的行动

这种分离设计解决了当前Agent落地的一个关键痛点——模型能力强但工程化不足。单纯依赖大模型直接执行复杂任务,往往面临幻觉、步骤遗漏、状态丢失等问题,而Harness层通过结构化的流程控制,显著提升了任务的完成可靠性。

为什么「90%成功率」值得关注?

在当前AI Agent领域,多步骤任务的端到端成功率一直是行业难题。许多Agent系统在面对需要多轮推理、工具调用和环境交互的复杂任务时,成功率往往远低于预期。

Qwen Intelligence 将成功率推至 90%,意味着其在以下方面取得了突破:

  • 任务拆解的准确性:能够将复杂目标分解为合理的子步骤
  • 执行过程的鲁棒性:在遇到异常或偏差时具备纠错能力
  • 工具与环境的适配:能够有效地调用外部工具和API完成实际任务

对开发者的实际价值

对于正在探索Agent落地的开发者而言,Qwen Intelligence 的发布提供了几个重要参考:

  1. 架构思路可借鉴:「模型×Harness」的分离式设计,为Agent系统开发提供了清晰的工程范式
  2. 成功率基准可对标:90%的成功率可作为Agent系统性能评估的参考标准
  3. 降低了Agent开发门槛:框架化的Harness设计减少了开发者需要自行处理的工程复杂度

行业影响

随着大模型能力持续增强,Agent正从「能对话」向「能干活」演进。Qwen Intelligence 的发布表明,Agent的规划能力正在成为大模型竞争的新焦点。未来,模型能力与工程框架的深度融合,或将决定AI Agent能否真正进入生产环境。

对于企业而言,高成功率的Agent意味着更低的试错成本和更高的自动化效率,这将加速AI在办公、客服、数据分析等场景的实际部署。

ai辅阅

本文基于 开源中国 的公开内容,由 AI 辅助整理改写后发布。

原标题:阿里发布 Qwen Intelligence,规划 Agent 靠「模型 ×Harness」,成功率达 90%

阅读原文