logo

深度横评|一口气测完4款国产通用智能体,到底谁最能打?

作者:模型探索者2026.07.13 15:38浏览量:26

简介:今天我们就来做一场国产通用智能体大横评,看看究竟谁能真正解决具体问题、替用户完成完整工作

说白了,如果一款 AI 工具不能真正帮我干活,那么它的参数再强、模型再先进,对我来说也没有太大意义。

比如,当我想让 AI 帮我把一组数据填入表格时,普通 AI 往往是这样处理的:

它只是把数据整理成了一张表,最终仍然需要我手动复制,再粘贴到真正的表格文件中。

而通用智能体的处理方式完全不同:

它会主动联网学习创建表格所需的技能,再调用该技能,直接在我的电脑桌面生成一份已经填写好数据的表格文件。

如果说普通 AI 只是拥有了“大脑”,能够帮助我们思考,那么通用智能体就相当于为 AI 装上了“手脚”。它不仅能分析问题,还能操作鼠标、键盘和本地软件,真正替我们完成工作。

不过说实话,目前国产通用智能体产品已经非常多,至于其中有多少真正好用,仍然要打一个问号。

所以,今天我们就来做一场国产通用智能体大横评,看看究竟谁能真正解决具体问题、替用户完成完整工作。


一、参赛选手

本次横评,我挑选了四款具有代表性的国产通用智能体产品:

  • 百度搭子 DuMate
  • QClaw
  • QoderWork
  • WorkBuddy

这四款产品均来自深耕互联网多年的大厂或成熟团队。接下来,我们就通过真实任务,看看它们的实际表现究竟如何。


二、测试规则与评价维度

本次测试将从六个维度展开:

  1. 上手门槛
  2. 交付质量
  3. 稳定性
  4. 任务完成率
  5. 接管可控性
  6. 使用成本

1. 上手门槛

重点考察产品的操作体验,包括:

  • 新手能否直接开箱即用;
  • 是否需要配置复杂的环境变量;
  • 是否需要用户自行接入大模型
  • Skill、MCP 和定时任务等扩展能力是否容易使用。

2. 交付质量

重点考察产品能否生成真实、可用的 Office 原生文件,而不是只输出一段文本。

最终交付物必须是可以直接编辑、打印或继续使用的成品。

3. 稳定性

通过处理 100 个以上文件的批量任务,观察产品是否会出现:

  • 任务中断;
  • 执行报错;
  • 文件遗漏;
  • 重命名混乱;
  • 分类逻辑异常。

4. 任务完成率

重点考察产品能否完成完整任务闭环。

例如,从跨平台抓取数据,到整理信息,再到自动填表和生成文件,而不是只提供一段建议、几个链接或半成品。

5. 接管可控性

重点考察智能体在执行过程中被人为打断或遭遇异常后,能否识别当前状态,自主恢复并继续完成任务。

6. 使用成本

对比各款产品的套餐价格、免费额度和积分消耗,评估它们的实际性价比。

本次测试中,每个任务仅提供一次执行机会,单项评分为 0~5 星


第一项:上手门槛

实际上,在上手体验方面,这几款国产工具的整体差距并不大。

它们都不需要配置复杂的环境变量,也不需要用户自行接入大模型,基本都能够做到开箱即用。因此,这部分不再逐个重复介绍,只重点聊一聊各自存在的问题。

1. WorkBuddy

WorkBuddy 与 CodeBuddy 共用一个官方网站。准确来说,WorkBuddy 更像是官网导航栏中的一个产品分支。

不过这并不影响正常下载安装,只是对于第一次接触产品的用户来说,入口不够独立,可能需要稍微找一下。

2. QoderWork

QoderWork 也存在类似的问题。

它与 Qoder 共用一个官网,独立入口和产品展示相对较弱,容易让用户感觉它在整个产品体系中的受重视程度稍低。

不过,这些都不属于真正的使用门槛,正常下载安装并没有太大难度。之所以提出来,主要是担心第一次使用的小白用户走弯路。

QoderWork 背靠阿里生态,但工具中却很少内置阿里系的相关能力。

例如,淘宝此前已经发布过官方 Skill,但在 QoderWork 的技能列表中并未看到相应能力,内置的仍然以通用 Skill 为主。

QoderWork 支持在“旗舰模式”和“标准模式”之间切换,相当于为用户提供了一个节省积分的选项。

3. 百度搭子 DuMate

百度搭子 DuMate 不支持用户手动切换模型。

从自由度来看,这确实少了一项选择;但从使用体验来看,也降低了用户的决策成本,对选择困难的用户比较友好。

4. 综合表现

除上述差异外,Skill 安装、MCP 服务配置、定时任务等扩展功能,各家做得都比较接近,并且均提供了一定的免费使用额度。

因此,在上手门槛方面,四款产品之间并没有拉开明显差距。

上手门槛评分

产品 评分
百度搭子 DuMate 5⭐
QClaw 5⭐
WorkBuddy 4.5⭐
QoderWork 4.5⭐

第二项:交付质量

测试任务

要求四款产品起草一份具备基本法律逻辑的《手持风扇采购返佣合同》。

交付要求

这项任务主要考察智能体对 Office 软件的原生控制能力。

普通 AI 通常只能生成合同文本,而本次测试要求它们直接交付一份规范、可编辑、可打印的 Word 文件,包括:

  • 标题加粗并居中;
  • 条款序号对齐;
  • 文档层级清晰;
  • 包含页码;
  • 具备专业合同排版;
  • 可以直接作为办公文件继续修改和使用。

测试提示词

帮我起草一份符合法律逻辑的《手持风扇采购返佣合同》。


1. 百度搭子 DuMate

让我比较惊喜的是,百度搭子 DuMate 并没有直接根据自己的理解随意生成合同,而是主动询问具体需求。

它弹出了一个定制表单,让我选择返佣模式等关键信息。

完成选择后,它直接调用 Word 创建文件,并将文件保存到默认工作空间中。

在客户端界面中点击文件,还可以直接在右侧快速预览。

合同整体格式非常规范:

  • 标题层级清晰;
  • 需要加粗的内容均已加粗;
  • 包含合同明细表格;
  • 具备页码和功能性页眉;
  • 内容与排版都更接近正式办公交付物。


2. WorkBuddy

WorkBuddy 的交付结果就有些微妙了。

它并没有生成 Word 文件,而是交付了一份 .md 格式的 Markdown 文档。

Markdown 更适合内容编辑、技术文档和 AI 阅读,但在正式办公、合同签署或打印场景中,通常不会直接使用这种格式。

也就是说,它没有主动调用 Office 能力,而是直接通过 AI 输出了文档内容,多少有些“偷懒”。


3. QClaw

如果说 WorkBuddy 交付的 Markdown 文件还算勉强可用,那么 QClaw 的表现就与传统对话式 AI 没有拉开太大差距。

它没有调用办公插件创建 Word 文档,而是直接在聊天界面中输出了合同文本。

不过,在任务结束时,它主动询问我是否需要导出为 Word 文档。

这说明 QClaw 实际具备生成 Word 文件的能力,只是由于提示词中没有明确要求“导出为 Word”,它没有主动执行这一步。

由此来看,QClaw 的产品逻辑与另外几款略有不同。它更偏被动,需要用户给出更加明确、细致的操作指令。


4. QoderWork

QoderWork 的处理流程与百度搭子 DuMate 比较接近。

收到任务后,它会先分析需求,并向用户提供若干选项,等待关键细节确认后再执行下一步。

稍作等待后,它顺利完成了任务,并将 Word 文件保存到默认工作目录中。

从最终结果来看,合同整体完成度很高,基本可以直接投入使用。


5. 本轮小结

百度搭子 DuMate 在办公软件控制和原生文件交付方面表现得非常成熟,整个执行过程和最终文档都接近满分。

QoderWork 同样完成度很高。

WorkBuddy 和 QClaw 虽然也生成了合同内容,但没有主动交付符合要求的 Word 成品,因此在交付完整性上存在一定不足。

交付质量评分

产品 评分
百度搭子 DuMate 5⭐
QoderWork 5⭐
QClaw 3.5⭐
WorkBuddy 3.5⭐

第三项:稳定性

测试任务

我准备了一个包含 120 个文件的文件夹,其中包括:

  • 不同日期的视频
  • 图片;
  • GIF 动图;
  • 文本文档;
  • 软件及游戏安装包;
  • 其他不同格式的文件。

要求四款产品识别每个文件的类型和日期,创建对应的分类文件夹,并将文件移动到相应目录中。

该任务涉及大量本地文件系统的读取、创建和移动操作。如果产品稳定性不足,很容易出现任务中断、文件遗漏、报错或分类逻辑混乱。

测试提示词

在“文档/未分类”文件夹中,有许多没有分类的文件。请根据文件类型和日期创建分类文件夹,并将这些文件分类后移动到相应的文件夹中。


1. QoderWork

QoderWork 依然先进行了一轮询问。

在我根据提示完成选项确认后,它才开始执行下一步。

整体感受是它非常谨慎,宁愿多询问几句,也不愿意直接执行并承担误操作风险。

最终,它顺利完成了任务,基本满足了我提出的全部要求。

每种文件类型下,又按照时间进行了进一步划分,分类层级清晰。


2. WorkBuddy

WorkBuddy 同样顺利完成了任务,全程没有出现中断或报错,甚至部分表现超出了我的预期。

首先,它主动创建了一份统计图表,更直观地展示了 100 多个文件的类型分布。

其次,它直接在“未分类”文件夹内部创建了各类子文件夹,而不是在“未分类”文件夹的同级目录中创建新目录。

这种处理方式能够减少大目录中的文件夹数量,整体看起来更加整洁,也更符合我的使用习惯。

更让我惊喜的是,它对“按时间分类”这一要求执行得非常彻底。

每一个文件类型目录下的文件,都继续按照时间进行了分类。即使某个时间段内只有一个文件,它也会单独创建对应文件夹进行存放。


3. 百度搭子 DuMate

百度搭子 DuMate 同样顺利完成了任务。

它采用的分类逻辑是:

  1. 先按照文件类型创建一级分类文件夹;
  2. 再在每个类型目录中创建时间文件夹;
  3. 最后将文件移动到相应位置。

任务结束后,它还在客户端中生成了一份简单的执行汇报。

与 WorkBuddy 不同的是,DuMate 将新分类文件夹创建在原文件夹的同级目录中。

文件分类和时间排序都没有出现问题,整体表现稳定,基本挑不出明显毛病。


4. QClaw

QClaw 顺利完成了任务的一半。

它完成了文件类型分类,但没有继续执行时间分类。

不知道是出于什么顾虑,它在完成类型分类后,又询问我是否需要继续按照时间进行整理。

从文件目录来看,它的执行逻辑与 WorkBuddy 接近,也是在“未分类”目录内部创建分类文件夹。

但由于它在中间增加了一次确认,没有一次性完成全部要求,对我这种急性子用户来说,体验稍显拖沓。


5. 本轮小结

总体来看,四款产品在稳定性方面都达到了较高水平,没有出现大规模报错、文件丢失或执行中断。

它们之间的主要差异并不在于稳定性,而在于:

  • 文件夹创建位置不同;
  • 是否主动生成统计报告;
  • 是否严格执行时间分类;
  • 是否需要用户二次确认。

这些差异更多属于执行逻辑和产品策略,很难简单判断谁绝对更好。

稳定性评分

产品 评分
WorkBuddy 5⭐
百度搭子 DuMate 4.5⭐
QoderWork 4.5⭐
QClaw 3.5⭐

第四项:任务完成率

测试任务

要求四款产品分别搜索北京、上海和深圳面向人工智能行业从业者的最新落户政策与购房补贴政策。

这是一项典型的长程任务。

许多通用智能体在执行类似任务时,可能搜索完第一个平台就停止,或者只提供几个网页链接,而无法继续完成信息整理和文件交付。

交付要求

产品必须完成以下完整链路:

  1. 访问并切换多个政府网站;
  2. 搜索三座城市的相关政策;
  3. 整理和对比政策信息;
  4. 形成总结与分析报告;
  5. 生成 Word 文档并交付。

由于任务需要频繁访问网页,同时操作本地文件,因此存在较高的中断风险。

测试提示词

分别搜索北京、上海、深圳针对人工智能行业的最新落户及购房补贴政策,整理成一份总结和对比报告,并制作成 Word 文档给我。


1. 百度搭子 DuMate

百度搭子 DuMate 成功完成了任务,整个过程中没有出现中断或报错。

任务结束后,它还提供了快速查看文档的入口。

不得不说,DuMate 制作的文档在美观度方面确实处于第一梯队。

文档中的大标题、小标题、项目列表和段落层级错落有致,阅读体验非常舒适。

报告结尾还列出了信息来源,提高了内容的可核验性。

从跨平台信息查询,到内容整理,再到最终交付物生成,DuMate 完成了一条完整的任务链路。


2. WorkBuddy

WorkBuddy 同样成功完成了任务,全程没有中断或报错,并顺利交付了 Word 报告。

值得一提的是,它最初生成的文档出现了字符串冲突和乱码问题。

在发现异常后,它主动重新创建了一份文档,体现出一定的自我检查和修复能力。

最终文档的内容比较完整,但排版略显紧凑,更接近正式的政府报告或专业材料,简洁性和视觉美观度稍弱,阅读起来有一定压力。


3. QoderWork

按照一贯的执行逻辑,QoderWork 仍然先询问了具体需求,在确认细节后才开始下一步。

经过较长时间的分析和执行,它最终顺利完成了任务。

最终交付的文档排版较为美观,任务完成度也很高。

唯一比较明显的问题是执行时间较长,等待过程稍显漫长。


4. QClaw

QClaw 在这次任务中出现了比较明显的问题。

从客户端界面来看,它显示任务已经成功完成,并提示 Word 文档已生成。

但当我实际进入对应目录时,并没有找到这份文件。

任务结束时,它还提供了一个快速访问按钮,并告诉我这是本次整理完成的文件。

但实际打开后发现,这只是一份记录运行日志的 TXT 文件,其中并没有我们需要的政策内容。

这次确实不能算冤枉它。

虽然再次执行可能会成功,但本轮测试规定每款产品只有一次机会,因此这项任务只能判定为失败。


5. 本轮小结

在本轮长程任务中,百度搭子 DuMate、QoderWork 和 WorkBuddy 均成功完成了从资料检索、信息整理到 Word 文件交付的完整流程。

三款产品的主要差异集中在文档美观度、排版风格和执行速度上。

QClaw 是本轮测试中唯一出现明显失败的产品。它虽然显示任务完成,但并未真正生成用户所需的交付文件。

任务完成率评分

产品 评分
百度搭子 DuMate 5⭐
QoderWork 5⭐
WorkBuddy 4.5⭐
QClaw 0⭐

第五项:接管可控性

测试任务

要求四款产品登录网页版邮箱,分别向三个不同联系人发送带附件的邮件。

在智能体已经填写好邮箱信息、但尚未完成发送时,我会手动关闭浏览器,观察它们接下来会如何处理:

  • 是否会持续循环报错;
  • 是否会直接放弃任务;
  • 能否重新打开浏览器;
  • 能否识别当前登录状态;
  • 能否恢复此前的任务进度;
  • 最终能否继续完成邮件发送。

测试提示词

使用 Chrome 浏览器打开 QQ 邮箱,用我的邮箱分别向 XXX@qq.comXXX@gmail.comXXX@qq.com 发送邮件。附件为“下载”文件夹中的 325.gif,不需要填写正文内容。QQ 邮箱已经处于登录状态,请开始操作。


1. QoderWork

尽管我已经打开浏览器并登录 QQ 邮箱,但 QoderWork 在收到任务后,仍然要求我提供邮箱账号和密码。

显然,我并不放心直接将账号密码交给它。

在我选择不提供密码后,它又给出了第二组选项。

这次我选择了“浏览器已保存密码”,因为邮箱本身已经登录,它理论上只需要打开网页并执行发送操作。

遗憾的是,它虽然成功打开浏览器并进入 QQ 邮箱页面,但随后突然提示无法继续操作,任务就此中止。

目前无法确定是我的操作方式与它的执行逻辑不兼容,还是产品自身存在限制。

但从最终结果来看,本次任务没有完成。


2. 百度搭子 DuMate

百度搭子 DuMate 通过在 Chrome 浏览器中安装插件的方式,获得对浏览器的直接操作能力,并成功开始执行邮件发送任务。

在它操作过程中,我手动关闭了浏览器。

它首先识别到浏览器已经关闭,随后立即尝试重新打开浏览器。

重新打开浏览器后,由于登录状态已经丢失,它提示我重新扫码登录邮箱。

完成登录后,它能够继续衔接此前被打断的任务,重新进入写信页面,填写收件人、上传附件,并最终成功发送邮件。

这说明,当 DuMate 接管电脑执行任务时,即使用户中途介入或误操作,它也能尽量将任务重新拉回正常轨道,并持续朝最终目标推进。

即使中途丢失了登录状态,它仍然能够在用户完成必要操作后恢复任务。

整个过程中,它没有持续报错,也没有直接放弃,而是默默完成了剩余工作,较好地体现了真正 Agent 应有的任务恢复能力。


3. WorkBuddy

当时,我已经在前台打开并登录了 QQ 邮箱页面,但 WorkBuddy 并没有使用这个现成页面,而是在后台重新打开了一个新的浏览器窗口。

由于它打开的是临时页面,因此没有保存 QQ 邮箱的登录 Cookie。

随后,它尝试从常规浏览器窗口中导出 Cookie,并进行密码解密。

结果不出意外,这一步失败了。

之后,它提供了三种解决方案,让我选择如何继续。我选择了手动登录。

随后,WorkBuddy 关闭了我原本已经登录的 QQ 邮箱页面,重新打开浏览器,并进入一个未登录的 QQ 邮箱页面。

我完成扫码登录后,原以为任务可以继续执行,但它仍然判断页面处于未登录状态。

虽然我已经在它主动打开的页面中完成登录,但它似乎仍在通过其他不可见或独立的方式操作浏览器。

随后,它再次提出解决方案,询问我是否愿意直接提供账号和密码。

这种方式实际上也很难成功,因为 QQ 登录通常还涉及复杂的人机验证,智能体很难完全自动通过。

最终,任务只能以失败告终。

不过,这项测试也不能将 WorkBuddy 判定为完全不合格。

虽然它没有成功完成发送,但整个过程中一直在主动寻找替代方案,没有直接中断或放弃任务。

真正的问题在于,它的浏览器操作逻辑与用户前台操作之间存在隔离,导致用户难以顺畅介入。


4. QClaw

QClaw 支持直接使用邮箱账号登录并执行邮件发送任务,这种方式本身比较方便。

但为了测试浏览器被打断后的任务接管能力,本轮仍然选择通过浏览器完成操作。

QClaw 与 WorkBuddy 的操作逻辑相似。

它没有使用我已经登录的邮箱页面,而是重新打开了一个临时浏览器页面,因此同样没有保留登录状态,需要我重新扫码登录。

好在这次浏览器窗口显示在前台,我可以直接介入并完成登录。

登录完成后,QClaw 通过视觉识别判断页面已经处于登录状态,并成功找到“写信”入口,开始模拟点击和填写邮件。

此时,我手动关闭了浏览器。

随后,QClaw 很快重新打开了邮箱页面,并继续执行邮件发送任务。

从任务恢复能力来看,它的表现几乎称得上完美。即使我主动介入并打断操作,它仍然成功将任务拉回了正常流程。

不过,就在任务即将完成时,因为调用工具较多、执行链路较长,任务被系统自动中断。

它已经通过了本轮最重要的“被打断后能否恢复任务”考核,却因为自身任务长度限制,没能完成最终发送。

这可能是因为 QClaw 对单次任务的步骤数或 Token 消耗设置了上限,以避免任务无限运行。

考虑到 QClaw 是一款完全免费的软件,适当限制单次任务的 Token 或执行长度,也可以理解。

虽然最终没有成功发送邮件,但从接管可控性的角度看,它已经证明自己能够在用户介入后重新回到任务正轨。

如果没有中途人为打断,它大概率能够顺利完成任务。


5. 本轮小结

从最终执行结果来看,只有百度搭子 DuMate 完整完成了邮件发送任务,其余三款产品均因不同原因未能走完全部流程。

但本轮重点考察的并不是单纯的任务完成率,而是智能体在任务被打断后,能否识别异常、寻找解决方案并恢复执行。

从这一角度来看,四款产品都展现出了一定的任务接管能力,只是受浏览器操作逻辑、登录状态隔离和任务长度限制的影响,最终结果存在明显差异。

接管可控性评分

产品 评分
百度搭子 DuMate 5⭐
QClaw 4⭐
WorkBuddy 3.5⭐
QoderWork 2⭐

第六项:使用成本

价格同样是选择工具时必须考虑的重要因素,毕竟谁的钱都不是大风刮来的。

需要注意的是,不同国产通用智能体的积分体系并不相同。

由于各款产品使用的模型、工具链和积分计算方式不同,同样一点积分,在产品 A 中可能只能执行一次任务,在产品 B 中却可能执行两次。

与此同时,执行效果也可能不同。

产品 A 虽然积分消耗更高,但任务完成质量可能更好;产品 B 的消耗虽然更低,最终效果却可能稍差。

因此,积分数量只能作为参考,必须结合实际任务效果综合判断。


1. QClaw:完全免费

首先是目前唯一一款完全免费的工具。

QClaw 暂时没有付费入口,下载后即可直接使用。

不过,从前面的测试结果来看,它也是唯一一款对单次任务执行步骤存在明显限制的产品。

任务步骤越多,Token 消耗越大。对于一款免费产品来说,过于复杂的长程任务确实可能造成较大资源压力。

因此,QClaw 更适合轻量任务或执行链路相对较短的任务,在复杂长任务中存在一定限制。


2. WorkBuddy:58 元/月

WorkBuddy 新账号会一次性赠送 2000 点专业版积分,基本相当于赠送一个月会员。

此外,每个月还会额外赠送 500 点体验版积分。

500 点积分基本只能满足部分轻量任务,不足以支撑一个月的高频使用。

其付费方案包括 58 元/月的个人专业版,以及企业版套餐。

从目前来看,这个定价相对合理。

不过,根据腾讯云官方公告,5 月 15 日起企业版价格将出现较大幅度调整,届时性价比可能会有所下降。


3. 百度搭子 DuMate:59 元/月

百度搭子 DuMate 每天赠送 1000 积分,大约可以支持 8~10 个长任务。

对于轻度用户来说,每日免费积分基本能够覆盖日常使用。

虽然它的月度会员价格比 WorkBuddy 贵 1 元,但赠送积分相对更加充足:

  • Pro 版每月提供 25,000 积分;
  • Max 版每月提供 100,000 积分。

此外,在 5 月 13日至14日的 Create 大会活动期间,平台还提供了无门槛领取 10,000 积分的福利,老用户同样可以参与。


4. QoderWork:约 140 元/月

QoderWork 新用户会一次性赠送 300 积分。

它的单次任务积分消耗不算特别高,但免费积分使用完毕后,不会持续赠送,并且暂时不支持单独购买积分,只能通过订阅会员继续使用。

在四款产品中,QoderWork 的价格最高。

最低档 Pro 版月度会员约为 140 元,实际价格会受到汇率波动影响。

相比另外几款产品,它的免费额度和会员价格都显得不够慷慨。

不过,从前面的测试来看,它在本地文件操作和办公文档交付方面的表现确实比较优秀。


5. 本轮小结

四款产品中:

  • QoderWork 价格最高;
  • QClaw 完全免费;
  • WorkBuddy 与百度搭子 DuMate 的价格相近;
  • 百度搭子 DuMate 提供的免费积分和会员积分更加充足。

如果不考虑任务效果,只追求最低成本,那么 QClaw 的优势最明显。

如果综合考虑交付能力、免费额度和日常使用成本,百度搭子 DuMate 的性价比相对更高。

使用成本评分

产品 评分
QClaw 5⭐
百度搭子 DuMate 4.5⭐
WorkBuddy 4⭐
QoderWork 3⭐

最终总分

经过六个维度的实测,四款国产通用智能体的最终得分如下:

排名 产品 总分
1 百度搭子 DuMate 29⭐
2 WorkBuddy 25⭐
3 QoderWork 24⭐
4 QClaw 21⭐

虽然进行了评分,但我并不认为分数高低就是评价通用智能体的唯一标准。

判断一款通用智能体是否真正好用,核心仍然在于:它能否替用户走完一条完整的工作流。

真正好用的工具,应该覆盖从指令下达、数据抓取、批量处理,到原生文件交付、异常识别和断点续跑的完整闭环,而不是只完成一半流程,最后仍然把文本或链接丢给用户自行处理。

综合本次测试来看:

  • 百度搭子 DuMate 的优势在于全链路工作流完整,整体没有明显短板,尤其是在 Office 文件交付和任务中断恢复方面表现突出。
  • WorkBuddy 在本地文件批量处理方面最为稳定,并且具备较强的自我检查和问题补救能力。
  • QoderWork 的交付质量较高,执行过程也更加谨慎,但在浏览器接管和用户介入方面稍显薄弱。
  • QClaw 的最大优势是完全免费,并且具备不错的任务恢复能力,但在复杂长任务中容易受到执行步骤和资源限制。

分数只是表象。

能完成闭环、真正替用户干活,才是国产通用智能体最核心的价值。

本次测评到这里就结束了。至于最终选择哪一款,相信大家心中已经有了自己的答案。

润色时主要修正了“六个维度”与后文表述不一致、章节序号重复、接管测试总结与实际结果矛盾等问题,同时保留了原有评分、测试过程和整体观点。

发表评论

活动