Qwen Code实测:同一套Skill能否跨Agent运行

📅 2026/7/27 19:25:23
Qwen Code实测:同一套Skill能否跨Agent运行
一、明确问题能复制目录不等于已经跨 Agent 跑通“跨 Agent”至少包含三层Skill 能否安装、运行时能否发现、Agent 能否正确执行并解释结果。只复制目录就宣布兼容证据并不完整。证据分三层。已实际运行验证Node.js CLI、fixture、Schema 和四类环境变量检测分支。来自项目文档可尝试安装到~/.qwen/skills实际目录以 Qwen Code 当前官方文档为准。尚未验证Qwen Code 实机发现与端到端调用运行记录仍标为“待实机验证”不能写成“Qwen 已跑通”。二、实测过程验证可迁移部分先验证同一份程序不依赖某个模型 APImake-Cproducts/agent-capability-benchmark verifymake-Cproducts/agent-capability-benchmark demo自动测试覆盖运行时检测、秘密脱敏、危险命令不执行和 Schema。fixture 扫描 3 个文件含 1 个源码、1 个测试识别node:testnpm test退出码 01 条通过0 条发现得分 97。接着可以把同一目录安装到 Qwen Code 的候选用户 Skills 路径products/agent-capability-benchmark/scripts/install.sh ~/.qwen/skillscommand-vqwenqwen--help进入 Qwen Code 后可要求它使用该 Skill 生成离线报告。只有确认发现、调用和报告生成才能改成“已验证”项目 README 不能代替官方文档与实机证据。三、实际输出说明了什么fixture 的测试缺口比为 1缺口和发现为空这不说明 Qwen Code 的分析能力。97 分因非 Git 仓库缺少历史证据扣 3 分patch 为not_generated不能声称已修复。可复用的是同一个 CLI、JSON 字段和“不修改被测仓库”的默认规则。Agent 如何选择命令、总结报告和遵守边界需要逐个测试不能从 fixture 分数推导。四、能力边界这次没有证明什么运行记录没有完成 Qwen Code 端到端验证也没有验证 Kimi CLI。本文不比较其模型质量。测试受白名单、安全分级和超时限制报告不是完整安全审计。五、免费 Benchmark 的使用方式不想先配置 Skill也可以直接免费运行底层 CLInodeproducts/agent-capability-benchmark/bin/agent-benchmark.js\/path/to/repo--output/tmp/qwen-agent-report先检查验证记录的退出码与超时再看发现和 patch 状态。工具默认离线、无遥测、不需要 API Key也不提供账号共享、VPN、代理或地区限制绕过方法。 本文是《Agent工程能力评测实战》系列第 2 篇当前为待审核草稿。 下一篇《别再只看模型榜单用真实仓库评测AI编程Agent》把评测对象从聊天答案转向可复核证据。 你认为跨 Agent 兼容最容易卡在安装、发现还是执行边界评论区聊聊。