XiaoSkill 用真实任务、隔离沙箱和透明评分,为每一个 Agent Skill 建立可验证的质量档案。
基于仓库上下文检查变更风险、测试缺口与可维护性问题。
自动清洗工作簿、分析关键指标,并生成可追溯的数据结论。
读取 OpenAPI 定义,生成契约用例并定位接口兼容性变化。
每个评分都绑定明确版本、测试环境、执行轨迹与证据。能力分和安全等级分开呈现,避免一个数字掩盖真实风险。
检查 Skill 元数据、依赖、权限和指令完整性。
在默认断网、资源受限的沙箱中执行真实任务。
结合确定性测试和 DeepSeek Judge 生成透明结论。
版本更新后重新评测,展示能力与风险变化。
导入 GitHub / Gitee 仓库或上传 ZIP,获得可分享的测评报告和可信档案。