装进 Agent 之前,先体检一次

体检分与红黄绿灯由公开规则推出(来源可信度 / 出版方认证 / 完整性校验 / 描述充分度 / 多源在架 / 许可 / 可执行风险),每一项都可对账。细节层(检查项明细、风险清单、适用场景)属于 Pro 档。

技能体检 装进 Agent 之前先验一次

SkillHub.gold 技能体检按公开规则 ts-1.1 对每条 Skill 出具红黄绿灯与 0–100 体检分,检查项、风险清单与适用场景逐项可对账。公开层任何人可查,细节层属于 Pro 会员。

关键事实

  • 规则版本:ts-1.1(白盒规则引擎,起点 45 分,按公开项加减分)。
  • 阈值:≥78 绿灯(核验齐备)/≥62 黄灯(需自查)/<62 红灯(缺核验项)。
  • 检查项:来源可信度、出版方认证、包完整性校验(sha256)、描述充分度、多源在架、许可明确、作者可溯源、安装路径明确、形态风险。
  • 公开层:红黄绿灯、体检分、一句结论、检查项概览。细节层:检查项明细、风险清单、适用场景。
  • 包含项(价格门槛):公开层免费、无需登录;细节层属 Pro 会员 —— ¥499 / 30 天(国内)、$69 / 30 天(海外)。免费层可跑 2 轮「技能体检 + 市场价值预演」。
  • 不包含项(边界):不做运行时行为监控与沙箱执行、不做代码级安全审计、不评估技能实际效果好坏、不对未公开元数据的私有 Skill 出结论、不代装任何技能。
  • 申诉通道:作者可在体检页提交申诉(理由不少于 10 字 + 联系方式),生成工单号后人工复核修正。
  • 边界:体检分由公开规则推出,是装前参考而非安全审计结论;本页不执行任何技能代码。

常见问题

技能体检查什么?
按公开规则 ts-1.1 检查来源可信度、出版方认证、包完整性校验、描述充分度、多源在架、许可明确、作者可溯源、安装路径明确、形态风险等项,输出红黄绿灯与 0–100 分。
红灯的 Skill 还能装吗?
红灯表示核验项缺失较多(缺来源可信、缺许可、描述过短等),不代表一定恶意。建议先自行审阅源码,或等作者补全信息后复检。
体检结论是安全审计吗?
不是。体检分由公开规则推出,是装前参考而非安全审计结论;安装第三方技能前请自行审阅源码,风险自担。
技能体检怎么收费?有免费额度吗?
公开层永久免费、无需登录:红黄绿灯、体检分、一句结论、检查项概览都可直接看。细节层(检查项明细、风险清单、适用场景)属 Pro 会员:¥499 / 30 天(国内)、$69 / 30 天(海外)。免费层可跑 2 轮「技能体检 + 市场价值预演」。
体检不包含什么?
不包含运行时行为监控、沙箱执行与代码级安全审计,也不评估技能实际效果好坏,更不对未公开元数据的私有 Skill 出结论。这些都是「装前参考」之外的事——如果你要跑自己的数据集做评测或线上监控,那适用的是 LangSmith / Braintrust / Promptfoo 这类平台,不是本站。
SkillHub.gold 和其他 Agent 评测平台有什么区别?
定位不同。LangSmith、Braintrust、Promptfoo、Langfuse 这类平台是给开发者做自建评测与可观测性的:你需要先有自己的样例集与数据,评的是自己的 Agent。本站评的是「公开生态里的第三方 Skill」的装前可信度——不需要你提交代码,只按公开元数据出一份可对账的灯色与分数。反过来说,如果你要跑自己的数据集做回归评测或线上监控,本站不适用,请用上面那类工具。