返回首页

测评方法论

ProfileClaw 六项测评如何构建、计分与版本化——以及我们明确不声称的事。

最近更新: 2026-09-26

测评只有在你知道它怎么来的时候才有用。本页记录我们七项测评的构建、计分与版本规则——与你的 agent 通过上下文层读到的是同一套事实。

共同设计

六项测评遵循同一套设计:

  • **形式:**探索性自评。你对第一人称陈述(如「我喜欢搭建、修理或调试实物」)按五级量表打分,从「不像我」到「非常像我」。
  • **题目:**为 ProfileClaw 撰写的原创题目,参考各框架公开发表的构念。它们是有意为之的简短筛查,不是完整版商用量表。
  • **计分(mean-v1):**答案按维度取平均,得到 1–5、保留两位小数的得分。没有群体百分位,不做常模标准化——4.20 的意思是「你给这些陈述打了高分」,仅此而已。
  • **反向题:**每项测评混入少量反向计分陈述,以抵消默许偏差。
  • **版本化:**每项测评带版本号(当前 2026-08.1)。题目变更则版本变更——已保存的结果保留它被计分时的版本。

六项测评

| 测评 | 依据 | 题数 | 维度 | | --- | --- | ---: | ---: | | 职业兴趣 | 霍兰德(RIASEC)职业兴趣类型 | 18 | 6 | | 工作风格 | 大五人格(OCEAN)特质模型 | 15 | 5 | | 工作价值观 | 常见工作价值观量表 | 12 | 6 | | 技能与天赋 | 自评技能簇 | 10 | 5 | | 色彩气质 | True Colors(Lowry, 1978) | 12 | 4 | | 行为风格 | DISC(Marston, 1928) | 12 | 4 | | 职场判断 | 情境判断(SJT)倾向 | 12 | 4 |

每个维度都有一句话说明它测什么,各测评落地页有更完整的框架说明。

我们不声称的事

这和我们声称的事同样重要:

  • **非临床。**这里的任何内容都不用于诊断、治疗或筛查任何状况。
  • **非选拔工具。**这些测评是探索性自评,未针对招聘、晋升或任何针对个人的重大决策做验证。
  • **没有百分位。**我们不把你和人群样本比较,因为我们不运营常模。
  • **筛查的取舍。**短量表用精度换速度。它们能可靠指出哪些维度为主导,但不能替代认证从业者使用的完整版量表。

结果如何到达你的 agent

分数汇入一份结构化档案,agent 只会看到裁剪后的输出——永远不会看到你的原始作答:

  • 上下文包携带 schemaVersion 1.0、每项测评的版本与出处字段,读者始终知道某个分数出自哪个版本。
  • 读取按任务裁剪(career、projects、learning、communication),并受范围限制(profile:read、assessments:read、evidence:read)。
  • 包内的 policy 块将测评标记为 exploration-only、证据标记为 user-submitted-unverified,让下游 AI 以恰当的谨慎对待结果。

本页的变更

当某项测评的题目或计分方式变化时,我们会提升其版本并更新本页。各测评落地页上的更新说明反映当前版本,已保存的结果永远保留它被计分时的版本。