公开验证中。
what-world-way 是一个仍在持续打磨的框架。作为一个非营利项目,我们不想为了赶进度就去宣称一种尚未赢得的准确性。我们的做法是:随着越来越多人参与测评,逐步地、公开地进行验证——先把验证计划发出来,让所有预测都留有记录,等数据到了再来对照。
我们实际站在哪。
三大支柱各有扎实的学术根基——人格部分源自大五人格理论,世界部分借鉴了格雷夫斯的发展层级模型,原型部分则延续了动机类型研究的脉络——同时也融入了我们自己多年的探讨与思考。不过,我们在此基础上搭建的具体测评工具仍处于早期阶段,尚未经过独立的效度验证,我们也从不声称已经通过了这样的验证。
所以我们的做法是:先以一个公开声明的「预验证原型」上线,然后在大家看得到的地方,一步步走向验证。每完成一个阶段就公布结果,附上坦诚的说明和局限,随着数据逐渐充实不断更新。目前测试里用到的权重和分界值,都是专家给出的初步估计,也明确标注了这一点——它们还不是最终确定的数值。
我们能证明什么,以及何时。
我们不会一上来就砸一大笔钱做一项大型研究。我们的做法是:随着用户量的增长,利用自然积累的数据,逐步验证能验证的部分——而且每一个阶段在正式开始之前,我们都会提前注册研究方案。整个过程不花额外的钱。
- 阶段 0现在——人们做免费测试时
怎么做:不断增长的「一瞥」测试量,加上那个让人一次坐下来就把「什么」「世界」「路径」三项都做完的流程。
它展示什么:内部结构、信度、Open 模式的真实出现率,以及对三个支柱能否彼此区分的初步粗检。
已在运行,随流量增长。
- 阶段 1在更深的洞察层级
怎么做:洞察所予的作答,随积累进行。
它展示什么:同样的检验,按洞察精度。
进行中,随洞察作答到来。
- 阶段 2决定性检验
怎么做:从招募样本中抽取一部分人,在完成「洞见·你是什么」测试的同时,完成一份成熟的大五人格量表和一份价值观量表。
它展示什么:这是最关键的独立性检验和原型结构分析——对照的是别人开发的成熟量表,而不是我们自己的工具。
滚动进行,随子样本填满。
有一点很重要,所以我们直说。阶段 0 和阶段 1 是用「你是什么」测试去跟我们自己开发的「你的世界」和「你的路径」测试做对比——用的是同一套措辞、同一次作答——所以它们能发现明显的重叠,但没办法证明三者是相互独立的。真正能支撑「三根支柱各自独立」这个结论的,是阶段 2:在那个阶段,我们拿测试去对照由其他团队开发的大五人格量表和价值观量表。我们从来不会把早期阶段的结果当作独立性的证据来呈现。
有数据之前,我们承诺了什么。
这些是可以被证伪的预测——在实验开展之前就写下来,允许事后被推翻。每一条预测都在对应阶段启动前完成了预注册。
- 独立性
在剔除人格特质和价值观已经能解释的部分之后,「你是什么」测试的每个维度应该仍然承载着属于自己的动机信号。风险最大的维度是「稳定与变化」——它最终可能被证明更适合归入「世界」或「道路」,而不是留在「你是什么」里。
- 结构
当我们让数据自然聚类时,是否真的会出现大约十一种不同的原型,还是其中一些会合并到一起?我们预期有一部分会彼此重叠——坦率地说,我们预判最终会形成六到八个清晰的群组,而这十一种原型则作为群组内部可辨识的不同位置存在。
- 开放模式
Open 这条路径应当能把那些真正在不同情境中灵活切换的人识别出来,并且把他们和那些只是没有认真回答问题的人区分开。
- 可靠性
测量同一事物的题目应彼此一致。
- 附加价值
最关键的检验在于:一个原型能否预测出一些东西——比如什么样的工作让你充满干劲、什么样的工作让你消耗殆尽、你觉得什么才有意义——而这些东西是单靠人格特质和价值观预测不到的?如果原型本身没有带来任何独立的解释力,那它就没有存在的理由。
框架可能出错的三种方式。
一个不允许自己被推翻的框架,算不上科学。所以我们提前列出了三种可能的结果——数据可能支持某个原型,可能要求修改它,也可能说明它根本不成立——并且承诺:不管数据指向哪个方向,我们跟着走,而不是死守最初的设计。
- 迁移
这个区分本身是成立的,只不过放错了位置——它应该归到 World 或 Way 下面,而不是 What。角色本身保留不变;那部分越界的内容会被挪到它该去的地方。
稳定与变化区域是当前候选。
- 合并
有时候两个看起来各不相同的角色,深挖下去才发现其实是同一回事——人们在实际中很难把它们区分开来,也找不到任何可衡量的指标能把两者分开。于是其中一个名字被去掉,角色本身并没有消失,只是归到了同一个名字之下。
Stag 与 Wolf 是我们最先关注的一对。
- 放下
当一个原型在它自己的标准上都站不住脚——陌生人辨认它的准确率并不比一段泛泛的好听描述更高,而且它本身也没有提供任何超出其他原型混合体的独特信息——这个原型就会被彻底移除。
Beaver 被提前点名为最可能走这条路的。
一个原型该保留还是去掉,关键看「辨识度」。一个原型能留下来,前提是人们确实能在其中看到自己、也能认出别人——而这本身就是一项检验,不是随便贴个标签就算数。我们衡量辨识度的方式有几个层面:人们是否能稳定地把自己归到同一个原型;熟悉他们的人是否也认同这个归类;以及陌生人能否把一个人准确归入正确的原型,而不是仅仅被一段好听但笼统的描述所吸引。如果一个原型通不过这些检验,它就没有理由继续存在。
这是什么,不是什么。
我们放在最前面的主张其实很克制——但我们觉得,这恰恰是最有意思的部分:人们能辨认出一些有意义的差异,而这些差异是现有模型没有明确命名的。我们并不是说自己发现了什么全新的人格维度——我们说的是那些可以被辨认出来的角色,被气质倾向所调色,分布在彼此半独立的层面上。
这里借用一个框架之外的类比来帮你理解:原型之于动机,大致相当于「社交型内向者」之于人格——给一个真实存在的模式起了一个好认、好用的名字,而不是在宣称发现了什么全新的独立维度。「社交型内向者」这个说法,既可以还原为已知的人格特质,又确实好用,这两件事并不矛盾。我们对自己的要求就是这个标准:保留原型作为一种有用的角色,但绝不把它过度包装成它本身并不具备的独立维度。
步步钉住,但从不冻结。
Clare Graves 的发展理论是六大「世界」背后的基石,他把自己毕生的研究称为一场永无止境的探索。我们的态度也是一样的。这里的验证工作是持续滚动、永不停歇的,而不是一次通过就万事大吉。随着证据不断积累,任何一个原型都有可能在某个阶段被合并、被重新归类、被淘汰,也有可能被进一步印证。
永不止步,但也不是永远不落锚。每个阶段的评判标准,在看到数据之前就已经确定好了,并且在公开科学记录中公开注册,连同测评工具的精确版本一起留下数字指纹——这样任何人都可以验证,产生某个结果的那个版本没有被事后悄悄改动过。探索没有终点,但每一步都提前亮明了靶心。
公开邀请。
我们提供这个机会,但不强加于人。如果你愿意帮忙验证或打磨这套体系,这里有你的位置。给研究者说一句:预注册方案是公开的,而且这里正在积累的跨测试数据——同一批人在多个框架下的测量结果——是一份很少见的研究资源,值得一用。给学生说一句:这是一个正在运行的真实项目,可以拿来练手。给所有人说一句:你来做测试,然后告诉我们结果准不准、像不像你自己——这件事本身就已经是证据的一部分了。
在第一阶段的目标正式锁定之前,还有一个短暂的窗口期,你可以帮助我们把目标打磨得更精准。等到这个阶段正式登记完成,我们会在这个页面上放出带有时间戳的存档记录——一份公开的「提前亮牌」凭证,所有人都能看到。