在一条直线上标上刻度,提供有关行为状况的线索,评定者沿着这个直观的尺度,从高到低迅速而简便地做出判断。这种量表不是用数字做评估。它的使用比较广泛。图示量表中的一种常用类型,是反义词图示量表。这是依据“语义分化”情况而设计的,量表的两端是相反意义的形容词或描述词语,中间是代表其程度的数字单位。通常有五个单位或七个单位,也可以用代表等级的符号或词语作为评定的方式。语义分析法多用这种形式。
3.标准评定量表
将观察对象的行为与总体做比较,以标准分数或百分位数等相对分数加以评价判断。如为申请人写推荐信,可将申请人与相应的群体相比较而做出判断。
4.累计评定量表
累计评定量表由一系列评定项目所组成,每个项目作为全部特征的部分独立表现。评定者分别对各个项目做出判断,最后以各项得分的和或平均数作为总得分。
5.强迫选择量表
给出一系列描述性短语,可以是积极肯定的,或是肯定加否定的行为项目,评定者必须从中选出一个最符合评定者的描述。这种评定法也称作“人物推定法”。
等级量表也是以数字作为描述观察对象的形式,但不同的是这些数字具有高度推论性,而不是根据短期的时间样本得到的频率计数,因而从数据中得出结论较代码系统、核查清单容易。等级量表其实是一种以客观定量的方式处理主观判断的记录方法。所以,这种方法最大的问题在于等级划分所固有的主观性。观察者划分的等级与其说是实际观察到的情况,不如说是观察者印象的总结。所以,如果量表上每个等级点的属性没有明确的操作性定义,那么很难保证观察的效度和信度。观察者本身作为测量的工具,他们在完成等级量表时知觉很容易受多种因素影响:慷慨误差——作为高层次的评价者对个体进行测定时较为宽松的倾向;光环误差——观察者对被观察者某一方面的固定印象影响了他对其他方面的评定的倾向;中间倾向误差——以量表的中间类型对别人进行测定并避免极端的倾向;逻辑误差——对某些特征予以相同等级评定的倾向,即观察者以为某些特征较为相似,可以相互搭配,但事实并非如此。这些效应都是在评定等级时难以避免的,因而也是等级量表的缺陷所在。
因此,在运用等级评定量表时应注意:①注意避免成见效应。针对评定法主观成分易带偏见或成见,克服的办法是要求在实地观察的基础上做出评定。②进行必要的重复评定。可以在规定的时间期限内,在不同时间做多次观察评定,最后求出平均值;或由多个评定者做判断进而计算平均值。③对评定等级尽可能拟定具体标准,如对表明评定等级的数字或词语应附有意义说明,降低术语的模糊性。④研究者应重视量表的设计和编制,要以能够全面真实地反映观察对象实际情况为目标,编制量表,要使词语及其意义与被评价的特征相一致,能够对所考察的问题做出较准确的表示。一般地,需经反复试用和多次修订后,再正式确定和运用。[6]
以上所提到的代码系统、核查清单和等级量表是定量观察中常用的记录方法,其中,代码系统一般都有严格而固定的使用规则。国外在20世纪六七十年代发展了大量的代码系统,一方面使研究者和教师有现成的观察工具直接可用;但另一方面,使用别人开发的代码系统,就不可避免地用别人的眼光来观察课堂,研究视角较为狭窄,有时候难以完全吻合研究者或教师的实际研究需要。核查清单和等级量表的使用较为灵活,研究者可以自行设计,也可以修改别人的东西为我所用,所以,在我国的定量课堂研究中,使用后两种记录方法的情况比较多。
现将三种记录方法的主要相同和差异之处进行总结,见表4-4。
表4-4 分类体系的类型及一般特征
二、定性观察的记录方法