化学分析测量数据处理有关概念的相关商榷
1
2
Discussions on the Concepts Related to Metrical Data in Chemical Analysis
1
2
通讯作者:
收稿日期: 2021-06-30 接受日期: 2021-08-11
| 基金资助: |
|
Received: 2021-06-30 Accepted: 2021-08-11
According to the general principles of classification and definition of concepts the concepts in the course of chemical analysis addressing metrical data are sorted out, including the basic tasks of chemometrics, accuracy, precision and error. Discussions are carried out on the arrangement of contents, concept terminology and definition of some concepts in the currently popular textbooks, and relevant suggestions are put forward, in the hope of providing reference for refining the textbooks of《Chemical Analysis》and standardizing academic terminology.
Keywords:
本文引用格式
岳宣峰, 樊鑫, 秦丹, 逯昊文, 张延妮.
Yue Xuanfeng.
1 引言
为了对测量数据进行科学的处理,现行《化学分析》教材中普遍介绍了相关化学计量学基础知识,并将其应用于对真值的预期。化学测量的基础理论是化学计量学,它通过数学及统计学方法在研究对象的“表观状态”和“真实状态”之间建立联系,并通过解析测量数据最大限度地提取被研究对象的有关特征信息。因此,教材中普遍介绍了误差、绝对误差、相对误差、系统误差、随机误差、偏差、准确度、精密度等概念,并对这些概念之间的关联也做了一定解读,这些内容涉及化学测量、统计学、数学及语言逻辑等多个学科,给教材的编写带来了很大的挑战,现行主要《化学分析》教材[1, 2]在涉及以上知识的编排结构上还不甚合理,一些概念的定义还不够统一,一些概念的分类还不够清晰,还有一些知识存在可能的疏漏甚至错讹,而这些问题都是分析化学专业共同体进行理论研究和教育教学时亟待解决的问题。本文基于概念的分类规则和定义规则,对两本主要《化学分析》教材中涉及测量数据处理的概念进行了探讨,指出有关概念的命名、定义、分类、知识编排等方面存在的问题,并提出了相应的改进建议。
2 概念的分类和概念的定义
2.1 概念分类的属性及其对概念定义的内在要求
概念分类是一项复杂的工程,涉及所有学科,并且需要在一定的哲学观念的指导下进行。相对于具体学科,跨学科的概念分类就更为困难,一方面是由于综合性工程的巨大挑战,另一方面是众口难调,要取得一致的分类标准非常困难;另外,哲学思想对这项工程起着纲领性的作用,而至今真正取得不同阶层、不同民族、不同国家与文明社会认同的作为科学的哲学还没有出现。因此,那种全面统一的概念分类及其体系的实现还有一段相当长的道路要走,但这并不妨碍在同一学科内部及交叉学科之间不断对旧概念进行新分类的尝试,甚至创立新概念。构建基础概念类别应该以语言学、形式逻辑、辨证逻辑、数学、系统论等学科所涉及的广义对象为基点,有关概念分类及构建的注意事项及其与专业术语之间的关联关系见文献[3]。概念分类的外延研究要求首先明确概念的定义,定义的合理描述有助于聚焦概念最关心的关系脉络,从而提高概念运用的效率。
2.2 概念的两种定义方法
在教育研究中,当在不同的层面、从不同的角度、用不同的定义来探讨同一个概念时,往往会产生很多误解和歧义,很大一部分原因是由于对所探讨的概念没有明确客观的操作性定义造成的。所谓概念的操作性定义(operational definition)是根据可观察、可测量、可操作的特征来界定概念含义的方法,从本质上说,下操作性定义就是详细描述研究变量的操作程序和测量指标,美国的物理学家布里奇的这一观点和思想在1971年被美国的《科学》杂志列为世界五大哲学成就之一,他认为:科学上的概念如果要想避免暧昧不清,最好能以我们“所采用的测量它的操作方法”来界定。下操作性定义的方法、注意事项等见文献[4]。所有的实证性研究都必须有测量,并且所有的测量都必须把一般的抽象概念变为具体的行为指标,以便他人重复、验证和交流,因而在实际研究过程中,操作性定义和抽象性定义都是需要的,应根据研究的性质和目的灵活运用。在给概念下定义的过程中,抽象性定义可涵盖研究概念所属的基本特征,解释范围较大,具有普遍性,但往往失之笼统,无法据此测量和操纵研究的概念;操作性定义着眼概念的客观可检验性,对概念的界定清楚明确,便于操纵和测量,但往往只能涉及概念的少数特征,具有明显的排它性;当一个概念同时具有两个定义时,比较理想的方式是:先用抽象性定义描述概念的基本特征,然后再用操作性定义描述概念的操作程序和测量指标,前者为后者提供方向并指明意义。
3 《化学分析》教材中测量数据处理有关概念的相关商榷
按照以上的概念分类和概念定义规则,对现行两本主要《化学分析》教材中与测量数据处理有关的概念及相关内容展开商榷,涉及预期真值的方法、准确度的内涵及其与误差的关系、误差的抽象性定义、误差的操作性定义及分类、误差的构成、测量的正确性及其判断方法、数值的“精密度”及衡量指标、预期真值的区间表达法等,详细内容如下。
3.1 预期真值的方法
商榷:以上几个概念之间的关联关系不够明晰(比如:真值→预期值→准确度→误差,这些概念引入教材时未能做好环环相扣),各个概念适用的领域并未完全明确(比如:准确度可以用来评价平均值法预期真值的效果,但一般不用于评价区间法预期真值的效果),涉及的内容在编排上不够紧凑(将这些概念有机统一起来的起点是:对真值的预期这个目的,然后是预期方法的分类,最后是对这些预期方法效果的评价指标,这些内容在现有教材中并未按照这一逻辑编排),知识结构呼应性不够强(“准确度”和“误差”涉及到真值,而“置信度”和“置信区间”只涉及总体平均值,其实这些概念的展开始终都应该和测量工作的根本目的即预期真值要相呼应)。
建议:为了获得用来表示测量对象某性质的状态的真值T,往往先获得研究对象某性质的一组平行测量结果(x1、x2、…、xi),然后可以采用该组数值的消除了误差系统项的平均值
3.2 准确度的内涵及其与误差的关系
商榷:在描述研究对象某性质的真实状况与其预期状况之间的关系时,科学家们从两个相对的角度逐渐发展了两个不同的概念,分别来描述这两个状态的一致程度及差异程度,前者对应的是准确度,后者对应的是误差。准确度这个概念的抽象性定义可以是“研究对象某性质的真实状况与其预期状况的一致程度”,其操作性定义可以采用文献[5]中的描述:
建议:在描述研究对象某性质的真实状况与其预期状况之间的关系时,科学家们从两个相对的角度逐渐发展了两个不同的概念,分别来描述这两个状态的一致程度及差异程度,前者对应的是准确度,后者对应的是误差。准确度是指研究对象某性质的真实状况与其预期状况的接近程度,一般采用一个确定的数值表示研究对象某性质的真实状况即真值T,而表示预期状态的预期值一般则是通过测量获得的,具有不确定性,一般采用
3.3 误差的抽象性定义
商榷:相对于“绝对误差”及“相对误差”这些低一级的概念,“误差”这个处于分类体系上一级的概念尚无抽象性定义,显然有待补充。
建议:误差指的是研究对象某性质的真实状况与其预期状况之间的差别。
3.4 误差的操作性定义及分类
现状:现有教材关于两类误差的描述有“误差有两种表示方法,绝对误差和相对误差”[1],“误差可用绝对误差和相对误差来表示”[2]。绝对误差是指“测定值与真实值的差值,其表达式为
建议:科学上常用一个数值表示研究对象某性质的具体状态,“误差”定义中的两个状态对应的两个值分别称为真值(T)和预期值(
3.5 误差的构成
建议:误差的产生往往是多个因素综合作用的结果,在平行测量中,有些因素对误差的贡献呈现较为固定的特征,即贡献的大小及正负方向较为固定,具有重复性、单向性和可测性的特点;而其他的因素对误差的贡献呈现出别样的特点,其特点包括:贡献的正负会随机变化,正负贡献出现的几率相当;贡献的大小随机变化,小贡献出现的几率高,大贡献出现的几率小,极大贡献出现的几率更小。实际上,每一次测量误差都可能是以上两类因素同时导致的,但为了更方便地研究这两类因素对误差贡献的独立特点,把他们人为分开,即一类是对误差的贡献呈现固定正负及大小特点的因素,另一类是对误差的贡献不呈现固定正负及大小的因素,我们可以把前者对误差的贡献称为误差的“系统项(systematic fraction),记做fsys”,把后者对误差的贡献称为误差的“随机项(random fraction),记做fran”,每一个预期值的误差往往都是由这两部分叠加耦合而构成的,误差与其“系统项”和“随机项”之间的关系式为E = fsys + fran (包括Eab = fsysab + fsysab及Ere = fsysre + fsysre)。
按照绝对误差的定义:
其中
3.6 测量的正确性及其判断方法
商榷:众所周知,测量的重现性高是其准确度高的必要而不充分条件,那么是测量的哪个环节的缺失导致了这个“不充分”呢?是正确性!
建议:所谓测量的“正确性”指的是在某具体测量条件下,研究对象某性质无限多个测量结果的平均值(即µ)与其真实状态(即真值T)的一致性。“绝对误差”的“系统项
3.7 数值的“精密度”及衡量指标
商榷:在汉语里一旦一个词汇的核心词是“度”,在语意上往往意味着需要用具体数字来体现量的大小,而“精密度”这个概念本身并无操作性定义,即无可测的量,它只能与定性描述用语如“高”或“低”等相关联,因此,在抽象表示几个数值之间的“亲密”状态时,也许采用“精密性”比“精密度”的名称更为贴切。但精密性可以用其他具有操作性定义的指标来衡量,比如标准偏差,精密性与其衡量指标常被混淆。近年来,因为混淆精密性的内涵、衡量指标及其意义而在研究生毕业论文中屡次出现“方法的精密度小于5%”(正确的表达应该是“测量结果的相对标准偏差小于5%,所以测量结果的精密性较高,说明方法的重现性较好”)这样的表达,由此也可见这部分内容急需规范的紧迫性。“精密度表示几次平行测定结果之间相互接近的程度,用偏差来衡量,偏差越小,精密度越好”[1]中的用词“表示”应该改成“是指”,用“偏差”来衡量也显然不合适,“偏差”这个概念在各种教材中还没有获得统一的操作性定义(即使按照教材[1]中的操作性定义
建议:所谓精密性是指多个数值(在测量学中,常涉及平行测量的测量结果)之间的绝对或相对接近程度,它的高低反映了数据获得过程相关环节的重现性的好坏,这些环节一般包括测量工具、测量方法、测量过程等,衡量精密性的指标有全距、平均偏差及相对平均偏差、标准偏差及相对标准偏差等。对研究对象某性质进行多次平行测量之后,获得一系列测量结果(x1、x2、…、xi),这组数值的平均值为
3.8 预期真值的区间表达法
商榷:测量的目的是为了预期真值,预期真值时的误差等于系统项fsys加上随机项fran,系统项是固定值,随机项出现的规律符合正态分布或者t分布,可以在计算总体平均值µ的基础上再考虑误差的系统项,就可以直接预期真值T所属的区间。另外,目前教材中给出的总体平均值µ的置信区间只是各种可能性中的一种,它是在保证优先考虑数值精密性最好的前提下的置信区间,有关这一点我们会另撰文阐述。
建议:由
参考文献
DOI:10.1007/s00216-014-7884-7 [本文引用: 1]
/
| 〈 |
|
〉 |

