‌Application of Grey Prediction Model in Acquisition of University Libraries

  • Kong Chao
Expand

Received date: 2014-07-25

  Accepted date: 2014-06-27

  Online published: 2025-04-28

Cite this article

Kong Chao . ‌Application of Grey Prediction Model in Acquisition of University Libraries[J]. Knowledge Management Forum, 2014 , 2014(4) : 35 -39 . DOI: 10.13266/j.issn.2095-5472.2014.04.006

1 引言

根据国家统计局网站上公布的图书出版数据,2012年全国新出版图书241 986种,比2011年多34 480种, 2006-2012年年间,每年平均增长13 538种[1]。对于高校图书馆来说,采访经费增长幅度有限,如何利用有限的采访经费,满足读者需求,提升馆藏质量,是图书馆采访工作追求的目标。一般情况下,高校图书馆的采访工作主要依靠采访人员对读者需求的把握,对本学校各专业发展趋势及热点的判断,容易受到采访人员主观意识的影响,这与读者的客观需求难以达成一致。以金陵科技学院图书馆为例,笔者对2012年7月至2013年7月(中标图书供应商履行合同期)新进图书做了一次调查,截至2014年2月26日,该批图书的零借阅率平均在38%,其中有9类图书零借阅率超过40%,T类(工业技术)图书零借阅率达到66%。这说明实际工作中确实会出现采访与需求脱节的情况。解决此类问题,完善采访工作,提高馆藏质量是本次研究的重点。
古代哲人提出“凡事预则立,不预则废”,这是对预测重要性的精辟概括,说明了预测在人类生活中具有重要的作用[2],本次研究希望通过对图书借阅情况的预测,把读者实际需求与采访工作紧密地联系起来。图书流通是受多种不确定因子影响,其内部状态不能用定数论规律描述,属于灰色系统的范畴,因此采用灰色GM(1,1)模型,利用图书借阅原始统计数据,预测高校图书馆的流通趋势,根据实际的流通趋势设计理性的采访计划。

2 灰色预测

灰色预测是指对既含有已知信息,又含有不确定信息的系统进行预测,就是对在一定范围内变化的、与时间有关的灰色过程进行预测[3]。

2.1 灰色GM(1,1)模型建立方法

2.1.1 数据处理

假定原始时间序列数据列为: ,这些观察值多为无规律的、随机的、有明显的摆动,若对原始观察数据列进行一次累加生成,获得新的数据列, 新生成的数据列为一条单调增长的曲线,增加了原始数据列的规律性,而弱化了波动性[4]。

2.1.2 建立微分方程

灰色系统建模思想是直接将时间序列转化为微分方程,从而建立抽象系统的发展变化动态模型,即grey dynamic model,简称为GM。本次研究所采用的模型为GM(1,1),模型参数含义为:一个变量的一阶微分方程的动态模型。该表达式记为:

2.1.3 估计参数 (发展灰数), (内生控制灰数)

参数的估计是灰色建模的关键,一般采用最小二乘法原理进行求解,即另 为待估参数向量, ,通过 估计参数 , 。其中:
,

2.1.4 灰色模型预测 将上式估计的参数 , 代入 ,即可得出预测值。

2.2 GM(1,1)模型的检验

模型能否进行合理的预测,首先要通过自身设立的检验标准,本次研究对所建立的GM(1,1)模型采取残差检验和后验差检验两种方式,考察模型是否合格,能否进一步采用其做实际预测。

2.2.1 残差检验

按照预测模型 ,并将 累减生成 ,然后计算原始数据 与预测值 的绝对误差序列和相对误差序列:
;

2.2.2 后验差检验

第一后验指标方差比 ,第二后延指标小误差概率 ,式中 是原始序列标准差, 是绝对误差标准差;通过检验的标准为表1所示:
表1 GM(1,1)模型精度等级
检验指标 精度等级
优 合格 勉强合格 不合格
P >0.95 >0.8 >0.7 <=0.7
C <0.35 <0.5 <0.65 >=0.65

3 中文图书流通情况预测分析

本次研究对象为金陵科技学院图书馆,数据来源为图书馆“汇文文献信息服务系统”,选取方法按《中国图书馆分类法》A到Z共22个大类,考虑到两校区图书馆的扩改建对研究的影响,因此在实际研究中,将检索条件设为:分类模板“A-Z”,馆藏地“江宁借书处”,统计时段“2007-2013年度”,文献类型“中文图书”进行统计。
将统计出的流通数据设为原始数列 ,输入Matlab R2010b编程的GM(1,1)模型中进行运算,同时对2014年各类图书的流通进行预测,以T类图书流通数据为例,具体编程运算过程如图1所示:
图1 构建-检验预测模型及Matlab代码
具体计算结果:
, ,
, , , , ,
根据运行后的程序结果分析,相对残差 ,小于等于0.05,平均相对残差 ,小于0.05,表明残差检验合格;后验差检验 小于0.35,模型为均方差比合格模型, 大于0.95,模型为小残差概率合格模型。上述预测模型通过GM(1,1)模型检验,可以进行预测,将数据带入预测模型计算结果,T类(工业技术类)图书2014年预计借阅量为29 627册。
根据上述方法,将2007-2013年度分类图书流通数据带入计算2014年度各类图书流通预测值,结果如表2所示:
表2 2014年度各类图书流通预测
类别 图书流通灰色预测模型 预测精度检验 预测值(册)/占比
c p 精度等级 2014年
A(马列主义、毛泽东思想、邓小平理论) 0.286 5 1 优 93 0.08%
B(哲学、宗教) 0.089 1 1 优 3 199 2.73%
C(社会科学总论) 0.172 1 优 1 291 1.10%
D(政治、法律) 0.265 1 1 优 2 423 2.07%
E(军事) 0.257 9 1 优 335 0.29%
F(经济) 0.300 4 1 优 7 844 6.70%
G(文化、科学、教育、体育) 0.188 4 1 优 1 990 1.70%
H(语言、文字) 0.388 1 合格 17 773 15.17%
I(文学) 0.360 6 1 合格 32 219 27.50%
J(艺术) 0.440 8 1 合格 8 807 7.52%
K(历史、地理) 0.3 1 优 5 156 4.40%
N(自然科学总论) 0.106 6 1 优 35 0.03%
O(数理科学和化学) 0.308 9 1 优 4 457 3.80%
P(天文学、地球科学) 0.247 8 1 优 205 0.17%
Q(生物科学) 0.362 6 1 合格 85 0.07%
R(医药、卫生) 0.100 5 1 优 430 0.37%
S(农业科学) 0.302 9 1 优 160 0.14%
T(工业技术) 0.202 1 优 29 627 25.29%
U(交通运输) 0.318 5 1 优 647 0.55%
V(航空、航天) 0.449 5 1 合格 9 0.01%
X(环境科学、安全科学) 0.359 4 1 合格 60 0.05%
Z(综合性图书) 0.457 8 1 合格 313 0.27%
根据表2,可以科学地预测出不同类的流通量及所占比例,在分配采访经费或复本量时,可以考虑按照比例合理调配。

4 研究结论

采访工作一直是馆藏建设的重要一环,面对当前日益蓬勃的图书发行市场,如何做好采访工作,直接关系到流通工作及馆藏建设质量。零借阅的现象是个系统性问题,促其形成的原因较复杂,一般情况下比例超过40%,情况就比较突出[5],同时也反映出采访人员实际工作时对图书流通情况和读者需求把握不够精准。本次采用的GM(1,1)预测图书流通量模型可以比较好的解决这个问题,根据预测值及所占比例科学分配采购经费或采购量。整个模型覆盖了图书馆近期的流通历史数据,能够充分体现到馆读者的实际需求,保证采访工作更接地气。
GM(1,1)预测模型属于惯性预测的开拓,其预测的可靠性依赖于历史统计资料的可靠性。笔者认为在获取历史数据进行预测时,要做如下考虑:
流通数据是否符合图书馆的真实情况,这该时段中有无新馆搬迁、图书滞留导致无法正常流通等突发情况,如果有以上现象发生,流通数据将无法真实地反映出读者的实际需求,需要谨慎处理。
GM(1,1)模型对图书馆流通数据进行预测时,可能会出现模型检验不合格或精度不理想的情况,可以考虑采用GM(1,1)残差修正模型、残差均值修正模型、尾部数列GM(1,1)修正模型等方式进行再次运算预测。
本次研究采用MATLAB 2010b进行编程,并设计了编程源码,构建科学完整、可操作性强的高校图书馆流通预测,并进行实际预测分析,可以为科学制定采访工作计划,提供科学决策的依据,从而提高馆藏建设工作的绩效。采用了GM(1,1)模型预测方法,减少了采访工作的主观性,提高了采访工作的精确度和可信度,为完善高校图书馆馆藏建设提供了依据。本次研究数据的处理通过MATLAB 2010b完成,在实际应用中具有较强的可操作性和有效性。
[1]
国家统计局图书出版数据.SOAP[EB/OL].[2014-04-15].http://www.stats.gov.cn/

[2]
刘凤娟.图书流通的灰色预测与藏书建设[J].图书与情报工作,1996(1):41-43.

[3]
杨德平,刘喜华,孙海涛.经济预测方法及MATLAB实现[M].北京:机械工业出版社,2012.

[4]
王晓原,李军.灰色GM(1,1)模型在区域物流规模预测中的应用[J].武汉理工大学学报(交通科学与工程版),2005,29(3):415-417.

[5]
毕艳娜.零借阅率现象分析[J].山东图书馆季刊,2006(1):62-64.

Outlines

/

〈 〉