信息检索复习整理概述
计算机复习信息检索

计算机复习信息检索信息检索是指通过计算机技术,根据用户的需求,在大规模的信息资源中准确、快速地找到相关的信息。
在当今信息爆炸的时代,信息检索的重要性不言而喻。
本文将介绍信息检索的基本概念、技术和应用,并附带答案和解析。
一、信息检索概述信息检索是指通过计算机对大规模信息资源进行全文检索、关键词检索等方式,根据用户需求提供相关信息的过程。
其目标是提高检索准确性和检索效率,帮助用户快速获取所需信息。
信息检索系统由信息资源、检索模型、检索方法和用户界面等组成。
其中,信息资源包括数据库、文档集合等;检索模型包括向量空间模型、布尔模型等;检索方法包括倒排索引、词频统计等;用户界面提供检索接口供用户输入查询词,并显示检索结果。
信息检索的基本流程包括:用户输入查询词->检索系统进行查询处理->检索系统返回相关文档。
二、信息检索技术1. 关键词检索关键词检索是最常见的信息检索方式,用户通过输入关键词,检索系统根据关键词在信息资源中进行匹配,并返回相关文档。
关键词检索常用的算法有向量空间模型、TF-IDF算法等。
全文检索是指对文档集合中的全部文本进行检索,而不仅仅是关键词。
全文检索主要通过分词、建立倒排索引等技术来实现。
用户输入的查询词可以是一个短语或一句话。
3. 自然语言查询自然语言查询是指用户使用自然语言进行查询,而不是像关键词查询那样只输入几个词。
自然语言查询需要将用户的自然语言转化为计算机可处理的查询语言,如SQL语句。
4. 语义检索语义检索是一种基于语义理解的检索方法,通过对查询词的语义进行分析,实现更精准、准确的检索。
语义检索常用的技术有词义消歧、词向量模型等。
三、信息检索应用1. 搜索引擎搜索引擎是信息检索的最常见应用之一,在互联网上广泛使用。
搜索引擎通过爬虫程序对互联网进行爬取,建立庞大的索引库,并通过用户输入的查询词返回相关页面。
2. 文献检索在学术界和科研领域,文献检索是非常重要的工作。
信息检索基础知识考点整理

信息检索基础知识考点整理●2.1 信息检索的概念与原理●2.1.1 信息检索的概念(重要)●2.1.2 信息检索的原理●信息检索原理就是将特定的信息需求与存储在检索系统中的信息标识进行异同的比较与匹配,选取两者相符或部分相符的信息予以输出●信息检索的类型●1.文献检索●2.数据检索●3.事实检索●2.1.3 信息检索的意义/作用(重要)●1.信息检索是有效利用信息资源,实现其最大价值的科学方法●2.信息检索是再学习的工具,是获取知识的有效途径●3.信息检索能有效地提高科研工作的效率,节省人力、物力及时间●2.1.4 信息检索的历程●1.手工检索●2.计算机检索●2.2 信息检索系统(重要)●2.2.1 信息检索系统的概念●1.信息检索系统的含义●2.信息检索系统的工作原理●2.2.2 信息检索系统的构成●1.信息选择子系统●2.信息索引子系统●3.词表管理子系统●4.用户接口子系统●5.匹配子系统●2.2.3 信息检索系统的分类●1.手工检索系统●1.书本式的手工检索系统●2.卡片式的手工检索系统●2.计算机检索系统●1.硬件●2.软件●3.数据库●1.参考数据库●1.书目数据库●2.指南数据库●2.源数据库●1.数值数据库●2.文本—数值数据库●3.全文数据库●4.术语数据库●5.图像数据库●6.多媒体数据库●2.3 信息检索方法(重要)●1.直接浏览法●直接查找法●2.常用法●顺查●倒查●抽查●3.追溯法●4.综合法(分段查找法、循环法、交替法)●2.4 信息检索效果(重要)●2.4.1 信息检索效果评价●信息检索效果的概念●1.检索结果有效性评价●2.检索系统实用性的评价●3.检索费用—效率评价●信息检索效果评价对于信息检索系统的建设和发展的意义●信息检索效果评价的核心问题是建立一套切实可行的评价指标●1.查全率和查准率●2.误检率和漏检率●3.响应时间●其他与检索效果相关的指标●2.4.2影响信息检索效果的因素●1.标引的质量●2.检索途径的数量●3.检索策略的优劣●4.检索人员的素质。
信息检索复习提纲总结

第一章信息检索导论(1)信息的概念是什么?概念:信息是物质存在的一种方式、形态或运动状态,也是事物的一种普遍属性,一般指数据、消息中所包含的意义,可以使消息中所描述事件的不确定性减少。
(2)信息素质的定义及其构成要素分别是什么?定义:信息素质是人们能够敏锐地察觉信息需求,并能对信息进行检索、评价和有效利用的能力。
构成要素:信息意识,信息能力,信息道德(3)信息环境特征信息超载严重,信息失衡明显,信息污染成灾,信息障碍加剧,信息犯罪增多(4)熟悉文献信息资源的划分方式,以及在不同划分方式下文献的表现形式从文献的物质载体特征:印刷型文献,缩微型文献,声像型文献,机读型文献从文献信息的表现形态:1.图书2.期刊 3.报纸 4.学位论文 5.会议文献 6.专利文献 7.标准文献 8.科技报告 9.政府出版物10.产品资料 11.其他文献从文献信息被加工的详略程度:一次文献是基础,是检索利用的对象,二次文献是检索一次文献的工具,三次文献是一次文献内容的高度浓缩(5)掌握文献检索的含义、文献检索系统的分类(6)了解常用的文献检索方法引文法——追溯法系统法——工具法引文法-系统法交替法——循环法(7)熟练运用常规的检索技术(布尔逻辑检索、截词检索、位置检索、限定检索)常用检索技术及其作用布尔逻辑检索截词检索位置检索限定检索如physic* 可检出的词汇有:physic, physical, physically,physician, physicians, physicist, physicists, physics如physic??可检出的词汇有:physic, physical, physics(8)了解提高信息检索效果的主要措施1.检索结果多时使用“AND”缩小检索范围2.检索下位词时不使用上位词3.使用“NOT”将不需要的检索标识排除4.使用位置符限定检索标识的位置5.使用限定符限定检索标识所在字段第二章常用国内全文数据库1、掌握中文全文数据库的常见类型电子图书数据库, 电子期刊数据库学位论文数据库中国专利文献数据库中国标准文献检索中国学术会议文献检索事实型数据库2、熟练操作常用的中文电子图书数据库选择检索项SU=主题TI=题名KY=关键词CF=被引频次FT=全文AU=作者AF=机构CLC=中图分类号RF=引文YE=年SN=ISSN CN=统一刊号IB=ISBN FU=基金AB=摘要FI=第一责任人JN=中文刊名&英文刊名3、熟练操作常用的中文电子期刊数据库4、掌握中文学位论文数据库的使用方法5、了解专利相关知识(包括专利概念、类型、特点、专利号等)以及专利文献数据库的使用专利的概念:专利是指国家授予发明创造申请人在一定时间内的对发明创造拥有的专有权利。
【云南大学】信息检索期末复习重点

【云南大学】信息检索期末复习重点第一篇:【云南大学】信息检索期末复习重点云南大学信息检索重点第一章一、检索策略定义:在处理信息需求提问实质的基础上确定检索途径、检索词语并明确各词语之间的逻辑关系,查找步骤、系统输出顺序等方面的科学安排,与检索效果密切相关。
二、检全率与检准率1.检全率及其影响:检全率=(检出的相关信息数/信息库中相关信息总数)x100%2.检准率及其影响:检准率=(检出的相关信息数/检出的信息总数)x100% 影响检出文献的检索效果的质量。
三、检索模型1.布尔检索模型(1)定义:布尔检索模型采用布尔代数和集合论的方法,用布尔表达式表达用户提问,通过对文献表示与提问式的逻辑运算来检索文献。
(2)优点:简单、易理解、易实现、能处理结构化提问(3)缺点:A.布尔检索式的非友善性,即构建一个好的检索式是不容易的。
尤其是对复杂的检索课题,不易套用布尔检索模型。
B.易造成零输出或过量输出。
检索输出完全依赖布尔提问式与系统倒排挡中的文献匹配情况,输出量较难控制。
C.无差别的组配元,不能区分各组配元的重要程度。
D.匹配标准存在某些不合理的地方。
由于匹配标准是有或无,因此,对于文献中表因此的数量没有评判,都一视同仁。
E.检索结果不能按照重要性排序输出。
2.向量检索模型(1)定义:向量检索是以向量的方式确定检索内容的方法,系统中的每一篇文献和每个提问均用等长的向量表示。
(2)优点:A.采用自动标引技术维文献提供标引词B.改变了布尔检索非“1”即“0”的简单判断,标引词和文献的相关程度可在【0,1】闭区间中取值,使标引和检索者都可比较灵活地定义组配元(标引词)与文献的关系深度,改变了布尔检索模型僵化的特点。
C.由于以其相似的程度作为检索的标准,可从量的角度判断文献命中与否,从而使检索更趋于合理。
D.检索结果可按提问的相关度排序输出便于用户通过相关反馈技术修正提问,控制检索量。
E.布尔模型的逻辑关系依然可以使用,保留了直观性和方便性。
信息检索知识点

信息检索知识点 Revised by Liu Jing on January 12, 2021信息检索考点整理1.信息检索的概念广义的信息检索是指将信息按一定的方式组织、存储起来,并根据信息用户的需要找出有关信息的过程,包括信息的存储和检索两个过程;而狭义的信息检索仅指有序化信息的检索查找。
2.信息检索的原理就是将检索者的检索提问标识与存储在检索工具中的信息特征标识进行相符性比较,凡是信息特征标识与检索提问标识相一致或者信息特征标识包含着检索提问的标识,则具有该特征的信息就从检索工具中输出,输出的信息就是初步命中检索所需的信息。
3.为什么说信息存储和检索是两个不可分割的有机体?检索的全过程包括存储和检索两个过程,存储和检索是相辅相成、不可分割的。
存储过程主要是利用检索语言对文献进行标引,形成文献特征标识并输入检索工具,为检索提供有规律的检索途径;检索过程主要是利用检索语言对检索提问进行标引,形成检索提问标识,再按照存储所提供的检索途径,将检索提问标识与文献特征标识进行比较。
检索过程是存储过程的逆过程。
因此,检索者只有在全面了解存储者是怎样把文献存入到检索工具中去以后,才知道怎样从检索工具中把所需要的信息检索出来。
4.信息检索的方法(1)顺查法(2)倒查法(3)抽查法(4)追溯法(5)循环法5.信息检索的途径(1)内部特征途径a)分类途径b)主题途径(2)外部特征途径a)题名途径b)着者途径c)文献编号途径d)目录检索途径e)机构检索法f)引文检索途径6.布尔模型的优缺点优点:(1)简单,形式简洁,易于理解;(2)可操作性强,应用广泛;(3)构成的逻辑提问式可以表达与用户思维习惯相一致的查询要求,提供非常精确的语义概念;(4)能处理结构化提问。
缺点:(1)表达用户复杂需求效果欠佳(2)准确匹配无法提供定量比较(3)匹配标准不尽合理(4)检索结果不易控制7.概率排序原则:如果一个检索系统对用户的每个检索提问的反应是以文献集合中的文献按相关性递减的顺序排列的,那么系统的总体效果是最好的。
信息检索复习大纲

信息检索复习大纲第一章1.、信息的含义:信息是客观事物经过感知或认识后的再现。
2、知识的含义:知识是人们通过客观实践对客观事物及运动过程和规律的认识。
3、文献的含义:文献是记录有知识的一切载体知识、载体、记录是构成文献的三个基本要素。
4、信息资源的含义:信息资源是经过人类筛选、组织、加工,并可以存取和能够满足人类需求的各种媒介信息的集合。
5 、图书:图书是作者围绕一个中心主题进行研究和探索,比较成熟的、定型的,而不定期出版的出版物。
6、连续出版物的概念:连续出版物是一种具有统一名称、固定版式、统一开本、连续编号,汇集多位著者的多篇著述,定期不定期编辑发行的出版物。
7、学位论文是大学生或研究生为取得学位资格而提交的学术论文。
8、会议文献主要是指在国内外各类会议上宣读或交流的论文、报告或其他有关资料。
9、专利文献是实行专利制度的国家和地区及国际性专利组织在审批专利过程中产生的官方文件及其出版物的总称。
10、标准文献是为了在一定范围内获得最佳秩序,经协商一致制定并由公认机构批准,共同使用和重复使用的一种规范性文件(GB/T20001-2000)。
11、信息素质的含义:利用大量的信息工具及主要信息源使问题得到解答的技术和技能。
信息素质的内涵包括三个方面:信息意识、信息能力、信息道德。
12、信息能力的含义:指人们有效利用信息技术和信息工具获取信息、加工处理信息以及创造和交流新信息的能力。
主要包括以下内容:信息需求分析和表达能力、信息获取能力、信息分析和处理能力、信息利用能力13、互联网的应用包括:信息获取、交流沟通、网络娱乐、商务交易。
第二章1、信息检索广义概念:是指将信息按一定的方式组织和存储起来,并根据信息用户的需要找出有关的信息过程,全称“信息的存储与检索”。
2、信息检索过程::(1)分析检索需求;(2)确定检索标示;(3)选择检索系统和检索工具;(4)实施检索操作;(5)索取原始文献。
3信息检索按检索对象内容划分包括:文献检索、数据检索、事实检索、多媒体检索。
信息检索复习知识点

信息检索复习知识点1.信息(Information)信息是物质存在的一种方式、形态或运动状态,也是事物的一种普遍属性,一般指数据、消息中所包含的意义,可以使消息中所描述事件的不确定性减少。
* 信息的属性——客观存在性* 信息的作用——消除不确定性* 信息的形式——数据、消息等事实2.各种客观存在的、可供人们直接或间接开发与利用的信息的集合总称为信息资源3. 信息用户Information User信息的使用者即是信息用户。
使用的情况可以包括需要信息、接受信息和利用信息。
4. 信息需求Information Demand人们在社会实践活动中,为了解决各种实际问题,会产生对信息的需要,这种需要可表现为对信息的必要感和不满足感。
我们把意识到的信息需要定义为信息需求5. 信息检索Information Retrieval对信息用户而言,信息检索就是根据各自的目的和要求,选择恰当的信息资源,采用适当的检索手段、检索技术、检索方法,对所需要的信息进行查找、筛选和索取的过程或活动。
6. 信息素质:人们能够敏锐地察觉信息需求,并能进行相应的信息检索、评估以及有效利用所需信息的水平。
* 信息意识* 信息能力* 信息道德7. 信息社会是以知识和信息为基础从而促进社会高速发展的一种社会形态。
8. 经济领域的特征a.劳动力结构出现根本性的变化,从事信息职业的人数与其它部门职业的人数相比已占绝对优势;b.在国民经济总产值中,信息经济所创产值与其它经济部门所创产值相比已占绝对优势;c.能源消耗少,污染得以控制;d.知识成为社会发展的巨大资源。
9. 社会、文化、生活方面的特征10.社会观念上的特征11当代信息环境特征描述* 信息超载严重信息超载又称信息泛滥或信息爆炸。
它是指在信息时代,伴随着科学技术的迅速发展,出现的数据爆炸、信息平庸化以及噪音化趋势,人们无法根据自己的需要和当前的信息能力选择并消化自己所需要的信息。
* 信息失衡明显所谓信息失衡是对由于各国经济水平、科技水平和其它多种相关因素的影响,不同国家、不同地区以及不同阶层的人群在信息占有水平以及利用程度上存在极大差距的描述。
文献信息检索复习总结

第一章文献信息检索基础1.信息、文献、情报三者的内涵信息:信息源于世界一切事物及其运动,是物质和事物存在方式和运动规律的反映。
文献:记录有知识或信息的物质载体. (记录在载体上的知识或信息)情报:人们为一定目的而传递收集的有使用价值的知识或信息.科技文献:记录有科技知识的载体.2.文献外表特征包括:著者、书名、刊名、篇名、序号、国别、文种等内容特征包括:分类、主题、分子式、结构式3.文献的类型:按文献自身用途和编辑出版特点分类:(十大情报源)①图书:ISBN②期刊:ISSN③科技报告:四大报告:PB报告、AD报告、NASA报告、DOE报告④会议文献: CPCI(ISTP) 、万方数据库、CNKI会议库、SFS⑤政府出版物:⑥专利文献:发明专利实用新型外观设计⑦标准文献:国家标准行业标准地方标准⑧产品资料:⑨学位论文:学士论文硕士博士⑩技术档案:文献按出版发行特点:正式出版文献:图书期刊报纸非正式出版文献:又叫灰色文献,指不经过公开出版物流通渠道不大量发行按文献载体分:①印刷型:以纸张为载体,空间大.②缩微型:以感光材料为载体,空间小.借助缩微阅读机阅读,携带不便。
③机读型:存储在磁盘光盘上依赖计算机输出信息网络信息④实物型:出土文物甲骨文羊皮纸纸帛竹简象牙文字等按文献的加工程度分类:① 零次文献:指未经公开发表或未交流于社会的文献.如:私人笔记、实验记录、书信、内部档案、设计草图.② 一次文献:(原始文献) 凡是以著者本人的研究成果为依据而创作的原始文献,公开发表或交流后,称为一次文献. 如:学报期刊(Journal)、报告(Report)、会刊(Proceedings)、汇刊(Transactions)、译文、大部分档案等。
一次文献是文献的主体,是检索的最终目的.③ 二次文献(工具书):是在一次文献数量激增的情况下形成的。
是对一次文献进行加工整理的产物,是为便于管理利用一次文献而编辑出版的工具性文献。
- 1、下载文档前请自行甄别文档内容的完整性,平台不提供额外的编辑、内容补充、找答案等附加服务。
- 2、"仅部分预览"的文档,不可在线预览部分如存在完整性等问题,可反馈申请退款(可完整预览的文档不适用该条件!)。
- 3、如文档侵犯您的权益,请联系客服反馈,我们会尽快为您处理(人工客服工作时间:9:00-18:30)。
一、什么是信息(Information)?在西方英文中information一词有情报、资料、消息、报道之意,我国大陆曾译为情报或信息,后经国家有关部门核准,统一译成“信息”。
在我国台湾、香港地区,该词被译为“资讯”。
信息是被反映物的属性再现,信息的属性在于表现它物。
也就是说,信息不是事物的本身,而是由事物发出的消息、情报、指令、数据、信号中所包含的内容,是对客观世界中各种事物发出的特征、变化及其相互联系的最新反映。
一切事物包括自然界和人类社会都会产生信息。
一个完整的信息过程,包括信息的传递、接收、贮存、加工和利用。
2、信息具有以下特征:1)普遍性(2)时效性:信息在一定的时间内是有效的信息,在此时间之外就是无效信息。
而且任何信息从信源传播到信宿都需要经过一定的时间,都有其时滞性。
(3)传递性(4)可转换性:信息是可以由一种形态转换成另一种形态。
信息一般有4种形态:数据、文本、声音、图像。
这4种形态可以相互转化,例如,照片被传送到计算机,就把v图像转化成了数字。
(5)可再生性(6)共享性:同一信源可以供给多个信宿,因此信息是可以共享的,且不因共享而减少(7)可识别性:信息是可以识别的,识别又可分为直接认别和间接识别,直接认别是指通过感官的识别,间接识别是指通过各种测试手段的识别。
不同的信息源有不同的识别方法。
(8)可存储性:信息是可以通过各种方法存储的。
二、信息检索广义:将信息按一定的方式组织和存储起来,并根据用户需要找出相关文献的过程。
其中包括存与取两个环节,存即信息存储,是对信息进行收集、标引、描述、及组织,并对其特征化表达集加以整序,形成信息检索工具或检索系统的过程。
取即信息查找,是通过某种查询机制从检索工具或检索系统中查找出用户所需的特定信息或获取其线索的过程。
狭义:仅仅指信息查找的过程。
即取的环节。
三、信息检索的发展1、第一阶段:完全手工检索阶段2、第二阶段:半机械检索系统-机电、光电检索系统的发展阶段3、第三阶段:计算机检索系统的发展阶段4、第四阶段:基于Internet 的网络化检索系统阶段信息资源的分类:1、信息源可分为自然信息源和社会信息源。
2、按信息资源所依附的载体划分(不用全背)(1)体裁信息资源:以人体为载体并能为他人识别的信息资源。
按其表述方式又可分为口语信息源和体语信息源。
口语信息源是人类以口头方式表述但未被记录下来的口语信息,如:谈话、讲课、讲演、讨论、唱歌等。
体语信息源是以人的体态为载体表述出来的信息资源,如:表情、手势、姿态等方式表述的体语信息。
(2)实物信息资源:以实物为载体的信息资源。
又分为自然实物信息源与人工实物信息源。
如:化石、产品、样品等。
(3)文献信息资源:以文字、图形、符号、声频、视频等发生记录在各种载体上的知识和信息资源。
(4)网络信息资源:以网络为纽带连接起来的信息资源和以网络为主要交流、传递、存储的手段与形式的信息资源。
3、按信息资源传递的范围划分:(1)公开信息资源:又称共享信息资源或白色信息资源(white information),指公开发行、流通和传递的信息资源,其蕴涵的信息人人可以使用。
一般来说,公开信息资源的数量最大,而且能够作为信息商品进行流通领域。
(2)半公开信息资源:又称灰色信息资源(grey information),指非公开发行、流通和传递,从常规途径难以获取的信息(内部信息)。
这类信息出版量小,发行渠道复杂,流通传递范围有限,不易收集。
例如:内部的刊物、技术报告、会议资料等。
(3)非公开信息资源:又称黑色信息资源(black information),指人们未破译或未被识别的,也指处于保密状态的信息。
例如:考古发现的古老文字、未解密的政府文件、内部档案、个人日记、私人信件等。
自然信息均属于不可检信息。
超文本型(Hypertext):是用超链结的方法,将各种不同空间的文字信息组织在一起的网状文本。
文献信息资源1、按信息资源所依附的载体的物质形态划分(1)刻写型:包括手稿、日记、信件、原始档案、碑刻等。
(2)印刷型:主要是指以纸张为载体,以印刷为记录手段,把信息内容固化在纸张上的形式。
其优点是便于直接阅读、使用方便,其缺点是较笨重、存储密度低、收藏占用空间大、加工保存等花费人力物力大、识别和提取难以实现机械化和自动化。
(3)缩微型:以感光材料为载体,以缩微照相为记录手段而产生的一种载体形式,如缩微胶卷、缩微胶片等。
其优点是存储密度较大、体积小、便于收藏保存和远距离传递。
缺点是不能直接阅读、需借助缩微阅读机或阅读复印机才能使用。
缩微型一般针对于数量大、利用率低但又有较大保存和利用价值的信息资源。
(4)声像型:以磁性和感光材料为载体,借助特殊的机械装置(如复录机、摄像机、录像机等)直接记录声音、图像信号的信息载体,又称视听资料,如唱片、录音带、录像带、幻灯片、电影片、多媒体资料等。
其优点是可以闻其声、观其形,直观而真切,给人以生动鲜明的印象。
其缺点是制造成本较高,且需要借助于一定的设备才能使用。
2、按信息资源的加工深度和结构等级划分(1)零次文献:指未经过任何加工的原始文献。
如:实验记录、手稿、日记、原始录音、原始录像、谈话记录。
(2)一次文献:未经加工或粗略加工的原始信息资源,以本人的研究成果为基本素材而创作的文献,具体、详尽和系统化。
如期刊论文、专利文献、科技报告、会议录、学位论文等等。
(3)二次文献:它是将大量分散、零乱、无序的一次文献进行进行加工、整理、标引、著录、浓缩,并按照一定的逻辑顺序和科学体系加以编排存储,使之系统化,以便于检索利用。
如:目录、题录、索引、文摘。
具有报道和检索功能。
(4)三次文献:通过二次信息资源提供的线索,对某一范围内的一次信息资源进行分析、研究、加工而成的信息资源,它包括综述、述评、专题情报研究报告、百科全书、年鉴、指南、手册、词典等。
特点:一次文献是最重要的文献,是全部文献的基础。
数量庞大、内容分散、无系统性,不便于管理和传播。
二次文献作为寻找一次文献的指南与向导,能提供多种检索途径(分类、主题、著者、团体著者、会议名称等)。
三次文献可以充分利用反映某一领域研究动态的综述类文献信息,在短时间内了解其历史、动态、水平等。
一次文献是二次文献和三次文献的基础,是文献检索的主要对象;二次文献具有浓缩性,是一次文献的简略及有序化,是文献检索的工具;三次文献具有综合性,既是检索对象,又可提供一定的检索途径与检索手段。
总之,文献经过加工、压缩,从零次信息到三次信息,使科技信息由分散到集中,由无序到有序,由无组织到系统化,由博而精的对知识信息进行不同层次的加工的过程。
信息的不同出版类型划分为:图书期刊科技报告会议文献[C]论题集中、新颖、丰富、专深、学术性强,是了解各国科技发展水平和动向的重要文献来源。
(5)专利文献[P]:(6)技术标准和规范[S]:7)政府出版物(8)学位论文[D]:(9)产品资料(10)技术档案(11)报纸[N]3)科技报告[R] (理解)scientific and technical report :报道(记录)研究工作和开发调查工作的成果或进展情况的一种文献类型。
又称研究报告、报告文献。
出现于20世纪初,第二次世界大战后迅速发展,成为科技文献中的一大门类。
大多与政府的研究活动、国防及尖端科技领域有关,发表及时,课题专深,内容新颖、成熟,数据完整,且注重报道进行中的科研工作,是一种重要的信息源。
查寻科技报告有专门的检索工具。
特点:①反映新的科研成果迅速。
以科技报告形式反映科研成果比这些成果在期刊上发表,一般要早一年左右,有的则不在期刊上发表。
②内容多样化。
它几乎涉及整个科学、技术领域和社会科学、行为科学以及部分人文科学领域。
③保密性。
大量科技报告都与政府的研究活动、高新技术有关,使用范围控制较严。
④报告质量参差不齐。
大部分科技报告是合同研究计划的产物,由工程技术人员编写,由于撰写受时间限制、因保密需要以工作文件形式出现等因素影响,使报告的质量相差很大。
⑤每份报告自成一册,装订简单,一般都有连续编号,出版发行不规则。
通常载有主持单位、报告撰写者、密级、报告号、研究项目号和合同号等。
附:美国四大科技报告(AD,PB,NASA ,DOE )按检索对象的内容区分:(1)文献检索(document retrieval)(2)数据检索(data retrieval)(3)事实检索(fact retrieval)手工检索:以手工操作的方式,利用检索工具书进行信息检索。
手工信息检索是信息检索的传统方式,已经历经了一个多世纪的发展历程。
检索效率高;直接性灵活性好,浏览功能差附:查全率:是指检出的相关文献量与检索系统中相关文献总量的比率,是衡量信息检索系统检出相关文献能力的尺度。
查全率=(检出相关文献量/系统中相关文献总量)*100%查准率:是指检出的相关文献量与检出文献总量的比率,是衡量信息检索系统精确度的尺度。
查准率=(检出相关文献量/检出文献总量)*100%三、按检索对象区分:(1)文本检索:查找含有特定信息的文本文献的检索,其结果是以文本形式反映特信息反映的文献。
这是一种传统的信息检索类型,在信息检索中至今占据主要地位。
(2)多媒体检索:多媒体是指将声音、图像、通信等在内的多种媒体的功能有机结合在一起,并用某种新媒体代替传统媒体的多种媒体。
多媒体检索是指根据用户的需求,对文字、声音、图像、图形等多种媒体信息进行组织、存储从而识别、查找并获取所需信息的过程。
在因特网上存在着大量的多媒体文献,用户常常需要查找特定的声音、图像、动画等。
多媒体文献的信息组织与处理传统文本的处理截然不同,其检索要求和检索途径也别具特色,这是现代信息检索的新课题。
(3)超媒体检索(hyper media retrieval)如果超文本节点中的信息除文本块以外,还有图形、图像、声音、视频等多媒体信息,则称为超媒体(hyper media )。
即存储对象超出了文本范畴,融入了静、动态图像(形)以及声音等多种媒体信息。
(同样具有超文本检索的优点,并且检索内容与形式更为丰富)(1)强相关检索:强调检索的准确性,也称作特性检索。
这种检索注重查准率。
只要检索得到的文献信息能满足用户的需求就行,对于检索结果的数量多少不作要求。
(2)弱相关检索:强调检索的全面性,向用户提供系统完整的信息的检索。
也称族性检索。
这种检索注重查全性,要求检索出一段时间期限内有关特定主题的所有信息。
为了尽可能避免漏检相关信息,对于检索的准确性相对要求较低。
要注意的是,这是两种检索要求比较极端的检索类型。
实际上是介于两者之间,保证一定的查全率和查准率。
按时间跨度(1)定题检索SDI (selective dissemination of information)查找有关特定主题最新信息的检索。