BIBFRAME2.0实施注册2018项目(附UIUC的关联数据来源)

又去LC官网看BIBFRAME2.0实施注册(BIBFRAME 2.0 Implementation Register),2017年7月迄今仅有3项新增或更新,都是2018年的:
(1)Reasonable Graph(2018.2.27更新)
据称是个开源项目,支持广泛的本体模型,已经实现BIBFRAME,希望用于图档博领域。
有一个在线演示,看了没什么感觉。

(2)Ex Libris, Alma(2018.4.24更新)
已完成的是:URI强化MARC记录;可以查看和导出BF格式的书目记录
计划:编辑、导入BIBFRAME记录
参见:
艾利贝斯与哈佛图书馆合作开启“BIBFRAME路线图”(2017-5-12)
2018年BIBFRAME更新论坛(2018-11-14):12月发布的Alma 2017,能够以BF发布整个馆藏

(3)University of Illinois at Urbana-Champaign Library(2018.6.28更新)
UIUC在2015年BIBFRAME 1.0时期就有一个项目,当时是把30万册电子书由MARC转换为BIBFRAME。看样例,外部链接是主题词(id.loc.gov)和创作者(VIAF)。提供4个当时的核心类(作品、实例、注释、规范)的RDF文件。
本次是19世纪英国小说的数字收藏:从Dublin Core转换为BIBFRAME 2.0共7,829项,并使用关联开放数据来增强发现。看样例,外部链接有所扩大:卷册链(Internet Archive电子书),作者(VIAF),DDC(OCLC的DDC概要网站),馆藏链接(机构馆主页,可惜不是OPAC);
因为是小说,没有主题词。提供各卷册(可以算实例)的BIBFRAME 2.0 RDF。

参见:
BIBFRAME 2.0实施注册(2017-4-26)
BIBFRAME 2.0实施注册新增项目(附:意大利SHARE目录)(2017-7-25)

———- UIUC的关联数据来源 ———
UIUC的项目页(最后更新2017.6.24)有Linked Data Sources,抄录如下:
作品标识符:xISBN: Worldcat Work ID(http://xisbn.worldcat.org/xisbnadmin/index.htm)
实例标识符(本地OPAC):University of Illinois at Urbana-Champaign Vu-Find Catalog(vu-find)
BIBFRAME 2.0作品标识符OCLC WorldCat services(https://www.oclc.org/support/services/worldcat.en.html)
BIBFRAME 2.0实例标识符(同上,本地OPAC)
个人名称、团体、地理名称The Virtual International Authority File (VIAF)(http://viaf.org/)
主题
Library of Congress Authority Files (LC/NACO Authority File)(http://authorities.loc.gov/webvoy.htm)
LC Linked Data Service: Authorities and Vocabularies(http://id.loc.gov/)
Faceted Application of Subject Terminology (FAST)(http://experimental.worldcat.org/fast/)
Medical Subject Headings (MeSH) RDF Linked Data(http://id.nlm.nih.gov/mesh/)
研究者与机构
The International Standard Name Identifier (ISNI)(http://isni.org/)
ORCiD(http://orcid.org/)

可与PCC《创制和获取URI:常用词表和参考源指南》对照。参见:
创制和获取URI的常用词表和参考源指南(2018-3-2)

LD4P2走向实施之路:目标与工作(附LD4系列)

LD4P2是Andrew W. Mellon基金会资助的LD4系列的第4个2年期项目(2018-2020),成员为康奈尔大学、哈佛大学、美国国会图书馆?、斯坦福大学和爱荷华大学。本期项目的终级目标是实施,即以关联数据来描述图书馆资源。特别值得注意的是与合作编目项目(PCC)和Wikidata的合作。
先前曾关注项目的7个目标(见下参见),现在已看到2个有所进展,因此再重复记录如下;项目维基网站还有6个工作包,在此一并记录:
Linked Data for Production: Pathway to Implementation (LD4P2)

7个目标:
[1] 由一个学术图书馆的核心小组,创建以BIBFRAME表示的关联数据的连续馈送池
[2] 开发基于云的沙箱编辑环境,以支持扩展的图书馆合伙人创建和重用关联数据【2018.11.1宣布已招募到17家学术图书馆承担子项目:Stanford Libraries announces Linked Data for Production (LD4P) cohort members and subgrant recipients;先前已召开合伙人会议,定下2019.4开始生成数据的目标】
[3] 开发用于使用标识符自动增强MARC数据的策略、技术和工作流程,以便尽可能干净地转换为关联数据
[4] 开发用于创建和重用关联数据及其支持标识符作为图书馆核心元数据的策略、技术和工作流程
[5] 通过与Wikidata的协作,更好地将图书馆元数据和标识符与Web集成【2018.8.27 斯坦福大学为此公开招聘一位驻留维基媒体人:Wikimedian-in-Residence position at Stanford University
[6] 使用基于关联数据的发现技术增强广泛采用的图书馆发现环境(Blacklight)
[7] 通过开发一个名为LD4的组织框架来协调持续的社区协作,确保在分布式发展社区中不断交流思想和技术。

6个工作包:
WP1:Sinopia:基于云的合作编目环境/原编元数据创建环境
WP2:元数据重用(MARC-to-BIBFRAME转换管道+直接使用原生RDF描述)
WP3:链接到外部规范和Web语境数据(标识符URI+Wikidata发布、链接和丰富)
WP4:发现(Blacklight+知识面板+语义搜索+浏览+可视化+微数据)
WP5:原生关联数据描述生产流程(特藏=电影+地图+音乐+唱片:与数字化配套、与Wikimedia链接)
WP6:社区协作(建立LD4社区+2次国际会议)

——— 附:LD4L: Linked Data for Libraries (The Gateway) ———
LD4L 2014 (2014-2016):“创建一个模型,既可以在各机构内部又可以通过一个协调可扩展的关联开放数据网络运作”(100万美元;斯坦福、康奈尔、哈佛)
LD4L Labs (2016-2018):“帮助图书馆使用关联数据来改善对学术资源信息的交流和理解”(150万美元;康奈尔、哈佛、爱荷华、斯坦福)
LD4P (2016-2018):“转变技术服务生产工作流程”(150万美元;斯坦福、哥伦比亚、康奈尔、哈佛、普林斯顿、美国国会图书馆)
参见:重量级图书馆关联数据项目LD4P获得资助(2016-5-10)
LD4P2 (2018-2020):“为编目社区建立一条途径,开始转向关联数据来描述图书馆资源”(400万美元;斯坦福、康奈尔、哈佛、爱荷华)
参见:BIBFRMAE应用进展:LD4P实施之路(2018-7-8)

开发中的图书馆服务平台Folio概览

2018年最后2天,应Keven之邀参加Folio系统界面翻译,跨年和元旦都在刷汉译——仅凭对图书馆自动化系统的了解,对Folio本身则几无所知。人多力量大,demo汉译在元旦那天基本完成。接下来还将参与Codex兴趣小组的活动,于是先来补下课。

一、关于Folio
Folio = Future of Libraries is Open,开源的图书馆服务平台,前身是开发多年的Kuali OLE (Open Library Environment)。2016年前后,Kuali基金会决定转向商业,于是OLE改与EBSCO和Index Data(丹麦)合作,启动Folio。由2016年项目启动时EBSCO中文网站的长篇介绍,可对Folio有更多了解:
隆重介绍 FOLIO – 一项崭新的合作项目,携手图书馆、服务供应商以及开发人员来促进、创新并且重塑图书馆自动化系统的未来 [2016-6-25]

二、平台状况和路线图(Platform & Roadmap)
Folio官网目前发布的路线图如下,不知是否能如期实现:
第1阶段:发布Alpha版,2018年1月
第2阶段:平台发布(Beta版),2019年初
第3阶段:在图书馆运行,期望2019年初至少有3家图书馆实施
第4阶段:早期实施者,11家图书馆计划在2019年实施

三、Folio平台FOLIO Platform
Folio的特点是模块化、灵活性、扩展性。
任何人可以开发Folio App。现在有十几个设想,比如App设想第3号预约房间、第6号与图书馆活动和网站集成、第8号与机构库集成、第13号支持联合目录。

四、资源管理数据域Resource Management Data Domains
对图书馆实体与电子资源的管理模型,包括以下6个域(图示是简化版):

Resource Management Data Domains

Folio法典域(Folio Codex Domain),由一组最小但足够的核心元数据集组成,更全面的元数据集在动态检索时调用。
知识库域(Knowledge base (KB) Domain):电子资源、印刷资源及其他资源等多种知识库(托管系统中,对实体资源,感觉像是类似联合目录的中心书目库)
馆藏域(Holdings Domain):电子资源的权益/馆藏(Entitlement/Holding),可能与知识库中包(Package)的收录范围等不一致。
采访域(Acquisition Domain):图示中只对电子资源作了标示(省略了实体资源),主要为说明电子资源采访产生的馆藏,可能与知识库中包的收录范围等不一致。
库存域(Inventory Domain):法典域对应的实体资源部分
流通域(Circulation Domain):包括用户借阅实体资源与使用电子资源
Folio的关键假定
1、合并电子和印刷;
2、合并单行和连续出版物;
3、库存和知识库(见上);
4、本地与远程。本模型的主要目标是避免元数据的本地复制。只要有可能,就应该对权威记录进行引用(即链接)。本地系统应仅保留与该单件相关的最小核心元数据集。每当需要完整、丰富的元数据集时,应从权威源(例如知识库)动态检索这些元数据。 此外,本地保留的核心元数据应仅在需要时存在于本地Folio系统中。对于电子单件,这意味着只有在访问单件时才会出现本地占位符。 换句话说,它是将权益(潜在馆藏)转换为实际馆藏的访问权,然后可以在本地Folio系统中表示。
我的理解,法典域是面向读者的检索结果一览信息,详细页面信息由动态调用获取。联想一下——不需要每个馆都维护更新数据,只需要大家共同维护、系统来做更新,是不是很美好?

五、法典元数据模型Codex Metadata Modal
Codex Metadata Modal
Codex是一个规范化和虚拟化层,允许Folio集成有关各种资源的元数据,无论其格式、编码或存储位置。
目前仅包含棕色的5个对象:实例、单件/馆藏、收录范围、位置、包;未来还会增加,确定将增加的是蓝色的2个:作品、主题。目前看各对象包含的字段并不多,应该就是前述法典域所称的元数据核心集。
本模型受BIBFRAME2启发(作品-实例-单件),但并不严格遵循BIBFRAME2(BIBFRAME 2 模型只针对单个资源,没有“包”的概念)。
另关于MARC,MARC记录格式被Folio用作数据交换格式——回归MARC(尤其是UNIMARC)的原始设计。其实现在的图书馆自动化系统、尤其是支持非MARC编目的系统,MARC的作用恐怕也是如此。
我想对Folio来说,这也意味着未来BIBFRAME或其它元数据也可以经crosswalk转换后,纳入到系统中。