开放WEMI(openWEMI)提案发布

都柏林核心(DCMI)上月发布openWEMI接受评审。

openWEMI是一个RDF词表。如名称所示,基于国际图书馆协会联合会(IFLA)1997年《书目记录功能需求》(FRBR)首次引入的“作品、内容表达、载体表现、单件”(WEMI为其首字母缩略)概念。但openWEMI不考虑图书馆目录功能,定义了一组可在各种环境中使用的最小约束的类和属性,期望其他元数据模型能将openWEMI元素用作所定义的更具体资源类型的超类和超属性。【或许能像同样脱胎于图书馆界的都柏林核心(DC)那样,在互联网元数据中得到广泛应用】

相关链接:

openWEMI 词表定义了5个类(《入门》中有6个),其中Endeavor类来自2005年的FRBR Core,是WEMI的上级类【可作为属性的定义域/值域(WEMI中的多个)】,可在省略WEMI中任何一个时宽松使用:

  • Endeavor(一种创作)
    • Work(艺术或智力创作的抽象概念)
    • Expression(一种可感知的创作形式)
    • Manifestation(创作的物理体现)
    • Item(创作的示例)
  • ResponsibleEntity(《入门》:对创作负有一定责任的行为者)

openWEMI 词表定义了16个属性,可分为4组:责任关系、主要关系、共同关系、相关关系

相关关系:可以很宽松地认定。

共同关系:FRBR没有,指示两个资源表示或包含相同的 openWEMI 实体。

主要关系(内在关系),与FRBR不同之处在于,openWEMI不是 W—E—M—I 环环相扣的,可以省略中间层,如下图,可以W-E-I或W-M-I等(出自:openWEMI Primer):

主要关系

扩展都柏林核心:学术资源应用纲要(DC-SRAP)

2021年初,芬兰国家图书馆(NLF)提出为描述学术资源而扩展都柏林核心(DC),开发“学术资源应用纲要”(SRAP或DC-SRAP)。

NLF的理由是:DC常用于描述学位论文和高等教育机构的其他资源,用于存储并通过其机构存储库提供。但DC元数据术语本身不包含对这些资料进行简单描述所需的所有核心元数据元素,因此出现了不同的本地扩展。由此产生的负面影响包括:为相同目的开发多个模型所涉及的重复工作,工具(编目和搜索、指南)需要额外的开发工作,减少了使用不同模型创建的元数据之间的语义互操作性,DC元数据术语的实用性降低。为使DC成为一个更有价值的工具,促进DC用于学术著作的描述,NLF建议开发学术资源应用纲要(SRAP)。NLF认为,采用SRAP不仅将使DCMI元数据术语的扩展能够利用新增属性,完善许多现有属性的语义,而且还能减少开发其他本地学术著作的需求(Scholarly resources and Dublin Core, 2021-1-8)。建议并附上了SRAP草案(目前是2021-07-19的版本0.76)【访问Google文档

SRAP主要开发者是2位NLF的DCMI成员Juha Hakala和Osma Suominen。日前在GitHub上放出了新的SRAP草案:

都柏林核心元数据倡议学术资源应用纲要(2022-10-6 草案)

Dublin Core Metadata Initiative Scholarly Resources Application Profile (SRAP) (Draft 2022-10-06)

当前版本针对学术论文、学位论文等,暂不包括研究数据,但有相关代码、相关数据集等属性。学术论文,增加了编者、资助者、资助号,发布状态(公开草案、预印本、印后本、出版、更新出版)及相关日期(如手稿收到日期、撤回日期等),呈现于(会议)等;学位论文,增加了隶属关系、导师、评审者、答辩主持人等。

新增属性除扩展DC外,还有来自现有词表:

Affiliation 隶属关系,schema.org属性https://schema.org/affiliation

Date retracted 撤回日期,Fabio元数据术语http://purl.org/spar/fabio/hasRetractionDate

以及MARC21关系词(MARC relator)

Editor 编者:https://id.loc.gov/vocabulary/relators/edt

Funder 资助者:https://id.loc.gov/vocabulary/relators/fnd

Degree supervisor 学位导师:http://id.loc.gov/vocabulary/relators/dgs

Opponent 评审者:http://id.loc.gov/vocabulary/relators/opn

Praeses 主持人/答辩主席:http://id.loc.gov/vocabulary/relators/pra

然而,美国国会图书馆(LC)的MARC 21关系词属于责任者(creator / contributor)的角色,在定义上是SKOS概念(名词)、用于取值(宾语),并非属性(动词、谓语)。Karen Coyle在BIBFRAME邮件组提出“LC关系词作为属性”的问题(LoC Relators as Properties),其中特别提到RDA将关系词定义为“行为者”属性【新RDA将原“关系说明语”改为“属性”】,瑞典国家图书馆也基于LC关系词创建相应的属性列表。从讨论看,大家都赞同将关系词作为属性;但LC在BIBFRAME实现中仍使用关系词作为角色概念。

[update 2022-12-5] LC的Kevin Ford于12月2日在邮件组中回复,说明LC同时声明关系词为取值和属性,但属性声明由于不明原因删除,现已恢复。

对回复邮件的理解后简述如下(含个人理解,不保证符合原意):

约2017年,LC和DCMI把[行为者]关系词映射到dc:contributor[作为下位属性]。2010年LC发布关联数据服务ID.loc.gov,关系词同时发布为取值[MADS规范+SKOS概念]与属性[RDF+OWL],但不知何时属性声明被误删、现已恢复。LC作过测试,认为既作为名词[主语/宾语=取值]也作为动词[谓语=属性]没有问题。BF的关系词由1.0属性到2.x变为对象(间接方法),主要原因是可以对关系做更多陈述,如同schema.org引入角色[作为对象](可以连接不同属性)。对于LC双重定义的资源,[是作为取值还是作为属性],社区可以各取所需。

ISO 15836:都柏林核心元数据元素集

都柏林核心元数据元素集作为ISO标准,第一部分出版于2017年,第二部分2019年12月出版。DCMI官网尚未更新信息,列出的最近更新标准有三:

ISO网站上标准是要付费的。但看介绍,内容来自官网2012年的DCMI Metadata Terms

  • 命名空间/elements/1.1/ ,包含15个核心元素(第2节),在ISO 15836-1:2017
  • 命名空间/terms/,包含属性(第3节)和类(第6节),在ISO 15836-2:2019
  • 后者也包含15个核心元素,但/terms/命名空间中的元素规定了定义域和值域,因而语义较窄。
  • ISO 15836不包括DCMI Metadata Terms的第4节词表编码体系(Vocabulary Encoding Schemes,VES)、第5节语法编码体系(Syntax Encoding Schemes,SES)、第7节类型词表(DCMI Type Vocabulary)和第8节与DCMI抽象模型相关的术语。
  • ISO 15836中的元素、属性和类都有URI,可用于关联数据

DC的属性包括核心元素和以前归在扩展或限定的元素。近年看到采用DC属性的研究/应用,也许是因为属性基本上没有规定定义域,所以少见采用相应类。以下将“类”粗略分组列出(缩进为下位类或实例,括号内为对应属性,标*者无对应属性):

BibliographicResource*,PhysicalResource*

AgentClass(audience,educationLevel,mediator值域)

  • Agent(实例)(contributor,creator,publisher,rightsHolder值域)

LocationPeriodOrJurisdiction(coverage值域)

  • Jurisdiction*
  • Location(spatial值域)
  • PeriodOfTime(temporal值域)

MediaTypeOrExtent(format值域)

  • MediaType
    • FileFormat*
    • PhysicalMedium(medium值域)
  • SizeOrDuration(extent值域)

Frequency(accrualPeriodicity值域),MethodOfAccrual(accrualMethod值域),Policy(accrualPolicy值域)

LicenseDocument(licence值域),RightsStatement(rights,accessRights值域),ProvenanceStatement(provenance值域)

LinguisticSystem(language值域),MethodOfInstruction(instructionalMethod值域),Standard(conformsTo值域)