登陆注册
9664100000017

第17章 内容的表达和元数据(1)

内容管理系统的核心是它管理的内容对象。内容管理的主要任务是在对象的生命周期内优化内容的处理和开发。对象的生命周期是指从内容的获取、制作、传输,到归档和存储的过程。内容对象在系统中怎样存储和表示对于检索和应用处理是至关重要的。然而内容的表示并不只与内容对象本身有关,还与内容对象所处的使用环境有关。因此,内容的表示模型应该考虑到这个因素,从而提供一个内容数据和信息的各种处理过程的抽象。

元数据是内容管理系统中不可或缺的部分,它被定义为“有关数据的数据”。元数据在从不同方面描述内容对象时考虑了不同的观点、方面、工作流、处理程序和存在的信息模型,这对于在需要时随时管理、搜索、查找、检索内容信息是很重要的。因此,内容的描述和描述的质量对内容管理系统提供快速便捷的查找内容的能力是很重要的。元数据要考虑不同的用户角色和与系统的交互运行,以及提供相应的视图。理想的内容管理系统支持所有的原始材料进入系统的创建处理过程和描述过程,以及所有相关工作和内容的分配、处理过程。这种情况下需要考虑的不仅是与内容的直接交互工作,还包括相关领域,如统计计算、权限管理和程序计划。

除了纯粹的描述和检索以外,元数据还管理着内容的内部组织和对外组织关系方式。因此,优化实际的交换和信息的转译交换都需要一定的标准。因为标准通常只提供大致的共同特征说明,标准本身并不能提供个体组织所需要的具体功能支持。因此,标准只能覆盖对于具体功能和主题背景很重要的特定方面。

目前已经开发出了很多数据模型、内容描述方案以及内容的表示和描述的参考模型。它们通常从不同角度描述内容,因此不是完全可比较的。不存在通用的内容描述方案。在内容管理系统中,针对不同方面的应用要使用不同的内容表示方案。本章给出了根据不同环境描述内容的概念。接下来介绍了元数据的结构和元数据方案应该捕获的信息。本章还介绍了元数据的交换和数据模型,介绍了许多主要表示模型和描述方案,以及元数据的编码和交换协议,给出了该领域目前的发展概况。另外,本章还说明了目前在不同环境下表示元数据的不同方法。具体方案或者模型的适合程度还要视其在具体实例中的使用情况而定,本章的讨论将有助于形成这种评价。

4.1内容的表示

内容对象的核心是素材,即包含实际信息或思想的部分。然而有时候内容的信息比内容对象本身还要重要,例如有关内容的所有管理任务。甚至在生产工作流中具体的元信息(元数据、摘要和低码率的素材版本)要比内容对象本身更重要(2.2.1节)。在这种情况下就需要选择适当的方法和适合的元数据,以表示对与内容对象有关的各种工作流和管理程序给予最好的支持。尽管数据模型、内容表示和工作流的详细信息根据不同的内容和不同的组织而不同,但是主要的内容特征和用例是大致相同的。

媒体对象(视频、音频轨道、图片等)可以被表示成为所谓的“代理”。代理对应于基于特定环境的特定方面的内容的具体视图。代理更加强调特定特征,表示特定视图或可视化的具体属性,因此更容易访问。代理可以有不同的媒体形式。视音频内容可以用多媒体代理来表示(综合使用不同媒体类型来表示)。其他代理有:摘要、编辑决策列表(Edit Decision List, EDL)、数据库记录等。

纯文本代理是有关内容的文档,包括摘要、产品文档(如产品单)、校本、EDL、日志文件(例如和时码有关的文本转换语句和注解)、合约、法律文档等等。这一组代理包含了一般文本中表示内容或者内容的特定部分的所有文档类型,可以对这些文档建立索引以便查找。

数据库代理是存储于数据库管理系统(Database Management System, DBMS)的全部内容的表示。DBMS的特性是可以管理巨大数量的数据。内容对象被表示成为一种抽象模型,称为“数据模型”。数据模型存储于数据库中。所有相关特征由一个结构化文本表示器来采集,它能够优化简便查找,并重新按照属性查找。文本和数据库代理通常和元数据有关。元数据定义为描述核心创作媒体对象数据的数据,这种媒体对象包含创作者需要传递的实际信息。

多媒体代理是表示如低码率副本、视听摘要和不同媒体类型的组合内容的表示方法。内容的低码率副本可以不用实际接触材料就能预览,因此能在窄带宽的链接上传输,在低配置的设备上输出。视听摘要是视听内容的组合,这些摘要通过显示素材的一部分而提供了素材的纵览,典型代表有关键帧或浏览。视听摘要通常通过自动分析程序自动提取和编译。不同媒体类型的组合可以通过链接文本、图片视频和视听信息提供实际内容的更好的总览。例如,情节串联图板就是包含内容描述信息和片断的关键帧和时码的组合,还有与低分辨率素材副本有关的文字材料等。如果内容对象是连续媒体类型,那么不连续的媒体内容表示部分也有与内容对象时码有关的时间参数。

广义的多媒体代理可以被看做是元数据,它们有附属的特征而且主要对象是优化内容的表述和检索。多媒体代理的文本部分显然是元数据描述内容对象的一部分。可视化摘要也有描述的特性。然而,低码率内容副本则是不带有描述信息的对素材的表示。

4.2元数据:内容的描述

元数据用来描述内容并在系统和系统组件中表示内容,它要遍布整个媒体制作的工作流程,从预制作到存档。另外,它还要容纳权限不同及对内容不同方面感兴趣的不同用户组。因此,对于内容的描述,有不同的方面和目的。

元数据最初在计划阶段产生,在内容对象的整个生命周期内被使用和不断修正。使用元数据的阶段有:生产、传输、媒体管理和其他开发过程。元数据要捕捉程序计划、生产计划(包括原材料、个人计划和相关贡献的参考),还有计划阶段的编辑准备(绘制、调查、收集和情节串联)。元数据应用的其他程序和用例包括:文档撰写、IPR、许可证、分析数据和位置相关数据(存储管理、位置ID等)。另一组元数据是有关内容的使用和开发的,通常这部分包括传输历史记录、程序交换和程序材料的数据和内容销售的信息(市场信息)。新一类的元数据是有关在互联网上使用的内容的数据,此时的数据记录是有关历史访问记录、负责人员(版主或者编辑者)等方面的。

元数据必须捕获和描述过多的特征和工作流,因此存在处理元数据的不同方案和(子)系统。元数据可以根据它所描述的实体来进行分组,有关于对象和关于片段的元数据。关于对象的元数据包括所有以描述媒体对象的特定特征为主题的元数据,而关于片段的元数据用于描述由于空间或时间界限(如图片边界和时码)所分割的内容对象的一个部分。

4.2.1关于对象的元数据

关于对象的元数据将内容对象作为一个整体描述。部分关于对象的元数据是内容描述(主题、作者、导演等)、相关组织数据(如项目位置、责任编辑办公室等信息)、内容标识和参加团体(处理内容的个人或组织,及其关系、角色和权利)。另外,关于内容的元数据包括技术元数据和所有商业过程(包括媒体制作的所有工作流步骤)。

关于对象的元数据通常存储在数据库中,有时也存储在结构化文件中,以全文检索引擎建立索引,以便于检索。内容对象的相关文档(如注解和合同)也可以以电子形式存储和建立索引来方便搜索。当文档需要像元数据一样存储于硬盘上时(如文章的法律文件),这些文档的相关资料可以(有时是必须)存储于内容管理系统的数据模型之中。

4.2.1.1工作流和内容描述

为了便于内容管理,内容的特征要被获取为结构化元数据。这可以使用描述对象(实体)本身和对象间链接的提取程序来完成。此时,工作流是要考虑的最主要的处理过程。元数据通过工作流被合成,因此,这些工作流定义了内容生命周期特定点所产生的元数据。然而,元数据的产生和标记是由系统定义的。本节介绍一些一般的与内容管理有关的工作流(如内容获取和解析、制作、存储以及归档)。具体的分析需要根据实际的组织及其系统和工作流才能进行,这需要在处理内容的系统中独立进行。

元数据可能在生成的时候就被处理并联系到一部分素材上。记录的位置(比如通过GPS得到的)、日期、时间等信息在产生记录时就自动与材料相关联了。然而,通常在输入和解析过程中,内容进入系统,元数据与内容对象建立关联。

理想情况下,大多数在这个过程中加入的元数据被自动处理。这些信息有:材料相关参数和自动分析程序检索的数据。这个过程中收集到的元数据被编入元数据集合,这些集合的结构有赖于特定系统的实际数据模型。

在查找阶段收集的典型元数据主要是与材料相关的,包括:

·视频源格式。

·视频压缩格式。

·音频源格式。

·音频压缩格式。

·记录参数(摄像和话筒设置)。

·生产信息。

在上载过程中,加入元数据可以用来标识内容,同时也用来支持快速检索和提供一个初始水平,该信息通常要手动输入系统。上载过程中加入的典型的元数据有:

·生产序号。

·标题。

·日期、时间和位置。

·源名(如机构名称、摄像者等)。

·剪辑描述(画面内容的文本摘要)。

·起始或结束标志(磁带或文件的剪辑)。

·拍摄质量。

不同的系统、部门和用户都参与了制作过程,这表现在其产生、引用和用来检索的元数据中。这些不同的系统有服务器组件(上载、制作和播出服务器)、制作条目的记者和编辑、最终内容条目的编辑、提供材料的归档和编目的归档部门。在所有这些处理过程中,额外的元数据被制作出来,并且与内容对象相关联起来。下面的元数据集即表现了后期制作和非线性编辑的典型的关于对象元数据集的例子:

·文献开始或结束。

·时码。

·副标题。

·授权信息。

·电子VTR卡。

·剪辑者、编辑者和制作人的名字等。

附加元数据可能被制作和搜集在另外的元数据集合中,如编辑集合、传输集合、描述集合等等。这些元数据集合更加明确地指向具体的任务和工作流步骤。

一旦材料被制作好之后就可以被分发播出。在广播系统中,分发播出是根据节目单进行的,并且被记录在播出节目(Program as Broadcast, PasB)中,此时相关数据有:

·首播日期。

·首播时间。

·播出频道。

·统计信息(观众或听众数量)。

·重播信息。

内容条目的生命周期最后一步是分类和深层编目。在这一步中,内容被分类和详细描述,以便查找、访问和复用。在制作过程中,添加的元数据在这一步中被修正和整合。应用的分类方案有赖于媒体类型和具体组织结构。这个过程中添加的典型数据有:

·目录表。

·编目时间。

·题目分类。

·节目关系。

·摘要。

在这一步产生了详细的内容描述,也就是关于片段元数据的一部分。

4.2.1.2关于权利的元数据

知识产权(Intellectual Property Rights, IPR)是关于对象元数据的一种特殊类型,它和内容的开发以及内容管理过程有紧密联系。然而,IPR通常是在内容管理系统之外的独立的版权管理系统中被管理,这是由于内容管理系统还没有覆盖到复杂组织的结构和法律领域。版权管理系统维护着IPR体系、合同信息和其他与内容对象有关的法律文档。版权管理系统管理的信息要和内容管理系统中内容对象的信息联系起来。

IPR描述了特定内容对象的所有权和使用限制。这些权限有可能很复杂,通常需要专业人士的解释。该版权有所有权(作者、作曲者、导演、摄影师等)、演出权(演员、音乐家等)、个人版权和其他很多版权。在使用(重用)作品时要充分考虑版权拥有者的具体权利。因此要妥善保管内容对象的法律文档并及时更新。

除了要考虑所有权、用户限制之外,还要考虑以下版权:

·地域限制(通常指地理限制)。

·传输和传播方法(通过电视、电影、广播和网络)。

·传输和传播时间(先于或后于某一天)。

·使用期限。

·用户(传输者)数量。

不仅要注意内容管理系统中和数据有关的某些基本版权,还应该注意在内容对象中享有其他版权的对象内容。然而,因为组织和法律原因,这些只能是象征性的。内容管理系统的用户要从法律部门得到更多有关版权的信息,以便在能用到内容的情况下保证尊重所有的版权。

同类推荐
  • 财政干部应用文写作

    财政干部应用文写作

    为全面提高基层财政干部的阅读理解应用文书的能力、沟通讲话能力和写作表达能力,建构应用文写作知识体系,使财政干部能正确、有效地履行岗位职责,提升财政公务活动的执行力,以适应财政改革与发展的需要,我们根据《财政部2010年关于开展乡镇财政干部培训工作的通知》(财预[2010]58号)精神和《四川省财政厅关于加强乡镇财政干部岗位培训的指导意见》的要求,按照财政干部的认知规律、应用文写作教学规律和基层财政工作实际编写本教材。
  • 学与教的变革

    学与教的变革

    本书是《当代课程与教学新视界》丛书之一,内容涉及作者多年来结合先进的教育理论进行探索的主题,主要有脑科学指导下的教学原理,珠心算实验的理论与实践,小班化教学,成功智力理论的应用,教育叙事的方法崛起。
  • 大国思维:破解深藏于大国的思维奥妙

    大国思维:破解深藏于大国的思维奥妙

    中国的国际地位和国家形象正在发生怎样的变化?中国在未来的国际格局中将会扮演怎样的角色?中国如何像宣扬的那样,成为主导世界的“英雄国家”?《大国思维》从具体的故事和新闻案例入手,没有抽象的概念,全是一些实际可感的素材和辩论性话语、直率的谈论,可谓一本呼吁“正视内政的愤懑”,“要做英雄国家”的“复兴宣言”。
  • 营销文案写作范本

    营销文案写作范本

    本书分15章,共100多种文体,详细阐述了市场调查文案、市场营销计划文案、新产品开发与推广文案、价格文案、营销渠道管理文案、促销与推广文案、推销文案、广告策划文案、公关文案、营销人员管理文案、客户管理文案、零售店营销文案、国际营销文案、谈判文案、合同文案、等内容。这些文案集中体现了企业营销观点、经营理念和策略方法。
  • 想爱

    想爱

    每个人的情感都是一株葱郁的植被,需要用爱灌溉生长,想爱,为你揭秘情感世界。
热门推荐
  • 千年仙万年魔

    千年仙万年魔

    炼器宗太上长老,用三百年时间终于祭炼出传说中的神器,殊不知,等待他的是神器破灭,自身死亡。千年修仙终过不了仙劫,那我还修仙干什么?如果有来生,我定要成魔,千年修仙,不如万年为魔。(新书上传,绝对爽文,嫌瘦先收藏,肥了再来,顺便推荐一下咯……)
  • 恶魔书

    恶魔书

    黑暗中,隐藏着光明,光明照到的地方,也总会有阴影伴随,无论你是否相信,恶魔确实存在,如果你感到害怕,那么说明,它已经悄然到来。
  • 宸诛玄霄

    宸诛玄霄

    古有修炼之途,进形境,看澈灵,石雷定,达琨皇境者万里挑一,凝师万里挑一中万里挑一。家道中落,小小年纪的他能否挑起如此重担,他不懂得年少轻狂却知道胜者为王;养尊处优,从小无忧无虑的她能否力挽狂澜,帮助蓝颜踏上强者之途;站在王者之途的最前线,准备踏过道路的荆棘;放眼天下等着他去征服;看宿敌和他赛跑,风雨和他狂飙,皇者之途自己打造;触碰远在蓝天的皇者之梦,心脏为梦想而跳动;让世界为他骄傲,大地为他欢呼,蓝天为他炫耀;所有的血泪、痛苦的煎熬,成为他身上光荣的烙印。
  • 新兰:见证爱情

    新兰:见证爱情

    新兰同人文她是身份成谜的离奇穿越者,陪新兰一起走下去,守护她的angel,见证独属于他们的甜蜜爱情……
  • 福妻驾到

    福妻驾到

    现代饭店彪悍老板娘魂穿古代。不分是非的极品婆婆?三年未归生死不明的丈夫?心狠手辣的阴毒亲戚?贪婪而好色的地主老财?吃上顿没下顿的贫困宭境?不怕不怕,神仙相助,一技在手,天下我有!且看现代张悦娘,如何身带福气玩转古代,开面馆、收小弟、左纳财富,右傍美男,共绘幸福生活大好蓝图!!!!快本新书《天媒地聘》已经上架开始销售,只要3.99元即可将整本书抱回家,你还等什么哪,赶紧点击下面的直通车,享受乐乐精心为您准备的美食盛宴吧!)
  • 瑾夏蓝年

    瑾夏蓝年

    前世,一心呵护的妹妹与男友上了床,还狠心将她刺死。再次睁眸,已然变成北焰国众人口中一无是处的废物。本想冷情冷心度过这一世安好,却不料邪魅如他竟慧眼独到缠上了她。她问,“娶我,你不后悔吗?”他笑,宛如九天外的神祗。“我们,只会有后,不会有悔。”
  • 最后一双灵瞳

    最后一双灵瞳

    我叫陈宇,我有一双灵瞳,也是最后一双灵瞳。
  • 烟花痣

    烟花痣

    兵临城下,她成了进献苍狼的祭品;屠城逼婚,她成了代嫁求和的替身。同根并蒂莲,双生帝女花。一个错承恩宠,情入骨髓;一个颠沛辗转,沦落风尘。如果命里没有第二次相遇,贴在心口的思恋始终甘之若醴。如果没有固执地拥她入怀,他亦无缘翻开那段苦苦隐瞒的曾经。侵略如火,裹在掌下的小痣犹如叛逆的蓓蕾惊醒了雪夜里的那场宿醉,问情归处,心已成魔。。。。。。
  • EXO之异能者的邂逅

    EXO之异能者的邂逅

    “原来你真是圣樱学院的异能者?!”“你为什么不告诉我们?”“你知道吗?哪一方拥有了你,那一方就赢了!”“什么?这件事情还有第三方介入?”“她暴走了!”“为什么两校要合并?你搞的鬼?”“现在十二个人要合体?”“这些,是你精心谋划好的?”“我该叫你什么呢……王者?”“原来你的内心还藏着一个不为人知的秘密……”“她,到底经历了什么?”这个异能世界的故事,就从她和十二个少年中奇妙地展开了······
  • 水浒天下

    水浒天下

    与传说中的英雄置身同一世界,他们将如何相处,他拥有了自己的事业,3个如花美眷的美妻,几百号把自己当做大哥的兄弟,他也不得不直面生死困难……