登陆注册
3289000000017

第17章 内容的表达和元数据(1)

内容管理系统的核心是它管理的内容对象。内容管理的主要任务是在对象的生命周期内优化内容的处理和开发。对象的生命周期是指从内容的获取、制作、传输,到归档和存储的过程。内容对象在系统中怎样存储和表示对于检索和应用处理是至关重要的。然而内容的表示并不只与内容对象本身有关,还与内容对象所处的使用环境有关。因此,内容的表示模型应该考虑到这个因素,从而提供一个内容数据和信息的各种处理过程的抽象。

元数据是内容管理系统中不可或缺的部分,它被定义为“有关数据的数据”。元数据在从不同方面描述内容对象时考虑了不同的观点、方面、工作流、处理程序和存在的信息模型,这对于在需要时随时管理、搜索、查找、检索内容信息是很重要的。因此,内容的描述和描述的质量对内容管理系统提供快速便捷的查找内容的能力是很重要的。元数据要考虑不同的用户角色和与系统的交互运行,以及提供相应的视图。理想的内容管理系统支持所有的原始材料进入系统的创建处理过程和描述过程,以及所有相关工作和内容的分配、处理过程。这种情况下需要考虑的不仅是与内容的直接交互工作,还包括相关领域,如统计计算、权限管理和程序计划。

除了纯粹的描述和检索以外,元数据还管理着内容的内部组织和对外组织关系方式。因此,优化实际的交换和信息的转译交换都需要一定的标准。因为标准通常只提供大致的共同特征说明,标准本身并不能提供个体组织所需要的具体功能支持。因此,标准只能覆盖对于具体功能和主题背景很重要的特定方面。

目前已经开发出了很多数据模型、内容描述方案以及内容的表示和描述的参考模型。它们通常从不同角度描述内容,因此不是完全可比较的。不存在通用的内容描述方案。在内容管理系统中,针对不同方面的应用要使用不同的内容表示方案。本章给出了根据不同环境描述内容的概念。接下来介绍了元数据的结构和元数据方案应该捕获的信息。本章还介绍了元数据的交换和数据模型,介绍了许多主要表示模型和描述方案,以及元数据的编码和交换协议,给出了该领域目前的发展概况。另外,本章还说明了目前在不同环境下表示元数据的不同方法。具体方案或者模型的适合程度还要视其在具体实例中的使用情况而定,本章的讨论将有助于形成这种评价。

4.1内容的表示

内容对象的核心是素材,即包含实际信息或思想的部分。然而有时候内容的信息比内容对象本身还要重要,例如有关内容的所有管理任务。甚至在生产工作流中具体的元信息(元数据、摘要和低码率的素材版本)要比内容对象本身更重要(2.2.1节)。在这种情况下就需要选择适当的方法和适合的元数据,以表示对与内容对象有关的各种工作流和管理程序给予最好的支持。尽管数据模型、内容表示和工作流的详细信息根据不同的内容和不同的组织而不同,但是主要的内容特征和用例是大致相同的。

媒体对象(视频、音频轨道、图片等)可以被表示成为所谓的“代理”。代理对应于基于特定环境的特定方面的内容的具体视图。代理更加强调特定特征,表示特定视图或可视化的具体属性,因此更容易访问。代理可以有不同的媒体形式。视音频内容可以用多媒体代理来表示(综合使用不同媒体类型来表示)。其他代理有:摘要、编辑决策列表(Edit Decision List, EDL)、数据库记录等。

纯文本代理是有关内容的文档,包括摘要、产品文档(如产品单)、校本、EDL、日志文件(例如和时码有关的文本转换语句和注解)、合约、法律文档等等。这一组代理包含了一般文本中表示内容或者内容的特定部分的所有文档类型,可以对这些文档建立索引以便查找。

数据库代理是存储于数据库管理系统(Database Management System, DBMS)的全部内容的表示。DBMS的特性是可以管理巨大数量的数据。内容对象被表示成为一种抽象模型,称为“数据模型”。数据模型存储于数据库中。所有相关特征由一个结构化文本表示器来采集,它能够优化简便查找,并重新按照属性查找。文本和数据库代理通常和元数据有关。元数据定义为描述核心创作媒体对象数据的数据,这种媒体对象包含创作者需要传递的实际信息。

多媒体代理是表示如低码率副本、视听摘要和不同媒体类型的组合内容的表示方法。内容的低码率副本可以不用实际接触材料就能预览,因此能在窄带宽的链接上传输,在低配置的设备上输出。视听摘要是视听内容的组合,这些摘要通过显示素材的一部分而提供了素材的纵览,典型代表有关键帧或浏览。视听摘要通常通过自动分析程序自动提取和编译。不同媒体类型的组合可以通过链接文本、图片视频和视听信息提供实际内容的更好的总览。例如,情节串联图板就是包含内容描述信息和片断的关键帧和时码的组合,还有与低分辨率素材副本有关的文字材料等。如果内容对象是连续媒体类型,那么不连续的媒体内容表示部分也有与内容对象时码有关的时间参数。

广义的多媒体代理可以被看做是元数据,它们有附属的特征而且主要对象是优化内容的表述和检索。多媒体代理的文本部分显然是元数据描述内容对象的一部分。可视化摘要也有描述的特性。然而,低码率内容副本则是不带有描述信息的对素材的表示。

4.2元数据:内容的描述

元数据用来描述内容并在系统和系统组件中表示内容,它要遍布整个媒体制作的工作流程,从预制作到存档。另外,它还要容纳权限不同及对内容不同方面感兴趣的不同用户组。因此,对于内容的描述,有不同的方面和目的。

元数据最初在计划阶段产生,在内容对象的整个生命周期内被使用和不断修正。使用元数据的阶段有:生产、传输、媒体管理和其他开发过程。元数据要捕捉程序计划、生产计划(包括原材料、个人计划和相关贡献的参考),还有计划阶段的编辑准备(绘制、调查、收集和情节串联)。元数据应用的其他程序和用例包括:文档撰写、IPR、许可证、分析数据和位置相关数据(存储管理、位置ID等)。另一组元数据是有关内容的使用和开发的,通常这部分包括传输历史记录、程序交换和程序材料的数据和内容销售的信息(市场信息)。新一类的元数据是有关在互联网上使用的内容的数据,此时的数据记录是有关历史访问记录、负责人员(版主或者编辑者)等方面的。

元数据必须捕获和描述过多的特征和工作流,因此存在处理元数据的不同方案和(子)系统。元数据可以根据它所描述的实体来进行分组,有关于对象和关于片段的元数据。关于对象的元数据包括所有以描述媒体对象的特定特征为主题的元数据,而关于片段的元数据用于描述由于空间或时间界限(如图片边界和时码)所分割的内容对象的一个部分。

4.2.1关于对象的元数据

关于对象的元数据将内容对象作为一个整体描述。部分关于对象的元数据是内容描述(主题、作者、导演等)、相关组织数据(如项目位置、责任编辑办公室等信息)、内容标识和参加团体(处理内容的个人或组织,及其关系、角色和权利)。另外,关于内容的元数据包括技术元数据和所有商业过程(包括媒体制作的所有工作流步骤)。

关于对象的元数据通常存储在数据库中,有时也存储在结构化文件中,以全文检索引擎建立索引,以便于检索。内容对象的相关文档(如注解和合同)也可以以电子形式存储和建立索引来方便搜索。当文档需要像元数据一样存储于硬盘上时(如文章的法律文件),这些文档的相关资料可以(有时是必须)存储于内容管理系统的数据模型之中。

4.2.1.1工作流和内容描述

为了便于内容管理,内容的特征要被获取为结构化元数据。这可以使用描述对象(实体)本身和对象间链接的提取程序来完成。此时,工作流是要考虑的最主要的处理过程。元数据通过工作流被合成,因此,这些工作流定义了内容生命周期特定点所产生的元数据。然而,元数据的产生和标记是由系统定义的。本节介绍一些一般的与内容管理有关的工作流(如内容获取和解析、制作、存储以及归档)。具体的分析需要根据实际的组织及其系统和工作流才能进行,这需要在处理内容的系统中独立进行。

元数据可能在生成的时候就被处理并联系到一部分素材上。记录的位置(比如通过GPS得到的)、日期、时间等信息在产生记录时就自动与材料相关联了。然而,通常在输入和解析过程中,内容进入系统,元数据与内容对象建立关联。

理想情况下,大多数在这个过程中加入的元数据被自动处理。这些信息有:材料相关参数和自动分析程序检索的数据。这个过程中收集到的元数据被编入元数据集合,这些集合的结构有赖于特定系统的实际数据模型。

在查找阶段收集的典型元数据主要是与材料相关的,包括:

·视频源格式。

·视频压缩格式。

·音频源格式。

·音频压缩格式。

·记录参数(摄像和话筒设置)。

·生产信息。

在上载过程中,加入元数据可以用来标识内容,同时也用来支持快速检索和提供一个初始水平,该信息通常要手动输入系统。上载过程中加入的典型的元数据有:

·生产序号。

·标题。

·日期、时间和位置。

·源名(如机构名称、摄像者等)。

·剪辑描述(画面内容的文本摘要)。

·起始或结束标志(磁带或文件的剪辑)。

·拍摄质量。

不同的系统、部门和用户都参与了制作过程,这表现在其产生、引用和用来检索的元数据中。这些不同的系统有服务器组件(上载、制作和播出服务器)、制作条目的记者和编辑、最终内容条目的编辑、提供材料的归档和编目的归档部门。在所有这些处理过程中,额外的元数据被制作出来,并且与内容对象相关联起来。下面的元数据集即表现了后期制作和非线性编辑的典型的关于对象元数据集的例子:

·文献开始或结束。

·时码。

·副标题。

·授权信息。

·电子VTR卡。

·剪辑者、编辑者和制作人的名字等。

附加元数据可能被制作和搜集在另外的元数据集合中,如编辑集合、传输集合、描述集合等等。这些元数据集合更加明确地指向具体的任务和工作流步骤。

一旦材料被制作好之后就可以被分发播出。在广播系统中,分发播出是根据节目单进行的,并且被记录在播出节目(Program as Broadcast, PasB)中,此时相关数据有:

·首播日期。

·首播时间。

·播出频道。

·统计信息(观众或听众数量)。

·重播信息。

内容条目的生命周期最后一步是分类和深层编目。在这一步中,内容被分类和详细描述,以便查找、访问和复用。在制作过程中,添加的元数据在这一步中被修正和整合。应用的分类方案有赖于媒体类型和具体组织结构。这个过程中添加的典型数据有:

·目录表。

·编目时间。

·题目分类。

·节目关系。

·摘要。

在这一步产生了详细的内容描述,也就是关于片段元数据的一部分。

4.2.1.2关于权利的元数据

知识产权(Intellectual Property Rights, IPR)是关于对象元数据的一种特殊类型,它和内容的开发以及内容管理过程有紧密联系。然而,IPR通常是在内容管理系统之外的独立的版权管理系统中被管理,这是由于内容管理系统还没有覆盖到复杂组织的结构和法律领域。版权管理系统维护着IPR体系、合同信息和其他与内容对象有关的法律文档。版权管理系统管理的信息要和内容管理系统中内容对象的信息联系起来。

IPR描述了特定内容对象的所有权和使用限制。这些权限有可能很复杂,通常需要专业人士的解释。该版权有所有权(作者、作曲者、导演、摄影师等)、演出权(演员、音乐家等)、个人版权和其他很多版权。在使用(重用)作品时要充分考虑版权拥有者的具体权利。因此要妥善保管内容对象的法律文档并及时更新。

除了要考虑所有权、用户限制之外,还要考虑以下版权:

·地域限制(通常指地理限制)。

·传输和传播方法(通过电视、电影、广播和网络)。

·传输和传播时间(先于或后于某一天)。

·使用期限。

·用户(传输者)数量。

不仅要注意内容管理系统中和数据有关的某些基本版权,还应该注意在内容对象中享有其他版权的对象内容。然而,因为组织和法律原因,这些只能是象征性的。内容管理系统的用户要从法律部门得到更多有关版权的信息,以便在能用到内容的情况下保证尊重所有的版权。

同类推荐
  • 大学生必读的100本书

    大学生必读的100本书

    本书是对世界的历史,人类文明成果的一次回顾和检阅。世界历史的车轮滚滚向前,人类文明将会开出更加灿烂多彩的思想之花,结出更加丰富的文化科学硕果。如果您阅读此书,实际上是对文化的一种选择,是一次对人类文明的礼拜,更是一次撷取知识信息的大好良机。
  • 社会常识全知道

    社会常识全知道

    什么是社会常识?“中国式管理之父”曾仕强曾说:“社会常识就是指在日常生活为人处世中必须掌握且行之有效的知识,对于一个人而言,社会常识往往比知识更重要。”一个人如果不具备社会常识,就很难在社会上立足,自然也不可能成就什么事业了。
  • 客观与偏见:美国主流报纸台海问题报道研究

    客观与偏见:美国主流报纸台海问题报道研究

    华报道是美国媒体的重要报道领域,随着中国国际地位的上升,这种趋势越发明显。就整体而言,美国媒体涉华报道以负面为主,批评多于赞扬,指责多于肯定,在报道台海问题时,这种现象更加明显。本书引用英文报道原文,通过解读1992年以来《纽约时报》和《华盛顿邮报》的台海问题报道,揭示其对两岸报道立场的严重偏差。
  • 妄谈疯话

    妄谈疯话

    诠释豪情人生的态度,剖析官场弊事的怪象,演绎男女情爱的风韵,解读处世哲学的智慧。
  • 城市精细化管理:新时期社区工作与管理

    城市精细化管理:新时期社区工作与管理

    随着改革的推进,社会流动性加速,越来越多的社会群体集聚到了社区。社区已成为政府做好社会管理和公共服务工作须臾不可少的好帮手。当前社区建设出现了许多新情况、新问题。如果处理不好,解决不当,势必增加社会的不稳定因素。这些都向当下的社区工作者提出了更高的理论水平和专业技能的要求。党的十八大报告把城乡社区服务纳入“加强和创新社会管理”体系,党的十八届三中全会通过的《中共中央关于全面深化改革若干重大问题的决定》首次将“创新社会治理体制”写入党的纲领性文件。在新时期新形势下,社区如何做好协调社会关系、规范社会行为、化解社会矛盾、解决社会问题等诸方面的工作。
热门推荐
  • 文娱之百亿人生

    文娱之百亿人生

    林洲,身家百亿,但百亿,只是一个开始。他的标签有很多:作家、编剧、导演、演员、企业家等等,不一而足。他自诩是老天爷赏饭吃,但所有人都把视为一个时代的象征!
  • 星系神帝

    星系神帝

    星系大陆为宇宙超等位面之一,大陆之人拥有掌控星系规则之力。六千三百五十九亿年前遭受其他位面袭击沦为低等位面。繁沉语因为压力跳楼身亡,却被一束星芒带入了星系大陆!!!他的出现会给星系大陆带来什么呢?
  • 我是购物狂小姐

    我是购物狂小姐

    表面光鲜亮丽的美女萧逸大学毕业后,进入了一家知名的广告公司。然而,浑身上下无一不是一线名牌的千金大小姐,其实只是个背负着巨额信用卡债的卡奴罢了,更不论清贫的家世带来的其他外债。糟糕的财务状况让她的生活一团糟,虽然试图戒掉名牌购物瘾,不过最终都在闪亮的奢侈品面前败下阵来。为了维护一个美丽的谎言,而不得不编织出无数个谎言的萧逸,只能咬牙放手一搏——利用自己美貌,在物欲横流的广告界钓上一个人人垂涎的铂金镶钻单身汉!
  • 追妻无门:女boss不好惹

    追妻无门:女boss不好惹

    青涩蜕变,如今她是能独当一面的女boss,爱了冷泽聿七年,也同样花了七年时间去忘记他。以为是陌路,他突然向他表白,扬言要娶她,她只当他是脑子抽风,他的殷勤她也全都无视。他帮她查她父母的死因,赶走身边情敌,解释当初拒绝她的告别,和故意对她冷漠都是无奈之举。突然爆出她父母的死居然和冷家有丝毫联系,还莫名跳出个公爵未婚夫,扬言要与她履行婚约。峰回路转,破镜还能重圆吗? PS:我又开新文了,每逢假期必书荒,新文《有你的世界遇到爱》,喜欢我的文的朋友可以来看看,这是重生类现言,对这个题材感兴趣的一定要收藏起来。
  • 绝色尤物之杀手太冷

    绝色尤物之杀手太冷

    男人这种动物,对于苏若来说,没有爱与不爱,只有杀与不杀!绝美的容颜下,她有着一颗冷若寒冰的心,杀人是她唯一的乐趣,也是她赖以生存的技能。离奇穿越到这个陌生的时空,她获得了新的能力,有如一朵妖艳而致命的罂粟花,让人情不自禁沉迷其间,无法自拔。她可以随意改变自己的容颜和声音,却抛不掉内心的孤冷和苦痛。一场场生死别离过后,谁是那个她怎么也甩不掉的护身符,谁又是那个布局在先的幕后黑手?这世上,是否有一个人,足够强大坚韧到,能将她的心,悄悄融化。。。
  • 探龙

    探龙

    科学的尽头是玄学,玄学之精髓尽在奇门遁甲,奇门遁甲六部六门,阴阳、五行、天干地支、八卦九宫、甲子、节气,包罗万象,更隐藏着一个天大的秘密!古村诡事、山野奇闻,六门异士,勾心斗角,阴谋阳谋齐出,斗天斗地斗人!六芒神珠,九大名人,以山为棋,以川为子,大明历代钦天监的数百年奇局,黑山白水暗藏玄机。中州风雪眼,海天神罗窟,婆娑影壁峰,绝岭探龙行,铁血狂沙舞,无妄得幻生,三元定格局,龙行布九星,凶险无数,步步惊心!奇门遁甲的终极之谜,究竟隐藏了什么?六册无字天书,揭开一个世界之外的世界!
  • 萌妻上天:豪门千金归来

    萌妻上天:豪门千金归来

    微信公众号:junfengyuan888.人前,她是懦弱乖巧的千金;人后,她是步步为营的复仇女神。扮猪吃老虎是她的拿手好戏,虐死人不偿命是她的风格,卖了人还帮着数钱是她的专长;有个宠她如命的土豪男盆友,一切都是浮云!欺骗她感情的负心汉?抓去坐牢!害死她生母的渣父?让他身败名裂!虚情假意的伪善后母?让她一无所有!想谋夺她一切的继妹?毁她容扒她皮!虐待狂弟弟?踢到暗街受虐去!
  • 男神入怀,宠妻为上

    男神入怀,宠妻为上

    她是林有鹿,二线小明星,最大的梦想就是能够成为一线大咖,吃遍全世界,然而,千年女二的地位稳若泰山,屹然不动。江湖传言,她出演女主,克戏。他是从古代穿越过来的剑客,英姿飘然,腹黑寡语,冷漠是他英俊的代言词。四处寻找丢失的宝物,恰巧闯入林有鹿的生活,成为她不可或缺的一部分。一个是朝天椒,一个是性冷淡,想想今后的生活都会不太平。她慢慢接受他,爱上他,到最后浓情蜜意要把帅气夫君捧上床的那一刻却发现,原来真相并不是眼睛看到的那么简单……漫漫此生,愿与你共依,琴瑟相鸣,至此终年。--情节虚构,请勿模仿
  • 白牯牛潭(第一部)

    白牯牛潭(第一部)

    本书是一部农村题材的小说。讲述了1949年到1959年作者家乡洪湖的一些人和事,作者从自身经历出发,真情实感,用更为贴近现实的手法,写出了农民们的心路历程。为一部不可多得可歌可泣的农民赞歌。全书共四部,本书为第一部。
  • 青涩情:独家爱恋

    青涩情:独家爱恋

    我不管,我不管,我也要浪漫一次,成为女主角。东方敖群,我告诉你,我也让你在流星雨下面对我许下承诺。不然的话,你这一辈子休想娶我。