登陆注册
3289000000017

第17章 内容的表达和元数据(1)

内容管理系统的核心是它管理的内容对象。内容管理的主要任务是在对象的生命周期内优化内容的处理和开发。对象的生命周期是指从内容的获取、制作、传输,到归档和存储的过程。内容对象在系统中怎样存储和表示对于检索和应用处理是至关重要的。然而内容的表示并不只与内容对象本身有关,还与内容对象所处的使用环境有关。因此,内容的表示模型应该考虑到这个因素,从而提供一个内容数据和信息的各种处理过程的抽象。

元数据是内容管理系统中不可或缺的部分,它被定义为“有关数据的数据”。元数据在从不同方面描述内容对象时考虑了不同的观点、方面、工作流、处理程序和存在的信息模型,这对于在需要时随时管理、搜索、查找、检索内容信息是很重要的。因此,内容的描述和描述的质量对内容管理系统提供快速便捷的查找内容的能力是很重要的。元数据要考虑不同的用户角色和与系统的交互运行,以及提供相应的视图。理想的内容管理系统支持所有的原始材料进入系统的创建处理过程和描述过程,以及所有相关工作和内容的分配、处理过程。这种情况下需要考虑的不仅是与内容的直接交互工作,还包括相关领域,如统计计算、权限管理和程序计划。

除了纯粹的描述和检索以外,元数据还管理着内容的内部组织和对外组织关系方式。因此,优化实际的交换和信息的转译交换都需要一定的标准。因为标准通常只提供大致的共同特征说明,标准本身并不能提供个体组织所需要的具体功能支持。因此,标准只能覆盖对于具体功能和主题背景很重要的特定方面。

目前已经开发出了很多数据模型、内容描述方案以及内容的表示和描述的参考模型。它们通常从不同角度描述内容,因此不是完全可比较的。不存在通用的内容描述方案。在内容管理系统中,针对不同方面的应用要使用不同的内容表示方案。本章给出了根据不同环境描述内容的概念。接下来介绍了元数据的结构和元数据方案应该捕获的信息。本章还介绍了元数据的交换和数据模型,介绍了许多主要表示模型和描述方案,以及元数据的编码和交换协议,给出了该领域目前的发展概况。另外,本章还说明了目前在不同环境下表示元数据的不同方法。具体方案或者模型的适合程度还要视其在具体实例中的使用情况而定,本章的讨论将有助于形成这种评价。

4.1内容的表示

内容对象的核心是素材,即包含实际信息或思想的部分。然而有时候内容的信息比内容对象本身还要重要,例如有关内容的所有管理任务。甚至在生产工作流中具体的元信息(元数据、摘要和低码率的素材版本)要比内容对象本身更重要(2.2.1节)。在这种情况下就需要选择适当的方法和适合的元数据,以表示对与内容对象有关的各种工作流和管理程序给予最好的支持。尽管数据模型、内容表示和工作流的详细信息根据不同的内容和不同的组织而不同,但是主要的内容特征和用例是大致相同的。

媒体对象(视频、音频轨道、图片等)可以被表示成为所谓的“代理”。代理对应于基于特定环境的特定方面的内容的具体视图。代理更加强调特定特征,表示特定视图或可视化的具体属性,因此更容易访问。代理可以有不同的媒体形式。视音频内容可以用多媒体代理来表示(综合使用不同媒体类型来表示)。其他代理有:摘要、编辑决策列表(Edit Decision List, EDL)、数据库记录等。

纯文本代理是有关内容的文档,包括摘要、产品文档(如产品单)、校本、EDL、日志文件(例如和时码有关的文本转换语句和注解)、合约、法律文档等等。这一组代理包含了一般文本中表示内容或者内容的特定部分的所有文档类型,可以对这些文档建立索引以便查找。

数据库代理是存储于数据库管理系统(Database Management System, DBMS)的全部内容的表示。DBMS的特性是可以管理巨大数量的数据。内容对象被表示成为一种抽象模型,称为“数据模型”。数据模型存储于数据库中。所有相关特征由一个结构化文本表示器来采集,它能够优化简便查找,并重新按照属性查找。文本和数据库代理通常和元数据有关。元数据定义为描述核心创作媒体对象数据的数据,这种媒体对象包含创作者需要传递的实际信息。

多媒体代理是表示如低码率副本、视听摘要和不同媒体类型的组合内容的表示方法。内容的低码率副本可以不用实际接触材料就能预览,因此能在窄带宽的链接上传输,在低配置的设备上输出。视听摘要是视听内容的组合,这些摘要通过显示素材的一部分而提供了素材的纵览,典型代表有关键帧或浏览。视听摘要通常通过自动分析程序自动提取和编译。不同媒体类型的组合可以通过链接文本、图片视频和视听信息提供实际内容的更好的总览。例如,情节串联图板就是包含内容描述信息和片断的关键帧和时码的组合,还有与低分辨率素材副本有关的文字材料等。如果内容对象是连续媒体类型,那么不连续的媒体内容表示部分也有与内容对象时码有关的时间参数。

广义的多媒体代理可以被看做是元数据,它们有附属的特征而且主要对象是优化内容的表述和检索。多媒体代理的文本部分显然是元数据描述内容对象的一部分。可视化摘要也有描述的特性。然而,低码率内容副本则是不带有描述信息的对素材的表示。

4.2元数据:内容的描述

元数据用来描述内容并在系统和系统组件中表示内容,它要遍布整个媒体制作的工作流程,从预制作到存档。另外,它还要容纳权限不同及对内容不同方面感兴趣的不同用户组。因此,对于内容的描述,有不同的方面和目的。

元数据最初在计划阶段产生,在内容对象的整个生命周期内被使用和不断修正。使用元数据的阶段有:生产、传输、媒体管理和其他开发过程。元数据要捕捉程序计划、生产计划(包括原材料、个人计划和相关贡献的参考),还有计划阶段的编辑准备(绘制、调查、收集和情节串联)。元数据应用的其他程序和用例包括:文档撰写、IPR、许可证、分析数据和位置相关数据(存储管理、位置ID等)。另一组元数据是有关内容的使用和开发的,通常这部分包括传输历史记录、程序交换和程序材料的数据和内容销售的信息(市场信息)。新一类的元数据是有关在互联网上使用的内容的数据,此时的数据记录是有关历史访问记录、负责人员(版主或者编辑者)等方面的。

元数据必须捕获和描述过多的特征和工作流,因此存在处理元数据的不同方案和(子)系统。元数据可以根据它所描述的实体来进行分组,有关于对象和关于片段的元数据。关于对象的元数据包括所有以描述媒体对象的特定特征为主题的元数据,而关于片段的元数据用于描述由于空间或时间界限(如图片边界和时码)所分割的内容对象的一个部分。

4.2.1关于对象的元数据

关于对象的元数据将内容对象作为一个整体描述。部分关于对象的元数据是内容描述(主题、作者、导演等)、相关组织数据(如项目位置、责任编辑办公室等信息)、内容标识和参加团体(处理内容的个人或组织,及其关系、角色和权利)。另外,关于内容的元数据包括技术元数据和所有商业过程(包括媒体制作的所有工作流步骤)。

关于对象的元数据通常存储在数据库中,有时也存储在结构化文件中,以全文检索引擎建立索引,以便于检索。内容对象的相关文档(如注解和合同)也可以以电子形式存储和建立索引来方便搜索。当文档需要像元数据一样存储于硬盘上时(如文章的法律文件),这些文档的相关资料可以(有时是必须)存储于内容管理系统的数据模型之中。

4.2.1.1工作流和内容描述

为了便于内容管理,内容的特征要被获取为结构化元数据。这可以使用描述对象(实体)本身和对象间链接的提取程序来完成。此时,工作流是要考虑的最主要的处理过程。元数据通过工作流被合成,因此,这些工作流定义了内容生命周期特定点所产生的元数据。然而,元数据的产生和标记是由系统定义的。本节介绍一些一般的与内容管理有关的工作流(如内容获取和解析、制作、存储以及归档)。具体的分析需要根据实际的组织及其系统和工作流才能进行,这需要在处理内容的系统中独立进行。

元数据可能在生成的时候就被处理并联系到一部分素材上。记录的位置(比如通过GPS得到的)、日期、时间等信息在产生记录时就自动与材料相关联了。然而,通常在输入和解析过程中,内容进入系统,元数据与内容对象建立关联。

理想情况下,大多数在这个过程中加入的元数据被自动处理。这些信息有:材料相关参数和自动分析程序检索的数据。这个过程中收集到的元数据被编入元数据集合,这些集合的结构有赖于特定系统的实际数据模型。

在查找阶段收集的典型元数据主要是与材料相关的,包括:

·视频源格式。

·视频压缩格式。

·音频源格式。

·音频压缩格式。

·记录参数(摄像和话筒设置)。

·生产信息。

在上载过程中,加入元数据可以用来标识内容,同时也用来支持快速检索和提供一个初始水平,该信息通常要手动输入系统。上载过程中加入的典型的元数据有:

·生产序号。

·标题。

·日期、时间和位置。

·源名(如机构名称、摄像者等)。

·剪辑描述(画面内容的文本摘要)。

·起始或结束标志(磁带或文件的剪辑)。

·拍摄质量。

不同的系统、部门和用户都参与了制作过程,这表现在其产生、引用和用来检索的元数据中。这些不同的系统有服务器组件(上载、制作和播出服务器)、制作条目的记者和编辑、最终内容条目的编辑、提供材料的归档和编目的归档部门。在所有这些处理过程中,额外的元数据被制作出来,并且与内容对象相关联起来。下面的元数据集即表现了后期制作和非线性编辑的典型的关于对象元数据集的例子:

·文献开始或结束。

·时码。

·副标题。

·授权信息。

·电子VTR卡。

·剪辑者、编辑者和制作人的名字等。

附加元数据可能被制作和搜集在另外的元数据集合中,如编辑集合、传输集合、描述集合等等。这些元数据集合更加明确地指向具体的任务和工作流步骤。

一旦材料被制作好之后就可以被分发播出。在广播系统中,分发播出是根据节目单进行的,并且被记录在播出节目(Program as Broadcast, PasB)中,此时相关数据有:

·首播日期。

·首播时间。

·播出频道。

·统计信息(观众或听众数量)。

·重播信息。

内容条目的生命周期最后一步是分类和深层编目。在这一步中,内容被分类和详细描述,以便查找、访问和复用。在制作过程中,添加的元数据在这一步中被修正和整合。应用的分类方案有赖于媒体类型和具体组织结构。这个过程中添加的典型数据有:

·目录表。

·编目时间。

·题目分类。

·节目关系。

·摘要。

在这一步产生了详细的内容描述,也就是关于片段元数据的一部分。

4.2.1.2关于权利的元数据

知识产权(Intellectual Property Rights, IPR)是关于对象元数据的一种特殊类型,它和内容的开发以及内容管理过程有紧密联系。然而,IPR通常是在内容管理系统之外的独立的版权管理系统中被管理,这是由于内容管理系统还没有覆盖到复杂组织的结构和法律领域。版权管理系统维护着IPR体系、合同信息和其他与内容对象有关的法律文档。版权管理系统管理的信息要和内容管理系统中内容对象的信息联系起来。

IPR描述了特定内容对象的所有权和使用限制。这些权限有可能很复杂,通常需要专业人士的解释。该版权有所有权(作者、作曲者、导演、摄影师等)、演出权(演员、音乐家等)、个人版权和其他很多版权。在使用(重用)作品时要充分考虑版权拥有者的具体权利。因此要妥善保管内容对象的法律文档并及时更新。

除了要考虑所有权、用户限制之外,还要考虑以下版权:

·地域限制(通常指地理限制)。

·传输和传播方法(通过电视、电影、广播和网络)。

·传输和传播时间(先于或后于某一天)。

·使用期限。

·用户(传输者)数量。

不仅要注意内容管理系统中和数据有关的某些基本版权,还应该注意在内容对象中享有其他版权的对象内容。然而,因为组织和法律原因,这些只能是象征性的。内容管理系统的用户要从法律部门得到更多有关版权的信息,以便在能用到内容的情况下保证尊重所有的版权。

同类推荐
  • 中国传媒产业效益评价研究

    中国传媒产业效益评价研究

    本书撰写力求从我国传媒产业经济体制改革的实际情况出发,充分考虑各传媒集团产业化进程的差距,系统阐述各传媒集团产业化的重要意义;产业化的现状和问题;各传媒集团加快产业化步伐的对策和措施;产业化经济效益评价的指标体系等。本书的创新点体现在产业经济体制改革的力度;加强传媒产业化进程的对策和措施;建立评价传媒产业综合经济效益的评价指标体系这三个方面。
  • 教师快乐工作手册(下)(教师职业发展与健康指导)

    教师快乐工作手册(下)(教师职业发展与健康指导)

    教师的职业是“传道、授业、解惑”,教师的职责是把教学当成自己的终生事业,用“爱”塔起教育的基石,用自己的学识及人格魅力,点燃学生的兴趣,促进学生的健康、快乐成长。
  • 道德自我的德育价值研究

    道德自我的德育价值研究

    本书是从道德与人的本体关系上对道德教育的一种学理性探讨。针对现代道德教育所存在的问题,从生命的自我观照出发,本书将德育的目的和价值取向放在道德自我的建立上,旨在从根源上寻求中国学校德育的根本性变革。
  • 世界名校全知道

    世界名校全知道

    本书深入探析了65所世界名校的优势学科和先进的教育资源,对各个国家的留学生活进行了非常细致的说明,介绍了学习、生活细节以及一些基本文化和礼仪,为留学申请者选择去什么国家、去哪个学校、读哪门学科提供了重要的帮助和参考。
  • 技术元素

    技术元素

    技术元素(technium)一词是凯文·凯利(KK)专门创造出来的词语。“技术元素不仅仅包括一些具象的技术(例如汽车、雷达和计算机等),它还包括文化、法律、社会机构和所有的智能创造物。”简而言之,技术元素就是从人的意识中涌现出来的一切。KK把这种科技的延伸面看成一个能产生自我动力的整体。KK把对这些疑惑的理解都写在了“技术元素”博客专栏里,他说:“我会将我不成熟的想法、笔记、内心论争、草稿以及对其他文章的回应上传到这儿,这样我就能知道自己到底在想些什么。”《技术元素》一书便是基于此专栏编撰而成。相比于KK之前的著作,本书将更通俗易懂,文章中涉及到的领域、所举的事例都更贴近当下人们的生活体验。
热门推荐
  • 青春,是巧克力色的

    青春,是巧克力色的

    她,是学习成绩样样都好的学霸;他,是富豪家里的纨绔弟子。她本不想与他有任何关系,但是,却阴差阳错的成为了他的家教老师,作为学霸级别的她,作为富豪家里的他,在一个校园里,将会碰装出怎样的火花......
  • 茶馆

    茶馆

    《茶馆》是中国话剧里程碑式的杰作,被西方人誉为“东方舞台的奇迹”。讲述了一个大茶馆在精明能干的王掌柜的努力经营下,规模却一点点变小,直至消失的悲剧。人生如戏,刹那欢喜,刹那悲哀。小茶馆就是一个大社会的缩影,在这里,品的不是茶,而是百味人生。
  • 我的火影忍者

    我的火影忍者

    博人传博人:我爸是火影,我爷爷是火影,我爷爷师父的老师是火影,我爸师父的老婆是火影,我爸师父的老婆她祖父和叔公都是火影,我爸的老师也是火影,我全家都是火影!鹿代:我们能不说火影吗?博人:六道仙人是我哥鹿代:...我们还是说说火影吧博人:我全家都是火影!鹿代:……这是一个小时候不小心解开了封印,导致九尾当爸,水门当妈的鸣人的故事。企鹅群:223685218新书已经发布,书名:为美好的异世献上科学,欢迎品尝
  • 遗谜

    遗谜

    丽娜大小姐和管家小姐(桑塔纳)从丽娜小姐的爸爸的遗书内容开始探寻秘密,寻找真相,从家出发到巴黎,再到偏远的小村庄,经历了各种起起落落,最后找寻到了不可思议的东西……
  • 我的末世手环

    我的末世手环

    陈冬升因为一部纪录片,穿越到一个与地球文明相似的世界,这个世界正逐步走向灭亡,知道末日走向,有能学习战技和合成装备的手环,异常残酷的环境下他依然要想尽办法努力活下去,随着时间的推移,他发现这个末日越来越不简单。
  • FBI心理操控术

    FBI心理操控术

    在多年的实战经验中,FBI越来越重视心理操纵的作用。FBI认为,人的一切行动都是由心理控制,在生活和工作的种种场合中,心理操控术都可以使人在人际交往中胜出。在社交场合中,懂得并且运用心理操纵术可以使人们笼络更多的人呢新白妍可以有效驾驭他人,如此自然会达到事半功倍的效果。本书便是为读者揭开心理操控的密码,让心里操控成为人人能读懂的东西。
  • 萧红短篇小说选

    萧红短篇小说选

    本书精选了萧红四部小说。在中国的现代作家中,没有一个人有着萧红这样的经历:出身地主阶级,饱读诗书,为了逃婚离开了那个封建家庭,之后却被未婚夫欺骗同居,被抛弃之后开始她颠沛流离的生活……萧红的命运正如她所说:“我一生最大的痛苦和不幸,都是因为我是一个女人。”正因为她承受着那些屈辱和痛苦,她那如诗歌一般的文字才带有如此强烈的时代穿透力,为我们缓缓展开一幅幅上世纪二三十年代下层百姓的生活画卷。同时,萧红也是属于荒野的,她的流亡经历使她的小说如散文般天马行空,没有规矩章法,却又流畅自然。这,仿若一种灵魂的本能。
  • 狼王黑点

    狼王黑点

    我的新作《成吉思汗的动物军团》和《盎然诗意》,正在连载,敬请关注。
  • 寡头:新俄罗斯的财富与权力

    寡头:新俄罗斯的财富与权力

    《寡头:新俄罗斯的财富与权力》一书记录了后苏联时代新富阶层的崛起。从1985年戈尔巴乔夫改革开始,一直到普京上台初期,几个甚为瞩目的寡头带领俄罗斯进行了未曾有过的险峻试验。从权力推手别列佐夫斯基、媒体大王古辛斯基、石油大亨霍多尔科夫斯基、银行巨头斯莫伦斯基、青年改革家丘拜斯到莫斯科市长卢日科夫……这些寡头化身新秩序的建筑家和鼓吹者,反过来操纵旧制度,推动了财富与权力的联姻。在寡头资本主义走向盛极之时,他们基本上控制了国家的油气、电力、冶金和金融业,并在很大程度上控制着媒体,操纵着舆论。
  • 最强绝色丫鬟

    最强绝色丫鬟

    因前世被暗算致死,今世的何杰与校花女友分手之时一个美女贴身丫鬟从天而降,带来何氏心法。你说你怕鬼,好,今晚咱们不见不散。你说你女友美若天仙,可以,月儿出来见人了。听说你想买凶杀我,来吧,让你见识见识我的还我漂漂拳。还有什么是何杰做不到的?无敌是多么的寂寞,最后问一句,还有谁!