2、数据模型
数据模型的设计应该是企业内容管理中最有挑战性的技术实现之一。数据模型的能力直接表现出一个企业内容管理平台适应用户需求的能力。在实施企业内容管理的初始阶段,我们只能了解很少的一部分需求,如果我们设计数据模型时仅基于这些特定的需求,那么这个应用可能只能适应客户当时的需求,而无法适应客户的需求变化。在内容管理中,通常元数据越复杂,内容提升价值的潜力就越大。而丰富元数据的模型不是一蹴而就的,这就要求一个面向客户内容管理的通用数据模型,以适应客户不断变化的需求,提升信息的价值。如下图这个抽象的内容管理数据模型非常值得借鉴。

在这个模型中,在对一个内容进行描述时,支持多层级的元数据模型,支持对各种复合文档的精确描述,可以对同一文档中不同的资源对象实施不同的处理和控制;该模型也可以灵活地描述内容和内容之间的关系以及内容在使用中的工作状态。而图形化的建模工具以及支持建模的API可以帮助方便客户和应用开发商通过不同方式快速建模并进行调整。现在,某些行业已经开始定制行业元数据标准来描述复杂的需求,例如数字图书馆行业和广电行业开始基于都柏林元数据定制自己行业的多层级元数据标准,并以XML描述。XML与通常的关系型数据库不同之处在于其数据是有结构的,并且可能在同一个Tag下包含多值。如上图所示的元数据模型可以方便地支持从XML文件向内容管理数据模型的转换。在描述不同内容之间的关系时,准许用户在初始模型建立时或者在使用过程中随时建立链接(Link)、数据库外键和引用属性(引用属性是一种可以将一个字段变成指向另一条记录的指针)。这是一种可以将系统中任意两个记录关联在一起的方法,不管这两条记录在数据模型上是否相似,也无论他们是否已经和其他记录建立了链接关系,从而为客户建立描述内容的组织方式提供了便利的条件。出于性能和稳定考虑,目前基于关系型数据库还是保存元数据最好的手段。未来的趋势是越来越加强对XML的支持,包括对XML数据库的支持。
3、检索查询
对于企业内容管理的最终用户来说,如何高效准确地找到自己所需要的资源是首要课题。尤其是企业内容管理的数据模型逐渐复杂、来源更加多样化,使得检索查询就变得更加重要,同时也变得非常困难。因此企业内容管理系统需要支持标准,支持多渠道复合检索以及查询优化。
用户可以实现在对单一系统的查询,也可以使用信息集成技术,完成一次检索对多个数据源的查询。
从数据模型的分析上得出,企业内容管理系统的元数据可以非常复杂。例如各种基于XML的元数据标准,其定义都极其详细。举例来说,广电标准数据模型规定了广播电视音像资料编目著录项目和规则,适用于广播电视音像资料的编目著录,将主要用于广播电视音像资料的收藏、管理、检索、资料获取,具有实用、简单、灵活、易转换、可扩展等特性。这个数据模型,包括了4级信息,每个级别的信息包括15大属性,属性里面又包括多个子属性,很多属性则是用多值的方式实现的。这样的模型创建后,需要一个简单、强大且基于标准的检索方式,而查询中可能会涉及到元数据参量查询、元数据的全文检索、文本对象的全文检索等复合检索等等,单纯使用关系型数据库的SQL语言很难满足这种多渠道检索的需求。对XML查询的支持是业界普遍采用技术基础。例如有的产品从XQuery和XPath上设计出了非常好的查询方法。IBMContentManager通过查询解析器,将用户的查询重新处理,并进行优化,然后向底层的数据库发出查询语句。这种被称为XQPE(XQueryPathExpressions)的查询语言可以完全阐释所有可能用到的数据模型,并且使用简单,高效。