简介:简介由于拼写错误、意外的缩略语和其他不规则问题,实际的数据是“有问题”的。因此,在数据仓储项目中,很大一部分的时间和金钱都花费在了数据提取、数据转换和数据加载(ETL,Extraction、Transformation、Loading)阶段。在ETL阶段,新数据被清理、标准化,并使其与现有数据一致。在MicrosoftSQLServer2005中可用的模糊查找和模糊分组转换,有助于使ETL过程在遇到若干种在交际数据中观测到的常见错误时更易复原。它们解决一般的匹配和分组问题,而无需特定于域的规则和脚本的专家集合。通过为您的域自定义模糊查找和模糊分组,您可以利用BusinessIntelligenceDevelopmentStudio内的通用数据清理算法,并避免创建复杂的自定义规则和代码。
简介:《FUZZYMATHEMATICALAPPROACHTOPATTERNRECOGNITION》一书,是由Sankar.Pal和DwijeshK.DuttaMajumder所著,两人就职于设在印度加尔各答的印度统计研究所,本书由威利东方有限公司在1986年出版。在我有限的视野内,尚未发现有中译本。由于本书论述的模糊数学方法在自动化机械摸式识别中有较高的应用价值,故选择其中部分章节译成汉文,介绍给对这方面有兴趣的读者。“pattern”一词,在专业书中通常被译为“模式”或者“图象”,本译文采用“模式”一词。