分享

人工智能[4132]聊聊数据仓库建设步骤[5]

 赵站长的博客 2024-04-16 发布于北京

2.数据仓库概念化和技术选择

上一步的结果将用作定义未来解决方案范围的基础,因此应仔细分析业务和IT用户的需求和期望并确定优先级,以制定最佳的数据仓库功能集。

之后,必须确定构建数据仓库解决方案的架构方法,评估并为每个架构组件(暂存区域、存储区域等)选择最佳技术。在制定技术堆栈时,请考虑以下因素:

当前的技术环境

规划的战略技术方向

内部IT团队成员的技术能力

具体数据安全要求等

此时,还应该定义部署选项-本地、云或混合。部署选项的选择取决于多种因素,例如数据量、数据性质、成本、安全要求、用户数量及其位置以及系统可用性等。

3.数据仓库环境设计

在设计数据仓库之前和期间,需要定义数据源并分析存储在其中的信息-可用的数据类型和结构,每天、每月生成的信息量等,以及其质量、敏感性、刷新率频率。

下一步是逻辑数据建模,或者将公司的数据排列成一系列称为实体(现实世界对象)和属性(定义这些对象的特征)的逻辑关系。实体关系建模用于各种建模技术,包括规范化模式(关系数据库的设计方法)和星型模式(用于维度建模)。

接下来,将这些逻辑数据模型转换为数据库结构,例如将实体转换为表、将属性转换为列、将关系转换为外键约束等。

数据建模完成后,第一步是设计数据暂存区,以便首先为数据仓库提供高质量的聚合数据,并在后续所有数据加载过程中定义和控制源到目标的数据流。

设计步骤还包括创建数据访问和使用策略、建立元数据目录、业务术语表等。

我是一位爱学习的老人!本站主要是些学习体验与分享(其中会引用一些作品的原话并结合我的一生体会与经验加工整理而成!在此一并感谢!如有不妥之处敬请与我联系,我会妥善处理,谢谢!)我写的主要是中老年人各方面应注意的事儿!退休后我希望通过这个平台广交朋友,互助交流,共筑美好生活!!!!!! 更多文章请参看http://www.赵站长的博客。期待大家的光临与指教哦^0^!欢迎大家转发! 

    本站是提供个人知识管理的网络存储空间,所有内容均由用户发布,不代表本站观点。请注意甄别内容中的联系方式、诱导购买等信息,谨防诈骗。如发现有害或侵权内容,请点击一键举报。
    转藏 分享 献花(0

    0条评论

    发表

    请遵守用户 评论公约

    类似文章 更多