什么是数据湖
【摘要】 如果需要定义数据湖,则可以将其定义为为企业存储各种原始数据的大型仓库,在该仓库中可以访问、处理、分析和传输数据。数据湖从企业中的多个数据源获取原始数据,并且出于不同的目的,相同的原始数据还可能具有满足特定内部模型格式的数据的多个副本。因此,在数据湖中处理的数据可以是任何类型的信息,从结构化数据到完全非结构化数据。企业对数据湖寄予厚望,该数据湖将帮助用户快速访问有用的信息,并将其用于数据分析和...
如果需要定义数据湖,则可以将其定义为为企业存储各种原始数据的大型仓库,在该仓库中可以访问、处理、分析和传输数据。
数据湖从企业中的多个数据源获取原始数据,并且出于不同的目的,相同的原始数据还可能具有满足特定内部模型格式的数据的多个副本。因此,在数据湖中处理的数据可以是任何类型的信息,从结构化数据到完全非结构化数据。
企业对数据湖寄予厚望,该数据湖将帮助用户快速访问有用的信息,并将其用于数据分析和机器学习算法,以获得与其运行方式相关的见解。
数据湖与企业的关系
数据湖可以为企业带来各种功能,例如,实现数据的集中管理,在此之上,企业可以利用许多以前不可用的功能。
此外,先进的数据科学和机器学习技术的结合可以帮助企业构建更优化的运营模式,还可以为企业提供其他能力,如预测分析、推荐模型等,可以刺激企业能力的后续增长。
企业数据中隐藏着许多功能,但是,重要数据不能用于提高企业的业务绩效,除非具有业务数据洞察力的人员可以使用它。
【版权声明】本文为华为云社区用户原创内容,转载时必须标注文章的来源(华为云社区)、文章链接、文章作者等基本信息, 否则作者和本社区有权追究责任。如果您发现本社区中有涉嫌抄袭的内容,欢迎发送邮件进行举报,并提供相关证据,一经查实,本社区将立刻删除涉嫌侵权内容,举报邮箱:
cloudbbs@huaweicloud.com
- 点赞
- 收藏
- 关注作者
评论(0)