大数据的商业化:从数据、模型到业务逻辑

简介:

1、市面上关于大数据的各种定义太多,不一而足,此处写在前面的,我先定义一下: 大数据,表示极多的数据,而其来源,凡能通过技术手段触达的都算。

2、商业化,即如何使数据产生价值,这个价值并不来源于数据本身,而是来源于数据的被需求方(被需求方可以是甲方也可以是乙方)是否能够在其业务范围内被满足具备一定价值的数据。 数据商业化的核心非数据,而是数据模型。

3、 数据模型:建立满足需要的业务导向的数据模型(算法),输入需要的可触达来源的获取的数据,并输出相应的结果。 比如用户画像分析、数据结构化等等都算数据模型。

这里为什么说是业务导向的数据模型?我举个例子,如果比方说我做一个数据模型要过滤出所有姓名笔画超过20画的人的名字并序列化其信息,这里可能它是一个数据模型,我也可以在互联网获取大量的可输入的数据,问题是这个数据模型没卵用。

所谓业务导向(业务逻辑导向),比如百度凤巢系统,利用凤巢客户系统对百度搜索推广信息进行更为高效地管理与优化,对推广效果更为科学地进行评估。这里输入的就是凤巢客户以及可以收集到的与之相关的所有数据,业务导向的逻辑就是输出可用于决策的对百度搜索推广信息进行更为高效地管理与优化、对推广效果更为科学地进行评估的数据。

业务逻辑定义了数据模型。

4、成熟的大数据商业变现,背后有极其复杂的业务逻辑,比如就像刚刚提到百度凤巢系统。其通过技术实现建模(业务导向),并实现的一个个数据模型,进而不断收集输入物以通过这些又业务逻辑定义的数据模型,输出成具备价值的数据。

5、 对于业务逻辑的优化和延展(新特性),业务逻辑决定了数据模型,而输出不一定是最好的结果,所以数据模型要被优化,而数据模型是被业务逻辑定义的,所以业务逻辑要做优化;当有新的业务需求需要在原有业务逻辑上生长出来,从而在定义了业务逻辑后数据模型相应改变从而得到新的输出。

6、总结下:大数据的商业化,我从数据、模型到业务逻辑简单梳理了一下,核心是在业务逻辑找到商业化的方向以使得技术实现和数据结果满足业务导向的数据模型落地,从而实现商业化。

本文转自d1net(转载)

相关实践学习
简单用户画像分析
本场景主要介绍基于海量日志数据进行简单用户画像分析为背景,如何通过使用DataWorks完成数据采集 、加工数据、配置数据质量监控和数据可视化展现等任务。
SaaS 模式云数据仓库必修课
本课程由阿里云开发者社区和阿里云大数据团队共同出品,是SaaS模式云原生数据仓库领导者MaxCompute核心课程。本课程由阿里云资深产品和技术专家们从概念到方法,从场景到实践,体系化的将阿里巴巴飞天大数据平台10多年的经过验证的方法与实践深入浅出的讲给开发者们。帮助大数据开发者快速了解并掌握SaaS模式的云原生的数据仓库,助力开发者学习了解先进的技术栈,并能在实际业务中敏捷的进行大数据分析,赋能企业业务。 通过本课程可以了解SaaS模式云原生数据仓库领导者MaxCompute核心功能及典型适用场景,可应用MaxCompute实现数仓搭建,快速进行大数据分析。适合大数据工程师、大数据分析师 大量数据需要处理、存储和管理,需要搭建数据仓库?学它! 没有足够人员和经验来运维大数据平台,不想自建IDC买机器,需要免运维的大数据平台?会SQL就等于会大数据?学它! 想知道大数据用得对不对,想用更少的钱得到持续演进的数仓能力?获得极致弹性的计算资源和更好的性能,以及持续保护数据安全的生产环境?学它! 想要获得灵活的分析能力,快速洞察数据规律特征?想要兼得数据湖的灵活性与数据仓库的成长性?学它! 出品人:阿里云大数据产品及研发团队专家 产品 MaxCompute 官网 https://www.aliyun.com/product/odps 
相关文章
|
2月前
|
分布式计算 DataWorks IDE
MaxCompute数据问题之忽略脏数据如何解决
MaxCompute数据包含存储在MaxCompute服务中的表、分区以及其他数据结构;本合集将提供MaxCompute数据的管理和优化指南,以及数据操作中的常见问题和解决策略。
47 0
|
2月前
|
SQL 存储 分布式计算
MaxCompute问题之下载数据如何解决
MaxCompute数据包含存储在MaxCompute服务中的表、分区以及其他数据结构;本合集将提供MaxCompute数据的管理和优化指南,以及数据操作中的常见问题和解决策略。
38 0
|
2月前
|
分布式计算 关系型数据库 MySQL
MaxCompute问题之数据归属分区如何解决
MaxCompute数据包含存储在MaxCompute服务中的表、分区以及其他数据结构;本合集将提供MaxCompute数据的管理和优化指南,以及数据操作中的常见问题和解决策略。
35 0
|
3月前
|
机器学习/深度学习 存储 分布式计算
机器学习PAI关于maxcompute上用protobuf 处理数据,比较方便的方式
机器学习PAI关于maxcompute上用protobuf 处理数据,比较方便的方式
|
2月前
|
分布式计算 DataWorks BI
MaxCompute数据问题之运行报错如何解决
MaxCompute数据包含存储在MaxCompute服务中的表、分区以及其他数据结构;本合集将提供MaxCompute数据的管理和优化指南,以及数据操作中的常见问题和解决策略。
38 1
|
2月前
|
分布式计算 关系型数据库 数据库连接
MaxCompute数据问题之数据迁移如何解决
MaxCompute数据包含存储在MaxCompute服务中的表、分区以及其他数据结构;本合集将提供MaxCompute数据的管理和优化指南,以及数据操作中的常见问题和解决策略。
34 0
|
2月前
|
分布式计算 Cloud Native MaxCompute
MaxCompute数据问题之没有访问权限如何解决
MaxCompute数据包含存储在MaxCompute服务中的表、分区以及其他数据结构;本合集将提供MaxCompute数据的管理和优化指南,以及数据操作中的常见问题和解决策略。
38 0
|
9天前
|
数据采集 搜索推荐 大数据
大数据中的人为数据
【4月更文挑战第11天】人为数据,源于人类活动,如在线行为和社交互动,是大数据的关键部分,用于理解人类行为、预测趋势和策略制定。数据具多样性、实时性和动态性,广泛应用于市场营销和社交媒体分析。然而,数据真实性、用户隐私和处理复杂性构成挑战。解决策略包括数据质量控制、采用先进技术、强化数据安全和培养专业人才,以充分发挥其潜力。
13 3
|
12天前
|
运维 供应链 大数据
数据之势丨从“看数”到“用数”,百年制造企业用大数据实现“降本增效”
目前,松下中国旗下的64家法人公司已经有21家加入了新的IT架构中,为松下集团在中国及东北亚地区节约了超过30%的总成本,减少了近50%的交付时间,同时,大幅降低了系统的故障率。
|
29天前
|
机器学习/深度学习 分布式计算 监控
大模型开发:你如何使用大数据进行模型训练?
在大数据模型训练中,关键步骤包括数据准备(收集、清洗、特征工程、划分),硬件准备(分布式计算、并行训练),模型选择与配置,训练与优化,监控评估,以及模型的持久化与部署。过程中要关注数据隐私、安全及法规遵循,利用技术进步提升效率和性能。
39 2