备案控制台

开发者社区华章出版社文章正文

《R语言数据挖掘：实用项目解析》——第2章，第2.6节变量分段

2017-05-02 1081

版权

版权声明：

本文内容由阿里云实名注册用户自发贡献，版权归原作者所有，阿里云开发者社区不拥有其著作权，亦不承担相应法律责任。具体规则请查看《阿里云开发者社区用户服务协议》和《阿里云开发者社区知识产权保护指引》。如果您发现本社区中有涉嫌抄袭的内容，填写侵权投诉表单进行举报，一经查实，本社区将立刻删除涉嫌侵权内容。

简介：

本节书摘来自华章出版社《R语言数据挖掘：实用项目解析》一书中的第2章，第2.6节变量分段，作者［印度］普拉迪帕塔·米什拉（Pradeepta Mishra），更多章节内容可以访问云栖社区“华章计算机”公众号查看

2.6　变量分段
在将连续变量纳入模型之前，需要对其进行处理。以Cars93数据集中的油箱容量为例，基于油箱容量，我们可以创建一个分类变量，值为高、中和低、低中：

f024e627d9d635b087ee479caaa1f45c0a799220

油箱容量的值域为9.2～27。根据逻辑，使用分类差4（也即每个分类之间相差4）完成分类。这些分类定义了变量中的每一个值被分配到每一组的方式。最后的输出表显示有4个组，最高的油箱容量组只有4辆车。
变量分段或离散化不仅有助于建立决策树，在做logistic回归和其他形式的机器学习模型时也会用到。

文章标签：

云解析DNS

数据挖掘

关键词：

r语言变量

r语言数据挖掘

云解析DNS变量

r语言分段

数据挖掘r语言

华章计算机

目录

相关文章

鼠鼠我呀

|

2月前

|

存储 C# 容器

C变量数据类型深度解析：打造高效代码的基石

C变量数据类型深度解析：打造高效代码的基石

鼠鼠我呀

17 1 1

sumith

|

4月前

|

存储 Python 容器

Python魔法解析：探索变量类型的丰富多彩世界！

Python魔法解析：探索变量类型的丰富多彩世界！

sumith

18 0 0

小万哥丶

|

5月前

|

JSON JavaScript Go

Go 语言学习指南：变量、循环、函数、数据类型、Web 框架等全面解析

掌握 Go 语言的常见概念，如变量、循环、条件语句、函数、数据类型等等。深入了解 Go 基础知识的好起点是查阅 Go 官方文档

小万哥丶

527 2 2

Go先锋

|

7月前

|

Go

这波操作太秀了！Go语言函数变量大解析

这波操作太秀了！Go语言函数变量大解析

Go先锋

68 0 0

拓端数据部落

|

6天前

|

算法数据挖掘数据库

R语言主成分PCA、决策树、boost预警模型在跨区域犯罪研究数据挖掘分析|数据分享

R语言主成分PCA、决策树、boost预警模型在跨区域犯罪研究数据挖掘分析|数据分享

拓端数据部落

13 0 0

拓端数据部落

|

13天前

|

数据可视化数据挖掘

数据分享|R语言IMDb TOP250电影特征数据挖掘可视化分析受众偏好、排名、投票、评分（下）

数据分享|R语言IMDb TOP250电影特征数据挖掘可视化分析受众偏好、排名、投票、评分

拓端数据部落

19 0 0

拓端数据部落

|

13天前

|

数据可视化算法数据挖掘

数据分享|R语言IMDb TOP250电影特征数据挖掘可视化分析受众偏好、排名、投票、评分（上）

数据分享|R语言IMDb TOP250电影特征数据挖掘可视化分析受众偏好、排名、投票、评分

拓端数据部落

23 0 0

东北赵四

|

20天前

|

安全

并发编程之变量的线程安全分析的详细解析

并发编程之变量的线程安全分析的详细解析

东北赵四

11 0 0

拓端数据部落

|

26天前

|

SQL 数据可视化算法

R语言公交地铁路线进出站数据挖掘网络图可视化

R语言公交地铁路线进出站数据挖掘网络图可视化

拓端数据部落

24 1 1

泡沫o0

|

2月前

|

存储缓存算法

CMake 变量作用域全解析：扩展、管理与应用

CMake 变量作用域全解析：扩展、管理与应用

泡沫o0

47 0 0

华章出版社

热门文章

最新文章

API电商接口大数据分析与数据挖掘（商品详情店铺）

从零到精通：学习这些R语言必学包成为数据分析高手！

【Python数据挖掘课程】八.关联规则挖掘及Apriori实现购物推荐

工具推荐 | 分析大数据最需要的Top 10数据挖掘工具

150+面试题，十大必读书，数据挖掘offer轻松搞定 | 面试宝典系列

数据挖掘实战：带你做客户价值分析(附代码)

聊聊数据挖掘竞赛中的套路与深度学习的局限

BR-MLP基于spark+Hadoop分布式数据挖掘解决方案功能剖析

R语言数据挖掘1.8.2　统计学与机器学习

零基础入门数据挖掘-心跳信号分类预测Top4赛事经验分享

Java必刷入门递归题×5（内附详细递归解析图）

【进阶C语言】数组笔试题解析

哲学家解析Sora本质，AI视频离世界模拟器还有多远？

HashMap源码全面解析

Qt 5.14.2 深度解析：打造高效JSON处理利器

机器学习的魔法（三）解析无监督学习的黑科技，揭秘新闻话题背后的神奇算法

argparse的基本使用--参数解析

机器学习-可解释性机器学习：随机森林与fastshap的可视化模型解析

请描述如何使用`BeautifulSoup`或其他类似的库来解析 HTML 或 XML 数据。

数据库核心术语解析与应用

相关课程

更多

云计算工程师解析与实战-网络专家篇（体验版）

深入解析Docker容器化技术

大数据之R语言速成与实战

Java面试疑难点解析 - 面试技巧及语言基础

Java面试疑难点解析 - Java Web开发

Java面试疑难点解析 - 系统架构及项目设计

相关电子书

更多

神龙云服务器产品及技术深度解析

弹性创造价值：基于ECS的最佳性价比实践解析

又快又稳：阿里云下一代虚拟交换机解析

相关实验场景

更多

通过云拨测对指定服务器进行Ping/DNS监测

推荐系统入门之使用ALS算法实现打分预测

自然语言入门：NLP数据读取与数据分析

推荐镜像

更多

DNS

NTP

kali-security

下一篇

部署LAMP环境（Alibaba Cloud Linux 3）