导航:首页 > 数据分析 > 如何用r将数据分类

如何用r将数据分类

发布时间:2023-03-31 17:34:41

⑴ 如何在R中导入不同类型的数据

在使用R的时候,我们肯定需要导入数据,现在总结一下如何导入不同类型的数据:
1.使用键盘输入数据
在导入数据比较少的时候,我们使用这种方法。R中的函数 edit() 会自动调用一个允许手动输入数据的文本编辑器。具体步骤如下:
(1) 创建一个空数据框(或矩阵) ,其中变量名和变量的模式需与理想中的最终数据集一致;
(2) 针对这个数据对象调用文本编辑器,输入你的数据,并将结果保存回此数据对象中。在下例中,你将创建一个名为 mydata 的数据框,它含有三个变量: age (数值型) 、 height(字符型)和 weight (数值型) 。然后通过edit()函数调用文本编辑器,键入数据,最后保存结果。编辑器界面如下,我们在这个界面可以输入变量值,也可以改变变量类型。
[plain] view plain
mydata<-data.frame(age=numeric(0),height=numeric(0),weight=numeric(0))
edit(mydata)
需要注意的是函数 edit() 事实上是在对象的一个副本上进行操作的。如果你没有将它其赋值到一个对象,你的所有修改将会全部丢失!
2.导入带分隔符的文本文件数据/CSV文件
read.table() 可以从带分隔符的文本文件中导入数据。此函数可读入一个表格格式的文件并将其保存为一个数据框。其语法如下:
read.table(file,header=value,sep="delimter",row.names="name")
file表示文件名,header表示表的首行是否包含变量值的逻辑值,sep 用来指定分隔数据的分隔符, row.names 用以指定一个或多个表示行标识符的变量,是个一可选参数,他还有许多参数,可以通过帮助文档进行查看。
3.导入Excel数据
虽然Excel可能是世界上最流行的数据分析工具,但R如果直接读取Excel数据还是比较困难的。
但我们可以在Excel中将数据将其导出为一个逗号分隔文件(csv) ,并使用前文描述的方式将其导入R中。在Windows系统中,你也可以使用 RODBC 包来访问Excel文件。但它好像只能在32位的R软件上面使用。虽然也有一些包可以这些问题,比如gdata,XLConnect,xlsReadWrite等,但它的有许多前提要求,比如Java环境,Per,或者32-bit R。因此一般情况将数据转换为csv文件或者将数据导入到数据库在导入在R。
4.导入XML数据
强大的R中有若干用于处理XML文件的包。 XML 包允许用户读取、写入和操作XML文件。因为我还没有遇到这种数据,因此还不太清楚xml包大体如何使用,感兴趣的朋友可以下载xml包,通过帮助文档进行学习。
5.从网页抓取数据
不仅Python可以爬取网页数据,R也可以在Web数据抓取。在这个的过程中,用户可以从互联网上提取嵌入在网页中的信息,并将其保存为R中的数据结构以做进一步的分析。 完成这个任务的一种途径是使用函数 readLines()下载网页,然后使用如 grep() 和 gsub() 一类的函数处理它。对于结构复杂的网页,可以使用RCurl 包和 XML 包来提取其中想要的信息。
6.导入SPSS数据
我们可以调用通过 foreign 包中的函数 read.spss() 将SPSS数据集可以导入到R中,也可以使用 Hmisc 包中的 spss.get() 函数。函数 spss.get() 是对 read. spss() 的一个封装,它可以为你自动设置后者的许多参数,让整个转换过程更加简单一致,最后得到数据分析人员所期望的结果。使用的时候我们只需要安装Hmisc 包,在较新的R中foreign 包已被默认安装。
[plain] view plain
mydata<-spss.get("data.sav",use.value.labels=TRUE)

这段代码中,data.sav 是要导入的SPSS数据文件, use.value.labels=TRUE 表示让函数将带有值标签的变量导入为R中水平对应相同的因子, mydataframe 是导入后的R数据框。

⑵ 如何用r语言进行数据分类

  1. 通过选择菜单

    程序包->安装程序包->在弹出的对话框中,选择你要安装的包,然后确掘梁定。

  2. 使用命令

    install.packages("package_name","dir")package_name:是指岁樱定要安装的包名,请注意大小写。dir:包安装的路径。默认情况下是安装在..library 文件夹中的。可以通过本参数来进行修改,来选择安装的文件夹。

  3. 本地来安装

    如果你已经下载的相应的包的压缩文件,则可以在本地来进行安装。请注意在windows、unix、macOS操作系统下安装文件的后缀名是不一样的:

    1)linux环境编译运行:tar.gz文件

    2)windows 环境编译运行 :.zip文件

    3)MacOSg环境编译运行:.tgz文件

  4. 加载包

包安装后,如果要使用包的功能。必须先把包加载到内存中(默认情况下,R启动后默认加载基本包),加载包命令:

Library(“包名”)

阅读全文

与如何用r将数据分类相关的资料

热点内容
angularjs表头固定 浏览:43
怎么样对excel设密码 浏览:108
光纤移动拨号连接错误代码651 浏览:165
什么网站买票订酒店便宜 浏览:317
天涯摄影小说网站怎么找 浏览:915
搜索不到视频文件 浏览:560
求生之路2哪个版本可以联机 浏览:472
word2010关闭页眉横线 浏览:626
db在数据结构里什么意思 浏览:29
室内效果图建模教程 浏览:364
A类地址网络号为什么不能全0 浏览:466
上古卷轴ol目前版本 浏览:420
黑蝴蝶的app是什么软件 浏览:456
程序批量查询网站信息 浏览:57
丽枫酒店订房间app是什么 浏览:241
拾零工具箱官网下载 浏览:49
房地产估价师视频哪个网站有 浏览:836
cad图形工具在哪 浏览:487
mastercamx哪个版本好 浏览:539
微信数据如何全部导出 浏览:781

友情链接