r语言批量读取某路径下文件内容的方法-kb88凯时官网登录

来自：网络

时间：2023-05-18

阅读：

r刚入门的时候，能够正确读取单个文件就觉得小有成就，随着时间的积累，单一文件地读取已经不能满足需求了，此时，批量地做就是解放双手地过程。

使用for循环把下载地tcga数据读入r语言并转换成数据框

使用三个for循环来完成，这是第一个for循环。

1. 把所有数据读入在一个文件夹中

dir.create("data_in_one") #创建目标文件夹，也可右键创建
dir("rawdata/") #查看原路径的内容
for (dirname in dir("rawdata/")){  
  ## 1.要查看的单个文件夹的绝对路径
  mydir <- paste0(getwd(),"/rawdata/",dirname)
  ## 2.找到对应文件夹中的文件并提取名称，pattern表示模式，可以是正则表达式
  file <- list.files(mydir,pattern = "*.counts")
  ## 3.当前文件的绝对路径是
  myfile <- paste0(mydir,"/",file)
  ## 4.复制这个文件到目的文件夹
  file.copy(myfile,"data_in_one")  
}

2. 寻找tcga id并让文件名称和tcga id保持一致。

第二个for循环。文件名称和tcga id的对应关系，藏在了metadata中。

metadata <- jsonlite::fromjson("data/metadata.cart.2021-05-28.json")
metadata_id <- metadata[,c("file_name","associated_entities")]
## 1.准备容器,已经存在，我们把新数据添加在第三列
metadata_id
## 2.循环操作
for (i in 1:nrow(metadata_id)){
  print(i)
  metadata_id[i,3] <- metadata_id$associated_entities[i][[1]]$entity_submitter_id
}
## 重新命名
colnames(metadata_id)[3] <- "tcga_id"

行排序，为了把文件名称和tcga_id对应起来。读入的顺序和复制到新路径的顺序不一致，这一步的目的是让其保持一致。

rownames(metadata_id) <- metadata_id[,1]
metadata_id <- metadata_id[files,]

3. 输入文件名并提取文件的第二列(counts列)

#install.packages("data.table")
#构建函数
myfread <- function(files){
  data.table::fread(paste0("data_in_one/",files))$v2
}
## 测试文件
test <- myfread(files[1])

4.1 使用for循环来批量读入并整合到一个数据框。

## 1.创建容器
gene_id <- data.table::fread(paste0("data_in_one/",files[1]))$v1
expr_df <- data.frame(gene_id=gene_id)
## 2.按照列读入
for (i in 1:length(files)){
  print(i)
  expr_df[,i 1] = myfread(files[i])
}
## 增加列名
colnames(expr_df) <- c("gene_id",metadata_id$tcga_id)
### 意外发现
tail(expr_df$gene_id,10)
### 去掉最后5行
(nrow(expr_df)-5)
expr_df <- expr_df[1:(nrow(expr_df)-5),]
save(expr_df,file = "output/brca_rnaseq_exprdf.rdata")

4.2 使用lapply function 模式

1.函数

myfread <- function(files){
  data.table::fread(paste0("data_in_one/",files))$v2
}
### 2.lapply
dd = lapply(files,myfread)
### 3.do.call
expr_df = as.data.frame(do.call(cbind,dd))
### 4.添加名称
colnames(expr_df) = metadata_id$tcga_id
rownames(expr_df) = data.table::fread(paste0("data_in_one/",files[1]))$v1

目录step1. 绘图数据的准备step3. 绘图所需package的安装、调用step4. 绘图改变size的大小调整顺序又是一年春来到，小仙祝大家在新的一年开开心心、顺顺利利！
今天给大家分享

2023-05-18 00:29:17

目录什么是ebimage1. 图像读取与保存2.色彩管理3.图像处理4.空间变换5.形态运算6.图像分割本文摘自《keras深度学习：入门、实战及进阶》第四章部分章节。什么是ebimageebimag

2023-05-18 00:28:50

目录step1. 绘图数据的准备step2. 绘图数据的读取step3. 绘图所需package的安装、调用step4. 绘图小提琴图之前已经画过了，不过最近小仙又看到一种貌美的画法，决定复刻一下。

2023-05-18 00:28:44

目录第一种实现方法：用aggregate计算数据第二种实现方法：用dplyr包计算数据笔者近期画了一张带error bar的分组条形图，将相关的代码分享一下。感谢网友青山屋主的建议，提示笔者

2023-05-18 00:28:35

目录1.列表1.1创建1.2 访问 1.3 注意2.数据框2.1 创建2.2 访问1.列表列表“list”是一种比较的特别的对象集合，不同的序号对于不同的元素，当然元素的也可以是不同类

2023-05-18 00:28:13

目录step1. 绘图数据的准备step2. 绘图数据的读取step3.绘图所需package的调用step4.绘图调整3d点的大小调整透明度注意事项它来了它来了，它顺着网线走来了…
哈哈，今天

2023-05-18 00:28:12

目录step1. 绘图数据的准备step2. 绘图数据的读取step3. 绘图所需package的安装、调用step4. 绘图调整透明度更改顺序更改线条形状今天给大家介绍一下ridgeline plot（山脊图）

2023-05-18 00:28:09

上一次小仙同学分享了 facet violin plot的画法，最后还卖了个关子，给大家留了个悬念。科研文章的插图通常要求比较高，不仅要精准地展示出数据，选对图表类型，还需要简洁优美（?翻译

2023-05-18 00:28:07

目录step1. 绘图数据的准备step2. 绘图数据的读取step3.绘图所需package的调用step4.绘图环形柱状图排好序的环形柱状图调整颜色注意事项不知不觉，距离小仙上次发文已经过去

2023-05-18 00:27:29

目录step1. 绘图数据的准备step2. 绘图数据的读取step3. 绘图所需package的安装、调用step4. 绘图今天小仙给大家分享一下slope chart(坡度图)的画法，我在paper中看到的图是

2023-05-18 00:27:22

目录step 1. 绘图数据的准备step2. 绘图数据的读取step3.绘图所需package的调用step4. 饼图百分比标签准备step5.绘图今天要给大家介绍的pie chart（饼图），本来是不打算写这个的

2023-05-18 00:27:16

目录step1. 绘图数据的准备step2. 绘图数据的读取step3.绘图所需package的安装、调用step4.绘图添加平均值添加误差线今天要给大家介绍的是点图（dot plot)，点图展示的数据比较

2023-05-18 00:26:54

目录引言安装例子高级特性引言patchwork是基于ggplot2的拼图包，因为ggplot2本身没有强大的拼图语法，而一般使用的gridextra与cowplot的拼ggplot2图形都存在不少问题。我关注这

2023-05-18 00:26:46

条形统计图是用一个单位长度表示一定的数量,根据数量的多少画成长短不同的直条.带误差的条形图可以通过误差线来判断显著性。继续使用我们的汽车销售数据（公众号回复：汽车销售

2023-05-18 00:26:32

目录1.读取数据2.auc和ci的计算3.利用ggplot2绘图4.合并多个roc曲线结果proc是一个专门用来计算和绘制roc曲线的r包，目前已被cran收录，因此安装也非常简单，同时该包也兼容ggplo

2023-05-18 00:26:26

目录step1. 绘图数据的准备step2. 绘图数据的读取step3.绘图所需package的安装、调用step4. 绘图step5.美化老铁们，许久未见啦。顺便说一下，最近可不是小仙同学偷懒哟，电脑上个

2023-05-18 00:26:23

目录1.正整数下标2.负整数下标3.空下标与零下标4.下标超界5.逻辑下标6. which()、which.min()、which.max() 函数7. 元素名8.用 r 向量下标作映射9.集合运算练习 1.正整数下

2023-05-18 00:26:18

时光飞逝，岁月如梭，转眼又是一年过去了，本小仙怎么还是一事无成呢！转念一想，这种事也不是一次两次了，再多一个又何妨，哈哈！回归正题，今天就给大家介绍下直方图（histogram）的“好兄

2023-05-18 00:26:11

目录火山图输入数据格式使用significant列绘制火山图自动计算significant列绘制火山图火山图中标记基因的名字火山图火山图用于展示基因表达差异的分布，横轴为log2 fold chan

2023-05-18 00:26:06

r刚入门的时候，能够正确读取单个文件就觉得小有成就，随着时间的积累，单一文件地读取已经不能满足需求了，此时，批量地做就是解放双手地过程。使用for循环把下载地tcga数据读入r语

2023-05-18 00:26:01

目录前言一、r包及数据二、upset()函数1）基本参数2）queries参数3）attribute.plots参数3.1 添加柱形图和散点图3.2 添加箱线图3.3 添加密度曲线图前言介绍一个r包upsetr，专门用来

2023-05-18 00:25:57

目录引言绘图示例1、下载安装ggtreeextra包2、加载依赖包3、设置工作目录4、数据来源5、获取数据6、绘制树状图7、获取数据集绘制图a、绘制点图层b、绘制热图层c、绘制热图

2023-05-18 00:25:52

前言h5只是一种简单的数据组织格式【层级数据存储格式(hierarchicaldataformat：hdf)】，该格式被设计用以存储和组织大量数据。在一些单细胞文献中，作者通常会将分析的数据上传

2023-05-18 00:25:45

目录更新前原文作图方法：step1.绘图数据的准备step2.绘图数据的读取step3.绘图所需package的安装、调用step4.绘图数据格式调整step5.绘图填充透明度调整方法如下：1.取消编组2

2023-05-18 00:25:43

目录step1. 绘图数据的准备step2. 绘图数据的读取step3.绘图所需package的调用step4.因子水平排序step5.绘图今天给大家分享的是lollipop chart(棒棒糖图)的画法。棒棒糖图

2023-05-18 00:25:19

目录step1. 绘图数据的准备step2. 绘图数据的读取step3.绘图所需package的安装、调用step4.绘图step5.美化又是一个好久不见，朋友们你们最近还好吗！最近小仙同学刚经历了人生

2023-05-18 00:25:14

目录前言效果展示小结参考附录：rvirusbroadcast代码前言前几天微博的一个热搜主题是**“计算机仿真程序告诉你为什么现在还没到出门的时候！！！”**，该视频用模拟的疫情

2023-05-18 00:25:10

目录1. w检验（shapiro–wilk (夏皮罗–威克尔 ) w统计量检验)2. k检验(经验分布的kolmogorov-smirnov检验)3. 相关性检验：4. t检验5. 正态总体方差检验6. 二项分布

2023-05-18 00:24:45

目录1.日期和日期时间类型2.从字符串生成日期数据3.日期显示格式4.访问日期时间的组成值5.日期舍入计算6.日期计算 6.1 时间长度 6.2 时间周期 6.3 时间区间7.基本r

2023-05-18 00:24:40

目录简介开始作图1. pca 分析图本质上是散点图2. 为不同类别着色3. 样式微调简介主成分分析（principal component analysis，pca）是一种无监督的数据降维方法，通过主成分分析可以

2023-05-18 00:24:31

2021-03-11

2021-03-12

2021-03-16

2021-03-11

2021-11-06

2021-03-11

2021-11-06

2021-03-15

r语言批量读取某路径下文件内容的方法-kb88凯时官网登录

r语言绘制数据可视化dumbbell plot哑铃图

详解r语言图像处理ebimage包

r语言绘制数据可视化小提琴图violin plot with dot画法

r语言绘制带errorbar的分组条形图代码的分享

r语言列表和数据框的具体使用

使用r语言绘制3d数据可视化scatter散点图实现步骤

r语言绘图数据可视化ridgeline plot山脊图画法

r语言绘图技巧导出高清图方法

r语言数据可视化绘制circular bar plot实现环形柱状图

r语言数据可视化绘图slope chart坡度图画法

r语言绘图数据可视化pie chart饼图

r语言数据可视化绘图dot plot点图画法示例

r语言ggplot2拼图包patchwork安装使用

r语言绘制带误差线的条形图

r语言实现漂亮的roc图效果

r语言绘制facet violin plot小提琴刻面图实现示例

r语言向量下标和子集的使用

r语言数据可视化绘图bar chart条形图实现示例

r语言学习之火山图的绘制详解

r语言批量读取某路径下文件内容的方法

r语言upset包实现集合可视化示例详解

r包ggtreeextra绘制进化树

r语言rhdf5读写hdf5并展示文件组织结构和索引数据

r语言绘制radar chart雷达图

r语言数据可视化绘图lollipop chart棒棒糖图

r语言绘制bubble matrix气泡矩阵图

r语言模拟疫情传播图rvirusbroadcast展示疫情数据

基于r语言数据检验详解

r语言日期时间的使用

r语言实现pca主成分分析图的示例代码

热点内容

免费资源网

在线工具

扫一扫随时看

本站下载频道