统计碱基数目、GC含量、read数、最长的read、最短的read及平均read长度

首页 > 代码库 > 统计碱基数目、GC含量、read数、最长的read、最短的read及平均read长度

统计碱基数目、GC含量、read数、最长的read、最短的read及平均read长度

2024-09-01 15:35:06 218人阅读

# 用于fasta格式文件的碱基数目和GC含量的统计

grep -v ‘>‘ input.fa| perl -ne ‘{$count_A=$count_A+($_=~tr/A//);$count_T=$count_T+($_=~tr/T//);$count_G=$count_G+($_=~tr/G//);$count_C=$count_C+($_=~tr/C//);$count_N=$count_N+($_=~tr/N//)};END{print qq{total count is },$count_A+$count_T+$count_G+$count_C+$count_N, qq{\nGC%:},($count_G+$count_C)/($count_A+$count_T+$count_G+$count_C+$cont_N),qq{\n} }‘

用于fastq格式文件的read数、碱基数、最长的read、最短的read及平均read长度

perl -ne ‘BEGIN{$min=1e10;$max=0;}next if ($.%4);chomp;$read_count++;$cur_length=length($_);$total_length+=$cur_length;$min=$min>$cur_length?$cur_length:$min;$max=$max<$cur_length?$cur_length:$max;END{print qq{Totally $read_count reads\nTotally $total_length bases\nMAX length is $max bp\nMIN length is $min bp \nMean length is },$total_length/$read_count,qq{ bp\n}}‘ input.fq

# 用于fasta格式文件的read数、碱基数、最长的read、最短的read及平均read长度

perl -ne ‘BEGIN{$min=1e10;$max=0;}next if ($.%2);chomp;$read_count++;$cur_length=length($_);$total_length+=$cur_length;$min=$min>$cur_length?$cur_length:$min;$max=$max<$cur_length?$cur_length:$max;END{print qq{Totally $read_count reads\nTotally $total_length bases\nMAX length is $max bp\nMIN length is $min bp \nMean length is },$total_length/$read_count,qq{ bp\n}}‘ input.fa

统计碱基数目、GC含量、read数、最长的read、最短的read及平均read长度

声明：以上内容来自用户投稿及互联网公开渠道收集整理发布，本网站不拥有所有权，未作人工编辑处理，也不承担相关法律责任，若内容有误或涉及侵权可进行投诉：投诉/举报工作人员会在5个工作日内联系你，一经查实，本站将立刻删除涉嫌侵权内容。

联系
我们

首页 > 代码库 > 统计碱基数目、GC含量、read数、最长的read、最短的read及平均read长度

统计碱基数目、GC含量、read数、最长的read、最短的read及平均read长度

看完仍有疑问？有类似问题直接问程序猿