原文:统计 fasta 文件序列长度及 GC 含量

注:该脚本适用于序列不断开的情况 可用一下命令将折行的序列合并为一行 运行脚本 升级版,输入文件是 fasta 格式即可。用 Bio 中的 Seq.IO 解析 fasta 文件, 用 python 的内置函数 count 的计算速度更快。 ...

2017-01-14 03:25 0 3357 推荐指数:

查看详情

统计fasta序列条数

1.统计大于号开始的行数或seqkit 工具 Total sequence length 5,759,798,599 Total ungapped length 5,759,798,599 Number of contigs 1,397,492 Contig N50 9,587 Contig ...

Sat Feb 23 05:30:00 CST 2019 0 678
统计 fastq 文件 q20 , GC 含量的软件

二代测序的分析过程中,经常需要统计原始下机数据的数据量,看数据量是否符合要求;另外还需要统计q20,q30,GC含量等反应测序质量的指标; 在kseq.h 的基础上稍加改造,就可以实现从fastq 文件统计这些指标的功能,而且速度非常的快 源代码保存为 parse.c ...

Tue Feb 14 22:56:00 CST 2017 6 2483
fasta文件序列的排序

同样的名为read_1.fa 的fasta文件,里面有若干序列,如: > ...

Thu May 18 06:03:00 CST 2017 0 1322
【Python小试】判断一条序列GC含量高低

题目: 随便给定一条序列,如果GC含量超过65%,则认为高。 编程: 测试 解析 Python提供了__future__模块,把下一个新版本的特性导入到当前版本,于是我们就可以在当前版本中测试一些新版本的特性。 主要解决python2版本中和python3不同的一些问题 ...

Tue Apr 21 07:23:00 CST 2020 0 611
根据bed文件fasta文件中获取基因序列

第一次写博客,分享一个做的提取基因序列的程序,根据bed文件里的位置信息从基因组里提取序列 源码地址:https://github.com/Liuyuan2018/fastaTools/blob/master/pyGetFasta.py bed文件通常用来保存注释基因信息,BED文件必须的3列 ...

Wed Nov 21 02:53:00 CST 2018 0 1142
 
粤ICP备18138465号  © 2018-2026 CODEPRJ.COM