diff --git a/data/genomics/homo_sapiens/README.md b/data/genomics/homo_sapiens/README.md index c9c83dcea..3b5c9b3b3 100644 --- a/data/genomics/homo_sapiens/README.md +++ b/data/genomics/homo_sapiens/README.md @@ -228,6 +228,21 @@ cat << EOF > GenomeSize.xml EOF ``` +Similarly, the GenomeSize.xml index for the entirety of chr22 (`homo_sapiens/genome/chr22/sequence/GenomeSize.xml`) was created accordingly: + +```bash +stripped_seq=$(mktemp) +tail -n +2 hg38.chr22.fasta | tr -d '\n' > $stripped_seq +length=$(wc -c $stripped_seq | cut -f 1 -d ' ' ) +md5=$(md5sum $stripped_seq | cut -f 1 -d ' ' ) + +cat << EOF > GenomeSize.xml + + + +EOF +``` + ### Genome map There is multiple type of genetic map depending on the softwares. diff --git a/data/genomics/homo_sapiens/genome/chr22/sequence/GenomeSize.xml b/data/genomics/homo_sapiens/genome/chr22/sequence/GenomeSize.xml new file mode 100644 index 000000000..630bf371c --- /dev/null +++ b/data/genomics/homo_sapiens/genome/chr22/sequence/GenomeSize.xml @@ -0,0 +1,4 @@ + + + +