Introduction to basic linux commands
#!/bin/bash
##mk subdirectories for projects ##Quiz 1
mkdir exercise
cd exercise
mkdir dataset result analysis
cd result
touch "nucleotide_C_count.txt" "nucleotide_T_count.txt" "nucleotide_G_count.txt" "nucleotide_A_count.txt" "nucleotidecount.txt" "sequence_names.txt" "non_transcripts_count.txt" "non_mrna.txt" "predicted.txt" "predicted_count.txt" "mrna_transcripts.txt" "organism.txt" "mrna_transcript_count.txt"
cd ../dataset
##Quiz 4
grep ">" *.fa | cat > /home/odongo/Desktop/exercise/result/sequence_names.txt
grep ">" *.fa | grep "mRNA" | uniq | cat >/home/odongo/Desktop/exercise/result/mrna_transcripts.txt
##count mrna transcripts
grep ">" *.fa | grep "mRNA" |cut -d "," -f1 |cut -d ":" -f3| cut -d "" -f12 |sort| uniq | wc -l| cat > /home/odongo/Desktop/exercise/result/mrna_transcript_count.txt
grep ">" *.fa | grep -v "mRNA" | cat > /home/odongo/Desktop/exercise/result/non_mrna.txt
###Extract predicted sequences and count them .Store count in predicted_count.txt and sequences in predicted.txt in your result directory
grep "PREDICTED" *.fa | cat > /home/odongo/Desktop/exercise/result/predicted.txt
grep "PREDICTED" *.fa | wc -l| cat > /home/odongo/Desktop/exercise/result/predicted_count.txt
### count non mrna transcripts and store in non_transcripts_count.txt and mrna
grep ">" *.fa | grep -v "mRNA"| cat > /home/odongo/Desktop/exercise/result/non_transcripts.txt
grep ">" *.fa | grep -v "mRNA"| wc -l| cat > /home/odongo/Desktop/exercise/result/non_transcripts_count.txt
grep ">" *.fa | grep "mRNA" |cut -d "," -f1 |cut -d ":" -f3| cut -d "" -f12 |sort| uniq | cat > /home/odongo/Desktop/exercise/result/organism.txt
grep -v "nrf1" *.fa | tr -d '\n' | grep -o '[AGCTagct]' | wc -c > /home/odongo/Desktop/exercise/result/nucleotidecount.txt
grep -v "nrf1" *.fa | tr -d '\n' | grep -o 'A' | wc -c > /home/odongo/Desktop/exercise/result/nucleotide_A_count.txt
grep -v "nrf1" *.fa | tr -d '\n' | grep -o 'G' | wc -c > /home/odongo/Desktop/exercise/result/nucleotide_G_count.txt
grep -v "nrf1" *.fa | tr -d '\n' | grep -o 'C' | wc -c > /home/odongo/Desktop/exercise/result/nucleotide_C_count.txt
grep -v "nrf1" *.fa | tr -d '\n' | grep -o 'T' | wc -c > /home/odongo/Desktop/exercise/result/nucleotide_T_count.txt