This is a test version of Biostars. For the public version, visit https://www.biostars.org.
Removing a DOT after each sequence

Hi, I have a FASTA file which contains a . after each sequence. How is it possilble to remove the dot?

>gene39576 gene=rps16
MVKLRLKRCGRKQRAVYRIVAIDVRSRREGKDLRKVGFYDPIKNQTYLNVPAILYFLEKG
AQPTGTVQDILKKAEVFKELRPNQS.
>gene39578 gene=psbK
MLNTFSLIGICLNSTLFSSSFFFGKLPEAYAFLNPIVDIMPVIPLFFFLLAFVWQAAVSF
R.
>gene39579 gene=psbI
MLTLKLFVYTVVIFFVSLFIFGFLSNDPGRNPGREE.
>gene39580 gene=NitoCp007
MIPDVILDVKNKIKRGFPCLIFKFSYDLVYSTHLTKNKNKGFRNLKKKNQVINGKRGIRT
LGTINSYNGLAIRRFSPLSHLSQLKKIITT.
>gene39584 gene=atpA
MVTIRADEISNIIRERIEQYNREVKVVNTGTVLQVGDGIARIHGLDEVMAGELVEFEEGT
IGIALNLESNNVGVVLMGDGLLIQEGSSVKATGRIAQIPVSEAYLGRVINALAKPIDGRG
EISASEFRLIESAAPGIISRRSVYEPLQTGLIAIDSMIPIGRGQRELIIGDRQTGKTAVA
TDTILNQQGQNVICVYVAIGQKASSVAQVVTTLQERGAMEYTIVVAETADSPATLQYLAP
YTGAALAEYFMYRERHTLIIYDDPSKQAQAYRQMSLLLRRPPGREAYPGDVFYLHSRLLE
RAAKLSSSLGEGSMTALPIVETQSGDVSAYIPTNVISITDGQIFLSADLFNSGIRPAINV
GISVSRVGSAAQIKAMKQVAGKLKLELAQFAELEAFAQFASDLDKATQNQLARGQRLREL
LKQSQSAPLTVEEQIMTIYTGTNGYLDSLEVGQVRKFLVELRTYLKTNKPQFQEIISSTK
TFTEEAEALLKEAIQEQTDRFILQEQA.

Thank you in advance,

sequence bioawk

I have tried both the cmd suggested above.

seqkit replace -sp "\." -r "" test.fa and grep -v "\." test.fa

&

seqkit replace -sp "\." -r "" test.fa and grep -v "\." test.fa

But i am still having the dots. I am adding the sequence here for you convenience (9th charecter on the string).

Can i please get any suggestions? @pierre lindenbaum cpad0112

>asap_1791
LTICQSKS.LCLGLGINLHLMYLGEIAPKRMRGILTLTCAVYLSIGKLLAQVIGLKELMGTEDMWPYLLA

You can use the following:

sed 's/\.//g' test.fa > test2.fa

2 answers

sed :

 sed '/^[^>]/s/\.$//'

It turns out a DOT is also available in the middle of each sequence. How it be possible to extend the sed command?

Did you try sed '/^[^>]/s/\.//' ? @ Ric

try seqkit replace -sp "\." -r "" test.fa and grep -v "\." test.fa on OP fasta sequences.

Log in to answer this question.