Sequence of DPV Rice hoja blanca virus

Rice hoja blanca virus nonstructural protein 3 and nucleoprotein genes, complete cds.

ACC No: L07940

Dated: 2007-09-25 | Length: 2299 | CRC: 376418285

                
ID   L07940; SV 1; linear; genomic RNA; STD; VRL; 2299 BP.
XX
AC   L07940;
XX
DT   07-JAN-1993 (Rel. 34, Created)
DT   25-SEP-2007 (Rel. 93, Last updated, Version 6)
XX
DE   Rice hoja blanca virus nonstructural protein 3 and nucleoprotein genes,
DE   complete cds.
XX
KW   N gene; nonstructural protein NS3; NS3-glycoprotein; nucleoprotein;
KW   ribonucleoprotein.
XX
OS   Rice hoja blanca virus
OC   Viruses; ssRNA negative-strand viruses; Tenuivirus.
XX
RN   [1]
RP   1-2299
RX   PUBMED; 8046420.
RA   de Miranda J., Hernandez M., Hull R., Espinoza A.M.;
RT   "Sequence analysis of rice hoja blanca virus RNA 3";
RL   J. Gen. Virol. 75(Pt 8):2127-2132(1994).
XX
FH   Key             Location/Qualifiers
FH
FT   source          1. .2299
FT                   /organism="Rice hoja blanca virus"
FT                   /strain="Costa Rica"
FT                   /mol_type="genomic RNA"
FT                   /db_xref="taxon:12332"
FT   misc_structure  1. .20
FT   CDS             96. .707
FT                   /codon_start=1
FT                   /product="nonstructural protein 3"
FT                   /note="NS-3; putative"
FT                   /db_xref="InterPro:IPR007974"
FT                   /db_xref="UniProtKB/TrEMBL:Q67897"
FT                   /protein_id="AAA53423.1"
FT                   /translation="MNVSLYYSGTPVSSHSLLSKNGLSNIVLTCKDLPIPIDLLSLFFD
FT                   ILNERHPSFDEHMFLQMIRKPDDPENLSVFLKSAIWMLSHKRDLPGHYRLPLTCLVSTY
FT                   SEYFVELKPRQPSTKCWFCKIAKDGLPFRVEGVHGFPSEAELYIVPSKEHAIESFEVLS
FT                   GKKLYRSPSKKKHGYLIASNKPPLTSKYVEYDPSKPDTKP"
FT   stem_loop       708. .1224
FT   repeat_region   940. .956
FT   repeat_region   1150. .1166
FT   CDS             complement(1225. .2184)
FT                   /codon_start=1
FT                   /product="nucleoprotein"
FT                   /function="ribonucleoprotein"
FT                   /note="N-protein"
FT                   /db_xref="GOA:Q67898"
FT                   /db_xref="InterPro:IPR008864"
FT                   /db_xref="UniProtKB/TrEMBL:Q67898"
FT                   /experiment="experimental evidence, no additional details
FT                   recorded"
FT                   /protein_id="AAA53424.1"
FT                   /translation="MTMSVADVQTEIERVTTLALKYITDHKDTLVTFVGQIEYNGYDAG
FT                   KLLQILKRKAEGRDFGKDLCYLLVMRYTRGTGFVRDVRKKIKTAAGGDTAHEIVTHYGV
FT                   VQSVGDNADAITLGRLASLFPAVSMNIVRNVSTGAKLAVDSSDLGSSGLDLLLWDFVPQ
FT                   FITLDSLTAPYCTGKGMNTILFSLHVLHGALTTKKTMPDQKKKARSLVTDFELVKYTTE
FT                   LLVITCNAKNLKVEKKTIYRESLMRPFQEGAGDALGFKETFWTSLAKVSTGCVRKMKKD
FT                   AQAYLSERTPLLKVFVENCNKSEDEVAEAIKSYFVTGA"
FT   misc_structure  2279. .2299
XX
SQ   Sequence 2299 BP; 667 A; 510 C; 410 G; 712 T; 0 other;

l07940 Length: 2299  25-SEP-2007  Type: N  Check: 6970  ..

       1  acacaaagtc ctgggtataa aaaaacaaac aaagatataa gaagagaaaa
      51  actttagtga cttgatatct aattacagga atcatatagt acaagatgaa
     101  cgtgtccttg tactacagcg ggactcctgt ctctagtcat agcttgctca
     151  gcaagaatgg tctgtcaaac attgttttga cttgtaagga tctacccata
     201  cccattgatc tcttgtctct tttctttgat atcctcaatg aacgacaccc
     251  aagcttcgat gaacacatgt ttttacaaat gattaggaag ccagatgatc
     301  ctgagaattt gtctgttttc ttgaagagtg cgatatggat gctctctcac
     351  aagagagatt tgccagggca ttacagactg cctctgactt gtttggtttc
     401  aacatatagt gagtattttg ttgaactaaa gcctcggcag ccatcaacaa
     451  aatgctggtt ttgtaagata gccaaggatg gattgccttt tagagtcgaa
     501  ggtgtccatg gcttcccgtc agaagcagag ctatacattg tcccttcaaa
     551  agagcatgca atcgagagct ttgaagtgct cagcgggaag aagttataca
     601  gatctcctag caagaagaaa catggatatt tgatagcttc aaataagcca
     651  ccactgactt ccaaatatgt cgagtatgac cccagcaaac ccgatactaa
     701  accatgaatg cactcattac tgcttccact ttaggcttgg tctactctcc
     751  atggttgtga acctaacaga gccttcaact ctctgagatt ctctcatctc
     801  gaacaaaaac aaataggcta agcctatttt ctcttaaaaa tagtatctgt
     851  gctaagcaca gcatccggat attgtttcgg atggttttta cctaacctaa
     901  tttttttgga tttttgttta ttttttgatt tttttgatta tttacatatt
     951  tacaagattt ttcatggttt tttcattttt ttagttttgt tttccttgat
    1001  atacactcaa atagcaagta catggttaat ttactttcaa ggcatagcac
    1051  actcaacaca cataataatg atatatagga caagatacta atttaaacaa
    1101  caatatagaa tatagaactt aaaagctaat gagattcata catatgataa
    1151  tttacatatt tacaaccaat ctgatttctc atcctttcca gcttcatcta
    1201  ccatctcaat ctgaactctc cattttatgc cccagtgaca aagtagcttt
    1251  tgatcgcctc agcaacctca tcctcactct tgttgcagtt ctccacaaat
    1301  actttcagta gaggagttct ctctgacaaa tatgcttgtg catctttttt
    1351  catctttctg acacaccccg tggagacctt tgctagagag gtccagaaag
    1401  tctctttgaa tccaagagca tctccagcgc cttcttggaa aggcctcatc
    1451  aaagactctc tataaattgt cttcttctct accttgagat tcttggcatt
    1501  acaagtgatg accaataatt cagttgtata tttcaccaac tcaaaatcag
    1551  tcacaaggct tctagccttc ttcttctgat caggcatggt cttcttagtg
    1601  gttagagcac catgcaagac atgcaaggag aagagaattg tgttcatgcc
    1651  ttttcctgtg cagtaagggg cagtcagaga gtccagagtg ataaactgag
    1701  gaacaaagtc ccagaggagg aggtctaagc ctgatgaccc taaatctgaa
    1751  gagtcaaccg ctagcttggc tccagttgat acattcctca ctatgttcat
    1801  tgacacagca gggaacagtg acgcaagtct gcctagagtt atagcatcag
    1851  cattatctcc aacagattgc acaactccat aatgtgtcac tatctcatgt
    1901  gcagtgtcac ctccagctgc tgtcttgatc ttctttctaa catctctgac
    1951  aaacccagta cccctggtgt atctcatcac caagagataa cagagatcct
    2001  ttccaaaatc tctcccttca gcctttctct tcaagatctg gaggagcttg
    2051  cctgcatcat agccattgta ctctatctga ccaacaaaag tcactagcgt
    2101  gtccttgtga tcagttatgt acttgagggc tagtgtagtg accctctcaa
    2151  tctcagtctg aacatcagca actgacatcg tcattgttgc aaccacagtt
    2201  atgtcttcac gaatgggggc aattgtaaga tttatcagaa gtacgtttca
    2251  gaaaacactc ttgcttgatg atctttacaa tgctacccag actttgtgt