-
Notifications
You must be signed in to change notification settings - Fork 7
Expand file tree
/
Copy pathDNA_sequence_database.txt
More file actions
236 lines (234 loc) · 15.8 KB
/
Copy pathDNA_sequence_database.txt
File metadata and controls
236 lines (234 loc) · 15.8 KB
1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
20
21
22
23
24
25
26
27
28
29
30
31
32
33
34
35
36
37
38
39
40
41
42
43
44
45
46
47
48
49
50
51
52
53
54
55
56
57
58
59
60
61
62
63
64
65
66
67
68
69
70
71
72
73
74
75
76
77
78
79
80
81
82
83
84
85
86
87
88
89
90
91
92
93
94
95
96
97
98
99
100
101
102
103
104
105
106
107
108
109
110
111
112
113
114
115
116
117
118
119
120
121
122
123
124
125
126
127
128
129
130
131
132
133
134
135
136
137
138
139
140
141
142
143
144
145
146
147
148
149
150
151
152
153
154
155
156
157
158
159
160
161
162
163
164
165
166
167
168
169
170
171
172
173
174
175
176
177
178
179
180
181
182
183
184
185
186
187
188
189
190
191
192
193
194
195
196
197
198
199
200
201
202
203
204
205
206
207
208
209
210
211
212
213
214
215
216
217
218
219
220
221
222
223
224
225
226
227
228
229
230
231
232
233
234
>NC_000011.10:c2161209-2159779 Homo sapiens chromosome 11, GRCh38.p13 Insulin
AGCCCTCCAGGACAGGCTGCATCAGAAGAGGCCATCAAGCAGGTCTGTTCCAAGGGCCTTTGCGTCAGGT
GGGCTCAGGATTCCAGGGTGGCTGGACCCCAGGCCCCAGCTCTGCAGCAGGGAGGACGTGGCTGGGCTCG
TGAAGCATGTGGGGGTGAGCCCAGGGGCCCCAAGGCAGGGCACCTGGCCTTCAGCCTGCCTCAGCCCTGC
CTGTCTCCCAGATCACTGTCCTTCTGCCATGGCCCTGTGGATGCGCCTCCTGCCCCTGCTGGCGCTGCTG
GCCCTCTGGGGACCTGACCCAGCCGCAGCCTTTGTGAACCAACACCTGTGCGGCTCACACCTGGTGGAAG
CTCTCTACCTAGTGTGCGGGGAACGAGGCTTCTTCTACACACCCAAGACCCGCCGGGAGGCAGAGGACCT
GCAGGGTGAGCCAACTGCCCATTGCTGCCCCTGGCCGCCCCCAGCCACCCCCTGCTCCTGGCGCTCCCAC
CCAGCATGGGCAGAAGGGGGCAGGAGGCTGCCACCCAGCAGGGGGTCAGGTGCACTTTTTTAAAAAGAAG
TTCTCTTGGTCACGTCCTAAAAGTGACCAGCTCCCTGTGGCCCAGTCAGAATCTCAGCCTGAGGACGGTG
TTGGCTTCGGCAGCCCCGAGATACATCAGAGGGTGGGCACGCTCCTCCCTCCACTCGCCCCTCAAACAAA
TGCCCCGCAGCCCATTTCTCCACCCTCATTTGATGACCGCAGATTCAAGTGTTTTGTTAAGTAAAGTCCT
GGGTGACCTGGGGTCACAGGGTGCCCCACGCTGCCTGCCTCTGGGCGAACACCCCATCACGCCCGGAGGA
GGGCGTGGCTGCCTGCCTGAGTGGGCCAGACCCCTGTCGCCAGGCCTCACGGCAGCTCCATAGTCAGGAG
ATGGGGAAGATGCTGGGGACAGGCCCTGGGGAGAAGTACTGGGATCACCTGTTCAGGCTCCCACTGTGAC
GCTGCCCCGGGGCGGGGGAAGGAGGTGGGACATGTGGGCGTTGGGGCCTGTAGGTCCACACCCAGTGTGG
GTGACCCTCCCTCTAACCTGGGTCCAGCCCGGCTGGAGATGGGTGGGAGTGCGACCTAGGGCTGGCGGGC
AGGCGGGCACTGTGTCTCCCTGACTGTGTCCTCCTGTGTCCCTCTGCCTCGCCGCTGTTCCGGAACCTGC
TCTGCGCGGCACGTCCTGGCAGTGGGGCAGGTGGAGCTGGGCGGGGGCCCTGGTGCAGGCAGCCTGCAGC
CCTTGGCCCTGGAGGGGTCCCTGCAGAAGCGTGGCATTGTGGAACAATGCTGTACCAGCATCTGCTCCCT
CTACCAGCTGGAGAACTACTGCAACTAGACGCAGCCCGCAGGCAGCCCCACACCCGCCGCCTCCTGCACC
GAGAGAGATGGAATAAAGCCCTTGAACCAGC
>NT_176377.1:12394966-12397002 Guinea pig insulin gene
TGCAGTGTGCCACAGGGCCTCAGCCAGATGACACCCTGGCCTGAAGGGGGAGAGGGGCAGGGGTTCAGGG
AAGAAAAGAGGGAGACAAGAGAAGGCATGGCCTGGGCCTGGGGAAAGTAAGAAACAGGGGTGATTCTTAG
GGTCAAAACTCTGCTTCTCCCTGGCCTGTGCTTTCTTCAGCTCCCAGAGCAAGCTGGGGGAGTCTTGTCT
GGGGTGAAGTCCTGGGGTGGGGTAAGCAATGAGCAGGCAATAGGCAGGACACTCCCCTCATTCACCCCCA
TGACCCTGGCCATCCATGGGGCCCCCCAGAACAAAGATACAAAGACACCCTACACATACACATATGCCCA
GCTCCCAGATCTCCCTGATTAATGTGGAAAATGCTCAGCCAAGCCAAGCCTGGGGTAGGCTCTGCTCTCC
TGGAGACCTTGGCCCCCAGCTGTGAGCCGGGCGAACTCCTGCCCTCGGGTCCCTCATTAACACTAATGAC
CCCAGGGCCCAAGCAGAGGTGCTGACGCCCAAGGAGCTCTTCCTGCAGACCCAGCACCAGGGAAATGATC
CAGAAATTGCAACCTCAGCCCCCTGGCCATCTGCTGATGCCACCACCCCCAGGTCCCTAATGGGCCTGGT
GGCAGAGTTTGGGAAGATGGGCTCAGGGCTATATAAAGTCCACAAGGACCTAAGAGCCCCCAGTGCTGCT
GGGCCAGCTGTATTCTGAGGTGGTCAGCACACAGGTCTGTGTCCTCCGTGCTAGATTGGGGCTGAGAGGC
TGGGGGCTCTGGGTTGGCTGGGACAGGACATGGGATTCTTCCTTGTATTGGGGGTTTTGGCTGTTACTCT
GTCTCTCCATCAGGTCATCATCCTTTCATCATGGCTCTGTGGATGCATCTCCTCACCGTGCTGGCCCTGC
TGGCCCTCTGGGGGCCCAACACTGGTCAGGCCTTTGTCAGCCGGCATCTGTGCGGCTCCAACTTAGTGGA
GACATTGTATTCAGTGTGTCAGGATGATGGCTTCTTCTATATACCCAAGGACCGTCGGGAGCTAGAGGAC
CCACAGGGTGAGCCCCTACCTGCCATCCCTTGCTGTTTCCCGTGCCCAGTACCCCCAGCCTGGCAGGGGC
ATAAGTAAGCAGGAAGCTAATTCCAAGGAGAGTCGATGGGTTTGTTGAAAAGGGAGGCGGCTCTCTTGGT
CATTTGCTAAAGAGAGTGGCTTCCTATAGCTGCTTTGAGGGTGAGGGGGTGAGCAGGCTGCACCCTTCAG
CTGTGGCTTCTGAGCACAGCTGGACTCTTCCCTCCACTTGCCTTCGAATAGCTGCCCTGGCCTCATGGCA
ACAGTAGCTCCTGGGCACCAATTTTATTATGCAGATTGCATCTTGGTGTTGATAGCCTTAGGGTAGCCTG
GGGGCCATTCATGGGGCGCCCCATCCCTCCTTCCTCCCTGCCTCTGGACAAATGCTCCATGGAGCTCCAA
GCTCTGCCACGTGGGAGGTGTGGGTCTCCAGCGCTCTGTGTGCCCAGCATGGCAGCCTCTGTCACCTGGA
CCAGCTCCCTGGGAGATGCAGTGAGAGGGTGGTAGTGTGGGGCCAGTGCGCAGGCATTCTGCTGCTCCTG
ACAGCATCTCCCCCTGTCTCTCTCCCCACTGCTGCTGCTCCTGTATTCTGGCACCTCACCCTGCAGTGGA
GCAGACAGAACTGGGCATGGGCCTGGGGGCAGGTGGACTACAGCCCTTGGCACTGGAGATGGCACTACAG
AAGCGTGGCATTGTGGATCAGTGCTGTACTGGCACCTGCACACGCCACCAGCTGCAGAGCTACTGCAACT
AGACACCTGCCTTGAACCTGGCCTCCCACTCTCCCCTGGCAACCAATAAACCCCTTGAATGAGCCCCATT
GAATGGTCTGTGTGTCATGGAGGGGGAGGGGCTGACTCAAGGGGGCACATGCATGCCAGCCTATCATCCA
GGTTCATTGCAAGACCCCCTCTCTATGCTCTGTGCACCTCTAACACACCCCTGAGCATCTTCCTTACTCT
TCCGTGG
>V00179.1 Dog gene encoding insulin
TCCCGCAGACCCAGCACTGGGGAAATGATCCAGAAATTGCAGCCTCAGCCTCCGGCCATCTGCCACCCCC
TCATGGCCAGGCCGTGGGCTCGGGAGCTATAAAGCAGGAGGGTCCAGCAGCCCCCAGCCCCCGGAACCAT
CTGCACCCCGACACGGCCGGCAAACAGGTCTGTCCCCACGGGCTCCCCGCCGCCGCCTCCCCGCCAGCCT
GTGCTCTCAAGGCAGCAGGAGGAGAAGAGCTGCCTCGGGGCCTTTGCGGGGTGGGCTCAGGGTGGGGGGG
CCGTGCCCCTTACCAGCCTCAACCCTGCCTGTCCCCAGGTCGCCATGGCCCTCTGGATGCGCCTCCTGCC
CCTGCTGGCCCTGCTGGCCCTCTGGGCGCCCGCGCCCACCCGAGCCTTCGTTAACCAGCACCTGTGTGGC
TCCCACCTGGTAGAGGCTCTGTACCTGGTGTGCGGGGAGCGCGGCTTCTTCTACACGCCTAAGGCCCGCA
GGGAGGTGGAGGACCTGCAGGGTGAGCCCCCGCCGCCCCCGCCCTGGCTCCCTACCTGGCCCCAGGGGCA
GGCCAGGTGGAAATATTAAAAAGAAAAATGACTTTCCCTTGGTCTACATCCTGCAAGGGACCAGCTCCTT
GGTCAGGGTCAGACACCAAAAGCCTGAGGGCAGCCTCCCACCTTGGCACCACCTTGGGGCCTGGGAGCCA
CTGGCATGGGGTTGGAGTAGGCGGGACACACTCTCTCCCTGACCCTGACCCGCTCTCCGCCTGGCTCCTC
CGCAGTGAGGGACGTGGAGCTGGCCGGGGCGCCTGGCGAGGGCGGCCTGCAGCCCCTGGCCCTGGAGGGG
GCCCTGCAGAAGCGAGGCATCGTGGAGCAGTGCTGCACCAGCATCTGCTCCCTCTACCAGCTGGAGAATT
ACTGCAACTAGGGGCGCGGGGGGCAGGACGTGGCAGCACCTGCTGCAGGTCACGGTGGCCGCAAGCCTTC
GGCTCTCTGCACCCCAAGTGATTCAATAAACCCTCTGAATGAGCCCTAGTGGTGTTGTCTGTGCGGCGCA
GGGGTTGAGGTGTGGGCCAGGGGTCCTTCCAGGGACCCCCTGTTTCCTGTTCTCTCACACCAGCCCCCCC
AAACTTGGCCCCTGCCCACTGGGTGCCCAAAGGCAAGCTCCTGCCCATTGTCGGCTGCCCCCTGCCCCAG
GTGCTAGGAGGTCCCATGGCCCCTGCTGCTTCAGCACAGGACAGAGAAGGACCTCTTTTTCTCTGCGGGG
CCTGGGGGCTGGTTGGGAGCAGATTTCCCTAGCTCAAAAGCCTT
>V01243.1 Rat gene for insulin 2
GGTGCTTTGGACTATAAAGCTAGTGGGGATTCAGTAACTCCCAGCCCTAAGTGACCAGCTACAGTCGGAA
ACCATCAGCAAGCAGGTATGTACTCTCCAAGGTGGGCCTAGCTTCCCCAGTCAAGACTCCAAGGATTTGA
GGGACGCTGTGGGCTCTTCTCTTACATGTACCTTTTGCTAGCCTCAACCCTGACTATCTTCCAGGTCATT
GTTCCAACATGGCCCTGTGGATCCGCTTCCTGCCCCTGCTGGCCCTGCTCATCCTCTGGGAGCCCCGCCC
TGCCCAGGCTTTTGTCAAACAGCACCTTTGTGGTTCTCACTTGGTGGAAGCTCTCTACCTGGTGTGTGGG
GAGCGTGGATTCTTCTACACACCCATGTCCCGCCGCGAAGTGGAGGACCCACAAGGTAAGCTCTGCTCCT
GAATTCTATCCCAAGTGCTAACTACCCTGTTTGTCTTTCACCCTTGAGACCTTGTAAATTGTGCCCTAGG
TGTGGAGGGTCTCAGGCTAACCAGTGGGGGGCACATTTCTGTGGGCAGCTAGACATATGTAAACATGGTA
GCTGCCAAGAAGGAGTGAGAATCCTTCCTTAAGTCTCCTAGGTGGTGACGGGTGGCTAGGCCCCAGGATA
GGTACCTATTTGGGGACCCCATAGAGCACTGCACTGACTGAGGGATGGTAACAGGATGTGTAGGTTTTGG
AGGCCCATATGTCCATTCATGACCAGTGACTTGTCTCACAGCCATGCAACCCTTGCCTCCTGTGCTGACT
TAGCAGGGGATAAAGTGAGAGAAAGCTTGGGCTAATCAGGGGGTCGCTCAGCTCCTCCTAACTGGATTGT
CCTATGTGTCTTTGCTTCTGTGCTGCTGATGCTCTGCCCTGTGCTGACATGACCTCCCTGGCAGTGGCAC
AACTGGAGCTGGGTGGAGGCCCGGGGGCCGGTGACCTTCAGACCTTGGCACTGGAGGTGGCCCGGCAGAA
GCGCGGCATCGTGGATCAGTGCTGCACCAGCATCTGCTCTCTCTACCAACTGGAGAACTACTGCAACTAG
GCCCACCACTACCCTGTCCACCCCTCTGCAATGAATAAAACCTTTGAAAGAGCACTACAAGTTGTGTGTA
CATGCGTGCATGTGCATATGTGGTGC
>AY092023.1 Gorilla gorilla insulin gene, partial cds
GTGCGGCTCCCACCTGGTGGAAGCTCTCTACCTAGTGTGCGGGGAACGAGGCTTCTTCTACACACCCAAG
ACCCGCCGGGAGGCAGAGGACCTGCAGGGTGAGCCAACCGCCCGTTGCTGCCCCTGGCCGCCCCCAGCCA
CCCCCTGCTCCTGGCGCTCCCACCCAGCATGGGCAGAAGGGGGCAGGAGGCTGCCACCCAGCAGGGGGTC
AGGTGTACTTTTTTAAAAAGAAATGAAGTTCTCTTGGTCACGTCCTAAAAGTGACCAGCTCCCTGTGGCC
CAGTCAGAGTCTCAGCCTGAGGACGGTGTTGGCTTCGGCAGCCCCGAGATACATCAGAGGGTGGGCACGC
TCCTCCCTCCACTCGCCCCTCAAACAAATGCCCCGCAGCCCATTTCTCCACCCTCATTTGAAGACCTCAG
ATTCAAGTGTTAAGTCCTGGGTGACCTGGGGTCACAGGGTGCCCCACGCTGCCTGCCTCTGGGCGAACGC
CCCATCACGCCCTGAGGAGGGCGTGGCTGCCTGCCTGAGTGGGCCAGACCCCTGTCGCCAGGCCTCACGG
CAGCTCCATAGTCAGGAGATGGGGAAGATGCTGGGGACAGGCCCTGGGGAGAAGTACTGGGGCCACCTGT
TCAGGCTCCCGCTGTGACACCGCCCCGGGGCAGGGGAAGGAGGTAGGACATGTGGGCGTTGGGGCCTGTA
GGTCCACACCCAGTGTGGGTGACCCTCCCTCTAACCTGGGTCCAGCCCGGCTGGAGATGGGTGGGAGTGC
AACCTAGGCCTGGTGGGCAGGCGGGCACTGTCTCTCCCTGACTGTGTCCTCCTGTGTCCCTCTGCCTCGC
CGCTGTTCCGGAACCTGCTCTGCGCGGCGTGCCCTGGCAGTGGGGCAGGTGGAGCTGGGCGGGGGCCCTG
GTGCAGGCAGCCTGCAGCCCTTGGCCCTGGAGGGGTCCCTGCAGAAGCGTGGCATCGTGGAACAATGC
>NC_052536.1 Gallus gallus isolate bGalGal1 chromosome 5, Insulin
ATATAAATATGGGAAAGAGAATGGGGAAATTTCTACCAGTCTTCATCTCTGAGAGCAAACTTCTCTGCAT
CTCTTTCTCTCTTCTCTGGGTAAGTACAGTTGCCTTCCTTTTATCTTCTAACTAATTTTTGTAGCTGTTT
TCTTAAGTGGATGTAGCTATTGGTAAAGAGCTGGCTTGGTAGGCCAGGAAAATGAGTTCTCAGGTCTTTG
AGCACATTGCTCTGGTTTGGGGTCAGCATAAATTACAGCCCCTTTTGCTTTGGCAAAGTGGGATTCTTCT
CTGAAGGTGCCAGTTGATCTCTGCTCTCTTGGACAGGTATGCCACAGGGCTTGGCAAAATGACTTTCAAC
ACCAGTGTCCCTGCTCCAAGGTGTCCAAGACAGATTTTTGCACTGCAGTCTCTGCTGCTCAGCCTGCAAG
GTGTCCTCTGCATACACTGAGTCTGACTAATAAAAGCCTTTGGATTGAAACCCTAAACATTTAGATGTCT
TCAAAGGTTGAAGGCTGTGCTATGAAAAGCCACTCCATATATATATTTTGGAGTCTGGTTTGTCTCTTTA
TGAGAAATCAGCAGGGAGGCCAGCATTGGTGTGAGTGTGTGGATGGAGACAGGCTTCTGGTTATAATTGG
TCATTTATTATGACTTTCAAAGCCTGATGAATAAAATATTCCTTTCCTCTTCAGAAGGTCCATTTGCTTC
>NC_045512.2:21563-25384 SARS-Cov-2 - surface spike protein
ATGTTTGTTTTTCTTGTTTTATTGCCACTAGTCTCTAGTCAGTGTGTTAATCTTACAACCAGAACTCAAT
TACCCCCTGCATACACTAATTCTTTCACACGTGGTGTTTATTACCCTGACAAAGTTTTCAGATCCTCAGT
TTTACATTCAACTCAGGACTTGTTCTTACCTTTCTTTTCCAATGTTACTTGGTTCCATGCTATACATGTC
TCTGGGACCAATGGTACTAAGAGGTTTGATAACCCTGTCCTACCATTTAATGATGGTGTTTATTTTGCTT
CCACTGAGAAGTCTAACATAATAAGAGGCTGGATTTTTGGTACTACTTTAGATTCGAAGACCCAGTCCCT
ACTTATTGTTAATAACGCTACTAATGTTGTTATTAAAGTCTGTGAATTTCAATTTTGTAATGATCCATTT
TTGGGTGTTTATTACCACAAAAACAACAAAAGTTGGATGGAAAGTGAGTTCAGAGTTTATTCTAGTGCGA
ATAATTGCACTTTTGAATATGTCTCTCAGCCTTTTCTTATGGACCTTGAAGGAAAACAGGGTAATTTCAA
AAATCTTAGGGAATTTGTGTTTAAGAATATTGATGGTTATTTTAAAATATATTCTAAGCACACGCCTATT
AATTTAGTGCGTGATCTCCCTCAGGGTTTTTCGGCTTTAGAACCATTGGTAGATTTGCCAATAGGTATTA
ACATCACTAGGTTTCAAACTTTACTTGCTTTACATAGAAGTTATTTGACTCCTGGTGATTCTTCTTCAGG
TTGGACAGCTGGTGCTGCAGCTTATTATGTGGGTTATCTTCAACCTAGGACTTTTCTATTAAAATATAAT
GAAAATGGAACCATTACAGATGCTGTAGACTGTGCACTTGACCCTCTCTCAGAAACAAAGTGTACGTTGA
AATCCTTCACTGTAGAAAAAGGAATCTATCAAACTTCTAACTTTAGAGTCCAACCAACAGAATCTATTGT
TAGATTTCCTAATATTACAAACTTGTGCCCTTTTGGTGAAGTTTTTAACGCCACCAGATTTGCATCTGTT
TATGCTTGGAACAGGAAGAGAATCAGCAACTGTGTTGCTGATTATTCTGTCCTATATAATTCCGCATCAT
TTTCCACTTTTAAGTGTTATGGAGTGTCTCCTACTAAATTAAATGATCTCTGCTTTACTAATGTCTATGC
AGATTCATTTGTAATTAGAGGTGATGAAGTCAGACAAATCGCTCCAGGGCAAACTGGAAAGATTGCTGAT
TATAATTATAAATTACCAGATGATTTTACAGGCTGCGTTATAGCTTGGAATTCTAACAATCTTGATTCTA
AGGTTGGTGGTAATTATAATTACCTGTATAGATTGTTTAGGAAGTCTAATCTCAAACCTTTTGAGAGAGA
TATTTCAACTGAAATCTATCAGGCCGGTAGCACACCTTGTAATGGTGTTGAAGGTTTTAATTGTTACTTT
CCTTTACAATCATATGGTTTCCAACCCACTAATGGTGTTGGTTACCAACCATACAGAGTAGTAGTACTTT
CTTTTGAACTTCTACATGCACCAGCAACTGTTTGTGGACCTAAAAAGTCTACTAATTTGGTTAAAAACAA
ATGTGTCAATTTCAACTTCAATGGTTTAACAGGCACAGGTGTTCTTACTGAGTCTAACAAAAAGTTTCTG
CCTTTCCAACAATTTGGCAGAGACATTGCTGACACTACTGATGCTGTCCGTGATCCACAGACACTTGAGA
TTCTTGACATTACACCATGTTCTTTTGGTGGTGTCAGTGTTATAACACCAGGAACAAATACTTCTAACCA
GGTTGCTGTTCTTTATCAGGATGTTAACTGCACAGAAGTCCCTGTTGCTATTCATGCAGATCAACTTACT
CCTACTTGGCGTGTTTATTCTACAGGTTCTAATGTTTTTCAAACACGTGCAGGCTGTTTAATAGGGGCTG
AACATGTCAACAACTCATATGAGTGTGACATACCCATTGGTGCAGGTATATGCGCTAGTTATCAGACTCA
GACTAATTCTCCTCGGCGGGCACGTAGTGTAGCTAGTCAATCCATCATTGCCTACACTATGTCACTTGGT
GCAGAAAATTCAGTTGCTTACTCTAATAACTCTATTGCCATACCCACAAATTTTACTATTAGTGTTACCA
CAGAAATTCTACCAGTGTCTATGACCAAGACATCAGTAGATTGTACAATGTACATTTGTGGTGATTCAAC
TGAATGCAGCAATCTTTTGTTGCAATATGGCAGTTTTTGTACACAATTAAACCGTGCTTTAACTGGAATA
GCTGTTGAACAAGACAAAAACACCCAAGAAGTTTTTGCACAAGTCAAACAAATTTACAAAACACCACCAA
TTAAAGATTTTGGTGGTTTTAATTTTTCACAAATATTACCAGATCCATCAAAACCAAGCAAGAGGTCATT
TATTGAAGATCTACTTTTCAACAAAGTGACACTTGCAGATGCTGGCTTCATCAAACAATATGGTGATTGC
CTTGGTGATATTGCTGCTAGAGACCTCATTTGTGCACAAAAGTTTAACGGCCTTACTGTTTTGCCACCTT
TGCTCACAGATGAAATGATTGCTCAATACACTTCTGCACTGTTAGCGGGTACAATCACTTCTGGTTGGAC
CTTTGGTGCAGGTGCTGCATTACAAATACCATTTGCTATGCAAATGGCTTATAGGTTTAATGGTATTGGA
GTTACACAGAATGTTCTCTATGAGAACCAAAAATTGATTGCCAACCAATTTAATAGTGCTATTGGCAAAA
TTCAAGACTCACTTTCTTCCACAGCAAGTGCACTTGGAAAACTTCAAGATGTGGTCAACCAAAATGCACA
AGCTTTAAACACGCTTGTTAAACAACTTAGCTCCAATTTTGGTGCAATTTCAAGTGTTTTAAATGATATC
CTTTCACGTCTTGACAAAGTTGAGGCTGAAGTGCAAATTGATAGGTTGATCACAGGCAGACTTCAAAGTT
TGCAGACATATGTGACTCAACAATTAATTAGAGCTGCAGAAATCAGAGCTTCTGCTAATCTTGCTGCTAC
TAAAATGTCAGAGTGTGTACTTGGACAATCAAAAAGAGTTGATTTTTGTGGAAAGGGCTATCATCTTATG
TCCTTCCCTCAGTCAGCACCTCATGGTGTAGTCTTCTTGCATGTGACTTATGTCCCTGCACAAGAAAAGA
ACTTCACAACTGCTCCTGCCATTTGTCATGATGGAAAAGCACACTTTCCTCGTGAAGGTGTCTTTGTTTC
AAATGGCACACACTGGTTTGTAACACAAAGGAATTTTTATGAACCACAAATCATTACTACAGACAACACA
TTTGTGTCTGGTAACTGTGATGTTGTAATAGGAATTGTCAACAACACAGTTTATGATCCTTTGCAACCTG
AATTAGACTCATTCAAGGAGGAGTTAGATAAATATTTTAAGAATCATACATCACCAGATGTTGATTTAGG
TGACATCTCTGGCATTAATGCTTCAGTTGTAAACATTCAAAAAGAAATTGACCGCCTCAATGAGGTTGCC
AAGAATTTAAATGAATCTCTCATCGATCTCCAAGAACTTGGAAAGTATGAGCAGTATATAAAATGGCCAT
GGTACATTTGGCTAGGTTTTATAGCTGGCTTGATTGCCATAGTAATGGTGACAATTATGCTTTGCTGTAT
GACCAGTTGCTGTAGTTGTCTCAAGGGCTGTTGTTCTTGTGGATCCTGCTGCAAATTTGATGAAGACGAC
TCTGAGCCAGTGCTCAAAGGAGTCAAATTACATTACACATAA
>NC_002018.1:21-1385 Influenza A virus (A/Puerto Rico/8/1934(H1N1)) segment 6, neuraminidase
ATGAATCCAAATCAGAAAATAATAACCATTGGATCAATCTGTCTGGTAGTCGGACTAATTAGCCTAATAT
TGCAAATAGGGAATATAATCTCAATATGGATTAGCCATTCAATTCAAACTGGAAGTCAAAACCATACTGG
AATATGCAACCAAAACATCATTACCTATAAAAATAGCACCTGGGTAAAGGACACAACTTCAGTGATATTA
ACCGGCAATTCATCTCTTTGTCCCATCCGTGGGTGGGCTATATACAGCAAAGACAATAGCATAAGAATTG
GTTCCAAAGGAGACGTTTTTGTCATAAGAGAGCCCTTTATTTCATGTTCTCACTTGGAATGCAGGACCTT
TTTTCTGACCCAAGGTGCCTTACTGAATGACAGGCATTCAAATGGGACTGTTAAGGACAGAAGCCCTTAT
AGGGCCTTAATGAGCTGCCCTGTCGGTGAAGCTCCGTCCCCGTACAATTCAAGATTTGAATCGGTTGCTT
GGTCAGCAAGTGCATGTCATGATGGCATGGGCTGGCTAACAATCGGAATTTCAGGTCCAGATAATGGAGC
AGTGGCTGTATTAAAATACAACGGCATAATAACTGAAACCATAAAAAGTTGGAGGAAGAAAATATTGAGG
ACACAAGAGTCTGAATGTGCCTGTGTAAATGGTTCATGTTTTACTATAATGACTGATGGCCCGAGTGATG
GGCTGGCCTCGTACAAAATTTTCAAGATCGAAAAGGGGAAGGTTACTAAATCAATAGAGTTGAATGCACC
TAATTCTCACTATGAGGAATGTTCCTGTTACCCTGATACCGGCAAAGTGATGTGTGTGTGCAGAGACAAT
TGGCATGGTTCGAACCGGCCATGGGTGTCTTTCGATCAAAACCTGGATTATCAAATAGGATACATCTGCA
GTGGGGTTTTCGGTGACAACCCGCGTCCCAAAGATGGAACAGGCAGCTGTGGTCCAGTGTATGTTGATGG
AGCAAACGGAGTAAAGGGATTTTCATATAGGTATGGTAATGGTGTTTGGATAGGAAGGACCAAAAGTCAC
AGTTCCAGACATGGGTTTGAGATGATTTGGGATCCTAATGGATGGACAGAGACTGATAGTAAGTTCTCTG
TGAGGCAAGATGTTGTGGCAATGACTGATTGGTCAGGGTATAGCGGGAGTTTCGTTCAACATCCTGAGCT
AACAGGGCTAGACTGTATAAGGCCGTGCTTCTGGGTTGAATTAATCAGGGGACGACCTAAAGAAAAAACA
ATCTGGACTAGTGCGAGCAGCATTTCTTTTTGTGGCGTGAATAGTGATACTGTAGATTGGTCTTGGCCAG
ACGGTGCTGAGTTGCCATTCACCATTGACAAGTAG
>NC_007366.1:30-1730 Influenza A virus (A/New York/392/2004(H3N2)) segment 4, hemagglutinin
ATGAAGACTATCATTGCTTTGAGCTACATTCTATGTCTGGTTTTCGCTCAAAAACTTCCCGGAAATGACA
ACAGCACGGCAACGCTGTGCCTTGGGCACCATGCAGTACCAAACGGAACGATAGTGAAAACAATCACGAA
TGACCAAATTGAAGTCACTAATGCTACTGAACTGGTTCAGAGTTCCTCAACAGGTGGAATATGCGACAGT
CCTCATCAGATCCTTGATGGAGAAAACTGCACACTAATAGATGCTCTATTGGGAGACCCTCAGTGTGATG
GCTTCCAAAATAAGAAATGGGACCTTTTTGTTGAACGCAGCAAAGCCTACAGCAACTGTTACCCTTATGA
TGTGCCGGATTATGCCTCCCTTAGGTCACTAGTTGCCTCATCCGGCACACTGGAGTTTAACAATGAAAGC
TTCAATTGGACTGGAGTCACTCAAAATGGAACAAGCTCTGCTTGCAAAAGGAGATCTAATAACAGTTTCT
TTAGTAGATTGAATTGGTTGACCCACTTAAAATTCAAATACCCAGCATTGAACGTGACTATGCCAAACAA
TGAAAAATTTGACAAACTGTACATTTGGGGGGTTCACCACCCGGGTACGGACAATGACCAAATCAGCCTA
TATGCTCAAGCATCAGGAAGAATCACAGTCTCTACCAAAAGAAGCCAACAAACCGTAATCCCGAGTATCG
GATCTAGACCCAGGATAAGGGATGTCCCCAGCAGAATAAGCATCTATTGGACAATAGTAAAACCGGGAGA
CATACTTTTGATTAACAGCACAGGGAATCTAATTGCTCCTCGGGGTTACTTCAAAATACGAAGTGGGAAA
AGCTCAATAATGAGATCAGATGCACCCATTGGCAAATGCAATTCTGAATGCATCACTCCAAATGGAAGCA
TTCCCAATGACAAACCATTTCAAAATGTAAACAGGATCACATATGGGGCCTGTCCCAGATATGTTAAGCA
AAACACTCTGAAATTGGCAACAGGGATGCGAAATGTACCAGAGAAACAAACTAGAGGCATATTTGGCGCA
ATCGCGGGTTTCATAGAAAATGGTTGGGAGGGAATGGTAGACGGTTGGTACGGTTTCAGGCATCAAAATT
CTGAGGGAACAGGACAAGCAGCAGATCTCAAAAGCACTCAAGCAGCAATCAACCAAATCAATGGGAAGCT
GAATAGGTTGATCGGGAAAACAAACGAGAAATTCCATCAGATTGAAAAAGAATTCTCAGAAGTAGAAGGG
AGAATTCAGGACCTCGAGAAATATGTTGAGGACACTAAAATAGATCTCTGGTCATACAACGCGGAGCTTC
TTGTGGCCCTGGAGAACCAACATACAATTGATCTAACTGACTCAGAAATGAACAAACTGTTTGAAAGAAC
AAAGAAGCAACTGAGGGAAAATGCTGAGGATATGGGCAATGGTTGTTTCAAAATATACCACAAATGTGAC
AATGCCTGCATAGGGTCAATCAGAAATGGAACTTATGACCATGATGTATACAGAGATGAAGCATTAAACA
ACCGGTTCCAGATCAAAGGTGTTGAGTTGAAGTCAGGATACAAAGATTGGATCCTATGGATTTCCTTTGC
CATATCATGTTTTTTGCTTTGTGTTGCTTTGTTGGGGTTCATCATGTGGGCCTGCCAAAAAGGCAACATT
AGGTGCAACATTTGCATTTGA
>MH537830.1 Streptococcus pyogenes strain SH2902A RopB-like (ropB) genes
ATGGAAATTGGTGAAACCGTTGAATTCATTAGGCATTCAAAAAACATTTCGATTAAACAAGTTTGTGGTG
ATTATCTCACTAGGCAAACCTATTATCGTTTTATTAAAAATAATCTTGACATTTCTTCGAAAAAGTTACT
TTATATCTTAGACAACTTGAATGTCAATGTTGATGAGTTTCTCTTTATTAGTAATAACTTTAAACAATAC
AAAGAATTTATTGATATGGATACGGCAAAACATTATTTTGAATGCCGAAACATAGAAGGTTTAAATCATA
TCCTTGATTCTTATAAAGATAGTAAGTAAACAAAGGAAAAGAACCTTTTTGCCTTGGTCAAGGTGTTATT
AGCAACTCTTACTGAGGAAGACTGTCTGACAGAGCGGACTTATTTGTCAAACTATCTTATTAATATTGAA
ACTTGGAGTCACTATGAGACTGTGCTTTTTAATAATTGTATGTTTATTTTTGAGTCTTGCTTTATTGAGA
TGGTGTTTTCAAAAGTTATTTTGAACCTCGATAAATACAATACCCTAAGGTATTATGGGAATGAATCGAT
TCGGATGTTTGTCAATATGTTGATTTTGTTTATTCAGCGACAAGAGTATGATAAAGCTTCTGAGATTTTG
GCAAAAATTGAAGATTATCAGCTAAATGATGATTGCTTATATGAACGGTGTTGTGTGTCTTTTTTTGATG
GCATTATTGGCCTCATAAATGGTAAAGAGGGGGCTGAGCAAAAGTGTGTGCAGATCTTGGAGATCTTCCA
ATTACTTAATTGCAAAACGATCCATCATATGTTTCAAACCTACCTAGAAGCCATTAAACATAAACTGTCC
TGA