| Label | Gene | Product | Position | Strand | |
|---|---|---|---|---|---|
| APOBEC-1 | — | cytidine deaminase (C to U editing enzy… | 145..832 | Fwd | |
|
DNA Sequence
ATGTCCTCCGAGACCGGCCCCGTGGCCGTGGACCCGACCCTGCGTCGCCGCATCGAGCCGCACGAGTTCGAGGTGTTCTTCGACCCGCGCGAGCTGCGCAAGGAGACCTGCCTGCTGTACGAGATCAACTGGGGCGGCCGGCACTCCATCTGGCGCCACACCTCGCAGAACACCAACAAGCACGTCGAGGTCAACTTCATCGAGAAGTTCACCACCGAGCGGTACTTCTGCCCGAACACCCGCTGCTCCATCACCTGGTTCCTGTCCTGGTCCCCCTGCGGCGAGTGCTCCCGGGCCATCACCGAGTTCCTGTCCCGCTACCCGCACGTCACCCTGTTCATCTACATCGCCCGGCTGTACCACCACGCCGACCCGCGCAACCGGCAGGGCCTGCGCGACCTGATCTCCTCCGGCGTCACCATCCAGATCATGACCGAGCAGGAGTCCGGCTACTGCTGGCGGAACTTCGTCAACTACTCCCCGTCCAACGAGGCCCACTGGCCCCGCTACCCGCACCTGTGGGTCCGCCTGTACGTCCTGGAGCTGTACTGCATCATCCTGGGCCTGCCGCCCTGCCTGAACATCCTGCGTCGCAAGCAGCCGCAGCTGACCTTCTTCACCATCGCCCTCCAGTCCTGCCACTACCAGCGCCTGCCGCCCCACATCCTGTGGGCCACCGGCCTGAAG
Protein Sequence
MSSETGPVAVDPTLRRRIEPHEFEVFFDPRELRKETCLLYEINWGGRHSIWRHTSQNTNKHVEVNFIEKFTTERYFCPNTRCSITWFLSWSPCGECSRAITEFLSRYPHVTLFIYIARLYHHADPRNRQGLRDLISSGVTIQIMTEQESGYCWRNFVNYSPSNEAHWPRYPHLWVRLYVLELYCIILGLPPCLNILRRKQPQLTFFTIALQSCHYQRLPPHILWATGLK
|
|||||
| Cas9(D10A) | — | nickase mutant of the Cas9 endonuclease… | 880..4981 | Fwd | |
|
DNA Sequence
GACAAGAAGTACTCCATCGGCCTCGCGATCGGCACCAACTCCGTGGGCTGGGCGGTCATCACCGACGAGTACAAGGTCCCCTCCAAGAAGTTCAAGGTCCTGGGCAACACCGACCGGCACTCGATCAAGAAGAACCTGATCGGCGCCCTGCTCTTCGACAGCGGCGAGACCGCCGAGGCGACCCGCCTGAAGCGGACCGCGCGTCGCCGCTACACCCGGCGCAAGAACCGCATCTGCTACCTGCAGGAAATCTTCTCCAACGAGATGGCCAAGGTGGACGACTCGTTCTTCCACCGCCTGGAGGAGAGCTTCCTGGTGGAGGAGGACAAGAAGCACGAGCGCCACCCGATCTTCGGCAACATCGTGGACGAGGTGGCCTACCACGAGAAGTACCCCACCATCTACCACCTCCGCAAGAAGCTGGTGGACTCGACCGACAAGGCGGACCTGCGGCTCATCTACCTGGCCCTCGCGCACATGATCAAGTTCCGCGGCCACTTCCTCATCGAGGGCGACCTGAACCCGGACAACTCCGACGTGGACAAGCTCTTCATCCAGCTGGTGCAGACCTACAACCAGCTGTTCGAGGAGAACCCCATCAACGCCAGCGGCGTGGACGCCAAGGCGATCCTCTCCGCGCGCCTGAGCAAGTCCCGGCGCCTGGAGAACCTCATCGCCCAGCTGCCGGGCGAGAAGAAGAACGGCCTCTTCGGCAACCTGATCGCGCTGTCGCTCGGCCTGACCCCCAACTTCAAGAGCAACTTCGACCTGGCCGAGGACGCGAAGCTCCAGCTGTCCAAGGACACCTACGACGACGACCTGGACAACCTGCTCGCCCAGATCGGCGACCAGTACGCGGACCTCTTCCTGGCCGCGAAGAACCTCTCGGACGCCATCCTGCTCAGCGACATCCTGCGGGTCAACACCGAGATCACCAAGGCCCCGCTGTCGGCGAGCATGATCAAGCGGTACGACGAGCACCACCAGGACCTGACCCTGCTCAAGGCCCTCGTGCGCCAGCAGCTGCCCGAGAAGTACAAGGAAATCTTCTTCGACCAGTCCAAGAACGGCTACGCCGGCTACATCGACGGCGGCGCGTCGCAGGAGGAGTTCTACAAGTTCATCAAGCCGATCCTGGAGAAGATGGACGGCACCGAGGAGCTGCTCGTCAAGCTGAACCGCGAGGACCTGCTCCGCAAGCAGCGGACCTTCGACAACGGCTCCATCCCGCACCAGATCCACCTGGGCGAGCTCCACGCCATCCTCCGGCGCCAGGAGGACTTCTACCCCTTCCTGAAGGACAACCGCGAGAAGATCGAGAAGATCCTGACCTTCCGCATCCCGTACTACGTCGGCCCCCTGGCCCGCGGCAACTCCCGGTTCGCGTGGATGACCCGGAAGTCGGAGGAGACCATCACCCCGTGGAACTTCGAGGAGGTCGTGGACAAGGGCGCGTCCGCGCAGTCGTTCATCGAGCGCATGACCAACTTCGACAAGAACCTCCCGAACGAGAAGGTCCTGCCCAAGCACTCCCTGCTCTACGAGTACTTCACCGTGTACAACGAGCTGACCAAGGTCAAGTACGTGACCGAGGGCATGCGGAAGCCGGCCTTCCTGTCGGGCGAGCAGAAGAAGGCGATCGTGGACCTGCTCTTCAAGACCAACCGCAAGGTCACCGTGAAGCAGCTGAAGGAGGACTACTTCAAGAAGATCGAGTGCTTCGACTCCGTCGAGATCAGCGGCGTGGAGGACCGCTTCAACGCCTCCCTGGGCACCTACCACGACCTGCTCAAGATCATCAAGGACAAGGACTTCCTCGACAACGAGGAGAACGAGGACATCCTGGAGGACATCGTCCTCACCCTGACCCTCTTCGAGGACCGCGAGATGATCGAGGAGCGGCTCAAGACCTACGCCCACCTGTTCGACGACAAGGTGATGAAGCAGCTGAAGCGTCGCCGCTACACCGGCTGGGGCCGCCTCTCCCGGAAGCTGATCAACGGCATCCGGGACAAGCAGAGCGGCAAGACCATCCTGGACTTCCTCAAGTCCGACGGCTTCGCCAACCGCAACTTCATGCAGCTCATCCACGACGACAGCCTGACCTTCAAGGAGGACATCCAGAAGGCCCAGGTCTCGGGCCAGGGCGACAGCCTCCACGAGCACATCGCCAACCTGGCGGGCTCCCCGGCGATCAAGAAGGGCATCCTCCAGACCGTCAAGGTCGTGGACGAGCTGGTCAAGGTGATGGGCCGCCACAAGCCCGAGAACATCGTGATCGAGATGGCCCGGGAGAACCAGACCACCCAGAAGGGCCAGAAGAACTCGCGCGAGCGGATGAAGCGGATCGAGGAGGGCATCAAGGAGCTCGGCAGCCAGATCCTGAAGGAGCACCCGGTCGAGAACACCCAGCTGCAGAACGAGAAGCTGTACCTCTACTACCTGCAGAACGGCCGCGACATGTACGTGGACCAGGAGCTCGACATCAACCGGCTGTCCGACTACGACGTGGACCACATCGTGCCGCAGTCCTTCCTGAAGGACGACTCGATCGACAACAAGGTCCTGACCCGCTCGGACAAGAACCGGGGCAAGTCCGACAACGTGCCCTCGGAGGAGGTCGTGAAGAAGATGAAGAACTACTGGCGCCAGCTGCTCAACGCCAAGCTCATCACCCAGCGCAAGTTCGACAACCTGACCAAGGCCGAGCGGGGCGGCCTGAGCGAGCTCGACAAGGCGGGCTTCATCAAGCGCCAGCTGGTCGAGACCCGGCAGATCACCAAGCACGTGGCCCAGATCCTGGACTCCCGGATGAACACCAAGTACGACGAGAACGACAAGCTGATCCGCGAGGTCAAGGTGATCACCCTCAAGAGCAAGCTGGTCTCCGACTTCCGCAAGGACTTCCAGTTCTACAAGGTCCGGGAGATCAACAACTACCACCACGCCCACGACGCGTACCTGAACGCCGTCGTGGGCACCGCGCTGATCAAGAAGTACCCGAAGCTGGAGTCCGAGTTCGTCTACGGCGACTACAAGGTCTACGACGTGCGCAAGATGATCGCCAAGAGCGAGCAGGAGATCGGCAAGGCCACCGCGAAGTACTTCTTCTACTCCAACATCATGAACTTCTTCAAGACCGAGATCACCCTGGCCAACGGCGAGATCCGCAAGCGGCCCCTGATCGAGACCAACGGCGAGACCGGCGAGATCGTCTGGGACAAGGGCCGCGACTTCGCCACCGTCCGGAAGGTGCTGTCGATGCCGCAGGTCAACATCGTGAAGAAAACCGAGGTGCAGACCGGCGGCTTCAGCAAGGAGTCCATCCTCCCCAAGCGCAACAGCGACAAGCTGATCGCCCGGAAGAAGGACTGGGACCCGAAGAAGTACGGCGGCTTCGACAGCCCCACCGTCGCCTACTCCGTGCTGGTCGTGGCGAAGGTCGAGAAGGGCAAGAGCAAGAAGCTGAAGTCCGTGAAGGAGCTGCTCGGCATCACCATCATGGAGCGCTCCTCGTTCGAGAAGAACCCGATCGACTTCCTGGAGGCCAAGGGCTACAAGGAGGTCAAGAAGGACCTCATCATCAAGCTGCCCAAGTACAGCCTGTTCGAGCTGGAGAACGGCCGCAAGCGGATGCTCGCCTCCGCGGGCGAGCTGCAGAAGGGCAACGAGCTGGCCCTCCCGTCGAAGTACGTCAACTTCCTGTACCTCGCGTCCCACTACGAGAAGCTGAAGGGCTCGCCCGAGGACAACGAGCAGAAGCAGCTCTTCGTGGAGCAGCACAAGCACTACCTGGACGAGATCATCGAGCAGATCAGCGAGTTCAGCAAGCGCGTCATCCTGGCCGACGCGAACCTCGACAAGGTGCTGTCCGCCTACAACAAGCACCGCGACAAGCCGATCCGGGAGCAGGCGGAGAACATCATCCACCTGTTCACCCTCACCAACCTGGGCGCCCCCGCCGCGTTCAAGTACTTCGACACCACCATCGACCGCAAGCGGTACACCTCCACCAAGGAGGTCCTCGACGCGACCCTGATCCACCAGAGCATCACCGGCCTGTACGAGACCCGCATCGACCTGTCCCAGCTCGGCGGCGAC
Protein Sequence
DKKYSIGLAIGTNSVGWAVITDEYKVPSKKFKVLGNTDRHSIKKNLIGALLFDSGETAEATRLKRTARRRYTRRKNRICYLQEIFSNEMAKVDDSFFHRLEESFLVEEDKKHERHPIFGNIVDEVAYHEKYPTIYHLRKKLVDSTDKADLRLIYLALAHMIKFRGHFLIEGDLNPDNSDVDKLFIQLVQTYNQLFEENPINASGVDAKAILSARLSKSRRLENLIAQLPGEKKNGLFGNLIALSLGLTPNFKSNFDLAEDAKLQLSKDTYDDDLDNLLAQIGDQYADLFLAAKNLSDAILLSDILRVNTEITKAPLSASMIKRYDEHHQDLTLLKALVRQQLPEKYKEIFFDQSKNGYAGYIDGGASQEEFYKFIKPILEKMDGTEELLVKLNREDLLRKQRTFDNGSIPHQIHLGELHAILRRQEDFYPFLKDNREKIEKILTFRIPYYVGPLARGNSRFAWMTRKSEETITPWNFEEVVDKGASAQSFIERMTNFDKNLPNEKVLPKHSLLYEYFTVYNELTKVKYVTEGMRKPAFLSGEQKKAIVDLLFKTNRKVTVKQLKEDYFKKIECFDSVEISGVEDRFNASLGTYHDLLKIIKDKDFLDNEENEDILEDIVLTLTLFEDREMIEERLKTYAHLFDDKVMKQLKRRRYTGWGRLSRKLINGIRDKQSGKTILDFLKSDGFANRNFMQLIHDDSLTFKEDIQKAQVSGQGDSLHEHIANLAGSPAIKKGILQTVKVVDELVKVMGRHKPENIVIEMARENQTTQKGQKNSRERMKRIEEGIKELGSQILKEHPVENTQLQNEKLYLYYLQNGRDMYVDQELDINRLSDYDVDHIVPQSFLKDDSIDNKVLTRSDKNRGKSDNVPSEEVVKKMKNYWRQLLNAKLITQRKFDNLTKAERGGLSELDKAGFIKRQLVETRQITKHVAQILDSRMNTKYDENDKLIREVKVITLKSKLVSDFRKDFQFYKVREINNYHHAHDAYLNAVVGTALIKKYPKLESEFVYGDYKVYDVRKMIAKSEQEIGKATAKYFFYSNIMNFFKTEITLANGEIRKRPLIETNGETGEIVWDKGRDFATVRKVLSMPQVNIVKKTEVQTGGFSKESILPKRNSDKLIARKKDWDPKKYGGFDSPTVAYSVLVVAKVEKGKSKKLKSVKELLGITIMERSSFEKNPIDFLEAKGYKEVKKDLIIKLPKYSLFELENGRKRMLASAGELQKGNELALPSKYVNFLYLASHYEKLKGSPEDNEQKQLFVEQHKHYLDEIIEQISEFSKRVILADANLDKVLSAYNKHRDKPIREQAENIIHLFTLTNLGAPAAFKYFDTTIDRKRYTSTKEVLDATLIHQSITGLYETRIDLSQLGGD
|
|||||
| UGI | — | uracil-DNA glycosylase inhibitor from a… | 4993..5245 | Fwd | |
|
DNA Sequence
ACCAACCTGTCCGACATCATCGAGAAGGAGACCGGCAAGCAGCTGGTCATCCAGGAGTCCATCCTGATGCTGCCGGAGGAAGTCGAGGAAGTCATCGGCAACAAGCCCGAGTCCGACATCCTGGTCCACACCGCCTACGACGAGTCCACCGACGAGAACGTCATGCTGCTGACCTCGGACGCCCCCGAGTACAAGCCCTGGGCCCTGGTCATCCAGGACTCCAACGGCGAGAACAAGATCAAGATGCTGTGA
Protein Sequence
TNLSDIIEKETGKQLVIQESILMLPEEVEEVIGNKPESDILVHTAYDESTDENVMLLTSDAPEYKPWALVIQDSNGENKIKML
|
|||||
| Label | Gene | Product | Position | Strand | |
|---|---|---|---|---|---|
| T3 promoter | — | — | 3..22 | Fwd | |
|
DNA Sequence
AATTAACCCTCACTAAAGG
|
|||||
| T7 promoter | — | — | 5837..5856 | Fwd | |
|
DNA Sequence
TAATACGACTCACTATAGG
|
|||||
| T3 promoter | — | — | 5903..5922 | Rev | |
|
DNA Sequence
AATTAACCCTCACTAAAGG
|
|||||
| lac promoter | — | — | 5990..6021 | Rev | |
|
DNA Sequence
TTTACACTTTATGCTTCCGGCTCGTATGTTG
|
|||||
| Label | Gene | Product | Position | Strand | |
|---|---|---|---|---|---|
| lac operator | — | — | 5966..5983 | Fwd | |
|
DNA Sequence
TTGTTATCCGCTCACAA
|
|||||
| CAP binding site | — | — | 6035..6057 | Fwd | |
|
DNA Sequence
ATGAGTGAGCTAACTCACATTA
|
|||||
| Label | Gene | Product | Position | Strand | |
|---|---|---|---|---|---|
| ori | — | — | 6271..6860 | Rev | |
|
DNA Sequence
TTGAGATCCTTTTTTTCTGCGCGTAATCTGCTGCTTGCAAACAAAAAAACCACCGCTACCAGCGGTGGTTTGTTTGCCGGATCAAGAGCTACCAACTCTTTTTCCGAAGGTAACTGGCTTCAGCAGAGCGCAGATACCAAATACTGTTCTTCTAGTGTAGCCGTAGTTAGGCCACCACTTCAAGAACTCTGTAGCACCGCCTACATACCTCGCTCTGCTAATCCTGTTACCAGTGGCTGCTGCCAGCGGCGATAAGTCGTGTCTTACCGGGTTGGACTCAAGACGATAGTTACCGGATAAGGCGCAGCGGTCGGGCTGAACGGGGGGGTCGTGCACACAGCCCAGCTTGGAGCGAACGACCTACACCGAACTGAGATACCTACAGCGTGAGCTATGAGAAAGCGCCACGCTTCCCGAAGGGAGAAAGGCGGACAGGTATCCGGTAAGCGGCAGGGTCGGAACAGGAGAGCGCACGAGGGAGCTTCCAGGGGGAAACGCCTGGTATCTTTATAGTCCTGTCGGGTTTCGCCACCTCTGACTTGAGCGTCGATTTTTGTGATGCTCGTCAGGGGGGCGGAGCCTATGGAAA
|
|||||
| Label | Gene | Product | Position | Strand | |
|---|---|---|---|---|---|
| fd terminator | — | — | 5425..5474 | Rev | |
|
DNA Sequence
ACCGATACAATTAAAGGCTCCTTTTGGAGCCTTTTTTTTTGGAGATTTT
|
|||||
| lambda t0 terminator | — | — | 6195..6230 | Fwd | |
|
DNA Sequence
TTCAGAACGCTCGGTTGCCGCCGGGCGTTTTTTAT
|
|||||