| Label | Gene | Product | Position | Strand | |
|---|---|---|---|---|---|
| KanR | aph(3')-Ia | aminoglycoside phosphotransferase | 632..1442 | Fwd | |
|
DNA Sequence
ATGGGTAAGGAAAAGACTCACGTTTCGAGGCCGCGATTAAATTCCAACATGGATGCTGATTTATATGGGTATAAATGGGCTCGCGATAATGTCGGGCAATCAGGTGCGACAATCTATCGATTGTATGGGAAGCCCGATGCGCCAGAGTTGTTTCTGAAACATGGCAAAGGTAGCGTTGCCAATGATGTTACAGATGAGATGGTCAGACTAAACTGGCTGACGGAATTTATGCCTCTTCCGACCATCAAGCATTTTATCCGTACTCCTGATGATGCATGGTTACTCACCACTGCGATCCCCGGCAAAACAGCATTCCAGGTATTAGAAGAATATCCTGATTCAGGTGAAAATATTGTTGATGCGCTGGCAGTGTTCCTGCGCCGGTTGCATTCGATTCCTGTTTGTAATTGTCCTTTTAACAGCGATCGCGTATTTCGTCTCGCTCAGGCGCAATCACGAATGAATAACGGTTTGGTTGATGCGAGTGATTTTGATGACGAGCGTAATGGCTGGCCTGTTGAACAAGTCTGGAAAGAAATGCATAAGCTTTTGCCATTCTCACCGGATTCAGTCGTCACTCATGGTGATTTCTCACTTGATAACCTTATTTTTGACGAGGGGAAATTAATAGGTTGTATTGATGTTGGACGAGTCGGAATCGCAGACCGATACCAGGATCTTGCCATCCTATGGAACTGCCTCGGTGAGTTTTCTCCTTCATTACAGAAACGGCTTTTTCAAAAATATGGTATTGATAATCCTGATATGAATAAATTGCAGTTTCATTTGATGCTCGATGAGTTTTTCTAA
Protein Sequence
MGKEKTHVSRPRLNSNMDADLYGYKWARDNVGQSGATIYRLYGKPDAPELFLKHGKGSVANDVTDEMVRLNWLTEFMPLPTIKHFIRTPDDAWLLTTAIPGKTAFQVLEEYPDSGENIVDALAVFLRRLHSIPVCNCPFNSDRVFRLAQAQSRMNNGLVDASDFDDERNGWPVEQVWKEMHKLLPFSPDSVVTHGDFSLDNLIFDEGKLIGCIDVGRVGIADRYQDLAILWNCLGEFSPSLQKRLFQKYGIDNPDMNKLQFHLMLDEFF
|
|||||
| SV40 NLS | — | nuclear localization signal of SV40 (si… | 2862..2883 | Fwd | |
|
DNA Sequence
CCAAAAAAGAAGAGAAAGGTC
Protein Sequence
PKKKRKV
|
|||||
| LbCpf1 | — | CRISPR-associated protein from Lachnosp… | 2901..6585 | Fwd | |
|
DNA Sequence
ATGAGCAAGCTGGAGAAGTTTACAAACTGCTACTCCCTGTCTAAGACCCTGAGGTTCAAGGCCATCCCTGTGGGCAAGACCCAGGAGAACATCGACAATAAGCGGCTGCTGGTGGAGGACGAGAAGAGAGCCGAGGATTATAAGGGCGTGAAGAAGCTGCTGGATCGCTACTATCTGTCTTTTATCAACGACGTGCTGCACAGCATCAAGCTGAAGAATCTGAACAATTACATCAGCCTGTTCCGGAAGAAAACCAGAACCGAGAAGGAGAATAAGGAGCTGGAGAACCTGGAGATCAATCTGCGGAAGGAGATCGCCAAGGCCTTCAAGGGCAACGAGGGCTACAAGTCCCTGTTTAAGAAGGATATCATCGAGACAATCCTGCCAGAGTTCCTGGACGATAAGGACGAGATCGCCCTGGTGAACAGCTTCAATGGCTTTACCACAGCCTTCACCGGCTTCTTTGATAACAGAGAGAATATGTTTTCCGAGGAGGCCAAGAGCACATCCATCGCCTTCAGGTGTATCAACGAGAATCTGACCCGCTACATCTCTAATATGGACATCTTCGAGAAGGTGGACGCCATCTTTGATAAGCACGAGGTGCAGGAGATCAAGGAGAAGATCCTGAACAGCGACTATGATGTGGAGGATTTCTTTGAGGGCGAGTTCTTTAACTTTGTGCTGACACAGGAGGGCATCGACGTGTATAACGCCATCATCGGCGGCTTCGTGACCGAGAGCGGCGAGAAGATCAAGGGCCTGAACGAGTACATCAACCTGTATAATCAGAAAACCAAGCAGAAGCTGCCTAAGTTTAAGCCACTGTATAAGCAGGTGCTGAGCGATCGGGAGTCTCTGAGCTTCTACGGCGAGGGCTATACATCCGATGAGGAGGTGCTGGAGGTGTTTAGAAACACCCTGAACAAGAACAGCGAGATCTTCAGCTCCATCAAGAAGCTGGAGAAGCTGTTCAAGAATTTTGACGAGTACTCTAGCGCCGGCATCTTTGTGAAGAACGGCCCCGCCATCAGCACAATCTCCAAGGATATCTTCGGCGAGTGGAACGTGATCCGGGACAAGTGGAATGCCGAGTATGACGATATCCACCTGAAGAAGAAGGCCGTGGTGACCGAGAAGTACGAGGACGATCGGAGAAAGTCCTTCAAGAAGATCGGCTCCTTTTCTCTGGAGCAGCTGCAGGAGTACGCCGACGCCGATCTGTCTGTGGTGGAGAAGCTGAAGGAGATCATCATCCAGAAGGTGGATGAGATCTACAAGGTGTATGGCTCCTCTGAGAAGCTGTTCGACGCCGATTTTGTGCTGGAGAAGAGCCTGAAGAAGAACGACGCCGTGGTGGCCATCATGAAGGACCTGCTGGATTCTGTGAAGAGCTTCGAGAATTACATCAAGGCCTTCTTTGGCGAGGGCAAGGAGACAAACAGGGACGAGTCCTTCTATGGCGATTTTGTGCTGGCCTACGACATCCTGCTGAAGGTGGACCACATCTACGATGCCATCCGCAATTATGTGACCCAGAAGCCCTACTCTAAGGATAAGTTCAAGCTGTATTTTCAGAACCCTCAGTTCATGGGCGGCTGGGACAAGGATAAGGAGACAGACTATCGGGCCACCATCCTGAGATACGGCTCCAAGTACTATCTGGCCATCATGGATAAGAAGTACGCCAAGTGCCTGCAGAAGATCGACAAGGACGATGTGAACGGCAATTACGAGAAGATCAACTATAAGCTGCTGCCCGGCCCTAATAAGATGCTGCCAAAGGTGTTCTTTTCTAAGAAGTGGATGGCCTACTATAACCCCAGCGAGGACATCCAGAAGATCTACAAGAATGGCACATTCAAGAAGGGCGATATGTTTAACCTGAATGACTGTCACAAGCTGATCGACTTCTTTAAGGATAGCATCTCCCGGTATCCAAAGTGGTCCAATGCCTACGATTTCAACTTTTCTGAGACAGAGAAGTATAAGGACATCGCCGGCTTTTACAGAGAGGTGGAGGAGCAGGGCTATAAGGTGAGCTTCGAGTCTGCCAGCAAGAAGGAGGTGGATAAGCTGGTGGAGGAGGGCAAGCTGTATATGTTCCAGATCTATAACAAGGACTTTTCCGATAAGTCTCACGGCACACCCAATCTGCACACCATGTACTTCAAGCTGCTGTTTGACGAGAACAATCACGGACAGATCAGGCTGAGCGGAGGAGCAGAGCTGTTCATGAGGCGCGCCTCCCTGAAGAAGGAGGAGCTGGTGGTGCACCCAGCCAACTCCCCTATCGCCAACAAGAATCCAGATAATCCCAAGAAAACCACAACCCTGTCCTACGACGTGTATAAGGATAAGAGGTTTTCTGAGGACCAGTACGAGCTGCACATCCCAATCGCCATCAATAAGTGCCCCAAGAACATCTTCAAGATCAATACAGAGGTGCGCGTGCTGCTGAAGCACGACGATAACCCCTATGTGATCGGCATCGCTAGGGGCGAGCGCAATCTGCTGTATATCGTGGTGGTGGACGGCAAGGGCAACATCGTGGAGCAGTATTCCCTGAACGAGATCATCAACAACTTCAACGGCATCAGGATCAAGACAGATTACCACTCTCTGCTGGACAAGAAGGAGAAGGAGAGGTTCGAGGCCCGCCAGAACTGGACCTCCATCGAGAATATCAAGGAGCTGAAGGCCGGCTATATCTCTCAGGTGGTGCACAAGATCTGCGAGCTGGTGGAGAAGTACGATGCCGTGATCGCCCTGGAGGACCTGAACTCTGGCTTTAAGAATAGCCGCGTGAAGGTGGAGAAGCAGGTGTATCAGAAGTTCGAGAAGATGCTGATCGATAAGCTGAACTACATGGTGGACAAGAAGTCTAATCCTTGTGCAACAGGCGGCGCCCTGAAGGGCTATCAGATCACCAATAAGTTCGAGAGCTTTAAGTCCATGTCTACCCAGAACGGCTTCATCTTTTACATCCCTGCCTGGCTGACATCCAAGATCGATCCATCTACCGGCTTTGTGAACCTGCTGAAAACCAAGTATACCAGCATCGCCGATTCCAAGAAGTTCATCAGCTCCTTTGACAGGATCATGTACGTGCCCGAGGAGGATCTGTTCGAGTTTGCCCTGGACTATAAGAACTTCTCTCGCACAGACGCCGATTACATCAAGAAGTGGAAGCTGTACTCCTACGGCAACCGGATCAGAATCTTCCGGAATCCTAAGAAGAACAACGTGTTCGACTGGGAGGAGGTGTGCCTGACCAGCGCCTATAAGGAGCTGTTCAACAAGTACGGCATCAATTATCAGCAGGGCGATATCAGAGCCCTGCTGTGCGAGCAGTCCGACAAGGCCTTCTACTCTAGCTTTATGGCCCTGATGAGCCTGATGCTGCAGATGCGGAACAGCATCACAGGCCGCACCGACGTGGATTTTCTGATCAGCCCTGTGAAGAACTCCGACGGCATCTTCTACGATAGCCGGAACTATGAGGCCCAGGAGAATGCCATCCTGCCAAAGAACGCCGACGCCAATGGCGCCTATAACATCGCCAGAAAGGTGCTGTGGGCCATCGGCCAGTTCAAGAAGGCCGAGGACGAGAAGCTGGATAAGGTGAAGATCGCCATCTCTAACAAGGAGTGGCTGGAGTACGCCCAGACCAGCGTGAAGCAC
Protein Sequence
MSKLEKFTNCYSLSKTLRFKAIPVGKTQENIDNKRLLVEDEKRAEDYKGVKKLLDRYYLSFINDVLHSIKLKNLNNYISLFRKKTRTEKENKELENLEINLRKEIAKAFKGNEGYKSLFKKDIIETILPEFLDDKDEIALVNSFNGFTTAFTGFFDNRENMFSEEAKSTSIAFRCINENLTRYISNMDIFEKVDAIFDKHEVQEIKEKILNSDYDVEDFFEGEFFNFVLTQEGIDVYNAIIGGFVTESGEKIKGLNEYINLYNQKTKQKLPKFKPLYKQVLSDRESLSFYGEGYTSDEEVLEVFRNTLNKNSEIFSSIKKLEKLFKNFDEYSSAGIFVKNGPAISTISKDIFGEWNVIRDKWNAEYDDIHLKKKAVVTEKYEDDRRKSFKKIGSFSLEQLQEYADADLSVVEKLKEIIIQKVDEIYKVYGSSEKLFDADFVLEKSLKKNDAVVAIMKDLLDSVKSFENYIKAFFGEGKETNRDESFYGDFVLAYDILLKVDHIYDAIRNYVTQKPYSKDKFKLYFQNPQFMGGWDKDKETDYRATILRYGSKYYLAIMDKKYAKCLQKIDKDDVNGNYEKINYKLLPGPNKMLPKVFFSKKWMAYYNPSEDIQKIYKNGTFKKGDMFNLNDCHKLIDFFKDSISRYPKWSNAYDFNFSETEKYKDIAGFYREVEEQGYKVSFESASKKEVDKLVEEGKLYMFQIYNKDFSDKSHGTPNLHTMYFKLLFDENNHGQIRLSGGAELFMRRASLKKEELVVHPANSPIANKNPDNPKKTTTLSYDVYKDKRFSEDQYELHIPIAINKCPKNIFKINTEVRVLLKHDDNPYVIGIARGERNLLYIVVVDGKGNIVEQYSLNEIINNFNGIRIKTDYHSLLDKKEKERFEARQNWTSIENIKELKAGYISQVVHKICELVEKYDAVIALEDLNSGFKNSRVKVEKQVYQKFEKMLIDKLNYMVDKKSNPCATGGALKGYQITNKFESFKSMSTQNGFIFYIPAWLTSKIDPSTGFVNLLKTKYTSIADSKKFISSFDRIMYVPEEDLFEFALDYKNFSRTDADYIKKWKLYSYGNRIRIFRNPKKNNVFDWEEVCLTSAYKELFNKYGINYQQGDIRALLCEQSDKAFYSSFMALMSLMLQMRNSITGRTDVDFLISPVKNSDGIFYDSRNYEAQENAILPKNADANGAYNIARKVLWAIGQFKKAEDEKLDKVKIAISNKEWLEYAQTSVKH
|
|||||
| nucleoplasmin NLS | — | bipartite nuclear localization signal f… | 6585..6633 | Fwd | |
|
DNA Sequence
AAAAGGCCGGCGGCCACGAAAAAGGCCGGCCAGGCAAAAAAGAAAAAG
Protein Sequence
KRPAATKKAGQAKKKK
|
|||||
| SV40 NLS | — | nuclear localization signal of SV40 (si… | 6657..6678 | Fwd | |
|
DNA Sequence
CCGAAAAAGAAACGCAAAGTT
Protein Sequence
PKKKRKV
|
|||||
| VP64 | — | tetrameric repeat of the minimal activa… | 6711..6861 | Fwd | |
|
DNA Sequence
GACGCATTGGACGATTTTGATCTGGATATGCTGGGAAGTGACGCCCTCGATGATTTTGACCTTGACATGCTTGGTTCGGATGCCCTTGATGACTTTGACCTCGACATGCTCGGCAGTGACGCCCTTGATGATTTCGACCTGGACATGCTG
Protein Sequence
DALDDFDLDMLGSDALDDFDLDMLGSDALDDFDLDMLGSDALDDFDLDML
|
|||||
| SV40 NLS | — | nuclear localization signal of SV40 (si… | 6885..6906 | Fwd | |
|
DNA Sequence
CCGAAAAAGAAACGCAAAGTT
Protein Sequence
PKKKRKV
|
|||||
| RelA (p65) AD | — | transcriptional activation domain of hu… | 7335..7692 | Fwd | |
|
DNA Sequence
CCTACACAGGCCGGCGAGGGCACACTGTCTGAAGCTCTGCTGCAGCTGCAGTTCGACGACGAGGATCTGGGAGCCCTGCTGGGAAACAGCACCGATCCTGCCGTGTTCACCGACCTGGCCAGCGTGGACAACAGCGAGTTCCAGCAGCTGCTGAACCAGGGCATCCCTGTGGCCCCTCACACCACCGAGCCCATGCTGATGGAATACCCCGAGGCCATCACCCGGCTCGTGACAGGCGCTCAGAGGCCTCCTGATCCAGCTCCTGCCCCTCTGGGAGCACCAGGCCTGCCTAATGGACTGCTGTCTGGCGACGAGGACTTCAGCTCTATCGCCGATATGGATTTCTCAGCCTTGCTG
Protein Sequence
PTQAGEGTLSEALLQLQFDDEDLGALLGNSTDPAVFTDLASVDNSEFQQLLNQGIPVAPHTTEPMLMEYPEAITRLVTGAQRPPDPAPAPLGAPGLPNGLLSGDEDFSSIADMDFSALL
|
|||||
| SV40 NLS | — | nuclear localization signal of SV40 (si… | 9924..9945 | Fwd | |
|
DNA Sequence
CCAAAGAAGAAGAGAAAGGTA
Protein Sequence
PKKKRKV
|
|||||
| SV40 NLS | — | nuclear localization signal of SV40 (si… | 14061..14082 | Fwd | |
|
DNA Sequence
CCCAAGAAAAAGCGCAAGGTA
Protein Sequence
PKKKRKV
|
|||||
| SaCas9 | — | Cas9 endonuclease from the Staphylococc… | 15563..18725 | Fwd | |
|
DNA Sequence
ATGGGGAAACGGAACTACATCCTGGGGCTTGACATTGGGATAACCAGCGTTGGCTACGGAATTATTGATTATGAGACACGCGATGTGATTGACGCCGGGGTTAGGCTGTTCAAAGAGGCCAACGTTGAAAACAACGAGGGAAGACGGAGTAAGCGCGGAGCAAGAAGACTCAAGCGCAGACGGAGACATCGGATTCAGAGGGTGAAAAAGCTGCTCTTCGATTACAATCTCCTGACCGATCATAGTGAGCTGAGCGGAATCAACCCCTACGAGGCGCGAGTGAAAGGGCTTTCCCAGAAGCTGTCCGAAGAGGAGTTCTCCGCCGCGTTGCTGCACCTGGCCAAACGGAGGGGGGTTCACAATGTAAACGAAGTGGAGGAGGACACGGGCAATGAACTTAGTACGAAAGAACAGATCAGTAGGAACTCTAAGGCTCTCGAAGAGAAATACGTCGCTGAGTTGCAGCTTGAGAGACTGAAAAAAGACGGCGAAGTACGCGGATCTATTAATAGGTTCAAGACTTCAGATTACGTAAAGGAAGCCAAGCAGCTCCTGAAAGTACAGAAAGCGTACCATCAGCTCGATCAGAGCTTCATCGATACCTACATAGATTTGCTGGAGACACGGAGGACATACTACGAGGGCCCAGGGGAAGGATCTCCTTTTGGGTGGAAGGACATCAAGGAATGGTACGAGATGCTTATGGGACATTGTACATATTTTCCGGAGGAGCTCAGGAGCGTCAAGTACGCCTACAATGCCGACCTGTACAATGCCCTCAATGACCTCAATAACCTCGTGATTACCAGGGACGAGAACGAGAAGCTGGAGTACTATGAAAAGTTCCAGATTATCGAGAATGTGTTTAAGCAGAAGAAGAAGCCGACACTTAAGCAGATTGCAAAGGAAATCCTCGTGAATGAGGAAGATATCAAGGGATACAGAGTGACAAGTACAGGCAAGCCCGAGTTCACAAATCTGAAGGTGTACCACGATATTAAGGACATAACCGCACGAAAGGAGATAATCGAAAACGCTGAGCTCCTCGATCAGATCGCAAAAATTCTTACCATCTACCAGTCTAGTGAGGACATTCAGGAGGAACTGACTAATCTGAACAGTGAGCTCACCCAAGAGGAAATTGAGCAGATTTCAAACCTGAAAGGCTACACCGGGACGCACAATCTGAGCCTCAAAGCAATCAACCTCATTCTGGATGAACTTTGGCACACAAATGACAACCAAATTGCCATATTCAACCGCCTGAAACTGGTGCCAAAAAAAGTGGATCTGTCACAGCAAAAGGAAATCCCTACAACCTTGGTTGACGATTTTATTCTGTCCCCCGTTGTCAAGCGGAGCTTCATCCAGTCAATCAAGGTGATCAATGCCATCATTAAAAAATACGGATTGCCAAACGATATAATTATCGAGCTTGCACGAGAGAAGAACTCAAAGGACGCCCAGAAGATGATTAACGAAATGCAGAAGCGCAACCGCCAGACAAACGAACGCATAGAGGAAATTATAAGAACAACCGGCAAAGAGAATGCCAAGTATCTGATCGAGAAAATCAAGCTGCACGACATGCAAGAAGGCAAGTGCCTGTACTCTCTGGAAGCTATCCCACTCGAAGATCTGCTGAATAATCCATTCAATTACGAGGTGGACCACATCATCCCTAGATCCGTAAGCTTTGACAATTCCTTCAATAACAAAGTTCTGGTTAAACAGGAGGAAAATTCTAAAAAAGGGAACCGGACCCCGTTCCAGTACCTGAGCTCCAGTGACAGCAAGATTAGCTACGAGACTTTTAAGAAACATATTCTGAATCTGGCCAAAGGCAAAGGCAGGATCAGCAAGACCAAGAAGGAGTACCTCCTCGAAGAACGCGACATTAACAGATTTAGTGTGCAGAAAGATTTCATCAACCGAAACCTTGTCGATACTCGGTACGCCACGAGAGGCCTGATGAATCTCCTCAGGAGCTACTTCCGCGTCAATAATCTGGACGTTAAAGTCAAGAGCATAAATGGGGGATTCACCAGCTTTCTGAGGAGAAAGTGGAAGTTTAAGAAGGAACGAAACAAAGGATACAAGCACCATGCTGAGGATGCTTTGATCATCGCTAACGCGGACTTTATCTTTAAGGAATGGAAAAAGCTGGATAAGGCAAAGAAAGTGATGGAAAACCAGATGTTCGAGGAGAAGCAGGCAGAGTCAATGCCTGAGATCGAGACAGAGCAGGAATACAAGGAAATTTTCATCACCCCTCATCAGATTAAACACATAAAGGACTTCAAAGACTATAAATACTCTCATAGGGTGGACAAAAAACCCAATCGCGAGCTCATTAATGACACCCTGTACTCAACACGGAAGGATGATAAAGGTAATACCTTGATTGTGAATAATCTTAATGGATTGTATGACAAAGATAACGACAAGCTCAAGAAGCTGATCAACAAGTCTCCAGAGAAGCTCCTTATGTATCACCACGACCCACAGACTTATCAGAAATTGAAACTGATCATGGAGCAATACGGGGATGAGAAGAACCCACTCTACAAATATTATGAGGAAACAGGTAATTACCTGACCAAGTACTCCAAGAAGGATAACGGACCAGTGATCAAAAAGATAAAGTACTATGGCAACAAACTTAATGCGCATTTGGACATAACTGACGATTACCCCAATTCTCGAAACAAGGTTGTGAAGCTCTCCCTGAAGCCTTATAGATTTGACGTGTACCTGGATAATGGGGTTTATAAATTCGTCACCGTGAAAAATCTGGACGTGATCAAAAAGGAGAACTATTATGAAGTAAACTCAAAGTGCTATGAGGAGGCGAAGAAGCTGAAGAAGATCTCCAATCAGGCCGAGTTCATCGCTTCCTTCTATAATAACGATCTCATCAAGATCAATGGAGAGCTTTATCGCGTCATTGGTGTGAACAATGACTTGCTGAACAGGATCGAAGTCAATATGATAGACATTACCTACCGGGAGTATCTCGAAAACATGAATGATAAACGGCCGCCTCGCATCATCAAGACAATCGCATCTAAAACTCAGTCAATAAAAAAGTACTCTACCGATATCCTGGGGAATCTCTATGAAGTGAAGTCAAAGAAGCACCCACAAATCATTAAAAAAGGT
Protein Sequence
MGKRNYILGLDIGITSVGYGIIDYETRDVIDAGVRLFKEANVENNEGRRSKRGARRLKRRRRHRIQRVKKLLFDYNLLTDHSELSGINPYEARVKGLSQKLSEEEFSAALLHLAKRRGVHNVNEVEEDTGNELSTKEQISRNSKALEEKYVAELQLERLKKDGEVRGSINRFKTSDYVKEAKQLLKVQKAYHQLDQSFIDTYIDLLETRRTYYEGPGEGSPFGWKDIKEWYEMLMGHCTYFPEELRSVKYAYNADLYNALNDLNNLVITRDENEKLEYYEKFQIIENVFKQKKKPTLKQIAKEILVNEEDIKGYRVTSTGKPEFTNLKVYHDIKDITARKEIIENAELLDQIAKILTIYQSSEDIQEELTNLNSELTQEEIEQISNLKGYTGTHNLSLKAINLILDELWHTNDNQIAIFNRLKLVPKKVDLSQQKEIPTTLVDDFILSPVVKRSFIQSIKVINAIIKKYGLPNDIIIELAREKNSKDAQKMINEMQKRNRQTNERIEEIIRTTGKENAKYLIEKIKLHDMQEGKCLYSLEAIPLEDLLNNPFNYEVDHIIPRSVSFDNSFNNKVLVKQEENSKKGNRTPFQYLSSSDSKISYETFKKHILNLAKGKGRISKTKKEYLLEERDINRFSVQKDFINRNLVDTRYATRGLMNLLRSYFRVNNLDVKVKSINGGFTSFLRRKWKFKKERNKGYKHHAEDALIIANADFIFKEWKKLDKAKKVMENQMFEEKQAESMPEIETEQEYKEIFITPHQIKHIKDFKDYKYSHRVDKKPNRELINDTLYSTRKDDKGNTLIVNNLNGLYDKDNDKLKKLINKSPEKLLMYHHDPQTYQKLKLIMEQYGDEKNPLYKYYEETGNYLTKYSKKDNGPVIKKIKYYGNKLNAHLDITDDYPNSRNKVVKLSLKPYRFDVYLDNGVYKFVTVKNLDVIKKENYYEVNSKCYEEAKKLKKISNQAEFIASFYNNDLIKINGELYRVIGVNNDLLNRIEVNMIDITYREYLENMNDKRPPRIIKTIASKTQSIKKYSTDILGNLYEVKSKKHPQIIKKG
|
|||||
| SV40 NLS | — | nuclear localization signal of SV40 (si… | 18731..18752 | Fwd | |
|
DNA Sequence
CCCAAGAAGAAGAGGAAAGTC
Protein Sequence
PKKKRKV
|
|||||
| 3xFLAG | — | three tandem FLAG(R) epitope tags, foll… | 18758..18824 | Fwd | |
|
DNA Sequence
GACTACAAAGACCATGACGGTGATTATAAAGATCATGACATCGATTACAAGGATGACGATGACAAG
Protein Sequence
DYKDHDGDYKDHDIDYKDDDDK
|
|||||
| AmpR | bla | beta-lactamase | 20551..21412 | Rev | |
|
DNA Sequence
ATGAGTATTCAACATTTCCGTGTCGCCCTTATTCCCTTTTTTGCGGCATTTTGCCTTCCTGTTTTTGCTCACCCAGAAACGCTGGTGAAAGTAAAAGATGCTGAAGATCAGTTGGGTGCACGAGTGGGTTACATCGAACTGGATCTCAACAGCGGTAAGATCCTTGAGAGTTTTCGCCCCGAAGAACGTTTTCCAATGATGAGCACTTTTAAAGTTCTGCTATGTGGCGCGGTATTATCCCGTATTGACGCCGGGCAAGAGCAACTCGGTCGCCGCATACACTATTCTCAGAATGACTTGGTTGAGTACTCACCAGTCACAGAAAAGCATCTTACGGATGGCATGACAGTAAGAGAATTATGCAGTGCTGCCATAACCATGAGTGATAACACTGCGGCCAACTTACTTCTGACAACGATCGGAGGACCGAAGGAGCTAACCGCTTTTTTGCACAACATGGGGGATCATGTAACTCGCCTTGATCGTTGGGAACCGGAGCTGAATGAAGCCATACCAAACGACGAGCGTGACACCACGATGCCTGTAGCAATGGCAACAACGTTGCGCAAACTATTAACTGGCGAACTACTTACTCTAGCTTCCCGGCAACAATTAATAGACTGGATGGAGGCGGATAAAGTTGCAGGACCACTTCTGCGCTCGGCCCTTCCGGCTGGCTGGTTTATTGCTGATAAATCTGGAGCCGGTGAGCGTGGGTCTCGCGGTATCATTGCAGCACTGGGGCCAGATGGTAAGCCCTCCCGTATCGTAGTTATCTACACGACGGGGAGTCAGGCAACTATGGATGAACGAAATAGACAGATCGCTGAGATAGGTGCCTCACTGATTAAGCATTGGTAA
Protein Sequence
MSIQHFRVALIPFFAAFCLPVFAHPETLVKVKDAEDQLGARVGYIELDLNSGKILESFRPEERFPMMSTFKVLLCGAVLSRIDAGQEQLGRRIHYSQNDLVEYSPVTEKHLTDGMTVRELCSAAITMSDNTAANLLLTTIGGPKELTAFLHNMGDHVTRLDRWEPELNEAIPNDERDTTMPVAMATTLRKLLTGELLTLASRQQLIDWMEADKVAGPLLRSALPAGWFIADKSGAGERGSRGIIAALGPDGKPSRIVVIYTTGSQATMDERNRQIAEIGASLIKHW
|
|||||
| Label | Gene | Product | Position | Strand | |
|---|---|---|---|---|---|
| TEF promoter | — | — | 288..632 | Fwd | |
|
DNA Sequence
GACATGGAGGCCCAGAATACCCTCCTTGACAGTCTTGACGTGCGCAGCTCAGGGGCATGATGTGACTGTCGCCCGTACATTTAGCCCATACATCCCCATGTATAATCATTTGCATCCATACATTTTGATGGCCGCACGGCGCGAAGCAAAAATTACGGCTCCTCGCTGCAGACCTGCGAGCAGGGAAACGCTCCCCTCACAGACGCGTTGAATTGTCCCCACGCCGCGCCCCTGTAGAGAAATATAAAAGGTTAGGATTTGCCACTGAGGTTCTTCTTTCATATACTTCCTTTTAAAATCTTGCTAGGATACAGTTCTCACATCACATCCGAACATAAACAACC
|
|||||
| T7 promoter | — | — | 2105..2124 | Fwd | |
|
DNA Sequence
TAATACGACTCACTATAGG
|
|||||
| GAP promoter | S. cerevisiae TDH3 | — | 2173..2840 | Fwd | |
|
DNA Sequence
TCATTATCAATACTGCCATTTCAAAGAATACGTAAATAATTAATAGTAGTGATTTTCCTAACTTTATTTAGTCAAAAAATTAGCCTTTTAATTCTGCTGTAACCCGTACATGCCCAAAATAGGGGGCGGGTTACACAGAATATATAACATCGTAGGTGTCTGGGTGAACAGTTTATTCCTGGCATCCACTAAATATAATGGAGCCCGCTTTTTAAGCTGGCATCCAGAAAAAAAAAGAATCCCAGCACCAAAATATTGTTTTCTTCACCAACCATCAGTTCATAGGTCCATTCTCTTAGCGCAACTACAGAGAACAGGGGCACAAACAGGCAAAAAACGGGCACAACCTCAATGGAGTGATGCAACCTGCCTGGAGTAAATGATGACACAAGGCAATTGACCCACGCATGTATCTATCTCATTTTCTTACACCTTCTATTACCTTCTGCTCTCTCTGATTTGGAAAAAGCTGAAAAAAAAGGTTGAAACCAGTTCCCTGAAATTATTCCCCTACTTGACTAATAAGTATATAAAGACGGTAGGTATTGATTGTAATTCTGTAAATCTATTTCTTAAACTTCTTAAATTCTACTTTTATAGTTAGTCTTTTTTTTAGTTTTAAAACACCAAGAACTTAGTTTCGAATAAACACACATAAACAAACAAA
|
|||||
| TPI1 promoter | S. cerevisiae TPI1 | — | 9481..9909 | Fwd | |
|
DNA Sequence
TATATCTAGGAACCCATCAGGTTGGTGGAAGATTACCCGTTCTAAGACTTTTCAGCTTCCTCTATTGATGTTACACCTGGACACCCTTTTCTGGCATCCAGTTTTTAATCTTCAGTGGCATGTGAGATTCTCCGAAATTAATTAAAGCAATCACACAATTCTCTCGGATACCACCTCGGTTGAAACTGACAGGTGGTTTGTTACGCATGCTAATGCAAAGGAGCCTATATACCTTTGGCTCGGCTGCTGTAACAGGGAATATAAAGGGCAGCATAATTTAGGAGTTTAGTGAACTTGCAACATTTACTATTTTCCCTTCTTACGTAAATATTTTTCTTTTTAATTCTAAATCAATCTTTTTCAATTTTTTGTTTGTATTCTTTTCTTGCTTAAATCTATAACTACAAAAAACACATACATAACTAAAA
|
|||||
| TEF1 promoter | S. cerevisiae TEF1 | — | 15145..15544 | Fwd | |
|
DNA Sequence
ATAGCTTCAAAATGTTTCTACTCCTTTTTTACTCTTCCAGATTTTCTCGGACTCCGCGCATCGCCGTACCACTTCAAAACACCCAAGCACAGCATACTAAATTCCCCCTCTTTCTTCCTCTAGGGTGTCGTTAATTACCCGTACTAAAGGTTTGGAAAAGAAAAAAGAGACCGCCTCGTTTCTTTTTCTTCGTCGAAAAGGGCAATAAAAATTTTTATCACGTTTCTTTTTCTTGAAAATTTTTTTTTTTGATTTTTTTCTCTTTCGATGACCTCCCATTGATATTTAAGTTATTAAATGGTCTTCAATTTCTCAAGTTTCAGTTTCATTTTTCTTGTTCTATTACAACTTTTTTTACTTCTTGCTCATTAGAAAGAAAGCATAGCAATCTAATCTAAG
|
|||||
| T3 promoter | — | — | 19351..19370 | Rev | |
|
DNA Sequence
AATTAACCCTCACTAAAGG
|
|||||
| lac promoter | — | — | 19438..19469 | Rev | |
|
DNA Sequence
TTTACACTTTATGCTTCCGGCTCGTATGTTG
|
|||||
| AmpR promoter | bla | — | 21412..21517 | Rev | |
|
DNA Sequence
CGCGGAACCCCTATTTGTTTATTTTTCTAAATACATTCAAATATGTATCCGCTCATGAGACAATAACCCTGATAAATGCTTCAATAATATTGAAAAAGGAAGAGT
|
|||||
| Label | Gene | Product | Position | Strand | |
|---|---|---|---|---|---|
| loxP | — | — | 200..234 | Fwd | |
|
DNA Sequence
ATAACTTCGTATAATGTATGCTATACGAAGTTAT
|
|||||
| loxP | — | — | 1707..1741 | Fwd | |
|
DNA Sequence
ATAACTTCGTATAATGTATGCTATACGAAGTTAT
|
|||||
| lac operator | — | — | 19414..19431 | Fwd | |
|
DNA Sequence
TTGTTATCCGCTCACAA
|
|||||
| CAP binding site | — | — | 19483..19505 | Fwd | |
|
DNA Sequence
ATGAGTGAGCTAACTCACATTA
|
|||||
| Label | Gene | Product | Position | Strand | |
|---|---|---|---|---|---|
| ori | — | — | 19792..20381 | Rev | |
|
DNA Sequence
TTGAGATCCTTTTTTTCTGCGCGTAATCTGCTGCTTGCAAACAAAAAAACCACCGCTACCAGCGGTGGTTTGTTTGCCGGATCAAGAGCTACCAACTCTTTTTCCGAAGGTAACTGGCTTCAGCAGAGCGCAGATACCAAATACTGTTCTTCTAGTGTAGCCGTAGTTAGGCCACCACTTCAAGAACTCTGTAGCACCGCCTACATACCTCGCTCTGCTAATCCTGTTACCAGTGGCTGCTGCCAGTGGCGATAAGTCGTGTCTTACCGGGTTGGACTCAAGACGATAGTTACCGGATAAGGCGCAGCGGTCGGGCTGAACGGGGGGTTCGTGCACACAGCCCAGCTTGGAGCGAACGACCTACACCGAACTGAGATACCTACAGCGTGAGCTATGAGAAAGCGCCACGCTTCCCGAAGGGAGAAAGGCGGACAGGTATCCGGTAAGCGGCAGGGTCGGAACAGGAGAGCGCACGAGGGAGCTTCCAGGGGGAAACGCCTGGTATCTTTATAGTCCTGTCGGGTTTCGCCACCTCTGACTTGAGCGTCGATTTTTGTGATGCTCGTCAGGGGGGCGGAGCCTATGGAAA
|
|||||
| Label | Gene | Product | Position | Strand | |
|---|---|---|---|---|---|
| TEF terminator | — | — | 1447..1645 | Fwd | |
|
DNA Sequence
ACTGACAATAAAAAGATTCTTGTTTTCAAGAACTTGTCATTTGTATAGTTTTTTTATATTGTAGTTGTTCTATTTTAATCAAATGTTAGCGTGATTTATATTTTTTTTCGCCTCGACATCATCTGCCCAGATGCGAAGTTAAGTGCGCAGAAAGTAATATCATGCGTCAATCGTATGTGAATGCTGGTCGCTATACTG
|
|||||
| ADH1 terminator | S. cerevisiae ADH1 | — | 7701..7867 | Fwd | |
|
DNA Sequence
GCGAATTTCTTATGATTTATGATTTTTATTATTAAATAAGTTATAAAAAAAATAAGTGTATACAAATTTTAAAGTGACTCTTAGGTTTTAAAACGAAAATTCTTATTCTTGAGTAACTCTTTCCTGTAGGTCAGGTTGCTTTCTCAGGTATAGCATGAGGTCGCTC
|
|||||
| PGK1 terminator | S. cerevisae PGK1 | — | 9074..9344 | Fwd | |
|
DNA Sequence
ATTGAATTGAATTGAAATCGATAGATCAATTTTTTTCTTTTCTCTTTCCCCATCCTTTACGCTAAAATAATAGTTTATTTTATTTTTGAATATTTTTTATTTATATACGTATATATAGACTATTATTTATCTTTTAATGATTATTAAGATTTTTATTAAAAAAAAATTCGCTCCTCTTTTAATGCCTTTATGCAGTTTTTTTTTCCCATTCGATATTTCTATGTTCGGGTTCAGCGTATTTTAAGTTTAATAACTCGAAAATTCTGCGTT
|
|||||