pV1435

111439 Synthetic Yeast Expression

Plasmid Information

Purpose
Solo vector pV1382 + sgCgADE2
Depositor
Gerald Fink
Article
Vyas et al mSphere. 2018 Apr 25;3(2). pii: 3/2/e001
Insert
CaCas9/sgCgADE2
Available Since
Aug. 29, 2018
Availability
Available

Sequence Information

Length
14,966 bp
Topology
circular
Molecule Type
other DNA

Features

CDS 7
Label Gene Product Position Strand
URA3 S. cerevisiae URA3 orotidine-5'-phosphate decarboxylase, r… 416..1220 Fwd
DNA Sequence
ATGTCGAAAGCTACATATAAGGAACGTGCTGCTACTCATCCTAGTCCTGTTGCTGCCAAGCTATTTAATATCATGCACGAAAAGCAAACAAACTTGTGTGCTTCATTGGATGTTCGTACCACCAAGGAATTACTGGAGTTAGTTGAAGCATTAGGTCCCAAAATTTGTTTACTAAAAACACATGTGGATATCTTGACTGATTTTTCCATGGAGGGCACAGTTAAGCCGCTAAAGGCATTATCCGCCAAGTACAATTTTTTACTCTTCGAAGACAGAAAATTTGCTGACATTGGTAATACAGTCAAATTGCAGTACTCTGCGGGTGTATACAGAATAGCAGAATGGGCAGACATTACGAATGCACACGGTGTGGTGGGCCCAGGTATTGTTAGCGGTTTGAAGCAGGCGGCAGAAGAAGTAACAAAGGAACCTAGAGGCCTTTTGATGTTAGCAGAATTGTCATGCAAGGGCTCCCTATCTACTGGAGAATATACTAAGGGTACTGTTGACATTGCGAAGAGCGACAAAGATTTTGTTATCGGCTTTATTGCTCAAAGAGACATGGGTGGAAGAGATGAAGGTTACGATTGGTTGATTATGACACCCGGTGTGGGTTTAGATGACAAGGGTGATGCATTGGGTCAACAGTATAGAACCGTGGATGATGTGGTCTCTACAGGATCTGACATTATTATTGTTGGAAGAGGACTATTTGCAAAGGGAAGGGATGCTAAGGTAGAGGGTGAACGTTACAGAAAAGCAGGCTGGGAAGCATATTTGAGAAGATGCGGCCAGCAAAACTAA
Protein Sequence
MSKATYKERAATHPSPVAAKLFNIMHEKQTNLCASLDVRTTKELLELVEALGPKICLLKTHVDILTDFSMEGTVKPLKALSAKYNFLLFEDRKFADIGNTVKLQYSAGVYRIAEWADITNAHGVVGPGIVSGLKQAAEEVTKEPRGLLMLAELSCKGSLSTGEYTKGTVDIAKSDKDFVIGFIAQRDMGGRDEGYDWLIMTPGVGLDDKGDALGQQYRTVDDVVSTGSDIIIVGRGLFAKGRDAKVEGERYRKAGWEAYLRRCGQQN
Cas9 Cas9 (Csn1) endonuclease from the Strep… 4011..8115 Fwd
DNA Sequence
ATGGATAAAAAGTATAGTATTGGTTTAGATATTGGTACTAACTCTGTGGGTTGGGCAGTTATCACTGACGAATATAAAGTTCCATCAAAGAAATTTAAGGTGTTAGGTAACACTGACAGACACTCAATAAAAAAGAATCTTATCGGTGCTCTTTTGTTCGACTCCGGTGAAACTGCCGAGGCTACACGTTTAAAAAGAACAGCAAGAAGAAGATATACCCGTAGAAAAAATAGAATATGTTATTTACAAGAAATCTTTTCTAATGAAATGGCTAAAGTTGATGATTCCTTTTTCCATAGATTGGAAGAGTCATTTTTGGTTGAAGAAGACAAAAAGCATGAGAGACATCCAATCTTTGGGAATATAGTTGATGAAGTGGCTTACCATGAAAAATATCCTACCATTTATCATTTAAGAAAGAAATTGGTAGATTCAACTGATAAAGCTGACCTTAGATTAATCTATTTAGCACTTGCCCATATGATTAAATTTAGAGGTCATTTTTTGATTGAAGGTGATTTGAACCCAGATAATTCTGACGTGGATAAATTATTTATTCAATTAGTCCAAACCTACAACCAATTATTTGAGGAAAATCCAATTAATGCTAGTGGTGTCGATGCCAAAGCTATATTATCAGCCAGATTATCAAAATCTAGACGTTTGGAAAATTTGATTGCCCAATTGCCAGGAGAAAAAAAGAATGGATTATTTGGAAACTTGATCGCATTATCATTGGGTTTGACACCAAATTTTAAATCTAATTTTGATTTAGCTGAAGATGCTAAATTACAATTATCAAAAGACACCTATGACGACGATTTGGACAATTTACTTGCTCAAATTGGTGATCAATATGCAGATTTGTTCTTAGCTGCTAAAAACTTATCTGATGCTATTTTGTTGTCTGATATTTTGAGAGTGAACACAGAAATAACCAAAGCTCCATTATCAGCATCTATGATCAAACGTTATGATGAACACCATCAGGATTTGACTTTATTGAAAGCTTTGGTGAGACAACAATTGCCAGAGAAGTATAAAGAAATCTTTTTCGATCAATCTAAAAACGGGTATGCAGGTTATATTGATGGGGGTGCCTCCCAAGAGGAATTTTACAAATTTATAAAACCTATTTTAGAAAAGATGGATGGGACTGAGGAACTTTTGGTCAAATTGAACAGAGAAGATTTGTTACGTAAACAGAGAACTTTTGATAATGGTAGTATACCTCACCAAATTCATTTGGGTGAGTTGCATGCAATTTTAAGAAGACAAGAAGATTTTTATCCATTTTTAAAAGATAATAGAGAAAAAATCGAGAAAATTTTAACCTTTAGAATTCCATACTATGTTGGGCCTTTGGCTAGAGGTAATTCAAGATTTGCCTGGATGACACGTAAATCAGAAGAAACTATTACCCCTTGGAATTTTGAAGAGGTTGTTGATAAAGGAGCATCAGCACAGAGTTTTATTGAAAGAATGACCAATTTCGATAAAAACTTACCAAATGAAAAAGTTTTACCAAAACATTCCTTGTTATACGAATATTTTACTGTTTACAATGAACTTACAAAGGTTAAATATGTTACTGAAGGTATGCGTAAGCCAGCCTTTTTATCTGGAGAACAGAAAAAGGCAATAGTTGATTTATTGTTTAAAACAAATAGAAAAGTTACTGTTAAACAATTAAAAGAAGATTACTTTAAGAAAATTGAATGTTTTGATTCAGTTGAAATCAGTGGTGTTGAAGACAGATTTAATGCTAGTTTAGGAACTTACCATGATTTACTTAAAATTATCAAAGATAAAGATTTCTTGGATAACGAAGAAAATGAAGACATTTTAGAAGACATTGTTTTAACCTTAACTTTATTCGAAGATAGAGAGATGATTGAAGAACGTTTGAAGACTTATGCACATTTGTTTGACGATAAAGTGATGAAACAGTTGAAAAGAAGACGTTATACTGGATGGGGTAGATTGTCTCGTAAATTGATCAATGGAATTAGAGATAAACAAAGTGGTAAAACTATCTTGGACTTTTTGAAATCTGACGGATTTGCTAATAGAAATTTCATGCAATTGATCCACGACGATAGTTTGACATTTAAAGAAGACATCCAAAAGGCCCAAGTGAGTGGGCAAGGTGATTCATTACATGAACATATTGCAAATTTAGCCGGATCTCCTGCTATTAAGAAAGGGATATTACAAACTGTTAAAGTTGTGGATGAATTAGTGAAAGTAATGGGAAGACATAAACCTGAAAACATTGTCATTGAGATGGCAAGAGAAAATCAAACTACACAAAAAGGACAGAAAAATAGTAGAGAACGTATGAAAAGAATAGAAGAGGGTATTAAAGAATTGGGTAGTCAAATATTGAAAGAACACCCAGTGGAAAATACCCAGTTGCAAAATGAAAAATTATATCTTTACTACCTTCAAAATGGACGTGATATGTATGTTGATCAGGAATTAGATATAAATAGACTTTCAGATTATGATGTAGATCATATAGTTCCACAATCTTTCTTGAAAGATGATTCCATAGACAATAAAGTATTAACTAGAAGTGATAAAAATAGAGGTAAAAGTGATAATGTCCCAAGTGAGGAAGTCGTCAAAAAGATGAAAAATTACTGGCGTCAACTTTTGAATGCTAAATTAATTACTCAAAGAAAATTTGATAATTTGACTAAAGCAGAAAGAGGTGGGCTTTCTGAATTAGATAAAGCCGGGTTCATTAAAAGACAATTGGTCGAAACTAGACAAATTACTAAACATGTTGCCCAAATTTTAGATTCCCGTATGAACACTAAGTATGACGAAAATGATAAGTTAATACGTGAGGTTAAAGTCATTACTTTAAAATCAAAACTTGTCTCTGATTTCAGAAAGGATTTCCAATTCTATAAAGTTAGAGAAATTAATAATTATCATCATGCTCATGATGCATATTTGAATGCTGTAGTTGGAACTGCTTTAATCAAGAAATACCCTAAATTAGAATCTGAATTTGTATATGGTGATTACAAAGTCTATGATGTTAGAAAGATGATTGCTAAATCAGAACAAGAAATTGGTAAAGCTACAGCTAAATACTTCTTTTACTCTAACATTATGAATTTCTTTAAAACAGAAATTACTTTGGCAAACGGTGAAATTAGAAAAAGACCTCTTATTGAAACAAATGGTGAGACTGGAGAGATAGTTTGGGACAAAGGGCGTGATTTCGCTACTGTTAGAAAAGTTTTATCAATGCCACAAGTTAACATTGTAAAGAAAACAGAGGTTCAAACTGGTGGTTTCTCAAAAGAAAGTATTTTGCCTAAAAGAAATAGTGATAAATTGATTGCCAGAAAAAAGGATTGGGATCCAAAGAAATATGGTGGTTTCGACTCACCAACCGTAGCCTATTCTGTTTTGGTTGTGGCAAAGGTTGAAAAGGGTAAAAGTAAAAAGCTTAAATCAGTAAAAGAACTTTTGGGTATTACAATAATGGAAAGAAGTTCCTTTGAAAAGAACCCTATTGATTTTTTGGAAGCTAAAGGTTATAAGGAAGTAAAGAAGGACTTAATAATCAAATTGCCTAAATATTCTTTATTTGAATTAGAAAATGGGAGAAAAAGAATGTTGGCTTCTGCTGGAGAATTGCAAAAGGGTAATGAATTAGCATTGCCTTCCAAATATGTTAACTTCTTGTATTTAGCTTCACACTATGAAAAGTTGAAAGGGTCACCAGAAGATAACGAGCAAAAACAATTATTTGTTGAACAACACAAACACTACTTAGATGAGATTATAGAACAAATTAGTGAATTCAGTAAAAGAGTGATATTAGCTGATGCAAATTTAGATAAAGTTTTGTCAGCCTATAACAAACATAGAGATAAGCCAATTAGAGAACAAGCAGAAAACATTATTCACTTATTTACCCTTACCAATTTAGGAGCACCTGCTGCTTTCAAGTATTTTGATACAACAATTGATCGTAAAAGATATACCTCAACAAAAGAAGTCTTAGACGCCACCTTAATTCATCAATCAATCACTGGATTGTATGAGACAAGAATTGATTTGTCTCAATTGGGTGGTGAT
Protein Sequence
MDKKYSIGLDIGTNSVGWAVITDEYKVPSKKFKVLGNTDRHSIKKNLIGALLFDSGETAEATRLKRTARRRYTRRKNRICYLQEIFSNEMAKVDDSFFHRLEESFLVEEDKKHERHPIFGNIVDEVAYHEKYPTIYHLRKKLVDSTDKADLRLIYLALAHMIKFRGHFLIEGDLNPDNSDVDKLFIQLVQTYNQLFEENPINASGVDAKAILSARLSKSRRLENLIAQLPGEKKNGLFGNLIALSLGLTPNFKSNFDLAEDAKLQLSKDTYDDDLDNLLAQIGDQYADLFLAAKNLSDAILLSDILRVNTEITKAPLSASMIKRYDEHHQDLTLLKALVRQQLPEKYKEIFFDQSKNGYAGYIDGGASQEEFYKFIKPILEKMDGTEELLVKLNREDLLRKQRTFDNGSIPHQIHLGELHAILRRQEDFYPFLKDNREKIEKILTFRIPYYVGPLARGNSRFAWMTRKSEETITPWNFEEVVDKGASAQSFIERMTNFDKNLPNEKVLPKHSLLYEYFTVYNELTKVKYVTEGMRKPAFLSGEQKKAIVDLLFKTNRKVTVKQLKEDYFKKIECFDSVEISGVEDRFNASLGTYHDLLKIIKDKDFLDNEENEDILEDIVLTLTLFEDREMIEERLKTYAHLFDDKVMKQLKRRRYTGWGRLSRKLINGIRDKQSGKTILDFLKSDGFANRNFMQLIHDDSLTFKEDIQKAQVSGQGDSLHEHIANLAGSPAIKKGILQTVKVVDELVKVMGRHKPENIVIEMARENQTTQKGQKNSRERMKRIEEGIKELGSQILKEHPVENTQLQNEKLYLYYLQNGRDMYVDQELDINRLSDYDVDHIVPQSFLKDDSIDNKVLTRSDKNRGKSDNVPSEEVVKKMKNYWRQLLNAKLITQRKFDNLTKAERGGLSELDKAGFIKRQLVETRQITKHVAQILDSRMNTKYDENDKLIREVKVITLKSKLVSDFRKDFQFYKVREINNYHHAHDAYLNAVVGTALIKKYPKLESEFVYGDYKVYDVRKMIAKSEQEIGKATAKYFFYSNIMNFFKTEITLANGEIRKRPLIETNGETGEIVWDKGRDFATVRKVLSMPQVNIVKKTEVQTGGFSKESILPKRNSDKLIARKKDWDPKKYGGFDSPTVAYSVLVVAKVEKGKSKKLKSVKELLGITIMERSSFEKNPIDFLEAKGYKEVKKDLIIKLPKYSLFELENGRKRMLASAGELQKGNELALPSKYVNFLYLASHYEKLKGSPEDNEQKQLFVEQHKHYLDEIIEQISEFSKRVILADANLDKVLSAYNKHRDKPIREQAENIIHLFTLTNLGAPAAFKYFDTTIDRKRYTSTKEVLDATLIHQSITGLYETRIDLSQLGGD
SV40 NLS nuclear localization signal of SV40 (si… 8127..8148 Fwd
DNA Sequence
CCTAAGAAGAAAAGAAAAGTT
Protein Sequence
PKKKRKV
SV40 NLS nuclear localization signal of SV40 (si… 8151..8172 Fwd
DNA Sequence
CCAAAGAAAAAGCGTAAGGTG
Protein Sequence
PKKKRKV
SV40 NLS nuclear localization signal of SV40 (si… 8175..8196 Fwd
DNA Sequence
CCTAAGAAAAAGAGAAAGGTT
Protein Sequence
PKKKRKV
3xFLAG three tandem FLAG(R) epitope tags, foll… 8196..8262 Fwd
DNA Sequence
GACTACAAAGACCATGACGGTGATTATAAAGATCATGACATCGACTACAAGGATGACGATGACAAG
Protein Sequence
DYKDHDGDYKDHDIDYKDDDDK
AmpR bla beta-lactamase 13392..14253 Rev
DNA Sequence
ATGAGTATTCAACATTTCCGTGTCGCCCTTATTCCCTTTTTTGCGGCATTTTGCCTTCCTGTTTTTGCTCACCCAGAAACGCTGGTGAAAGTAAAAGATGCTGAAGATCAGTTGGGTGCACGAGTGGGTTACATCGAACTGGATCTCAACAGCGGTAAGATCCTTGAGAGTTTTCGCCCCGAAGAACGTTTTCCAATGATGAGCACTTTTAAAGTTCTGCTATGTGGCGCGGTATTATCCCGTATTGACGCCGGGCAAGAGCAACTCGGTCGCCGCATACACTATTCTCAGAATGACTTGGTTGAGTACTCACCAGTCACAGAAAAGCATCTTACGGATGGCATGACAGTAAGAGAATTATGCAGTGCTGCCATAACCATGAGTGATAACACTGCGGCCAACTTACTTCTGACAACGATCGGAGGACCGAAGGAGCTAACCGCTTTTTTGCACAACATGGGGGATCATGTAACTCGCCTTGATCGTTGGGAACCGGAGCTGAATGAAGCCATACCAAACGACGAGCGTGACACCACGATGCCTGTAGCAATGGCAACAACGTTGCGCAAACTATTAACTGGCGAACTACTTACTCTAGCTTCCCGGCAACAATTAATAGACTGGATGGAGGCGGATAAAGTTGCAGGACCACTTCTGCGCTCGGCCCTTCCGGCTGGCTGGTTTATTGCTGATAAATCTGGAGCCGGTGAGCGTGGGTCTCGCGGTATCATTGCAGCACTGGGGCCAGATGGTAAGCCCTCCCGTATCGTAGTTATCTACACGACGGGGAGTCAGGCAACTATGGATGAACGAAATAGACAGATCGCTGAGATAGGTGCCTCACTGATTAAGCATTGGTAA
Protein Sequence
MSIQHFRVALIPFFAAFCLPVFAHPETLVKVKDAEDQLGARVGYIELDLNSGKILESFRPEERFPMMSTFKVLLCGAVLSRIDAGQEQLGRRIHYSQNDLVEYSPVTEKHLTDGMTVRELCSAAITMSDNTAANLLLTTIGGPKELTAFLHNMGDHVTRLDRWEPELNEAIPNDERDTTMPVAMATTLRKLLTGELLTLASRQQLIDWMEADKVAGPLLRSALPAGWFIADKSGAGERGSRGIIAALGPDGKPSRIVVIYTTGSQATMDERNRQIAEIGASLIKHW
promoter 8
Label Gene Product Position Strand
URA3 promoter S. cerevisiae URA3 200..416 Fwd
DNA Sequence
TTCAATTCATCATTTTTTTTTTATTCTTTTTTTTGATTTCGGTTTCCTTGAAATTTTTTTGATTCGGTAATCTCCGAACAGAAGGAAGAACGAAGGAAGGAGCACAGACTTAGATTGGTATATATACGCATATGTAGTGTTGAAGAAACATGAAATTGCCCAGTATTCTTAACCCAACTGCACAGAACAAAAACCTGCAGGAAACGAAGATAAATC
T7 promoter 1972..1991 Fwd
DNA Sequence
TAATACGACTCACTATAGG
TEF1 promoter S. cerevisiae TEF1 3578..3992 Fwd
DNA Sequence
GATCCCCCACACACCATAGCTTCAAAATGTTTCTACTCCTTTTTTACTCTTCCAGATTTTCTCGGACTCCGCGCATCGCCGTACCACTTCAAAACACCCAAGCACAGCATACTAAATTTCCCCTCTTTCTTCCTCTAGGGTGTCGTTAATTACCCGTACTAAAGGTTTGGAAAAGAAAAAAGAGACCGCCTCGTTTCTTTTTCTTCGTCGAAAAAGGCAATAAAAATTTTTATCACGTTTCTTTTTCTTGAAAATTTTTTTTTTTGATTTTTTTCTCTTTCGATGACCTCCCATTGATATTTAAGTTAATAAACGGTCTTCAATTTCTCAAGTTTCAGTTTCATTTTTCTTGTTCTATTACAACTTTTTTTACTTCTTGCTCATTAGAAAGAAAGCATAGCAATCTAATCTAAG
TEF promoter 9316..9660 Rev
DNA Sequence
GACATGGAGGCCCAGAATACCCTCCTTGACAGTCTTGACGTGCGCAGCTCAGGGGCATGATGTGACTGTCGCCCGTACATTTAGCCCATACATCCCCATGTATAATCATTTGCATCCATACATTTTGATGGCCGCACGGCGCGAAGCAAAAATTACGGCTCCTCGCTGCAGACCTGCGAGCAGGGAAACGCTCCCCTCACAGACGCGTTGAATTGTCCCCACGCCGCGCCCCTGTAGAGAAATATAAAAGGTTAGGATTTGCCACTGAGGTTCTTCTTTCATATACTTCCTTTTAAAATCTTGCTAGGATACAGTTCTCACATCACATCCGAACATAAACAACC
SNR52 promoter 9707..9976 Fwd
DNA Sequence
TCTTTGAAAAGATAATGTATGATTTTGCTTTCACTCATATTTATACAGAAACTTGATGTTTTCTTTCGAGTATATACAAGGTGATTACATGTACGTTTGAAGTACAACTCTAGATTTTGTAGTGCCCTCTTGGGCTAGCGGTAAAGGTGCGCATTTTTTCACACCCTACAATGTTCTGTTCAAAAGATTTTGGTCAAACGCTGTAGAAGTGAAAGTTGGTGCGCATGTTTCGGCGTTCGAAACTTCTCCGCAGTGAAAGATAAATGATC
T3 promoter 12192..12211 Rev
DNA Sequence
AATTAACCCTCACTAAAGG
lac promoter 12279..12310 Rev
DNA Sequence
TTTACACTTTATGCTTCCGGCTCGTATGTTG
AmpR promoter bla 14253..14358 Rev
DNA Sequence
CGCGGAACCCCTATTTGTTTATTTTTCTAAATACATTCAAATATGTATCCGCTCATGAGACAATAACCCTGATAAATGCTTCAATAATATTGAAAAAGGAAGAGT
protein_bind 2
Label Gene Product Position Strand
lac operator 12255..12272 Fwd
DNA Sequence
TTGTTATCCGCTCACAA
CAP binding site 12324..12346 Fwd
DNA Sequence
ATGAGTGAGCTAACTCACATTA
rep_origin 2
Label Gene Product Position Strand
f1 ori 1350..1806 Rev
DNA Sequence
ACGCGCCCTGTAGCGGCGCATTAAGCGCGGCGGGTGTGGTGGTTACGCGCAGCGTGACCGCTACACTTGCCAGCGCCCTAGCGCCCGCTCCTTTCGCTTTCTTCCCTTCCTTTCTCGCCACGTTCGCCGGCTTTCCCCGTCAAGCTCTAAATCGGGGGCTCCCTTTAGGGTTCCGATTTAGTGCTTTACGGCACCTCGACCCCAAAAAACTTGATTAGGGTGATGGTTCACGTAGTGGGCCATCGCCCTGATAGACGGTTTTTCGCCCTTTGACGTTGGAGTCCACGTTCTTTAATAGTGGACTCTTGTTCCAAACTGGAACAACACTCAACCCTATCTCGGTCTATTCTTTTGATTTATAAGGGATTTTGCCGATTTCGGCCTATTGGTTAAAAAATGAGCTGATTTAACAAAAATTTAACGCGAATTTTAACAAAATATTAACGCTTACAATTT
ori 12633..13222 Rev
DNA Sequence
TTGAGATCCTTTTTTTCTGCGCGTAATCTGCTGCTTGCAAACAAAAAAACCACCGCTACCAGCGGTGGTTTGTTTGCCGGATCAAGAGCTACCAACTCTTTTTCCGAAGGTAACTGGCTTCAGCAGAGCGCAGATACCAAATACTGTTCTTCTAGTGTAGCCGTAGTTAGGCCACCACTTCAAGAACTCTGTAGCACCGCCTACATACCTCGCTCTGCTAATCCTGTTACCAGTGGCTGCTGCCAGTGGCGATAAGTCGTGTCTTACCGGGTTGGACTCAAGACGATAGTTACCGGATAAGGCGCAGCGGTCGGGCTGAACGGGGGGTTCGTGCACACAGCCCAGCTTGGAGCGAACGACCTACACCGAACTGAGATACCTACAGCGTGAGCTATGAGAAAGCGCCACGCTTCCCGAAGGGAGAAAGGCGGACAGGTATCCGGTAAGCGGCAGGGTCGGAACAGGAGAGCGCACGAGGGAGCTTCCAGGGGGAAACGCCTGGTATCTTTATAGTCCTGTCGGGTTTCGCCACCTCTGACTTGAGCGTCGATTTTTGTGATGCTCGTCAGGGGGGCGGAGCCTATGGAAA
terminator 1
Label Gene Product Position Strand
TEF terminator 8518..8716 Rev
DNA Sequence
ACTGACAATAAAAAGATTCTTGTTTTCAAGAACTTGTCATTTGTATAGTTTTTTTATATTGTAGTTGTTCTATTTTAATCAAATGTTAGCGTGATTTATATTTTTTTTCGCCTCGACATCATCTGCCCAGATGCGAAGTTAAGTGCGCAGAAAGTAATATCATGCGTCAATCGTATGTGAATGCTGGTCGCTATACTG