LOCUS HEXA-pGEc1-DEST 6082 bp DNA circular 24-JAN-2013 FEATURES Location/Qualifiers misc_feature complement(5560..5689) /note="3'-ITR" misc_feature complement(5258..5472) /note="BGH pA" rep_origin 1137..1804 /dnas_title="Col E1 origin" /label=Col E1 origin /vntifkey="33" CDS 129..989 /dnas_title="AmpR" /label=AmpR /vntifkey="4" misc_feature 1998..2127 /note="5'ITR" misc_feature 2208..2790 /note="CMV Promoter" misc_feature 2828..2960 /note="Artificial Intron" misc_feature 4710..5251 /note="WPRE" misc_recomb complement(2974..3001) /label=attB1 /note="attB1 site" /note="recognized as attB1" misc_recomb 4615..4637 /label=attB2 /note="attB2 site" misc_feature 4647..4670 /note="8xHis Tag" misc_feature 4674..4697 /note="StrepTag" PCR_frame 3002..4615 /note="Reading Frame" /set="Set 1" source 3006..4592 /dnas_title="HEXA-pGEc1-DEST" /organism="Homo sapiens" /mol_type="mRNA" /db_xref="taxon:9606" /clone="MGC:14125 IMAGE:3353424" /tissue_type="Eye, retinoblastoma" /clone_lib="NIH_MGC_16" /lab_host="DH10B-R" /note="Vector: pOTB7" gene 3006..4592 /dnas_title="HEXA" /gene="HEXA" /gene_synonym="TSD" /db_xref="GeneID:3073" /db_xref="HGNC:4878" /db_xref="MIM:606869" CDS 3006..4592 /dnas_title="hexosaminidase A (alpha polypeptide)" /gene="HEXA" /gene_synonym="TSD" /codon_start=1 /product="hexosaminidase A (alpha polypeptide)" /protein_id="AAH18927.1" /db_xref="GI:17511941" /db_xref="GeneID:3073" /db_xref="HGNC:4878" /db_xref="MIM:606869" /translation="MTSSRLWFSLLLAAAFAGRATALWPWPQNFQTSDQRYVLYPNNF QFQYDVSSAAQPGCSVLDEAFQRYRDLLFGSGSWPRPYLTGKRHTLEKNVLVVSVVTP GCNQLPTLESVENYTLTINDDQCLLLSETVWGALRGLETFSQLVWKSAEGTFFINKTE IEDFPRFPHRGLLLDTSRHYLPLSSILDTLDVMAYNKLNVFHWHLVDDPSFPYESFTF PELMRKGSYNPVTHIYTAQDVKEVIEYARLRGIRVLAEFDTPGHTLSWGPGIPGLLTP CYSGSEPSGTFGPVNPSLNNTYEFMSTFFLEVSSVFPDFYLHLGGDEVDFTCWKSNPE IQDFMRKKGFGEDFKQLESFYIQTLLDIVSSYGKGYVVWQEVFDNKVKIQPDTIIQVW REDIPVNYMKELELVTKAGFRALLSAPWYLNRISYGPDWKDFYVVEPLAFEGTPEQKA LVIGGEACMWGEYVDNTNLVPRLWPRAGAVAERLWSNKLTSDLTFAYERLSHFRCELL RRGVQAQPLNVGFCEQEFEQT" misc_difference 3014..3014 /dnas_title="HEXA" /gene="HEXA" /gene_synonym="TSD" /note="'T' in cDNA is 'C' in the human genome; no amino acid change. The chimpanzee genome agrees with the human genomic sequence and not the cDNA." misc_feature 3006..4592 /note="HEXA coding region" misc_difference 4311..4311 /dnas_title="HEXA" /gene="HEXA" /gene_synonym="TSD" /note="'G' in cDNA is 'A' in the human genome; amino acid difference: 'V' in cDNA, 'I' in the human genome." misc_feature 4593..4613 /note="TEV site" misc_difference 4523..4523 /dnas_title="HEXA" /gene="HEXA" /gene_synonym="TSD" /note="'G' in cDNA is 'A' in the human genome; no amino acid change." PCR_primer 2992..3001 /dnas_title="GTACAAAAAAGCAGGCTCATGGAACAAGGACAGCTCTTCC" /primer="CAGCTCTTCC" /set="Set 1" /pair="Pair 1" /current=1 /original="GTACAAAAAAGCAGGCTCATGGAACAAGGACAGCTCTTCC" PCR_primer complement(3002..4622) /dnas_title="AAAGCTGGGTTTAGCAGTGAATGGTCCG" /primer="AAAGCTGGGTTTAGCAGTGAATGGTCCG" /set="Set 1" /pair="Pair 1" /current=1 /original="ACCACTTTGTACAAGAAAGCTGGGTTTAGCAGTGAATGGTCCG" PCR_product complement(2992..4622) /pair="Pair 1" /set="Set 1" /current=1 /score="1.000" vector join(4623..6082,1..2991) /source="pGEc1-DEST" /type="Destination Vector" clone 2992..4622 /source="HEXA-Cterm-TEVfusion-pDONR221" /type="Entry Clone" ORIGIN 1 GTGGCACTTT TCGGGGAAAT GTGCGCGGAA CCCCTATTTG TTTATTTTTC TAAATACATT 61 CAAATATGTA TCCGCTCATG AGACAATAAC CCTGATAAAT GCTTCAATAA TATTGAAAAA 121 GGAAGAGTAT GAGTATTCAA CATTTCCGTG TCGCCCTTAT TCCCTTTTTT GCGGCATTTT 181 GCCTTCCTGT TTTTGCTCAC CCAGAAACGC TGGTGAAAGT AAAAGATGCT GAAGATCAGT 241 TGGGTGCACG AGTGGGTTAC ATCGAACTGG ATCTCAACAG CGGTAAGATC CTTGAGAGTT 301 TTCGCCCCGA AGAACGTTTT CCAATGATGA GCACTTTTAA AGTTCTGCTA TGTGGCGCGG 361 TATTATCCCG TATTGACGCC GGGCAAGAGC AACTCGGTCG CCGCATACAC TATTCTCAGA 421 ATGACTTGGT TGAGTACTCA CCAGTCACAG AAAAGCATCT TACGGATGGC ATGACAGTAA 481 GAGAATTATG CAGTGCTGCC ATAACCATGA GTGATAACAC TGCGGCCAAC TTACTTCTGA 541 CAACGATCGG AGGACCGAAG GAGCTAACCG CTTTTTTGCA CAACATGGGG GATCATGTAA 601 CTCGCCTTGA TCGTTGGGAA CCGGAGCTGA ATGAAGCCAT ACCAAACGAC GAGCGTGACA 661 CCACGATGCC TGTAGCAATG GCAACAACGT TGCGCAAACT ATTAACTGGC GAACTACTTA 721 CTCTAGCTTC CCGGCAACAA TTAATAGACT GGATGGAGGC GGATAAAGTT GCAGGACCAC 781 TTCTGCGCTC GGCCCTTCCG GCTGGCTGGT TTATTGCTGA TAAATCTGGA GCCGGTGAGC 841 GTGGTTCTCG CGGTATCATT GCAGCACTGG GGCCAGATGG TAAGCCCTCC CGTATCGTAG 901 TTATCTACAC GACGGGGAGT CAGGCAACTA TGGATGAACG AAATAGACAG ATCGCTGAGA 961 TAGGTGCCTC ACTGATTAAG CATTGGTAAC TGTCAGACCA AGTTTACTCA TATATACTTT 1021 AGATTGATTT AAAACTTCAT TTTTAATTTA AAAGGATCTA GGTGAAGATC CTTTTTGATA 1081 ATCTCATGAC CAAAATCCCT TAACGTGAGT TTTCGTTCCA CTGAGCGTCA GACCCCGTAG 1141 AAAAGATCAA AGGATCTTCT TGAGATCCTT TTTTTCTGCG CGTAATCTGC TGCTTGCAAA 1201 CAAAAAAACC ACCGCTACCA GCGGTGGTTT GTTTGCCGGA TCAAGAGCTA CCAACTCTTT 1261 TTCCGAAGGT AACTGGCTTC AGCAGAGCGC AGATACCAAA TACTGTTCTT CTAGTGTAGC 1321 CGTAGTTAGG CCACCACTTC AAGAACTCTG TAGCACCGCC TACATACCTC GCTCTGCTAA 1381 TCCTGTTACC AGTGGCTGCT GCCAGTGGCG ATAAGTCGTG TCTTACCGGG TTGGACTCAA 1441 GACGATAGTT ACCGGATAAG GCGCAGCGGT CGGGCTGAAC GGGGGGTTCG TGCACACAGC 1501 CCAGCTTGGA GCGAACGACC TACACCGAAC TGAGATACCT ACAGCGTGAG CTATGAGAAA 1561 GCGCCACGCT TCCCGAAGGG AGAAAGGCGG ACAGGTATCC GGTAAGCGGC AGGGTCGGAA 1621 CAGGAGAGCG CACGAGGGAG CTTCCAGGGG GAAACGCCTG GTATCTTTAT AGTCCTGTCG 1681 GGTTTCGCCA CCTCTGACTT GAGCGTCGAT TTTTGTGATG CTCGTCAGGG GGGCGGAGCC 1741 TATGGAAAAA CGCCAGCAAC GCGGCCTTTT TACGGTTCCT GGCCTTTTGC TGGCCTTTTG 1801 CTCATTAGGC ACCCCAGGCT TTACCCGAAC GACCGAGCGC AGCGAGTCAG TGAGCGAGGA 1861 AGCGGAGAGC GCCCAATACG CAAGGAAACA GCTATGACCA TGTTAATGCA GCTGGCACGA 1921 CAGGTTTCCC GACTGGAAAG CGGGCAGTGA GCGGAAGGCC CATGAGGCCA GTTAATTAAG 1981 AGGTACCTTA ATTAAGGCTG CGCGCTCGCT CGCTCACTGA GGCCGCCCGG GCAAAGCCCG 2041 GGCGTCGGGC GACCTTTGGT CGCCCGGCCT CAGTGAGCGA GCGAGCGCGC AGAGAGGGAG 2101 TGGCCAACTC CATCACTAGG GGTTCCTTGT AGTTAATGAT TAACCCGCCA TGCTACTTAT 2161 CTACGTAGCC ATGCTCTAGG AAGATCGCAA TTCGCCCTTA AGCTAGCTAG TTATTAATAG 2221 TAATCAATTA CGGGGTCATT AGTTCATAGC CCATATATGG AGTTCCGCGT TACATAACTT 2281 ACGGTAAATG GCCCGCCTGG CTGACCGCCC AACGACCCCC GCCCATTGAC GTCAATAATG 2341 ACGTATGTTC CCATAGTAAC GCCAATAGGG ACTTTCCATT GACGTCAATG GGTGGAGTAT 2401 TTACGGTAAA CTGCCCACTT GGCAGTACAT CAAGTGTATC ATATGCCAAG TACGCCCCCT 2461 ATTGACGTCA ATGACGGTAA ATGGCCCGCC TGGCATTATG CCCAGTACAT GACCTTATGG 2521 GACTTTCCTA CTTGGCAGTA CATCTACGTA TTAGTCATCG CTATTACCAT GGTGATGCGG 2581 TTTTGGCAGT ACATCAATGG GCGTGGATAG CGGTTTGACT CACGGGGATT TCCAAGTCTC 2641 CACCCCATTG ACGTCAATGG GAGTTTGTTT TGGCACCAAA ATCAACGGGA CTTTCCAAAA 2701 TGTCGTAACA ACTCCGCCCC ATTGACGCAA ATGGGCGGTA GGCGTGTACG GTGGGAGGTC 2761 TATATAAGCA GAGCTGGTTT AGTGAACCGT CAGATCCTGC AGAAGTTGGT CGTGAGGCAC 2821 TGGGCAGGTA AGTATCAAGG TTACAAGACA GGTTTAAGGA GACCAATAGA AACTGGGCTT 2881 GTCGAGACAG AGAAGACTCT TGCGTTTCTG ATAGGCACCT ATTGGTCTTA CTGACATCCA 2941 CTTTGCCTTT CTCTCCACAG GTGTCCAGCG GCCATCACAA GTTTGTACAA AAAAGCAGGC 3001 TCGCCatgac aagttccagg ctttggtttt cgctgctgct ggcggcagcg ttcgcaggac 3061 gggcgacggc cctctggccc tggcctcaga acttccaaac ctccgaccag cgctacgtcc 3121 tttacccgaa caactttcaa ttccagtacg atgtcagctc ggccgcgcag cccggctgct 3181 cagtcctcga cgaggccttc cagcgctatc gtgacctgct tttcggttcc gggtcttggc 3241 cccgtcctta cctcacaggg aaacggcata cactggagaa gaatgtgttg gttgtctctg 3301 tagtcacacc tggatgtaac cagcttccta ctttggagtc agtggagaat tataccctga 3361 ccataaatga tgaccagtgt ttactcctct ctgagactgt ctggggagct ctccgaggtc 3421 tggagacttt tagccagctt gtttggaaat ctgctgaggg cacattcttt atcaacaaga 3481 ctgagattga ggactttccc cgctttcctc accggggctt gctgttggat acatctcgcc 3541 attacctgcc actctctagc atcctggaca ctctggatgt catggcgtac aataaattga 3601 acgtgttcca ctggcatctg gtagatgatc cttccttccc atatgagagc ttcacttttc 3661 cagagctcat gagaaagggg tcctacaacc ctgtcaccca catctacaca gcacaggatg 3721 tgaaggaggt cattgaatac gcacggctcc ggggtatccg tgtgcttgca gagtttgaca 3781 ctcctggcca cactttgtcc tggggaccag gtatccctgg attactgact ccttgctact 3841 ctgggtctga gccctctggc acctttggac cagtgaatcc cagtctcaat aatacctatg 3901 agttcatgag cacattcttc ttagaagtca gctctgtctt cccagatttt tatcttcatc 3961 ttggaggaga tgaggttgat ttcacctgct ggaagtccaa cccagagatc caggacttta 4021 tgaggaagaa aggcttcggt gaggacttca agcagctgga gtccttctac atccagacgc 4081 tgctggacat cgtctcttct tatggcaagg gctatgtggt gtggcaggag gtgtttgata 4141 ataaagtaaa gattcagcca gacacaatca tacaggtgtg gcgagaggat attccagtga 4201 actatatgaa ggagctggaa ctggtcacca aggccggctt ccgggccctt ctctctgccc 4261 cctggtacct gaaccgtata tcctatggcc ctgactggaa ggatttctac gtagtggaac 4321 ccctggcatt tgaaggtacc cctgagcaga aggctctggt gattggtgga gaggcttgta 4381 tgtggggaga atatgtggac aacacaaacc tggtccccag gctctggccc agagcagggg 4441 ctgttgccga aaggctgtgg agcaacaagt tgacatctga cctgacattt gcctatgaac 4501 gtttgtcaca cttccgctgt gagttgctga ggcgaggtgt ccaggcccaa cccctcaatg 4561 taggcttctg tgagcaggag tttgaacaga ccgaaaactt gtactttcaa ggctCCAGCT 4621 TTCTTGTACA AAGTGGTGAT GGCCGCCATC ATCATCATCA TCATCATCAT GCGTGGAGCC 4681 ACCCGCAGTT CGAAAAATAA TAAGGATCCA ATCAACCTCT GGATTACAAA ATTTGTGAAA 4741 GATTGACTGG TATTCTTAAC TATGTTGCTC CTTTTACGCT ATGTGGATAC GCTGCTTTAA 4801 TGCCTTTGTA TCATGCTATT GCTTCCCGTA TGGCTTTCAT TTTCTCCTCC TTGTATAAAT 4861 CCTGGTTGCT GTCTCTTTAT GAGGAGTTGT GGCCCGTTGT CAGGCAACGT GGCGTGGTGT 4921 GCACTGTGTT TGCTGACGCA ACCCCCACTG GTTGGGGCAT TGCCACCACC TGTCAGCTCC 4981 TTTCCGGGAC TTTCGCTTTC CCCCTCCCTA TTGCCACGGC GGAACTCATC GCCGCCTGCC 5041 TTGCCCGCTG CTGGACAGGG GCTCGGCTGT TGGGCACTGA CAATTCCGTG GTGTTGTCGG 5101 GGAAGCTGAC GTCCTTTCCA TGGCTGCTCG CCTGTGTTGC CACCTGGATT CTGCGCGGGA 5161 CGTCCTTCTG CTACGTCCCT TCGGCCCTCA ATCCAGCGGA CCTTCCTTCC CGCGGCCTGC 5221 TGCCGGCTCT GCGGCCTCTT CCGCGTCTTC GAGATCTGCC TCGACTGTGC CTTCTAGTTG 5281 CCAGCCATCT GTTGTTTGCC CCTCCCCCGT GCCTTCCTTG ACCCTGGAAG GTGCCACTCC 5341 CACTGTCCTT TCCTAATAAA ATGAGGAAAT TGCATCGCAT TGTCTGAGTA GGTGTCATTC 5401 TATTCTGGGG GGTGGGGTGG GGCAGGACAG CAAGGGGGAG GATTGGGAAG ACAATAGCAG 5461 GCATGCTGGG GACTCGAGTT AAGGGCGAAT TGCCGATTAG GATCTTCCTA GAGCATGGCT 5521 ACGTAGATAA GTAGCATGGC GGGTTAATCA TTAACTACAA GGAACCCCTA GTGATGGAGT 5581 TGGCCACTCC CTCTCTGCGC GCTCGCTCGC TCACTGAGGC CGGGCGACCA AAGGTCGCCC 5641 GACGCCCGGG CTTTGCCCGG GCGGCCTCAG TGAGCGAGCG AGCGCGCAGC CTTAATTAAG 5701 AGCTCATGGC GCGCCTAGGC CTTGACGGCC TTCCGCCAAT TCGCCCTATA GTGAGTCGTA 5761 TTACGTCGCG CTCACTGGCC GTCGTTTTAC AACGTCGTGA CTGGGAAAAC CCTGGCGTTA 5821 CCCAACTTAA TCGCCTTGCA GCACATCCCC CTTTCGCCAG CTGGCGTAAT AGCGAAGAGG 5881 CCCGCACCGA AACGCCCTTC CCAACAGTTG CGCAGCCTGA ATGGCGAATG GGAGCGCCCT 5941 GTAGCGGCCA CTCAACCCTA TCTCGGTCTA TTCTTTTGAT TTATAAGGGA TTTTGCCGAT 6001 TTCGGCCTAT TGGTTAAAAA ATGAGCTGAT TTAACAAAAA TTTAACGCGA ATTTTAACAA 6061 AATATTAACG CTTACAATTT AG //