LOCUS NAGA-pGEc2-DEST 6454 bp DNA circular 24-JAN-2013 FEATURES Location/Qualifiers misc_feature complement(5932..6061) /note="3'-ITR" misc_feature complement(5630..5844) /note="BGH pA" rep_origin 1137..1804 /dnas_title="Col E1 origin" /label=Col E1 origin /vntifkey="33" CDS 129..989 /dnas_title="AmpR" /label=AmpR /vntifkey="4" misc_feature 1998..2127 /note="5'ITR" misc_feature 2208..2790 /note="CMV Promoter" misc_feature 2828..2960 /note="Artificial Intron" misc_feature 5082..5623 /note="WPRE" misc_recomb complement(2974..3001) /label=attB1 /note="attB1 site" /note="recognized as attB1" misc_feature 4261..4283 /note="attB2" misc_feature 5061..5066 /note="BstB1 site" misc_feature 4284..4979 /note="Super GFP" misc_feature 4980..5030 /note="AviTag" misc_feature 5031..5054 /note="His Tag" PCR_frame 3002..4261 /note="Reading Frame" /set="Set 1" source 3006..4238 /dnas_title="NAGA-pGEc2-DEST" /organism="Homo sapiens" /mol_type="mRNA" /db_xref="taxon:9606" /clone="MGC:2280 IMAGE:3504221" /tissue_type="Placenta, choriocarcinoma" /clone_lib="NIH_MGC_21" /lab_host="DH10B-R" /note="Vector: pOTB7" gene 3006..4238 /dnas_title="NAGA" /gene="NAGA" /gene_synonym="D22S674" /gene_synonym="GALB" /db_xref="GeneID:4668" /db_xref="HGNC:7631" /db_xref="MIM:104170" CDS 3006..4238 /dnas_title="N-acetylgalactosaminidase, alpha-" /gene="NAGA" /gene_synonym="D22S674" /gene_synonym="GALB" /codon_start=1 /product="N-acetylgalactosaminidase, alpha-" /protein_id="AAH00095.1" /db_xref="GI:12652693" /db_xref="GeneID:4668" /db_xref="HGNC:7631" /db_xref="MIM:104170" /translation="MLLKTVLLLGHVAQVLMLDNGLLQTPPMGWLAWERFRCNINCDE DPKNCISEQLFMEMADRMAQDGWRDMGYTYLNIDDCWIGGRDASGRLMPDPKRFPHGI PFLADYVHSLGLKLGIYADMGNFTCMGYPGTTLDKVVQDAQTFAEWKVDMLKLDGCFS TPEERAQGYPKMAAALNATGRPIAFSCSWPAYEGGLPPRVNYSLLADICNLWRNYDDI QDSWWSVLSILNWFVEHQDILQPVAGPGHWNDPDMLLIGNFGLSLEQSRAQMALWTVL AAPLLMSTDLRTISAQNMDILQNPLMIKINQDPLGIQGRRIHKEKSLIEVYMRPLSNK ASALVFFSCRTDMPYRYHSSLGQLNFTGSVIYEAQDVYSGDIISGLRDETNFTVIINP SGVVMWYLYPIKNLEMSQQ" misc_difference 3284..3284 /dnas_title="NAGA" /gene="NAGA" /gene_synonym="D22S674" /gene_synonym="GALB" /note="'A' in cDNA is 'G' in the human genome; no amino acid change." misc_feature 3006..4238 /note="NAGA coding region" misc_feature 4239..4259 /note="TEV site" PCR_primer 2992..3001 /dnas_title="GTACAAAAAAGCAGGCTCATGGAACAAGGACAGCTCTTCC" /primer="CAGCTCTTCC" /set="Set 1" /pair="Pair 1" /current=1 /original="GTACAAAAAAGCAGGCTCATGGAACAAGGACAGCTCTTCC" PCR_primer complement(3002..4268) /dnas_title="AAAGCTGGGTTTAGCAGTGAATGGTCCG" /primer="AAAGCTGGGTTTAGCAGTGAATGGTCCG" /set="Set 1" /pair="Pair 1" /current=1 /original="ACCACTTTGTACAAGAAAGCTGGGTTTAGCAGTGAATGGTCCG" PCR_product complement(2992..4268) /pair="Pair 1" /set="Set 1" /current=1 /score="1.000" vector join(4269..6454,1..2991) /source="pGEc2-DEST" /type="Destination Vector" clone 2992..4268 /source="NAGA-Cterm-TEVfusion-pDONR221" /type="Entry Clone" ORIGIN 1 GTGGCACTTT TCGGGGAAAT GTGCGCGGAA CCCCTATTTG TTTATTTTTC TAAATACATT 61 CAAATATGTA TCCGCTCATG AGACAATAAC CCTGATAAAT GCTTCAATAA TATTGAAAAA 121 GGAAGAGTAT GAGTATTCAA CATTTCCGTG TCGCCCTTAT TCCCTTTTTT GCGGCATTTT 181 GCCTTCCTGT TTTTGCTCAC CCAGAAACGC TGGTGAAAGT AAAAGATGCT GAAGATCAGT 241 TGGGTGCACG AGTGGGTTAC ATCGAACTGG ATCTCAACAG CGGTAAGATC CTTGAGAGTT 301 TTCGCCCCGA AGAACGTTTT CCAATGATGA GCACTTTTAA AGTTCTGCTA TGTGGCGCGG 361 TATTATCCCG TATTGACGCC GGGCAAGAGC AACTCGGTCG CCGCATACAC TATTCTCAGA 421 ATGACTTGGT TGAGTACTCA CCAGTCACAG AAAAGCATCT TACGGATGGC ATGACAGTAA 481 GAGAATTATG CAGTGCTGCC ATAACCATGA GTGATAACAC TGCGGCCAAC TTACTTCTGA 541 CAACGATCGG AGGACCGAAG GAGCTAACCG CTTTTTTGCA CAACATGGGG GATCATGTAA 601 CTCGCCTTGA TCGTTGGGAA CCGGAGCTGA ATGAAGCCAT ACCAAACGAC GAGCGTGACA 661 CCACGATGCC TGTAGCAATG GCAACAACGT TGCGCAAACT ATTAACTGGC GAACTACTTA 721 CTCTAGCTTC CCGGCAACAA TTAATAGACT GGATGGAGGC GGATAAAGTT GCAGGACCAC 781 TTCTGCGCTC GGCCCTTCCG GCTGGCTGGT TTATTGCTGA TAAATCTGGA GCCGGTGAGC 841 GTGGTTCTCG CGGTATCATT GCAGCACTGG GGCCAGATGG TAAGCCCTCC CGTATCGTAG 901 TTATCTACAC GACGGGGAGT CAGGCAACTA TGGATGAACG AAATAGACAG ATCGCTGAGA 961 TAGGTGCCTC ACTGATTAAG CATTGGTAAC TGTCAGACCA AGTTTACTCA TATATACTTT 1021 AGATTGATTT AAAACTTCAT TTTTAATTTA AAAGGATCTA GGTGAAGATC CTTTTTGATA 1081 ATCTCATGAC CAAAATCCCT TAACGTGAGT TTTCGTTCCA CTGAGCGTCA GACCCCGTAG 1141 AAAAGATCAA AGGATCTTCT TGAGATCCTT TTTTTCTGCG CGTAATCTGC TGCTTGCAAA 1201 CAAAAAAACC ACCGCTACCA GCGGTGGTTT GTTTGCCGGA TCAAGAGCTA CCAACTCTTT 1261 TTCCGAAGGT AACTGGCTTC AGCAGAGCGC AGATACCAAA TACTGTTCTT CTAGTGTAGC 1321 CGTAGTTAGG CCACCACTTC AAGAACTCTG TAGCACCGCC TACATACCTC GCTCTGCTAA 1381 TCCTGTTACC AGTGGCTGCT GCCAGTGGCG ATAAGTCGTG TCTTACCGGG TTGGACTCAA 1441 GACGATAGTT ACCGGATAAG GCGCAGCGGT CGGGCTGAAC GGGGGGTTCG TGCACACAGC 1501 CCAGCTTGGA GCGAACGACC TACACCGAAC TGAGATACCT ACAGCGTGAG CTATGAGAAA 1561 GCGCCACGCT TCCCGAAGGG AGAAAGGCGG ACAGGTATCC GGTAAGCGGC AGGGTCGGAA 1621 CAGGAGAGCG CACGAGGGAG CTTCCAGGGG GAAACGCCTG GTATCTTTAT AGTCCTGTCG 1681 GGTTTCGCCA CCTCTGACTT GAGCGTCGAT TTTTGTGATG CTCGTCAGGG GGGCGGAGCC 1741 TATGGAAAAA CGCCAGCAAC GCGGCCTTTT TACGGTTCCT GGCCTTTTGC TGGCCTTTTG 1801 CTCATTAGGC ACCCCAGGCT TTACCCGAAC GACCGAGCGC AGCGAGTCAG TGAGCGAGGA 1861 AGCGGAGAGC GCCCAATACG CAAGGAAACA GCTATGACCA TGTTAATGCA GCTGGCACGA 1921 CAGGTTTCCC GACTGGAAAG CGGGCAGTGA GCGGAAGGCC CATGAGGCCA GTTAATTAAG 1981 AGGTACCTTA ATTAAGGCTG CGCGCTCGCT CGCTCACTGA GGCCGCCCGG GCAAAGCCCG 2041 GGCGTCGGGC GACCTTTGGT CGCCCGGCCT CAGTGAGCGA GCGAGCGCGC AGAGAGGGAG 2101 TGGCCAACTC CATCACTAGG GGTTCCTTGT AGTTAATGAT TAACCCGCCA TGCTACTTAT 2161 CTACGTAGCC ATGCTCTAGG AAGATCGCAA TTCGCCCTTA AGCTAGCTAG TTATTAATAG 2221 TAATCAATTA CGGGGTCATT AGTTCATAGC CCATATATGG AGTTCCGCGT TACATAACTT 2281 ACGGTAAATG GCCCGCCTGG CTGACCGCCC AACGACCCCC GCCCATTGAC GTCAATAATG 2341 ACGTATGTTC CCATAGTAAC GCCAATAGGG ACTTTCCATT GACGTCAATG GGTGGAGTAT 2401 TTACGGTAAA CTGCCCACTT GGCAGTACAT CAAGTGTATC ATATGCCAAG TACGCCCCCT 2461 ATTGACGTCA ATGACGGTAA ATGGCCCGCC TGGCATTATG CCCAGTACAT GACCTTATGG 2521 GACTTTCCTA CTTGGCAGTA CATCTACGTA TTAGTCATCG CTATTACCAT GGTGATGCGG 2581 TTTTGGCAGT ACATCAATGG GCGTGGATAG CGGTTTGACT CACGGGGATT TCCAAGTCTC 2641 CACCCCATTG ACGTCAATGG GAGTTTGTTT TGGCACCAAA ATCAACGGGA CTTTCCAAAA 2701 TGTCGTAACA ACTCCGCCCC ATTGACGCAA ATGGGCGGTA GGCGTGTACG GTGGGAGGTC 2761 TATATAAGCA GAGCTGGTTT AGTGAACCGT CAGATCCTGC AGAAGTTGGT CGTGAGGCAC 2821 TGGGCAGGTA AGTATCAAGG TTACAAGACA GGTTTAAGGA GACCAATAGA AACTGGGCTT 2881 GTCGAGACAG AGAAGACTCT TGCGTTTCTG ATAGGCACCT ATTGGTCTTA CTGACATCCA 2941 CTTTGCCTTT CTCTCCACAG GTGTCCAGCG GCCATCACAA GTTTGTACAA AAAAGCAGGC 3001 TCGCCatgct gctgaagaca gtgctcttgc tgggacatgt ggcccaggtg ctgatgctgg 3061 acaatgggct cctgcagaca ccacccatgg gctggctggc ctgggaacgc ttccgctgca 3121 acattaactg tgatgaggac ccaaagaact gcataagtga acagctcttc atggagatgg 3181 ctgaccggat ggcacaggat ggatggcggg acatgggcta cacatacctc aacattgatg 3241 actgctggat cggtggtcgc gatgccagtg gccgcctgat gccagatccc aagcgcttcc 3301 ctcatggcat tcctttcctg gctgactacg ttcactccct gggcctgaag ttgggtatct 3361 acgcggacat gggcaacttc acctgcatgg gttacccagg caccacactg gacaaggtgg 3421 tccaggatgc tcagaccttc gccgagtgga aggtagacat gctcaagctg gatggctgct 3481 tctccacccc cgaggagcgg gcccaggggt accccaagat ggctgctgcc ctgaatgcca 3541 caggccgccc catcgccttc tcctgcagct ggccagccta tgaaggcggc ctccccccaa 3601 gggtgaacta cagtctgctg gcggacatct gcaacctctg gcgtaactat gatgacatcc 3661 aggactcctg gtggagcgtg ctctccatcc tgaattggtt cgtggagcac caggacatac 3721 tgcagccagt ggccggccct gggcactgga atgaccctga catgctgctc attgggaact 3781 ttggtctcag cttagagcaa tcccgggccc agatggccct gtggacggtg ctggcagccc 3841 ccctcttgat gtccacagac ctgcgtacca tctccgccca gaacatggac attctgcaga 3901 atccactcat gatcaaaatc aaccaggatc ccttaggcat ccagggacgc aggattcaca 3961 aggaaaaatc tctcatcgaa gtgtacatgc ggcctctgtc caacaaggct agcgccttag 4021 tcttcttcag ctgcaggacc gatatgcctt atcgctacca ctcctccctt ggccagctga 4081 acttcaccgg gtctgtgata tatgaggccc aggacgtcta ctcaggtgac atcatcagtg 4141 gcctccgaga tgaaaccaac ttcacagtga tcatcaaccc ttcaggggta gtgatgtggt 4201 acctgtatcc catcaagaac ctggagatgt cccagcagga aaacttgtac tttcaaggct 4261 CCAGCTTTCT TGTACAAAGT GGTATGAGCA AGGGCGAGGA ACTGTTCACC GGCGTGGTGC 4321 CCATCCTGGT GGAACTGGAT GGCGACGTGA ACGGCCACAA GTTCTCTGTG CGGGGAGAGG 4381 GCGAAGGCGA CGCCACAAAT GGCAAGCTGA CCCTGAAGTT CATCTGCACC ACCGGCAAGC 4441 TGCCCGTGCC TTGGCCTACC CTCGTGACCA CACTGACCTA CGGCGTGCAG TGCTTCAGCA 4501 GATACCCCGA CCATATGAAG CGGCACGACT TCTTCAAGAG CGCCATGCCC GAGGGCTACG 4561 TGCAGGAACG GACCATCAGC TTCAAGGACG ACGGCACCTA CAAGACCAGA GCCGAAGTGA 4621 AGTTCGAGGG CGACACCCTC GTGAACCGGA TCGAGCTGAA GGGCATCGAT TTCAAAGAGG 4681 ACGGCAACAT CCTGGGCCAC AAGCTGGAGT ACAACTTCAA CAGCCACAAC GTGTACATCA 4741 CCGCCGACAA GCAGAAGAAC GGCATCAAGG CCAACTTCAA GATCCGGCAC AACGTGGAAG 4801 ATGGCAGCGT GCAGCTGGCC GACCACTACC AGCAGAACAC CCCCATCGGA GATGGCCCCG 4861 TGCTGCTGCC CGACAACCAC TACCTGAGCA CCCAGAGCGT GCTGAGCAAG GACCCCAACG 4921 AGAAGCGGGA CCACATGGTG CTGCTGGAAT TCGTGACCGC CGCTGGCATC ACCCACGGCA 4981 TGAGCGGCCT GAACGACATC TTCGAGGCCC AGAAAATCGA GTGGCACGAG CACCACCATC 5041 ATCACCATCA CCACTGATGA TTCGAAAAAT AATAAGGATC CAATCAACCT CTGGATTACA 5101 AAATTTGTGA AAGATTGACT GGTATTCTTA ACTATGTTGC TCCTTTTACG CTATGTGGAT 5161 ACGCTGCTTT AATGCCTTTG TATCATGCTA TTGCTTCCCG TATGGCTTTC ATTTTCTCCT 5221 CCTTGTATAA ATCCTGGTTG CTGTCTCTTT ATGAGGAGTT GTGGCCCGTT GTCAGGCAAC 5281 GTGGCGTGGT GTGCACTGTG TTTGCTGACG CAACCCCCAC TGGTTGGGGC ATTGCCACCA 5341 CCTGTCAGCT CCTTTCCGGG ACTTTCGCTT TCCCCCTCCC TATTGCCACG GCGGAACTCA 5401 TCGCCGCCTG CCTTGCCCGC TGCTGGACAG GGGCTCGGCT GTTGGGCACT GACAATTCCG 5461 TGGTGTTGTC GGGGAAGCTG ACGTCCTTTC CATGGCTGCT CGCCTGTGTT GCCACCTGGA 5521 TTCTGCGCGG GACGTCCTTC TGCTACGTCC CTTCGGCCCT CAATCCAGCG GACCTTCCTT 5581 CCCGCGGCCT GCTGCCGGCT CTGCGGCCTC TTCCGCGTCT TCGAGATCTG CCTCGACTGT 5641 GCCTTCTAGT TGCCAGCCAT CTGTTGTTTG CCCCTCCCCC GTGCCTTCCT TGACCCTGGA 5701 AGGTGCCACT CCCACTGTCC TTTCCTAATA AAATGAGGAA ATTGCATCGC ATTGTCTGAG 5761 TAGGTGTCAT TCTATTCTGG GGGGTGGGGT GGGGCAGGAC AGCAAGGGGG AGGATTGGGA 5821 AGACAATAGC AGGCATGCTG GGGACTCGAG TTAAGGGCGA ATTGCCGATT AGGATCTTCC 5881 TAGAGCATGG CTACGTAGAT AAGTAGCATG GCGGGTTAAT CATTAACTAC AAGGAACCCC 5941 TAGTGATGGA GTTGGCCACT CCCTCTCTGC GCGCTCGCTC GCTCACTGAG GCCGGGCGAC 6001 CAAAGGTCGC CCGACGCCCG GGCTTTGCCC GGGCGGCCTC AGTGAGCGAG CGAGCGCGCA 6061 GCCTTAATTA AGAGCTCATG GCGCGCCTAG GCCTTGACGG CCTTCCGCCA ATTCGCCCTA 6121 TAGTGAGTCG TATTACGTCG CGCTCACTGG CCGTCGTTTT ACAACGTCGT GACTGGGAAA 6181 ACCCTGGCGT TACCCAACTT AATCGCCTTG CAGCACATCC CCCTTTCGCC AGCTGGCGTA 6241 ATAGCGAAGA GGCCCGCACC GAAACGCCCT TCCCAACAGT TGCGCAGCCT GAATGGCGAA 6301 TGGGAGCGCC CTGTAGCGGC CACTCAACCC TATCTCGGTC TATTCTTTTG ATTTATAAGG 6361 GATTTTGCCG ATTTCGGCCT ATTGGTTAAA AAATGAGCTG ATTTAACAAA AATTTAACGC 6421 GAATTTTAAC AAAATATTAA CGCTTACAAT TTAG //