LOCUS pDONR™/Zeo DISCLAIMER Certain terms are trademarks or registered trademarks of Invitrogen Corporation. See "Intellectual Property" in the Help file for more information. FEATURES Location/Qualifiers misc_feature complement(268..295) /note="rrnB T2 transcription termination sequence (c)" misc_feature complement(427..470) /note="rrnB T1 transcription termination sequence (c)" primer_bind 537..552 /note="M13 Forward (-20) priming site" misc_recomb 570..668 /label=attL1 /note="attL1" misc_recomb complement(1877..1973) /label=attL2 /note="attL2 (c)" misc_signal complement(1988..2007) /note="T7 Promoter/priming site (c)" primer_bind 2015..2031 /note="M13 Reverse priming site" gene 2144..2953 /note="Kanamycin resistance gene" rep_origin 3074..3747 /note="pUC origin" vector join(1885..3750,1..651) /source="pDONR%99221" /type="Donor Vector" misc_feature 669..691 /note="TEV site" source 692..1876 /organism="Homo sapiens" /mol_type="mRNA" /db_xref="taxon:9606" /clone="MGC:2280 IMAGE:3504221" /tissue_type="Placenta, choriocarcinoma" /clone_lib="NIH_MGC_21" /lab_host="DH10B-R" /note="Vector: pOTB7" gene 692..1876 /gene="NAGA" /gene_synonym=D22S674 /gene_synonym=GALB /db_xref="GeneID:4668" /db_xref="HGNC:7631" /db_xref="MIM:104170" CDS 692..1876 /dnas_title="N-acetylgalactosaminidase, alpha-" /gene="NAGA" /gene_synonym=D22S674 /gene_synonym=GALB /codon_start=1 /product="N-acetylgalactosaminidase, alpha-" /protein_id="AAH00095.1" /db_xref="GI:12652693" /db_xref="GeneID:4668" /db_xref="HGNC:7631" /db_xref="MIM:104170" /translation="MLLKTVLLLGHVAQVLMLDNGLLQTPPMGWLAWERFRCNINCDE DPKNCISEQLFMEMADRMAQDGWRDMGYTYLNIDDCWIGGRDASGRLMPDPKRFPHGI PFLADYVHSLGLKLGIYADMGNFTCMGYPGTTLDKVVQDAQTFAEWKVDMLKLDGCFS TPEERAQGYPKMAAALNATGRPIAFSCSWPAYEGGLPPRVNYSLLADICNLWRNYDDI QDSWWSVLSILNWFVEHQDILQPVAGPGHWNDPDMLLIGNFGLSLEQSRAQMALWTVL AAPLLMSTDLRTISAQNMDILQNPLMIKINQDPLGIQGRRIHKEKSLIEVYMRPLSNK ASALVFFSCRTDMPYRYHSSLGQLNFTGSVIYEAQDVYSGDIISGLRDETNFTVIINP SGVVMWYLYPIKNLEMSQQ" misc_difference 919..919 /gene="NAGA" /gene_synonym=D22S674 /gene_synonym=GALB /note="'A' in cDNA is 'G' in the human genome; no amino acid change." misc_feature 692..1876 /note="NAGA coding region" ORIGIN 1 CTTTCCTGCG TTATCCCCTG ATTCTGTGGA TAACCGTATT ACCGCCTTTG AGTGAGCTGA 61 TACCGCTCGC CGCAGCCGAA CGACCGAGCG CAGCGAGTCA GTGAGCGAGG AAGCGGAAGA 121 GCGCCCAATA CGCAAACCGC CTCTCCCCGC GCGTTGGCCG ATTCATTAAT GCAGCTGGCA 181 CGACAGGTTT CCCGACTGGA AAGCGGGCAG TGAGCGCAAC GCAATTAATA CGCGTACCGC 241 TAGCCAGGAA GAGTTTGTAG AAACGCAAAA AGGCCATCCG TCAGGATGGC CTTCTGCTTA 301 GTTTGATGCC TGGCAGTTTA TGGCGGGCGT CCTGCCCGCC ACCCTCCGGG CCGTTGCTTC 361 ACAACGTTCA AATCCGCTCC CGGCGGATTT GTCCTACTCA GGAGAGCGTT CACCGACAAA 421 CAACAGATAA AACGAAAGGC CCAGTCTTCC GACTGAGCCT TTCGTTTTAT TTGATGCCTG 481 GCAGTTCCCT ACTCTCGCGT TAACGCTAGC ATGGATGTTT TCCCAGTCAC GACGTTGTAA 541 AACGACGGCC AGTCTTAAGC TCGGGCCCCA AATAATGATT TTATTTTGAC TGATAGTGAC 601 CTGTTCGTTG CAACACATTG ATGAGCAATG CTTTTTTATA ATGCCAACTT TGTACAAAAA 661 AGCAGGCTct gaaaacttgt actttcaagg cctggacaat gggctcctgc agacaccacc 721 catgggctgg ctggcctggg aacgcttccg ctgcaacatt aactgtgatg aggacccaaa 781 gaactgcata agtgaacagc tcttcatgga gatggctgac cggatggcac aggatggatg 841 gcgggacatg ggctacacat acctcaacat tgatgactgc tggatcggtg gtcgcgatgc 901 cagtggccgc ctgatgccag atcccaagcg cttccctcat ggcattcctt tcctggctga 961 ctacgttcac tccctgggcc tgaagttggg tatctacgcg gacatgggca acttcacctg 1021 catgggttac ccaggcacca cactggacaa ggtggtccag gatgctcaga ccttcgccga 1081 gtggaaggta gacatgctca agctggatgg ctgcttctcc acccccgagg agcgggccca 1141 ggggtacccc aagatggctg ctgccctgaa tgccacaggc cgccccatcg ccttctcctg 1201 cagctggcca gcctatgaag gcggcctccc cccaagggtg aactacagtc tgctggcgga 1261 catctgcaac ctctggcgta actatgatga catccaggac tcctggtgga gcgtgctctc 1321 catcctgaat tggttcgtgg agcaccagga catactgcag ccagtggccg gccctgggca 1381 ctggaatgac cctgacatgc tgctcattgg gaactttggt ctcagcttag agcaatcccg 1441 ggcccagatg gccctgtgga cggtgctggc agcccccctc ttgatgtcca cagacctgcg 1501 taccatctcc gcccagaaca tggacattct gcagaatcca ctcatgatca aaatcaacca 1561 ggatccctta ggcatccagg gacgcaggat tcacaaggaa aaatctctca tcgaagtgta 1621 catgcggcct ctgtccaaca aggctagcgc cttagtcttc ttcagctgca ggaccgatat 1681 gccttatcgc taccactcct cccttggcca gctgaacttc accgggtctg tgatatatga 1741 ggcccaggac gtctactcag gtgacatcat cagtggcctc cgagatgaaa ccaacttcac 1801 agtgatcatc aacccttcag gggtagtgat gtggtacctg tatcccatca agaacctgga 1861 gatgtcccag cagtgaCCAG CTTTCTTGTA CAAAGTTGGC ATTATAAGAA AGCATTGCTT 1921 ATCAATTTGT TGCAACGAAC AGGTCACTAT CAGTCAAAAT AAAATCATTA TTTGCCATCC 1981 AGCTGATATC CCCTATAGTG AGTCGTATTA CATGGTCATA GCTGTTTCCT GGCAGCTCTG 2041 GCCCGTGTCT CAAAATCTCT GATGTTACAT TGCACAAGAT AAAATAATAT CATCATGAAC 2101 AATAAAACTG TCTGCTTACA TAAACAGTAA TACAAGGGGT GTTATGAGCC ATATTCAACG 2161 GGAAACGTCG AGGCCGCGAT TAAATTCCAA CATGGATGCT GATTTATATG GGTATAAATG 2221 GGCTCGCGAT AATGTCGGGC AATCAGGTGC GACAATCTAT CGCTTGTATG GGAAGCCCGA 2281 TGCGCCAGAG TTGTTTCTGA AACATGGCAA AGGTAGCGTT GCCAATGATG TTACAGATGA 2341 GATGGTCAGA CTAAACTGGC TGACGGAATT TATGCCTCTT CCGACCATCA AGCATTTTAT 2401 CCGTACTCCT GATGATGCAT GGTTACTCAC CACTGCGATC CCCGGAAAAA CAGCATTCCA 2461 GGTATTAGAA GAATATCCTG ATTCAGGTGA AAATATTGTT GATGCGCTGG CAGTGTTCCT 2521 GCGCCGGTTG CATTCGATTC CTGTTTGTAA TTGTCCTTTT AACAGCGATC GCGTATTTCG 2581 TCTCGCTCAG GCGCAATCAC GAATGAATAA CGGTTTGGTT GATGCGAGTG ATTTTGATGA 2641 CGAGCGTAAT GGCTGGCCTG TTGAACAAGT CTGGAAAGAA ATGCATAAAC TTTTGCCATT 2701 CTCACCGGAT TCAGTCGTCA CTCATGGTGA TTTCTCACTT GATAACCTTA TTTTTGACGA 2761 GGGGAAATTA ATAGGTTGTA TTGATGTTGG ACGAGTCGGA ATCGCAGACC GATACCAGGA 2821 TCTTGCCATC CTATGGAACT GCCTCGGTGA GTTTTCTCCT TCATTACAGA AACGGCTTTT 2881 TCAAAAATAT GGTATTGATA ATCCTGATAT GAATAAATTG CAGTTTCATT TGATGCTCGA 2941 TGAGTTTTTC TAATCAGAAT TGGTTAATTG GTTGTAACAC TGGCAGAGCA TTACGCTGAC 3001 TTGACGGGAC GGCGCAAGCT CATGACCAAA ATCCCTTAAC GTGAGTTACG CGTCGTTCCA 3061 CTGAGCGTCA GACCCCGTAG AAAAGATCAA AGGATCTTCT TGAGATCCTT TTTTTCTGCG 3121 CGTAATCTGC TGCTTGCAAA CAAAAAAACC ACCGCTACCA GCGGTGGTTT GTTTGCCGGA 3181 TCAAGAGCTA CCAACTCTTT TTCCGAAGGT AACTGGCTTC AGCAGAGCGC AGATACCAAA 3241 TACTGTTCTT CTAGTGTAGC CGTAGTTAGG CCACCACTTC AAGAACTCTG TAGCACCGCC 3301 TACATACCTC GCTCTGCTAA TCCTGTTACC AGTGGCTGCT GCCAGTGGCG ATAAGTCGTG 3361 TCTTACCGGG TTGGACTCAA GACGATAGTT ACCGGATAAG GCGCAGCGGT CGGGCTGAAC 3421 GGGGGGTTCG TGCACACAGC CCAGCTTGGA GCGAACGACC TACACCGAAC TGAGATACCT 3481 ACAGCGTGAG CTATGAGAAA GCGCCACGCT TCCCGAAGGG AGAAAGGCGG ACAGGTATCC 3541 GGTAAGCGGC AGGGTCGGAA CAGGAGAGCG CACGAGGGAG CTTCCAGGGG GAAACGCCTG 3601 GTATCTTTAT AGTCCTGTCG GGTTTCGCCA CCTCTGACTT GAGCGTCGAT TTTTGTGATG 3661 CTCGTCAGGG GGGCGGAGCC TATGGAAAAA CGCCAGCAAC GCGGCCTTTT TACGGTTCCT 3721 GGCCTTTTGC TGGCCTTTTG CTCACATGTT //