LOCUS pDONR™/Zeo DISCLAIMER Certain terms are trademarks or registered trademarks of Invitrogen Corporation. See "Intellectual Property" in the Help file for more information. FEATURES Location/Qualifiers misc_feature complement(268..295) /note="rrnB T2 transcription termination sequence (c)" misc_feature complement(427..470) /note="rrnB T1 transcription termination sequence (c)" primer_bind 537..552 /note="M13 Forward (-20) priming site" misc_recomb 570..668 /label=attL1 /note="attL1" misc_recomb complement(1928..2024) /label=attL2 /note="attL2 (c)" misc_signal complement(2039..2058) /note="T7 Promoter/priming site (c)" primer_bind 2066..2082 /note="M13 Reverse priming site" gene 2195..3004 /note="Kanamycin resistance gene" rep_origin 3125..3798 /note="pUC origin" PCR_frame 669..1928 /note="Reading Frame" /set="Set 1" PCR_primer 652..668 /primer="GTACAAAAAAGCAGGCTCATGGAACAAGGACAGCTCTTCC" /set="Set 1" /pair="Pair 1" /current=1 /original=ACAAGTTTGTACAAAAAAGCAGGCTCATGGAACAAGGACAGCTCTTCC PCR_primer complement(669..1948) /primer="AAAGCTGGGTTTAGCAGTGAATGGTCCG" /set="Set 1" /pair="Pair 1" /current=1 /original=ACCACTTTGTACAAGAAAGCTGGGTTTAGCAGTGAATGGTCCG PCR_product complement(652..1945) /pair="Pair 1" /set="Set 1" /current=1 /score=1.000 vector join(1936..3801,1..651) /source="pDONR%99221" /type="Donor Vector" misc_feature 1906..1926 /note="TEV site" source 673..1905 /organism="Homo sapiens" /mol_type="mRNA" /db_xref="taxon:9606" /clone="MGC:2280 IMAGE:3504221" /tissue_type="Placenta, choriocarcinoma" /clone_lib="NIH_MGC_21" /lab_host="DH10B-R" /note="Vector: pOTB7" gene 673..1905 /gene="NAGA" /gene_synonym=D22S674 /gene_synonym=GALB /db_xref="GeneID:4668" /db_xref="HGNC:7631" /db_xref="MIM:104170" CDS 673..1905 /dnas_title="N-acetylgalactosaminidase, alpha-" /gene="NAGA" /gene_synonym=D22S674 /gene_synonym=GALB /codon_start=1 /product="N-acetylgalactosaminidase, alpha-" /protein_id="AAH00095.1" /db_xref="GI:12652693" /db_xref="GeneID:4668" /db_xref="HGNC:7631" /db_xref="MIM:104170" /translation="MLLKTVLLLGHVAQVLMLDNGLLQTPPMGWLAWERFRCNINCDE DPKNCISEQLFMEMADRMAQDGWRDMGYTYLNIDDCWIGGRDASGRLMPDPKRFPHGI PFLADYVHSLGLKLGIYADMGNFTCMGYPGTTLDKVVQDAQTFAEWKVDMLKLDGCFS TPEERAQGYPKMAAALNATGRPIAFSCSWPAYEGGLPPRVNYSLLADICNLWRNYDDI QDSWWSVLSILNWFVEHQDILQPVAGPGHWNDPDMLLIGNFGLSLEQSRAQMALWTVL AAPLLMSTDLRTISAQNMDILQNPLMIKINQDPLGIQGRRIHKEKSLIEVYMRPLSNK ASALVFFSCRTDMPYRYHSSLGQLNFTGSVIYEAQDVYSGDIISGLRDETNFTVIINP SGVVMWYLYPIKNLEMSQQ" misc_difference 951..951 /gene="NAGA" /gene_synonym=D22S674 /gene_synonym=GALB /note="'A' in cDNA is 'G' in the human genome; no amino acid change." misc_feature 673..1905 /note="NAGA coding region" ORIGIN 1 CTTTCCTGCG TTATCCCCTG ATTCTGTGGA TAACCGTATT ACCGCCTTTG AGTGAGCTGA 61 TACCGCTCGC CGCAGCCGAA CGACCGAGCG CAGCGAGTCA GTGAGCGAGG AAGCGGAAGA 121 GCGCCCAATA CGCAAACCGC CTCTCCCCGC GCGTTGGCCG ATTCATTAAT GCAGCTGGCA 181 CGACAGGTTT CCCGACTGGA AAGCGGGCAG TGAGCGCAAC GCAATTAATA CGCGTACCGC 241 TAGCCAGGAA GAGTTTGTAG AAACGCAAAA AGGCCATCCG TCAGGATGGC CTTCTGCTTA 301 GTTTGATGCC TGGCAGTTTA TGGCGGGCGT CCTGCCCGCC ACCCTCCGGG CCGTTGCTTC 361 ACAACGTTCA AATCCGCTCC CGGCGGATTT GTCCTACTCA GGAGAGCGTT CACCGACAAA 421 CAACAGATAA AACGAAAGGC CCAGTCTTCC GACTGAGCCT TTCGTTTTAT TTGATGCCTG 481 GCAGTTCCCT ACTCTCGCGT TAACGCTAGC ATGGATGTTT TCCCAGTCAC GACGTTGTAA 541 AACGACGGCC AGTCTTAAGC TCGGGCCCCA AATAATGATT TTATTTTGAC TGATAGTGAC 601 CTGTTCGTTG CAACACATTG ATGAGCAATG CTTTTTTATA ATGCCAACTT TGTACAAAAA 661 AGCAGGCTCG CCatgctgct gaagacagtg ctcttgctgg gacatgtggc ccaggtgctg 721 atgctggaca atgggctcct gcagacacca cccatgggct ggctggcctg ggaacgcttc 781 cgctgcaaca ttaactgtga tgaggaccca aagaactgca taagtgaaca gctcttcatg 841 gagatggctg accggatggc acaggatgga tggcgggaca tgggctacac atacctcaac 901 attgatgact gctggatcgg tggtcgcgat gccagtggcc gcctgatgcc agatcccaag 961 cgcttccctc atggcattcc tttcctggct gactacgttc actccctggg cctgaagttg 1021 ggtatctacg cggacatggg caacttcacc tgcatgggtt acccaggcac cacactggac 1081 aaggtggtcc aggatgctca gaccttcgcc gagtggaagg tagacatgct caagctggat 1141 ggctgcttct ccacccccga ggagcgggcc caggggtacc ccaagatggc tgctgccctg 1201 aatgccacag gccgccccat cgccttctcc tgcagctggc cagcctatga aggcggcctc 1261 cccccaaggg tgaactacag tctgctggcg gacatctgca acctctggcg taactatgat 1321 gacatccagg actcctggtg gagcgtgctc tccatcctga attggttcgt ggagcaccag 1381 gacatactgc agccagtggc cggccctggg cactggaatg accctgacat gctgctcatt 1441 gggaactttg gtctcagctt agagcaatcc cgggcccaga tggccctgtg gacggtgctg 1501 gcagcccccc tcttgatgtc cacagacctg cgtaccatct ccgcccagaa catggacatt 1561 ctgcagaatc cactcatgat caaaatcaac caggatccct taggcatcca gggacgcagg 1621 attcacaagg aaaaatctct catcgaagtg tacatgcggc ctctgtccaa caaggctagc 1681 gccttagtct tcttcagctg caggaccgat atgccttatc gctaccactc ctcccttggc 1741 cagctgaact tcaccgggtc tgtgatatat gaggcccagg acgtctactc aggtgacatc 1801 atcagtggcc tccgagatga aaccaacttc acagtgatca tcaacccttc aggggtagtg 1861 atgtggtacc tgtatcccat caagaacctg gagatgtccc agcaggaaaa cttgtacttt 1921 caaggctCCA GCTTTCTTGT ACAAAGTTGG CATTATAAGA AAGCATTGCT TATCAATTTG 1981 TTGCAACGAA CAGGTCACTA TCAGTCAAAA TAAAATCATT ATTTGCCATC CAGCTGATAT 2041 CCCCTATAGT GAGTCGTATT ACATGGTCAT AGCTGTTTCC TGGCAGCTCT GGCCCGTGTC 2101 TCAAAATCTC TGATGTTACA TTGCACAAGA TAAAATAATA TCATCATGAA CAATAAAACT 2161 GTCTGCTTAC ATAAACAGTA ATACAAGGGG TGTTATGAGC CATATTCAAC GGGAAACGTC 2221 GAGGCCGCGA TTAAATTCCA ACATGGATGC TGATTTATAT GGGTATAAAT GGGCTCGCGA 2281 TAATGTCGGG CAATCAGGTG CGACAATCTA TCGCTTGTAT GGGAAGCCCG ATGCGCCAGA 2341 GTTGTTTCTG AAACATGGCA AAGGTAGCGT TGCCAATGAT GTTACAGATG AGATGGTCAG 2401 ACTAAACTGG CTGACGGAAT TTATGCCTCT TCCGACCATC AAGCATTTTA TCCGTACTCC 2461 TGATGATGCA TGGTTACTCA CCACTGCGAT CCCCGGAAAA ACAGCATTCC AGGTATTAGA 2521 AGAATATCCT GATTCAGGTG AAAATATTGT TGATGCGCTG GCAGTGTTCC TGCGCCGGTT 2581 GCATTCGATT CCTGTTTGTA ATTGTCCTTT TAACAGCGAT CGCGTATTTC GTCTCGCTCA 2641 GGCGCAATCA CGAATGAATA ACGGTTTGGT TGATGCGAGT GATTTTGATG ACGAGCGTAA 2701 TGGCTGGCCT GTTGAACAAG TCTGGAAAGA AATGCATAAA CTTTTGCCAT TCTCACCGGA 2761 TTCAGTCGTC ACTCATGGTG ATTTCTCACT TGATAACCTT ATTTTTGACG AGGGGAAATT 2821 AATAGGTTGT ATTGATGTTG GACGAGTCGG AATCGCAGAC CGATACCAGG ATCTTGCCAT 2881 CCTATGGAAC TGCCTCGGTG AGTTTTCTCC TTCATTACAG AAACGGCTTT TTCAAAAATA 2941 TGGTATTGAT AATCCTGATA TGAATAAATT GCAGTTTCAT TTGATGCTCG ATGAGTTTTT 3001 CTAATCAGAA TTGGTTAATT GGTTGTAACA CTGGCAGAGC ATTACGCTGA CTTGACGGGA 3061 CGGCGCAAGC TCATGACCAA AATCCCTTAA CGTGAGTTAC GCGTCGTTCC ACTGAGCGTC 3121 AGACCCCGTA GAAAAGATCA AAGGATCTTC TTGAGATCCT TTTTTTCTGC GCGTAATCTG 3181 CTGCTTGCAA ACAAAAAAAC CACCGCTACC AGCGGTGGTT TGTTTGCCGG ATCAAGAGCT 3241 ACCAACTCTT TTTCCGAAGG TAACTGGCTT CAGCAGAGCG CAGATACCAA ATACTGTTCT 3301 TCTAGTGTAG CCGTAGTTAG GCCACCACTT CAAGAACTCT GTAGCACCGC CTACATACCT 3361 CGCTCTGCTA ATCCTGTTAC CAGTGGCTGC TGCCAGTGGC GATAAGTCGT GTCTTACCGG 3421 GTTGGACTCA AGACGATAGT TACCGGATAA GGCGCAGCGG TCGGGCTGAA CGGGGGGTTC 3481 GTGCACACAG CCCAGCTTGG AGCGAACGAC CTACACCGAA CTGAGATACC TACAGCGTGA 3541 GCTATGAGAA AGCGCCACGC TTCCCGAAGG GAGAAAGGCG GACAGGTATC CGGTAAGCGG 3601 CAGGGTCGGA ACAGGAGAGC GCACGAGGGA GCTTCCAGGG GGAAACGCCT GGTATCTTTA 3661 TAGTCCTGTC GGGTTTCGCC ACCTCTGACT TGAGCGTCGA TTTTTGTGAT GCTCGTCAGG 3721 GGGGCGGAGC CTATGGAAAA ACGCCAGCAA CGCGGCCTTT TTACGGTTCC TGGCCTTTTG 3781 CTGGCCTTTT GCTCACATGT T //