LOCUS pDONR™/Zeo DISCLAIMER Certain terms are trademarks or registered trademarks of Invitrogen Corporation. See "Intellectual Property" in the Help file for more information. FEATURES Location/Qualifiers misc_feature complement(268..295) /note="rrnB T2 transcription termination sequence (c)" misc_feature complement(427..470) /note="rrnB T1 transcription termination sequence (c)" primer_bind 537..552 /note="M13 Forward (-20) priming site" misc_recomb 570..668 /label=attL1 /note="attL1" misc_recomb complement(1919..2015) /label=attL2 /note="attL2 (c)" misc_signal complement(2030..2049) /note="T7 Promoter/priming site (c)" primer_bind 2057..2073 /note="M13 Reverse priming site" gene 2186..2995 /note="Kanamycin resistance gene" rep_origin 3116..3789 /note="pUC origin" vector join(1927..3792,1..651) /source="pDONR%99221" /type="Donor Vector" misc_feature 669..691 /note="TEV site" source 692..1912 /organism="Homo sapiens" /mol_type="mRNA" /db_xref="taxon:9606" /clone="MGC:26636 IMAGE:4825619" /tissue_type="Testis" /clone_lib="NIH_MGC_97" /lab_host="DH10B" /note="Vector: pBluescriptR" gene 692..1912 /gene="GALNTL5" /db_xref="GeneID:168391" /db_xref="HGNC:21725" CDS 692..1912 /dnas_title="UDP-N-acetyl-alpha-D-galactosamine:polypeptid e N-acetylgalactosaminyltransferase-like 5" /gene="GALNTL5" /codon_start=1 /product="UDP-N-acetyl-alpha-D-galactosamine:polypeptide N-acetylgalactosaminyltransferase-like 5" /protein_id="AAH22021.1" /db_xref="GI:18314429" /db_xref="GeneID:168391" /db_xref="HGNC:21725" /translation="MRNAIIQGLFYGSLTFGIWTALLFIYLHHNHVSSWQKKSQEPLS AWSPGKKVHQQIIYGSEQIPKPHVIVKRTDEDKAKSMLGTDFNHTNPELHKELLKYGF NVIISRSLGIEREVPDTRSKMRLQKHYPARLPTASIVICFYNEECNALFQTMSSVTNL TPHYFLEEIILVDDMSKVDDLKEKLDYHLETFRGKVKIIRNKKREGLIRARLIGASHA SGDVLVFLDSHCEVNRVWLEPLLHAIAKDPKMVVCPLIDVIDDRTLEYKPSPLVRGTF DWNLQFKWDNVFSYEMDGPEGSTKPIRSPAMSGGIFAIRRHYFNEIGQYDKDMDFWGR ENLELSLRIWMCGGQLFIIPCSRVGHISKKQTGKPSTIISAMTHNYLRLVHVWLDEYK EQFFLRKPGLKYVTYGNIRERVELRKRLGCKSFQWYLDNVFPELEASVNSL" misc_difference 953..953 /gene="GALNTL5" /note="'C' in cDNA is 'T' in the human genome; amino acid difference: 'R' in cDNA, 'C' in the human genome. The chimpanzee genome agrees with the human genomic sequence and not the cDNA." misc_feature 692..1912 /note="GALNT5 coding region" ORIGIN 1 CTTTCCTGCG TTATCCCCTG ATTCTGTGGA TAACCGTATT ACCGCCTTTG AGTGAGCTGA 61 TACCGCTCGC CGCAGCCGAA CGACCGAGCG CAGCGAGTCA GTGAGCGAGG AAGCGGAAGA 121 GCGCCCAATA CGCAAACCGC CTCTCCCCGC GCGTTGGCCG ATTCATTAAT GCAGCTGGCA 181 CGACAGGTTT CCCGACTGGA AAGCGGGCAG TGAGCGCAAC GCAATTAATA CGCGTACCGC 241 TAGCCAGGAA GAGTTTGTAG AAACGCAAAA AGGCCATCCG TCAGGATGGC CTTCTGCTTA 301 GTTTGATGCC TGGCAGTTTA TGGCGGGCGT CCTGCCCGCC ACCCTCCGGG CCGTTGCTTC 361 ACAACGTTCA AATCCGCTCC CGGCGGATTT GTCCTACTCA GGAGAGCGTT CACCGACAAA 421 CAACAGATAA AACGAAAGGC CCAGTCTTCC GACTGAGCCT TTCGTTTTAT TTGATGCCTG 481 GCAGTTCCCT ACTCTCGCGT TAACGCTAGC ATGGATGTTT TCCCAGTCAC GACGTTGTAA 541 AACGACGGCC AGTCTTAAGC TCGGGCCCCA AATAATGATT TTATTTTGAC TGATAGTGAC 601 CTGTTCGTTG CAACACATTG ATGAGCAATG CTTTTTTATA ATGCCAACTT TGTACAAAAA 661 AGCAGGCTct gaaaacttgt actttcaagg caagaaaagc caggagcctc tgtcagcttg 721 gtcccctgga aaaaaagtgc atcagcaaat tatctatggc tcagagcaaa taccaaaacc 781 tcatgtaata gtcaaaagga ctgatgaaga taaagcaaag tctatgttag gtacagattt 841 taaccataca aacccagaac ttcataaaga acttttaaaa tatggattta atgtgattat 901 cagtagaagc ttgggcatcg aaagagaagt gccagatacc aggagtaaaa tgcgtcttca 961 aaaacattac ccagcccgcc tcccgactgc cagcattgtc atttgcttct ataatgaaga 1021 atgtaatgcc ttgtttcaga ccatgtccag tgtcacgaac ctcacgccac actattttct 1081 tgaagaaatt attttggtag atgacatgag caaagttgat gatttgaaag aaaaactaga 1141 ctatcacctg gaaacttttc ggggaaaggt taaaataata agaaacaaaa agagagaggg 1201 gctgattcga gcaaggctga ttggagcttc tcatgcttca ggggatgttc tggtgttcct 1261 ggacagccac tgtgaggtga acagagtatg gctggagccc ctgctgcatg ccattgccaa 1321 ggaccccaaa atggtggtgt gccccctgat agatgtcatt gatgatagaa ctctggagta 1381 taagccctct cctcttgtaa ggggaacttt tgattggaac ctacaattta aatgggataa 1441 tgttttctct tatgagatgg atggaccaga aggatctact aaaccaatcc ggtcacctgc 1501 aatgtctgga ggaatttttg ctatacgtcg gcattatttt aatgaaattg gacagtatga 1561 caaggatatg gatttttggg gaagagaaaa tttggaactt tcactaagga tctggatgtg 1621 tggaggccaa ctctttataa tcccctgctc tcgagtagga catatcagta agaaacaaac 1681 tggaaaacct tctacaatca tcagtgctat gacacataac tacctaagac tggtgcacgt 1741 ttggctggat gaatataagg agcagttttt tcttcgaaag cctggtctga aatatgtcac 1801 ctacggaaat attcgcgagc gtgttgagtt aaggaaacga ctgggttgca agtcatttca 1861 gtggtatttg gataatgtct tcccagagtt ggaggcatct gtgaacagcc tgTAGGACCC 1921 AGCTTTCTTG TACAAAGTTG GCATTATAAG AAAGCATTGC TTATCAATTT GTTGCAACGA 1981 ACAGGTCACT ATCAGTCAAA ATAAAATCAT TATTTGCCAT CCAGCTGATA TCCCCTATAG 2041 TGAGTCGTAT TACATGGTCA TAGCTGTTTC CTGGCAGCTC TGGCCCGTGT CTCAAAATCT 2101 CTGATGTTAC ATTGCACAAG ATAAAATAAT ATCATCATGA ACAATAAAAC TGTCTGCTTA 2161 CATAAACAGT AATACAAGGG GTGTTATGAG CCATATTCAA CGGGAAACGT CGAGGCCGCG 2221 ATTAAATTCC AACATGGATG CTGATTTATA TGGGTATAAA TGGGCTCGCG ATAATGTCGG 2281 GCAATCAGGT GCGACAATCT ATCGCTTGTA TGGGAAGCCC GATGCGCCAG AGTTGTTTCT 2341 GAAACATGGC AAAGGTAGCG TTGCCAATGA TGTTACAGAT GAGATGGTCA GACTAAACTG 2401 GCTGACGGAA TTTATGCCTC TTCCGACCAT CAAGCATTTT ATCCGTACTC CTGATGATGC 2461 ATGGTTACTC ACCACTGCGA TCCCCGGAAA AACAGCATTC CAGGTATTAG AAGAATATCC 2521 TGATTCAGGT GAAAATATTG TTGATGCGCT GGCAGTGTTC CTGCGCCGGT TGCATTCGAT 2581 TCCTGTTTGT AATTGTCCTT TTAACAGCGA TCGCGTATTT CGTCTCGCTC AGGCGCAATC 2641 ACGAATGAAT AACGGTTTGG TTGATGCGAG TGATTTTGAT GACGAGCGTA ATGGCTGGCC 2701 TGTTGAACAA GTCTGGAAAG AAATGCATAA ACTTTTGCCA TTCTCACCGG ATTCAGTCGT 2761 CACTCATGGT GATTTCTCAC TTGATAACCT TATTTTTGAC GAGGGGAAAT TAATAGGTTG 2821 TATTGATGTT GGACGAGTCG GAATCGCAGA CCGATACCAG GATCTTGCCA TCCTATGGAA 2881 CTGCCTCGGT GAGTTTTCTC CTTCATTACA GAAACGGCTT TTTCAAAAAT ATGGTATTGA 2941 TAATCCTGAT ATGAATAAAT TGCAGTTTCA TTTGATGCTC GATGAGTTTT TCTAATCAGA 3001 ATTGGTTAAT TGGTTGTAAC ACTGGCAGAG CATTACGCTG ACTTGACGGG ACGGCGCAAG 3061 CTCATGACCA AAATCCCTTA ACGTGAGTTA CGCGTCGTTC CACTGAGCGT CAGACCCCGT 3121 AGAAAAGATC AAAGGATCTT CTTGAGATCC TTTTTTTCTG CGCGTAATCT GCTGCTTGCA 3181 AACAAAAAAA CCACCGCTAC CAGCGGTGGT TTGTTTGCCG GATCAAGAGC TACCAACTCT 3241 TTTTCCGAAG GTAACTGGCT TCAGCAGAGC GCAGATACCA AATACTGTTC TTCTAGTGTA 3301 GCCGTAGTTA GGCCACCACT TCAAGAACTC TGTAGCACCG CCTACATACC TCGCTCTGCT 3361 AATCCTGTTA CCAGTGGCTG CTGCCAGTGG CGATAAGTCG TGTCTTACCG GGTTGGACTC 3421 AAGACGATAG TTACCGGATA AGGCGCAGCG GTCGGGCTGA ACGGGGGGTT CGTGCACACA 3481 GCCCAGCTTG GAGCGAACGA CCTACACCGA ACTGAGATAC CTACAGCGTG AGCTATGAGA 3541 AAGCGCCACG CTTCCCGAAG GGAGAAAGGC GGACAGGTAT CCGGTAAGCG GCAGGGTCGG 3601 AACAGGAGAG CGCACGAGGG AGCTTCCAGG GGGAAACGCC TGGTATCTTT ATAGTCCTGT 3661 CGGGTTTCGC CACCTCTGAC TTGAGCGTCG ATTTTTGTGA TGCTCGTCAG GGGGGCGGAG 3721 CCTATGGAAA AACGCCAGCA ACGCGGCCTT TTTACGGTTC CTGGCCTTTT GCTGGCCTTT 3781 TGCTCACATG TT //