LOCUS pDONR™/Zeo DISCLAIMER Certain terms are trademarks or registered trademarks of Invitrogen Corporation. See "Intellectual Property" in the Help file for more information. FEATURES Location/Qualifiers misc_feature complement(268..295) /note="rrnB T2 transcription termination sequence (c)" misc_feature complement(427..470) /note="rrnB T1 transcription termination sequence (c)" primer_bind 537..552 /note="M13 Forward (-20) priming site" misc_recomb 570..668 /label=attL1 /note="attL1" misc_recomb complement(2450..2546) /label=attL2 /note="attL2 (c)" misc_signal complement(2561..2580) /note="T7 Promoter/priming site (c)" primer_bind 2588..2604 /note="M13 Reverse priming site" gene 2717..3526 /note="Kanamycin resistance gene" rep_origin 3647..4320 /note="pUC origin" vector join(2458..4323,1..651) /source="pDONR%99221" /type="Donor Vector" misc_feature 669..691 /note="TEV site" source 692..2443 /organism="Homo sapiens" /mol_type="mRNA" /db_xref="taxon:9606" /clone="MGC:17334 IMAGE:4212702" /tissue_type="Brain, glioblastoma with EGFR amplification" /clone_lib="NCI_CGAP_Brn64" /lab_host="DH10B" /note="Vector: pCMV-SPORT6" gene 692..2443 /gene="GALNTL2" /gene_synonym=GALNT13 /gene_synonym=GALNT15 /gene_synonym=GALNT7 /db_xref="GeneID:117248" /db_xref="HGNC:21531" CDS 692..2443 /dnas_title="UDP-N-acetyl-alpha-D-galactosamine:polypeptid e N-acetylgalactosaminyltransferase-like 2" /gene="GALNTL2" /gene_synonym=GALNT13 /gene_synonym=GALNT15 /gene_synonym=GALNT7 /codon_start=1 /product="UDP-N-acetyl-alpha-D-galactosamine:polypeptide N-acetylgalactosaminyltransferase-like 2" /protein_id="AAH14789.1" /db_xref="GI:15928642" /db_xref="GeneID:117248" /db_xref="HGNC:21531" /translation="MLLRKRYRHRPCRLQFLLLLLMLGCVLMMVAMLHPPHHTLHQTV TAQASKHSPEARYRLDFGESQDWVLEAEDEGEEYSPLEGLPPFISLREDQLLVAVALP QARRNQSQGRRGGSYRLIKQPRRQDKEAPKRDWGADEDGEVSEEEELTPFSLDPRGLQ EALSARIPLQRALPEVRHPLCLQQHPQDSLPTASVILCFHDEAWSTLLRTVHSILDTV PRAFLKEIILVDDLSQQGQLKSALSEYVARLEGVKLLRSNKRLGAIRARMLGATRATG DVLVFMDAHCECHPGWLEPLLSRIAGDRSRVVSPVIDVIDWKTFQYYPSKDLQRGVLD WKLDFHWEPLPEHVRKALQSPISPIRSPVVPGEVVAMDRHYFQNTGAYDSLMSLRGGE NLELSFKAWLCGGSVEILPCSRVGHIYQNQDSHSPLDQETTLRNRVRIAETWLGSFKE TFYKHSPEAFSLSKAEKPDCMERLQLQRRLGCRTFHWFLANVYPELYPSEPRPSFSGK LHNTGLGLCADCQAEGDILGCPMVLAPCSDSRQQQYLQHTSRKEIHFGSPQHLCFAVR QEQVILQNCTEEGLAIHQQHWDFQENGMIVHILSGKCMEAVVQENNKDLYLRPCDGKA RQQWRFDQINAVDER" misc_feature 692..2443 /note="GALNTL2 coding region" misc_difference 1336..1336 /gene="GALNTL2" /gene_synonym=GALNT13 /gene_synonym=GALNT15 /gene_synonym=GALNT7 /note="'A' in cDNA is 'G' in the human genome; no amino acid change. The chimpanzee genome agrees with the human genomic sequence and not the cDNA." misc_difference 1820..1820 /gene="GALNTL2" /gene_synonym=GALNT13 /gene_synonym=GALNT15 /gene_synonym=GALNT7 /note="'A' in cDNA is 'G' in the human genome; amino acid difference: 'T' in cDNA, 'A' in the human genome. The chimpanzee genome agrees with the human genomic sequence and not the cDNA." ORIGIN 1 CTTTCCTGCG TTATCCCCTG ATTCTGTGGA TAACCGTATT ACCGCCTTTG AGTGAGCTGA 61 TACCGCTCGC CGCAGCCGAA CGACCGAGCG CAGCGAGTCA GTGAGCGAGG AAGCGGAAGA 121 GCGCCCAATA CGCAAACCGC CTCTCCCCGC GCGTTGGCCG ATTCATTAAT GCAGCTGGCA 181 CGACAGGTTT CCCGACTGGA AAGCGGGCAG TGAGCGCAAC GCAATTAATA CGCGTACCGC 241 TAGCCAGGAA GAGTTTGTAG AAACGCAAAA AGGCCATCCG TCAGGATGGC CTTCTGCTTA 301 GTTTGATGCC TGGCAGTTTA TGGCGGGCGT CCTGCCCGCC ACCCTCCGGG CCGTTGCTTC 361 ACAACGTTCA AATCCGCTCC CGGCGGATTT GTCCTACTCA GGAGAGCGTT CACCGACAAA 421 CAACAGATAA AACGAAAGGC CCAGTCTTCC GACTGAGCCT TTCGTTTTAT TTGATGCCTG 481 GCAGTTCCCT ACTCTCGCGT TAACGCTAGC ATGGATGTTT TCCCAGTCAC GACGTTGTAA 541 AACGACGGCC AGTCTTAAGC TCGGGCCCCA AATAATGATT TTATTTTGAC TGATAGTGAC 601 CTGTTCGTTG CAACACATTG ATGAGCAATG CTTTTTTATA ATGCCAACTT TGTACAAAAA 661 AGCAGGCTct gaaaacttgt actttcaagg caggtaccgc ctggactttg gggaatccca 721 ggattgggta ctggaagctg aggatgaggg tgaagagtac agccctctgg agggcctgcc 781 accctttatc tcactgcggg aggatcagct gctggtggcc gtggccttac cccaggccag 841 aaggaaccag agccagggca ggagaggtgg gagctaccgc ctcatcaagc agccaaggag 901 gcaggataag gaagccccaa agagggactg gggggctgat gaggacgggg aggtgtctga 961 agaagaggag ttgaccccgt tcagcctgga cccacgtggc ctccaggagg cactcagtgc 1021 ccgcatcccc ctccagaggg ctctgcccga ggtgcggcac ccactgtgtc tgcagcagca 1081 ccctcaggac agcctgccca cagccagcgt catcctctgt ttccatgatg aggcctggtc 1141 cactctcctg cggactgtac acagcatcct cgacacagtg cccagggcct tcctgaagga 1201 gatcatcctc gtggacgacc tcagccagca aggacaactc aagtctgctc tcagcgaata 1261 tgtggccagg ctggaggggg tgaagttact caggagcaac aagaggctgg gtgccatcag 1321 ggcccggatg ctgggagcca ccagagccac cggggatgtg ctcgtcttca tggatgccca 1381 ctgcgagtgc cacccaggct ggctggagcc cctcctcagc agaatagctg gtgacaggag 1441 ccgagtggta tctccggtga tagatgtgat tgactggaag actttccagt attacccctc 1501 aaaggacctg cagcgtgggg tgttggactg gaagctggat ttccactggg aacctttgcc 1561 agagcatgtg aggaaggccc tccagtcccc cataagcccc atcaggagcc ctgtggtgcc 1621 cggagaggtg gtggccatgg acagacatta cttccaaaac actggagcgt atgactctct 1681 tatgtcgctg cgaggtggtg aaaacctcga actgtctttc aaggcctggc tctgtggtgg 1741 ctctgttgaa atccttccct gctctcgggt aggacacatc taccaaaatc aggattccca 1801 ttcccccctc gaccaggaga ccaccctgag gaacagggtt cgcattgctg agacctggct 1861 ggggtcattc aaagaaacct tctacaagca tagcccagag gccttctcct tgagcaaggc 1921 tgagaagcca gactgcatgg aacgcttgca gctgcaaagg agactgggtt gtcggacatt 1981 ccactggttt ctggctaatg tctaccctga gctgtaccca tctgaaccca ggcccagttt 2041 ctctggaaag ctccacaaca ctggacttgg gctctgtgca gactgccagg cagaagggga 2101 catcctgggc tgtcccatgg tgttggctcc ttgcagtgac agccggcagc aacagtacct 2161 gcagcacacc agcaggaagg agattcactt tggcagccca cagcacctgt gctttgctgt 2221 caggcaggag caggtgattc ttcagaactg cacggaggaa ggcctggcca tccaccagca 2281 gcactgggac ttccaggaga atgggatgat tgtccacatt ctttctggga aatgcatgga 2341 agctgtggtg caagaaaaca ataaagattt gtacctgcgt ccgtgtgatg gaaaagcccg 2401 ccagcagtgg cgttttgacc agatcaatgc tgtggatgaa cgaTAGGACC CAGCTTTCTT 2461 GTACAAAGTT GGCATTATAA GAAAGCATTG CTTATCAATT TGTTGCAACG AACAGGTCAC 2521 TATCAGTCAA AATAAAATCA TTATTTGCCA TCCAGCTGAT ATCCCCTATA GTGAGTCGTA 2581 TTACATGGTC ATAGCTGTTT CCTGGCAGCT CTGGCCCGTG TCTCAAAATC TCTGATGTTA 2641 CATTGCACAA GATAAAATAA TATCATCATG AACAATAAAA CTGTCTGCTT ACATAAACAG 2701 TAATACAAGG GGTGTTATGA GCCATATTCA ACGGGAAACG TCGAGGCCGC GATTAAATTC 2761 CAACATGGAT GCTGATTTAT ATGGGTATAA ATGGGCTCGC GATAATGTCG GGCAATCAGG 2821 TGCGACAATC TATCGCTTGT ATGGGAAGCC CGATGCGCCA GAGTTGTTTC TGAAACATGG 2881 CAAAGGTAGC GTTGCCAATG ATGTTACAGA TGAGATGGTC AGACTAAACT GGCTGACGGA 2941 ATTTATGCCT CTTCCGACCA TCAAGCATTT TATCCGTACT CCTGATGATG CATGGTTACT 3001 CACCACTGCG ATCCCCGGAA AAACAGCATT CCAGGTATTA GAAGAATATC CTGATTCAGG 3061 TGAAAATATT GTTGATGCGC TGGCAGTGTT CCTGCGCCGG TTGCATTCGA TTCCTGTTTG 3121 TAATTGTCCT TTTAACAGCG ATCGCGTATT TCGTCTCGCT CAGGCGCAAT CACGAATGAA 3181 TAACGGTTTG GTTGATGCGA GTGATTTTGA TGACGAGCGT AATGGCTGGC CTGTTGAACA 3241 AGTCTGGAAA GAAATGCATA AACTTTTGCC ATTCTCACCG GATTCAGTCG TCACTCATGG 3301 TGATTTCTCA CTTGATAACC TTATTTTTGA CGAGGGGAAA TTAATAGGTT GTATTGATGT 3361 TGGACGAGTC GGAATCGCAG ACCGATACCA GGATCTTGCC ATCCTATGGA ACTGCCTCGG 3421 TGAGTTTTCT CCTTCATTAC AGAAACGGCT TTTTCAAAAA TATGGTATTG ATAATCCTGA 3481 TATGAATAAA TTGCAGTTTC ATTTGATGCT CGATGAGTTT TTCTAATCAG AATTGGTTAA 3541 TTGGTTGTAA CACTGGCAGA GCATTACGCT GACTTGACGG GACGGCGCAA GCTCATGACC 3601 AAAATCCCTT AACGTGAGTT ACGCGTCGTT CCACTGAGCG TCAGACCCCG TAGAAAAGAT 3661 CAAAGGATCT TCTTGAGATC CTTTTTTTCT GCGCGTAATC TGCTGCTTGC AAACAAAAAA 3721 ACCACCGCTA CCAGCGGTGG TTTGTTTGCC GGATCAAGAG CTACCAACTC TTTTTCCGAA 3781 GGTAACTGGC TTCAGCAGAG CGCAGATACC AAATACTGTT CTTCTAGTGT AGCCGTAGTT 3841 AGGCCACCAC TTCAAGAACT CTGTAGCACC GCCTACATAC CTCGCTCTGC TAATCCTGTT 3901 ACCAGTGGCT GCTGCCAGTG GCGATAAGTC GTGTCTTACC GGGTTGGACT CAAGACGATA 3961 GTTACCGGAT AAGGCGCAGC GGTCGGGCTG AACGGGGGGT TCGTGCACAC AGCCCAGCTT 4021 GGAGCGAACG ACCTACACCG AACTGAGATA CCTACAGCGT GAGCTATGAG AAAGCGCCAC 4081 GCTTCCCGAA GGGAGAAAGG CGGACAGGTA TCCGGTAAGC GGCAGGGTCG GAACAGGAGA 4141 GCGCACGAGG GAGCTTCCAG GGGGAAACGC CTGGTATCTT TATAGTCCTG TCGGGTTTCG 4201 CCACCTCTGA CTTGAGCGTC GATTTTTGTG ATGCTCGTCA GGGGGGCGGA GCCTATGGAA 4261 AAACGCCAGC AACGCGGCCT TTTTACGGTT CCTGGCCTTT TGCTGGCCTT TTGCTCACAT 4321 GTT //