LOCUS pDONR™/Zeo DISCLAIMER Certain terms are trademarks or registered trademarks of Invitrogen Corporation. See "Intellectual Property" in the Help file for more information. FEATURES Location/Qualifiers misc_feature complement(268..295) /note="rrnB T2 transcription termination sequence (c)" misc_feature complement(427..470) /note="rrnB T1 transcription termination sequence (c)" primer_bind 537..552 /note="M13 Forward (-20) priming site" misc_recomb 570..668 /label=attL1 /note="attL1" misc_recomb complement(2294..2390) /label=attL2 /note="attL2 (c)" misc_signal complement(2405..2424) /note="T7 Promoter/priming site (c)" primer_bind 2432..2448 /note="M13 Reverse priming site" gene 2561..3370 /note="Kanamycin resistance gene" rep_origin 3491..4164 /note="pUC origin" vector join(2302..4167,1..651) /source="pDONR%99221" /type="Donor Vector" misc_feature 669..691 /note="TEV site" source 692..2287 /organism="Homo sapiens" /mol_type="mRNA" /db_xref="taxon:9606" /clone="MGC:41784 IMAGE:5261236" /tissue_type="Brain, hippocampus" /clone_lib="NIH_MGC_95" /lab_host="DH10B" /note="Vector: pBluescriptR" gene 692..2287 /gene="GALNT4" /gene_synonym=GALNAC-T4 /gene_synonym=GalNAcT4 /db_xref="GeneID:8693" /db_xref="HGNC:4126" /db_xref="MIM:603565" CDS 692..2287 /dnas_title="UDP-N-acetyl-alpha-D-galactosamine:polypeptid e N-acetylgalactosaminyltransferase 4 (GalNAc-T4)" /gene="GALNT4" /gene_synonym=GALNAC-T4 /gene_synonym=GalNAcT4 /codon_start=1 /product="UDP-N-acetyl-alpha-D-galactosamine:polypeptide N-acetylgalactosaminyltransferase 4 (GalNAc-T4)" /protein_id="AAH36390.1" /db_xref="GI:22137798" /db_xref="GeneID:8693" /db_xref="HGNC:4126" /db_xref="MIM:603565" /translation="MAVRWTWAGKSCLLLAFLTVAYIFVELLVSTFHASAGAGRAREL GSRRLSGLQKNTEDLSRPLYKKPPADSRALGEWGKASKLQLNEDELKQQEELIERYAI NIYLSDRISLHRHIEDKRMYECKSQKFNYRTLPTTSVIIAFYNEAWSTLLRTIHSVLE TSPAVLLKEIILVDDLSDRVYLKTQLETYISNLDRVRLIRTNKREGLVRARLIGATFA TGDVLTFLDCHCECNSGWLEPLLERIGRDETAVVCPVIDTIDWNTFEFYMQIGEPMIG GFDWRLTFQWHSVPKQERDRRISRIDPIRSPTMAGGLFAVSKKYFQYLGTYDTGMEVW GGENLELSFRVWQCGGKLEIHPCSHVGHVFPKRAPYARPNFLQNTARAAEVWMDEYKE HFYNRNPPARKEAYGDISERKLLRERLRCKSFDWYLKNVFPNLHVPEDRPGWHGAIRS RGISSECLDYNSPDNNPTGANLSLFGCHGQGGNQFFEYTSNKEIRFNSVTELCAEVPE QKNYVGMQNCPKDGFPVPANIIWHFKEDGTIFHPHSGLCLSAYRTPEGRPDVQMRTCD ALDKNQIWSFEK" misc_difference 705..705 /gene="GALNT4" /gene_synonym=GALNAC-T4 /gene_synonym=GalNAcT4 /note="'G' in cDNA is 'A' in the human genome; amino acid difference: 'G' in cDNA, 'D' in the human genome. The chimpanzee genome agrees with the human genomic sequence and not the cDNA." misc_feature 692..2287 /note="GALNT4 coding region" ORIGIN 1 CTTTCCTGCG TTATCCCCTG ATTCTGTGGA TAACCGTATT ACCGCCTTTG AGTGAGCTGA 61 TACCGCTCGC CGCAGCCGAA CGACCGAGCG CAGCGAGTCA GTGAGCGAGG AAGCGGAAGA 121 GCGCCCAATA CGCAAACCGC CTCTCCCCGC GCGTTGGCCG ATTCATTAAT GCAGCTGGCA 181 CGACAGGTTT CCCGACTGGA AAGCGGGCAG TGAGCGCAAC GCAATTAATA CGCGTACCGC 241 TAGCCAGGAA GAGTTTGTAG AAACGCAAAA AGGCCATCCG TCAGGATGGC CTTCTGCTTA 301 GTTTGATGCC TGGCAGTTTA TGGCGGGCGT CCTGCCCGCC ACCCTCCGGG CCGTTGCTTC 361 ACAACGTTCA AATCCGCTCC CGGCGGATTT GTCCTACTCA GGAGAGCGTT CACCGACAAA 421 CAACAGATAA AACGAAAGGC CCAGTCTTCC GACTGAGCCT TTCGTTTTAT TTGATGCCTG 481 GCAGTTCCCT ACTCTCGCGT TAACGCTAGC ATGGATGTTT TCCCAGTCAC GACGTTGTAA 541 AACGACGGCC AGTCTTAAGC TCGGGCCCCA AATAATGATT TTATTTTGAC TGATAGTGAC 601 CTGTTCGTTG CAACACATTG ATGAGCAATG CTTTTTTATA ATGCCAACTT TGTACAAAAA 661 AGCAGGCTct gaaaacttgt actttcaagg cagaaggctc tcaggcctcc agaaaaatac 721 ggaggatttg tctcgaccgc tttataagaa gccccctgca gattcccgtg cacttgggga 781 gtgggggaaa gccagcaaac tccagctcaa cgaggatgaa ctgaagcagc aagaagaact 841 cattgagaga tacgccatca atatttacct cagtgacagg atttccctgc atcgacacat 901 agaggataaa agaatgtatg agtgtaagtc ccagaagttc aactatagga cacttcctac 961 cacctctgtt atcattgctt tctataacga agcctggtcg actttgctcc gtaccattca 1021 cagtgtttta gaaacttctc ctgcagttct tttgaaagag atcatcttgg tggatgactt 1081 gagtgacaga gtttatttga agacacaact tgaaacttac atcagcaatc ttgatagagt 1141 acgcttgatt aggaccaata agcgagaggg gctggttagg gcccgtctga ttggggccac 1201 tttcgccact ggggacgtcc tcactttcct ggattgtcac tgtgagtgta attccggttg 1261 gctggaaccg cttttggaaa ggattgggag agatgaaaca gcagttgtgt gtcctgttat 1321 agacacaatt gattggaata cttttgaatt ctatatgcag ataggggagc ccatgattgg 1381 tgggtttgac tggcgtttaa catttcagtg gcattctgtc cccaaacagg aaagggacag 1441 gcggatatca agaattgacc ccatcagatc acctaccatg gctggaggac tgtttgctgt 1501 cagcaagaaa tattttcagt accttggaac gtatgacaca ggaatggaag tgtggggagg 1561 tgaaaacctt gagctgtctt ttagggtgtg gcagtgtggt ggcaaattgg agatccaccc 1621 gtgttcccac gtgggccatg tgttccccaa gcgggcacca tatgctcgcc ccaatttcct 1681 acagaatact gctcgggcag cagaagtttg gatggatgaa tacaaagagc acttctacaa 1741 tagaaaccct ccagcaagaa aagaagctta tggtgatatt tctgaaagaa aattactacg 1801 agagcggttg agatgcaaga gctttgactg gtatttgaaa aacgtttttc ctaatttaca 1861 tgttccagag gatagaccag gctggcatgg ggctattcgc agtagaggga tctcgtctga 1921 atgtttagat tataattctc ctgacaacaa ccccacaggt gctaaccttt cactgtttgg 1981 atgccatggt caaggaggca atcaattctt tgaatatact tcaaacaaag aaataaggtt 2041 taattctgtg acagagttat gtgcagaggt acctgagcaa aaaaattatg tgggaatgca 2101 aaattgtccc aaagatgggt tccctgtacc agcaaacatt atttggcatt ttaaagaaga 2161 tggaactatt tttcacccac actcaggact gtgtcttagt gcttatcgga caccggaggg 2221 ccgacctgat gtacaaatga gaacttgtga tgctctagat aaaaatcaaa tttggagttt 2281 tgagaaaTAG GACCCAGCTT TCTTGTACAA AGTTGGCATT ATAAGAAAGC ATTGCTTATC 2341 AATTTGTTGC AACGAACAGG TCACTATCAG TCAAAATAAA ATCATTATTT GCCATCCAGC 2401 TGATATCCCC TATAGTGAGT CGTATTACAT GGTCATAGCT GTTTCCTGGC AGCTCTGGCC 2461 CGTGTCTCAA AATCTCTGAT GTTACATTGC ACAAGATAAA ATAATATCAT CATGAACAAT 2521 AAAACTGTCT GCTTACATAA ACAGTAATAC AAGGGGTGTT ATGAGCCATA TTCAACGGGA 2581 AACGTCGAGG CCGCGATTAA ATTCCAACAT GGATGCTGAT TTATATGGGT ATAAATGGGC 2641 TCGCGATAAT GTCGGGCAAT CAGGTGCGAC AATCTATCGC TTGTATGGGA AGCCCGATGC 2701 GCCAGAGTTG TTTCTGAAAC ATGGCAAAGG TAGCGTTGCC AATGATGTTA CAGATGAGAT 2761 GGTCAGACTA AACTGGCTGA CGGAATTTAT GCCTCTTCCG ACCATCAAGC ATTTTATCCG 2821 TACTCCTGAT GATGCATGGT TACTCACCAC TGCGATCCCC GGAAAAACAG CATTCCAGGT 2881 ATTAGAAGAA TATCCTGATT CAGGTGAAAA TATTGTTGAT GCGCTGGCAG TGTTCCTGCG 2941 CCGGTTGCAT TCGATTCCTG TTTGTAATTG TCCTTTTAAC AGCGATCGCG TATTTCGTCT 3001 CGCTCAGGCG CAATCACGAA TGAATAACGG TTTGGTTGAT GCGAGTGATT TTGATGACGA 3061 GCGTAATGGC TGGCCTGTTG AACAAGTCTG GAAAGAAATG CATAAACTTT TGCCATTCTC 3121 ACCGGATTCA GTCGTCACTC ATGGTGATTT CTCACTTGAT AACCTTATTT TTGACGAGGG 3181 GAAATTAATA GGTTGTATTG ATGTTGGACG AGTCGGAATC GCAGACCGAT ACCAGGATCT 3241 TGCCATCCTA TGGAACTGCC TCGGTGAGTT TTCTCCTTCA TTACAGAAAC GGCTTTTTCA 3301 AAAATATGGT ATTGATAATC CTGATATGAA TAAATTGCAG TTTCATTTGA TGCTCGATGA 3361 GTTTTTCTAA TCAGAATTGG TTAATTGGTT GTAACACTGG CAGAGCATTA CGCTGACTTG 3421 ACGGGACGGC GCAAGCTCAT GACCAAAATC CCTTAACGTG AGTTACGCGT CGTTCCACTG 3481 AGCGTCAGAC CCCGTAGAAA AGATCAAAGG ATCTTCTTGA GATCCTTTTT TTCTGCGCGT 3541 AATCTGCTGC TTGCAAACAA AAAAACCACC GCTACCAGCG GTGGTTTGTT TGCCGGATCA 3601 AGAGCTACCA ACTCTTTTTC CGAAGGTAAC TGGCTTCAGC AGAGCGCAGA TACCAAATAC 3661 TGTTCTTCTA GTGTAGCCGT AGTTAGGCCA CCACTTCAAG AACTCTGTAG CACCGCCTAC 3721 ATACCTCGCT CTGCTAATCC TGTTACCAGT GGCTGCTGCC AGTGGCGATA AGTCGTGTCT 3781 TACCGGGTTG GACTCAAGAC GATAGTTACC GGATAAGGCG CAGCGGTCGG GCTGAACGGG 3841 GGGTTCGTGC ACACAGCCCA GCTTGGAGCG AACGACCTAC ACCGAACTGA GATACCTACA 3901 GCGTGAGCTA TGAGAAAGCG CCACGCTTCC CGAAGGGAGA AAGGCGGACA GGTATCCGGT 3961 AAGCGGCAGG GTCGGAACAG GAGAGCGCAC GAGGGAGCTT CCAGGGGGAA ACGCCTGGTA 4021 TCTTTATAGT CCTGTCGGGT TTCGCCACCT CTGACTTGAG CGTCGATTTT TGTGATGCTC 4081 GTCAGGGGGG CGGAGCCTAT GGAAAAACGC CAGCAACGCG GCCTTTTTAC GGTTCCTGGC 4141 CTTTTGCTGG CCTTTTGCTC ACATGTT //