LOCUS MGAT1-pGEn1-DEST 5830 bp DNA circular 22-JAN-2013 FEATURES Location/Qualifiers CDS 129..1108 /dnas_title="AmpR" /label=AmpR /vntifkey="4" rep_origin 1137..1804 /dnas_title="Col E1 origin" /label=Col E1 origin /vntifkey="33" misc_feature 1998..2127 /note="5'ITR" misc_feature 2208..2790 /note="CMV Promoter" misc_feature 2828..2960 /note="Artificial Intron" misc_feature 2977..3054 /note="TCM Sig Seq" misc_recomb complement(3114..3142) /label=attB1 /note="attB1 site" /note="recognized as attB1" misc_feature 3055..3078 /note="8xHis Tag" misc_feature 3085..3108 /note="StrepTag" misc_feature 4458..4999 /note="WPRE" misc_recomb 4420..4442 /label=attB2 /note="attB2 site" /note="recognized as attB2" misc_feature complement(5006..5220) /note="BGH pA" misc_feature complement(5308..5437) /note="3'-ITR" misc_feature 3143..3165 /note="TEV site" source 3166..4413 /dnas_title="MGAT1-pGEn1-DEST" /organism="Homo sapiens" /mol_type="mRNA" /db_xref="taxon:9606" /clone="MGC:2304 IMAGE:3544942" /tissue_type="Kidney, renal cell adenocarcinoma" /clone_lib="NIH_MGC_14" /lab_host="DH10B-R" /note="Vector: pOTB7" gene 3166..4413 /dnas_title="MGAT1" /gene="MGAT1" /gene_synonym="GLCNAC-TI" /gene_synonym="GLCT1" /gene_synonym="GNT-1" /gene_synonym="GNT-I" /db_xref="GeneID:4245" /db_xref="MIM:160995" CDS 3166..4413 /dnas_title="MGAT1 protein" /gene="MGAT1" /gene_synonym="GLCNAC-TI" /gene_synonym="GLCT1" /gene_synonym="GNT-1" /gene_synonym="GNT-I" /codon_start=1 /product="MGAT1 protein" /protein_id="AAH03575.1" /db_xref="GI:13097753" /db_xref="GeneID:4245" /db_xref="MIM:160995" /translation="MLKKQSAGLVLWGAILFVAWNALLLLFFWTRPAPGRPPSVSALD GDPASLTREVIRLAQDAEVELERQRGLLQQIGDALSSQRGRVPTAAPPAQPRVPVTPA PAVIPILVIACDRSTVRRCLDKLLHYRPSAELFPIIVSQDCGHEETAQAIASYGSAVT HIRQPDLSSIAVPPDHRKFQGYYKIARHYRWALGQVFRQFRFPAAVVVEDDLEVAPDF FEYFRATYPLLKADPSLWCVSAWNDNGKEQMVDASRPELLYRTDFFPGLGWLLLAELW AELEPKWPKAFWDDWMRRPEQRQGRACIRPEISRTMTFGRKGVSHGQFFDQHLKFIKL NQQFVHFTQLDLSYLQREAYDRDFLARVYGAPQLQVEKVRTNDRKELGEVRVQYTGRD SFKAFAKALGVMDDLKSGVPRAGYRGIVTFQFRGRRVHLAPPPTWEGYDPSWN" misc_feature 3166..4413 /note="MGAT1 coding region" misc_difference 4382..4382 /dnas_title="MGAT1" /gene="MGAT1" /gene_synonym="GLCNAC-TI" /gene_synonym="GLCT1" /gene_synonym="GNT-1" /gene_synonym="GNT-I" /note="'C' in cDNA is 'T' in the human genome; amino acid difference: 'P' in cDNA, 'L' in the human genome. The chimpanzee genome agrees with the cDNA sequence, suggesting that this difference is unlikely to be due to an artifact." vector join(4428..5830,1..3132) /source="pGEn1-DEST" /type="Destination Vector" clone 3133..4427 /source="MGAT1-Nterm-TEVfusion-pDONR221" /type="Entry Clone" ORIGIN 1 GTGGCACTTT TCGGGGAAAT GTGCGCGGAA CCCCTATTTG TTTATTTTTC TAAATACATT 61 CAAATATGTA TCCGCTCATG AGACAATAAC CCTGATAAAT GCTTCAATAA TATTGAAAAA 121 GGAAGAGTAT GAGTATTCAA CATTTCCGTG TCGCCCTTAT TCCCTTTTTT GCGGCATTTT 181 GCCTTCCTGT TTTTGCTCAC CCAGAAACGC TGGTGAAAGT AAAAGATGCT GAAGATCAGT 241 TGGGTGCACG AGTGGGTTAC ATCGAACTGG ATCTCAACAG CGGTAAGATC CTTGAGAGTT 301 TTCGCCCCGA AGAACGTTTT CCAATGATGA GCACTTTTAA AGTTCTGCTA TGTGGCGCGG 361 TATTATCCCG TATTGACGCC GGGCAAGAGC AACTCGGTCG CCGCATACAC TATTCTCAGA 421 ATGACTTGGT TGAGTACTCA CCAGTCACAG AAAAGCATCT TACGGATGGC ATGACAGTAA 481 GAGAATTATG CAGTGCTGCC ATAACCATGA GTGATAACAC TGCGGCCAAC TTACTTCTGA 541 CAACGATCGG AGGACCGAAG GAGCTAACCG CTTTTTTGCA CAACATGGGG GATCATGTAA 601 CTCGCCTTGA TCGTTGGGAA CCGGAGCTGA ATGAAGCCAT ACCAAACGAC GAGCGTGACA 661 CCACGATGCC TGTAGCAATG GCAACAACGT TGCGCAAACT ATTAACTGGC GAACTACTTA 721 CTCTAGCTTC CCGGCAACAA TTAATAGACT GGATGGAGGC GGATAAAGTT GCAGGACCAC 781 TTCTGCGCTC GGCCCTTCCG GCTGGCTGGT TTATTGCTGA TAAATCTGGA GCCGGTGAGC 841 GTGGTTCTCG CGGTATCATT GCAGCACTGG GGCCAGATGG TAAGCCCTCC CGTATCGTAG 901 TTATCTACAC GACGGGGAGT CAGGCAACTA TGGATGAACG AAATAGACAG ATCGCTGAGA 961 TAGGTGCCTC ACTGATTAAG CATTGGTAAC TGTCAGACCA AGTTTACTCA TATATACTTT 1021 AGATTGATTT AAAACTTCAT TTTTAATTTA AAAGGATCTA GGTGAAGATC CTTTTTGATA 1081 ATCTCATGAC CAAAATCCCT TAACGTGAGT TTTCGTTCCA CTGAGCGTCA GACCCCGTAG 1141 AAAAGATCAA AGGATCTTCT TGAGATCCTT TTTTTCTGCG CGTAATCTGC TGCTTGCAAA 1201 CAAAAAAACC ACCGCTACCA GCGGTGGTTT GTTTGCCGGA TCAAGAGCTA CCAACTCTTT 1261 TTCCGAAGGT AACTGGCTTC AGCAGAGCGC AGATACCAAA TACTGTTCTT CTAGTGTAGC 1321 CGTAGTTAGG CCACCACTTC AAGAACTCTG TAGCACCGCC TACATACCTC GCTCTGCTAA 1381 TCCTGTTACC AGTGGCTGCT GCCAGTGGCG ATAAGTCGTG TCTTACCGGG TTGGACTCAA 1441 GACGATAGTT ACCGGATAAG GCGCAGCGGT CGGGCTGAAC GGGGGGTTCG TGCACACAGC 1501 CCAGCTTGGA GCGAACGACC TACACCGAAC TGAGATACCT ACAGCGTGAG CTATGAGAAA 1561 GCGCCACGCT TCCCGAAGGG AGAAAGGCGG ACAGGTATCC GGTAAGCGGC AGGGTCGGAA 1621 CAGGAGAGCG CACGAGGGAG CTTCCAGGGG GAAACGCCTG GTATCTTTAT AGTCCTGTCG 1681 GGTTTCGCCA CCTCTGACTT GAGCGTCGAT TTTTGTGATG CTCGTCAGGG GGGCGGAGCC 1741 TATGGAAAAA CGCCAGCAAC GCGGCCTTTT TACGGTTCCT GGCCTTTTGC TGGCCTTTTG 1801 CTCATTAGGC ACCCCAGGCT TTACCCGAAC GACCGAGCGC AGCGAGTCAG TGAGCGAGGA 1861 AGCGGAGAGC GCCCAATACG CAAGGAAACA GCTATGACCA TGTTAATGCA GCTGGCACGA 1921 CAGGTTTCCC GACTGGAAAG CGGGCAGTGA GCGGAAGGCC CATGAGGCCA GTTAATTAAG 1981 AGGTACCTTA ATTAAGGCTG CGCGCTCGCT CGCTCACTGA GGCCGCCCGG GCAAAGCCCG 2041 GGCGTCGGGC GACCTTTGGT CGCCCGGCCT CAGTGAGCGA GCGAGCGCGC AGAGAGGGAG 2101 TGGCCAACTC CATCACTAGG GGTTCCTTGT AGTTAATGAT TAACCCGCCA TGCTACTTAT 2161 CTACGTAGCC ATGCTCTAGG AAGATCGCAA TTCGCCCTTA AGCTAGCTAG TTATTAATAG 2221 TAATCAATTA CGGGGTCATT AGTTCATAGC CCATATATGG AGTTCCGCGT TACATAACTT 2281 ACGGTAAATG GCCCGCCTGG CTGACCGCCC AACGACCCCC GCCCATTGAC GTCAATAATG 2341 ACGTATGTTC CCATAGTAAC GCCAATAGGG ACTTTCCATT GACGTCAATG GGTGGAGTAT 2401 TTACGGTAAA CTGCCCACTT GGCAGTACAT CAAGTGTATC ATATGCCAAG TACGCCCCCT 2461 ATTGACGTCA ATGACGGTAA ATGGCCCGCC TGGCATTATG CCCAGTACAT GACCTTATGG 2521 GACTTTCCTA CTTGGCAGTA CATCTACGTA TTAGTCATCG CTATTACCAT GGTGATGCGG 2581 TTTTGGCAGT ACATCAATGG GCGTGGATAG CGGTTTGACT CACGGGGATT TCCAAGTCTC 2641 CACCCCATTG ACGTCAATGG GAGTTTGTTT TGGCACCAAA ATCAACGGGA CTTTCCAAAA 2701 TGTCGTAACA ACTCCGCCCC ATTGACGCAA ATGGGCGGTA GGCGTGTACG GTGGGAGGTC 2761 TATATAAGCA GAGCTGGTTT AGTGAACCGT CAGATCCTGC AGAAGTTGGT CGTGAGGCAC 2821 TGGGCAGGTA AGTATCAAGG TTACAAGACA GGTTTAAGGA GACCAATAGA AACTGGGCTT 2881 GTCGAGACAG AGAAGACTCT TGCGTTTCTG ATAGGCACCT ATTGGTCTTA CTGACATCCA 2941 CTTTGCCTTT CTCTCCACAG GTGTCCAGCG GCCGCCATGA GACTGCTGAC AGCCCTGTTC 3001 GCCTACTTCA TCGTGGCCCT GATCCTGGCC TTCAGCGTGT CCGCCAAGAG CATGCACCAC 3061 CACCATCACC ATCATCACAG CGCCTGGTCC CACCCCCAGT TCGAGAAAGA ATTATCAACA 3121 AGTTTGTACA AAAAAGCAGG CTctgaaaac ttgtactttc aaggcacgcg cccagcacct 3181 ggcaggccac cctcagtcag cgctctcgat ggcgaccccg ccagcctcac ccgggaagtg 3241 attcgcctgg cccaagacgc cgaggtggag ctggagcggc agcgtgggct gctgcagcag 3301 atcggggatg ccctgtcgag ccagcggggg agggtgccca ccgcggcccc tcccgcccag 3361 ccgcgtgtgc ctgtgacccc cgcgccggcg gtgattccca tcctggtcat cgcctgtgac 3421 cgcagcactg ttcggcgctg cctggacaag ctgctgcatt atcggccctc ggctgagctc 3481 ttccccatca tcgttagcca ggactgcggg cacgaggaga cggcccaggc catcgcctcc 3541 tacggcagcg cggtcacgca catccggcag cccgacctga gcagcattgc ggtgccgccg 3601 gaccaccgca agttccaggg ctactacaag atcgcgcgcc actaccgctg ggcgctgggc 3661 caggtcttcc ggcagtttcg cttccccgcg gccgtggtgg tggaggatga cctggaggtg 3721 gccccggact tcttcgagta ctttcgggcc acctatccgc tgctgaaggc cgacccctcc 3781 ctgtggtgcg tctcggcctg gaatgacaac ggcaaggagc agatggtgga cgccagcagg 3841 cctgagctgc tctaccgcac cgactttttc cctggcctgg gctggctgct gttggccgag 3901 ctctgggctg agctggagcc caagtggcca aaggccttct gggacgactg gatgcggcgg 3961 ccggagcagc ggcaggggcg ggcctgcata cgccctgaga tctcaagaac gatgaccttt 4021 ggccgcaagg gtgtgagcca cgggcagttc tttgaccagc acctcaagtt tatcaagctg 4081 aaccagcagt ttgtgcactt cacccagctg gacctgtctt acctgcagcg ggaggcctat 4141 gaccgagatt tcctcgcccg cgtctacggt gctccccagc tgcaggtgga gaaagtgagg 4201 accaatgacc ggaaggagct gggggaggtg cgggtgcagt atacgggcag ggacagcttc 4261 aaggctttcg ccaaggctct gggtgtcatg gatgacctta agtcgggggt tccgagagct 4321 ggctaccggg gtattgtcac cttccagttc cggggccgcc gtgtccacct ggcgccccca 4381 ccgacgtggg agggctatga tcctagctgg aatTAGGACC CAGCTTTCTT GTACAAAGTG 4441 GTTGATAGCT TGGATCCAAT CAACCTCTGG ATTACAAAAT TTGTGAAAGA TTGACTGGTA 4501 TTCTTAACTA TGTTGCTCCT TTTACGCTAT GTGGATACGC TGCTTTAATG CCTTTGTATC 4561 ATGCTATTGC TTCCCGTATG GCTTTCATTT TCTCCTCCTT GTATAAATCC TGGTTGCTGT 4621 CTCTTTATGA GGAGTTGTGG CCCGTTGTCA GGCAACGTGG CGTGGTGTGC ACTGTGTTTG 4681 CTGACGCAAC CCCCACTGGT TGGGGCATTG CCACCACCTG TCAGCTCCTT TCCGGGACTT 4741 TCGCTTTCCC CCTCCCTATT GCCACGGCGG AACTCATCGC CGCCTGCCTT GCCCGCTGCT 4801 GGACAGGGGC TCGGCTGTTG GGCACTGACA ATTCCGTGGT GTTGTCGGGG AAGCTGACGT 4861 CCTTTCCATG GCTGCTCGCC TGTGTTGCCA CCTGGATTCT GCGCGGGACG TCCTTCTGCT 4921 ACGTCCCTTC GGCCCTCAAT CCAGCGGACC TTCCTTCCCG CGGCCTGCTG CCGGCTCTGC 4981 GGCCTCTTCC GCGTCTTCGA GATCTGCCTC GACTGTGCCT TCTAGTTGCC AGCCATCTGT 5041 TGTTTGCCCC TCCCCCGTGC CTTCCTTGAC CCTGGAAGGT GCCACTCCCA CTGTCCTTTC 5101 CTAATAAAAT GAGGAAATTG CATCGCATTG TCTGAGTAGG TGTCATTCTA TTCTGGGGGG 5161 TGGGGTGGGG CAGGACAGCA AGGGGGAGGA TTGGGAAGAC AATAGCAGGC ATGCTGGGGA 5221 CTCGAGTTAA GGGCGAATTG CCGATTAGGA TCTTCCTAGA GCATGGCTAC GTAGATAAGT 5281 AGCATGGCGG GTTAATCATT AACTACAAGG AACCCCTAGT GATGGAGTTG GCCACTCCCT 5341 CTCTGCGCGC TCGCTCGCTC ACTGAGGCCG GGCGACCAAA GGTCGCCCGA CGCCCGGGCT 5401 TTGCCCGGGC GGCCTCAGTG AGCGAGCGAG CGCGCAGCCT TAATTAAGAG CTCATGGCGC 5461 GCCTAGGCCT TGACGGCCTT CCGCCAATTC GCCCTATAGT GAGTCGTATT ACGTCGCGCT 5521 CACTGGCCGT CGTTTTACAA CGTCGTGACT GGGAAAACCC TGGCGTTACC CAACTTAATC 5581 GCCTTGCAGC ACATCCCCCT TTCGCCAGCT GGCGTAATAG CGAAGAGGCC CGCACCGAAA 5641 CGCCCTTCCC AACAGTTGCG CAGCCTGAAT GGCGAATGGG AGCGCCCTGT AGCGGCCACT 5701 CAACCCTATC TCGGTCTATT CTTTTGATTT ATAAGGGATT TTGCCGATTT CGGCCTATTG 5761 GTTAAAAAAT GAGCTGATTT AACAAAAATT TAACGCGAAT TTTAACAAAA TATTAACGCT 5821 TACAATTTAG //