LOCUS UGT8-pGEn1-DEST 5950 bp DNA circular 21-JAN-2013 FEATURES Location/Qualifiers CDS 129..1108 /dnas_title="AmpR" /label=AmpR /vntifkey="4" rep_origin 1137..1804 /dnas_title="Col E1 origin" /label=Col E1 origin /vntifkey="33" misc_feature 1998..2127 /note="5'ITR" misc_feature 2208..2790 /note="CMV Promoter" misc_feature 2828..2960 /note="Artificial Intron" misc_feature 2977..3054 /note="TCM Sig Seq" misc_recomb complement(3114..3142) /label=attB1 /note="attB1 site" /note="recognized as attB1" misc_feature 3055..3078 /note="8xHis Tag" misc_feature 3085..3108 /note="StrepTag" misc_feature 4578..5119 /note="WPRE" misc_recomb 4540..4562 /label=attB2 /note="attB2 site" /note="recognized as attB2" misc_feature complement(5126..5340) /note="BGH pA" misc_feature complement(5428..5557) /note="3'-ITR" misc_feature 3143..3165 /note="TEV site" source 3166..4533 /dnas_title="UGT8-pGEn1-DEST" /organism="Homo sapiens" /mol_type="mRNA" /db_xref="taxon:9606" /clone="MGC:104134 IMAGE:30915590" /tissue_type="Brain, PCR rescued clones" /clone_lib="NIH_MGC_272" /lab_host="DH10B" /note="Vector: pCR4 Topo TA with reversed insert" gene 3166..4533 /dnas_title="UGT8" /gene="UGT8" /db_xref="GeneID:7368" /db_xref="HGNC:12555" /db_xref="MIM:601291" CDS 3166..4533 /dnas_title="UGT8 protein" /gene="UGT8" /codon_start=1 /product="UGT8 protein" /protein_id="AAH75069.1" /db_xref="GI:50959968" /db_xref="GeneID:7368" /db_xref="HGNC:12555" /db_xref="MIM:601291" /translation="MKSYTPYFILLWSAVGIAKAAKIIIVPPIMFESHMYIFKTLASA LHERGHHTVFLLSEGRDIAPSNHYSLQRYPGIFNSTTSDAFLQSKMRNIFSGRLTAIE LFDILDHYTKNCDLMVGNHALIQGLKKEKFDLLLVDPNDMCGFVIAHLLGVKYAVFST GLWYPAEVGAPAPLAYVPEFNSLLTDRMNLLQRMKNTGVYLISRLGVSFLVLPKYERI MQKYNLLPEKSMYDLVHGSSLWMLCTDVALEFPRPTLPNVVYVGGILTKPASPLPEDL QRWVNGANEHGFVLVSFGAGVKYLSEDIANKLAGALGRLPQKVIWRFSGPKPKNLGNN TKLIEWLPQNDLLGHSKIKAFLSHGGLNSIFETMYHGVPVVGIPLFGDHYDTMTRVQA KGMGILLEWKTVTEKELYEALVKVINNPSYRQRAQKLSEIHKDQPGHPVNRTIYWIDY IIRHNGAHHLRAAVHQISFCQYFLLDIAFVLLLGAALLYFLLSWVTKFIYRKIKSLWS RNKHSTVNGHYHNGILNGKYKRNGHIKHEKKVK" misc_feature 3166..4533 /note="UGT8 coding region" misc_difference 3783..3783 /dnas_title="UGT8" /gene="UGT8" /note="'G' in cDNA is 'A' in the human genome; no amino acid change. The chimpanzee genome agrees with the cDNA sequence, suggesting that this difference is unlikely to be due to an artifact." misc_difference 4209..4209 /dnas_title="UGT8" /gene="UGT8" /note="'G' in cDNA is 'A' in the human genome; amino acid difference: 'M' in cDNA, 'I' in the human genome. The chimpanzee genome agrees with the cDNA sequence, suggesting that this difference is unlikely to be due to an artifact." vector join(4548..5950,1..3132) /source="pGEn1-DEST" /type="Destination Vector" clone 3133..4547 /source="UGT8-Nterm-TEVfusion-pDONR221" /type="Entry Clone" ORIGIN 1 GTGGCACTTT TCGGGGAAAT GTGCGCGGAA CCCCTATTTG TTTATTTTTC TAAATACATT 61 CAAATATGTA TCCGCTCATG AGACAATAAC CCTGATAAAT GCTTCAATAA TATTGAAAAA 121 GGAAGAGTAT GAGTATTCAA CATTTCCGTG TCGCCCTTAT TCCCTTTTTT GCGGCATTTT 181 GCCTTCCTGT TTTTGCTCAC CCAGAAACGC TGGTGAAAGT AAAAGATGCT GAAGATCAGT 241 TGGGTGCACG AGTGGGTTAC ATCGAACTGG ATCTCAACAG CGGTAAGATC CTTGAGAGTT 301 TTCGCCCCGA AGAACGTTTT CCAATGATGA GCACTTTTAA AGTTCTGCTA TGTGGCGCGG 361 TATTATCCCG TATTGACGCC GGGCAAGAGC AACTCGGTCG CCGCATACAC TATTCTCAGA 421 ATGACTTGGT TGAGTACTCA CCAGTCACAG AAAAGCATCT TACGGATGGC ATGACAGTAA 481 GAGAATTATG CAGTGCTGCC ATAACCATGA GTGATAACAC TGCGGCCAAC TTACTTCTGA 541 CAACGATCGG AGGACCGAAG GAGCTAACCG CTTTTTTGCA CAACATGGGG GATCATGTAA 601 CTCGCCTTGA TCGTTGGGAA CCGGAGCTGA ATGAAGCCAT ACCAAACGAC GAGCGTGACA 661 CCACGATGCC TGTAGCAATG GCAACAACGT TGCGCAAACT ATTAACTGGC GAACTACTTA 721 CTCTAGCTTC CCGGCAACAA TTAATAGACT GGATGGAGGC GGATAAAGTT GCAGGACCAC 781 TTCTGCGCTC GGCCCTTCCG GCTGGCTGGT TTATTGCTGA TAAATCTGGA GCCGGTGAGC 841 GTGGTTCTCG CGGTATCATT GCAGCACTGG GGCCAGATGG TAAGCCCTCC CGTATCGTAG 901 TTATCTACAC GACGGGGAGT CAGGCAACTA TGGATGAACG AAATAGACAG ATCGCTGAGA 961 TAGGTGCCTC ACTGATTAAG CATTGGTAAC TGTCAGACCA AGTTTACTCA TATATACTTT 1021 AGATTGATTT AAAACTTCAT TTTTAATTTA AAAGGATCTA GGTGAAGATC CTTTTTGATA 1081 ATCTCATGAC CAAAATCCCT TAACGTGAGT TTTCGTTCCA CTGAGCGTCA GACCCCGTAG 1141 AAAAGATCAA AGGATCTTCT TGAGATCCTT TTTTTCTGCG CGTAATCTGC TGCTTGCAAA 1201 CAAAAAAACC ACCGCTACCA GCGGTGGTTT GTTTGCCGGA TCAAGAGCTA CCAACTCTTT 1261 TTCCGAAGGT AACTGGCTTC AGCAGAGCGC AGATACCAAA TACTGTTCTT CTAGTGTAGC 1321 CGTAGTTAGG CCACCACTTC AAGAACTCTG TAGCACCGCC TACATACCTC GCTCTGCTAA 1381 TCCTGTTACC AGTGGCTGCT GCCAGTGGCG ATAAGTCGTG TCTTACCGGG TTGGACTCAA 1441 GACGATAGTT ACCGGATAAG GCGCAGCGGT CGGGCTGAAC GGGGGGTTCG TGCACACAGC 1501 CCAGCTTGGA GCGAACGACC TACACCGAAC TGAGATACCT ACAGCGTGAG CTATGAGAAA 1561 GCGCCACGCT TCCCGAAGGG AGAAAGGCGG ACAGGTATCC GGTAAGCGGC AGGGTCGGAA 1621 CAGGAGAGCG CACGAGGGAG CTTCCAGGGG GAAACGCCTG GTATCTTTAT AGTCCTGTCG 1681 GGTTTCGCCA CCTCTGACTT GAGCGTCGAT TTTTGTGATG CTCGTCAGGG GGGCGGAGCC 1741 TATGGAAAAA CGCCAGCAAC GCGGCCTTTT TACGGTTCCT GGCCTTTTGC TGGCCTTTTG 1801 CTCATTAGGC ACCCCAGGCT TTACCCGAAC GACCGAGCGC AGCGAGTCAG TGAGCGAGGA 1861 AGCGGAGAGC GCCCAATACG CAAGGAAACA GCTATGACCA TGTTAATGCA GCTGGCACGA 1921 CAGGTTTCCC GACTGGAAAG CGGGCAGTGA GCGGAAGGCC CATGAGGCCA GTTAATTAAG 1981 AGGTACCTTA ATTAAGGCTG CGCGCTCGCT CGCTCACTGA GGCCGCCCGG GCAAAGCCCG 2041 GGCGTCGGGC GACCTTTGGT CGCCCGGCCT CAGTGAGCGA GCGAGCGCGC AGAGAGGGAG 2101 TGGCCAACTC CATCACTAGG GGTTCCTTGT AGTTAATGAT TAACCCGCCA TGCTACTTAT 2161 CTACGTAGCC ATGCTCTAGG AAGATCGCAA TTCGCCCTTA AGCTAGCTAG TTATTAATAG 2221 TAATCAATTA CGGGGTCATT AGTTCATAGC CCATATATGG AGTTCCGCGT TACATAACTT 2281 ACGGTAAATG GCCCGCCTGG CTGACCGCCC AACGACCCCC GCCCATTGAC GTCAATAATG 2341 ACGTATGTTC CCATAGTAAC GCCAATAGGG ACTTTCCATT GACGTCAATG GGTGGAGTAT 2401 TTACGGTAAA CTGCCCACTT GGCAGTACAT CAAGTGTATC ATATGCCAAG TACGCCCCCT 2461 ATTGACGTCA ATGACGGTAA ATGGCCCGCC TGGCATTATG CCCAGTACAT GACCTTATGG 2521 GACTTTCCTA CTTGGCAGTA CATCTACGTA TTAGTCATCG CTATTACCAT GGTGATGCGG 2581 TTTTGGCAGT ACATCAATGG GCGTGGATAG CGGTTTGACT CACGGGGATT TCCAAGTCTC 2641 CACCCCATTG ACGTCAATGG GAGTTTGTTT TGGCACCAAA ATCAACGGGA CTTTCCAAAA 2701 TGTCGTAACA ACTCCGCCCC ATTGACGCAA ATGGGCGGTA GGCGTGTACG GTGGGAGGTC 2761 TATATAAGCA GAGCTGGTTT AGTGAACCGT CAGATCCTGC AGAAGTTGGT CGTGAGGCAC 2821 TGGGCAGGTA AGTATCAAGG TTACAAGACA GGTTTAAGGA GACCAATAGA AACTGGGCTT 2881 GTCGAGACAG AGAAGACTCT TGCGTTTCTG ATAGGCACCT ATTGGTCTTA CTGACATCCA 2941 CTTTGCCTTT CTCTCCACAG GTGTCCAGCG GCCGCCATGA GACTGCTGAC AGCCCTGTTC 3001 GCCTACTTCA TCGTGGCCCT GATCCTGGCC TTCAGCGTGT CCGCCAAGAG CATGCACCAC 3061 CACCATCACC ATCATCACAG CGCCTGGTCC CACCCCCAGT TCGAGAAAGA ATTATCAACA 3121 AGTTTGTACA AAAAAGCAGG CTctgaaaac ttgtactttc aaggcgccaa aatcatcatc 3181 gtgccgccaa ttatgtttga aagccatatg tacattttca agacgctagc ctcagccttg 3241 cacgagagag gccaccatac agtgttcctc ctctctgaag gcagagacat cgccccatct 3301 aatcattaca gcctccagcg ctacccaggg atctttaaca gtaccacctc agatgctttc 3361 ctacagtcca agatgcggaa tattttctct gggagattga cagcaatcga actgtttgac 3421 atactggatc actatactaa gaactgtgac ctgatggttg gcaaccatgc cctgatccag 3481 ggtctgaaga aagaaaaatt tgacctgctg ctggtggacc ctaatgatat gtgtggattt 3541 gtgatagctc atcttttagg ggttaaatat gctgtatttt caactggcct ttggtatcct 3601 gctgaagtgg gtgctcctgc tccattagca tacgtcccag agtttaactc actcctcaca 3661 gaccgcatga acttgctgca aaggatgaaa aataccggtg tttacctcat ttccagatta 3721 ggggtcagct ttctggttct tcccaaatat gaaaggataa tgcagaagta caacctgctg 3781 ccggagaagt ccatgtatga tttggttcat gggtccagcc tgtggatgct gtgtactgac 3841 gtagcactgg aattcccaag acccactctg cctaatgttg tttatgtagg aggaatccta 3901 accaaaccag ccagcccact accagaagat ctccaaagat gggtaaatgg tgctaatgaa 3961 catggctttg tcttggtgtc ttttggagct ggtgtcaagt atctgtcaga agacattgct 4021 aacaaactgg caggagctct ggggagattg cctcaaaaag tgatttggag gttttctgga 4081 cccaaaccaa agaatctagg aaacaacact aaactcatag aatggttacc acaaaatgac 4141 ctgcttgggc attcaaagat taaagccttc ctgagccatg gtggtttgaa cagtattttt 4201 gaaactatgt atcatggtgt gcctgtagtg ggaattccac tctttggaga ccattatgat 4261 actatgacca gagtacaggc aaaaggcatg gggatattgc tagaatggaa gacagttact 4321 gaaaaagagc tctatgaagc actagtgaag gttatcaata atcccagcta ccgtcagagg 4381 gctcagaagc tttcggaaat tcacaaggat caacctggtc accctgtcaa tcgaactatc 4441 tattggatag attatattat tcgtcacaat ggagcccatc acctacgtgc cgctgtccat 4501 cagatctcct tttgtcagta ttttttactg gatTAGGACC CAGCTTTCTT GTACAAAGTG 4561 GTTGATAGCT TGGATCCAAT CAACCTCTGG ATTACAAAAT TTGTGAAAGA TTGACTGGTA 4621 TTCTTAACTA TGTTGCTCCT TTTACGCTAT GTGGATACGC TGCTTTAATG CCTTTGTATC 4681 ATGCTATTGC TTCCCGTATG GCTTTCATTT TCTCCTCCTT GTATAAATCC TGGTTGCTGT 4741 CTCTTTATGA GGAGTTGTGG CCCGTTGTCA GGCAACGTGG CGTGGTGTGC ACTGTGTTTG 4801 CTGACGCAAC CCCCACTGGT TGGGGCATTG CCACCACCTG TCAGCTCCTT TCCGGGACTT 4861 TCGCTTTCCC CCTCCCTATT GCCACGGCGG AACTCATCGC CGCCTGCCTT GCCCGCTGCT 4921 GGACAGGGGC TCGGCTGTTG GGCACTGACA ATTCCGTGGT GTTGTCGGGG AAGCTGACGT 4981 CCTTTCCATG GCTGCTCGCC TGTGTTGCCA CCTGGATTCT GCGCGGGACG TCCTTCTGCT 5041 ACGTCCCTTC GGCCCTCAAT CCAGCGGACC TTCCTTCCCG CGGCCTGCTG CCGGCTCTGC 5101 GGCCTCTTCC GCGTCTTCGA GATCTGCCTC GACTGTGCCT TCTAGTTGCC AGCCATCTGT 5161 TGTTTGCCCC TCCCCCGTGC CTTCCTTGAC CCTGGAAGGT GCCACTCCCA CTGTCCTTTC 5221 CTAATAAAAT GAGGAAATTG CATCGCATTG TCTGAGTAGG TGTCATTCTA TTCTGGGGGG 5281 TGGGGTGGGG CAGGACAGCA AGGGGGAGGA TTGGGAAGAC AATAGCAGGC ATGCTGGGGA 5341 CTCGAGTTAA GGGCGAATTG CCGATTAGGA TCTTCCTAGA GCATGGCTAC GTAGATAAGT 5401 AGCATGGCGG GTTAATCATT AACTACAAGG AACCCCTAGT GATGGAGTTG GCCACTCCCT 5461 CTCTGCGCGC TCGCTCGCTC ACTGAGGCCG GGCGACCAAA GGTCGCCCGA CGCCCGGGCT 5521 TTGCCCGGGC GGCCTCAGTG AGCGAGCGAG CGCGCAGCCT TAATTAAGAG CTCATGGCGC 5581 GCCTAGGCCT TGACGGCCTT CCGCCAATTC GCCCTATAGT GAGTCGTATT ACGTCGCGCT 5641 CACTGGCCGT CGTTTTACAA CGTCGTGACT GGGAAAACCC TGGCGTTACC CAACTTAATC 5701 GCCTTGCAGC ACATCCCCCT TTCGCCAGCT GGCGTAATAG CGAAGAGGCC CGCACCGAAA 5761 CGCCCTTCCC AACAGTTGCG CAGCCTGAAT GGCGAATGGG AGCGCCCTGT AGCGGCCACT 5821 CAACCCTATC TCGGTCTATT CTTTTGATTT ATAAGGGATT TTGCCGATTT CGGCCTATTG 5881 GTTAAAAAAT GAGCTGATTT AACAAAAATT TAACGCGAAT TTTAACAAAA TATTAACGCT 5941 TACAATTTAG //