LOCUS UGT8-pGEn2-DEST 6675 bp DNA circular 21-JAN-2013 FEATURES Location/Qualifiers CDS 129..1108 /dnas_title="AmpR" /label=AmpR /vntifkey="4" rep_origin 1137..1804 /dnas_title="Col E1 origin" /label=Col E1 origin /vntifkey="33" misc_feature 1998..2127 /note="5'ITR" misc_feature 2208..2790 /note="CMV Promoter" misc_feature 2828..2960 /note="Artificial Intron" misc_recomb complement(3839..3867) /label=attB1 /note="attB1 site" /note="recognized as attB1" misc_feature 5303..5844 /note="WPRE" misc_recomb 5265..5287 /label=attB2 /note="attB2 site" /note="recognized as attB2" misc_feature complement(5851..6065) /note="BGH pA" misc_feature complement(6153..6282) /note="3'-ITR" misc_feature 2982..3056 /note="TCM signal sequence" misc_feature 3060..3083 /note="His tag" misc_feature 3084..3134 /note="AviTag" misc_feature 3135..3830 /note="Superfolder GFP" misc_feature 2976..2981 /note="Kozak seq" misc_feature 3868..3890 /note="TEV site" source 3891..5258 /dnas_title="UGT8-pGEn2-DEST" /organism="Homo sapiens" /mol_type="mRNA" /db_xref="taxon:9606" /clone="MGC:104134 IMAGE:30915590" /tissue_type="Brain, PCR rescued clones" /clone_lib="NIH_MGC_272" /lab_host="DH10B" /note="Vector: pCR4 Topo TA with reversed insert" gene 3891..5258 /dnas_title="UGT8" /gene="UGT8" /db_xref="GeneID:7368" /db_xref="HGNC:12555" /db_xref="MIM:601291" CDS 3891..5258 /dnas_title="UGT8 protein" /gene="UGT8" /codon_start=1 /product="UGT8 protein" /protein_id="AAH75069.1" /db_xref="GI:50959968" /db_xref="GeneID:7368" /db_xref="HGNC:12555" /db_xref="MIM:601291" /translation="MKSYTPYFILLWSAVGIAKAAKIIIVPPIMFESHMYIFKTLASA LHERGHHTVFLLSEGRDIAPSNHYSLQRYPGIFNSTTSDAFLQSKMRNIFSGRLTAIE LFDILDHYTKNCDLMVGNHALIQGLKKEKFDLLLVDPNDMCGFVIAHLLGVKYAVFST GLWYPAEVGAPAPLAYVPEFNSLLTDRMNLLQRMKNTGVYLISRLGVSFLVLPKYERI MQKYNLLPEKSMYDLVHGSSLWMLCTDVALEFPRPTLPNVVYVGGILTKPASPLPEDL QRWVNGANEHGFVLVSFGAGVKYLSEDIANKLAGALGRLPQKVIWRFSGPKPKNLGNN TKLIEWLPQNDLLGHSKIKAFLSHGGLNSIFETMYHGVPVVGIPLFGDHYDTMTRVQA KGMGILLEWKTVTEKELYEALVKVINNPSYRQRAQKLSEIHKDQPGHPVNRTIYWIDY IIRHNGAHHLRAAVHQISFCQYFLLDIAFVLLLGAALLYFLLSWVTKFIYRKIKSLWS RNKHSTVNGHYHNGILNGKYKRNGHIKHEKKVK" misc_feature 3891..5258 /note="UGT8 coding region" misc_difference 4508..4508 /dnas_title="UGT8" /gene="UGT8" /note="'G' in cDNA is 'A' in the human genome; no amino acid change. The chimpanzee genome agrees with the cDNA sequence, suggesting that this difference is unlikely to be due to an artifact." misc_difference 4934..4934 /dnas_title="UGT8" /gene="UGT8" /note="'G' in cDNA is 'A' in the human genome; amino acid difference: 'M' in cDNA, 'I' in the human genome. The chimpanzee genome agrees with the cDNA sequence, suggesting that this difference is unlikely to be due to an artifact." vector join(5273..6675,1..3857) /source="pGEn2-DEST" /type="Destination Vector" clone 3858..5272 /source="UGT8-Nterm-TEVfusion-pDONR221" /type="Entry Clone" ORIGIN 1 GTGGCACTTT TCGGGGAAAT GTGCGCGGAA CCCCTATTTG TTTATTTTTC TAAATACATT 61 CAAATATGTA TCCGCTCATG AGACAATAAC CCTGATAAAT GCTTCAATAA TATTGAAAAA 121 GGAAGAGTAT GAGTATTCAA CATTTCCGTG TCGCCCTTAT TCCCTTTTTT GCGGCATTTT 181 GCCTTCCTGT TTTTGCTCAC CCAGAAACGC TGGTGAAAGT AAAAGATGCT GAAGATCAGT 241 TGGGTGCACG AGTGGGTTAC ATCGAACTGG ATCTCAACAG CGGTAAGATC CTTGAGAGTT 301 TTCGCCCCGA AGAACGTTTT CCAATGATGA GCACTTTTAA AGTTCTGCTA TGTGGCGCGG 361 TATTATCCCG TATTGACGCC GGGCAAGAGC AACTCGGTCG CCGCATACAC TATTCTCAGA 421 ATGACTTGGT TGAGTACTCA CCAGTCACAG AAAAGCATCT TACGGATGGC ATGACAGTAA 481 GAGAATTATG CAGTGCTGCC ATAACCATGA GTGATAACAC TGCGGCCAAC TTACTTCTGA 541 CAACGATCGG AGGACCGAAG GAGCTAACCG CTTTTTTGCA CAACATGGGG GATCATGTAA 601 CTCGCCTTGA TCGTTGGGAA CCGGAGCTGA ATGAAGCCAT ACCAAACGAC GAGCGTGACA 661 CCACGATGCC TGTAGCAATG GCAACAACGT TGCGCAAACT ATTAACTGGC GAACTACTTA 721 CTCTAGCTTC CCGGCAACAA TTAATAGACT GGATGGAGGC GGATAAAGTT GCAGGACCAC 781 TTCTGCGCTC GGCCCTTCCG GCTGGCTGGT TTATTGCTGA TAAATCTGGA GCCGGTGAGC 841 GTGGTTCTCG CGGTATCATT GCAGCACTGG GGCCAGATGG TAAGCCCTCC CGTATCGTAG 901 TTATCTACAC GACGGGGAGT CAGGCAACTA TGGATGAACG AAATAGACAG ATCGCTGAGA 961 TAGGTGCCTC ACTGATTAAG CATTGGTAAC TGTCAGACCA AGTTTACTCA TATATACTTT 1021 AGATTGATTT AAAACTTCAT TTTTAATTTA AAAGGATCTA GGTGAAGATC CTTTTTGATA 1081 ATCTCATGAC CAAAATCCCT TAACGTGAGT TTTCGTTCCA CTGAGCGTCA GACCCCGTAG 1141 AAAAGATCAA AGGATCTTCT TGAGATCCTT TTTTTCTGCG CGTAATCTGC TGCTTGCAAA 1201 CAAAAAAACC ACCGCTACCA GCGGTGGTTT GTTTGCCGGA TCAAGAGCTA CCAACTCTTT 1261 TTCCGAAGGT AACTGGCTTC AGCAGAGCGC AGATACCAAA TACTGTTCTT CTAGTGTAGC 1321 CGTAGTTAGG CCACCACTTC AAGAACTCTG TAGCACCGCC TACATACCTC GCTCTGCTAA 1381 TCCTGTTACC AGTGGCTGCT GCCAGTGGCG ATAAGTCGTG TCTTACCGGG TTGGACTCAA 1441 GACGATAGTT ACCGGATAAG GCGCAGCGGT CGGGCTGAAC GGGGGGTTCG TGCACACAGC 1501 CCAGCTTGGA GCGAACGACC TACACCGAAC TGAGATACCT ACAGCGTGAG CTATGAGAAA 1561 GCGCCACGCT TCCCGAAGGG AGAAAGGCGG ACAGGTATCC GGTAAGCGGC AGGGTCGGAA 1621 CAGGAGAGCG CACGAGGGAG CTTCCAGGGG GAAACGCCTG GTATCTTTAT AGTCCTGTCG 1681 GGTTTCGCCA CCTCTGACTT GAGCGTCGAT TTTTGTGATG CTCGTCAGGG GGGCGGAGCC 1741 TATGGAAAAA CGCCAGCAAC GCGGCCTTTT TACGGTTCCT GGCCTTTTGC TGGCCTTTTG 1801 CTCATTAGGC ACCCCAGGCT TTACCCGAAC GACCGAGCGC AGCGAGTCAG TGAGCGAGGA 1861 AGCGGAGAGC GCCCAATACG CAAGGAAACA GCTATGACCA TGTTAATGCA GCTGGCACGA 1921 CAGGTTTCCC GACTGGAAAG CGGGCAGTGA GCGGAAGGCC CATGAGGCCA GTTAATTAAG 1981 AGGTACCTTA ATTAAGGCTG CGCGCTCGCT CGCTCACTGA GGCCGCCCGG GCAAAGCCCG 2041 GGCGTCGGGC GACCTTTGGT CGCCCGGCCT CAGTGAGCGA GCGAGCGCGC AGAGAGGGAG 2101 TGGCCAACTC CATCACTAGG GGTTCCTTGT AGTTAATGAT TAACCCGCCA TGCTACTTAT 2161 CTACGTAGCC ATGCTCTAGG AAGATCGCAA TTCGCCCTTA AGCTAGCTAG TTATTAATAG 2221 TAATCAATTA CGGGGTCATT AGTTCATAGC CCATATATGG AGTTCCGCGT TACATAACTT 2281 ACGGTAAATG GCCCGCCTGG CTGACCGCCC AACGACCCCC GCCCATTGAC GTCAATAATG 2341 ACGTATGTTC CCATAGTAAC GCCAATAGGG ACTTTCCATT GACGTCAATG GGTGGAGTAT 2401 TTACGGTAAA CTGCCCACTT GGCAGTACAT CAAGTGTATC ATATGCCAAG TACGCCCCCT 2461 ATTGACGTCA ATGACGGTAA ATGGCCCGCC TGGCATTATG CCCAGTACAT GACCTTATGG 2521 GACTTTCCTA CTTGGCAGTA CATCTACGTA TTAGTCATCG CTATTACCAT GGTGATGCGG 2581 TTTTGGCAGT ACATCAATGG GCGTGGATAG CGGTTTGACT CACGGGGATT TCCAAGTCTC 2641 CACCCCATTG ACGTCAATGG GAGTTTGTTT TGGCACCAAA ATCAACGGGA CTTTCCAAAA 2701 TGTCGTAACA ACTCCGCCCC ATTGACGCAA ATGGGCGGTA GGCGTGTACG GTGGGAGGTC 2761 TATATAAGCA GAGCTGGTTT AGTGAACCGT CAGATCCTGC AGAAGTTGGT CGTGAGGCAC 2821 TGGGCAGGTA AGTATCAAGG TTACAAGACA GGTTTAAGGA GACCAATAGA AACTGGGCTT 2881 GTCGAGACAG AGAAGACTCT TGCGTTTCTG ATAGGCACCT ATTGGTCTTA CTGACATCCA 2941 CTTTGCCTTT CTCTCCACAG GTGTCCAgcg gccgcGCCAC cATGAGACTG CTGACCGCCC 3001 TGTTCGCCTA CTTCATCGTG GCCCTGATCC TGGCCTTCAG CGTGTCCGCC AAGAGCATGC 3061 ACCACCACCA TCACCATCAT CACATGAGCG GCCTGAACGA CATCTTCGAG GCCCAGAAAA 3121 TCGAGTGGCA CGAGATGAGC AAGGGCGAGG AACTGTTCAC CGGCGTGGTG CCCATCCTGG 3181 TGGAACTGGA CGGCGACGTG AACGGCCACA AGTTCTCTGT GCGGGGCGAG GGCGAGGGGG 3241 ACGCCACAAA TGGCAAGCTG ACCCTGAAGT TCATCTGCAC CACCGGAAAG CTGCCCGTGC 3301 CCTGGCCTAC CCTGGTCACA ACCCTGACCT ACGGCGTGCA GTGCTTCAGC AGATACCCCG 3361 ACCACATGAA GCGGCACGAT TTCTTCAAGA GCGCCATGCC CGAGGGCTAC GTGCAAGAAC 3421 GGACCATCAG CTTCAAGGAC GACGGCACCT ACAAGACCAG AGCCGAAGTG AAGTTCGAGG 3481 GCGACACCCT GGTCAACCGG ATCGAGCTGA AGGGCATCGA CTTCAAAGAG GACGGCAACA 3541 TCCTGGGCCA CAAGCTCGAG TACAACTTCA ACAGCCACAA CGTGTACATC ACCGCCGACA 3601 AGCAGAAGAA CGGCATCAAG GCCAACTTCA AGATCCGGCA CAACGTGGAA GATGGCAGCG 3661 TGCAGCTGGC CGACCACTAC CAGCAGAACA CCCCCATCGG CGACGGCCCC GTGCTGCTGC 3721 CCGACAATCA CTACCTGAGC ACCCAGAGCG TGCTGAGCAA GGACCCCAAC GAGAAGCGGG 3781 ACCACATGGT GCTGCTGGAA TTTGTGACCG CCGCTGGCAT CACCCACGGC GAATTCgcAT 3841 CAACAAGTTT GTACAAAAAA GCAGGCTctg aaaacttgta ctttcaaggc gccaaaatca 3901 tcatcgtgcc gccaattatg tttgaaagcc atatgtacat tttcaagacg ctagcctcag 3961 ccttgcacga gagaggccac catacagtgt tcctcctctc tgaaggcaga gacatcgccc 4021 catctaatca ttacagcctc cagcgctacc cagggatctt taacagtacc acctcagatg 4081 ctttcctaca gtccaagatg cggaatattt tctctgggag attgacagca atcgaactgt 4141 ttgacatact ggatcactat actaagaact gtgacctgat ggttggcaac catgccctga 4201 tccagggtct gaagaaagaa aaatttgacc tgctgctggt ggaccctaat gatatgtgtg 4261 gatttgtgat agctcatctt ttaggggtta aatatgctgt attttcaact ggcctttggt 4321 atcctgctga agtgggtgct cctgctccat tagcatacgt cccagagttt aactcactcc 4381 tcacagaccg catgaacttg ctgcaaagga tgaaaaatac cggtgtttac ctcatttcca 4441 gattaggggt cagctttctg gttcttccca aatatgaaag gataatgcag aagtacaacc 4501 tgctgccgga gaagtccatg tatgatttgg ttcatgggtc cagcctgtgg atgctgtgta 4561 ctgacgtagc actggaattc ccaagaccca ctctgcctaa tgttgtttat gtaggaggaa 4621 tcctaaccaa accagccagc ccactaccag aagatctcca aagatgggta aatggtgcta 4681 atgaacatgg ctttgtcttg gtgtcttttg gagctggtgt caagtatctg tcagaagaca 4741 ttgctaacaa actggcagga gctctgggga gattgcctca aaaagtgatt tggaggtttt 4801 ctggacccaa accaaagaat ctaggaaaca acactaaact catagaatgg ttaccacaaa 4861 atgacctgct tgggcattca aagattaaag ccttcctgag ccatggtggt ttgaacagta 4921 tttttgaaac tatgtatcat ggtgtgcctg tagtgggaat tccactcttt ggagaccatt 4981 atgatactat gaccagagta caggcaaaag gcatggggat attgctagaa tggaagacag 5041 ttactgaaaa agagctctat gaagcactag tgaaggttat caataatccc agctaccgtc 5101 agagggctca gaagctttcg gaaattcaca aggatcaacc tggtcaccct gtcaatcgaa 5161 ctatctattg gatagattat attattcgtc acaatggagc ccatcaccta cgtgccgctg 5221 tccatcagat ctccttttgt cagtattttt tactggatTA GGACCCAGCT TTCTTGTACA 5281 AAGTGGTTGA TAGCTTGGAT CCAATCAACC TCTGGATTAC AAAATTTGTG AAAGATTGAC 5341 TGGTATTCTT AACTATGTTG CTCCTTTTAC GCTATGTGGA TACGCTGCTT TAATGCCTTT 5401 GTATCATGCT ATTGCTTCCC GTATGGCTTT CATTTTCTCC TCCTTGTATA AATCCTGGTT 5461 GCTGTCTCTT TATGAGGAGT TGTGGCCCGT TGTCAGGCAA CGTGGCGTGG TGTGCACTGT 5521 GTTTGCTGAC GCAACCCCCA CTGGTTGGGG CATTGCCACC ACCTGTCAGC TCCTTTCCGG 5581 GACTTTCGCT TTCCCCCTCC CTATTGCCAC GGCGGAACTC ATCGCCGCCT GCCTTGCCCG 5641 CTGCTGGACA GGGGCTCGGC TGTTGGGCAC TGACAATTCC GTGGTGTTGT CGGGGAAGCT 5701 GACGTCCTTT CCATGGCTGC TCGCCTGTGT TGCCACCTGG ATTCTGCGCG GGACGTCCTT 5761 CTGCTACGTC CCTTCGGCCC TCAATCCAGC GGACCTTCCT TCCCGCGGCC TGCTGCCGGC 5821 TCTGCGGCCT CTTCCGCGTC TTCGAGATCT GCCTCGACTG TGCCTTCTAG TTGCCAGCCA 5881 TCTGTTGTTT GCCCCTCCCC CGTGCCTTCC TTGACCCTGG AAGGTGCCAC TCCCACTGTC 5941 CTTTCCTAAT AAAATGAGGA AATTGCATCG CATTGTCTGA GTAGGTGTCA TTCTATTCTG 6001 GGGGGTGGGG TGGGGCAGGA CAGCAAGGGG GAGGATTGGG AAGACAATAG CAGGCATGCT 6061 GGGGACTCGA GTTAAGGGCG AATTGCCGAT TAGGATCTTC CTAGAGCATG GCTACGTAGA 6121 TAAGTAGCAT GGCGGGTTAA TCATTAACTA CAAGGAACCC CTAGTGATGG AGTTGGCCAC 6181 TCCCTCTCTG CGCGCTCGCT CGCTCACTGA GGCCGGGCGA CCAAAGGTCG CCCGACGCCC 6241 GGGCTTTGCC CGGGCGGCCT CAGTGAGCGA GCGAGCGCGC AGCCTTAATT AAGAGCTCAT 6301 GGCGCGCCTA GGCCTTGACG GCCTTCCGCC AATTCGCCCT ATAGTGAGTC GTATTACGTC 6361 GCGCTCACTG GCCGTCGTTT TACAACGTCG TGACTGGGAA AACCCTGGCG TTACCCAACT 6421 TAATCGCCTT GCAGCACATC CCCCTTTCGC CAGCTGGCGT AATAGCGAAG AGGCCCGCAC 6481 CGAAACGCCC TTCCCAACAG TTGCGCAGCC TGAATGGCGA ATGGGAGCGC CCTGTAGCGG 6541 CCACTCAACC CTATCTCGGT CTATTCTTTT GATTTATAAG GGATTTTGCC GATTTCGGCC 6601 TATTGGTTAA AAAATGAGCT GATTTAACAA AAATTTAACG CGAATTTTAA CAAAATATTA 6661 ACGCTTACAA TTTAG //