LOCUS UGT2B4-pGEn1-DES 5989 bp DNA circular 21-JAN-2013 FEATURES Location/Qualifiers CDS 129..1108 /dnas_title="AmpR" /label=AmpR /vntifkey="4" rep_origin 1137..1804 /dnas_title="Col E1 origin" /label=Col E1 origin /vntifkey="33" misc_feature 1998..2127 /note="5'ITR" misc_feature 2208..2790 /note="CMV Promoter" misc_feature 2828..2960 /note="Artificial Intron" misc_feature 2977..3054 /note="TCM Sig Seq" misc_recomb complement(3114..3142) /label=attB1 /note="attB1 site" /note="recognized as attB1" misc_feature 3055..3078 /note="8xHis Tag" misc_feature 3085..3108 /note="StrepTag" misc_feature 4617..5158 /note="WPRE" misc_recomb 4579..4601 /label=attB2 /note="attB2 site" /note="recognized as attB2" misc_feature complement(5165..5379) /note="BGH pA" misc_feature complement(5467..5596) /note="3'-ITR" misc_feature 3143..3165 /note="TEV site" source 3166..4572 /dnas_title="UGT2B4-pGEn1-DEST" /organism="Homo sapiens" /mol_type="mRNA" /db_xref="taxon:9606" /clone="MGC:22623 IMAGE:4709436" /tissue_type="Liver" /clone_lib="NIH_MGC_76" /lab_host="DH10B" /note="Vector: pDNR-LIB" gene 3166..4572 /dnas_title="UGT2B4" /gene="UGT2B4" /gene_synonym="UGT2B11" /db_xref="GeneID:7363" /db_xref="HGNC:12553" /db_xref="MIM:600067" CDS 3166..4572 /dnas_title="UDP glucuronosyltransferase 2 family, polypeptide B4" /gene="UGT2B4" /gene_synonym="UGT2B11" /codon_start=1 /product="UDP glucuronosyltransferase 2 family, polypeptide B4" /protein_id="AAH26264.1" /db_xref="GI:20070776" /db_xref="GeneID:7363" /db_xref="HGNC:12553" /db_xref="MIM:600067" /translation="MSMKWTSALLLIQLSCYFSSGSCGKVLVWPTEFSHWMNIKTILD ELVQRGHEVTVLASSASISFDPNSPSTLKFEVYPVSLTKTEFEDIIKQLVKRWAELPK DTFWSYFSQVQEIMWTFNDILRKFCKDIVSNKKLMKKLQESRFDVVLADAVFPFGELL AELLKIPFVYSLRFSPGYAIEKHSGGLLFPPSYVPVVMSELSDQMTFIERVKNMIYVL YFEFWFQIFDMKKWDQFYSEVLGRPTTLSETMAKADIWLIRNYWDFQFPHPLLPNVEF VGGLHCKPAKPLPKEMEEFVQSSGENGVVVFSLGSMVSNTSEERANVIASALAKIPQK VLWRFDGNKPDTLGLNTRLYKWIPQNDLLGHPKTRAFITHGGANGIYEAIYHGIPMVG VPLFADQPDNIAHMKAKGAAVSLDFHTMSSTDLLNALKTVINDPLYKENAMKLSRIHH DQPVKPLDRAVFWIEFVMRHKGAKHLRVAAHDLTWFQYHSLDVTGFLLACVATVIFII TKCLFCVWKFVRTGKKGKRD" misc_feature 3166..4572 /note="UGT2B4 coding region" misc_difference 4044..4044 /dnas_title="UGT2B4" /gene="UGT2B4" /gene_synonym="UGT2B11" /note="'G' in cDNA is 'A' in the human genome; no amino acid change. The chimpanzee genome agrees with the cDNA sequence, suggesting that this difference is unlikely to be due to an artifact." misc_difference 4365..4365 /dnas_title="UGT2B4" /gene="UGT2B4" /gene_synonym="UGT2B11" /note="'T' in cDNA is 'A' in the human genome; no amino acid change. The chimpanzee genome agrees with the human genomic sequence and not the cDNA." vector join(4587..5989,1..3132) /source="pGEn1-DEST" /type="Destination Vector" clone 3133..4586 /source="UGT2B4_Nterm-TEVfusion-pDONR221" /type="Entry Clone" ORIGIN 1 GTGGCACTTT TCGGGGAAAT GTGCGCGGAA CCCCTATTTG TTTATTTTTC TAAATACATT 61 CAAATATGTA TCCGCTCATG AGACAATAAC CCTGATAAAT GCTTCAATAA TATTGAAAAA 121 GGAAGAGTAT GAGTATTCAA CATTTCCGTG TCGCCCTTAT TCCCTTTTTT GCGGCATTTT 181 GCCTTCCTGT TTTTGCTCAC CCAGAAACGC TGGTGAAAGT AAAAGATGCT GAAGATCAGT 241 TGGGTGCACG AGTGGGTTAC ATCGAACTGG ATCTCAACAG CGGTAAGATC CTTGAGAGTT 301 TTCGCCCCGA AGAACGTTTT CCAATGATGA GCACTTTTAA AGTTCTGCTA TGTGGCGCGG 361 TATTATCCCG TATTGACGCC GGGCAAGAGC AACTCGGTCG CCGCATACAC TATTCTCAGA 421 ATGACTTGGT TGAGTACTCA CCAGTCACAG AAAAGCATCT TACGGATGGC ATGACAGTAA 481 GAGAATTATG CAGTGCTGCC ATAACCATGA GTGATAACAC TGCGGCCAAC TTACTTCTGA 541 CAACGATCGG AGGACCGAAG GAGCTAACCG CTTTTTTGCA CAACATGGGG GATCATGTAA 601 CTCGCCTTGA TCGTTGGGAA CCGGAGCTGA ATGAAGCCAT ACCAAACGAC GAGCGTGACA 661 CCACGATGCC TGTAGCAATG GCAACAACGT TGCGCAAACT ATTAACTGGC GAACTACTTA 721 CTCTAGCTTC CCGGCAACAA TTAATAGACT GGATGGAGGC GGATAAAGTT GCAGGACCAC 781 TTCTGCGCTC GGCCCTTCCG GCTGGCTGGT TTATTGCTGA TAAATCTGGA GCCGGTGAGC 841 GTGGTTCTCG CGGTATCATT GCAGCACTGG GGCCAGATGG TAAGCCCTCC CGTATCGTAG 901 TTATCTACAC GACGGGGAGT CAGGCAACTA TGGATGAACG AAATAGACAG ATCGCTGAGA 961 TAGGTGCCTC ACTGATTAAG CATTGGTAAC TGTCAGACCA AGTTTACTCA TATATACTTT 1021 AGATTGATTT AAAACTTCAT TTTTAATTTA AAAGGATCTA GGTGAAGATC CTTTTTGATA 1081 ATCTCATGAC CAAAATCCCT TAACGTGAGT TTTCGTTCCA CTGAGCGTCA GACCCCGTAG 1141 AAAAGATCAA AGGATCTTCT TGAGATCCTT TTTTTCTGCG CGTAATCTGC TGCTTGCAAA 1201 CAAAAAAACC ACCGCTACCA GCGGTGGTTT GTTTGCCGGA TCAAGAGCTA CCAACTCTTT 1261 TTCCGAAGGT AACTGGCTTC AGCAGAGCGC AGATACCAAA TACTGTTCTT CTAGTGTAGC 1321 CGTAGTTAGG CCACCACTTC AAGAACTCTG TAGCACCGCC TACATACCTC GCTCTGCTAA 1381 TCCTGTTACC AGTGGCTGCT GCCAGTGGCG ATAAGTCGTG TCTTACCGGG TTGGACTCAA 1441 GACGATAGTT ACCGGATAAG GCGCAGCGGT CGGGCTGAAC GGGGGGTTCG TGCACACAGC 1501 CCAGCTTGGA GCGAACGACC TACACCGAAC TGAGATACCT ACAGCGTGAG CTATGAGAAA 1561 GCGCCACGCT TCCCGAAGGG AGAAAGGCGG ACAGGTATCC GGTAAGCGGC AGGGTCGGAA 1621 CAGGAGAGCG CACGAGGGAG CTTCCAGGGG GAAACGCCTG GTATCTTTAT AGTCCTGTCG 1681 GGTTTCGCCA CCTCTGACTT GAGCGTCGAT TTTTGTGATG CTCGTCAGGG GGGCGGAGCC 1741 TATGGAAAAA CGCCAGCAAC GCGGCCTTTT TACGGTTCCT GGCCTTTTGC TGGCCTTTTG 1801 CTCATTAGGC ACCCCAGGCT TTACCCGAAC GACCGAGCGC AGCGAGTCAG TGAGCGAGGA 1861 AGCGGAGAGC GCCCAATACG CAAGGAAACA GCTATGACCA TGTTAATGCA GCTGGCACGA 1921 CAGGTTTCCC GACTGGAAAG CGGGCAGTGA GCGGAAGGCC CATGAGGCCA GTTAATTAAG 1981 AGGTACCTTA ATTAAGGCTG CGCGCTCGCT CGCTCACTGA GGCCGCCCGG GCAAAGCCCG 2041 GGCGTCGGGC GACCTTTGGT CGCCCGGCCT CAGTGAGCGA GCGAGCGCGC AGAGAGGGAG 2101 TGGCCAACTC CATCACTAGG GGTTCCTTGT AGTTAATGAT TAACCCGCCA TGCTACTTAT 2161 CTACGTAGCC ATGCTCTAGG AAGATCGCAA TTCGCCCTTA AGCTAGCTAG TTATTAATAG 2221 TAATCAATTA CGGGGTCATT AGTTCATAGC CCATATATGG AGTTCCGCGT TACATAACTT 2281 ACGGTAAATG GCCCGCCTGG CTGACCGCCC AACGACCCCC GCCCATTGAC GTCAATAATG 2341 ACGTATGTTC CCATAGTAAC GCCAATAGGG ACTTTCCATT GACGTCAATG GGTGGAGTAT 2401 TTACGGTAAA CTGCCCACTT GGCAGTACAT CAAGTGTATC ATATGCCAAG TACGCCCCCT 2461 ATTGACGTCA ATGACGGTAA ATGGCCCGCC TGGCATTATG CCCAGTACAT GACCTTATGG 2521 GACTTTCCTA CTTGGCAGTA CATCTACGTA TTAGTCATCG CTATTACCAT GGTGATGCGG 2581 TTTTGGCAGT ACATCAATGG GCGTGGATAG CGGTTTGACT CACGGGGATT TCCAAGTCTC 2641 CACCCCATTG ACGTCAATGG GAGTTTGTTT TGGCACCAAA ATCAACGGGA CTTTCCAAAA 2701 TGTCGTAACA ACTCCGCCCC ATTGACGCAA ATGGGCGGTA GGCGTGTACG GTGGGAGGTC 2761 TATATAAGCA GAGCTGGTTT AGTGAACCGT CAGATCCTGC AGAAGTTGGT CGTGAGGCAC 2821 TGGGCAGGTA AGTATCAAGG TTACAAGACA GGTTTAAGGA GACCAATAGA AACTGGGCTT 2881 GTCGAGACAG AGAAGACTCT TGCGTTTCTG ATAGGCACCT ATTGGTCTTA CTGACATCCA 2941 CTTTGCCTTT CTCTCCACAG GTGTCCAGCG GCCGCCATGA GACTGCTGAC AGCCCTGTTC 3001 GCCTACTTCA TCGTGGCCCT GATCCTGGCC TTCAGCGTGT CCGCCAAGAG CATGCACCAC 3061 CACCATCACC ATCATCACAG CGCCTGGTCC CACCCCCAGT TCGAGAAAGA ATTATCAACA 3121 AGTTTGTACA AAAAAGCAGG CTctgaaaac ttgtactttc aaggcggaaa ggtgctggtg 3181 tggcccacag aattcagcca ctggatgaat ataaagacaa tcctggatga acttgtccag 3241 agaggtcatg aggtgactgt attggcatct tcagcttcca tttctttcga tcccaacagc 3301 ccatctactc ttaaatttga agtttatcct gtatctttaa ctaaaactga gtttgaggat 3361 attatcaagc agctggttaa gagatgggca gaacttccaa aagacacatt ttggtcatat 3421 ttttcacaag tacaagaaat catgtggaca tttaatgaca tacttagaaa gttctgtaag 3481 gatatagttt caaataagaa acttatgaag aaactacagg agtcaagatt tgatgttgtt 3541 cttgcagatg ctgttttccc ctttggtgag ctgctggccg agttacttaa aatacccttt 3601 gtctacagcc tccgcttctc tcctggctac gcaattgaaa agcatagtgg aggacttctg 3661 ttccctcctt cctatgtgcc tgttgttatg tcagaactaa gtgaccaaat gactttcata 3721 gagagggtaa aaaatatgat ctatgtgctt tattttgaat tttggttcca aatatttgac 3781 atgaagaagt gggatcagtt ctacagtgaa gttctaggaa gacccactac gttatctgag 3841 acaatggcaa aagctgacat atggcttatt cgaaactact gggattttca atttcctcac 3901 ccactcttac caaatgttga gttcgttgga ggactccact gcaaacctgc caaaccccta 3961 ccgaaggaaa tggaagagtt tgtccagagc tctggagaaa atggtgttgt ggtgttttct 4021 ctggggtcga tggtcagtaa cacgtcagaa gaaagggcca atgtaattgc atcagccctt 4081 gccaagatcc cacaaaaggt tctgtggaga tttgatggga ataaaccaga tactttagga 4141 ctcaatactc ggctgtacaa gtggataccc cagaatgatc ttcttggtca cccaaaaacc 4201 agagctttta taactcatgg tggagccaat ggcatctatg aggcaatcta ccatggaatc 4261 cctatggtgg gcgttccatt gtttgcagat caacctgata acattgcaca catgaaggcc 4321 aagggagcag ctgttagttt ggacttccac acaatgtcga gtactgactt actcaatgca 4381 ctgaagacag taattaatga tcctttatat aaagagaatg ctatgaaatt atcaagaatt 4441 catcatgatc aaccagtgaa gccccttgat cgagcagtct tctggattga atttgtcatg 4501 cgccataaag gagccaagca ccttcgggtt gcagcccacg acctcacctg gttccagtac 4561 cactctttgg atTAGGACCC AGCTTTCTTG TACAAAGTGG TTGATAGCTT GGATCCAATC 4621 AACCTCTGGA TTACAAAATT TGTGAAAGAT TGACTGGTAT TCTTAACTAT GTTGCTCCTT 4681 TTACGCTATG TGGATACGCT GCTTTAATGC CTTTGTATCA TGCTATTGCT TCCCGTATGG 4741 CTTTCATTTT CTCCTCCTTG TATAAATCCT GGTTGCTGTC TCTTTATGAG GAGTTGTGGC 4801 CCGTTGTCAG GCAACGTGGC GTGGTGTGCA CTGTGTTTGC TGACGCAACC CCCACTGGTT 4861 GGGGCATTGC CACCACCTGT CAGCTCCTTT CCGGGACTTT CGCTTTCCCC CTCCCTATTG 4921 CCACGGCGGA ACTCATCGCC GCCTGCCTTG CCCGCTGCTG GACAGGGGCT CGGCTGTTGG 4981 GCACTGACAA TTCCGTGGTG TTGTCGGGGA AGCTGACGTC CTTTCCATGG CTGCTCGCCT 5041 GTGTTGCCAC CTGGATTCTG CGCGGGACGT CCTTCTGCTA CGTCCCTTCG GCCCTCAATC 5101 CAGCGGACCT TCCTTCCCGC GGCCTGCTGC CGGCTCTGCG GCCTCTTCCG CGTCTTCGAG 5161 ATCTGCCTCG ACTGTGCCTT CTAGTTGCCA GCCATCTGTT GTTTGCCCCT CCCCCGTGCC 5221 TTCCTTGACC CTGGAAGGTG CCACTCCCAC TGTCCTTTCC TAATAAAATG AGGAAATTGC 5281 ATCGCATTGT CTGAGTAGGT GTCATTCTAT TCTGGGGGGT GGGGTGGGGC AGGACAGCAA 5341 GGGGGAGGAT TGGGAAGACA ATAGCAGGCA TGCTGGGGAC TCGAGTTAAG GGCGAATTGC 5401 CGATTAGGAT CTTCCTAGAG CATGGCTACG TAGATAAGTA GCATGGCGGG TTAATCATTA 5461 ACTACAAGGA ACCCCTAGTG ATGGAGTTGG CCACTCCCTC TCTGCGCGCT CGCTCGCTCA 5521 CTGAGGCCGG GCGACCAAAG GTCGCCCGAC GCCCGGGCTT TGCCCGGGCG GCCTCAGTGA 5581 GCGAGCGAGC GCGCAGCCTT AATTAAGAGC TCATGGCGCG CCTAGGCCTT GACGGCCTTC 5641 CGCCAATTCG CCCTATAGTG AGTCGTATTA CGTCGCGCTC ACTGGCCGTC GTTTTACAAC 5701 GTCGTGACTG GGAAAACCCT GGCGTTACCC AACTTAATCG CCTTGCAGCA CATCCCCCTT 5761 TCGCCAGCTG GCGTAATAGC GAAGAGGCCC GCACCGAAAC GCCCTTCCCA ACAGTTGCGC 5821 AGCCTGAATG GCGAATGGGA GCGCCCTGTA GCGGCCACTC AACCCTATCT CGGTCTATTC 5881 TTTTGATTTA TAAGGGATTT TGCCGATTTC GGCCTATTGG TTAAAAAATG AGCTGATTTA 5941 ACAAAAATTT AACGCGAATT TTAACAAAAT ATTAACGCTT ACAATTTAG //