LOCUS UGCG-pGEn1-DEST 5665 bp DNA circular 22-JAN-2013 FEATURES Location/Qualifiers CDS 129..1108 /dnas_title="AmpR" /label=AmpR /vntifkey="4" rep_origin 1137..1804 /dnas_title="Col E1 origin" /label=Col E1 origin /vntifkey="33" misc_feature 1998..2127 /note="5'ITR" misc_feature 2208..2790 /note="CMV Promoter" misc_feature 2828..2960 /note="Artificial Intron" misc_feature 2977..3054 /note="TCM Sig Seq" misc_recomb complement(3114..3142) /label=attB1 /note="attB1 site" /note="recognized as attB1" misc_feature 3055..3078 /note="8xHis Tag" misc_feature 3085..3108 /note="StrepTag" misc_feature 4293..4834 /note="WPRE" misc_recomb 4255..4277 /label=attB2 /note="attB2 site" /note="recognized as attB2" misc_feature complement(4841..5055) /note="BGH pA" misc_feature complement(5143..5272) /note="3'-ITR" misc_feature 3143..3165 /note="TEV site" source 3166..4248 /dnas_title="UGCG-pGEn1-DEST" /organism="Homo sapiens" /mol_type="mRNA" /db_xref="taxon:9606" /clone="MGC:33797 IMAGE:5295561" /tissue_type="Testis" /clone_lib="NIH_MGC_97" /lab_host="DH10B" /note="Vector: pBluescriptR" gene 3166..4248 /dnas_title="UGCG" /gene="UGCG" /gene_synonym="GCS" /db_xref="GeneID:7357" /db_xref="HGNC:12524" /db_xref="MIM:602874" CDS 3166..4248 /dnas_title="UDP-glucose ceramide glucosyltransferase" /gene="UGCG" /gene_synonym="GCS" /codon_start=1 /product="UDP-glucose ceramide glucosyltransferase" /protein_id="AAH38711.1" /db_xref="GI:24270822" /db_xref="GeneID:7357" /db_xref="HGNC:12524" /db_xref="MIM:602874" /translation="MALLDLALEGMAVFGFVLFLVLWLMHFMAIIYTRLHLNKKATDK QPYSKLPGVSLLKPLKGVDPNLINNLETFFELDYPKYEVLLCVQDHDDPAIDVCKKLL GKYPNVDARLFIGGKKVGINPKINNLMPGYEVAKYDLIWICDSGIRVIPDTLTDMVNQ MTEKVGLVHGLPYVADRQGFAATLEQVYFGTSHPRYYISANVTGFKCVTGMSCLMRKD VLDQAGGLIAFAQYIAEDYFMAKAIADRGWRFAMSTQVAMQNSGSYSISQFQSRMIRW TKLRINMLPATIICEPISECFVASLIIGWAAHHVFRWDIMVFFMCHCLAWFIFDYIQL RGVQGGTLCFSKLDYAVAWFIRESMTIYIFLSALWDPTISWRTGRYRLRCGGTAEEIL DV" misc_feature 3166..4248 /note="UGCG coding region" misc_difference 3525..3525 /dnas_title="UGCG" /gene="UGCG" /gene_synonym="GCS" /note="'A' in cDNA is 'G' in the human genome; no amino acid change. The chimpanzee genome agrees with the human genomic sequence and not the cDNA." vector join(4263..5665,1..3132) /source="pGEn1-DEST" /type="Destination Vector" clone 3133..4262 /source="UGCG-Nterm-TEVfusion-pDONR221" /type="Entry Clone" ORIGIN 1 GTGGCACTTT TCGGGGAAAT GTGCGCGGAA CCCCTATTTG TTTATTTTTC TAAATACATT 61 CAAATATGTA TCCGCTCATG AGACAATAAC CCTGATAAAT GCTTCAATAA TATTGAAAAA 121 GGAAGAGTAT GAGTATTCAA CATTTCCGTG TCGCCCTTAT TCCCTTTTTT GCGGCATTTT 181 GCCTTCCTGT TTTTGCTCAC CCAGAAACGC TGGTGAAAGT AAAAGATGCT GAAGATCAGT 241 TGGGTGCACG AGTGGGTTAC ATCGAACTGG ATCTCAACAG CGGTAAGATC CTTGAGAGTT 301 TTCGCCCCGA AGAACGTTTT CCAATGATGA GCACTTTTAA AGTTCTGCTA TGTGGCGCGG 361 TATTATCCCG TATTGACGCC GGGCAAGAGC AACTCGGTCG CCGCATACAC TATTCTCAGA 421 ATGACTTGGT TGAGTACTCA CCAGTCACAG AAAAGCATCT TACGGATGGC ATGACAGTAA 481 GAGAATTATG CAGTGCTGCC ATAACCATGA GTGATAACAC TGCGGCCAAC TTACTTCTGA 541 CAACGATCGG AGGACCGAAG GAGCTAACCG CTTTTTTGCA CAACATGGGG GATCATGTAA 601 CTCGCCTTGA TCGTTGGGAA CCGGAGCTGA ATGAAGCCAT ACCAAACGAC GAGCGTGACA 661 CCACGATGCC TGTAGCAATG GCAACAACGT TGCGCAAACT ATTAACTGGC GAACTACTTA 721 CTCTAGCTTC CCGGCAACAA TTAATAGACT GGATGGAGGC GGATAAAGTT GCAGGACCAC 781 TTCTGCGCTC GGCCCTTCCG GCTGGCTGGT TTATTGCTGA TAAATCTGGA GCCGGTGAGC 841 GTGGTTCTCG CGGTATCATT GCAGCACTGG GGCCAGATGG TAAGCCCTCC CGTATCGTAG 901 TTATCTACAC GACGGGGAGT CAGGCAACTA TGGATGAACG AAATAGACAG ATCGCTGAGA 961 TAGGTGCCTC ACTGATTAAG CATTGGTAAC TGTCAGACCA AGTTTACTCA TATATACTTT 1021 AGATTGATTT AAAACTTCAT TTTTAATTTA AAAGGATCTA GGTGAAGATC CTTTTTGATA 1081 ATCTCATGAC CAAAATCCCT TAACGTGAGT TTTCGTTCCA CTGAGCGTCA GACCCCGTAG 1141 AAAAGATCAA AGGATCTTCT TGAGATCCTT TTTTTCTGCG CGTAATCTGC TGCTTGCAAA 1201 CAAAAAAACC ACCGCTACCA GCGGTGGTTT GTTTGCCGGA TCAAGAGCTA CCAACTCTTT 1261 TTCCGAAGGT AACTGGCTTC AGCAGAGCGC AGATACCAAA TACTGTTCTT CTAGTGTAGC 1321 CGTAGTTAGG CCACCACTTC AAGAACTCTG TAGCACCGCC TACATACCTC GCTCTGCTAA 1381 TCCTGTTACC AGTGGCTGCT GCCAGTGGCG ATAAGTCGTG TCTTACCGGG TTGGACTCAA 1441 GACGATAGTT ACCGGATAAG GCGCAGCGGT CGGGCTGAAC GGGGGGTTCG TGCACACAGC 1501 CCAGCTTGGA GCGAACGACC TACACCGAAC TGAGATACCT ACAGCGTGAG CTATGAGAAA 1561 GCGCCACGCT TCCCGAAGGG AGAAAGGCGG ACAGGTATCC GGTAAGCGGC AGGGTCGGAA 1621 CAGGAGAGCG CACGAGGGAG CTTCCAGGGG GAAACGCCTG GTATCTTTAT AGTCCTGTCG 1681 GGTTTCGCCA CCTCTGACTT GAGCGTCGAT TTTTGTGATG CTCGTCAGGG GGGCGGAGCC 1741 TATGGAAAAA CGCCAGCAAC GCGGCCTTTT TACGGTTCCT GGCCTTTTGC TGGCCTTTTG 1801 CTCATTAGGC ACCCCAGGCT TTACCCGAAC GACCGAGCGC AGCGAGTCAG TGAGCGAGGA 1861 AGCGGAGAGC GCCCAATACG CAAGGAAACA GCTATGACCA TGTTAATGCA GCTGGCACGA 1921 CAGGTTTCCC GACTGGAAAG CGGGCAGTGA GCGGAAGGCC CATGAGGCCA GTTAATTAAG 1981 AGGTACCTTA ATTAAGGCTG CGCGCTCGCT CGCTCACTGA GGCCGCCCGG GCAAAGCCCG 2041 GGCGTCGGGC GACCTTTGGT CGCCCGGCCT CAGTGAGCGA GCGAGCGCGC AGAGAGGGAG 2101 TGGCCAACTC CATCACTAGG GGTTCCTTGT AGTTAATGAT TAACCCGCCA TGCTACTTAT 2161 CTACGTAGCC ATGCTCTAGG AAGATCGCAA TTCGCCCTTA AGCTAGCTAG TTATTAATAG 2221 TAATCAATTA CGGGGTCATT AGTTCATAGC CCATATATGG AGTTCCGCGT TACATAACTT 2281 ACGGTAAATG GCCCGCCTGG CTGACCGCCC AACGACCCCC GCCCATTGAC GTCAATAATG 2341 ACGTATGTTC CCATAGTAAC GCCAATAGGG ACTTTCCATT GACGTCAATG GGTGGAGTAT 2401 TTACGGTAAA CTGCCCACTT GGCAGTACAT CAAGTGTATC ATATGCCAAG TACGCCCCCT 2461 ATTGACGTCA ATGACGGTAA ATGGCCCGCC TGGCATTATG CCCAGTACAT GACCTTATGG 2521 GACTTTCCTA CTTGGCAGTA CATCTACGTA TTAGTCATCG CTATTACCAT GGTGATGCGG 2581 TTTTGGCAGT ACATCAATGG GCGTGGATAG CGGTTTGACT CACGGGGATT TCCAAGTCTC 2641 CACCCCATTG ACGTCAATGG GAGTTTGTTT TGGCACCAAA ATCAACGGGA CTTTCCAAAA 2701 TGTCGTAACA ACTCCGCCCC ATTGACGCAA ATGGGCGGTA GGCGTGTACG GTGGGAGGTC 2761 TATATAAGCA GAGCTGGTTT AGTGAACCGT CAGATCCTGC AGAAGTTGGT CGTGAGGCAC 2821 TGGGCAGGTA AGTATCAAGG TTACAAGACA GGTTTAAGGA GACCAATAGA AACTGGGCTT 2881 GTCGAGACAG AGAAGACTCT TGCGTTTCTG ATAGGCACCT ATTGGTCTTA CTGACATCCA 2941 CTTTGCCTTT CTCTCCACAG GTGTCCAGCG GCCGCCATGA GACTGCTGAC AGCCCTGTTC 3001 GCCTACTTCA TCGTGGCCCT GATCCTGGCC TTCAGCGTGT CCGCCAAGAG CATGCACCAC 3061 CACCATCACC ATCATCACAG CGCCTGGTCC CACCCCCAGT TCGAGAAAGA ATTATCAACA 3121 AGTTTGTACA AAAAAGCAGG CTctgaaaac ttgtactttc aaggccgatt acacctcaac 3181 aagaaggcaa ctgacaaaca gccttatagc aagctcccag gtgtctctct tctgaaacca 3241 ctgaaagggg tagatcctaa cttaatcaac aacctggaaa cattctttga attggattat 3301 cccaaatatg aagtgctcct ttgtgtacaa gatcatgatg atccagccat tgatgtatgt 3361 aagaagcttc ttggaaaata tccaaatgtt gatgctagat tgtttatagg tggcaaaaaa 3421 gttggcatta atcctaaaat taataattta atgccaggat atgaagttgc aaagtatgat 3481 cttatatgga tttgtgatag tggaataaga gtaattccag atacacttac tgacatggtg 3541 aatcaaatga cagaaaaagt aggcttggtt cacgggctgc cttacgtagc agacagacag 3601 ggctttgctg ccaccttaga gcaggtatat tttggaactt cacatccaag atactatatc 3661 tctgccaatg taactggttt caaatgtgtg acaggaatgt cttgtttaat gagaaaagat 3721 gtgttggatc aagcaggagg acttatagct tttgctcagt acattgccga agattacttt 3781 atggccaaag cgatagctga ccgaggttgg aggtttgcaa tgtccactca agttgcaatg 3841 caaaactctg gctcatattc aatttctcag tttcaatcca gaatgatcag gtggaccaaa 3901 ctacgaatta acatgcttcc tgctacaata atttgtgagc caatttcaga atgctttgtt 3961 gccagtttaa ttattggatg ggcagcccac catgtgttca gatgggatat tatggtattt 4021 ttcatgtgtc attgcctggc atggtttata tttgactaca ttcaactcag gggtgtccag 4081 ggtggcacac tgtgtttttc aaaacttgat tatgcagtcg cctggttcat ccgcgaatcc 4141 atgacaatat acattttttt gtctgcatta tgggacccaa ctataagctg gagaactggt 4201 cgctacagat tacgctgtgg gggtacagca gaggaaatcc tagatgtaTA GGACCCAGCT 4261 TTCTTGTACA AAGTGGTTGA TAGCTTGGAT CCAATCAACC TCTGGATTAC AAAATTTGTG 4321 AAAGATTGAC TGGTATTCTT AACTATGTTG CTCCTTTTAC GCTATGTGGA TACGCTGCTT 4381 TAATGCCTTT GTATCATGCT ATTGCTTCCC GTATGGCTTT CATTTTCTCC TCCTTGTATA 4441 AATCCTGGTT GCTGTCTCTT TATGAGGAGT TGTGGCCCGT TGTCAGGCAA CGTGGCGTGG 4501 TGTGCACTGT GTTTGCTGAC GCAACCCCCA CTGGTTGGGG CATTGCCACC ACCTGTCAGC 4561 TCCTTTCCGG GACTTTCGCT TTCCCCCTCC CTATTGCCAC GGCGGAACTC ATCGCCGCCT 4621 GCCTTGCCCG CTGCTGGACA GGGGCTCGGC TGTTGGGCAC TGACAATTCC GTGGTGTTGT 4681 CGGGGAAGCT GACGTCCTTT CCATGGCTGC TCGCCTGTGT TGCCACCTGG ATTCTGCGCG 4741 GGACGTCCTT CTGCTACGTC CCTTCGGCCC TCAATCCAGC GGACCTTCCT TCCCGCGGCC 4801 TGCTGCCGGC TCTGCGGCCT CTTCCGCGTC TTCGAGATCT GCCTCGACTG TGCCTTCTAG 4861 TTGCCAGCCA TCTGTTGTTT GCCCCTCCCC CGTGCCTTCC TTGACCCTGG AAGGTGCCAC 4921 TCCCACTGTC CTTTCCTAAT AAAATGAGGA AATTGCATCG CATTGTCTGA GTAGGTGTCA 4981 TTCTATTCTG GGGGGTGGGG TGGGGCAGGA CAGCAAGGGG GAGGATTGGG AAGACAATAG 5041 CAGGCATGCT GGGGACTCGA GTTAAGGGCG AATTGCCGAT TAGGATCTTC CTAGAGCATG 5101 GCTACGTAGA TAAGTAGCAT GGCGGGTTAA TCATTAACTA CAAGGAACCC CTAGTGATGG 5161 AGTTGGCCAC TCCCTCTCTG CGCGCTCGCT CGCTCACTGA GGCCGGGCGA CCAAAGGTCG 5221 CCCGACGCCC GGGCTTTGCC CGGGCGGCCT CAGTGAGCGA GCGAGCGCGC AGCCTTAATT 5281 AAGAGCTCAT GGCGCGCCTA GGCCTTGACG GCCTTCCGCC AATTCGCCCT ATAGTGAGTC 5341 GTATTACGTC GCGCTCACTG GCCGTCGTTT TACAACGTCG TGACTGGGAA AACCCTGGCG 5401 TTACCCAACT TAATCGCCTT GCAGCACATC CCCCTTTCGC CAGCTGGCGT AATAGCGAAG 5461 AGGCCCGCAC CGAAACGCCC TTCCCAACAG TTGCGCAGCC TGAATGGCGA ATGGGAGCGC 5521 CCTGTAGCGG CCACTCAACC CTATCTCGGT CTATTCTTTT GATTTATAAG GGATTTTGCC 5581 GATTTCGGCC TATTGGTTAA AAAATGAGCT GATTTAACAA AAATTTAACG CGAATTTTAA 5641 CAAAATATTA ACGCTTACAA TTTAG //