LOCUS GYG2-pGEn1-DEST 5866 bp DNA circular 21-JAN-2013 FEATURES Location/Qualifiers CDS 129..1108 /dnas_title="AmpR" /label=AmpR /vntifkey="4" rep_origin 1137..1804 /dnas_title="Col E1 origin" /label=Col E1 origin /vntifkey="33" misc_feature 1998..2127 /note="5'ITR" misc_feature 2208..2790 /note="CMV Promoter" misc_feature 2828..2960 /note="Artificial Intron" misc_feature 2977..3054 /note="TCM Sig Seq" misc_recomb complement(3114..3142) /label=attB1 /note="attB1 site" /note="recognized as attB1" misc_feature 3055..3078 /note="8xHis Tag" misc_feature 3085..3108 /note="StrepTag" misc_feature 4494..5035 /note="WPRE" misc_recomb 4456..4478 /label=attB2 /note="attB2 site" /note="recognized as attB2" misc_feature complement(5042..5256) /note="BGH pA" misc_feature complement(5344..5473) /note="3'-ITR" misc_feature 3143..3165 /note="TEV site" source 3166..4449 /dnas_title="GYG2-pGEn1-DEST" /organism="Homo sapiens" /mol_type="mRNA" /db_xref="taxon:9606" /clone="MGC:9153 IMAGE:3923041" /tissue_type="Skin, melanotic melanoma." /clone_lib="NIH_MGC_72" /lab_host="DH10B" /note="Vector: pCMV-SPORT6" gene 3166..4449 /dnas_title="GYG2" /gene="GYG2" /gene_synonym="GN-2" /gene_synonym="GN2" /db_xref="GeneID:8908" /db_xref="HGNC:4700" /db_xref="MIM:300198" CDS 3166..4449 /dnas_title="glycogenin 2" /gene="GYG2" /gene_synonym="GN-2" /gene_synonym="GN2" /codon_start=1 /product="glycogenin 2" /protein_id="AAH23152.1" /db_xref="GI:18605503" /db_xref="GeneID:8908" /db_xref="HGNC:4700" /db_xref="MIM:300198" /translation="MSVTDQAFVTLATNDIYCQGALVLGQSLRRHRLTRKLVVLITPQ VSSLLRVILSKVFDEVIEVNLIDSADYIHLAFLKRPELGLTLTKLHCWTLTHYSKCVF LDADTLVLSNVDELFDRGEFSAAPDPGWPDCFNSGVFVFQPSLHTHKLLLQHAMEHGS FDGADQGLLNSFFRNWSTTDIHKHLPFIYNLSSNTMYTYSPAFKQFGSSAKVVHFLGS MKPWNYKYNPQSGSVLEQGSVSSSQHQAAFLHLWWTVYQNNVLPLYKSVQAGEARASP GHTLCRSDVGGPCADSASGVGEPCENSTPSAGVPCANSPLGSNQPAQGLPEPTQIVDE TLSLPEGRRSEDMIACPETETPAVITCDPLSQPSPQPADFTETETILQPANKVESVSS EETFEPSQELPAEALRDPSLQDALEVDLAVSVSQISIEEKVKELSPEEERRKWEEGRI DYMGKDAFARIQEKLDRFLQ" misc_feature 3166..4449 /note="GYG2 coding region" misc_difference 3755..3755 /dnas_title="GYG2" /gene="GYG2" /gene_synonym="GN-2" /gene_synonym="GN2" /note="'T' in cDNA is 'C' in the human genome; amino acid difference: 'V' in cDNA, 'A' in the human genome. The chimpanzee genome agrees with the human genomic sequence and not the cDNA." misc_difference 3884..3884 /dnas_title="GYG2" /gene="GYG2" /gene_synonym="GN-2" /gene_synonym="GN2" /note="'G' in cDNA is 'A' in the human genome; amino acid difference: 'R' in cDNA, 'H' in the human genome." vector join(4464..5866,1..3132) /source="pGEn1-DEST" /type="Destination Vector" clone 3133..4463 /source="GYG2-Nterm-TEVfusion-pDONR221" /type="Entry Clone" ORIGIN 1 GTGGCACTTT TCGGGGAAAT GTGCGCGGAA CCCCTATTTG TTTATTTTTC TAAATACATT 61 CAAATATGTA TCCGCTCATG AGACAATAAC CCTGATAAAT GCTTCAATAA TATTGAAAAA 121 GGAAGAGTAT GAGTATTCAA CATTTCCGTG TCGCCCTTAT TCCCTTTTTT GCGGCATTTT 181 GCCTTCCTGT TTTTGCTCAC CCAGAAACGC TGGTGAAAGT AAAAGATGCT GAAGATCAGT 241 TGGGTGCACG AGTGGGTTAC ATCGAACTGG ATCTCAACAG CGGTAAGATC CTTGAGAGTT 301 TTCGCCCCGA AGAACGTTTT CCAATGATGA GCACTTTTAA AGTTCTGCTA TGTGGCGCGG 361 TATTATCCCG TATTGACGCC GGGCAAGAGC AACTCGGTCG CCGCATACAC TATTCTCAGA 421 ATGACTTGGT TGAGTACTCA CCAGTCACAG AAAAGCATCT TACGGATGGC ATGACAGTAA 481 GAGAATTATG CAGTGCTGCC ATAACCATGA GTGATAACAC TGCGGCCAAC TTACTTCTGA 541 CAACGATCGG AGGACCGAAG GAGCTAACCG CTTTTTTGCA CAACATGGGG GATCATGTAA 601 CTCGCCTTGA TCGTTGGGAA CCGGAGCTGA ATGAAGCCAT ACCAAACGAC GAGCGTGACA 661 CCACGATGCC TGTAGCAATG GCAACAACGT TGCGCAAACT ATTAACTGGC GAACTACTTA 721 CTCTAGCTTC CCGGCAACAA TTAATAGACT GGATGGAGGC GGATAAAGTT GCAGGACCAC 781 TTCTGCGCTC GGCCCTTCCG GCTGGCTGGT TTATTGCTGA TAAATCTGGA GCCGGTGAGC 841 GTGGTTCTCG CGGTATCATT GCAGCACTGG GGCCAGATGG TAAGCCCTCC CGTATCGTAG 901 TTATCTACAC GACGGGGAGT CAGGCAACTA TGGATGAACG AAATAGACAG ATCGCTGAGA 961 TAGGTGCCTC ACTGATTAAG CATTGGTAAC TGTCAGACCA AGTTTACTCA TATATACTTT 1021 AGATTGATTT AAAACTTCAT TTTTAATTTA AAAGGATCTA GGTGAAGATC CTTTTTGATA 1081 ATCTCATGAC CAAAATCCCT TAACGTGAGT TTTCGTTCCA CTGAGCGTCA GACCCCGTAG 1141 AAAAGATCAA AGGATCTTCT TGAGATCCTT TTTTTCTGCG CGTAATCTGC TGCTTGCAAA 1201 CAAAAAAACC ACCGCTACCA GCGGTGGTTT GTTTGCCGGA TCAAGAGCTA CCAACTCTTT 1261 TTCCGAAGGT AACTGGCTTC AGCAGAGCGC AGATACCAAA TACTGTTCTT CTAGTGTAGC 1321 CGTAGTTAGG CCACCACTTC AAGAACTCTG TAGCACCGCC TACATACCTC GCTCTGCTAA 1381 TCCTGTTACC AGTGGCTGCT GCCAGTGGCG ATAAGTCGTG TCTTACCGGG TTGGACTCAA 1441 GACGATAGTT ACCGGATAAG GCGCAGCGGT CGGGCTGAAC GGGGGGTTCG TGCACACAGC 1501 CCAGCTTGGA GCGAACGACC TACACCGAAC TGAGATACCT ACAGCGTGAG CTATGAGAAA 1561 GCGCCACGCT TCCCGAAGGG AGAAAGGCGG ACAGGTATCC GGTAAGCGGC AGGGTCGGAA 1621 CAGGAGAGCG CACGAGGGAG CTTCCAGGGG GAAACGCCTG GTATCTTTAT AGTCCTGTCG 1681 GGTTTCGCCA CCTCTGACTT GAGCGTCGAT TTTTGTGATG CTCGTCAGGG GGGCGGAGCC 1741 TATGGAAAAA CGCCAGCAAC GCGGCCTTTT TACGGTTCCT GGCCTTTTGC TGGCCTTTTG 1801 CTCATTAGGC ACCCCAGGCT TTACCCGAAC GACCGAGCGC AGCGAGTCAG TGAGCGAGGA 1861 AGCGGAGAGC GCCCAATACG CAAGGAAACA GCTATGACCA TGTTAATGCA GCTGGCACGA 1921 CAGGTTTCCC GACTGGAAAG CGGGCAGTGA GCGGAAGGCC CATGAGGCCA GTTAATTAAG 1981 AGGTACCTTA ATTAAGGCTG CGCGCTCGCT CGCTCACTGA GGCCGCCCGG GCAAAGCCCG 2041 GGCGTCGGGC GACCTTTGGT CGCCCGGCCT CAGTGAGCGA GCGAGCGCGC AGAGAGGGAG 2101 TGGCCAACTC CATCACTAGG GGTTCCTTGT AGTTAATGAT TAACCCGCCA TGCTACTTAT 2161 CTACGTAGCC ATGCTCTAGG AAGATCGCAA TTCGCCCTTA AGCTAGCTAG TTATTAATAG 2221 TAATCAATTA CGGGGTCATT AGTTCATAGC CCATATATGG AGTTCCGCGT TACATAACTT 2281 ACGGTAAATG GCCCGCCTGG CTGACCGCCC AACGACCCCC GCCCATTGAC GTCAATAATG 2341 ACGTATGTTC CCATAGTAAC GCCAATAGGG ACTTTCCATT GACGTCAATG GGTGGAGTAT 2401 TTACGGTAAA CTGCCCACTT GGCAGTACAT CAAGTGTATC ATATGCCAAG TACGCCCCCT 2461 ATTGACGTCA ATGACGGTAA ATGGCCCGCC TGGCATTATG CCCAGTACAT GACCTTATGG 2521 GACTTTCCTA CTTGGCAGTA CATCTACGTA TTAGTCATCG CTATTACCAT GGTGATGCGG 2581 TTTTGGCAGT ACATCAATGG GCGTGGATAG CGGTTTGACT CACGGGGATT TCCAAGTCTC 2641 CACCCCATTG ACGTCAATGG GAGTTTGTTT TGGCACCAAA ATCAACGGGA CTTTCCAAAA 2701 TGTCGTAACA ACTCCGCCCC ATTGACGCAA ATGGGCGGTA GGCGTGTACG GTGGGAGGTC 2761 TATATAAGCA GAGCTGGTTT AGTGAACCGT CAGATCCTGC AGAAGTTGGT CGTGAGGCAC 2821 TGGGCAGGTA AGTATCAAGG TTACAAGACA GGTTTAAGGA GACCAATAGA AACTGGGCTT 2881 GTCGAGACAG AGAAGACTCT TGCGTTTCTG ATAGGCACCT ATTGGTCTTA CTGACATCCA 2941 CTTTGCCTTT CTCTCCACAG GTGTCCAGCG GCCGCCATGA GACTGCTGAC AGCCCTGTTC 3001 GCCTACTTCA TCGTGGCCCT GATCCTGGCC TTCAGCGTGT CCGCCAAGAG CATGCACCAC 3061 CACCATCACC ATCATCACAG CGCCTGGTCC CACCCCCAGT TCGAGAAAGA ATTATCAACA 3121 AGTTTGTACA AAAAAGCAGG CTctgaaaac ttgtactttc aaggccctca ggtgtccagc 3181 ctgctcaggg tcatcctctc gaaggtgttc gatgaagtca ttgaagtgaa tctaatcgat 3241 agtgccgact acatccacct ggcctttctg aagagacctg agctcgggct caccctcacc 3301 aagcttcact gttggactct cactcactac agcaagtgtg tcttcctgga tgcagacact 3361 ctggtgctgt ccaatgtcga tgagctgttt gacaggggag agttttctgc ggccccggac 3421 cccggatggc cggattgctt caatagcggg gtgtttgtct tccagccttc tctccacacg 3481 cataaactcc tgctacagca cgccatggaa cacggcagct ttgacggggc agaccaaggc 3541 ttactgaata gtttcttcag gaactggtcg accacagaca tccacaagca cctgccgttc 3601 atctataact tgagtagtaa cacgatgtac acttacagcc ctgccttcaa gcaattcggt 3661 tccagtgcaa aggtcgtcca ctttttgggg tccatgaaac cttggaacta caagtacaat 3721 ccacagagtg gctcggtgtt ggagcaaggc tcagtgtcca gcagccagca ccaggcggca 3781 ttccttcatc tctggtggac ggtctaccag aacaacgtgc tgccccttta taaaagcgtc 3841 caagcggggg aagcacgcgc gtctcctggt cacacacttt gccgcagtga tgtggggggg 3901 ccgtgtgcgg attcagcctc tggtgttgga gagccgtgtg aaaattcaac acccagtgcg 3961 ggcgtgccgt gtgcaaattc accactgggt tctaaccagc ctgctcaggg ccttccggag 4021 ccgacccaga tagtggatga gaccctgtcc ctacctgaag gacgccgttc agaagatatg 4081 atagcttgtc ctgaaactga gactcctgcc gtgataacgt gtgacccact gtcccagcct 4141 tcccctcagc ctgcagactt cacagagact gaaaccatct tgcagccagc aaataaagtc 4201 gaaagtgtct catccgagga aaccttcgaa ccaagccagg aactccctgc tgaggctctc 4261 agggacccca gtctgcagga tgcactggag gtcgacctgg ccgtctctgt ttcccagatc 4321 tccatcgaag agaaggtgaa ggaattgagc cccgaggaag agaggaggaa gtgggaggaa 4381 ggccgtatcg actacatggg gaaggacgcg tttgctcgca tccaggagaa gctggaccgg 4441 ttcctgcagT AGGACCCAGC TTTCTTGTAC AAAGTGGTTG ATAGCTTGGA TCCAATCAAC 4501 CTCTGGATTA CAAAATTTGT GAAAGATTGA CTGGTATTCT TAACTATGTT GCTCCTTTTA 4561 CGCTATGTGG ATACGCTGCT TTAATGCCTT TGTATCATGC TATTGCTTCC CGTATGGCTT 4621 TCATTTTCTC CTCCTTGTAT AAATCCTGGT TGCTGTCTCT TTATGAGGAG TTGTGGCCCG 4681 TTGTCAGGCA ACGTGGCGTG GTGTGCACTG TGTTTGCTGA CGCAACCCCC ACTGGTTGGG 4741 GCATTGCCAC CACCTGTCAG CTCCTTTCCG GGACTTTCGC TTTCCCCCTC CCTATTGCCA 4801 CGGCGGAACT CATCGCCGCC TGCCTTGCCC GCTGCTGGAC AGGGGCTCGG CTGTTGGGCA 4861 CTGACAATTC CGTGGTGTTG TCGGGGAAGC TGACGTCCTT TCCATGGCTG CTCGCCTGTG 4921 TTGCCACCTG GATTCTGCGC GGGACGTCCT TCTGCTACGT CCCTTCGGCC CTCAATCCAG 4981 CGGACCTTCC TTCCCGCGGC CTGCTGCCGG CTCTGCGGCC TCTTCCGCGT CTTCGAGATC 5041 TGCCTCGACT GTGCCTTCTA GTTGCCAGCC ATCTGTTGTT TGCCCCTCCC CCGTGCCTTC 5101 CTTGACCCTG GAAGGTGCCA CTCCCACTGT CCTTTCCTAA TAAAATGAGG AAATTGCATC 5161 GCATTGTCTG AGTAGGTGTC ATTCTATTCT GGGGGGTGGG GTGGGGCAGG ACAGCAAGGG 5221 GGAGGATTGG GAAGACAATA GCAGGCATGC TGGGGACTCG AGTTAAGGGC GAATTGCCGA 5281 TTAGGATCTT CCTAGAGCAT GGCTACGTAG ATAAGTAGCA TGGCGGGTTA ATCATTAACT 5341 ACAAGGAACC CCTAGTGATG GAGTTGGCCA CTCCCTCTCT GCGCGCTCGC TCGCTCACTG 5401 AGGCCGGGCG ACCAAAGGTC GCCCGACGCC CGGGCTTTGC CCGGGCGGCC TCAGTGAGCG 5461 AGCGAGCGCG CAGCCTTAAT TAAGAGCTCA TGGCGCGCCT AGGCCTTGAC GGCCTTCCGC 5521 CAATTCGCCC TATAGTGAGT CGTATTACGT CGCGCTCACT GGCCGTCGTT TTACAACGTC 5581 GTGACTGGGA AAACCCTGGC GTTACCCAAC TTAATCGCCT TGCAGCACAT CCCCCTTTCG 5641 CCAGCTGGCG TAATAGCGAA GAGGCCCGCA CCGAAACGCC CTTCCCAACA GTTGCGCAGC 5701 CTGAATGGCG AATGGGAGCG CCCTGTAGCG GCCACTCAAC CCTATCTCGG TCTATTCTTT 5761 TGATTTATAA GGGATTTTGC CGATTTCGGC CTATTGGTTA AAAAATGAGC TGATTTAACA 5821 AAAATTTAAC GCGAATTTTA ACAAAATATT AACGCTTACA ATTTAG //