LOCUS ALG10-pGEc1-DEST 5914 bp DNA circular 23-JAN-2013 FEATURES Location/Qualifiers misc_feature complement(5392..5521) /note="3'-ITR" misc_feature complement(5090..5304) /note="BGH pA" rep_origin 1137..1804 /dnas_title="Col E1 origin" /label=Col E1 origin /vntifkey="33" CDS 129..989 /dnas_title="AmpR" /label=AmpR /vntifkey="4" misc_feature 1998..2127 /note="5'ITR" misc_feature 2208..2790 /note="CMV Promoter" misc_feature 2828..2960 /note="Artificial Intron" misc_feature 4542..5083 /note="WPRE" misc_recomb complement(2974..3001) /label=attB1 /note="attB1 site" /note="recognized as attB1" misc_recomb 4447..4469 /label=attB2 /note="attB2 site" misc_feature 4479..4502 /note="8xHis Tag" misc_feature 4506..4529 /note="StrepTag" PCR_frame 3002..4447 /note="Reading Frame" /set="Set 1" source 3006..4424 /dnas_title="ALG10-pGEc1-DEST" /organism="Homo sapiens" /mol_type="mRNA" /db_xref="taxon:9606" /clone="MGC:88353 IMAGE:3839674" /tissue_type="Brain, glioblastoma" /clone_lib="NIH_MGC_57" /lab_host="DH10B" /note="Vector: pDNR-LIB" gene 3006..4424 /dnas_title="ALG10" /gene="ALG10" /gene_synonym="DIE2" /gene_synonym="KCR1" /db_xref="GeneID:84920" /db_xref="HGNC:23162" /db_xref="MIM:603313" CDS 3006..4424 /dnas_title="ALG10 protein" /gene="ALG10" /gene_synonym="DIE2" /gene_synonym="KCR1" /codon_start=1 /product="ALG10 protein" /protein_id="AAH70347.1" /db_xref="GI:47125451" /db_xref="GeneID:84920" /db_xref="HGNC:23162" /db_xref="MIM:603313" /translation="MAQLEGYYFSAALSCTFLVSCLLFSAFSRALREPYMDEIFHLPQ AQRYCEGHFSLSQWDPMITTLPGLYLVSIGVIKPAIWIFGWSEHVVCSIGMLRFVNLL FSVGNFYLLYLLFCKVQPRNKAASSIQRVLSTLTLAVFPTLYFFNFLYYTEAGSMFFT LFAYLMCLYGNHKTSAFLGFCGFVFRQTNIIWAVFCAGNVIAQKLTEAWKTELQKKED RLPPIKGPFAEFRKILQFLLAYSMSFKNLSMLLLLTWPYILLGFLFCAFVVVNGGIVI GDRSSHEACLHFPQLFYFFSFTLFFSFPHLLSPSKIKTFLSLVWKRRILFFVVTLVSV FLVWKFTYAHKYLLADNRHYTFYVWKRVFQRYETVKYLLVPAYIFAGWSIADSLKSKS IFWNLMFFICLFTVIVPQKLLEFRYFILPYVIYRLNIPLPPTSRLICELSCYAVVNFI TFFIFLNKTFQWPNSQDIQRFMW" misc_feature 3006..4424 /note="ALG10 coding region" misc_difference 3555..3555 /dnas_title="ALG10" /gene="ALG10" /gene_synonym="DIE2" /gene_synonym="KCR1" /note="'G' in cDNA is 'A' in the human genome; amino acid difference: 'V' in cDNA, 'M' in the human genome. The chimpanzee genome agrees with the human genomic sequence and not the cDNA." misc_feature 4425..4445 /note="TEV site" PCR_primer 2992..3001 /dnas_title="GTACAAAAAAGCAGGCTCATGGAACAAGGACAGCTCTTCC" /primer="CAGCTCTTCC" /set="Set 1" /pair="Pair 1" /current=1 /original="GTACAAAAAAGCAGGCTCATGGAACAAGGACAGCTCTTCC" PCR_primer complement(3002..4454) /dnas_title="AAAGCTGGGTTTAGCAGTGAATGGTCCG" /primer="AAAGCTGGGTTTAGCAGTGAATGGTCCG" /set="Set 1" /pair="Pair 1" /current=1 /original="ACCACTTTGTACAAGAAAGCTGGGTTTAGCAGTGAATGGTCCG" PCR_product complement(2992..4454) /pair="Pair 1" /set="Set 1" /current=1 /score="1.000" vector join(4455..5914,1..2991) /source="pGEc1-DEST" /type="Destination Vector" clone 2992..4454 /source="ALG10-C-term-TEVfusion-pDONR221" /type="Entry Clone" ORIGIN 1 GTGGCACTTT TCGGGGAAAT GTGCGCGGAA CCCCTATTTG TTTATTTTTC TAAATACATT 61 CAAATATGTA TCCGCTCATG AGACAATAAC CCTGATAAAT GCTTCAATAA TATTGAAAAA 121 GGAAGAGTAT GAGTATTCAA CATTTCCGTG TCGCCCTTAT TCCCTTTTTT GCGGCATTTT 181 GCCTTCCTGT TTTTGCTCAC CCAGAAACGC TGGTGAAAGT AAAAGATGCT GAAGATCAGT 241 TGGGTGCACG AGTGGGTTAC ATCGAACTGG ATCTCAACAG CGGTAAGATC CTTGAGAGTT 301 TTCGCCCCGA AGAACGTTTT CCAATGATGA GCACTTTTAA AGTTCTGCTA TGTGGCGCGG 361 TATTATCCCG TATTGACGCC GGGCAAGAGC AACTCGGTCG CCGCATACAC TATTCTCAGA 421 ATGACTTGGT TGAGTACTCA CCAGTCACAG AAAAGCATCT TACGGATGGC ATGACAGTAA 481 GAGAATTATG CAGTGCTGCC ATAACCATGA GTGATAACAC TGCGGCCAAC TTACTTCTGA 541 CAACGATCGG AGGACCGAAG GAGCTAACCG CTTTTTTGCA CAACATGGGG GATCATGTAA 601 CTCGCCTTGA TCGTTGGGAA CCGGAGCTGA ATGAAGCCAT ACCAAACGAC GAGCGTGACA 661 CCACGATGCC TGTAGCAATG GCAACAACGT TGCGCAAACT ATTAACTGGC GAACTACTTA 721 CTCTAGCTTC CCGGCAACAA TTAATAGACT GGATGGAGGC GGATAAAGTT GCAGGACCAC 781 TTCTGCGCTC GGCCCTTCCG GCTGGCTGGT TTATTGCTGA TAAATCTGGA GCCGGTGAGC 841 GTGGTTCTCG CGGTATCATT GCAGCACTGG GGCCAGATGG TAAGCCCTCC CGTATCGTAG 901 TTATCTACAC GACGGGGAGT CAGGCAACTA TGGATGAACG AAATAGACAG ATCGCTGAGA 961 TAGGTGCCTC ACTGATTAAG CATTGGTAAC TGTCAGACCA AGTTTACTCA TATATACTTT 1021 AGATTGATTT AAAACTTCAT TTTTAATTTA AAAGGATCTA GGTGAAGATC CTTTTTGATA 1081 ATCTCATGAC CAAAATCCCT TAACGTGAGT TTTCGTTCCA CTGAGCGTCA GACCCCGTAG 1141 AAAAGATCAA AGGATCTTCT TGAGATCCTT TTTTTCTGCG CGTAATCTGC TGCTTGCAAA 1201 CAAAAAAACC ACCGCTACCA GCGGTGGTTT GTTTGCCGGA TCAAGAGCTA CCAACTCTTT 1261 TTCCGAAGGT AACTGGCTTC AGCAGAGCGC AGATACCAAA TACTGTTCTT CTAGTGTAGC 1321 CGTAGTTAGG CCACCACTTC AAGAACTCTG TAGCACCGCC TACATACCTC GCTCTGCTAA 1381 TCCTGTTACC AGTGGCTGCT GCCAGTGGCG ATAAGTCGTG TCTTACCGGG TTGGACTCAA 1441 GACGATAGTT ACCGGATAAG GCGCAGCGGT CGGGCTGAAC GGGGGGTTCG TGCACACAGC 1501 CCAGCTTGGA GCGAACGACC TACACCGAAC TGAGATACCT ACAGCGTGAG CTATGAGAAA 1561 GCGCCACGCT TCCCGAAGGG AGAAAGGCGG ACAGGTATCC GGTAAGCGGC AGGGTCGGAA 1621 CAGGAGAGCG CACGAGGGAG CTTCCAGGGG GAAACGCCTG GTATCTTTAT AGTCCTGTCG 1681 GGTTTCGCCA CCTCTGACTT GAGCGTCGAT TTTTGTGATG CTCGTCAGGG GGGCGGAGCC 1741 TATGGAAAAA CGCCAGCAAC GCGGCCTTTT TACGGTTCCT GGCCTTTTGC TGGCCTTTTG 1801 CTCATTAGGC ACCCCAGGCT TTACCCGAAC GACCGAGCGC AGCGAGTCAG TGAGCGAGGA 1861 AGCGGAGAGC GCCCAATACG CAAGGAAACA GCTATGACCA TGTTAATGCA GCTGGCACGA 1921 CAGGTTTCCC GACTGGAAAG CGGGCAGTGA GCGGAAGGCC CATGAGGCCA GTTAATTAAG 1981 AGGTACCTTA ATTAAGGCTG CGCGCTCGCT CGCTCACTGA GGCCGCCCGG GCAAAGCCCG 2041 GGCGTCGGGC GACCTTTGGT CGCCCGGCCT CAGTGAGCGA GCGAGCGCGC AGAGAGGGAG 2101 TGGCCAACTC CATCACTAGG GGTTCCTTGT AGTTAATGAT TAACCCGCCA TGCTACTTAT 2161 CTACGTAGCC ATGCTCTAGG AAGATCGCAA TTCGCCCTTA AGCTAGCTAG TTATTAATAG 2221 TAATCAATTA CGGGGTCATT AGTTCATAGC CCATATATGG AGTTCCGCGT TACATAACTT 2281 ACGGTAAATG GCCCGCCTGG CTGACCGCCC AACGACCCCC GCCCATTGAC GTCAATAATG 2341 ACGTATGTTC CCATAGTAAC GCCAATAGGG ACTTTCCATT GACGTCAATG GGTGGAGTAT 2401 TTACGGTAAA CTGCCCACTT GGCAGTACAT CAAGTGTATC ATATGCCAAG TACGCCCCCT 2461 ATTGACGTCA ATGACGGTAA ATGGCCCGCC TGGCATTATG CCCAGTACAT GACCTTATGG 2521 GACTTTCCTA CTTGGCAGTA CATCTACGTA TTAGTCATCG CTATTACCAT GGTGATGCGG 2581 TTTTGGCAGT ACATCAATGG GCGTGGATAG CGGTTTGACT CACGGGGATT TCCAAGTCTC 2641 CACCCCATTG ACGTCAATGG GAGTTTGTTT TGGCACCAAA ATCAACGGGA CTTTCCAAAA 2701 TGTCGTAACA ACTCCGCCCC ATTGACGCAA ATGGGCGGTA GGCGTGTACG GTGGGAGGTC 2761 TATATAAGCA GAGCTGGTTT AGTGAACCGT CAGATCCTGC AGAAGTTGGT CGTGAGGCAC 2821 TGGGCAGGTA AGTATCAAGG TTACAAGACA GGTTTAAGGA GACCAATAGA AACTGGGCTT 2881 GTCGAGACAG AGAAGACTCT TGCGTTTCTG ATAGGCACCT ATTGGTCTTA CTGACATCCA 2941 CTTTGCCTTT CTCTCCACAG GTGTCCAGCG GCCATCACAA GTTTGTACAA AAAAGCAGGC 3001 TCGCCatggc gcagctggaa ggttactatt tctcggccgc cttgagctgt acctttttag 3061 tatcctgcct cctcttctcc gccttcagcc gggcgttgcg agagccctac atggacgaga 3121 tcttccacct gcctcaggcg cagcgctact gtgagggcca tttctccctt tcccagtggg 3181 atcccatgat tactacatta cctggcttgt acctggtgtc aattggagtg atcaaacctg 3241 ccatttggat ctttggatgg tctgaacatg ttgtctgctc cattgggatg ctcagatttg 3301 ttaatcttct cttcagtgtt ggcaacttct atttactata tttgcttttc tgcaaggtac 3361 aacccagaaa caaggctgcc tcaagtatcc agagagtctt gtcaacatta acactagcag 3421 tatttccaac actttatttt tttaacttcc tttattatac agaagcagga tctatgtttt 3481 ttactctttt tgcgtatttg atgtgtcttt atggaaatca taaaacttca gccttccttg 3541 gattttgtgg cttcgtgttt cggcaaacaa atatcatctg ggctgtcttc tgtgcaggaa 3601 atgtcattgc acaaaagtta acggaggctt ggaaaactga gctacaaaag aaggaagaca 3661 gacttccacc tattaaagga ccatttgcag aattcagaaa aattcttcag tttcttttgg 3721 cttattccat gtcctttaaa aacttgagta tgcttttgct tctgacttgg ccctacatcc 3781 ttctgggatt tctgttttgt gcttttgtag tagttaatgg tggaattgtt attggcgatc 3841 ggagtagtca tgaagcctgt cttcattttc ctcaactatt ctactttttt tcatttactc 3901 tctttttttc ctttcctcat ctcctgtctc ctagcaaaat taagactttt ctttccttag 3961 tttggaaacg tagaattctg ttttttgtgg ttaccttagt ctctgtgttt ttagtttgga 4021 aattcactta tgctcataaa tacttgctag cagacaatag acattatact ttctatgtgt 4081 ggaaaagagt ttttcaaaga tatgaaactg taaaatattt gttagttcca gcctatatat 4141 ttgctggttg gagtatagct gactcattga aatcaaagtc aattttttgg aatttaatgt 4201 ttttcatatg cttgttcact gttatagttc ctcagaaact gctggaattt cgttacttca 4261 ttttacctta tgtcatttat aggcttaaca tacctctgcc tcccacatcc agactcattt 4321 gtgaactgag ctgctatgca gttgttaatt tcataacttt tttcatcttt ctgaacaaga 4381 cttttcagtg gccaaatagt caggacattc aaaggtttat gtgggaaaac ttgtactttc 4441 aaggctCCAG CTTTCTTGTA CAAAGTGGTG ATGGCCGCCA TCATCATCAT CATCATCATC 4501 ATGCGTGGAG CCACCCGCAG TTCGAAAAAT AATAAGGATC CAATCAACCT CTGGATTACA 4561 AAATTTGTGA AAGATTGACT GGTATTCTTA ACTATGTTGC TCCTTTTACG CTATGTGGAT 4621 ACGCTGCTTT AATGCCTTTG TATCATGCTA TTGCTTCCCG TATGGCTTTC ATTTTCTCCT 4681 CCTTGTATAA ATCCTGGTTG CTGTCTCTTT ATGAGGAGTT GTGGCCCGTT GTCAGGCAAC 4741 GTGGCGTGGT GTGCACTGTG TTTGCTGACG CAACCCCCAC TGGTTGGGGC ATTGCCACCA 4801 CCTGTCAGCT CCTTTCCGGG ACTTTCGCTT TCCCCCTCCC TATTGCCACG GCGGAACTCA 4861 TCGCCGCCTG CCTTGCCCGC TGCTGGACAG GGGCTCGGCT GTTGGGCACT GACAATTCCG 4921 TGGTGTTGTC GGGGAAGCTG ACGTCCTTTC CATGGCTGCT CGCCTGTGTT GCCACCTGGA 4981 TTCTGCGCGG GACGTCCTTC TGCTACGTCC CTTCGGCCCT CAATCCAGCG GACCTTCCTT 5041 CCCGCGGCCT GCTGCCGGCT CTGCGGCCTC TTCCGCGTCT TCGAGATCTG CCTCGACTGT 5101 GCCTTCTAGT TGCCAGCCAT CTGTTGTTTG CCCCTCCCCC GTGCCTTCCT TGACCCTGGA 5161 AGGTGCCACT CCCACTGTCC TTTCCTAATA AAATGAGGAA ATTGCATCGC ATTGTCTGAG 5221 TAGGTGTCAT TCTATTCTGG GGGGTGGGGT GGGGCAGGAC AGCAAGGGGG AGGATTGGGA 5281 AGACAATAGC AGGCATGCTG GGGACTCGAG TTAAGGGCGA ATTGCCGATT AGGATCTTCC 5341 TAGAGCATGG CTACGTAGAT AAGTAGCATG GCGGGTTAAT CATTAACTAC AAGGAACCCC 5401 TAGTGATGGA GTTGGCCACT CCCTCTCTGC GCGCTCGCTC GCTCACTGAG GCCGGGCGAC 5461 CAAAGGTCGC CCGACGCCCG GGCTTTGCCC GGGCGGCCTC AGTGAGCGAG CGAGCGCGCA 5521 GCCTTAATTA AGAGCTCATG GCGCGCCTAG GCCTTGACGG CCTTCCGCCA ATTCGCCCTA 5581 TAGTGAGTCG TATTACGTCG CGCTCACTGG CCGTCGTTTT ACAACGTCGT GACTGGGAAA 5641 ACCCTGGCGT TACCCAACTT AATCGCCTTG CAGCACATCC CCCTTTCGCC AGCTGGCGTA 5701 ATAGCGAAGA GGCCCGCACC GAAACGCCCT TCCCAACAGT TGCGCAGCCT GAATGGCGAA 5761 TGGGAGCGCC CTGTAGCGGC CACTCAACCC TATCTCGGTC TATTCTTTTG ATTTATAAGG 5821 GATTTTGCCG ATTTCGGCCT ATTGGTTAAA AAATGAGCTG ATTTAACAAA AATTTAACGC 5881 GAATTTTAAC AAAATATTAA CGCTTACAAT TTAG //