LOCUS pDONR™/Zeo DISCLAIMER Certain terms are trademarks or registered trademarks of Invitrogen Corporation. See "Intellectual Property" in the Help file for more information. FEATURES Location/Qualifiers misc_feature complement(268..295) /note="rrnB T2 transcription termination sequence (c)" misc_feature complement(427..470) /note="rrnB T1 transcription termination sequence (c)" primer_bind 537..552 /note="M13 Forward (-20) priming site" misc_recomb 570..668 /label=attL1 /note="attL1" misc_recomb complement(2282..2378) /label=attL2 /note="attL2 (c)" misc_signal complement(2393..2412) /note="T7 Promoter/priming site (c)" primer_bind 2420..2436 /note="M13 Reverse priming site" gene 2549..3358 /note="Kanamycin resistance gene" rep_origin 3479..4152 /note="pUC origin" vector join(2290..4155,1..651) /source="pDONR%99221" /type="Donor Vector" misc_feature 669..691 /note="TEV site" source 692..2281 /organism="Homo sapiens" /mol_type="mRNA" /db_xref="taxon:9606" /clone="MGC:129621 IMAGE:40006501" /tissue_type="PCR rescued clones" /clone_lib="NIH_MGC_283" /note="Vector: pCR-Blunt II-TOPO with reversed insert; Clone identification sequence tag: ATACAATA sequenced from the forward primer" gene 692..2281 /gene="TREH" /gene_synonym=TRE /gene_synonym=TREA /db_xref="GeneID:11181" /db_xref="HGNC:12266" /db_xref="MIM:275360" CDS 692..2281 /dnas_title="TREH protein" /gene="TREH" /gene_synonym=TRE /gene_synonym=TREA /codon_start=1 /product="TREH protein" /protein_id="AAI09207.1" /db_xref="GI:80475840" /db_xref="GeneID:11181" /db_xref="HGNC:12266" /db_xref="MIM:275360" /translation="MPGRTWELCLLLLLGLGLGSQEALPPPCESEIYCHGELLNQVQM AKLYQDDKQFVDMPLSIAPEQVLQTFTELSRDHNHSIPREQLQAFVHEHFQAKGQELQ PWTPADWKDSPQFLQKISDAKLRAWAGQLHQLWKKLGKKMKPEVLSHPERFSLIYSEH PFIVPGGRFVEFYYCYGHVPNGGRVYYLQRSQPPLLTLMMDCYLTHTNDTAFLQENIE TLALELDFWTKNRTVSVSLEGKNYLLNRYYVPYGGPRPESYSKDVELADTLPEGDREA LWAELKAGAESGWDFSSRWLIGGPNPNSLSGIRTSKLVPVDLNAFLCQAEELMSNFYS RLGNDSQATKYRILRSQRLAALNTVLWDEQTGAWFDYDLEKKKKNREFYPSNLTPLWA GCFSDPGVADKALKYLEDNRILTYQYGIPTSLQKTGQQWDFPNAWAPLQDLVIRGLAK APLRRAQEVAFQLAQNWIRTNFDVYSQKSAMYEKYDVSNGGQPGGGGEYEVQEGFGWT NGVVLMLLDRYGDRLTSGAKLAFLEPHCLAATLLPSLLLSLLPW" misc_feature 692..2281 /note="TREH coding region" misc_difference 2201..2201 /gene="TREH" /gene_synonym=TRE /gene_synonym=TREA /note="'G' in cDNA is 'C' in the human genome; amino acid difference: 'A' in cDNA, 'P' in the human genome. The chimpanzee genome agrees with the cDNA sequence, suggesting that this difference is unlikely to be due to an artifact." misc_difference 2210..2210 /gene="TREH" /gene_synonym=TRE /gene_synonym=TREA /note="'G' in cDNA is 'C' in the human genome; amino acid difference: 'A' in cDNA, 'P' in the human genome. The chimpanzee genome agrees with the cDNA sequence, suggesting that this difference is unlikely to be due to an artifact." misc_difference 2235..2235 /gene="TREH" /gene_synonym=TRE /gene_synonym=TREA /note="1 base in cDNA is not found in the human genome. The chimpanzee genome agrees with the cDNA sequence, suggesting that this difference is unlikely to be due to an artifact." misc_difference 2263..2263 /gene="TREH" /gene_synonym=TRE /gene_synonym=TREA /note="'C' in cDNA is 'A' in the human genome; no amino acid change. The chimpanzee genome agrees with the cDNA sequence, suggesting that this difference is unlikely to be due to an artifact." ORIGIN 1 CTTTCCTGCG TTATCCCCTG ATTCTGTGGA TAACCGTATT ACCGCCTTTG AGTGAGCTGA 61 TACCGCTCGC CGCAGCCGAA CGACCGAGCG CAGCGAGTCA GTGAGCGAGG AAGCGGAAGA 121 GCGCCCAATA CGCAAACCGC CTCTCCCCGC GCGTTGGCCG ATTCATTAAT GCAGCTGGCA 181 CGACAGGTTT CCCGACTGGA AAGCGGGCAG TGAGCGCAAC GCAATTAATA CGCGTACCGC 241 TAGCCAGGAA GAGTTTGTAG AAACGCAAAA AGGCCATCCG TCAGGATGGC CTTCTGCTTA 301 GTTTGATGCC TGGCAGTTTA TGGCGGGCGT CCTGCCCGCC ACCCTCCGGG CCGTTGCTTC 361 ACAACGTTCA AATCCGCTCC CGGCGGATTT GTCCTACTCA GGAGAGCGTT CACCGACAAA 421 CAACAGATAA AACGAAAGGC CCAGTCTTCC GACTGAGCCT TTCGTTTTAT TTGATGCCTG 481 GCAGTTCCCT ACTCTCGCGT TAACGCTAGC ATGGATGTTT TCCCAGTCAC GACGTTGTAA 541 AACGACGGCC AGTCTTAAGC TCGGGCCCCA AATAATGATT TTATTTTGAC TGATAGTGAC 601 CTGTTCGTTG CAACACATTG ATGAGCAATG CTTTTTTATA ATGCCAACTT TGTACAAAAA 661 AGCAGGCTct gaaaacttgt actttcaagg cctaccccca ccctgtgaga gtgagattta 721 ctgccacggg gagctcctaa accaagttca aatggccaag ctctaccagg atgacaagca 781 gtttgtggac atgccactgt ctatagctcc agaacaagtc ctgcagacct tcactgagct 841 gtccagggac cacaatcaca gcatccccag ggagcagctg caggcgtttg tccacgaaca 901 cttccaggcc aaggggcagg agctgcagcc ctggacccct gcagactgga aagacagccc 961 ccagttcctg cagaagattt cagatgccaa actgcgtgcc tgggcagggc agctgcatca 1021 gctctggaag aagctgggga agaagatgaa gccagaggtt ctcagccacc ctgagcggtt 1081 ctctctcatc tactcagaac atcccttcat tgtgcctggc ggtcgctttg ttgagttcta 1141 ctactgctat gggcatgtcc ccaatggtgg gcgcgtgtac tacctgcagc ggagccagcc 1201 cccactcttg accctcatga tggattgcta cttgactcac accaatgaca ccgcctttct 1261 acaggaaaac attgaaacac tagccttgga attggacttt tggaccaaga acaggactgt 1321 ctctgtgagc ttggagggaa agaactacct cctgaatcgc tattatgtcc cttatggggg 1381 acccaggcct gagtcctaca gcaaagatgt ggagttggct gacaccttgc cagaaggaga 1441 ccgggaggct ctgtgggctg agctcaaggc tggggctgag tctggctggg acttctcttc 1501 acgctggctc attggaggcc caaaccccaa ctcgcttagc ggcatccgaa caagcaaact 1561 ggtgcctgtt gacctgaatg ccttcctatg ccaagcagag gagctgatga gcaacttcta 1621 ttccaggctg gggaacgact cccaggccac gaagtacaga atcctgcggt cgcagcgctt 1681 ggccgccctg aacacagtcc tgtgggatga gcagaccgga gcctggttcg attacgacct 1741 tgagaagaag aagaaaaacc gggagtttta cccatccaac ctcactccac tctgggccgg 1801 gtgtttctct gaccctggcg tggcggacaa ggctctgaaa tacctggagg acaaccggat 1861 cctgacttac cagtatggga tcccgacctc tctccagaag acaggccagc agtgggattt 1921 ccccaatgcc tgggcccccc tgcaggacct ggtcatcaga ggcctggcca aggcaccttt 1981 acgtcgggcc caggaagtgg ctttccagct ggctcagaat tggatccgaa ccaattttga 2041 tgtctactcg cagaagtcag ccatgtatga gaagtatgac gtcagcaacg gtggacagcc 2101 cggtggggga ggagaatatg aagttcagga gggatttggc tggacgaatg gcgtggtcct 2161 gatgctgctg gaccgctatg gtgaccggct gacctcaggg gccaagctgg ctttcctgga 2221 gccccactgc ctggcggcca cccttctgcc cagcctcctg ctcagcctcc tgccatggtg 2281 aCCAGCTTTC TTGTACAAAG TTGGCATTAT AAGAAAGCAT TGCTTATCAA TTTGTTGCAA 2341 CGAACAGGTC ACTATCAGTC AAAATAAAAT CATTATTTGC CATCCAGCTG ATATCCCCTA 2401 TAGTGAGTCG TATTACATGG TCATAGCTGT TTCCTGGCAG CTCTGGCCCG TGTCTCAAAA 2461 TCTCTGATGT TACATTGCAC AAGATAAAAT AATATCATCA TGAACAATAA AACTGTCTGC 2521 TTACATAAAC AGTAATACAA GGGGTGTTAT GAGCCATATT CAACGGGAAA CGTCGAGGCC 2581 GCGATTAAAT TCCAACATGG ATGCTGATTT ATATGGGTAT AAATGGGCTC GCGATAATGT 2641 CGGGCAATCA GGTGCGACAA TCTATCGCTT GTATGGGAAG CCCGATGCGC CAGAGTTGTT 2701 TCTGAAACAT GGCAAAGGTA GCGTTGCCAA TGATGTTACA GATGAGATGG TCAGACTAAA 2761 CTGGCTGACG GAATTTATGC CTCTTCCGAC CATCAAGCAT TTTATCCGTA CTCCTGATGA 2821 TGCATGGTTA CTCACCACTG CGATCCCCGG AAAAACAGCA TTCCAGGTAT TAGAAGAATA 2881 TCCTGATTCA GGTGAAAATA TTGTTGATGC GCTGGCAGTG TTCCTGCGCC GGTTGCATTC 2941 GATTCCTGTT TGTAATTGTC CTTTTAACAG CGATCGCGTA TTTCGTCTCG CTCAGGCGCA 3001 ATCACGAATG AATAACGGTT TGGTTGATGC GAGTGATTTT GATGACGAGC GTAATGGCTG 3061 GCCTGTTGAA CAAGTCTGGA AAGAAATGCA TAAACTTTTG CCATTCTCAC CGGATTCAGT 3121 CGTCACTCAT GGTGATTTCT CACTTGATAA CCTTATTTTT GACGAGGGGA AATTAATAGG 3181 TTGTATTGAT GTTGGACGAG TCGGAATCGC AGACCGATAC CAGGATCTTG CCATCCTATG 3241 GAACTGCCTC GGTGAGTTTT CTCCTTCATT ACAGAAACGG CTTTTTCAAA AATATGGTAT 3301 TGATAATCCT GATATGAATA AATTGCAGTT TCATTTGATG CTCGATGAGT TTTTCTAATC 3361 AGAATTGGTT AATTGGTTGT AACACTGGCA GAGCATTACG CTGACTTGAC GGGACGGCGC 3421 AAGCTCATGA CCAAAATCCC TTAACGTGAG TTACGCGTCG TTCCACTGAG CGTCAGACCC 3481 CGTAGAAAAG ATCAAAGGAT CTTCTTGAGA TCCTTTTTTT CTGCGCGTAA TCTGCTGCTT 3541 GCAAACAAAA AAACCACCGC TACCAGCGGT GGTTTGTTTG CCGGATCAAG AGCTACCAAC 3601 TCTTTTTCCG AAGGTAACTG GCTTCAGCAG AGCGCAGATA CCAAATACTG TTCTTCTAGT 3661 GTAGCCGTAG TTAGGCCACC ACTTCAAGAA CTCTGTAGCA CCGCCTACAT ACCTCGCTCT 3721 GCTAATCCTG TTACCAGTGG CTGCTGCCAG TGGCGATAAG TCGTGTCTTA CCGGGTTGGA 3781 CTCAAGACGA TAGTTACCGG ATAAGGCGCA GCGGTCGGGC TGAACGGGGG GTTCGTGCAC 3841 ACAGCCCAGC TTGGAGCGAA CGACCTACAC CGAACTGAGA TACCTACAGC GTGAGCTATG 3901 AGAAAGCGCC ACGCTTCCCG AAGGGAGAAA GGCGGACAGG TATCCGGTAA GCGGCAGGGT 3961 CGGAACAGGA GAGCGCACGA GGGAGCTTCC AGGGGGAAAC GCCTGGTATC TTTATAGTCC 4021 TGTCGGGTTT CGCCACCTCT GACTTGAGCG TCGATTTTTG TGATGCTCGT CAGGGGGGCG 4081 GAGCCTATGG AAAAACGCCA GCAACGCGGC CTTTTTACGG TTCCTGGCCT TTTGCTGGCC 4141 TTTTGCTCAC ATGTT //