LOCUS pDONR™/Zeo DISCLAIMER Certain terms are trademarks or registered trademarks of Invitrogen Corporation. See "Intellectual Property" in the Help file for more information. FEATURES Location/Qualifiers misc_feature complement(268..295) /note="rrnB T2 transcription termination sequence (c)" misc_feature complement(427..470) /note="rrnB T1 transcription termination sequence (c)" primer_bind 537..552 /note="M13 Forward (-20) priming site" misc_recomb 570..668 /label=attL1 /note="attL1" misc_recomb complement(2657..2753) /label=attL2 /note="attL2 (c)" misc_signal complement(2768..2787) /note="T7 Promoter/priming site (c)" primer_bind 2795..2811 /note="M13 Reverse priming site" gene 2924..3733 /note="Kanamycin resistance gene" rep_origin 3854..4527 /note="pUC origin" vector join(2665..4530,1..651) /source="pDONR%99221" /type="Donor Vector" misc_feature 669..691 /note="TEV site" source 692..2656 /organism="Homo sapiens" /mol_type="mRNA" /db_xref="taxon:9606" /clone="MGC:2315 IMAGE:2988086" /tissue_type="Colon, adenocarcinoma" /clone_lib="NIH_MGC_15" /lab_host="DH10B-R" /note="Vector: pOTB7" gene 692..2656 /gene="GLB1" /db_xref="GeneID:2720" /db_xref="HGNC:4298" /db_xref="MIM:230500" CDS 692..2656 /dnas_title="galactosidase, beta 1" /gene="GLB1" /codon_start=1 /product="galactosidase, beta 1" /protein_id="AAH07493.1" /db_xref="GI:13960104" /db_xref="GeneID:2720" /db_xref="HGNC:4298" /db_xref="MIM:230500" /translation="MPGFLVRILLLLLVLLLLGPTRGLRNATQRMFEIDYSRDSFLKD GQPFRYISGSIHYSRVPRFYWKDRLLKMKMAGLNAIQTYVPWNFHEPWPGQYQFSEDH DVEYFLRLAHELGLLVILRPGPYICAEWEMGGLPAWLLEKESILLRSSDPDYLAAVDK WLGVLLPKMKPLLYQNGGPVITVQVENEYGSYFACDFDYLRFLQKRFRHHLGDDVVLF TTDGAHKTFLKCGALQGLYTTVDFGTGSNITDAFLSQRKCEPKGPLINSEFYTGWLDH WGQPHSTIKTEAVASSLYDILARGASVNLYMFIGGTNFAYWNGANSPYAAQPTSYDYD APLSEAGDLTEKYFALRNIIQKFEKVPEGPIPPSTPKFAYGKVTLEKLKTVGAALDIL CPSGPIKSLYPLTFIQVKQHYGFVLYRTTLPQDCSNPAPLSSPLNGVHDRAYVAVDGI PQGVLERNNVITLNITGKAGATLDLLVENMGRVNYGAYINDFKGLVSNLTLSSNILTD WTIFPLDTEDAVRSHLGGWGHRDSGHHDEAWAHNSSNYTLPAFYMGNFSIPSGIPDLP QDTFIQFPGWTKGQVWINGFNLGRYWPARGPQLTLFVPQHILMTSAPNTITVLELEWA PCSSDDPELCAVTFVDRPVIGSSVTYDHPSKPVEKRLMPPPPQKNKDSWLDHV" misc_feature 692..2656 /note="GLB1 coding region" misc_difference 2183..2183 /gene="GLB1" /note="'C' in cDNA is 'T' in the human genome; amino acid difference: 'R' in cDNA, 'C' in the human genome." ORIGIN 1 CTTTCCTGCG TTATCCCCTG ATTCTGTGGA TAACCGTATT ACCGCCTTTG AGTGAGCTGA 61 TACCGCTCGC CGCAGCCGAA CGACCGAGCG CAGCGAGTCA GTGAGCGAGG AAGCGGAAGA 121 GCGCCCAATA CGCAAACCGC CTCTCCCCGC GCGTTGGCCG ATTCATTAAT GCAGCTGGCA 181 CGACAGGTTT CCCGACTGGA AAGCGGGCAG TGAGCGCAAC GCAATTAATA CGCGTACCGC 241 TAGCCAGGAA GAGTTTGTAG AAACGCAAAA AGGCCATCCG TCAGGATGGC CTTCTGCTTA 301 GTTTGATGCC TGGCAGTTTA TGGCGGGCGT CCTGCCCGCC ACCCTCCGGG CCGTTGCTTC 361 ACAACGTTCA AATCCGCTCC CGGCGGATTT GTCCTACTCA GGAGAGCGTT CACCGACAAA 421 CAACAGATAA AACGAAAGGC CCAGTCTTCC GACTGAGCCT TTCGTTTTAT TTGATGCCTG 481 GCAGTTCCCT ACTCTCGCGT TAACGCTAGC ATGGATGTTT TCCCAGTCAC GACGTTGTAA 541 AACGACGGCC AGTCTTAAGC TCGGGCCCCA AATAATGATT TTATTTTGAC TGATAGTGAC 601 CTGTTCGTTG CAACACATTG ATGAGCAATG CTTTTTTATA ATGCCAACTT TGTACAAAAA 661 AGCAGGCTct gaaaacttgt actttcaagg cttgcgcaat gccacccaga ggatgtttga 721 aattgactat agccgggact ccttcctcaa ggatggccag ccatttcgct acatctcagg 781 aagcattcac tactcccgtg tgccccgctt ctactggaag gaccggctgc tgaagatgaa 841 gatggctggg ctgaacgcca tccagacgta tgtgccctgg aactttcatg agccctggcc 901 aggacagtac cagttttctg aggaccatga tgtggaatat tttcttcggc tggctcatga 961 gctgggactg ctggttatcc tgaggcccgg gccctacatc tgtgcagagt gggaaatggg 1021 aggattacct gcttggctgc tagagaaaga gtctattctt ctccgctcct ccgacccaga 1081 ttacctggca gctgtggaca agtggttggg agtccttctg cccaagatga agcctctcct 1141 ctatcagaat ggagggccag ttataacagt gcaggttgaa aatgaatatg gcagctactt 1201 tgcctgtgat tttgactacc tgcgcttcct gcagaagcgc tttcgccacc atctggggga 1261 tgatgtggtt ctgtttacca ctgatggagc acataaaaca ttcctgaaat gtggggccct 1321 gcagggcctc tacaccacgg tggactttgg aacaggcagc aacatcacag atgctttcct 1381 aagccagagg aagtgtgagc ccaaaggacc cttgatcaat tctgaattct atactggctg 1441 gctagatcac tggggccaac ctcactccac aatcaagacc gaagcagtgg cttcctccct 1501 ctatgatata cttgcccgtg gggcgagtgt gaacttgtac atgtttatag gtgggaccaa 1561 ttttgcctat tggaatgggg ccaactcacc ctatgcagca cagcccacca gctacgacta 1621 tgatgcccca ctgagtgagg ctggggacct cactgagaag tattttgctc tgcgaaacat 1681 catccagaag tttgaaaaag taccagaagg tcctatccct ccatctacac caaagtttgc 1741 atatggaaag gtcactttgg aaaagttaaa gacagtggga gcagctctgg acattctgtg 1801 tccctctggg cccatcaaaa gcctttatcc cttgacattt atccaggtga aacagcatta 1861 tgggtttgtg ctgtaccgga caacacttcc tcaagattgc agcaacccag cacctctctc 1921 ttcacccctc aatggagtcc acgatcgagc atatgttgct gtggatggga tcccccaggg 1981 agtccttgag cgaaacaatg tgatcactct gaacataaca gggaaagctg gagccactct 2041 ggaccttctg gtagagaaca tgggacgtgt gaactatggt gcatatatca acgattttaa 2101 gggtttggtt tctaacctga ctctcagttc caatatcctc acggactgga cgatctttcc 2161 actggacact gaggatgcag tgcgcagcca cctggggggc tggggacacc gtgacagtgg 2221 ccaccatgat gaagcctggg cccacaactc atccaactac acgctcccgg ccttttatat 2281 ggggaacttc tccattccca gtgggatccc agacttgccc caggacacct ttatccagtt 2341 tcctggatgg accaagggcc aggtctggat taatggcttt aaccttggcc gctattggcc 2401 agcccggggc cctcagttga ccttgtttgt gccccagcac atcctgatga cctcggcccc 2461 aaacaccatc accgtgctgg aactggagtg ggcaccctgc agcagtgatg atccagaact 2521 atgtgctgtg acgttcgtgg acaggccagt tattggctca tctgtgacct acgatcatcc 2581 ctccaaacct gttgaaaaaa gactcatgcc cccacccccg caaaaaaaca aagattcatg 2641 gctggaccat gtatgaCCAG CTTTCTTGTA CAAAGTTGGC ATTATAAGAA AGCATTGCTT 2701 ATCAATTTGT TGCAACGAAC AGGTCACTAT CAGTCAAAAT AAAATCATTA TTTGCCATCC 2761 AGCTGATATC CCCTATAGTG AGTCGTATTA CATGGTCATA GCTGTTTCCT GGCAGCTCTG 2821 GCCCGTGTCT CAAAATCTCT GATGTTACAT TGCACAAGAT AAAATAATAT CATCATGAAC 2881 AATAAAACTG TCTGCTTACA TAAACAGTAA TACAAGGGGT GTTATGAGCC ATATTCAACG 2941 GGAAACGTCG AGGCCGCGAT TAAATTCCAA CATGGATGCT GATTTATATG GGTATAAATG 3001 GGCTCGCGAT AATGTCGGGC AATCAGGTGC GACAATCTAT CGCTTGTATG GGAAGCCCGA 3061 TGCGCCAGAG TTGTTTCTGA AACATGGCAA AGGTAGCGTT GCCAATGATG TTACAGATGA 3121 GATGGTCAGA CTAAACTGGC TGACGGAATT TATGCCTCTT CCGACCATCA AGCATTTTAT 3181 CCGTACTCCT GATGATGCAT GGTTACTCAC CACTGCGATC CCCGGAAAAA CAGCATTCCA 3241 GGTATTAGAA GAATATCCTG ATTCAGGTGA AAATATTGTT GATGCGCTGG CAGTGTTCCT 3301 GCGCCGGTTG CATTCGATTC CTGTTTGTAA TTGTCCTTTT AACAGCGATC GCGTATTTCG 3361 TCTCGCTCAG GCGCAATCAC GAATGAATAA CGGTTTGGTT GATGCGAGTG ATTTTGATGA 3421 CGAGCGTAAT GGCTGGCCTG TTGAACAAGT CTGGAAAGAA ATGCATAAAC TTTTGCCATT 3481 CTCACCGGAT TCAGTCGTCA CTCATGGTGA TTTCTCACTT GATAACCTTA TTTTTGACGA 3541 GGGGAAATTA ATAGGTTGTA TTGATGTTGG ACGAGTCGGA ATCGCAGACC GATACCAGGA 3601 TCTTGCCATC CTATGGAACT GCCTCGGTGA GTTTTCTCCT TCATTACAGA AACGGCTTTT 3661 TCAAAAATAT GGTATTGATA ATCCTGATAT GAATAAATTG CAGTTTCATT TGATGCTCGA 3721 TGAGTTTTTC TAATCAGAAT TGGTTAATTG GTTGTAACAC TGGCAGAGCA TTACGCTGAC 3781 TTGACGGGAC GGCGCAAGCT CATGACCAAA ATCCCTTAAC GTGAGTTACG CGTCGTTCCA 3841 CTGAGCGTCA GACCCCGTAG AAAAGATCAA AGGATCTTCT TGAGATCCTT TTTTTCTGCG 3901 CGTAATCTGC TGCTTGCAAA CAAAAAAACC ACCGCTACCA GCGGTGGTTT GTTTGCCGGA 3961 TCAAGAGCTA CCAACTCTTT TTCCGAAGGT AACTGGCTTC AGCAGAGCGC AGATACCAAA 4021 TACTGTTCTT CTAGTGTAGC CGTAGTTAGG CCACCACTTC AAGAACTCTG TAGCACCGCC 4081 TACATACCTC GCTCTGCTAA TCCTGTTACC AGTGGCTGCT GCCAGTGGCG ATAAGTCGTG 4141 TCTTACCGGG TTGGACTCAA GACGATAGTT ACCGGATAAG GCGCAGCGGT CGGGCTGAAC 4201 GGGGGGTTCG TGCACACAGC CCAGCTTGGA GCGAACGACC TACACCGAAC TGAGATACCT 4261 ACAGCGTGAG CTATGAGAAA GCGCCACGCT TCCCGAAGGG AGAAAGGCGG ACAGGTATCC 4321 GGTAAGCGGC AGGGTCGGAA CAGGAGAGCG CACGAGGGAG CTTCCAGGGG GAAACGCCTG 4381 GTATCTTTAT AGTCCTGTCG GGTTTCGCCA CCTCTGACTT GAGCGTCGAT TTTTGTGATG 4441 CTCGTCAGGG GGGCGGAGCC TATGGAAAAA CGCCAGCAAC GCGGCCTTTT TACGGTTCCT 4501 GGCCTTTTGC TGGCCTTTTG CTCACATGTT //