LOCUS pDONR™/Zeo DISCLAIMER Certain terms are trademarks or registered trademarks of Invitrogen Corporation. See "Intellectual Property" in the Help file for more information. FEATURES Location/Qualifiers misc_feature complement(268..295) /note="rrnB T2 transcription termination sequence (c)" misc_feature complement(427..470) /note="rrnB T1 transcription termination sequence (c)" primer_bind 537..552 /note="M13 Forward (-20) priming site" misc_recomb 570..668 /label=attL1 /note="attL1" misc_recomb complement(3029..3125) /label=attL2 /note="attL2 (c)" misc_signal complement(3140..3159) /note="T7 Promoter/priming site (c)" primer_bind 3167..3183 /note="M13 Reverse priming site" gene 3296..4105 /note="Kanamycin resistance gene" rep_origin 4226..4899 /note="pUC origin" vector join(3037..4902,1..651) /source="pDONR%99221" /type="Donor Vector" misc_feature 669..691 /note="TEV site" source 692..3028 /organism="Homo sapiens" /mol_type="mRNA" /db_xref="taxon:9606" /clone="MGC:34915 IMAGE:5110525" /tissue_type="Cervix, carcinoma" /clone_lib="NIH_MGC_12" /lab_host="DH10B" /note="Vector: pCMV-SPORT6" gene 692..3028 /gene="GCS1" /db_xref="GeneID:7841" /db_xref="MIM:601336" CDS 692..3028 /dnas_title="glucosidase I" /gene="GCS1" /codon_start=1 /product="glucosidase I" /protein_id="AAH28337.1" /db_xref="GI:62020522" /db_xref="GeneID:7841" /db_xref="MIM:601336" /translation="MARGERRRRAVPAEGVRTAERAARGGPGRRDGRGGGPRSTAGGV ALAVVVLSLALGMSGRWVLAWYRARRAVTLHSAPPVLPADSSSPAVAPDLFWGTYRPH VYFGMKTRSPKPLLTGLMWAQQGTTPGTPKLRHTCEQGDGVGPYGWEFHDGLSFGRQH IQDGALRLTTEFVKRPGGQHGGDWSWRVTVEPQDSGTSALPLVSLFFYVVTDGKEVLL PEVGAKGQLKFISGHTSELGNFRFTLLPPTSPGDTAPKYGSYNVFWTSNPGLPLLTEM VKSRLNSWFQHRPPGASPERYLGLPGSLKWEDRGPSGQGQGQFLIQQVTLKIPISIEF VFESGSAQAGGNQALPRLAGSLLTQALESHAEGFRERFEKTFQLKEKGLSSGEQVLGQ AALSGLLGGIGYFYGQGLVLPDIGVEGSEQKVDPALFPPVPLFTAVPSRSFFPRGFLW DEGFHQLVVQRWDPSLTREALGHWLGLLNADGWIGREQILGDEARARVPPEFLVQRAV HANPPTLLLPVAHMLEVGDPDDLAFLRKALPRLHAWFSWLHQSQAGPLPLSYRWRGRD PALPTLLNPKTLPSGLDDYPRASHPSVTERHLDLRCWVALGARVLTRLAEHLGEAEVA AELGPLAASLEAAESLDELHWAPELGVFADFGNHTKAVQLKPRPPQGLVRVVGRPQPQ LQYVDALGYVSLFPLLLRLLDPTSSRLGPLLDILADSRHLWSPFGLRSLAASSSFYGQ RNSEHDPPYWRGAVWLNVNYLALGALHHYGHLEGPHQARAAKLHGELRANVVGNVWRQ YQATGFLWEQYSDRDGRGMGCRPFHGWTSLVLLAMAEDY" misc_feature 692..3028 /note="GCS1 coding region" misc_difference 1229..1229 /gene="GCS1" /note="'A' in cDNA is 'G' in the human genome; amino acid difference: 'N' in cDNA, 'D' in the human genome. The chimpanzee genome agrees with the human genomic sequence and not the cDNA." misc_difference 1391..1391 /gene="GCS1" /note="'T' in cDNA is 'C' in the human genome; amino acid difference: 'S' in cDNA, 'P' in the human genome." ORIGIN 1 CTTTCCTGCG TTATCCCCTG ATTCTGTGGA TAACCGTATT ACCGCCTTTG AGTGAGCTGA 61 TACCGCTCGC CGCAGCCGAA CGACCGAGCG CAGCGAGTCA GTGAGCGAGG AAGCGGAAGA 121 GCGCCCAATA CGCAAACCGC CTCTCCCCGC GCGTTGGCCG ATTCATTAAT GCAGCTGGCA 181 CGACAGGTTT CCCGACTGGA AAGCGGGCAG TGAGCGCAAC GCAATTAATA CGCGTACCGC 241 TAGCCAGGAA GAGTTTGTAG AAACGCAAAA AGGCCATCCG TCAGGATGGC CTTCTGCTTA 301 GTTTGATGCC TGGCAGTTTA TGGCGGGCGT CCTGCCCGCC ACCCTCCGGG CCGTTGCTTC 361 ACAACGTTCA AATCCGCTCC CGGCGGATTT GTCCTACTCA GGAGAGCGTT CACCGACAAA 421 CAACAGATAA AACGAAAGGC CCAGTCTTCC GACTGAGCCT TTCGTTTTAT TTGATGCCTG 481 GCAGTTCCCT ACTCTCGCGT TAACGCTAGC ATGGATGTTT TCCCAGTCAC GACGTTGTAA 541 AACGACGGCC AGTCTTAAGC TCGGGCCCCA AATAATGATT TTATTTTGAC TGATAGTGAC 601 CTGTTCGTTG CAACACATTG ATGAGCAATG CTTTTTTATA ATGCCAACTT TGTACAAAAA 661 AGCAGGCTct gaaaacttgt actttcaagg ccgctgggtg ctggcgtggt accgtgcgcg 721 gcgggcggtc acgctgcact ccgcgcctcc tgtgttgcct gccgactcct ccagccccgc 781 cgtggccccg gacctcttct ggggaaccta ccgccctcac gtctacttcg gcatgaagac 841 ccgcagcccg aagcccctcc tcaccggact gatgtgggcg cagcagggca ccaccccggg 901 gactcctaag ctcaggcaca cgtgtgagca gggggacggt gtgggtccct atggctggga 961 gttccacgac ggcctctcct tcgggcgcca acacatccag gatggggcct taaggctcac 1021 cactgagttc gtcaagaggc ctgggggtca gcacggaggg gactggagct ggagagtgac 1081 tgtagagcct caggactcag gtacttctgc cctccctttg gtctccctgt tcttctatgt 1141 ggtgacagat ggcaaggaag tcctactacc agaggttggg gccaaggggc agttgaagtt 1201 tatcagtggg cacaccagtg aacttggtaa cttccgcttt acacttttgc caccaaccag 1261 tccaggggat acagccccca agtatggcag ctacaatgtc ttctggacct ccaacccagg 1321 actgcccctg ctgacagaga tggtaaagag tcgcctaaat agctggtttc agcatcggcc 1381 cccaggggcc tcccctgaac gctacctcgg cttgccagga tccctgaagt gggaggacag 1441 aggtccaagt gggcaagggc aggggcagtt cttgatacag caggtgaccc tgaaaattcc 1501 catttccata gagtttgtgt ttgaatcagg cagtgcccag gcaggaggaa atcaagccct 1561 gccaagactg gcaggcagtc tactgaccca ggccctggag agccatgctg aaggctttag 1621 agagcgcttt gagaagacct tccagctgaa ggagaagggc ctgagctctg gcgagcaggt 1681 tttgggtcag gctgccctca gcggcctcct tggtggaatt ggctacttct acggacaagg 1741 gctggtattg ccagacatcg gggtggaagg gtctgagcag aaggtggacc cagccctctt 1801 tccacccgta cctcttttta cagcagtgcc ctcccggtca ttcttcccac gaggcttcct 1861 ttgggatgaa ggctttcacc agctggtggt tcagcggtgg gatccctccc tcacccggga 1921 agcccttggc cactggctgg ggctgctaaa tgctgatggc tggattggga gggagcagat 1981 actgggggat gaggcccgag cccgggtgcc tccagaattc ctagtacaac gagcagtcca 2041 cgccaacccc ccaaccctac ttttgcctgt agcccatatg ctagaggttg gtgaccctga 2101 cgacttggct ttcctccgaa aggccttgcc ccgcctgcat gcctggtttt cctggctcca 2161 tcagagccag gcaggcccac tgccactatc ttaccgctgg cggggacggg accctgcctt 2221 accaacctta ctgaacccca agaccctacc ctctgggctg gatgactacc cccgggcttc 2281 acacccttca gtaaccgagc ggcacctgga cctgcgatgt tgggtggcac tgggtgcccg 2341 tgtgctgacg cggctggcag agcatctggg tgaggctgag gtagctgctg agctgggccc 2401 actggctgcc tcactggagg cagcagagag cctggatgag ctgcactggg ccccagagct 2461 aggagtcttt gcagactttg ggaaccacac aaaagcagta cagctgaagc ccaggccccc 2521 tcaggggctc gttcgggtgg tgggtcggcc ccaacctcaa ctgcagtatg tagatgctct 2581 tggctatgtc agtctttttc ccttgctgct gcgactgctg gaccccacct catcccgcct 2641 tgggcccctg ctggacattc tagccgacag ccgccatctc tggagcccct ttggtttacg 2701 ctcccttgca gcctccagct ccttttatgg ccagcgcaat tcagagcatg atccccccta 2761 ctggcggggt gctgtgtggc tcaatgtcaa ctacctggct ttgggagcac tccaccacta 2821 tgggcatctg gagggtcctc accaggctcg ggctgccaaa ctccacggtg agctccgtgc 2881 caacgtggta ggcaatgtat ggcgccagta ccaggctaca ggctttcttt gggagcagta 2941 cagtgaccgc gatgggcgag gcatgggctg ccgccctttc cacggctgga ccagccttgt 3001 cttactggcc atggctgaag actactgaCC AGCTTTCTTG TACAAAGTTG GCATTATAAG 3061 AAAGCATTGC TTATCAATTT GTTGCAACGA ACAGGTCACT ATCAGTCAAA ATAAAATCAT 3121 TATTTGCCAT CCAGCTGATA TCCCCTATAG TGAGTCGTAT TACATGGTCA TAGCTGTTTC 3181 CTGGCAGCTC TGGCCCGTGT CTCAAAATCT CTGATGTTAC ATTGCACAAG ATAAAATAAT 3241 ATCATCATGA ACAATAAAAC TGTCTGCTTA CATAAACAGT AATACAAGGG GTGTTATGAG 3301 CCATATTCAA CGGGAAACGT CGAGGCCGCG ATTAAATTCC AACATGGATG CTGATTTATA 3361 TGGGTATAAA TGGGCTCGCG ATAATGTCGG GCAATCAGGT GCGACAATCT ATCGCTTGTA 3421 TGGGAAGCCC GATGCGCCAG AGTTGTTTCT GAAACATGGC AAAGGTAGCG TTGCCAATGA 3481 TGTTACAGAT GAGATGGTCA GACTAAACTG GCTGACGGAA TTTATGCCTC TTCCGACCAT 3541 CAAGCATTTT ATCCGTACTC CTGATGATGC ATGGTTACTC ACCACTGCGA TCCCCGGAAA 3601 AACAGCATTC CAGGTATTAG AAGAATATCC TGATTCAGGT GAAAATATTG TTGATGCGCT 3661 GGCAGTGTTC CTGCGCCGGT TGCATTCGAT TCCTGTTTGT AATTGTCCTT TTAACAGCGA 3721 TCGCGTATTT CGTCTCGCTC AGGCGCAATC ACGAATGAAT AACGGTTTGG TTGATGCGAG 3781 TGATTTTGAT GACGAGCGTA ATGGCTGGCC TGTTGAACAA GTCTGGAAAG AAATGCATAA 3841 ACTTTTGCCA TTCTCACCGG ATTCAGTCGT CACTCATGGT GATTTCTCAC TTGATAACCT 3901 TATTTTTGAC GAGGGGAAAT TAATAGGTTG TATTGATGTT GGACGAGTCG GAATCGCAGA 3961 CCGATACCAG GATCTTGCCA TCCTATGGAA CTGCCTCGGT GAGTTTTCTC CTTCATTACA 4021 GAAACGGCTT TTTCAAAAAT ATGGTATTGA TAATCCTGAT ATGAATAAAT TGCAGTTTCA 4081 TTTGATGCTC GATGAGTTTT TCTAATCAGA ATTGGTTAAT TGGTTGTAAC ACTGGCAGAG 4141 CATTACGCTG ACTTGACGGG ACGGCGCAAG CTCATGACCA AAATCCCTTA ACGTGAGTTA 4201 CGCGTCGTTC CACTGAGCGT CAGACCCCGT AGAAAAGATC AAAGGATCTT CTTGAGATCC 4261 TTTTTTTCTG CGCGTAATCT GCTGCTTGCA AACAAAAAAA CCACCGCTAC CAGCGGTGGT 4321 TTGTTTGCCG GATCAAGAGC TACCAACTCT TTTTCCGAAG GTAACTGGCT TCAGCAGAGC 4381 GCAGATACCA AATACTGTTC TTCTAGTGTA GCCGTAGTTA GGCCACCACT TCAAGAACTC 4441 TGTAGCACCG CCTACATACC TCGCTCTGCT AATCCTGTTA CCAGTGGCTG CTGCCAGTGG 4501 CGATAAGTCG TGTCTTACCG GGTTGGACTC AAGACGATAG TTACCGGATA AGGCGCAGCG 4561 GTCGGGCTGA ACGGGGGGTT CGTGCACACA GCCCAGCTTG GAGCGAACGA CCTACACCGA 4621 ACTGAGATAC CTACAGCGTG AGCTATGAGA AAGCGCCACG CTTCCCGAAG GGAGAAAGGC 4681 GGACAGGTAT CCGGTAAGCG GCAGGGTCGG AACAGGAGAG CGCACGAGGG AGCTTCCAGG 4741 GGGAAACGCC TGGTATCTTT ATAGTCCTGT CGGGTTTCGC CACCTCTGAC TTGAGCGTCG 4801 ATTTTTGTGA TGCTCGTCAG GGGGGCGGAG CCTATGGAAA AACGCCAGCA ACGCGGCCTT 4861 TTTACGGTTC CTGGCCTTTT GCTGGCCTTT TGCTCACATG TT //