LOCUS NEU2-pGEn2-DEST 6444 bp DNA circular 24-JAN-2013 FEATURES Location/Qualifiers CDS 129..1108 /dnas_title="AmpR" /label=AmpR /vntifkey="4" rep_origin 1137..1804 /dnas_title="Col E1 origin" /label=Col E1 origin /vntifkey="33" misc_feature 1998..2127 /note="5'ITR" misc_feature 2208..2790 /note="CMV Promoter" misc_feature 2828..2960 /note="Artificial Intron" misc_recomb complement(3839..3867) /label=attB1 /note="attB1 site" /note="recognized as attB1" misc_feature 5072..5613 /note="WPRE" misc_recomb 5034..5056 /label=attB2 /note="attB2 site" misc_feature complement(5620..5834) /note="BGH pA" misc_feature complement(5922..6051) /note="3'-ITR" misc_feature 2982..3056 /note="TCM signal sequence" misc_feature 3060..3083 /note="His tag" misc_feature 3084..3134 /note="AviTag" misc_feature 3135..3830 /note="Superfolder GFP" misc_feature 2976..2981 /note="Kozak seq" misc_feature 3868..3890 /note="TEV site" source 3891..5033 /dnas_title="NEU2-pGEn2-DEST" /organism="Homo sapiens" /mol_type="mRNA" /db_xref="taxon:9606" /clone="MGC:95436 IMAGE:7217011" /tissue_type="Synthetic constructs" /clone_lib="NIH_MGC_243" /lab_host="TOP10" /note="Vector: pCR Blunt II TOPO" gene 3891..5033 /dnas_title="NEU2" /gene="NEU2" /gene_synonym="SIAL2" /db_xref="GeneID:4759" /db_xref="HGNC:7759" /db_xref="MIM:605528" CDS 3891..5033 /dnas_title="sialidase 2 (cytosolic sialidase)" /gene="NEU2" /gene_synonym="SIAL2" /codon_start=1 /product="sialidase 2 (cytosolic sialidase)" /protein_id="AAH69151.1" /db_xref="GI:46575656" /db_xref="GeneID:4759" /db_xref="HGNC:7759" /db_xref="MIM:605528" /translation="MASLPVLQKESVFQSGAHAYRIPALLYLPGQQSLLAFAEQRASK KDEHAELIVLRRGDYDAPTHQVQWQAQEVVAQARLDGHRSMNPCPLYDAQTGTLFLFF IAIPGQVTEQQQLQTRANVTRLCQVTSTDHGRTWSSPRDLTDAAIGPAYREWSTFAVG PGHCLQLHDRARSLVVPAYAYRKLHPIQRPIPSAFCFLSHDHGRTWARGHFVAQDTLE CQVAEVETGEQRVVTLNARSHLRARVQAQSTNDGLDFQESQLVKKLVEPPPQGCQGSV ISFPSPRSGPGSPAQWLLYTHPTHSWQRADLGAYLNPRPPAPEAWSEPVLLAKGSCAY SDLQSMGTGPDGSPLFGCLYEANDYEEIVFLMFTLKQAFPAEYLPQ" misc_feature 3891..5033 /dnas_title="NEU2" /gene="NEU2" /gene_synonym="SIAL2" /note="; This cDNA sequence aligns to the human reference genome (build 36) without differences" misc_feature 3891..5033 /note="NEU2 coding region" vector join(5042..6444,1..3857) /source="pGEn2-DEST" /type="Destination Vector" clone 3858..5041 /source="NEU2-Nterm-TEVfusion-pDONR221" /type="Entry Clone" ORIGIN 1 GTGGCACTTT TCGGGGAAAT GTGCGCGGAA CCCCTATTTG TTTATTTTTC TAAATACATT 61 CAAATATGTA TCCGCTCATG AGACAATAAC CCTGATAAAT GCTTCAATAA TATTGAAAAA 121 GGAAGAGTAT GAGTATTCAA CATTTCCGTG TCGCCCTTAT TCCCTTTTTT GCGGCATTTT 181 GCCTTCCTGT TTTTGCTCAC CCAGAAACGC TGGTGAAAGT AAAAGATGCT GAAGATCAGT 241 TGGGTGCACG AGTGGGTTAC ATCGAACTGG ATCTCAACAG CGGTAAGATC CTTGAGAGTT 301 TTCGCCCCGA AGAACGTTTT CCAATGATGA GCACTTTTAA AGTTCTGCTA TGTGGCGCGG 361 TATTATCCCG TATTGACGCC GGGCAAGAGC AACTCGGTCG CCGCATACAC TATTCTCAGA 421 ATGACTTGGT TGAGTACTCA CCAGTCACAG AAAAGCATCT TACGGATGGC ATGACAGTAA 481 GAGAATTATG CAGTGCTGCC ATAACCATGA GTGATAACAC TGCGGCCAAC TTACTTCTGA 541 CAACGATCGG AGGACCGAAG GAGCTAACCG CTTTTTTGCA CAACATGGGG GATCATGTAA 601 CTCGCCTTGA TCGTTGGGAA CCGGAGCTGA ATGAAGCCAT ACCAAACGAC GAGCGTGACA 661 CCACGATGCC TGTAGCAATG GCAACAACGT TGCGCAAACT ATTAACTGGC GAACTACTTA 721 CTCTAGCTTC CCGGCAACAA TTAATAGACT GGATGGAGGC GGATAAAGTT GCAGGACCAC 781 TTCTGCGCTC GGCCCTTCCG GCTGGCTGGT TTATTGCTGA TAAATCTGGA GCCGGTGAGC 841 GTGGTTCTCG CGGTATCATT GCAGCACTGG GGCCAGATGG TAAGCCCTCC CGTATCGTAG 901 TTATCTACAC GACGGGGAGT CAGGCAACTA TGGATGAACG AAATAGACAG ATCGCTGAGA 961 TAGGTGCCTC ACTGATTAAG CATTGGTAAC TGTCAGACCA AGTTTACTCA TATATACTTT 1021 AGATTGATTT AAAACTTCAT TTTTAATTTA AAAGGATCTA GGTGAAGATC CTTTTTGATA 1081 ATCTCATGAC CAAAATCCCT TAACGTGAGT TTTCGTTCCA CTGAGCGTCA GACCCCGTAG 1141 AAAAGATCAA AGGATCTTCT TGAGATCCTT TTTTTCTGCG CGTAATCTGC TGCTTGCAAA 1201 CAAAAAAACC ACCGCTACCA GCGGTGGTTT GTTTGCCGGA TCAAGAGCTA CCAACTCTTT 1261 TTCCGAAGGT AACTGGCTTC AGCAGAGCGC AGATACCAAA TACTGTTCTT CTAGTGTAGC 1321 CGTAGTTAGG CCACCACTTC AAGAACTCTG TAGCACCGCC TACATACCTC GCTCTGCTAA 1381 TCCTGTTACC AGTGGCTGCT GCCAGTGGCG ATAAGTCGTG TCTTACCGGG TTGGACTCAA 1441 GACGATAGTT ACCGGATAAG GCGCAGCGGT CGGGCTGAAC GGGGGGTTCG TGCACACAGC 1501 CCAGCTTGGA GCGAACGACC TACACCGAAC TGAGATACCT ACAGCGTGAG CTATGAGAAA 1561 GCGCCACGCT TCCCGAAGGG AGAAAGGCGG ACAGGTATCC GGTAAGCGGC AGGGTCGGAA 1621 CAGGAGAGCG CACGAGGGAG CTTCCAGGGG GAAACGCCTG GTATCTTTAT AGTCCTGTCG 1681 GGTTTCGCCA CCTCTGACTT GAGCGTCGAT TTTTGTGATG CTCGTCAGGG GGGCGGAGCC 1741 TATGGAAAAA CGCCAGCAAC GCGGCCTTTT TACGGTTCCT GGCCTTTTGC TGGCCTTTTG 1801 CTCATTAGGC ACCCCAGGCT TTACCCGAAC GACCGAGCGC AGCGAGTCAG TGAGCGAGGA 1861 AGCGGAGAGC GCCCAATACG CAAGGAAACA GCTATGACCA TGTTAATGCA GCTGGCACGA 1921 CAGGTTTCCC GACTGGAAAG CGGGCAGTGA GCGGAAGGCC CATGAGGCCA GTTAATTAAG 1981 AGGTACCTTA ATTAAGGCTG CGCGCTCGCT CGCTCACTGA GGCCGCCCGG GCAAAGCCCG 2041 GGCGTCGGGC GACCTTTGGT CGCCCGGCCT CAGTGAGCGA GCGAGCGCGC AGAGAGGGAG 2101 TGGCCAACTC CATCACTAGG GGTTCCTTGT AGTTAATGAT TAACCCGCCA TGCTACTTAT 2161 CTACGTAGCC ATGCTCTAGG AAGATCGCAA TTCGCCCTTA AGCTAGCTAG TTATTAATAG 2221 TAATCAATTA CGGGGTCATT AGTTCATAGC CCATATATGG AGTTCCGCGT TACATAACTT 2281 ACGGTAAATG GCCCGCCTGG CTGACCGCCC AACGACCCCC GCCCATTGAC GTCAATAATG 2341 ACGTATGTTC CCATAGTAAC GCCAATAGGG ACTTTCCATT GACGTCAATG GGTGGAGTAT 2401 TTACGGTAAA CTGCCCACTT GGCAGTACAT CAAGTGTATC ATATGCCAAG TACGCCCCCT 2461 ATTGACGTCA ATGACGGTAA ATGGCCCGCC TGGCATTATG CCCAGTACAT GACCTTATGG 2521 GACTTTCCTA CTTGGCAGTA CATCTACGTA TTAGTCATCG CTATTACCAT GGTGATGCGG 2581 TTTTGGCAGT ACATCAATGG GCGTGGATAG CGGTTTGACT CACGGGGATT TCCAAGTCTC 2641 CACCCCATTG ACGTCAATGG GAGTTTGTTT TGGCACCAAA ATCAACGGGA CTTTCCAAAA 2701 TGTCGTAACA ACTCCGCCCC ATTGACGCAA ATGGGCGGTA GGCGTGTACG GTGGGAGGTC 2761 TATATAAGCA GAGCTGGTTT AGTGAACCGT CAGATCCTGC AGAAGTTGGT CGTGAGGCAC 2821 TGGGCAGGTA AGTATCAAGG TTACAAGACA GGTTTAAGGA GACCAATAGA AACTGGGCTT 2881 GTCGAGACAG AGAAGACTCT TGCGTTTCTG ATAGGCACCT ATTGGTCTTA CTGACATCCA 2941 CTTTGCCTTT CTCTCCACAG GTGTCCAgcg gccgcGCCAC cATGAGACTG CTGACCGCCC 3001 TGTTCGCCTA CTTCATCGTG GCCCTGATCC TGGCCTTCAG CGTGTCCGCC AAGAGCATGC 3061 ACCACCACCA TCACCATCAT CACATGAGCG GCCTGAACGA CATCTTCGAG GCCCAGAAAA 3121 TCGAGTGGCA CGAGATGAGC AAGGGCGAGG AACTGTTCAC CGGCGTGGTG CCCATCCTGG 3181 TGGAACTGGA CGGCGACGTG AACGGCCACA AGTTCTCTGT GCGGGGCGAG GGCGAGGGGG 3241 ACGCCACAAA TGGCAAGCTG ACCCTGAAGT TCATCTGCAC CACCGGAAAG CTGCCCGTGC 3301 CCTGGCCTAC CCTGGTCACA ACCCTGACCT ACGGCGTGCA GTGCTTCAGC AGATACCCCG 3361 ACCACATGAA GCGGCACGAT TTCTTCAAGA GCGCCATGCC CGAGGGCTAC GTGCAAGAAC 3421 GGACCATCAG CTTCAAGGAC GACGGCACCT ACAAGACCAG AGCCGAAGTG AAGTTCGAGG 3481 GCGACACCCT GGTCAACCGG ATCGAGCTGA AGGGCATCGA CTTCAAAGAG GACGGCAACA 3541 TCCTGGGCCA CAAGCTCGAG TACAACTTCA ACAGCCACAA CGTGTACATC ACCGCCGACA 3601 AGCAGAAGAA CGGCATCAAG GCCAACTTCA AGATCCGGCA CAACGTGGAA GATGGCAGCG 3661 TGCAGCTGGC CGACCACTAC CAGCAGAACA CCCCCATCGG CGACGGCCCC GTGCTGCTGC 3721 CCGACAATCA CTACCTGAGC ACCCAGAGCG TGCTGAGCAA GGACCCCAAC GAGAAGCGGG 3781 ACCACATGGT GCTGCTGGAA TTTGTGACCG CCGCTGGCAT CACCCACGGC GAATTCgcAT 3841 CAACAAGTTT GTACAAAAAA GCAGGCTctg aaaacttgta ctttcaaggc atggcgtccc 3901 ttcctgtcct gcagaaggag agcgtgttcc agtcgggagc ccatgcctac agaatccctg 3961 ccctgctcta cctgcctggg cagcagtccc tgctggcctt cgcggaacag cgggcaagca 4021 agaaggatga gcacgcagag ctgattgtcc tgcgcagagg agactacgac gcacccaccc 4081 accaggttca gtggcaagct caggaggtgg tggcccaggc ccggctggat ggccaccggt 4141 ccatgaaccc atgccccttg tatgacgcgc agacggggac cctcttcctc ttcttcattg 4201 ccatccctgg gcaagtcacg gagcaacagc agctgcagac cagggccaat gtgacgcggc 4261 tgtgccaagt caccagcact gaccacggga ggacctggag ctcccccaga gacctcactg 4321 atgcggccat cggcccagcc taccgggagt ggtccacctt tgcagtgggc ccggggcatt 4381 gtttgcagct tcacgacagg gcccggagcc tggtggtgcc cgcctacgcc taccggaaac 4441 ttcaccccat ccaaaggccg atcccctctg ccttctgctt cctcagccat gaccatgggc 4501 gcacgtgggc gcgagggcac tttgtggccc aggacaccct ggagtgccag gtggccgaag 4561 tcgagactgg ggagcagagg gtggtgaccc tcaacgcgag aagccacctc cgagccaggg 4621 tccaggccca gagcaccaat gacgggcttg atttccagga gtctcagctg gtgaagaagc 4681 tggtggagcc gccgccccag ggctgccagg ggagcgtcat cagcttcccc agcccccgct 4741 cggggcctgg ctccccagcc cagtggctgc tctacactca ccccacacac tcctggcaga 4801 gggccgacct gggtgcctac ctcaacccgc gacctccagc ccctgaggcc tggtcagagc 4861 cggtactgct ggccaagggc agctgtgcct actcagacct ccagagcatg ggcaccggcc 4921 ctgatgggtc ccccttgttt gggtgtctgt acgaagccaa tgattacgag gagattgtct 4981 ttctcatgtt caccctgaag caagccttcc cagctgagta cctgcctcag tgaCCAGCTT 5041 TCTTGTACAA AGTGGTTGAT AGCTTGGATC CAATCAACCT CTGGATTACA AAATTTGTGA 5101 AAGATTGACT GGTATTCTTA ACTATGTTGC TCCTTTTACG CTATGTGGAT ACGCTGCTTT 5161 AATGCCTTTG TATCATGCTA TTGCTTCCCG TATGGCTTTC ATTTTCTCCT CCTTGTATAA 5221 ATCCTGGTTG CTGTCTCTTT ATGAGGAGTT GTGGCCCGTT GTCAGGCAAC GTGGCGTGGT 5281 GTGCACTGTG TTTGCTGACG CAACCCCCAC TGGTTGGGGC ATTGCCACCA CCTGTCAGCT 5341 CCTTTCCGGG ACTTTCGCTT TCCCCCTCCC TATTGCCACG GCGGAACTCA TCGCCGCCTG 5401 CCTTGCCCGC TGCTGGACAG GGGCTCGGCT GTTGGGCACT GACAATTCCG TGGTGTTGTC 5461 GGGGAAGCTG ACGTCCTTTC CATGGCTGCT CGCCTGTGTT GCCACCTGGA TTCTGCGCGG 5521 GACGTCCTTC TGCTACGTCC CTTCGGCCCT CAATCCAGCG GACCTTCCTT CCCGCGGCCT 5581 GCTGCCGGCT CTGCGGCCTC TTCCGCGTCT TCGAGATCTG CCTCGACTGT GCCTTCTAGT 5641 TGCCAGCCAT CTGTTGTTTG CCCCTCCCCC GTGCCTTCCT TGACCCTGGA AGGTGCCACT 5701 CCCACTGTCC TTTCCTAATA AAATGAGGAA ATTGCATCGC ATTGTCTGAG TAGGTGTCAT 5761 TCTATTCTGG GGGGTGGGGT GGGGCAGGAC AGCAAGGGGG AGGATTGGGA AGACAATAGC 5821 AGGCATGCTG GGGACTCGAG TTAAGGGCGA ATTGCCGATT AGGATCTTCC TAGAGCATGG 5881 CTACGTAGAT AAGTAGCATG GCGGGTTAAT CATTAACTAC AAGGAACCCC TAGTGATGGA 5941 GTTGGCCACT CCCTCTCTGC GCGCTCGCTC GCTCACTGAG GCCGGGCGAC CAAAGGTCGC 6001 CCGACGCCCG GGCTTTGCCC GGGCGGCCTC AGTGAGCGAG CGAGCGCGCA GCCTTAATTA 6061 AGAGCTCATG GCGCGCCTAG GCCTTGACGG CCTTCCGCCA ATTCGCCCTA TAGTGAGTCG 6121 TATTACGTCG CGCTCACTGG CCGTCGTTTT ACAACGTCGT GACTGGGAAA ACCCTGGCGT 6181 TACCCAACTT AATCGCCTTG CAGCACATCC CCCTTTCGCC AGCTGGCGTA ATAGCGAAGA 6241 GGCCCGCACC GAAACGCCCT TCCCAACAGT TGCGCAGCCT GAATGGCGAA TGGGAGCGCC 6301 CTGTAGCGGC CACTCAACCC TATCTCGGTC TATTCTTTTG ATTTATAAGG GATTTTGCCG 6361 ATTTCGGCCT ATTGGTTAAA AAATGAGCTG ATTTAACAAA AATTTAACGC GAATTTTAAC 6421 AAAATATTAA CGCTTACAAT TTAG //