LOCUS HPSE2-pGEn1-DEST 6355 bp DNA circular 25-JAN-2013 FEATURES Location/Qualifiers CDS 129..1108 /dnas_title="AmpR" /label=AmpR /vntifkey="4" rep_origin 1137..1804 /dnas_title="Col E1 origin" /label=Col E1 origin /vntifkey="33" misc_feature 1998..2127 /note="5'ITR" misc_feature 2208..2790 /note="CMV Promoter" misc_feature 2828..2960 /note="Artificial Intron" misc_feature 2977..3054 /note="TCM Sig Seq" misc_recomb complement(3114..3142) /label=attB1 /note="attB1 site" /note="recognized as attB1" misc_feature 3055..3078 /note="8xHis Tag" misc_feature 3085..3108 /note="StrepTag" misc_feature 4983..5524 /note="WPRE" misc_recomb 4945..4967 /label=attB2 /note="attB2 site" misc_feature complement(5531..5745) /note="BGH pA" misc_feature complement(5833..5962) /note="3'-ITR" misc_feature 3143..3165 /note="TEV site" source 3166..4944 /dnas_title="HPSE2-pGEn1-DEST" /organism="Homo sapiens" /mol_type="mRNA" /db_xref="taxon:9606" /clone="MGC:133234 IMAGE:40033830" /tissue_type="PCR rescued clones" /clone_lib="NIH_MGC_282" /note="Vector: pCR-Blunt II-TOPO; Clone identification sequence tag: AGGAGAAG" gene 3166..4944 /dnas_title="HPSE2" /gene="HPSE2" /gene_synonym="HPA2" /gene_synonym="HPR2" /db_xref="GeneID:60495" /db_xref="HGNC:18374" CDS 3166..4944 /dnas_title="heparanase 2" /gene="HPSE2" /gene_synonym="HPA2" /gene_synonym="HPR2" /codon_start=1 /product="heparanase 2" /protein_id="AAI12357.1" /db_xref="GI:85662624" /db_xref="GeneID:60495" /db_xref="HGNC:18374" /translation="MRVLCAFPEAMPSSNSRPPACLAPGALYLALLLHLSLSSQAGDR RPLPVDRAAGLKEKTLILLDVSTKNPVRTVNENFLSLQLDPSIIHDGWLDFLSSKRLV TLARGLSPAFLRFGGKRTDFLQFQNLRNPAKSRGGPGPDYYLKNYEDDIVRSDVALDK QKGCKIAQHPDVMLELQREKAAQMHLVLLKEQFSNTYSNLILTARSLDKLYNFADCSG LHLIFALNALRRNPNNSWNSSSALSLLKYSASKKYNISWELGNEPNNYRTMHGRAVNG SQLGKDYIQLKSLLQPIRIYSRASLYGPNIGRPRKNVIALLDGFMKVAGSTVDAVTWQ HCYIDGRVVKVMDFLKTRLLDTLSDQIRKIQKVVNTYTPGKKIWLEGVVTTSAGGTNN LSDSYAAGFLWLNTLGMLANQGIDVVIRHSFFDHGYNHLVDQNFNPLPDYWLSLLYKR LIGPKVLAVHVAGLQRKPRPGRVIRDKLRIYAHCTNHHNHNYVRGSITLFIINLHRSR KKIKLTGTLRDKLVHQYLLQPYGQEGLKSKSVQLNGQPLVMVDDGTLPELKPRPLRAG RTLVIPPVTMGFFVVKNVNALACRYR" misc_feature 3166..4944 /note="HPSE2 coding region" misc_difference 4705..4705 /dnas_title="HPSE2" /gene="HPSE2" /gene_synonym="HPA2" /gene_synonym="HPR2" /note="'A' in cDNA is 'G' in the human genome; amino acid difference: 'T' in cDNA, 'A' in the human genome. The chimpanzee genome agrees with the human genomic sequence and not the cDNA." misc_difference 4901..4901 /dnas_title="HPSE2" /gene="HPSE2" /gene_synonym="HPA2" /gene_synonym="HPR2" /note="'T' in cDNA is 'A' in the human genome; amino acid difference: 'F' in cDNA, 'Y' in the human genome. The chimpanzee genome agrees with the human genomic sequence and not the cDNA." vector join(4953..6355,1..3132) /source="pGEn1-DEST" /type="Destination Vector" clone 3133..4952 /source="HPSE2-Nterm-TEVfusion-pDONR221" /type="Entry Clone" ORIGIN 1 GTGGCACTTT TCGGGGAAAT GTGCGCGGAA CCCCTATTTG TTTATTTTTC TAAATACATT 61 CAAATATGTA TCCGCTCATG AGACAATAAC CCTGATAAAT GCTTCAATAA TATTGAAAAA 121 GGAAGAGTAT GAGTATTCAA CATTTCCGTG TCGCCCTTAT TCCCTTTTTT GCGGCATTTT 181 GCCTTCCTGT TTTTGCTCAC CCAGAAACGC TGGTGAAAGT AAAAGATGCT GAAGATCAGT 241 TGGGTGCACG AGTGGGTTAC ATCGAACTGG ATCTCAACAG CGGTAAGATC CTTGAGAGTT 301 TTCGCCCCGA AGAACGTTTT CCAATGATGA GCACTTTTAA AGTTCTGCTA TGTGGCGCGG 361 TATTATCCCG TATTGACGCC GGGCAAGAGC AACTCGGTCG CCGCATACAC TATTCTCAGA 421 ATGACTTGGT TGAGTACTCA CCAGTCACAG AAAAGCATCT TACGGATGGC ATGACAGTAA 481 GAGAATTATG CAGTGCTGCC ATAACCATGA GTGATAACAC TGCGGCCAAC TTACTTCTGA 541 CAACGATCGG AGGACCGAAG GAGCTAACCG CTTTTTTGCA CAACATGGGG GATCATGTAA 601 CTCGCCTTGA TCGTTGGGAA CCGGAGCTGA ATGAAGCCAT ACCAAACGAC GAGCGTGACA 661 CCACGATGCC TGTAGCAATG GCAACAACGT TGCGCAAACT ATTAACTGGC GAACTACTTA 721 CTCTAGCTTC CCGGCAACAA TTAATAGACT GGATGGAGGC GGATAAAGTT GCAGGACCAC 781 TTCTGCGCTC GGCCCTTCCG GCTGGCTGGT TTATTGCTGA TAAATCTGGA GCCGGTGAGC 841 GTGGTTCTCG CGGTATCATT GCAGCACTGG GGCCAGATGG TAAGCCCTCC CGTATCGTAG 901 TTATCTACAC GACGGGGAGT CAGGCAACTA TGGATGAACG AAATAGACAG ATCGCTGAGA 961 TAGGTGCCTC ACTGATTAAG CATTGGTAAC TGTCAGACCA AGTTTACTCA TATATACTTT 1021 AGATTGATTT AAAACTTCAT TTTTAATTTA AAAGGATCTA GGTGAAGATC CTTTTTGATA 1081 ATCTCATGAC CAAAATCCCT TAACGTGAGT TTTCGTTCCA CTGAGCGTCA GACCCCGTAG 1141 AAAAGATCAA AGGATCTTCT TGAGATCCTT TTTTTCTGCG CGTAATCTGC TGCTTGCAAA 1201 CAAAAAAACC ACCGCTACCA GCGGTGGTTT GTTTGCCGGA TCAAGAGCTA CCAACTCTTT 1261 TTCCGAAGGT AACTGGCTTC AGCAGAGCGC AGATACCAAA TACTGTTCTT CTAGTGTAGC 1321 CGTAGTTAGG CCACCACTTC AAGAACTCTG TAGCACCGCC TACATACCTC GCTCTGCTAA 1381 TCCTGTTACC AGTGGCTGCT GCCAGTGGCG ATAAGTCGTG TCTTACCGGG TTGGACTCAA 1441 GACGATAGTT ACCGGATAAG GCGCAGCGGT CGGGCTGAAC GGGGGGTTCG TGCACACAGC 1501 CCAGCTTGGA GCGAACGACC TACACCGAAC TGAGATACCT ACAGCGTGAG CTATGAGAAA 1561 GCGCCACGCT TCCCGAAGGG AGAAAGGCGG ACAGGTATCC GGTAAGCGGC AGGGTCGGAA 1621 CAGGAGAGCG CACGAGGGAG CTTCCAGGGG GAAACGCCTG GTATCTTTAT AGTCCTGTCG 1681 GGTTTCGCCA CCTCTGACTT GAGCGTCGAT TTTTGTGATG CTCGTCAGGG GGGCGGAGCC 1741 TATGGAAAAA CGCCAGCAAC GCGGCCTTTT TACGGTTCCT GGCCTTTTGC TGGCCTTTTG 1801 CTCATTAGGC ACCCCAGGCT TTACCCGAAC GACCGAGCGC AGCGAGTCAG TGAGCGAGGA 1861 AGCGGAGAGC GCCCAATACG CAAGGAAACA GCTATGACCA TGTTAATGCA GCTGGCACGA 1921 CAGGTTTCCC GACTGGAAAG CGGGCAGTGA GCGGAAGGCC CATGAGGCCA GTTAATTAAG 1981 AGGTACCTTA ATTAAGGCTG CGCGCTCGCT CGCTCACTGA GGCCGCCCGG GCAAAGCCCG 2041 GGCGTCGGGC GACCTTTGGT CGCCCGGCCT CAGTGAGCGA GCGAGCGCGC AGAGAGGGAG 2101 TGGCCAACTC CATCACTAGG GGTTCCTTGT AGTTAATGAT TAACCCGCCA TGCTACTTAT 2161 CTACGTAGCC ATGCTCTAGG AAGATCGCAA TTCGCCCTTA AGCTAGCTAG TTATTAATAG 2221 TAATCAATTA CGGGGTCATT AGTTCATAGC CCATATATGG AGTTCCGCGT TACATAACTT 2281 ACGGTAAATG GCCCGCCTGG CTGACCGCCC AACGACCCCC GCCCATTGAC GTCAATAATG 2341 ACGTATGTTC CCATAGTAAC GCCAATAGGG ACTTTCCATT GACGTCAATG GGTGGAGTAT 2401 TTACGGTAAA CTGCCCACTT GGCAGTACAT CAAGTGTATC ATATGCCAAG TACGCCCCCT 2461 ATTGACGTCA ATGACGGTAA ATGGCCCGCC TGGCATTATG CCCAGTACAT GACCTTATGG 2521 GACTTTCCTA CTTGGCAGTA CATCTACGTA TTAGTCATCG CTATTACCAT GGTGATGCGG 2581 TTTTGGCAGT ACATCAATGG GCGTGGATAG CGGTTTGACT CACGGGGATT TCCAAGTCTC 2641 CACCCCATTG ACGTCAATGG GAGTTTGTTT TGGCACCAAA ATCAACGGGA CTTTCCAAAA 2701 TGTCGTAACA ACTCCGCCCC ATTGACGCAA ATGGGCGGTA GGCGTGTACG GTGGGAGGTC 2761 TATATAAGCA GAGCTGGTTT AGTGAACCGT CAGATCCTGC AGAAGTTGGT CGTGAGGCAC 2821 TGGGCAGGTA AGTATCAAGG TTACAAGACA GGTTTAAGGA GACCAATAGA AACTGGGCTT 2881 GTCGAGACAG AGAAGACTCT TGCGTTTCTG ATAGGCACCT ATTGGTCTTA CTGACATCCA 2941 CTTTGCCTTT CTCTCCACAG GTGTCCAGCG GCCGCCATGA GACTGCTGAC AGCCCTGTTC 3001 GCCTACTTCA TCGTGGCCCT GATCCTGGCC TTCAGCGTGT CCGCCAAGAG CATGCACCAC 3061 CACCATCACC ATCATCACAG CGCCTGGTCC CACCCCCAGT TCGAGAAAGA ATTATCAACA 3121 AGTTTGTACA AAAAAGCAGG CTctgaaaac ttgtactttc aaggcatgag ggtgctttgt 3181 gccttccctg aagccatgcc ctccagcaac tcccgccccc ccgcgtgcct agccccgggg 3241 gctctctact tggctctgtt gctccatctc tccctttcct cccaggctgg agacaggaga 3301 cccttgcctg tagacagagc tgcaggtttg aaggaaaaga ccctgattct acttgatgtg 3361 agcaccaaga acccagtcag gacagtcaat gagaacttcc tctctctgca gctggatccg 3421 tccatcattc atgatggctg gctcgatttc ctaagctcca agcgcttggt gaccctggcc 3481 cggggacttt cgcccgcctt tctgcgcttc gggggcaaaa ggaccgactt cctgcagttc 3541 cagaacctga ggaacccggc gaaaagccgc gggggcccgg gcccggatta ctatctcaaa 3601 aactatgagg atgacattgt tcgaagtgat gttgccttag ataaacagaa aggctgcaag 3661 attgcccagc accctgatgt tatgctggag ctccaaaggg agaaggcagc tcagatgcat 3721 ctggttcttc taaaggagca attctccaat acttacagta atctcatatt aacagccagg 3781 tctctagaca aactttataa ctttgctgat tgctctggac tccacctgat atttgctcta 3841 aatgcactgc gtcgtaatcc caataactcc tggaacagtt ctagtgccct gagtctgttg 3901 aagtacagcg ccagcaaaaa gtacaacatt tcttgggaac tgggtaatga gccaaataac 3961 tatcggacca tgcatggccg ggcagtaaat ggcagccagt tgggaaagga ttacatccag 4021 ctgaagagcc tgttgcagcc catccggatt tattccagag ccagcttata tggccctaat 4081 attgggcggc cgaggaagaa tgtcatcgcc ctcctagatg gattcatgaa ggtggcagga 4141 agtacagtag atgcagttac ctggcaacat tgctacattg atggccgggt ggtcaaggtg 4201 atggacttcc tgaaaactcg cctgttagac acactctctg accagattag gaaaattcag 4261 aaagtggtta atacatacac tccaggaaag aagatttggc ttgaaggtgt ggtgaccacc 4321 tcagctggag gcacaaacaa tctatccgat tcctatgctg caggattctt atggttgaac 4381 actttaggaa tgctggccaa tcagggcatt gatgtcgtga tacggcactc attttttgac 4441 catggataca atcacctcgt ggaccagaat tttaacccat taccagacta ctggctctct 4501 ctcctctaca agcgcctgat cggccccaaa gtcttggctg tgcatgtggc tgggctccag 4561 cggaagccac ggcctggccg agtgatccgg gacaaactaa ggatttatgc tcactgcaca 4621 aaccaccaca accacaacta cgttcgtggg tccattacac tttttatcat caacttgcat 4681 cgatcaagaa agaaaatcaa gctgactggg actctcagag acaagctggt tcaccagtac 4741 ctgctgcagc cctatgggca ggagggccta aagtccaagt cagtgcaact gaatggccag 4801 cccttagtga tggtggacga cgggaccctc ccagaattga agccccgccc ccttcgggcc 4861 ggccggacat tggtcatccc tccagtcacc atgggctttt ttgtggtcaa gaatgtcaat 4921 gctttggcct gccgctaccg ataaCCAGCT TTCTTGTACA AAGTGGTTGA TAGCTTGGAT 4981 CCAATCAACC TCTGGATTAC AAAATTTGTG AAAGATTGAC TGGTATTCTT AACTATGTTG 5041 CTCCTTTTAC GCTATGTGGA TACGCTGCTT TAATGCCTTT GTATCATGCT ATTGCTTCCC 5101 GTATGGCTTT CATTTTCTCC TCCTTGTATA AATCCTGGTT GCTGTCTCTT TATGAGGAGT 5161 TGTGGCCCGT TGTCAGGCAA CGTGGCGTGG TGTGCACTGT GTTTGCTGAC GCAACCCCCA 5221 CTGGTTGGGG CATTGCCACC ACCTGTCAGC TCCTTTCCGG GACTTTCGCT TTCCCCCTCC 5281 CTATTGCCAC GGCGGAACTC ATCGCCGCCT GCCTTGCCCG CTGCTGGACA GGGGCTCGGC 5341 TGTTGGGCAC TGACAATTCC GTGGTGTTGT CGGGGAAGCT GACGTCCTTT CCATGGCTGC 5401 TCGCCTGTGT TGCCACCTGG ATTCTGCGCG GGACGTCCTT CTGCTACGTC CCTTCGGCCC 5461 TCAATCCAGC GGACCTTCCT TCCCGCGGCC TGCTGCCGGC TCTGCGGCCT CTTCCGCGTC 5521 TTCGAGATCT GCCTCGACTG TGCCTTCTAG TTGCCAGCCA TCTGTTGTTT GCCCCTCCCC 5581 CGTGCCTTCC TTGACCCTGG AAGGTGCCAC TCCCACTGTC CTTTCCTAAT AAAATGAGGA 5641 AATTGCATCG CATTGTCTGA GTAGGTGTCA TTCTATTCTG GGGGGTGGGG TGGGGCAGGA 5701 CAGCAAGGGG GAGGATTGGG AAGACAATAG CAGGCATGCT GGGGACTCGA GTTAAGGGCG 5761 AATTGCCGAT TAGGATCTTC CTAGAGCATG GCTACGTAGA TAAGTAGCAT GGCGGGTTAA 5821 TCATTAACTA CAAGGAACCC CTAGTGATGG AGTTGGCCAC TCCCTCTCTG CGCGCTCGCT 5881 CGCTCACTGA GGCCGGGCGA CCAAAGGTCG CCCGACGCCC GGGCTTTGCC CGGGCGGCCT 5941 CAGTGAGCGA GCGAGCGCGC AGCCTTAATT AAGAGCTCAT GGCGCGCCTA GGCCTTGACG 6001 GCCTTCCGCC AATTCGCCCT ATAGTGAGTC GTATTACGTC GCGCTCACTG GCCGTCGTTT 6061 TACAACGTCG TGACTGGGAA AACCCTGGCG TTACCCAACT TAATCGCCTT GCAGCACATC 6121 CCCCTTTCGC CAGCTGGCGT AATAGCGAAG AGGCCCGCAC CGAAACGCCC TTCCCAACAG 6181 TTGCGCAGCC TGAATGGCGA ATGGGAGCGC CCTGTAGCGG CCACTCAACC CTATCTCGGT 6241 CTATTCTTTT GATTTATAAG GGATTTTGCC GATTTCGGCC TATTGGTTAA AAAATGAGCT 6301 GATTTAACAA AAATTTAACG CGAATTTTAA CAAAATATTA ACGCTTACAA TTTAG //