Fusion proteins and methods thereof
The invention discloses oncogenic fusion proteins. The invention provides methods for treating gene-fusion based cancers.
1. A cDNA encoding an EGFR-Septin-14 fusion protein comprising an EGFR portion fused to a Septin-14 portion, wherein the EGFR portion comprises amino acids:
CTGPGLEGCPTNGPKIPSIATGMVGALLLLLVVALGIGLFMRRRHIVRKR
TLRRLLQERELVEPLTPSGEAPNQALLRILKETEFKKIKVLGSGAFGTVY
KGLWIPEGEKVKIPVAIKELREATSPKANKEILDEAYVMASVDNPHVCRL
LGICLTSTVQLITQLMPFGCLLDYVREHKDNIGSQYLLNWCVQIAKGMNY
LEDRRLVHRDLAARNVLVKTPQHVKITDFGLAKLLGAEEKEYHAEGGKVP
IKWMALESILHRIYTHQSDVWSYGVTVWELMTFGSKPYDGIPASEISSIL
EKGERLPQPPICTIDVYMIMVKCWMIDADSRPKFRELIIEFSKMARDPQR
YLVIQ (amino acids 628-982 of SEQ ID NO: 5);
and wherein the Septin-14 portion comprises amino acids:
LQDKFEHLKMIQQEEIRKLEEEKKQLEGEIIDFYKMKAASEALQTQLSTD
TKKDKHRKK (amino acids 983-1041 of SEQ ID NO: 5).
2. The cDNA of claim 1 , wherein the cDNA encoding the EGFR-Septin-14 fusion protein comprises SEQ ID NO: 2, or SEQ ID NO: 4 or has a genomic breakpoint comprising SEQ ID NO: 4.
3. The cDNA of claim 1 , wherein the EGFR-Septin-14 fusion protein comprises a breakpoint LVIQLQDK (SEQ ID NO: 3) between the EGFR portion and the Septin-14 portion.
4. The cDNA of claim 1 , wherein the EGFR portion comprises amino acids:
MRPSGTAGAALLALLAALCPASRALEEKKVCQGTSNKLTQLGTFEDHFLS
LQRMFNNCEVVLGNLEITYVQRNYDLSFLKTIQEVAGYVLIALNTVERIP
LENLQIIRGNMYYENSYALAVLSNYDANKTGLKELPMRNLQEILHGAVRF
SNNPALCNVESIQWRDIVSSDFLSNMSMDFQNHLGSCQKCDPSCPNGSCW
GAGEENCQKLTKIICAQQCSGRCRGKSPSDCCHNQCAAGCTGPRESDCLV
CRKFRDEATCKDTCPPLMLYNPTTYQMDVNPEGKYSFGATCVKKCPRNYV
VTDHGSCVRACGADSYEMEEDGVRKCKKCEGPCRKVCNGIGIGEFKDSLS
INATNIKHFKNCTSISGDLHILPVAFRGDSFTHTPPLDPQELDILKTVKE
ITGFLLIQAWPENRTDLHAFENLEIIRGRTKQHGQFSLAVVSLNITSLGL
RSLKEISDGDVIISGNKNLCYANTINWKKLFGTSGQKTKIISNRGENSCK
ATGQVCHALCSPEGCWGPEPRDCVSCRNVSRGRECVDKCNLLEGEPREFV
ENSECIQCHPECLPQAMNITCTGRGPDNCIQCAHYIDGPHCVKTCPAGVM
GENNTLVWKYADAGHVCHLCHPNCTYGCTGPGLEGCPTNGPKIPSIATGM
VGALLLLLVVALGIGLFMRRRHIVRKRTLRRLLQERELVEPLTPSGEAPN
QALLRILKETEFKKIKVLGSGAFGTVYKGLWIPEGEKVKIPVAIKELREA
TSPKANKEILDEAYVMASVDNPHVCRLLGICLTSTVQLITQLMPFGCLLD
YVREHKDNIGSQYLLNWCVQIAKGMNYLEDRRLVHRDLAARNVLVKTPQH
VKITDFGLAKLLGAEEKEYHAEGGKVPIKWMALESILHRIYTHQSDVWSY
GVTVWELMTFGSKPYDGIPASEISSILEKGERLPQPPICTIDVYMIMVKC
WMIDADSRPKFRELIIEFSKMARDPQRYLVIQ (amino acids
1-982 of SEQ ID NO: 5).
5. The cDNA of claim 3 , wherein the EGFR portion comprises amino acids:
MRPSGTAGAALLALLAALCPASRALEEKKVCQGTSNKLTQLGTFEDHFLS
LQRMFNNCEVVLGNLEITYVQRNYDLSFLKTIQEVAGYVLIALNTVERIP
LENLQIIRGNMYYENSYALAVLSNYDANKTGLKELPMRNLQEILHGAVRF
SNNPALCNVESIQWRDIVSSDFLSNMSMDFQNHLGSCQKCDPSCPNGSCW
GAGEENCQKLTKIICAQQCSGRCRGKSPSDCCHNQCAAGCTGPRESDCLV
CRKFRDEATCKDTCPPLMLYNPTTYQMDVNPEGKYSFGATCVKKCPRNYV
VTDHGSCVRACGADSYEMEEDGVRKCKKCEGPCRKVCNGIGIGEFKDSLS
INATNIKHFKNCTSISGDLHILPVAFRGDSFTHTPPLDPQELDILKTVKE
ITGFLLIQAWPENRTDLHAFENLEIIRGRTKQHGQFSLAVVSLNITSLGL
RSLKEISDGDVIISGNKNLCYANTINWKKLFGTSGQKTKIISNRGENSCK
ATGQVCHALCSPEGCWGPEPRDCVSCRNVSRGRECVDKCNLLEGEPREFV
ENSECIQCHPECLPQAMNITCTGRGPDNCIQCAHYIDGPHCVKTCPAGVM
GENNTLVWKYADAGHVCHLCHPNCTYGCTGPGLEGCPTNGPKIPSIATGM
VGALLLLLVVALGIGLFMRRRHIVRKRTLRRLLQERELVEPLTPSGEAPN
QALLRILKETEFKKIKVLGSGAFGTVYKGLWIPEGEKVKIPVAIKELREA
TSPKANKEILDEAYVMASVDNPHVCRLLGICLTSTVQLITQLMPFGCLLD
YVREHKDNIGSQYLLNWCVQIAKGMNYLEDRRLVHRDLAARNVLVKTPQH
VKITDFGLAKLLGAEEKEYHAEGGKVPIKWMALESILHRIYTHQSDVWSY
GVTVWELMTFGSKPYDGIPASEISSILEKGERLPQPPICTIDVYMIMVKC
WMIDADSRPKFRELIIEFSKMARDPQRYLVIQ (amino acids
1-982 of SEQ ID NO: 5).
6. The cDNA of claim 1 , wherein the Septin-14 portion consists of amino acids:
LQDKFEHLKMIQQEEIRKLEEEKKQLEGEIIDFYKMKAASEALQTQLSTD
TKKDKHRKK (amino acids 983-1041 of SEQ ID NO: 5).
7. The cDNA of claim 3 , wherein the Septin-14 portion consists of amino acids:
LQDKFEHLKMIQQEEIRKLEEEKKQLEGEIIDFYKMKAASEALQTQLSTD
TKKDKHRKK (amino acids 983-1041 of SE0 ID NO: 5).
8. The cDNA of claim 1 , wherein the EGFR portion consists of amino acids:
MRPSGTAGAALLALLAALCPASRALEEKKVCQGTSNKLTQLGTFEDHFLS
LQRMFNNCEVVLGNLEITYVQRNYDLSFLKTIQEVAGYVLIALNTVERIP
LENLQIIRGNMYYENSYALAVLSNYDANKTGLKELPMRNLQEILHGAVRF
SNNPALCNVESIQWRDIVSSDFLSNMSMDFQNHLGSCQKCDPSCPNGSCW
GAGEENCQKLTKIICAQQCSGRCRGKSPSDCCHNQCAAGCTGPRESDCLV
CRKFRDEATCKDTCPPLMLYNPTTYQMDVNPEGKYSFGATCVKKCPRNYV
VTDHGSCVRACGADSYEMEEDGVRKCKKCEGPCRKVCNGIGIGEFKDSLS
INATNIKHFKNCTSISGDLHILPVAFRGDSFTHTPPLDPQELDILKTVKE
ITGFLLIQAWPENRTDLHAFENLEIIRGRTKQHGQFSLAVVSLNITSLGL
RSLKEISDGDVIISGNKNLCYANTINWKKLFGTSGQKTKIISNRGENSCK
ATGQVCHALCSPEGCWGPEPRDCVSCRNVSRGRECVDKCNLLEGEPREFV
ENSECIQCHPECLPQAMNITCTGRGPDNCIQCAHYIDGPHCVKTCPAGVM
GENNTLVWKYADAGHVCHLCHPNCTYGCTGPGLEGCPTNGPKIPSIATGM
VGALLLLLVVALGIGLFMRRRHIVRKRTLRRLLQERELVEPLTPSGEAPN
QALLRILKETEFKKIKVLGSGAFGTVYKGLWIPEGEKVKIPVAIKELREA
TSPKANKEILDEAYVMASVDNPHVCRLLGICLTSTVQLITQLMPFGCLLD
YVREHKDNIGSQYLLNWCVQIAKGMNYLEDRRLVHRDLAARNVLVKTPQH
VKITDFGLAKLLGAEEKEYHAEGGKVPIKWMALESILHRIYTHQSDVWSY
GVTVWELMTFGSKPYDGIPASEISSILEKGERLPQPPICTIDVYMIMVKC
WMIDADSRPKFRELIIEFSKMARDPQRYLVIQ (amino acids
1-982 of SEQ ID NO: 5).
9. The cDNA of claim 3 , wherein the EGFR portion consists of amino acids:
MRPSGTAGAALLALLAALCPASRALEEKKVCQGTSNKLTQLGTFEDHFLS
LQRMFNNCEVVLGNLEITYVQRNYDLSFLKTIQEVAGYVLIALNTVERIP
LENLQIIRGNMYYENSYALAVLSNYDANKTGLKELPMRNLQEILHGAVRF
SNNPALCNVESIQWRDIVSSDFLSNMSMDFQNHLGSCQKCDPSCPNGSCW
GAGEENCQKLTKIICAQQCSGRCRGKSPSDCCHNQCAAGCTGPRESDCLV
CRKFRDEATCKDTCPPLMLYNPTTYQMDVNPEGKYSFGATCVKKCPRNYV
VTDHGSCVRACGADSYEMEEDGVRKCKKCEGPCRKVCNGIGIGEFKDSLS
INATNIKHFKNCTSISGDLHILPVAFRGDSFTHTPPLDPQELDILKTVKE
ITGFLLIQAWPENRTDLHAFENLEIIRGRTKQHGQFSLAVVSLNITSLGL
RSLKEISDGDVIISGNKNLCYANTINWKKLFGTSGQKTKIISNRGENSCK
ATGQVCHALCSPEGCWGPEPRDCVSCRNVSRGRECVDKCNLLEGEPREFV
ENSECIQCHPECLPQAMNITCTGRGPDNCIQCAHYIDGPHCVKTCPAGVM
GENNTLVWKYADAGHVCHLCHPNCTYGCTGPGLEGCPTNGPKIPSIATGM
VGALLLLLVVALGIGLFMRRRHIVRKRTLRRLLQERELVEPLTPSGEAPN
QALLRILKETEFKKIKVLGSGAFGTVYKGLWIPEGEKVKIPVAIKELREA
TSPKANKEILDEAYVMASVDNPHVCRLLGICLTSTVQLITQLMPFGCLLD
YVREHKDNIGSQYLLNWCVQIAKGMNYLEDRRLVHRDLAARNVLVKTPQH
VKITDFGLAKLLGAEEKEYHAEGGKVPIKWMALESILHRIYTHQSDVWSY
GVTVWELMTFGSKPYDGIPASEISSILEKGERLPQPPICTIDVYMIMVKC
WMIDADSRPKFRELIIEFSKMARDPQRYLVIQ (amino acids
1-982 of SEQ ID NO: 5).
10. The cDNA of claim 1 , wherein the EGFR-Septin-14 fusion protein consists of SEQ ID NO: 5.