Methods and compositions for regulation of transgene expression
Nucleases and methods of using these nucleases for expressing a transgene from a safe harbor locus in a secretory tissue, and clones and animals derived therefrom.
1. A method of integrating a transgene into a human or mouse liver cell, the method comprising:
administering a polynucleotide encoding a nuclease to the liver cell, the nuclease comprising (i) a DNA-binding domain that binds to a target site in an endogenous albumin gene, wherein the DNA-binding domain is a zinc finger protein (ZFP) comprising four, five or six zinc finger domains ordered F1 to F4, F1 to F5, or F1 to F6, each zinc finger domain comprising a recognition helix region, wherein the recognition helix regions are ordered as shown in a single row of the following Table:
F1
F2
F3
F4
F5
F6
TSGSLTR
RSDALST
QSATRTK
TSGHLSR
QSGNLAR
NA
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
NO:1)
NO:2)
NO:3)
NO:4)
NO:5)
RSDHLSA
TKSNRTK
DRSNLSR
WRSSLRA
DSSDRKK
NA
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
NO:6)
NO:7)
NO:8)
NO:9)
NO:10)
TSGNLTR
DRSTRRQ
TSGSLTR
ERGTLAR
TSANLSR
NA
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
NO:11)
NO:12)
NO:1)
NO:13)
NO:14)
DRSALAR
RSDHLSE
HRSDRTR
QSGALAR
QSGHLSR
NS
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
NO:15)
NO:16)
NO:17)
NO:18)
NO:19)
RSDNLST
DRSALAR
DRSNLSR
DGRNLRH
RSDNLAR
QSNALNR
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
NO:20)
NO:15)
NO:8)
NO:21)
NO:22)
NO:23)
DRSNLSR
LKQVLVR
QSGNLAR
QSTPLFA
QSGALAR
NA
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
NO:8)
NO:24)
NO:5)
NO:25)
NO:18)
DRSNLSR
DGRNLRH
RSDNLAR
QSNALNR
NA
NA
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
NO:8)
NO:21)
NO:22)
NO:23)
RSDNLSV
HSNARKT
RSDSLSA
QSGNLAR
RSDSLSV
QSGHLSR
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
NO:26)
NO:27)
NO:28)
NO:5)
NO:29)
NO:19)
RSDNLSE
ERANRNS
QSANRTK
ERGTLAR
RSDALTQ
NA
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
NO:30)
NO:31)
NO:32)
NO:13)
NO:33)
TSGSLTR
DRSNLSR
DGRNLRH
ERGTLAR
RSDALTQ
NA
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
NO:1)
NO:8)
NO:21)
NO:13)
NO:33)
QSGHLAR
RSDHLTQ
RSDHLSQ
WRSSLVA
RSDVLSE
RNQHRKT
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
NO:34)
NO:35)
NO:36)
NO:37)
NO:38)
NO:39)
QSGDLTR
RSDALAR
QSGDLTR
RRDPLIN
RSDNLSV
IRSTLRD
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
NO:40)
NO:41)
NO:40)
NO:42)
NO:26)
NO:43)
RSDNLSV
YSSTRNS
RSDHLSA
SYWSRTV
QSSDLSR
RTDALRG
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
NO:26)
NO:44)
NO:6)
NO:45)
NO:46)
NO:47)
RSDNLST
QKSPLNT
TSGNLTR
QAENLKS
QSSDLSR
RTDALRG
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
NO:20)
NO:48)
NO:11)
NO:49)
NO:46)
NO:47)
RSDNLSV
RRAHLNQ
TSGNLTR
SDTNRFK
RSDNLST
QSGHLSR
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
NO:26)
NO:50)
NO:11)
NO:51)
NO:20)
NO:19)
DSSDRKK
DRSALSR
TSSNRKT
QSGALAR
RSDHLSR
NA
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
NO:10)
NO:52)
NO:53)
NO:18)
NO:54)
QSSDLSR
LRHNLRA
DQSNLRA
RPYTLRL
QSSDLSR
HRSNLNK
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
NO:46)
NO:105)
NO:106)
NO:107)
NO:46)
NO:108)
QSSDLSR
HRSNLNK
DQSNLRA
RPYTLRL
QSSDLSR
HRSNLNK
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
NO:46)
NO:108)
NO:106)
NO:107)
NO:46)
NO:108)
QSSDLSR
LKWNLRT
DQSNLRA
RPYTLRL
QSSDLSR
HRSNLNK
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
NO:46)
NO:109)
NO:106)
NO:107)
NO:46)
NO:108)
QSSDLSR
LRHNLRA
DQSNLRA
RPYTLRL
QSSDLSR
HRSNLNK
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
NO:46)
NO:105)
NO:106)
NO:107)
NO:46)
NO:108)
QSSDLSR
HRSNLNK
DQSNLRA
RPYTLRL
QSSDLSR
HRSNLNK
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
NO:46)
NO:108)
NO:106)
NO:107)
NO:46)
NO:108)
QSSDLSR
WKWNLRA
DQSNLRA
RPYTLRL
QSSDLSR
HRSNLNK
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
NO:46)
NO:110)
NO:106)
NO:107)
NO:46)
NO:108)
QSGNLAR
LMQNRNQ
LKQHLNE
TSGNLTR
RRYYLRL
N/A
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
NO:5)
NO:97
NO:111)
NO:11)
NO:112)
QSGNLAR
HLGNLKT
LKQHLNE
TSGNLTR
RRDWRRD
N/A
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
NO:5)
NO:94)
NO:111)
NO:11)
NO:113)
QSGNLAR
LMQNRNQ
LKQHLNE
TSGNLTR
RRDWRRD
N/A
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
NO:5)
NO:97
NO:111)
NO:11)
NO:113)
QRSNLVR
TSSNRKT
LKHHLTD
TSGNLTR
RRDWRRD
N/A
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
NO:99)
NO:53)
NO:95)
NO:11)
NO:113)
DKSYLRP
TSGNLTR
HRSARKR
QSSDLSR
WRSSLKT
N/A
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
NO:114)
NO:11)
NO:115)
NO:46)
NO:163)
TSGNLTR
HRSARKR
QSGDLTR
NRHHLKS
N/A
N/A
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
NO:11)
NO:115)
NO:40)
NO:163)
QSGDLTR
QSGNLHV
QSAHRKN
STAALSY
TSGSLSR
RSDALAR
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
NO:40)
NO:117)
NO:118)
NO:119)
NO:120)
NO:41)
QSGDLTR
QRSNLNI
QSAHRKN
STAALSY
DRSALSR
RSDALAR
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
(SEQ ID
NO:40)
NO:121)
NO:118)
NO:119)
NO:52)
NO:41)
or a TAL-effector domain that binds to a target site as shown in any of SEQ ID NO:133-153, 158, 159 or 164
and (ii) a cleavage domain, wherein the nuclease cleaves the endogenous albumin gene;
administering a donor vector comprising the transgene to the liver cell, wherein the transgene is integrated into and expressed from the endogenous albumin gene following cleavage of the endogenous albumin gene by the nuclease.
2. The method of claim 1 , wherein the target site is in intron 1 of the endogenous albumin gene.
3. The method of claim 1 , wherein the transgene encodes a clotting factor.
4. The method of claim 3 , wherein the clotting factor is Factor IX or Factor VIII.
5. The method of claim 1 , wherein the transgene encodes an enzyme.
6. The method of claim 5 , wherein the enzyme is involved in lysosomal storage disease.
7. The method of claim 1 , wherein the polynucleotide encoding the nuclease comprises mRNA, a plasmid or a viral vector.
8. The method of claim 7 , wherein the viral vector is an adenoviral (Ad) vector or an andeno-associated viral (AAV) vector.
9. The method of claim 1 , wherein the donor vector comprises mRNA, a plasmid or a viral vector.
10. The method of claim 9 , wherein the viral vector is an adenoviral (Ad) vector or an adeno-associated viral (AAV) vector.
11. A liver cell made by the method of claim 1 , wherein the liver cell expresses the transgene from the endogenous albumin gene.