(
model,
base_learning_rate,
parameters=None,
max_gradient_norm=None,
allow_lr_injection=False,
**kwargs
)
| 2267 | |
| 2268 | |
| 2269 | def build_wngrad( |
| 2270 | model, |
| 2271 | base_learning_rate, |
| 2272 | parameters=None, |
| 2273 | max_gradient_norm=None, |
| 2274 | allow_lr_injection=False, |
| 2275 | **kwargs |
| 2276 | ): |
| 2277 | wngrad_optimizer = WngradOptimizer(alpha=base_learning_rate, **kwargs) |
| 2278 | return _build( |
| 2279 | model, |
| 2280 | wngrad_optimizer, |
| 2281 | max_gradient_norm=max_gradient_norm, |
| 2282 | allow_lr_injection=allow_lr_injection, |
| 2283 | ) |
| 2284 | |
| 2285 | |
| 2286 | def build_storm( |
searching dependent graphs…