v0.1.0
What's Changed
- Fix dtype upcast when loading checkpoints by @jessegrabowski in #54
- Add cosine annealing learning rate schedule by @jessegrabowski in #60
- Accept a float, shared variable, or schedule as learning_rate by @jessegrabowski in #61
- Add linear decay learning rate schedule by @jessegrabowski in #62
- Add exponential decay learning rate schedule by @jessegrabowski in #63
- Split the test job into parallel groups and cache compiled graphs by @jessegrabowski in #64
- Add polynomial decay learning rate schedule by @jessegrabowski in #65
- Add step decay learning rate schedule by @jessegrabowski in #66
- Let schedules run in either direction, and compose them by @jessegrabowski in #67
- Add a training clock and advance it once per step by @jessegrabowski in #68
- Allow unknown dimensions in Input by @jessegrabowski in #69
- Let parameters declare their own initializer by @jessegrabowski in #70
- Stop silently training parameters behind a stop-gradient by @jessegrabowski in #71
- Fix state-name collision between adam and adamw by @jessegrabowski in #73
- Name the parameters in the disconnected-input error by @jessegrabowski in #72
- Read schedules off the clock the rule counts on by @jessegrabowski in #74
- Fix RNG seeding and reject generators nothing advances by @jessegrabowski in #75
- Let compile_train take extra updates by @jessegrabowski in #76
- Fold the receptive field into the Xavier fans by @jessegrabowski in #77
- Let every layer take its initializers by @jessegrabowski in #78
Full Changelog: v0.0.7...v0.1.0