kumama
- Karma
- 17
- Created
- 9 years ago
Recent Submissions
- 1. ▲ Token-in-token-out RL training with any agent harness, via a proxy gateway (castform.com)
- 2. ▲ Castform now supports supervised finetuning (castform.com)
- 3. ▲ how we monitor our rl training runs (castform.com)
- 4. ▲ Designing dev onboarding for an agent-first world (castform.com)
- 5. ▲ I post-trained a model to reliably roll a die (castform.com)