| dragonfarm::post-training-loop | The post-training loop: fine-tune, judge, prefer, repeat | HTML | source | R code | |
| dragonfarm::quickstart | Quickstart: fine-tune a small model from R | HTML | source | R code | |
| dragonfarm::reinforcement-learning | Reinforcement learning with rewards you can check | HTML | source | R code | |
| dragonfarm::shiny-app | The dragon-farm app | HTML | source | R code |