Open-weight & owned stack · Training tuning
Lacuna Presents Reinforcement Unlearning Using GRPO
Lacuna presented a GRPO-based method for removing targeted personal or copyrighted data from language models.
Read the original at lacuna.tiptreesystems.comOpens the publisher's site in a new tab