Rule enforcement in LLMs: a parameter efficient fine-tuning approach with self-generated training dataset