DeepSeek-R1를 리뷰다가 GRPO에서 막혔을 때.
논문 리뷰 - NeurIPS 2024 / Continuous Adversarial Training 방식의 LLM Guardrail
논문 리뷰 - ICLR 2022 / (PEFT) LoRA: Low-Rank Adaptation
논문 리뷰 - NeurIPS 2024 / post-hoc 방식의 LoRA fine-tuning alignment 성능 향상