LLM 3 Jailbreak: LLM의 safety alignment를 우회하여 금지된 답변 출력 Jul 30, 2026 Model Merging: 효율적인 멀티태스크 학습을 위한 가중치의 결합 Feb 5, 2026 DeepSeek-R1 : Incentivizing Reasoning Capability in LLMs via Reinforcement Learning Apr 16, 2025