الباحثون

Duygu Nur Yaldiz

المنشورات 1

نسخة أولية وصول مفتوح

Aligned Data Can Induce Misalignment via Context Confusion

Yavuz Bakman, Duygu Nur Yaldiz, Baris Askin وآخرون · 2026

Large language models (LLMs) are frequently updated for various use cases, where filtering out misaligned training samples is a common practice for preventing post-update misalignment. However, alignment is inherently context-dependent: a recommendation that is aligned in one context may be inappropriate in another. Fo …

المؤلفون المشاركون