Decoy Direction Optimization: A Post-Hoc Defense Against LLM Abliteration Paper • 2609.16204 • Published 6 days ago • 4
WearableQA: A Benchmark for Health Reasoning over Real-World Wearable Data Paper • 2609.05405 • Published 16 days ago • 44
Mind2Dialogue: Training Human-Aware Language Models by Simulating User Mental States Paper • 2609.15972 • Published 6 days ago • 8
Drift-Constrained Optimization: Only Direction Matters in Fine-Tuning Instruct Models Paper • 2609.13680 • Published 8 days ago • 10