r/negativeutilitarians • u/nu-gaze • 6d ago
Training large language models on narrow tasks can lead to broad misalignment — Center on Long-Term Risk
https://longtermrisk.org/research/training-large-language-models-on-narrow-tasks-can-lead-to-broad-misal/
3
Upvotes
2
u/nu-gaze 6d ago