AI agents can't reliably simulate human values
LLM agents frequently fail to faithfully represent diverse human value systems, even before any drift occurs over time.
LLM agents frequently fail to faithfully represent diverse human value systems, even before any drift occurs over time.