Systematic runaway-optimiser-like LLM failure modes on Biologically and Economically aligned AI safety benchmarks for LLM-s with simplified navigation-free observation format. The benchmark themes include multi-objective homeostasis, (multi-objective) diminishing returns, complementary goods, sustainability.
python benchmarking sustainability multi-objective ai-safety runaway homeostasis ai-alignment utility-functions pluralism llm-benchmarking diminishing-returns complementary-goods
-
Updated
Jul 4, 2026 - Python