Pihlakas, 2025 — Research agenda for training aligned {AIs} using concave utility functions following the principles of homeostasis and diminishing returns
Homeostatic target ranges and diminishing-returns balancing as a concave outer-training alternative to unbounded linear reward.
Publication links
Homeostatic target ranges and diminishing-returns balancing as a concave outer-training alternative to unbounded linear reward.