Pihlakas, 2025 — Research agenda for training aligned {AIs} using concave utility functions following the principles of homeostasis and diminishing returns

Homeostatic target ranges and diminishing-returns balancing as a concave outer-training alternative to unbounded linear reward.

Publication links

Homeostatic target ranges and diminishing-returns balancing as a concave outer-training alternative to unbounded linear reward.

Chapter-grouped bibliography All reference cards