How do we (more) safely defer to AIs?
blog.redwoodresearch.org · saved by 1 readers
How can we make AIs aligned and well-elicited on extremely hard to check open ended tasks?
How can we make AIs aligned and well-elicited on extremely hard to check open ended tasks?