×
Site Menu
Everything
International
Politics
Business
Finance
Sports
Entertainment
Lifestyle
Literature
Travel
Technology
Startups
Innovation
iBazaar deals
Art & Culture
Wine & Spirits
Science
Health
Local
Faulty reward functions in the wild
9 years ago
14
Add to circle
Reinforcement learning algorithms can break in surprising, counterintuitive ways. In this post we’ll explore one failure mode, which is where you misspecify your reward function.
Read Entire Article
Homepage
Technology
Faulty reward functions in the wild
Related
Drying Lakebeds Are Releasing Massive Amounts of Carbon, Stu...
5 minutes ago
0
‘Dark Matter’ Season 2 Trailer Raises the Stakes Across Dime...
13 minutes ago
0
GM Backs Sodium Ion Batteries for U.S. Grid Storage
17 minutes ago
0
Everything
International
Politics
Business
Finance
Sports
Entertainment
Lifestyle
Literature
Travel
Technology
Startups
Innovation
iBazaar deals
Art & Culture
Wine & Spirits
Science
Health
Local