Ayaka Nishimura
ayakani
ยท
AI & ML interests
anomaly detection
multi-agent RL
reward hacking
Recent Activity
liked a dataset 8 minutes ago
Dahoas/full-hh-rlhf liked a dataset 8 minutes ago
D21W12/Diffusion-Deep-Reinforcement-Learning liked a dataset 8 minutes ago
DBbun/motoman-up6-cq-lambda-reinforcement-learning_v1.0Organizations
None yet