Ayaka Nishimura
ayakani
ยท
AI & ML interests
anomaly detection
multi-agent RL
reward hacking
Recent Activity
liked a dataset about 18 hours ago
AdityaaXD/Multi-Agent_Reinforcement_Learning_Trading_System_Data liked a dataset about 18 hours ago
jojo0217/korean_rlhf_dataset upvoted a paper about 18 hours ago
DiffGate: Difficulty-Gated Teacher Guidance for On-Policy DistillationOrganizations
None yet