强化学习最近是不是没有什么突破了?

研一方向是多智能体强化学习,发现用的算法像是PPO,SAC,TD3都是好几年前的东西,多智能体强化学习的算法和单智能体强化学习的算法整体框架也都相近。也没听说deepmind和openai最近在决策智能这块有什么动作

查看原文
分享到:

相关推荐

What is the difference between a dead pixel and a ...

1小时前

AI基建让建筑产业链再度“复生”?

1小时前

从OpenAI的《外星思维》说起:AI越来越强,我们为什么还要亲自学习?

1小时前

奥尔特曼:受人工智能安全担忧影响,OpenAI不会在2026年上市

1小时前