强化学习最近是不是没有什么突破了?
研一方向是多智能体强化学习,发现用的算法像是PPO,SAC,TD3都是好几年前的东西,多智能体强化学习的算法和单智能体强化学习的算法整体框架也都相近。也没听说deepmind和openai最近在决策智能这块有什么动作
HOT TREND
近 7 次采集,数值由热榜热度字段解析而来
热度走势
CONFIRMED
已确认的信息
- 来源平台:知乎
- 首次收录:2026-09-13 00:22:04 UTC
- 最近更新:2026-09-13 01:52:12 UTC
- 历史最佳排名:第 28 位
- 最近热度:69 万热度