您正在使用IE低版浏览器,为了您的雷峰网账号安全和更好的产品体验,强烈建议使用更快更安全的浏览器
雷峰网公开课
活动中心
GAIR
专题
爱搞机
业界
人工智能
学术
开发者
智能驾驶
数智化
零售数智化
金融数智化
工业数智化
医疗数智化
城市数智化
金融科技
科技巨头
银行AI
金融云
风控与安全
//= baseUrl()?>
医疗科技
医疗AI
投融资
医疗器械
互联网医疗
生物医药
健康险
芯片
政企安全
智慧城市
智慧安防
智慧教育
智慧交通
智慧社区
智慧零售
智慧政务
智慧地产
行业云
工业互联网
工业软件
工业安全
5G工业互联网
工业转型实践
AIoT
物联网
智能硬件
机器人
智能家居
热门标签
强化学习
强化学习
本专题为雷峰网的
强化学习
专题,内容全部来自雷峰网精心选择与
强化学习
相关的最近资讯,雷峰网读懂智能与未来,拥有
强化学习
资讯的信息,在这里你能看到未来的世界。
蚂蚁集团 IJCAI 2026 论文盘点:让 AI 学会「随机应变」
清华刘知远团队论文:在严格可控环境下重新回答「强化学习能否教会大模型新能力」丨ICLR 2026
「一脑多形」圆桌:世界模型、空间智能在具身智能出现了哪些具体进展?|GAIR 2025
强化学习最新资讯
人工智能
汪军对话 Rich Sutton:大模型在一定程度上分散了我们对智能理解的注意力
大模型缺乏目标和奖励,RL 才能驱动智能理解。
刘欣
09月28日 11:10
强化学习
人工智能
RL China
机器人
DeepMind 颠覆机器人学习范式:让机器像人一样 “自由成长”
从 “模仿者” 到 “学习者”,机器人的进化更进一步
刘欣
09月25日 17:11
deepmind
强化学习
具身智能
业界
外滩大会嘉宾锐评AGI即将“撞墙”,正在向数字与物理世界进化
AGI迈向系统智能,重塑数字物理边界。
小七
09月12日 17:36
多智能体系统
强化学习
蚂蚁金融
智能驾驶
多模态+强化学习,千里科技与阶跃星辰联合研发千里智驾RLM大模型
千里科技发布RLM智驾大模型,多模态+强化学习赋能L2+级自动驾驶新体验。
小七
06月24日 16:49
多模态大模型
强化学习
千里科技
人工智能
具身智能的“Z 世代”,来了
鲜衣怒马少年时,不负具身行且知。
洪雨欣
06月12日 10:36
具身智能
VLA
强化学习
人工智能
RL 是推理神器?清华上交大最新研究指出:RL 让大模型更会“套公式”、却不会真推理
基座模型天花板,困住强化学习。
郑佳美
梁丙鉴
04月23日 11:11
AI
RL
强化学习
人工智能
AI Agent 发展史:从 RL 驱动到大模型驱动 |AIR 2025
从 Agent 前沿研究中一窥复制 Manus 的启示。
王悦
03月31日 20:23
AIR2025
强化学习
Agent
人工智能学术
万字梳理:揭秘 DeepSeek 中的 RL 与 AGI 下一步丨AIR 2025
Transformer架构的非递归设计阻碍了跨层的记忆共享,或限制模型泛化能力。
王悦
02月28日 20:26
AIR2025
强化学习
DeepSeek
人工智能
UCL强化学习派:汪军与他的学生们
导语:他们构成中国强化学习研究的半壁江山。
赖文昕
02月27日 19:15
强化学习
UCL
汪军
人工智能
伯克利罗剑岚:机器人的范式革命,藏在真实世界中
导语:Sergey Levine 对罗剑岚说,“You really made RL work.”
赖文昕
11月12日 16:23
强化学习
具身智能
伯克利
1
2
3
4
5
...
10
相关文章
AI Agent 发展史:从 RL 驱动到大模型驱动 |AIR 2025
万字梳理:揭秘 DeepSeek 中的 RL 与 AGI 下一步丨AIR 2025
UCL强化学习派:汪军与他的学生们
伯克利罗剑岚:机器人的范式革命,藏在真实世界中
伯克利具身智能图谱:深度强化学习浪尖上的中国 90 后们
热门搜索
机器学习
无人驾驶
电动汽车
乐视
专利
游戏
增强现实
拼多多
数据中心
通用
移动电源
请填写申请人资料
姓名
电话
邮箱
微信号
作品链接
个人简介
为了您的账户安全,请
验证邮箱
您的邮箱还未验证,完成可获20积分哟!
重发邮箱
修改邮箱
请验证您的邮箱
立即验证
完善账号信息
您的账号已经绑定,现在您可以
设置密码
以方便用邮箱登录
立即设置
以后再说