Skip to content

Search for:
Log in
Register

Menu

Close
  • 人形机器人
  • 大模型
  • 机器学习
  • 物联网
  • VR/AR
  • 元宇宙
  • 云计算
  • 5G通讯
  • 区块链
  • 大数据
  • 智能手机终端
  • 智能汽车
  • 可穿戴设备
  • 智能硬件
  • 智能家居
  • 无人机
  • 智慧城市
  • 智能电网
  • 要闻
  • 访谈
  • 观察
  • 技术社区
  • AMT
  • SCF
  • 机械知网
  • 活动会议
  • 帐户
    • 登录
    • 注册
  • 返回首页
  • 人形机器人
  • 大模型
  • 机器学习
  • 物联网
  • VR/AR
  • 元宇宙
  • 云计算
  • 5G通讯
  • 区块链
  • 大数据
  • 智能手机终端
  • 智能汽车
  • 可穿戴设备
  • 智能硬件
  • 智能家居
  • 无人机
  • 智慧城市
  • 智能电网
  • 要闻
  • 访谈
  • 观察
  • 技术社区
  • AMT
  • SCF
  • 机械知网
  • 活动会议
  • 帐户
    • 登录
    • 注册
  • 返回首页
Search for:
Log in
Register

标签: 强化学习

  • Home
  • 强化学习
AI技术文章

DanceGRPO:首个统一视觉生成的强化学习框架

Written by yinhua 2025年5月15日
DanceGRPO:首个统一视觉生成的强化学习框架

R1 横空出世,带火了 GRPO 算法,RL 也随之成为 2025 年的热门技术探索方向,近期,字节 Seed … Continue reading “DanceGRPO:首个统一视觉生成的强化学习框架”

Loading

AI科技

OpenAI:强化学习确实可显著提高LLM性能,DeepSeek R1、Kimi k1.5发现o1的秘密

Written by yinhua 2025年2月20日
OpenAI:强化学习确实可显著提高LLM性能,DeepSeek R1、Kimi k1.5发现o1的秘密

OpenAI 在论文开篇就用一句话进行了总结:「将强化学习应用于大型语言模型(LLM)可显著提高在复杂编程和推 … Continue reading “OpenAI:强化学习确实可显著提高LLM性能,DeepSeek R1、Kimi k1.5发现o1的秘密”

Loading

AI科技

强化学习之父Richard Sutton给出一个简单思路,大幅增强所有RL算法

Written by yinhua 2024年11月1日

近日,强化学习之父、阿尔伯塔大学教授 Richard Sutton 的团队低调更新了一篇论文,其中提出了一种新 … Continue reading “强化学习之父Richard Sutton给出一个简单思路,大幅增强所有RL算法”

Loading

    AIF™ 是AMT™成员,上海蓝韬( Shanghai Bluewave™ )旗下产品,是领先的人工智能产业服务平台!联系我们: info@bluewave-corp.com 电话:021-37709287

    备案号: 沪ICP备18032047号-9

    Copyright © 2026 | Powered by BuddyX WordPress Theme
    登录
    注册|忘记密码?