人工智能
机器人不能停下来等模型:星尘发布 SmoothRL,让在线强化学习跟上大模型的异步推理
量子位的朋友们 量子位
1 浏览
星尘智能(Astribot) 基座模型团队发布能异步执行的在线强化学习框架 SmoothRL
阅读原文:https://www.qbitai.com/2026/09/484437.html
← 上一篇
[AI Agent 智能体] 问下大家多台电脑的,如何同步桌面端 AI 软件(比如 ChatGPT, Claude)的对话呢?
下一篇 →
趋境科技与摩尔线程达成战略合作,高品质 AI Token 国产异构方案性价比超越国际先进算力