SD百科导航
  • 首页
  • 快讯
  • 早报
  • 模型
  • ComfyUI
  • 新技术
  • 百科
    • 教程
    • 硬件
    • 科普
  • 百科工具
    • 工具
  • 排行榜
  • 网址提交
    • 首页
    • 快讯
    • 早报
    • 模型
    • ComfyUI
    • 新技术
    • 百科
      • 教程
      • 硬件
      • 科普
    • 百科工具
      • 工具
    • 排行榜
    • 网址提交

    FlashRL

    共 1 篇文章
    排序
    发布更新浏览点赞
    大模型 RL 加速新方案:FlashRL 实现无损量化 rollout

    大模型 RL 加速新方案:FlashRL 实现无损量化 rollout

    在大模型强化学习(RL)训练中,rollout 生成是耗时最长的环节之一。以 DAPO-32B 为例,rollout 阶段占据了约 70% 的总训练时间。这一瓶颈使得整个训练流程效率低下,尤其在大规模...
    新技术# FlashRL
    5个月前
    03330
    没有了
    SD百科导航
    SD百科导航是专注于AI创作领域的专业导航网站。我们全面涵盖Stable Diffusion、Flux、AI绘画、AI视频、AI音乐以及大语言模型等前沿内容。

    关于我们网址提交友链申请广告合作

    扫码关注微信公众号SD百科导航
    扫码关注微信公众号
    Copyright © 2026 SD百科导航 皖ICP备18025588号-5  皖公网安备34040002000401 
    网址
    网址文章软件模型

    网址

    日榜周榜月榜
    AIpai

    AIpai

    AIPAI是一款新一代AI视频创作智能体,专注于通过人与AI的协作方式解决多样化和复杂的视频制作需求。
    Shape-O-Holic

    Shape-O-Holic

    Shape-O-Holic专注于提供高品质、易定制的 SVG 向量形状素材。目前收录超过 140 个简洁现代的图形,涵盖自然、科技、情绪、食物、天气等多种主题,所有素材均可免费下载并用于商业项目,无需署名。
    BuildCores

    BuildCores

    BuildCores 是一款集 3D 组装预览、智能兼容性检测、全球比价 于一体的在线装机工具。无论你是首次装机的新手,还是追求极致性能的发烧友,都能在手机或电脑上轻松规划、验证并优化你的 PC 配置。
    NotebookLM

    NotebookLM

    NotebookLM是谷歌推出的一款个性化AI协作工具,旨在帮助用户更高效地进行信息整理和笔记记录。利用强大的语言模型帮助用户更快地从各种文本、图像以及网页中提取主要信息。
    DiffRhythm(谛韵)

    DiffRhythm(谛韵)

    DiffRhythm(中文名“谛韵”)是由西北工业大学音频、语音与语言处理研究组(ASLP Lab)和香港中文大学(深圳)深圳大数据研究院联合开发的新型端到端全长度歌曲生成模型。基于潜扩散(Latent Diffusion)技术,DiffRhythm 能够快速生成包含人声和伴奏的完整歌曲,解决了现有音乐生成方法的诸多局限性。
    Juchats

    Juchats

    Juchats是一个基于GPT、Claude、Gemini、DeepSeek等模型API打造的聊天平台,由Hermstudio推出,支持个性化设置和实时互动,界面设计直观,适合各种用户。
    查看完整榜单