SD百科导航
  • 首页
  • 快讯
  • 早报
  • 模型
  • ComfyUI
  • 新技术
  • 百科
    • 教程
    • 硬件
    • 科普
  • 百科工具
    • 工具
  • 排行榜
  • 网址提交
    • 首页
    • 快讯
    • 早报
    • 模型
    • ComfyUI
    • 新技术
    • 百科
      • 教程
      • 硬件
      • 科普
    • 百科工具
      • 工具
    • 排行榜
    • 网址提交

    大语言模型

    共 41 篇文章
    排序
    发布更新浏览点赞
    谷歌发布 Gemma 3:您可以在单个 GPU 或 TPU 上运行的最强大模型

    谷歌发布 Gemma 3:您可以在单个 GPU 或 TPU 上运行的最强大模型

    谷歌在今天宣布推出 Gemma 3,声称这是目前可以在单个 GPU 上运行的最强大的 AI 模型。这款全新升级的“开放”AI 模型不仅能够处理文本,还能解读图像和短视频,进一步拓展了其应用场景。 Ge...
    早报# Gemma 3# Gemmaverse# 大语言模型
    11个月前
    03190
    端到端的训练框架Mimir:通过大语言模型增强文本到视频生成

    端到端的训练框架Mimir:通过大语言模型增强文本到视频生成

    蚂蚁集团和清华大学的研究人员提出了Mimir,这是一个端到端的训练框架,旨在解决当前视频扩散模型在文本理解方面的不足,并充分利用大语言模型(LLMs)的强大文本处理能力。Mimir通过引入精心设计的标...
    新技术# Mimir# 大语言模型
    1年前
    02910
    高效的无数据量化方法HIGGS:可快速压缩大语言模型而无需显著牺牲质量

    高效的无数据量化方法HIGGS:可快速压缩大语言模型而无需显著牺牲质量

    近年来,大语言模型(LLM)的快速发展为AI领域带来了巨大的潜力,但其对计算资源的高需求也限制了广泛应用。无论是研究机构还是个人开发者,都面临着高昂的成本和技术门槛。然而,这一局面可能即将被打破。 由...
    新技术# HIGGS# 大语言模型
    10个月前
    02700
    字节跳动发布DAPO(动态采样策略优化):提升大语言模型的推理能力

    字节跳动发布DAPO(动态采样策略优化):提升大语言模型的推理能力

    来自字节跳动、清华大学和香港大学的研究团队共同推出了一款名为 DAPO(动态采样策略优化)的开源系统,旨在提升大语言模型(LLM)的推理能力。DAPO 的发布标志着在强化学习(RL)技术应用于大规模语...
    新技术# DAPO# 动态采样策略优化# 大语言模型
    10个月前
    02580
    开启大语言模型的新篇章:《大语言模型的后训练技术:全面综述》

    开启大语言模型的新篇章:《大语言模型的后训练技术:全面综述》

    在AI领域,大语言模型(LLMs)的发展正以前所未有的速度重塑自然语言处理(NLP)的边界。从聊天机器人到科学探索,LLMs 已经成为不可或缺的工具。然而,这些模型在预训练阶段往往暴露出在特定领域的局...
    新技术# 后训练# 大语言模型
    11个月前
    02570
    谷歌推出Gemma系列最新模型Gemma 3,号称是全球最佳单加速器模型

    谷歌推出Gemma系列最新模型Gemma 3,号称是全球最佳单加速器模型

    自首次推出以来,Gemma 模型已被下载超过 1 亿次,社区创造了超过 60,000 个适用于各种用例的变体。今天,谷歌正式发布 Gemma 3,这是 Gemma 开源模型家族中最强大、最先进的版本...
    大语言模型# Gemma 3# 多语言大语言模型# 大语言模型
    11个月前
    02540
    针对大语言模型(LLMs)的量化感知训练(QAT)的统一缩放定律

    针对大语言模型(LLMs)的量化感知训练(QAT)的统一缩放定律

    香港大学和字节跳动的研究人员介绍了一种针对大语言模型(LLMs)的量化感知训练(QAT)的统一缩放定律。量化是一种减少模型权重和激活精度的方法,以降低内存使用和计算成本。尽管现有的量化方法在中等精度...
    新技术# 大语言模型# 量化感知训练
    8个月前
    02510
    LongWriter-Zero:通过强化学习从零开始训练大语言模型,以实现超长文本生成

    LongWriter-Zero:通过强化学习从零开始训练大语言模型,以实现超长文本生成

    新加坡科技设计大学和清华大学的研究人员推出新型模型LongWriter-Zero,基于 Qwen 2.5-32B-Base 构建,通过强化学习(RL)从零开始训练大语言模型(LLMs),以实现超长文本...
    大语言模型# LongWriter-Zero# 大语言模型
    7个月前
    02440
    大语言模型真的具备推理能力吗?——RoR-Bench研究揭示真相

    大语言模型真的具备推理能力吗?——RoR-Bench研究揭示真相

    随着大语言模型(LLMs)在各种任务上的表现越来越接近人类水平,人们开始质疑这些模型是否真的具备人类意义上的推理能力,还是仅仅是在重复训练过程中见过的解决方案。 论文:https://arxiv.or...
    新技术# 大语言模型# 推理能力
    10个月前
    02440
    阿里巴巴提出START:显著提升大语言模型推理能力的创新工具

    阿里巴巴提出START:显著提升大语言模型推理能力的创新工具

    在大语言模型的发展中,尽管在理解和生成类人文本方面取得了显著进展,但在处理复杂推理任务时,尤其是需要多步计算或逻辑分析的任务,这些模型往往表现不佳。传统的思维链(Chain of Thought, C...
    新技术# START# 大语言模型# 推理
    11个月前
    02280
    ComfyUI LLM Toolkit:将各种大语言模型提供商与 ComfyUI 集成的自定义节点集合

    ComfyUI LLM Toolkit:将各种大语言模型提供商与 ComfyUI 集成的自定义节点集合

    ComfyUI LLM Toolkit是一个专为 ComfyUI 打造的自定义节点集合,旨在将多种大语言模型(包括云端和本地模型)无缝集成到工作流中。无论是文本生成、图像创作,还是未来的视频生成,这款...
    插件# ComfyUI LLM Toolkit# 大语言模型
    9个月前
    02270
    改进大语言模型的后训练方法,提升其在创意写作任务中的输出多样性和质量

    改进大语言模型的后训练方法,提升其在创意写作任务中的输出多样性和质量

    Midjourney和纽约大学的研究人员发布论文《Modifying Large Language Model Post-Training for Diverse Creative Writing...
    新技术# 创意写作# 大语言模型
    10个月前
    02060
    加载更多
    SD百科导航
    SD百科导航是专注于AI创作领域的专业导航网站。我们全面涵盖Stable Diffusion、Flux、AI绘画、AI视频、AI音乐以及大语言模型等前沿内容。

    关于我们网址提交友链申请广告合作

    扫码关注微信公众号SD百科导航
    扫码关注微信公众号
    Copyright © 2026 SD百科导航 皖ICP备18025588号-5  皖公网安备34040002000401 
    网址
    网址文章软件模型

    网址

    日榜周榜月榜
    Clawdbot/Moltbot

    Clawdbot/Moltbot

    Clawdbot 是一款可在您自己的设备上运行的个人 AI 助手。它在您已使用的渠道(WhatsApp、Telegram、Slack、Discord、Google Chat、Signal、iMessage、Microsoft Teams、WebChat)以及扩展渠道(如 BlueBubbles、Matrix、Zalo 和 Zalo Personal)上为您提供应答。它可以在 macOS/iOS/Android 上进行语音交谈,并能渲染一个您可控制的实时画布。网关仅是控制平面——核心产品是助手本身。
    Skills.sh

    Skills.sh

    Vercel 近日上线了一个名为 skills.sh 的新站点,专门用于发现、浏览和安装 AI 智能体的“技能”(Skills)。
    Situation Monitor

    Situation Monitor

    Situation Monitor 是由开发者 Reggie James 创建的一个免费、开源的全球风险监测平台。它通过一张交互式地图,实时整合并可视化全球范围内的关键地缘政治与安全信息,帮助用户快速掌握潜在冲突热点和战略动态。
     CutCut

     CutCut

    CutCut是一个视频下载与剪辑工具,支持从 YouTube、Bilibili 等主流平台直接按章节或自定义时间范围下载片段,无需先下完整视频再剪辑。
    Fogsight (雾象)

    Fogsight (雾象)

    雾象是一款由大语言模型(LLM)驱动的动画引擎 agent 。用户输入抽象概念或词语,雾象会将其转化为高水平的生动动画。
    Awesome Clawdbot(Moltbot) Skills

    新Awesome Clawdbot(Moltbot) Skills

    社区维护了一份名为 Awesome Clawdbot (Moltbot) Skills 的精选技能集合。该列表收录了 565 项以上 来自 ClawdHub(Moltbot 官方公共技能注册表)的技能,并按功能类别组织,便于浏览与安装。
    查看完整榜单