SD百科导航
  • 首页
  • 快讯
  • 早报
  • 模型
  • ComfyUI
  • 新技术
  • 百科
    • 教程
    • 硬件
    • 科普
  • 百科工具
    • 工具
  • 排行榜
  • 网址提交
    • 首页
    • 快讯
    • 早报
    • 模型
    • ComfyUI
    • 新技术
    • 百科
      • 教程
      • 硬件
      • 科普
    • 百科工具
      • 工具
    • 排行榜
    • 网址提交

    新技术

    共 958 篇文章
    百科工具模型ComfyUIAI合集web UI提示词
    教程新技术硬件科普早报
    排序
    发布更新浏览点赞
    Sakana AI 新算法 M2N2:无需重新训练,让 AI 模型 “进化” 得更强

    Sakana AI 新算法 M2N2:无需重新训练,让 AI 模型 “进化” 得更强

    日本 AI 实验室 Sakana AI 近期推出一项突破性技术 ——自然生态位模型合并(M2N2) ,彻底改变了 AI 模型的优化逻辑。与传统依赖昂贵算力和海量数据的 “重新训练”“微调” 不同,M2...
    新技术# M2N2# Sakana AI
    7个月前
    01510
    Mixture of Contexts (MoC) :新型注意力机制模块来解决长视频生成中的长期记忆问题

    Mixture of Contexts (MoC) :新型注意力机制模块来解决长视频生成中的长期记忆问题

    斯坦福大学、字节跳动、约翰·霍普金斯大学和香港中文大学的研究人员推出一种名为 Mixture of Contexts (MoC) 的新型注意力机制模块来解决长视频生成中的长期记忆问题。长视频生成的关键...
    新技术# MoC# 长视频生成
    7个月前
    01270
    TKG-DM:无需微调,让扩散模型精准生成色键背景图像

    TKG-DM:无需微调,让扩散模型精准生成色键背景图像

    当前扩散模型已能生成高真实感、高文本忠实度的图像,但主流大规模文本到图像模型(如 Stable Diffusion)面临一大局限——难以生成“前景对象置于色键背景”的图像,若要分离前景与背景元素,往往...
    新技术# TKG-DM
    7个月前
    01500
    TransMLA 框架 + TPLA 机制:解决 GQA 模型迁移痛点,大幅提升 LLM 推理效率

    TransMLA 框架 + TPLA 机制:解决 GQA 模型迁移痛点,大幅提升 LLM 推理效率

    由北京大学人工智能研究院、北京通用人工智能研究院与腾讯优图实验室联合提出的新方法 TransMLA,为大模型推理效率的提升提供了一条实用路径。该方法能够将已广泛部署的 GQA(Grouped Quer...
    新技术# TPLA 机制# TransMLA
    7个月前
    01790
    XQUANT:通过低比特量化和KV缓存重物质化来显著降低大语言模型推理过程中的内存消耗

    XQUANT:通过低比特量化和KV缓存重物质化来显著降低大语言模型推理过程中的内存消耗

    加州大学伯克利分校、FuriosaAI、ICSI和劳伦斯伯克利国家实验室的研究人员推出一种名为XQUANT的技术,通过低比特量化和KV缓存重物质化来显著降低大语言模型(LLM)推理过程中的内存消耗。X...
    新技术# KV缓存# XQUANT
    7个月前
    01990
    港大、浙大联合快手提出Context-as-Memory:解决交互式长视频生成的场景一致性难题

    港大、浙大联合快手提出Context-as-Memory:解决交互式长视频生成的场景一致性难题

    香港大学、浙江大学与快手可灵团队的研究人员,针对当前交互式长视频生成中“场景易断裂、历史上下文难复用”的痛点,提出 Context-as-Memory(上下文即记忆) 方法。该方法通过将历史帧直接作为...
    新技术# Context-as-Memory# 场景一致性
    7个月前
    03450
    DuPO框架:通过双学习和偏好优化的方法,使大语言模型能够在没有标注数据的情况下进行自我验证和优化

    DuPO框架:通过双学习和偏好优化的方法,使大语言模型能够在没有标注数据的情况下进行自我验证和优化

    字节跳动Seed团队和南京大学的研究人员推出DuPO框架,它通过双学习(dual learning)和偏好优化(preference optimization)的方法,使大语言模型(LLMs)能够在没...
    新技术# DuPO框架# 大语言模型
    7个月前
    01850
    北卡教堂山分校新研究:GPT-5、Gemini-2.5-Pro等顶级多模态大语言模型,竟难区分图像90°与270°旋转

    北卡教堂山分校新研究:GPT-5、Gemini-2.5-Pro等顶级多模态大语言模型,竟难区分图像90°与270°旋转

    北卡罗来纳大学教堂山分校的研究团队,针对多模态大语言模型(MLLMs)的空间视觉推理能力展开专项测试——聚焦“图像旋转角度识别”任务(判断图像是否旋转0°、90°、180°、270°)。 GitHub...
    新技术# RotBench# 多模态大语言模型# 空间视觉推理能力
    7个月前
    01500
    自动化桌面任务设计的框架COMPUTERRL:通过强化学习提升计算机桌面智能代理的操作能力

    自动化桌面任务设计的框架COMPUTERRL:通过强化学习提升计算机桌面智能代理的操作能力

    清华大学、智谱AI和中国科学院大学的研究人员推出一个名为 COMPUTERRL 的框架,通过强化学习(Reinforcement Learning, RL)提升计算机桌面智能代理(agents)的操作...
    新技术# COMPUTERRL
    7个月前
    01790
    TLB-VFI:让视频帧插值更高效,时序信息与速度兼得

    TLB-VFI:让视频帧插值更高效,时序信息与速度兼得

    视频帧插值(VFI)是计算机视觉领域的关键任务——它能根据两个连续帧(过去帧(I_0)、未来帧(I_1))生成中间帧(I_n),让视频播放更流畅、压缩更高效。但现有方法始终面临“两难”:基于图像的扩散...
    新技术# TLB-VFI# 视频帧插
    7个月前
    02050
    如何让图像生成模型“遗忘”一个概念?东北大学与MIT提出扩散模型概念擦除新方法

    如何让图像生成模型“遗忘”一个概念?东北大学与MIT提出扩散模型概念擦除新方法

    随着图像生成模型(如Stable Diffusion、Flux等)在质量和可控性上的飞速进步,其潜在风险也日益凸显: 生成裸露或暴力内容 模仿特定艺术家风格引发版权争议 复现受保护的商标或人物形象 现...
    新技术# 图像生成模型# 概念擦除
    7个月前
    02340
    大模型 RL 加速新方案:FlashRL 实现无损量化 rollout

    大模型 RL 加速新方案:FlashRL 实现无损量化 rollout

    在大模型强化学习(RL)训练中,rollout 生成是耗时最长的环节之一。以 DAPO-32B 为例,rollout 阶段占据了约 70% 的总训练时间。这一瓶颈使得整个训练流程效率低下,尤其在大规模...
    新技术# FlashRL
    7个月前
    04440
    加载更多
    SD百科导航
    SD百科导航是专注于AI创作领域的专业导航网站。我们全面涵盖Stable Diffusion、Flux、AI绘画、AI视频、AI音乐以及大语言模型等前沿内容。

    关于我们网址提交友链申请广告合作

    扫码关注微信公众号SD百科导航
    扫码关注微信公众号
    Copyright © 2026 SD百科导航 皖ICP备18025588号-5  皖公网安备34040002000401 
    网址
    网址文章软件模型

    网址

    日榜周榜月榜
    悟空

    悟空

    阿里巴巴发布全球首个企业级AI原生工作平台——“悟空”,让每个团队、每家公司,都能拥有一支24h工作的“龙虾军团”。悟空是一款独立应用,即日起开启邀测,也将直接内置到超2000万企业组织的钉钉之中。
    S.H.I.T

    S.H.I.T

    在主流学术界为顶刊版面、高影响因子和“非升即走”的考核指标疯狂内卷之时,一场名为“学术垃圾”的反叛运动正在角落里悄然兴起。一群“想开了”的硕博研究生和青年学者(青椒),不再试图迎合传统的学术评价体系,而是隆重推出了一系列名字惊世骇俗的“旗舰”期刊——《SHIT》、《Notrue》、《Silence》、《Crazy》。
    Meshy

    Meshy

    Meshy 是一款非常适合初学者和专业用户的 3D 模型生成工具。无论是快速建模、3D 打印还是动画设计,它都能轻松应对。如果你对 3D 模型创建感兴趣,不妨试试 Meshy,让生成式 AI 为你的创意插上翅膀!
    OpenMAIC

    OpenMAIC

    OpenMAIC是一个开源的 AI 互动课堂平台,能够将任何主题或文档转化为丰富的互动学习体验。基于多智能体协作引擎,它可以自动生成演示幻灯片、测验、交互式模拟实验和项目制学习活动——由 AI 教师和 AI 同学进行语音讲解、白板绘图,并与你展开实时讨论。内置 OpenClaw 集成,你还可以直接在飞书、Slack、Telegram 等聊天应用中生成课堂。
    BuildCores

    BuildCores

    BuildCores 是一款集 3D 组装预览、智能兼容性检测、全球比价 于一体的在线装机工具。无论你是首次装机的新手,还是追求极致性能的发烧友,都能在手机或电脑上轻松规划、验证并优化你的 PC 配置。
    Grok

    Grok

    Grok是一款先进的对话式人工智能。Grok 旨在提供高效、准确且自然的对话交互体验,适用于多种应用场景,包括客户服务、虚拟助手、教育辅导等。
    查看完整榜单