SD百科导航
  • 首页
  • 快讯
  • 早报
  • 模型
  • ComfyUI
  • 新技术
  • 百科
    • 教程
    • 硬件
    • 科普
  • 百科工具
    • 工具
  • 知识库
  • 排行榜
  • 网址提交
    • 首页
    • 快讯
    • 早报
    • 模型
    • ComfyUI
    • 新技术
    • 百科
      • 教程
      • 硬件
      • 科普
    • 百科工具
      • 工具
    • 知识库
    • 排行榜
    • 网址提交

    新技术

    共 942 篇文章
    百科工具模型ComfyUIAI合集web UI提示词
    教程新技术硬件科普早报
    排序
    发布更新浏览点赞
    PractiLight:基于基础扩散模型实现实用光照控制,兼顾泛化与效率

    PractiLight:基于基础扩散模型实现实用光照控制,兼顾泛化与效率

    在图像生成领域,精准控制光照一直是颇具挑战性的任务 —— 改变场景光照不仅要调整直接光源效果,还需协调反射、阴影、高光等连锁反应,涉及全图像及多频率范围的复杂关系。现有方法多依赖大规模特定领域数据集训...
    新技术# PractiLight# 光照控制
    4个月前
    01600
    TRKT:用关系感知与时序增强提升弱监督场景图生成

    TRKT:用关系感知与时序增强提升弱监督场景图生成

    在视频理解任务中,如何让机器“看懂”复杂的视觉场景?不仅要知道画面中有哪些对象,还要理解它们之间的互动关系——这正是动态场景图生成(Dynamic Scene Graph Generation, DS...
    新技术# TRKT# 场景图生成
    4个月前
    01410
    RealDevWorld:首个面向 AI 开发的生产级软件工程基准

    RealDevWorld:首个面向 AI 开发的生产级软件工程基准

    随着 AI 编程能力的快速演进,越来越多的模型可以“一键生成”完整应用。但一个问题随之而来:我们该如何判断这些 AI 生成的应用,是否真的可用? 传统的代码评测方法,如 LeetCode 式的算法题或...
    新技术# RealDevWorld# 软件工程基准
    4个月前
    01220
    腾讯推出 Think in Games (TiG) 框架:通过强化学习结合大语言模型来提升模型在游戏环境中的决策和推理能力

    腾讯推出 Think in Games (TiG) 框架:通过强化学习结合大语言模型来提升模型在游戏环境中的决策和推理能力

    腾讯推出 Think in Games (TiG) 框架,通过强化学习(Reinforcement Learning, RL)结合大语言模型(LLMs)来提升模型在游戏环境中的决策和推理能力。TiG ...
    新技术# Think in Games# 腾讯
    4个月前
    01990
    新型辅助训练目标Token Order Prediction (TOP):用于改进语言模型中的下一个词预测(NTP)任务

    新型辅助训练目标Token Order Prediction (TOP):用于改进语言模型中的下一个词预测(NTP)任务

    MBZUAI推出新型辅助训练目标Token Order Prediction (TOP),用于改进语言模型中的下一个词预测(Next-Token Prediction, NTP)任务。TOP 通过预测...
    新技术# TOP# 辅助训练目标
    4个月前
    0810
    字节跳动推出 UltraMemV2:在低内存访问下,追平8专家MoE性能

    字节跳动推出 UltraMemV2:在低内存访问下,追平8专家MoE性能

    在大模型稀疏化架构的演进中,效率与性能的权衡始终是核心挑战。 MoE(Mixture of Experts)通过仅激活部分专家实现高效推理,但其频繁的跨专家参数访问带来了高昂的内存开销。为解决这一问题...
    新技术# UltraMemV2# 字节跳动
    4个月前
    0820
    Beyond Memorization:通过不同的架构和训练方法来提升大语言模型多步推理能力

    Beyond Memorization:通过不同的架构和训练方法来提升大语言模型多步推理能力

    阿联酋MBZUAI、莫斯科物理技术学院、莫斯科AIRI和伦敦数学科学研究所的研究人员推出Beyond Memorization,通过不同的架构和训练方法来提升大语言模型(LLMs)多步推理能力。作者们...
    新技术# Beyond Memorization# 大语言模型
    4个月前
    0860
    应对 95% AI 试点失败!Salesforce 发布 CRMArena-Pro,模拟真实业务环境

    应对 95% AI 试点失败!Salesforce 发布 CRMArena-Pro,模拟真实业务环境

    企业AI的一大痛点是“演示时亮眼,落地时拉胯”——MIT最新报告显示,95%的企业生成式AI试点无法推进至生产阶段,Salesforce自身研究也发现,仅依赖大语言模型(LLM)的AI代理在复杂业务场...
    新技术# CRMArena-Pro# Salesforce
    4个月前
    01410
    Sakana AI 新算法 M2N2:无需重新训练,让 AI 模型 “进化” 得更强

    Sakana AI 新算法 M2N2:无需重新训练,让 AI 模型 “进化” 得更强

    日本 AI 实验室 Sakana AI 近期推出一项突破性技术 ——自然生态位模型合并(M2N2) ,彻底改变了 AI 模型的优化逻辑。与传统依赖昂贵算力和海量数据的 “重新训练”“微调” 不同,M2...
    新技术# M2N2# Sakana AI
    4个月前
    01170
    Mixture of Contexts (MoC) :新型注意力机制模块来解决长视频生成中的长期记忆问题

    Mixture of Contexts (MoC) :新型注意力机制模块来解决长视频生成中的长期记忆问题

    斯坦福大学、字节跳动、约翰·霍普金斯大学和香港中文大学的研究人员推出一种名为 Mixture of Contexts (MoC) 的新型注意力机制模块来解决长视频生成中的长期记忆问题。长视频生成的关键...
    新技术# MoC# 长视频生成
    4个月前
    01090
    TKG-DM:无需微调,让扩散模型精准生成色键背景图像

    TKG-DM:无需微调,让扩散模型精准生成色键背景图像

    当前扩散模型已能生成高真实感、高文本忠实度的图像,但主流大规模文本到图像模型(如 Stable Diffusion)面临一大局限——难以生成“前景对象置于色键背景”的图像,若要分离前景与背景元素,往往...
    新技术# TKG-DM
    5个月前
    01210
    TransMLA 框架 + TPLA 机制:解决 GQA 模型迁移痛点,大幅提升 LLM 推理效率

    TransMLA 框架 + TPLA 机制:解决 GQA 模型迁移痛点,大幅提升 LLM 推理效率

    由北京大学人工智能研究院、北京通用人工智能研究院与腾讯优图实验室联合提出的新方法 TransMLA,为大模型推理效率的提升提供了一条实用路径。该方法能够将已广泛部署的 GQA(Grouped Quer...
    新技术# TPLA 机制# TransMLA
    5个月前
    01370
    加载更多
    SD百科导航
    SD百科导航是专注于AI创作领域的专业导航网站。我们全面涵盖Stable Diffusion、Flux、AI绘画、AI视频、AI音乐以及大语言模型等前沿内容。

    关于我们网址提交友链申请广告合作

    扫码关注微信公众号SD百科导航
    扫码关注微信公众号
    Copyright © 2026 SD百科导航 皖ICP备18025588号-5  皖公网安备34040002000401 
    网址
    网址文章软件模型

    网址

    日榜周榜月榜
    人生 K 线

    人生 K 线

    人生 K 线(Life Destiny K-Line)是一个结合传统八字命理与现代大语言模型(LLM)的轻量级可视化工具。它将一个人从 1 岁到 100 岁的运势走势,以类似股票 K 线图的形式呈现,试图用数据可视化的方式“翻译”命理推演结果。
    Fogsight (雾象)

    Fogsight (雾象)

    雾象是一款由大语言模型(LLM)驱动的动画引擎 agent 。用户输入抽象概念或词语,雾象会将其转化为高水平的生动动画。
    NotebookLM

    NotebookLM

    NotebookLM是谷歌推出的一款个性化AI协作工具,旨在帮助用户更高效地进行信息整理和笔记记录。利用强大的语言模型帮助用户更快地从各种文本、图像以及网页中提取主要信息。
    Google AI Studio

    Google AI Studio

    Google AI Studio 是一个功能齐全的工具,特别适合希望快速构建和试验 AI 应用的开发者。其多模态支持、提示库和与 Gemini API 的无缝集成使其成为生成 AI 开发的有力平台。
    Next AI Draw.io

    Next AI Draw.io

    Next AI Draw.io 是一个基于 Next.js 的 Web 应用,将大语言模型(LLM)与 draw.io 的强大图表能力深度集成。用户可通过自然语言指令创建、修改和增强专业图表,无需手动拖拽。
    KEJILION.SH

    新KEJILION.SH

    科技Lion的Shell脚本工具是款全能脚本工具箱,使用shell脚本编写。专为Linux服务器监控、测试和管理而设计。 无论您是初学者还是经验丰富的用户,该工具都能为您提供便捷的解决方案。
    查看完整榜单