SD百科导航
  • 首页
  • 快讯
  • 早报
  • 模型
  • ComfyUI
  • 工具
  • 新技术
  • 百科
    • 教程
    • 硬件
    • 科普
  • 知识库
  • 导航
  • 百科工具
    • 首页
    • 快讯
    • 早报
    • 模型
    • ComfyUI
    • 工具
    • 新技术
    • 百科
      • 教程
      • 硬件
      • 科普
    • 知识库
    • 导航
    • 百科工具

    新技术

    共 939 篇文章
    百科工具模型ComfyUIAI合集web UI提示词
    教程新技术硬件科普早报
    排序
    发布更新浏览点赞
     LaTCoder:将网页设计图像自动转换为代码

     LaTCoder:将网页设计图像自动转换为代码

    华中科技大学和重庆大学的研究人员提出了一种名为 LaTCoder 的新方法,将网页设计图像自动转换为代码(即设计到代码,design-to-code)。这种方法通过引入“布局即思考”(Layout-a...
    新技术# LaTCoder
    4个月前
    01800
    微软推出 Agent Lightning:打通智能体开发与模型优化的“最后一公里”

    微软推出 Agent Lightning:打通智能体开发与模型优化的“最后一公里”

    在 AI 智能体(Agent)技术快速发展的当下,开发者已经可以通过 LangChain、AutoGen、OpenAI Agent SDK 等框架,快速构建具备工具调用、多轮对话和任务编排能力的智能系...
    新技术# Agent Lightning# 微软# 智能体
    4个月前
    01330
    R-Zero:首个完全自进化的推理增强框架,无需数据即可提升大模型能力

    R-Zero:首个完全自进化的推理增强框架,无需数据即可提升大模型能力

    由腾讯 AI 西雅图实验室、圣路易斯华盛顿大学、马里兰大学帕克分校与德克萨斯大学达拉斯分校联合提出的新框架 R-Zero,正在挑战当前大语言模型训练范式的边界。 项目主页:https://chengs...
    新技术# R-Zero# 推理增强框架
    4个月前
    05170
    基于二维高斯分布的图像表示方法Image-GS:通过自适应地分配和优化一组二维高斯分布来重建图像

    基于二维高斯分布的图像表示方法Image-GS:通过自适应地分配和优化一组二维高斯分布来重建图像

    纽约大学、英特尔和AMD的研究人员推出一种基于二维高斯分布的图像表示方法Image-GS,它通过自适应地分配和优化一组二维高斯分布来重建图像。这种方法旨在为图像和纹理提供一种高效、灵活且硬件友好的表示...
    新技术# Image-GS# 图像表示方法
    4个月前
    01630
    DAEDAL:无需训练的动态长度生成,释放扩散大模型新潜力

    DAEDAL:无需训练的动态长度生成,释放扩散大模型新潜力

    在大语言模型(LLM)领域,扩散型大语言模型(Diffusion Large Language Models, DLLMs)正凭借其并行生成能力与全局上下文建模优势,成为传统自回归模型(AR)的有力竞...
    新技术# DAEDAL# 扩散大模型
    4个月前
    01780
    加速DiT架构模型推理速度的新方法TaylorSeer:通过预测未来时间步的特征来加速扩散模型

    加速DiT架构模型推理速度的新方法TaylorSeer:通过预测未来时间步的特征来加速扩散模型

    上海交通大学、山东大学、电子科技大学和香港科技大学的研究人员推出加速DiT架构模型推理速度的新方法TaylorSeer,扩散模型在图像和视频生成任务中表现出色,但其计算需求较高,限制了实时应用的可行性...
    新技术# TaylorSeer
    4个月前
    01430
    Radial Attention:用“物理直觉”突破长视频生成的计算瓶颈

    Radial Attention:用“物理直觉”突破长视频生成的计算瓶颈

    近年来,视频生成模型在质量上取得了显著进步。然而,一个根本性挑战始终存在: 时序维度的引入,使计算成本呈指数级增长。 标准扩散模型中的稠密注意力机制(Dense Attention)在处理长视频时面临...
    新技术# Radial Attention
    4个月前
    01570
    阿里Qwen项目组推出新型强化学习算法GSPO:用于训练最新 Qwen3 模型

    阿里Qwen项目组推出新型强化学习算法GSPO:用于训练最新 Qwen3 模型

    阿里Qwen项目组推出新型强化学习算法 Group Sequence Policy Optimization (GSPO),用于训练大型语言模型(LLMs)。与以往基于单个标记(token)重要性比率...
    新技术# GSPO# Qwen3
    4个月前
    03240
    如何让AI“不生成某物”?UBC研究人员提出轻量级负提示新方案VSF

    如何让AI“不生成某物”?UBC研究人员提出轻量级负提示新方案VSF

    在文本到图像生成中,如何让模型“不生成某样东西”——例如“一只没有翅膀的鸟”或“一辆没有轮子的自行车”——始终是一个挑战。尽管正向提示可以引导生成内容,但负提示(negative prompt)的执行...
    新技术# VSF# 负面提示
    4个月前
    01590
    混合递归(MoR):用“动态思考”提升大模型推理效率

    混合递归(MoR):用“动态思考”提升大模型推理效率

    在大模型追求极致规模的浪潮中,一种新的架构正试图从“智能调度”而非“堆叠参数”的角度,重新定义效率。 由 KAIST AI 与 Mila 联合提出的新框架——混合递归(Mixture-of-Recur...
    新技术# MoR# 混合递归
    4个月前
    0850
    Snap Research 推出 Zero-Shot Dynamic Concept:无需微调,即可实现视频级动态个性化

    Snap Research 推出 Zero-Shot Dynamic Concept:无需微调,即可实现视频级动态个性化

    Snap Research 发布了一项名为 Zero-Shot Dynamic Concept 的新方法,为文本到视频生成模型中的动态概念个性化提供了全新的解决方案。该技术基于网格化 LoRA 架构...
    新技术# Snap Research# Zero-Shot Dynamic Concept
    5个月前
    01070
    首尔大学研究团队提出推理加速框架 RALU:无需训练的混合分辨率采样,加速DIT架构模型推理最高达7倍

    首尔大学研究团队提出推理加速框架 RALU:无需训练的混合分辨率采样,加速DIT架构模型推理最高达7倍

    DIT架构模型凭借其卓越的可扩展性,正逐步取代传统的 U-Net 架构,成为高保真图像与视频生成的主流模型。然而,其高昂的计算成本严重制约了在移动端、实时应用和大规模部署中的实用性。 为解决这一瓶颈...
    新技术# DiT架构模型# RALU# 首尔大学
    5个月前
    01040
    加载更多
    SD百科导航
    SD百科导航是专注于AI创作领域的专业导航网站。我们全面涵盖Stable Diffusion、Flux、AI绘画、AI视频、AI音乐以及大语言模型等前沿内容。

    友链申请免责声明广告合作关于我们

    扫码关注微信公众号SD百科导航
    扫码关注微信公众号
    Copyright © 2025 SD百科导航 皖ICP备18025588号-5  皖公网安备34040002000401 
    网址
    网址文章软件模型

    网址

    日榜周榜月榜
    OpenStock

    OpenStock

    OpenStock 是昂贵市场平台的开源替代品。追踪实时价格、设置个性化提醒并探索详细的公司洞察——公开构建,为所有人服务,永久免费。
    Next AI Draw.io

    Next AI Draw.io

    Next AI Draw.io 是一个基于 Next.js 的 Web 应用,将大语言模型(LLM)与 draw.io 的强大图表能力深度集成。用户可通过自然语言指令创建、修改和增强专业图表,无需手动拖拽。
    朱雀大模型检测

    朱雀大模型检测

    腾讯朱雀 AI 检测是于 2025 年 1 月 17 日推出的一款 AI 生成内容检测工具,主要用于帮助用户识别 AI 生成的文本和图像内容。每位用户每天最多可检测20次文本和20次图片。
    DiffRhythm(谛韵)

    DiffRhythm(谛韵)

    DiffRhythm(中文名“谛韵”)是由西北工业大学音频、语音与语言处理研究组(ASLP Lab)和香港中文大学(深圳)深圳大数据研究院联合开发的新型端到端全长度歌曲生成模型。基于潜扩散(Latent Diffusion)技术,DiffRhythm 能够快速生成包含人声和伴奏的完整歌曲,解决了现有音乐生成方法的诸多局限性。
    Magentic-UI

    Magentic-UI

    Magentic-UI 是一个由多代理系统驱动的研究原型,专为网页任务自动化而设计。它不仅能帮助用户在网页上轻松浏览和执行各种操作,还能生成和执行代码,以及生成和分析文件。无论是填写复杂的表单、定制个性化的食品订单,还是在未被搜索引擎索引的网站上进行深度导航,如筛选航班、查找个人网站上的链接,亦或是需要网页导航和代码执行的任务,如从在线数据生成图表,Magentic-UI 都能轻松应对。
    YouMind

    YouMind

    YouMind 是一款重新构想的 AI 写作工具,帮助每个人轻松开启创作之旅。捕捉灵感、收集素材、撰写草稿,并将其转化为精炼的文章、播客、视频等丰富内容。
    查看完整榜单