SD百科导航
  • 首页
  • 快讯
  • 早报
  • 模型
  • ComfyUI
  • 新技术
  • 百科
    • 教程
    • 硬件
    • 科普
  • 百科工具
    • 工具
  • 排行榜
  • 网址提交
    • 首页
    • 快讯
    • 早报
    • 模型
    • ComfyUI
    • 新技术
    • 百科
      • 教程
      • 硬件
      • 科普
    • 百科工具
      • 工具
    • 排行榜
    • 网址提交

    百科

    共 2628 篇文章
    百科工具模型ComfyUIAI合集web UI提示词
    教程新技术硬件科普早报
    排序
    发布更新浏览点赞
    灵活视觉变换器FiT v2:根据给定的文本描述或已有的图像,生成高质量、高分辨率的新图像

    灵活视觉变换器FiT v2:根据给定的文本描述或已有的图像,生成高质量、高分辨率的新图像

    自然界的图像具有无穷的分辨率,而现有的扩散模型(如扩散变换器)在处理超出其训练领域的图像分辨率时常常面临挑战。为了解决这一限制,研究人员提出了一种新的视角,将图像概念化为具有动态大小的令牌序列,而不是...
    新技术# FiT v2# 灵活视觉变换器
    1年前
    04610
    阿里推出角色视频合成框架MIMO:允许用户对视频中的人物进行替换

    阿里推出角色视频合成框架MIMO:允许用户对视频中的人物进行替换

    阿里巴巴智能计算研究院推出MIMO,它能够根据用户提供的简单输入,合成具有可控属性(如角色、动作和场景)的逼真角色视频。简单来说,这项技术能够让用户通过提供一些基本的指令或样本,来创造出一段新的视频...
    新技术# MIMO# 角色视频合成# 阿里巴巴
    2年前
    04600
    3D感知图像对齐技术3D Congealing:用于处理捕捉语义相似对象的2D图像集合

    3D感知图像对齐技术3D Congealing:用于处理捕捉语义相似对象的2D图像集合

    来自斯坦福大学、谷歌研究、图宾根大学和Stability AI的研究人员推出3D Congealing,这是一种新颖的3D感知图像对齐技术,用于处理捕捉语义相似对象的2D图像集合。 项目主页 论文 简...
    新技术# 3D Congealing
    2年前
    04600
    谷歌在Gemini API 中推出“隐式缓存”功能,降低模型使用成本

    谷歌在Gemini API 中推出“隐式缓存”功能,降低模型使用成本

    谷歌今天在Gemini API中引入了一项名为“隐式缓存”(implicit caching)的新功能,帮助第三方开发者更经济地使用其最新的AI模型。谷歌表示,这项功能可以为通过Gemini API传...
    早报# Gemini API# 谷歌# 隐式缓存
    11个月前
    04590
    CAMI2V:引入物理约束提升文生视频模型中的相机控制精度

    CAMI2V:引入物理约束提升文生视频模型中的相机控制精度

    浙江大学计算机科学与技术学院的研究团队推出一个名为CAMI2V(Camera-Controlled Image-to-Video Diffusion Model)的模型,它是一个基于扩散模型的图像到视...
    新技术# CAMI2V# 文生视频# 相机控制
    1年前
    04570
    DrawingSpinUp:将单一的平面角色绘画转换成三维动画,同时保留了原始艺术作品的风格和特征

    DrawingSpinUp:将单一的平面角色绘画转换成三维动画,同时保留了原始艺术作品的风格和特征

    香港城市大学的研究人员推出创新系统DrawingSpinUp,它能够将单一的平面角色绘画转换成三维动画,同时保留了原始艺术作品的风格和特征。这就像是给一张静态的画注入生命,让它动起来,比如让一个纸上的...
    新技术# DrawingSpinUp
    2年前
    04570
    Android 新设计曝光:Material 3 Expressive 即将登场,你的手机会变样吗?

    Android 新设计曝光:Material 3 Expressive 即将登场,你的手机会变样吗?

    谷歌即将推出全新的 Material 3 Expressive 设计语言,这一消息因一次意外泄露而提前曝光。尽管谷歌迅速删除了相关博客文章,但互联网档案馆和科技媒体已经捕捉到了关键细节。从目前的信息来...
    早报# Android# Material 3 Expressive# 谷歌
    11个月前
    04560
    新型视频生成技术Dr. Mo:提高视频生成的效率,同时保持或提升视频质量

    新型视频生成技术Dr. Mo:提高视频生成的效率,同时保持或提升视频质量

    新型视频生成技术Dr. Mo(Diffusion Reuse MOtion),这项技术的核心在于提高视频生成的效率,同时保持或提升视频质量。研究团队的关键发现是,在早期去噪步骤中的粗粒度噪声在连续视频...
    新技术# Dr. Mo# 视频生成
    2年前
    04560
    SimpleGVR:轻量高效视频超分辨率模型,让低清视频也能高清呈现

    SimpleGVR:轻量高效视频超分辨率模型,让低清视频也能高清呈现

    由澳门大学智慧城市物联网国家重点实验室、中国科学院深圳先进技术研究院、清华大学、快手科技和深圳理工大学联合研究团队提出了一种新型视频超分辨率(Video Super-Resolution, VSR)模...
    新技术# SimpleGVR# 视频超分辨率模型
    10个月前
    04550
    Yo’Chameleon:使大型多模态模型(LMM)实现个性化视觉和语言生成能力

    Yo’Chameleon:使大型多模态模型(LMM)实现个性化视觉和语言生成能力

    威斯康星大学麦迪逊分校和Adob​​e Research的研究人员推出新型框架Yo’Chameleon,为大型多模态模型(LMMs)实现个性化视觉和语言生成能力。Yo’Chameleon 通过软提示调...
    新技术# Yo’Chameleon# 多模态模型
    12个月前
    04550
    如何在保持计算效率的同时,将原始文生图模型的多样性和控制能力转移到高效的蒸馏模型中

    如何在保持计算效率的同时,将原始文生图模型的多样性和控制能力转移到高效的蒸馏模型中

    美国东北大学的研究人员发布论文《Distilling Diversity and Control in Diffusion Models》,探讨了如何在保持计算效率的同时,将原始扩散模型的多样性和控制...
    新技术# 文生图模型# 蒸馏模型
    1年前
    04550
    CoRe:用于文本到图像个性化的上下文正则化文本嵌入学习

    CoRe:用于文本到图像个性化的上下文正则化文本嵌入学习

    中山大学和香港理工大学的研究人员推出文本对齐新技术CoRe,它用于提升文本到图像个性化生成的效果。简单来说,CoRe技术可以帮助人工智能系统更好地理解用户通过文本提供的概念,并生成与这些概念和文本描述...
    新技术# CoRe
    2年前
    04550
    加载更多
    SD百科导航
    SD百科导航是专注于AI创作领域的专业导航网站。我们全面涵盖Stable Diffusion、Flux、AI绘画、AI视频、AI音乐以及大语言模型等前沿内容。

    关于我们网址提交友链申请广告合作

    扫码关注微信公众号SD百科导航
    扫码关注微信公众号
    Copyright © 2026 SD百科导航 皖ICP备18025588号-5  皖公网安备34040002000401 
    网址
    网址文章软件模型

    网址

    日榜周榜月榜
    S.H.I.T

    S.H.I.T

    在主流学术界为顶刊版面、高影响因子和“非升即走”的考核指标疯狂内卷之时,一场名为“学术垃圾”的反叛运动正在角落里悄然兴起。一群“想开了”的硕博研究生和青年学者(青椒),不再试图迎合传统的学术评价体系,而是隆重推出了一系列名字惊世骇俗的“旗舰”期刊——《SHIT》、《Notrue》、《Silence》、《Crazy》。
    ITELLOU

    ITELLOU

    ITELLYOU(也称为NEXT, ITELLYOU)是一个专注于提供微软原版软件资源的非官方网站,主要帮助用户获取未经修改的微软产品镜像,如Windows操作系统、Office办公软件和开发工具等。
    Tripo

    Tripo

    Tripo AI 是一家领先的 AI 驱动 3D 建模解决方案提供商,允许用户使用文本、单张图像、多张图像、涂鸦或视频等输入,快速创建高质量的 3D 模型和环境。
    同事.skill

    同事.skill

    同事.skill 是一款创新工具。它不仅能提取离职同事的技术规范和工作经验,更能通过飞书消息、钉钉文档、微信聊天记录等“数字足迹”,还原其性格特质、沟通风格甚至“甩锅”技巧。
    BuildCores

    BuildCores

    BuildCores 是一款集 3D 组装预览、智能兼容性检测、全球比价 于一体的在线装机工具。无论你是首次装机的新手,还是追求极致性能的发烧友,都能在手机或电脑上轻松规划、验证并优化你的 PC 配置。
    Meshy

    Meshy

    Meshy 是一款非常适合初学者和专业用户的 3D 模型生成工具。无论是快速建模、3D 打印还是动画设计,它都能轻松应对。如果你对 3D 模型创建感兴趣,不妨试试 Meshy,让生成式 AI 为你的创意插上翅膀!
    查看完整榜单