SD百科导航
  • 首页
  • 快讯
  • 早报
  • 模型
  • ComfyUI
  • 新技术
  • 百科
    • 教程
    • 硬件
    • 科普
  • 百科工具
    • 工具
  • 排行榜
  • 网址提交
    • 首页
    • 快讯
    • 早报
    • 模型
    • ComfyUI
    • 新技术
    • 百科
      • 教程
      • 硬件
      • 科普
    • 百科工具
      • 工具
    • 排行榜
    • 网址提交

    图像编辑

    共 58 篇文章
    排序
    发布更新浏览点赞
    无监督指令驱动图像编辑框架UIP2P:在不需要真实编辑图像数据集的情况下,根据文本指令对图像进行编辑

    无监督指令驱动图像编辑框架UIP2P:在不需要真实编辑图像数据集的情况下,根据文本指令对图像进行编辑

    现有的基于指令的图像编辑方法通常依赖于监督学习,需要包含输入图像、编辑图像和编辑指令的三元组数据集。这些数据集通常通过现有编辑方法或人工标注生成,引入了偏差并限制了模型的泛化能力。为了克服这些挑战,苏...
    新技术# UIP2P# 图像编辑
    1年前
    03490
    Madd模型:通过引入“功能性”概念,旨在根据各种位置提示将任何对象无缝插入任何场景中

    Madd模型:通过引入“功能性”概念,旨在根据各种位置提示将任何对象无缝插入任何场景中

    图像合成是计算机视觉中的一个常见任务,涉及将前景对象无缝集成到背景场景中。传统的图像合成方法通常依赖于人为的编辑或预定义的规则,难以处理前景对象与背景场景之间的复杂相互作用。为了应对这一挑战,哈佛大学...
    新技术# Madd模型# 图像编辑
    1年前
    03450
    新型图像编辑方法FluxSpace:基于修正流变换器(如Flux)来实现文本引导的图像编辑

    新型图像编辑方法FluxSpace:基于修正流变换器(如Flux)来实现文本引导的图像编辑

    校正流模型(如 Flux)在图像生成中已成为主导方法,展示了高质量图像合成的卓越能力。然而,尽管它们在视觉生成中表现出色,校正流模型在图像的解耦编辑方面往往表现不佳。这一限制阻碍了在不影响图像无关部分...
    新技术# FLUX# FluxSpace# 图像编辑
    1年前
    03410
    ObjectMate:能够在无需微调的情况下,实现对象插入和主题驱动的图像生成

    ObjectMate:能够在无需微调的情况下,实现对象插入和主题驱动的图像生成

    对象插入和主体驱动生成是计算机视觉中的两个重要任务,旨在将给定的对象合成到由图像或文本指定的场景中。具体来说: 对象插入:将一个对象无缝地插入到目标场景中,要求合成后的图像在姿态、光照等方面看起来逼真...
    新技术# ObjectMate# 图像编辑
    1年前
    04280
    基于预训练流模型的新型文本驱动图像编辑方法FlowEdit:适用于SD3和Flux模型

    基于预训练流模型的新型文本驱动图像编辑方法FlowEdit:适用于SD3和Flux模型

    使用预训练的文本到图像(T2I)扩散或流模型编辑真实图像是一项具有挑战性的任务。传统的方法通常涉及将目标图像反转为对应的噪声图,然后根据新的文本提示重新生成图像。然而,仅靠反转变换往往无法获得满意的结...
    新技术# FlowEdit# 图像编辑
    1年前
    03140
    解决图像生成与编辑任务的统一框架UniReal

    解决图像生成与编辑任务的统一框架UniReal

    图像生成和编辑任务在计算机视觉领域中具有广泛的应用,如图像合成、风格迁移、图像修复等。然而,现有的解决方案通常针对特定任务设计,缺乏一个统一的框架来处理多种图像级任务。香港大学和Adobe Resea...
    新技术# UniReal# 图像生成# 图像编辑
    1年前
    02940
    图像编辑工具SwiftEdit:通过简单的文本提示实现快速的图像编辑

    图像编辑工具SwiftEdit:通过简单的文本提示实现快速的图像编辑

    VinAI 研究中心、越南科技大学邮电研究所的研究人员推出图像编辑工具SwiftEdit,它能够通过简单的文本提示实现快速的图像编辑。SwiftEdit的核心优势在于其极速的编辑能力,能够在0.23秒...
    新技术# SwiftEdit# 图像编辑
    1年前
    03060
    无需训练的图像编辑技术Stable Flow:执行各种类型的图像编辑操作,包括非刚性编辑、物体添加、物体替换和全局场景编辑

    无需训练的图像编辑技术Stable Flow:执行各种类型的图像编辑操作,包括非刚性编辑、物体添加、物体替换和全局场景编辑

    Snap Research、耶路撒冷希伯来大学、特拉维夫大学和赖希曼大学的研究人员推出图像编辑方法Stable Flow,这是一种无需训练的图像编辑技术,能够执行各种类型的图像编辑操作,包括非刚性编辑...
    新技术# Stable Flow# 图像编辑
    1年前
    03970
    基于SD1.5模型的智能交互式图像编辑系统MagicQuill

    基于SD1.5模型的智能交互式图像编辑系统MagicQuill

    香港科技大学、蚂蚁集团、浙江大学和香港大学的研究人员推出智能交互式图像编辑系统MagicQuill,该系统基于扩散模型(SD1.5模型)构建,允许用户通过三种直观的笔触:添加(add)、减去(subt...
    工具# MagicQuill# SD1.5模型# 图像编辑
    1年前
    05330
    Midjourney 推出全新外部图像编辑功能、图像重新纹理化以及下一代AI审查系统

    Midjourney 推出全新外部图像编辑功能、图像重新纹理化以及下一代AI审查系统

    由前 Magic Leap 工程师 David Holz 创立的 AI 图像生成初创公司Midjourney,昨晚宣布了一项令人瞩目的新功能——AI 图像编辑。这项功能不仅让现有的2000多万用户感到...
    教程# Midjourney# 图像编辑
    1年前
    05920
    免费且开源的桌面图像编辑器IntraPaint:将传统数字绘画艺术技术与 AI 修复相结合

    免费且开源的桌面图像编辑器IntraPaint:将传统数字绘画艺术技术与 AI 修复相结合

    IntraPaint 是一款免费且开源的桌面图像编辑器,专为 Windows 和 Linux 用户设计。它将传统的数字绘画和图像编辑工具与先进的基于 AI 的功能相结合,为用户提供了一个无缝的创意工作...
    工具# AI 修复# IntraPaint# 图像编辑
    1年前
    06920
    结合了大语言模型与文生图模型的新框架SGEdit:用于基于场景图的精确和灵活的图像编辑

    结合了大语言模型与文生图模型的新框架SGEdit:用于基于场景图的精确和灵活的图像编辑

    场景图提供了一种结构化、层次化的图像表示方式,其中节点和边分别代表图像中的对象及其相互关系。这种方式不仅能够帮助用户更直观地理解图像内容,还能作为图像编辑的有效接口,极大提升了编辑工作的准确性和灵活性...
    新技术# SGEdit# 图像编辑# 大语言模型
    1年前
    04410
    加载更多
    SD百科导航
    SD百科导航是专注于AI创作领域的专业导航网站。我们全面涵盖Stable Diffusion、Flux、AI绘画、AI视频、AI音乐以及大语言模型等前沿内容。

    关于我们网址提交友链申请广告合作

    扫码关注微信公众号SD百科导航
    扫码关注微信公众号
    Copyright © 2026 SD百科导航 皖ICP备18025588号-5  皖公网安备34040002000401 
    网址
    网址文章软件模型

    网址

    日榜周榜月榜
    Clawdbot/Moltbot

    Clawdbot/Moltbot

    Clawdbot 是一款可在您自己的设备上运行的个人 AI 助手。它在您已使用的渠道(WhatsApp、Telegram、Slack、Discord、Google Chat、Signal、iMessage、Microsoft Teams、WebChat)以及扩展渠道(如 BlueBubbles、Matrix、Zalo 和 Zalo Personal)上为您提供应答。它可以在 macOS/iOS/Android 上进行语音交谈,并能渲染一个您可控制的实时画布。网关仅是控制平面——核心产品是助手本身。
    Higgsfield AI

    Higgsfield AI

    Higgsfield AI平台支持文生图和图生视频,近期对图生视频功能进行了全面升级,专为追求高质量、风格化内容创作并渴望真正电影级操控的创意人士打造——无论是MV导演、商业片制作人、AI创作者,还是社交媒体叙事者。
    Situation Monitor

    Situation Monitor

    Situation Monitor 是由开发者 Reggie James 创建的一个免费、开源的全球风险监测平台。它通过一张交互式地图,实时整合并可视化全球范围内的关键地缘政治与安全信息,帮助用户快速掌握潜在冲突热点和战略动态。
    Fogsight (雾象)

    Fogsight (雾象)

    雾象是一款由大语言模型(LLM)驱动的动画引擎 agent 。用户输入抽象概念或词语,雾象会将其转化为高水平的生动动画。
    CivitAI

    CivitAI

    CivitAI是一个AI图像及视频模型托管平台,主要聚焦于 AI 生成的图像、视频和模型。它为用户提供了一个空间,可以上传、分享和发现由特定数据集训练的自定义 AI 模型,这些模型可用于生成独特的内容,如图像、视频。
    打滑作业平台

    打滑作业平台

    “打滑作业”是一个面向学生和自学者的开源工具,帮助用户快速理解题目、获取答案,从而节省时间,把精力投入到更重要的兴趣与生活中。
    查看完整榜单