SD百科导航
  • 首页
  • 快讯
  • 早报
  • 模型
  • ComfyUI
  • 新技术
  • 百科
    • 教程
    • 硬件
    • 科普
  • 百科工具
    • 工具
  • 知识库
  • 排行榜
    • 首页
    • 快讯
    • 早报
    • 模型
    • ComfyUI
    • 新技术
    • 百科
      • 教程
      • 硬件
      • 科普
    • 百科工具
      • 工具
    • 知识库
    • 排行榜

    模型

    共 1020 篇文章
    百科工具模型ComfyUIAI合集web UI提示词
    大语言模型多模态模型图像模型语音模型3D模型Flux衍生视频模型
    排序
    发布更新浏览点赞
    字节跳动Seed项目组推出基于大语言模型(LLM)的自动化定理证明系统 Seed-Prover

    字节跳动Seed项目组推出基于大语言模型(LLM)的自动化定理证明系统 Seed-Prover

    字节跳动Seed项目组推出基于大语言模型(LLM)的自动化定理证明系统 Seed-Prover,Seed-Prover 通过结合 LLM 的推理能力和形式化语言(如 Lean)的验证能力,实现了对数学...
    大语言模型# Seed-Prover# 字节跳动# 自动化定理证明
    5个月前
    0960
    MiniMax-Remover:港中大等联合提出高效视频目标移除新方法

    MiniMax-Remover:港中大等联合提出高效视频目标移除新方法

    在视频编辑中,目标移除是一项关键任务:从视频中删除指定对象(如行人、车辆、水印),同时保持背景的视觉一致性与时间连贯性。然而,现有方法常面临三大挑战: 生成伪影或“幻觉对象” 推理速度慢,依赖高步数采...
    视频模型# MiniMax-Remover
    5个月前
    01540
    GPT-IMAGE-EDIT-1.5M:用 GPT-4o 重构开源图像编辑数据集

    GPT-IMAGE-EDIT-1.5M:用 GPT-4o 重构开源图像编辑数据集

    在图像生成领域,闭源模型如 GPT-4o、IDEF-2 和 DALL·E 3 已展现出令人惊叹的指令遵循能力,能够精准执行复杂的文本引导编辑任务。相比之下,开源社区虽有进展,却始终受限于高质量、大规模...
    图像模型# GPT-Image-Edit# GPT-IMAGE-EDIT-1.5M# 图像编辑模型
    5个月前
    01730
    微软推出Phi-Ground:提高计算机界面(GUI)定位(grounding)的准确性

    微软推出Phi-Ground:提高计算机界面(GUI)定位(grounding)的准确性

    微软推出一个名为 Phi-Ground 的模型家族,旨在提高计算机界面(GUI)定位(grounding)的准确性。GUI 定位是计算机使用代理(CUAs)执行实际操作的核心组件,类似于机器人中的机械...
    大语言模型# Phi-Ground# 微软
    5个月前
    01590
    DreamScene:用 GPT-4 规划 + 3D 高斯建模,实现端到端文本生成 3D 场景

    DreamScene:用 GPT-4 规划 + 3D 高斯建模,实现端到端文本生成 3D 场景

    从一句“现代客厅,带沙发和挂墙电视”,到一个完整、一致、可编辑的 3D 场景——这曾是 3D 内容创作的理想。如今,中国科学技术大学、南洋理工大学、香港科技大学(广州)与奥胡斯大学联合提出的 Drea...
    3D模型# 3D 场景# DreamScene
    5个月前
    01460
    腾讯混元项目组联合北京大学提出新框架MixGRPO:用混合微分方程提升图像对齐效率

    腾讯混元项目组联合北京大学提出新框架MixGRPO:用混合微分方程提升图像对齐效率

    在图像生成领域,如何让模型输出更符合人类审美与偏好,已成为对齐研究的核心目标。基于流匹配(Flow Matching)的生成模型近年来展现出强大潜力,而 Group Relative Policy O...
    图像模型# MixGRPO
    5个月前
    02570
    字节跳动 Seed 团队推出Seed Diffusion:打破自回归瓶颈,实现 5.4 倍代码生成加速

    字节跳动 Seed 团队推出Seed Diffusion:打破自回归瓶颈,实现 5.4 倍代码生成加速

    字节跳动 Seed 团队近期发布了一款实验性语言模型——Seed Diffusion 预览版,它采用离散状态扩散机制,专注于代码生成任务,在推理速度上实现了显著突破:最高可达 2,146 token...
    大语言模型# Seed Diffusion# 字节跳动
    5个月前
    01410
    Meta发布新型多语言对比语言-图像预训练(CLIP)模型MetaCLIP 2

    Meta发布新型多语言对比语言-图像预训练(CLIP)模型MetaCLIP 2

    MetaCLIP 2 是一种新型的多语言对比语言-图像预训练(CLIP)模型,旨在从全球范围内的网络数据中学习图像和文本的表示。传统的 CLIP 模型主要基于英语数据进行训练,而 MetaCLIP 2...
    大语言模型# Meta# MetaCLIP 2
    5个月前
    01350
    Cohere 推出 Command A Vision:专为企业打造的高效多模态 AI

    Cohere 推出 Command A Vision:专为企业打造的高效多模态 AI

    今天,AI 不再只是“读文字”的工具。越来越多的企业需要系统能“看懂”图像——从产品手册、工程图纸到财务报表、现场照片。 为此,Cohere 正式发布 Command A Vision —— 一款专为...
    多模态模型# Cohere# Command A Vision
    5个月前
    01150
    阿里推出“会思考”的30B模型Qwen3-30B-A3B-Thinking-2507:复杂任务表现大幅提升

    阿里推出“会思考”的30B模型Qwen3-30B-A3B-Thinking-2507:复杂任务表现大幅提升

    阿里通义千问团队再次升级其 30B 级模型线,正式推出 Qwen3-30B-A3B-Thinking-2507。 这并非一次简单迭代,而是针对复杂推理能力的深度优化版本。过去三个月中,项目组重点提升了...
    大语言模型# Qwen3-30B-A3B-Thinking-2507# 推理模型
    5个月前
    03470
    阿里推出 Qwen3-Coder-30B-A3B-Instruct:轻量级代码大模型,支持 256K 上下文

    阿里推出 Qwen3-Coder-30B-A3B-Instruct:轻量级代码大模型,支持 256K 上下文

    继发布超大规模的 Qwen3-Coder-480B-A35B-Instruct 后,阿里通义千问团队近日推出一款更轻量但性能强劲的新版本: Qwen3-Coder-30B-A3B-Instruct 这...
    大语言模型# Qwen3-Coder-30B-A3B-Instruct# 代码大模型
    5个月前
    07300
    黑森林实验室联合 KREA AI 发布 FLUX.1 Krea [dev]: 实现更真实、更自然的图像生成

    黑森林实验室联合 KREA AI 发布 FLUX.1 Krea [dev]: 实现更真实、更自然的图像生成

    黑森林实验室(Black Forest Labs, BFL)与创意 AI 平台 KREA AI 正式宣布推出 FLUX.1 Krea [dev] —— 一个全新的开源文本到图像生成模型,也是 Krea...
    图像模型# FLUX.1 Krea [dev]# 图像生成# 黑森林实验室
    5个月前
    05200
    加载更多
    SD百科导航
    SD百科导航是专注于AI创作领域的专业导航网站。我们全面涵盖Stable Diffusion、Flux、AI绘画、AI视频、AI音乐以及大语言模型等前沿内容。

    关于我们网址提交友链申请广告合作

    扫码关注微信公众号SD百科导航
    扫码关注微信公众号
    Copyright © 2025 SD百科导航 皖ICP备18025588号-5  皖公网安备34040002000401 
    网址
    网址文章软件模型

    网址

    日榜周榜月榜
    人生 K 线

    人生 K 线

    人生 K 线(Life Destiny K-Line)是一个结合传统八字命理与现代大语言模型(LLM)的轻量级可视化工具。它将一个人从 1 岁到 100 岁的运势走势,以类似股票 K 线图的形式呈现,试图用数据可视化的方式“翻译”命理推演结果。
    Udio

    Udio

    Udio是一款AI音乐创作工具,能够根据用户输入的音乐风格、情感、主题等要求,快速生成相应的音乐作品。
    海螺音乐

    海螺音乐

    海螺音乐不仅是一款强大的音乐生成工具,还提供了丰富的功能和实用的小贴士,帮助用户优化歌词输入、控制歌曲结构并激发创作灵感。
    Hedra Studio

    Hedra Studio

    Hedra Studio 作为一个强大的内容创作平台,结合了 Character-3 和其他顶级 AI 模型(如 ElevenLabs、Flux Dev、Hunyuan 等),为创作者、营销人员和企业提供了简化且高效的内容创作流程。
    CloudBase AI ToolKit

    CloudBase AI ToolKit

    CloudBase AI Toolkit 是由腾讯云开发平台推出的 AI 编程配套工具集,专为解决 AI 编程中复杂的后端问题设计。它适配主流 AI 编程工具,如 Cursor、CodeBuddy 等。
     Dia 

     Dia 

    Dia浏览器基于谷歌支持的开源浏览器项目Chromium,核心亮点是其AI智能功能。除了允许输入网站名称和搜索词,Dia的URL栏还充当内置AI聊天机器人的界面。该机器人可以为你搜索网络、总结上传的文件,并能在聊天和搜索功能间自动切换。
    查看完整榜单