英伟达开源多语言语音识别和翻译模型:Canary 1B Flash 和 Canary 180M Flash在促进全球交流的进程中,多语言语音识别和翻译技术扮演着至关重要的角色。然而,开发能够实时准确地转录和翻译多种语言的模型面临着诸如处理语言细微差别、确保高准确性与低延迟以及实现跨设备高效部署等挑战。为应...语音模型# Canary 180M Flash# Canary 1B Flash# 多语言语音识别1周前0430
英伟达推出世界生成与自适应多模态控制Cosmos-Transfer1英伟达推出了一个名为 Cosmos World Foundation Model Platform 的平台,旨在为 Physical AI(物理人工智能)提供定制化的世界模型(World Founda...视频模型# Cosmos-Transfer1# 英伟达2周前0330
英伟达开源了世界上第一个人形机器人基础模型 GR00T N1,加速通用人形机器人开发人形机器人旨在适应人类工作空间,处理重复性或高要求任务。然而,为现实世界的任务和不可预测环境开发通用人形机器人具有挑战性。每项任务通常需要专用的AI模型。从头开始为每个新任务和环境训练这些模型是一个繁...多模态模型# GR00T N1# 人形机器人基础模型# 英伟达2周前0340
这对英伟达来说可能是坏消息!AI芯片初创公司Cerebras 新建 6 个 AI 数据中心,每秒处理 4000 万tokensCerebras Systems,一家致力于挑战英伟达在AI市场主导地位的初创公司,于周二宣布了一项重大扩展计划:在全球新增六个AI数据中心。此举不仅将大幅提升其推理能力,还将与关键行业伙伴建立合作关...早报# AI芯片# Cerebras# 英伟达3周前0610
英伟达 CEO 黄仁勋表示市场对 DeepSeek 的影响理解错误英伟达创始人兼首席执行官黄仁勋在最近的一次采访中表示,市场对 DeepSeek 技术进步及其对英伟达业务潜在负面影响的理解存在偏差。他强调,DeepSeek 的开源推理模型 R1 并不会削弱对计算资源...早报# DeepSeek# 英伟达# 黄仁勋1个月前0540
ComfyUI现已支持英伟达Cosmos:迄今为止最好的开源图生视频模型?英伟达在前段时间推出Cosmos 平台,该平台包含先进的世界基础生成模型、高级分词器、防护栏和加速视频处理管道,旨在推动自动驾驶汽车(AV)和机器人等物理 AI 系统的发展。虽然被称为“世界模型”,但...教程# ComfyUI# Cosmos# 英伟达2个月前02060
英伟达推出世界基础模型平台NVIDIA Cosmos :帮助物理 AI 开发人员更好、更快地构建物理 AI 系统英伟达在CES2025上宣布推出 NVIDIA Cosmos 平台,该平台包含先进的世界基础生成模型、高级分词器、防护栏和加速视频处理管道,旨在推动自动驾驶汽车(AV)和机器人等物理 AI 系统的发展...多模态模型# NVIDIA Cosmos# 世界模型# 英伟达2个月前01330
英伟达推出图像生成模型家族Edify Image:能够生成高保真度的图像内容,并且具有像素级完美准确性英伟达推出图像生成模型家族Edify Image,它们能够生成高保真度的图像内容,并且具有像素级完美准确性。Edify Image利用了一系列级联的像素空间扩散模型,这些模型通过一个新颖的拉普拉斯扩散...新技术# Edify Image# 图像生成# 英伟达5个月前03040
英伟达推出Add-it:基于文本指令在图像中添加对象的创新方法英伟达、特拉维夫大学和巴伊兰大学的研究人员推出一个名为Add-it的系统,它是一种无需训练的方法,可以在图像中根据文本提示添加对象。这种方法扩展了预训练扩散模型的注意力机制,以整合来自三个关键来源的信...新技术# Add-it# 英伟达5个月前01800
英伟达推出Autoguidance:改进图像生成扩散模型的性能英伟达和阿尔托大学的研究人员推出Autoguidance,改进图像生成扩散模型的性能,特别是通过一种新颖的方法来控制图像质量、结果的变化性以及与给定条件(如类别标签或文本提示)的一致性。扩散模型是一种...新技术# Autoguidance# 英伟达10个月前04240
TensorRT Node for ComfyUI:TensorRT插件正式上架ComfyUI,加速图像生成之前英伟达已经在Stable Diffusion web UI上推出了TensorRT插件,近日又联合ComfyUI开发者推出了ComfyUI插件,此插件专为英伟达GeForce RTX与 RTX显卡...插件# TensorRT# TensorRT Node for ComfyUI# 加速10个月前01,2440
英文将推出RTX Remix开源工具套件,还将推出配套的ComfyUI节点与工作流英伟达RTX Remix 为游戏修改者提供了强大的工具,使他们能够对经典 DirectX 8 和 DirectX 9 游戏进行重制,包括完整的光线追踪技术、DLSS 3.5(深度学习超采样技术)、精致...工具# ComfyUI# RTX Remix# 英伟达10个月前07470