🔔科技频道[奇诺分享-ccino.org]⚡️
2 小时前
IT之家
英伟达发布 PiD 图像生成技术:13GB 显存跑通,最快 210ms 生成 2048×2048 图像
Telegraph
|
原文
Telegraph
英伟达发布 PiD 图像生成技术:13GB 显存跑通,最快 210ms 生成 2048×2048 图像 - IT之家
IT之家 5 月 27 日消息,英伟达团队最新发布图像生成技术 PiD,在消费级单张 RTX 5090 显卡上,能在 1 秒内将 512×512 图像潜变量直接解码并放大到 2048×2048 像素,峰值显存为 13 GB。 根据博文介绍,高分辨率文本生成图像过程中,通常先在潜在空间生成,再由解码器恢复成清晰图像。 潜在空间指模型把原始图像压缩后得到的数值表示空间,保留主体结构、语义关系等关键信息,却省去大量像素级细节,因此计算成本更低。 这种路线计算效率高,但传统解码器主要负责还原编码器输出,擅长“复…
Home
Blog
Discuss
Gsearch
Powered by
BroadcastChannel
&
Sepia