图像生成的相关内容 - 漫话开发者

2024-04-16 talkingdev

深度解析：视频扩散模型的生成与应用

本文深入探讨了如何训练扩散模型以生成视频，如何适配图像模型，甚至在无需额外训练的情况下，如何从图像模型中生成视频。扩散模型作为一种新兴的生成模型，已经在图像生成领域取得了显著的成果。文章首先介绍了扩散...

2024-04-15 talkingdev

最近，一个名为PanFusion的项目引起了业界的广泛关注。该项目采用了一种双分支扩散模型，可以直接从文本提示生成360度全景图像。该方法结合了稳定的扩散技术和专门的全景分支，并通过独特的交叉注意力机制来减少图像...

2024-04-10 talkingdev

Visual Autoregressive Models是一个新的GitHub项目，它将图像生成视为逐步预测更高分辨率的过程。该代码库包含了用于下一分辨率预测工作的推理脚本和演示笔记本。虽然训练代码将很快公开，但目前该项目已经引起了技...

2024-04-10 talkingdev

UniFL是一种通过一系列复杂的反馈步骤来提高扩散模型输出质量的方法。这些步骤旨在提升生成图像的视觉质量、美感和偏好对齐。这些技术与底层模型无关，可用于提升任何图像生成模型的性能。

2024-04-09 talkingdev

近期，研究人员开发了一种名为提示自动编辑（Prompt Auto-Editing，简称PAE）的新技术，旨在提升基于文本生成图像的技术水平。该技术利用了Imagen和Stable Diffusion等扩散模型，通过在线强化学习动态调整文本提示中...

2024-04-08 talkingdev

OpenAI宣布其创新性AI图像生成模型DALL-E现已成功与聊天机器人ChatGPT整合。这一新功能的推出使得用户能够在网页版、iOS以及Android平台上直接编辑DALL-E生成的图像。DALL-E此前已因其惊人的图像创造能力而名声大噪...

2024-04-05 talkingdev

TGATE最新研究成果展示了一种高效的图像生成方法，该方法通过将整个生成过程分为规划和细化两个阶段来实现。这种新颖的方法不仅通过早期确定某些输出而简化了生成过程，而且还意外地提高了生成图像的质量。在规划阶...

2024-04-04 talkingdev

OpenAI的DALL-E现已推出图像编辑工具，支持网页和移动端使用。用户可以使用预设的风格建议来激发图像创作灵感。这一图像生成平台已经与ChatGPT集成，用户可以在网页、iOS和Android上的ChatGPT中编辑DALL-E生成的图像...