图像生成的相关内容 - 漫话开发者

2023-06-07 talkingdev

Redditor运用稳定扩散技术制作出可读取的动漫风二维码

一位Reddit用户最近发布了一系列采用稳定扩散技术制作的艺术二维码，其风格为动漫和亚洲艺术风格，可通过智能手机相机应用程序进行扫描。该用户显然训练了多个定制的稳定扩散控制网络模型，并在将QR码输入图像生成器...

2023-06-06 talkingdev

近日，一项名为ViCo的新技术问世，其可以根据文本描述生成逼真的图像，并且能够从仅有的几个样本中捕捉到新概念的细节。与其他方法不同，ViCo对系统资源的消耗较小，不需要对原始模型的参数进行微调，但它仍然通过专...

2023-06-05 talkingdev

在人工智能领域中，研究人员一直在探索如何利用计算机生成逼真的图像。在这个过程中，DreamBooth 系列研究的下一个步骤——StyleDrop 已经发布。这个开源项目提供了一种新的方法，只需要使用单个参考图像，就可以在任...

2023-05-31 talkingdev

今天，我们向大家介绍一个名为Threestudio的开源项目。这个项目采用了先进的2D文本到图像生成模型，从文本提示、单张图像和少量样本图像中创建3D内容的统一框架。以下是该框架的三个核心要点： - Threestudio利用...

2023-05-31 talkingdev

ProlificDreamer是一种提高文本到3D图像生成效果的新方法。它通过将3D参数视为随机变量来解决文本到3D生成中早期Score Distillation Sampling（SDS）方法中存在的过度饱和和低多样性等问题。这种变分Score Distillat...

2023-05-19 talkingdev

近日，研究人员开发出一种名为FastComposer的新方法，能够快速创建个性化的多主题图像，避免了其他方法中耗时的微调。不仅如此，FastComposer还能够处理多主题生成中的混合问题，并且可以更快地生成不同风格、动作和...

2023-05-10 talkingdev

近日，科研团队推出了一种名为 SUR-adapter 的新技术，可升级计算机程序中的扩散模型，将简单的描述转化为详细的图像。通过训练这些模型更好地理解故事，并使用超过 57,000 个样本的新数据集，研究人员使模型更擅长...

2023-05-05 talkingdev

研究人员调查了在富文本中发现的各种格式元素（例如字体大小、颜色、样式和脚注）的使用，以生成从文本到图像的过程。他们的方法允许轻松控制本地样式、准确地创建颜色，并在处理长文本提示时提供额外信息。通过利用...