PixArt是一种新的文本到图像模型,它使用T5文本编码、交叉注意力和扩散变压器,以比可比模型低得多的计算成本取得了出色的结果。这种新模型使用Transformer扩散模型,可以比使用UNet模型训练快90%。PixArt模型的训练...
Read MoreHugging Face Space最近发布了两项重要技术:Segment Anything和MetaCLIP,这两项技术结合了最强大的语言模型和计算机视觉技术,能够基于文本输入进行开放式分词。开放式分词是计算机视觉领域中一个新颖且令人兴奋的...
Read More一位联邦法官驳回了一项划时代的诉讼中的大部分索赔,艺术家在此诉讼中指控生成性AI艺术生成器未经授权使用图像,针对Midjourney和DeviantArt的版权侵权指控存在缺陷。在这场判决中,法官明确指出,艺术家对AI生成艺...
Read More研究人员发现,将生成句子的模型所需的思路或“概念”以一定顺序呈现给它们,将会影响生成的句子质量。在测试的各个程序中,BART-large在给定特定顺序的思路后表现最佳,但令人惊讶的是,更大的并不总是更好。
Read More人工智能驱动软件的下一步演变并非聊天机器人,而是利用LLMs来完成实际工作的应用。AI基础设施联盟的此篇电子书全面覆盖了此领域的各个方面,包括Prompt工程、LLM逻辑和推理、主要框架如LlamaIndex、LangChain、Hays...
Read MoreArtifact,最初是Instagram联合创始人推出的一个AI驱动的新闻应用,现在让用户能够利用AI为他们的帖子创建封面艺术。这种增强功能,根据用户输入的关键词来制作“抓人眼球的图像”,进一步将Artifact定位为像Instagram...
Read More机械可解释性是通过将神经网络分解为更可解释的子部分来理解神经网络的过程。不幸的是,神经元本身往往不可解释。有一些深层次的原因,如叠加,导致了这个挑战。Anthropic公司的这项工作使用稀疏自编码器从一层Trans...
Read More本文研究了LLMs(大型语言模型)如何像社会中的人们一样协同工作。研究人员制造了具有不同个性的计算机“社会”,并观察他们如何在任务中协作,发现他们有时会像人类一样行为,比如跟随多数人的意见或进行辩论。有些团...
Read More