漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2024-08-12 talkingdev

Server Mono:一款受打字机、苹果SF Mono和CLI启发的字体

Server Mono是一款受打字机、苹果SF Mono和CLI启发的等宽字体,由Monotype的设计师Mike Abbink创建。Server Mono是Monotype的Product Sans字体家族的最新成员,它是一款简单、现代的字体,适用于Web和移动应用程序的...

Read More
2024-07-22 talkingdev

AI编程实习生Mandark:为代码提供改进建议

这款极其简易的命令行界面(CLI)工具,采用了Claude Sonnet 3.5,能够为您的现有代码库提供优化改进建议。它是一个智能工具,通过AI技术,分析现有代码的结构和逻辑,从而产生改善代码的建议。这款工具的目的是帮助...

Read More
2024-07-16 talkingdev

LAPT自动化异常值检测:提高视觉语言模型的表现

近日,研究人员提出了一种新的方法——标签驱动的自动提示调整(LAPT),用于视觉语言模型如CLIP的异常值检测。这种新方法可以自动识别出数据集中的异常值,提高模型在处理各种情况时的灵活性和准确性。通过LAPT,可以更...

Read More
2024-07-01 talkingdev

Lambda Labs训练Open Sora视频模型,一键生成乐高电影

Lambda Labs最近在其1-click集群上训练了一个名为Open Sora的视频模型,用于制作乐高电影。这一技术的出现,不仅改变了乐高动画制作的传统方式,也为AI技术在创新应用中开辟了新的道路。利用这一模型,制作者可以方...

Read More
2024-06-27 talkingdev

玩具反斗城携手AI技术,打造首支Sora文本到视频广告片

玩具反斗城(Toys “R” Us)与广告代理Native Foreign合作,利用OpenAI的文本到视频工具Sora,创作了一部品牌影片。这部影片通过AI生成的视频片段,讲述了公司创始人的故事。Sora自2月份推出以来,尚未对公众开放。该...

Read More
2024-06-19 talkingdev

多视图图像赋能3D表征学习:Duoduo CLIP模型发布

近日,一款名为Duoduo CLIP的3D表征学习模型引起了业界的广泛关注。与传统的3D表征学习模型不同,Duoduo CLIP采用多视图图像,而非点云数据作为输入。这种独特的设计,使得Duoduo CLIP在3D表征学习的效果上,可能会...

Read More
2024-06-04 talkingdev

PPAD:基于CLIP的胸部X光异常检测研究

该研究探讨了如何利用CLIP(Contrastive Language-Image Pre-training)方法进行胸部X光片的异常检测。CLIP是一种新兴的多模态学习方法,它通过对图像和文本的联合训练,实现了在多个任务中的优异表现。在本研究中,...

Read More
2024-05-02 talkingdev

论文:CLIP预训练的Mamba模型,零样本图像分类的新标杆

近日,一个全新的Mamba模型引起了工业界的广泛关注。该模型通过使用对比性语言-图像预训练(CLIP)的方式进行训练,展现出在零样本图像分类任务上的出色效率和性能。据了解,零样本分类任务一直是计算机视觉领域的一个...

Read More
  1. Prev Page
  2. 16
  3. 17
  4. 18
  5. Next Page