漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2025-03-12 talkingdev

Perception Efficient Reconstruction:结合文本查询与3D图像重建的创新方法

近日,GitHub上发布了一项名为Perception Efficient Reconstruction的创新技术,该方法将文本查询能力与从图像中进行3D重建的技术相结合。该系统采用前馈模型(feed forward model),能够实现快速的三维重建。这一...

Read More
2025-03-04 talkingdev

Llama Stack:从零到卓越的生成式AI应用构建指南

Llama Stack 定义并标准化了将生成式AI应用推向市场所需的核心构建模块。这些构建模块以可互操作的API形式呈现,并由广泛的提供商提供其实现。它们被组装成易于开发者从零到生产的发行版。Llama Stack 的目标是简化...

Read More
2025-02-27 talkingdev

Google推出AI视频模型Veo 2,每秒成本高达0.5美元

Google近日发布了其最新的AI视频模型Veo 2,该模型的生成成本高达每秒0.5美元,相当于每分钟30美元。这一高昂的成本引发了业界的广泛关注。Veo 2作为Google在AI视频生成领域的最新成果,其技术复杂度和计算资源需求...

Read More
2024-07-11 talkingdev

论文:自动驾驶的3D数据生成,PerlDiff方法引领新潮流

PerlDiff方法将3D几何信息与街景图像生成相结合,进一步提高了街景图像生成的精确性。这种方法的提出,无疑为自动驾驶领域的3D数据生成提供了新的研究方向和方法。通过更精确的街景图像生成,自动驾驶技术的安全性和...

Read More
2024-05-30 talkingdev

Mistral推出新型AI非生产许可,寻求开放与商业成功的平衡

Mistral公司在追求开放性和商业成功的平衡中迈出了新的一步。他们推出了一种新的许可协议,旨在在开放共享与商业利益之间找到一个平衡点。Mistral的新许可协议称为MNPL(Mistral Non-Production License),它允许项...

Read More
2024-03-25 talkingdev

人工智能领域巨头合并引发行业担忧

近期,微软对Inflection人才的收购再次激起了关于科技巨头公司在人工智能发展中控制过度的争论。虽然这些公司拥有的资源可以在核心语言模型上快速取得进展,但人们对于权力集中可能限制创新和透明度的担忧是有道理的...

Read More
2024-03-05 talkingdev

OpenAI与Figure合作,让人形机器人更加智能化

不久的将来,人形机器人将会与人类制造工人一起工作。在这个领域中占据重要地位的Figure公司最近筹集了6.75亿美元,并与OpenAI达成协议,为其机器人开发下一代人工智能模型。这笔资金超过了Figure最初设定的金额150...

Read More
2024-02-16 talkingdev

LWM-视频语言模型可回答长达小时的视频问题

近期,一种新型的视频语言模型已经问世,可以回答长达数百万词的视频问题。该模型采用环形关注机制和精细调整的7B参数模型,能够在检索基准测试中表现极其准确,胜过商业化视频语言模型。

Read More
  1. Prev Page
  2. 18
  3. 19
  4. 20
  5. Next Page