DeepMind提出了GenCeption,将预训练的视频生成模型重新设计为一种可通过文本指令控制的统一视觉系统,引发学界关注。该模型基于前馈、非自回归的生成式架构,不需要针对下游任务进行微调即可同时处理深度估计、表面...
Read MoreNVIDIA近日宣布其XR AI平台进入公开测试阶段,为增强现实(AR)眼镜和扩展现实(XR)头显开发者提供了一个关键的底层基础设施。该平台是一个开源库,旨在填补当前硬件就绪但缺乏集成本地AI体验的空白。它允许开发者...
Read MoreMeta AI研究院近日在GitHub开源了ShapeR项目,该项目代表了3D场景重建领域的一项重要进展。ShapeR的核心技术在于能够仅从一系列图像中,重建出完整的、高质量的三维场景网格。其技术路径颇具创新性:首先,系统从输...
Read More在流媒体算法主导音乐发现的今天,开发者通过融合NFC近场通信技术与实体交互设计,创新性地打造出物理专辑卡片系统。这套系统包含精心设计的实体卡片,每张卡片嵌入NFC标签,用户只需用手机轻触卡片即可立即播放对应...
Read More随着人工智能技术在心理健康领域的深度应用,基于认知行为疗法(CBT)的AI社交训练工具正成为解决社交焦虑的新方案。最新研究表明,采用自然语言处理(NLP)技术的对话模拟系统可通过实时生成社交场景,帮助用户循序...
Read More谷歌Android生态系统总裁Sameer Samat近日深入探讨了Android平台的最新进展,包括即将发布的Android 16系统及其与Gemini AI的深度整合。谷歌正致力于提升Android系统的可定制性和跨设备兼容性,例如即将上市的三星Ga...
Read More研究人员近日推出名为SpatialScore的多模态基准测试套件,专门用于评估大型模型在3D空间理解方面的能力。这一创新性基准整合了来自12个不同数据集的28,000个样本,为衡量AI系统的空间推理性能提供了全面且标准化的评...
Read More谷歌正通过Android XR平台重新进军智能眼镜领域,整合其Gemini AI技术,旨在通过AR眼镜提供实时视觉分析、翻译和情境辅助功能。此次布局将首先推出与三星合作开发的混合现实头显Project Moohan,随后是Xreal专为开发...
Read More