漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2024-01-30 talkingdev

谷歌发布新AI学习医学诊断

谷歌DeepMind开发了一个名为AMIE(Articulate Medical Intelligence Explorer)的AI模型,用于协助医疗保健。AMIE在医学文本和对话上进行训练,将提供医学状况的解释,可能有助于诊断。在一项对比试验中,AMIE的表现...

Read More
2023-11-01 talkingdev

论文:深度解析医学视觉问答,GPT-4与视觉的结合

该研究主要评估了GPT-4与视觉(GPT-4V)针对来自多种来源的医学图像(如X光和CT扫描)提出的问题的回答能力。这是一项极具挑战性的任务,它需要深度的医学知识和高级的视觉理解能力。GPT-4V作为一种尖端的人工智能技...

Read More
2023-11-01 talkingdev

同构实验室预告AlphaFold的下一版本

AlphaFold是科学领域中的一项惊人模型。新的工作是由同构实验室(Google的一个衍生公司)进行的,不仅将其应用领域扩展到蛋白质以外,还提高了整体性能。AlphaFold的改进和发展,将有力推动科学研究的深入,对生物医...

Read More
2023-10-30 talkingdev

论文:LLM-FP4,一种新型的LLM压缩方法

在最新的研究中,科学家们介绍了一种名为LLM-FP4的新型方法,该方法能够通过在训练后将大型语言模型的权重和活动转换为4位浮点值,实现对其进行压缩。这种技术的创新之处在于,它不仅能够显著减少模型的存储需求,还...

Read More
2023-10-25 talkingdev

使用SAM模型进行3D医学影像分割

SAM-Med3D是Segment Anything Model(SAM)的升级版,专门针对3D医学影像进行了优化。虽然原始的SAM在处理3D医学影像时存在困难,但是经过对超过131K个3D掩模的广泛数据集进行训练的SAM-Med3D在捕捉3D空间细节方面使...

Read More
2023-10-05 talkingdev

Claude推出新技术提升技术文档索引能力

Claude最近推出了一项新技术,该技术将其记忆库的容量提高到了100,000个令牌。此次技术升级主要通过两种技术实现了对技术文档的索引能力的提升。Anthropic公司也对此进行了全面的发布,并推出了名为'Anthropic Cookb...

Read More
2023-10-05 talkingdev

思考再说:为LLMs添加暂停标记以提高推理能力

最近的研究表明,为ViTs注册器添加[reg]标记可以修复图像注意力映射的突增。这项工作表明,将一系列可学习的[pause]标记预置到序列中可以提高语言模型推理(仅解码器,最高可达10亿)的能力,最多可提高18%。直观上...

Read More
2023-10-05 talkingdev

深度解析:在Jax中运行SDXL与TPU v5的协同作用

SDXL是一种最先进的图像生成模型,虽然强大,但运行速度较慢。然而,Google与HuggingFace最近在Google的研究语言Jax中展示了它在新型TPU芯片上的运行速度。通过这种新的硬件加速,SDXL的性能得到了极大的提升,可以...

Read More
  1. Prev Page
  2. 7
  3. 8
  4. 9
  5. Next Page