谷歌在其AI音乐生成平台Flow Music中正式推出最新模型Lyria 3.5,标志着AI音乐创作能力再次迈上新台阶。作为Lyria系列的重大迭代,3.5版本在音乐性、歌词生成和人声质感三大核心维度上均实现显著提升,能够生成更富...
Read More英伟达实验室(NVIDIA Research)正式推出SANA-Video 2.0,一套面向长视频和高分辨率生成的最新模型方案。该方法在架构上融合了线性注意力(linear attention)与周期性softmax层,一改传统自注意力机制在长序列下的...
Read More微软正式推出两款全新自研AI模型——MAI-Image-2.5-Pro和MAI-Voice-2-Flash,进一步强化其在多模态生成领域的布局。MAI-Image-2.5-Pro专注于高保真图像生成与编辑,能够根据复杂文本描述生成细节丰富、构图精准的高质...
Read More在 AI 大模型竞争白热化的当下,开源模型与闭源旗舰的性能差距一直是业界关注的焦点。知名科技评测媒体 Tech Stackups 发布了一项引人注目的对比测试:将智谱开源的大型语言模型 GLM-5.2 与 Anthropic 的顶级闭源模...
Read More近日,一款名为πFS(π File System)的开源项目在GitHub上引发了技术社区的广泛关注。该项目由开发者philipl创建,其核心概念极具颠覆性:它声称是一个“无数据”的文件系统。πFS的工作原理并非传统意义上的数据存储,...
Read MoreMitos 是一个基于 ASCII 艺术生成技术的开源工具,旨在将图像、GIF 动画甚至自定义 JavaScript 代码转化为纯文本风格的视觉作品。该项目由 Oxide Computer Company 开发,托管于 GitHub,具备较高的科技可玩性和实用...
Read More字节跳动近日在GitHub上开源了一款名为Lance的原生统一多模态模型,以其仅3B(30亿)激活参数的设计,在AI领域引起了广泛关注。该模型打破了传统多模态模型需要为不同任务(如图像理解、视频生成、图像编辑等)分别...
Read More在计算机辅助设计(CAD)领域,生成式人工智能正展现出颠覆传统工作流的潜力。GenCAD项目正是这一趋势的典型代表。该项目旨在利用生成模型,直接根据用户的自然语言描述或简单草图,自动生成精确且可编辑的设计文件...
Read More