漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-07-30 talkingdev

谷歌Flow Music迎来Lyria 3.5:音乐、歌词与人声生成全面进化

谷歌在其AI音乐生成平台Flow Music中正式推出最新模型Lyria 3.5,标志着AI音乐创作能力再次迈上新台阶。作为Lyria系列的重大迭代,3.5版本在音乐性、歌词生成和人声质感三大核心维度上均实现显著提升,能够生成更富...

Read More
2026-07-27 talkingdev

英伟达发布SANA-Video 2.0:单GPU即可生成长时720p视频,延迟大幅降低

英伟达实验室(NVIDIA Research)正式推出SANA-Video 2.0,一套面向长视频和高分辨率生成的最新模型方案。该方法在架构上融合了线性注意力(linear attention)与周期性softmax层,一改传统自注意力机制在长序列下的...

Read More
2026-07-24 talkingdev

微软发布MAI-Image-2.5-Pro与MAI-Voice-2-Flash:高保真图像生成和超低延迟语音模型正式公开预览

微软正式推出两款全新自研AI模型——MAI-Image-2.5-Pro和MAI-Voice-2-Flash,进一步强化其在多模态生成领域的布局。MAI-Image-2.5-Pro专注于高保真图像生成与编辑,能够根据复杂文本描述生成细节丰富、构图精准的高质...

Read More
2026-06-23 talkingdev

开源模型 GLM-5.2 硬刚 Claude Opus:3D 游戏开发实测,成本与性能的终极博弈

在 AI 大模型竞争白热化的当下,开源模型与闭源旗舰的性能差距一直是业界关注的焦点。知名科技评测媒体 Tech Stackups 发布了一项引人注目的对比测试:将智谱开源的大型语言模型 GLM-5.2 与 Anthropic 的顶级闭源模...

Read More
2026-06-11 talkingdev

开源|πFS:一个不存储数据的文件系统,用圆周率“存”一切

近日,一款名为πFS(π File System)的开源项目在GitHub上引发了技术社区的广泛关注。该项目由开发者philipl创建,其核心概念极具颠覆性:它声称是一个“无数据”的文件系统。πFS的工作原理并非传统意义上的数据存储,...

Read More
2026-06-08 talkingdev

开源|Mitos:一键将图片和GIF转ASCII艺术的生成器,支持实时预览与自定义字符集

Mitos 是一个基于 ASCII 艺术生成技术的开源工具,旨在将图像、GIF 动画甚至自定义 JavaScript 代码转化为纯文本风格的视觉作品。该项目由 Oxide Computer Company 开发,托管于 GitHub,具备较高的科技可玩性和实用...

Read More
2026-05-21 talkingdev

开源|字节跳动Lance:3B参数原生统一多模态模型,图像视频理解与生成编辑全搞定

字节跳动近日在GitHub上开源了一款名为Lance的原生统一多模态模型,以其仅3B(30亿)激活参数的设计,在AI领域引起了广泛关注。该模型打破了传统多模态模型需要为不同任务(如图像理解、视频生成、图像编辑等)分别...

Read More
2026-05-18 talkingdev

开源|GenCAD:用生成式AI革新计算机辅助设计,引发Hacker News热议

在计算机辅助设计(CAD)领域,生成式人工智能正展现出颠覆传统工作流的潜力。GenCAD项目正是这一趋势的典型代表。该项目旨在利用生成模型,直接根据用户的自然语言描述或简单草图,自动生成精确且可编辑的设计文件...

Read More
  1. Prev Page
  2. 2
  3. 3
  4. 4
  5. Next Page