漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-08-28 talkingdev

SGLang Diffusion加持:MiniMax-H3视频生成在8×H200上无损提速1.95倍,最高6.24倍

LMSYS.org发布的最新基准测试显示,在8×NVIDIA H200 GPU环境中,SGLang Diffusion对MiniMax-H3视频生成工作负载实现了显著加速。测试严格固定提示词、随机种子、分辨率、帧率和去噪步数,并在六类工作负载上进行比较...

Read More
2026-08-28 talkingdev

fal 推出 H3 Max:MiniMax H3 后训练版最快 3 秒生成 5 秒视频,综合质量登顶

fal Research 宣布推出 H3 Max,这是 MiniMax H3 的后训练版本,由 fal 推理团队专门针对生成速度进行优化。官方表示,该模型可在不到 3 秒内生成一段 5 秒长的视频,显著降低视频生成等待时间。在人类偏好评估中,H...

Read More
2026-08-27 talkingdev

Meta推出Muse Image图像生成模型:先推理后渲染,单图成本仅0.01美元

Meta推出的Muse Image图像生成模型,其核心特点在于能够基于搜索结果进行图像生成,并在最终渲染前执行推理过程。这意味着模型不再仅依赖训练数据中的视觉模式,而是可以结合外部信息来约束生成结果,有望提升图像的...

Read More
2026-08-20 talkingdev

Meta Muse Video 视频模型独家样片曝光:原生音频与10秒级时间一致性表现抢眼

Meta 旗下的 Muse Video 视频生成模型已进入封闭测试阶段。根据曝光的早期生成样片,该模型在 10 秒级视频中展现出较高的细节还原能力、对场景的理解能力以及时间一致性,并且原生支持音频生成。这意味着 Muse Video...

Read More
2026-08-17 talkingdev

AI视频生成创企Higgsfield融资4亿美元:估值从1月13亿飙升至54亿美元

AI视频生成初创公司Higgsfield宣布完成4亿美元新一轮融资,投资方包括DST、高盛、Liberty Global、英特尔等机构,投后估值达到54亿美元。该轮融资前,公司估值在1月为13亿美元,短短数月内增长超过三倍,显示市场对A...

Read More
2026-08-13 talkingdev

微软MAI-Image-2.6空降Arena文生图榜第二,超越Google、Meta与xAI

微软宣布其最新文本到图像模型MAI-Image-2.6在Arena文本到图像排行榜上首次亮相即升至第二位,排名超过Google、Meta和xAI等竞争对手。Arena排行榜基于用户盲测与偏好投票,是评估生成模型综合表现的重要公开基准之一...

Read More
2026-08-12 talkingdev

NVIDIA提出WorldTrace:让视频世界模型拥有可寻址记忆,突破长时序生成瓶颈

NVIDIA研究团队近日推出了一项名为WorldTrace的训练无关框架,直指视频世界模型在长时序自回归生成中的关键短板——记忆遗忘与生成质量退化。该工作通过为压缩的键值记忆赋予稳定、分布内位置偏移的方式,确保记忆在远...

Read More
2026-08-10 talkingdev

中国AI视频模型横扫全球榜单:前十独占九席,或将在构建世界模型上建立优势

根据人工智能分析机构Artificial Analysis的最新排名,全球排名前十的文生视频模型中,中国AI实验室占据了其中九席,展现出在视频生成领域压倒性的技术集群优势。彭博社评论指出,过去一段时间,外界对中国人工智能...

Read More
  1. 1
  2. 2
  3. 3
  4. Next Page