影视制作的相关内容 - 漫话开发者

2025-05-21 talkingdev

谷歌发布Veo 3、Imagen 4及影视制作新工具Flow，生成式媒体模型再升级

在2025年谷歌I/O大会上，谷歌正式推出新一代生成式媒体模型Veo 3和Imagen 4，以及专为影视制作设计的新工具Flow。Veo 3作为视频生成模型的迭代版本，在动态细节和场景连贯性上实现突破；Imagen 4则进一步提升了文本...

2025-04-15 talkingdev

字节跳动团队最新发布的论文展示了如何在655k H100小时的“适度”计算预算下，训练出一个具有竞争力的70亿参数视频生成模型Seaweed-7B。该模型在多项时间敏感任务中表现出色，展现了强大的视频生成能力。这一突破不仅...

2025-04-01 talkingdev

近日，arXiv平台发布了一项名为'Video Generation Faithfulness Benchmark'的研究，旨在系统评估视频生成模型对用户输入提示词（prompt）的忠实度。该研究不仅建立了首个针对视频生成忠实度的量化评估体系，还创新性...

2025-03-24 talkingdev

近日，GitHub上发布了一个名为LHM（Large Animatable Human Reconstruction Model）的开源项目，该项目展示了如何通过单张图像快速生成一个完全可动画的3D人体模型。这一技术突破不仅展示了计算机视觉领域的重大进展...

2025-03-20 talkingdev

近日，Stability推出了一项名为Stable Virtual Camera的创新技术，该技术基于一种多视角扩散模型，能够从单张或多张2D图像中生成沉浸式3D视频。这一技术允许用户自定义或预设相机轨迹，从而实现对3D场景的灵活控制。...

2025-01-28 talkingdev

1Prompt1Story是一种无需训练的文本到图像生成方法，通过单一串联提示实现一致的图像生成。该方法的核心在于将多个提示信息串联成一个整体，从而在生成过程中保持一致性。与传统的训练依赖型方法不同，1Prompt1Story...

2025-01-23 talkingdev

MMAudio 是一个创新的视频到音频生成系统，能够以视频作为输入，并根据视频内容生成与之配对的音频。该系统在处理合成视频和真实视频时均表现出色。通过先进的算法和模型，MMAudio 能够捕捉视频中的关键视觉信息，并...

2024-12-27 talkingdev

近日，Blender社区推出了一款名为Differential Growth的插件，该插件基于LLM（Large Language Model）技术，旨在通过模拟自然生长过程，为3D建模师提供一种全新的建模方法。Differential Growth插件通过智能算法，允...