腾讯混元开源端到端AI模型Hunyuan-Foley：视频+文字=“电影级”音效-新科技-资讯-头部财经

腾讯混元开源端到端AI模型Hunyuan-Foley：视频+文字=“电影级”音效

资讯 » 新科技 2025-08-28

IT之家 8 月 28 日消息，腾讯混元今天午间宣布开源端到端视频音效生成模型 Hunyuan-Foley，用户只需输入视频和文字，就能为视频匹配电影级音效。

根据官方介绍，HunyuanVideo-Foley 不仅打破了 AI 生成的视频只能“看”不能“听” 的局限，让无声 AI 视频成为历史，更是真正做到了“看懂画面、读懂文字、配准声音”，带来沉浸式视听体验。这款音效生成工具可广泛应用于短视频创作、电影制作、广告创意和游戏开发等场景。

文字描述：Engine revving loudly and accelerating.

文本描述：Rustling and crunching of leaves and twigs under the fox kit's paws.

混元团队开发了一个全面的数据处理管道，能够自动化标注和过滤收集的音视频数据，构建了约 10 万小时级的高质量 TV2A 数据集，为模型训练提供了强大支撑，使得模型拥有强大的泛化能力，能够在各种复杂的视频条件下生成音画一致、语义对齐的高质量音频，包括音效与背景音乐。生成的音频能够与无声视频相结合，极大提升了视频的真实感和沉浸感。

免责声明：本网信息来自于互联网，目的在于传递更多信息，并不代表本网赞同其观点。其内容真实性、完整性不作任何保证或承诺。由用户投稿，经过编辑审核收录，不代表头部财经观点和立场。
证券投资市场有风险，投资需谨慎！请勿添加文章的手机号码、公众号等信息，谨防上当受骗！如若本网有任何内容侵犯您的权益，请及时联系我们。

IBM 联合 NASA 发布开源 AI 模型，对太阳天气进行预测和预警

2025-08-288阅读
杜克大学与Zoom推出LiveMCP‑101：GPT‑5表现出色但仍未破60%

2025-08-288阅读
前景压倒短期波动，分析师集体上调英伟达目标价

2025-08-288阅读
ChatGPT被指协助自杀！OpenAI将扫描用户对话：试图伤害他人将转交警方

2025-08-288阅读
中芯国际：上半年净利润同比增长35.6%

2025-08-288阅读
全球首次，我国自研脑机接口帮助精准切除脑肿瘤

2025-08-288阅读
AI助力线缆检测……全球线缆工业的最新发展动态与技术突破在沪亮相

2025-08-288阅读
快快评｜指导少年自杀写遗书，ChatGPT这是“疯”了吗

2025-08-288阅读
AI赋能教与学，卓越教育开启“师-机-生”教育新模式

2025-08-288阅读
小米发布超级岛，能用 iPhone 回微信

2025-08-288阅读