通义实验室开源Fun-CineForge:全球首个影视级多模态配音大模型
创始人
2026-03-17 17:18:10

3月16日消息,通义实验室今日正式发布并开源Fun-CineForge,该模型为全球首个支持影视级多场景配音的多模态大模型,同时开放其配套高质量数据集构建方法 CineDub,旨在解决AI在专业影视配音中长期存在的“口型不同步、情绪不匹配、音色不一致、时间对不准”四大核心难题。

目前,模型已在 GitHub、Hugging Face、ModelScope 三平台开源,支持30秒以内视频片段推理。

相关内容

热门资讯

游戏产业下半场,AI开始走向前... 上海新国际博览中心,N2馆。一位观众对着屏幕输入一行文字,几秒钟后,一个可交互的3D游戏世界在他眼前...
AI时代,效率正在消灭学徒期 当 AI 接管初级工作,我们可能也在拆掉人类成为专家的阶梯。 过去,人们担心机器抢走流水线上的岗位。...
国金证券:国内AI链相对海外出... 智通财经获悉,国金证券发布研报称,从筹码出清的角度来看,A股AI相关股票相对海外市场出清较慢,因此本...
胃镜室里来了个“AI侦察兵”(... □本报全媒体记者 李晓敏 7月30日上午,河南科技大学第一附属医院(以下简称“河科大一附院”)胃镜中...
TCL华星进入专业电竞显示序列... 【CNMO科技消息】2026年中国国际数码互动娱乐展览会(ChinaJoy)正式开幕。TCL华星以“...