阿里通义首个音频生成模型ThinkSound正式开源
创始人
2025-07-06 22:11:34

新榜讯 7月5日讯,阿里“通义大模型”公众号发布消息,通义实验室首个音频生成模型ThinkSound正式开源,此举将突破“静音画面”所带来的想象力限制。ThinkSound开创性地将CoT应用于音频生成领域,促使AI能够逐步明晰画面事件与声音之间的关联,进而达成高保真、强同步的空间音频生成效果。这并非简单的“看图配音”,而是真正意义上的“听懂画面”。

相关内容

热门资讯

2026年青岛热门的酒店抖音获... 2026年青岛热门的酒店抖音获客推广服务商有哪些 做酒店生意核心的就是获客,尤其是近些年来抖音本地流...
宁波4天,和爸妈的碎碎念 宁波4天,和爸妈的碎碎念 出发前 清明过后,趁着天气还没热起来,我请了几天假,带爸妈去宁波转了转。老...