关闭导航

包含标签"空间音频生成"的内容

通义实验室OmniAudio技术:360°视频直接生成FOA空间音视频获突破
AI妹 1 个月前 8 0

近日,通義實驗室語音團隊在空間音頻生成領域取得里程碑式成果,推出OmniAudio技術,該技術可直接從360°視頻生成FOA(First-order Ambisonics)音頻,爲虛擬現實和沉浸式

通义实验室OmniAudio技术实现360°视频到精准FOA空间音频生成重大里程碑突破
AI妹 1 个月前 8 0

近日,通义实验室语音团队在空间音频生成领域取得里程碑式成果,推出OmniAudio技术,该技术可直接从360°视频生成FOA(First-order Ambisonics)音频,为虚拟现实和沉浸式

阿里语音AI开源ThinkSound 全球首个支持链式推理的音频生成模型
AI妹 1 个月前 7 0

近日,阿里语音AI团队宣布开源全球首个支持链式推理的音频生成模型ThinkSound,该模型通过引入思维链(Chain-of-Thought)技术,突破传统视频转音频技术对画面动态捕捉的局限,实现

阿里语音AI团队开源ThinkSound 全球首个支持链式推理的音频生成模型
AI妹 1 个月前 8 0

近日,阿里語音AI團隊宣佈開源全球首個支持鏈式推理的音頻生成模型ThinkSound,該模型通過引入思維鏈(Chain-of-Thought)技術,突破傳統視頻轉音頻技術對畫面動態捕捉的侷限,實現