近日,通義實驗室語音團隊在空間音頻生成領域取得里程碑式成果,推出OmniAudio技術,該技術可直接從360°視頻生成FOA(First-order Ambisonics)音頻,爲虛擬現實和沉浸式
近日,通义实验室语音团队在空间音频生成领域取得里程碑式成果,推出OmniAudio技术,该技术可直接从360°视频生成FOA(First-order Ambisonics)音频,为虚拟现实和沉浸式
近日,阿里语音AI团队宣布开源全球首个支持链式推理的音频生成模型ThinkSound,该模型通过引入思维链(Chain-of-Thought)技术,突破传统视频转音频技术对画面动态捕捉的局限,实现
emlog1 个月前
发表在:欢迎使用emlog这是系统生成的演示评论