慕尼黑的初創公司 Spaitial 正在開發一種全新的生成 AI 技術,旨在創建和理解三維環境。這種技術被稱爲空間基礎模型(SFM),它能夠從文本或圖像中生成真實和想象的3D 場景。Spaitia
慕尼黑的初创公司 Spaitial 正在开发一种全新的生成 AI 技术,旨在创建和理解三维环境。这种技术被称为空间基础模型(SFM),它能够从文本或图像中生成真实和想象的3D 场景。Spaitia
AI领域迎来一项重大技术突破——MotionPro,一款专为图像到视频(I2V)生成设计的精密运动控制器正式亮相。这一技术通过创新的区域轨迹和运动掩码技术,实现了对物体和镜头运动的精细化控制,为视
AI分野において画期的な技術革新が登場しました。MotionProと呼ばれる画像から動画(I2V)生成専用の精密なモーションコントローラーが正式に発表されました。この技術は革新的な領域軌跡とモーシ
近日,通義實驗室語音團隊在空間音頻生成領域取得里程碑式成果,推出OmniAudio技術,該技術可直接從360°視頻生成FOA(First-order Ambisonics)音頻,爲虛擬現實和沉浸式
近日,通义实验室语音团队在空间音频生成领域取得里程碑式成果,推出OmniAudio技术,该技术可直接从360°视频生成FOA(First-order Ambisonics)音频,为虚拟现实和沉浸式
近日,阿里语音AI团队宣布开源全球首个支持链式推理的音频生成模型ThinkSound,该模型通过引入思维链(Chain-of-Thought)技术,突破传统视频转音频技术对画面动态捕捉的局限,实现
近日,阿里語音AI團隊宣佈開源全球首個支持鏈式推理的音頻生成模型ThinkSound,該模型通過引入思維鏈(Chain-of-Thought)技術,突破傳統視頻轉音頻技術對畫面動態捕捉的侷限,實現
近日,高通AI研究院(Qualcomm AI Research)推出了一項顛覆性技術——CSD-VAR,通過創新的內容-風格分解方法,進一步提升了視覺自迴歸模型的生成能力與創意靈活性。 &nbs
人工智能在數字人領域的應用持續升溫,阿里巴巴聯合北京郵電大學近日推出了一項令人矚目的新項目——FantasyPortrait。這一項目通過創新的表情增強擴散變換器(DiT),實現了單人及多人場景下
emlog1 个月前
发表在:欢迎使用emlog这是系统生成的演示评论