AI工具
琴樂大模型 – 騰訊推出的AI音樂創作大模型
琴樂大模型是什麼 琴樂大模型是由騰訊AI Lab與騰訊TME天琴實驗室共同研發的人工智能音樂創作大模型,該模型通過輸入中英文關鍵詞、描述性語句或音頻,能夠直...
Unique3D – 清華大學團隊開源的圖像到3D生成模型
Unique3D是什麼 Unique3D是由清華大學團隊開源的一個單張圖像到3D模型轉換的框架,通過結合多視圖擴散模型和法線擴散模型,以及一種高效的多級上採樣策略,能...
谷歌DeepMind推出V2A技術,可爲無聲視頻添加逼真音效
在人工智能領域,谷歌旗下的DeepMind公司再次取得突破性進展,推出了一款名爲V2A(Video-to-Audio,視頻到音頻)的AI模型。該項技術能夠將視頻像素與文本提示...
Gen-3 Alpha – Runway公司最新推出的AI視頻生成模型
Gen-3 Alpha是什麼 Gen-3 Alpha是由AI視頻初創公司Runway最新發布的新一代AI視頻生成模型,通過大規模多模態訓練基礎設施,顯著提升了視頻的保真度、一致性和...
Hallo – 復旦百度等開源的AI對口型肖像視頻生成框架
Hallo是什麼 Hallo是由復旦大學、百度公司、蘇黎世聯邦理工學院和南京大學的研究人員共同提出的一個AI對口型肖像圖像動畫技術,可基於語音音頻輸入來驅動生成...
階躍星辰推出移動端AI智能問答助手躍問APP
AI工具集 6月14日消息,由微軟前全球副總裁姜大昕所創辦的人工智能初創公司階躍星辰日前宣佈上線其AI智能問答助手躍問的移動端APP,用戶可在蘋果App Store和...
MimicBrush – 阿里等開源的AI圖像編輯融合框架
MimicBrush是什麼 MimicBrush是由阿里巴巴、香港大學和螞蟻集團的研究人員推出的AI圖像編輯融合框架,允許用戶通過簡單的操作,在源圖像上指定需要編輯的區域...
Stability AI開源Stable Diffusion 3 Medium文生圖模型
6月12日晚間消息,人工智能初創公司Stability AI宣佈正式開源發佈其最新的文本到圖像生成模型——Stable Diffusion 3 Medium(SD3 Medium)。Stable Diffusion ...
國家網信辦發佈第六批深度合成服務算法備案信息,騰訊混元等492個算法在列
6月12日消息,國家網信辦今日發佈公告,根據《互聯網信息服務深度合成管理規定》,現公開發布第六批境內深度合成服務算法備案信息。 《互聯網信息服務深度合...
ToonCrafter – 騰訊等開源的卡通動畫視頻插幀工具
ToonCrafter是什麼 ToonCrafter是由騰訊AI實驗室、香港中文大學和香港城市大學的研究人員開源的卡通動畫視頻中間幀生成工具,突破了傳統卡通動畫製作中線性運...