AI工具

Real-ESRGAN:騰訊推出的開源圖像分辨率提升模型

Real-ESRGAN是什麼 Real-ESRGAN(Real-World Blind Super-Resolution with Pure Synthetic Data)是由騰訊的ARC實驗室推出的一個開源深度學習模型,專門用於...

DemoFusion – 免費開源的圖像分辨率超清增強框架

DemoFusion是什麼 DemoFusion是一個旨在低成本進行高分辨率圖像生成的技術框架,通過擴展現有的開源生成人工智能模型(如Stable Diffusion),使得這些模型能...

DemoFusion – 免費開源的圖像分辨率超清增強框架

DemoFusion是什麼 DemoFusion是一個旨在低成本進行高分辨率圖像生成的技術框架,通過擴展現有的開源生成人工智能模型(如Stable Diffusion),使得這些模型能...

ActAnywhere – Adobe推出的AI視頻背景生成模型

ActAnywhere是什麼 ActAnywhere是一個由斯坦福大學和Adobe Research的研究人員共同開發的視頻生成模型,旨在解決視頻背景生成的問題,特別是在需要將前景主體...

ActAnywhere – Adobe推出的AI視頻背景生成模型

ActAnywhere是什麼 ActAnywhere是一個由斯坦福大學和Adobe Research的研究人員共同開發的視頻生成模型,旨在解決視頻背景生成的問題,特別是在需要將前景主體...

Vary-toy:開源的小型視覺多模態模型

Vary-toy是什麼 Vary-toy是一個小型的視覺語言模型(LVLM),由來自曠視、國科大、華中大的研究人員共同提出,旨在解決大型視覺語言模型(LVLMs)在訓練和部...

Lepton Search – 開源的對話式AI搜索引擎項目

Lepton Search是什麼 Lepton Search是由原阿里巴巴技術副總裁和AI科學家賈揚清創辦的Lepton AI應用構建平台開源的一個對話式AI搜素引擎,該項目基於調用Lepto...

Lepton Search – 開源的對話式AI搜索引擎項目

Lepton Search是什麼 Lepton Search是由原阿里巴巴技術副總裁和AI科學家賈揚清創辦的Lepton AI應用構建平台開源的一個對話式AI搜素引擎,該項目基於調用Lepto...

Follow Your Pose – 開源的姿態全可控視頻生成框架

Follow Your Pose是什麼 Follow Your Pose是由清華大學、香港科技大學、騰訊AI Lab以及中科院的研究人員開源的一個基於文本到視頻生成的框架,允許用戶通過文...

IP-Adapter – 騰訊開源的文本到圖像擴散模型適配器

IP-Adapter是什麼 IP-Adapter(Image Prompt Adapter)是一種專門爲預訓練的文本到圖像擴散模型(如Stable Diffusion)設計的適配器,目的是讓文生圖模型能夠...
1 ... 163 164 165 166 167 ... 169