AI工具
Real-ESRGAN:騰訊推出的開源圖像分辨率提升模型
Real-ESRGAN是什麼 Real-ESRGAN(Real-World Blind Super-Resolution with Pure Synthetic Data)是由騰訊的ARC實驗室推出的一個開源深度學習模型,專門用於...
DemoFusion – 免費開源的圖像分辨率超清增強框架
DemoFusion是什麼 DemoFusion是一個旨在低成本進行高分辨率圖像生成的技術框架,通過擴展現有的開源生成人工智能模型(如Stable Diffusion),使得這些模型能...
DemoFusion – 免費開源的圖像分辨率超清增強框架
DemoFusion是什麼 DemoFusion是一個旨在低成本進行高分辨率圖像生成的技術框架,通過擴展現有的開源生成人工智能模型(如Stable Diffusion),使得這些模型能...
ActAnywhere – Adobe推出的AI視頻背景生成模型
ActAnywhere是什麼 ActAnywhere是一個由斯坦福大學和Adobe Research的研究人員共同開發的視頻生成模型,旨在解決視頻背景生成的問題,特別是在需要將前景主體...
ActAnywhere – Adobe推出的AI視頻背景生成模型
ActAnywhere是什麼 ActAnywhere是一個由斯坦福大學和Adobe Research的研究人員共同開發的視頻生成模型,旨在解決視頻背景生成的問題,特別是在需要將前景主體...
Vary-toy:開源的小型視覺多模態模型
Vary-toy是什麼 Vary-toy是一個小型的視覺語言模型(LVLM),由來自曠視、國科大、華中大的研究人員共同提出,旨在解決大型視覺語言模型(LVLMs)在訓練和部...
Lepton Search – 開源的對話式AI搜索引擎項目
Lepton Search是什麼 Lepton Search是由原阿里巴巴技術副總裁和AI科學家賈揚清創辦的Lepton AI應用構建平台開源的一個對話式AI搜素引擎,該項目基於調用Lepto...
Lepton Search – 開源的對話式AI搜索引擎項目
Lepton Search是什麼 Lepton Search是由原阿里巴巴技術副總裁和AI科學家賈揚清創辦的Lepton AI應用構建平台開源的一個對話式AI搜素引擎,該項目基於調用Lepto...
Follow Your Pose – 開源的姿態全可控視頻生成框架
Follow Your Pose是什麼 Follow Your Pose是由清華大學、香港科技大學、騰訊AI Lab以及中科院的研究人員開源的一個基於文本到視頻生成的框架,允許用戶通過文...
IP-Adapter – 騰訊開源的文本到圖像擴散模型適配器
IP-Adapter是什麼 IP-Adapter(Image Prompt Adapter)是一種專門爲預訓練的文本到圖像擴散模型(如Stable Diffusion)設計的適配器,目的是讓文生圖模型能夠...