AI工具

Iris – 小紅書 AllSpark 團隊開源的搜索智能體

Iris是什麼 Iris 是小紅書 AllSpark 團隊開源的搜索智能體,含 35B(Iris-mini)和 397B(Iris-pro)兩個版本。Iris能在真實網絡中自主決定搜什麼、怎麼讀、...

Step Audio 3 – 階躍星辰推出的語音大模型系列

Step Audio 3是什麼 StepAudio 3 是階躍星辰推出的語音大模型系列,包含 Realtime、ASR、TTS、Gen和 Music五款模型。模型中 Realtime 的語音推理準確率99.7%...

HiDream-O1-Video-1.0 – 智象未來推出的全模態視頻生成模型

HiDream-O1-Video-1.0是什麼 HiDream-O1-Video-1.0(簡稱HD-V1)是智象未來(HiDream.ai)推出的原生全模態視頻生成模型,支持文本、圖片、視頻等多模態輸入...

法界通 – 一站式 AI 法律服務平台,支持多端使用

法界通是什麼 法界通是面向中國用戶的 AI 法律服務平台,將律師與創作者的內容社區、用戶向律師提問的公開諮詢、可隨時對話的 AI 法律助手整合在同一產品中。...

YuE2 – 港科技大聯合 M-A-P 團隊開源的音樂生成模型

YuE2是什麼 YuE2是香港科技大學與M-A-P團隊開源的音樂生成模型。模型能根據歌詞和風格生成可編輯的ABC樂譜(旋律+和絃),再渲染爲48kHz完整歌曲,讓創作過程...

書生-S2 – 上海 AI Lab 開源的多模態基礎大模型

書生-S2是什麼 書生-S2是上海人工智能實驗室開源的多模態基礎大模型(397B參數),是最懂科學的大模型。模型通過Memory Decoder架構引入可插拔專業記憶模塊,...

UnifoLM-WLA-1.0 – 宇樹科技推出的具身多模態大模型

UnifoLM-WLA-1.0是什麼 UnifoLM-WLA-1.0是宇樹科技推出的6B具身多模態大模型,基於約2500小時真機數據訓練,將視覺、語言與動作統一建模,單模型統籌64項桌面...

WooMoo – AI 塔羅應用,支持語音提問和語音收聽解讀

WooMoo是什麼 WooMoo是Romangic團隊推出的AI塔羅應用,主打”以心理學爲底、用塔羅語言表達”的情緒陪伴。用戶文字或語音提問後,經搖手機洗牌、抽牌等儀式感流...

LingBot-World 2.0 – 螞蟻靈波科技開源的實時交互世界模型

LingBot-World 2.0是什麼 LingBot-World 2.0 是螞蟻靈波科技開源的實時交互世界模型,能像遊戲一樣被實時遊玩。遊戲支持移動、攻擊、施法、跳躍等操作及雨雪...

Xiaomi-CocktailASR-1 – 小米開源的說話人語音識別模型

Xiaomi-CocktailASR-1是什麼 Xiaomi-CocktailASR-1是小米開源的目標說話人語音識別大模型,基於LLM端到端架構,用參考語音作爲聲紋提示,無需語音分離可從多...
1 ... 3 4 5 6 7 ... 169