AI工具
JoyAI-Echo – 京東開源的長音視頻生成框架
JoyAI-Echo是什麼 JoyAI-Echo 是京東推出的開源長音視頻生成框架,專爲分鐘級多鏡頭故事生成設計。框架通過跨模態記憶庫、記憶驅動後訓練、Director Agent 對...
Kimi Work – 月之暗面推出的通用型本地 Agent
Kimi Work是什麼 Kimi Work 是月之暗面推出的面向知識工作者的通用型本地 Agent,隨 Kimi 最新測試版 Mac 和 Windows 客戶端推出。工具基於 Kimi Code 內核,...
Toonflow – 開源的一站式 AI 短劇創作工具
Toonflow是什麼 Toonflow 是開源的一站式 AI 短劇創作工具,將小說、劇本通過多 Agent 協作自動轉化爲結構化劇本、智能分鏡、角色視覺和動畫視頻,實現小說→...
Hermes Desktop – Nous Research 推出的 Hermes 桌面端
Hermes Desktop是什麼 Hermes Desktop 是 Nous Research 推出的官方 Hermes 桌面客戶端,支持 macOS、Windows 和 Linux 三端。工具具備持久記憶、任務調度、...
Odysseus – 開源的本地自託管 AI 工作空間
Odysseus是什麼 Odysseus 是開源自託管的 AI 工作空間,提供類似 ChatGPT / Claude 的聊天界面,工具完全本地化運行,數據不出本機、隱私零泄露。工具集成聊...
MAI-Thinking-1 – 微軟推出的首款自研高級推理模型
MAI-Thinking-1是什麼 MAI-Thinking-1 是微軟推出的首款自研高級推理模型。模型採用 35B 活躍參數 / 約 1T 總參數的稀疏 MoE 架構,完全基於乾淨、商業授權數...
Science Skills – 谷歌 DeepMind 開源的科研技能工具包
Science Skills是什麼 Science Skills 是谷歌 DeepMind 推出的開源科研技能集合,專爲加速 AI Agent 驅動的科學研究工作流設計。工具整合 AlphaGenome、Alpha...
Bernini – 字節跳動開源的統一視頻生成與編輯框架
Bernini是什麼 Bernini 是字節跳動開源的統一視頻生成與編輯框架,採用MLLM 語義規劃 + DiT 視覺渲染的兩階段解耦架構。多模態大模型理解指令並規劃語義草圖...
PaddleOCR-VL-1.6 – 百度推出的文檔解析視覺語言模型
PaddleOCR-VL-1.6是什麼 PaddleOCR-VL-1.6 是百度飛槳團隊推出的文檔解析視覺語言模型(VLM),是 PaddleOCR-VL 系列的最新升級版本。模型僅 0.9B 參數,在 O...
Mellum2 – JetBrains 開源的混合專家模型
Mellum2是什麼 Mellum2 是 JetBrains 開源的面向軟件工程系統的新機器學習模型。模型每 token 僅激活 2.5B 參數,專爲軟件工程 AI 工作流優化,支持代碼生成...