HyOCR-1.5 – 騰訊混元開源的輕量級端到端 OCR 專家大模型
HyOCR-1.5是什麼 HyOCR-1.5 是騰訊混元開源的輕量級端到端 OCR 專家大模型,僅 1B 參數能實現文檔解析、文本識別、信息抽取、拍照翻譯、圖表解析、古文字識別...
Agnes-2.5-Flash – Agnes AI 推出的新一代高性能文本模型
Agnes-2.5-Flash是什麼 Agnes-2.5-Flash 是 Agnes AI 推出的新一代高性能文本模型,Coding 能力位列全球第一梯隊,在代碼理解、工程修復、多步驟任務執行與複...
SenseNova-Vision – 商湯開源的理解生成統一視覺大模型
SenseNova-Vision是什麼 SenseNova-Vision 是商湯開源的理解生成統一視覺大模型,將目標檢測、圖像分割、深度預測、3D重建等經典視覺任務原生融入大模型底座...
阿里 Wan2.1 本地部署教程 – 8G 顯存可文生視頻
今天發點適合本地做 AI 視頻的東西。 說實話,現在的 AI 視頻生成技術已經算成熟了,只有一個缺點:貴,收費基本都按秒,而且很難保證一條過,錢包真的頂不住...
Step Edge – 階躍星辰推出的端側模型全家桶
Step Edge是什麼 Step Edge是階躍星辰推出的端側模型全家桶,包含基礎模型、Audio、GUI、Gen 四大成員,面向手機與汽車等終端打造。模型通過端雲協同架構,讓...
DramaClaw – 工業級 AI 視頻製作工具,提供一站式流水線
DramaClaw是什麼 DramaClaw 是工業級 AIGC 視頻製作工具,主要面向 AI 短劇、漫劇、小說推文、解說劇等多類型視頻創作場景。工具基於自研靈山 AI 大模型,提...
SeFi-Image – 開源的文本到圖像模型,基於語義優先擴散
SeFi-Image是什麼 SeFi-Image 是基於語義優先擴散的文本到圖像模型,提供 1B、2B、5B 三種規格。模型將高層語義結構與紋理細節分離,讓語義流提前去噪,爲紋...
CodeMote – AI 原生跨端終端工具,支持遠程操控編碼環境
CodeMote是什麼 CodeMote 是 AI 原生跨端終端工具,支持 iPhone/iPad 遠程控制桌面 AI 編碼智能體與完整開發環境。工具將手機變爲個人開發工作站遙控器,讓開...
開閉源模型實測 – 橫評 Sonnet 5 與四大國產開源模型編程能力
今天發點開閉源模型的對比實測。 Sonnet 系列上次更新還是在 2月,這次隨着Fable 5的解禁又更新了一版,從 Claude 發佈的數據上來看整體比 Oups 4.6和4.7 強...
Agents-A1 – 上海 AI Lab開源的混合專家智能體模型
Agents-A1是什麼 Agents-A1是上海AI實驗室開源的35B參數混合專家(MoE)智能體模型,專爲複雜科研任務設計。模型通過知識-行動圖譜構建可驗證長軌跡基礎設施...