站内搜索「VLM」共 13 条结果
vlmcsd
推荐服务器运维
vlmcsd
用 C 语言编写的开源 KMS 服务器模拟器,体积仅几百 KB,可在路由器、NAS、树莓派上运行为局域网内 VL 版 Windows/Office 提供激活服务
2个月前
Gemma 4 31B Uncensored MAX — BF16 全精度 MLX 去审查模型
推荐模型
Gemma 4 31B Uncensored MAX — BF16 全精度 MLX 去审查模型
prithivMLmods 出品的 Gemma 4 31B 全精度(BF16)去审查版,无量化损失,mlx-vlm 原生支持
5个月前
MinerU - 文档解析引擎
推荐程序员
MinerU - 文档解析引擎
开源文档解析引擎,OpenDataLab 出品 78k Star。PDF/Word/PPT/Excel/图片一键转 LLM 友好的 Markdown/JSON,公式转 LaTeX、表格转 HTML、跨页表格合并、109 语言 OCR;Pipeline 后端纯 CPU 可跑,VLM 后端精度 95+,另有 mineru.net 在线服务免部署
5个月前
TurboOCR — GPU 极限速度的文档解析器
推荐软件
TurboOCR — GPU 极限速度的文档解析器
OCR/版面/表格/公式全流水线跑在显卡上,PDF 进 Markdown 出,单卡 5090 最快 559 图/秒,比传统 OCR 快 15-90 倍
1个月前
TuriX CUA - 开源计算机使用代理
推荐模型
TuriX CUA - 开源计算机使用代理
macOS/Windows/Linux 开源 GUI 自动化代理,OSWorld 60% 成功率,支持 OpenClaw
5个月前
SD.Next - 接替 A1111 的全能 AI 生成 WebUI
推荐模型
SD.Next - 接替 A1111 的全能 AI 生成 WebUI
支持 Stable Diffusion、SDXL、SD3、FLUX 及视频生成,内置量化引擎与自动调优,跨平台开箱即用
4个月前
ViMax:多智能体全流程视频生成框架
推荐模型
ViMax:多智能体全流程视频生成框架
HKUDS 开源,导演+编剧+制片人+视频生成器一体化,支持创意/小说/剧本一键成片
4个月前
VideoDevour - 视频吃进去,图文报告吐出来
推荐软件
VideoDevour - 视频吃进去,图文报告吐出来
扔一段视频进去,自动出带章节配图的 Markdown 报告,网课笔记/会议纪要/内容素材一站搞定
26天前
MOSS-VL:边看边答的开源实时视频理解模型
推荐软件
MOSS-VL:边看边答的开源实时视频理解模型
复旦OpenMOSS开源11B实时视频理解模型:边看边答、主动沉默、动态纠错,NF4版单卡24G可跑
26天前
Rapid-MLX - 专为 Apple Silicon 打造的极速本地 AI 引擎
推荐MacOS
Rapid-MLX - 专为 Apple Silicon 打造的极速本地 AI 引擎
比 Ollama 快 4.2 倍,17 种工具调用解析器,0.08 秒首字延迟,完整兼容 OpenAI API
4个月前
Qwen3.8-27B - 27B多模态新王,终端编程超Opus 4.6 Max
推荐模型
Qwen3.8-27B - 27B多模态新王,终端编程超Opus 4.6 Max
Qwen3.6-27B正统后继:原生多模态+混合线性注意力架构,262K上下文,终端编程基准超Opus 4.6 Max,Apache 2.0可商用,量化后16GB内存可跑
1个月前
最新开源视觉大模型横评:Qwen3.6 vs Keye-VL-2.0 vs Tarsier2-Recap
推荐模型
最新开源视觉大模型横评:Qwen3.6 vs Keye-VL-2.0 vs Tarsier2-Recap
三家最新开源MoE视觉大模型,全部30B级只激活3B,定位完全不同
1个月前
Mac 上跑本地大模型:该选哪个版本、免审模型用哪个(附下载地址与实测速度)
推荐模型
Mac 上跑本地大模型:该选哪个版本、免审模型用哪个(附下载地址与实测速度)
同一个模型有 4bit/8bit/免审版,怎么选?一句话:稠密选小、MoE 选大。附下载地址与实测速度;2026-09 补测 oMLX 引擎,修正「换引擎不会变快」的旧结论。
7天前