站内搜索「mlx」共 28 条结果

推荐MacOS
mlx-video - Mac原生MLX视频生成库(LTX-2.3+Wan2.2)一个库在Apple Silicon上原生跑LTX-2.3和Wan2.2两大视频模型,纯MLX加速,CLI一行出片,比PyTorch MPS快1.7倍
3个月前

推荐MacOS
mlx-engine - LM Studio官方MLX推理引擎(多轮缓存+批量读图)LM Studio跑MLX模型的官方引擎:多轮对话缓存命中秒回、同图追问只算一次视觉编码。99%的人不用装(LM Studio自带),自建MLX服务的值得抄它的缓存设计。
7天前

推荐MacOS
vibevoice-mlx - VibeVoice TTS MLX 推理实现(Mac Studio 部署指南)微软删除官方推理代码后,社区补上的完整 MLX 实现。支持 1.5B/7B 语音合成、零样本语音克隆、量化加速。
5个月前

推荐MacOS
Rapid-MLX - 专为 Apple Silicon 打造的极速本地 AI 引擎比 Ollama 快 4.2 倍,17 种工具调用解析器,0.08 秒首字延迟,完整兼容 OpenAI API
4个月前

推荐模型
Gemma 4 31B JANG CRACK — MLX 原生去审查模型dealign.ai 出品的 Gemma 4 31B 去审查版,JANG 混合量化 5.1bit,HarmBench 93.7%,支持视觉+思维链
5个月前

推荐硬件
M5 Max 实测 Qwen3.8-27B MLX 4bit 并发扩展性:1→32 并行全数据64GB 统一内存本地跑 27B,252 次请求零报错。低并发看响应,高并发看总量,甜蜜区在 N≤4
28天前

推荐模型
Gemma 4 31B Uncensored MAX — BF16 全精度 MLX 去审查模型prithivMLmods 出品的 Gemma 4 31B 全精度(BF16)去审查版,无量化损失,mlx-vlm 原生支持
5个月前

推荐模型
DFlash - 块扩散加速LLM推理的推测解码方案轻量级块扩散模型,专为 LLM Speculative Decoding 设计,支持 vLLM/SGLang/MLX,已适配 20+ 主流大模型
4个月前

推荐模型
Qwen3.8-27B 去审查版首选:OrcaRouter Uncensored十几个去审查版里口碑最干净的一版,MLX 786赞/FP8 715赞双第一,红队探针0拒绝且不变笨;附 JonathanColetti/OBLITERATUS/huihui 等6家横评
1个月前

推荐软件
BiliNote - AI 视频笔记生成工具:让 AI 为你的视频做笔记扔个B站/YouTube/抖音链接进去,自动出带截图、可跳转原片的 Markdown 笔记,还支持笔记内容 AI 问答。开源可自部署,7.3k Stars。
16天前

推荐模型
Google Gemma 4 12B - 无编码器多模态大模型Google DeepMind 开源多模态模型,11.95B参数支持文本+图像+音频,256K上下文,原生函数调用,Apache 2.0免费商用
3个月前

推荐模型
FLUX.2-klein-9B - 文生图+图生图+图像编辑三合一Black Forest Labs新作,一个9B模型统一生成与编辑,支持多图参考编辑,Qwen3编码器中文强,最快不到1秒
3个月前







