站内搜索「LM」共 18 条结果
mlx-engine - LM Studio官方MLX推理引擎(多轮缓存+批量读图)
推荐MacOS
mlx-engine - LM Studio官方MLX推理引擎(多轮缓存+批量读图)
LM Studio跑MLX模型的官方引擎:多轮对话缓存命中秒回、同图追问只算一次视觉编码。99%的人不用装(LM Studio自带),自建MLX服务的值得抄它的缓存设计。
7天前
Open Notebook - 开源隐私优先的 Notebook LM 替代品
推荐程序员
Open Notebook - 开源隐私优先的 Notebook LM 替代品
开源自托管的智能笔记研究工具,支持18+AI模型、多模态内容、多说话人播客生成,数据完全本地存储
3个月前
Omni-SimpleMem - LLM Agent 终身记忆系统
推荐模型
Omni-SimpleMem - LLM Agent 终身记忆系统
支持文本、图像、音频、视频的多模态终身记忆,LoCoMo SOTA
5个月前
VibeVoice 社区版 - PyTorch/CUDA 多 GPU 推理完整代码
推荐程序员
VibeVoice 社区版 - PyTorch/CUDA 多 GPU 推理完整代码
微软删除官方 TTS 推理代码后,社区 fork 保留的 PyTorch 完整实现。支持单卡/多卡推理、语音克隆、Gradio Demo。
5个月前
Peekaboo - Mac 屏幕感知 AI Agent 自动化工具
推荐MacOS
Peekaboo - Mac 屏幕感知 AI Agent 自动化工具
像素级截屏 + AI 分析 + 完整 GUI 自动化,支持自然语言指令驱动点击、输入、滚动、热键等操作,含 MCP Server
4个月前
Qwen3-TTS - 阿里开源最强语音合成模型
推荐模型
Qwen3-TTS - 阿里开源最强语音合成模型
10语言全覆盖、97ms流式延迟、3秒声音克隆,中文TTS天花板,Apache 2.0商用免费
3个月前
Robin — AI 驱动的暗网 OSINT 调查工具
推荐程序员
Robin — AI 驱动的暗网 OSINT 调查工具
通过 Tor 搜索暗网,用 LLM 自动过滤、总结,支持 Docker 一键部署。
2个月前
GSQ-RCO:ISTA研究所的非均匀量化,11.8GB跑出BF16满分的Qwen3.8-27B
推荐软件
GSQ-RCO:ISTA研究所的非均匀量化,11.8GB跑出BF16满分的Qwen3.8-27B
学术派量化天花板:每个张量单独分配精度,同体积比Unsloth高10分,论文代码全公开可自己复刻
5天前
Unsloth Dynamic GGUF:新模型发布当天就能跑,510万人下载的量化生态闭环
推荐软件
Unsloth Dynamic GGUF:新模型发布当天就能跑,510万人下载的量化生态闭环
不只量化更是全链路:Dynamic v3.0动态精度+MTP投机解码+Flash Attention加速,llama.cpp/Ollama一键起
5天前
Kimi 开源 K2.6:1万亿参数 MoE,长程编码与 Agent Swarm 能力行业领先
推荐模型
Kimi 开源 K2.6:1万亿参数 MoE,长程编码与 Agent Swarm 能力行业领先
Moonshot AI 开源 Kimi K2.6,1万亿参数 MoE(激活32B),原生多模态。在 SWE-Bench Pro、长程编码、Agent Swarm 等关键指标上超越 Claude Opus 4.6 和 GPT-5.4。开源模型做到这个水平,闭源阵营的压力来了。
5个月前
Gemma 4 31B Uncensored MAX — BF16 全精度 MLX 去审查模型
推荐模型
Gemma 4 31B Uncensored MAX — BF16 全精度 MLX 去审查模型
prithivMLmods 出品的 Gemma 4 31B 全精度(BF16)去审查版,无量化损失,mlx-vlm 原生支持
5个月前
Google Gemma 4 12B - 无编码器多模态大模型
推荐模型
Google Gemma 4 12B - 无编码器多模态大模型
Google DeepMind 开源多模态模型,11.95B参数支持文本+图像+音频,256K上下文,原生函数调用,Apache 2.0免费商用
3个月前
Qwen3.8-27B - 27B多模态新王,终端编程超Opus 4.6 Max
推荐模型
Qwen3.8-27B - 27B多模态新王,终端编程超Opus 4.6 Max
Qwen3.6-27B正统后继:原生多模态+混合线性注意力架构,262K上下文,终端编程基准超Opus 4.6 Max,Apache 2.0可商用,量化后16GB内存可跑
1个月前
Hindsight:让 agent 越用越聪明的记忆系统
推荐软件
Hindsight:让 agent 越用越聪明的记忆系统
LongMemEval 榜单 SOTA(第三方复现背书)——仿生记忆结构:事实/经历/信念/心智模型四层,Docker 一条命令自部署,25+ LLM 提供商含全本地方案
1个月前
Bonsai 2 27B - 54GB压到5.9GB还留98%智力的三值模型(Qwen3.8-27B官方压缩,笔记本能跑满血27B推理)
推荐模型
Bonsai 2 27B - 54GB压到5.9GB还留98%智力的三值模型(Qwen3.8-27B官方压缩,笔记本能跑满血27B推理)
发布3天下载破150万!54GB的Qwen3.8-27B压到5.9GB还留98.2%智力,传统2bit崩掉的数学题它守住95分,低比特本地部署天花板。
8天前
Jev:不生成文本的 System One 决策模型(TypeSafe AI)
推荐随笔
Jev:不生成文本的 System One 决策模型(TypeSafe AI)
RLHF共同发明人新公司首作:不做聊天只做结构化决策,概率校准可信到能写进代码阈值,便宜两个数量级
8天前
Mac 上跑本地大模型:该选哪个版本、免审模型用哪个(附下载地址与实测速度)
推荐模型
Mac 上跑本地大模型:该选哪个版本、免审模型用哪个(附下载地址与实测速度)
同一个模型有 4bit/8bit/免审版,怎么选?一句话:稠密选小、MoE 选大。附下载地址与实测速度;2026-09 补测 oMLX 引擎,修正「换引擎不会变快」的旧结论。
7天前
Awesome-LLMs-for-Video-Understanding:视频理解大模型全家桶清单(3.3k★)
推荐软件
Awesome-LLMs-for-Video-Understanding:视频理解大模型全家桶清单(3.3k★)
IEEE TCSVT 收录的 Vid-LLM 综述配套清单:论文+代码+数据集+基准全整理,选型与研究必备
26天前