站内搜索「量化」共 41 条结果

推荐软件
GSQ-RCO:ISTA研究所的非均匀量化,11.8GB跑出BF16满分的Qwen3.8-27B学术派量化天花板:每个张量单独分配精度,同体积比Unsloth高10分,论文代码全公开可自己复刻
5天前

推荐软件
Unsloth Dynamic GGUF:新模型发布当天就能跑,510万人下载的量化生态闭环不只量化更是全链路:Dynamic v3.0动态精度+MTP投机解码+Flash Attention加速,llama.cpp/Ollama一键起
5天前

推荐程序员
Fincept Terminal — 开源金融智能终端基于 C++20/Qt6 的金融分析终端,内嵌 Python 3.11+,提供 CFA 级别分析、37 个 AI Agent、100+ 数据源、实时交易、QuantLib 量化套件与可视化节点工作流
5个月前

推荐模型
Gemma 4 31B JANG CRACK — MLX 原生去审查模型dealign.ai 出品的 Gemma 4 31B 去审查版,JANG 混合量化 5.1bit,HarmBench 93.7%,支持视觉+思维链
5个月前

推荐模型
Gemma 4 31B Uncensored MAX — BF16 全精度 MLX 去审查模型prithivMLmods 出品的 Gemma 4 31B 全精度(BF16)去审查版,无量化损失,mlx-vlm 原生支持
5个月前

推荐程序员
DwarfStar 4 — DeepSeek V4 Flash 本地推理引擎antirez新作:DeepSeek V4 Flash的Metal/CUDA原生推理引擎,2-bit量化128GB Mac跑百万token上下文
4个月前

推荐程序员
TradingAgents - 多智能体 LLM 金融交易框架,模拟真实交易公司决策流程基于多智能体 LLM 的开源金融交易框架,模拟真实交易公司架构,部署基本面/情绪/新闻/技术分析师和交易员、风控团队进行协作决策,支持多种 LLM 提供商和回测,适合量化交易研究与策略验证。
5个月前

推荐MacOS
vibevoice-mlx - VibeVoice TTS MLX 推理实现(Mac Studio 部署指南)微软删除官方推理代码后,社区补上的完整 MLX 实现。支持 1.5B/7B 语音合成、零样本语音克隆、量化加速。
5个月前

推荐模型
SD.Next - 接替 A1111 的全能 AI 生成 WebUI支持 Stable Diffusion、SDXL、SD3、FLUX 及视频生成,内置量化引擎与自动调优,跨平台开箱即用
4个月前

推荐模型
Qwen3.8-27B - 27B多模态新王,终端编程超Opus 4.6 MaxQwen3.6-27B正统后继:原生多模态+混合线性注意力架构,262K上下文,终端编程基准超Opus 4.6 Max,Apache 2.0可商用,量化后16GB内存可跑
1个月前

推荐模型
LTX-2.5 - Lightricks 开源视频生成模型,22B 参数音视频同步83 万下载的开源视频模型天花板——文生视频/图生视频/音视频同步/4K 20 秒,8GB 显存量化可跑
1个月前

推荐模型
NVIDIA 上跑本地大模型:一张 3090 Ti 跑 27B 免审模型(附下载地址与实测对照)一张 3090 Ti 跑 27B 免审模型:改写/翻译类比原双卡快 2.2 倍,日常对话快 32%。代价是量化从 8 位降到 4 位,且质量尚未验证。
5天前

推荐软件
MiniMax H3 开源满月实测:社区加速链+全显卡数据+48G硬件选购H3跑一个月社区卷出6-8倍加速链,8G卡到48G魔改实测数据全收录,4090魔改还是Pro 5000这一篇帮你算明白
12天前

推荐模型
Bonsai 2 27B - 54GB压到5.9GB还留98%智力的三值模型(Qwen3.8-27B官方压缩,笔记本能跑满血27B推理)发布3天下载破150万!54GB的Qwen3.8-27B压到5.9GB还留98.2%智力,传统2bit崩掉的数学题它守住95分,低比特本地部署天花板。
8天前

推荐MacOS
Rapid-MLX - 专为 Apple Silicon 打造的极速本地 AI 引擎比 Ollama 快 4.2 倍,17 种工具调用解析器,0.08 秒首字延迟,完整兼容 OpenAI API
4个月前




