站内搜索「bf16」共 17 条结果

推荐模型
Gemma 4 31B Uncensored MAX — BF16 全精度 MLX 去审查模型prithivMLmods 出品的 Gemma 4 31B 全精度(BF16)去审查版,无量化损失,mlx-vlm 原生支持
5个月前

推荐软件
GSQ-RCO:ISTA研究所的非均匀量化,11.8GB跑出BF16满分的Qwen3.8-27B学术派量化天花板:每个张量单独分配精度,同体积比Unsloth高10分,论文代码全公开可自己复刻
5天前

推荐程序员
VibeVoice 社区版 - PyTorch/CUDA 多 GPU 推理完整代码微软删除官方 TTS 推理代码后,社区 fork 保留的 PyTorch 完整实现。支持单卡/多卡推理、语音克隆、Gradio Demo。
5个月前

推荐模型
Qwen3.8-27B - 27B多模态新王,终端编程超Opus 4.6 MaxQwen3.6-27B正统后继:原生多模态+混合线性注意力架构,262K上下文,终端编程基准超Opus 4.6 Max,Apache 2.0可商用,量化后16GB内存可跑
1个月前

推荐模型
Qwen3.8-27B 去审查版首选:OrcaRouter Uncensored十几个去审查版里口碑最干净的一版,MLX 786赞/FP8 715赞双第一,红队探针0拒绝且不变笨;附 JonathanColetti/OBLITERATUS/huihui 等6家横评
1个月前

推荐模型
NVIDIA 上跑本地大模型:一张 3090 Ti 跑 27B 免审模型(附下载地址与实测对照)一张 3090 Ti 跑 27B 免审模型:改写/翻译类比原双卡快 2.2 倍,日常对话快 32%。代价是量化从 8 位降到 4 位,且质量尚未验证。
5天前

推荐模型
蚂蚁Ling-2.6-flash正式亮相:104B参数仅激活7.4B,Agent专用MoE模型蚂蚁集团AGI团队出品,OpenRouter/Kilo限时免费。速度比Claude Sonnet 4.6快6倍,成本低约50倍,专为Agent场景原生设计。
5个月前

推荐模型
Google Gemma 4 12B - 无编码器多模态大模型Google DeepMind 开源多模态模型,11.95B参数支持文本+图像+音频,256K上下文,原生函数调用,Apache 2.0免费商用
3个月前

推荐MacOS
mlx-video - Mac原生MLX视频生成库(LTX-2.3+Wan2.2)一个库在Apple Silicon上原生跑LTX-2.3和Wan2.2两大视频模型,纯MLX加速,CLI一行出片,比PyTorch MPS快1.7倍
3个月前

推荐软件
MiniMax H3 完整使用教程:部署、长视频、实时直播33B 开源全模态视频模型,从零部署到 Motion Context 长视频拼接、低显存优化、fal.ai H3 Max 实时直播,一份搞定
28天前

推荐软件
Krea 2 - 专治AI味的开源图像模型:风格参考混搭+8步2秒出图,ComfyUI官方仓935万下载Krea.ai从零自研的12.9B图像模型,ComfyUI官方仓935万下载:风格参考混搭+反AI味审美,Turbo版8步2秒出2K图,3090可跑
10天前





