站内搜索「bf16」共 17 条结果
Gemma 4 31B Uncensored MAX — BF16 全精度 MLX 去审查模型
推荐模型
Gemma 4 31B Uncensored MAX — BF16 全精度 MLX 去审查模型
prithivMLmods 出品的 Gemma 4 31B 全精度(BF16)去审查版,无量化损失,mlx-vlm 原生支持
5个月前
GSQ-RCO:ISTA研究所的非均匀量化,11.8GB跑出BF16满分的Qwen3.8-27B
推荐软件
GSQ-RCO:ISTA研究所的非均匀量化,11.8GB跑出BF16满分的Qwen3.8-27B
学术派量化天花板:每个张量单独分配精度,同体积比Unsloth高10分,论文代码全公开可自己复刻
5天前
Qwen3.6-27B - ≤130B开源最强本地大模型
推荐模型
Qwen3.6-27B - ≤130B开源最强本地大模型
27B稠密多模态,SWE-bench 77.2碾压同级,Apple Silicon最优甜点,Apache 2.0商用免费
2个月前
Tarsier2-Recap-7B - 字节视频描述专精模型,7B超GPT-4o
推荐源码
Tarsier2-Recap-7B - 字节视频描述专精模型,7B超GPT-4o
字节跳动蒸馏版视频理解模型,DREAM-1K描述F1超越GPT-4o,8.3B参数低门槛部署
1个月前
VibeVoice 社区版 - PyTorch/CUDA 多 GPU 推理完整代码
推荐程序员
VibeVoice 社区版 - PyTorch/CUDA 多 GPU 推理完整代码
微软删除官方 TTS 推理代码后,社区 fork 保留的 PyTorch 完整实现。支持单卡/多卡推理、语音克隆、Gradio Demo。
5个月前
LTX-2.3 - 开源最强音视频一体生成模型
推荐模型
LTX-2.3 - 开源最强音视频一体生成模型
Lightricks出品22B DiT模型,单一模型同时生成同步视频+音频,支持图生视频/文生视频,蒸馏版8步出片
3个月前
MiniMax H3 — 开源全模态视频生成模型
推荐模型
MiniMax H3 — 开源全模态视频生成模型
33B参数开源视频生成模型,文生视频/图生视频/首尾帧过渡,原生同步音频,支持2K,ComfyUI Day-0原生支持
1个月前
Qwen3.8-27B - 27B多模态新王,终端编程超Opus 4.6 Max
推荐模型
Qwen3.8-27B - 27B多模态新王,终端编程超Opus 4.6 Max
Qwen3.6-27B正统后继:原生多模态+混合线性注意力架构,262K上下文,终端编程基准超Opus 4.6 Max,Apache 2.0可商用,量化后16GB内存可跑
1个月前
Qwen3.8-27B 去审查版首选:OrcaRouter Uncensored
推荐模型
Qwen3.8-27B 去审查版首选:OrcaRouter Uncensored
十几个去审查版里口碑最干净的一版,MLX 786赞/FP8 715赞双第一,红队探针0拒绝且不变笨;附 JonathanColetti/OBLITERATUS/huihui 等6家横评
1个月前
NVIDIA 上跑本地大模型:一张 3090 Ti 跑 27B 免审模型(附下载地址与实测对照)
推荐模型
NVIDIA 上跑本地大模型:一张 3090 Ti 跑 27B 免审模型(附下载地址与实测对照)
一张 3090 Ti 跑 27B 免审模型:改写/翻译类比原双卡快 2.2 倍,日常对话快 32%。代价是量化从 8 位降到 4 位,且质量尚未验证。
5天前
蚂蚁Ling-2.6-flash正式亮相:104B参数仅激活7.4B,Agent专用MoE模型
推荐模型
蚂蚁Ling-2.6-flash正式亮相:104B参数仅激活7.4B,Agent专用MoE模型
蚂蚁集团AGI团队出品,OpenRouter/Kilo限时免费。速度比Claude Sonnet 4.6快6倍,成本低约50倍,专为Agent场景原生设计。
5个月前
Google Gemma 4 12B - 无编码器多模态大模型
推荐模型
Google Gemma 4 12B - 无编码器多模态大模型
Google DeepMind 开源多模态模型,11.95B参数支持文本+图像+音频,256K上下文,原生函数调用,Apache 2.0免费商用
3个月前
Qwen3-TTS - 阿里开源最强语音合成模型
推荐模型
Qwen3-TTS - 阿里开源最强语音合成模型
10语言全覆盖、97ms流式延迟、3秒声音克隆,中文TTS天花板,Apache 2.0商用免费
3个月前
mlx-video - Mac原生MLX视频生成库(LTX-2.3+Wan2.2)
推荐MacOS
mlx-video - Mac原生MLX视频生成库(LTX-2.3+Wan2.2)
一个库在Apple Silicon上原生跑LTX-2.3和Wan2.2两大视频模型,纯MLX加速,CLI一行出片,比PyTorch MPS快1.7倍
3个月前
Qwen3-ASR - 开源最强中文语音识别+时间戳对齐
推荐软件
Qwen3-ASR - 开源最强中文语音识别+时间戳对齐
阿里Qwen团队出品,中文WER开源最低,配套ForcedAligner毫秒级时间戳,视频配音翻译链路的基础设施
1个月前
MiniMax H3 完整使用教程:部署、长视频、实时直播
推荐软件
MiniMax H3 完整使用教程:部署、长视频、实时直播
33B 开源全模态视频模型,从零部署到 Motion Context 长视频拼接、低显存优化、fal.ai H3 Max 实时直播,一份搞定
28天前
Krea 2 - 专治AI味的开源图像模型:风格参考混搭+8步2秒出图,ComfyUI官方仓935万下载
推荐软件
Krea 2 - 专治AI味的开源图像模型:风格参考混搭+8步2秒出图,ComfyUI官方仓935万下载
Krea.ai从零自研的12.9B图像模型,ComfyUI官方仓935万下载:风格参考混搭+反AI味审美,Turbo版8步2秒出2K图,3090可跑
10天前