NVIDIA 上跑本地大模型:一张 3090 Ti 跑 27B 免审模型(附下载地址与实测对照)模型

一张 3090 Ti 跑 27B 免审模型:改写/翻译类比原双卡快 2.2 倍,日常对话快 32%。代价是量化从 8 位降到 4 位,且质量尚未验证。

102000子龙子龙•5天前
Mac 上跑本地大模型:该选哪个版本、免审模型用哪个(附下载地址与实测速度)模型

同一个模型有 4bit/8bit/免审版,怎么选?一句话:稠密选小、MoE 选大。附下载地址与实测速度;2026-09 补测 oMLX 引擎,修正「换引擎不会变快」的旧结论。

155000子龙子龙•7天前
Bonsai 2 27B - 54GB压到5.9GB还留98%智力的三值模型(Qwen3.8-27B官方压缩,笔记本能跑满血27B推理)模型

发布3天下载破150万!54GB的Qwen3.8-27B压到5.9GB还留98.2%智力,传统2bit崩掉的数学题它守住95分,低比特本地部署天花板。

37000子龙子龙•8天前
Hyper3D Rodin - 一张图生成生产级 3D 模型(千万面级 3D 大模型)模型

国产 3D 大模型的天花板:一张图几十秒出生产级 3D 模型,SIGGRAPH 最佳论文团队出品,先试再说

90000子龙子龙•13天前
Google TimesFM 3.0 - 零样本时间序列预测基础模型模型

Google Research 时序预测模型:丢历史曲线直接出未来预测+置信区间,1.3GB 零样本免训练,注意非商用许可

108000子龙子龙•23天前
Phantom - 字节开源主体一致性视频生成模型(产品图进,同款商品视频出)模型

字节ICCV 2025开源模型:喂几张产品图,生成视频里你的商品全程不跑偏,电商带货视频复刻的换主体神器,权重直接部署

50000子龙子龙•26天前
短视频音视频联合分析:Qwen3.5-Omni 五条链路实测与选型模型

要同时读画面+声音分析快手/抖音短视频,实测硅基流动 Qwen3-Omni、DashScope Qwen3.5-Omni flash/plus、本地抽帧+ASR 五条链路,给出选型建议和避坑点。

42000子龙子龙•26天前
Qwen3-Omni - 30B原生全模态,能看能听还能说模型

甩一段视频进去,画面内容、背景音乐、音效、对白全给你分析出来——阿里原生全模态模型,30B只激活3B,还能直接用语音回答你,Apache 2.0

153000子龙子龙•26天前
GPT-SoVITS - 1分钟数据训练高质量TTS模型模型

5秒样本零样本TTS,1分钟数据微调即可克隆声音。支持中英日韩粤跨语言推理,集成WebUI工具链,58k Stars

170001子龙子龙•4个月前
LTX-2.5 - Lightricks 开源视频生成模型,22B 参数音视频同步模型

83 万下载的开源视频模型天花板——文生视频/图生视频/音视频同步/4K 20 秒,8GB 显存量化可跑

134101子龙子龙•1个月前
FLUX 3 - Black Forest Labs 多模态统一模型,图像视频音频一个架构模型

FLUX 1/2 团队新作:图像/视频/音频联合训练的世界模型,视频+原生音频最长 20 秒,Early Access 已开放

66000子龙子龙•1个月前
三大开源 ASR 横评 - VibeVoice-ASR 7B vs Qwen3-ASR vs Whisper模型

Qwen3-ASR 效率碾压、VibeVoice 长音频分人无敌、Whisper 生态覆盖最广——三大 ASR 各守一象限,谁该装谁

137000子龙子龙•1个月前
Qwen开源模型全家桶选购指南(3.5/3.6/3.8全系列)模型

从0.8B到397B全覆盖,编程/视觉/推理/端侧一张表选对模型

266000子龙子龙•1个月前
最新开源视觉大模型横评:Qwen3.6 vs Keye-VL-2.0 vs Tarsier2-Recap模型

三家最新开源MoE视觉大模型,全部30B级只激活3B,定位完全不同

87000子龙子龙•1个月前
Keye-VL — 8B 短视频理解大模型模型

快手开源 8B 多模态模型,专为短视频理解优化,Video-MME 73% 同级最强。

122001子龙子龙•3个月前
WeMM-Embedding:微信开源的多模态向量模型模型

微信视觉团队出品,Apache-2.0 可商用——2B 打赢别家 8B,MMEB-v2 新 SOTA;Matryoshka 可变维度,256 维保住 98.7% 性能,视频号/朋友圈搜索同款技术

47000子龙子龙•1个月前
Qwen3.8-27B 去审查版首选:OrcaRouter Uncensored模型

十几个去审查版里口碑最干净的一版,MLX 786赞/FP8 715赞双第一,红队探针0拒绝且不变笨;附 JonathanColetti/OBLITERATUS/huihui 等6家横评

165000子龙子龙•1个月前
Qwen3.8-27B - 27B多模态新王,终端编程超Opus 4.6 Max模型

Qwen3.6-27B正统后继:原生多模态+混合线性注意力架构,262K上下文,终端编程基准超Opus 4.6 Max,Apache 2.0可商用,量化后16GB内存可跑

102000子龙子龙•1个月前
TRELLIS.2:微软开源图生 3D 大模型,3 秒出带 PBR 材质的 3D 资产模型

微软研究院 4B 参数 image-to-3D 模型:O-Voxel 表示搞定任意拓扑+完整 PBR 材质,512³ 仅 3 秒,24GB 显存可本地跑,MIT 协议全开源

93000子龙子龙•1个月前
Seedance 2.5 登陆 Higgsfield,百万美元 AI 电影大赛开赛模型

字节 Seedance 2.5 正式上线,Higgsfield 同步启动 100万美元 AI 电影竞赛,比赛期间不限量免费用

211000子龙子龙•1个月前