站内搜索「量化」共 41 条结果
MiniCPM-V 4.6 - 口袋级多模态大模型,手机端部署的超高效视觉语言模型
推荐模型
MiniCPM-V 4.6 - 口袋级多模态大模型,手机端部署的超高效视觉语言模型
OpenBMB超轻量多模态模型,SigLIP2+Qwen3.5-0.8B,AI Index 13分,三端手机部署
3个月前
Qwen3.6-27B - ≤130B开源最强本地大模型
推荐模型
Qwen3.6-27B - ≤130B开源最强本地大模型
27B稠密多模态,SWE-bench 77.2碾压同级,Apple Silicon最优甜点,Apache 2.0商用免费
2个月前
鲲鹏无限 C2000 Max 5G CPE(海思巴龙 MT5700 / WiFi7 / N79)
推荐硬件
鲲鹏无限 C2000 Max 5G CPE(海思巴龙 MT5700 / WiFi7 / N79)
国产 5G-A CPE,巴龙模组信号实测第一梯队,支持 N79,WiFi7+2.5G 口,可刷 OpenWrt,约¥1299
1个月前
MiniMax H3 — 开源全模态视频生成模型
推荐模型
MiniMax H3 — 开源全模态视频生成模型
33B参数开源视频生成模型,文生视频/图生视频/首尾帧过渡,原生同步音频,支持2K,ComfyUI Day-0原生支持
1个月前
MiniMax H3 本地部署完整指南:从装机到出片
推荐Linux
MiniMax H3 本地部署完整指南:从装机到出片
33B开源全模态视频模型,原生立体声,从3060到5090全覆盖的保姆级部署+提示词+加速教程
1个月前
蚂蚁Ling-2.6-flash正式亮相:104B参数仅激活7.4B,Agent专用MoE模型
推荐模型
蚂蚁Ling-2.6-flash正式亮相:104B参数仅激活7.4B,Agent专用MoE模型
蚂蚁集团AGI团队出品,OpenRouter/Kilo限时免费。速度比Claude Sonnet 4.6快6倍,成本低约50倍,专为Agent场景原生设计。
5个月前
Google Gemma 4 12B - 无编码器多模态大模型
推荐模型
Google Gemma 4 12B - 无编码器多模态大模型
Google DeepMind 开源多模态模型,11.95B参数支持文本+图像+音频,256K上下文,原生函数调用,Apache 2.0免费商用
3个月前
FLUX.1-schnell - 免费商用的最强开源文生图模型
推荐模型
FLUX.1-schnell - 免费商用的最强开源文生图模型
Black Forest Labs出品,4步出图,质量接近Midjourney,Apache 2.0开源可商用
3个月前
本地跑顶级大模型完整攻略(2千到4万美元硬件方案)
推荐硬件
本地跑顶级大模型完整攻略(2千到4万美元硬件方案)
想自己组装机器在本地跑顶级AI大模型,不依赖任何API?这份攻略从硬件选型到系统配置到模型推荐全讲清楚了,2千美元起步。
2个月前
LongCat-Video-Avatar 1.5 — 美团开源数字人
推荐模型
LongCat-Video-Avatar 1.5 — 美团开源数字人
音频驱动数字人视频生成,照片+语音生成对口型视频,支持唱歌/双人对话/动漫动物,8步推理,MIT协议可商用
2个月前
Qwen开源模型全家桶选购指南(3.5/3.6/3.8全系列)
推荐模型
Qwen开源模型全家桶选购指南(3.5/3.6/3.8全系列)
从0.8B到397B全覆盖,编程/视觉/推理/端侧一张表选对模型
1个月前
三大开源 ASR 横评 - VibeVoice-ASR 7B vs Qwen3-ASR vs Whisper
推荐模型
三大开源 ASR 横评 - VibeVoice-ASR 7B vs Qwen3-ASR vs Whisper
Qwen3-ASR 效率碾压、VibeVoice 长音频分人无敌、Whisper 生态覆盖最广——三大 ASR 各守一象限,谁该装谁
1个月前
M5 Max 实测 Qwen3.8-27B MLX 4bit 并发扩展性:1→32 并行全数据
推荐硬件
M5 Max 实测 Qwen3.8-27B MLX 4bit 并发扩展性:1→32 并行全数据
64GB 统一内存本地跑 27B,252 次请求零报错。低并发看响应,高并发看总量,甜蜜区在 N≤4
28天前
MiniMax H3 完整使用教程:部署、长视频、实时直播
推荐软件
MiniMax H3 完整使用教程:部署、长视频、实时直播
33B 开源全模态视频模型,从零部署到 Motion Context 长视频拼接、低显存优化、fal.ai H3 Max 实时直播,一份搞定
28天前
LTX-2.5 完整指南:22B 开源视频模型,速度优先
推荐软件
LTX-2.5 完整指南:22B 开源视频模型,速度优先
2K/5秒视频47秒生成,RTX3060可跑,Mac MLX原生支持,多镜头+立体声,免费商用(年入<0M)
28天前
MOSS-VL:边看边答的开源实时视频理解模型
推荐软件
MOSS-VL:边看边答的开源实时视频理解模型
复旦OpenMOSS开源11B实时视频理解模型:边看边答、主动沉默、动态纠错,NF4版单卡24G可跑
26天前
Krea 2 - 专治AI味的开源图像模型:风格参考混搭+8步2秒出图,ComfyUI官方仓935万下载
推荐软件
Krea 2 - 专治AI味的开源图像模型:风格参考混搭+8步2秒出图,ComfyUI官方仓935万下载
Krea.ai从零自研的12.9B图像模型,ComfyUI官方仓935万下载:风格参考混搭+反AI味审美,Turbo版8步2秒出2K图,3090可跑
10天前
NInfer - 只认RTX 5090的Qwen3.8-27B极限推理引擎(从零手搓CUDA,单卡并发破千tok/s)
推荐程序员
NInfer - 只认RTX 5090的Qwen3.8-27B极限推理引擎(从零手搓CUDA,单卡并发破千tok/s)
从零手搓的C++/CUDA推理引擎,只认RTX 5090一张卡:Qwen3.8-27B八路并发767 tok/s、AIME双96.7%不掉点,240K上下文还能看图看视频,5090党的天花板玩法。
8天前
mlx-engine - LM Studio官方MLX推理引擎(多轮缓存+批量读图)
推荐MacOS
mlx-engine - LM Studio官方MLX推理引擎(多轮缓存+批量读图)
LM Studio跑MLX模型的官方引擎:多轮对话缓存命中秒回、同图追问只算一次视觉编码。99%的人不用装(LM Studio自带),自建MLX服务的值得抄它的缓存设计。
7天前
Google ADK - 官方 AI Agent 开发框架(多Agent编排/一键部署GCP)
推荐软件
Google ADK - 官方 AI Agent 开发框架(多Agent编排/一键部署GCP)
Google 官方出品的开源 Agent 框架,内部同款,22k stars,写 Agent 不用再造轮子!
5天前