站内搜索「模态」共 44 条结果

推荐模型
MiniCPM-V 4.6 - 口袋级多模态大模型,手机端部署的超高效视觉语言模型OpenBMB超轻量多模态模型,SigLIP2+Qwen3.5-0.8B,AI Index 13分,三端手机部署
3个月前

推荐模型
Google Gemma 4 12B - 无编码器多模态大模型Google DeepMind 开源多模态模型,11.95B参数支持文本+图像+音频,256K上下文,原生函数调用,Apache 2.0免费商用
3个月前

推荐模型
Marqo Ecommerce Embeddings - 电商专用多模态嵌入模型基于SigLIP微调的电商领域专用嵌入模型,vs通用SigLIP提升67%,vs Amazon Titan提升45%,支持文搜图/图搜图/商品去重
3个月前

推荐模型
Qwen3.8-27B - 27B多模态新王,终端编程超Opus 4.6 MaxQwen3.6-27B正统后继:原生多模态+混合线性注意力架构,262K上下文,终端编程基准超Opus 4.6 Max,Apache 2.0可商用,量化后16GB内存可跑
1个月前

推荐模型
WeMM-Embedding:微信开源的多模态向量模型微信视觉团队出品,Apache-2.0 可商用——2B 打赢别家 8B,MMEB-v2 新 SOTA;Matryoshka 可变维度,256 维保住 98.7% 性能,视频号/朋友圈搜索同款技术
1个月前

推荐模型
FLUX 3 - Black Forest Labs 多模态统一模型,图像视频音频一个架构FLUX 1/2 团队新作:图像/视频/音频联合训练的世界模型,视频+原生音频最长 20 秒,Early Access 已开放
1个月前

推荐模型
Qwen3-Omni - 30B原生全模态,能看能听还能说甩一段视频进去,画面内容、背景音乐、音效、对白全给你分析出来——阿里原生全模态模型,30B只激活3B,还能直接用语音回答你,Apache 2.0
26天前

推荐软件
MiniMax H3 完整使用教程:部署、长视频、实时直播33B 开源全模态视频模型,从零部署到 Motion Context 长视频拼接、低显存优化、fal.ai H3 Max 实时直播,一份搞定
28天前

推荐模型
Kimi 开源 K2.6:1万亿参数 MoE,长程编码与 Agent Swarm 能力行业领先Moonshot AI 开源 Kimi K2.6,1万亿参数 MoE(激活32B),原生多模态。在 SWE-Bench Pro、长程编码、Agent Swarm 等关键指标上超越 Claude Opus 4.6 和 GPT-5.4。开源模型做到这个水平,闭源阵营的压力来了。
5个月前

推荐模型
Gemma 4 31B JANG CRACK — MLX 原生去审查模型dealign.ai 出品的 Gemma 4 31B 去审查版,JANG 混合量化 5.1bit,HarmBench 93.7%,支持视觉+思维链
5个月前









