站内搜索「微调」共 31 条结果
Google Gemma 4 12B - 无编码器多模态大模型
推荐模型
Google Gemma 4 12B - 无编码器多模态大模型
Google DeepMind 开源多模态模型,11.95B参数支持文本+图像+音频,256K上下文,原生函数调用,Apache 2.0免费商用
3个月前
FLUX.2-klein-9B - 文生图+图生图+图像编辑三合一
推荐模型
FLUX.2-klein-9B - 文生图+图生图+图像编辑三合一
Black Forest Labs新作,一个9B模型统一生成与编辑,支持多图参考编辑,Qwen3编码器中文强,最快不到1秒
3个月前
LTX-2.5 - Lightricks 开源视频生成模型,22B 参数音视频同步
推荐模型
LTX-2.5 - Lightricks 开源视频生成模型,22B 参数音视频同步
83 万下载的开源视频模型天花板——文生视频/图生视频/音视频同步/4K 20 秒,8GB 显存量化可跑
1个月前
Qwen开源模型全家桶选购指南(3.5/3.6/3.8全系列)
推荐模型
Qwen开源模型全家桶选购指南(3.5/3.6/3.8全系列)
从0.8B到397B全覆盖,编程/视觉/推理/端侧一张表选对模型
1个月前
东南亚口播配音选型:越南语/马来语/泰语 TTS 模型横评
推荐教程
东南亚口播配音选型:越南语/马来语/泰语 TTS 模型横评
中文口播稿出海东南亚怎么配音?覆盖云端统一方案(Qwen-Audio-3.0-TTS/ElevenLabs/MiniMax/豆包)、开源单模型(Scicom/Confucius4)和各语种专用模型(JaiTTS/VieNeu-TTS/Malaysian-TTS),含选型矩阵
1个月前
Awesome-LLMs-for-Video-Understanding:视频理解大模型全家桶清单(3.3k★)
推荐软件
Awesome-LLMs-for-Video-Understanding:视频理解大模型全家桶清单(3.3k★)
IEEE TCSVT 收录的 Vid-LLM 综述配套清单:论文+代码+数据集+基准全整理,选型与研究必备
26天前
Qwen3-Omni - 30B原生全模态,能看能听还能说
推荐模型
Qwen3-Omni - 30B原生全模态,能看能听还能说
甩一段视频进去,画面内容、背景音乐、音效、对白全给你分析出来——阿里原生全模态模型,30B只激活3B,还能直接用语音回答你,Apache 2.0
26天前
MOSS-VL:边看边答的开源实时视频理解模型
推荐软件
MOSS-VL:边看边答的开源实时视频理解模型
复旦OpenMOSS开源11B实时视频理解模型:边看边答、主动沉默、动态纠错,NF4版单卡24G可跑
26天前
Krea 2 - 专治AI味的开源图像模型:风格参考混搭+8步2秒出图,ComfyUI官方仓935万下载
推荐软件
Krea 2 - 专治AI味的开源图像模型:风格参考混搭+8步2秒出图,ComfyUI官方仓935万下载
Krea.ai从零自研的12.9B图像模型,ComfyUI官方仓935万下载:风格参考混搭+反AI味审美,Turbo版8步2秒出2K图,3090可跑
10天前
Unsloth Dynamic GGUF:新模型发布当天就能跑,510万人下载的量化生态闭环
推荐软件
Unsloth Dynamic GGUF:新模型发布当天就能跑,510万人下载的量化生态闭环
不只量化更是全链路:Dynamic v3.0动态精度+MTP投机解码+Flash Attention加速,llama.cpp/Ollama一键起
5天前
文档智能体入门教程
如何拥有一个自己的智能体
如何拥有一个自己的智能体 本文只讨论能调用工具、自主执行的智能体(Agent),不讨论纯对话机器人。 按照难度从低到高分为三层。 --- 第一层:大厂云端智能体(开箱即用,零安装) 这一层是各大厂已经搭建好、部署在云端的智能体产品。你不需要安装任何软件,注册账号就能用。 基于 OpenClaw 的云端产品 OpenClaw(龙虾)是一个开源的自主 AI 助手框架,GitHub 地址 。国内外大厂基
5个月前