站内搜索模型」共 178 条结果
Replicate - 一行代码调用数千AI模型
推荐酷站
Replicate - 一行代码调用数千AI模型
AI模型云平台,聚合Flux/GPT-Image/Seedream/Claude等数千个模型,Python/Node/HTTP一行代码接入,支持微调和自定义部署,按用量付费
2个月前
Sakana Fugu - 多模型编排即服务,一个API调度顶级模型军团
推荐软件
Sakana Fugu - 多模型编排即服务,一个API调度顶级模型军团
Sakana AI 推出的多智能体编排系统,用AI学出来的协作方式协调GPT/Claude/Gemini等顶级模型,一个API搞定复杂编程与推理任务
1个月前
CanIRun.ai - AI 模型运行检测
推荐软件
CanIRun.ai - AI 模型运行检测
检测你的机器能否本地运行各种 AI 大模型
4个月前
Civitai - Stable Diffusion 模型与 AI 艺术社区
推荐酷站
Civitai - Stable Diffusion 模型与 AI 艺术社区
最大的 Stable Diffusion 模型分享平台,涵盖 Checkpoint、LoRA、Flux、SDXL,支持创作者经济与社区互动
3个月前
civitdl - Civitai 模型批量下载 CLI 工具
推荐软件
civitdl - Civitai 模型批量下载 CLI 工具
命令行批量下载 Stable Diffusion 模型、LoRA、元数据与示例图,支持 API Key 和自定义分类规则
3个月前
Supervision - Roboflow 计算机视觉工具库,统一所有 CV 模型输出
推荐源码
Supervision - Roboflow 计算机视觉工具库,统一所有 CV 模型输出
39K Stars,模型无关的检测/分割/分类接口,内置丰富标注器和数据集工具
2个月前
TeaCache - 扩散模型免训练推理加速,视频/图片/音频生成提速神器
推荐源码
TeaCache - 扩散模型免训练推理加速,视频/图片/音频生成提速神器
CVPR 2025 Highlight,通过智能缓存跳过冗余时间步,无需重训模型即可大幅加速扩散模型推理。支持Wan2.1/FLUX/HunyuanVideo等20+主流模型
2个月前
VideoCaptioner - 大模型驱动的视频字幕处理工具
推荐软件
VideoCaptioner - 大模型驱动的视频字幕处理工具
一站式视频字幕处理:语音识别、字幕优化、翻译、配音、烧录,免费功能安装即用
2个月前
Venice.ai - 免审查AI模型API平台,OpenAI兼容
推荐软件
Venice.ai - 免审查AI模型API平台,OpenAI兼容
6个免审查模型,OpenAI兼容API,按量付费,最低$0.16/M tokens
1个月前
本地跑顶级大模型完整攻略(2千到4万美元硬件方案)
推荐教程
本地跑顶级大模型完整攻略(2千到4万美元硬件方案)
想自己组装机器在本地跑顶级AI大模型,不依赖任何API?这份攻略从硬件选型到系统配置到模型推荐全讲清楚了,2千美元起步。
1个月前
52TOYS-汇聚专业玩家、正品模型及衍生品的社交平台
推荐酷站
52TOYS-汇聚专业玩家、正品模型及衍生品的社交平台
52TOYS是一个汇聚动漫周边模型、玩具品牌、达人和玩家的互联网社交平台,以玩具及衍生品文化为核心价值,以培养中国玩具及衍生品市场为目的垂直领域大型社交平台。
10年前
Happy-LLM - 从零开始构建大模型(Datawhale 开源教程)
推荐教程
Happy-LLM - 从零开始构建大模型(Datawhale 开源教程)
Datawhale 开源的系统性 LLM 学习教程,从 NLP 基础到动手搭建 LLaMA2,再到训练实践与 RAG/Agent 应用
3个月前
VoxCPM2 - 开源无分词器 TTS 模型,30 语言语音合成与声音克隆
推荐源码
VoxCPM2 - 开源无分词器 TTS 模型,30 语言语音合成与声音克隆
OpenBMB 开源的 2B 参数文本转语音模型,支持 30 语言、Voice Design 声音设计、可控声音克隆,48kHz 输出,Apache-2.0 可商业使用
3个月前
Whisper — OpenAI 开源语音识别模型
推荐软件
Whisper — OpenAI 开源语音识别模型
68种语言语音转文字,支持多语言识别/翻译/语种检测,命令行即可使用
3个月前
讯飞星辰 MaaS 平台:模型集市
推荐酷站
讯飞星辰 MaaS 平台:模型集市
讯飞开放的大模型一站式服务平台,聚合科大讯飞、阿里、深度追求、智谱、Kimi 等62+模型
2个月前
Lance — 3B 统一多模态模型
推荐源码
Lance — 3B 统一多模态模型
字节跳动开源的 3B 活跃参数原生统一多模态模型,支持图像/视频理解、生成与编辑。
2个月前
MiniCPM-V 4.6 - 口袋级多模态大模型,手机端部署的超高效视觉语言模型
推荐源码
MiniCPM-V 4.6 - 口袋级多模态大模型,手机端部署的超高效视觉语言模型
OpenBMB超轻量多模态模型,SigLIP2+Qwen3.5-0.8B,AI Index 13分,三端手机部署
2个月前
Google Gemma 4 12B - 无编码器多模态大模型
推荐软件
Google Gemma 4 12B - 无编码器多模态大模型
Google DeepMind 开源多模态模型,11.95B参数支持文本+图像+音频,256K上下文,原生函数调用,Apache 2.0免费商用
2个月前
Qwen3-TTS - 阿里开源最强语音合成模型
推荐源码
Qwen3-TTS - 阿里开源最强语音合成模型
10语言全覆盖、97ms流式延迟、3秒声音克隆,中文TTS天花板,Apache 2.0商用免费
1个月前
LTX-2.3 - 开源最强音视频一体生成模型
推荐软件
LTX-2.3 - 开源最强音视频一体生成模型
Lightricks出品22B DiT模型,单一模型同时生成同步视频+音频,支持图生视频/文生视频,蒸馏版8步出片
1个月前