SadTalker - 单图+音频生成说话人脸动画模型

CVPR 2023 论文项目,一张照片+一段音频即可生成逼真的数字人/虚拟主播视频,支持口型同步和表情控制

93000子龙子龙•4个月前
Omniparse — 将任意文档/图片/音视频解析为LLM友好格式模型

Ingest, parse, and optimize any data format:PDF/Word/PPT/Excel、图片、音频、视频一键转结构化Markdown,专为GenAI框架优化

94000子龙子龙•4个月前
Dexter - AI Agent 金融分析框架模型

基于 LLM 的自动化金融研究 Agent,支持多源数据聚合、深度推理与投资决策

140000子龙子龙•4个月前
OpenHuman - 开源个人 AI 超级智能,本地记忆 + 118+ 集成模型

25K Stars,Rust 构建,本地 Obsidian 知识库,20 分钟自动同步,TokenJuice 压缩降本 80%

90000子龙子龙•4个月前
Supervision - Roboflow 计算机视觉工具库,统一所有 CV 模型输出模型

39K Stars,模型无关的检测/分割/分类接口,内置丰富标注器和数据集工具

106000子龙子龙•4个月前
Voicebox - 开源 AI 语音工作室,本地替代 ElevenLabs模型

7 引擎 TTS + 语音克隆 + 全局语音输入,本地运行零隐私泄露

104000子龙子龙•4个月前
GenCAD:图片驱动的 CAD 生成框架模型

基于 Transformer 对比表示与扩散先验,输入草图或图片即可生成 3D CAD 模型,TMCE 2025 论文

192000子龙子龙•4个月前
讯飞星辰 MaaS 平台:模型集市模型

讯飞开放的大模型一站式服务平台,聚合科大讯飞、阿里、深度追求、智谱、Kimi 等62+模型

109000子龙子龙•4个月前
ViMax:多智能体全流程视频生成框架模型

HKUDS 开源,导演+编剧+制片人+视频生成器一体化,支持创意/小说/剧本一键成片

93000子龙子龙•4个月前
Fara-7B - 微软开源 7B 电脑自动化代理模型模型

微软首个 Agentic SLM,7B 参数本地跑,看屏幕操作鼠标键盘自动执行任务

131000子龙子龙•4个月前
civitdl - Civitai 模型批量下载 CLI 工具模型

命令行批量下载 Stable Diffusion 模型、LoRA、元数据与示例图,支持 API Key 和自定义分类规则

171000子龙子龙•4个月前
Civitai - Stable Diffusion 模型与 AI 艺术社区模型

最大的 Stable Diffusion 模型分享平台,涵盖 Checkpoint、LoRA、Flux、SDXL,支持创作者经济与社区互动

212000子龙子龙•4个月前
SD.Next - 接替 A1111 的全能 AI 生成 WebUI模型

支持 Stable Diffusion、SDXL、SD3、FLUX 及视频生成,内置量化引擎与自动调优,跨平台开箱即用

193000子龙子龙•4个月前
DFlash - 块扩散加速LLM推理的推测解码方案模型

轻量级块扩散模型,专为 LLM Speculative Decoding 设计,支持 vLLM/SGLang/MLX,已适配 20+ 主流大模型

155000子龙子龙•4个月前
Open Generative AI — 无审查的开源AI图像/视频生成平台模型

200+ SOTA模型,无content filters,可自托管。替代Higgsfield/Freepik/Krea/Openart的开源方案

168000子龙子龙•4个月前
B.AI — AI Agent 金融基础设施模型

匿名访问全球顶级 AI 模型,赋予 Agent 独立经济身份

98000子龙子龙•4个月前
AudioNotes - 音视频转结构化笔记系统模型

上传音视频,AI 自动整理成结构化 Markdown 笔记

95000子龙子龙•4个月前
Toonflow - AI短剧工厂 小说秒变剧集模型

开源AI短剧创作工具,小说/剧本一键转动画短剧,AI编剧+智能分镜+角色与视频生成

143000子龙子龙•4个月前
火宝短剧 - AI一站式短剧生成平台模型

一句话生成完整短剧,从剧本到成片全流程AI自动化,支持小说/剧本转视频

140000子龙子龙•4个月前
VideoLingo - Netflix级AI视频字幕翻译配音模型

一键全自动视频翻译,字幕切割+AI翻译+配音,Netflix品质,支持YouTube视频下载

106000子龙子龙•4个月前