Qwen3-TTS - 阿里开源最强语音合成模型模型

10语言全覆盖、97ms流式延迟、3秒声音克隆,中文TTS天花板,Apache 2.0商用免费

58000Xiao.XiXiao.Xi1个月前
FLUX.1-schnell - 免费商用的最强开源文生图模型模型

Black Forest Labs出品,4步出图,质量接近Midjourney,Apache 2.0开源可商用

115000Xiao.XiXiao.Xi1个月前
Luma AI - 手机拍一圈房子院子秒变3D模型

用手机拍视频走一圈,AI自动生成照片级真实3D场景,室内外通吃,免费Gaussian Splatting

45000Xiao.XiXiao.Xi1个月前
Google Gemma 4 12B - 无编码器多模态大模型模型

Google DeepMind 开源多模态模型,11.95B参数支持文本+图像+音频,256K上下文,原生函数调用,Apache 2.0免费商用

100000Xiao.XiXiao.Xi2个月前
Headroom - AI Agent 上下文压缩层,减少60-95%Token模型

本地运行的AI上下文压缩工具,支持6种算法、可逆压缩、跨Agent共享记忆,零代码接入

72000Xiao.XiXiao.Xi2个月前
ECC - AI Agent智能体操作系统模型

64个Agent+261个Skill+安全扫描+持续学习,跨Claude Code/Cursor/Codex/Gemini/Copilot等7大平台,182K Star

74000Xiao.XiXiao.Xi2个月前
Agent Reach - 一句话给AI Agent装上互联网能力模型

一条命令装完,Agent就能读推特、搜Reddit、看YouTube、刷小红书、抓B站字幕、读微信公众号,15+平台全覆盖

102000Xiao.XiXiao.Xi2个月前
WorldMonitor - 全球实时态势感知AI仪表盘模型

500+新闻源AI摘要、3D地球+56种图层、92个交易所金融雷达、12维国家风险评分,一个界面掌控全球

106000Xiao.XiXiao.Xi2个月前
Honcho - AI Agent 推理优先的记忆基础设施模型

Agent记忆不是存文本块做匹配,而是从对话中提取结论,持续理解用户和Agent。支持MCP集成Claude Code/OpenCode/Hermes等,托管或自托管。

85000Xiao.XiXiao.Xi2个月前
MiniCPM-V 4.6 - 口袋级多模态大模型,手机端部署的超高效视觉语言模型模型

OpenBMB超轻量多模态模型,SigLIP2+Qwen3.5-0.8B,AI Index 13分,三端手机部署

76000Xiao.XiXiao.Xi2个月前
DINOv2 - Meta最强纯视觉自监督特征提取模型模型

Meta出品纯视觉自监督ViT,无需标注数据开箱即用,300M参数86.3% ImageNet线性分类,月下载290万+

80000Xiao.XiXiao.Xi2个月前
Marqo Ecommerce Embeddings - 电商专用多模态嵌入模型模型

基于SigLIP微调的电商领域专用嵌入模型,vs通用SigLIP提升67%,vs Amazon Titan提升45%,支持文搜图/图搜图/商品去重

86000Xiao.XiXiao.Xi2个月前

Google 官方出品的 Gemma 模型技能库,让 AI 编码助手自动掌握 Gemma 选型、部署、MTP 加速推理,支持 Vercel/Context7 CLI 一键安装

69000Xiao.XiXiao.Xi2个月前
fal.ai - 开发者首选的生成式AI媒体平台模型

1000+图像视频音频3D模型一行API调用,自研推理引擎比竞品快10倍,H100低至$1.2/小时,SOC2企业合规

68000Xiao.XiXiao.Xi2个月前
Replicate - 一行代码调用数千AI模型模型

AI模型云平台,聚合Flux/GPT-Image/Seedream/Claude等数千个模型,Python/Node/HTTP一行代码接入,支持微调和自定义部署,按用量付费

83000Xiao.XiXiao.Xi2个月前
Lance — 3B 统一多模态模型模型

字节跳动开源的 3B 活跃参数原生统一多模态模型,支持图像/视频理解、生成与编辑。

68000Xiao.XiXiao.Xi2个月前
GPT-SoVITS - 1分钟数据训练高质量TTS模型模型

5秒样本零样本TTS,1分钟数据微调即可克隆声音。支持中英日韩粤跨语言推理,集成WebUI工具链,58k Stars

69000Xiao.XiXiao.Xi2个月前
SadTalker - 单图+音频生成说话人脸动画模型

CVPR 2023 论文项目,一张照片+一段音频即可生成逼真的数字人/虚拟主播视频,支持口型同步和表情控制

60000Xiao.XiXiao.Xi2个月前
Omniparse — 将任意文档/图片/音视频解析为LLM友好格式模型

Ingest, parse, and optimize any data format:PDF/Word/PPT/Excel、图片、音频、视频一键转结构化Markdown,专为GenAI框架优化

61000Xiao.XiXiao.Xi2个月前
Dexter - AI Agent 金融分析框架模型

基于 LLM 的自动化金融研究 Agent,支持多源数据聚合、深度推理与投资决策

92000Xiao.XiXiao.Xi2个月前