站内搜索「Fast」共 35 条结果

推荐Skills
video-talkcraft - 口播稿+配音一键成片的 agent skill,78张动效配方卡字级配音同步、七层反PPT镜头系统、三重验收自动返工,把Claude Code/Codex变成口播视频动效工作室
28天前

推荐源码
Open-LLM-VTuber - 开源语音交互 AI 虚拟伴侣,Live2D 形象+完全离线开源语音交互 AI 虚拟伴侣,13.5K Stars。支持实时语音对话、视觉感知、Live2D 形象,桌面宠物模式可完全离线运行
27天前

推荐模型
LTX-2.5 - Lightricks 开源视频生成模型,22B 参数音视频同步83 万下载的开源视频模型天花板——文生视频/图生视频/音视频同步/4K 20 秒,8GB 显存量化可跑
1个月前

推荐软件
GPT-6 Astra 做 3D 空间的四条路线:哪条最省 token,哪条效果最好9张照片拼出可交互3D工作室刷屏背后:四条路线token成本差10倍,选错又贵又绕,附实测数据和场外更优解
13天前

推荐软件
LibTV - LiblibAI旗下AI视频创作平台(无限画布+Agent双入口,Seedance 2.5/H3随便切)国内首个同时给人和AI Agent用的视频创作平台:一张无限画布从剧本拉到成片,短剧公司批量在用的生产力工具。
10天前

推荐程序员
MinerU - 文档解析引擎开源文档解析引擎,OpenDataLab 出品 78k Star。PDF/Word/PPT/Excel/图片一键转 LLM 友好的 Markdown/JSON,公式转 LaTeX、表格转 HTML、跨页表格合并、109 语言 OCR;Pipeline 后端纯 CPU 可跑,VLM 后端精度 95+,另有 mineru.net 在线服务免部署
5个月前

推荐程序员
StemDeck - 本地 AI 音轨分离工具将音频分离成人声、鼓、贝斯、吉他、钢琴、其他 6 轨,支持 MP3/WAV 导入和 YouTube URL 粘贴,完全本地运行,无需账号/上传/订阅
3个月前

推荐模型
TeaCache - 扩散模型免训练推理加速,视频/图片/音频生成提速神器CVPR 2025 Highlight,通过智能缓存跳过冗余时间步,无需重训模型即可大幅加速扩散模型推理。支持Wan2.1/FLUX/HunyuanVideo等20+主流模型
3个月前

推荐模型
Honcho - AI Agent 推理优先的记忆基础设施Agent记忆不是存文本块做匹配,而是从对话中提取结论,持续理解用户和Agent。支持MCP集成Claude Code/OpenCode/Hermes等,托管或自托管。
3个月前

推荐模型
三大开源 ASR 横评 - VibeVoice-ASR 7B vs Qwen3-ASR vs WhisperQwen3-ASR 效率碾压、VibeVoice 长音频分人无敌、Whisper 生态覆盖最广——三大 ASR 各守一象限,谁该装谁
1个月前

推荐软件
Tel-Agent:开源自托管的 AI 电话助手,把电话线接到任意大模型SIP 电话线接任意 AI 模型,实时接听可调用工具,录音转写全归自己。pre-alpha 阶段,值得提前关注。
22天前



