站内搜索「输出」共 128 条结果

推荐模型
Omniparse — 将任意文档/图片/音视频解析为LLM友好格式Ingest, parse, and optimize any data format:PDF/Word/PPT/Excel、图片、音频、视频一键转结构化Markdown,专为GenAI框架优化
4个月前

推荐模型
TeaCache - 扩散模型免训练推理加速,视频/图片/音频生成提速神器CVPR 2025 Highlight,通过智能缓存跳过冗余时间步,无需重训模型即可大幅加速扩散模型推理。支持Wan2.1/FLUX/HunyuanVideo等20+主流模型
3个月前

推荐软件
Video-Subtitle-Remover:AI 本地去字幕/去水印工具 (12.6k Star)基于 STTN/LaMA/ProPainter 等多算法的视频硬字幕和文本水印去除工具,完全本地运行,支持 Windows/Mac/Linux/Docker
1个月前

推荐模型
Qwen3-Omni - 30B原生全模态,能看能听还能说甩一段视频进去,画面内容、背景音乐、音效、对白全给你分析出来——阿里原生全模态模型,30B只激活3B,还能直接用语音回答你,Apache 2.0
26天前

推荐程序员
HyperFrames - 用 HTML 写视频、AI Agent 友好的开源渲染框架HeyGen 推出的开源视频渲染框架,通过 HTML + data attributes 定义视频时间轴,支持 GSAP/Lottie/CSS 动画,一键渲染为确定性 MP4,适合开发者与 AI Agent 自动化生成视频
5个月前

推荐程序员
agentic-video-editor - 多 Agent 协作的 AI 视频自动剪辑工具基于 Google Gemini + FFmpeg,通过 Director/Editor/Reviewer 多 Agent 流水线,将原始素材和创意简报自动剪辑成精品广告,支持 YAML 管道配置与风格模板
5个月前

推荐模型
蚂蚁Ling-2.6-flash正式亮相:104B参数仅激活7.4B,Agent专用MoE模型蚂蚁集团AGI团队出品,OpenRouter/Kilo限时免费。速度比Claude Sonnet 4.6快6倍,成本低约50倍,专为Agent场景原生设计。
5个月前












