站内搜索「https」共 275 条结果

推荐软件
TurboOCR — GPU 极限速度的文档解析器OCR/版面/表格/公式全流水线跑在显卡上,PDF 进 Markdown 出,单卡 5090 最快 559 图/秒,比传统 OCR 快 15-90 倍
1个月前

推荐软件
OJO - 全球首个设计Agent团队工作台:从想法到可交互原型不是单个AI画页面,而是自己组建Agent设计团队:需求分析/线框/UI审查/视觉基因分工协作,调研驱动,一张画布走到代码交付
1个月前

推荐软件
ChatCut - 打字就能剪片的AI剪辑师:对话式视频编辑像跟剪辑师说话一样下指令:文字稿删字即剪片、去口水词、MG动画配乐一体,还能挂进ChatGPT/Codex当插件,剪辑技能可复用
1个月前

推荐模型
FLUX 3 - Black Forest Labs 多模态统一模型,图像视频音频一个架构FLUX 1/2 团队新作:图像/视频/音频联合训练的世界模型,视频+原生音频最长 20 秒,Early Access 已开放
1个月前

推荐硬件
M5 Max 实测 Qwen3.8-27B MLX 4bit 并发扩展性:1→32 并行全数据64GB 统一内存本地跑 27B,252 次请求零报错。低并发看响应,高并发看总量,甜蜜区在 N≤4
29天前

推荐Skills
video-talkcraft - 口播稿+配音一键成片的 agent skill,78张动效配方卡字级配音同步、七层反PPT镜头系统、三重验收自动返工,把Claude Code/Codex变成口播视频动效工作室
28天前

推荐源码
Open-LLM-VTuber - 开源语音交互 AI 虚拟伴侣,Live2D 形象+完全离线开源语音交互 AI 虚拟伴侣,13.5K Stars。支持实时语音对话、视觉感知、Live2D 形象,桌面宠物模式可完全离线运行
27天前

推荐源码
LiveTalking - 实时流式数字人引擎,文本/语音驱动虚拟形象对话实时交互流式数字人引擎,9.3K Stars。支持 Wav2Lip/MuseTalk/Ernerf 多模型,WebRTC/RTMP/虚拟摄像头输出,已广泛商用
27天前

推荐源码
Duix Avatar - 开源 AI 数字人工具包,离线视频生成+声音克隆真正开源的 AI 数字人克隆工具,15K Stars。支持外观+声音克隆、文本/语音驱动生成视频,完全离线运行,Docker 一键部署
27天前

推荐软件
Awesome-LLMs-for-Video-Understanding:视频理解大模型全家桶清单(3.3k★)IEEE TCSVT 收录的 Vid-LLM 综述配套清单:论文+代码+数据集+基准全整理,选型与研究必备
26天前









