站内搜索「OCR」共 15 条结果

推荐源码
Unlimited-OCR - 百度开源一次性长文档OCR解析模型百度出品,基于DeepSeek-OCR改进,支持一次性解析超长文档、多页PDF,单图640切片+多页1024两种模式,SGLang部署兼容OpenAI API
1个月前

推荐源码
MarkItDown - 微软开源文档转 Markdown 工具微软开源的 Python 工具,一键将 PDF/Word/Excel/PPT 等文件转换为 Markdown,支持 OCR 和 MCP
4个月前

推荐软件
PixPin - 强大且免费的截图贴图工具PixPin是一款功能强大的免费截图工具,支持截图、录屏、长截图、OCR文字识别、屏幕贴图等功能。为设计师、开发者、办公人员提供高效的屏幕操作体验。
1年前

推荐Skills
Anything → NotebookLM - Claude Code Skill 多源内容智能处理器支持微信公众号、YouTube、播客、PDF、300+付费墙绕过等15+种内容源,一键生成播客/PPT/思维导图/Quiz
3个月前

推荐源码
Omniparse — 将任意文档/图片/音视频解析为LLM友好格式Ingest, parse, and optimize any data format:PDF/Word/PPT/Excel、图片、音频、视频一键转结构化Markdown,专为GenAI框架优化
2个月前

推荐源码
Video Copy Analyzer - AI视频文案拆解分析AI驱动的视频字幕提取+文案三维度分析,支持B站/YouTube/抖音,FunASR中文语音转录+RapidOCR烧录字幕识别
2个月前

推荐源码
MiniCPM-V 4.6 - 口袋级多模态大模型,手机端部署的超高效视觉语言模型OpenBMB超轻量多模态模型,SigLIP2+Qwen3.5-0.8B,AI Index 13分,三端手机部署
2个月前

推荐软件
Google Gemma 4 12B - 无编码器多模态大模型Google DeepMind 开源多模态模型,11.95B参数支持文本+图像+音频,256K上下文,原生函数调用,Apache 2.0免费商用
2个月前






