ORC
1. PaddleOC
识别率接近100%,支持图片,PDF,但是默认不提供API,只能 python 调用,Api需要自己集成
2. MinerU
支持Api,暂未试用
网页自动化工具
1. Drissionpage
强大的浏览器自动化工具,用于爬虫很厉害,常规 Selenium 无法爬取的网站都能爬取
2. Browser Use
AI帮你操控浏览器,但是特别消耗Token,并且功能是否强大,取决于看模型能力和你的提示词写的好不好,还提供了一个 UI界面 的项目
AI
1. Open Router
AI时代大善人,里面提供了大量的免费模型供你调用
2. n8n
github star 80k+不是开玩笑的,开源的流程自动化工具,25年4月支持了 MCP,里面的工具非常多
3. comfyui
画图佬必备的 一个开源的AI绘图,视频工具,但是要用好,有比较高的学习门槛
4.VLLM
企业级本地部署大模型的优选方案,高并发,可集群,但是对显卡有比较高的要求,如果你算力低于7.5tops,还是别用了,启动不了的
5.SgLang
企业级本地部署大模型的优选方案,高并发,可集群,VLLM的竞争者,如果VLLM不能部署,可以尝试用这个
6.ollama
个人大模型本地部署方案,比较简单,但是个人如果显卡2张以上,还是建议优先试用 VLLM和SgLang
7.xinference
企业级大模型部署整合方案,支持 VLLM和SgLang,新手友好,有UI界面,实际用下来,它自带的可选模型部署没问题,自己下载的模型部署很容易出错
8.cursor
前端AI编码 IDE,要收费,20刀一个月,当然,有方法无限白嫖,强无敌,要是能支持后端就好了