
APIs & datasets for the platforms that matter | Happy Endpoint
Happy Endpoint提供房地产、旅游、零售等行业的网页爬虫API和批量数据集,附带免费样本。
@happyendpointhq · X
完整作品展
技术栈
60 projects

Happy Endpoint提供房地产、旅游、零售等行业的网页爬虫API和批量数据集,附带免费样本。
@happyendpointhq · X

从任何网页中提取图片、图标、视频、字体和文档到网格中
@gaurav_jain26 · X
Built a tool which will help developers and designers to extract resources without touching inspect try out and leave feedback

从文本或URL快速提取关键词,支持CSV下载,无需注册。
ExtractKeywords — AI 驱动的关键词提取工具,支持中英文,免费使用,无需注册,纯前端实现,隐私安全

从网页提取干净的 Markdown、JSON 或文本,为 AI 应用和 RAG 管道优化。
Sparkfetch · GitHub
sparkfetch 🔥 Turn any URL into clean, structured, LLM-ready content. The open-source web fetching & extraction API.

用在线GIS地图工具分析和可视化地理空间数据、计算距离并处理批量CSV文件。
@JanasSebastian · X

ScrapingDaddy helps developers and businesses extract public website data at scale with a reliable API, JavaScript rendering, geo-targeting, and simple integration.
@tadyav · X

文档解析 API,准确提取表格、公式和结构化数据给 AI 代理。
g418572664 · V2EX
做了一个文档解析与记忆工具,专门辅助给传统行业做 AI 落地的老哥 现在 AI+的工作还挺常见的,就像大佬们说的,“所有行业的产品可能都会用 AI 重新做一遍”。最常见的就是各种 agent ,说要用 AI 赋能传统行业啥的,代替人类专家去处理海量的复杂资料、进行深度分析并做出决策。 举个例子,金融行业的“智能审计与尽调 Agent”。 过去,银行或投资机构想要给一家企业贷款或投资,需要人类审计师去读几十份、每份几百页的招股书和财务报表。现在虽然有了 AI ,但把文件一股脑全丢给它是不现实的,且不说烧 token 的问题,这些文档里有无数的跨行、跨列单元格表格,普通工具一拉,表格数据全串行了。如果 AI 把“第一季度利润”和“第二季度支出”的信息碎在一块,那得出的财务分析就完蛋了。 所以,现在要真想开发出一个能干活,还确保正确率的 agent ,就需要一个专业的、AI-native 的解析工具,把复杂的表结构和章节层级完整还原出来。我做的工具 Knowhere 就是干这个的: https://knowhereto.ai/?utm_source=v2ex 它能把复


自动从网页提取表格和数据,一键导出为Excel或JSON文件。
Scrapilot — AI 爬虫插件,零代码采集任意网页数据,运行在真实浏览器中,天然抗反爬,支持定时自动化工作流

SpecParse 将工程PDF表格自动转换为格式化的Excel工作簿
@SpecParse · X
Convert Complex PDF Tables into Styled Excel Workbooks

从Google Maps提取商业线索,按评分筛选,导出为CSV。
@prakzymessi · X
Want local leads you can actually message on WhatsApp? 250 free to start →

通过REST API使用多个OCR模型从PDF中提取文本。
nmatej1 · HN
OpenParser – swappable OCR models in one API