Search and extract ArXiv research papers as structured JSON: titles, authors, abstracts, categories, dates, PDFs, and metadata. Built for AI research monitoring, literature review, RAG datasets, and academic intelligence.
Scrape GitHub Trending repositories by language and date range. Returns repository names, descriptions, stars, forks, languages, and URLs for developer intelligence, trend monitoring, and startup research.
Extract structured Hacker News data: top stories, Ask HN, Show HN, job posts, comments, and monthly Who is Hiring threads. Fast Firebase API scraper for market research, recruiting, startup monitoring, and AI/RAG datasets.
Get npm package downloads, metadata, versions, keywords, maintainers, repositories, and trending/search results. Useful for developer-tool research, market intelligence, dependency analysis, and package popularity tracking.
Extract Stack Overflow and Stack Exchange questions, answers, scores, tags, owners, and accepted answers. Ideal for AI training datasets, developer support analytics, documentation gaps, and technical knowledge mining.
Extract Substack newsletter posts, titles, subtitles, publication dates, engagement metrics, and optional full text. Useful for media monitoring, creator research, market intelligence, and AI/RAG datasets.
Extract Wikipedia articles from any category with titles, URLs, extracts, page IDs, categories, and metadata. A fast MediaWiki API actor for building RAG datasets, knowledge bases, research corpora, and AI training data.