GitHub repos

GitHub repository health and manifest dependency rows

This Actor uses the GitHub REST API for repositories you list, optionally reading manifestPaths, and emits repository summary and dependency rows. Public repos work without a token; githubToken raises rate limits.

Not a GitHub Releases watcher (use GitHub Release & Tag Scraper). Not npm/PyPI registry intelligence. Not private-repo access without a token you supply.

from $3.00 / 1,000 result ($0.003 per delivered apify-default-dataset-item). $0.001 Actor Start. Unchanged runs that write zero default-dataset rows typically charge $0.00 on current PPE.

Open GitHub Repo & Dependency Scraper on Apify

GitHub Repo & Dependency Scraper, not a neighboring Actor

Use this page for this Actor’s job. Use GitHub Release & Tag Scraper for Release/tag diffs; Use npm Package & Dependency Scraper for npm deps/versions; Use OSS Vulnerability Monitor for OSV/GitHub advisories.

This ActorGitHub Release & Tag Scrapernpm Package & Dependency ScraperOSS Vulnerability Monitor
Intent GitHub Repo & Dependency ScraperRelease/tag diffsnpm deps/versionsOSV/GitHub advisories
Primary input see schemarepositoriespackagespackages
What it reads Public sources listed on the Store pageGitHub releasesnpm registryOSV + GitHub Advisories
Primary output Dataset rows billed per live PPErelease rowsnpm dep rowsvuln rows
Not this job Not a GitHub Releases watcher (use GitHub Release & Tag Scraper). Not npm/PyPI registry intelligence. Not private-repo access without a token you supply.Not npm/PyPI package metadataNot license-policy auditsNot license-policy trees

Store ID: taroyamada/github-repo-dependency-intelligence. Respect source terms, robots.txt, and rate limits.

Use cases

How is GitHub Repo & Dependency Scraper different from GitHub Release & Tag Scraper and npm Package & Dependency Scraper?

GitHub Repo & Dependency Scraper (taroyamada/github-repo-dependency-intelligence): This Actor uses the GitHub REST API for repositories you list, optionally reading manifestPaths, and emits repository summary and dependency rows. Public repos work without a token; githubToken raises rate limits. Not a GitHub Releases watcher (use GitHub Release & Tag Scraper). Not npm/PyPI registry intelligence. Not private-repo access without a token you supply. GitHub Release & Tag Scraper is for Release/tag diffs (input repositories; GitHub releases; release rows). Not npm/PyPI package metadata. npm Package & Dependency Scraper is for npm deps/versions (input packages; npm registry; npm dep rows). Not license-policy audits. OSS Vulnerability Monitor is for OSV/GitHub advisories (input packages; OSV + GitHub Advisories; vuln rows). Not license-policy trees.

What input is required?

Live required fields: repositories. Published exampleRunInput is shown below. Analyze GitHub repository metadata and dependency manifests from public repositories.

Field Type Default Notes
repositories any[] required empty required Repositories. GitHub repositories as owner/name slugs or URLs.
manifestPaths any[] empty Manifest paths. Manifest file paths to inspect. Leave empty for common defaults.
includeDevDependencies boolean true Include dev dependencies. Include development/test dependency groups when present.
includeRepositorySummary boolean true Include repository summaries. Emit one repository_summary row for each repository.
maxDependenciesPerRepo integer 250 Max dependencies per repo. Maximum dependency rows to emit per repository. min=1 max=1000
githubToken string empty GitHub token. Optional GitHub token for higher API rate limits.
timeoutMs integer 20000 Timeout (ms). HTTP request timeout for GitHub API calls. min=1000 max=60000
delivery string enum dataset Delivery. Where to send results. Webhook delivery does not also push dataset rows. enum: dataset, webhook
webhookUrl string empty Webhook URL. Webhook URL to POST the full normalized payload to when delivery=webhook.
dryRun boolean false Dry run. Run without pushing rows to the dataset or webhook.

Published Store example run input (omitted fields take schema defaults):

{
  "repositories": [
    "facebook/react",
    "vercel/next.js"
  ],
  "manifestPaths": [],
  "includeDevDependencies": true,
  "includeRepositorySummary": true,
  "maxDependenciesPerRepo": 250,
  "timeoutMs": 20000,
  "delivery": "dataset",
  "dryRun": false
}

Run GitHub Repo & Dependency Scraper on Apify

How do dataset, webhook, and dry-run delivery work?

delivery defaults to dataset on the live schema. Dataset output is the billable surface when rows are written. webhookUrl is used when delivery is webhook (and typically not during dryRun). dryRun true validates or samples without the usual dataset/webhook side effects described on the Store schema. Unchanged runs that write zero default-dataset rows typically charge $0.00 on current PPE.

What does a result contain?

Published README Output Example / Sample Output JSON. Treat README samples as illustrations, not a live coverage guarantee. There is no published output JSON schema on the Store page.

How is GitHub Repo & Dependency Scraper priced?

Billing is pay per event. The live Store card is from $3.00 / 1,000 result ($0.003 per delivered apify-default-dataset-item). $0.001 Actor Start. Unchanged runs that write zero default-dataset rows typically charge $0.00 on current PPE. Current PPE:

Event Price Emitted when
apify-default-dataset-item (result) $0.003 Single result in the default dataset.
apify-actor-start (Actor Start) $0.001 Charged when the Actor starts running. Number of events charged depends on Actor memory (one event per GB, minimum one event).

from $3.00 / 1,000 result ($0.003 per delivered apify-default-dataset-item). $0.001 Actor Start. Unchanged runs that write zero default-dataset rows typically charge $0.00 on current PPE.

See GitHub Repo & Dependency Scraper pricing on Apify

Limits to keep in mind

Open GitHub Repo & Dependency Scraper on Apify

Related pages