Ross ROSS = Recommend OSS · open-source software intelligence for agents

karpathy/reinforcejs

Reinforcement Learning Agents in Javascript (Dynamic Programming, Temporal Difference, Deep Q-Learning, Stochastic/Deterministic Policy Gradients) observed · 2026-08-28

github.com/karpathy/reinforcejs · HTML observed · 2026-08-28

Health v2 · maintenance only

32/100

  • Activity 0
  • Release rhythm 35
  • Longevity 100

Flags: no_releases no_license

How is this computed?

round(0.45*activity + 0.35*rhythm + 0.20*longevity); archived -> min(score, 10) — computed 2026-09-03. Adoption (stars, forks) is never an input.

  • gap_med: n/a
  • age_days: 4155
  • days_rel: n/a
  • days_push: 2753
  • n_releases_24m: 0

Full methodology

Adoption not part of the score

1480 stars · 355 forks observed · 2026-08-28

What it is AI-extracted, prompt v1, taxonomy v1, 2026-08-30, confidence not recorded

REINFORCEjs is a JavaScript library implementing common reinforcement learning algorithms including Dynamic Programming, Temporal Difference Learning (SARSA/Q-Learning), Deep Q-Learning, and Stochastic/Deterministic Policy Gradients. It ships with web demos and exports an RL object with DP, TD, and DQN agent classes for building learning loops in the browser or Node.

Use cases

  • train reinforcement learning agents in the browser
  • learn how Q-learning and deep Q-learning work
  • implement tabular TD learning like SARSA
  • experiment with policy gradient methods for continuous actions
  • build interactive RL demos for teaching
  • run a DQN agent on a custom environment in JavaScript

When to choose

  • you want to learn or teach RL algorithms with runnable browser demos
  • you need lightweight RL agents in JavaScript for small state/action spaces
  • you want a simple DQN implementation without heavy dependencies

When to avoid

  • you need production-grade, well-tested RL for real applications
  • you need GPU-accelerated training or large-scale experiments
  • you need actively maintained software with ongoing bug fixes
  • you need policy gradient methods that are reliable, as they are described as very alpha

Facets

library · maturity maintenance

machine-learning reinforcement-learning agent-framework reinforcement-learning machine-learning education browser reinforcement-learning q-learning deep-q-learning policy-gradients javascript educational-demos nodejs

1 source

Member repositories

RepositoryRoleHealth v2
karpathy/reinforcejsmain32

For agents

markdown · JSON · MCP: product_card(name="karpathy/reinforcejs")

Data as of 2026-08-30T08:39:29.467469+00:00 · Report a problem