Rainbow DQN

E200562

Rainbow DQN is a deep reinforcement learning algorithm that combines several key extensions to the original DQN—such as double Q-learning, prioritized replay, dueling networks, multi-step learning, distributional RL, and noisy nets—into a single, more performant agent.

All labels observed (5)

How this entity was disambiguated

Statements (49)

Predicate Object
instanceOf DQN extension ⓘ
deep reinforcement learning algorithm ⓘ
value-based reinforcement learning method ⓘ
actionSpace discrete action spaces ⓘ
basedOn Deep Q-Network ⓘ
linked to: Deep Q-Learning
citationYear 2018 ⓘ
codeAvailability open-source implementations in multiple frameworks (e.g., PyTorch, TensorFlow) ⓘ
combines Double Q-learning ⓘ
distributional reinforcement learning ⓘ
dueling network architecture ⓘ
multi-step learning ⓘ
noisy networks for exploration ⓘ
prioritized experience replay ⓘ
developedAt DeepMind ⓘ
evaluatedOn Atari 2600 games from the Arcade Learning Environment ⓘ
goal maximize expected cumulative reward ⓘ
improvesOver C51 distributional DQN ⓘ
linked to: Rainbow DQN

DQN ⓘ
linked to: Deep Q-Learning

Double DQN ⓘ
Dueling DQN ⓘ
Prioritized DQN ⓘ
influenced subsequent Atari benchmark baselines ⓘ
introducedInPaper Rainbow: Combining Improvements in Deep Reinforcement Learning ⓘ
linked to: Rainbow DQN
learningSignal temporal-difference error ⓘ
optimizationAlgorithm stochastic gradient descent variant ⓘ
outperforms baseline DQN on Atari benchmarks ⓘ
proposedBy Bilal Piot ⓘ
Dan Horgan ⓘ
David Silver ⓘ
Georg Ostrovski ⓘ
Hado van Hasselt ⓘ
Joseph Modayil ⓘ
Matteo Hessel ⓘ
Mohammad Azar ⓘ
Tom Schaul ⓘ
Will Dabney ⓘ
publishedAt AAAI 2018 ⓘ
taskType model-free reinforcement learning ⓘ
uses Q-learning update rule ⓘ
epsilon-greedy policy with noisy nets modification ⓘ
experience replay buffer ⓘ
target network ⓘ
usesDistributionalMethod categorical value distribution (C51) ⓘ
usesExplorationMethod noisy linear layers ⓘ
usesFunctionApproximator deep convolutional neural network ⓘ
usesMultiStepReturn n-step returns ⓘ
usesNetworkArchitecture dueling network with value and advantage streams ⓘ
usesPrioritization proportional prioritized replay ⓘ
valueRepresentation distribution over returns ⓘ

How these facts were elicited

Referenced by (22)

Full triples — surface form annotated when it differs from this entity's canonical label.

Dueling DQN → influenced → Rainbow DQN ⓘ
Double DQN → influenced → Rainbow DQN ⓘ
Rainbow DQN → introducedInPaper → Rainbow: Combining Improvements in Deep Reinforcement Learning ⓘ
linked to: Rainbow DQN
Rainbow DQN → improvesOver → C51 distributional DQN ⓘ
linked to: Rainbow DQN
Deep Q-Learning → inspired → Rainbow DQN ⓘ
Tianshou → supportsAlgorithm → Rainbow DQN ⓘ
Joseph Modayil → notableWork → Rainbow DQN ⓘ
Joseph Modayil → coAuthored → Rainbow: Combining Improvements in Deep Reinforcement Learning ⓘ
linked to: Rainbow DQN
Joseph Modayil → algorithmContribution → Rainbow DQN combines several DQN improvements into one unified agent ⓘ
linked to: Rainbow DQN
Dan Horgan → notableWork → Rainbow: Combining Improvements in Deep Reinforcement Learning ⓘ
linked to: Rainbow DQN
Dan Horgan → coAuthorOf → Rainbow: Combining Improvements in Deep Reinforcement Learning ⓘ
linked to: Rainbow DQN
Rainbow: Combining Improvements in Deep Reinforcement Learning → introducedAlgorithm → Rainbow DQN ⓘ
subject linked to: Dan Horgan
Bilal Piot → knownFor → Rainbow DQN ⓘ
Bilal Piot → coAuthorOf → Rainbow: Combining Improvements in Deep Reinforcement Learning ⓘ
linked to: Rainbow DQN
Bilal Piot → contributedTo → Rainbow DQN algorithm ⓘ
linked to: Rainbow DQN
Mohammad Azar → notableWork → Rainbow: Combining Improvements in Deep Reinforcement Learning ⓘ
linked to: Rainbow DQN
Mohammad Azar → knownFor → Rainbow DQN algorithm ⓘ
linked to: Rainbow DQN
Mohammad Azar → coAuthorOf → Rainbow: Combining Improvements in Deep Reinforcement Learning ⓘ
linked to: Rainbow DQN
Will Dabney → notableWork → Rainbow: Combining Improvements in Deep Reinforcement Learning ⓘ
linked to: Rainbow DQN
Georg Ostrovski → notableWork → Rainbow DQN ⓘ
Georg Ostrovski → coAuthorOf → Rainbow: Combining Improvements in Deep Reinforcement Learning ⓘ
linked to: Rainbow DQN