前回はParallel Scanのforwardについてある程度確かめた。今回はParallel Scanの逆伝播と状態空間モデルの離散化について確認する。 Parallel Scanの逆伝播 【2024/05/04】理解に誤りがあった部分の記述を訂正。 mamba.pyにおいてParallel Scanの逆伝播はpsc…
引用をストックしました
引用するにはまずログインしてください
引用をストックできませんでした。再度お試しください
限定公開記事のため引用できません。