Recurrent neural networks and their variants, including training methods, architectures, and applications in sequence modeling

表格 4 results
NameCategoriesTopicsReferencesCredibilityCreateDateUpdateDateTitleRelatedNotesNavigationOrderEleventyTemplateEngineOverrideCreated
20260604_pretraining_recurrent_networks_without_recurrencepaper_analysismemory_mechanism, recurrent_neural_networks, llm, reinforce_learning, neuro_sciencemit, supervised_memory_training, backpropagation_through_time100Pretraining Recurrent Networks without Recurrence[object Object][object Object]md
20260618_fixed_point_reasoners_stable_adaptive_deep_looped_transformerspaper_analysisreasoning, llm, recurrent_neural_networks, memory_mechanism, agent_architecturetuebingen_ai_center, eth_zurich, liquidai, max_planck_institute100Fixed-Point Reasoners: Stable and Adaptive Deep Looped Transformers[object Object][object Object]md
20260629_carve_content_aware_recurrent_value_efficiencypaper_analysismemory_mechanism, recurrent_neural_networks, llm, reasoning, linear_attentioncarve, deltanet100CARVE: Content-Aware Recurrent with Value Efficiency for Chunk-Parallel Linear AttentionGated DeltaNet-2: Decoupling Erase and Write in Linear Attention[object Object][object Object]md
20260719_t2mlr_transformer_temporal_middle_layer_recurrencepaper_analysisreasoning, llm, memory_mechanism, recurrent_neural_networks, reasoning_memoryprinceton_university, chain_of_thought, backpropagation_through_time, gsm8k, hotpotqa100T²MLR: Transformer with Temporal Middle-Layer Recurrencesearchos_v1_open_domain_information_seeking_agent_collaboration, chain_of_thought_prompting_elicits_reasoning, memory_r1_enhancing_llm_agents_manage_utilize_memories_rl[object Object][object Object]md
Powered by Forestry.md