Interactive science experiment benchmark for evaluating long-term memory, multi-step planning, and scientific reasoning in LLM agents.
| Name | Categories | Topics | References | Credibility | CreateDate | UpdateDate | Title | RelatedNotes | NavigationOrder | Eleventy | TemplateEngineOverride | Created |
|---|---|---|---|---|---|---|---|---|---|---|---|---|
| 20260717_experience_memory_graph_one_shot_error_correction_for_agents | paper_analysis | memory_mechanism, agent_architecture, reasoning, long_term_memory, knowledge_graph | alfworld, scienceworld, uestc | 100 | Experience Memory Graph: One-Shot Error Correction for Agents | memlineage_lineage_guided_llm_agent_memory, shared_selective_persistent_memory_agentic_llm, agent_memory_and_reasoning_frontier_survey_2026 | [object Object] | [object Object] | md |