Mind2Web benchmark for web navigation agents
| Name | Categories | Topics | References | Credibility | CreateDate | UpdateDate | Title | RelatedNotes | NavigationOrder | Eleventy | TemplateEngineOverride | Created |
|---|---|---|---|---|---|---|---|---|---|---|---|---|
| 20260429_agent_workflow_memory | paper_analysis | agent_architecture, memory_mechanism, llm, gui_agent, long_term_memory, cognitive_science | cmu, mit, mind2web, webarena | 100 | Agent Workflow Memory | disentangling_memory_reasoning_llm | [object Object] | [object Object] | md | |||
| 20260504_reasoningbank_scaling_agent_self_evolving_reasoning_memory | paper_analysis | self_evolving_agents, reasoning_memory, test_time_scaling, agent_architecture, memory_mechanism | google_cloud_ai_research, webarena, mind2web, swebench_verified | 100 | ReasoningBank: Scaling Agent Self-Evolving with Reasoning Memory | Self-Evolving Agents: A Survey | [object Object] | [object Object] | md |