Mind2Web benchmark for web navigation agents

表格 2 results
NameCategoriesTopicsReferencesCredibilityCreateDateUpdateDateTitleRelatedNotesNavigationOrderEleventyTemplateEngineOverrideCreated
20260429_agent_workflow_memorypaper_analysisagent_architecture, memory_mechanism, llm, gui_agent, long_term_memory, cognitive_sciencecmu, mit, mind2web, webarena100Agent Workflow Memorydisentangling_memory_reasoning_llm[object Object][object Object]md
20260504_reasoningbank_scaling_agent_self_evolving_reasoning_memorypaper_analysisself_evolving_agents, reasoning_memory, test_time_scaling, agent_architecture, memory_mechanismgoogle_cloud_ai_research, webarena, mind2web, swebench_verified100ReasoningBank: Scaling Agent Self-Evolving with Reasoning MemorySelf-Evolving Agents: A Survey[object Object][object Object]md
Powered by Forestry.md