A benchmark for evaluating LLM agent skill creation, curation, and reuse capabilities
表格 2 results
| Name | Categories | Topics | References | Credibility | CreateDate | UpdateDate | Title | RelatedNotes | NavigationOrder | Eleventy | TemplateEngineOverride | Created |
|---|
| 20260528_muse_autoskill_self_evolving_skill_memory | paper_analysis | agent_architecture, memory_mechanism, self_evolving_agents, skill_curation, continual_learning | bytedance_seed, skillsbench, muse_autoskill | 100 | | | MUSE-Autoskill: Self-Evolving Agents via Skill Creation, Memory, Management, and Evaluation | skillos_learning_skill_curation_self_evolving_agents, skillopt_executive_strategy_self_evolving_agent_skills, agent_memory_and_reasoning_frontier_survey_2026 | [object Object] | [object Object] | md | |
| 20260605_aip_graph_representation_for_learning_and_governing_agent_skills | paper_analysis | agent_architecture, skill_curation, self_evolving_agents, reasoning, workflow_optimization | skillsbench, agent_instruction_protocol | 95 | | | AIP: A Graph Representation for Learning and Governing Agent Skills | skillos_learning_skill_curation_self_evolving_agents, muse_autoskill_self_evolving_skill_memory, aflow_automating_agentic_workflow_generation, apwa_parallelizable_agentic_workflows | [object Object] | [object Object] | md | |