SciKnowEval: Scientific knowledge evaluation benchmark for LLM reasoning

表格 2 results
NameCategoriesTopicsReferencesCredibilityCreateDateUpdateDateTitleRelatedNotesNavigationOrderEleventyTemplateEngineOverrideCreated
20260520_amr_sd_token_level_credit_assignmentpaper_analysisreinforce_learning, reasoning, llm, reward_modeling, self_evolving_agentsgrpo, dapo, meituan, sciknoweval100AMR-SD: Asymmetric Meta-Reflective Self-Distillation for Token-Level Credit Assignmentrl_long_horizon_reasoning_llm_expressiveness, skillos_learning_skill_curation_self_evolving_agents[object Object][object Object]md
20260706_demopsd_disagreement_modulated_policy_self_distillationpaper_analysisreinforce_learning, reasoning, llm, self_evolving_agentsgrpo, sciknoweval, kl_distillation, gpqa100DemoPSD: Disagreement-Modulated Policy Self-Distillationrl_long_horizon_reasoning, vector_policy_optimization[object Object][object Object]md
Powered by Forestry.md