TruthfulQA benchmark dataset for evaluating model truthfulness
| Name | Categories | Topics | References | Credibility | CreateDate | UpdateDate | Title | RelatedNotes | NavigationOrder | Eleventy | TemplateEngineOverride | Created |
|---|---|---|---|---|---|---|---|---|---|---|---|---|
| 20260429_disentangling_memory_reasoning_llm | paper_analysis | memory_mechanism, reasoning, llm, multi_hop_reasoning, chain_of_thought, cognitive_science | rutgers_university, ohio_state_university, ucsb, truthfulqa, strategyqa, commonsenseqa | 100 | Disentangling Memory and Reasoning Ability in Large Language Models | agent_workflow_memory | [object Object] | [object Object] | md |