Enhancing Reasoning Capabilities of LLMs via Principled Synthetic Logic   Corpus

Terufumi Morishita; Gaku Morio; Atsuki Yamaguchi; Yasuhiro Sogawa

arXiv:2411.12498·cs.LG·December 24, 2024·2 cites

Enhancing Reasoning Capabilities of LLMs via Principled Synthetic Logic Corpus

Terufumi Morishita, Gaku Morio, Atsuki Yamaguchi, Yasuhiro Sogawa

PDF

Open Access 2 Repos 1 Video

TL;DR

This paper introduces a principled synthetic logic training approach that significantly improves large language models' reasoning abilities across multiple benchmarks by using a carefully designed logical reasoning corpus.

Contribution

The paper presents a novel training method, ALT, and a synthetic corpus, FLD$_{ imes 2}$, to enhance LLM reasoning through high-quality, diverse logical samples based on symbolic logic principles.

Findings

01

Up to 30-point improvement on logical reasoning benchmarks

02

Up to 10-point gains on math and coding tasks

03

5-point increase on the BBH benchmark

Abstract

Large language models (LLMs) are capable of solving a wide range of tasks, yet they have struggled with reasoning. To address this, we propose $Additional Logic Training (ALT)$ , which aims to enhance LLMs' reasoning capabilities by program-generated logical reasoning samples. We first establish principles for designing high-quality samples by integrating symbolic logic theory and previous empirical insights. Then, based on these principles, we construct a synthetic corpus named $Formal Logic Deduction Diverse$ ( $FLD$ $_{\times 2}$ ), comprising numerous samples of multi-step deduction with unknown facts, diverse reasoning rules, diverse linguistic expressions, and challenging distractors. Finally, we empirically show that ALT on FLD $_{\times 2}$ substantially enhances the reasoning capabilities of state-of-the-art LLMs, including LLaMA-3.1-70B. Improvements…

Peer Reviews

No public reviews on file for this paper yet. If you reviewed it on a platform where reviews are public (OpenReview, ICLR, NeurIPS, ICML), you can paste yours below so the community can read it here.

Code & Models

Repositories

Videos

Enhancing Reasoning Capabilities of LLMs via Principled Synthetic Logic Corpus· slideslive

Taxonomy

TopicsNatural Language Processing Techniques · Semantic Web and Ontologies