Multilingual Contrastive Decoding via Language-Agnostic Layers Skipping

Wenhao Zhu; Sizhe Liu (斯哲 刘); Shujian Huang; Shuaijie She; Chris Wendler; Jiajun Chen

Multilingual Contrastive Decoding via Language-Agnostic Layers Skipping

Wenhao Zhu, Sizhe Liu, Shujian Huang, Shuaijie She, Chris Wendler, Jiajun Chen

Abstract

Decoding by contrasting layers (DoLa), is designed to improve the generation quality of large language models (LLMs) by contrasting the prediction probabilities between an early exit output (amateur logits) and the final output (expert logits).However, we find that this approach does not work well on non-English tasks.Inspired by previous interpretability work on language transition during the model’s forward pass, we discover that this issue arises from a language mismatch between early exit output and final output.In this work, we propose an improved contrastive decoding algorithm that is effective for diverse languages beyond English.To obtain more helpful amateur logits, we devise two strategies to skip a set of bottom, language-agnostic layers based on our preliminary analysis.Experimental results on multilingual reasoning benchmarks demonstrate that our proposed method outperforms previous contrastive decoding baselines and substantially improves LLM’s chain-of-thought reasoning accuracy across 11 languages.

Anthology ID:: 2024.findings-emnlp.512
Volume:: Findings of the Association for Computational Linguistics: EMNLP 2024
Month:: November
Year:: 2024
Address:: Miami, Florida, USA
Editors:: Yaser Al-Onaizan, Mohit Bansal, Yun-Nung Chen
Venue:: Findings
SIG:
Publisher:: Association for Computational Linguistics
Note:
Pages:: 8775–8782
Language:
URL:: https://aclanthology.org/2024.findings-emnlp.512
DOI:
Bibkey:
Cite (ACL):: Wenhao Zhu, Sizhe Liu, Shujian Huang, Shuaijie She, Chris Wendler, and Jiajun Chen. 2024. Multilingual Contrastive Decoding via Language-Agnostic Layers Skipping. In Findings of the Association for Computational Linguistics: EMNLP 2024, pages 8775–8782, Miami, Florida, USA. Association for Computational Linguistics.
Cite (Informal):: Multilingual Contrastive Decoding via Language-Agnostic Layers Skipping (Zhu et al., Findings 2024)
Copy Citation:
PDF:: https://aclanthology.org/2024.findings-emnlp.512.pdf

PDF Cite Search