Jun 07, 2024
IrokoBench: A New Benchmark for African Languages in the Age of Large Language Models
We introduce IrokoBench, a human-translated benchmark dataset for 16 typologically-diverse low-resource African languages.

Authors
David Ifeoluwa Adelani, Jessica Ojo, Israel Abebe Azime, Jian Yun Zhuang, Jesujoba O. Alabi, Xuanli He, Millicent Ochieng, Sara Hooker, Andiswa Bukula, En-Shiun Annie Lee, Chiamaka Chukwuneke, Happy Buzaaba, Blessing Sibanda, Godson Kalipe, Jonathan Mukiibi, Salomon Kabongo, Foutse Yuehgoh, Mmasibidi Setaka, Lolwethu Ndolela, Nkiruka Odu, Rooweither Mabuya, Shamsuddeen Hassan Muhammad, Salomey Osei, Sokhar Samb, Tadesse Kebede Guge, Pontus Stenetorp
Abstract
Related works

Research
Unlocking Reasoning Capability on Machine Translation in Large Language Models
Read

Research
The Art of Asking: Multilingual Prompt Optimization for Synthetic Data
Read

Research
Findings of the WMT25 Multilingual Instruction Shared Task: Persistent Hurdles in Reasoning, Generation, and Evaluation
Read






