BLOOM: A 176B-Parameter Open-Access Multilingual Language Model

BigScience Workshop: Teven Le Scao; Angela Fan; Christopher Akiki,; Ellie Pavlick; Suzana Ili\'c; Daniel Hesslow; Roman Castagn\'e; Alexandra; Sasha Luccioni; Fran\c{c}ois Yvon; Matthias Gall\'e; Jonathan Tow; Alexander; M. Rush; Stella Biderman; Albert Webson; Pawan Sasanka Ammanamanchi; Thomas; Wang; Beno\^it Sagot; Niklas Muennighoff; Albert Villanova del Moral,; Olatunji Ruwase; Rachel Bawden; Stas Bekman; Angelina McMillan-Major; Iz; Beltagy; Huu Nguyen; Lucile Saulnier; Samson Tan; Pedro Ortiz Suarez; Victor; Sanh; Hugo Lauren\c{c}on; Yacine Jernite; Julien Launay; Margaret Mitchell,; Colin Raffel; Aaron Gokaslan; Adi Simhi; Aitor Soroa; Alham Fikri Aji; Amit; Alfassy; Anna Rogers; Ariel Kreisberg Nitzav; Canwen Xu; Chenghao Mou; Chris; Emezue; Christopher Klamm; Colin Leong; Daniel van Strien; David Ifeoluwa; Adelani; Dragomir Radev; Eduardo Gonz\'alez Ponferrada; Efrat Levkovizh,; Ethan Kim; Eyal Bar Natan; Francesco De Toni; G\'erard Dupont; Germ\'an; Kruszewski; Giada Pistilli; Hady Elsahar; Hamza Benyamina; Hieu Tran; Ian Yu,; Idris Abdulmumin; Isaac Johnson; Itziar Gonzalez-Dios; Javier de la Rosa,; Jenny Chim; Jesse Dodge; Jian Zhu; Jonathan Chang; J\"org Frohberg; Joseph; Tobing; Joydeep Bhattacharjee; Khalid Almubarak; Kimbo Chen; Kyle Lo; Leandro; Von Werra; Leon Weber; Long Phan; Loubna Ben allal; Ludovic Tanguy; Manan; Dey; Manuel Romero Mu\~noz; Maraim Masoud; Mar\'ia Grandury; Mario; \v{S}a\v{s}ko; Max Huang; Maximin Coavoux; Mayank Singh; Mike Tian-Jian; Jiang; Minh Chien Vu; Mohammad A. Jauhar; Mustafa Ghaleb; Nishant Subramani,; Nora Kassner; Nurulaqilla Khamis; Olivier Nguyen; Omar Espejel; Ona de; Gibert; Paulo Villegas; Peter Henderson; Pierre Colombo; Priscilla Amuok,; Quentin Lhoest; Rheza Harliman; Rishi Bommasani; Roberto Luis L\'opez; Rui; Ribeiro; Salomey Osei; Sampo Pyysalo; Sebastian Nagel; Shamik Bose,; Shamsuddeen Hassan Muhammad; Shanya Sharma; Shayne Longpre; Somaieh Nikpoor,; Stanislav Silberberg; Suhas Pai; Sydney Zink; Tiago Timponi Torrent; Timo; Schick; Tristan Thrush; Valentin Danchev; Vassilina Nikoulina; Veronika; Laippala; Violette Lepercq; Vrinda Prabhu; Zaid Alyafeai; Zeerak Talat; Arun; Raja; Benjamin Heinzerling; Chenglei Si; Davut Emre Ta\c{s}ar; Elizabeth; Salesky; Sabrina J. Mielke; Wilson Y. Lee; Abheesht Sharma; Andrea Santilli,; Antoine Chaffin; Arnaud Stiegler; Debajyoti Datta; Eliza Szczechla; Gunjan; Chhablani; Han Wang; Harshit Pandey; Hendrik Strobelt; Jason Alan Fries; Jos; Rozen; Leo Gao; Lintang Sutawika; M Saiful Bari; Maged S. Al-shaibani; Matteo; Manica; Nihal Nayak; Ryan Teehan; Samuel Albanie; Sheng Shen; Srulik; Ben-David; Stephen H. Bach; Taewoon Kim; Tali Bers; Thibault Fevry; Trishala; Neeraj; Urmish Thakker; Vikas Raunak; Xiangru Tang; Zheng-Xin Yong; Zhiqing; Sun; Shaked Brody; Yallow Uri; Hadar Tojarieh; Adam Roberts; Hyung Won Chung,; Jaesung Tae; Jason Phang; Ofir Press; Conglong Li; Deepak Narayanan; Hatim; Bourfoune; Jared Casper; Jeff Rasley; Max Ryabinin; Mayank Mishra; Minjia; Zhang; Mohammad Shoeybi; Myriam Peyrounette; Nicolas Patry; Nouamane Tazi,; Omar Sanseviero; Patrick von Platen; Pierre Cornette; Pierre Fran\c{c}ois; Lavall\'ee; R\'emi Lacroix; Samyam Rajbhandari; Sanchit Gandhi; Shaden Smith,; St\'ephane Requena; Suraj Patil; Tim Dettmers; Ahmed Baruwa; Amanpreet Singh,; Anastasia Cheveleva; Anne-Laure Ligozat; Arjun Subramonian; Aur\'elie; N\'ev\'eol; Charles Lovering; Dan Garrette; Deepak Tunuguntla; Ehud Reiter,; Ekaterina Taktasheva; Ekaterina Voloshina; Eli Bogdanov; Genta Indra Winata,; Hailey Schoelkopf; Jan-Christoph Kalo; Jekaterina Novikova; Jessica Zosa; Forde; Jordan Clive; Jungo Kasai; Ken Kawamura; Liam Hazan; Marine Carpuat,; Miruna Clinciu; Najoung Kim; Newton Cheng; Oleg Serikov; Omer Antverg; Oskar; van der Wal; Rui Zhang; Ruochen Zhang; Sebastian Gehrmann; Shachar Mirkin,; Shani Pais; Tatiana Shavrina; Thomas Scialom; Tian Yun; Tomasz Limisiewicz,; Verena Rieser; Vitaly Protasov; Vladislav Mikhailov; Yada Pruksachatkun,; Yonatan Belinkov; Zachary Bamberger; Zden\v{e}k Kasner; Alice Rueda; Amanda; Pestana; Amir Feizpour; Ammar Khan; Amy Faranak; Ana Santos; Anthony Hevia,; Antigona Unldreaj; Arash Aghagol; Arezoo Abdollahi; Aycha Tammour; Azadeh; HajiHosseini; Bahareh Behroozi; Benjamin Ajibade; Bharat Saxena; Carlos; Mu\~noz Ferrandis; Daniel McDuff; Danish Contractor; David Lansky; Davis; David; Douwe Kiela; Duong A. Nguyen; Edward Tan; Emi Baylor; Ezinwanne; Ozoani; Fatima Mirza; Frankline Ononiwu; Habib Rezanejad; Hessie Jones,; Indrani Bhattacharya; Irene Solaiman; Irina Sedenko; Isar Nejadgholi; Jesse; Passmore; Josh Seltzer; Julio Bonis Sanz; Livia Dutra; Mairon Samagaio,; Maraim Elbadri; Margot Mieskes; Marissa Gerchick; Martha Akinlolu; Michael; McKenna; Mike Qiu; Muhammed Ghauri; Mykola Burynok; Nafis Abrar; Nazneen; Rajani; Nour Elkott; Nour Fahmy; Olanrewaju Samuel; Ran An; Rasmus Kromann,; Ryan Hao; Samira Alizadeh; Sarmad Shubber; Silas Wang; Sourav Roy; Sylvain; Viguier; Thanh Le; Tobi Oyebade; Trieu Le; Yoyo Yang; Zach Nguyen; Abhinav; Ramesh Kashyap; Alfredo Palasciano; Alison Callahan; Anima Shukla; Antonio; Miranda-Escalada; Ayush Singh; Benjamin Beilharz; Bo Wang; Caio Brito; Chenxi; Zhou; Chirag Jain; Chuxin Xu; Cl\'ementine Fourrier; Daniel Le\'on; Peri\~n\'an; Daniel Molano; Dian Yu; Enrique Manjavacas; Fabio Barth; Florian; Fuhrimann; Gabriel Altay; Giyaseddin Bayrak; Gully Burns; Helena U. Vrabec,; Imane Bello; Ishani Dash; Jihyun Kang; John Giorgi; Jonas Golde; Jose David; Posada; Karthik Rangasai Sivaraman; Lokesh Bulchandani; Lu Liu; Luisa; Shinzato; Madeleine Hahn de Bykhovetz; Maiko Takeuchi; Marc P\`amies; Maria A; Castillo; Marianna Nezhurina; Mario S\"anger; Matthias Samwald; Michael; Cullan; Michael Weinberg; Michiel De Wolf; Mina Mihaljcic; Minna Liu; Moritz; Freidank; Myungsun Kang; Natasha Seelam; Nathan Dahlberg; Nicholas Michio; Broad; Nikolaus Muellner; Pascale Fung; Patrick Haller; Ramya Chandrasekhar,; Renata Eisenberg; Robert Martin; Rodrigo Canalli; Rosaline Su; Ruisi Su,; Samuel Cahyawijaya; Samuele Garda; Shlok S Deshmukh; Shubhanshu Mishra; Sid; Kiblawi; Simon Ott; Sinee Sang-aroonsiri; Srishti Kumar; Stefan Schweter,; Sushil Bharati; Tanmay Laud; Th\'eo Gigant; Tomoya Kainuma; Wojciech Kusa,; Yanis Labrak; Yash Shailesh Bajaj; Yash Venkatraman; Yifan Xu; Yingxin Xu; Yu; Xu; Zhe Tan; Zhongli Xie; Zifan Ye; Mathilde Bras; Younes Belkada; Thomas; Wolf

arXiv:2211.05100·cs.CL·June 28, 2023

BLOOM: A 176B-Parameter Open-Access Multilingual Language Model

BigScience Workshop: Teven Le Scao, Angela Fan, Christopher Akiki,, Ellie Pavlick, Suzana Ili\'c, Daniel Hesslow, Roman Castagn\'e, Alexandra, Sasha Luccioni, Fran\c{c}ois Yvon, Matthias Gall\'e, Jonathan Tow, Alexander, M. Rush, Stella Biderman, Albert Webson

PDF

5 Repos 10 Models 1 Datasets

TL;DR

BLOOM is a large, open-access multilingual language model with 176 billion parameters, designed to democratize access to advanced NLP technology and achieve competitive performance across diverse tasks.

Contribution

This work introduces BLOOM, a 176B-parameter multilingual language model developed through a collaborative effort, and emphasizes open access and multilingual capabilities.

Findings

01

BLOOM achieves competitive benchmark performance.

02

Multitask prompted finetuning improves results.

03

Models and code are publicly released.

Abstract

Large language models (LLMs) have been shown to be able to perform new tasks based on a few demonstrations or natural language instructions. While these capabilities have led to widespread adoption, most LLMs are developed by resource-rich organizations and are frequently kept from the public. As a step towards democratizing this powerful technology, we present BLOOM, a 176B-parameter open-access language model designed and built thanks to a collaboration of hundreds of researchers. BLOOM is a decoder-only Transformer language model that was trained on the ROOTS corpus, a dataset comprising hundreds of sources in 46 natural and 13 programming languages (59 in total). We find that BLOOM achieves competitive performance on a wide variety of benchmarks, with stronger results after undergoing multitask prompted finetuning. To facilitate future research and applications using LLMs, we…

Peer Reviews

No public reviews on file for this paper yet. If you reviewed it on a platform where reviews are public (OpenReview, ICLR, NeurIPS, ICML), you can paste yours below so the community can read it here.

Code & Models

Repositories

Models

Datasets

society-ethics/papers
dataset· 44 dl
44 dl

Videos

No videos yet. Explain this paper in a talk, walkthrough, or lecture? Add one.

Taxonomy

MethodsAttention Is All You Need · BLOOM · Massively multilingual probing based on Universal Dependencies · Label Smoothing · Dense Connections · Softmax · Position-Wise Feed-Forward Layer · Linear Layer · Multi-Head Attention · Adam