← 返回资源分享
BLOOM: A 176B-Parameter Open-Access Multilingual Language Model
论文
论文
发布时间2022-11-09
发表arXiv:2211.05100
作者:Minjia Zhang,Sabrina J. Mielke,Douwe Kiela,Genta Indra Winata,Pascale Fung,Thomas Wolf,Samuel Albanie,Verena Rieser,Shachar Mirkin,Colin Raffel,Samyam Rajbhandari,Mohammad Shoeybi,Peter Henderson,Yonatan Belinkov,Angela Fan,Timo Schick,Alexander M. Rush,Mayank Singh,Jared Casper,Yacine Jernite,Margaret Mitchell,Jekaterina Novikova,Zhiqing Sun,Dian Yu,Jason Phang,Elizabeth Salesky,Chirag Jain,Najoung Kim,Ellie Pavlick,Victor Sanh,Vikas Raunak,Jungo Kasai,Ofir Press,Enrique Manjavacas,Iz Beltagy,Kyle Lo,Dan Garrette,Rui Zhang,Stefan Schweter,Patrick von Platen,Daniel McDuff,Nishant Subramani,Rachel Bawden,Matthias Samwald,Sebastian Gehrmann,Irene Solaiman,Dragomir Radev,Suzana Ilić,Jeff Rasley,Olatunji Ruwase,Hendrik Strobelt,Benjamin Beilharz,Yifan Xu,Samuel Cahyawijaya,Nora Kassner,Benoît Sagot,Maximin Coavoux,Ahmed Baruwa,John Giorgi,Bo wang,Urmish Thakker,Max Ryabinin,Pierre Colombo,Matteo Manica,Adam Roberts,Germán Kruszewski,Canwen Xu,Ruochen Zhang,Sampo Pyysalo,Tomasz Limisiewicz,Danish Contractor,Nazneen Rajani,Zdeněk Kasner,Chenglei Si,Leo Gao,Sheng Shen,Stella Biderman,Pawan Sasanka Ammanamanchi,Miruna Clinciu,Chris Emezue,Angelina McMillan-Major,Salomey Osei,Abheesht Sharma,Harshit Pandey,Gunjan Chhablani,Vassilina Nikoulina,Matthias Gallé,Davis David,Deepak Narayanan,Javier de la Rosa,Oleg Serikov,Yada Pruksachatkun,Lucile Saulnier,Quentin Lhoest,Albert Villanova del Moral,Hieu Tran,Long Phan,Taewoon Kim,Thomas Scialom,Antoine Chaffin,Tim Dettmers,Jaesung Tae,Ryan Teehan,Lu Liu,Hyung Won Chung,Albert Webson,Stephen H. Bach,Lintang Sutawika,Zaid Alyafeai,Arnaud Stiegler,Teven Le Scao,Arun Raja,Manan Dey,M Saiful Bari,Eliza Szczechla,Nihal Nayak,Debajyoti Datta,Jonathan Chang,Mike Tian-Jian Jiang,Han Wang,Thomas Wang,Trishala Neeraj,Jos Rozen,Andrea Santilli,Thibault Fevry,Jason Alan Fries,Tali Bers,Jordan Clive,Shubhanshu Mishra,Xiangru Tang,Jesse Dodge,Shaden Smith,Pedro Ortiz Suarez,Zheng-Xin Yong,Daniel Hesslow,Julien Launay,David Ifeoluwa Adelani,Jonathan Tow,Benjamin Ajibade,Marine Carpuat,Aitor Soroa,Hady Elsahar,Ehud Reiter,Suraj Patil,Mario Šaško,Nicolas Patry,Stas Bekman,Alexandra Sasha Luccioni,Rishi Bommasani,Hugo Laurençon,Leon Weber,Natasha Seelam,Gabriel Altay,Samuele Garda,Myungsun Kang,Ruisi Su,Wojciech Kusa,Fabio Barth,Simon Ott,Mario Sänger,Alison Callahan,Daniel León Periñán,Théo Gigant,Patrick Haller,Jenny Chim,Jose David Posada,Karthik Rangasai Sivaraman,Marc Pàmies,Marianna Nezhurina,Robert Martin,Michael Cullan,Moritz Freidank,Nathan Dahlberg,Shamik Bose,Nicholas Michio Broad,Yanis Labrak,Shlok S Deshmukh,Sid Kiblawi,Ayush Singh,Minh Chien Vu,Jonas Golde,Paulo Villegas,Oskar van der Wal,Younes Belkada,Jan-Christoph Kalo,Hailey Schoelkopf,Samson Tan,Rui Ribeiro,Idris Abdulmumin,Shamsuddeen Hassan Muhammad,Sanchit Gandhi,Jian Zhu,Colin Leong,Niklas Muennighoff,Jessica Zosa Forde,Sylvain Viguier,Anne-Laure Ligozat,Itziar Gonzalez-Dios,BigScience Workshop,:,Christopher Akiki,Roman Castagné,François Yvon,Huu Nguyen,Aaron Gokaslan,Adi Simhi,Alham Fikri Aji,Amit Alfassy,Anna Rogers,Ariel Kreisberg Nitzav,Chenghao Mou,Christopher Klamm,Daniel van Strien,Eduardo González Ponferrada,Efrat Levkovizh,Ethan Kim,Eyal Bar Natan,Francesco De Toni,Gérard Dupont,Giada Pistilli,Hamza Benyamina,Ian Yu,Isaac Johnson,Jörg Frohberg,Joseph Tobing,Joydeep Bhattacharjee,Khalid Almubarak,Kimbo Chen,Leandro von Werra,Loubna Ben allal,Ludovic Tanguy,Manuel Romero Muñoz,Maraim Masoud,María Grandury,Max Huang,Mohammad A. Jauhar,Mustafa Ghaleb,Nurulaqilla Khamis,Olivier Nguyen,Omar Espejel,Ona de Gibert,Priscilla Amuok,Rheza Harliman,Roberto Luis López,Sebastian Nagel,Shanya Sharma,Shayne Longpre,Somaieh Nikpoor,Stanislav Silberberg,Suhas Pai,Sydney Zink,Tiago Timponi Torrent,Tristan Thrush,Valentin Danchev,Veronika Laippala,Violette Lepercq,Vrinda Prabhu,Zeerak Talat,Benjamin Heinzerling,Davut Emre Taşar,Wilson Y. Lee,Maged S. Al-shaibani,Srulik Ben-David,Shaked Brody,Yallow Uri,Hadar Tojarieh,Conglong Li,Hatim Bourfoune,Mayank Mishra,Myriam Peyrounette,Nouamane Tazi,Omar Sanseviero,Pierre Cornette,Pierre François Lavallée,Rémi Lacroix,Stéphane Requena,Amanpreet Singh,Anastasia Cheveleva,Arjun Subramonian,Aurélie Névéol,Charles Lovering,Deepak Tunuguntla,Ekaterina Taktasheva,Ekaterina Voloshina,Eli Bogdanov,Ken Kawamura,Liam Hazan,Newton Cheng,Omer Antverg,Shani Pais,Tatiana Shavrina,Tian Yun,Vitaly Protasov,Vladislav Mikhailov,Zachary Bamberger,Alice Rueda,Amanda Pestana,Amir Feizpour,Ammar Khan,Amy Faranak,Ana Santos,Anthony Hevia,Antigona Unldreaj,Arash Aghagol,Arezoo Abdollahi,Aycha Tammour,Azadeh HajiHosseini,Bahareh Behroozi,Bharat Saxena,Carlos Muñoz Ferrandis,David Lansky,Duong A. Nguyen,Edward Tan,Emi Baylor,Ezinwanne Ozoani,Fatima Mirza,Frankline Ononiwu,Habib Rezanejad,Hessie Jones,Indrani Bhattacharya,Irina Sedenko,Isar Nejadgholi,Jesse Passmore,Josh Seltzer,Julio Bonis Sanz,Livia Dutra,Mairon Samagaio,Maraim Elbadri,Margot Mieskes,Marissa Gerchick,Martha Akinlolu,Michael McKenna,Mike Qiu,Muhammed Ghauri,Mykola Burynok,Nafis Abrar,Nour Elkott,Nour Fahmy,Olanrewaju Samuel,Ran An,Rasmus Kromann,Ryan Hao,Samira Alizadeh,Sarmad Shubber,Silas Wang,Sourav Roy,Thanh Le,Tobi Oyebade,Trieu Le,Yoyo Yang,Zach Nguyen,Abhinav Ramesh Kashyap,Alfredo Palasciano,Anima Shukla,Antonio Miranda-Escalada,Caio Brito,Chenxi Zhou,Chuxin Xu,Clémentine Fourrier,Daniel Molano,Florian Fuhrimann,Giyaseddin Bayrak,Gully Burns,Helena U. Vrabec,Imane Bello,Ishani Dash,Jihyun Kang,Lokesh Bulchandani,Luisa Shinzato,Madeleine Hahn de Bykhovetz,Maiko Takeuchi,Maria A Castillo,Michael Weinberg,Michiel De Wolf,Mina Mihaljcic,Minna Liu,Nikolaus Muellner,Ramya Chandrasekhar,Renata Eisenberg,Rodrigo Canalli,Rosaline Su,Sinee Sang-aroonsiri,Srishti Kumar,Sushil Bharati,Tanmay Laud,Tomoya Kainuma,Yash Shailesh Bajaj,Yash Venkatraman,Yingxin Xu,Yu Xu,Zhe Tan,Zhongli Xie,Zifan Ye,Mathilde Bras
详细介绍
Large language models (LLMs) have been shown to be able to perform new tasks based on a few demonstrations or natural language instructions. While these capabilities have led to widespread adoption, most LLMs are developed by resource-rich organizations and are frequently kept from the public. As a step towards democratizing this powerful technology, we present BLOOM, a 176B-parameter open-access language model designed and built thanks to a collaboration of hundreds of researchers. BLOOM is a decoder-only Transformer language model that was trained on the ROOTS corpus, a dataset comprising hundreds of sources in 46 natural and 13 programming languages (59 in total). We find that BLOOM achieves competitive performance on a wide variety of benchmarks, with stronger results after undergoing multitask prompted finetuning. To facilitate future research and applications using LLMs, we publicly release our models and code under the Responsible AI License.
代码仓库 (7)
tigerresearch/tigerbot官方PyTorch
bigscience-workshop/massive-probing-frameworkPyTorch
bigscience-workshop/bigsciencePyTorch
2024-MindSpore-1/Code2/tree/main/model-1/bloomMindSpore
xusenlinzy/api-for-open-llmPyTorch
rvlopes/gloriaPyTorch
2023-MindSpore-4/Code12/tree/main/MindFormers/bloomMindSpore
