Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context

Gemini Team,Machel Reid,Nikolay Savinov,Denis Teplyashin, Dmitry, Lepikhin,Timothy Lillicrap,Jean-baptiste Alayrac,Radu Soricut,Angeliki Lazaridou,Orhan Firat,Julian Schrittwieser,Ioannis Antonoglou,Rohan Anil,Sebastian Borgeaud,Andrew Dai,Katie Millican,Ethan Dyer,Mia Glaese,Thibault Sottiaux,Benjamin Lee,Fabio Viola,Malcolm Reynolds,Yuanzhong Xu,James Molloy,Jilin Chen,Michael Isard,Paul Barham,Tom Hennigan,Ross McIlroy,Melvin Johnson,Johan Schalkwyk,Eli Collins,Eliza Rutherford,Erica Moreira,Kareem Ayoub,Megha Goel,Clemens Meyer,Gregory Thornton,Zhen Yang,Henryk Michalewski,Zaheer Abbas,Nathan Schucher,Ankesh Anand,Richard Ives,James Keeling,Karel Lenc,Salem Haykal,Siamak Shakeri,Pranav Shyam,Aakanksha Chowdhery,Roman Ring,Stephen Spencer,Eren Sezener,Luke Vilnis,Oscar Chang,Nobuyuki Morioka,George Tucker,Ce Zheng,Oliver Woodman,Nithya Attaluri,Tomas Kocisky,Evgenii Eltyshev,Xi Chen,Timothy Chung,Vittorio Selo,Siddhartha Brahma,Petko Georgiev,Ambrose Slone,Zhenkai Zhu,James Lottes,Siyuan Qiao,Ben Caine,Sebastian Riedel,Alex Tomala,Martin Chadwick,Juliette Love,Peter Choy,Sid Mittal,Neil Houlsby,Yunhao Tang,Matthew Lamm,Libin Bai,Qiao Zhang,Luheng He,Yong Cheng,Peter Humphreys,Yujia Li,Sergey Brin,Albin Cassirer,Yingjie Miao,Lukas Zilka,Taylor Tobin,Kelvin Xu,Lev Proleev,Daniel Sohn,Alberto Magni,Lisa Anne Hendricks,Isabel Gao,Santiago Ontanon,Oskar Bunyan,Nathan Byrd,Abhanshu Sharma,Biao Zhang,Mario Pinto,Rishika Sinha,Harsh Mehta,Dawei Jia,Sergi Caelles,Albert Webson,Alex Morris,Becca Roelofs,Yifan Ding,Robin Strudel,Xuehan Xiong,Marvin Ritter,Mostafa Dehghani,Rahma Chaabouni,Abhijit Karmarkar,Guangda Lai,Fabian Mentzer,Bibo Xu,YaGuang Li,Yujing Zhang,Tom Le Paine,Alex Goldin,Behnam Neyshabur,Kate Baumli,Anselm Levskaya,Michael Laskin,Wenhao Jia,Jack W. Rae,Kefan Xiao,Antoine He,Skye Giordano,Lakshman Yagati,Jean-Baptiste Lespiau,Paul Natsev,Sanjay Ganapathy,Fangyu Liu,Danilo Martins,Nanxin Chen,Yunhan Xu,Megan Barnes,Rhys May,Arpi Vezer,Junhyuk Oh,Ken Franko,Sophie Bridgers,Ruizhe Zhao,Boxi Wu,Basil Mustafa,Sean Sechrist,Emilio Parisotto,Thanumalayan Sankaranarayana Pillai,Chris Larkin,Chenjie Gu,Christina Sorokin,Maxim Krikun,Alexey Guseynov,Jessica Landon,Romina Datta,Alexander Pritzel,Phoebe Thacker,Fan Yang,Kevin Hui,Anja Hauth,Chih-Kuan Yeh,David Barker,Justin Mao-Jones,Sophia Austin,Hannah Sheahan,Parker Schuh,James Svensson,Rohan Jain,Vinay Ramasesh,Anton Briukhov,Da-Woon Chung,Tamara von Glehn,Christina Butterfield,Priya Jhakra,Matthew Wiethoff,Justin Frye,Jordan Grimstad,Beer Changpinyo,Charline Le Lan,Anna Bortsova,Yonghui Wu,Paul Voigtlaender,Tara Sainath,Shane Gu,Charlotte Smith,Will Hawkins,Kris Cao,James Besley,Srivatsan Srinivasan,Mark Omernick,Colin Gaffney,Gabriela Surita,Ryan Burnell,Bogdan Damoc,Junwhan Ahn,Andrew Brock,Mantas Pajarskas,Anastasia Petrushkina,Seb Noury,Lorenzo Blanco,Kevin Swersky,Arun Ahuja,Thi Avrahami,Vedant Misra,Raoul de Liedekerke,Mariko Iinuma,Alex Polozov,Sarah York,George van den Driessche,Paul Michel,Justin Chiu,Rory Blevins,Zach Gleicher,Adrià Recasens,Alban Rrustemi,Elena Gribovskaya,Aurko Roy,Wiktor Gworek,Sébastien M. R. Arnold,Lisa Lee,James Lee-Thorp,Marcello Maggioni,Enrique Piqueras,Kartikeya Badola,Sharad Vikram,Lucas Gonzalez,Anirudh Baddepudi,Evan Senter,Jacob Devlin,James Qin,Michael Azzam,Maja Trebacz,Martin Polacek,Kashyap Krishnakumar,Shuo-yiin Chang,Matthew Tung,Ivo Penchev,Rishabh Joshi,Kate Olszewska,Carrie Muir,Mateo Wirth,Ale Jakse Hartman,Josh Newlan,Sheleem Kashem,Vijay Bolina,Elahe Dabir,Joost van Amersfoort,Zafarali Ahmed,James Cobon-Kerr,Aishwarya Kamath,Arnar Mar Hrafnkelsson,Le Hou,Ian Mackinnon,Alexandre Frechette,Eric Noland,Xiance Si,Emanuel Taropa,Dong Li,Phil Crone,Anmol Gulati,Sébastien Cevey,Jonas Adler,Ada Ma,David Silver,Simon Tokumine,Richard Powell,Stephan Lee,Kiran Vodrahalli,Samer Hassan,Diana Mincu,Antoine Yang,Nir Levine,Jenny Brennan,Mingqiu Wang,Sarah Hodkinson,Jeffrey Zhao,Josh Lipschultz,Aedan Pope,Michael B. Chang,Cheng Li,Laurent El Shafey,Michela Paganini,Sholto Douglas,Bernd Bohnet,Fabio Pardo,Seth Odoom,Mihaela Rosca,Cicero Nogueira dos Santos,Kedar Soparkar,Arthur Guez,Tom Hudson,Steven Hansen,Chulayuth Asawaroengchai,Ravi Addanki,Tianhe Yu,Wojciech Stokowiec,Mina Khan,Justin Gilmer,Jaehoon Lee,Carrie Grimes Bostock,Keran Rong,Jonathan Caton,Pedram Pejman,Filip Pavetic,Geoff Brown,Vivek Sharma,Mario Lučić,Rajkumar Samuel,Josip Djolonga,Amol Mandhane,Lars Lowe Sjösund,Elena Buchatskaya,Elspeth White,Natalie Clay,Jiepu Jiang,Hyeontaek Lim,Ross Hemsley,Zeyncep Cankara,Jane Labanowski,Nicola De Cao,David Steiner,Sayed Hadi Hashemi,Jacob Austin,Anita Gergely,Tim Blyth,Joe Stanton,Kaushik Shivakumar,Aditya Siddhant,Anders Andreassen,Carlos Araya,Nikhil Sethi,Rakesh Shivanna,Steven Hand,Ankur Bapna,Ali Khodaei,Antoine Miech,Garrett Tanzer,Andy Swing,Shantanu Thakoor,Lora Aroyo,Zhufeng Pan,Zachary Nado,Jakub Sygnowski,Stephanie Winkler,Dian Yu,Mohammad Saleh,Loren Maggiore,Yamini Bansal,Xavier Garcia,Mehran Kazemi,Piyush Patil,Ishita Dasgupta,Iain Barr,Minh Giang,Thais Kagohara,Ivo Danihelka,Amit Marathe,Vladimir Feinberg,Mohamed Elhawaty,Nimesh Ghelani,Dan Horgan,Helen Miller,Lexi Walker,Richard Tanburn,Mukarram Tariq,Disha Shrivastava,Fei Xia,Qingze Wang,Chung-Cheng Chiu,Zoe Ashwood,Khuslen Baatarsukh,Sina Samangooei,Raphaël Lopez Kaufman,Fred Alcober,Axel Stjerngren,Paul Komarek,Katerina Tsihlas,Anudhyan Boral,Ramona Comanescu,Jeremy Chen,Ruibo Liu,Chris Welty,Dawn Bloxwich,Charlie Chen,Yanhua Sun,Fangxiaoyu Feng,Matthew Mauger,Xerxes Dotiwalla,Vincent Hellendoorn,Michael Sharman,Ivy Zheng,Krishna Haridasan,Gabe Barth-Maron,Craig Swanson,Dominika Rogozińska,Alek Andreev,Paul Kishan Rubenstein,Ruoxin Sang,Dan Hurt,Gamaleldin Elsayed,Renshen Wang,Dave Lacey,Anastasija Ilić,Yao Zhao,Adam Iwanicki,Alejandro Lince,Alexander Chen,Christina Lyu,Carl Lebsack,Jordan Griffith,Meenu Gaba,Paramjit Sandhu,Phil Chen,Anna Koop,Ravi Rajwar,Soheil Hassas Yeganeh,Solomon Chang,Rui Zhu,Soroush Radpour,Elnaz Davoodi,Ving Ian Lei,Yang Xu,Daniel Toyama,Constant Segal,Martin Wicke,Hanzhao Lin,Anna Bulanova,Adrià Puigdomènech Badia,Nemanja Rakićević,Pablo Sprechmann,Angelos Filos,Shaobo Hou,Víctor Campos,Nora Kassner,Devendra Sachan,Meire Fortunato,Chimezie Iwuanyanwu,Vitaly Nikolaev,Balaji Lakshminarayanan,Sadegh Jazayeri,Mani Varadarajan,Chetan Tekur,Doug Fritz,Misha Khalman,David Reitter,Kingshuk Dasgupta,Shourya Sarcar,Tina Ornduff,Javier Snaider,Fantine Huot,Johnson Jia,Rupert Kemp,Nejc Trdin,Anitha Vijayakumar,Lucy Kim,Christof Angermueller,Li Lao,Tianqi Liu,Haibin Zhang,David Engel,Somer Greene,Anaïs White,Jessica Austin,Lilly Taylor,Shereen Ashraf,Dangyi Liu,Maria Georgaki,Irene Cai,Yana Kulizhskaya,Sonam Goenka,Brennan Saeta,Ying Xu,Christian Frank,Dario de Cesare,Brona Robenek,Harry Richardson,Mahmoud Alnahlawi,Christopher Yew,Priya Ponnapalli,Marco Tagliasacchi,Alex Korchemniy,Yelin Kim,Dinghua Li,Bill Rosgen,Kyle Levin,Jeremy Wiesner,Praseem Banzal,Praveen Srinivasan,Hongkun Yu,Çağlar Ünlü,David Reid,Zora Tung,Daniel Finchelstein,Ravin Kumar,Andre Elisseeff,Jin Huang,Ming Zhang,Ricardo Aguilar,Mai Giménez,Jiawei Xia,Olivier Dousse,Willi Gierke,Damion Yates,Komal Jalan,Lu Li,Eri Latorre-Chimoto,Duc Dung Nguyen,Ken Durden,Praveen Kallakuri,Yaxin Liu,Matthew Johnson,Tomy Tsai,Alice Talbert,Jasmine Liu,Alexander Neitz,Chen Elkind,Marco Selvi,Mimi Jasarevic,Livio Baldini Soares,Albert Cui,Pidong Wang,Alek Wenjiao Wang,Xinyu Ye,Krystal Kallarackal,Lucia Loher,Hoi Lam,Josef Broder,Dan Holtmann-Rice,Nina Martin,Bramandia Ramadhana,Mrinal Shukla,Sujoy Basu,Abhi Mohan,Nick Fernando,Noah Fiedel,Kim Paterson,Hui Li,Ankush Garg,Jane Park,DongHyun Choi,Diane Wu,Sankalp Singh,Zhishuai Zhang,Amir Globerson,Lily Yu,John Carpenter,Félix de Chaumont Quitry,Carey Radebaugh,Chu-Cheng Lin,Alex Tudor,Prakash Shroff,Drew Garmon,Dayou Du,Neera Vats,Han Lu,Shariq Iqbal,Alex Yakubovich,Nilesh Tripuraneni,James Manyika,Haroon Qureshi,Nan Hua,Christel Ngani,Maria Abi Raad,Hannah Forbes,Jeff Stanway,Mukund Sundararajan,Victor Ungureanu,Colton Bishop,Yunjie Li,Balaji Venkatraman,Bo Li,Chloe Thornton,Salvatore Scellato,Nishesh Gupta,Yicheng Wang,Ian Tenney,Xihui Wu,Ashish Shenoy,Gabriel Carvajal,Diana Gage Wright,Ben Bariach,Zhuyun Xiao,Peter Hawkins,Sid Dalmia,Clement Farabet,Pedro Valenzuela,Quan Yuan,Ananth Agarwal,Mia Chen,Wooyeol Kim,Brice Hulse,Nandita Dukkipati,Adam Paszke,Andrew Bolt,Kiam Choo,Jennifer Beattie,Jennifer Prendki,Harsha Vashisht,Rebeca Santamaria-Fernandez,Luis C. Cobo,Jarek Wilkiewicz,David Madras,Ali Elqursh,Grant Uy,Kevin Ramirez,Matt Harvey,Tyler Liechty,Heiga Zen,Jeff Seibert,Clara Huiyi Hu,Andrey Khorlin,Maigo Le,Asaf Aharoni,Megan Li,Lily Wang,Sandeep Kumar,Norman Casagrande,Jay Hoover,Dalia El Badawy,David Soergel,Denis Vnukov,Matt Miecnikowski,Jiri Simsa,Praveen Kumar,Thibault Sellam,Daniel Vlasic,Samira Daruki,Nir Shabat,John Zhang,Guolong Su,Jiageng Zhang,Jeremiah Liu,Yi Sun,Evan Palmer,Alireza Ghaffarkhah,Xi Xiong,Victor Cotruta,Michael Fink,Lucas Dixon,Ashwin Sreevatsa,Adrian Goedeckemeyer,Alek Dimitriev,Mohsen Jafari,Remi Crocker,Nicholas FitzGerald,Aviral Kumar,Sanjay Ghemawat,Ivan Philips,Frederick Liu,Yannie Liang,Rachel Sterneck,Alena Repina,Marcus Wu,Laura Knight,Marin Georgiev,Hyo Lee,Harry Askham,Abhishek Chakladar,Annie Louis,Carl Crous,Hardie Cate,Dessie Petrova,Michael Quinn,Denese Owusu-Afriyie,Achintya Singhal,Nan Wei,Solomon Kim,Damien Vincent,Milad Nasr,Christopher A. Choquette-Choo,Reiko Tojo,Shawn Lu,Diego de Las Casas,Yuchung Cheng,Tolga Bolukbasi,Katherine Lee,Saaber Fatehi,Rajagopal Ananthanarayanan,Miteyan Patel,Charbel Kaed,Jing Li,Shreyas Rammohan Belle,Zhe Chen,Jaclyn Konzelmann,Siim Põder,Roopal Garg,Vinod Koverkathu,Adam Brown,Chris Dyer,Rosanne Liu,Azade Nova,Jun Xu,Alanna Walton,Alicia Parrish,Mark Epstein,Sara McCarthy,Slav Petrov,Demis Hassabis,Koray Kavukcuoglu,Jeffrey Dean,Oriol Vinyals

In this report, we present the latest model of the Gemini family, Gemini 1.5 Pro, a highly compute-efficient multimodal mixture-of-experts model capable of recalling and reasoning over fine-grained information from millions of tokens of context, including multiple long documents and hours of video and audio. Gemini 1.5 Pro achieves near-perfect recall on long-context retrieval tasks across modalities, improves the state-of-the-art in long-document QA, long-video QA and long-context ASR, and matches or surpasses Gemini 1.0 Ultra's state-of-the-art performance across a broad set of benchmarks. Studying the limits of Gemini 1.5 Pro's long-context ability, we find continued improvement in next-token prediction and near-perfect retrieval (>99%) up to at least 10M tokens, a generational leap over existing models such as Claude 2.1 (200k) and GPT-4 Turbo (128k). Finally, we highlight surprising new capabilities of large language models at the frontier; when given a grammar manual for Kalamang, a language with fewer than 200 speakers worldwide, the model learns to translate English to Kalamang at a similar level to a person who learned from the same content.

翻译：本报告介绍了Gemini系列的最新模型——Gemini 1.5 Pro，这是一种高效计算的多模态混合专家模型，能够从数百万词元的上下文中（包括多个长文档以及数小时的视频和音频）回忆并推理细粒度信息。Gemini 1.5 Pro在多模态长上下文检索任务中实现了近乎完美的召回率，在长文档问答、长视频问答和长上下文自动语音识别任务中提升了现有最优水平，并在广泛基准测试中达到或超越了Gemini 1.0 Ultra的最优性能。通过研究Gemini 1.5 Pro长上下文能力的极限，我们发现其下一词元预测持续改进，且检索近乎完美（>99%）的能力可覆盖至少1000万词元，这一代际飞跃远超Claude 2.1（20万词元）和GPT-4 Turbo（12.8万词元）等现有模型。最后，我们揭示了前沿大语言模型令人惊叹的新能力：当提供全球使用人数不足200人的科拉曼语语法手册时，该模型能将英语翻译为科拉曼语，其水平与基于相同内容学习的人类译者相当。

相关内容

Gemini

关注 12

2023年12 月 6 日，谷歌 CEO 桑达尔・皮查伊官宣 Gemini 1.0 版正式上线。这次发布的 Gemini 大模型是原生多模态大模型，是谷歌大模型新时代的第一步，它包括三种量级：能力最强的 Gemini Ultra，适用于多任务的 Gemini Pro 以及适用于特定任务和端侧的 Gemini Nano。

Linux导论，Introduction to Linux，96页ppt

专知会员服务

82+阅读 · 2020年7月26日

【跨语言BERT模型大集合】Transfer learning is increasingly going multilingual with language-specific BERT models

专知会员服务

54+阅读 · 2020年1月30日

【WSDM2020】超越统计关系：将知识关系整合到多标签音乐风格分类的风格关联中（附pdf）

专知会员服务

18+阅读 · 2019年11月23日

FlowQA: Grasping Flow in History for Conversational Machine Comprehension

专知会员服务

34+阅读 · 2019年10月18日