flâneur — a map of the web's best reading

Molmo and PixMo: Open Weights and Open Data for State-of-the-Art Vision-Language Models

arxiv.org · 20,445 words · saved by 1 readers

This is experimental HTML to improve accessibility. We invite you to report rendering errors. Use Alt+Y to toggle on accessible reporting links and Alt+Shift+Y to toggle off. Learn more about this project and help improve conversions.

Molmo and PixMo : Open Weights and Open Data for State-of-the-Art Vision-Language Models Matt Deitke ∗†ψ Christopher Clark ∗† Sangho Lee † Rohun Tripathi † Yue Yang † Jae Sung Park ψ Mohammadreza Salehi ψ Niklas Muennighoff † Kyle Lo † Luca Soldaini † Jiasen Lu † Taira Anderson † Erin Bransom † Kiana Ehsani † Huong Ngo † YenSung Chen † Ajay Patel † Mark Yatskar † Chris Callison-Burch † Andrew Head † Rose Hendrix † Favyen Bastani † Eli VanderBilt † Nathan Lambert † Yvonne Chou † Arnavi Chheda † Jenna Sparks † Sam Skjonsberg † Michael Schmitz † Aaron Sarnat † Byron Bischoff † Pete Walsh † Chris

Explore this link on the map →

saved by

related reading