AI Dynamics

Global AI News Aggregator

About

Transfusion: Multi-Modal Model for Token Prediction and Image Diffusion

New research paper from Meta FAIR – Transfusion: Predict the Next Token and Diffuse Images with One Multi-Modal Model. @violet_zct
, @liliyu_lili and team introduce this recipe for training a multi-modal model over discrete and continuous data. Transfusion combines next token

→ View original post on X — @aiatmeta