Como funciona
Um modelo multimodal lê um gráfico, transcreve um vídeo e interpreta uma foto de produto, ampliando o material que pode virar fonte de resposta.
Por que importa para o GEO
Vídeos com transcrição, imagens com texto alternativo descritivo e gráficos explicados no texto passam a contribuir para a presença em IA.
