
规模小、效率高:DeepMind推出多模态解决方案Mirasol 3B
规模小、效率高:DeepMind推出多模态解决方案Mirasol 3B
性能优于规模更大的模型。
多模态学习面临的主要挑战之一是需要融合文本、音频、视频等异构的模态,多模态模型需要组合不同来源的信号。然而,这些模态具有不同的特征,很难通过单一模型来组合。例如,视频和文本具有不同的采样率。
16
0
2025-09-03