MLLM 近期进展
MLLM(多模态大语言模型)是一种能够处理多种类型数据(如文本、图像、声音等)的机器学习模型。近期,MLLM在多个领域的应用和研究取得了显著进展。
XX 近期进展
当前焦点与观察点
- 当前,MLLM的研究和应用主要集中在以下几个方面:
- MLLM的多模态特征发现与控制(如MMDiff:多模态模型特征发现与控制的差分框架);
- 科学领域知识密集型视频生成(如Sci-VBench:科学领域知识密集型视频生成新基准);
- 视觉-文本压缩评测(如解耦语义与视觉:为视觉-文本压缩评测引入ZeroSense基准);
- 多模态大语言模型的属性级遗忘(如面向细粒度遗忘:多模态大语言模型的属性级遗忘)。