neng8科技快讯网AI人工智能前沿资讯_汽车数码相机评测_手机电脑硬件百科

Migician – 北交大联合清华、华中科大推出的多模态视觉定位模型

Migician – 北交大联合清华、华中科大推出的多模态视觉定位模型

Migician是北京交通大学、华中科技大学和清华大学的研究团队联合推出的多模态大语言模型(MLLM),专门用在自由形式的多图像定位(Multi-Image Grounding, MIG)任务,设计了大规模训练数据集MGrounding-630k。根据自由形式的查询(如文本描述、图像或两者的组合)在多幅图像中识别并精确定位相关的视觉区域。
22 0 2025-08-30
DCEdit – 北交大联合美图推出的双层控制图像编辑方法

DCEdit – 北交大联合美图推出的双层控制图像编辑方法

DCEdit 是新型的双层控制图像编辑方法,是北京交通大学和美图2MT实验室联合推出的。DCEdit基于精确语义定位策略(PSL),用视觉和文本自注意力优化交叉注意力图,提供更精准的区域线索指导图像编辑。
22 0 2025-08-28