近日,360集团低调开源的视觉语言对齐模型FG-CLIP2在全球科技圈掀起热议。在涵盖长短文本图文检索、目标检测等在内的29项权威公开基准测试中,这款模型全面超越了科技巨头Google的SigLIP 2与Meta的MetaCLIP2。
据悉,360的FG-CLIP2成功攻克了CLIP模型长期存在的“细粒度识别”痛点,面对包含多个物体的复杂场景,其细节识别置信度仍高达96%。该模型实现了三大创新:层次化对齐架构、动态注意力机制和双语协同优化策略。
近日,360集团低调开源的视觉语言对齐模型FG-CLIP2在全球科技圈掀起热议。在涵盖长短文本图文检索、目标检测等在内的29项权威公开基准测试中,这款模型全面超越了科技巨头Google的SigLIP 2与Meta的MetaCLIP2。
据悉,360的FG-CLIP2成功攻克了CLIP模型长期存在的“细粒度识别”痛点,面对包含多个物体的复杂场景,其细节识别置信度仍高达96%。该模型实现了三大创新:层次化对齐架构、动态注意力机制和双语协同优化策略。
网友评论