首页 > 业界资讯 > 正文

打通图文视频理解,微信自研多模态嵌入模型已在微信大规模使用

【太平洋科技快讯】据 IT 之家报道,9 月 4 日,微信 AI 官方宣布开源通用多模态嵌入模型 WeMM-Embedding,该模型包含 2B、4B、9B 三种参数版本,以 Qwen3.5 多模态架构作为基础骨干网络,支持文本、图片、视频、视觉文档以及多种模态交错混合输入。

图源:微信 AI,下同

在国际权威评测榜单 MMEB-v2 当中,WeMM-Embedding 取得综合排名第一,性能超越同榜单其余开源以及闭源参赛模型。

微信员工@客村小蒋 日前发文表示,WeMM-Embedding 的核心能力是让 AI 系统可以同时理解文字、图片、视频内容,并将不同模态信息映射至同一语义空间,完成跨模态对比与检索工作。

该模型已经在微信内部实现大规模落地,朋友圈搜索、视频号内容推荐、公众号推荐、微信电商等业务均接入该模型,每日调用规模达到 10 亿次。

网友评论

热门IT产品
  1. ¥1699
    华为畅享90 Pro Max
    ·
  2. ¥4699
    HUAWEI Mate 80
    ·
  3. ¥5999
    苹果iPhone17
    ·
  4. ¥8999
    苹果iPhone17 Pro
    ·
  5. ¥2399
    iQOO Z11 Turbo
    ·
  6. ¥1999
    vivo Y600 Pro
    ·
  7. ¥3599
    荣耀500 Pro
    ·
  8. ¥3499
    一加Ace 6至尊版
    ·
  9. ¥1399
    荣耀X70
    ·
  10. ¥2199
    REDMI Turbo 5 Max
    ·
为您推荐
  • 相关阅读
  • 业界资讯
  • 手机通讯
  • 电脑办公
  • 新奇数码
  • 软件游戏
  • 科学探索