阿里云 EasyNLP 跨模态学习能力再升级,电商文图检索效果刷新SOTA

访客10个月前AI生活123
阿里云 EasyNLP 跨模态学习能力再升级,电商文图检索效果刷新SOTA

近日,阿里云机器学习 PAI 开源框架 EasyNLP进行升级发布,推出了融合了丰富电商场景知识的CLIP模型,在电商文图检索效果上刷新了SOTA结果,并且将上述模型免费开源,贡献给开源社区。

CLIP(Contrastive Language-Image Pre-training)是一种经典的文图跨模态检索模型,它在大规模图文数据集上进行了对比学习预训练,具有很强的文图跨模态表征学习能力。EasyNLP借鉴CLIP的轻量化、易迁移的预训练架构,构建基于CLIP包含图像和文本Encoder两部分的双流模型,同时基于商品数据,以优化电商场景的文图检索优化。

Fashion-Gen数据集是一个大规模的时尚场景的图文数据集,以Fashion-Gen数据集为例,EasyNLP基于pai-clip-commercial-base-en和pai-clip-commercial-large-en这两个模型在Fashion-Gen数据集上进行了20个epoch的微调。实验结果表明,相比于现公布的SOTA模型(CommerceMM),电商CLIP-large模型在文到图和图到文的检索结果上均有显著提升,评测指标最高提升了8.7~15个百分点。

除此之外,电商base模型在文到图与CommerceMM相当检索结果下,使用了更少的参数量。由此可见,电商CLIP无论在large还是base图像Encoder的设置下,都取得了有竞争力的电商场景跨模态检索能力。

文到图检索评测结果

999.jpg 

图到文检索评测结果

888(1)_看图王.jpg 

目前,电商CLIP可在EasyNLP中直接安装使用,在未来,EasyNLP框架会集成更多NLP的多模态的知识模型,覆盖各个常见领域和任务,同时也将集成更多SOTA模型(特别是中⽂模型),来⽀持各种NLP和多模态任务,共建NLP和多模态算法库。

Github地址:https://github.com/alibaba/EasyNLP

本站部分文章来自互联网,文章版权归原作者所有。如有疑问请联系QQ:362580117!

相关文章

华为发布业界首款心率体温双测TWS耳机,引领行业差异化发展

华为发布业界首款心率体温双测TWS耳机,引领行业差异化发展

随着消费者对便捷生活方式的追求越来越高,市场上主流手机已经陆续取消了耳机插孔,TWS耳机市场也随之迅速成长起来。苹果作为第一款推出TWS耳机的...

AI产业在未来3至5年的发展前景!

AI产业在未来3至5年的发展前景!

当“无接触”开始成为疫情中的现实需求,AI这个曾经引发过数次热潮的产业从幕后走向前台,逐渐成为人们视线的焦点。未来AI与产业的关系将如何发展...

光鉴科技发布柔性OLED的屏下3D人脸识别方案!

光鉴科技发布柔性OLED的屏下3D人脸识别方案!

众所周知,3D结构光人脸识别需要收/发传感器之间的距离尽量大,以提高识别性能,导致iPhone屏幕上一直保持着“大刘海”,而用3D人脸识别的华...

王慧文的光年之外开张,四家大模型抢开发布会,新科技革命如火如荼

王慧文的光年之外开张,四家大模型抢开发布会,新科技革命如火如荼

1 光年之外开张,王慧文喊出: “加速AGI,普惠人类” 光年之外在这天正式开张。其开工仪式尤为有趣,王慧文带着马占凯、刘江...

天问一号传回的首幅火星图像!

天问一号传回的首幅火星图像!

昨晚,国家航天局公布了天问一号传回的首幅火星图像,这是天问一号在距离火星约 220 万公里处拍下的景象。 图中,包括阿茜达利亚...

Hinton、LeCun、Bengio 与 Demis Hassabis一同获得 2022 年阿斯图里亚斯公主技术和科学研究奖!

本站部分文章来自互联网,文章版权归原作者所有。如有疑问请联系QQ:362580117!...

发表评论    

◎欢迎参与讨论,请在这里发表您的看法、交流您的观点。