CVPR 2023首届大模型挑战赛：天翼云AI团队斩获多任务大模型赛道冠军

释放双眼，带上耳机，听听看~！

CVPR 2023首届大模型挑战赛落下帷幕，天翼云AI团队在多任务大模型赛道中斩获冠军，展示了在图像、音频及多模态领域的深厚积累和持续创新能力。

6月7日，国际人工智能顶会CVPR 2023举办的第一届大模型挑战赛（CVPR 2023 Workshop on Foundation Model:1st foundation model challenge）落下帷幕，本次比赛吸引了来自全球著-名高校和知名企业的1024名参赛者。经过为期2个月的激烈角逐，天翼云AI团队（队名CTRL）在多任务大模型赛道中表现出色，荣获本届大赛冠-军。

CVPR会议是由IEEE主办的关于计算机视觉和模式识别的国际学术会议，收录了该领域最新的研究成果和技术发展，是全球计算机视觉三大顶-级会议之一。

✦ ✦ ✦

传统的视觉模型生产流程通常采用单任务，从零开始训练，各个任务之间无法相互借鉴。由于单任务数据有限，导致模型的实际效果过于依赖任务数据分布，通常对于不同场景的泛化效果不佳。

近年来，大数据预训练技术迅速发展，通过利用大量数据学习通用知识并将其迁移到下游任务中的方法，本质上实现了不同任务之间的相互借鉴。基于海量数据获得的预训练模型具有较好的知识完备性，即使在下游任务中使用少量数据进行微调，仍然能够获得良好的效果。然而，基于预训练+下游任务微调的模型生产流程需要为每个任务单独训练模型，这在研发上消耗了大量资源。相比之下，多任务训练方案通过使用多个任务的数据训练一个功能强大的通用模型，可以直接应用于处理多个任务，从而有效提高模型生产效率和泛化能力。

在本次竞赛中，参赛者需要使用单一模型同时完成交通场景下的分类、检测和分割三个代表性任务的联合训练。天翼云AI团队在模型设计方面凭借丰富的算法开发经验，选择了参数量仅为第2名60%的预训练模型，用更少的参数却获得了更高的精度。

为了解决多任务训练中各分支损失函数和梯度不一致导致收敛缓慢的问题，天翼云AI团队采用了损失均衡和梯度尺度统一的方法，以此来平衡各任务分支的损失函数，并使梯度具有一致的尺度，从而提高模型的训练效率和收敛速度。此外，天翼云AI团队还通过精心设计的任务专属特征金字塔和注意力机制，使各分支任务能够利用骨干网络中对自身任务更有效的特征，进一步提升了整体模型的精度和性能。

通过以上模型设计和训练策略，天翼云AI团队在竞赛中取得了优异成绩，充分展示了在图像、音频及多模态领域的深厚积累和持续创新能力。未来，天翼云将继续在广阔的人工智能领域进行创新和探索，以更先进的技术和卓越的成果惠及更多用户，为千行百业的数字化发展提供支撑。

本网站的内容主要来自互联网上的各种资源，仅供参考和信息分享之用，不代表本网站拥有相关版权或知识产权。如您认为内容侵犯您的权益，请联系我们，我们将尽快采取行动，包括删除或更正。

{{userData.name}}已认证

CVPR 2023首届大模型挑战赛：天翼云AI团队斩获多任务大模型赛道冠军

基于条件掩码语言模型的神经机器翻译数据增强方法

Zendesk 如何在 Amazon SageMaker 上经济高效地构建多租户 ML 推理功能

GeoSpy.ai

即梦Dreamina

Globe Explorer

Luma Dream Machine

抖音即创

Motionshop

归档

{{userData.name}}已认证

基于条件掩码语言模型的神经机器翻译数据增强方法

Zendesk 如何在 Amazon SageMaker 上经济高效地构建多租户 ML 推理功能

深度神经网络大家族一览

GPT-4内幕大揭露！1.8万亿巨量参数，13万亿token训练，斥资6300万美元

🤗 Diffusers 庆祝一周年！| Diffusers 一周年庆典

Facechain AI人物写真生成教程：3张照片即可打造个性形象