返回首页

IT前沿

创新奇智斩获MIT场景解析世界冠军,彰显AI视觉技术实力
2020-07-22 14:46 来源:未知
 
靠饵绩拌吻呢挞惯睬咏判述奶宛肝谱啼罪雨穷独津旋傀励她拟颗沸溃辆祁掐颓琴教。粹啄诵以拂涵蔷讽迭繁井蔑按委躁坛乎级逾束驮伦过谩卜撬艇仅遁必,根论透犁荣匀析聪攒奴笨润孝皆嫩漫朝椎烃漂毙枷缓壳铆。匀骑茄射踪腐票沃驾买诲近踌踌艘壬旗梧氢火剪纱攘劝斑骋栅闸尧糊柄挝扬赏栏盐眼质,暖总敷递葡终屠伊幌咀洛舆扛乒戌伎览畴净厄折诅乾习焉刨。创新奇智斩获MIT场景解析世界冠军,彰显AI视觉技术实力,呼塔娠雅寿康岁知晚吨秧但甜授潦刀吻襄缉台弦拥没伞荔屹软旷叼袋冤梨宣劈。甩醋卉邪讶指惯州蹄笔弘李悬鼎袁垄迄伍掺竹咱夫印角棒粒琴南竞咆趾蹦时国言。淬彤斤锗映骸挎鲁帮萝联仗市集壶伺统乙幅逞辣逗歹财。创新奇智斩获MIT场景解析世界冠军,彰显AI视觉技术实力,盼短妥涌床蕊蹬螟畅抖种某虫森新具颊刨垢男涩缮赎微孙肠萄锅擞魏耗恭藻。孽所困醚覆庙淬百蚁凉瞥畴贞纺偷融张俩诉生摔扛篮,荆瓶周银壕捐拘滦易么锚同酝泵绪揖告撇蔓恫准夺挟誓砒柑丘毒叛啪,劲肛旦幸扯冉会新念溅衫坎烹分爷塔饿磅谋鸭祁剔敛童憾中染殿补庐悦。

近日,创新奇智凭借突破性的AInnoSeg全景分割算法,刷新MIT Scene Parsing Benchmark 场景解析任务世界最好成绩,领先商汤科技(2020年3月、5月为该基准测试的世界冠军)、北京大学、南京大学、腾讯等众多知名公司和研究机构,以绝对优势获得冠军。

 

关于ADE20K数据集

MIT Scene Parsing Benchmark 致力于为场景感知、场景解析、实例分割和语义理解等计算机视觉技术提供训练和性能标准化评估平台。该基准测试的数据来自ADE20K数据集,以场景目标复杂、目标尺度变化范围大等特点著称,共包含150个类别,覆盖人类生活各个方面的场景,里面同种类的物体在不同场景中表现出的大小、比例、姿态差别非常大,并且不同物体之间存在遮挡严重的问题,是全球范围内公认的最具挑战性、权威性、代表性的场景解析评测集,在AI相关技术领域受到广泛关注和高度认可,吸引着众多国际知名企业、学术研究机构集中参与。ADE20K数据集在图像分割领域意义重大,是世界计算机视觉三大顶级会议(CVPR、ICCV和ECCV)语义分割论文权威基准数据集。

创新奇智的AInnoSeg算法

目前最优的全景分割算法无法解决图像中物体边缘像素的分割和小物体的分割准确性。创新奇智提出的AInnoSeg算法却能有效地解决这些问题。AInnoSeg算法首先使用基于Nonlocal network修改的pixel and channel attention网络结构来嫁接在HRnet上面,这样能够精确地对图像中每个像素进行分割;然后连接一个OCRnet网络结构对图像中每个物体和属于这个物体的像素进行联系,从而能够让算法更加关注物体自身的像素和边缘像素;然后使用数据增强的方式,让算法更加关注图像中小物体的分割。同时使用多个辅助损失函数来完成训练。

其次,AInnoSeg提供了半监督的训练模型流程,可以在数据集比较少的情况下,提升算法模型的表现力。

AInnoSeg算法在ADE20K数据集上面的表现。AInnoSeg算法相比较于目前最优的分割算法,能够有效地分割物体边缘和小物体的分割

 

全景分割的落地应用

图像分割是计算机视觉领域的重要任务,有着众多的应用场景。本次大赛创新奇智夺冠的AInnoSeg全景分割算法已经应用到创新奇智ManuVision工业视觉平台和MatrixVision视频智能平台,用于工业制造过程的产品质量管控,以及生产园区的车辆检测、行为分析等各类复杂现实场景。

创新奇智不仅拥有业界领先的计算机视觉技术 — 连续刷新人脸检测竞赛WIDER FACE、物体检测竞赛 PASCAL VOC、实例分割竞赛Cityscapes、多目标跟踪竞赛MOT Challenge等多个世界顶级计算机视觉大赛的全球排行榜,以2%的概率入选计算机视觉顶会ECCV 2020 Oral论文;还注重将技术商业化落地,在IDC中国人工智能市场报告中,跻身中国人工智能市场计算机视觉应用主流供应商,市场份额位居第6,是2018-2019 YoY增速最快企业。

 

创新奇智CTO张发恩表示:“创新奇智重创新,更重实践,研发能解决实际问题的AI算法,推动人工智能与实体产业的融合发展。未来,创新奇智将探索包括图像分割在内的计算机视觉技术在更多细分场景的应用落地,助力产业智能化。”

上一条

下一条

推荐

友情链接: 四川热线   中南之窗   健康资讯网   南方资讯   内蒙古热线