[导读]公开的数据集具有重要意义,尤其是对于那些经历过传统方法的科研人员而言(传统方法没有统一的数据和评价标准,算法之间可比性较差)。公开的数据集可促进这一领域的健康快速发展,健康是指研究人员采用统一的训练集和测试集,采用同一个评价指标,增加可比性和可信性;快速是指专注于算法,不需要重复...
公开的数据集具有重要意义,尤其是对于那些经历过传统方法的科研人员而言(传统方法没有统一的数据和评价标准,算法之间可比性较差)。公开的数据集可促进这一领域的健康快速发展,健康是指研究人员采用统一的训练集和测试集,采用同一个评价指标,增加可比性和可信性;快速是指专注于算法,不需要重复性做数据收集工作。SSDD近几年的发展验证了上述观点。
SSDD使用情况
2017年12月1日,在中国北京召开的BIGSARDATA会议上公开了一个用于SAR图像船舶目标检测的数据集SSDD,SSDD是该领域中第一个公开的数据集。这篇论文仅发布了SSDD的初始粗略版本,但这个第一个公开的数据集得到了相当多学者的前所未有的关注,这也超出了作者的想象。
截止到2021年8月25日,在161个基于深度学习的SAR船舶检测的论文中,使用SSDD作为训练测试数据的有75篇,占46.6%,这显示了SSDD在SAR遥感社区的普及和巨大影响。其它论文采用的数据集是近些年提出的另外五个公开数据集,即Wang等人在2019年发布的SAR-Ship数据集,Sun等人在2019年发布的AIR-SARShip-1.0,Wei等人在2020年发布的HRSID,Zhang等人在2020年发布的LS-SSDD-v1.0,和AIR-SARShip-2.0。
这75篇论文中,只有一份来自国外(印度),其它所有论文作者均为中国学者,这说明中国已成为研究中最活跃的国家或地区。SSDD数据集常出现在各种主流遥感期刊中,例如MDPI的Remote Sensing,IEEE的 JSTARS、TGRS和GRSL等,这表明SSSD被遥感界的学术界广泛接受。
这75篇论文中,有62篇论文使用垂直边框,有9个使用旋转边框,有4篇论文使用像素级多边形分割。SSDD的初始版本仅提供垂直边框的标注,这使得使用垂直边框的数量占大多数(82.7%)。
SSDD得到广泛使用的原因
SSDD取得以上成功的原因主要有以下七点:
1.SSDD的公开时间最早,它比第二个公开的数据集要早1.5年,当没有其他数据集可用时,SSDD成为唯一的选择。
2.用于SAR船舶检测的几种常用卫星都是商业卫星,数据获取渠道有限,SSDD的出现可以解决此困境。
3.SSDD的作者活跃在SAR遥感社区,在公共媒体平台发布的文章促进了这个数据集的传播。
4.SSDD中的SAR图像样本具有不同分辨率,不同传感器,不同的极化,不同的海况,不同的船舶场景,包括近海和近海,以及不同的船舶尺寸。数据多样性是建立可靠的检测模型的基础。
5.当出现一些使用SSDD的论文时,后续学者一般会选择对这个SSDD数据集进行实验,以便于将所提方法与以前的方法进行比较,因此,使用此SSDD数据集的公共论文逐渐增加。这也是为什么其它数据集虽然比SSDD更大更好,但却没有SSDD应用广泛的原因。
6.早期SAR遥感界大多数学者计算机的GPU计算能力有限,与计算机视觉领域中的大规模数据集相比,SSDD的样本数量相对适中(有1160个样本,而PASCAL VOC有 9000个,COCO有20w个样本),这使得配备普通GPU的研究人员能够进行研究和开发,这使使用SSDD数据集进行研究变得相当活跃。此外,相对适中的样本数量也有助于调试模型,提高工作效率,而不是长时间的训练等待。当然,在使用SSDD数据集时,应考虑一些策略,例如数据增强和迁移学习,以避免过拟合。
7.SSDD中有典型的难检测样本,这些样本在SAR船舶检测的实际应用中都需要特别考虑,例如:特征不明显的小型船舶、港口内密集平行停泊的船舶、大型船舶、严重斑点噪声下的船舶测和复杂背景的船舶测。无论是传统的方法还是基于深度学习的方法,这些困难样本的检测都是一个研究热点,而SSDD可提供数据来源以研究这些问题。SSDD数据集存在的问题以及解决办法
尽管SSDD取得了较大的成功,但SSDD初始版本的粗略标注和模糊标准阻碍了算法的公平比较和学术交流。
首先,初始版本中存在一些粗略的标注,例如,有些船标注错误,有些船未进行标注,有些船的边框标注的不紧凑。因此,SSDD的初始版本是“脏的”。脏数据在计算机视觉领域广泛存在,对于庞大的数据集,深度网络可以通过批量训练减少脏数据的负面影响,从而提高模型的泛化能力。然而,对于少量的SAR图像出现的脏数据,深度网络中可能会出现训练振荡,这将降低检测性能,因此,有必要纠正它们。其次,在SSDD原始论文中存在使用标准模棱两可甚至不合理的问题。
例如,训练测试划分是随机的,但由于样本太少,不同的测试集会导致结果差异很大,这将导致与不同学者的不公平的方法比较。此外,原论文中没有提供划分近岸和远海目标的标准,导致后来的学者对近岸和远海船舶的检测精度进行不公平的比较。
更重要的是,目前该数据集仍缺乏全面的数据统计分析,这不利于其他学者的进一步研究。因此,为了公平的算法比较和有效的学术交流,这里明确制定了一些严格的使用标准,包括训练测试的划分,近岸和远海目标的定义,船舶尺寸的定义,确定密集分布的小型船舶样本,确定在港口密集平行停泊的样本。
SSDD初始版本是垂直矩形边界框(BBox)的标签,但垂直边框不够紧凑,其中存在大量背景杂乱,减少了船舶特征学习,导致船舶特征提取不足,它也不适用于长宽比大且方向任意的船舶,当港口船舶排列过于密集时,BBox无法有效区分,从而导致检测缺失。
因此BBox不再能够满足可旋转边界框(RBox)任务和像素级多边形分割(PSeg)任务的研究需求。RBox可以更好地描述目标的真实形状,同时在船舶检测中提供更好的准确性。像素级多边形分割(PSeg)可完全抑制背景杂乱,是进行SAR船舶检测是最理想的标注。
因此这里发布的最新版本的SSDD涵盖三种标注类型:边界框SSDD(BBox-SSDD),可旋转边界框SSDD(RBox-SSDD)和多边形分割SSDD(PSeg-SSDD)。需要对BBox-SSDD,RBox-SSDD和PSeg-SSDD进行全面的数据统计,分析结果将为未来可能的学者提供一些有价值的建议,以便在使用SSDD时进一步精心设计更高精度和更强鲁棒性的基于深度学习的SAR船舶检测算法。
以上内容来自论文:SAR Ship Detection Dataset (SSDD)-Official Release and Comprehensive Data Analysis
本站声明: 本文章由作者或相关机构授权发布,目的在于传递更多信息,并不代表本站赞同其观点,本站亦不保证或承诺内容真实性等。需要转载请联系该专栏作者,如若文章内容侵犯您的权益,请及时联系本站删除。
如今汽车正逐渐成为“车轮上的数据中心”,而先进功能和计算架构的创新也使得这一称号愈加贴切。例如,智能汽车是目前最复杂的由软件驱动的机器,运行约一亿行代码,随着 AI 在汽车中的兴起,这一数字预计很快将攀升至 10 亿行。...
关键字:
SSD
智能汽车
存储系统
美光的多端口 4150AT SSD支持虚拟化技术,为日益复杂的软件定义汽车提供集中决策新模式
关键字:
自动驾驶
AI智能汽车
SSD
5G、人工智能、物联网、云计算技术快速升级,存储容量和性能需求也快速增长,全球数据量也进而呈现出爆炸式提升的状态。在海量应用场景下依靠单一的存储方式已经无法满足大规模非结构数据,如何在可控成本内高效、弹性地应对每一次数据...
关键字:
SSD
存储
物联网
Mar. 28, 2024 ---- TrendForce集邦咨询表示,除了铠侠(Kioxia)和西部数据(WDC)自今年第一季起提升产能利用率外,其它供应商大致维持低投产策略。尽管第二季NAND Flash采购量较第一...
关键字:
SSD
NAND Flash
智能手机
2024年3月20日,2024中国闪存市场峰会(CFMS2024)在深圳宝安前海·JW万豪酒店盛大举办。本次峰会以“存储周期、激发潜能”为主题,共同探讨在供需关系依然充满挑战的大环境下,未来存储市场的变化,以及如何挖掘产...
关键字:
SSD
存储
AI
Mar. 7, 2024 ---- 2023年第三季供应商大幅减少产出,使得Enterprise SSD价格有撑,第四季合约价的反弹吸引买家积极购货,加上服务器品牌商需求也随着2024年企业资本支出展望优于去年,进而扩大...
关键字:
NAND Flash
服务器
SSD
1月1日消息,据供应链最新消息称,SSD产品九个季度以来首次上涨,而厂商拟2024年1-3月后持续要求涨价。
关键字:
SSD
存储芯片
芯片
英伟达
Dec. 8, 2023 ---- TrendForce集邦咨询表示,目前CSP业者随着手中库存持续去化,第四季开始已有部分Server OEM开始采购企业级SSD(Enterprise SSD),虽然今年NAND Fl...
关键字:
NAND Flash
SSD
在计算机硬件领域,硬盘作为存储数据的设备,其性能直接影响到整个系统的运行速度。目前市场上主流的硬盘类型主要有液态硬盘(HDD)和固态硬盘(SSD)。那么,液态硬盘和固态硬盘究竟有什么区别?哪个更好呢?本文将对此进行详细的...
关键字:
HDD
SSD
固态硬盘
业内消息,受NAND Flash市场长期疲软的影响,传闻美国芯片设计厂商美满科技(Marvell)近日已经对其位于中国台湾的SSD闪存控制器研发团队进行了裁撤,裁员人数高达200人,但此事还需经过公司官方证实。
关键字:
裁员
芯片
SSD
NAND Flash
美满科技
Marvell
数据中心可以看作是一台大号的计算机,而云计算同样也符合冯诺依曼结构:数据从存储设备中取出,通过网络传送到计算单元,运算结果通过网络传输至存储设备中保存。 因此要实现更高性能的运算,更高效地支持LLM等新兴应用,算力、网力...
关键字:
平头哥
SSD
镇岳510
分布式存储
玄铁
2023年11月1日,阿里旗下半导体公司“平头哥”宣布,其自主研发的首款SSD主控芯片“镇岳510”正式发布。
关键字:
平头哥
SSD
芯片
2型炎症领域新突破 上海2023年9月22日 /美通社/ -- 赛诺菲今天宣布,达必妥®(度普利尤单抗注射液)获得中国国家药品监督管理局(NMPA)批准,用于治疗适合系统治疗的中度至重度结节性痒疹的成...
关键字:
PRIME
BSP
REPORT
SAR
轻薄实力! 深圳2023年9月22日 /美通社/ -- 9月20日,由中国电子信息产业发展研究院主办的2023琴珠澳集成电路产业促进峰会暨第十八届"中国...
关键字:
FOR
PCIE
SSD
中国芯
(全球TMT2023年9月8日讯)9月6日,国际独立第三方检测、检验和认证机构德国莱茵TÜV大中华区(TÜV莱茵)与维沃移动通信有限公司(vivo)在东莞举行中心实验室授权仪式。 TÜV莱茵大中华区电子电气产品...
关键字:
VIVO
电磁兼容
RF
SAR
(全球TMT2023年8月30日讯)宜鼎国际(Innodisk)呼应AI边缘运算的高速运算需求,宣布推出全新微型“nanoSSD PCIe 4TE3”产品系列。4TE3是宜鼎旗下首款支持PCIe传输规格的BGA SSD...
关键字:
PCIE
SSD
微型
产品系列
上海2023年9月4日 /美通社/ -- Bossard柏中在上海总部设立智能装配工作站, 提供现场沉浸式体验"智能工厂装配"如何提升工厂装配效率。 该模拟装配工作站由ELAM平...
关键字:
SAR
数字化
沉浸式体验
OS
BGA解决方案呼应边缘AI微型需求 以高效能推动5G、车载与航天应用 深圳2023年8月30日 /美通社/ -- AIoT解决方案与工业级存储领导品牌宜鼎国际(I...
关键字:
PCIE
SSD
OS
AN
台北, June 28, 2023 (GLOBE NEWSWIRE) -- 专业存储和内存解决方案的全球领导者ATP推出其最新的高速N601系列M.2 2280和U.2固态硬盘(SSD),具有第四代PCIe®接口并支持N...
关键字:
GEN
PCIE
SSD
固态硬盘