计算机视觉:YOLO目标检测原理与实践

凌峰
内容简介 本书详细介绍YOLO目标检测核心技术与前沿进展,涵盖基础概念、主流算法框架及其实际应用场景。本书分为3部分,共10章。基础理论部分(第1~3章):介绍目标检测的核心概念、评估指标与公开数据集,常用的深度学习框架及其目标检测开发环境的搭建与使用,以及卷积神经网络(CNN)的核心原理与经典架构。技术实现部分(第4~8章):重点介绍YOLO目标检测框架的技术演进,从YOLOv1到YOLOv11,涵盖特征提取、特征融合、Anchor机制、损失函数优化、多维注意力机制等关键技术,并结合实际案例介绍YOLOv11的小目标检测实现过程。实战应用部分(第9、10章):以交通场景中的目标检测为例,介绍YOLOv11在实际项目中的应用,以及开放世界目标检测技术YOLO-UniOW框架在动态开放环境下的表现。 本书内容系统且案例丰富,适合计算机专业的学生、目标检测领域的初学者,以及希望深入掌握目标检测最新进展的科研人员与工程师使用。 作者简介 凌峰/博士 就职于985高校,长期从事机器学习、人工智能、计算机视觉及大语言模型方向的研发与教学工作。专注于模型优化、训练加速与数据驱动算法设计,具备扎实的理论基础与丰富的实践经验,主持及参与多项相关科研项目,致力于推动大模型及多模态技术在教学与产业中的落地应用。 前言 目标检测是计算机视觉领域的核心任务,旨在从图像或视频中定位并识别出特定目标。它不仅需要确定目标的种类(分类任务),还需要给出目标在图像中的具体位置(通常以边界框的形式表示)。目标检测广泛应用于自动驾驶、安防监控、人脸识别、智慧交通、工业检测等领域,是人工智能技术在实际场景中的重要应用之一。 目标检测方法经历了从传统计算机视觉技术到深度学习驱动的演变。传统方法依赖人工设计的特征提取与分类模型,性能受限于特征表达能力;而现代目标检测算法(如YOLO(You Only Loo…