YOLOv11室内吸烟行为目标检测数据集

📊 数据集基本信息

  • 目标类别: [‘cigarette’, ‘person’, ‘smoke’, ‘vape’]
  • 中文类别:[‘香烟’, ‘人’, ‘烟雾’, ‘电子烟’]
  • 训练集:1364 张
  • 验证集:129 张
  • 测试集:51 张
  • 总计:1544 张

📄 data.yaml 配置信息

该数据集提供了data.yaml文件,内容如下:

train: ../train/images
val: ../valid/images
test: ../test/images

nc: 4
names: ['cigarette', 'person', 'smoke', 'vape']

🖼️ 标注可视化

标注图1

标注图2

📝 数据集分析

YOLOv11室内吸烟行为目标检测数据集

该数据集专注于室内环境中的人与香烟、电子烟及烟雾的交互行为,通过精准标注为智能监控系统提供高质量训练样本。数据集涵盖多种室内场景,包括卧室、客厅、办公室等,全面覆盖了日常生活中可能发生的吸烟行为,具有重要的社会价值和应用前景。

从数据分布来看,该数据集包含1364张训练图像、129张验证图像和51张测试图像,总计1544张。训练集占比88.3%,验证集占比8.4%,测试集占比3.3%,这种分布比例合理,能够有效支持模型的训练、调优和性能评估,确保模型在不同场景下的泛化能力。

该数据集的标注工作细致规范,所有目标均采用精确的矩形框标注,且标注名称与实际物体完全一致。标注人员严格遵循统一标准,确保了数据的一致性和可靠性,为后续的目标检测任务奠定了坚实基础。

该数据集可广泛应用于室内安防监控、公共场所管理以及健康行为研究等领域。特别是在需要识别和记录室内吸烟行为的场景中,如酒店房间、办公室、家庭环境等,该数据集能够为相关系统提供可靠的技术支持,助力实现智能化监管和行为分析。

YOLOv11训练步骤

一、环境安装

pip install ultralytics
# 依赖要求:Python≥3.8,PyTorch≥1.8。安装完成后可通过 `yolo checks` 验证环境。

二、数据集准备(YOLO格式)

1. 目录结构

数据集必须严格按以下结构组织:

dataset/
├── train/
│   ├── images/          # 训练图片(jpg/png)
│   └── labels/          # YOLO格式标注(txt)
├── val/
│   ├── images/
│   └── labels/
└── data.yaml            # 数据集配置文件
2. YOLO标注格式

每个 *.txt 文件对应一张图片,每行格式为:

class_id center_x center_y width height

所有数值均为相对于图片宽高的归一化值(0~1)。

3. data.yaml 配置文件
# data.yaml
path: ../dataset          # 数据集根目录(相对或绝对路径)
train: train/images       # 训练集图片路径
val: val/images           # 验证集图片路径
test: test/images         # 测试集图片路径(可选)

# 类别信息
nc: 2                     # 类别数量
names: ['class1', 'class2']  # 类别名称列表

三、模型选择

YOLO11 提供 5 种尺度,官方命名规则为 yolo11{n/s/m/l/x}.pt

模型参数量适用场景
yolo11n2.6M边缘设备、速度优先
yolo11s9.4M平衡精度与速度
yolo11m20.1M常规GPU训练
yolo11l25.3M高精度需求
yolo11x56.9M极致精度、算力充足

四、模型训练

方式1:Python API(推荐)

创建 train.py

from ultralytics import YOLO

def main():
    # 加载预训练模型(推荐:基于COCO预训练权重微调)
    model = YOLO("yolo11m.pt")

    # 训练参数
    train_params = {
        'data': 'data.yaml',           # 数据集配置文件
        'epochs': 100,                 # 训练轮次
        'imgsz': 640,                  # 输入图像尺寸
        'batch': 16,                   # 批次大小(根据显存调整)
        'device': '0',                 # GPU设备号,'cpu'表示CPU训练
        'workers': 8,                  # 数据加载线程数
        'optimizer': 'SGD',            # 优化器:SGD/Adam/AdamW
        'lr0': 0.01,                   # 初始学习率
        'patience': 50,                # 早停耐心值
        'save': True,                  # 保存模型
        'project': 'runs/train',       # 项目保存路径
        'name': 'exp',                 # 实验名称
        'single_cls': False,           # 单类别检测设为True
        'close_mosaic': 10,            # 最后N轮关闭马赛克增强
    }

    # 开始训练
    results = model.train(**train_params)

    # 输出最佳模型路径
    print(f"Best model saved at: {results.best}")

if __name__ == '__main__':
    main()

三种模型加载方式对比:

# 方式A:从YAML构建全新模型(从头训练,适合网络结构改进)
model = YOLO("yolo11m.yaml")

# 方式B:加载预训练权重(最常用,推荐)
model = YOLO("yolo11m.pt")

# 方式C:构建新模型并迁移预训练权重(改进网络后使用)
model = YOLO("yolo11m.yaml").load("yolo11m.pt")
方式2:命令行 CLI
# 基础训练
yolo detect train data=data.yaml model=yolo11m.pt epochs=100 imgsz=640 batch=16 device=0

# 多GPU训练
yolo detect train data=data.yaml model=yolo11m.pt epochs=100 device=0,1

# 从YAML+预训练权重训练
yolo detect train data=data.yaml model=yolo11m.yaml pretrained=yolo11m.pt epochs=100

五、关键训练参数说明

参数说明建议值
epochs训练总轮次100~300
imgsz输入尺寸640(标准)
batch批次大小8/16/32(根据显存)
device训练设备0(单GPU)、0,1(多GPU)、cpumps(Apple芯片)
workers数据加载线程8~16(Windows建议≤8)
optimizer优化器SGD(默认)、AdamAdamW
lr0 / lrf初始/最终学习率0.01 / 0.01
momentumSGD动量0.937
weight_decay权重衰减0.0005
single_cls单类别模式True/False
resume恢复中断训练True(需指定last.pt)
amp自动混合精度True(默认开启,省显存)

六、模型验证

创建 val.py

from ultralytics import YOLO

def main():
    # 加载训练好的最佳权重
    model = YOLO('runs/train/exp/weights/best.pt')

    # 验证
    metrics = model.val(
        data='data.yaml',
        split='val',              # 验证集:'val' 或 'test'
        imgsz=640,
        batch=16,
        iou=0.6,                  # NMS IoU阈值
        device='0',
        save_json=False,          # 是否保存COCO格式JSON
    )

    # 输出关键指标
    print(f"mAP50-95: {metrics.box.map}")   # mAP@0.5:0.95
    print(f"mAP50: {metrics.box.map50}")    # mAP@0.5
    print(f"mAP75: {metrics.box.map75}")    # mAP@0.75

if __name__ == '__main__':
    main()

CLI 方式:

yolo detect val model=runs/train/exp/weights/best.pt data=data.yaml

七、模型推理/预测

创建 predict.py

from ultralytics import YOLO
import cv2

def main():
    model = YOLO('runs/train/exp/weights/best.pt')

    # 单张图片推理
    results = model.predict(
        source='test_images/',    # 图片路径、文件夹、URL或摄像头索引(0)
        imgsz=640,
        conf=0.25,                # 置信度阈值
        iou=0.45,                 # NMS IoU阈值
        device='0',
        save=True,                # 保存结果图
        show=False,               # 是否弹窗显示
    )

    # 遍历结果
    for result in results:
        boxes = result.boxes      # 检测框
        masks = result.masks      # 分割掩码(如使用分割模型)
        probs = result.probs      # 分类概率

        # 获取坐标、置信度、类别
        for box in boxes:
            x1, y1, x2, y2 = box.xyxy[0].tolist()
            conf = box.conf[0].item()
            cls = int(box.cls[0].item())
            print(f"Class: {cls}, Conf: {conf:.2f}, Box: [{x1:.1f}, {y1:.1f}, {x2:.1f}, {y2:.1f}]")

if __name__ == '__main__':
    main()

CLI 方式:

yolo detect predict model=runs/train/exp/weights/best.pt source=test_images/ save=True

## 数据集下载>     小郭AI日志
Logo

DAMO开发者矩阵,由阿里巴巴达摩院和中国互联网协会联合发起,致力于探讨最前沿的技术趋势与应用成果,搭建高质量的交流与分享平台,推动技术创新与产业应用链接,围绕“人工智能与新型计算”构建开放共享的开发者生态。

更多推荐