1. 项目概述:基于YOLO的世界名画作者识别系统
在艺术鉴定和数字人文领域,准确识别画作作者一直是个专业门槛极高的工作。传统方法依赖艺术史专家的肉眼判断,不仅效率低下,且受主观因素影响较大。我们开发的这套系统通过计算机视觉技术,使用YOLO系列模型实现了对世界名画作者的自动化识别,支持34位西方艺术史上最具代表性的画家作品识别。
这个项目的核心价值在于:
- 提供了包含5000余幅标注图像的高质量数据集(涵盖从文艺复兴到现代主义的各时期代表作)
- 预训练了适配不同硬件环境的YOLO模型版本(v5到v8)
- 支持多种标注格式转换(COCO JSON/Pascal VOC XML)
- 识别准确率在验证集上达到89%以上(具体指标因模型版本而异)
实际测试中发现,系统对印象派画家(如莫奈、梵高)的识别准确率最高,这与其鲜明的个人风格特征有关;而对早期文艺复兴作品(如扬·凡·艾克)的识别则需要更多训练数据支持。
需要模型API调用? 免费领10W Token,多模型网关一键接入 Claude、DeepSeek 等主流模型。
2. 数据集深度解析
2.1 数据构成与分布
数据集包含4999幅高质量名画数字图像,按7:2:1的比例划分为:
- 训练集:2988幅(59.8%)
- 验证集:1008幅(20.2%)
- 测试集:1003幅(20.0%)
覆盖的34位画家按时期分布如下表所示:
| 艺术时期 | 代表画家 | 作品数量占比 |
|---|---|---|
| 文艺复兴 | 达芬奇、波提切利 | 18% |
| 巴洛克 | 伦勃朗、委拉斯开兹 | 15% |
| 印象派 | 莫奈、德加 | 22% |
| 现代主义 | 毕加索、达利 | 25% |
| 其他 | 蒙克、霍普等 | 20% |
2.2 数据预处理流程
原始图像经过标准化处理流程:
- 自动定向校正(Exif信息解析)
- 统一resize到416×416像素(保持长宽比)
- 色彩空间转换为RGB
- 像素值归一化到0-1范围
增强策略采用多维度组合:
python复制# 示例增强配置(YOLOv8)
augment:
hsv_h: 0.015 # 色相扰动
hsv_s: 0.7 # 饱和度扰动
hsv_v: 0.4 # 明度扰动
degrees: 24 # 旋转
