
突破性工业异常检测方法
AnomalyGPT是一种创新的工业异常检测方法,结合了大型视觉语言模型技术。该方法无需手动设置阈值,能自动检测工业图像中的异常,并指出其位置和特征。AnomalyGPT通过预训练的图像编码器和语言模型,利用模拟异常数据来分析工业图像及相关描述。此外,它还可以仅凭少量正常样本就能识别新类型的异常。
准备数据:
克隆代码仓库:
git clone https://github.com/CASIA-IVA-Lab/AnomalyGPT.git
安装所需的包:
pip install -r requirements.txt
下载ImageBind预训练模型:
准备Vicuna检查点:
准备PandaGPT权重:
openllmplayground/pandagpt_7b_max_len_1024。如果切换到Vicuna-13B,预计会有更好的结果。有关如何配置训练设置的详细信息,请参阅./code/config.py中的注释。主要配置包括数据集路径、训练参数、模型设置等。
<span id='model_training'/>要训练您自己的AnomalyGPT,请运行以下命令:
cd ./code/ python train.py
训练过程包括数据准备、模型训练和评估等步骤。训练完成后,模型权重将保存在[./code/ckpt/]目录中。
你可以根据需要调整训练配置,并参考[./code/config.py]中的注释进行设置。如有任何疑问,欢迎随时与我们联系。 你可以从[此链接]下载MVTec-AD数据集, 并从[此链接]下载VisA。你也可以从[此处]下载PandaGPT的预训练数据。下载后,请将数据放置在[./data]目录下。
[./data]目录应该如下所示:
data
|---pandagpt4_visual_instruction_data.json
|---images
|-----|-- ...
|---mvtec_anomaly_detection
|-----|-- bottle
|-----|-----|----- ground_truth
|-----|-----|----- test
|-----|-----|----- train
|-----|-- capsule
|-----|-- ...
|----VisA
|-----|-- split_csv
|-----|-----|--- 1cls.csv
|-----|-----|--- ...
|-----|-- candle
|-----|-----|--- Data
|-----|-----|-----|----- Images
|-----|-----|-----|--------|------ Anomaly
|-----|-----|-----|--------|------ Normal
|-----|-----|-----|----- Masks
|-----|-----|-----|--------|------ Anomaly
|-----|-----|--- image_anno.csv
|-----|-- capsules
|-----|-----|----- ...
下表显示了我们实验中使用的训练超参数。这些超参数是根据我们的计算资源(即2个RTX3090 GPU)进行选择的。
| 基础语言模型 | 纪元数量 | 批量大小 | 学习率 | 最大长度 |
|---|---|---|---|---|
| Vicuna-7B | 50 | 16 | 1e-3 | 1024 |
要在MVTec-AD数据集上训练AnomalyGPT,请运行以下命令:
cd ./code bash ./scripts/train_mvtec.sh
训练脚本的关键参数如下:
--data_path: 用于pandagpt4_visual_instruction_data.json文件的数据路径。--image_root_path: PandaGPT训练图像的根路径。--imagebind_ckpt_path: ImageBind检查点的路径。--vicuna_ckpt_path: 保存预训练的Vicuna检查点的目录。--max_tgt_len: 训练实例的最大序列长度。--save_path: 保存训练后的delta权重的目录。这个目录将自动创建。--log_path: 保存日志的目录。这个目录将自动创建。请注意,纪元数量可以在./code/config/openllama_peft.yaml文件的epochs参数中设置,学习率可以在./code/dsconfig/openllama_peft_stage_1.json文件中设置。


职场AI,就用扣子
AI办公助手,复杂任务高效处理。办公效率低?扣子空间AI助手支持播客生成、PPT制作、网页开发及报告写作,覆盖科研、商业、舆情等领域的专家Agent 7x24小时响应,生活工作无缝切换,提升50%效率!


多风格AI绘画神器
堆友平台由阿里巴巴设计团队创建,作为一款AI驱动的设计工具,专为设计师提供一站式增长服务。功能覆盖海量3D素材、AI绘画、实时渲染以及专业抠图,显著提升设计品质和效率。平台不仅提供工具,还是一个促进创意交流和个人发展的空间,界面友好,适合所有级别的设计师和创意工作者。


零代码AI应用开发平台
零代码AI应用开发平台,用户只需一句话简单描述需求,AI能自动生成小程序、APP或H5网页应用,无需编写代码。


免费创建高清无水印Sora视频
Vora是一个免费创建高清无水印Sora视频的AI工具


最适合小白的AI自动化工作流平台
无需编码,轻松生成可复用、可变现的AI自动化工作流
