GenImagemain 函数文档
June 17, 2025 · View on GitHub
概述
Gen_Image_main.py 函数是生成训练数据的重要文件。它处理一个包含 CSV 文件的目录,根据指定的方法生成可视化图表,并将输出保存到指定的目录。该函数接受多个参数,包括模型权重、输入数据目录、输出目录以及用于生成可视化的方法。
初始文件夹
/phase_1_csv2image/
├── dataset/ - 包含原始csv表格的文件夹
├── Gen_Image/ - 包含用于生成图表与图表数据的主要代码和模块。
└── Gen_Image_main.py - 主函数文件
主参数参数
data_dir_path
- 类型:
str - 描述:
- 包含要处理的 CSV 文件的目录路径。该目录中的每个 CSV 文件将被读取、清理并用于生成可视化图表。
output_path
- 类型:
str - 描述:
- 生成的可视化图表将保存到的目录路径。如果该目录不存在,函数将创建它。
model_id
- 类型:
str - 描述:
- 使用指定模型权重初始化的
LLM类实例。该模型用于修改生成的图表标题。模型权重通常以包含模型文件的目录路径形式提供。
- 使用指定模型权重初始化的
method
- 类型:
str - 默认值:
"Rules"
使用示例
要使用默认参数运行 main 函数,请使用以下命令:
python /path/to/Gen_Image_main.py --model_id /path/to/llama3_weights --data_dir_path /path/to/datasets --output_path /path/to/phase_1_csv2image --method Rules
输出示例
生成的图表与对应的JSON文件将保存在指定的输出目录中。每个图表将根据其类型保存在相应的子目录中,例如 Bar、Line 等。
process_files.txt 用于记录处理过的文件名。
/phase_1_csv2image/
|── process_files.txt
└── VisBench
└── Rules
|── Bar
| ├── image/
| └── json/
├── Line
| ├── image/
| └── json/
├── Pie
| ├── image/
| └── json/
└── Scatter
├── image/
└── json/