diff --git a/download_dataset.py b/download_dataset.py new file mode 100644 index 000000000..24b46c051 --- /dev/null +++ b/download_dataset.py @@ -0,0 +1,14 @@ +from datasets import load_dataset +import pandas as pd +import os + +# 确保dataset目录存在 +os.makedirs('dataset', exist_ok=True) + +# 加载ETTh1数据集 +dataset = load_dataset('thuml/Time-Series-Library', 'ETTh1') + +# 将训练集保存为CSV +print("Saving ETTh1 dataset...") +dataset['train'].to_csv('dataset/ETTh1.csv', index=False) +print("Dataset saved successfully!") \ No newline at end of file diff --git a/extract_zips.py b/extract_zips.py new file mode 100644 index 000000000..7cfaee131 --- /dev/null +++ b/extract_zips.py @@ -0,0 +1,16 @@ +import zipfile +import os +from pathlib import Path + +def extract_all_zips(root_dir): + for path in Path(root_dir).rglob('*.zip'): + print(f"Extracting {path}...") + try: + with zipfile.ZipFile(path, 'r') as zip_ref: + zip_ref.extractall(path.parent) + print(f"Successfully extracted {path}") + except Exception as e: + print(f"Error extracting {path}: {e}") + +if __name__ == "__main__": + extract_all_zips('dataset') \ No newline at end of file