add example_dataset in training scripts (#1358)

* add example_dataset in training scripts * fix example datasets
2026-03-18 22:08:13 +00:00 · 2026-03-18 15:37:03 +08:00
parent 4ec4d9c20a
commit ba0626e38f
196 changed files with 911 additions and 567 deletions
--- a/examples/mova/model_training/lora/MOVA-720P-I2AV.sh
+++ b/examples/mova/model_training/lora/MOVA-720P-I2AV.sh
@@ -1,6 +1,8 @@
+modelscope download --dataset DiffSynth-Studio/diffsynth_example_dataset --include "mova/MOVA-720P-I2AV/*" --local_dir ./data/diffsynth_example_dataset
+
 accelerate launch examples/mova/model_training/train.py \
-  --dataset_base_path data/example_video_dataset/ltx2 \
-  --dataset_metadata_path data/example_video_dataset/ltx2_t2av.csv \
+  --dataset_base_path data/diffsynth_example_dataset/mova/MOVA-720P-I2AV \
+  --dataset_metadata_path data/diffsynth_example_dataset/mova/MOVA-720P-I2AV/metadata.csv \
  --data_file_keys "video,input_audio" \
  --extra_inputs "input_audio,input_image" \
  --height 720 \
@@ -21,8 +23,8 @@ accelerate launch examples/mova/model_training/train.py \
 # boundary corresponds to timesteps [900, 1000]

 accelerate launch examples/mova/model_training/train.py \
-  --dataset_base_path data/example_video_dataset/ltx2 \
-  --dataset_metadata_path data/example_video_dataset/ltx2_t2av.csv \
+  --dataset_base_path data/diffsynth_example_dataset/mova/MOVA-720P-I2AV \
+  --dataset_metadata_path data/diffsynth_example_dataset/mova/MOVA-720P-I2AV/metadata.csv \
  --data_file_keys "video,input_audio" \
  --extra_inputs "input_audio,input_image" \
  --height 720 \
@@ -40,4 +42,4 @@ accelerate launch examples/mova/model_training/train.py \
  --max_timestep_boundary 1 \
  --min_timestep_boundary 0.358 \
  --use_gradient_checkpointing
-# boundary corresponds to timesteps [0, 900)
+# boundary corresponds to timesteps [0, 900)