Use scripts/inference.py to generate videos from text prompts. You can run inference on a single GPU, multiple GPUs, or using LoRA weights.
Single GPU Inference
python scripts/inference.py \
--data-path /path/to/packed_test_data/ \
--save-dir /path/to/vis_results/ \
--transformer-model-path /path/to/your_transformer/ \
--text-encoder-model-path /path/to/giga_world_0_video/text_encoder/ \
--vae-model-path /path/to/giga_world_0/vae/ \
--gpu_ids 0
Multi-GPU Inference
Specify multiple IDs in --gpu_ids for faster inference or larger batches.
python scripts/inference.py \
--data-path /path/to/packed_test_data/ \
--save-dir /path/to/vis_results/ \
--transformer-model-path /path/to/your_transformer/ \
--text-encoder-model-path /path/to/giga_world_0_video/text_encoder/ \
--vae-model-path /path/to/giga_world_0_video/vae/ \
--gpu_ids 0 1 2 3 4 5 6 7
LoRA Inference
Include the --lora-model-path argument to load fine-tuned LoRA weights.
python scripts/inference.py \
--data-path /path/to/packed_test_data/ \
--save-dir /path/to/vis_results/ \
--transformer-model-path /path/to/giga_world_0_video/transformer/ \
--text-encoder-model-path /path/to/giga_world_0_video/text_encoder/ \
--vae-model-path /path/to/giga_world_0_video/vae/ \
--lora-model-path /path/to/your_lora/ \
--gpu_ids 0