Traceback (most recent call last): File "/root/.cache/uv/environments-v2/nvfp4-f6f5cc5d579a8852/lib/python3.12/site-packages/llmcompressor/entrypoints/utils.py", line 68, in pre_process model_args.processor = initialize_processor_from_path( ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^ File "/root/.cache/uv/environments-v2/nvfp4-f6f5cc5d579a8852/lib/python3.12/site-packages/llmcompressor/entrypoints/utils.py", line 191, in initialize_processor_from_path processor = AutoProcessor.from_pretrained( ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^ File "/root/.cache/uv/environments-v2/nvfp4-f6f5cc5d579a8852/lib/python3.12/site-packages/transformers/models/auto/processing_auto.py", line 441, in from_pretrained return processor_class.from_pretrained( ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^ File "/root/.cache/uv/environments-v2/nvfp4-f6f5cc5d579a8852/lib/python3.12/site-packages/transformers/processing_utils.py", line 1691, in from_pretrained args = cls._get_arguments_from_pretrained(pretrained_model_name_or_path, processor_dict, **kwargs) ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^ File "/root/.cache/uv/environments-v2/nvfp4-f6f5cc5d579a8852/lib/python3.12/site-packages/transformers/processing_utils.py", line 1820, in _get_arguments_from_pretrained sub_processor = auto_processor_class.from_pretrained( ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^ File "/root/.cache/uv/environments-v2/nvfp4-f6f5cc5d579a8852/lib/python3.12/site-packages/transformers/models/auto/video_processing_auto.py", line 354, in from_pretrained ).__module__.startswith("transformers.") ^^^^^^^^^^ AttributeError: 'NoneType' object has no attribute '__module__'. Did you mean: '__reduce__'? The above exception was the direct cause of the following exception: Traceback (most recent call last): File "/data/nvfp4.py", line 78, in main oneshot(model=model, dataset=calib, recipe=recipe, File "/root/.cache/uv/environments-v2/nvfp4-f6f5cc5d579a8852/lib/python3.12/site-packages/llmcompressor/entrypoints/oneshot.py", line 419, in oneshot one_shot = Oneshot(**local_args, **kwargs) ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^ File "/root/.cache/uv/environments-v2/nvfp4-f6f5cc5d579a8852/lib/python3.12/site-packages/llmcompressor/entrypoints/oneshot.py", line 170, in __init__ pre_process(model_args, dataset_args, output_dir) File "/root/.cache/uv/environments-v2/nvfp4-f6f5cc5d579a8852/lib/python3.12/site-packages/llmcompressor/entrypoints/utils.py", line 73, in pre_process raise RuntimeError( RuntimeError: An error occurred when attempting to initialize model processor, which is required when a dataset is provided. To resolve, create and pass in a processor directly to `oneshot`/`train`. During handling of the above exception, another exception occurred: Traceback (most recent call last): File "/data/nvfp4.py", line 107, in main() File "/data/nvfp4.py", line 87, in main oneshot(model=model, recipe=recipe) File "/root/.cache/uv/environments-v2/nvfp4-f6f5cc5d579a8852/lib/python3.12/site-packages/llmcompressor/entrypoints/oneshot.py", line 420, in oneshot one_shot() File "/root/.cache/uv/environments-v2/nvfp4-f6f5cc5d579a8852/lib/python3.12/site-packages/llmcompressor/entrypoints/oneshot.py", line 191, in __call__ self.apply_recipe_modifiers( File "/root/.cache/uv/environments-v2/nvfp4-f6f5cc5d579a8852/lib/python3.12/site-packages/llmcompressor/entrypoints/oneshot.py", line 252, in apply_recipe_modifiers pipeline( File "/root/.cache/uv/environments-v2/nvfp4-f6f5cc5d579a8852/lib/python3.12/site-packages/llmcompressor/pipelines/independent/pipeline.py", line 45, in __call__ pipeline(model, dataloader, dataset_args) File "/root/.cache/uv/environments-v2/nvfp4-f6f5cc5d579a8852/lib/python3.12/site-packages/llmcompressor/pipelines/data_free/pipeline.py", line 33, in __call__ dispatch_model(model) File "/root/.cache/uv/environments-v2/nvfp4-f6f5cc5d579a8852/lib/python3.12/site-packages/compressed_tensors/offload/dispatch.py", line 229, in dispatch_model remove_module_offload(module, onload_tensors=True) File "/root/.cache/uv/environments-v2/nvfp4-f6f5cc5d579a8852/lib/python3.12/site-packages/compressed_tensors/offload/module.py", line 77, in remove_module_offload name: module._parameters.onload(param) ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^ File "/root/.cache/uv/environments-v2/nvfp4-f6f5cc5d579a8852/lib/python3.12/site-packages/compressed_tensors/offload/cache/cpu.py", line 27, in onload return send_tensors(offloaded, device=self.onload_device, copy=False) ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^ File "/root/.cache/uv/environments-v2/nvfp4-f6f5cc5d579a8852/lib/python3.12/site-packages/compressed_tensors/offload/utils.py", line 42, in send_tensors tensor = value.to(*args, **kwargs) ^^^^^^^^^^^^^^^^^^^^^^^^^ torch.OutOfMemoryError: CUDA out of memory. Tried to allocate 170.00 MiB. GPU 0 has a total capacity of 94.97 GiB of which 13.75 MiB is free. Including non-PyTorch memory, this process has 94.95 GiB memory in use. Of the allocated memory 94.19 GiB is allocated by PyTorch, and 138.87 MiB is reserved by PyTorch but unallocated. If reserved but unallocated memory is large try setting PYTORCH_CUDA_ALLOC_CONF=expandable_segments:True to avoid fragmentation. See documentation for Memory Management (https://docs.pytorch.org/docs/stable/notes/cuda.html#optimizing-memory-usage-with-pytorch-cuda-alloc-conf)