Description
Qwen3.6-27B-FP8 export failed in fuse_gdn_input_projections: Float8_e4m3fn and Half torch.cat promotion unsupported
Environment
hardware: jetson thor
torch: 2.10.0+cu130
transformers: 5.3.0
cuda: 13.0
tensorrt-edge-llm: 0.7.1
model: Qwen/Qwen3.6-27B-FP8 · Hugging Face
Command
export MODEL_NAME=Qwen/Qwen3.6-27B-FP8
export WORKSPACE_DIR=$HOME/Projects/export_qwen3
mkdir -p $WORKSPACE_DIR
cd $WORKSPACE_DIR
python -m llm_loader.export_all_cli \
$MODEL_NAME \
$MODEL_NAME/onnx
Log
16:21:17 INFO llm_loader.export_all_cli: ============================================================ [00:00<?, ?it/s]
16:21:17 INFO llm_loader.export_all_cli: Model type : qwen3_5
16:21:17 INFO llm_loader.export_all_cli: Checkpoint : /home/wsc-noble/.cache/huggingface/hub/models–Qwen–Qwen3.6-27B-FP8/snapshots/e89b16ebf1988b3d6befa7de50abc2d76f26eb09
16:21:17 INFO llm_loader.export_all_cli: Output dir : Qwen/Qwen3.6-27B-FP8/onnx
16:21:17 INFO llm_loader.export_all_cli: thinker : yes
16:21:17 INFO llm_loader.export_all_cli: mtp_draft : no
16:21:17 INFO llm_loader.export_all_cli: talker : no
16:21:17 INFO llm_loader.export_all_cli: code_predictor : no
16:21:17 INFO llm_loader.export_all_cli: visual : yes
16:21:17 INFO llm_loader.export_all_cli: visual : no
16:21:17 INFO llm_loader.export_all_cli: audio : no
16:21:17 INFO llm_loader.export_all_cli: code2wav : no
16:21:17 INFO llm_loader.export_all_cli: action : no
16:21:17 INFO llm_loader.export_all_cli: FP8 embedding : no
16:21:17 INFO llm_loader.export_all_cli: MTP capable : yes
16:21:17 INFO llm_loader.export_all_cli: MTP export : no
16:21:17 INFO llm_loader.export_all_cli: Reduced vocab : no
16:21:17 INFO llm_loader.export_all_cli: ============================================================
16:21:17 INFO llm_loader.export_all_cli: [LLM] Loading checkpoint from /home/wsc-noble/.cache/huggingface/hub/models–Qwen–Qwen3.6-27B-FP8/snapshots/e89b16ebf1988b3d6befa7de50abc2d76f26eb09
Download complete: : 0.00B [00:00, ?B/s]
16:21:30 INFO llm_loader.checkpoint.loader: Stripping key prefix ‘model.language_model.’ from checkpoint keys (inserting ‘model.’)
16:21:30 INFO llm_loader.checkpoint.loader: Loaded 851 tensors, skipped 755 from /home/wsc-noble/.cache/huggingface/hub/models–Qwen–Qwen3.6-27B-FP8/snapshots/e89b16ebf1988b3d6befa7de50abc2d76f26eb09
16:21:30 INFO llm_loader.checkpoint.repacking: Repacked GPTQ weights
16:21:30 ERROR llm_loader.export_all_cli: [LLM] Failed to load checkpoint
Traceback (most recent call last):
File “/home/wsc-noble/Libraries/tensorrt-edge-llm/experimental/llm_loader/export_all_cli.py”, line 492, in _export_llm
model = AutoModel.from_pretrained(
File “/home/wsc-noble/Libraries/tensorrt-edge-llm/experimental/llm_loader/model.py”, line 167, in from_pretrained
fuse_gdn_input_projections(model)
File “/home/wsc-noble/Libraries/tensorrt-edge-llm/experimental/llm_loader/models/qwen3_5/modeling_qwen3_5_text.py”, line 720, in fuse_gdn_input_projections
fused_buffers[attr] = torch.cat(parts, dim=0)
RuntimeError: Promotion for Float8 Types is not supported, attempted to promote Float8_e4m3fn and Half