2026 年 8 月 26 日、NVIDIA が Hugging Face にモデルリポジトリ「nvidia/Qwen3.8-2.4T-A95B-NVFP4」を公開した。ベースモデルは Qwen/Qwen3.8-2.4T-A95B であり、NVIDIA の ModelOpt(Model Optimizer)を用いた FP4(4-bit 精度)量子化版として提供されている。

タグ情報では、モデルは MoE アーキテクチャのテキスト生成モデル(qwen3_5_moe_text)に分類され、用途として conversational(会話)も指定されている。重みの保存形式は safetensors、ライセンスは other に分類されている。


出典: nvidia/Qwen3.8-2.4T-A95B-NVFP4(HF: NVIDIA、2026-08-26)