sixstringzen氏は、Apple silicon上のMLXおよびoMLX向けに最適化された、Altworld/Hemmingway-1モデルの強化されたoQ6e 量子化をリリースしました。この特定のビルドは、量子化プロセス中にモデルのマルチトークン予測(MTP)テンソルを保持している点が特徴です。
モデル発表Hemmingway-1Altworld/Hemmingway-1
sixstringzenがHemmingway-1のoQ6e 量子化をリリース、MLX向けにMTPテンソルを保持
この記事は翻訳です。 原文を読む
この変換にはoMLXの0.7.0.dev2ツールが使用されており、強化されたoQ6e混合精度アフィン量子化手法が採用されています。基本精度はグループサイズ64,の6-bitに設定されていますが、このビルドでは、より高い精度を維持するために、language_model.lm_headを含む9つの重要なテンソルに対して8-bitの精度が割り当てられています。生成されたアーティファクトのサイズは約21.39 GiBです。
構造およびoMLXのロードチェックにより、2026-09-20,におけるアーティファクトの互換性が確認されており、モデルは形式や重みのエラーなしにロードされます。重みはMLX safetensors形式で提供されています。ユーザーはoMLXモデルブラウザ経由でモデルをロードでき、直接的な散文生成のために「enable_thinking」を無効にするオプションも用意されています。
出典
- sixstringzen/Hemmingway-1-oQ6e-mtp(oMLX向けMTP保持6bit版) (Hugging Face: sixstringzen / Hemmingway-1 oQ6e, 2026-09-20)