ブンリンAIラボ
新着
PLUS ULTRA
ニュース
特集
データ
日本語
日本語
English
タグ: Qwen 3.8 Flash Next
リリース
vLLM v0.30.0 リリース — モデルサポートの拡大と Model Runner V2 の機能強化
ニュース
Tim DettmersがローカルAIと自律的研究エコシステムを披露する「オープンソース・ウィーク」の開催を発表
リリース
mlx-vlm v0.7.0公開 — サポートモデルの拡充と推論パフォーマンスの最適化
リリース
llama.cpp v0.4.0公開 — 新モデルへの対応とメモリ使用量の最適化を実現
ニュース
NVIDIAがQwen3.8-Flash-NextをFP4量子化したモデルをHugging Faceで公開
ニュース
125BモデルのQwen3.8-Flash-Nextを16GB Macで約12 tok/s実行するslotstreamが公開
モデル評価
DeepSeek-V4-Flash-Vision-Exp 評価レポート
リリース
mlx-vlm v0.7.0rc0 公開 — Qwen3.8-Flash-Next の MTP 対応と多数のバグ修正
リリース
llama-cpp b10712 公開 — Vulkan top-k 高速化と n-gram 生成速度向上
リリース
koboldcpp v1.120 公開 — DirectIO 対応と新モデル追加、複数バグ修正
リリース
ollama v0.33.2 公開 — ダークモード復元と MLX 機能追加
リリース
mlx-vlm v0.6.16〜17 公開 — 新モデル対応と Metal リソースリーク修正
ニュース
Qwen3.8-Flash-Nextの重みを公開、Qwen4アーキテクチャの早期プレビューとして