モデルNEW
GGUF
GGMLプロジェクトで仕様が公開されている、推論用モデルを保存するバイナリ形式。重みなどのテンソルと、読み込みに必要なメタデータを格納する。メモリマッピングによる読み込みや、互換性を保ったメタデータの拡張を想定し、GGMLを使う推論ソフトウェアで利用される。
関連記事
モデル
Hcompany、GUI・コード・API横断のHolo4を公開 OSWorld 2.0で61.7%
ローカルLLM
bartowski、jebadiah-9b-v2のGGUF量子化版を公開 Q4_K_Mは5.98GB
ハードウェア
AMD Quark、Strix HaloでQwen3.6-35B-A3Bを70GBから21GBへ量子化
ツール・開発
Unsloth Studio/Desktop、マルチユーザーアカウントとAMD ROCm Dockerイメージを追加
モデル
Liquid AI、日本語向けLFM2.5-1.2BのGGUF版を公開
ツール・開発
Perplexity、Mac向け推論サーバ「lily」を公開
ローカルLLM
Qwen3.8-27Bを3推論エンジンで比較
モデル
huihui-ai、Qwen3.8系モデルのGGUF版を提供
ハードウェア
llama.cppでQwen3.8-Flash-Nextを性能検証
関連ヘッドライン(過去7日)
- ローカルLLM
bartowskiがQwen3.8-27B-piのGGUF量子化版を公開、28Bパラメータ対応bartowski (HF)
- モデル
bartowskiがGLM-5.3-Flash-BF16のGGUF量子化を公開bartowski (HF)記事
- ローカルLLM
bartowski/OmniJev_OneJev-4B-GGUFを公開、5Bパラメータの画像テキスト対応bartowski (HF)
- ローカルLLM
bartowski/OmniJev_OneJev-0.8B-GGUFを公開、1Bパラメータの画像テキスト対応bartowski (HF)
- ローカルLLM
bartowski/BAAI_AREX-2-GGUFを公開、27Bパラメータの画像テキスト対応bartowski (HF)
- ローカルLLM
Kronumos-Kairos-v2のGGUF量子化版をbartowskiが公開bartowski (HF)
- ローカルLLM
Darwin-27B-RSIのGGUF量子化版をbartowskiが公開bartowski (HF)
- ローカルLLM
bartowskiがOneJev-27BのGGUF量子化を公開、画像とテキスト入力に対応bartowski (HF)
- モデル
Holo4-35B-A3BのGGUF量子化版がリリース、画像入力対応bartowski (HF)
- ローカルLLM
RinggAIの5Bモデルringg-router-e2bをGGUF量子化で公開bartowski (HF)
- 政策・セーフティ
huihui-ai、GLM-5.3-Flashの検閲なし版GGUFを公開huihui-ai (HF)
