huihui-ai、Kolibri-1の無検閲GGUF版を公開 llama.cppパッチ必須

スペック

ライセンスapache-2.0
重みの公開GGUF
配布形式・量子化GGUF, Q4_K_M

メモリの目安はパラメータ数×0.6バイトの概算で、実際はコンテキスト長と実装で変わります

huihui-aiは、Aleph-Alpha/Kolibri-1をabliterationで無検閲化したHuihui-Kolibri-1-abliterated-GGUFをHugging Faceで公開しています。標準のllama.cppはkolibri1アーキテクチャに未対応のため、同梱パッチをupstream commit 836d571に当てて使います。

huihui.aiは、応答の拒否を減らすabliterationを適用した言語モデルの改変版をHugging Faceで配布する開発者アカウントです。

何が新しいか

huihui-aiはabliterationをTransformersを使わず、llama.cppのGGUFモデルだけで実施しました。具体的な手法はllama.cppのcvector-generatorのREADMEを参照するよう案内しています。GGUFはHob-forge/Kolibri-1-GGUF由来で、ライセンスはapache-2.0、量子化はQ4_K_Mです。タグにはreasoning、moeが付いています。

試し方

リポジトリに含まれるkolibri1-llama.cpp.patchを適用してビルドします。

git clone https://github.com/ggml-org/llama.cpp && cd llama.cpp
git checkout 836d571
git am /path/to/kolibri1-llama.cpp.patch
cmake -B build -DCMAKE_BUILD_TYPE=Release # GPU利用時は -DGGML_CUDA=ON などを追加
cmake --build build -j --target llama-server llama-cli

実行例はコンテキスト長262144です。

llama-cli -m huihui-ai/Huihui-Kolibri-1-abliterated-GGUF/Huihui-Kolibri-1-abliterated-Q4_K_M.gguf -c 262144

利用上の注意

モデルカードによると、このモデルは安全性フィルタリングが大幅に削減され、厳密な安全性最適化を受けていません。機微・物議を醸す・不適切な出力を生成する可能性があり、公開の場、未成年ユーザー、高いセキュリティが必要な用途には適さない可能性があります。huihui-aiは研究、テスト、管理された環境での利用を推奨し、本番や一般公開の商用用途を避けること、出力のリアルタイム監視と必要に応じた手動レビューを求めています。法令・倫理基準への適合と結果の責任は利用者が負うとしています。

この記事の固有名詞

コメント (0)

まだコメントはありません。

コメントを書く

2000文字以内