huihui-aiは、Qwen/Qwen3.8-Flash-Nextをabliterationで改変し拒否応答を低減した非検閲版モデル huihui-ai/Huihui-Qwen3.8-Flash-Next-abliterated をHugging Faceで公開しました。huihui.aiはHugging Faceで言語モデルの改変版を公開する開発者アカウントで、abliterationを適用したモデルを配布しています。
何が新しいか
ベースモデルは Qwen/Qwen3.8-Flash-Next で、pipeline_tagは image-text-to-text、ライセンスは other です。作成者は、TransformerLensを使わずにLLMから拒否応答を除去する「粗い概念実証実装」だと説明しています。手法の詳細は remove-refusals-with-transformers を参照するよう案内しています。モデルカードによると、このモデルのアブレーションは寄付によって実施され、全員向けに公開されました。
利用条件と注意点
モデルカードは次の警告を挙げています。
| 項目 | 内容 |
|---|---|
| 出力リスク | 安全フィルタリングが大幅に低減され、敏感・物議を醸す・不適切な出力を生成する可能性がある |
| 対象 | 公開環境、未成年者、高いセキュリティを要する用途には適さない可能性がある |
| 責任 | 利用者は現地法と倫理基準を順守し、生成内容の結果に責任を負う |
| 推奨用途 | 研究・テスト・管理された環境。本番や一般公開の商用アプリでの直接利用は避ける |
| 監視 | リアルタイム監視と必要に応じた手動レビューを強く推奨 |
| 安全保証 | 厳格な安全最適化を受けておらず、デフォルトの安全保証はない |
huihui.aiは、利用によって生じた結果について責任を負わないとしています。

まだコメントはありません。