ローカルLLM
Qwen
Alibaba Cloudが開発する大規模言語モデルのファミリー。文章の生成、推論、コード作成、外部ツールの利用、多言語の処理などに対応する。モデルの重みを公開し、密な構造と専門家混合型のモデルを提供するほか、画像などを扱うマルチモーダルモデルも展開している。
関連記事
モデル
Hcompany、GUI・コード・API横断のHolo4を公開 OSWorld 2.0で61.7%
ローカルLLM
Ming-Image-0.1-Design、20.5GBの4bit MLX版が公開
ローカルLLM
mlx-community、Ming-Image-0.1-Design-Layerの4-bit MLX版を20.5GBで公開
ハードウェア
AMD Quark、Strix HaloでQwen3.6-35B-A3Bを70GBから21GBへ量子化
ローカルLLM
LM Studio Bionic、Inco AIのSplash EngineでQwen3.8-27Bが74 tok/s
ツール・開発
LocalAI 4.10.0公開、280PRでフリート運用ダッシュボードとCLIベンチマークを追加
ツール・開発
Unsloth Studio/Desktop、マルチユーザーアカウントとAMD ROCm Dockerイメージを追加
ツール・開発
Unsloth、MTP有効化で推論を最大2倍高速化
ツール・開発
Unsloth、Qwen3.8とGLM-5.3の更新内容を公開
ツール・開発
Perplexity、Mac向け推論サーバ「lily」を公開
ローカルLLM
Qwen3.8-27Bを3推論エンジンで比較
ツール・開発
ExLlamav3が大規模アップデート、新モデルに対応
研究
2x DGX SparkでGLMとDeepSeekのHumanEval比較
モデル
huihui-ai、Qwen3.8系モデルのGGUF版を提供
モデル
Qwen3.8-27B、Wikipediaゲームを6クリックでクリア
ローカルLLM
Qwen3.8-Flash-Nextの分割推論で速度改善
モデル
Qwen3.8 Flash AP Quantsの結果を公開
ツール・開発
Ollamaがクラウド料金を刷新、トークン単価制に
ハードウェア
llama.cppでQwen3.8-Flash-Nextを性能検証
ローカルLLM
SGLang-V100がQwen3.8-Flash-Nextに対応
関連ヘッドライン(過去7日)
- ローカルLLM
bartowskiがQwen3.8-27B-piのGGUF量子化版を公開、28Bパラメータ対応bartowski (HF)
- 政策・セーフティ
huihui-aiがQwen3.8-Flash-Nextの無検閲版をabliterationで公開huihui-ai (HF)
