モデルNEW
Llama
Metaが開発し、モデルの重みを公開する大規模言語モデルのファミリー。開発者や研究者、企業が生成AIの実験やアプリケーション開発に利用できる。公式リポジトリにはモデルカード、利用許諾、重みとトークナイザーの取得方法、モデルを実行するための手順がまとめられている。
関連記事
ローカルLLM
Magnitude、端末上でカーネル調整しllama.cpp比最大2倍の推論
ローカルLLM
Tetra、Leech格子量子化を2.148 bits/weightでサービング
ローカルLLM
llama.cppのprompt lookup drafting、最適化で最大140倍高速化
ローカルLLM
bartowski、jebadiah-9b-v2のGGUF量子化版を公開 Q4_K_Mは5.98GB
ハードウェア
AMD Quark、Strix HaloでQwen3.6-35B-A3Bを70GBから21GBへ量子化
ハードウェア
AMD、MLPerf Inference v6.1で72基のMI355Xによるgpt-oss-120b結果を提出
ローカルLLM
llama.cpp、Hexagonバックエンドに複数デバイスへのrow-split分割を追加
モデル
Liquid AI、日本語向けLFM2.5-1.2BのGGUF版を公開
ツール・開発
llama.cpp、mtmdにビデオID伝播機能を導入
ローカルLLM
Qwen3.8-27Bを3推論エンジンで比較
ツール・開発
llama.cpp 0.4.0がリリース、推論制御を拡充
ツール・開発
llama_print_build_infoが出力先指定に対応
ローカルLLM
Qwen3.8-Flash-Nextの分割推論で速度改善
ハードウェア
llama.cppでQwen3.8-Flash-Nextを性能検証
ツール・開発
llama.cpp、旧macOS向けRPC修正のPRを公開
関連ヘッドライン(過去7日)
- 研究
PanoVLNがパノラマ観測で視覚言語ナビゲーションを改善HF Daily Papers
