Ollamaはv0.40.0で、Apple Siliconデバイス上ではMLXランタイムが対応するモデルアーキテクチャを自動的にMLXで実行するようにしました。実行例としてqwen3.8を挙げ、追加モデルとしてgemma4、qwen3.6、qwen3.5、意思決定モデルとしてNimble、tev1、clef、clef-flashがMLXで利用できるとしています。
OllamaはOllamaプロジェクトが開発する、オープンなAIモデルを実行・管理するツールです。MLXはAppleの機械学習研究チームが開発する、Appleシリコン向けの配列計算フレームワークです。
何が変わったか
v0.40.0では、Apple Silicon上でMLXランタイムが対応するモデルアーキテクチャについて、OllamaがデフォルトでMLXを使って実行します。
MLXで利用できるモデル
| 区分 | モデル |
|---|---|
| 実行例 | qwen3.8 |
| 追加モデル | gemma4、qwen3.6、qwen3.5 |
| 意思決定モデル | Nimble、tev1、clef、clef-flash |
試し方
Apple Siliconデバイスで次のコマンドを実行します。
ollama pull qwen3.8
ollama run qwen3.8
今後
Ollamaは、さらに多くのモデルのテストと有効化を続けるとしています。変更履歴の比較範囲はv0.34.4...v0.40.0-rc3です。

まだコメントはありません。