Ollama v0.40.0、Apple Silicon上でMLXランタイムを既定に

Ollamaはv0.40.0で、Apple Siliconデバイス上ではMLXランタイムが対応するモデルアーキテクチャを自動的にMLXで実行するようにしました。実行例としてqwen3.8を挙げ、追加モデルとしてgemma4、qwen3.6、qwen3.5、意思決定モデルとしてNimble、tev1、clef、clef-flashがMLXで利用できるとしています。

OllamaはOllamaプロジェクトが開発する、オープンなAIモデルを実行・管理するツールです。MLXはAppleの機械学習研究チームが開発する、Appleシリコン向けの配列計算フレームワークです。

何が変わったか

v0.40.0では、Apple Silicon上でMLXランタイムが対応するモデルアーキテクチャについて、OllamaがデフォルトでMLXを使って実行します。

MLXで利用できるモデル

区分 モデル
実行例 qwen3.8
追加モデル gemma4、qwen3.6、qwen3.5
意思決定モデル Nimble、tev1、clef、clef-flash

試し方

Apple Siliconデバイスで次のコマンドを実行します。

ollama pull qwen3.8
ollama run qwen3.8

今後

Ollamaは、さらに多くのモデルのテストと有効化を続けるとしています。変更履歴の比較範囲はv0.34.4...v0.40.0-rc3です。

この記事の固有名詞

コメント (0)

まだコメントはありません。

コメントを書く

2000文字以内