Microsoftは2026年10月7日、エージェントをローカルとクラウドの両方で実行する「ハイブリッドインテリジェンス」の基盤としてWindowsを構築する方針を発表し、Windows 11向けにMicrosoft Execution Containers(MXC)を一般提供しました。あわせて、総137B・活性6.8BのMAI Code 1.1 Flashを3-bit量子化でローカル実行可能にすると説明しています。発表記事はWindows + Devices担当エグゼクティブ・バイス・プレジデントのPavan Davuluri氏が執筆しました。
MXCでエージェントのアクセスを実行時に制御
MXCは、エージェントがアクセスできるファイルとネットワークを定義し、そのポリシーを実行時に適用する仕組みです。封じ込め方式として、プロセスおよびセッション分離、WSLc、仮想マシン、Windows 365 for Agentsに対応します。Microsoftは、プロンプトやツール呼び出しごとに封じ込めの要件が変わるエージェントには従来のサンドボックスが合わないと説明しています。
対応済みのエージェントは、OpenAIのCodex、GitHub Copilot、OpenClaw、Replit、LM Studio、NVIDIAのOpenShell、Unsloth AIです。Anthropic Claude Code、Hermes Agent by Nous Research、Perplexity、Raycastなども今後対応予定とされています。CodexはOpenAIが提供するコーディングエージェントです。
組織向けには、MXCによる封じ込め、エージェントの識別、Agent 365やIntuneとの連携による管理を組み合わせ、アクセス・活動・ポリシーを統制できるようにします。
ローカルモデルの仕様
| モデル | パラメータ | 量子化・メモリ | その他 |
|---|---|---|---|
| MAI Code 1.1 Flash | 総137B / 活性6.8B | 3-bit(サイズ約80%削減) | ローカルで256Kコンテキスト |
| NVIDIA次期Nemotron | 70B超 | 2-bit、20GB強 | — |
| DeepSeek V4 Flash | 284B | — | — |
これらのモデルはRTX Spark上でのローカル実行を想定しています。Surface Laptop Ultra(NVIDIA RTX Spark搭載)は同日予約開始です。
試し方・提供条件
- MXC: Windows 11で一般提供。
- GitHub HydraFusion: タスクをクラウドと端末上のモデルに振り分けるルーティング。GitHub Copilot app、GitHub Copilot CLI、Visual Studio Codeで10月下旬にexperimental previewとして提供予定。
- Windows ML: GPU、NPU、CPUにモデルを展開するランタイムで、新たに
llama.cppをサポートし、オープンソースモデルを利用・実験できます。 - OpenClaw: ミニデスクトップPC向けに、WindowsネイティブゲートウェイとMXC統合を備えた数クリックの簡易セットアップを提供します。
- Copilot: Copilot+ PCsで今後数か月以内に順次提供。ユーザーの許可のもと、PC上のファイルや最近のアクティビティを参照するローカルコンテキスト、ファイル整理・診断・トラブルシューティング・コーディングなどのローカル操作、ローカルモデルの利用に対応します。
背景と狙い
Microsoftは、モデルの大型化で顧客のニーズがクラウド予算を上回りつつあるとし、ローカルで動かせる処理は端末上で、必要な場合はクラウドで実行することでトークン消費とコストを抑える狙いを説明しています。Copilot+ PCでは月間2兆回超の推論がローカルで実行され、企業向けに製造されるノートPCの40%超がCopilot+ PCだとしています。

まだコメントはありません。