ローカル推論
Apple のネイティブな MLX Swift フレームワークによる、プロセス内での高速実行。プロンプトもデータも Mac の外へ出ません。
macOS ネイティブアプリケーション
ローカルの AI モデル(Llama、Qwen)を Mac で完全オフラインに動かします。Apple Silicon 専用に作られたこのメニューバー常駐ユーティリティは、高速なローカル推論エンジンを、ショートカット、macOS のサービス、内蔵のフローティングチャットを通じてシステム全体に開放します。
機能
Apple のネイティブな MLX Swift フレームワークによる、プロセス内での高速実行。プロンプトもデータも Mac の外へ出ません。
Apple の「ショートカット」App の中で AI への問い合わせを直接呼び出し、つなげて、作業を自動化できます。
Safari、Xcode、メールでテキストを選び、右クリックして、モデルの出力にその場で置き換えられます(書き直し、要約、翻訳)。
複数ターンの履歴を持つ独立したチャットウインドウで、読み込んだモデルと手早くやり取りできます。
一定時間使われなければモデルを自動的に解放し、Metal のキャッシュも消して、ユニファイドメモリを macOS に返します。
Hugging Face Hub の ID を入力すれば自動でモデルをダウンロードでき、手元の重みのフォルダを指定することもできます。
自動化
LocalModel Bridge はシステム全体で使える AppIntents を提供し、オフライン推論をなめらかに制御できます。
プロンプトをローカルのモデルへ送り、生成された文章をそのままショートカットの中で受け取ります。
繰り返しの作業の前に、モデルのプロファイルをバックグラウンドで読み込んでメモリを温めておけます。
自動処理が終わり次第モデルを解放し、Mac のユニファイドメモリをただちに空けられます。
データのプライバシー
プロンプト、処理した書類、チャットは、いずれもコンピューターの外へ出ません。推論はローカルで、オフラインに行われます。
モデルの処理は、Metal のシェーダーを使って Apple Silicon のコア上でプロセス内実行されます。外部のクラウドサーバーは関わりません。
ネットワークの利用は、あなたが自分で始めた Hugging Face のモデルのダウンロードと、ローカルホストの API に厳密に限られます。
利用データ、プロンプト、選んだモデルのいずれも、アプリが収集・監視・送信することはありません。
安全性の保証:アカウントなしで完全にオフラインに動き、モデルをダウンロードしたあとはインターネット接続を必要としません。
プライバシーポリシーの全文を読む →サポート
モデルファイルの設定、ショートカットの用意、ローカル API サーバーの導入について、お手伝いします。
サポートとよくある質問を見る →