---
title: "カバンのMacに「秘書」が来た。PerplexityがHybrid Compute対応、独自モデルも公開"
description: "NVIDIA機で先行したComputerのローカルAI活用がMacへ。Hybrid Computeの対応条件、公式に公開されたモデル重み、そして「自分の資料のそばで働く秘書」の意味を追う"
url: https://itpostjp.com/ai/perplexity-hybrid-compute-mac-local-model/
category: "AI・生成AI"
published_at: 2026-09-07T16:31:17Z
updated_at: 2026-09-07T16:31:17Z
author: "IT Post編集部"
editor: "編集長 千田智也"
publisher: "IT Post by Rice Studio Lab"
language: ja-JP
ai_generated: true
ai_model: gpt-6
terms: ["AIエージェント", "クラウド", "大規模言語モデル（LLM）"]
---

# カバンのMacに「秘書」が来た。PerplexityがHybrid Compute対応、独自モデルも公開

IT Post編集部 ＆ 編集長 千田智也

NVIDIA機で先行したComputerのローカルAI活用がMacへ。Hybrid Computeの対応条件、公式に公開されたモデル重み、そして「自分の資料のそばで働く秘書」の意味を追う

## 30秒で分かる結論

Perplexityは2026年9月1日、Mac内のAIとクラウドのAIが仕事を分担する「Hybrid Compute on Mac」を発表しました。対応するMacでは、機密ファイルを扱う処理を端末側に置きながら、ウェブ調査や高度な推論をクラウドに任せられます。Perplexity製モデルも選択肢に加わり、同社の公式Hugging FaceではComputer向けモデルの重みファイルも公開されています。利用条件はApple silicon、macOS 15以降、ユニファイドメモリ24GB以上と対象の有料プランです。

## まず初めに

これは大きい。IT Postでは、今回のMac対応を「いつものカバンに、仕事を手伝う秘書の席ができた」変化だと考える。立派なAIを呼び出すために、こちらが資料を集め、読ませてよい部分を切り出し、せっせと運ぶ。秘書を雇ったはずなのに、なぜか自分が秘書の世話係。そんな妙な主従関係を、ひっくり返す方向へ進んだ。

しかも入口は、NVIDIAの専用機だけではなくなった。条件を満たせば、普段使うMacが参加する。パソコンに「AI対応」の札を貼って満足する話より、よほど中身がある。もちろん、カバンを閉じた瞬間から万能の秘書が働き続ける、という魔法ではない。それでも、自分の資料のそばでAIが働く。その距離の変化は大事件だ。※個人の感想です

![ノートパソコンと書類を描いた挿絵](/images/articles/perplexity-hybrid-compute-mac-local-model-inline-1.webp)

## 何が変わったのか。Macの中にもAIの実行場所ができた

今回のHybrid Computeは、AIエージェント「Perplexity Computer」の仕事を、端末とクラウドに分ける仕組みです。AIエージェントとは、目標に向けて複数の作業を進めるAIのこと。ローカルとは手元の端末、推論とは学習済みモデルを動かして出力を得る処理を指します。

新機能では、Macにローカルモデルをダウンロードして利用します。単にMacからクラウドAIへ指示を送ることと、Mac自身がモデルを実行することは別です。今回、Perplexityは後者をComputerの一連の作業に組み込みました。

公式案内の対応条件は次の通りです。

| 項目 | Hybrid Compute on Macの条件 |
| --- | --- |
| チップ | Apple silicon |
| OS | macOS 15以降 |
| メモリ | ユニファイドメモリ24GB以上 |
| 契約 | Perplexity Pro・Max・Enterprise |
| 開始方法 | 最新Macアプリでモデルを取得し、モデル選択でHybridとローカル・クラウドの各モデルを選択 |

Intel Macやメモリ8GB・16GBのMacは、この公表条件に入りません。最新機種への買い替えを一律に求める条件でもありません。Apple siliconとメモリ容量などの条件で判断する必要があります。

## NVIDIA版との違い。「初めてMacで使える」とは少し違う

Perplexityは8月25日、NVIDIA DGX Spark向けに「Portable Computer」を発表していました。こちらは、作業を振り分ける仕組みやモデル、ツールなどを端末で動かすローカル主体の製品です。必要な場合は、利用者の許可を得てクラウドへ処理を引き継ぎます。

NVIDIAの9月3日付公式ブログでは、Linuxと24GB以上のVRAMを備えたNVIDIA RTX GPUでもPortable Computerが利用可能とされています。ここでのVRAMはGPU用のメモリです。Macのユニファイドメモリと、数字だけを見て同じ条件と解釈することはできません。

一方、Macのファイルやツールと連携する「Personal Computer」は、今回より前から存在しました。したがって、今回を「Perplexityが初めてMacを操作できるようになった」と表現するのは不正確です。

変化は、NVIDIA機で先行していたComputerのローカルAI活用が、MacではHybrid Computeという形で広がったことです。Portable Computerの完全な同一機能版がそのままMacへ移植された、という発表ではありません。*名前が似た製品が増えてきたので、名札より仕事の分担を見た方が早い。*

![ノートパソコンとクラウドを描いた挿絵](/images/articles/perplexity-hybrid-compute-mac-local-model-inline-2.webp)

## Perplexity製モデルも公開。重みファイルの実在を確認

Hybrid Computeの公式発表は、ローカルモデルとしてGemma 4 E4B、Qwen3.6 35B-A3B、Perplexityモデルの3つを挙げています。同社はComputer向けに追加学習した小型のローカルモデルを案内しています。

さらにIT Postは9月8日（日本時間）、Hugging Faceの認証済みPerplexity公式アカウントで、次の公開リポジトリを確認しました。

`perplexity-ai/pplx-computer-qwen-3-6-35b-a3b-mlx-20260709`

掲載情報は35B規模、MLX形式、4ビット精度で、ファイル一覧には4分割されたSafetensors形式のモデル重み、設定ファイル、トークナイザーが存在します。ページ上の容量表示は約19.5GBです。これは単に製品名を発表した状態とは異なり、モデルを構成するファイルを公開していることが確認できます。

大規模言語モデル（LLM）の「重み」とは、学習結果を数値として保存したものです。これを対応する実行ソフトに読み込ませることで、手元の環境でモデルを動かす土台になります。ただし、ファイル容量は実行時に必要なメモリ総量を意味しません。会話の長さや実行ソフトなどによって、追加のメモリも使います。

この公開リポジトリは、詳細なモデル説明の本文が空欄で、学習内容や評価、日本語性能を十分に説明したモデルカードは確認できませんでした。アプリ内の「Perplexityモデル」とこの公開ファイルが、現時点でどの版まで一致するかも、名称だけでは断定できません。ゼロから独自設計した基盤モデルだとしたり、自由な再配布・商用利用まで無条件に保証されたとしたりする根拠はありません。**Computer向けのモデル重みが公式に公開されていること**と、詳細仕様・利用条件は分けて確認する必要があります。

## 外に出す情報を選ぶ「Privacy Gate」もローカルで動く

この分担を支えるのが、送信前の情報を確認する「Privacy Gate」です。Perplexityの技術解説では、個人を識別できる情報を検出し、端末に残す、該当箇所を伏せる、送信前に承認を求める、といった処理につなげます。

同社は検出用の0.6Bモデル「PII-Tracer」と評価用の「PII-TRACE」も説明しています。こちらは文章を生成して仕事を進めるComputer向けモデルとは役割が異なります。個人情報らしい文字列の位置を検出し、その結果を受けてアプリ側が送信ルールを適用する構成です。

技術解説は、長い会話で同じ個人情報が繰り返されると、1か所の見落としでも情報が外へ出る可能性があると明記しています。IT Postでは、これを「何を入れても絶対に漏れない」という保証とは捉えていません。保護機構の存在と、検出が完全であることは別だからです。

本記事は公式仕様と公開ファイルの確認に基づくもので、日本語の機密文書を使った送信制御や、実機の処理速度・電池持ちを検証したレビューではありません。

![ノートパソコンとクラウドと書類を描いた挿絵](/images/articles/perplexity-hybrid-compute-mac-local-model-inline-3.webp)

## 推論エンジン「Lily」も公開。ただし対応条件は別

Perplexityは、Apple silicon向け推論エンジン「Lily」のコードも公式GitHubで公開しています。これはモデルそのものではなく、モデルを実行するソフトです。RustとMetalを利用し、Qwen3.6-35B-A3Bの特定の4ビット形式を対象にしています。

9月8日時点で確認したREADMEは、M5以降に相当するApple GPU family 10以降、macOS 26以降などを要求しています。一般利用者向けHybrid Computeの「macOS 15以降」という条件と、公開版Lilyを自分で動かす条件は同一ではありません。LilyのライセンスはApache-2.0と明記されていますが、それを別のモデル重みの利用条件へそのまま当てはめることもできません。

## IT Postの見方——「一人一人のカバンに秘書」の入口だ

IT Postでは、この発表の核心は、AIに自分の仕事を渡すまでの手間を減らせる点にあると考える。

例えば、小さな会社の営業担当者を想像してほしい。手元には過去の見積もりや打ち合わせメモがあり、外には市場情報や競合の公開資料がある。頼みたいのは「この案件の提案を詰めておいて」だ。ところが、資料をどこまで渡せるか判断し、あちこちへ貼り付け、回答をまた手元へ戻していたら、それだけで朝が終わる。秘書への説明資料を作るために、もう一人秘書が必要になる。笑えない。

Hybridの方向性が面白いのは、その往復を一つの仕事として扱おうとしているところだ。外を調べる力と、手元の事情を読む力。その両方がつながって、初めて「自分の仕事が分かる助手」に近づく。上の営業の例はIT Postが考える活用像であり、実機で完遂を確認した事例ではない。それでも、どこを目指している技術なのかは伝わるはずだ。

そしてMac対応だ。専用の計算機を買って、設置して、管理する。その段階で足が止まっていた人にも、手持ちの条件に合うMacから試す道ができた。IT Postでは、この入口の広がりを高く評価する。AIの進歩は性能表の小数点だけで決まらない。いつもの机、いつもの資料、いつもの一台へ降りてきた時に、生活との接点が生まれる。

「一人一人のカバンに秘書が来た」という言葉は、その変化を表す比喩だ。ただし、誰のMacでも動くわけではない。MacBookを閉じてスリープさせたまま働き続けることまで、今回の発表が約束したわけでもない。Perplexityが案内する外出先からの使い方には、稼働させたMac miniをiPhoneから遠隔操作する形もある。ポケットのiPhone自身が、このローカルモデルを実行するという意味ではない。

それでも、これは時代が変わる入口だとIT Postでは考える。自分の事情を読ませるために、すべてを遠くへ運ばなくてもよい。自分の道具の中で、仕事の一部を任せられる。パーソナルコンピューターの「パーソナル」が、ようやく助手の働き方にまで踏み込んできた。

モデルを配る。実行ソフトを公開する。普段のMacを仕事の分担に加える。派手なデモの拍手だけでは終わらせない材料が並んだ。あとは、毎日の面倒をどれだけ片付けるかだ。次に見届けたいのは性能表の王冠ではない。夕方、机に残る仕事が本当に減っているか。その変化が積み重なれば、「AIを使う」は特別な行為でなくなる。カバンからパソコンを出す、その続きになる。

![ノートパソコンと書類を描いた挿絵](/images/articles/perplexity-hybrid-compute-mac-local-model-inline-4.webp)

## 情報源

- [Introducing Hybrid Compute on Mac](https://www.perplexity.ai/en-GB/hub/blog/introducing-hybrid-compute-on-mac) — Perplexity（一次情報）
- [Introducing Portable Computer](https://www.perplexity.ai/en-GB/hub/blog/introducing-portable-computer-for-local-first-ai) — Perplexity（一次情報）
- [Sparks Fly: NVIDIA Accelerates Local AI at IFA 2026](https://blogs.nvidia.com/blog/local-ai-ifa-next-gen-agents-nv-pair-rtx-spark/) — NVIDIA（一次情報）
- [Perplexity Computer Qwen3.6 35B-A3B MLX 公開モデル](https://huggingface.co/perplexity-ai/pplx-computer-qwen-3-6-35b-a3b-mlx-20260709) — Perplexity / Hugging Face（一次情報）
- [Perplexity Computer Qwen3.6 35B-A3B MLX 重みファイル一覧](https://huggingface.co/perplexity-ai/pplx-computer-qwen-3-6-35b-a3b-mlx-20260709/tree/main) — Perplexity / Hugging Face（一次情報）
- [PII-TRACE: Detecting Personal Data Before It Leaves a Device](https://www.perplexity.ai/en-GB/hub/blog/pii-trace-detecting-personal-data-before-it-leaves-the-device) — Perplexity（一次情報）
- [Lily: Apple silicon向け推論エンジン README](https://github.com/perplexityai/pplx-garden/tree/main/lily) — Perplexity / GitHub（一次情報）
- [Perplexity can now split your tasks between the cloud and local AI](https://www.androidauthority.com/perplexity-hybrid-compute-3705883/) — Android Authority

## この記事に出てくるIT用語

- [AIエージェント](https://itpostjp.com/terms/ai-agent/): 与えられた目標に向けて、AIが自ら計画を立て、複数の作業を連続して実行する仕組みのことです。
- [クラウド](https://itpostjp.com/terms/cloud-computing/): 自分の機器ではなく、インターネットの先にあるコンピューターを借りて使う仕組みです。
- [大規模言語モデル（LLM）](https://itpostjp.com/terms/large-language-model/): 大量の文章から言葉のつながりを学習した、文章を扱うAIの中核技術です。

---

この記事は、公開情報と出典URLの検証、文章作成の一部に生成AIを使用しています。内容の責任はIT Post by Rice Studio Labが負います。

出典表記: IT Post by Rice Studio Lab — https://itpostjp.com/ai/perplexity-hybrid-compute-mac-local-model/
