PerplexityがAppleシリコン向け推論エンジン「Lily」をオープンソース化、ローカルAI活用が加速へ

生成AI検索サービスを展開するPerplexityが、Appleシリコン向けに最適化したローカル推論エンジン「Lily(リリー)」をオープンソースとして公開しました。クラウドと端末内処理を組み合わせる「ハイブリッド計算」を前提に設計されており、MacなどのAppleデバイスでのAI処理を高速かつスムーズに行うことを狙います。

Lilyとは何か:Perplexity Computerを支えるローカル推論エンジン

Appleシリコンに特化した「ハイブリッド計算」用エンジン

Lilyは、Perplexityが自社の「Perplexity Computer」向けに開発したローカル推論エンジンで、クラウド側の大規模モデルと、ユーザー端末上で動作するローカルモデルを組み合わせて処理する「ハイブリッド計算」を前提に設計されています。これにより、完全クラウド型と比べて応答の遅延を抑えつつ、プライバシーにも配慮したAI活用を実現しやすくなります。

Qwen3.6-35B-A3B向けに最適化

Lilyは、Alibaba系の大規模言語モデル「Qwen」シリーズの一つである「Qwen3.6-35B-A3B」に特化して最適化されています。35B(350億)パラメータ級のモデルは通常クラウド上で動かすことが多いサイズですが、Appleシリコン向けに工夫することで、手元のMac上でも実用的な速度で推論を行えるように設計されている点が特徴です。

「Computerタスク」でボトルネックにならない設計

PerplexityはX(旧Twitter)の投稿で、Lilyが「Computerタスクにおいて、オンデバイス側の計算がボトルネックにならないように設計されている」と説明しています。つまり、検索や情報要約、ドキュメント操作など、Perplexity Computerが担う複雑な処理の中で、ローカル推論が足を引っ張らないよう、パフォーマンスと効率を重視したアーキテクチャとなっています。

Lilyがもたらすメリット:ユーザー・開発者・企業へのインパクト

ユーザー視点:高速レスポンスとプライバシーの両立

Lilyのようなローカル推論エンジンは、以下のようなユーザー体験の向上につながります。

  • ネットワーク状況に左右されにくい、安定したレスポンス
  • 一部の処理を端末内で完結できることによるプライバシー性の向上
  • クラウド側の負荷軽減による、全体的な応答速度の改善

特に、社外に出せない情報や個人データを扱う際に、ローカルで処理できる範囲が広がることは大きな利点になります。

開発者視点:オープンソースによる再利用と拡張性

Lilyがオープンソースとして公開されたことで、開発者はPerplexityのエンジニアリング成果を自らのアプリケーションやワークフローに取り込むことが可能になります。Appleシリコン向けの最適化ノウハウや、ハイブリッド計算の設計思想を学び、自社サービスに応用できる点は大きな価値と言えるでしょう。

企業視点:コストとリスクを抑えたAI導入

企業にとっても、ローカル推論エンジンの成熟は、AI導入の選択肢を広げる要因となります。クラウドのみで大規模モデルを動かす場合と比べて、

  • クラウド利用料の抑制(ローカルで処理できる分だけコスト削減)
  • ネットワーク障害やリージョン障害に対するレジリエンス向上
  • データの社外持ち出しを最小限に抑えることで、コンプライアンスリスクを軽減

といった効果が期待できます。特にAppleシリコン搭載のMacを標準端末として採用している企業にとっては、既存のハードウェア資産をより有効に活かせる可能性があります。

今後の展望:ハイブリッドAIコンピューティングの加速

ローカル×クラウドの「いいとこ取り」へ

Lilyの登場は、AIの計算を「すべてクラウドで行う」時代から、「クラウドとローカルを状況に応じて使い分ける」時代へとシフトしていることを象徴しています。高負荷な推論や大規模な検索はクラウドで、ユーザー固有のデータやリアルタイム性が求められる処理はローカルで、といった役割分担が今後さらに進むでしょう。

Appleシリコン最適化のベースラインとしてのLily

Appleシリコンは、Mシリーズチップを軸にGPUやNeural EngineなどAI処理向けのハードウェアを強化し続けています。Lilyは、そのポテンシャルを引き出すための一つの「ベースライン実装」として、今後のローカルAIアプリ開発の参考例になる可能性があります。同時に、他のモデルやフレームワークへの展開・移植を通じて、Appleデバイス上で動くAIのエコシステム拡大にもつながると考えられます。

まとめ

Perplexityがオープンソース化したLilyは、Appleシリコン上でのローカル推論を高速化し、クラウドと組み合わせるハイブリッドAIコンピューティングを実現する重要なピースとなり得ます。ユーザーにとっては快適でプライバシーに配慮したAI体験を、開発者・企業にとってはコストとリスクを抑えたAI活用の道筋を示す存在と言えるでしょう。今後、具体的な実装事例やコミュニティからの改良が進むことで、ローカルAIの可能性はさらに広がっていきそうです。

参考リンク