Perplexityが発表した「Portable Computer」は、オーケストレータLLM・サブエージェントLLM・エージェントハーネスまで、エージェントの全ランタイムをNVIDIAのローカルハードウェア上で完結させる。既定でクラウドに一切依存せず、ローカルで完結する処理にはトークン課金が発生しない——AIエージェントの利用コストを、使うたびに積み上がる従量課金から、ハードウェアの買い切りへと置き換える設計だ。

エージェントを日常的に多用する開発者・実務者にとっての効き目は明確だ。タスクを回すたびにクラウド側のトークン消費量を気にする必要がなくなり、コストの上限は手元のハードウェアの処理能力そのものに移る。推論コストの高騰が業界全体で懸念され始めている中、Portable Computerはクラウド従量課金に依存しないアーキテクチャを実務レベルで提示した具体例のひとつになる。コストの重心が「使った分だけ払うクラウド」から「先に買い切るハードウェア」へ移るとき、AIエージェント運用の意思決定基準もまた、月々の請求額ではなく手元マシンの性能でどこまで賄えるかという計算に変わっていく。

何が起きたか

Perplexityは2026年8月25日、NVIDIAと提携し、既存のエージェント基盤「Perplexity Computer」の完全ローカル版「Portable Computer」を発表した。Perplexity公式Xの発表文によれば、オーケストレータLLM、サブエージェントLLM、エージェントハーネスまで含めた全ランタイムがユーザーのローカルハードウェア上で動作し、クラウドへの依存が一切ない設計になっている。

仕組み・詳細

NVIDIA公式ブログは、Portable Computerについて「トークン制限にカウントされないローカルかつプライベートなワークフローを可能にする」と説明しており、ローカルで完結する処理にはトークン課金が発生しない。既定では、使用するモデル・ユーザーデータ・作業内容はすべてローカル機器内に留まる。

発表時点の対応ハードウェアはNVIDIA DGX Spark(GB10搭載機)が中心である。一部の報道はRTX GPU・VRAM24GB以上でも発表時点で動作すると伝えているが、NVIDIA公式ブログは同じ発表について「GeForce RTXおよびRTX PROへの対応は近日公開(coming soon)」と明記しており、発表時点で確実に動作する主対応ハードウェアはDGX Sparkにとどまる。Windows対応についても、NVIDIA公式ブログは「Perplexityは現在Windowsおよび DGX Station への対応にも取り組んでいる」と説明しており、発表時点では未提供・開発中の段階にある。

なぜ重要か

従来のクラウド型AIエージェントは、使うほど積み上がるトークン課金がコスト構造の中心にあった。Portable Computerは、その課金構造そのものをハードウェアの買い切りへ置き換える提案であり、推論コストの高騰が今後のAI投資判断を左右しうるという業界の懸念に対する、実務レベルでの代替回路のひとつになる。対応ハードウェアが現状DGX Sparkに限られる以上、広く普及するかどうかはRTX GPUなどより一般的なハードウェアへの対応拡大にかかっている。