지난 2월에 Perplexity Computer가 데뷔했습니다. Claude Cowork와 마찬가지로 웹은 물론 PC의 파일과 앱을 사용하여 자동으로 작업을 완료할 수 있는 AI 에이전트 제품군입니다. 그 이후로 플랫폼은 Mac용 개인용 컴퓨터를 포함하여 몇 가지 다른 제품을 포함하도록 발전했으며 오늘날 Perplexity는 Hybrid Compute라는 파생물을 발표했습니다.
새로운 도구를 사용하면 Opus 5 또는 GPT-5.6 Sol과 같은 최첨단 클라우드 기반 모델과 컴퓨터에서 실행되는 로컬 LLM 간에 작업을 분할할 수 있습니다. 즉, 로컬 모델이 중요한 정보를 처리하여 컴퓨터에서 안전하게 유지되도록 할 수 있다는 것입니다. Perplexity는 하이브리드 컴퓨팅이 적합한 몇 가지 다양한 사용 사례를 제안합니다. 예를 들어, 변호사는 현재 진행 중인 사건을 기존 판례법과 비교하는 개요를 준비하고 싶을 수 있습니다. 이 시나리오에서는 도구를 사용하여 고객의 데이터를 기밀로 유지할 수 있습니다. Perplexity는 또한 알뜰한 사용자가 (일반적으로 더 비싼) 프론티어 모델에서 일부 작업을 오프로드하여 추론 비용을 절약할 수 있는 방법으로 하이브리드 컴퓨팅을 제시하고 있습니다.
Perplexity의 모든 Mac 제품을 감독하는 Jon Staff는 “이것은 Mac 앱에 직접 통합되어 있습니다. 파일을 업로드하거나 정보를 보내려고 할 때마다 우리는 민감한 콘텐츠를 자동으로 확인하고 해당 데이터를 클라우드에 공유할지 확인합니다”라고 말했습니다. 이번 릴리스의 일부로 회사는 사용자가 컴퓨터에 보관해야 하는 파일과 정보를 자동으로 제안하는 새로운 개인 정보 분류자를 교육했습니다.
하이브리드 컴퓨팅이 여러 모델 간에 작업을 위임하기 전에 어떤 파일을 제외할지 살펴보고 중요한 내용을 놓치지 않았는지 다시 확인할 수 있습니다. 이 단계에서는 작업을 수행할 모델을 결정할 수도 있습니다. 로컬 측면에서는 Gemma E4B와 Qwen의 350억 매개변수 3.6 모델의 두 가지 옵션이 있습니다. 이러한 변형 중 하나는 Perplexity에 의해 사후 훈련되었습니다. 회사는 앞으로 더 많은 현지 모델을 제공할 것이라고 밝혔습니다. 어떤 옵션을 선택하든 로컬 모델을 설치할 때 Mac 터미널을 열 필요가 없으며 Perplexity의 앱이 설치 프로세스를 처리합니다.

시스템이 진행되면 로컬 CPU, GPU 및 메모리 사용량을 표시하는 시각화가 표시됩니다. 그 옆에 있는 사이드바에는 작업에서 사용한 토큰 수가 표시됩니다. 로컬 모델이 개인 컴퓨터에서 생성하는 토큰에 대해서는 요금이 부과되지 않습니다. 시스템이 출력을 생성하면 평소대로 후속 지침을 작성할 수 있습니다. iPhone을 사용하여 작업을 대기열에 추가할 수도 있습니다.
나는 Perplexity가 완전한 클라우드 시스템의 출력에 대해 생성된 하이브리드 컴퓨팅 출력을 벤치마킹했는지 직원에게 물었습니다. “짧은 대답은 완전히 개척된 결과물이 원시 유물 생성 측면에서 거의 항상 더 좋을 것이라는 것입니다. 비용이 더 많이 들고 성능도 더 좋습니다.”라고 그는 말했습니다. 그러나 스태프는 일부 사용자는 작업을 수행하기 위해 가장 강력하고 강력한 AI 모델에 액세스할 필요가 없으며 이러한 경우 데이터 개인 정보 보호 및 비용이 더 중요한 요소일 수 있다고 덧붙였습니다.
“저는 이것이 슬라이딩 스케일이어야 한다고 생각하며, 우리는 사용자가 원하는 특정 유형의 작업에 대해 슬라이딩 스케일의 위치를 제어할 수 있기를 원합니다. 분명히 우리는 상황에 따라 가장 좋은 것을 제안하려고 노력할 것이지만 궁극적으로 사용자는 자신에게 적합한 솔루션을 결정할 수 있어야 합니다.”라고 직원은 말했습니다.
당분간 하이브리드 컴퓨팅은 macOS 15를 실행하는 Apple Silicon Mac에서만 사용할 수 있으며 Perplexity에서는 통합 메모리가 32GB 이상인 시스템을 권장합니다. 이 기능은 Pro 및 Max 가입자는 물론 회사의 기업 고객도 사용할 수 있습니다.
관련 정보는 아래 링크에서 확인하세요