Le calcul hybride de Perplexity répartit les tâches sensibles entre le cloud et l’IA locale

1 septembre 2026

De retour en février, Perplexity a dévoilé Perplexity Computer. Tout comme Claude Cowork, il s’agit d’une suite d’agents d’IA capables d’accomplir autonomement des tâches en utilisant le Web, ainsi que des fichiers et des applications sur votre PC. Depuis lors, la plateforme a évolué pour englober plusieurs produits différents, dont Personal Computer pour Mac, et aujourd’hui Perplexity annonce une autre branche appelée Hybrid Compute.

Les nouveaux outils vous permettent de répartir une tâche entre un modèle de frontière, basé sur le cloud, tel Opus 5 ou GPT-5.6 Sol, et un LLM local s’exécutant sur votre ordinateur — l’idée étant que le modèle local peut gérer toute information sensible, afin de rester sûr et sécurisé sur votre machine. Perplexity propose plusieurs cas d’usage où Hybrid Compute serait bien adapté. Par exemple, un avocat pourrait vouloir préparer un mémoire qui compare l’affaire sur laquelle il travaille avec la jurisprudence existante. Dans ce scénario, l’outil lui permettrait de garder les données de son client confidentielles. Perplexity présente également Hybrid Compute comme un moyen pour les utilisateurs économes d’économiser sur les coûts d’inférence en déléguant une partie du travail aux modèles de frontière (généralement plus coûteux).

« C’est intégré directement dans l’application Mac. Chaque fois que vous essayez de télécharger des fichiers ou d’envoyer des informations, nous allons automatiquement vérifier le contenu sensible et nous assurer que vous souhaitez partager ces données dans le cloud », a déclaré Jon Staff, responsable de tous les produits Mac de l’entreprise. Dans le cadre de cette version, l’entreprise a formé un nouveau classificateur de confidentialité qui suggérera automatiquement les fichiers et les informations que l’utilisateur devrait garder sur son ordinateur.

Avant que Hybrid Compute ne délègue votre tâche entre différents modèles, vous pourrez examiner les fichiers qu’il souhaite faire passer en retrait afin de vérifier qu’il n’a rien manqué d’important. À ce stade, vous pouvez également décider quels modèles vous voulez prendre en charge le travail. Du côté local, vos options sont Gemma E4B et deux variantes du modèle 3,6 de 35 milliards de paramètres de Qwen. L’une de ces variantes a été post-entraînée par Perplexity. L’entreprise déclare qu’elle proposera d’autres modèles locaux à l’avenir. Quelle que soit l’option que vous choisissez, l’installation d’un modèle local ne nécessite pas d’ouvrir le terminal de votre Mac, et l’application de Perplexity gère le processus d’installation.

Une fois le système lancé, vous verrez une visualisation affichant l’utilisation locale du CPU, du GPU et de la mémoire. À côté de cela, une barre latérale montre le nombre de tokens consommés par la tâche. Vous ne serez pas facturé pour les tokens générés par un modèle local sur votre machine personnelle. Une fois que le système génère une sortie, vous pouvez écrire des instructions de suivi comme d’habitude. Vous pouvez également utiliser un iPhone pour mettre des tâches en file d’attente.

J’ai demandé à Staff si Perplexity avait mesuré les sorties produites par Hybrid Compute par rapport à celles d’un système entièrement basé sur le cloud. « En bref, une sortie entièrement issue d’un modèle de frontière sera presque toujours meilleure en termes de création brute d’artefacts. C’est plus coûteux, c’est plus capable », a-t-il déclaré. Toutefois, Staff a ajouté que certains utilisateurs n’ont pas besoin d’accéder aux meilleurs et des plus puissants modèles d’IA pour effectuer leur travail et, dans ces cas, la confidentialité des données et le coût peuvent être des facteurs plus importants.

« Je pense que cela doit être une échelle coulissante, et nous voulons que l’utilisateur puisse contrôler où il se situe sur cette échelle pour le type de travail qu’il souhaite réaliser. Bien sûr, nous essaierons de recommander la meilleure option compte tenu du contexte dont nous disposons, mais en fin de compte, l’utilisateur doit pouvoir décider quelle solution lui convient », a déclaré Staff.

Pour l’instant, Hybrid Compute n’est disponible que sur des Macs équipés de puce Apple Silicon fonctionnant sous macOS 15, et Perplexity recommande une machine dotée d’au moins 32 Go de mémoire unifiée. La fonctionnalité est accessible aux abonnés Pro et Max, ainsi qu’aux clients d’entreprise de Perplexity.

Nadia Kerroum

Nadia Kerroum

Rédactrice chez GeekyAlgeria, j’explore chaque jour l’impact de la technologie sur notre vie. Entre innovations locales, tendances mondiales et culture numérique, je raconte ce qui façonne le futur de manière simple, précise et accessible. Toujours curieuse, je cherche avant tout à partager une passion : comprendre la tech pour mieux la vivre.