💡 En 3 points clés
- Les modèles comme Qwen 3.8 27B ou PPLX 27B sont post-entraînés pour maximiser l’autonomie locale. Ils analysent les fichiers, exécutent des recherches dans les documents ou le code, et prennent des actions sur l’appareil (comme ouvrir un pull request ou poster un message Slack).
- Un modèle supplémentaire, NVIDIA Nemotron 3.5 Lightning (30 milliards de paramètres), est prévu pour renforcer les capacités de transcription vocale locale (dictation mode).
- L’agent inclut un planificateur, un routeur d’outils, un scheduler et une file de tâches persistante, le tout exécuté en local. Cela permet de gérer des workflows complexes (ex : analyser des fichiers fiscaux + générer un rapport) sans dépendre d’une connexion internet.
Un agent IA qui travaille chez vous, pas dans le cloud
Imaginez un assistant capable de parcourir des années de relevés bancaires pour identifier les frais récurrents superflus, de trier des pull requests GitHub en fonction de leur priorité, ou de détecter pourquoi votre taux d’activation chute — le tout sans jamais quitter votre machine. C’est exactement ce que propose Portable Computer, la version locale de l’agent Perplexity Computer, désormais disponible sur Windows via l’écosystème NVIDIA RTX.
Concrètement, l’agent s’appuie sur les GPU NVIDIA (GeForce RTX ou RTX PRO avec au moins 24 Go de VRAM) pour exécuter des modèles locaux comme Qwen 3.8 27B ou PPLX 27B, optimisés pour les cartes RTX. L’objectif ? Traiter des données sensibles en local, sans consommer de crédits Perplexity, et n’escalader vers le cloud que si la tâche le nécessite — et uniquement après validation de l’utilisateur.
L’agent repose sur trois piliers techniques :
1. Un modèle local post-entraîné
Les modèles comme Qwen 3.8 27B ou PPLX 27B sont post-entraînés pour maximiser l’autonomie locale. Ils analysent les fichiers, exécutent des recherches dans les documents ou le code, et prennent des actions sur l’appareil (comme ouvrir un pull request ou poster un message Slack).Un modèle supplémentaire, NVIDIA Nemotron 3.5 Lightning (30 milliards de paramètres), est prévu pour renforcer les capacités de transcription vocale locale (dictation mode).2. Un orchestrateur intégré
L’agent inclut un planificateur, un routeur d’outils, un scheduler et une file de tâches persistante, le tout exécuté en local. Cela permet de gérer des workflows complexes (ex : analyser des fichiers fiscaux + générer un rapport) sans dépendre d’une connexion internet.3. Une escalade contrôlée vers le cloud
Si une tâche dépasse les capacités du modèle local (ex : recherche de données financières récentes), l’agent demande explicitement l’autorisation avant d’envoyer des données vers le cloud. Les informations sensibles restent ainsi sous contrôle utilisateur.Trois cas d’usage concrets (et pourquoi c’est disruptif)
Finance : L’agent peut analyser deux ans de relevés de courtage et de déclarations fiscales pour identifier les frais récurrents évitables, en citant la page exacte de chaque document — sans jamais transmettre ces données à un serveur externe.Développement logiciel : Il trie automatiquement les pull requests GitHub en fonction de leur statut (prêt à merger, bloqué, obsolète) et propose des corrections pour la documentation désynchronisée, le tout en local.Startups : En analysant les données d’activation, il détecte où les nouveaux utilisateurs abandonnent entre l’installation et la première tâche accomplie, puis publie les insights directement sur Slack.Pourquoi c’est une avancée majeure pour la confidentialité et l’efficacité ?
Confidentialité : Les données sensibles (code, documents fiscaux, emails) ne quittent jamais l’appareil. Même en mode dictée, l’audio est traité localement par le modèle Nemotron 3.5 ASR.Coût maîtrisé : Les tâches exécutées en local ne consomment pas de crédits Perplexity, contrairement aux requêtes cloud. Seules les escalades vers des modèles frontaliers (comme ceux de Perplexity) sont facturées.Simplicité : Plus besoin de configurer manuellement des stacks logicielles complexes. L’installation se fait en un clic via l’application Perplexity, avec des modèles pré-optimisés pour les GPU NVIDIA.Hype-mètre : 3,5/5
Cette solution marque une étape clé dans l’adoption des agents IA locaux, surtout pour les utilisateurs professionnels. Cependant, son déploiement reste limité aux configurations matérielles haut de gamme (RTX 3090 ou supérieur). La généralisation à des tâches encore plus complexes (ex : génération de code avancée) dépendra des progrès des modèles locaux et des GPU grand public.
Pour les entreprises ou les développeurs soucieux de confidentialité, Portable Computer offre une alternative crédible aux solutions purement cloud — à condition d’avoir le matériel adapté.