Perplexity et NVIDIA lancent Portable Computer l’agent IA 100% local

·

·

Ingénieur devant un PC Linux puissant exécutant Portable Computer de Perplexity et NVIDIA, agent IA 100 % local, dans un bureau moderne.
Résumer cet article avec :

Pendant deux ans, utiliser un agent IA a souvent signifié envoyer ses fichiers les plus sensibles vers des serveurs distants. Le 25 août 2026, Perplexity et NVIDIA inversent cette logique avec Portable Computer, un agent qui raisonne entièrement sur la machine. Le compteur de jetons cesse alors de tourner.


À retenir

  • Lancement le 25 août 2026 de Portable Computer, version 100 % locale de Perplexity Computer développée avec NVIDIA.
  • Traitement local par défaut : fichiers, code et documents ne quittent jamais le poste, sauf autorisation explicite vers plus de 15 modèles cloud.
  • Zéro frais par jeton en local pour toutes les tâches traitées sur la machine, contre une facturation à l’usage dans le cloud.
  • Modèles embarqués Qwen 3.8 27B et PPLX 27B, bientôt Nemotron 3.5 Lightning 30B MoE, avec sandbox au niveau du système.
  • Ticket d’entrée élevé : DGX Spark à 4 699 dollars (environ 3 994 euros) ou PC Linux avec 24 Go de VRAM minimum.

Passer du cloud-first au local-first change l’équation économique et réglementaire de l’IA agentique. Cela concerne les entreprises soumises au secret professionnel, mais aussi les professionnels qui enchaînent des workflows longs sans payer à chaque jeton.

L’IA quitte le cloud pour s’exécuter sur la machine

L’architecture proposée rompt avec le modèle dominant des agents dépendants d’API distantes.

Une confidentialité par défaut

Portable Computer exécute les requêtes, analyses et automatisations directement sur le poste de travail. Les fichiers internes, bases documentaires et code source propriétaire restent sur l’appareil. Aucune donnée ne transite vers un serveur tiers sans action volontaire. Cette étanchéité répond aux blocages de la finance, du droit ou de la santé, où la souveraineté des données freine l’adoption.

Professionnel concentré devant un ordinateur de bureau Linux avec câbles réseau débranchés, illustrant le passage de l’IA du cloud vers la machine locale.
Avec Portable Computer, les requêtes d’agent IA s’exécutent d’abord sur le poste local plutôt que sur des serveurs distants.

Le système conserve une connectivité hybride, mais verrouillée. Lorsque la tâche dépasse les capacités locales, l’orchestrateur s’arrête et demande une validation. Après accord explicite, seule la requête ciblée part vers le cloud, sans exposer l’arborescence locale. Selon MarkTechPost, ce mécanisme donne accès à plus de 15 modèles cloud de pointe, uniquement avec le consentement de l’utilisateur.

La fin du compteur à jetons

L’exécution locale supprime la facturation à l’inférence. Perplexity annonce zéro frais par jeton en local pour les opérations de traitement et d’analyse, comme le relaie Korben.info. L’utilisateur peut lancer des recherches longues, compiler du code ou analyser des lots de documents sans craindre une facture d’API qui s’emballe. Les coûts d’usage basculent vers le matériel plutôt que vers chaque requête.

La passerelle hybride reste facturée à l’usage lors d’une escalade vers le cloud. Sur des tâches de terminal, MarkTechPost mesure un coût de 0,415 dollar par exécution, soit environ 0,35 euro, lorsque l’agent sollicite un modèle distant. En mode 100 % local, aucun coût par jeton ne s’ajoute.

Une passerelle hybride sous contrôle humain

Le harnais n’envoie rien par défaut. Il propose une escalade lorsqu’il détecte un besoin de raisonnement plus avancé ou de recherche web actualisée. L’utilisateur valide chaque transfert. Cette architecture rend l’agent compatible avec les politiques de confidentialité les plus strictes, sans l’enfermer dans un fonctionnement totalement hors ligne.

Sous le capot : un harnais compact et cloisonné

La solution ne se limite pas à une interface de chat locale : elle embarque une pile complète.

Des modèles compacts pour le local

Le lancement embarque Qwen 3.8 27B et une variante post-entraînée par Perplexity, PPLX 27B. Cette dernière utilise la prédiction multi-jetons, qui anticipe plusieurs jetons à chaque étape afin d’accélérer le débit local. Le prochain modèle attendu est NVIDIA Nemotron 3.5 Lightning, un MoE de 30 milliards de paramètres.

Les poids sont fortement quantifiés pour tenir sur une machine de bureau. Qwen 3.8 27B est livré en 3-bit avec 17,4 Go de téléchargement et 32 Go de RAM requis. Nemotron 3.5 Lightning 30B MoE est quantifié en 4-bit pour 19 Go de téléchargement. Le système accepte aussi des moteurs d’inférence personnalisés comme llama.cpp, Ollama, Unsloth ou LM Studio.

Un bac à sable qui verrouille le système

Chaque exécution de code et chaque appel d’outil s’isole dans un bac à sable au niveau du système. Le système d’exploitation applique ce cloisonnement et interrompt automatiquement l’agent si le confinement n’est pas disponible, selon le blog technique de Perplexity. Les connecteurs vers Google Drive, Gmail, GitHub et Slack sont exposés comme outils légers en ligne de commande, sans transmettre les jetons d’accès à distance.

L’agent s’exécute entièrement en local, dans un environnement cloisonné qui protège les fichiers et les processus de l’hôte.
Perplexity Technical Blog, présentation de l’architecture local-first

Une mémoire qui se compacte pour tenir la durée

Les modèles compacts perdent souvent en attention au-delà de 100 000 jetons de contexte. Portable Computer compense avec une compaction dynamique propriétaire qui résume et réorganise le contexte pour conserver les instructions clés. La pile intègre aussi l’orchestrateur, le planificateur, le routeur d’outils, une file de tâches persistante et un index de recherche local.

Performances mesurées, mais ticket d’entrée salé

Les benchmarks publiés cherchent à montrer que la conception conjointe du harnais et du modèle compense leur taille réduite.

Mini-supercalculateur NVIDIA DGX Spark posé sur un bureau moderne, observé par un professionnel, symbolisant le coût d’entrée élevé du matériel pour Portable Computer.
Les performances locales de Portable Computer reposent sur des machines haut de gamme comme le mini-supercalculateur NVIDIA DGX Spark, réservé à un public expert.

Des benchmarks favorables au harnais maison

Sur Local Knowledge Work Bench, un banc de 53 tâches bureautiques réelles, Qwen 3.8 27B sur DGX Spark atteint 82,6 % de précision. Le même modèle avec les harnais ouverts Pi et Hermes plafonne à 77,6 % et 74,0 %. Avec PPLX 27B, Portable Computer monte à 85,4 %, selon VentureBeat.

Sur BrowseComp (recherche web agentique), le système signe 66,7 % de précision, contre 50,2 % pour Pi, tout en consommant 51 % de temps en moins et 70 % de jetons en moins. Sur ParseBench-100 (compréhension visuelle de documents), il obtient 65,1 % d’exactitude contre 34,6 % pour Pi et 13,9 % pour Hermes. Sur Terminal Bench 2.1, l’inférence 100 % locale délivre 59,6 % sans coût par jeton, puis atteint 73,0 % avec une escalade cloud ponctuelle.

Un matériel qui filtre la majorité des utilisateurs

Le matériel cible est le mini-supercalculateur NVIDIA DGX Spark. Il embarque la superpuce Grace Blackwell GB10, avec CPU Arm à 20 cœurs, GPU Blackwell, 128 Go de mémoire unifiée LPDDR5X et 1 PFLOP en FP4. Son prix catalogue atteint 4 699 dollars, soit environ 3 994 euros. L’alternative sur PC exige au moins 24 Go de VRAM, 32 Go de RAM système et 1 To de SSD.

Cela réserve l’usage aux cartes haut de gamme comme les GeForce RTX 3090, 4090, 5090 ou RTX Pro, selon Jon Peddie Research. Le lancement du 25 août 2026 couvre DGX OS et Ubuntu Linux. Windows 11 est prévu pour septembre 2026, tandis que macOS et Apple Silicon restent absents de la feuille de route. L’accès logiciel nécessite un abonnement Perplexity Pro à 20 dollars par mois (environ 17 euros) ou Max à 200 dollars (environ 170 euros).

Portable Computer déplace la dépense du jeton vers la machine. Pour les équipes qui manipulent des données sensibles, il apporte une confidentialité renforcée et des coûts d’usage plus prévisibles. Son adoption dépendra surtout de l’ouverture promise aux RTX grand public : sans elle, l’outil restera l’affaire des stations de travail les plus chères.


Sur le même Thème :

Laisser un commentaire

Trop d’infos IA ?

Inscrivez-vous à la newsletter pour recevoir un résumé hebdomadaire directement dans ta boite email (et rien d’autre)