Un ancien portable connecte une RX 7900 XT via son unique emplacement M.2, obtenant 60 tokens/s sur Qwen3.6 27B avec une fenêtre de contexte de 100K, le système d’exploitation étant sur un disque externe

Un ordinateur portable sans GPU dédié est généralement incapable d’exécuter des modèles de langage locaux. Un utilisateur a contourné cette limite avec ingéniosité en connectant une carte graphique de bureau Radeon RX 7900 XT via un port M.2. Son vieux Lenovo parvient désormais à faire tourner efficacement le modèle Qwen3.6 27B.

Une Radeon RX 7900 XT greffée sur un portable

Exécuter le modèle Qwen3.6 27B n’est pas une mince affaire. Pourtant, le Redditor « Alternative-Panic69 » a démontré qu’avec un peu de créativité et les bons composants, c’est possible. Nous avons déjà vu ce type de configuration. Bien que son portable soit dépourvu de port Thunderbolt, il a relié la carte RX 7900 XT à la machine en utilisant un adaptateur PCIe relié au connecteur M.2.

Une alimentation externe de 750W dédiée au GPU était nécessaire, le bloc d’alimentation du portable étant bien trop faible. Démarrer Windows depuis un disque externe a été relativement simple, pourvu de disposer d’un port USB libre. La fluidité globale de l’expérience reste cependant à confirmer.

Un écran externe est branché sur le GPU, tandis que l’écran du portable fonctionne sur la puce graphique intégrée pour éviter toute surcharge de la mémoire vidéo. Grâce à llama.cpp, la RX 7900 XT a pu exécuter Qwen3.6 27B à des vitences impressionnantes de 55 à 60 tokens par seconde, tirant parti des 20 Go de mémoire vidéo de la carte.

Les pondérations du modèle et le cache KV ont été déportés dans la mémoire vidéo de la RX 7900 XT. Une longueur de contexte de 100 000 tokens a cependant saturé les 16 Go de RAM système du portable. Ce faible volume de mémoire vive constitue probablement le principal goulot d’étranglement de l’expérience.

À lire :  David Sacks du Tech Advisor américain identifie le principal risque pour le plan de financement IA de 500 milliards d'euros de NVIDIA comme un surplus de "GPU sombres"

Face à la crise actuelle des prix de la DRAM, l’achat de barrettes supplémentaires à un tarif abordable est compliqué. Si Alternative-Panic69 souhaite continuer à utiliser Qwen3.6 27B, il devra composer avec cette contrainte. Malgré l’absence de matériel dernier cri, ce passionné a réussi à faire fonctionner un modèle d’IA local capable de mettre à genoux la majorité des GPU actuels.

Guide Optimisation Pc Windows 11 Jeux Performance Bot Guide Optimisations Pc Windows 10 Jeux Performances Sur Omgpu.com Bot

Guide Comment Reduire Input Lag Latence Omgpu Bot Comment supprimer Coil Whine carte graphique

Vous pourriez aussi aimer