La génération d'images par LLM est juste à un niveau vraiment très bon, même en local, sur un GPU de 16 Go de VRAM... De beaux fonds d'écran en prévision de la période automnale approchante 😁 #Hymenara https://t.co/kQkZ8rusjZ
Quelques unités de plus dans Hymenara, suite à un premier retour. Si vous avez 20 minutes, n’hésitez pas à commenter et je vous envoie une invitation 🙂 https://t.co/tHhy5LtRWQ
Petit RTS fait avec @ClaudeDevs CLI en nostalgie d'un Age of Empire des familles. Cette fois, pas de maison, pas de bucherons, mais juste de l'organique dans une forêt. Si des testeurs sont dispo pour 20 min, faites signe et je vous partage un lien :) https://t.co/N14oTef3Yt
Sujets repérés · Modèles & recherche · Infra & self-host
Qwen-Image-2.1 tourne sur une Intel Arc Pro B70. Une image toutes les 52 secondes avec une très bonne qualité, et vous avez même la retouche ainsi que le support de la transparence. Cela vous tente ? Ce n'était pas acquis au lancement du projet. ComfyUI annonce le support natif https://t.co/WIe403J8vD
On entre dans une nouvelle ère. Et c’est formidable ! Qwen-Image 2.1, sur une RTX 5080 16 Go dans un PC, à la maison. Des illustrations de ce niveau, chez soi, sans API, sans cloud. C’est une époque incroyable. https://t.co/inPnxxFU2P https://t.co/Q3qQBjA9E1
Et hop, un petit coup de forge de tokens pour ce modèle sur une RTX 5080 (16 Go) et ça passe nickel 👌 80-90 tok/s sur nos benchs petit et moyen contexte (13k) entre code debug et prise EN/FR. C’est stable et efficace : pas de bug de justesse relevé. Un bon modèle donc 👏
Publication avec citation · Modèles & recherche · Infra & self-host
Presque 6 Go… 7,2 en Q2. Intéressant sur des GPU contraints en VRAM. 80 tok/s en génération et 3000 en prefill sur une 4090, par exemple. Sur Mac, le format GGUF est aussi dispo : #LocalAI
Deux GPU Intel Arc Pro B70 32 Go, même base, mais ça ne fonctionne pas comme espéré. La carte mère MSI B860-P n’a pas les lignes PCIe nécessaires pour les faire marcher de concert. On tourne donc en dégradé, oneCCL patché. Max : 75,4 tok/s / code debug 52,4 / prose EN 37,1 / https://t.co/R026UWJLjE
Une seule carte, une Intel Arc Pro B70 avec 32 Go de VRAM entièrement dédiée à notre bench. Plateforme Ubuntu 26 et vLLM XPU compilé (pas de docker). J'ai reproduit mes benchs au plafond de 230 W : max à 89 tok/s, 62 tok/s en debug de code python, 44 en prose EN, 47 en prose FR. https://t.co/tGdCCmlia0
Je vous avais dit que cette carte B70 de chez @IntelFrance était sur le grill. Après quelques pb, on peut maintenant la mettre en chauffe. J’espère publier des résultats bientôt ! https://t.co/bXivQ8kUgK