Sujets repérés · Modèles & recherche · Infra & self-host
Qwen-Image-2.1 tourne sur une Intel Arc Pro B70. Une image toutes les 52 secondes avec une très bonne qualité, et vous avez même la retouche ainsi que le support de la transparence. Cela vous tente ? Ce n'était pas acquis au lancement du projet. ComfyUI annonce le support natif https://t.co/WIe403J8vD
On entre dans une nouvelle ère. Et c’est formidable ! Qwen-Image 2.1, sur une RTX 5080 16 Go dans un PC, à la maison. Des illustrations de ce niveau, chez soi, sans API, sans cloud. C’est une époque incroyable. https://t.co/inPnxxFU2P https://t.co/Q3qQBjA9E1
Supersocks met le doigt sur un truc que je vois de plus en plus : à mesure qu’on ouvre le robinet à compute, l’attention humaine devient la ressource rare. Tu peux faire tourner 1 000 agents. Si 1 000 décisions remontent ensuite à relire, valider ou corriger, le système a
Et hop, un petit coup de forge de tokens pour ce modèle sur une RTX 5080 (16 Go) et ça passe nickel 👌 80-90 tok/s sur nos benchs petit et moyen contexte (13k) entre code debug et prise EN/FR. C’est stable et efficace : pas de bug de justesse relevé. Un bon modèle donc 👏
Publication avec citation · Modèles & recherche · Infra & self-host
Presque 6 Go… 7,2 en Q2. Intéressant sur des GPU contraints en VRAM. 80 tok/s en génération et 3000 en prefill sur une 4090, par exemple. Sur Mac, le format GGUF est aussi dispo : #LocalAI
Deux GPU Intel Arc Pro B70 32 Go, même base, mais ça ne fonctionne pas comme espéré. La carte mère MSI B860-P n’a pas les lignes PCIe nécessaires pour les faire marcher de concert. On tourne donc en dégradé, oneCCL patché. Max : 75,4 tok/s / code debug 52,4 / prose EN 37,1 / https://t.co/R026UWJLjE
Une seule carte, une Intel Arc Pro B70 avec 32 Go de VRAM entièrement dédiée à notre bench. Plateforme Ubuntu 26 et vLLM XPU compilé (pas de docker). J'ai reproduit mes benchs au plafond de 230 W : max à 89 tok/s, 62 tok/s en debug de code python, 44 en prose EN, 47 en prose FR. https://t.co/tGdCCmlia0
On a notre sujet de la semaine. Un nouveau modèle vient d’apparaître chez OpenCode appelé Union Alpha. 262k de contexte et orienté coding agentique, et comme les autres fois on ne sait pas qui est derrière. Ces derniers mois, plusieurs modèles ont suivi le même schéma : Pony
Je vous avais dit que cette carte B70 de chez @IntelFrance était sur le grill. Après quelques pb, on peut maintenant la mettre en chauffe. J’espère publier des résultats bientôt ! https://t.co/bXivQ8kUgK
Imagine passer des mois sur un problème de maths, puis apprendre qu’un labo d’IA aurait déjà la solution. Et que certains le savaient. C’est le scénario que soulèvent les rumeurs rapportées par Scott Aaronson : des labos auraient résolu de grands problèmes d’informatique
TypeSafe vient de lancer Jev, une IA qui ne génère pas de texte. Elle est conçue pour aider un logiciel à décider quoi faire ensuite : quel document retenir, où envoyer une demande, quand faire intervenir un humain. On lui fournit du contexte et plusieurs questions. Il renvoie
Publication avec citation · Agents & automatisation
Du coup j’ai testé Cursor Projects ces derniers jours. J'utilisais déjà l'orchestration de plusieurs agents et subagents. Ce n’est pas vraiment ça qui change avec Projects mais ça apporte des choses très intéressantes. Je l'ai fait bossé sur un projet from scratch avec la