New Gemini 4 Argon a l’air plutôt intéressant ! Nouveau modèle frontier de @GoogleDeepMind, pensé pour les tâches complexes : coding agentique, legal, finance, cyberdéfense… Pas encore dispo pour tout le monde, mais les premiers résultats ont l’air solides. À suivre 👀
Premiers tests de GPT-6.1 Sol : un vrai progrès pour coder. Mais il ne remplace pas encore Astra dans mes projets. Sur mes essais de ce matin, je le trouve meilleur que Sol 6 et Sonnet 5.5. Il est convaincant sur les tâches bien cadrées, mais j’ai dû le corriger sur plusieurs
OpenAI DevDay : beaucoup d’annonces. Voici un récap des principales infos, en version courte. • Dots : des agents permanents avec leur propre PC cloud. Pas disponibles en France au lancement avec Pro, mais accessibles avec Business Premium. Bêta Enterprise sur activation de https://t.co/AoiC4Lj3J6
Sonnet 5.5 pour coder au quotidien ? Après mes premiers essais, je reste sur Opus 5.5. Après des essais hier soir et ce matin, je trouve Sonnet très rapide et convaincant sur le front : UI, retouches, protos. C’est sur ces allers-retours autour d’une interface que je le trouve
Avec Opus 5.5 et Astra, vous utilisez encore autant le mode plan ? L’article « Plan mode is dead » de @aymannadeem remet en question le passage systématique par un plan avant de commencer. Boris Cherny, chez Claude Code, décrit lui aussi une planification plus interactive avec
Opus 5.5 et Astra déjà « nerfés » ? Les premiers résultats de NerfBench ne vont pas dans ce sens. L’idée de modèles volontairement dégradés après leur sortie me laissait sceptique. Autant regarder des mesures. BridgeMind a retesté les deux modèles le 27 septembre, en comparant
J’avais lâché Opus. Opus 5.5 m’a fait revenir. Après une semaine, voilà comment je l’utilise : les réglages, les consignes à copier, et ce que je vérifie encore avant de lui faire confiance ↓