Je me répète, mais Opus 5.5 est vraiment exceptionnel comme modèle. Il gère ses agents comme un vrai chef d'orchestre, il n'oublie rien, va dans le détail, vérifie sérieusement son travail, sur n'importe quel type de tache.
Couplé à Astra 6 en configuration Max (pareil pour Opus), j'ai l'impression d'avoir 2 véritable ingénieur système et logiciel senior à ma disposition qui avancent avec sérieux sur n'importe quelle tache.
J'en vient à avoir confiance dans le mode Objectif de chaque coté car même avec un prompt relativement simplifié, ils savent aller vers le résultat attendu en comblant les trou, via une très bonne réutilisation du contexte global et de la documentation (comme je le disais, presque pas d'oubli).
Coté cout d'utilisation, je suis sur des abonnements pro (5x chez Anthropic et 20x chez OpenIA) de chaque coté. Avec ces nouvelles capacités, je les fait chauffer fortement pendant au moins 6 à 8h par jour. Je pense que chacun peut tourner ainsi avec cette charge de travail pendant 3 ou 4 jours.
Ce n'est donc possible que grâce aux Reset que j'ai banké en prévoyant ce petit rush ce week-end. Mais il y a un vrai mieux au niveau des tokens, on sent que les modèles sont optimisés et que le cout réel derrière a été réduit. Jamais je n'aurais pu atteindre autant de travail aussi bien fait avec les modèles précédents, ou alors avec 3 ou 4x plus d'étapes et de prompting et donc autant de token supplémentaires.
La décennie 2020 a peut être mal commencée avec le Covid, mais en ce qui concerne la révolution auquel on assiste avec l'IA, je suis absolument stupéfait par les avenirs possible. Incroyable époque.