✦ Agentic Dev ✦ Formateur ✦ SAAS Builder → Ship-Saas.now / YouThumb.AI / AgentsMail.io / VillaSlot.io

Bali, Indonésie
Opus 5.5 vient de sortir. Anthropic le place au niveau de Fable 5.1 et annonce un coût 40 % inférieur à Opus 5 sur un workload typique. Je lui ai confié 10 projets : frontend, API, jeu, simulation, galaxie et trou noir 3D. 10/10 livrés. 1 h 46. 20,45 $. mkc.sh/opus-5-5?utm_source=x
3
365
Je vous offre avec Tibo un reset d’utilisation codex aujourd’hui, profitez en
Replying to @My_Ai_Bi
3am on a tuesday
4
764
On découvre régulièrement de nouveaux modèles d’IA. Mais rares sont ceux qui créent un vrai gap. Jev, développé par un ancien chercheur d’OpenAI, change complètement la manière dont nos logiciels prennent des décisions. Vidéo : mkc.sh/jev?utm_source=x Jev n’est pas un chatbot. Il ne rédige pas un texte et ne génère pas de code. Ton logiciel lui transmet un contexte métier, pose une question fermée et récupère directement une réponse typée avec ses probabilités. Exemple : billing : 91 % technical_support : 6 % sales : 3 % TypeSafe annonce jusqu’à 193,6× plus rapide et 444,6× moins cher sur ses propres workflows. Ces chiffres viennent du fournisseur, pas d’un benchmark indépendant. Je l’ai testé dans trois de mes SaaS : VillaSlot, YouThumb et AgentsMail. Dans AgentsMail, un seul appel pose 14 questions pour analyser le risque global, l’objet, l’aperçu, le corps, la pression commerciale et la ligne la plus problématique. Le code garde les faits exacts. Jev traite les jugements sémantiques bornés. Un LLM génère. L’humain garde les décisions sensibles. Une sortie typée peut toujours être fausse. Jev garantit la forme de la réponse, pas la justesse de chaque décision. Je montre l’intégration complète dans la vidéo.
1
7
695
Mon nouveau SaaS VillaSlot a été construit lors d’un run autonome de 9 heures. Une réaction de certains devs est rapidement apparue : « C’est du vibe code. » J’ai donc décidé d’ouvrir toute son architecture : mkc.sh/architecture-villaslo… Et leur doute est légitime. Un run autonome de 9 heures ne prouve pas que le code est maintenable. 20 user stories livrées ne prouvent pas que les responsabilités sont bien séparées. Dans cette masterclass, je montre l’architecture réelle de ShipSaaS et VillaSlot : présentation, services, persistance, authentification, isolation des données, règles métier, tests et garde-fous imposés aux agents. Plus les agents codent vite, moins on peut se permettre une architecture floue. La première vidéo montrait la vitesse. Celle-ci montre ce qui l’empêche de produire du code spaghetti.
4
1
11
694
Le support technique de Timely a mis 4 jours à me répondre. J’ai donc redéveloppé leur SaaS en 48 heures. Avec mes agents IA et un seul run autonome de 9 heures. 🎥 mkc.sh/villaslot?utm_source=… J’utilisais Timely pour gérer les réservations à l’heure de mes villas. J’ai construit VillaSlot pour réunir dans un seul outil les réservations à la nuitée, les créneaux horaires pour les shootings et les paiements Stripe des villas. Derrière les 48 heures, il n’y a pas un gros prompt magique. J’ai cadré le produit, préparé le PRD, 20 user stories avec leurs critères d’acceptation, le graphe de dépendances et 20 maquettes. Puis j’ai lancé un run autonome de 9 h 20 pendant la nuit. Chaque story passe par le TDD, une review séparée, les tests, l’E2E dans Chrome, le contrôle visuel et une boucle d’auto-correction. Le lendemain, la première version était livrée. Le vrai accélérateur, c’est de donner aux agents un résultat fonctionnel précis à atteindre et les moyens de prouver qu’ils l’ont atteint. 🏡 VillaSlot : villaslot.io?utm_source=x
3
1
9
1,145
Mes agents tournent parfois 8 à 10 h sur plusieurs user stories, avec des sous-agents qui planifient, codent, testent et relisent. Le problème n’est plus de lancer les agents. C’est de garder une vue claire sur tout ce qui tourne. Herdr + VPS + Hermes : mkc.sh/herdr?utm_source=x
2
7
811
Mes agents tournent H24. Par dizaines. Mais sans isolation correcte, une boucle entière peut finir à la poubelle. J’ai brûlé 12 millions de tokens comme ça. 🎥 mkc.sh/agents-isoles?utm_sou… Tu connais les worktrees. Mais ils n’isolent que les fichiers. La base de données, les ports, les variables d’environnement, les migrations, les données de test et les navigateurs E2E restent souvent partagés. Un agent réinitialise la base pendant qu’un autre teste. Un deuxième prend le même port. Un troisième passe grâce à l’état laissé par son voisin. Tout le monde travaille. Le résultat, lui, est inutilisable. Dans cette vidéo, je montre comment dériver de chaque user story un environnement complet : branche, worktree, port, base, serveur et tests E2E. Des agents parallèles, oui. Des agents qui se marchent dessus pendant 24 heures, non.
4
7
1,075
Claude Code ou Codex ? Et si OpenAI était en train de mettre tout le monde d’accord avec GPT-6 Astra ? Ce modèle est bien plus puissant que tu ne le penses. Vidéo : mkc.sh/gpt-6-astra?utm_sourc… Astra peut naviguer, coder, tester une interface et piloter KiCad, Blender ou Unreal Engine. Côté développeurs : 1,05 million de tokens de contexte, 10 outils via la Responses API, appels asynchrones, correction de l’agent pendant son travail et nouveau harnais Codex pour accélérer le computer use. Sur Mind2Web, Astra + le nouveau harnais Codex termine les tâches 1,9 fois plus vite que l’expérience GPT-5.6 Sol. Astra atteint aussi 99,9 % sur ARC-AGI-3 avec le Provider Adapter. Le revers : c’est le premier modèle OpenAI classé « Critical » en cybersécurité. Il peut découvrir des vulnérabilités inconnues et construire des exploits avancés. #gpt6 #openai #codex #claudecode #agenticdev
2
476
Anthropic ont reset hier deja épuisé ... Codex pareil ... Bientôt il va falloir 3 ou 4 comptes... (Oui j'ai des agents qui tourne h24 mais il y a quelques temps ça posait pas problème) ... même avec un 2x200 tu dois prendre des pauses
1
4
719
109 user stories. 497 agents. Claude Code + Codex. La vidéo : mkc.sh/497-agents?utm_source… J’ai construit AgentsMail, mon SaaS d’email marketing. Le sujet n’est pas de choisir un camp entre Claude et Codex. Je les utilise indépendamment. La méthode au-dessus décide du périmètre, des stories, du contexte, des dépendances, des tests et de la review. C’est ça qui transforme des agents en produit.
1
1
361
Mon plan Codex à 200 USD fumé en 24h mais wtf ? Plus de Claude non plus ... je vais devoir aller chez Mistral en attendant le 4 septembre
11
6
1,908
J’arrête Codex. J’arrête Claude Code. Je les remplace par un outil que personne ne connaît. Je te le montre ici : mkc.sh/claude-code-codex?utm… Je le teste depuis quelque temps et je ne travaille déjà plus de la même manière. Les nouveaux LLM savent raisonner, analyser du code et résoudre des problèmes de plus en plus complexes. Mais mon nouvel outil ne se contente pas de générer du code. Il utilise plusieurs modèles, travaille dans le terminal, manipule les fichiers, contrôle les permissions et boucle sur une tâche jusqu’à obtenir un résultat exploitable. Je peux l’adapter à mes projets et à ma manière de développer, sans dépendre d’Anthropic ou d’OpenAI. Pour moi, c’est la suite logique après Claude Code, Codex et OpenCode.
3
1
9
2,730
Claude a 100$ ne permet plus grand chose ...
13
13
4,209
La DGFiP s’est fait hacker, malgré les audits. 678 000 contribuables sont concernés. Alors si Hermes tourne 24h/24 sur ton VPS, tu n’es pas à l’abri. La vidéo : mkc.sh/hermes-security?utm_s… Hermes peut accéder au terminal, lire tes fichiers, appeler des API et lancer des automatisations pendant que tu dors. J’ai donc audité trois niveaux : 1. Le VPS : ports, accès, mises à jour et sauvegardes. 2. La configuration de Hermes : utilisateurs, outils, permissions, secrets et approbations. 3. Les usages à risque : crons sans surveillance, comptes sensibles, contenus externes et prompt injections. Je te montre comment garder Hermes autonome sans lui donner les clés de toute la maison. Vidéo réalisée en collaboration commerciale avec Hostinger.
9
967
On peut enfin utiliser le workflow de Claude Design depuis Claude Code grâce à /design. 🎥 mkc.sh/claude-code-design?ut… Dans mon workflow agentique, j’étais encore obligé de quitter Claude Code, d’ouvrir Claude Design sur le web, de remettre le contexte, de générer la maquette, de l’exporter, puis de revenir dans le projet. Avec /design, Claude Code part du dépôt et génère plusieurs directions visuelles dans un Artifact HTML. Je peux les comparer, corriger une direction, puis l’implémenter dans les vrais fichiers du projet. La nuance compte : /design reprend le workflow d’artboards de Claude Design. Ce n’est pas encore toute l’application Claude Design dans le terminal. Je l’ai testé sur une vraie fonctionnalité de mon SaaS. Je montre le résultat, le fonctionnement et les limites dans la vidéo. #ClaudeCode #ClaudeDesign #AgenticEngineering
1
6
618
Aujourd’hui, tous les développeurs génèrent 100 % de leur code avec l’IA. Ça ne fait même plus débat. Ma masterclass sur l’Agentic Engineering : mkc.sh/agentic-engineering-m… On a arrêté de traiter automatiquement de « Vibe Codeur » chaque développeur qui utilise Claude Code, des MCP, des subagents ou des worktrees. Mais maintenant, on mélange tout. Le développeur expérimenté qui utilise l’IA pour aller plus vite. Le Vibe Coder qui accepte ce qui sort tant que ça semble fonctionner. Et l’Agentic Engineer qui construit de vraies boucles de développement : objectif, contraintes, agents spécialisés, tests, revue, correction, puis nouvelle boucle. Les trois peuvent utiliser le même setup. Les trois peuvent faire écrire 100 % du code par l’IA. Ils ne travaillent pourtant pas de la même manière. Beaucoup jugent encore l’Agentic Engineering avec le paradigme de 2025 : petits contextes, modèles fragiles et micromanagement permanent. En 2026, les modèles, les contextes qui atteignent un million de tokens et les nouveaux outils permettent de déléguer une user story complète, parfois plusieurs en parallèle. Certains pensent encore que c’est du bullshit. Pendant ce temps, des entreprises me paient pour remplacer une partie du travail autrefois confié à des équipes de développement par des workflows et des équipes agentiques. On peut trouver ça inquiétant. Mais on ne peut plus faire comme si ça n’existait pas. J’ai enregistré 50 minutes de masterclass pour remettre de la clarté entre Vibe Coding, développement assisté par l’IA et Agentic Engineering. Non, l’Agentic Engineering n’est pas du bullshit.
2
1
7
781
L’IA nous a rendus extrêmement productifs. On génère énormément de choses. Et surtout énormément de merde. mkc.sh/workslop?utm_source=x Des posts, des présentations, du code, des fonctionnalités, des SaaS entiers... En quelques minutes, on peut produire ce qui demandait auparavant plusieurs heures, parfois plusieurs jours de travail. Alors on produit. On poste. On commit. On publie. On recommence. Et comme on produit beaucoup, on se croit productif. Une partie de cette production porte désormais un nom : le Workslop. Du contenu qui ressemble à du bon travail, mais qui ne fait rien avancer. L’IA n’a pas inventé le phénomène. Elle a industrialisé ce que Cal Newport appelait déjà le shallow work dans Deep Work en 2016 : du travail superficiel, facile à reproduire, qui nous occupe sans créer beaucoup de valeur. Avant, ce travail inutile nous coûtait du temps. Aujourd’hui, on peut en générer des tonnes en quelques secondes. La vraie question n’est plus « combien ai-je produit ? », mais « qu’est-ce qui existera encore dans 30 jours ? »
1
1
12
819
trop d'agents ...
2
8
952
Tout le monde vibe code. Tout le monde sort des produits. Mais la boucle agentique s'arrête presque toujours au même endroit : plan, puis execute. Le code est écrit, la feature est déployée, l'agent a fini son travail. Un dev doit aller au-delà. Trois choses commencent là où la boucle s'arrête : - l'audit de sécurité - l'exploitation des logs de prod - et le stress test Dans cette vidéo je détaille le troisième. Mon workflow agentique pour pousser un SaaS jusqu'à la rupture. Au programme : - 2 skills. Un qui construit et lance le stress test, un qui trie les erreurs de prod et remonte au déploiement fautif - k6 pour la charge, Sentry pour les exceptions - comment briefer l'agent pour qu'il déduise le vrai parcours depuis ton code Et le truc qui m'a occupé la semaine. Mon test de charge annonçait 40 689 requêtes, 0 erreur. Rejoué avec 10 fois moins de monde, le même test a sorti 29 erreurs Postgres. Le tir était vert. Le service était par terre. La cause touche toutes les apps en rendu streaming. Next App Router, Remix, Nuxt. Si tu juges sur le code HTTP, tu ne verras jamais rien. mkc.sh/stress-test?utm_sourc… Les 2 skills + 3 guides : mkc.sh/the-agentic-dev?lead=…
3
1
16
2,248