victime quotidienne des modèles linguistiques à grande échelle🎢

Paris (France)
Anthropic ne sortira pas Sonnet 5 demain si OpenAI se ridiculise tout seul
I don't know how Anthropic pulled this off, but I need to look into it: not only is Opus 5.5 an incredibly good model, but the rates are also incredibly good; Opus now appears to be an outstandingly efficient model. Makes you wonder how much more efficient sonnet 5.5 will be.
1
59
basedpolymer retweeted
J’entends souvent ce raisonnement (intéressant) : « Le travail d’écriture changera de forme. Il ne s’agira certes plus de choisir chacun des mots, mais de guider son IA. Si on a tous accès à une IA, celui qui produit les meilleurs romans est celui qui aura investi dans son IA le plus de créativité, d’intelligence, ou en tout cas, d’un quelque chose. Le résultat sera tout de même le reflet de son travail et de sa subjectivité, qui transparaitra sous une autre forme que le choix des mots. L’IA restera un levier cognitif, un amplificateur de talent, peut-être pas du même talent qu’aujourd’hui, mais d’une forme de talent. Les meilleures productions culturelles et intellectuelles seront le fruit d’un travail hybride humain/IA, où l’humain sera chef-d’orchestre. » Je comprends l’attrait de cet argument, car il est intuitif et correspond à ce qu'il s’est passé pour chaque révolution technologique passée. Mais il repose sur l’hypothèse implicite d’un plafond aux capacités des modèles. Or, lorsque les modèles dépassent un certain seuil d’intelligence créative, l’argument s’effondre. Imaginez une compétition d’échecs entre dix IA au niveau Elo 10 000. Les résultats de cette compétition seraient-ils très différents si chacune des IA étaient « guidées » par des grands maîtres d’échec (Elo 2500) ? Non. Pire encore : la stratégie optimale pour chacun des grands maîtres serait sans doute de ne rien toucher aux choix de l’IA. Aux échecs comme dans la production intellectuelle, l’idée que dans le futur, l’apport de chaque humain aura une influence causale significative sur la qualité du résultat, me semble très incertaine. Pour que ce soit vrai, il faudrait qu’une IA super-intelligente soit mieux guidée par un humain que par elle-même. Que l’humain garde suffisamment de zones de domination par rapport à l'intelligence de la machine. Or, si l’on prolonge les courbes de progression des modèles, cela ne restera pas vrai longtemps. Je pense qu’on a *déjà*, tendance à surestimer la qualité nécessaire du prompt pour obtenir un excellent résultat. Demandez par exemple à un modèle d’IA récent « Écris le début d’un excellent roman sur [thème] ». Le résultat sera tout à fait publiable. À terme, le prompt qui permettra d’obtenir le meilleur roman possible ressemblera sans doute à « Produis le meilleur roman possible. » Rien ne permet d’affirmer qu’il existera une corrélation entre la qualité littéraire du livre (ou son succès en librairie) et un quelconque ingrédient que l’homme aurait apporté à son travail avec la machine. Entrainée par apprentissage par renforcement sur les préférences humaines, les modèles de langage atteindront un niveau surhumain dans la production de contenu culturel et intellectuel. Si l'on décide de tolérer la méthode d’écriture consistant à prompter son IA et à copier-coller le résultat, les concours littéraires deviendront rapidement des compétitions entre IA.
85
53
312
34,563
C'est le pire nom possible pour un produit destiné au grand public. Comment va fonctionner le bouche à oreille ? @OpenAI rejoint @Google pour les pires noms de produits
OPENAI 🔥: An upcoming always-on assistant from OpenAI will be named "o". > Its reference appeared briefly on the ChatGPT upgrade screen for some users. > Internal config has references to "o" as a display name and "-o" as an email suffix. This means that "o" will support email handling. > OpenAI is hosting its DevDay next week, where we will likely hear more about their always-on assistant. > P.S. A rumored "Aeon" reference is an internal name for the existing custom Agents implementation for ChatGPT Workspace accounts. Yet OpenAI will likely build a consumer-facing "o" assistant on top of this feature. Next week will be huge. I also like that Meta set a super high standard with its Muse assistant. OpenAI will need to cross a very high bar. Soon? 👀
1
84
Fable 5.5 sera l’AGY. Le messie tant attendu
Anthropic made Sonnet 5.5 so insanely good that comparing it to Luna feels like AN INSULT. And the same thing happened with Opus 5.5. It beat Sol so badly that the comparison barely even makes sense anymore. That puts real pressure on OpenAI to build much better models, because its current flagship, Astra, is now getting beaten on both price and quality by an INTERMEDIATE Anthropic model. And if Fable 5.5 comes in significantly stronger than Opus 5.5, which I genuinely believe it will, I honestly don’t see many options left for OpenAI. Not even GPT-6.1 Astra may be enough.
1
58
basedpolymer retweeted
Quelques mots sur « Balance ton Claude », projet à travers lequel nous avons révélé que « C’était ça ou mourir », livre phénomène de la rentrée littéraire, est sans doute très largement rédigé par une IA. 1) Je n’étais pas seul ; il s’agissait d’un projet collectif. Les autres révéleront leur identité en temps voulu s’ils le souhaitent. 2) À tous ceux qui nous reprochent d’avoir nui à Orélien, pensez plutôt à l’auteur qui a passé des centaines d’heures sur son manuscrit pour écrire un magnifique livre, qui aurait mérité le Goncourt, et qui ne l’aurait pas eu. Aurait-il été plus juste de laisser cet auteur être floué ? Et des milliers de lecteurs être trahis ? Nous avons évidemment de la compassion pour les jours difficiles que doit vivre Orélien, et nous espérons qu’il est soutenu. Mais il nous a semblé être de notre devoir de lancer l’alerte. 3) Quelles étaient nos motivations ? Ceux qui me lisent savent que je mène, depuis un an, une reflexion sur les effets de l’IA sur nos vies. Pourtant plutôt techno-optimiste, je redoute qu’après plusieurs millénaires de civilisation fondée sur l’écrit, l’IA provoque la disparition de la lecture et de l’écriture. L’IA peut, et pourra de plus en plus (les tics d’écriture disparaîtront avec le progrès des modèles) produire des oeuvres exceptionnelles, en quasi autonomie. Le contenu humain sera (est déjà ?) noyé dans un océan de contenu IA d’excellente qualité. Un jour l’écrivain humain se dira : à quoi bon ? À quoi bon passer des centaines d’heures à me documenter, à réfléchir, à choisir mes mots pour être dans tous les cas soupçonnés d’avoir copié-collé Chat GPT (parce que certains trompent leurs lecteurs, le soupçon se généralisera) et pour ne pas être lu (l’attention humaine est une ressource finie ; plus elle est absorbée par du contenu IA, moins elle est allouée aux productions humaines) ? Pour preserver les incitations à écrire dans ce nouveau monde, il faudrait que les lecteurs puissent savoir s’ils ont affaire au texte d’un humain ou d’un robot, pour pouvoir, si tel est leur souhait, allouer disproportionnellement leur attention aux productions humaines. Je chéris donc l’existence de Pangram (entreprise dans laquelle je ne suis pas investisseur, même si cette théorie est amusante), tout en redoutant que le logiciel soit dépassé par les progrès des modèles. En disant ça, je ne pense pas uniquement aux écrivains, mais avant tout aux lecteurs. Les lecteurs semblent aimer lire un roman rédigé par une IA, mais uniquement… lorsqu’ils ne savent pas qu’il s’agit d’IA ! Or on peut collectivement s’aveugler un certain temps, mais le jour où la plupart des écrivains humains auront abandonné, le jour où chaque lecteur comprendra qu’il fait face, avec une forte probabilité, à la prose de Chat GPT, il cessera sans doute de lire. En effet, ce qui comble, dans la lecture d’un bon roman, voire d’un essai, n’est pas uniquement le fait de lire une suite de mots intéressante (même si cela compte !), mais aussi le fait de lire des mots qu’un autre humain a pensés, pesés, qui reflètent sa subjectivité et sa singularité. Et ainsi d’entrer, par cette lecture, en contact avec un autre esprit. L’être humain n’est pas fait pour rester longtemps isolé de ses semblables, or la lecture d’un roman rédigé par un humain le lie à l’un de ses semblables ; la lecture d’un roman produit par Chat GPT ne fait rien de tel. C’est pourquoi il est important de dénoncer les auteurs qui proposent un copié-collé de Chat GPT en prétendant qu’il s’agit de leur plume. Non seulement ils trahissent le pacte moral qui les lie à leur lectorat, mais en plus, ils contribuent à retirer, de façon déloyale (car ils mentent sur la nature de leur produit !) des lecteurs à ceux qui font encore l’effort de choisir leurs mots (et donc à décourager cet effort). Et surtout, ils contribuent à la généralisation du soupçon, ils érodent la présomption d’humanité dont bénéficie un texte face à de potentiels lecteurs. Ils précipitent l’avénement d’un monde où plus personne ne lira et n’écrira, avec toutes les regressions cognitives et culturelles que cela implique. (Je m’étonne d’ailleurs de voir certains écrivains ne pas comprendre qu’en défendant la démarche d’Orélien, ils scient la branche qui a permis à la littérature d’exister.) Entendons-nous bien : si des producteurs de contenu IA souhaitent concurrencer les écrivains humain, c’est leur droit le plus strict *du moment qu’ils ne mentent pas sur la nature de leur travail et qu’ils laissent donc les lecteurs choisir en connaissance de cause*. S’il se trouve que dans ces conditions, l’attention des lecteurs se porte toute de même massivement vers l’artificiel plutôt que l’authentique, les écrivains humains auront perdu à la loyale. Mais les réactions à l’affaire Orélien montrent que les lecteurs semblent avoir une forte préférence pour l’authentique. Le projet est donc né de ces préoccupations. Ni les idées politiques d’Orélien ni le thème de son livre ne nous importaient (ceux qui me lisent savent que mon combat contre le slop n’a rien de politiquement partisan). Il se trouve que des lecteurs attentifs nous ont parlé d’importants soupçons sur ce livre en particulier. Nous avons testé beaucoup d’autres livres ; aucun n’atteignait de tels scores d’IA. 4) Je pense (cela n’engage que moi, pas les autres membres du collectif) qu’un mauvais procès est fait aux jurys des prix littéraires et aux critiques ayant encensé ce livre. Le style du texte pouvait être pénible pour quiconque a l’habitude de discuter avec des LLM, mais pour les autres, l’admiration est compréhensible : si chaque mot de ce livre avait été choisi par un humain, il aurait sans doute fallu saluer une forme de génie dans le rythme de cette écriture, soutenue ainsi sur 250 pages. L’angle le plus profond dans cette polémique n’est pas la naiveté des jurys (nous serons tous, à un moment ou un autre, dépassés par les progrès de ces modèles), mais justement, cette vitesse de progression, illustrée ici par la capacité des IA non seulement à passer le test de Turing mais à remporter nos prix littéraires les plus prestigieux. Cela donne le vertige et soulève des questions existentielles sur la place de l’homme dans ce nouveau monde. 5) Merci à tous les médias, parmi lesquels Libération, France Info, France Inter, Le Huffington Post ou Les Échos, qui ont fait un travail d’enquête honnête et rigoureux pour établir la fiabilité de Pangram.
457
990
4,382
528,497
Et vive la France 🇫🇷🗿
leaving work early after a day of underperforming to go drinking
33
Je suis en train de concocter une oeuvre de propagande avec plusieurs Opus 5.5 High en parallèle ça va être fou
1
15
Les croquis pour les briefs aux sous-agents c'est quelque chose
20
Ces histoires d'alignement ce n'est pas encore ça 💣
27
Ça devient long pour fournir le fichier Word de travail aux journalistes (avec l'historique de modifs) :)
21
Entre les mathématiques et la biologie il y a la physique et la chimie. Tout ces domaines sont condamnés à travailler sous la supervision de l’IA
55
basedpolymer retweeted
Bollore a non seulement force Orelien a ecrire son bouquin avec Claude, mais aussi a plagier 100% de ses articles, nouvelles et poemes ecrits entre 2013 et 2022 - quel sens de l'anticipation!
À propos de la polémique IA entourant le livre de Thélyson Orélien, je me demande si l’un des objectifs n’est pas de jeter le discrédit sur Olivier Nora qui avait choisi de publier le texte aux @EditionsGrasset juste avant d’en être violemment chassé par Vincent Bolloré [@VB_Officiel].
8
13
279
17,908
Pangram ne coûte que 20€/mois pour avoir le détail de la détection. Et personne ne l’a encore fait. Ça peut être utile vu le scandale actuelle
100
basedpolymer retweeted
Puis il se fout pas de notre gueule c'est bien...
Thélyson Orélien réagit dans un communiqué aux allégations d’utilisation supposée de l’IA dans son premier roman « C’était ça ou mourir » #ThélysonOrélien #Grasset
11
3
83
62,118
basedpolymer retweeted
Travail très propre de @s_jourdain, qui interroge une chercheuse ayant vraiment, elle, travaillé sur la fiabilité de Pangram : "nous n'avons pas eu un seul faux positif dans notre étude". Et il mentionne que Pangram ne se trompe pas sur "les autres auteurs caribéens".
C'est de la folie. @TV5MONDE prétend démontrer en plateau la non fiabilité de Pangram... en montrant des tests avec le premier outil merdique trouvé sur Google ! Ce n'est tout simplement pas Pangram qui a été utilisé, c'est presque effrayant ce niveau d'incompétence 😨
11
76
383
67,830
basedpolymer retweeted
OMG the February 2013 article (NOT AI-generated) by Thelyson Orelien (which was absolutely terrible) was apparently 100% translated and plagiarized word for word from a Filipino newspaper article from a week before. This is insane.
Après une recherche google, j'ai trouvé l'article original en anglais du 23 février 2013 sur un journal philippin: philstar.com/opinion/2013/02… Tout l'article a été plagié/traduit en français.
7
69
638
79,800
Lorsque tu te bas toute la journée contre les détracteurs de Pangram
269